天数智芯完成阶跃星辰开源多模态大模型适配,共筑AI开源新生态
2025-02-19 13:12:03AI云资讯9464
2025 年 2 月 18 日,头部大模型创业公司阶跃星辰宣布开源两款 Step 系列多模态模型 ——Step-Video-T2V 视频生成模型和 Step-Audio 语音交互模型,引发行业高度关注。目前,两款模型都可以在跃问 App 内体验。天数智芯作为通用 GPU提供商,已第一时间携手合作伙伴,完成对阶跃两款开源模型的适配。
阶跃Step-Video-T2V 模型的参数量达到 300 亿,可以直接生成 204 帧、540P 分辨率的高质量视频,这意味着能确保生成的视频内容具有极高的信息密度和强大的一致性。在阶跃发布并开源了针对文生视频质量评测的新基准数据集 Step-Video-T2V-Eval上的测评结果显示,Step-Video-T2V 的模型性能在指令遵循、运动平滑性、物理合理性、美感度等方面的表现均显著超过市面上既有的效果最佳的开源视频模型。
Step-Audio 是行业内首个产品级的开源语音交互模型,能够根据不同的场景需求生成情绪、方言、语种、歌声和个性化风格的表达,能和用户自然地进行高质量对话。模型生成的语音具有自然流畅、情商高等特征,同时也能支持不同角色的音色克隆,满足影视娱乐、社交、游戏等行业场景下的应用需求。
在 LlaMA Question、Web Questions 等 5 大主流公开测试集中,Step-Audio 模型性能均超过了行业内同类型开源模型,位列第一。Step-Audio 在 HSK-6(汉语水平考试六级)评测中的表现尤为突出,是最懂中国话的开源语音交互大模型。比如下面这段对话中,模型能够深入理解中文的博大精深,而不会被「绕晕」。
此次,为支持阶跃星辰开源多模态大模型,天数智芯迅速调配资源展开模型适配工作。通过优化 GPU 架构和算法,天数智芯确保了模型在运行过程中的稳定性和高效性,让 Step-Video-T2V 和 Step-Audio 的性能得以充分发挥,为用户带来流畅的体验。
天数智芯与阶跃星辰的携手合作,不仅为双方在 AI 领域的发展注入了新动力,也为 AI 产业开源技术生态的繁荣添砖加瓦,有望推动 AI 技术在更多行业落地生根,创造更大的社会价值。
相关文章
- 产业AI大模型万联摩尔上线,从“通用”到“专用”的必然路径
- 云从科技入选大模型一体机产业图谱 以全栈能力推动AI落地新范式
- 百度王海峰:通用大模型与场景大模型相辅相成 并非割裂
- “工具”到“伙伴”:科大讯飞展示大模型如何助力教育减负增效
- 升级版“蓝心小V”亮相,豆包大模型助力vivo打造AI原生体验
- 讯飞星火燎原86届教装展,全栈自主可控国产教育大模型助推教育数字化转型
- 京东11.11直播技术全面升级,立影3D技术、JoyAI大模型重构沉浸式购物体验
- 云知声AGI落地智慧生活:推出“智能拍学机”等多款“智能硬件+大模型”解决方案
- 128 卡 4 天时间!百度百舸助力 LLaVA-OneVision-1.5 刷新多模态大模型训练效率纪录
- AI防护,与时俱进:信通院X电子科大X腾讯云共话大模型安全
- 金蝶征信“金融风控大模型” 摘得AFAC2025大奖
- IDC权威报告:中能拾贝强势登榜IDC中国工业大模型应用市场第一梯队
- 科大讯飞同传大模型再升级,上海、迪拜同发讯飞AI翻译耳机
- 以科技创新推动产业创新专题|国际认可!FRC开创专家经验更有效传递给大模型的新范式
- 创新奇智AInnoGC工业大模型,中国市场份额第一
- 容联云以AI+金融实践,入选「大模型厂商全景报告」核心阵列









