天数智芯完成阶跃星辰开源多模态大模型适配,共筑AI开源新生态
2025-02-19 13:12:03AI云资讯9759
2025 年 2 月 18 日,头部大模型创业公司阶跃星辰宣布开源两款 Step 系列多模态模型 ——Step-Video-T2V 视频生成模型和 Step-Audio 语音交互模型,引发行业高度关注。目前,两款模型都可以在跃问 App 内体验。天数智芯作为通用 GPU提供商,已第一时间携手合作伙伴,完成对阶跃两款开源模型的适配。

阶跃Step-Video-T2V 模型的参数量达到 300 亿,可以直接生成 204 帧、540P 分辨率的高质量视频,这意味着能确保生成的视频内容具有极高的信息密度和强大的一致性。在阶跃发布并开源了针对文生视频质量评测的新基准数据集 Step-Video-T2V-Eval上的测评结果显示,Step-Video-T2V 的模型性能在指令遵循、运动平滑性、物理合理性、美感度等方面的表现均显著超过市面上既有的效果最佳的开源视频模型。
Step-Audio 是行业内首个产品级的开源语音交互模型,能够根据不同的场景需求生成情绪、方言、语种、歌声和个性化风格的表达,能和用户自然地进行高质量对话。模型生成的语音具有自然流畅、情商高等特征,同时也能支持不同角色的音色克隆,满足影视娱乐、社交、游戏等行业场景下的应用需求。

在 LlaMA Question、Web Questions 等 5 大主流公开测试集中,Step-Audio 模型性能均超过了行业内同类型开源模型,位列第一。Step-Audio 在 HSK-6(汉语水平考试六级)评测中的表现尤为突出,是最懂中国话的开源语音交互大模型。比如下面这段对话中,模型能够深入理解中文的博大精深,而不会被「绕晕」。
此次,为支持阶跃星辰开源多模态大模型,天数智芯迅速调配资源展开模型适配工作。通过优化 GPU 架构和算法,天数智芯确保了模型在运行过程中的稳定性和高效性,让 Step-Video-T2V 和 Step-Audio 的性能得以充分发挥,为用户带来流畅的体验。
天数智芯与阶跃星辰的携手合作,不仅为双方在 AI 领域的发展注入了新动力,也为 AI 产业开源技术生态的繁荣添砖加瓦,有望推动 AI 技术在更多行业落地生根,创造更大的社会价值。
相关文章
- 垂直大模型技术创新的“专业燃料”:为什么知识产权高质量数据集不可或缺?
- 交付结果而非工具:零犀科技如何用因果大模型打破AI商业化僵局,实现规模盈利
- 又一金融信创标杆!神州鲲泰入围中信银行CANN生态信创大模型服务器项目
- 物理AI领航者江行智能:“空间智能大模型”让AI真正看懂工业现场
- 海康威视徐习明:聚焦感知多模态大模型,为中国制造业发展服务
- Seedance 2.0面向企业公测,豆包大模型日均Token使用量突破120万亿
- 凤凰卫视×火山引擎:达成深度合作!豆包大模型助力媒体智能升级
- 冲击百亿美金估值:阶跃星辰如何定义大模型“下半场“
- 大模型智能体行业元年来临,腾讯/阿里/微美全息集体锁定AI+Agent高增长赛道!
- 因果大模型如何让垂直领域智能体“可解释”?零犀科技交付可靠结果的实践
- 微通人工智能科技到访百度智能云创新基地 共探大模型落地与企业AI转型新路径
- 打造办公新模式,科大讯飞三大核心“AI+办公”大模型在成都发布
- 腾讯云与闪铸战略合作 混元3D大模型助力3D打印产业场景落地
- 同济大学 × 海光信息:筑牢高校大模型安全运行底座
- 重磅!中国首个民航端侧大模型标准发布 浩鲸科技牵头
- 26年大模型应用开发从现在开始学!稳了!









