天数智芯完成阶跃星辰开源多模态大模型适配,共筑AI开源新生态
2025-02-19 13:12:03爱云资讯9218
2025 年 2 月 18 日,头部大模型创业公司阶跃星辰宣布开源两款 Step 系列多模态模型 ——Step-Video-T2V 视频生成模型和 Step-Audio 语音交互模型,引发行业高度关注。目前,两款模型都可以在跃问 App 内体验。天数智芯作为通用 GPU提供商,已第一时间携手合作伙伴,完成对阶跃两款开源模型的适配。
阶跃Step-Video-T2V 模型的参数量达到 300 亿,可以直接生成 204 帧、540P 分辨率的高质量视频,这意味着能确保生成的视频内容具有极高的信息密度和强大的一致性。在阶跃发布并开源了针对文生视频质量评测的新基准数据集 Step-Video-T2V-Eval上的测评结果显示,Step-Video-T2V 的模型性能在指令遵循、运动平滑性、物理合理性、美感度等方面的表现均显著超过市面上既有的效果最佳的开源视频模型。
Step-Audio 是行业内首个产品级的开源语音交互模型,能够根据不同的场景需求生成情绪、方言、语种、歌声和个性化风格的表达,能和用户自然地进行高质量对话。模型生成的语音具有自然流畅、情商高等特征,同时也能支持不同角色的音色克隆,满足影视娱乐、社交、游戏等行业场景下的应用需求。
在 LlaMA Question、Web Questions 等 5 大主流公开测试集中,Step-Audio 模型性能均超过了行业内同类型开源模型,位列第一。Step-Audio 在 HSK-6(汉语水平考试六级)评测中的表现尤为突出,是最懂中国话的开源语音交互大模型。比如下面这段对话中,模型能够深入理解中文的博大精深,而不会被「绕晕」。
此次,为支持阶跃星辰开源多模态大模型,天数智芯迅速调配资源展开模型适配工作。通过优化 GPU 架构和算法,天数智芯确保了模型在运行过程中的稳定性和高效性,让 Step-Video-T2V 和 Step-Audio 的性能得以充分发挥,为用户带来流畅的体验。
天数智芯与阶跃星辰的携手合作,不仅为双方在 AI 领域的发展注入了新动力,也为 AI 产业开源技术生态的繁荣添砖加瓦,有望推动 AI 技术在更多行业落地生根,创造更大的社会价值。
相关文章
- 顶尖大模型厂商齐聚2025 TUYA全球开发者大会,共探AI如何重塑行业生态
- 海信重磅发布“云信·通途交通大模型”: 以AI之力,解锁智能交通无限可能
- 大模型用于招采评审,这样解决“AI幻觉”问题!
- AUDI携手Momenta联合打造行业首个 “德系电动豪华标准+飞轮大模型” 智能辅助驾驶方案
- 华为开发者大会 2025 发布邀请函,盘古大模型、昇腾AI云服务新进展即将公布
- 凯迪拉克VISTIQ亚洲首秀,搭载Momenta飞轮大模型定义豪华纯电智能出行
- 大模型赋能智慧交通,宇视携30+创新产品方案亮相武汉交博会
- 2025上海车展 | 讯飞星火大模型“朋友圈”持续扩大,智能座舱、智慧声场引领汽车交互新体验
- 腾讯智慧出行技术开放日:升级全栈AI能力,助力汽车产业大模型应用
- 罗盘大模型应用开发平台Compass Copilot助力企业快速搭建大模型应用
- 全国首个“AI大模型+智能体”智能查号系统,亚信科技携手天津联通打造
- 腾讯云李力:构建稳定安全的基础设施,助力大模型应用落地
- 中国电子商会大模型应用产业专业委员会正式成立 构建大模型落地“最后一公里“枢纽
- UU跑腿全面接入MCP大模型上下文协议 开启智能服务生态新纪元
- 腾讯云大模型知识引擎已率先接入MCP!拓展AI应用边界
- 腾讯云王麒:大模型+知识库,是企业落地AI的最佳路径