Soul成果亮眼:实时人像视频生成研究成果被CVPR2025录用
2025/06/04 15:09AI云资讯12769
近日,AI领域再度传来重磅消息。新型社交平台Soul App的技术论文《Teller: Real-Time Streaming Audio-Driven Portrait Animation with Autoregressive Motion Generation》,成功被人工智能领域顶会CVPR 2025录用。这不仅是Soul在技术研发上的一次重大突破,更意味着其在AI社交领域的探索,正逐步引领行业走向新的阶段。

CVPR作为计算机视觉与模式识别领域的标杆会议,一直以高水准的录用标准著称。根据会议官方统计,本次CVPR 2025会议总投稿13008篇,录用2878篇,录用率仅为22.1%,竞争可谓异常激烈。Soul App此次入选,彰显其技术实力得到了学术界与行业的高度认可。
事实上,这并非Soul在AI领域的首次亮相。2024 年,Soul多模态情感识别研究论文入选ACM国际多媒体会议研讨会,且在国际人工智能联合会议组织的挑战赛中,Soul技术团队在半监督学习赛道拔得头筹。从2016年上线基于AI算法的灵犀引擎,到2023年推出自研语言大模型Soul X,再到如今多模态端到端大模型的升级,Soul始终坚定不移地深耕AI社交领域。
此次被录用的论文,提出了全新的实时音频驱动人像动画自回归框架。该框架创新性地将talking head任务拆分为面部Motion生成和高效身体Movement生成模块,不仅大幅提升了视频生成效率,更显著优化了生成效果的自然度和拟人性。这一成果,是Soul在语音、视觉、NLP融合方面的一次积极探索,为打造更真实的AI社交交互体验奠定了基础。
此前,Soul基于多模态大模型上线的语音交互功能,收获了用户的广泛好评。如今,从语音到视觉的交互模态升级,无疑将为用户带来更为沉浸式的社交体验。未来,Soul计划将这一技术成果应用于实时视频通话、AI虚拟人情感化陪伴等多元场景,进一步提升人机交互的情感温度。
Soul在AI社交领域的持续创新,不仅为用户带来了更优质的体验,也为整个行业的发展指明了方向。在未来,Soul将凭借其在AI技术上的深厚积累,继续打造充满趣味与温暖的社交空间,推动AI社交迈向新的高度。
相关文章
- 视频生成大模型搞不定几何一致,如视让每一帧符合物理世界的逻辑
- 阿里云发布AI视频创作平台“万镜一刻”,打通短漫剧和营销视频生成全流程
- Soul App发布开源模型SoulX-LiveAct,解决数字人长视频生成难题
- 从开源引领到国产算力适配:兔展智能如何领跑全球开源视频生成领域?
- 新手体验热门AI视频生成双雄即梦与万兴天幕AI,天幕性价比友好度拉满!
- 昇腾算力赋能视频生成革命 浙江大学团队攻克长时一致性难题
- 百度商业视频生成模型MuseSteamer来了:音画一步到位,出厂自带bgm!
- CVPR2025:快手可灵四大技术方向布局视频生成及世界模型
- 智象未来两篇论文入选 CVPR 2025!视频生成与虚拟换装齐破局,开源赋能产业革新
- 字节豆包视频模型Seedance 1.0首次登顶全球视频生成竞技榜
- Soul成果亮眼:实时人像视频生成研究成果被CVPR2025录用
- SkyReels-V2开源:突破视频生成技术边界,开启无限时长电影生成新时代
- 《Global Talk》对话生数科技:国产视频生成模型Vidu 2.0引领视频生成进入“秒级时代“
- 昆仑万维开源中国首个面向AI短剧创作的视频生成模型SkyReels-V1,重塑AI短剧行业格局
- 基于豆包·视频生成模型打造创新体验,即梦成为“想象力的相机”
- 抢先OpenAI Sora谷歌新推Veo模型,亚马逊/微美全息加入AI视频生成竞赛引关注
AI企业
更多>>AI硬件
更多>>AI产业
更多>>AI技术
更多>>- 全球最强开源模型 Kimi K3 发布,参数规模 3 万亿,真的是强!
- 范式变革!东软发布AI原生软件工程白皮书,重构软件产业底层逻辑
- KAT-Coder-Pro V2.5正式发布:从“写代码”迈向“做工程”,Agentic能力全面升级
- 自变量机器人王昊:训练世界模型需付出“时间税”,解决模态对齐是当务之急
- 腾讯发布CodeBuddy Security,用AI Agent实现更高效的代码审计
- Twinkle x昇腾,率先实现Deepseek-V4系列模型高效训练
- 高德发布鸿蒙首个生成式 UI 开源框架 AGenUI,告别传统 UI 开发模式
- 发布即适配| 天数智芯全力支持腾讯混元Hy3 preview 开源落地,共推国内大模型产业普惠









