从实验室到产业一线:王拓为谈端侧AI
2026/10/08 10:16AI云资讯13643
2025年1月,北京万象智维科技有限公司(以下简称“万象智维”)正式创立,围绕端侧AI软硬件基础设施推进产品化与产业落地。团队以端侧模型推理引擎OmniInfer为核心,逐步形成覆盖模型部署、任务执行、端云协同的基础设施能力,并进一步延伸至硬件与整机形态。
对于万象智维联合创始人兼CEO王拓为而言,创业并不是离开科研,而是尝试让实验室里的技术进入真实应用场景。他关注的问题始终比较明确:如何让端侧AI的推理、执行与数据处理能力,在资源有限的终端设备上持续稳定运行。
带着问题走出实验室
从清华大学泛在智能实验室到万象智维位于北京AI原点社区的办公室,距离只有几公里。但对王拓为而言,他跨越的是从“技术成立”到“技术落地”的距离。
读博期间,他长期开展大模型系统与端侧高效推理研究,重点围绕模型动态稀疏性与端侧两级存储架构,探索通过模型布局、缓存管理、推测执行和异构计算等系统优化,使更大规模的模型能够在资源受限的终端上高效运行。
博士二年级时,他就产出了博士阶段大部分核心科研成果。在科研过程中,一个现实问题逐渐浮现:为什么一些在学术上成立的技术,仍难以在真实场景中落地应用?
王拓为逐渐意识到,AI的价值不仅取决于模型本身,也取决于技术能否产品化、进入真实场景,在复杂环境中持续运行。一次与导师、清华大学泛在智能实验室主任任炬的深入交流,让王拓为创业的想法逐渐明确。“我们发现彼此都有创业的想法,就一拍即合了。”王拓为说,“而且,如果一件事情我已经看到了方向,却没有尽力去做,我会后悔。”
2025年1月,万象智维创立。任炬作为联合创始人,为公司的技术方向与长期发展提供支持。依托泛在智能实验室在端智能、边缘智能、端云协同以及端侧大模型系统等方向的长期科研积累,团队逐步将研究成果转化为端侧AI基础设施能力,并进一步向推理引擎、智能系统、算力硬件等产品方向延伸。

万象智维联合创始人兼CEO王拓为
万象智维以端侧AI软硬件基础设施为核心,围绕终端设备智能升级、系统级端侧解决方案及算力模组等场景,推进企业级项目合作与标准化产品协同发展,提升端侧智能的部署、交付与规模化复制效率。
让大模型适应端侧设备
在王拓为看来,端侧AI并不是简单地把云端模型“搬到设备上”。手机、PC、可穿戴设备等终端通常采用高度集成的系统级芯片,CPU、GPU、NPU、内存与存储需要共享有限的功耗和系统资源。端侧推理因此不只是“把算子跑快”,而需要同时考虑计算单元调度、内存占用、功耗以及不同芯片之间的适配。
与此同时,端侧AI所面对的模型形态也更加多样。云端服务多围绕一个或少数通用大语言模型构建;端侧则需要在小模型、量化模型、专用模型和多模态模型之间,结合设备算力、功耗与具体任务进行动态选择和调度。模型也不再只是通过远程接口提供能力,而需要与摄像头、麦克风、文件、传感器及系统权限协同工作。由此,云端常用的模型推理服务、智能体执行框架和运行机制难以直接迁移至终端,需要围绕端侧设备特征重新设计。
针对这些需求,万象智维自研端侧模型推理引擎OmniInfer,以系统级协同为重点,结合动态稀疏性、CPU-GPU-NPU异构调度、两级存储与数据布局优化,降低大模型在端侧系统级芯片上的资源开销。
围绕OmniInfer,万象智维进一步搭建端侧模型部署工具链。OmniStudio提供模型转换、量化压缩、算子适配与设备部署的一体化能力,覆盖Android、iOS、macOS、Windows、Linux等主流平台,帮助降低跨芯片、跨系统适配的工程成本。在此基础上,万象智维还进一步布局OmniQuant、OmniRouter、OmniClaw等能力,将技术边界从单一模型推理延伸至模型压缩、端云调度和端侧智能体执行。

端侧模型推理引擎OmniInfer
从科研积累到产业实践
万象智维团队目前约30人,由核心全职团队与科研协同力量共同构成,并持续保持与清华大学泛在实验室科研团队的紧密技术联动。团队长期围绕端侧AI、大模型系统、异构计算与智能体等方向开展研究,同时推进产品工程化。
此前,万象智维曾开源底层技术框架。项目上线后大量开发者持续提交技术优化建议。对团队而言,这些来自实际使用者的反馈,也成为技术迭代和产品完善的一部分。
这种“科研创新+产业实践”的协同,是万象智维推进端侧AI基础设施产品化的重要基础。未来,公司将继续以基础设施能力服务硬件与终端生态,并在此基础上稳步拓展面向个人级、家庭级的端侧应用场景。
“如果未来AI要真正理解一个人、服务一个人,那么一定会有越来越多的智能,运行在离人更近的地方。”王拓为在采访中留下了这样一句话。端侧AI的价值,不只在于将模型部署到设备上,更在于在用户授权与安全边界内,提升模型对真实场景的响应和服务能力。
相关文章
- 端侧AI普及提速!移远通信M.2智能算力板卡QSC600XA-AP,让AI算力“即插即用“
- 星火X2.5-4B和1.7B开源,端侧AI正在改写“好模型”标准
- 《行业鸿蒙终端发展蓝皮书2026》发布:迈向规模复制,端侧AI打开增长空间
- 解锁端侧AI新上限!小米玄戒O3携手长鑫开启LPDDR6时代
- 忆联AM6B0:为端侧AI提速,UMA时代的大模型存储“标配”!
- 瑞芯微亮相WAIC2026:端侧AI领跑者,成熟方案全面落地
- MWC26上海:芯翼信息科技深化端侧AI算力与NTN全域连接布局
- 端侧AI快车道上,思必驰十九年的“慢生意”
- 高通×极视角端侧AI开发者技术日暨骁龙大赛颁奖典礼圆满落幕
- 桑达银络携端侧AI硬科技亮相新加坡NRF APAC 2026
- 端侧AI构筑“新丝路”:面壁智能大模型开源与端侧推理框架的出海实践
- Google I/O 2026亮点回顾:晶晨股份携手谷歌共拓端侧AI新生态
- 铠大师携手摩尔线程 共筑AIPC生态 激活端侧AI新动能
- 炬芯端侧AI 音频芯片又一落地新场景,刷新无线游戏耳机体验
- 端侧AI普惠落地 生态协同升级 传音控股AI技术布局成效凸显
- 亿道正式启动 Agent One 项目:打造端侧AI中枢,开启智能代理新时代
AI企业
更多>>AI硬件
更多>>AI产业
更多>>AI技术
更多>>- 阶跃这次够狠:AA 全球开源前二,价格打到 Claude 的 1/8
- 科大讯飞发布Spark-Audio-1.0-Preview,全国产语音基座大模型实现从“听清”到“听懂”
- 全球最强开源模型 Kimi K3 发布,参数规模 3 万亿,真的是强!
- 范式变革!东软发布AI原生软件工程白皮书,重构软件产业底层逻辑
- KAT-Coder-Pro V2.5正式发布:从“写代码”迈向“做工程”,Agentic能力全面升级
- 自变量机器人王昊:训练世界模型需付出“时间税”,解决模态对齐是当务之急
- 腾讯发布CodeBuddy Security,用AI Agent实现更高效的代码审计
- Twinkle x昇腾,率先实现Deepseek-V4系列模型高效训练









