提升高质量数据供给能力,推动通用人工智能大模型领域创新
2023-08-06 15:21:24AI云资讯1441
近年来,大规模预训练模型(以下简称“大模型”)作为人工智能取得突破性进展的重要驱动力之一,显著加速人工智能工程化和普惠化发展进程,有望成为新一代智能技术底座。人工智能大模型的突破源于高质量数据的不断发展,提升高质量数据要素供给能力是推动通用人工智能大模型领域创新的关键。
2020年的一项重要研究工作发现,模型效果与模型的参数、数据和计算量之间存在幂律发展规律“ScalingLaws”。模型参数、数据和计算量呈指数级增长,模型在测试集上的损失呈指数级下降,模型性能越好。
也就是说,在计算量给定、参数规模较小的情况下,增加模型参数量对模型性能的影响远高于数据和训练次数的贡献模型的步骤。
因此,业界对大型模型的性能形成了普遍的认识,即模型的参数和容量越多,模型的性能越好。
从AI产业链的发展情况和未来发展趋势来看,中国AI数据服务行业的市场规模正在逐步扩大。随着行业内对训练数据需求类型的增加以及对服务标准要求的提高,产业链的专业化分工愈加清晰。

在青年先锋论坛活动上,云测数据总经理贾宇航指出,作为人工智能的“燃料”,AI数据的质量影响着大模型的最终的结果的好坏。数据的数量越多、质量越高,模型的训练和性能优化就越充分、性能就越好,高质量的AI数据将助力人工智能应用具备更强大的服务能力。
谈及面向大模型高质量数据需求,云测数据在相关层面有哪些优势布局时,贾宇航表示云测数据一直将数据质量作为AI数据服务的发展核心,不仅聚焦于技术研发优化,更是延伸至人才培养、产品服务等环节,为企业提供高质量的场景化的AI数据服务。业务层面通过数据采集、数据清洗、数据标注等方式为企业引入AI数据处理,以标准API接口支持数据导入和导出、支持已有算法预标注功能,可以提供多项AI数据产品应用和AI数据服务,跟任何的企业的数据库打通,完成原始数据到标注数据的快速积累,加速AI模型的开发进程。
相关文章
- 26年大模型应用开发从现在开始学!稳了!
- 风行在线携手阿里云通义大模型,AI漫剧创作平台“橙星梦工厂”,引领数字内容生产新范式!
- 我国首部大模型国家标准实施,天翼云推动智算服务标准化
- 下一代大模型技术竞争一触即发,苹果/微美全息强势布局端侧AI高潜力领域!
- 东风奕派 X 中关村科金 | 大模型外呼重塑汽车营销新链路,实现高效线索转化
- 找钢集团携手智谱AI、清华大学共建产业级大模型与智能体协同体系
- 行业安全新标杆 中石油数智研究院携手深信服构建昆仑大模型安全能力内核
- 教程 | OpenCode调用基石智算大模型,AI 编程效率翻倍
- 让大模型“长出”手脚:云从科技联手嘉陵江实验室 加速人工智能走向物理世界
- 20+大模型与70+智能体调度!李未可AI眼镜定义群体智能新范式
- 从“看家”到“懂家”:海雀大模型摄像头,重塑家庭主动智能新范式
- 昇腾赋能 TransMLA:无需重训突破架构壁垒,助力主流大模型高效适配 MLA
- 华为联合云南建投物流重磅发布智慧物流样板点,并启动“云链物流大模型”研发
- 连投六轮!明势天使项目「MiniMax」正式登陆港交所,成史上IPO规模最大AI大模型公司
- 欧琳全球首款“生活大模型”AI水槽 登陆美国拉斯维加斯CES展
- CES 2026 | 亿道数码以端侧大模型,重塑边缘AI算力规则









