澳鹏入选亿欧大模型基础层图谱,以优质数据赋能AGI智能涌现
2024-05-29 10:18:33AI云资讯3033

澳鹏Appen凭借高质量的大模型数据能力入选大模型基础层图谱
随着"数据二十条"等一系列政策措施相继出台,数据要素市场的探索与发展已步入高速增长阶段。据亿欧预计,2025年数据要素市场规模可达1990亿元,年复合增长率可达25%。尤其是在人工智能快速迭代、大模型与数据相得益彰的发展态势中,数据要素的战略地位进一步凸显。
澳鹏(中国)自主研发的大模型智能开发平台集大模型数据准备、训练、推理、部署应用于一体,支持从数据集管理、数据标注、模型评估、模型调优、训练平台部署及标注工具部署等大模型定制开发的全流程需求,助力企业轻松拥抱大模型。

澳鹏(中国)自主研发的大模型智能开发平台
澳鹏大模型智能开发平台涵盖三大核心技术:自研的预标注模型、交互式分割模型及算法赋能的文档智能。首先,澳鹏通过海量图像、点云等数据,结合丰富的实际项目经验,预训练了车辆行驶、交通灯、停车位、人像识别等多场景预标注模型,可实现2D 3D联合拉框、视频连续帧mask追踪等全方位的预识别结果输出,大幅提高后续标注效率。

澳鹏自研预标注模型
为适应2D图像标注中多样化的物体类别分割与检测,澳鹏结合丰富的图像数据训练了交互式分割模型并内嵌于标注工具中。仅需通过点击的方式标记正确区域并纠正输出结果,即可完成物体识别;再结合连续帧信息引入,大幅提升2D图像标注效率。模型支持微调训练,可适应定制化的场景需求。

澳鹏交互式分割模型
为解决各类场景下的文档信息转化提取难题,澳鹏基于海量文档数据预训练了智能文档处理模型。支持输入图片或PDF格式文档,对带阴影图片、倾斜图片、手写表格、各类学科公式等多类信息进行识别,并转化成word文档输出,便于人工编辑校对。

澳鹏Appen算法赋能的文档智能
随着大模型技术的演进,其赋能千行百业的能力不断提升。在数据集方面,澳鹏LLM数据库覆盖教育、法律、医疗、金融、百科等众多热门垂直领域,提供超过290种语言和方言的文本、语音数据库,并创建了一系列大模型专用数据集,如:百科类人工泛化文本问答数据集,知识类百科文本语料对数据库,58亿图文对数据库等等。澳鹏提供JSON格式的多学科题目,并拥有20万余条各种不同类型的高质量指令集文本及法律医疗百科类文本,通过多重质检环节严格把关数据质量,助力通用大模型和各种细分垂类大模型的训练和落地。
澳鹏Appen全球高级副总裁、大中华区及北亚区总经理田小鹏博士表示:"数据是决定机器学习模型性能的三大要素之一。随着各类大模型的智能涌现,数据,尤其是高质量的行业数据,正在成为决定大模型高速发展的关键因素。澳鹏自研的算法模型和核心技术,以及一系列大模型数据集,充分给予AI应用优质的数据养料,为大规模的大模型场景落地提供支持。"
相关文章
- 东软添翼医疗大模型领跑 医疗AI进入“可信时代”
- 直接上智能体,还需要统一基座大模型吗?医院智能化走到十字路口
- 云知声 U2-ASR 2.5上线:首个中文方言语义转写大模型
- 全国首个内容审核大模型过审 云从科技破解Agent时代谣言难题
- 湖北移动AI实验室让中小企业零门槛用上大模型
- 数据的第三种形态:艺恩如何为大模型提供多模态的数据弹药?
- 荆华密算入选主流价值语料生态联盟首批成员,护航大模型时代,为AI系上“安全带”
- 稳居第一梯队!东软添翼医疗大模型用实力回应“医疗AI”
- 许欢:人工智能应急大模型开启应急管理新发展时代
- 唯一聚焦制造业!创新奇智入围IDC大模型私有化市场前五
- 可视、可管、可算、可追溯!浩鲸科技重磅推出鲸智大模型Token运营平台
- 数字峰会探新“智”| 数字中国AI竞速:大模型从“能力竞赛”转向“可信落地”
- 数字峰会探新“智”|为AI装上“质检员”,浪潮软件集团发布大模型“体检”方案
- AI大模型智能体独角兽再落子!探迹科技完成真爱美家收购交割,持股达 43%
- 北京亦庄设立大模型生态服务站 助力AI产业合规发展
- 从精准评估到智慧辅学:宝盛鑫以轻量级大模型引领AI司法教育新赛道
人工智能企业
更多>>人工智能硬件
更多>>人工智能产业
更多>>人工智能技术
更多>>- 高德发布鸿蒙首个生成式 UI 开源框架 AGenUI,告别传统 UI 开发模式
- 发布即适配| 天数智芯全力支持腾讯混元Hy3 preview 开源落地,共推国内大模型产业普惠
- Seedance 2.0面向企业公测,豆包大模型日均Token使用量突破120万亿
- 端到端OCR模型第一!百度千帆Qianfan-OCR正式发布
- 云知声Unisound U1-OCR大模型发布!首个工业级文档智能基础大模型,开启OCR 3.0时代
- 基石智算上线 MiniMax M2.5,超强编程与智能体工具调用能力
- 昇腾原生支持,科学多模态大模型Intern-S1-Pro正式发布并开源
- 百度千帆深度研究Agent登顶权威评测榜单DeepResearch Bench









