中国电信星辰语义大模型正式开源,携手昇腾共建开源大模型生态
2024-01-12 18:55:36AI云资讯24342
1月10日,中国电信星辰语义大模型TeleChat-7B版本宣布开源,并开放1T高质量清洗数据集。星辰语义大模型已与昇腾AI基础软硬件完成适配,并开源了适配后的代码。此外,中国电信还将在1月20日开源12B版本模型,拥抱更多开发者共建开源大模型生态。
星辰语义大模型是由中电信人工智能科技有限公司研发训练的大语言模型,采用1.5万亿 Tokens中英文高质量语料进行训练。星辰语义大模型在业界首次提出缓解多轮幻觉的解决方案,通过关键信息注意力增强、知识图谱强化、多轮知识强化、知识溯源能力四大技术,将AI大模型的幻觉率降低了40%,这有助于大模型变得更有“人味”,真正理解问题语境,告别风马牛不相及的答案。
目前,星辰语义大模型正在与千行百业的信息化解决方案进行融合,满足多样场景需求。在中国电信内部,星辰语义大模型赋能行文写作、代码编程、网络故障分析以及经营分析等场景,以行文写作为例,其平均生成字数超过1500字,有效采纳率达到85.7%;在对外企事业单位客户的业务中,星辰语义大模型赋能企业经营分析、政务公开咨询、民生诉求接待等场景,其业务覆盖率达到95%,多轮理解准确率达到90%。
早在2023年11月,中国电信就在2023数字科技生态大会上发布了千亿参数“星辰语义大模型”,并公布了后续的开源开放的时间表。本次TeleChat-7B版本开源了对话模型TeleChat-7B-bot,以及其huggingface格式的权重文件。此外,还开源了7B模型的int8和int4量化版本。
可访问开源仓了解详情:
Gitee地址:https://gitee.com/Tele-AI/tele-chat
Github地址:https://github.com/Tele-AI/Telechat
在模型开发上,星辰语义大模型已与昇腾AI基础软硬件完成适配:支持Atlas 300I pro推理卡,具备int8量化能力,精度与性能表现均与业界第一梯队持平;支持Atlas训练服务器,用户可使用昇思MindSpore和PyTorch框架进行模型训练和推理,两个框架下模型精度与性能均有不俗表现。
除了星辰语义大模型,目前已有50+业界主流大模型基于昇腾训练迭代,9家伙伴携手昇腾发布了大模型训推一体机,昇腾以开放易用的平台使能千模百态,为大模型创新注入动能。
本次星辰语义大模型TeleChat-7B版本开源,夯实了中国电信构建开放生态的重要一环,降低了大模型开发门槛,未来,中国电信将进一步携手昇腾AI等合作伙伴推动中国大模型在千行百业落地,加速人工智能产业发展。
相关文章
- 云栖大会|斑马智行将发布全球首个全模态端侧大模型实车方案
- 鸿蒙版高德地图重磅更新,VLM交通视觉语言大模型、天气提醒护航十一出行
- 蘑菇车联凭MogoMind大模型获评新科技百强 ,以AI重构未来城市运行逻辑
- 陈天桥创立的AI公司MiroMind成为全球顶尖预测型大模型,性能领先行业基准
- 华东师大与华为联合发布《大模型背景下高等教育数智化转型研究报告》
- 2025世界制造业大会|科大讯飞用十项“黑科技”破解制造强国密码,发布羚羊工业大模型3.0
- 2025H1大模型公有云中国第一!火山引擎市场份额近半
- 科大讯飞联合华为发布“星火教育、医疗大模型场景一体机解决方案”
- 打造端到端智算服务,移动云全面推动大模型普惠化落地
- 破解 AI “安全与性能” 难题!DeepSeek-R1-Safe 基础大模型在华为全联接大会2025正式发布
- 今天AI唱主角!科大讯飞发布星火东盟多语言大模型底座及系列AI产品
- 92%学生实现高效突破!她将高中物理考点浓缩为4大模型,逆袭突破成常态
- 网安周开幕|绿盟大模型能力再获权威肯定,持续推动AI与网络安全深度融合
- 网络安全领域唯一入选!联通数科网络安全大模型入选北京首台(套)重大技术装备目录
- 亚信科技通过中国信通院首批“大模型应用交付总体能力”评估
- 科大讯飞亮相2025服贸会多个展馆,讯飞星火大模型引领AI+产业融合实践