基石智算CoresHub模型推理服务再升级!第三方平台下载模型可一键部署、推理
2025/06/11 17:17AI云资讯11661
基石智算CoresHub 全面升级了模型推理服务!用户可在魔搭、huggingface 等下载模型到基石智算,通过模型推理服务进行一键部署推理服务,并对外提供 API 能力,也可经过基石智算的模型调优进行二次训练后再部署。
推理过程中可以根据业务的并发量,进行推理服务的弹性扩缩容,提高业务运行效率的同时,节省算力成本。
以下是通过模型推理服务一键部署模型的详细步骤,以魔搭下载的模型为例:
一、从魔搭下载模型到文件存储
1.创建存储目录。

2.创建一个用于传数据的无卡启动实例,挂载文件存储。

3.在 Web 连接窗口中输入如下命令:

4.查看魔搭中的“模型文件—模型下载—下载”命令,使用 Git 下载

在 Web 连接中继续执行以下步骤:

如果模型中有大文件,并且大文件下载失败,可以执行以下代码:

二、模型部署
1.到“模型管理”添加模型。

选择已下载的模型。

输入模型名称等信息,选择部署方式。


2.部署模型

选择部署方式,支持单节点和多节点部署。

选择资源类型。

部署成功后,点击服务 ID 即可查看服务信息、服务监控、服务日志。


3.支持扩容
当推理服务需要满足更高并发时,可以通过增加推理实例的数量,以满足业务的高并发需求。
假设 1 张 4090 可以满足 DeepSeek-R1-1.5B 最高 100 的并发数量,当业务并发超出 100,可以增加到 2 个 4090 的 1 卡实例进行模型部署。

三、模型调用
1.使用第三方客户端 Cherry Studio 调用为例,开启第三方工具,点击界面左下角的设置图标,选择模型服务 > 添加。

2.在弹出添加提供商窗口中,配置各项参数,点击确定。

3.新添加的提供商已显示在列,配置相应的 API 密钥和 API 路径,并点击管理,对应的密钥和 API 地址在服务信息中。


4.配置模型名称。

5.在 CherryStudio 平台,点击左侧导航栏中的聊天助手,在对话框的顶部,切换已添加至平台上的模型,即可对话。

相关文章
- 以CPU为核心,英特尔为智能体AI打造全新智算中心
- 中兴通讯以算电协同构筑AIDC智算底座,破解算力高能耗难题
- 中兴通讯王卫斌:全栈协同,打造最佳 TCO 智算基础设施
- 联想凌拓陈弘:存储闪跃AI就绪——从数据容器到智算引擎
- SRv6赋能AI计算——释放算力效能,优化智算成本
- 绿绘低碳底色 智建算力未来——同方全链技术赋能智算中心低碳升级
- 中国移动发布智算中心液冷全链条创新成果
- 光启智算·连接未来!第24届讯石光通信大会(IFOC 2026)成功举办 超3000人逾900家企业出席
- 聚力智算光互联|星特科技携双 Lens 自动耦合机亮相 IFOC 2026
- 湖北移动实现高校智算单板全覆盖 校园迈入“智能追焦”网络时代
- 魏桥国科智算中心:以国产算力,为发展未来产业提供创新支撑
- 中科通量推出OmniMate BOX,以“边缘智算主机+存量屏幕“模式降低AI数字员工落地门槛
- 亚洲新型电力展|算电协同进入工程实践阶段,维谛技术分享智算基础设施建设实践
- 强力落地环京智算核心战略 中国移动天津公司加速在津算力AI产业布局
- 智算资产运营新范式:东软Neusoft SDA发布,业内唯一全栈闭环
- 首家!九章云极通过中国信通院智算云平台能力评测
AI企业
更多>>AI硬件
更多>>AI产业
更多>>AI技术
更多>>- 阶跃这次够狠:AA 全球开源前二,价格打到 Claude 的 1/8
- 科大讯飞发布Spark-Audio-1.0-Preview,全国产语音基座大模型实现从“听清”到“听懂”
- 全球最强开源模型 Kimi K3 发布,参数规模 3 万亿,真的是强!
- 范式变革!东软发布AI原生软件工程白皮书,重构软件产业底层逻辑
- KAT-Coder-Pro V2.5正式发布:从“写代码”迈向“做工程”,Agentic能力全面升级
- 自变量机器人王昊:训练世界模型需付出“时间税”,解决模态对齐是当务之急
- 腾讯发布CodeBuddy Security,用AI Agent实现更高效的代码审计
- Twinkle x昇腾,率先实现Deepseek-V4系列模型高效训练









