国产算力新里程碑!曦云C系列GPU率先完成中国电信星辰Xing4.0大模型Day 0适配
  • 红茶
  • 2026年09月19日 20:36
  • 0

快科技9月19日消息,中电信人工智能科技有限公司日前正式发布新一代星辰大模型Xing4.0-29B-A4B。沐曦股份宣布,依托自研MXMACA软件栈,曦云C系列GPU率先完成对该模型的Day 0适配,实现“上线即适配”。

Xing4.0-29B-A4B是面向智能体时代打造的轻量级代码智能体大模型,采用MOE架构,总参数量29B,激活参数仅4B,原生支持256K上下文,可扩展至512K。

该模型是国内首个基于国产算力与国产框架完成训练、面向复杂工程任务深度优化的百亿参数大模型,聚焦任务规划、工具调用和自主执行等能力。

国产算力新里程碑!曦云C系列GPU率先完成中国电信星辰Xing4.0大模型Day 0适配

性能方面,Xing4.0-29B-A4B在SWE-bench Verified上得分75.0,Terminal-Bench 2.1得分57.5,均超过同尺寸竞品。

国产算力新里程碑!曦云C系列GPU率先完成中国电信星辰Xing4.0大模型Day 0适配

在SuperCLUE智能体能力评测中,该模型以93.52分位列第三,与两款头部Qwen模型差距不足1分。4-bit量化后显存占用降至15GB,RTX 3090、RTX 4090等消费级显卡即可本地运行。

沐曦此次Day 0适配的核心支撑来自MXMACA软件栈。该软件栈全链路覆盖底层驱动、MXCC编译器、算子深度适配及主流训练/推理框架对接,可将传统模型适配周期从数周压缩至小时级。

目前MXMACA已兼容40余种AI框架,适配超1000款模型,全量支持PyTorch 2.8的2410个GPU算子。

自2025年12月以来,沐曦已完成38个主流顶尖模型的Day 0适配,范围涵盖智谱AI、阿里千问、MiniMax、DeepSeek、阶跃星辰、腾讯混元等头部厂商,适配速度、数量与生态广度均位居行业前列。

国产算力新里程碑!曦云C系列GPU率先完成中国电信星辰Xing4.0大模型Day 0适配

文章纠错

  • 好文点赞
  • 水文反对

此文章为快科技原创文章,快科技网站保留文章图片及文字内容版权,如需转载此文章请注明出处:快科技

观点发布 网站评论、账号管理说明
热门评论
查看全部评论
相关报道

最热文章排行查看排行详情

邮件订阅

评论0 | 点赞0| 分享0 | 收藏0