曦云GPU率先完成星辰Xing4.0大模型Day0适配

IT时代网9月19日消息,中电信人工智能科技有限公司发布新一代星辰大模型Xing4.0-29B-A4B,沐曦股份宣布,依托自研MXMACA软件栈,曦云C系列GPU率先完成对该模型的Day 0适配,实现“上线即适配”。此前,本站曾报道过沐曦GPU完成腾讯混元大模型Day 0适配。

Xing4.0-29B-A4B面向智能体时代打造,是一款轻量级代码智能体大模型。它采用MOE架构,总参数量29B,激活参数仅4B,原生支持256K上下文,并可扩展至512K。

按官方说法,这是国内首个基于国产算力与国产框架完成训练、面向复杂工程任务深度优化的百亿参数大模型,聚焦任务规划、工具调用和自主执行等能力。

性能方面,Xing4.0-29B-A4B在SWE-bench Verified上得分75.0,Terminal-Bench 2.1得分57.5,均超过同尺寸竞品;在SuperCLUE智能体能力评测中以93.52分位列第三,与两款头部Qwen模型差距不足1分。4-bit量化后显存占用降至15GB,RTX 3090、RTX 4090等消费级显卡即可本地运行。

沐曦此次Day 0适配的支撑来自MXMACA软件栈。该软件栈全链路覆盖底层驱动、MXCC编译器、算子深度适配及主流训练与推理框架对接,可将传统模型适配周期从数周压缩至小时级。

据了解,MXMACA已兼容40余种AI框架,适配超1000款模型,全量支持PyTorch 2.8的2410个GPU算子。自2025年12月以来,沐曦已完成38个主流模型的Day 0适配,范围涵盖智谱AI、阿里千问、MiniMax、DeepSeek、阶跃星辰、腾讯混元等厂商。

注:本文中包含AI辅助创作的内容。

编辑:林一舟

THE END