新闻详情

新闻详情

首页 / 资讯中心 / 详情

中国电信开源Xing4.0:一张24G显卡跑29B智能体,账怎么算

发布时间:2026/9/29 14:54:50来源:尧图网络
中国电信开源Xing4.0:一张24G显卡跑29B智能体,账怎么算
9月17日中电信人工智能科技有限公司发布并开源了新一代星辰大模型 Xing4.0-29B-A4B。参数上它是一个 MoE 模型总参数 29B单次推理只激活约 4B原生支持 256K 上下文、可扩展到 512K官方称这是国内首个基于国产算力与国产框架训练、面向复杂工程任务优化的百亿参数大模型。据科技日报报道发布后它一度冲进 Hugging Face 趋势榜前四目前已上架 GitHub、HuggingFace、魔搭、Gitee、魔乐等社区。公开评测数据里几项比较有参考价值SuperCLUE 智能体能力 93.52 分排第三与前两名 Qwen 模型差距不足 1 分SWE-bench Verified 拿到 75.0 分接近 Qwen3.6-35B-A3B 的 76.0 分Terminal-Bench 2.1 为 57.5 分。训练侧官方提到全流程在昇腾 910C 集群上完成依托 MindSpore/MindFormers用专家负载均衡、Grouped GEMM 等手段把训练吞吐较原始性能提升了约 96%。技术本质把跑得动这件事往下拉了一档这次真正值得关注的不是分数表而是部署门槛。公开材料里的几个数字FP16 精度部署同量级 29B 模型权重显存需求约 58–60GB基本离不开多卡服务器4-bit 量化后单卡权重显存压到约 15GB降幅约 75%RTX 3090、RTX 4090 这类 24GB 消费级显卡即可本地运行长上下文任务官方给出的推理吞吐约 30 tokens/s。架构上它用了面向 Agent 的 mHC MLA MTP 组合64 个路由专家、Top4 激活MLA 负责压缩长上下文的 KV Cache。这个模型的目标不是聊天榜上的数字而是能在有限硬件上把一长串工具调用跑完。和今年上半年那批权重动辄几百 GB、要靠 8 卡起步才能推理的超大开源模型比路线明显是两个方向一头把天花板往上顶一头把地板往下压。对绝大多数开发者和中小团队来说后者才真正有使用价值——毕竟不是每个团队都有一柜子专业卡。想试的话怎么上手以及必须知道的三个坑官方给的下载方式比较直接走 ModelScopepipinstall-Umodelscope modelscope download--modelXingChen-AGI/Xing4.0-29B-A4B\--local_dirXingChen-AGI/Xing4.0-29B-A4BexportMODEL_PATHXingChen-AGI/Xing4.0-29B-A4B推理框架已面向 vLLM、SGLang、KTransformers 提供启动示例微调侧兼容 LLaMA-Factory、MindFormersAgent 框架对 OpenCode、Claude Code 等做了定向适配。官方给出的采样参数是复杂推理与通用任务 temperature1.0、top_p0.95、repetition_penalty1.05代码与智能体任务把 temperature 调到 0.8。坑有三个基本都是显存账没算清导致的15GB 是权重装得下不是吃得消。上下文越长KV Cache 越大256K / 512K 是能力上限不是你在 24GB 卡上的默认配置。想跑长上下文得配合 KV Cache 量化、限制并发必要时把部分层放到 CPU。4B 激活不等于 4B 成本。29B 的总权重仍然要占显存和带宽业务如果以大量短请求为主一个总参数更小的稠密模型批处理效率可能反而更高不能只看激活参数就下结论。量化版本要盯错误累积。长链路 Agent 任务跑几十步之后量化误差叠加、指令保持会不会漂目前公开的还是基准分和单场景部署为主多步稳定性得自己在真实任务里压测。结尾全栈国产、消费级显卡可跑、代码与 Agent 能力能打这三点叠在一起Xing4.0-29B-A4B 给中小团队提供了一个够用的本地底座——客服这类数据不出域的场景据介绍已经完成了私有化部署。它最后能不能立住看的不是榜单分数而是长任务跑起来稳不稳。你会在什么场景下考虑本地跑 Agent评论区聊聊。
网站建设高端定制企业官网
RELATED

相关资讯

更多精彩内容,欢迎继续阅读

较早相关资讯

最新相关资讯

PyCharm快捷键实战指南:从导航到重构全面提速开发效率 2026/9/29 15:49:04

PyCharm快捷键实战指南:从导航到重构全面提速开发效率

1. 为什么快捷键能显著提速开发效率做Java和Python开发这些年,PyCharm一直是我主力IDE,身边不少同事问我效率怎么这么高,翻代码、改方法、跑了断点,一顿操作行云流水,其实最大的秘密就是快捷键用得足够熟练。快捷键从来…

阅读更多 →
多数据源切换优雅实践:AbstractRoutingDataSource + AOP + ThreadLocal 2026/9/29 15:48:56

多数据源切换优雅实践:AbstractRoutingDataSource + AOP + ThreadLocal

1. 为什么多数据源切换总是写得又乱又难维护做后端的人,尤其是跟业务系统打过交道的,大概率都遇到过这种场景:系统一开始连一个库就够了,后来报表要分库,或者接了某个老系统的Oracle,再或者搞了读写分离&am…

阅读更多 →
LLC谐振变换器LTspice仿真:从半桥到全桥的软开关设计 2026/9/29 15:48:55

LLC谐振变换器LTspice仿真:从半桥到全桥的软开关设计

刚接触LLC拓扑的时候,我也跟大部分人一样,对着半桥、全桥那几张图死记硬背,直到后来被项目逼着在LTspice里把这个电路真正仿真跑通,才发现很多以前背不下来的结论,其实只要看一遍波形就全懂了。这篇文章就从“为什么”…

阅读更多 →
江苏华泽供水设备有限公司正规吗,客户认可吗 2026/9/29 15:48:55

江苏华泽供水设备有限公司正规吗,客户认可吗

把握储水供水行业发展趋势,锚定民生领域品牌使命随着我国城镇化建设的持续推进,城乡基础设施不断完善,建筑消防、民生供水、工业生产等领域对安全稳定的储水供水设备需求持续提升。一方面,居民生活水平提升后,对生活饮…

阅读更多 →
VLAN原理与配置实战:从广播域隔离到PVID/VLAN ID排障 2026/9/29 15:48:55

VLAN原理与配置实战:从广播域隔离到PVID/VLAN ID排障

1. 从一张交换机构建起来的网络看VLAN为什么会出现 1.1 交换机到底在做什么:MAC学习、泛洪与转发过滤 先别急着背VLAN配置命令,我建议所有做网络的人都先把交换机的“转发模型”在脑子里过一遍。很多VLAN问题翻车,根本不是VLAN这个特性本身有…

阅读更多 →
MITM攻击原理与实战:从流量劫持到漏洞挖掘全解析 2026/9/29 15:48:55

MITM攻击原理与实战:从流量劫持到漏洞挖掘全解析

聊到中间人攻击,也就是常说的MITM,很多刚入门的朋友第一反应是“抓包改包”,第二反应是“这不就是个工具用法吗”。但实际参与过漏洞挖掘、做过应急响应的人心里都清楚,MITM从来不是一个孤立的技巧,它是一整套打破信任…

阅读更多 →

今日资讯

本周资讯

本月资讯

看完文章仍有疑问?

联系尧图顾问,获取一对一建站咨询

立即免费咨询 📞 400-888-8888
📞 ✉