大模型越做越大,本地部署门槛却让个人开发者望而却步?9月22日,中国电信 AI 正式发布新一代轻量级智能体大模型 Xing4.0-29B-A4B,用”小身材”给出了一个务实的答案:总参数 29B、激活参数仅 4B,却只要 15GB 显存就能在消费级显卡上跑起来。

核心亮点:单卡部署 + 完整智能体能力
基于新一代 MoE(混合专家)架构,Xing4.0-29B-A4B 每次推理只激活 4B 参数,兼顾响应速度与深层推理。它原生支持 256K 超长上下文,可自主规划多步任务、调用外部工具并输出完整结果。在 SWE-bench Verified 编程基准上拿下 75.0 分,排进同参数量级第一梯队,代码生成、函数调用、JSON 输出等能力一应俱全。
实用价值:本地 AI Agent 不再是”大厂专属”
通过低比特量化与显存优化,模型占用仅 15GB,普通游戏显卡即可运行,数据全程不出设备、隐私可控。它已在电信集团客服平台等真实生产环境验证,复杂工单处理效率显著提升;模型已在 GitHub、Hugging Face(XingChen-AGI)开源,兼容主流训练推理框架。
对个人开发者和小团队而言,这意味着可以低成本搭建自己的本地智能体:让 AI 读仓库、写代码、做数据分析,全部离线完成。当”轻量”与”能打”不再对立,AI Agent 的平民化时代或许真的来了。