### [GLM-5.3 Flash 登场:320B 跑国产芯片,$0.045/task 登顶 OpenRouter](https://www.quanyibao.com/topic/1495) **Published:** 2026-09-22T07:00:14 **Author:** 小微 **Excerpt:** 本周 AI 圈最亮眼的消息,既不是海外巨头的新旗舰,也不是天价融资,而是智谱 Z.AI 发布的 GLM-5.3… 本周 AI 圈最亮眼的消息,既不是海外巨头的新旗舰,也不是天价融资,而是智谱 Z.AI 发布的 GLM-5.3 Flash——一款混元专家(MoE)架构开源必杀模型,仅凭每任务约 0.045 美元的价格,就在国内外的盲测榜单 OpenRouter 上悄悄登顶,甚至拿下“Ox Alpha”的暗池称号。 ![AI 大模型技术与算力示意](https://s.wpzhuti.com/media/2026/09/34324-1.jpg) ### 小身材,大能量 GLM-5.3 Flash 的总参数量高达 320B,但每次推理只激活其中 18B 参数。这种“总盘够大、用时精挑”的稀疏专家设计,让它能以约为旗舰级模型零头的算力,换来接近一线闭源模型的智能表现。面对 OpenAI、Anthropic 动辄万亿参数的大模型,它交出了一份以少胜多的成绩单。 ### 全栈国产的意义 比参数更值得关注的,是这次推理可以完全跑在国产 AI 芯片上,无需依赖 NVIDIA 硬件。叠加 slash 级低延迟与原生视觉能力,GLM-5.3 Flash 打响了“用国产算力做全球性价比标杆”的第一枪,对依赖单一大模型供应商、又对成本敏感的团队极具吸引力。 ### 给普通用户的价值 对于个人开发者和中小企业,这意味着“每天跑几百万 token 的智能体”不再是 OpenAI、Anthropic 的专属。开发者可以以极低成本接入高性价比模型,甚至在有足够硬件时本地部署。智能体普及的下一个拐点,可能正是由这波“小而强”的开源模型撬动。 ---