智谱发布GLM-5.3-FlashX,扩算力、提速度、提定价。
9月18日,港股“大模型第一股”智谱股价大涨,截至发稿,涨幅为5.34%。

消息面上,智谱正式发布GLM-5.3-FlashX,API同步全面开放。据介绍,新版本推理速度最高可达200 tokens/s,较现有GLM-5.3-Flash提升5倍,定价提升至原版本的2.5倍。
需求持续超预期,算力扩容为业务增长提供支撑。据智谱介绍,由10万张国产芯片组成的推理集群上线即被用户用满。此次公司再次扩大算力规模,并推出价格更高、速度更快的FlashX版本,以承接持续增长的市场需求。
智谱方面还表示,GLM-5.3-Flash长期保持同尺寸模型领先的智能水平,同时具备较高性价比。智谱强调,随着FlashX上线,模型收入规模和盈利能力有望进一步提升。
GLM-5.3-FlashX将推理速度提升至200 tokens/s并相应上调定价,反映的是国产大模型竞争逻辑的一次切换:从单纯追求模型能力上限,转向在同等智能水平下比拼推理效率和用户体验。
这一趋势在今年下半年已经显现。例如,8月26日,阿里与智谱同日发布高性价比模型,阿里Qwen3.8-Flash训练成本较前代骤降近90%,推理定价低至每百万Tokens输入0.8元、输出2.7元。智谱GLM-5.3-Flash发布时以匿名模型在OpenRouter平台测试,Token调用量高达62T,登顶并刷新双平台历史纪录。
当前,国产大模型产业正在进入一个新阶段:算力供给的规模化与国产化,让模型公司得以将更多精力从“抢算力”转向“拼效率”;推理速度、响应体验和单位成本,正在取代单纯的参数规模,成为衡量模型商业竞争力的核心标尺。
校对:苏焕文
