智谱上线GLM-5.3-FlashX,最高推理速度达200 tokens/s
PANews|2026年09月18日 05:23
据智谱公众号,公司推出GLM-5.3-FlashX,API与体验中心已开放,官方称最高推理速度达200 tokens/s,此次提速建立在10万张国产芯片提供的推理算力之上,并追加了Infra与推理优化投入。其基础模型GLM-5.3-Flash于8月26日开源,总参数3200亿、激活参数180亿,上下文100万tokens,此前曾以"Ox Alpha"匿名测试。
分享至:
脉络
热门快讯
APP下载
X
Telegram
复制链接