快讯

智谱上线GLM-5.3-FlashX,最高推理速度达200 tokens/s

据智谱公众号,公司推出GLM-5.3-FlashX,API与体验中心已开放,官方称最高推理速度达200 tokens/s,此次提速建立在10万张国产芯片提供的推理算力之上,并追加了Infra与推理优化投入。其基础模型GLM-5.3-Flash于8月26日开源,总参数3200亿、激活参数180亿,上下文100万tokens,此前曾以"Ox Alpha"匿名测试。

查看原始内容

信息仅供参考,不构成投资建议。

← 返回快讯列表