智谱发布 GLM-5.3-FlashX,最高 200 tokens/s

智谱发布 GLM-5.3-FlashX,最高 200 tokens/s

智谱今日正式推出 GLM-5.3-FlashX 模型,最高输出速度达 200 tokens/s,API 现已上线,模型标识为 GLM-5.3-FlashX。

此前 GLM-5.3-Flash 以 Ox Alpha 之名面向全球开发者,调用量持续攀升。此次在 10 万张国产芯片推理算力基础上加大推理优化,进一步形成智能、价格、速度的全面竞争力。

智谱

科技圈· 茶馆 · 投稿

0 评论

发表评论

您是本站第36059名访客 今日有43篇新文章/评论