
智谱发布 GLM-5.3-FlashX,最高 200 tokens/s
智谱今日正式推出 GLM-5.3-FlashX 模型,最高输出速度达 200 tokens/s,API 现已上线,模型标识为 GLM-5.3-FlashX。
此前 GLM-5.3-Flash 以 Ox Alpha 之名面向全球开发者,调用量持续攀升。此次在 10 万张国产芯片推理算力基础上加大推理优化,进一步形成智能、价格、速度的全面竞争力。
智谱
智谱发布 GLM-5.3-FlashX,最高 200 tokens/s
|
|
|
|
文章标签
暂无标签
上一篇
下一篇
相关资源
评论区 (0)
暂无评论,快来抢沙发吧!