
智谱发布 GLM-5.3-FlashX,最高 200 tokens/s
智谱今日正式推出 GLM-5.3-FlashX 模型,最高输出速度达 200 tokens/s,API 现已上线,模型标识为 GLM-5.3-FlashX。
此前 GLM-5.3-Flash 以 Ox Alpha 之名面向全球开发者,调用量持续攀升。此次在 10 万张国产芯片推理算力基础上加大推理优化,进一步形成智能、价格、速度的全面竞争力。
© 版权声明
文章版权归作者所有,未经允许请勿转载。
THE END


智谱发布 GLM-5.3-FlashX,最高 200 tokens/s
智谱今日正式推出 GLM-5.3-FlashX 模型,最高输出速度达 200 tokens/s,API 现已上线,模型标识为 GLM-5.3-FlashX。
此前 GLM-5.3-Flash 以 Ox Alpha 之名面向全球开发者,调用量持续攀升。此次在 10 万张国产芯片推理算力基础上加大推理优化,进一步形成智能、价格、速度的全面竞争力。
暂无评论内容