智谱发布GLM-5.3-FlashX模型,推理速度达200tokens/s

AI 驱动中国 宋谣 5,961次阅读 26 条评论
分享 Q
AI摘要
由 AI 生成 · 仅供参考

智谱正式推出GLM-5.3-FlashX模型,最高推理速度达200tokens/s。该模型基于10万张国产芯片算力优化,旨在提升企业级应用体验,API已上线,价格略高于前代。

驱动中国9月18日消息,智谱宣布正式推出GLM-5.3-FlashX模型。该模型最高推理速度可达200 tokens/s,旨在为企业与开发者提供更快速、流畅的大模型服务体验。

智谱官方披露,GLM-5.3-Flash此前曾以“Ox Alpha”代号与全球开发者见面,凭借稳定的表现获得了海内外开发者的认可,其调用量呈现持续攀升态势。针对日益增长的市场需求,智谱在依托10万张国产芯片提供的推理算力基础上,进一步加大了在基础设施侧的投入与推理优化力度。

官方表示,GLM-5.3-Flash长期保持同尺寸模型中的智能水平,此次推出的GLM-5.3-FlashX通过速度提升,进一步强化了在智能水平、价格体系与推理速度方面的综合竞争力。

目前,GLM-5.3-FlashX API已正式上线,开发者可通过Model Key:GLM-5.3-FlashX进行调用。价格方面,GLM-5.3-FlashX的定价略高于GLM-5.3-Flash。

版权声明:本文由驱动中国整理发布,转载需注明出处与原文链接。如有疑问请联系 editor@qudong.com
本文价值 4 70 人已评
登录后为本文打分
网友评论26 条评论
正在回复 的评论取消
评论加载中…
🔐

登录后参与互动

评论、点赞均可赚积分
连续签到、邀请好友也有奖励 🎁

电脑端: 微信扫码登录 微信内: 一键登录
我要投稿有独家观点或行业线索?向驱动中国投稿,审核采用后署名发布并获积分奖励。 去投稿 ›

微信扫一扫

打开微信「扫一扫」,分享本文到朋友圈或好友