智谱发布GLM-5.3-FlashX模型,推理速度达200tokens/s
AI摘要
由 AI 生成 · 仅供参考
智谱正式推出GLM-5.3-FlashX模型,最高推理速度达200tokens/s。该模型基于10万张国产芯片算力优化,旨在提升企业级应用体验,API已上线,价格略高于前代。
驱动中国9月18日消息,智谱宣布正式推出GLM-5.3-FlashX模型。该模型最高推理速度可达200 tokens/s,旨在为企业与开发者提供更快速、流畅的大模型服务体验。
智谱官方披露,GLM-5.3-Flash此前曾以“Ox Alpha”代号与全球开发者见面,凭借稳定的表现获得了海内外开发者的认可,其调用量呈现持续攀升态势。针对日益增长的市场需求,智谱在依托10万张国产芯片提供的推理算力基础上,进一步加大了在基础设施侧的投入与推理优化力度。
官方表示,GLM-5.3-Flash长期保持同尺寸模型中的智能水平,此次推出的GLM-5.3-FlashX通过速度提升,进一步强化了在智能水平、价格体系与推理速度方面的综合竞争力。
目前,GLM-5.3-FlashX API已正式上线,开发者可通过Model Key:GLM-5.3-FlashX进行调用。价格方面,GLM-5.3-FlashX的定价略高于GLM-5.3-Flash。
版权声明:本文由驱动中国整理发布,转载需注明出处与原文链接。如有疑问请联系
editor@qudong.com。
本文价值
★★★★★
4
70 人已评
登录后为本文打分
评论加载中…