智谱发布 GLM-5.3-FlashX:速度飙至200to…

智谱 AI 旗下 BigModel 平台正式推出 GLM-5.3-FlashX 大模型,API 同步上线,模型标识为“GLM-5.3-FlashX”。新版本最高输出速度达200tokens/s,主打“智能、价格、速度”三位一体竞争力,面向企业与开发者提供高吞吐、低延迟的推理服务。

该模型前身 GLM-5.3-Flash 曾以“Ox Alpha”匿名亮相海外,凭借同尺寸最强智能水平与极高性价比迅速积累口碑,调用量持续攀升。为支撑增长需求,智谱依托10万张国产芯片算力底座,加大推理优化投入,最终推出提速版 FlashX。

智谱发布 GLM-5.3-FlashX:速度飙至200tokens/s,国产算力再提速

FlashX 在保持原有智能水准与亲民定价的基础上,将生成速度拉满,进一步巩固了其在高并发场景下的商用优势。开发者可通过官方 API 文档接入,非技术用户也可在体验中心直接试用。此次升级标志着国产大模型在推理效率与普惠化落地上又迈进一步。

智谱发布新模型GLM-5.3-FlashX,最高速度达每秒200 token,主打企业开发者体验。其前身GLM-5.3-Flash曾以“Ox Alpha”面向全球开发者,凭同尺寸领先智能表现积累口碑,调用量快速增长。为应对需求,智谱依托10万张国产芯片算力,持续加码基础设施与推理优化。

智谱AI建成1GW级国产AI算力数据中心,全面采用国产芯片,并收购源自中科院计算所的中科加禾。后者专注异构算力软件栈与编译优化,此举强化了智谱AI从算力到基础软件的国产AI基础设施布局。

6月17日,智谱AI开源GLM-5.2大模型,聚焦代码生成与长程任务。在Code Arena前端评估中,该模型全球可用排名第二、开源模型第一。智谱自2025年初攻关代码基座,先后推出GLM-4.5/4.7,GLM-5.2进一步拓展至跨数天乃至数月的复杂工程执行。

智谱AI启动科创板IPO,计划募资150亿元,距其1月登陆港股不足五个月。公司通过“A+H”双渠道融资,旨在拓宽资金来源,巩固大模型领域领先地位。

智谱AI近日推出AutoClaw(澳龙)iOS版,用户可通过App Store下载。这是继PC端上线后,两个月内新增的移动端入口。APP支持与PC端账号实时同步,用户可在手机上创建、编辑、注销Agent及管理群聊,通过多智能体协作处理复杂任务。核心亮点是“双模式”功能。

智谱发布 GLM-5.3-FlashX:速度飙至200to…

关注 “悠AI” 更多干货技巧行业动态

© 版权声明

相关文章

没有相关内容!

暂无评论

您必须登录才能参与评论!
立即登录
none
暂无评论...