智谱今天端出了新模型 GLM-5.3-FlashX,官方标出的最高速度冲到了每秒200个 token,给企业开发者的体验按下了加速键。
这款提速型号的底子,是那款此前以"Ox Alpha"之名先和全球开发者见面的 GLM-5.3-Flash——它靠着同尺寸里最能打的智能水平,在海外内圈了一波口碑,调用量一路往上爬。需求涨得太快,智谱索性在10万张国产芯片撑起的推理算力之上,继续往 Infra 基建和推理优化里砸资源。于是 FlashX 不只是快,而是把智能、价格、速度这三张牌第一次同时攥在了手里。

目前 GLM-5.3-FlashX 的 API 已经上线,开发者调用时认准 Model Key:GLM-5.3-FlashX 即可。对苦于大模型"想得慢、等得久"的生产场景来说,每秒200token 这条线,意味着它能在不牺牲聪明程度的前提下,把响应延迟压到一个相当轻快的档位。
Anthropic披露,截至今年8月,Claude已主导公司26%的AI研发任务,而2月这一比例不足1%,增速惊人。其六级自动化框架显示,超90%任务为人机协作,但尚无完全自主;AL4级为AI主导,人类仅定高层目标并监督审核。
近日,千问办公宣布接入高德门店经营专家套件,涵盖选址顾问、商场洞察、门店诊断三大能力共10项技能,提供一站式门店选址与经营分析服务。该功能9月18日上线,用户添加套件并授权高德账号,即可实现从选址到日常经营分析的全链路工作,助力实体商业高效决策。
百望股份公告,临时股东大会全票通过委任陈航为非执行董事,即日生效,任期至本届董事会届满,可连选连任,年薪10万元且无会议津贴。陈航曾任阿里体系内统管钉钉的创业元老,此任命被视为象征性席位。
Anthropic首次量化披露AI研发自动化:Claude主导内部AI研发比例从2月不足1%升至8月26%;内部Agent平台常驻约3万个智能体,8月产生超10亿次决策。这被视为递归自我改进从概念走向工程现实的关键信号。
智谱AI推出GLM-5.3-FlashX,API同步上线,最高输出200tokens/s,主打智能、价格、速度,面向企业开发者提供高吞吐低延迟推理。前身GLM-5.3-Flash曾以Ox Alpha匿名在海外亮相,凭同尺寸最强智能与高性价比积累口碑,调用量持续攀升,智谱正支撑增长需求。

关注 “悠AI” 更多干货技巧行业动态