字节跳动原计划于 8 月推出的豆包大模型 2.2 将适当推迟面世。本次延期的核心原因是内部希望通过更充分的预训练和后训练,全面提升模型在编程、工具调用以及 Agent 智能体等维度的综合能力,力求以更长的研发周期换取性能的显著跃升。
作为两代大模型之间的关键技术补强,豆包大模型 2.2 采取了更为扎实的研发路径。它既不等待下一代超大模型完全成型再去解决编程等痛点,也拒绝简单的日常迭代模式。按照规划,Seed 团队将 2026 年的主要目标之一锚定在将 Coding 能力推向行业第一梯队,并期望其能在年底前展现出对标智谱 GLM-5.2 以及 Kimi-K3 等同类前沿产品的行业冲击力。

在高层战略指引上,张一鸣明确表示公司未来不会依赖 AI 蒸馏技术来改良模型,而梁汝波也在年中全员会上强调,字节在大语言模型领域将坚定不移地坚持自研路线。团队愿意接受短期的相对落后,扎实做好底层基本功,坚持进行长期的技术优化。
腾讯发布混元 Hy4 preview 开源模型,总参数770B、激活参数49B,上下文长度1M。官方称预训练与后训练同步进步,智能水平跃升,居开源第一梯队。模型已在 HuggingFace、GitHub、ModelScope、Gitcode 上线,并接入腾讯云 TokenHub 与 OpenRouter。生产力场景盲测力压 GLM-5.3 与 Kimi K3。
腾讯混元发布旗舰模型预览版Hy4preview,总参数770B、激活参数49B,上下文长度支持1M。该模型在代码、办公、科学等真实生产力任务中表现卓越,居开源模型第一梯队,内部盲测综合表现优于同类竞品,并已在腾讯内部多领域应用。
8月27日,Anthropic以研究预览形式推出“模型硬件标准”(MHS),被路透社、CNBC等解读为首次公开进军具身智能与物理AI领域。该标准类似MCP,作为统一控制与通信标准,为AI装“身体”,使其能操控自动驾驶、机械臂等物理设备,感知世界、执行动作并持续学习。
国光量超人工智能团队将前沿量子技术引入大语言模型决策与推理核心,推出面向科研学术领域的“玄幂”大模型家族。该模型在科研科普、任务路由、智能体决策等垂直任务中展现独特竞争优势,助力大语言模型突破纯经典计算物理边界。
OpenAI、Anthropic、微软、谷歌、亚马逊等116家企业机构联名呼吁将网络安全置于AI时代最高优先级,警告未来数月AI赋能网络攻击将更猖獗,敦促政府与企业双线强化防御,加快推行“可信访问计划”,让合规企业在模型公开前接入以防范风险。

关注 “悠AI” 更多干货技巧行业动态