企业在构建人工智能系统时,往往面临一个痛点:核心业务数据和专有知识由于涉及机密,通常被隔离在各种长篇密集文档、金融申报文件、法律合同以及政府记录之后。传统的一次性检索增强生成(RAG)由于只能检索固定文本块且缺乏推理迭代能力,面对这类结构复杂的长文档和跨来源对比任务时往往力不从心。为了解决这一行业难题,Mistral AI 正式推出了全新升级的 Agentic Search。该技术引入了多步骤检索循环机制,不仅打破了传统方法的局限,还让 AI 系统在处理企业级复杂文档查询时实现了质的飞跃。
传统 RAG 的核心缺陷在于“只检索、不推理、无法迭代”,模型必须根据初次命中的碎片化文本硬着头皮作答。而 Agentic Search 构建在企业现有的搜索索引之上,为模型赋予了五个类似于常见文件系统操作的核心工具:

通过这一套组合拳,模型不再受限于传统的分块粒度。它可以在回答前主动检查找到的内容、优化搜索策略、深入查阅底层证据,甚至在多份文档间进行对比核对,从而让检索质量随着模型自身推理能力的提升而水涨船高。
在实际行业基准测试中,Agentic Search 展现出了极强的落地实力与数据爆发力:
此外,Agentic Search 能够完美适配云端和本地部署需求,无论是内置于 Studio 和 Vibe 的 Libraries 中,还是通过 Mistral Search Toolkit 集成到客户自建的工作流中,它都为企业释放敏感领域数据价值、打造高精度检索系统提供了强有力的底层支撑。
OpenAI向开发者开放Codex Harness核心能力,该框架是Codex智能体的运行环境,负责连接模型、用户与工具,管理任务、上下文、会话及代码操作。此前已开源Codex CLI及核心代码,并持续完善Harness与App Server。其架构不仅是代码生成工具,更是完整的Agent执行框架。
Anthropic宣布电脑操作、Skills API与Files API在Claude平台全面开放,正式进入GA阶段;同步推出浏览器使用工具,并优化底层能力,助力企业构建生产级智能体,实现软件操作、团队知识运用与成品输出。
Waymo将谷歌Gemini人工智能助手深度整合进定制自动驾驶出租车Ojai,推动无人出行智能化升级。目前该车型已在洛杉矶、菲尼克斯和旧金山向所有普通用户全面开放,官方今年还计划进一步拓展布局。
阿里巴巴8月20日发布GUI智能体基座模型Qwen-UI-Agent,覆盖移动端、电脑端、网页端及深度搜索,多项核心基准超越业界旗舰。移动端MobileWorld得82.1%,分别领先GPT-5.6Sol和Claude Opus4.8达12.0和14.6个百分点,展现强劲实力。
Google DeepMind宣布Gemma系列模型全球下载量突破10亿次。过去两年开发者已发布超十万个变体,形成创新生态“Gemmaverse”。该模型灵活性高,可部署于本地设备、边缘基础设施乃至太空等复杂环境。

关注 “悠AI” 更多干货技巧行业动态