阿里巴巴正式推出了以真实世界为中心的 GUI 智能体基座模型 Qwen-UI-Agent。该模型全面覆盖了移动端、电脑端、网页端以及深度搜索环境,旨在打破传统模拟测试的局限,让模型真正具备在复杂真实设备上无缝操作的能力。
在各项权威测试与实际环境中,Qwen-UI-Agent 展现出了强劲的实力:

为了打通“从模拟到真实”的最后一公里,Qwen-UI-Agent 搭建了覆盖100多台真实手机、150多个应用的真机移动环境,用于任务构建、轨迹采集及模型训练,并推出了包含400多个任务的 MobileWorld-Real 真机基准,使研发团队能够根据真机成功率进行精准选型。
在功能特性上,该模型不仅支持常规的 GUI 界面操作,还能直接执行命令行操作,并在单次决策中以批量动作输出,大幅缩短了执行轨迹并提升了效率。同时,它具备完善的全过程安全判断机制:面对违法或高风险请求,它会直接拒绝并终止任务;而在涉及支付、数据删除、隐私授权等敏感场景时,则会在关键步骤主动停手,等待用户确认后再继续。
此外,该模型支持在超过100步的超长轨迹上进行在线强化学习训练,配合自适应课程学习,持续攻克高难度的长程任务。
项目主页:https://tongyi-mai.github.io/Qwen-UI-Agent/
阿里巴巴8月20日发布GUI智能体基座模型Qwen-UI-Agent,覆盖移动端、电脑端、网页端及深度搜索,多项核心基准超越业界旗舰。移动端MobileWorld得82.1%,分别领先GPT-5.6Sol和Claude Opus4.8达12.0和14.6个百分点,展现强劲实力。
8月17日,阿里发布AI音乐生成模型HappyShrimp(快乐虾米)1.0。它突破传统标签式输入门槛,用生活化自然语言即可驱动作词、作曲、编曲、演唱全流程,让普通用户产出高完成度原创音乐。不同于堆砌专业术语的工具,它将音乐理解为有语法、语义的创作。
苹果在华销量承压,正调整AI布局,已专为中国市场训练专属大语言模型,并与阿里巴巴深度合作,由后者提供技术支持完成核心训练。此前外界预计苹果会引入国内第三方大模型。
阿里巴巴千问图像生成模型Qwen-Image-3.0上线,旗舰版Pro与标准版API开放,文生图起售价0.18元/张。该模型在Arena.ai文生图榜单居国内第一,主打超长文本理解与精细化渲染,最高支持4.5k token指令,可生成分镜、试卷、九宫格知识图等复杂版面。
阿里巴巴发布新一代大模型Qwen3.8-Max,参数量达2.4万亿。其在编程与专业办公等核心场景性能大幅跃升,于权威榜单Arena中综合实力仅次于Claude系列,位居前列,标志着国产大模型在复杂任务处理上取得重要突破。

关注 “悠AI” 更多干货技巧行业动态