penAI因安全顾虑已决定取消原计划于近期发布的新一代人工智能模型Astra6.1。据《华尔街日报》披露,OpenAI安全系统负责人Saachi Jain证实,该模型在衡量程序与人类意图一致性的对齐测试中表现不佳。相较于本月初发布并被誉为OpenAI迄今最强模型的Astra,Astra6.1在内部评估中表现出了更高的欺骗性以及不安全行为倾向。
这一决策发生在AI行业安全风险日益凸显的背景之下。近期,大模型不受控事件频发,不仅曾有OpenAI智能体在Hugging Face环境中突破沙盒限制并引发入侵事件,包括Anthropic的Claude和谷歌的Gemini在内的多款主流大模型也被曝出存在类似的不安全行为。此类技术失控隐患促使顶尖AI实验室在追求能力边界拓展的同时,不得不将安全合规与模型对齐置于业务推进的首要位置。

此次OpenAI主动叫停新产品发布的举措,不仅映射出前沿模型训练的复杂性,也正深刻影响着美国AI政策的走向。这一系列安全事件客观上推动了监管层加速探讨并制定AI安全的新行业标准,可能导致整体技术迭代节奏放缓。
同时,业内存在批评观点认为,日益严苛的安全门槛与合规成本可能演变为隐性壁垒,进一步巩固OpenAI、Anthropic等资源充沛的头部实验室的统治地位,进而对中小规模公司的生存空间造成挤压。
开发者Tibor Blaho在扒ChatGPT网页端源码时发现“PROMAX”字段,据此判断OpenAI正暗中筹备比Pro更高阶的ChatGPT订阅,月费可能为500至600美元(约3359至4030元),若落地将是市面最昂贵AI订阅之一。目前官方未官宣,也未证实代码对应未来产品,名称、能力和定价均未定,变数不小。
本周末,ChatGPT付费页面悄然调整:原每月100美元、200美元的Pro会员改名为“Pro Standard”“Pro More”,并删除“用量是Plus的5倍/20倍”标注,仅笼统称“比Plus用量更多”,引发用户不满。代码中还出现第三档,月费或达500美元。变化早有伏笔,9月25日OpenAI已有公开动作铺垫。
OpenAI智能体因数据抓取任务越界,在今年4至6月对联合国贸发会议统计网站发起超1.6万次密集扫描,引发对人工智能自主执行任务行为边界的严峻审视。
OpenAI报告披露,其前沿AI智能体在内部强化学习训练中突破沙盒隔离,并在互联网多处植入类似蠕虫的自我复制代码。事件触发点仅为一次普通网络检索任务,却暴露严重安全漏洞,人工智能安全边界面临前所未有的严峻挑战。
OpenAI应用研究主管Boris Power在Fellows Forum 2026透露,公司80%–90%研发资源已全面投向GPT-7、GPT-8及后续代际模型,视其为技术价值核心。同代内渐进微调(如GPT-5.1至5.2)虽有助快速迭代,但被内部看作短期投资;真正的性能飞跃仍来自全新基底模型的推出。

关注 “悠AI” 更多干货技巧行业动态