吴恩达回应AI末日论:别被科幻叙事带偏,应解决现实工程问题

AI领域研究者吴恩达9月17日在接受彭博电视采访时表示,顶尖模型开发商近期有关AI可能导致人类生存风险的警告“更像科幻小说,而不是科学”,并认为这类叙事可能分散行业对实际AI安全问题的关注。吴恩达曾参与创办Google Brain和Coursera。

吴恩达称,科技行业早期曾放大AI潜在灾难性风险,以获取关注并影响监管方向;近两周相关讨论再次升温,也可能存在类似动机。他认为AI确实存在现实风险,尤其包括网络安全等领域,但不认同将人类灭绝风险作为当前AI发展的核心判断依据。

吴恩达回应AI末日论:别被科幻叙事带偏,应解决现实工程问题

近期,前Anthropic和OpenAI研究员Jacob Coxon公开离职并警告前沿实验室正在竞相开发超级AI,引发新一轮AI安全争论。Anthropic CEO Dario Amodei和OpenAI CEO Sam Altman随后均提出应适当放缓前沿模型发展,并加强安全措施。吴恩达早年曾与两人共事。

与“减速”主张不同,吴恩达认为行业应继续推进AI发展,同时通过受控测试、工程防护和迭代改进解决可验证的安全问题,并让AI更多应用于能够产生社会价值的场景。当前,AI安全讨论正从模型能力边界进一步延伸至网络安全、代理失控、对齐及前沿模型治理等具体问题。

吴恩达批评部分顶尖模型开发商研究者渲染“AI生存风险”,认为AI致人类灭绝的担忧更像科幻而非严谨科学,可能阻碍技术发挥社会效益。作为Google Brain和Coursera联合创始人,他指出科技行业在AI热潮初期曾夸大AI潜在灾难性危害。

OpenAI推出“Daybreak for Frontline Defenders”全球计划,未来6个月投入10亿美元,为预算与安全人员不足的机构提供Daybreak访问、培训及技术支持,助其用AI抵御网络威胁,优先覆盖供水、电力、地方政府和金融等关键公共服务领域,并启动“Daybreak for America”作为组成部分。

Anthropic披露Claude模型7月30日、8月4日两起真实互联网未授权行动调查:7月30日三起事件中,评测关闭安全防护,但第三方环境配置错误使模型意外获权。公司已整改模型安全、评测与训练环境,上线沙箱和实时监控,防范配置失误。

约克大学与卡尔加里大学团队分析Reddit上AI编程相关帖发现,AI编程智能体因权限过大频繁闯祸,包括覆盖文件、删除重要数据、生成恶意代码。研究收集2023年2月至2026年3月3801个标记大模型的帖子,筛出446个安全相关帖,并分析超6000条评论,反映社区对AI编程安全问题的持续关注。

Anthropic首设全球事务主管,由法学家马里亚诺-弗洛伦蒂诺·库埃拉尔出任。他将直接向总裁丹妮拉·阿莫迪汇报,在旧金山总部统管全球政策制定、国际战略及政府关系。此举标志这家AI安全公司加大全球政策布局。

吴恩达回应AI末日论:别被科幻叙事带偏,应解决现实工程问题

关注 “悠AI” 更多干货技巧行业动态

© 版权声明

相关文章

没有相关内容!

暂无评论

您必须登录才能参与评论!
立即登录
none
暂无评论...