Anthropic 全球范围内为 Claude 输出嵌入隐…

AI广播站10小时前更新 小悠
10 0 0

Anthropic 签署欧盟 AI 法案实践准则,宣布自 2026 年 8 月起所有新发布的 Claude 模型将在全球范围内嵌入内容标识。该要求不仅限于欧盟市场,而是覆盖包括 API、Claude、Claude Code、Claude Cowork 和 Claude Tag 在内的所有 Claude 产品线。现有模型将获得法律过渡期,但 Anthropic 表示已在推进水印功能的回溯适配工作。

Anthropic 采用两种标识机制:文本输出将携带不影响内容含义和可读性的隐形水印,该水印在复制粘贴后依然存在,并"可能在一定程度编辑后保留"。图像等文件格式将基于 C2PA 开放标准附加数字签名溯源元数据,签名可表明文件经过 Claude 处理并能揭示后续篡改行为。文本水印还将通过 AWS、Google Cloud 和 Microsoft Foundry 等云合作伙伴生效,不过这些平台可能不支持签名元数据。Anthropic 计划后续发布验证工具,供用户和第三方检测这些标识。

Anthropic 全球范围内为 Claude 输出嵌入隐形水印:AI 内容溯源时代正式开启

Anthropic 坦承水印技术存在明显限制:检测到水印并不意味着该内容完全由 Claude 生成,因为用户经常使用 Claude 进行校对、翻译或摘要,输出内容可能携带水印但核心思想来自人类。同样,未检测到水印也不能排除 AI 的参与——模型可能在水印功能上线前就已输出、文本可能经过重度编辑或翻译、段落可能过短无法可靠检测,或元数据在格式转换和截图中被剥离。水印能否在编辑、重排版和翻译后存活,将是检验其真正价值的关键测试。

AI 文本检测在教育等社会敏感领域影响尤为深远。研究表明过度依赖 AI 工具会削弱批判性思维和写作能力,已有诈骗者利用 AI 注册虚假学生身份骗取助学金。然而不可靠的检测器同样危险,可能导致误判学生作弊的错误指控。Anthropic 的水印方案若比现有第三方检测工具更可靠,或将为这一困局提供新的出路。

Anthropic 并非唯一探索水印技术的公司。Google DeepMind 已开源 SynthID 水印系统并内置于 Gemini 模型中,通过在词元预测时微调概率值实现不降质水印,支持多语言但同样在编辑后检测困难。相比之下,OpenAI 拥有准确率达 99.9% 的文本检测器却搁置两年未发布,原因包括用户可通过翻译或改写轻松绕过、可能污名化特定群体,以及公开检测器可能损害自身商业利益。

Anthropic 的决定也可能带来商业风险。Claude 在知识工作领域尤其受学生欢迎,更可靠的检测能力可能降低这部分用户的吸引力。但随着 AI 生成内容泛滥和深度伪造风险加剧,内容溯源已从可选项变为必选项,率先建立可信标识体系的厂商将在监管趋严的环境中获得先发优势。

近日,Anthropic未发布科研版Claude在挑战黎曼猜想时虽未成功,却将黎曼zeta函数临界线零点比例下界从41.6%大幅提升至67.2%,引发学界热议。需澄清,该成果并非证明猜想67.2%的正确性,而是零点比例界限的突破。

Meta发布300亿参数开源多模态模型Muse Glimmer,采用宽松Apache 2.0许可,专为本地智能体工作流优化,强化多步推理与工具调用能力,支持文本和视觉处理。这是Llama 4后首次开放模型权重,旨在推动开源AI生态发展。

Anthropic宣布为新Claude模型加入不易察觉的水印,以标识AI生成文本来源,水印不影响语义和阅读,复制粘贴时保留,部分编辑后仍可存在。此举系根据欧盟《人工智能法案》推动AI透明度,自8月2日起发布的新模型生成内容支持标记识别,适用于全球用户。

知情人士透露,Anthropic与比特币矿企Riot达成价值91亿美元的20年云计算合约,获得191兆瓦算力供应。这是Anthropic近期多项大规模算力采购之一,凸显AI行业算力供给持续紧张。消息公布后,Riot盘后股价飙升25%,至24.4美元。

OpenAI 的新图像模型 mona-lisa-1 现身 Arena,确认带有 SynthID 水印。实测显示,该模型真实感显著提升,“塑料感” 大幅减弱,细节更丰富,在艺术画作与信息图生成上表现突出。此外,有线索表明其训练可能在去年便已完成。

Anthropic 全球范围内为 Claude 输出嵌入隐…

关注 “悠AI” 更多干货技巧行业动态

© 版权声明

相关文章

没有相关内容!

暂无评论

您必须登录才能参与评论!
立即登录
none
暂无评论...