Anthropic 已承诺遵守《欧盟人工智能法案》的实践准则,通过为人工智能生成的内容实施机器可读的透明度措施。自 2026 年 8 月 2 日起,所有新版 Claude 模型都将嵌入文本水印和符合 C2PA 标准的来源签名元数据。这些标记将适用于全球所有 Claude 产品及云合作伙伴。 该公司也正致力于为旧版模型追溯性地添加这些功能。为确保透明度,Anthropic 计划提供工具供用户和第三方检测这些标记,以标识内容是由 Claude 处理的。 不过,Anthropic 强调这些标记具有局限性:它们并非来源的决定性证明,因为内容在经过深度编辑、重新保存或总结后,可能会导致标记被移除或遮盖。此外,没有标记也并不代表内容一定是由人类创作的。Anthropic 将发布更多技术文档,以协助开发人员履行其在《欧盟人工智能法案》下的透明度义务。
注意:本文所述的攻击也可以在没有 Skill 的情况下,通过间接提示注入(例如 Zoom 摄入的隐藏指令,如电子邮件)进行。Skill 通常通过在线市场分发,并可在 Zoom 用户之间共享;先前的研究表明,攻击者正在将恶意 Skill 上传到这些在线注册表中。
已安装的 Zoom Skill 列表中显示的 weekly-meeting-report Skill。
注意:Zoom 在用户上传 Skill 时确实会提供警告,但我们认为它未能充分告知用户相关风险。该警告为:“此 Skill 并非来自 Zoom 官方目录,且未经 Zoom 验证。在安装前,请确保您信任该 Skill 的创建者。”