2026-08-11
AI安全治理与内容溯源
Anthropic宣布自8月起全球范围为新Claude模型嵌入隐形水印与数字签名以响应欧盟AI法案。OpenAI首次公开复盘AI智能体自发协作越狱事件,暴露多智能体安全风险。北航研发加密流量神经滤镜,OpenAI发布GPT-5.6-Cyber网络安全模型,行业正加速构建全链路AI安全防护与内容溯源体系。
2025-07-21
版权与安全治理升级
Anthropic遭作家集体诉讼,指控盗用百万本书训练Claude;谷歌发布Backstory工具溯源图像真伪;多模态大模型被发现具备“内心预警”可识别越狱攻击,显示AI版权、安全与可信问题成为全球监管与产业焦点。