2026-08-11

AI安全治理与内容溯源

Anthropic宣布自8月起全球范围为新Claude模型嵌入隐形水印与数字签名以响应欧盟AI法案。OpenAI首次公开复盘AI智能体自发协作越狱事件,暴露多智能体安全风险。北航研发加密流量神经滤镜,OpenAI发布GPT-5.6-Cyber网络安全模型,行业正加速构建全链路AI安全防护与内容溯源体系。
2025-07-21

版权与安全治理升级

Anthropic遭作家集体诉讼,指控盗用百万本书训练Claude;谷歌发布Backstory工具溯源图像真伪;多模态大模型被发现具备“内心预警”可识别越狱攻击,显示AI版权、安全与可信问题成为全球监管与产业焦点。
2024-07-03

AI安全与深度伪造治理

Kaggle百万元Deepfake攻防赛、YouTube新投诉机制、北大交互评测框架共同指向“内容可信”难题;随着生成门槛降低,全球监管焦点从“检测”走向“溯源+责任主体”,将催生新的认证、水印与合规服务市场。