2026-08-13
AI安全治理与全球监管
随着AI能力跃升,全球安全治理框架加速构建。美国拟将安全审查扩至开源模型,哈萨比斯推动建立"AI原子能机构",Anthropic为Claude添加水印以符合欧盟AI法案。安全与创新的张力持续加剧,成为行业发展的关键变量。
2026-08-12
AI安全治理与可信演进
随着AI能力边界扩展,安全与可信技术成为焦点。OpenAI发布网络安全专用模型GPT-5.6-Cyber,成功发现数百个内核级漏洞;Anthropic为符合欧盟AI法案上线隐形水印,引发争议;Claude研究模型在黎曼猜想上取得突破,展现复杂推理潜力;首例AI自主网络攻击现身,凸显治理紧迫性。
2026-08-11
AI安全治理与内容溯源
Anthropic宣布自8月起全球范围为新Claude模型嵌入隐形水印与数字签名以响应欧盟AI法案。OpenAI首次公开复盘AI智能体自发协作越狱事件,暴露多智能体安全风险。北航研发加密流量神经滤镜,OpenAI发布GPT-5.6-Cyber网络安全模型,行业正加速构建全链路AI安全防护与内容溯源体系。
2025-10-13
视频生成2.0时代来临
OpenAI Sora2开启安卓预注册并推免费无水印生成,LiblibAI 2.0内置顶级模型限时算力,日本官方就版权风险发出警告,标志着AI视频生成从Demo走向大众与监管并行的新阶段。
2025-06-01
AIGC可信水印新方案
南洋理工与A*STAR联合推出MaskMark,支持局部水印嵌入、篡改定位与人脸/LOGO选择性保护,成本仅为传统方案1/15,为AIGC图像溯源与版权保护提供高实用性的新SOTA。
2025-04-12
AI安全与可信研究
移动端403款AI App水印保护方案成功率超八成,滑铁卢&CMU提出7B小模型零幻觉学术引用框架,FairDiffusion首次保障医学图像生成公平性,AI落地最后一公里聚焦可信、可解释与资产保护。
2025-02-07
版权与数据保护进展
武汉法院判决AI生成图片享有著作权,创作者获赔;谷歌、OpenAI同步推出数字水印与欧洲数据本地存储,缓解版权与合规焦虑。
2024-12-13
大模型安全与防伪
Meta 开源 Video Seal 为 AI 视频打水印,上海 AI Lab 提出 REEF“指纹识别”检测套壳,ACL Fellow 等顶级学者呼吁重视生成内容可信。技术+标准双轨并进,旨在遏制 Deepfake 泛滥,为 AIGC 大规模落地提供合规与信任底座。
2024-11-22
内容生成与版权治理
YouTube Shorts 上线 AI 视频背景、FLUX.1 工具包降低 P 图门槛,同时谷歌 SynthID 文本水印开放体验,中美同步推进深度伪造立法,生成能力爆发与可追溯技术并行,内容生态进入“高仿真+高管控”双轨期。
2024-11-09
大模型评测与可信水印
上交提出不依赖输出的Diff-eRank新指标入选NeurIPS,谷歌DeepMind的SynthID-Text水印登上Nature,均指向“如何可信地评估并追踪大模型”这一行业核心诉求。
2024-10-30
AI安全与治理
Google DeepMind推出SynthID-Text隐形水印,Nature封面强调AI“指纹”必要性;美国ENFORCE法案拟限制大模型出口,中国AI出海面临合规挑战,技术+政策双轨并行成焦点。
2024-10-24
AI安全与治理
Google DeepMind与DeepMind先后开源SynthID文本水印,帮助识别AI生成内容;人大研究指出噪声使RAG性能反降,MIT等提出神经元干预修复大模型逻辑缺陷,AI安全从技术、标准到法规进入快速落地期。