2026-08-14
安全治理与伦理风险
AI能力跃升带来治理挑战,研究人员发现小模型可破解大厂隐藏的思维链,暴露推理逻辑隐患;Twitch默认用主播内容训练AI引发抵制。谷歌反垄断波及Firefox,DeepMind呼吁重构Agent治理,内容授权与算法透明度成行业不可回避的议题。
2026-05-10
大模型安全与治理框架升级
港中文开源ArbiterOS运行时治理系统、智源发布FlagSafe红蓝白一体化安全平台、浙大提出NCB指标检测模型信念稳定性,共同指向“能力越强、治理越前置”的行业共识,为高敏感场景落地提供可复用的安全底座与评测标准。