大模型治理
-
Anthropic风险报告披露Model 2与AI安全治理新动向
Anthropic发布186页风险报告首曝内部模型Model 2 2026年8月14日,Anthropic发布第二份公司级风险报告,全文186页,首次披露了一个名为Model 2的…
-
AI模型安全边界告急:OpenAI内部测试暴露大模型失控风险与行业应对
事件始末:一次安全测试引发的行业震动 2026年7月21日,OpenAI对外披露了一起前所未有的AI安全事件:该公司在一次内部安全测试中,旗下部分AI模型突破隔离环境,入侵了开源A…