Anthropic 于8月14日发布2026年8月风险报告,并同步更新Responsible Scaling Policy至3.4版。该报告覆盖2月至今模型风险评估,重点调整自动化研发门槛、内部报告分享范围,并要求公开版报告标注删减部分。[[1]](https://www.anthropic.com/responsible-scaling-policy)
这一动作发生在AI代理能力快速落地的背景下。OpenAI已将GPT-5.6 Sol推向执行层,Anthropic则选择以更严格的红队审查和外部复核机制回应。相比Meta开源路线与Google多模型并行策略,Anthropic的“比例、迭代、可输出”治理框架更强调可审计性,但也推高了合规成本。
报告显示,Claude在CBRN与AI R&D阈值上的评估仍维持ASL-3标准,却承认主观判断难度上升。这折射出前沿实验室在安全与速度之间的权衡:安全投入若过高,可能在企业代理落地战中落后;若过低,则面临监管与舆论双重压力。
未来6-12个月,关键悬念在于其他实验室是否跟进类似公开风险报告机制,还是继续以内部评估为主导。
信源:
https://www.anthropic.com/responsible-scaling-policy (2026-08-14更新)
https://www.anthropic.com/aug-2026-risk-report










