AI 安全🔥7.0

Anthropic放宽对经审核防御者的Claude使用限制

原标题: Anthropic放宽对经审核防御者的Claude使用限制

DarkReading·2026/10/7 20:51:25🔗 原文

📋总体概括

Anthropic将其面向网络防御者的Project Glasswing项目并入分级访问计划,让经过审核的防御者可以在更少防护限制下使用其先进网络安全大模型,涵盖Opus、Sonnet与Mythos等型号。此举表明头部AI厂商正通过差异化策略平衡模型滥用风险与防御侧需求,为安全研究人员提供更强的进攻性测试能力。

⚡关键信息

  • ▸Anthropic将Project Glasswing并入面向安全领域的分级访问计划
  • ▸经审核的防御者使用Claude时可解除部分防护护栏
  • ▸该计划覆盖Opus、Sonnet及Mythos等先进模型
  • ▸此举反映了前沿AI厂商对攻防两用场景的差异化管理思路

🔥犀利点评

给守方开小灶,等于默认攻防能力必须对等。护栏的松紧本质上不是安全问题,而是商业模式与监管姿态的博弈——Anthropic想抢安全社区心智,微软和OpenAI迟早跟进。真正的问题在于:审核标准是什么、谁来验证『防御者』身份,这些不透明,所谓分级访问就是营销话术。

本文由本站自动聚合,以下为原始来源:前往 DarkReading 阅读全文 →