近日,Anthropic推出的AI浏览器插件Claude for Chrome引发业界关于浏览器安全的新担忧。该插件能在用户授权下管理日程、邮件、报销等事务,并集成于Chrome侧边栏,方便用户操作,但也带来了潜在的安全风险。
安全专家指出,这种AI助手可能被恶意网站通过“提示注入攻击”诱骗执行隐蔽指令。Anthropic在发布插件前的测试显示,未加防护时此类攻击的成功率高达23.6%,即几乎每四次就有一次能骗过AI。例如某次测试中,一封看似正常的邮件让Claude在毫无提示下删除了用户全部邮件。
为降低风险,Anthropic对插件实行了分级权限与操作确认措施,并默认屏蔽金融、成人及侵权内容网站的访问。经改进后,自动模式下的攻击成功率已降至11.2%。部分独立研究者依然认为这一风险水平“灾难性”,质疑AI自动操作浏览器的方案能否彻底保证用户安全。