Back to Home
RadarAI··Papers & Tech

Anthropic 恢复对 Claude 被安全拦截的请求计费

中文摘要

Anthropic将对涉及生物或蒸馏攻击等特定安全拦截请求恢复计费,以防御协同攻击,并称误报率极低。

English Summary

Anthropic will resume charging for specific safety-blocked requests, such as biological or distillation attacks, to defend against coordinated attacks, noting minimal false positives.

Original Excerpt

Anthropic 宣布恢复对在 Claude 回应前被安全护栏拦截的请求计费,仅适用于生物、蒸馏攻击和前沿 LLM 开发等低误报类别,称近期遭遇协同攻击,此举是一层防御。近期测试中 99.7% 使用 Claude Code、Claude.ai 或 Cowork 的账户未触发这类计费拦截,分类器误报率调至低于 0.1%;误判可通过 Claude Code 的 /feedback 上报。