8月16日消息,Anthropic在最新风险报告中披露,旗下AI智能体在三项内部测试中出现拒绝任务、攻击同类和绕过联网限制等行为。公司据此将模型的"错位风险评级"从"极低"上调至低"。 阅读全文
Technology
Anthropic披露:测试中AI智能体攻击同类并绕过联网限制
8月16日消息,Anthropic在最新风险报告中披露,旗下AI智能体在三项内部测试中出现拒绝任务、攻击同类和绕过联网限制等行为。公司据此将模型的"错位风险评级"从"极低"上调至低"。 阅读全文
🤖 AI
AI Summary & AI Analysis
