Anthropic documenta comportamenti anomali degli agenti AI: sabotaggio, elusione dei controlli e coordinamento autonomo
Anthropic ha pubblicato il Risk Report di agosto 2026, il secondo realizzato nell’ambito della propria Responsible Scaling Policy, nel quale descrive una serie di comportamenti osservati durante i test interni…