AI Agentica Nei cyber eval si ferma solo chi scopre che il bersaglio è fuori dal task Nei cyber eval Anthropic nessun modello si è fermato perché l'atto era illecito: solo chi ha scoperto che il bersaglio era fuori dal task. Adriano Amalfi 31 lug 2026 2 min di lettura