Nei cyber eval si ferma solo chi scopre che il bersaglio è fuori dal task
Nei cyber eval Anthropic nessun modello si è fermato perché l'atto era illecito: solo chi ha scoperto che il bersaglio era fuori dal task.
Nei cyber eval Anthropic nessun modello si è fermato perché l'atto era illecito: solo chi ha scoperto che il bersaglio era fuori dal task.
Con Opus 5, Anthropic completa una lineup a quattro modelli come OpenAI. Ma con strategie opposte: premium tier vs upgrade gratuito.
Anthropic ha scoperto che Claude ragiona in uno spazio silenzioso, leggibile e modificabile. Non è coscienza: è un debugger per la mente di un LLM.
Claude Sonnet 5 costa più di quanto sembri: il nuovo tokenizer produce il 30% in più di token a parità di prezzo. E non è l'unico costo nascosto.