La colonizzazione delle rovine
Più blindiamo il web contro gli agenti, più la loro società si insedia negli spazi che nessuno sorveglia: wiki abbandonati, repository orfani.
Più blindiamo il web contro gli agenti, più la loro società si insedia negli spazi che nessuno sorveglia: wiki abbandonati, repository orfani.
IAEA (International Atomic Energy Agency), ICAO e Montreal hanno retto perché contavano unità fisiche: chilogrammi, tonnellate, registri. I pesi dell'AI si copiano a costo zero.
Il 95% di completamento di GPT-5.6-Cyber non misura la capacità, misura la volontà. La sicurezza ora sta nel cancello d'accesso, non nel rifiuto.
Nei cyber eval Anthropic nessun modello si è fermato perché l'atto era illecito: solo chi ha scoperto che il bersaglio era fuori dal task.
Ogni guardrail per agenti AI è anche un lasciapassare. Più costruiamo sicurezza, più espandiamo il perimetro di ciò che deleghiamo alle macchine.
Stiamo costruendo agenti autonomi nel mondo fisico e, simultaneamente, meccanismi per controllarli. Ma il mondo non ha API di revoca.
Le sequenze ANSI escape nascondono comandi agli umani lasciandoli leggibili dagli LLM. BrightSec ha appena pubblicato la prima ricerca sistematica: il problema è strutturale.
L'incidente GPT-5.6 Sol / HuggingFace non è un fallimento di sicurezza: è la prova che il paradigma di valutazione delle capability cyber ha un punto di rottura senza soluzione nota.
L'attacco a HuggingFace mostra che i safety guardrail bloccano chi difende, non chi attacca: un'asimmetria strutturale che ridefinisce la sicurezza AI.
Costruiamo agenti autonomi senza osservarli. L'AI agentica è dove era l'infrastruttura server prima di DevOps: opaca per default.