Vai al contenuto

Agenti: come l'AI Act li ha gestiti senza nominarli

L'AI Act non nomina gli agenti: li copre con le definizioni esistenti. Autonomia e tool use diventano criteri di rischio sistemico.

Nel dibattito "agente AI" significa tutto e niente: un chatbot con accesso a una API, un orchestratore di task, un sistema che pianifica e compra.

La Commissione europea ha risposto a questa confusione in un modo che sembra un'astensione e invece è una decisione: gli agenti non sono una categoria nuova dell'AI Act, ma le definizioni esistenti sono sufficienti a coprirli, e il livello di autonomia è diventato un fatto giuridico prima ancora che una metrica tecnica.

Chi distribuisce agenti in UE è già nel perimetro regolatorio, anche con modelli medi.

La non-categoria: nessuna voce "agente" nel testo

La FAQ dell'AI Act Service Desk dedica una sezione alla domanda "come sono trattati gli agenti AI nell'AI Act" e la risposta è tecnicamente netta: il termine "AI agent" non è definito legalmente, ma un agente contiene tipicamente un modello GPAI e costituisce un sistema AI, perché ha un'interfaccia considerata componente del sistema. Le due definizioni portanti del regolamento bastano: il sistema AI dell'articolo 3(1) e il modello GPAI dell'articolo 3(63).

In pratica: le regole che si applicano ai sistemi AI e ai modelli GPAI si applicano anche agli agenti, senza bisogno di una voce dedicata.

💡
L'articolo 3, punto 63, dell'AI Act (Reg. UE 2024/1689) definisce formalmente il modello GPAI come un sistema caratterizzato da significativa generalità, capace di eseguire un'ampia gamma di compiti distinti e di essere integrato in differenti applicazioni a valle.

La scelta non è casuale: il legislatore europeo ha costruito l'AI Act su categorie funzionali (sistema, modello, deployer, provider) proprio per non inseguire le etichette di mercato.

Un agente è regolato per quello che fa, non per come si chiama. Un agente che usa strumenti e compie azioni è un sistema AI ai sensi dell'articolo 3, con tutti gli obblighi che ne conseguono, dalla trasparenza dell'articolo 50 in giù.

La conseguenza giuridica: autonomia e tool use come criteri di rischio

Il punto che cambia la partita sta nella designazione dei modelli a rischio sistemico.

La soglia quantitativa è nota: un modello GPAI è presunto ad alto impatto quando il calcolo cumulativo di training supera i 10^25 FLOP (articolo 51(2)). Ma la FAQ ufficiale aggiunge un secondo binario che finora è passato sotto traccia: "fattori come il livello di autonomia o l'uso di strumenti del modello possono essere decisivi nella designazione del modello come modello con rischio sistemico", sulla base dell'articolo 51(1)(b) e dell'allegato XIII, punto (e).

La soglia FLOP non è più l'unico metro: Un modello di medie dimensioni, sotto i 10^25 FLOP, può essere designato come a rischio sistemico se le sue capacità agentiche lo rendono di fatto equiparabile ai modelli di frontiera. Il perimetro si allarga esattamente dove il mercato pensava di stare fuori.

Cosa dice l'allegato XIII, punto (e)

L'allegato XIII elenca i criteri qualitativi che la Commissione considera per designare un modello come a rischio sistemico al di là della soglia FLOP: numero di parametri, qualità dei dati, modalità di input e output, benchmark di capacità e, appunto al punto (e), i risultati delle valutazioni su capacità considerate ad alto impatto.

La FAQ rende esplicito che l'autonomia agentica e il tool use rientrano in questa valutazione.

La conseguenza è concreta e riguarda una fascia di mercato che finora si sentiva fuori dal radar: un modello di medie dimensioni, sotto la soglia dei 10^25 FLOP, può essere designato come a rischio sistemico se le sue capacità agentiche (pianificazione, uso di strumenti, esecuzione autonoma) lo rendono di fatto equiparabile ai modelli di frontiera.

Il GPAI Code of Practice, versione finale di luglio 2025, operazionalizza questa lettura: le misure sulla gestione del rischio sistemico, in particolare la misura 5.1 punto 7 e le appendici 1.3.1, 1.3.3 e 3.2 del capitolo Safety and Security, chiedono ai firmatari di considerare le capacità autonome del modello e il suo uso agentico nella valutazione dei rischi sistemici.

L'enforcement è già attivo

Da agosto 2026 la Commissione, tramite l'AI Office, ha poteri di enforcement sui fornitori di modelli GPAI, come conferma la pagina del quadro regolatorio: richieste di documentazione tecnica, accesso ai modelli per valutazioni, misure correttive e multe fino a 15 milioni di euro o al 3% del fatturato annuo globale, se superiore, ai sensi dell'articolo 101.

La FAQ precisa la strategia: il primo strumento resta il dialogo tecnico di conformità, ma i poteri formali ci sono e possono essere usati quando i dialoghi non bastano.

Il punto per chi lavora con gli agenti è che la designazione a rischio sistemico non è più una questione di FLOP: può partire da una decisione della Commissione basata sulle capacità agentiche, e da lì gli obblighi aggiuntivi dell'articolo 55 (valutazioni, mitigazione dei rischi, incident reporting) scattano in pieno.

Chi distribuisce agenti in UE deve quindi verificare non solo il modello sottostante, ma come quel modello viene impacchettato: lo stesso modello può essere fuori perimetro come API generica e dentro come base di un agente autonomo.

Il segnale dei soldi

L'AI Office ha lanciato un bando da 9 milioni di euro per il supporto tecnico alla valutazione della sicurezza dei modelli GPAI, articolato in sei lotti. I primi cinque coprono rischi classici (CBRN, cyber, perdita di controllo, manipolazione, rischi sociotecnici). Il sesto è la novità: supporto trasversale per "valutazioni agentiche", con focus sul comportamento autonomo dei modelli in task dinamici o a obiettivi aperti.

In pratica: la Commissione sta comprando la capacità di misurare l'autonomia degli agenti prima ancora che una metrica di autonomia esista formalmente.

Il lotto 6 del tender e la sezione agenti della FAQ sono lo stesso gesto su due piani diversi: il regolatore dice che gli agenti sono nel perimetro (piano giuridico) e nel frattempo costruisce gli strumenti per valutarli (piano tecnico).

Cosa significa per chi costruisce agenti

Messi in fila, i segnali disegnano un perimetro più largo di quello che la discussione sui FLOP lasciava intendere.

Chi distribuisce agenti in UE ha tre verifiche da fare subito:

  1. Qual è il modello sottostante e se supera la soglia quantitativa (10^25 FLOP).
  2. Se le capacità agentiche del modello, autonomia e tool use, possono giustificare una designazione qualitativa ai sensi dell'articolo 51(1)(b).
  3. Quali obblighi di trasparenza scattano perché l'agente interagisce con persone fisiche, dal 2 agosto 2026.

La macchina sanzionatoria è pronta, ma ciò che si può documentare viene prima di ciò che si può misurare: le carte si verificano in un procedimento, mentre l’autonomia di un agente no, perché non esiste ancora una metrica che possa convincere un funzionario.

Presto verrà definita quella metrica e, per chi vuole stare tranquillo, c’è solo una cosa da fare: mantenere la documentazione in ordine, perché da lì inizierà il controllo.

Further Reading

AI Act Service Desk - Frequently Asked Questions
AI Act
The AI Act is the first-ever legal framework on AI, which addresses the risks of AI and positions Europe to play a leading role globally.
Code of Practice | EU AI Act
The General-Purpose AI Code of Practice under Article 56 of the EU AI Act — its chapters, commitments, and working groups in a readable explorer.
EU AI Office Launches €9 million tender for Technical Support on GPAI Safety
The AI Office has launched a call for tenders to procure technical support for the enforcement of the AI Act, focusing on assessing and monitoring systemic risks posed by General-Purpose AI (GPAI) models at EU level.
EU AI Act Enforcement Phase Begins
On August 2, 2026, the European Commission (EC), acting through its European AI Office (EU AI Office), became formally entitled to exercise its powers to investigate and enforce the EU AI Act…
Condividi