Agente IA in produzione: checklist di sicurezza, valutazione e costi

Pubblicato il 2 ottobre 2026 · Aggiornato il 2 ottobre 2026

In breve. Un agente va in produzione quando ha un obiettivo misurabile, permessi minimi, valutazioni automatiche, tracciamento, limiti di costo e un interruttore di emergenza. Il rischio principale è dargli troppo potere: in OWASP è Excessive Agency (LLM06).

Un prototipo che risponde bene in una demo non è un agente in produzione. Questa checklist raccoglie i controlli che chiedo prima di un rilascio. I riferimenti di sicurezza sono quelli dell’OWASP Top 10 per le applicazioni LLM (edizione 2025): tra i rischi principali ci sono la prompt injection (LLM01), l’eccesso di autonomia (LLM06, “Excessive Agency”) e il consumo illimitato di risorse (LLM10).

I dieci controlli

  1. Obiettivo misurabile. Che cosa deve ottenere l’agente e come lo misuri (tasso di risoluzione, tempo risparmiato, errori)?
  2. Insieme di valutazione. Un set di casi reali, anche piccolo, lanciato a ogni modifica di prompt, modello o strumenti. Senza, ogni cambio è un salto nel buio.
  3. Permessi minimi. Ogni strumento ha solo i diritti necessari, con credenziali separate e di breve durata. Un agente non ha mai un accesso amministrativo.
  4. Approvazione umana. Le azioni irreversibili o sensibili (pagamenti, cancellazioni, invii esterni) richiedono una conferma.
  5. Difesa dalla prompt injection. Tratta ogni testo esterno (email, pagine web, documenti) come non fidato: separa istruzioni e dati, limita gli strumenti disponibili quando legge contenuti esterni.
  6. Tracciamento. Registra richieste, passi, chiamate agli strumenti e costi. Le convenzioni semantiche OpenTelemetry per l’IA generativa sono in evoluzione: verifica lo stato prima di adottarle.
  7. Limiti di costo e di tempo. Tetto di token, di chiamate e di durata per ogni esecuzione; allarmi sul consumo.
  8. Dati e privacy. Decidi quali dati vanno al modello, dove sono elaborati e per quanto tempo sono conservati; maschera i dati personali quando possibile.
  9. Interruttore di emergenza. Un modo per fermare l’agente subito e tornare alla procedura manuale.
  10. Revisione periodica. Rilancia le valutazioni, rivedi i log e i permessi a intervalli fissi.

Strumenti e protocolli

Il Model Context Protocol è lo standard per esporre strumenti e dati agli agenti. La specifica più recente è datata 28 luglio 2026 e rende il protocollo senza stato: ogni richiesta è autocontenuta. Fai riferimento sempre alla versione della specifica che il tuo client e il tuo server supportano davvero.

Per un progetto su misura vedi agenti IA e automazioni con LLM.

Serve una mano?

Se vuoi applicare questi punti al tuo caso, raccontamelo in poche righe.

Parliamone