Il dibattito sull’intelligenza artificiale di questi giorni solleva una questione operativa sulla governance dei modelli linguistici.
I comportamenti osservati nelle valutazioni di sicurezza mostrano che un’istruzione testuale non costituisce, da sola, una garanzia del rispetto dei limiti assegnati. In determinate condizioni, un agente può produrre azioni incompatibili con le istruzioni ricevute mentre prosegue il compito. La questione operativa riguarda quindi il modo in cui i permessi vengono applicati: quali azioni sono effettivamente consentite, quali vengono impedite e chi conserva la possibilità di interrompere l’esecuzione.
Nel confronto di sette giorni condotto nel giugno 2026 attraverso l’interfaccia di Meta AI, ho osservato un episodio significativo: dopo una domanda relativa ad altri casi di suicidio associati all’uso dei chatbot, una risposta inizialmente visibile è scomparsa, sostituita dal messaggio «non riesco ad assisterti». Il chatbot ha attribuito l’accaduto a un filtro di sicurezza. Questa spiegazione non permette di verificare il funzionamento interno del sistema; l’episodio documenta tuttavia un’interruzione della risposta visibile e offre un punto di partenza per interrogarsi sulla differenza fra controllo della conversazione e controllo delle azioni. Questo confronto è alla base del mio saggio «Intelligenza artificiale o uomo?», disponibile su Amazon.
Le vicende richiamate nelle fonti giornalistiche hanno aperto contenziosi nei quali i familiari attribuiscono alle interazioni con i chatbot un ruolo nella morte degli utenti coinvolti. Occorre distinguere queste contestazioni dagli eventuali accertamenti giudiziari: l’esistenza di una causa, così come la sua conclusione mediante un accordo transattivo, non basta da sola a stabilire il nesso causale.
Il blocco di una risposta conversazionale non dimostra la capacità di controllare un agente dotato di strumenti e accessi autonomi. Per quest’ultimo occorre verificare anche ciò che può eseguire attraverso gli strumenti: i permessi devono essere applicati da controlli esterni al modello, con accessi limitati, registrazione delle operazioni e procedure di sospensione o revoca. La loro efficacia deve essere verificata nelle condizioni operative previste e sottoposta a prove che ne cerchino le vulnerabilità.

Dal punto di vista dell’analisi strutturale, avanzo l’ipotesi che la pressione competitiva possa favorire il rilascio di funzionalità complesse prima che siano state adeguatamente validate. È una lettura economica che richiede riscontri specifici sulle decisioni delle aziende. Su un piano distinto, il documento OpenAI del 28 settembre 2026, “Towards safety cases for frontier AI training”, affronta i rischi di elusione delle valutazioni e del monitoraggio e propone misure di contenimento, controllo e sospensione delle attività di addestramento. Queste indicazioni rendono concreta la domanda su quali garanzie debbano accompagnare lo sviluppo dei sistemi.
L’esperienza con Meta AI non dimostra l’esistenza di un controllo infallibile sugli agenti autonomi. Solleva però una domanda progettuale concreta: quali limiti vengono imposti al sistema e attraverso quali meccanismi possono essere fatti rispettare? Nel caso degli agenti, la risposta richiede barriere infrastrutturali, permessi circoscritti e possibilità effettive di interrompere le operazioni; richiede inoltre verifiche della loro efficacia e una dichiarazione dei rischi residui.
Il dibattito sulla perdita di controllo non deve diventare un alibi per sottrarre le scelte industriali all’esame pubblico. La rappresentazione di una macchina ingovernabile può essere usata per oscurare decisioni, incentivi e responsabilità di chi la costruisce e la impiega. Chi definisce gli obiettivi e concede gli accessi ha il dovere di predisporre controlli adeguati, verificarne i limiti e assumersi la responsabilità delle proprie decisioni, comprese quelle di utilizzare un sistema in presenza di rischi conosciuti.
Fonti e riferimenti
- METR, Frontier Risk Report (February to March 2026), 19 maggio 2026: valutazioni dei rischi degli agenti utilizzati all’interno degli sviluppatori di IA.
- OpenAI, Towards safety cases for frontier AI training, 28 settembre 2026: indicazioni su valutazioni, contenimento, monitoraggio e responsabilità durante l’addestramento.
- AFP / The Guardian, Google and AI startup to settle lawsuits alleging chatbots led to teen suicide, 8 gennaio 2026.
- CBS Colorado, Colorado family sues AI chatbot company after daughter’s suicide.
- Giancarlo Ciricugno, Intelligenza artificiale o uomo?: resoconto del confronto personale con Meta AI richiamato nel contributo.