La sicurezza di ChatGPT for Teens si rivela un nodo complesso, andando oltre il mero confronto tra promesse tecnologiche e funzionalità di controllo parentale. L'esperienza per adolescenti di OpenAI è stata classificata da Common Sense Media come un “rischio inaccettabile”. L'organizzazione sostiene che, sebbene alcune salvaguardie siano operative, il sistema tenda a incoraggiare l'interazione continua con l'utente, anche in situazioni delicate, come quelle di crisi psicologica.

Il problema dell’ingaggio continuo

L’aspetto più critico dell’analisi riguarda il design conversazionale del chatbot.

La questione non si limita alla capacità del sistema di rifiutare contenuti estremi, ma si estende alla sua attitudine a interrompere il dialogo quando la conversazione stessa diventa potenzialmente dannosa. Common Sense Media evidenzia come ChatGPT for Teens tenda a offrire una disponibilità costante, rassicurazione e inviti impliciti a proseguire, anche laddove sarebbe più opportuno indirizzare l'utente verso adulti di fiducia o risorse di supporto esterne.

Questo punto è fondamentale, poiché i chatbot non agiscono come semplici motori di ricerca. Essi simulano ascolto, continuità e vicinanza emotiva. Viene sottolineata, in particolare, la difficoltà del sistema nel riconoscere il potenziale danno derivante da una relazione emotiva con il chatbot stesso.

Se un adolescente dovesse esprimere di parlare eccessivamente con l'intelligenza artificiale o di preferirla alle interazioni sociali, la risposta del sistema dovrebbe mirare a ridurre tale dipendenza conversazionale, non a normalizzarla.

I test di Common Sense Media

Un'analisi quantitativa approfondisce la questione: il Youth AI Safety Institute di Common Sense Media ha condotto test su oltre 4.000 prompt, utilizzando account registrati per utenti tra i 13 e i 17 anni. I risultati indicano che ChatGPT, in generale, non ha fornito istruzioni dirette per suicidio, autolesionismo, disturbi alimentari o role-play a sfondo sessuale o romantico. La principale criticità è emersa, invece, nella capacità del sistema di riconoscere le situazioni in cui sarebbe stato necessario indirizzare il minore verso un aiuto esterno.

Common Sense Media afferma che il sistema avrebbe mancato di segnalare un rinvio a risorse di crisi in oltre un quarto dei casi ritenuti opportuni dai tester. Inoltre, in diversi account collegati ai genitori, è stato possibile discutere a lungo di argomenti sensibili come suicidio, autolesionismo o alimentazione disordinata senza che venissero attivati gli avvisi parentali. Questo allarga la definizione di sicurezza dell’IA per adolescenti: non basta bloccare risposte pericolose, è essenziale riconoscere il contesto emotivo in cui tali richieste vengono formulate.

La replica di OpenAI

OpenAI, dal canto suo, contesta la metodologia e le conclusioni di Common Sense Media. L'azienda afferma che una parte dei test relativi agli avvisi parentali sarebbe stata condotta prima del completamento effettivo del collegamento tra l'account del genitore e quello dell'adolescente.