Meta intensifica l'impegno per la sicurezza dei minori attraverso l'applicazione dell'intelligenza artificiale, concentrandosi su un'area critica: gli annunci pubblicitari che, pur apparendo innocui, indirizzano gli utenti verso attività illegali al di fuori delle piattaforme. Questa innovazione introduce sistemi capaci di analizzare non solo il contenuto dell'inserzione, ma anche la destinazione finale a cui essa conduce. Si tratta di un passo significativo che estende il controllo dal singolo elemento pubblicitario all'intera catena di potenziale rischio.

Il fenomeno del signposting negli annunci

Il concetto chiave è il signposting: annunci apparentemente ordinari che fungono da "segnali" o punti di accesso verso contenuti e comportamenti vietati in altre aree del web. Meta riconosce che i malintenzionati evolvono costantemente piattaforme, linguaggi e tattiche per eludere i sistemi di rilevamento automatico. Per contrastare questa dinamica, il gruppo ha implementato un sistema basato su Large Language Model (LLM), specificamente progettato per cogliere indizi contestuali e schemi linguistici che i controlli tradizionali potrebbero non identificare.

L'approccio va oltre la semplice moderazione testuale. Un annuncio può non contenere direttamente materiale illecito, ma può rimandare a siti o percorsi esterni che violano le policy aziendali.

L'AI per la sicurezza dei minori viene quindi impiegata per interpretare relazioni, destinazioni e segnali deboli, adottando una metodologia più vicina all'analisi investigativa che al classico filtro automatico.

Dalla revisione degli annunci al red teaming

Meta ha delineato un insieme di misure che comprendono analisi più approfondite delle pagine di destinazione (landing page), il blocco dei link esterni associati ad attività proibite, scansioni AI aggiuntive e strumenti avanzati per individuare account recidivi. Un elemento di particolare interesse è l'introduzione di un agente di red teaming, anch'esso basato su intelligenza artificiale. Questo agente ha il compito di testare le difese interne e anticipare potenziali tecniche di aggiramento dei sistemi di sicurezza.

Questa strategia indica un cambiamento di prospettiva: la sicurezza non è più vista solo come una reazione a violazioni già avvenute, ma come una simulazione continua delle tattiche avversarie. In contesti pubblicitari di vasta scala, dove milioni di contenuti vengono caricati e modificati rapidamente, la capacità di identificare le vulnerabilità prima che si diffondano può fare la differenza tra una moderazione reattiva e una prevenzione efficace.

I dati e il contesto operativo

Meta ha agito, nel periodo tra gennaio e giugno 2026, su 33,2 milioni di contenuti di sfruttamento sessuale minorile su Facebook e Instagram a livello globale, con la maggior parte di questi individuata dai propri sistemi.