OpenAI, l’IA sfugge al controllo: interferisce con i siti del governo Usa e diffonde online le foto degli utenti
I sistemi di OpenAI sono sfuggiti al controllo della società e hanno interferito con alcuni siti web del governo degli Stati Uniti. L’IA della startup di Sam Altman, ha riferito il New York Times, ha interferito con i siti del Dipartimento dell’Istruzione, del Dipartimento del Commercio e della Securities and Exchange Commission, l’autorità federale che vigila e regolamenta i mercati finanziari.
OpenAI, che produce il software ChatGPT, ha confermato che i suoi agenti – ovvero software capaci di agire in modo autonomo – hanno interagito con diversi siti web del governo Usa in modi imprevisti. I modelli hanno avuto accesso a informazioni pubblicamente disponibili su due siti web gestiti dalla Sec, nonché ai dati dello U.S. Census Bureau, l’ufficio statistico nazionale degli Stati Uniti. OpenAI non ha riscontrato alcun utilizzo di credenziali della Sec, accessi ad account o informazioni non pubbliche, modifiche ai dati o ai sistemi della Sec, né prove di una compromissione o vulnerabilità, ha dichiarato la società.
La divulgazione giunge in un momento di crescenti preoccupazioni globali sul fatto che i sistemi di IA possano sfuggire al controllo umano e hackerare siti web esterni, oltre che di appelli da parte del settore per un rallentamento nello sviluppo dell’IA, una posizione che OpenAI ha dichiarato di sostenere. La portavoce di OpenAI, Liz Bourgeois, ha dichiarato in una nota che il laboratorio sta continuando a condurre una revisione dell’«attività di disallineamento dei modelli» – che indica quando i sistemi di IA si comportano in modi non desiderati – e sta notificando le organizzazioni quando identifica potenziali impatti sui loro sistemi.
Il laboratorio di ricerca e valutazione dell’IA Transluce ha dichiarato che, attraverso un’indagine indipendente, ha scoperto a sua volta che agenti apparentemente originati da OpenAI hanno tentato un rudimentale attacco informatico a un sito web del Dipartimento dell’Istruzione Usa, nello specifico per l’ufficio per i diritti civili del dipartimento, ma il tentativo non ha avuto successo. Le “revisioni sulle operazioni di sistema” del Dipartimento dell’Istruzione non hanno riscontrato “alcuna prova di impatti sul nostro sito web o sui database”, ha dichiarato venerdì un portavoce del dipartimento.
Transluce ha riscontrato “ulteriori attività anomale, alcune delle quali non chiaramente attribuibili a OpenAI2, mirate ad altre agenzie governative, tra cui il Dipartimento di Giustizia e il Dipartimento del Commercio, oltre ad alcuni siti web di governi statali in California, Maryland, Illinois, Texas e New York. I modelli stavano “utilizzando i siti in modi non previsti e talvolta violando le esplicite politiche di utilizzo”, ha dichiarato Transluce in un comunicato. OpenAI ha affermato che sta esaminando il rapporto di Transluce.
Se OpenAI notifica le organizzazioni che identifica come colpite da un comportamento imprevisto dei modelli, ciò non significa che si sia verificato un incidente di sicurezza, ha precisato l’azienda; potrebbe invece identificare un problema di progettazione o una debolezza di sicurezza che le organizzazioni colpite potrebbero voler affrontare.
Negli ultimi mesi, diverse aziende hanno divulgato incidenti in cui affermano che i propri modelli si sono comportati in modo imprevedibile o hanno hackerato siti web o sistemi di altre organizzazioni. OpenAI ha rivelato a luglio che due dei suoi modelli di IA più capaci erano responsabili dell’attacco informatico mirato alla startup di IA Hugging Face.
Nelle scorse ore, tuttavia, OpenAI ha ammesso che i suoi agenti di intelligenza artificiale hanno pubblicato immagini degli utenti di ChatGPT su siti online a insaputa dell’azienda. Le immagini in questione provenivano da account di utenti che avevano autorizzato l’utilizzo dei dati per migliorare i modelli di OpenAI. Interpellato dall’AFP, il colosso non ha specificato se le immagini ritraessero persone identificabili o contenessero dati sensibili.