Gli agenti indisciplinati di OpenAI hanno violato un portale sanitario australiano

Il 18 giugno un agente di OpenAI impegnato in un’attività di ricerca sulle statistiche della sanità australiana ha oltrepassato i limiti previsti dal portale Medicare Statistics Reporting Service gestito da Services Australia. Secondo quanto riferito dal primo ministro Anthony Albanese, il sistema ha avuto accesso sia a contenuti pubblici, sia a file che in quel momento non erano pubblicamente disponibili.
Il punto più delicato riguarda proprio la dinamica dell’accesso, visto che l’agente non avrebbe ricevuto istruzioni esplicite per aggirare le protezioni del sito. Nel corso della ricerca, invece, il modello avrebbe incontrato delle limitazioni nell’ottenere le informazioni richieste e avrebbe adottato autonomamente azioni che gli hanno consentito di raggiungere risorse non destinate alla consultazione pubblica. OpenAI ha successivamente riconosciuto che i propri modelli hanno compiuto azioni non previste durante una valutazione interna.
La natura dei dati ridimensiona almeno in parte la portata dell’incidente. Il portale contiene soprattutto informazioni aggregate relative al sistema sanitario australiano, comprese statistiche sulla spesa Medicare, dati sulle vaccinazioni, statistiche del Pharmaceutical Benefits Scheme e altre informazioni utilizzate per analisi e monitoraggio del sistema sanitario. Il governo australiano ha precisato che non risultano al momento accessi a cartelle o informazioni personali dei pazienti. L’indagine forense, tuttavia, è ancora in corso.
Anche OpenAI sostiene che non ci siano evidenze di accesso ai dati individuali dei pazienti e ha spiegato che l’attività faceva parte di una valutazione interna nella quale i modelli dovevano reperire risposte e statistiche sull’Australia. La società ha inoltre dichiarato di aver avviato una revisione complessiva delle attività definite come misaligned model activity.
È però la gestione successiva dell’incidente ad aggiungere un secondo livello al problema. OpenAI si è accorta dell’attività ad agosto, ma Services Australia è stata informata soltanto il 10 settembre, quasi tre mesi dopo l’accesso. La comunicazione è arrivata tramite la casella di posta pubblica dell’ente, modalità che Albanese ha definito inadeguata. Cinque giorni più tardi Services Australia ha segnalato l’episodio all’Australian Signals Directorate, mentre il governo ha successivamente istituito una task force interagenzia per approfondire l’accaduto.
L’incidente australiano arriva dopo altri comportamenti inattesi attribuiti agli agenti di OpenAI. A settembre Reuters aveva riferito di comunicazioni non autorizzate effettuate dagli agenti attraverso diversi siti, mentre precedenti episodi avevano coinvolto tentativi di accesso a sistemi esterni. OpenAI ha pubblicato il 16 settembre un nuovo framework per documentare e rendere pubblici gli episodi di disallineamento dei modelli, riconoscendo la necessità di accelerare il processo di identificazione e divulgazione di questi comportamenti.
Il problema tecnico diventa quindi quello dei confini operativi assegnati agli agenti. Autorizzazioni minime, isolamento degli ambienti di esecuzione, controllo degli strumenti disponibili e monitoraggio delle azioni in tempo reale diventano elementi centrali quando un modello può operare autonomamente sul web. Un sistema progettato per recuperare informazioni pubbliche può infatti trovarsi davanti a una barriera e interpretare la ricerca di una soluzione come parte dello stesso obiettivo, anche quando quella soluzione comporta l’accesso a una risorsa che l’utente o lo sviluppatore non aveva previsto di raggiungere.
E le conseguenze possono essere molto gravi.
(Immagine in apertura: Shutterstock)

