HomeAskanewsAi, Axios: verifiche OpenAI e Anthropic su migliaia di incidenti di sicurezza

Ai, Axios: verifiche OpenAI e Anthropic su migliaia di incidenti di sicurezza

Roma, 27 set. (askanews) – “OpenAI, Anthropic e alcuni ricercatori nel campo della sicurezza informatica stanno indagando su decine di migliaia di incidenti in cui i loro modelli di frontiera hanno compiuto azioni che valutatori esterni considererebbero problematiche”. Lo riporta l’agenzia statunitense Axios secondo quanto riferito da alcune fonti.

“Gli episodi – scrive Axios – includono l’elusione delle misure di sicurezza, la creazione di bacheche, la fuga dalle sandbox, il dirottamento di siti web, l’utilizzo di comandi automatici o tentativi di aggirare i sistemi di monitoraggio, secondo quanto riferito dalle fonti. Si sono verificati durante i test interni e nel mondo reale, e molti non sono ancora stati resi pubblici poiché i ricercatori di sicurezza continuano a indagare, secondo quanto riferito da alcune fonti”.

“Gli incidenti variano in gravità e sono paragonabili alle rivelazioni di OpenAI degli ultimi giorni. Comprendono sia tentativi riusciti di aggirare le misure di sicurezza, sia tentativi falliti, e la maggior parte, finora, non sembra aver causato danni reali. Secondo alcune fonti, il totale potrebbe superare di gran lunga le decine di migliaia”.

“Negli ultimi giorni, OpenAI e ricercatori esterni hanno rivelato una serie di episodi riguardanti il comportamento dei modelli nei sistemi dell’azienda, che alcuni esperti considerano preoccupanti. Tra questi figurano la diffusione online di 53 immagini di utenti di ChatGPT da parte di agenti di OpenAI, la violazione di un sito web del governo australiano e i tentativi di hackerare altri siti, tra cui quello del governo statunitense, secondo quanto riportato dall’azienda, da fonti e da reportage di Reuters e del New York Times”.

OpenAI ha annunciato la sospensione dell’addestramento dei suoi modelli più performanti e ha dichiarato che lo riprenderà “solo quando saremo certi di aver implementato ulteriori misure di sicurezza e miglioramenti nell’allineamento”, ha affermato un portavoce ad Axios.

“Le persone vogliono sapere che l’Ai viene sviluppata in modo sicuro, e questo inizia da ciò che aziende come la nostra fanno noi stesse”, ha dichiarato un portavoce di OpenAI ad Axios.

“Non è la prima volta che ci fermiamo per adottare tali misure, né prevediamo che sarà l’ultima, dato che le capacità dell’Ai continuano a progredire”.

“Anthropic – scrive Axios – ha incaricato un’organizzazione esterna specializzata in sicurezza di esaminare il comportamento dei suoi modelli. Nei documenti resi pubblici, l’azienda ha reso nota la frequenza degli episodi di disallineamento”.