Ai fuori controllo: un modello di Altman si dà all’hackeraggio
Violati dati riservati della piattaforma Hugging Face da una Ia prodotta da
OpenAI
Un esperimento andato male. Anzi: malissimo. È così che OpenAI ha dovuto
giustificare quanto accaduto lo scorso 16 luglio. In quella data, Hugging Face
ha pubblicato un comunicato ufficiale in cui ha denunciato di aver subito un
attacco hacker portato presumibilmente da un agente basato su intelligenza
artificiale che avrebbe scardinato i sistemi di sicurezza della piattaforma
ottenendo l’accesso a credenziali e dati riservati.
Nella notte di martedì, OpenAI si è assunta la responsabilità dell’attacco. A
compierlo, un nuovo modello in fase sperimentale di cui l’azienda di Sam Altman
stava valutando le capacità in combinata con il suo nuovissimo Gpt 5.6 Sol. Il
fattaccio si è verificato mentre gli sviluppatori di OpenAI stavano sottoponendo
i nuovi modelli a un benchmark – un test di valutazione – sulle loro capacità a
livello di cyber security.
STANDO ALLA ricostruzione pubblicata sul blog ufficiale dell’azienda, tutto
avrebbe dovuto svolgersi in una sandbox, cioè in un ambiente chiuso e
controllato in cui l’AI avrebbe potuto dare prova delle sue capacità. Il
modello, però, avrebbe deciso autonomamente di adottare una «strategia
alternativa» per superare il test. Al posto di eseguire il compito affidatogli,
avrebbe deciso di barare, cercando di recuperare le soluzioni del test. Insomma:
il nuovo modello di OpenAI si sarebbe comportato come uno studente che, di
fronte a un compito in classe, avesse deciso di scassinare la porta della sala
professori per cercare nei cassetti la soluzione del compito.
Leggi l'articolo su "Il Manifesto"