OpenAI ha accusato l’evento di hacking del fatto che i suoi modelli di intelligenza artificiale sono diventati ingannevoli. Ecco cosa sapere: NPR


FILE – Il logo OpenAI viene visualizzato su un telefono cellulare davanti a un’immagine generata dal modello testo-immagine Dall-E di ChatGPT l’8 dicembre 2023 a Boston.

Michael Dwyer/AP


Nascondi titolo



Cambia titolo

Michael Dwyer/AP

OpenAI, produttore di ChatGPT, ha affermato che sta ancora indagando su un “incidente informatico senza precedenti” che ha portato i suoi sistemi di intelligenza artificiale a fuggire da un ambiente di test e ad entrare in un’altra società di intelligenza artificiale.

OpenAI ha dichiarato martedì che due dei suoi modelli di intelligenza artificiale più potenti sono stati responsabili di un attacco informatico contro la startup di intelligenza artificiale Hugging Face. L’incidente sta accendendo il dibattito sulla necessità di barriere di intelligenza artificiale più forti e sulla capacità degli agenti di intelligenza artificiale di agire da soli.

Hugging Face ha dichiarato la scorsa settimana di aver rilevato un’intrusione nei suoi sistemi di elaborazione dati che sospettava fosse causata da un agente AI che agiva di propria iniziativa. Ma la startup con sede a New York non ha saputo fino a questa settimana che OpenAI era responsabile e ha collaborato con la grande azienda per avere quello che il CEO di Hugging Face, Clement DeLongue, ha definito “un attacco diverso da qualsiasi cosa abbiamo visto prima”.

OpenAI, con sede a San Francisco, ha affermato che la sua intelligenza artificiale ha utilizzato credenziali rubate e ha scoperto una vulnerabilità precedentemente sconosciuta per accedere ai server di Hugging Face. Funziona con guardrail ridotti perché è pensato per essere in un ambiente di test isolato chiamato sandbox.

Ma ha fatto di tutto per raggiungere un obiettivo di test ristretto, trovando modi per connettersi a Internet senza la direzione umana e ottenendo informazioni riservate che potrebbero essere utilizzate per ingannare la valutazione, ha detto la società.

Alcuni esperti sostengono che OpenAI stia travisando la tecnologia

Hannes Kools, sociologo dell’Università di Amsterdam, ha affermato che inquadrare l’attacco informatico come un agente dell’intelligenza artificiale è un’antropomorfizzazione non necessaria che toglie un po’ di calore all’azienda.

“È una decisione umana disattivare alcune difese”, ha detto Cools. “Non si trattava di un’intelligenza artificiale che si è comportata in modo ribelle in questo senso. Ha seguito istruzioni specifiche basate su un suggerimento fornito a quel sistema di intelligenza artificiale.”

Tali istruzioni, secondo OpenAI, richiedono l’utilizzo di “metodi di attacco sofisticati” per testare quanto bene un’intelligenza artificiale possa sfruttare un sistema informatico.

Tuttavia, altri esperti affermano che i modelli di intelligenza artificiale parlano di rischi legati all’intelligence che possono causare problemi con poca direzione umana. OpenAI ha affermato che l’intrusione è stata causata da una combinazione dei suoi modelli di intelligenza artificiale, incluso il GPT‑5.6 Sol appena rilasciato e un modello “più capace” ancora in fase di test interno.



Link alla fonte

Lascia un commento