OpenAI annulla il rilascio del nuovo modello a causa di problemi di sicurezza nei test interni | OpenAI


OpenAI sta annullando il rilascio del suo modello di intelligenza artificiale di prossima generazione dopo che i ricercatori hanno sollevato problemi di sicurezza durante i test interni.

Il modello, il GPT-6.1 Astra, che apparirà su ChatGPT e ⁠Codex a ottobre, è progettato per eseguire compiti più complessi senza assistenza umana.

Sachi Jain, capo dei sistemi di sicurezza di OpenAI, ha affermato che il nuovo modello non soddisfa gli standard dell’azienda.

L’AI Security Institute del Regno Unito ha pubblicato lunedì il proprio rapporto di test sul GPT-6 Astra, il predecessore del GPT-6.1, lanciato questo mese, e È stato accertato che hanno effettuato diverse operazioni offensive non autorizzate Più spesso rispetto ai precedenti modelli OpenAI.

Gli esperti hanno accolto con favore la mossa di OpenAI di mettere fuori servizio l’ultimo modello Astra, ma hanno avvertito che le società di intelligenza artificiale sono responsabili della propria regolamentazione piuttosto che dei cani da guardia sostenuti dal governo.

Jain ha detto lunedì al Wall Street Journal che l’Astra non è stata all’altezza degli standard dell’azienda nei test di calibrazione, che valutano se un sistema segue l’intento umano.

Il modello mostrava più inganni rispetto ai suoi predecessori, a volte non riuscendo a rivelare accuratamente le azioni intraprese o meno.

Presenta problemi con l'”autorizzazione dell’ambito”, rendendo pericoloso l’avanzamento delle funzioni senza richiedere l’autorizzazione dell’utente e talvolta tentando di utilizzare strumenti o servizi esterni per farlo.

L’azienda con sede a San Francisco ha fatto la mossa dopo che diversi agenti di intelligenza artificiale in tutto il mondo si sono comportati in modo disonesto, suscitando avvertimenti da parte di ricercatori e dirigenti dell’azienda sui rischi della tecnologia.

All’inizio di questo mese, Dario Amodei, amministratore delegato di Anthropic, rivale di OpenAI, Ha invitato l’industria dell’intelligenza artificiale a “rallentare”. E offre un piano in tre parti per farlo. Ha rapidamente ottenuto il sostegno dell’amministratore delegato di OpenAI Sam Altman e del CEO di SpaceX Elon Musk.

L’abbandono del modello dimostra che OpenAI è pronta a prendere decisioni severe in materia di sicurezza, ma tali decisioni non dovrebbero essere lasciate nelle mani dell’azienda, dicono gli esperti.

“Serve a ricordare che le aziende tecnologiche, non gli organismi di regolamentazione, possono ancora decidere cosa è sicuro e cosa è affidabile”, ha affermato Kate Devlin, professoressa di intelligenza artificiale e società al King’s College di Londra.

Dame Wendy Hall, professoressa di informatica all’Università di Southampton e consigliere del governo britannico sull’intelligenza artificiale, ha affermato che le aziende ora si preoccupano della futura responsabilità per possibili danni.

“Ciò di cui abbiamo bisogno è un monitoraggio e una regolamentazione indipendenti piuttosto che una completa dipendenza da queste società”, ha affermato.

La decisione arriva prima della conferenza degli sviluppatori OpenAI a San Francisco, dove l’azienda solitamente annuncia nuovi prodotti rivolti agli sviluppatori di software.

Salta le campagne di newsletter precedenti


Martedì OpenAI si è scusata Hacking del sito web del governo australiano attraverso un agente IA canaglia e stanziare fondi per migliorare le difese informatiche e istituire una task force di risposta locale.

In un post sul blog chiamato Come possiamo rendere l’Australia migliore?La società ha ammesso di aver gestito male la sua risposta e ha promesso di assumersi la responsabilità di “ricostruire la fiducia con il pubblico australiano”.

OpenAI ha dichiarato: “Ci scusiamo e stiamo lavorando per fare meglio in futuro”.

L’hack di giugno, annunciato pubblicamente solo la scorsa settimana, è stato il primo caso in cui un agente dell’intelligenza artificiale ha violato un sito web governativo. Il primo ministro australiano, Anthony Albanese, l’ha definito “inaccettabile” e ha criticato il ritardo della società nell’avvisare il governo.

Sempre martedì, Anthropic – che produce Clad – ha avvertito i potenziali investitori della sua tecnologia Può rappresentare “pericoli esistenziali per l’umanità”. nel tanto atteso prospetto per la prevista quotazione sul mercato azionario di 2 trilioni di dollari (1,5 trilioni di sterline).

I “fattori di rischio” nel suo prospetto includono la possibilità che i modelli di intelligenza artificiale ricattino, manipolino e mostrino altri comportamenti imprevedibili, ha riferito il Financial Times.

L’azienda californiana riferisce che l’intelligenza artificiale trasformerà l’economia globale oltre l’industrializzazione, l’elettricità e Internet.

Tuttavia, ciò ha un costo sbalorditivo. Anthropic ha riportato una perdita netta di 42 miliardi di dollari per il 2025 e prevede di spendere 518 miliardi di dollari in passività relative a cloud, computing e infrastrutture nei prossimi anni, riporta il prospetto.



Link alla fonte

Lascia un commento