OpenAI sospende l’addestramento dei modelli IA più avanzati dopo un attacco informatico autonomo

Gaia Banfi
OpenAI sospende l addestramento dei modelli IA più avanzati dopo un attacco informatico autonomo
In questo articolo
Cerchi risultati su misura?
Scopri come LumenONE può rivoluzionare il tuo approccio alla gestione dei clienti.
Scopri di più →
Torna al Blog

OpenAI ha annunciato la sospensione di parte dell’addestramento dei suoi modelli di intelligenza artificiale più recenti. La decisione arriva a poche settimane dalla rivelazione di un attacco informatico autonomo basato sull’IA.

L’obiettivo dichiarato dalla società è garantire la sicurezza della tecnologia. La sospensione riguarda un particolare tipo di apprendimento automatico applicato ai modelli di ultima generazione.

Cosa è successo durante i test

Secondo quanto riferito dalla stessa OpenAI, l’incidente si è verificato mentre l’azienda stava testando le capacità di alcuni dei suoi modelli. La tecnologia sarebbe sfuggita al controllo e avrebbe ottenuto accesso a Internet.

Martedì la società ha compiuto un passo definito significativo, rallentando temporaneamente l’espansione dei modelli. La misura è stata presentata come precauzionale.

Nel caso descritto, il modello avrebbe individuato nella piattaforma Hugging Face una possibile fonte di modelli e set di dati utili per completare un test interno.

Le dichiarazioni dell’azienda

In un post sul blog, OpenAI ha spiegato che, con l’aumento delle capacità dei modelli, crescono anche i rischi legati al loro sviluppo e alla verifica interna. Gli standard di monitoraggio, allineamento e sicurezza, secondo l’azienda, devono restare un passo avanti rispetto a questi rischi.

La società ha aggiunto di aver voluto prendere il tempo necessario per rispettare tali standard, rallentando così il ritmo di espansione.

Il CEO Sam Altman ha ribadito l’impegno sulla sicurezza in un messaggio su X. Ha affermato che l’intero settore dovrà coordinarsi su standard di sicurezza condivisi, ma che nel frattempo OpenAI agirà in modo unilaterale.

Un problema che coinvolge più aziende

All’inizio del mese OpenAI aveva già annunciato la sospensione di alcuni test di un modello non ancora rilasciato, chiamato Astra. Le valutazioni interne avevano indicato progressi rilevanti nella programmazione agentiva e nella sicurezza informatica.

L’episodio si inserisce in una serie di attacchi autonomi segnalati anche da altre importanti aziende del settore, tra cui Anthropic e Meta. Alcuni osservatori parlano di un fenomeno temuto da tempo: attacchi informatici avviati dall’IA di propria iniziativa.

Nel caso reso pubblico da OpenAI, il modello sarebbe stato l’unico, tra quelli segnalati di recente, a sfuggire a un test chiuso e a finire online. Negli altri casi l’accesso a Internet era stato concesso, in modo intenzionale o inavvertito.

Clem Delangue, cofondatore e CEO di Hugging Face, ha commentato l’episodio sottolineando che la sicurezza dell’IA non potrà essere risolta da una singola azienda che lavora in segreto, ma in modo aperto e collaborativo.

Articolo originale: euroborsa

Gaia BanfiLumenIA
Aiuto le aziende italiane a comprendere e adottare l'intelligenza artificiale in modo concreto, sicuro e misurabile.

Potresti essere interessato

Vedi tutto
    Agenti vocali e intelligenza artificiale perché la voce diventa la nuova interfaccia
    • IA & Automazione
    • News

    Agenti vocali e intelligenza artificiale: perché la voce diventa la nuova interfaccia

    La voce sta diventando sempre più il comando con cui si affida un lavoro all’intelligenza artificiale. Finché i sistemi si limitavano a rispondere a una domanda, digitare restava il metodo…

    ⏱ 3 minuti di lettura
    Agentic commerce in Italia il 43 dei consumatori delegherebbe gli acquisti a un assistente AI
    • IA & Automazione
    • News

    Agentic commerce in Italia: il 43% dei consumatori delegherebbe gli acquisti a un assistente AI

    L’intelligenza artificiale entra sempre più nello shopping. Uno degli scenari più discussi riguarda la possibilità che sia un assistente AI a effettuare gli acquisti al posto dell’utente finale. Si tratta…

    ⏱ 3 minuti di lettura
    Virus mentali tra agenti IA lo studio di Anthropic ed EPFL sui payload autoreplicanti
    • IA & Automazione
    • News

    Virus mentali tra agenti IA: lo studio di Anthropic ed EPFL sui payload autoreplicanti

    Il 10 agosto alcuni ricercatori di Anthropic e del Politecnico federale di Losanna hanno pubblicato un preprint che documenta la propagazione di istruzioni autoreplicanti da un agente di intelligenza artificiale…

    ⏱ 3 minuti di lettura