Troppo intelligenti per controllarle: OpenAI cambia strategia sulle IA

by | 16 Apr 2025 | IA

Illustrazione: OpenAI
Tempo di lettura: 2 minuti

Ottobre 2027. L’umanità si trova a un bivio. Da un lato, rallentare lo sviluppo dell’intelligenza artificiale per contenerne i potenziali rischi. Dall’altro, accelerare per non perdere terreno rispetto alla Cina.

È questo il cuore di uno studio appena pubblicato, dal titolo AI 2027, che sotto forma di racconto distopico – ma nemmeno troppo – immagina un futuro in cui una singola intelligenza artificiale diventa più capace del più brillante tra gli esseri umani.

A firmare il documento, ripreso anche dal Corriere della Sera, troviamo Daniel Kokotajlo, ex ricercatore di OpenAI che nel 2024 aveva lasciato l’azienda perché convinto che non stesse più agendo in modo responsabile.

Forse allora non è un caso che, proprio mentre quel tipo di scenario torna a far discutere, OpenAI annunci il primo aggiornamento al proprio framework di sicurezza da quando, nel dicembre 2023, ha deciso di dotarsi di uno strumento ufficiale per valutare i rischi delle sue IA.

Un cambio di paradigma per OpenAI

La nuova versione del preparedness framework, così si chiama il sistema adottato da OpenAI per determinare se un modello è sicuro, introduce alcune modifiche sostanziali.

La più evidente è che scompare la distinzione tra rischio “basso” e “medio”. D’ora in poi conterà solo una cosa: se un sistema presenta rischi “alti” o “critici”.

La la vera svolta è però l’aggiunta di nuove categorie pensate per tenere conto dei comportamenti più imprevedibili e sfuggenti.

Come ad esempio la capacità di un modello di replicarsi da solo, di eludere le misure di sicurezza, di nascondere le proprie vere potenzialità o addirittura di opporsi a uno spegnimento forzato.

L’IA come agente autonomo

Il rischio, insomma, non è più solo quello di un uso malevolo da parte dell’uomo, per esempio nella creazione di armi biologiche, ma anche quello che un sistema sempre più “agentico”, come si dice in gergo, cominci a prendere decisioni autonome e imprevedibili.

«Siamo sull’orlo di sistemi capaci di fare nuova scienza», ha dichiarato OpenAI nel documento di aggiornamento. «E che potranno presto generare rischi concreti e gravi. Per questo servono misure di salvaguardia affidabili e solide».

L’idea di fondo, confermata dalla ricercatrice Sandhini Agarwal in un’intervista a Axios, è che tutto il lavoro sull’affidabilità debba ora concentrarsi sui rischi “catastrofici”.

Modelli sempre più abili nel mascherarsi

Uno dei motivi di allarme è che i modelli di ultima generazione stanno dimostrando di essere molto più abili nel mascherare le proprie capacità.

Una recente ricerca di Anthropic, ad esempio, ha suggerito che alcuni modelli linguistici sono in grado di pianificare azioni complesse in modo non visibile e di simulare processi di ragionamento fuorvianti.

Detto altrimenti: un modello potrebbe comportarsi in un modo nei test di laboratorio e in un altro – molto meno sicuro – nel mondo reale.

Ed è proprio questo il tipo di rischio che, con il nuovo framework, OpenAI dice di voler affrontare in maniera prioritaria.

POTREBBE INTERESSARTI

Zuckerberg Meta Connect

Meta sconta l’IA del 95% se può addestrarla sui vostri dati

Con Muse Spark, prompt e risposte diventano una moneta di scambio: chi accetta di condividerli con Meta, paga molto meno per usare il modello.

cani guida robot (1)

La Cina prova a sostituire i cani guida con i robot

Oltre 17 milioni di persone hanno disabilità visive, ma nel Paese sono disponibili appena circa 400 cani guida. Xiaoyuan prova a colmare quel vuoto.

Greg Brockman OpenAI

OpenAI dice che l’AGI è arrivata. Ma ne ha cambiato il significato

Per anni l’intelligenza artificiale generale è stata una soglia tecnica ed economica molto concreta. Ora Brockman la definisce qualcosa di “grigio” e persino...
musk altman openai cursor

OpenAI taglia fuori Cursor dopo l’acquisizione di Elon Musk

I modelli OpenAI valgono solo il 5% del traffico di Cursor, ma il caso mostra quanto chi sviluppa servizi basati sull’IA dipenda dalle guerre tra i fornitori dei...
cina droni novasky

La Cina e il business dei droni anti-drone stampati in 3D

Costano da 1.500 dollari, superano i 300 km/h e alcune aziende ne vendono già migliaia al mese. La filiera che ha reso la Cina dominante nei droni commerciali, si...
meta iran

Meta blocca una rete iraniana di propaganda sui social

Gli account pubblicavano contenuti sulla politica americana e cercavano collaborazioni con giornalisti e figure politiche reali. Nessuno dei tentativi è...
Meta bambini

Meta potrà usare i dati dei bambini (per capire se sono bambini)

I dati potranno servire ad addestrare il sistema di verifica dell’età, ma non a pubblicità e algoritmi. Resta da capire come verranno tenuti separati.

Masayoshi Son SoftBank

SoftBank cerca altri 10 miliardi per ripagare il debito della scommessa OpenAI

A marzo aveva ottenuto un prestito ponte da 40 miliardi di dollari per finanziare OpenAI. Ora Masayoshi Son cerca prestiti e obbligazioni per sostituire quel...
hugging face

Nvidia vuole comprarsi Hugging Face per 13 miliardi

OpenAI e gli altri grandi laboratori cercano di ridurre la dipendenza dalle sue GPU. Nvidia risponde investendo sull’IA aperta e sulla piattaforma che la...
Colette Kress Nvidia

Nvidia fa 96 miliardi in tre mesi e difende i “finanziamenti circolari”

Ricavi +106% e crescita prevista del 70% nel fiscal 2028. Ma aumentano il costo delle memorie, le garanzie finanziarie e la concorrenza dei chip progettati dagli stessi...
Share This