Il Pentagono avrebbe chiesto a OpenAI un’IA che non dica (quasi) mai di no

by | 9 Set 2026 | IA

Riassunto IA
  • Il Pentagono ha chiesto modelli OpenAI per la sicurezza nazionale con “tassi minimi di rifiuto”, secondo documenti ottenuti da The Intercept.
  • OpenAI sostiene di aver respinto la clausola, mentre il Pentagono ha prima confermato che il documento fosse definitivo e poi ha ritrattato.
  • L’accordo successivo sulle reti militari classificate contiene la stessa sezione sugli OpenAI Mission Models, ma il testo che ne definisce i limiti è oscurato.
Tempo di lettura: 3 minuti

Il Pentagono voleva una versione dell’IA di OpenAI progettata per la sicurezza nazionale e capace di dire “no” il meno possibile.

La richiesta compare nero su bianco in un documento ottenuto da The Intercept attraverso una causa basata sul Freedom of Information Act. La formula utilizzata è “minimal refusal rates”, cioè “tassi minimi di rifiuto”.

Nel documento, gli “OpenAI Mission Models” vengono definiti come modelli “progettati per casi d’uso di sicurezza nazionale” e caratterizzati appunto da un numero minimo di richieste respinte.

OpenAI sostiene però di non aver mai accettato quella condizione. “OpenAI non ha mai accettato una formulazione contrattuale che imponesse ‘tassi minimi di rifiuto’. Questa formulazione non compare nel nostro contratto sottoscritto”, ha dichiarato il portavoce Nate Evans.

Secondo l’azienda, si trattava di una bozza proposta dal Pentagono e successivamente respinta.

OpenAI The Intercept

Il documento in cui compare la richiesta di una versione della tecnologia OpenAI con “tassi minimi di rifiuto”, in giallo. | Foto: Dipartimento della Difesa

Il documento che non doveva essere una bozza

Qui però inizia la parte più strana della storia. The Intercept aveva chiesto espressamente al Pentagono soltanto i contratti definitivi e sottoscritti, escludendo le bozze. Il documento ricevuto non risulta inoltre contrassegnato come tale.

Quando la testata ha chiesto chiarimenti, un avvocato del Dipartimento di Giustizia che rappresenta il Pentagono ha inizialmente confermato che quella con i “minimal refusal rates” fosse effettivamente la versione firmata del contratto.

Poche ore dopo, però, ha ritrattato. Il Pentagono ha chiesto di ignorare la precedente conferma e, successivamente, ha sostenuto che il documento non fosse quello definitivo.

Il portavoce Jacob Bliss ha dichiarato che la frase “minimal refusal rates” non compare in nessun contratto attivo con OpenAI. Nel frattempo, la versione che dovrebbe chiarire definitivamente la vicenda non è stata resa pubblica.

Cosa significa un’IA che rifiuta meno richieste

Il concetto di “rifiuto” è semplice. I modelli commerciali come ChatGPT possiedono guardrail che impediscono loro di rispondere a determinate richieste.

Per esempio, se si chiede alla versione pubblica di ChatGPT di fornire istruzioni operative per costruire un ordigno o aggirare i sistemi di sicurezza di un’arma, il modello tende a rifiutare la richiesta per ragioni di sicurezza.

Un modello destinato alle forze armate deve necessariamente operare in un contesto molto diverso da quello di un chatbot per il grande pubblico. Ma la questione è quanto diversi debbano essere i suoi limiti e, soprattutto, chi debba deciderli.

Heidy Khlaaf, chief scientist dell’AI Now Institute ed ex systems safety engineer di OpenAI, interpreta la formula utilizzata dal Pentagono in modo netto: “‘Rifiuto minimo’ probabilmente significa che il modello utilizzato abbia poche o nessuna misura di sicurezza”.

I documenti, però, non spiegano quali richieste il Pentagono volesse che i modelli smettessero di respingere.

OpenAI e il precedente Anthropic

Il caso di queste ore arriva dopo mesi di battaglia tra il Pentagono e Anthropic proprio sul diritto delle aziende di IA di imporre limiti all’utilizzo militare dei propri modelli.

Anthropic aveva accettato l’uso di Claude da parte delle forze armate, ma aveva mantenuto due linee rosse: niente sorveglianza di massa degli americani e niente armi completamente autonome. Il Pentagono pretendeva invece la possibilità di utilizzare i modelli per tutti gli impieghi consentiti dalla legge.

Lo scontro ha portato il governo a classificare Anthropic come rischio per la catena di approvvigionamento, una decisione che, come abbiamo raccontato, un giudice federale ha annullato a fine agosto.

OpenAI ha raggiunto invece un accordo con il Pentagono per portare i propri modelli sulle reti militari classificate. L’azienda sostiene di aver mantenuto i propri sistemi di sicurezza e di aver ottenuto garanzie contro armi autonome letali e sorveglianza domestica.

Ma i limiti restano nascosti

Il problema è che verificare dove siano oggi quei confini è difficile. Il 27 febbraio OpenAI ha firmato una nuova versione dell’accordo per l’utilizzo dei propri servizi sulle reti classificate.

Il documento mantiene una sezione dedicata al “Testing, Evaluation, and Refinement of OpenAI Mission Models”, la stessa definizione sotto la quale è comparsa la formula sui tassi minimi di rifiuto. Questa volta, però, il contenuto della sezione è completamente oscurato.

Sappiamo che il Pentagono ha chiesto esplicitamente modelli di OpenAI che dicessero “no” il meno possibile. OpenAI afferma di avere respinto quella formulazione e di aver mantenuto i propri guardrail. Ma il testo che permetterebbe di vedere con precisione che cosa sia stato infine concordato, non è pubblico.

Fonte: The Intercept

POTREBBE INTERESSARTI

Cina censura

Anche la Cina respinge lo stop all’IA: “È solo allarmismo”

Il portavoce di Pechino accusa Amodei, Altman e Musk di allarmismo sull’IA. Lo stesso giorno il ministro della sicurezza di stato cinese lancia un allarme quasi...
Donald Trump annuncerà domani World Liberty Financial

Trump respinge lo stop all’IA: “Chi vince, vince tutto”

Amodei, Altman e Musk chiedono più cautela sull’IA. Trump risponde dal golf in Irlanda: fermarsi significa regalare il vantaggio alla Cina.

Claude Anthropic Apple

I governi si affidano a Claude per automatizzare la sorveglianza

Dai dossier costruiti con i dati telefonici alla selezione degli obiettivi politici, il rapporto di Anthropic mostra come l’IA stia abbassando i costi della...
Dario Amodei Anthropic Claude

Amodei, Altman e Musk chiedono di rallentare la corsa all’IA

Anthropic chiede di frenare l’aumento delle capacità dei modelli. OpenAI aderisce ai controlli indipendenti e Musk appoggia Amodei. Ma nessuno promette ancora di...
openai ia pensano

OpenAI avverte: capire cosa ‘pensano’ le IA è sempre più difficile

OpenAI ammette che seguire il ragionamento delle IA diventerà sempre più complicato perché esplicitano sempre meno il proprio ragionamento. In gioco c’è...
rubygems

OpenAI: prima di Hugging Face c’è stato RubyGems

OpenAI conferma il coinvolgimento dei propri sistemi in un incidente avvenuto a maggio. Due mesi dopo, fino a 1.200 agenti avrebbero poi attaccato Hugging Face.

pentagono

Il Pentagono entra nella filiera dell’IA con Fluidstack

Il finanziamento a Fluidstack sarebbe il più grande mai concesso dall’Office of Strategic Capital e servirebbe a produrre negli USA componenti per i data...
IA umanità Coxon

Già, ma come potrebbe davvero l’IA ucciderci tutti?

La denuncia di Coxon nei giorni scorsi ha fatto scalpore, ma come potrebbe concretizzarsi realmente il suo scenario apocalittico? Risposta: attenzione alle...
Anthropic

Anthropic accusa: Russia e Cina hanno usato Claude per cyberattacchi e distillazione

Il rapporto descrive attacchi informatici gestiti in larga parte dall’IA. E accusa Alibaba, DeepSeek, Moonshot e Xiaomi di aver cercato di replicare le capacità...
OpenAI matematica

OpenAI dice di aver risolto un Problema del Millennio della matematica

OpenAI ha impiegato fino a 10.000 agenti IA coordinati dai suoi ricercatori per risolvere il problema di Navier-Stokes in 88 ore. E adesso?

Share This