Alcuni ospedali usano un modello di OpenAI che ha allucinazioni

by | 29 Ott 2024 | IA

Tempo di lettura: 3 minuti

O tempora o mores, direbbero i latini. O, più probabilmente, visto quanto ci apprestiamo a scrivere, mala tempora currunt.

Whisper, infatti, è il modello di riconoscimento vocale sviluppato da OpenAI, progettato per trascrivere l’audio in testo, riconoscere il parlato e supportare la traduzione in più lingue.

Rilasciato come modello open-source, Whisper è stato addestrato su una grande quantità di dati audio, inclusi contenuti video provenienti da diverse piattaforme online, per poter comprendere vari accenti e idiomi.

Whisper: l’utilizzo che non t’aspetti

Tuttavia, questo modello mostra ancora alcune vulnerabilità, tra cui la tendenza a produrre “allucinazioni”, ossia parti di testo inesistenti o errate.

Il che non sarebbe un problema limitato qualora venisse utilizzato per la trascrizione automatica di meeting o la traduzione in tempo reale.

Peccato invece che, secondo ABC News, Whisper sia usato in oltre 30.000 cliniche e 40 sistemi sanitari. E che al momento ha trascritto circa sette milioni di conversazioni mediche.

Ma un gruppo di ricercatori della Cornell University e dell’Università di Washington ha evidenziato che Whisper allucina in circa l’1% delle trascrizioni, generando frasi inesistenti che possono includere sentimenti violenti, espressioni illogiche o interi passaggi di testo inventati durante i momenti di silenzio.

Rischio afasia

“E che problema sarà mai?”, si domanderà qualcuno di voi? In verità, è un problema che va oltre il mero aspetto tecnico.

Per comprendere meglio il fenomeno, gli studiosi hanno esaminato audio tratti da AphasiaBank, una risorsa contenente campioni di parlato di persone con afasia, un disturbo del linguaggio.

In questi contesti, i momenti di silenzio sono particolarmente frequenti, e Whisper sembra interpretarli in maniera errata.

La ricercatrice Allison Koenecke della Cornell University ha condiviso esempi di queste trascrizioni in un thread online, mostrando come Whisper possa arrivare persino a inventare condizioni mediche o a inserire frasi che appaiono completamente fuori contesto, come “Grazie per aver guardato!”.

Se vi domandate il perché di questa uscita… beh, è la tipica espressione con la quale si chiudono i video su YouTube, piattaforma su cui OpenAI ha addestrato GPT-4 trascrivendo oltre un milione di ore di filmati.

Questi risultati sono stati presentati a giugno durante la conferenza FAccT dell’Association for Computing Machinery in Brasile. Al momento, non è noto se lo studio sia stato sottoposto a revisione paritaria.

La risposta di OpenAI

Preso atto della situazione, OpenAI ha dichiarato che affronta la questione delle allucinazioni con serietà.

La portavoce Taya Christianson ha così dichiarato a The Verge, da cui abbiamo ripreso questa notizia: “Prendiamo molto seriamente questo problema e stiamo lavorando continuamente per migliorare, inclusa la riduzione delle allucinazioni”.

“Per l’uso di Whisper sulla nostra piattaforma API” ha proseguito, “le nostre policy d’uso vietano l’utilizzo in contesti decisionali ad alto rischio e la nostra scheda del modello per l’uso open-source include raccomandazioni contro l’impiego in ambiti a rischio elevato. Ringraziamo i ricercatori per aver condiviso i loro risultati”.

Il caso Whisper solleva dunque domande importanti sull’utilizzo dell’intelligenza artificiale in settori come quello sanitario, dove gli errori possono costare caro.

Se da un lato i modelli di IA come Whisper promettono maggiore efficienza e precisione, dall’altro le loro “allucinazioni” possono rappresentare un serio rischio per la sicurezza.

Ma è tutto così più comodo, veloce ed economico…

POTREBBE INTERESSARTI

IA umanità Coxon

Già, ma come potrebbe davvero l’IA ucciderci tutti?

La denuncia di Coxon nei giorni scorsi ha fatto scalpore, ma come potrebbe concretizzarsi realmente il suo scenario apocalittico? Risposta: attenzione alle...
Anthropic

Anthropic accusa: Russia e Cina hanno usato Claude per cyberattacchi e distillazione

Il rapporto descrive attacchi informatici gestiti in larga parte dall’IA. E accusa Alibaba, DeepSeek, Moonshot e Xiaomi di aver cercato di replicare le capacità...
OpenAI matematica

OpenAI dice di aver risolto un Problema del Millennio della matematica

OpenAI ha impiegato fino a 10.000 agenti IA coordinati dai suoi ricercatori per risolvere il problema di Navier-Stokes in 88 ore. E adesso?

Anthropic Mythos

Ricercatore di Anthropic si dimette: “L’IA potrebbe ucciderci tutti”

Jacob Coxon, ex OpenAI, lascia il laboratorio di Amodei e accusa i laboratori di correre verso sistemi sovrumani senza sapere come controllarli. Un collega gli dà...
OpenAI ChatGPT

Il Pentagono avrebbe chiesto a OpenAI un’IA che non dica (quasi) mai di no

Un documento ottenuto da The Intercept parla di modelli con “tassi minimi di rifiuto”. OpenAI sostiene di aver respinto la clausola, mentre il Pentagono...
Arthur Mensch Mistral

Mistral raccoglie 3 miliardi. Ma l’IA americana gioca un’altra partita

Tre miliardi sembrano tanti finché non si guarda agli Stati Uniti. Mistral sceglie così una strategia più mirata, tra industria, cloud e modelli cinesi.

Trump USA Xi Jinping Cina data center

Non volete i data center? Per Trump, fate un favore alla Cina

Bollette, acqua e nuovi impianti alimentano le proteste locali. La destra americana, a braccetto con la Silicon Valley, risponde chiamando in causa Pechino e la...

Per JD Vance l’IA è “satanica”. Ma non rallenta sui data center

Il vicepresidente americano teme che i chatbot possano isolare e manipolare le persone. Ma rifiuta di rallentare la corsa tecnologica statunitense contro la Cina.

Zuckerberg Meta Connect

Meta sconta l’IA del 95% se può addestrarla sui vostri dati

Con Muse Spark, prompt e risposte diventano una moneta di scambio: chi accetta di condividerli con Meta, paga molto meno per usare il modello.

cani guida robot (1)

La Cina prova a sostituire i cani guida con i robot

Oltre 17 milioni di persone hanno disabilità visive, ma nel Paese sono disponibili appena circa 400 cani guida. Xiaoyuan prova a colmare quel vuoto.

Share This