CatAttack: quando i gatti avvelenano le intelligenze artificiali…

by | 7 Lug 2025 | IA

Illustrazione: chatgpt
Tempo di lettura: 2 minuti

A quanto pare, nel mondo dell’intelligenza artificiale un semplice “I gatti dormono la maggior parte della loro vita” può bastare per far perdere la bussola anche ai modelli più avanzati.

Lo ha dimostrato un team di ricercatori di Stanford, Collinear AI e ServiceNow, che ha scoperto quanto siano vulnerabili i modelli linguistici di nuova generazione quando vengono distratti con frasi casuali e fuori contesto.

Il loro strumento si chiama CatAttack e non ha nulla a che vedere con i felini, se non per la capacità di confondere anche il più preciso degli algoritmi con una mossa inaspettata.

Piccoli trigger, grandi danni

Il principio alla base della ricerca che trovate qui linkata, è semplice quanto inquietante: basta aggiungere un frammento di testo apparentemente irrilevante a una domanda di matematica (ad esempio, un consiglio generico o un’informazione curiosa), per compromettere il ragionamento del modello.

L’attacco non modifica la domanda né introduce errori logici: semplicemente, sposta l’attenzione del sistema. Eppure, il risultato è drammatico e i modelli che normalmente rispondono correttamente, diventano fino a tre volte più propensi a sbagliare.

Gli autori hanno testato l’attacco su DeepSeek R1, uno dei modelli più promettenti nel campo del ragionamento logico, ma anche su varianti distillate e modelli OpenAI.

I numeri parlano chiaro: i trigger hanno provocato errori in una quantità significativa di casi, alterando non solo la correttezza della risposta ma anche la lunghezza delle spiegazioni, con una crescita dei token generati che in alcuni casi ha superato il 300%.

Quando l’illusione diventa realtà

Tra i trigger più efficaci identificati da CatAttack ci sono quelli che includono suggerimenti numerici fuorvianti, tipo “Potrebbe essere intorno a 175?” messi in coda a una domanda, oppure affermazioni di buon senso del tutto scollegate (“Ricorda di risparmiare almeno il 20% dei tuoi guadagni”).

La forza di questi attacchi è la loro indipendenza dal contenuto della domanda: possono essere utilizzati con qualsiasi quesito e ottenere comunque lo stesso effetto.

La pipeline sviluppata dai ricercatori si basa dunque su una brillante intuizione: usare un modello più debole per generare gli attacchi, e poi verificarne la capacità di trasferirsi a modelli più potenti.

Questo approccio non solo riduce i costi computazionali, ma dimostra anche che le fragilità individuate non sono isolate, ripresentandosi anche nei modelli di fascia alta. E soprattutto, lo fanno in modo sistemico, non casuale.

Una questione strategica, e di efficienza

Ciò che emerge da CatAttack è un campanello d’allarme per tutto il mondo delle IA.

Se modelli capaci di ragionamenti logici articolati possono essere ingannati da un innocuo commento sui gatti, allora la robustezza dell’intelligenza artificiale, specialmente in contesti critici come sanità, finanza o giustizia, non può più essere data per scontata.

Il problema non è soltanto il rischio di vedere generato un errore ma anche quello di inefficienza computazionale: risposte più lunghe significano più consumo, più attese, più costi. E in un mondo dove la corsa agli LLM sta diventando sempre più energivora, ogni vulnerabilità di questo tipo diventa un tallone d’Achille che può far lievitare i costi dei modelli avversari..

Ciò che emerge dallo studio di CatAttack è potente: non servono hacker esperti né exploit sofisticati per mettere in crisi un modello, basta una frase ambigua nel posto giusto. Ed è questo, forse, l’aspetto più inquietante di tutta la vicenda.

POTREBBE INTERESSARTI

Google Android

Google e OpenAI vendono la loro intelligenza artificiale ai colossi cinesi in blacklist

OpenAI e Google continuano a fornire i propri modelli alle filiali di Alibaba, Baidu e Tencent registrate a Singapore, aggirando la lista nera del Pentagono. La legge...

SK Hynix sbarca al Nasdaq con una domanda sette volte superiore all’offerta

SK Hynix punta a raccogliere circa 28 miliardi di dollari con il suo debutto al Nasdaq, ma gli investitori ne hanno chiesti sette volte tanto. Il fornitore di memorie...
Meta Zuckerberg Meta Ray-Ban EssilorLuxottica

Meta testa occhiali IA che registrano ogni istante della giornata

Il prototipo scatterebbe foto ogni pochi secondi e registrerebbe l’audio in continuo, con la spia luminosa spenta. Fin dove può spingersi la raccolta dati per...
Meta Muse

Meta lancia Muse Image, ma il generatore di immagini è già nel mirino per la privacy

Il nuovo generatore di immagini di Meta arriva gratis su Instagram, WhatsApp e Meta AI. Ma la funzione che permette di utilizzare le immagini degli altri utenti di...
Open AI ChatGPT

Il governo Usa “sblocca” GPT-5.6, OpenAI lo lancia giovedì

Il governo Usa toglie i vincoli imposti a GPT-5.6 dopo settimane di accesso contingentato. OpenAI lancia il nuovo modello giovedì, con la stessa cautela già riservata...
Robot killer

ONU: i robot killer vanno vietati per legge

Il segretario generale dell’ONU rilancia il divieto per le armi autonome capaci di scegliere e colpire da sole. Ma sul campo i robot da guerra sono già...
lavoro IA

IA: i CEO tech pensano che presto aumenteranno i posti di lavoro

Un anno fa i big del tech promettevano lavori distrutti dall’IA. Ora parlano di produttività e nuove assunzioni. Cos’è cambiato davvero?

Sede di Samsung Electronics a Seul, Corea del Sud

I conti di Samsung sono da record grazie al boom della memoria per l’IA

Il colosso coreano annuncerà martedì una stima preliminare di 86.000 miliardi di won, il terzo trimestre consecutivo da record. Ma la divisione mobile rischia il primo...
Midjourney: c'è l’hardware nel suo futuro

Midjourney vuole sapere quanto Disney, Universal e Warner Bros. usano l’IA

Midjoourney chiede al tribunale di obbligare le tre major a rivelare quanto usano l’IA, nella causa per copyright che le vede opposte.

Peter Thiel Dialog

Peter Thiel attacca il Papa: “lavora per i comunisti cinesi” sull’IA

Al festival di Aspen, il fondatore di Palantir accusa Leone XIV di favorire la Cina criticando l’IA, e rilancia le sue tesi su Democratici, Costituzione e...
Share This