Deepmind, l’intelligenza artificiale di Google, è in grado di creare dialoghi e colonne sonore

by | 19 Giu 2024 | IA

Tempo di lettura: 2 minuti

DeepMind, la divisione impegnata a sviluppare innovazioni legate all’intelligenza artificiale di Google, afferma di essere al lavoro su una tecnologia I.A. in grado di generare suoni sincronizzati coi i video.

In un post sul blog ufficiale, DeepMind afferma di aver creato una tecnologia in grado di superare uno dei limiti più comuni dei modelli IA attualmente più diffusi, anche quello creato dalla stessa divisione di Google: l’I.A. può generare video, ma non può creare effetti sonori sincronizzati con le immagini generate.

“I modelli di generazione video stanno avanzando a un ritmo incredibile, ma molti sistemi attuali possono generare solo output silenziosi”, scrive DeepMind. “La tecnologia V2A potrebbe diventare uno strumento promettente per dare vita a interi film generati dall’IA”.

La tecnologia V2A è in grado di partire da una descrizione e da un video (ad es. “meduse pulsanti sott’acqua, vita marina, oceano”) e creare musica, effetti sonori e persino dialoghi a tono con le immagini.

“Allenandosi su video, audio e annotazioni aggiuntive la nostra tecnologia impara ad associare specifici eventi audio con varie scene visive, rispondendo alle informazioni fornite nelle annotazioni o nelle trascrizioni”, si legge nel blog DeepMind.

Apparentemente quella presentata da DeepMind non è una novità. Sono diverse le startup che nelle settimane scorse hanno provato a proporre qualcosa di simile. La divisione di Google, però, sostiene che la tecnologia V2A è unica nel suo genere in quanto può comprendere i pixel grezzi di un video e sincronizzare automaticamente i suoni generati con le immagini.

Si tratta, però, solo del primo passo. V2A non è perfetto e persino DeepMind lo riconosce. È ancora in fase di “addestramento” e sono tanti i tipi di audio che non è in grado di riprodurre in maniera convincente. Inoltre quello che crea per il momento viene definito “stereotipato” da chi lo ha sentito.

Anche per questo motivo DeepMind afferma che per il momento non renderà pubblica la tecnologia e forse non lo farà mai. Nonostante gli utilizzi concreti, il pericolo di IA generative di questo tipo è quello di sconvolgere l’industria del cinema e della TV. Il pericolo, quindi, è quello sia di perdere migliaia di posti di lavoro, sia quello di infrangere diverse proprietà intellettuali.

POTREBBE INTERESSARTI

Cina censura

Anche la Cina respinge lo stop all’IA: “È solo allarmismo”

Il portavoce di Pechino accusa Amodei, Altman e Musk di allarmismo sull’IA. Lo stesso giorno il ministro della sicurezza di stato cinese lancia un allarme quasi...
Donald Trump annuncerà domani World Liberty Financial

Trump respinge lo stop all’IA: “Chi vince, vince tutto”

Amodei, Altman e Musk chiedono più cautela sull’IA. Trump risponde dal golf in Irlanda: fermarsi significa regalare il vantaggio alla Cina.

Claude Anthropic Apple

I governi si affidano a Claude per automatizzare la sorveglianza

Dai dossier costruiti con i dati telefonici alla selezione degli obiettivi politici, il rapporto di Anthropic mostra come l’IA stia abbassando i costi della...
Dario Amodei Anthropic Claude

Amodei, Altman e Musk chiedono di rallentare la corsa all’IA

Anthropic chiede di frenare l’aumento delle capacità dei modelli. OpenAI aderisce ai controlli indipendenti e Musk appoggia Amodei. Ma nessuno promette ancora di...
openai ia pensano

OpenAI avverte: capire cosa ‘pensano’ le IA è sempre più difficile

OpenAI ammette che seguire il ragionamento delle IA diventerà sempre più complicato perché esplicitano sempre meno il proprio ragionamento. In gioco c’è...
rubygems

OpenAI: prima di Hugging Face c’è stato RubyGems

OpenAI conferma il coinvolgimento dei propri sistemi in un incidente avvenuto a maggio. Due mesi dopo, fino a 1.200 agenti avrebbero poi attaccato Hugging Face.

pentagono

Il Pentagono entra nella filiera dell’IA con Fluidstack

Il finanziamento a Fluidstack sarebbe il più grande mai concesso dall’Office of Strategic Capital e servirebbe a produrre negli USA componenti per i data...
IA umanità Coxon

Già, ma come potrebbe davvero l’IA ucciderci tutti?

La denuncia di Coxon nei giorni scorsi ha fatto scalpore, ma come potrebbe concretizzarsi realmente il suo scenario apocalittico? Risposta: attenzione alle...
Anthropic

Anthropic accusa: Russia e Cina hanno usato Claude per cyberattacchi e distillazione

Il rapporto descrive attacchi informatici gestiti in larga parte dall’IA. E accusa Alibaba, DeepSeek, Moonshot e Xiaomi di aver cercato di replicare le capacità...
OpenAI matematica

OpenAI dice di aver risolto un Problema del Millennio della matematica

OpenAI ha impiegato fino a 10.000 agenti IA coordinati dai suoi ricercatori per risolvere il problema di Navier-Stokes in 88 ore. E adesso?

Share This