Wikipedia dice basta allo scraping: “Usate la nostra API a pagamento”

by | 11 Nov 2025 | IA

Tempo di lettura: 2 minuti

Wikipedia ha deciso di affrontare di petto la sfida dell’intelligenza artificiale, proponendo un modello che vuole garantire la sopravvivenza della sua enciclopedia nell’era dei chatbot generativi.

La Wikimedia Foundation, che gestisce il progetto, ha infatti invitato le aziende di intelligenza artificiale a smettere di prelevare i suoi contenuti attraverso lo scraping e a utilizzare invece la piattaforma a pagamento Wikimedia Enterprise, pensata proprio per un accesso strutturato e sostenibile ai dati.

Col termine “scraping” si indica l’estrazione automatica di grandi quantità di testi o immagini da un sito web, spesso senza autorizzazione. È una pratica alla base dell’addestramento dei modelli fondazionali come ChatGPT o Gemini, che hanno bisogno di enormi quantità di informazioni per funzionare.

Il problema, secondo Wikipedia, è che questo processo grava sui suoi server e sfrutta il lavoro di milioni di volontari senza alcun ritorno economico o visibilità.

Il picco di traffico “fantasma”

Negli ultimi mesi la Wikimedia Foundation ha notato un’anomalia nel traffico verso il proprio sito. Dopo aver potenziato i sistemi di rilevamento, ha scoperto che l’impennata di visite registrata tra maggio e giugno era in realtà dovuta a bot di intelligenza artificiale che cercavano di “sfuggire al rilevamento” fingendosi utenti umani.

Parallelamente, le visualizzazioni reali, ovvero quelle generate dalle persone, sono calate dell’8% rispetto all’anno precedente.

Il post della Fondazione non minaccia sanzioni o azioni legali ma traccia una linea chiara. Le aziende di intelligenza artificiale devono utilizzare i contenuti “in modo responsabile”, con un’adeguata attribuzione e preferibilmente attraverso Wikimedia Enterprise.

L’obiettivo è duplice: evitare di sovraccaricare i server e permettere alle aziende di sostenere la missione no profit di Wikipedia, che vive di donazioni e lavoro volontario.

L’appello: dare credito al lavoro umano

“Affinché le persone possano fidarsi delle informazioni condivise su internet, le piattaforme dovrebbero rendere chiara la provenienza dei dati e offrire la possibilità di visitare e partecipare direttamente alle fonti”, si legge nel post ufficiale.

Per Wikipedia, il rischio non è solo economico ma anche culturale. Meno visite significano meno volontari pronti a migliorare le voci e meno donatori disposti a contribuire, in un circolo vizioso che potrebbe indebolire una delle ultime grandi opere collettive del web aperto.

La mossa di Wikipedia arriva in un momento di tensione crescente tra i produttori di contenuti e le aziende che sviluppano modelli generativi.

Da un lato, i colossi dell’IA dipendono da fonti aperte per addestrare i propri modelli. Dall’altro, sempre più editori hanno iniziato a chiedere compensi per l’uso del loro materiale.

Con la sua piattaforma a pagamento, Wikimedia cerca una via di mezzo: continuare a condividere conoscenza liberamente, ma in modo sostenibile e trasparente.

Fonte: TechCrunch

POTREBBE INTERESSARTI

Zuckerberg Meta Connect

Meta sconta l’IA del 95% se può addestrarla sui vostri dati

Con Muse Spark, prompt e risposte diventano una moneta di scambio: chi accetta di condividerli con Meta, paga molto meno per usare il modello.

cani guida robot (1)

La Cina prova a sostituire i cani guida con i robot

Oltre 17 milioni di persone hanno disabilità visive, ma nel Paese sono disponibili appena circa 400 cani guida. Xiaoyuan prova a colmare quel vuoto.

Greg Brockman OpenAI

OpenAI dice che l’AGI è arrivata. Ma ne ha cambiato il significato

Per anni l’intelligenza artificiale generale è stata una soglia tecnica ed economica molto concreta. Ora Brockman la definisce qualcosa di “grigio” e persino...
musk altman openai cursor

OpenAI taglia fuori Cursor dopo l’acquisizione di Elon Musk

I modelli OpenAI valgono solo il 5% del traffico di Cursor, ma il caso mostra quanto chi sviluppa servizi basati sull’IA dipenda dalle guerre tra i fornitori dei...
cina droni novasky

La Cina e il business dei droni anti-drone stampati in 3D

Costano da 1.500 dollari, superano i 300 km/h e alcune aziende ne vendono già migliaia al mese. La filiera che ha reso la Cina dominante nei droni commerciali, si...
meta iran

Meta blocca una rete iraniana di propaganda sui social

Gli account pubblicavano contenuti sulla politica americana e cercavano collaborazioni con giornalisti e figure politiche reali. Nessuno dei tentativi è...
Meta bambini

Meta potrà usare i dati dei bambini (per capire se sono bambini)

I dati potranno servire ad addestrare il sistema di verifica dell’età, ma non a pubblicità e algoritmi. Resta da capire come verranno tenuti separati.

Masayoshi Son SoftBank

SoftBank cerca altri 10 miliardi per ripagare il debito della scommessa OpenAI

A marzo aveva ottenuto un prestito ponte da 40 miliardi di dollari per finanziare OpenAI. Ora Masayoshi Son cerca prestiti e obbligazioni per sostituire quel...
hugging face

Nvidia vuole comprarsi Hugging Face per 13 miliardi

OpenAI e gli altri grandi laboratori cercano di ridurre la dipendenza dalle sue GPU. Nvidia risponde investendo sull’IA aperta e sulla piattaforma che la...
Colette Kress Nvidia

Nvidia fa 96 miliardi in tre mesi e difende i “finanziamenti circolari”

Ricavi +106% e crescita prevista del 70% nel fiscal 2028. Ma aumentano il costo delle memorie, le garanzie finanziarie e la concorrenza dei chip progettati dagli stessi...
Share This