Anthropic, una startup specializzata in intelligenza artificiale, una dei principali rivali di ChatGPT, ha annunciato un nuovo strumento che è in grado di analizzare ciò che appare sullo schermo di un utente e completare una serie di compiti online al posto suo. Questa tecnologia rappresenta un ulteriore passo avanti rispetto ai classici chatbot, spostandosi verso quelli che sono definiti “agenti AI”, in grado di agire autonomamente per conto degli utenti.
Questa nuova funzione, chiamata “computer use”, consente all’intelligenza artificiale di interpretare in tempo reale ciò che l’utente vede sul proprio schermo e, con il suo consenso, eseguire azioni come navigare sul web, cliccare pulsanti e digitare. Attualmente, Anthropic ha reso disponibile una versione beta per gli sviluppatori che utilizzano la tecnologia Claude, dopo una fase di test con alcuni clienti aziendali.
Sempre più aziende stanno investendo nello sviluppo di agenti AI, progettati per svolgere compiti con minima supervisione umana, con l’obiettivo di aumentare la produttività in ambito personale e professionale. Ad esempio, Microsoft ha recentemente lanciato strumenti per automatizzare la gestione di email e registri, mentre Salesforce ha promosso le sue app di assistenza clienti basate su AI.

Anthropic Claude 3
Anthropic ha scelto un approccio diverso rispetto alla concorrenza: invece di integrarsi con varie applicazioni in background, la sua tecnologia analizza direttamente ciò che avviene sullo schermo dell’utente. Questo, secondo l’azienda, rende l’esperienza più intuitiva e simile a come le persone interagiscono con i loro computer. Jared Kaplan, co-fondatore di Anthropic, ha dichiarato che sarà il primo modello capace di usare un computer come farebbe una persona.
In una dimostrazione, l’AI di Anthropic ha pianificato una gita escursionistica senza input umano oltre al prompt iniziale, cercando percorsi, controllando l’orario dell’alba e inviando un invito al calendario con i dettagli. Tuttavia, strumenti di questo tipo possono sollevare preoccupazioni legate alla sicurezza, poiché accedere alle attività sullo schermo di un utente può renderlo vulnerabile.
Per mitigare i rischi, Anthropic ha introdotto alcune limitazioni, come il divieto di interagire con social media o siti governativi, e ha permesso agli sviluppatori di stabilire regole più restrittive o supervisionare le azioni del sistema. Sebbene il modello possa gestire molti compiti, fa ancora fatica con azioni semplici come lo scrolling o il drag-and-drop.


