News

L’intelligenza artificiale alla prova del lavoro reale: i risultati deludono le aspettative

L’intelligenza artificiale continua a essere uno dei settori tecnologici con la crescita più rapida al mondo. Secondo le stime degli analisti, il valore complessivo dell’industria ha ormai superato 1.600 miliardi di dollari, una cifra destinata ad aumentare nei prossimi anni. Nonostante investimenti sempre più consistenti e modelli linguistici sempre più avanzati, però, una recente ricerca evidenzia che l’IA è ancora lontana dal poter sostituire efficacemente i professionisti nelle attività più complesse.

A mettere alla prova le capacità dei principali sistemi di IA è stato un gruppo di ricercatori della University of California, Berkeley, che ha sviluppato un nuovo benchmark pensato per simulare scenari lavorativi reali.

Un test con oltre 1.500 attività professionali

Lo studio si basa sul Agentic Labor Evaluation (ALE), un sistema di valutazione che comprende oltre 1.500 compiti realistici, selezionati da esperti appartenenti a 55 diverse professioni. Tra i settori coinvolti figurano lo sviluppo software, la progettazione grafica, l’agricoltura, il comparto marittimo e numerose altre attività che richiedono competenze tecniche e decisionali.

L’obiettivo era verificare quanto gli attuali modelli di intelligenza artificiale siano realmente in grado di affrontare incarichi simili a quelli svolti quotidianamente dai lavoratori.

Per il confronto sono stati analizzati alcuni dei sistemi più avanzati oggi disponibili, tra cui Anthropic Claude, OpenAI GPT-5.5, Cursor Composer 2.5 e Google Gemini 3.1 Pro.

Leggi anche:

Nessun modello supera la prova

I risultati ottenuti mostrano come nessuno dei modelli testati sia riuscito a raggiungere un livello di affidabilità sufficiente nelle attività più impegnative.

Tra tutti, GPT-5.5 ha registrato la prestazione migliore, completando con successo circa il 24% delle attività previste dal benchmark. Tuttavia, quando il livello di difficoltà è aumentato, richiedendo ragionamenti prolungati, conoscenze specialistiche e capacità di mantenere prestazioni affidabili nel tempo, tutti i sistemi hanno mostrato limiti significativi, senza riuscire a portare a termine i compiti più complessi.

Secondo i ricercatori, gli attuali agenti di IA riescono già a gestire una parte consistente delle attività professionali, ma sono ancora lontani dalle capacità richieste per affrontare incarichi che richiedono pensiero logico avanzato, esperienza approfondita e decisioni affidabili in contesti complessi.

L’IA resta utile nelle attività ripetitive

Nonostante questi risultati, gli autori dello studio sottolineano che l’intelligenza artificiale continua a rappresentare uno strumento estremamente utile per molte aziende.

Le tecnologie attuali si dimostrano infatti particolarmente efficaci nello svolgimento di procedure standardizzate, attività ripetitive e processi ben definiti, consentendo di aumentare la produttività e ridurre il tempo necessario per completare numerose operazioni quotidiane.

Il quadro che emerge è quindi più equilibrato rispetto alle aspettative spesso alimentate dal mercato: almeno per il momento, l’IA rappresenta soprattutto un potente strumento di supporto ai professionisti, piuttosto che un sostituto completo del lavoro umano.

Fonte

Ti potrebbe interessare:
Segui guruhitech su:

Esprimi il tuo parere!

Che ne pensi di questa notizia? Lascia un commento nell’apposita sezione che trovi più in basso e se ti va, iscriviti alla newsletter.

Per qualsiasi domanda, informazione o assistenza nel mondo della tecnologia, puoi inviare una email all’indirizzo [email protected].

Condividi l'articolo

Scopri di piรน da GuruHiTech

Abbonati per ricevere gli ultimi articoli inviati alla tua e-mail.

0 0 voti
Article Rating
Iscriviti
Notificami
guest
0 Commenti
Piรน recenti
Vecchi Le piรน votate