Una nuova ondata di ricerche ha rivelato limitazioni critiche negli attuali modelli di intelligenza artificiale, in particolare nella loro capacità di gestire compiti di ragionamento logico e spaziale complessi. Secondo un recente studio pubblicato su MIT Technology Review, i sistemi di intelligenza artificiale continuano a lottare con puzzle e giochi che richiedono una comprensione sfumata, adattabilità e consapevolezza spaziale, abilità che gli esseri umani eseguono con facilità. Questa scoperta sottolinea un divario crescente tra intelligenza umana e artificiale, sollevando domande sulla vera portata delle capacità cognitive dell'IA.
Alla fine del 2024, un team di scienziati della Columbia University ha condotto una serie di esperimenti utilizzando i puzzle Connections del New York Times, una popolare sfida quotidiana che richiede l'identificazione di connessioni tematiche tra quattro parole apparentemente non correlate. Al momento, anche i modelli di IA più avanzati sono riusciti a risolvere correttamente solo il 18% di questi puzzle. Tuttavia, all'inizio del 2025, diversi modelli erano migliorati in modo significativo, raggiungendo punteggi quasi perfetti in modo coerente. Questo rapido progresso dimostra il ritmo accelerato dello sviluppo dell'IA, ma evidenzia anche sfide persistenti in settori come il riconoscimento di schemi sottili e il ragionamento astratto.
Nonostante questi guadagni, i modelli di intelligenza artificiale continuano ad affrontare notevoli carenze. Un'area in cui vacillano è il ragionamento spaziale, un'abilità fondamentale che svolge un ruolo cruciale in campi come l'architettura, l'ingegneria e il design. Gli esercizi di rotazione mentale, che chiedono agli individui di identificare il corretto orientamento di un oggetto dopo che è stato ruotato, rimangono un ostacolo importante per i grandi modelli linguistici.
Mentre i moderni modelli di IA possiedono enormi quantità di conoscenze memorizzate, questa forza può diventare una debolezza quando si trovano di fronte a scenari nuovi o leggermente modificati. Uno studio del 2024 condotto da ricercatori di Google e dell'Università dell'Illinois di Urbana-Champaign ha dimostrato questa limitazione attraverso una serie di enigmi di Cavalieri e Fanciulli. Questi enigmi si basano sulla deduzione logica basata su dichiarazioni fatte da personaggi che dicono sempre la verità o mentono sempre. Anche se i modelli sono stati addestrati su problemi simili, spesso non sono riusciti a rilevare inconsistenze sottili, portando a conclusioni errate.
Questo suggerisce che i sistemi di IA potrebbero non avere la flessibilità necessaria per regolare le loro risposte in tempo reale quando si trovano di fronte a situazioni sconosciute. Gli enigmi di Knights and Knaves offrono un chiaro esempio di questo problema. Considera il primo scenario che coinvolge Edward e Wallace. Wallace afferma che Edward dice la verità, mentre Edward afferma che sia lui che Wallace sono dello stesso tipo. Risolvere questo richiede un'attenta analisi delle implicazioni di ogni affermazione, un compito che richiede sia precisione logica che consapevolezza contestuale. Allo stesso modo, il secondo scenario introduce la complessità aggiungendo un terzo personaggio, Alice, le cui affermazioni complicano ulteriormente la logica.
Questi puzzle mostrano i limiti dell'intelligenza artificiale nella gestione del ragionamento a livelli, dove piccoli cambiamenti nella frase o nella struttura possono alterare drasticamente il risultato. Mentre l'intelligenza artificiale continua ad evolversi, i ricercatori sottolineano l'importanza di progettare test che spingano i confini dei modelli attuali. Espondendo l'intelligenza artificiale a puzzle sempre più impegnativi, gli sviluppatori possono ottenere approfondimenti sulla natura dell'intelligenza artificiale e identificare le aree in cui la cognizione umana ha ancora un vantaggio. Questa esplorazione continua non solo aiuta a perfezionare le capacità dell'intelligenza artificiale, ma rafforza anche gli aspetti unici della risoluzione dei problemi, della creatività e dell'intuizione umana.
★
Manteniamo le notizie oneste.
ObjectiveNews è finanziato dai lettori e senza pubblicità: ti mostriamo il bias invece di nasconderlo. Sostieni il giornalismo indipendente per 4 €/mese.
Diventa sostenitore