Une nouvelle vague de recherches a révélé des limites critiques dans les modèles d'IA actuels, en particulier dans leur capacité à gérer des tâches de raisonnement logique et spatial complexes. Selon une étude récente publiée dans le MIT Technology Review, les systèmes d'IA continuent de lutter avec des énigmes et des jeux qui nécessitent une compréhension nuancée, une adaptabilité et une conscience spatiale, des compétences que les humains exécutent facilement.
À la fin de 2024, une équipe de scientifiques de l'Université de Columbia a mené une série d'expériences en utilisant les puzzles Connections du New York Times, un défi quotidien populaire qui nécessite d'identifier des connexions thématiques entre quatre mots apparemment sans rapport. À l'époque, même les modèles d'IA les plus avancés n'ont réussi à résoudre correctement que 18% de ces puzzles. Cependant, au début de 2025, plusieurs modèles s'étaient considérablement améliorés, atteignant des scores presque parfaits de manière constante.
Malgré ces gains, les modèles d'IA sont toujours confrontés à des lacunes notables. Un domaine dans lequel ils vacillent est le raisonnement spatial, une compétence fondamentale qui joue un rôle crucial dans des domaines tels que l'architecture, l'ingénierie et la conception.
Alors que les modèles d'IA modernes possèdent de vastes quantités de connaissances stockées, cette force peut devenir une faiblesse lorsqu'ils sont confrontés à des scénarios nouveaux ou légèrement modifiés.
Cela suggère que les systèmes d'IA peuvent manquer de la flexibilité requise pour ajuster leurs réponses en temps réel lorsqu'ils sont confrontés à des situations inconnues. Les énigmes des Chevaliers et des Valet offrent un exemple clair de cette question. Considérons le premier scénario impliquant Edward et Wallace. Wallace affirme qu'Edward dit la vérité, tandis qu'Edward affirme que lui et Wallace sont du même type. La résolution de ce problème nécessite une analyse minutieuse des implications de chaque déclaration, une tâche qui exige à la fois une précision logique et une conscience contextuelle. De même, le deuxième scénario introduit la complexité en ajoutant un troisième personnage, Alice, dont les déclarations compliquent davantage la logique.
Ces énigmes révèlent les limites de l'IA dans le traitement du raisonnement en couches, où de petits changements dans la formulation ou la structure peuvent modifier radicalement le résultat. Alors que l'IA continue d'évoluer, les chercheurs soulignent l'importance de concevoir des tests qui repoussent les limites des modèles actuels. En exposant l'IA à des énigmes de plus en plus difficiles, les développeurs peuvent obtenir des informations plus approfondies sur la nature de l'intelligence artificielle et identifier les domaines où la cognition humaine détient encore un avantage. Cette exploration continue aide non seulement à affiner les capacités de l'IA, mais renforce également les aspects uniques de la résolution de problèmes, de la créativité et de l'intuition humaine.
★
Gardons l’information honnête.
ObjectiveNews est financé par ses lecteurs et sans publicité : nous vous montrons le biais au lieu de le cacher. Soutenez un journalisme indépendant pour 4 €/mois.
Devenir soutien