Modèles et plateformes d’IA
L’intelligence déchiquetée : pourquoi les IA excellent dans les problèmes olympiques mais échouent en mathématiques scolaires
La communauté de l’intelligence artificielle a célébré un jalon remarquable en 2025 lorsque les systèmes d’IA de Google DeepMind (GOOGL ) et OpenAI ont obtenu une performance de médaille d’or à l’Olympiade internationale de mathématiques. Ces modèles d’IA ont résolu des problèmes que seuls quelques-uns des jeunes mathématiciens les plus brillants du monde pouvaient résoudre. Pourtant, ces mêmes systèmes échouent souvent lorsqu’on leur demande d’effectuer des calculs arithmétiques de base que n’importe quel élève de collège pourrait effectuer avec facilité. Ce paradoxe frappant révèle quelque chose de fondamental sur la nature de l’intelligence artificielle aujourd’hui. Nous assistons à l’émergence de ce que l’on ne peut appeler que intelligence déchiquetée, où les machines affichent des capacités surhumaines dans certains domaines tout en échouant dans des tâches que nous considérons comme élémentaires.
Le triomphe olympique
L’Olympiade internationale de mathématiques est la référence en matière de concours mathématiques pré-universitaires. Chaque année, les jeunes mathématiciens les plus brillants du monde entier s’attaquent à six problèmes qui nécessitent une profonde compréhension, une pensée créative et des techniques de preuve de haut niveau. En 2025, les systèmes d’IA de Google DeepMind et d’OpenAI ont obtenu 35 points sur 42, ce qui leur a valu des médailles d’or. Le AlphaGeometry 2 de DeepMind a résolu un problème de géométrie complexe en seulement 19 secondes, tandis que le AlphaProof a résolu des problèmes de théorie des nombres et d’algèbre qui ont déjoué la plupart des concurrents humains.
Ces réalisations s’appuient sur des années de progrès progressif. Les systèmes utilisent des langages mathématiques formels comme Lean pour construire des preuves rigoureuses. Ils emploient des techniques comme l’apprentissage par curriculum, où l’IA s’entraîne sur des problèmes de difficulté croissante. Cette formation permet à l’IA de comprendre les relations complexes entre les objets mathématiques, de reconnaître des modèles subtils et de construire des preuves élégantes.
La lutte élémentaire
Les mêmes systèmes d’IA qui obtiennent des médailles d’or aux problèmes olympiques échouent souvent aux tâches qui semblent triviales. Par exemple, si vous leur demandez de multiplier de grands nombres, ils peuvent produire avec confiance des réponses incorrectes. De même, si vous essayez d’effectuer d’autres opérations arithmétiques de base, leur performance devient imprévisible. Le problème ne se limite pas à la simple calcul. Ces systèmes ont souvent du mal avec les problèmes de mots qui nécessitent de suivre plusieurs quantités, de comprendre le contexte du monde réel ou d’appliquer des opérations mathématiques de base dans une séquence.
Cette faiblesse découle fondamentalement de la façon dont ces modèles d’IA fonctionnent. Les grands modèles de langage prédisent ce que le texte devrait être ensuite en fonction des modèles qu’ils ont vus dans les données d’entraînement. Lorsqu’ils rencontrent “2 + 2”, ils reconnaissent ce modèle et prédisent correctement “4” non pas parce qu’ils comprennent l’addition, mais parce que cette séquence apparaît de nombreuses fois dans leurs données d’entraînement. Lorsque vous leur présentez des calculs inhabituels qui apparaissent rarement dans le texte, leur performance se dégrade rapidement. Ils sont essentiellement des machines de reconnaissance de modèles qui excellent lorsqu’ils sont confrontés à des modèles clairs et cohérents, mais qui ont du mal lorsqu’ils sont forcés de calculer un problème non vu.
Le paradoxe architectural
La contradiction entre le succès olympique et l’échec arithmétique révèle un problème architectural plus profond. Les systèmes d’IA modernes excellent dans les problèmes qui peuvent être résolus par reconnaissance de modèles, déduction logique et recherche systématique dans les espaces de solutions. Les problèmes olympiques, malgré leur difficulté, ont souvent des structures élégantes que l’IA peut exploiter. Les systèmes peuvent explorer différentes stratégies de preuve, vérifier les étapes logiques et construire sur des cadres mathématiques établis. Ils opèrent dans un monde de symboles et de règles où la cohérence et la logique dominent.
En revanche, les calculs arithmétiques de base posent des défis différents. Ils nécessitent une manipulation précise des quantités, et non une reconnaissance de modèles. Ils exigent une compréhension de la grandeur numérique et des relations qui ne peuvent pas être approximées. Lorsqu’un système d’IA aborde l’arithmétique par la modélisation du langage, il traite les nombres comme des jetons à prédire plutôt que des quantités à calculer. Cette discordance fondamentale entre les exigences de la tâche et l’architecture du modèle crée l’écart de performance que nous observons.
Les données d’entraînement et leurs limites
Les capacités de l’IA dépendent en grande partie de la qualité et de la nature des données d’entraînement. Les preuves mathématiques et les problèmes avancés apparaissent souvent dans des formats bien structurés en ligne. Les articles universitaires, les manuels et les ressources éducatives fournissent des exemples clairs de raisonnement mathématique. Internet contient de vastes discussions sur les concepts mathématiques, les techniques de preuve et les stratégies de résolution de problèmes. Ce riche corpus permet aux systèmes d’IA d’apprendre des capacités de raisonnement mathématique avancées.
Les mathématiques élémentaires, cependant, souffrent d’un problème différent. Même si les calculs arithmétiques de base apparaissent fréquemment en ligne, ils sont rarement accompagnés de chaînes de raisonnement détaillées qui aident l’IA à comprendre les processus sous-jacents. Les calculs simples sont énoncés comme des faits plutôt que comme des procédures. Les données d’entraînement contiennent les résultats du calcul, mais pas le processus de calcul lui-même. Cela crée un écart fondamental dans la compréhension qui se manifeste par de mauvaises performances sur les tâches de base.
Les implications pour le développement de l’IA
Ce modèle inégal d’intelligence a des implications cruciales pour la façon dont nous concevons et utilisons les systèmes d’IA. Nous ne pouvons pas supposer que le succès dans les tâches complexes signifie la compétence dans les tâches plus simples. Un IA capable de prouver des théorèmes mathématiques peut échouer à équilibrer un chéquier. Un système qui écrit du code informatique peut avoir du mal avec les calculs de base. Cette réalité exige une considération soigneuse des capacités et des limites de l’IA dans les applications du monde réel.
Le phénomène révèle également l’importance des approches hybrides. Au lieu d’attendre qu’un seul modèle gère chaque tâche, nous pourrions avoir besoin de systèmes spécialisés pour différents types de tâches. Par exemple, combiner le calcul symbolique pour l’arithmétique avec les modèles de langage pour la raison pourrait créer des solutions plus fiables. L’avenir de l’IA pourrait résider dans la coordination de systèmes spécialisés multiples plutôt que de poursuivre une intelligence générale monolithique.
La voie à suivre
Reconnaître l’intelligence déchiquetée fournit une direction plus claire pour construire des systèmes d’IA plus capables. Les chercheurs développent des méthodes pour intégrer des outils de calcul dans les modèles de langage, leur permettant de déléguer l’arithmétique aux calculateurs. De nouvelles stratégies de formation se concentrent sur l’enseignement des modèles pour utiliser des outils externes au lieu d’essayer d’internaliser chaque compétence. Cette approche reflète l’intelligence humaine, où nous utilisons des calculateurs pour les calculs et réservons nos efforts mentaux pour un raisonnement de niveau supérieur.
Le paradoxe de l’intelligence déchiquetée nous enseigne finalement l’humilité sur l’intelligence artificielle. Ces systèmes ne sont ni universellement supérieurs ni uniformément limités. Au lieu de cela, ils affichent un mélange complexe de forces et de faiblesses dont nous devons être conscients pour utiliser et améliorer efficacement les capacités de l’IA. Le succès nécessite non seulement d’élargir ce que l’IA peut faire, mais également de résoudre ses lacunes fondamentales. Les machines qui peuvent prouver des théorèmes mais échouent dans les calculs de base montrent que l’intelligence, qu’elle soit artificielle ou humaine, reste un phénomène multifacette qui n’est pas facile à définir.
Le fond
Le succès de l’IA dans la résolution de problèmes olympiques mais son échec en mathématiques scolaires montrent que l’intelligence ne se développe pas de manière uniforme. Ces systèmes peuvent être brillants dans un domaine et faibles dans un autre. Comprendre ce modèle inégal est important pour la façon dont nous concevons et utilisons l’IA. Au lieu d’attendre qu’un seul modèle fasse tout, nous pourrions avoir besoin de combiner différentes approches qui jouent sur les forces de chaque système. Les progrès réels viendront de la construction d’une IA qui fonctionne de manière fiable dans la pratique, et non de supposer qu’elle sera bonne dans chaque tâche. en traduisant cette idée finale naturellement à l’intérieur du champ approprié.












