Retour à l'accueil

Progrès de l'IA en code et en mathématiques : Thèses de Karpathy

Andrej Karpathy explique le progrès asymétrique de l'IA : essor en code et mathématiques dû à RL sur des métriques claires, retard dans les textes. Les professionnels voient le potentiel dans les systèmes d'agents IA, les non-spécialistes voient les échecs des anciens modèles. Pour les devs : concentrez-vous sur des outils comme Codex.

Essor de l'IA uniquement en code : Explication de Karpathy
Advertisement 728x90

# Pourquoi les progrès de l'IA ne sont perceptibles que dans le code et les mathématiques : Analyse des thèses de Karpathy

Andrey Karpathy, cofondateur d'OpenAI et ancien directeur de l'IA chez Tesla, explique l'écart dans les évaluations des capacités des modèles modernes. Les progrès sont concentrés dans la programmation, les mathématiques et la recherche, où l'IA atteint des résultats exceptionnels. Dans les tâches quotidiennes comme la recherche d'informations ou la génération de texte, les améliorations restent minimes.

Deux groupes aux expériences divergentes

Les utilisateurs se divisent en deux camps : ceux qui se fient à l'ancien ChatGPT gratuit de l'année dernière, et les professionnels qui utilisent des outils avancés comme Codex ou Claude Code.

  • Le premier groupe juge sur des modèles obsolètes : le mode vocal avancé trébuche dans des scénarios simples, comme choisir entre marcher ou conduire jusqu'à un lave-auto à 50 mètres.
  • Le second groupe assiste à une « frénésie de l'IA » : des modèles avec accès au terminal peuvent restructurer une base de code entière ou détecter des vulnérabilités en une heure — des tâches qui prennent des jours aux humains.

Cette fracture génère des malentendus : les échecs viraux des anciens modèles ne reflètent pas le potentiel des systèmes agentiques.

Google AdInline article slot

Raisons techniques de la domination du code et des mathématiques

La programmation et les mathématiques sont idéales pour le RLHF (Reinforcement Learning from Human Feedback) et le RL sur des métriques vérifiables.

  • Récompenses claires : un test unitaire passe ou échoue — un signal binaire pour l'optimisation, contrairement à la subjectivité de la qualité du texte.
  • Focus économique : les tâches B2B génèrent la majeure partie des revenus, les laboratoires d'IA y investissent massivement pour la génération de code et les calculs.
  • Évolutivité : les systèmes agentiques avec outils (terminal, API) gèrent des tâches complexes de manière autonome.

Résultat : les meilleurs modèles comme Codex peuvent réviser des projets en quelques heures, tandis que les interfaces vocales peinent avec des requêtes non structurées.

Réalités parallèles de l'IA

Karpathy insiste : les deux visions sont justes. ChatGPT vocal patine sur les mèmes, mais les agents spécialisés dominent les flux de travail professionnels. Ce n'est pas une contradiction — c'est un progrès réparti par domaines.

Google AdInline article slot

Les professionnels soulignent :

  • La restructuration de code legacy sans perte de fonctionnalité.
  • Les audits de sécurité automatisés, y compris les exploits zero-day.
  • La résolution de problèmes mathématiques au niveau recherche doctorale.

Pour les développeurs intermédiaires et seniors, cela signifie intégrer l'IA dans les pipelines CI/CD et les revues de code, où la vérifiabilité accélère les itérations.

Ce qui compte

  • Les progrès de l'IA sont asymétriques : les pics dans le code et les maths proviennent du RL sur des métriques binaires.
  • Les priorités B2B dictent le focus — les tâches quotidiennes sont à la traîne.
  • Les systèmes agentiques avec accès terminal résolvent les problèmes des ordres de grandeur plus vite que les humains.
  • Les écarts de perception naissent des différences entre les modèles utilisés.
  • Pour les pros de l'IT, la clé est d'adopter des outils comme Codex pour les charges de production.

— Editorial Team

Google AdInline article slot
Advertisement 728x90

Lire ensuite