Une conjecture mathématique tenait depuis 30 ans : ChatGPT l'aurait fait tomber en 4 phrases
Un neurochirurgien pékinois aux antécédents atypiques vient peut-être d'écrire une page importante de l'histoire des mathématiques. Jin Shanmu, chercheur postdoctoral au Peking Union Medical College Hospital, a grandi géologue avant de bifurquer vers la médecine, puis vers la recherche sur les ultrasons transcrâniens. Sa formation en mathématiques se limitait aux cours de premier cycle, le reste étant autodidacte. C'est en travaillant sur ces ultrasons cérébraux qu'il a croisé la conjecture de Crouzeix, un problème resté ouvert depuis 2004.
Formulée par le mathématicien français Michel Crouzeix, cette conjecture relève de l'algèbre linéaire numérique : elle affirme que la norme de l'application d'une fonction à une matrice ne dépasse jamais le double du maximum de cette fonction sur le domaine numérique de la matrice. Concrètement, cela touche à des questions fondamentales d'analyse matricielle, utilisée en physique et en informatique. Pendant vingt ans, les meilleurs spécialistes du domaine n'étaient parvenus ni à prouver ni à réfuter cette propriété.
Pour tenter de percer ce mystère, Jin Shanmu a eu recours à GPT-5.6-Sol, la version avancée du modèle d'OpenAI, qu'il a laissé travailler de manière autonome pendant seize heures sur la plateforme ChatGPT Work. Le résultat est une démonstration complète, que Jin a rédigée sous forme d'article et déposée en ligne le 27 juillet 2025.
Trois jours plus tard, le mathématicien Alex Townsend, de l'université Cornell, qui consultait régulièrement depuis plus d'un an les modèles GPT pour attaquer cette même conjecture, a été informé par l'IA de l'existence de cet article. Avec Anne Greenbaum, professeure à l'université de Washington, et Michel Crouzeix lui-même, il a examiné le manuscrit. Tous trois ont jugé la démonstration correcte. Townsend et Greenbaum ont publié un compte rendu de ces échanges, soulignant les capacités "remarquablement impressionnantes" de GPT-5.6, d'autant plus frappantes eu égard à l'absence de formation spécialisée de Jin. La preuve n'a toutefois pas encore fait l'objet d'une évaluation formelle par les pairs, étape indispensable avant toute validation définitive.
Cet épisode s'inscrit dans un mouvement plus large. En mai 2025, OpenAI avait annoncé qu'un modèle interne de raisonnement avait autonomement progressé sur un problème posé par le mathématicien hongrois Paul Erdos en 1946. La société a depuis publié une liste de dix autres problèmes sur lesquels son futur modèle Astra aurait réalisé des avancées significatives. De son côté, Anthropic a indiqué que son modèle Claude, sans parvenir à démontrer l'hypothèse de Riemann, avait néanmoins produit des résultats inattendus sur une question connexe. L'intelligence artificielle semble désormais capable non seulement de suivre des pistes humaines, mais d'en proposer de nouvelles.
Sources : letribunaldunet.fr · geo.fr · scmp.com · interestingengineering.com · sciencepost.fr
Actu