Démerdez-vous avec ça

Tout à son idée de montrer la puissance de ses outils, OpenAI a mis en ligne 722 prépublications de mathématiques générées par IA. L’entreprise met en ligne des « résultats » se trouvant pourtant à « différents stades de vérification », en s’appuyant sur l’avis d’un groupe de chercheurs pour « mettre en place les meilleures pratiques » concernant leur partage. L’un de ses membres, le mathématicien François Charles, explique à Next que ce groupe veut être « un canal de communication » entre les entreprises et la communauté.
OpenAI a publié la nuit dernière 772 documents PDF de mathématiques dans un dépôt GitHub. Alors que l’entreprise affichait récemment une volonté de dialogue avec les mathématiciens, elle intensifie la mise en ligne d’articles qu’elle appelle « prépublications » (preprints, en anglais). Elle affirme s’appuyer sur le travail d’un groupe de chercheurs indépendants qui a publié des recommandations concernant l’ « utilisation responsable des résultats mathématiques générés par l’IA ».
Alors que des milliers de mathématiciens déploraient récemment que l’IA menace la pratique scientifique et qu’OpenAI a été accusée de mauvaises pratiques scientifiques pour résoudre un problème de maths, l’entreprise présente sur son dépôt GitHub ces fichiers comme des « des manuscrits mathématiques et des éléments justificatifs de démonstration générés par un modèle interne d’OpenAI ». Mais ceux-ci n’ont que l’apparence d’articles de mathématiques travaillés par des chercheurs : aucune signature de chercheurs n’apparait sous leur titre, ils ne sont signés que par le nom de l’entreprise dirigée par Sam Altman.
« Des résultats se trouvant à différents stades de vérification »
Dans son fichier Readme, OpenAI explique que le dépôt « regroupe des résultats se trouvant à différents stades de vérification. Tous ne sont pas accompagnés de formalisations Lean [langage d’assistant de preuve, ndlr]. Nous continuerons à mettre à jour ce référentiel avec des formalisations Lean au fur et à mesure que nous les obtiendrons ».
Ainsi, si l’entreprise regroupe tous ces PDF dans un dossier intitulé « preprints », ils ne sont pas du tout prêts à la publication comme sont censés l’être les articles désignés comme tels et mis en ligne sur les serveurs comme arXiv. Même si ces serveurs autorisent les chercheurs à modifier avec un système de gestion de versions, le terme de « prépublications » implique que les chercheurs assument que ces articles pourraient être présentés dans une revue scientifique.






