OpenAI a communiqué à propos de cette décision sur son blog. Selon son évaluation interne, Astra a beaucoup progressé en termes de codage autonome et de cybersécurité. Mais le modèle montre des signes de dangerosité que le laboratoire IA décide de ne pas ignorer.
Avant toute chose, précisons qu'OpenAI note le danger de ses modèles sur une échelle interne. Le plus grave niveau désigne un modèle capable de pirater des systèmes bien protégés sans intervention humaine. Astra atteindrait justement ce niveau.
Le modèle pourrait trouver puis exploiter des failles sans aucune aide. Un objectif décrit en une phrase suffirait pour lancer une attaque informatique. Et face à ce niveau grave de dangerosité, OpenAI a renforcé la sécurité autour de son modèle. Toutefois, le laboratoire IA n'a pas prouvé que son modèle atteint ce niveau de gravité, mais un simple doute suffit à imposer des règles strictes.
L'entreprise applique désormais des mesures. Astra tourne dans des environnements de test isolés, avec un accès limité au réseau et aux outils extérieurs. Les fichiers du modèle passent sous une protection à chiffrement renforcé. Tous les travaux internes sur Astra qui n'appliquent pas ces règles passent en pause. Et désormais, l'utilisation du modèle est étroitement surveillée.
Des agences publiques et des organismes de sécurité extérieurs rejoignent les tests. OpenAI précise dans son communiqué qu'Astra n'a pas quitté son environnement de test. L'entreprise a donc pris cette pause et le dit publiquement avant le moindre incident.
Rappelons que les dernières semaines furent agitées pour le secteur de l'IA. Justement, puisque l'on parle d'OpenAI, le modèle GPT-5.6 Sol est sorti de son bac à sable pendant un test. Le modèle a touché l'infrastructure de la plateforme Hugging Face.
OpenAI insiste toutefois sur le fait que ce modèle n'est pas Astra et que les deux dossiers n'ont aucun rapport. Et précisons toutefois que les concurrents rencontrent des soucis comparables comme Anthropic. Meta aussi a admis que l'un de ses modèles a attaqué une autre société lors d'un test de cybersécurité.
Mais disons-le. Il est aussi possible qu'OpenAI joue la carte de la dramatisation pour marketer son prochain modèle, Astra. Une accusation que Sam Altman a portée contre Anthropic, qui présentait Mythos comme un agent à la dangerosité redoutable. Le marketing et la communication ont aussi un grand rôle dans ce marché ultra concurrentiel. Alors pour convaincre les clients, il faut parfois jouer sur l'émotion.
Mais ne minimisons surtout pas les problèmes de cybersécurité que posent ces IA. Les gouvernements tentent de poser des réglementations face à une industrie qui avance à toute vitesse. modèles d'IA sur les risques de cybersécurité. OpenAI et Anthropic poussent même une régulation fédérale renforcée.
"Nous voulons que les capacités de pointe de modèles comme Astra soient déployées de façon responsable pour le bénéfice de toute l'humanité", explique OpenAI. Pour le moment, la date de sortie de ce modèle n'est pas connue.
Suivez toute l'actualité des Numériques sur Google Actualités et sur la chaîne WhatsApp des Numériques
Envie de faire encore plus d'économies ? Découvrez nos codes promo sélectionnés pour vous.





