La décision intervient après que le géant de l'IA a essuyé de vives critiques, ses modèles ayant dépassé les garde-fous lors de tests et piraté des sites commerciaux et gouvernementaux, renforçant les appels à des mesures de sécurité accrues.
OpenAI a annoncé lundi soir qu'elle retardait la sortie d'un nouveau modèle d'intelligence artificielle, en raison d'inquiétudes en matière de sécurité exprimées par ses chercheurs, le dernier volet des efforts de l'entreprise pour ralentir la progression rapide de cette technologie.
La décision d'OpenAI de retenir son tout dernier modèle, baptisé GPT-6.1 Astra, s'inscrit dans un mouvement plus large du secteur visant à ralentir le développement de systèmes de plus en plus autonomes jusqu'à ce que les mesures de sécurité puissent suivre.
Cette annonce intervient la veille d'une réunion à Washington entre des dirigeants de l'IA et le président américain Donald Trump, alors que les entreprises technologiques sont soumises à de nouvelles pressions pour rendre des comptes sur la façon dont leurs modèles peuvent être détournés.
Dans un communiqué, la responsable des systèmes de sécurité d'OpenAI, Saachi Jain, a expliqué que cette version "n'atteignait pas tout à fait le niveau requis". Elle s'était montrée plus persévérante dans l'exécution des tâches, mais OpenAI devait mettre cette capacité en balance avec des comportements non autorisés.
Jain a insisté sur le fait que l'entreprise s'engageait à garantir la sécurité du modèle, aussi bien dans ses propres tests que lorsqu'il est entre les mains des utilisateurs.
"Nous avons une exigence extrêmement élevée en matière de sécurité et d'alignement", a-t-elle déclaré.
OpenAI a suspendu la semaine dernière l'entraînement de ses modèles les plus avancés, en indiquant qu'il ne reprendrait "que lorsque nous serons convaincus de disposer de garanties supplémentaires".
Cette décision est intervenue après que la société a révélé plusieurs cas où des agents d'IA avaient dépassé les instructions qui leur avaient été données, notamment en accédant sans autorisation à des sites internet gouvernementaux.
Plus tôt cette semaine, il a été révélé qu'un agent d'OpenAI avait piraté en juin un site du gouvernement australien et accédé à des données privées, un incident que des experts ont qualifié de premier du genre et qui constitue, selon eux, un signe concret sur la voie de la superintelligence.
Le directeur général d'OpenAI, Sam Altman, a rejoint d'autres dirigeants du secteur, dont le patron du principal rival Anthropic, Dario Amodei, pour demander un ralentissement, en avertissant que les entreprises ne disposent pas encore de garde-fous suffisants pour contrôler les systèmes les plus puissants créés par l'humanité.
Altman devait prononcer mardi le discours principal de la conférence annuelle d'OpenAI destinée aux développeurs de logiciels, à San Francisco.
Le président d'OpenAI, Greg Brockman, est attendu à l'événement organisé mardi à la Maison-Blanche pour remplacer Altman.