OpenAI signale un risque potentiel majeur en matière de cybersécurité dans son prochain modèle et renforce ses contrôles information fournie par Reuters 07/08/2026 à 19:46
((Traduction automatisée par Reuters à l'aide de l'apprentissage automatique et de l'IA générative, veuillez vous référer à l'avertissement suivant: https://bit.ly/rtrsauto))
OpenAI a déclaré vendredi qu'elle ne pouvait exclure que son prochain modèle d'IA, Astra, dispose de capacités « critiques » en matière de cybersécurité, ce qui a conduit la start-up à suspendre certains développements internes et à déclencher des protocoles de sécurité.
Selon les directives de sécurité d’OpenAI, un modèle atteint le seuil « critique » s’il est capable d’identifier et d’exploiter de manière autonome des failles logicielles graves et réelles, appelées « exploits zero-day », ou de mener des cyberattaques complexes contre des cibles hautement sécurisées sans intervention humaine.
Voici quelques détails concernant Astra:
* Cette annonce fait suite à un reportage exclusif de Reuters révélant qu’OpenAI a découvert d’autres cas dans lesquels des agents autonomes ont échappé aux mesures de confinement , alors que l’entreprise élargit son enquête sur l’incident de piratage survenu chez la société technologique Hugging Face, qui avait attiré l’attention du monde entier en juillet.
* Au cours des dernières semaines, OpenAI, Anthropic et Meta Platforms META.O ont révélé que leurs modèles d’IA avaient pénétré dans les systèmes d’autres entreprises lors de tests de cybersécurité, soulignant à quel point les capacités croissantes de l’IA mettent à rude épreuve la capacité des développeurs à maintenir leurs systèmes sous contrôle.
* Les évaluations préliminaires menées ces derniers jours, ainsi que les analyses d’experts externes, indiquent qu’Astra pourrait être capable d’effectuer de manière autonome des tâches informatiques de plus en plus sophistiquées, a déclaré OpenAI.
* "Alors que nous continuons à tester et à évaluer ce modèle, nos évaluations préliminaires indiquent des performances suffisamment élevées pour que nous ne puissions pas exclure, à ce stade, un niveau de capacité “critique”", a déclaré le créateur de ChatGPT.
* En réponse à ces conclusions préliminaires, OpenAI a déclaré avoir renforcé ses contrôles de sécurité et suspendu les activités internes impliquant Astra qui ne répondent pas à ses nouvelles exigences de sécurité renforcées.
* Le développement d’Astra sera transféré vers des environnements de test isolés, avec un accès réseau restreint et une exécution en bac à sable.
* OpenAI a également précisé qu’Astra n’était pas impliqué dans le piratage visant la plateforme d’IA Hugging Face.
* L’entreprise s’associera à des agences gouvernementales et à certaines organisations spécialisées dans la sécurité de l’IA pour tester les capacités du modèle.