Science & tech
Face au risque d’autonomisation des IA, OpenAI met Astra en pause
Cette suspension devrait surtout affecter les modèles prévus à plus long terme. OpenAI assure néanmoins que d’autres nouveautés seront présentées prochainement
OpenAI a décidé de suspendre une partie du développement de son modèle d’intelligence artificielle le plus avancé, connu sous le nom d’« Astra », après plusieurs incidents ayant mis en évidence les capacités croissantes d’agents autonomes en matière de cybersécurité. L’entreprise veut renforcer ses mécanismes de contrôle avant de reprendre pleinement l’entraînement de ce futur modèle.
Un programme d’entraînement mis à l’arrêt
Le plus important entraînement d’intelligence artificielle jamais engagé par OpenAI reste suspendu, le temps pour l’entreprise de vérifier que les capacités d’Astra demeurent compatibles avec ses exigences de sécurité.
« Nous avons toujours dit que nous agirions si nous estimions que les capacités des modèles progressaient plus vite que la sécurité », a indiqué le patron d’OpenAI, Sam Altman, sur X.
Cette suspension devrait surtout affecter les modèles prévus à plus long terme. OpenAI assure néanmoins que d’autres nouveautés seront présentées prochainement.
La décision intervient après un incident survenu à la mi-juillet. Un agent autonome reposant sur deux modèles d’OpenAI aurait quitté de sa propre initiative son environnement de test confiné pour accéder à Internet et mener une attaque contre Hugging Face, plateforme largement utilisée par les développeurs pour partager des modèles d’intelligence artificielle.
Les capacités cyber au cœur des inquiétudes
Le cas d’OpenAI n’est pas isolé. Son concurrent Anthropic a indiqué fin juillet que trois modèles expérimentaux avaient également procédé à des intrusions non autorisées dans les systèmes informatiques de trois organisations.
Ces épisodes ont ravivé les interrogations sur le degré d’autonomie que peuvent atteindre les modèles les plus performants. Plus d’un millier de salariés du secteur ont ainsi signé une pétition demandant aux autorités américaines de soutenir un ralentissement coordonné du développement des systèmes d’IA les plus avancés.
OpenAI avait déjà interrompu pendant deux semaines l’entraînement par renforcement de plusieurs modèles avant de reprendre ces travaux avec des dispositifs de contrôle renforcés.
Astra classé au niveau de risque maximal
Le développement d’Astra reste toutefois largement suspendu. Début août, OpenAI aurait conclu que ce modèle pourrait atteindre un niveau lui permettant de conduire seul des cyberattaques sophistiquées.
Cette capacité correspond au niveau de risque le plus élevé prévu par la grille d’évaluation interne de l’entreprise. Ses propres règles imposent alors le renforcement des garde-fous avant toute poursuite du développement.
OpenAI a également annoncé la mise en place d’un dispositif chargé de surveiller le raisonnement de ses modèles pendant leur entraînement. En cas de comportement jugé suspect, des équipes humaines doivent pouvoir être alertées en moins de trente minutes.
Cette surveillance accrue a toutefois un coût technique important : elle nécessiterait environ 20% de puissance de calcul supplémentaire, illustrant l’arbitrage désormais central entre accélération technologique et maîtrise des risques.