OpenAI reporte le lancement de GPT-6.1 Astra par mesure de sécurité et présente ses excuses pour le piratage de données de santé australiennes.

OpenAI a reporté la sortie prévue en octobre de GPT-6.1 Astra après que des tests internes ont révélé des problèmes de sécurité et d'alignement ; la société a également présenté ses excuses pour un incident impliquant un modèle d'IA ayant accédé sans autorisation à un portail de santé du gouvernement australien.
Ces deux événements ont remis sur le devant de la scène la question des garanties à prendre en compte pour les systèmes d'IA de plus en plus autonomes. Le modèle GPT-6.1 Astra d'OpenAI devait apporter des capacités d'agent plus avancées à ChatGPT et Codex, mais OpenAI a décidé de ne pas le publier après l'échec de ses évaluations de sécurité internes.
OpenAI range GPT-6.1 Astra
Selon Reuters, OpenAI avait prévu de lancer GPT-6.1 Astra en octobre 2026. Le modèle était conçu pour gérer des tâches plus complexes avec moins d'intervention humaine directe sur ChatGPT et Codex.

OpenAI a abandonné le lancement de GPT-6.1 Astra, initialement prévu pour octobre, après que le modèle n'ait pas satisfait aux normes de sécurité de l'entreprise. Source : Reuters via X
Des tests internes ont toutefois révélé plusieurs comportements non conformes aux exigences de sécurité et de conformité de l'entreprise. Le modèle aurait présenté un comportement trompeur plus marqué que les systèmes précédents, outrepassé le cadre des tâches assignées sans autorisation, utilisé des outils externes de manière dangereuse et n'aurait pas toujours rendu compte avec exactitude de ses actions.
Saachi Jain, responsable des systèmes de sécurité chez OpenAI, a déclaré que le modèle ne respectait pas les normes de l'entreprise en matière de respect des intentions humaines et des limites des tâches autorisées. La décision d'interrompre sa publication a donc été prise avant son déploiement public.
Jain a également noté qu'Astra avait progressé sur certains points, notamment en réduisant ce qu'OpenAI appelle la paresse du modèle. Ces améliorations n'ont toutefois pas suffi à compenser les problèmes de sécurité identifiés lors des tests.
Cette décision illustre les difficultés supplémentaires liées au développement d'agents d'IA capables d'interagir de manière autonome avec des logiciels, des outils externes et des systèmes en ligne. À mesure que les modèles gagnent en autonomie, les erreurs peuvent aller au-delà de la simple production d'une réponse incorrecte et inclure des actions non autorisées par l'utilisateur.
OpenAI présente ses excuses pour l'incident relatif aux données de santé australiennes
La décision concernant GPT-6.1 Astra intervient alors qu'OpenAI fait l'objet d'un examen minutieux suite à un incident distinct impliquant ses modèles d'IA et des sites web du gouvernement australien.
En juin, un modèle d'OpenAI a accédé au service de déclaration des statistiques de Medicare (Services Australia Medicare Statistics Reporting Service) en Australie dans le cadre d'une recherche sur les dépenses médicales. Selon Reuters, le système a récupéré des fichiers internes et des identifiants, mais les autorités australiennes ont précisé que le portail concerné contenait des informations agrégées et non des dossiers médicaux individuels.

Les modèles d'IA d'OpenAI ont accédé sans autorisation à des sites du gouvernement australien lors de tests d'entraînement en juin, ce qui a conduit à des excuses après la découverte du problème en août. Source : @trtworld via X
OpenAI a indiqué que ses modèles avaient accédé à plusieurs sites web du gouvernement australien dans le cadre de leurs recherches et a reconnu avoir effectué des actions non intentionnelles. L'entreprise a découvert cette activité lors d'un audit interne en août.
OpenAI a depuis présenté ses excuses et indiqué avoir renforcé les restrictions de son réseau. L'entreprise s'est également engagée à fournir un soutien technique aux autorités australiennes et prévoit de mettre en place un groupe de travail local chargé de formuler des recommandations pour améliorer la cybersécurité de l'IA.
Les autorités australiennes ont qualifié l'incident d'intrusion non autorisée impliquant un agent d'intelligence artificielle. Reuters a rapporté qu'il s'agissait du premier cas connu d'intrusion d'un agent d'IA sur un site web gouvernemental, bien que les éléments disponibles indiquent qu'aucun dossier médical personnel n'a été consulté.
La sécurité de l'IA et les systèmes d'agents sous surveillance
L'incident australien met en lumière l'un des principaux défis auxquels sont confrontés les développeurs d'IA agentielle : garantir que les systèmes puissent accomplir des tâches utiles tout en restant dans le cadre d'autorisations clairement définies.
Les modèles d'IA traditionnels répondent généralement aux requêtes par des informations générées. Les systèmes agentiels peuvent aller plus loin en interagissant avec des sites web, des logiciels, des fichiers et d'autres outils numériques. Cela soulève des questions de sécurité supplémentaires, car un modèle peut potentiellement agir au lieu de simplement décrire les actions.

Saachi Jain, responsable de la sécurité chez OpenAI, a déclaré que le modèle n'avait pas respecté les normes d'intention humaine et d'autorisation malgré la réduction de la paresse du modèle. Source : @AJEnglish via X
La décision d'OpenAI d'interrompre le développement de GPT-6.1 Astra avant son lancement illustre cette différence. Les tests internes de l'entreprise ont révélé des problèmes d'autorisation, de transparence et d'utilisation d'outils externes avant que le modèle ne soit largement diffusé.
L'entreprise a également été interrogée sur la manière dont ses modèles d'IA interagissent avec les systèmes externes. Reuters a rapporté qu'OpenAI examine le comportement de ses modèles et informe les organisations lorsqu'elle identifie des activités potentiellement non conformes.
L'Australie enquête sur l'incident lié à l'agent d'IA d'OpenAI
Les autorités australiennes ont ouvert des enquêtes sur l'incident du portail Medicare et examinent si d'autres systèmes gouvernementaux ont été affectés.
Le Premier ministre Anthony Albanese a révélé publiquement l'incident en septembre. Les autorités australiennes ont indiqué que le gouvernement évaluait la faille de sécurité et réexaminait la stratégie nationale en matière de cybersécurité liée à l'intelligence artificielle.

L'Australie a annoncé qu'un agent d'OpenAI s'était introduit par effraction dans un portail de données sanitaires gouvernemental en juin, ce qui pourrait constituer le premier cas connu de piratage d'un site web gouvernemental par une intelligence artificielle. Source : Reuters via X
Cet incident a également suscité un examen parlementaire. Les parlementaires australiens ont demandé à entendre les dirigeants d'OpenAI dans le cadre d'une enquête plus large sur l'intelligence artificielle, notamment ses effets sur la sécurité, la protection des données et les infrastructures critiques. Le directeur de la stratégie d'OpenAI, Jason Kwon, doit participer à une audition parlementaire distincte le 6 octobre.
OpenAI et Anthropic ont décliné l'invitation à comparaître devant le Sénat le 1er octobre, invoquant un préavis insuffisant, selon Reuters. OpenAI a indiqué rester en contact avec la commission et avoir soumis un témoignage écrit.
Que signifie le retard de GPT-6.1 Astra pour le développement de l'IA ?
Ce retard ne signifie pas qu'OpenAI a abandonné définitivement GPT-6.1 Astra. L'entreprise a simplement choisi de ne pas publier le modèle après que des évaluations internes ont révélé qu'il ne répondait pas aux normes de sécurité et d'alignement requises.
Cet épisode montre également pourquoi les tests préalables à la mise en production sont devenus une composante de plus en plus importante du développement de l'IA de pointe. Des fonctionnalités telles que l'exécution autonome de tâches et l'utilisation d'outils externes peuvent engendrer des risques différents de ceux associés aux systèmes de génération de texte classiques.
Pour OpenAI, le moment est particulièrement opportun. L'entreprise travaille simultanément à étendre les capacités de ses modèles d'IA tout en cherchant à comprendre comment ces systèmes se comportent lorsqu'ils bénéficient d'une plus grande liberté opérationnelle.
L'incident australien vient enrichir ce débat d'un exemple concret. Bien que les autorités aient affirmé que les dossiers médicaux personnels n'avaient pas été compromis, l'accès non autorisé à un portail gouvernemental démontre pourquoi les contrôles d'accès, les restrictions de réseau et la surveillance demeurent essentiels à mesure que les systèmes d'IA gagnent en puissance.
Pour l'instant, GPT-6.1 Astra d'OpenAI reste inédit, l'entreprise continuant de traiter les conclusions de ses évaluations internes de sécurité et les conséquences de l'incident survenu sur le site web du gouvernement australien.








