taraskuzio.com

« Bienvenue dans l'ère de l'IA générale », déclare OpenAI, alors que la société lance GPT-6 Astra, premier modèle d'IA à atteindre le niveau de risque de cybersécurité « critique »

OpenAI a annoncé qu'elle allait commencer à déployer son tout dernier modèle d'IA, GPT-6 Astra, qui, selon l'entreprise, est le fruit de « plusieurs années de recherche et de paris audacieux ». Le PDG Sam Altman a déclaré qu'Astra représentait un « nouveau niveau de capacités » et qu'il s'attendait à « un essor de l'entrepreneuriat, de la créativité, de la croissance économique et des découvertes scientifiques ». Le modèle sera lancé par étapes, avec un accès prioritaire pour les entreprises du programme de cybersécurité « Daybreak ». Astra sera déployé dans les prochains jours auprès des utilisateurs des formules ChatGPT Plus, Pro, Business et Enterprise.

OpenAI est une société d'intérêt public (PBC) américaine spécialisée dans l'intelligence artificielle (IA), dont le siège social est situé à San Francisco. Elle développe des modèles d'IA générative propriétaires, notamment sa série de grands modèles de langage (LLM) appelés « Generative Pre-trained Transformer » (GPT). Le lancement de ChatGPT en novembre 2022 est considéré comme ayant catalysé l'essor de l'IA ; en septembre 2026, ChatGPT est le cinquième site web le plus visité au monde. OpenAI commercialise également les modèles GPT Image et Codex, un agent de codage basé sur l'IA.

Récemment, OpenAI a déclaré que son prochain modèle d’IA, Astra, est le premier à dépasser le seuil de capacité en cybersécurité « critique ». L’entreprise a précisé qu’Astra est capable de détecter des failles de sécurité jusque-là inconnues et de les exploiter sans instructions détaillées de la part d’humains. OpenAI a ajouté qu’elle prévoyait toujours de rendre Astra disponible « prochainement », mais que l’accès à ses capacités en matière de cybersécurité serait plus limité.

OpenAI a annoncé qu’elle allait commencer à déployer son tout dernier modèle d’IA, GPT-6 Astra, qui, selon l’entreprise, est le fruit de « plusieurs années de recherche et de paris audacieux ». Le PDG Sam Altman a déclaré qu’Astra représentait un « nouveau niveau de capacités » et qu’il avait transformé ses méthodes de travail. Il a ajouté qu’il s’attendait à « un essor de l’entrepreneuriat, de la créativité, de la croissance économique et des découvertes scientifiques ».

Le modèle sera lancé par étapes, et OpenAI a indiqué qu’un groupe restreint d’entreprises participant à son programme de cybersécurité basé sur des applications, « Daybreak », serait le premier à y avoir accès. OpenAI a révélé qu’Astra était son premier modèle à atteindre son seuil interne de cybersécurité « critique », et a précisé qu’elle prévoyait de limiter l’accès à ces fonctionnalités avancées. OpenAI subit des pressions pour renforcer ses mesures de sécurité et de protection depuis que deux de ses modèles ont échappé à leur confinement, ont accédé au Web public et ont piraté les systèmes de Hugging Face le mois dernier. À la suite de cet incident, l’entreprise a temporairement suspendu certaines de ses activités de recherche et de formation, y compris celles concernant Astra, bien que ce modèle n’ait pas été impliqué.

« L’IA ne peut être bénéfique pour l’humanité que si la sécurité en est un élément central ; c’est pourquoi nous consacrons plus de ressources informatiques et d’efforts que jamais à la sécurité, à la sûreté et à l’alignement », a déclaré Greg Brockman, président d’OpenAI, lors d’un point presse. L'entreprise a ajouté des mesures de protection supplémentaires à Astra à la suite de la faille de sécurité chez Hugging Face, et elle a déclaré qu'elle estimait que ces mesures « réduisaient suffisamment le risque de préjudice grave pour permettre sa mise à disposition ».

Altman a précisé que le nouveau modèle avait fait l'objet d'un processus d'examen officiel par l'administration Trump avant sa mise à disposition. Astra sera déployé « dans les prochains jours » auprès des utilisateurs des formules ChatGPT Plus, Pro, Business et Enterprise d’OpenAI, ainsi que via l’API OpenAI et Amazon Web Services, a indiqué OpenAI. Outre ses capacités avancées en matière de cybersécurité, Astra est à la pointe de la technologie dans des domaines tels que l’informatique, le génie logiciel, le travail professionnel et les sciences, a précisé OpenAI.

Selon un communiqué, le modèle est également plus performant pour rester concentré sur son objectif, respecter les limites des tâches, comprendre l’intention de l’utilisateur, accomplir des tâches fastidieuses et exécuter des flux de travail en plusieurs étapes. « Il reste encore du chemin à parcourir, je pense qu’il y a encore beaucoup d’améliorations à apporter, mais il y a ici quelque chose d’important qui, selon moi, constitue une amélioration qualitative, et c’est cela qui, à mes yeux, est significatif et représente un véritable tournant dans le type de travail que les gens peuvent déléguer à l’IA et dans la manière dont celle-ci peut leur donner les moyens d’agir », a déclaré Brockman.

La « profondeur récurrente » d’OpenAI effectue des boucles de raisonnement en interne, générant ainsi moins de traces lisibles que les chercheurs en sécurité utilisent pour surveiller le comportement du modèle avant qu’il n’agisse. Ce qui inquiète les concurrents d’OpenAI et les chercheurs en sécurité, ce n’est pas la capacité d’Astra à détecter et à exploiter des vulnérabilités « zero-day ». C’est la perte de visibilité qui a alarmé une partie de la communauté chargée de la sécurité de l’IA.

Voici l’annonce d’OpenAI concernant GPT-6 Astra :

Une nouvelle génération d'intelligence

Nous vous présentons GPT-6 Astra, le modèle le plus intelligent et le mieux aligné au monde. GPT-6 Astra est le fruit d’années de recherche et d’investissements ambitieux dans les domaines du pré-entraînement, de l’apprentissage par renforcement et de l’alignement. Astra est à la pointe de la technologie en matière d’utilisation de l’ordinateur, de navigation sur Internet, d’ingénierie logicielle, de cybersécurité, de sciences et de travail professionnel.

Astra atteint le score maximal (98 %) au test FrontierMath Tier 4, après avoir déjà contribué à résoudre des problèmes mathématiques ouverts de longue date. Astra atteint également le score maximal (99,9 %) à l’ARC-AGI-3 et le score maximal (100 %) à l’ExploitBench. Il repousse également les limites en matière d’utilisation de l’ordinateur et du navigateur, en gérant les tâches professionnelles les plus exigeantes avec une vitesse, une précision et un jugement inégalés. GPT-6 Astra est déployé auprès d’un nombre limité d’organisations et sera accessible dans les prochains jours à tous les utilisateurs de ChatGPT Plus, Pro, Business et Enterprise, ainsi que via l’API OpenAI et AWS.

Selon Greg Kamradt, de la Fondation ARC Prize, « Sur ARC-AGI-3, Astra a dépassé notre référence en matière d’efficacité d’action humaine dans 96 % des niveaux, atteignant ainsi la parité avec l’humain sur ce benchmark. Non seulement il s’agit du meilleur modèle que nous ayons jamais testé, mais cela représente également une avancée significative dans les performances des modèles de pointe – tant par sa capacité à s’adapter et à résoudre des environnements inédits que par l’efficacité avec laquelle il apprend à le faire. »

Astra est notre modèle le plus aligné, avec des améliorations substantielles en matière de compréhension de l’intention de l’utilisateur et du comportement du modèle : vous pouvez déléguer des tâches en ayant davantage confiance dans le jugement d’Astra. Pour tester cela, nous avons notamment mis au point une nouvelle évaluation inspirée de l’incident Hugging Face, qui évalue si un modèle confronté à une tâche difficile ou impossible dépassera le cadre prévu. Comparé à GPT-5.6 Sol, qui, en l’absence de mesures de sécurité en production, a dépassé la cible autorisée dans 48 % des cas, GPT-6 Astra ne l’a fait dans aucun cas.

Le meilleur modèle d'assistance informatique au monde

GPT-6 Astra ouvre de nouvelles perspectives en matière de rapidité, de précision et de sécurité dans l'utilisation des outils informatiques. Il peut se charger de tâches fastidieuses telles que remplir des formulaires en ligne, mettre à jour les fiches clients dans un CRM ou organiser votre agenda. Il peut effectuer des recherches en ligne et rédiger des résumés dans votre messagerie ou dans votre éditeur de documents. Il peut analyser des données scientifiques, générer des graphiques, créer un site web et effectuer des contrôles de qualité côté client pour s'assurer que toutes les fonctionnalités de ce site fonctionnent correctement. Il peut vous aider à installer et tester des logiciels de manière autonome, ainsi qu'à résoudre les problèmes que vous rencontrez à l'écran. Ces améliorations se reflètent également dans nos résultats d'évaluation à la pointe de la technologie.

Ces améliorations se traduisent également par des gains d’efficacité significatifs dans des tâches réelles de travail intellectuel. Lors de simulations de latence sur OSWorld 2.0, Astra affiche de meilleures performances en matière d’utilisation de l’ordinateur en environ 47 % de temps en moins par tâche que GPT-5.6 Sol, avec un score de 72,6 % en environ 40 minutes par tâche, contre 65,7 % en environ 75 minutes.

Parallèlement à Astra, nous mettons également à jour le harnais Codex afin d’améliorer considérablement la vitesse d’utilisation de l’ordinateur. Associée à l’efficacité d’Astra, cette amélioration se traduit par une exécution des tâches 1,9 fois plus rapide que celle offerte par l’expérience actuelle avec GPT-5.6 Sol, selon le benchmark Mind2Web. Grâce à ces gains de vitesse, le modèle est capable de prendre en charge pour vous de nombreuses tâches quotidiennes chronophages, et ce plus rapidement que vous ne pourriez le faire vous-même.

Selon Silas Alberti, vice-président senior chargé de la recherche, Cognition, « Nous intégrons GPT-6 Astra dans le harnais de Devin dès le jour de son lancement, où il affiche des performances de pointe lors de nos tests de référence internes. Son excellente maîtrise de l’informatique, de la rédaction et de la compréhension du code a permis d’améliorer les tests dès sa mise en service : les vidéos sont nettement plus faciles à suivre, et les rapports sont plus clairs et plus concis. »

Une véritable révolution dans le monde du travail

GPT-6 Astra allie les dernières avancées en matière d'informatique à une formation ciblée pour les environnements professionnels, afin de faciliter la réalisation de tâches complexes. Il combine l'intelligence nécessaire pour résoudre des problèmes complexes avec la capacité à exécuter des flux de travail en plusieurs étapes et à produire des documents, des feuilles de calcul et des présentations de grande qualité.

GPT-6 Astra est notre meilleur modèle pour respecter les modèles existants et produire des diapositives bien agencées qui transmettent de manière concise les points clés grâce à un récit structuré. Il crée des documents, des présentations, des feuilles de calcul et des analyses clairs et bien structurés, qui suivent vos modèles et correspondent à votre style rédactionnel et visuel. Astra est également entraînée pour extraire spécifiquement uniquement le contexte pertinent dans ses résultats, au lieu de répéter des informations inutiles pour le travail à accomplir. Tout cela signifie qu’elle peut produire des documents immédiatement exploitables, adaptés à votre contexte métier et à vos normes.

GPT-6 Astra apporte également une meilleure capacité d'évaluation visuelle aux sites web, jeux, applications et rendus qu'il crée. Grâce à la fonctionnalité « Sites » de ChatGPT, Astra peut créer, héberger et partager des sites web, des applications web et des jeux directement à partir d'une invite. Selon Alex Mashrabov, PDG et cofondateur de Higgsfield AI, « Astra nous offre un avantage considérable tant en termes de capacités que d’efficacité. Il gère avec brio nos flux de travail créatifs les plus complexes tout en utilisant jusqu’à 20 % de jetons en moins que les autres modèles que nous avons testés. Mais surtout, pour nos clients, cela se traduit par des résultats de meilleure qualité. »

Lorsque les instructions laissent place à l’interprétation, GPT-6 Astra est plus performant que les modèles précédents pour prendre la bonne décision. Il s’appuie sur le contexte pour combler les lacunes courantes et pose des questions ciblées lorsque la réponse est susceptible d’influencer le résultat. Dans Codex, il peut poser des questions de manière asynchrone tout en poursuivant les tâches qui ne dépendent pas de votre réponse. Si vous ne répondez pas, il procède à des hypothèses raisonnables lorsque cela est approprié, mais attend votre avis pour les décisions importantes.

Astra parvient également mieux à garder le cap à mesure qu'une tâche évolue. Les modèles précédents considéraient parfois les instructions de réorientation comme un nouvel objectif, perdant ainsi de vue la demande initiale ou les contraintes antérieures. Astra intègre les nouvelles exigences, change de cap lorsqu'on le lui demande et répond aux questions annexes sans perdre de vue la tâche globale.

Programmation

GPT-6 Astra est à ce jour le meilleur modèle pour l'ingénierie logicielle. Avec Astra, nous introduisons une nouvelle façon pour Codex de conserver et de récupérer le contexte lorsque la fenêtre de contexte est pleine. Jusqu’à présent, les modèles utilisaient la compression pour résumer le travail effectué au cours de longues sessions, par exemple lors du débogage de problèmes complexes ou de refactorisations de grande envergure. Chaque compression peut omettre des détails expliquant pourquoi une correction a échoué ou comment un composant se comporte.

Dans Codex, Astra peut conserver des notes d’une fenêtre de contexte à l’autre, préservant ainsi les détails accumulés sans les compresser à plusieurs reprises en un seul résumé. Les fenêtres de contexte antérieures restent consultables ; Astra peut ainsi retrouver des exigences ou des résultats de test issus de messages et de sorties d’outils précédents, même si ces informations n’ont pas été capturées dans ses notes. Vous pouvez activer cette fonctionnalité expérimentale dans votre fichier config.toml de Codex⁠(s’ouvre dans une nouvelle fenêtre) ; elle deviendra la valeur par défaut pour Astra dans les semaines à venir.

Faire progresser la recherche scientifique

GPT-6 Astra représente une avancée majeure pour la recherche scientifique, les mathématiques et la santé. Astra établit également de nouveaux records dans toute une série d’évaluations en mathématiques et en sciences. Astra peut faciliter le travail pratique qui sous-tend la découverte scientifique. En associant le raisonnement scientifique à l'utilisation de l'informatique, il peut intervenir directement dans des logiciels spécialisés pour analyser les données et explorer les résultats, aidant ainsi les chercheurs à évaluer les éléments probants et à déterminer les pistes de recherche à explorer ensuite.

Cybersécurité

Astra représente une avancée considérable en matière de capacités cybernétiques et atteint le seuil « Critique » en matière de cybersécurité selon notre cadre de préparation. Sa capacité à identifier et à développer des exploits « zero-day » peut aider les défenseurs à détecter et à corriger les failles, mais elle rend également nécessaire la mise en place de mesures de protection plus solides. Afin de comprendre l’étendue de ces capacités, nous avons soumis Astra à des évaluations menées en interne et par des experts tiers.

Nous avons d’abord testé le modèle sans mesures de sécurité de production sur ExploitBench et ExploitGym, qui évaluent si les modèles sont capables de transformer des vulnérabilités logicielles connues en exploits fonctionnels. Sur ExploitBench, Astra a obtenu un score parfait de 100 %, contre 78,5 % pour GPT-5.6 Sol, notre précédent modèle de pointe doté de capacités cybernétiques. Sur ExploitGym, Astra a atteint un taux de réussite de 42,4 %, contre 30,3 % pour GPT-5.6 Sol, tout en utilisant nettement moins de tokens de sortie.

Compte tenu des craintes que l'exposition à des vulnérabilités logicielles historiques ait pu affecter les résultats des tests de performance, nous avons également évalué Astra sur deux nouveaux benchmarks. D'une part, nous avons mis au point un test d'évaluation interne baptisé « ExploitBench (juin-août 2026) » afin de tester le développement d'exploits à partir des vulnérabilités identifiées au cours des trois derniers mois. Sur cet ensemble de données, Astra a atteint des taux d'exécution de code arbitraire nettement supérieurs à ceux de GPT-5.6 Sol, tout en utilisant un nombre de tokens de sortie bien moindre. Au cours de l'évaluation, Astra a même découvert et exploité deux vulnérabilités « zero-day » jusque-là inconnues. Nous communiquons ces deux vulnérabilités à leurs responsables de maintenance.

Nous avons également testé Astra sur SRE-Bench, un benchmark qui mesure la capacité des modèles à procéder à une ingénierie inverse de binaires logiciels afin d’en comprendre la logique fondamentale sans avoir accès au code source brut. Astra a résolu 88,0 % des tâches en une seule tentative et 99,2 % en quatre tentatives, contre respectivement 55,9 % et 68,7 % pour GPT-5.6 Sol. Au-delà des tests de performance, des évaluations menées par des experts ont révélé qu’Astra, lorsqu’il est exécuté sans les mesures de sécurité de production, pourrait exploiter des vulnérabilités jusque-là inconnues pour parvenir à l’exécution de code arbitraire dans des navigateurs renforcés et créer des exploits d’élévation de privilèges pour des systèmes d’exploitation renforcés.

Les capacités cyber de pointe peuvent aider les défenseurs à identifier plus rapidement les failles, mais elles facilitent également leur exploitation, ce qui rend d’autant plus urgente la nécessité pour les défenseurs de s’adapter. Grâce à la version d’Astra lancée, les défenseurs peuvent l’utiliser pour effectuer des tâches telles que la révision sécurisée du code et l’application de correctifs.

Cependant, Astra refusera d’exécuter des tâches de cybersécurité plus avancées, telles que la création d’exploits de preuve de concept pour des vulnérabilités. Grâce à OpenAI Daybreak⁠, nous prévoyons d’élargir l’accès et de mettre en place des mesures de sécurité moins restrictives dans les semaines à venir. Cela permettra davantage de workflows défensifs, notamment la validation des vulnérabilités et des preuves de concept, l’analyse des logiciels malveillants et l’ingénierie de détection.

Nous avons également renforcé nos protections contre les utilisations abusives potentielles, en nous appuyant sur notre ensemble de mesures de sécurité pour GPT-5.6 Sol. Celles-ci comprennent une robustesse accrue du modèle pour mieux résister aux tentatives potentielles de « jailbreak », ainsi qu’un contexte plus riche pour nos systèmes de...

La fin de cet article est réservée aux abonnés. Soutenez le Club Developpez.com en prenant un abonnement pour que nous puissions continuer à vous proposer des publications.