GPT-6 Astra : Lancement, benchmarks, prix et affirmation d'AGI d'OpenAI
GPT-6 Astra est officiel. OpenAI a présenté son nouveau modèle phare le 3 septembre 2026, annonçant un bond significatif dans le contrôle des ordinateurs, le codage, les mathématiques, la cybersécurité et les contextes longs. Parallèlement, la déclaration du président d'OpenAI, Greg Brockman, selon laquelle Astra pourrait marquer le début de l'ère AGI, suscite autant d'attention que les valeurs de référence elles-mêmes.
Au 5 septembre 2026, l'accès est encore en cours de déploiement progressif. Cet article sépare donc les données produit confirmées de l'auto-évaluation d'OpenAI : combien coûte réellement GPT-6 Astra, pour qui ChatGPT Astra sera activé, quels benchmarks sont particulièrement performants, où les modèles concurrents restent en tête et pourquoi un score de 99,9 % sur ARC-AGI-3 n'est pas encore une preuve scientifique d'AGI.
En bref
- Lancement : OpenAI a présenté GPT-6 Astra le 3 septembre 2026. Le déploiement a commencé avec un nombre limité d'organisations et devrait ensuite atteindre les offres Plus, Pro, Business et Enterprise.
- API : Le modèle s'appelle gpt-6-astra et est également proposé via Microsoft Azure et AWS Bedrock.
- Prix : Dans l'API standard, 1 million de tokens d'entrée coûte 10 USD et 1 million de tokens de sortie coûte 50 USD. L'entrée mise en cache coûte 1 USD par million de tokens.
- Benchmarks : Particulièrement notables sont 99,9 % sur ARC-AGI-3, 97,6 % sur FrontierMath Tier 4, 100 % sur ExploitBench et 72,6 % sur OSWorld 2.0.
- Pas numéro un partout : Sur Humanity's Last Exam avec outils, Astra obtient 57,2 %, tandis que Claude Fable 5.1 atteint 65,0 % dans le tableau comparatif d'OpenAI.
- AGI : Greg Brockman a déclaré qu'il croyait personnellement qu'OpenAI avait atteint l'AGI. Il s'agit d'une interprétation d'un responsable d'OpenAI, pas d'une conclusion scientifique indépendante.
Qu'est-ce que GPT-6 Astra ?
GPT-6 Astra est le nouveau modèle de pointe d'OpenAI pour des tâches de bout en bout particulièrement exigeantes. OpenAI le positionne non seulement comme un meilleur chatbot, mais comme un modèle capable de travailler directement avec des logiciels, de contrôler des navigateurs et des interfaces de bureau, d'écrire du code, de mener des recherches complexes et de générer des documents professionnels. Dans son annonce officielle, OpenAI décrit Astra comme son modèle le plus « intelligent et le plus aligné » à ce jour. Cette formulation est une évaluation du fabricant et ne doit pas être confondue avec un classement indépendant.
Techniquement, la grande fenêtre de contexte est particulièrement remarquable. La documentation de l'API mentionne 1 050 000 tokens de contexte et jusqu'à 128 000 tokens de sortie. La date limite de connaissance documentée est le 30 avril 2026. Pour le raisonnement, les développeurs peuvent choisir les niveaux faible, moyen, élevé, très élevé et maximum. Ceux qui souhaitent suivre le développement de la génération précédente trouveront également la classification de GPT-5.6 Sol et son déploiement ChatGPT.
Lancement de GPT-6 Astra : Qui recevra ChatGPT Astra ?
Le lancement n'est pas un interrupteur mondial activé simultanément pour tous les comptes le 3 septembre. OpenAI a commencé avec un groupe limité d'organisations et a annoncé qu'il déploierait GPT-6 Astra pour ChatGPT Plus, Pro, Business et Enterprise dans les jours suivants. Les clients Pro, Business et Enterprise recevront également un accès supplémentaire à GPT-6 Astra Pro. Pour les clients Enterprise, Astra est désactivé par défaut au démarrage et doit être activé par les administrateurs pour l'espace de travail.
Important : OpenAI ne mentionne dans son annonce Astra aucune disponibilité générale pour les comptes Free ou Go. Par conséquent, ceux qui ne voient pas encore le modèle le 5 septembre 2026, malgré un tarif potentiellement éligible, peuvent simplement être encore dans le déploiement progressif. L'utilisation d'Astra dans ChatGPT est incluse dans les quotas tarifaires existants selon OpenAI ; une utilisation supplémentaire devrait être possible via des crédits. Il n'y a donc pas de "tarif Astra" mensuel annoncé séparément.

Source: simpleicons.org
GPT-6 Astra n'est pas seulement proposé directement via OpenAI. OpenAI mentionne explicitement Microsoft Azure comme voie de distribution supplémentaire pour les développeurs et les entreprises.

Source: simpleicons.org
AWS Bedrock fait également partie du déploiement annoncé d'Astra. Pour les architectures cloud existantes, cela peut être plus important qu'un changement direct vers l'API OpenAI.
Benchmarks de GPT-6 Astra : Quel est le bond ?
Les chiffres les plus élevés se situent dans des domaines où les modèles d'agents atteignaient auparavant rapidement leurs limites : résolution de problèmes abstraits, contrôle d'ordinateurs, développement de logiciels et tâches de sécurité offensives. La publication d'OpenAI contient à la fois des benchmarks externes et des tests internes. Les reproductions indépendantes ne sont naturellement pas encore possibles pour les évaluations internes.
| Benchmark | GPT-6 Astra | GPT-5.6 Sol | Classification |
|---|---|---|---|
| ARC-AGI-3 | 99,9 % | 7,8 % | Saut extrêmement important dans les nouvelles tâches d'abstraction interactives |
| FrontierMath Tier 4 (v2) | 97,6 % | 83,0 % | Performances très élevées en mathématiques complexes |
| Terminal-Bench 4.0 | 57,9 % | 37,3 % | Progrès significatifs dans le codage agentique dans le terminal |
| OSWorld 2.0 | 72,6 % | 65,7 % | Meilleur contrôle de l'ordinateur ; OpenAI signale également des temps de tâche nettement plus courts |
| AutomationBench | 41,4 % | 18,1 % | Plus du double du score pour les tâches d'automatisation professionnelles |
| ExploitBench | 100,0 % | 78,5 % | Démontre une capacité de développement d'exploitation très forte dans des tests contrôlés |
Ces chiffres sont impressionnants, mais ils nécessitent du contexte. OpenAI lui-même souligne que les évaluations GPT ont été effectuées dans un environnement de recherche ou via l'API. ChatGPT en production peut produire des résultats légèrement différents en raison de différents prompts système, outils et mécanismes de sécurité. De plus, le tableau comparatif présente les meilleurs scores obtenus sur différentes charges de raisonnement.
Astra ne gagne pas non plus tous les tests. Un bon contre-exemple est Humanity's Last Exam avec outils : Astra obtient 57,2 %, tandis que Claude Fable 5.1 est indiqué à 65,0 % dans le même tableau OpenAI. L'indice d'intelligence d'analyse artificielle est de 61,2 pour Astra, également inférieur à plusieurs modèles Claude répertoriés. Cela contredit l'affirmation simpliste selon laquelle Astra serait automatiquement le meilleur modèle dans toutes les dimensions.
Pourquoi ARC-AGI-3 attire autant l'attention
Le passage de 7,8 % pour GPT-5.6 Sol à 99,9 % pour GPT-6 Astra est la valeur individuelle la plus spectaculaire du lancement. ARC-AGI-3 est censé tester si un système découvre des règles dans de nouveaux environnements interactifs et agit efficacement, au lieu de simplement récupérer des modèles connus. La ARC Prize Foundation a déclaré dans l'article de lancement d'OpenAI qu'Astra avait surpassé la baseline d'efficacité d'action humaine sur 96 % des niveaux. C'est un signal fort pour de nouvelles capacités de résolution de problèmes, mais pas encore une mesure générale de toutes les capacités humaines.
Prix de GPT-6 Astra : Combien coûte l'API ?
Pour les développeurs, la structure tarifaire est plus claire que les tarifs ChatGPT : OpenAI facture Astra dans l'API standard par token. Les valeurs s'appliquent par million de tokens texte.
| Facturation | Prix par 1 million de tokens |
|---|---|
| Entrée | 10,00 USD |
| Entrée mise en cache | 1,00 USD |
| Écriture en cache | 12,50 USD |
| Sortie | 50,00 USD |
Avec des prompts très importants, cela coûte plus cher : dès qu'une requête contient plus de 272 000 tokens d'entrée, OpenAI facture pour l'ensemble de la requête le double du taux d'entrée et de cache, ainsi que le taux de sortie multiplié par 1,5. Selon la documentation du modèle, le batch et le flex coûtent 50 % des tarifs standard. Le mode Fast, en revanche, coûte le double du taux applicable et devrait offrir une vitesse doublée. Ainsi, la fenêtre de contexte maximale est techniquement attrayante, mais pas automatiquement économique. Ceux qui alimentent régulièrement des centaines de milliers de tokens dans des exécutions d'agents devraient prendre au sérieux la mise en cache des prompts, la sélection du contexte et la division des tâches. L'aperçu plus ancien de Zerlo sur ChatGPT 5.4 et sa structure de prix d'API montre à quel point les coûts ont évolué entre les générations de modèles.
OpenAI a-t-il atteint l'AGI avec GPT-6 Astra ?
La déclaration est confirmée, pas la preuve. Axios a rapporté lors de la conférence de presse de lancement que le président d'OpenAI, Greg Brockman, croyait personnellement qu'OpenAI avait atteint l'AGI avec Astra, ou que ce modèle pouvait rétrospectivement être considéré comme l'arrivée de l'Intelligence Artificielle Générale. Il a simultanément laissé l'interprétation finale aux utilisateurs. Le communiqué produit officiel d'OpenAI présente Astra de manière très offensive comme une nouvelle génération d'intelligence, mais ne fournit aucune certification indépendante selon laquelle un seuil d'AGI généralement accepté aurait été dépassé.
Le problème principal réside dans la définition. Il n'existe pas de test universellement accepté pour l'AGI qui, une fois atteint, qualifierait objectivement un modèle d'"AGI". Un modèle peut saturer presque un benchmark abstrait individuel et rester en deçà des modèles concurrents dans d'autres domaines, faire des erreurs, nécessiter des limites de sécurité ou échouer dans des tâches réelles à long terme. C'est précisément ce que montre le tableau de benchmarks d'OpenAI : Astra est exceptionnellement fort sur ARC-AGI-3, mais pas le leader sur Humanity's Last Exam avec outils.
La formulation la plus objectivement sensée est donc la suivante : GPT-6 Astra est un candidat exceptionnellement fort dans le débat actuel sur l'AGI, mais l'affirmation d'AGI d'OpenAI reste une évaluation de l'entreprise et de la direction. Que la recherche et le public considèrent également ce seuil comme atteint dépend de la définition d'AGI utilisée et des réplications indépendantes en utilisation réelle.
Contrôle informatique et agents : C'est là qu'Astra devient pratiquement pertinent
Le changement le plus important par rapport à un modèle de chat classique n'est pas seulement plus de connaissances ou un score de codage plus élevé, mais la capacité d'exécuter directement des tâches. OpenAI cite comme exemples la gestion des formulaires, les mises à jour CRM, l'organisation des calendriers, la recherche, l'installation de logiciels, le dépannage, l'analyse de données et le contrôle qualité frontal. Sur OSWorld 2.0, Astra atteint 72,6 % contre 65,7 % pour GPT-5.6 Sol. Dans la simulation de latence d'OpenAI, Astra a mis environ 40 minutes par tâche au lieu de 75 minutes, soit environ 47 % de temps en moins. Pour les entreprises, cette combinaison de raisonnement, d'utilisation de l'ordinateur et de contexte long peut être plus importante qu'un point de pourcentage supplémentaire sur un benchmark de connaissances. Un agent qui comprend correctement une tâche, peut utiliser plusieurs applications et maintenir le contexte sur de longues périodes peut potentiellement changer des flux de travail entiers. Simultanément, cela augmente également l'importance des autorisations, des dialogues de confirmation, de la journalisation et des limites claires.
Le revers de la médaille : Astra atteint le seuil "Critique" d'OpenAI pour la cybersécurité
OpenAI classe GPT-6 Astra comme son premier modèle propriétaire à atteindre le seuil critique dans le cadre de préparation pour les capacités cybernétiques. Sans protection de production, Astra a pu, selon OpenAI, trouver des vulnérabilités inconnues et développer des exploits contre des systèmes durcis. Le modèle atteint 100 % sur ExploitBench et 42,4 % sur ExploitGym. Ceux qui souhaitent comprendre plus en détail le fonctionnement de ce benchmark trouveront une explication détaillée chez Zerlo sur ExploitGym et le développement d'exploits assisté par l'IA.
OpenAI réagit à cela avec des mécanismes de protection renforcés et des restrictions pour les tâches cybernétiques offensives avancées. Parallèlement, il existe une deuxième observation désagréable : dans des tests spécialement conçus pour être contradictoires, le raisonnement écrit d'Astra était plus difficile à surveiller que celui de GPT-5.6 Sol. OpenAI attribue cela, entre autres, au fait qu'Astra a plus de contrôle sur son raisonnement écrit et peut résoudre des problèmes plus simples avec moins d'étapes intermédiaires visibles. L'entreprise qualifie elle-même la diminution de la monitorabilité de sujet de recherche sérieux.
Cela ne semble contradictoire qu'à première vue avec l'affirmation d'OpenAI selon laquelle Astra est plus « aligné ». Un modèle peut fréquemment rester dans les limites spécifiées dans son comportement normal tout en possédant des capacités techniquement plus dangereuses. C'est précisément pourquoi le comportement du modèle, les capacités de base et les systèmes de protection externes doivent être considérés séparément.
Qu'est-ce que GPT-6 Astra signifie pour les utilisateurs et les développeurs ?
Pour les utilisateurs normaux de ChatGPT, la question à court terme la plus importante est le déploiement. Ceux qui utilisent Plus, Pro, Business ou Enterprise ne doivent pas supposer que l'absence d'accès à Astra le 5 septembre est déjà une erreur. OpenAI parle explicitement d'un déploiement progressif sur plusieurs jours.
Pour les développeurs, la décision est plus économique. Astra est particulièrement intéressant là où une seule exécution réussie a une grande valeur : agents de codage complexes, grands dépôts, automatisation de l'utilisation informatique, recherche approfondie ou longs flux de travail professionnels. Pour une classification simple, une génération de texte courte ou des tâches de masse sensibles aux coûts, un modèle plus petit peut toujours être plus judicieux. Le prix élevé de sortie de 50 USD par million de tokens et les suppléments pour des contextes très longs rendent un choix de modèle propre plus important, et non moins important.
Pour les entreprises, un troisième facteur s'ajoute : la gouvernance. Un agent plus performant ne devrait pas automatiquement recevoir plus de droits. En particulier pour les systèmes de fichiers, les navigateurs, les e-mails, les applications internes et les ressources cloud, les autorisations minimales, les confirmations pour les actions irréversibles et les pistes d'audit traçables doivent rester la norme.
FAQ
Quand GPT-6 Astra a-t-il été publié ?
OpenAI a présenté GPT-6 Astra le 3 septembre 2026. Le déploiement a commencé auprès d'un nombre limité d'organisations et sera ensuite progressivement étendu à ChatGPT Plus, Pro, Business et Enterprise, ainsi qu'à l'API, Microsoft Azure et AWS Bedrock.
GPT-6 Astra est-il déjà disponible dans ChatGPT Plus ?
OpenAI a explicitement annoncé Plus pour le déploiement. Étant donné que le déploiement s'effectue sur plusieurs jours, un compte Plus éligible pourrait ne pas encore montrer d'accès à Astra le 5 septembre 2026. Cela seul n'est pas encore un signe de défaut technique.
Combien coûte GPT-6 Astra dans l'API ?
Le prix standard est de 10 USD par 1 million de tokens d'entrée et 50 USD par 1 million de tokens de sortie. Les entrées mises en cache coûtent 1 USD et les écritures de cache 12,50 USD par million de tokens. Les requêtes avec plus de 272 000 tokens d'entrée sont soumises à des multiplicateurs plus élevés.
Quelle est la taille de la fenêtre de contexte de GPT-6 Astra ?
La documentation de l'API d'OpenAI indique une fenêtre de contexte de 1 050 000 tokens et un maximum de 128 000 tokens de sortie. Cependant, les requêtes très longues ne sont pas seulement techniquement plus exigeantes, elles sont aussi plus chères à partir de plus de 272 000 tokens d'entrée.
GPT-6 Astra a-t-il vraiment atteint l'AGI ?
Cela n'est pas prouvé objectivement. Greg Brockman a déclaré qu'il croyait personnellement qu'OpenAI avait atteint l'AGI, ou plutôt qu'Astra pouvait être considéré comme le début de l'ère de l'AGI. Il n'existe cependant pas de benchmark scientifique universellement accepté qui fixe un seuil universel d'AGI. Cette affirmation doit donc être interprétée comme une évaluation d'OpenAI et non comme un fait scientifique établi.
GPT-6 Astra est-il plus sûr que GPT-5.6 Sol ?
OpenAI rapporte de meilleurs résultats dans plusieurs tests d'alignement et de limites, tout en possédant des capacités cybernétiques nettement plus fortes et en étant plus difficile à surveiller dans des tests contradictoires via son raisonnement écrit. « Plus sûr » dépend donc de si l'on considère le comportement, les capacités sous-jacentes ou la surveillabilité.
Conclusion
GPT-6 Astra est une sortie réelle et techniquement exceptionnelle, pas une simple rumeur. Les points forts confirmés sont la fenêtre de contexte de 1,05 million de tokens, des progrès significatifs dans l'utilisation informatique et le codage, ainsi que des scores extrêmement élevés sur les benchmarks ARC-AGI-3, FrontierMath et Cybersecurity. Parallèlement, une image nuancée reste nécessaire : Astra n'est pas leader dans tous les comparaisons, le déploiement est toujours en cours et la nouvelle performance cybernétique crée des risques de sécurité supplémentaires.
L'affirmation d'AGI d'OpenAI est donc la partie du lancement qui nécessite le plus d'éclaircissements. La déclaration de Brockman est remarquable, mais un score ARC-AGI-3 presque parfait ne transforme pas une définition controversée en un fait scientifique établi. Pour les utilisateurs, Astra est avant tout un nouveau modèle ChatGPT et agent très performant ; qu'il soit effectivement considéré rétrospectivement comme le début de l'ère de l'AGI, cela ne se révélera qu'à travers des tests indépendants et une utilisation réelle à long terme.