Technologie GPT
Famille de modèles de langage d'OpenAI, de GPT-5.6 (Sol, Terra, Luna) à GPT-6 Astra : raisonnement, codage agentique, usage d'ordinateur.
SFEIR AI · Publié le 16 juillet 2026 · Mis à jour le 14 septembre 2026
La famille de modèles de langage d'OpenAI
GPT (Generative Pre-trained Transformer) désigne la famille de modèles de langage développée par OpenAI. Elle a popularisé l'IA générative grand public avec ChatGPT, puis s'est imposée comme l'une des références pour le raisonnement, le codage agentique et la génération de contenu. L'entité GPT couvre les modèles eux-mêmes, distincts du laboratoire OpenAI qui les conçoit — comme Claude est distinct d'Anthropic ou Gemini de Google.
GPT-5.6 : Sol, Terra, Luna
Le 9 juillet 2026, OpenAI a rendu GPT-5.6 généralement disponible, non pas comme un modèle unique mais comme une famille de trois « tiers de capacité » : Sol (le flagship, pour les tâches complexes long-horizon et le coding avancé, seul à débloquer les modes « max » et « ultra »), Terra (l'équilibré, candidat au statut de modèle par défaut en production) et Luna (le rapide et économique, pour le haut volume, le résumé, la classification et le routing).
Le nombre désigne la génération ; Sol, Terra et Luna désignent des tiers appelés à évoluer à leur rythme. Les trois partagent une fenêtre de contexte d'environ 1,05 million de tokens, un plafond de 128 000 tokens en sortie et une coupure de connaissances au 16 février 2026. La famille est disponible dès le premier jour sur ChatGPT, l'API OpenAI, Codex, GitHub Copilot, Cursor et Amazon Bedrock.
GPT-6 Astra, 3 septembre 2026
Le 3 septembre 2026, OpenAI met en ligne GPT-6 Astra, deux jours après Claude Fable 5.1 et au même tarif : 10 $ par million de tokens en entrée, 50 $ en sortie, le double en mode Fast, soit 2,5 fois le prix de GPT-5.6 Sol. L'identifiant API est gpt-6-astra. Le déploiement passe par le programme Daybreak pour les capacités cyber, puis ChatGPT Plus, Pro, Business et Enterprise, l'API, Amazon Bedrock et Azure.
Les gains les mieux établis portent sur les agents : 72,6 % sur OSWorld 2.0 (score partiel) contre 65,7 % pour Sol, en deux fois moins de temps par tâche, et un coût par tâche inférieur de moitié à Fable 5 sur le Coding Agent Index d'Artificial Analysis, à score égal. Sur l'Intelligence Index du même cabinet, Astra reste à 61, le score de Sol, derrière Fable 5.1 (66). Le 99,9 % annoncé sur ARC-AGI-3 est obtenu avec un harnais fourni par OpenAI ; avec le harnais standard, ARC Prize mesure 62,7 %. Voir notre analyse d'Astra.
Coût d'inférence et routing multi-modèles
L'enjeu structurant de GPT-5.6 n'est pas un score de benchmark mais une grille tarifaire agressive et une mécanique de facturation nouvelle (écritures de cache facturées, surcoût long contexte). La bonne question n'est plus « quel modèle est le champion ? » mais « comment router le travail entre modèles selon le triptyque intelligence / vitesse / coût ». C'est le cœur d'une approche FinOps de l'inférence, développée dans notre analyse de l'illusion du prix par token.
Lecture SFEIR : neutralité et souveraineté
SFEIR est à la fois partenaire Google Cloud Premier et partenaire Anthropic : ni modèle à vendre, ni camp à défendre. Notre lecture des modèles GPT est celle d'ingénieurs, factuelle et chiffrée. Pour les organisations européennes, GPT reste servi sous juridiction américaine : sa place dans une architecture critique relève de la stratégie multi-LLM souveraine — abstraction des modèles et plan de sortie comme garde-fous contre la dépendance mono-fournisseur.
Questions fréquentes
Quelle est la différence entre GPT et OpenAI ?
OpenAI est le laboratoire d'IA américain qui conçoit les modèles ; GPT (Generative Pre-trained Transformer) est la famille de modèles de langage qu'il produit. La distinction est la même qu'entre Anthropic et Claude, ou Google et Gemini.
Que sont Sol, Terra et Luna dans GPT-5.6 ?
Ce sont les trois tiers de capacité de la génération GPT-5.6, disponibles depuis le 9 juillet 2026. Sol est le flagship (tâches complexes, coding avancé), Terra l'équilibré (défaut en production), Luna le rapide et économique (haut volume, faible latence).
Qu'est-ce que GPT-6 Astra ?
Le modèle de tête d'OpenAI, mis en ligne le 3 septembre 2026, au prix de Claude Fable 5.1 (10 $ / 50 $ par million de tokens). Ses gains les plus solides portent sur l'usage d'ordinateur et le codage agentique ; sur le travail de connaissance général, les mesures indépendantes le placent au niveau de GPT-5.6 Sol.
GPT-6 Astra a-t-il atteint 99,9 % sur ARC-AGI-3 ?
Avec un harnais fourni par OpenAI qui conserve l'état de raisonnement entre les requêtes, oui. Avec le harnais standard commun à tous les modèles, ARC Prize mesure 62,7 %. Les deux chiffres décrivent le même modèle et ARC Prize ne revendique pas l'AGI.
Sources
- OpenAI — GPT-6 Astra: A new generation of intelligence · 2026-09-03
- ARC Prize — OpenAI's GPT-6 Astra on ARC-AGI-3 · 2026-09-03
we are not claiming that it is AGI
- Artificial Analysis — Benchmarking GPT-6 Astra · 2026-09-03
- OpenAI — GPT-5.6 (Sol, Terra, Luna), annonce de disponibilité générale · 2026-07-09
GPT dans vos projets
Échanger avec SFEIRArticles liés
La course aux capitaux derrière GPT-6 Astra : 207 milliards levés, 725 milliards de capex, et le mot bulle
Entre janvier et mai 2026, OpenAI, Anthropic et xAI ont levé 207 milliards de dollars ; les hyperscalers engagent 725 milliards de capex. Qui paie l'ère de l'AGI, ce que disent les comptes derrière les annonces, qui prononce le mot bulle, et ce que cela change pour vos budgets IA.
GPT-6 Astra : un vrai saut sur les agents, un récit d'AGI taillé pour l'entrée en Bourse
GPT-6 Astra (3 septembre 2026) : gains réels en usage d'ordinateur et en codage, prix aligné sur Fable 5.1, score ARC-AGI-3 qui passe de 99,9 % à 62,7 % selon le harnais. Et un « Welcome to the AGI era » qui arrive six mois après une levée de 122 milliards de dollars.
GPT-5.6 Sol, Terra, Luna : comment OpenAI rebat les cartes du coding agentique et du pricing
Le 9 juillet 2026, OpenAI a rendu GPT-5.6 généralement disponible, non pas un modèle mais trois : Sol, Terra, Luna. Lecture d'ingénieurs, chiffrée et sans parti pris : ce que la famille change pour le coût d'inférence, le routing entre modèles et l'équilibre concurrentiel avec Claude.
Sol, Terra, Luna : comment choisir et optimiser les coûts dans la famille GPT-5.6
Avec GPT-5.6, OpenAI ne vend plus un modèle mais une échelle de prix-performance : un facteur 5× entre Luna et Sol. Bien exploitée, elle divise votre facture ; mal exploitée, elle la multiplie. Le guide de décision SFEIR pour choisir le bon tier et optimiser le prompt caching.
Terminal-Bench et Coding Agent Index : pourquoi GPT-5.6 prend l'avantage sur les agents de coding en production
En production, un agent de coding ne se juge pas à un score mais à sa capacité à terminer le travail : en un minimum d'étapes, d'appels d'outils et de tokens. Sur ce terrain, Terminal-Bench 2.1 et Coding Agent Index, GPT-5.6 prend l'avantage. Voici pourquoi, et où passe la limite.
GPT-5.6 sur la voie de Fable 5 : les modèles d'IA de pointe passent sous contrôle gouvernemental
Après la suspension mondiale de Fable 5, OpenAI retarde GPT-5.6 sur demande de l'administration Trump : un déploiement en preview validé au cas par cas. Le « release and see » des modèles frontier est terminé, et la souveraineté devient un sujet de conseil d'administration.
Le prix par token est une illusion : mesurer le coût par résultat
Comparer les grilles tarifaires ne dit presque rien de la facture réelle. Sur un cycle agentique, la dépense suit l'ingestion, pas la génération : 153 pour 1. Un modèle « moins cher au token » qui relit plus n'économise rien. Le seul indicateur qui compte est le coût par résultat.
Architecture multi-LLM souveraine : la résilience par le design
L'architecture multi-LLM souveraine est la réponse structurelle à la dépendance aux fournisseurs d'IA. Routage par sensibilité, modèles open source comme porte de sortie et résilience par le design : les clés d'une stratégie IA durable.
Comment choisir son modèle LLM en 2026 : la carte, pas le classement
Cinq laboratoires, des capacités qui convergent, des prix qui s'effondrent : en 2026, « quel est le meilleur modèle ? » devient la mauvaise question. Voici le cadre de décision qui remplace le classement : router par tâche, mesurer le coût par résultat, rester réversible, investir dans le système.