AI Cert Prep
Saisissez un mot-clé pour rechercher dans la documentation.

Annexes · OpenAI

Gamme de modèles et tarifs (OpenAI)

La gamme de modèles API OpenAI de septembre 2026, les IDs et alias, les niveaux de reasoning effort, les tarifs, les fenêtres de contexte, les familles de modèles spécialisées, un tableau de sélection et des calculs de coût détaillés.

Ceci est la référence unique pour les IDs, tarifs et limites des modèles OpenAI utilisés dans l’ensemble des pistes OpenAI. Tout ce qui figure ici reflète la gamme API publiée au 15 septembre 2026 ; les tarifs sont en USD par million de tokens (MTok) et sensibles au déploiement, alors traitez le tableau comme un instantané à partir duquel raisonner, pas comme une grille tarifaire en direct. Revérifiez auprès des pages API pricing et API models avant d’engager une architecture ou un budget.

Gamme API (septembre 2026)

Tous les derniers modèles acceptent du texte et des images en entrée, produisent du texte en sortie, sont multilingues et prennent en charge la vision. Ils sont servis via la Responses API et les SDK clients.

ModèleIDReasoning effortsEntrée $/MTokSortie $/MTokContexteSortie maxDate de coupure des connaissances
GPT-6 Astragpt-6-astralow, medium, high, xhigh, max$10$501.05M128K30 Apr 2026
GPT-5.6 Solgpt-5.6-sol (alias gpt-5.6)none…max$4$201.05M128K16 Feb 2026
GPT-5.6 Terragpt-5.6-terranone…max$2$121.05M128K16 Feb 2026
GPT-5.6 Lunagpt-5.6-lunanone…max$0.20$1.201.05M128K16 Feb 2026

Génération précédente, toujours disponible : gpt-5.5 à $5 / $30 et gpt-5.5-pro à $30 / $180. Les modèles hérités restent appelables ; les nouveaux travaux devraient viser la ligne GPT-5.6 ou Astra.

Les alias bougent, les IDs épinglés non

gpt-5.6 est un alias qui résout vers gpt-5.6-sol. Les alias peuvent être repointés par OpenAI ; épinglez l’ID explicite (gpt-5.6-sol, gpt-5.6-terra, gpt-5.6-luna, gpt-6-astra) en production, afin qu’un changement d’alias côté serveur ne modifie jamais silencieusement votre coût ou votre comportement.

Reasoning effort

Les modèles GPT-5.6 acceptent des efforts de none à max ; Astra fonctionne avec low, medium, high, xhigh, max. La règle, tirée directement de la documentation, est d’utiliser le reasoning effort le plus bas qui donne le résultat — un effort plus élevé dépense davantage de tokens de sortie (et donc plus d’argent et de latence) en raisonnement interne. Il n’existe aucune correspondance exacte entre les efforts GPT-5.5 et GPT-5.6, alors reréglez plutôt que de porter un paramètre d’effort d’une génération à l’autre.

EffortÀ dépenser sur
none (5.6 uniquement)Transformations déterministes où le raisonnement n’apporte rien
lowTâches mécaniques et bien spécifiées
mediumRaisonnement quotidien ; un défaut sensé
highProblèmes réellement difficiles et ouverts
xhighLe travail multi-étapes le plus difficile ; Astra et 5.6
maxDélibération maximale sur une tâche ; à utiliser avec parcimonie

Positionnement des modèles

Guide de sélection, tiré directement de la documentation :

Signal dans le scénarioChoisirPourquoi
Travail de bout en bout le plus difficile : raisonnement soutenu, jugement, orchestration multi-outilsGPT-6 AstraLe modèle de pointe ; acceptez le tarif $10 / $50
Travail complexe, ouvert et à forte valeurGPT-5.6 SolRaisonnement solide en dessous du tarif d’Astra
Polyvalent pragmatique ; remplaçant naturel des charges GPT-5.5GPT-5.6 TerraCoût et qualité équilibrés
Tâches claires, répétables, à fort volume : extraction, classification, transformation, résumés structurésGPT-5.6 LunaLe moins cher d’un ordre de grandeur
Migration d’une charge GPT-5.5 existanteTerra d’abord, benchmark, puis décidezLa correspondance coût/qualité la plus proche
text
capability ▲
│ GPT-6 Astra frontier, judgment, multi-tool
│ GPT-5.6 Sol complex, open-ended, high-value
│ GPT-5.6 Terra pragmatic all-rounder
│ GPT-5.6 Luna high-volume, structured, cheap
└───────────────────────────────► $ / MTok rises
choose the lowest tier that clears the task, then the lowest effort that clears it

Noms de modèles côté ChatGPT

Le produit grand public/entreprise expose des libellés différents pour la même famille sous-jacente. Ne supposez pas qu’un ID d’API existe pour un libellé ChatGPT, ni l’inverse.

Libellé ChatGPTNotes
GPT-5.6 SolModèle par défaut capable de raisonnement
GPT-5.6 Sol ProSol de niveau supérieur
GPT-5.6 TerraPolyvalent
GPT-5.6 LunaRapide, léger
GPT-5 Thinking MiniModèle de raisonnement léger
GPT-6 Pro (propulsé par GPT-6 Astra)Sur Pro $100 / Pro $200 / Business / Enterprise

Les modèles hérités restent disponibles dans ChatGPT. La liste exacte des modèles qu’un utilisateur voit est dépendante du plan — voir la référence des fonctionnalités et plans ChatGPT.

Familles de modèles spécialisées

Ce sont des lignes conçues à dessein, dont plusieurs sont réservées aux organisations autorisées ou approuvées. Ne routez jamais du trafic général vers elles.

FamilleModèlesObjectif / accès
Cybergpt-5.6-cyber, gpt-daybreak-red-latest, gpt-daybreak-blue-latestTravail de sécurité autorisé uniquement
Sciences du vivantgpt-rosalind-researchRecherche en sciences du vivant, organisations approuvées
Imagegpt-image-2.5-sunburst, gpt-image-2.5-flareGénération d’images
Realtime / GPT-Livegpt-live-1, gpt-realtime-2.1, gpt-realtime-2.1-mini, gpt-realtime-2, gpt-realtime-translate, gpt-realtime-1.5Voix / realtime faible latence et traduction en direct
Transcriptiongpt-transcribe, gpt-live-transcribe, gpt-realtime-whisper, gpt-4o-transcribe, gpt-4o-mini-transcribeSpeech-to-text
TTSgpt-4o-mini-ttsText-to-speech

Familles réservées

Les modèles Daybreak (red/blue) et gpt-5.6-cyber sont réservés au travail de sécurité autorisé, et gpt-rosalind-research est limité aux organisations approuvées en sciences du vivant. Un scénario qui recourt à l’un d’eux pour du trafic applicatif ordinaire choisit le mauvais outil.

Sélectionner un modèle — tableau de décision

Le scénario dit…ModèleEffortLivraison
« extraire des champs de millions de documents, à bas coût »Lunalow/noneBatch
« assistant face au client, équilibré »TerramediumRealtime
« analyse ouverte et difficile, à forte valeur »SolhighRealtime
« la tâche de codage / recherche agentique la plus difficile qu’on ait »Astraxhigh/maxRealtime ou Agents API
« job nocturne hors ligne, la latence n’a pas d’importance »n’importe quel niveauselon le besoinBatch (remisé)
« le même long system prompt à chaque appel »n’importe quel niveauselon le besoinprompt caching
« nous migrons notre charge GPT-5.5 »Terrabenchmarkcomparez avant de basculer

Calculs de coût détaillés

Les tarifs sont par MTok. Ils illustrent des différences d’ordre de grandeur ; faites vos propres calculs par rapport aux tarifs en direct avant de vous engager.

Exemple 1 — une seule réponse RAG de 50 k tokens

Une réponse augmentée par récupération avec 50 000 tokens en entrée (contexte récupéré + prompt) et 1 000 tokens en sortie, un seul appel.

ModèleCoût entréeCoût sortieTotal
Luna50k × $0.20/1M = $0.0101k × $1.20/1M = $0.0012≈ $0.0112
Terra50k × $2/1M = $0.1001k × $12/1M = $0.012≈ $0.112
Sol50k × $4/1M = $0.2001k × $20/1M = $0.020≈ $0.220
Astra50k × $10/1M = $0.5001k × $50/1M = $0.050≈ $0.550

Le côté entrée domine une réponse RAG parce que le contexte récupéré est volumineux par rapport à la réponse. Astra coûte ~49× Luna pour la même réponse — le choix du modèle est donc une décision de qualité de récupération, pas de puissance de raisonnement, sauf si la synthèse est réellement difficile.

Exemple 2 — un job batch d’un million de tokens

Classifier ou transformer un million de tokens en entrée avec 200 k tokens en sortie, exécuté hors ligne.

ModèleEntréeSortieTotal realtimeAvec Batch (hors ligne)
Luna1M × $0.20 = $0.200.2M × $1.20 = $0.24$0.44le moins cher ; Batch le réduit encore
Terra1M × $2 = $2.000.2M × $12 = $2.40$4.40à réserver aux items plus difficiles
Sol1M × $4 = $4.000.2M × $20 = $4.00$8.00rarement justifié pour de la classification

Pour du travail structuré à fort volume, Luna sur Batch est le défaut ; escalader un sous-ensemble vers Terra uniquement là où un validateur signale une qualité faible est une cascade, pas une montée en gamme généralisée.

Exemple 3 — une session d’agent

Une seule session d’agent qui consomme 300 k tokens en entrée (contexte accumulé, résultats d’outils, compaction) et produit 40 k tokens en sortie sur de nombreux tours.

ModèleEntréeSortieTotal
Terra300k × $2/1M = $0.6040k × $12/1M = $0.48≈ $1.08
Sol300k × $4/1M = $1.2040k × $20/1M = $0.80≈ $2.00
Astra300k × $10/1M = $3.0040k × $50/1M = $2.00≈ $5.00

Les sessions d’agent accumulent du contexte, donc la compaction et la synthèse de contexte (voir l’aide-mémoire Agents) sont les vrais leviers de coût : une session qui laisse le contexte croître sans limite sur Astra est là où les budgets disparaissent. Mettre en cache (prompt caching) un system prompt stable d’un tour à l’autre aide aussi.

Signal d’évaluation

Un énoncé qui associe « le moins cher », « fort volume », « extraction » ou « classification » à une fenêtre tolérante à la latence pointe vers Luna sur Batch. Un énoncé qui dit « le plus difficile », « raisonnement soutenu » ou « jugement multi-outils » pointe vers Astra. « Remplaçant naturel de notre charge GPT-5.5 » est l’indice Terra.

Comment revérifier

  1. Ouvrez developers.openai.com/api/docs/models pour les IDs, alias, fenêtres de contexte et dates de coupure actuels.
  2. Ouvrez developers.openai.com/api/docs/pricing pour les tarifs entrée/sortie en direct et toute remise Batch/cached-input.
  3. Consultez la page Codex models pour la liste spécifique à Codex et les dates de retrait.
  4. Quand un fait ici est en désaccord avec la documentation, la documentation l’emporte — cette page est une aide à l’étude, pas une autorité.

Faits clés à mémoriser

  • Quatre modèles API actuels : Astra ($10/$50), Sol ($4/$20), Terra ($2/$12), Luna ($0.20/$1.20) ; tous 1.05M de contexte, 128K de sortie max.
  • gpt-5.6 est un alias de gpt-5.6-sol ; épinglez les IDs explicites en production.
  • Utilisez le niveau le plus bas et l’effort le plus bas qui traitent la tâche ; il n’y a pas de correspondance d’effort GPT-5.5 → 5.6.
  • Terra est le remplaçant pragmatique des charges GPT-5.5 ; Luna est pour les tâches structurées à fort volume.
  • Les familles spécialisées (cyber, Daybreak, Rosalind) sont réservées et interdites au trafic général.

Dernière mise à jour le 18 sept. 2026