Monsieur Prompt
Fiche modèle · LLM

GPT-5.6 Luna

Le palier rapide et abordable de la famille GPT-5.6 d'OpenAI, pensé pour le volume : classification, résumé, pipelines. Rapide et économique, mais il paie son meilleur score en temps de calcul.

Vérifié le 14 juil. 2026 2 sources officielles
Le rapide, pour le volume
Le mieux pour : le volume, classification, résumé et pipelines à faible coût. À écarter dès que le temps compte : pour atteindre son meilleur score, il consomme plus de calcul et de temps que ses grands frères.

En bref

GPT-5.6 Luna est le palier le plus rapide et le moins cher de la génération GPT-5.6. Selon OpenAI, il atteint environ 85 % de la qualité de Sol pour un cinquième du prix. Idéal pour le volume : classification, résumé, pipelines. Sa limite nette : pour atteindre son meilleur score de 50,3 %, il consomme 6,87 M de jetons et 5 686 minutes, quand Sol fait mieux en deux fois moins. Prix API : 1 $ en entrée et 6 $ en sortie par million de tokens.

01 C'est quoi

Sol, Terra et Luna sont trois paliers de capacité durables de la même génération GPT-5.6. Luna est l'entrée de gamme, optimisée pour la vitesse et le coût sur des tâches simples et répétées.

01

Le palier rapide

Le plus abordable des trois. Environ 85 % de la qualité de Sol pour un cinquième du prix, selon OpenAI. Pensé pour le volume.

02

Sa place dans la famille

Sous Terra (l'équilibré) et Sol (le vaisseau amiral). Luna vise les traitements de masse, pas les tâches les plus profondes.

03

Accès et model ID

Disponible dans ChatGPT, Codex et l'API OpenAI. Model ID gpt-5.6-luna.

02 Comment ça marche

Luna est le palier économique de la génération 5.6. Son intérêt est arithmétique.

  • Il coûte un cinquième de Sol. 1 dollar par million en entrée et 6 en sortie, contre 5 et 30. Sur du volume, l'écart n'est pas un détail de marge : c'est un changement d'ordre de grandeur.
  • La sortie coûte six fois l'entrée, ratio constant sur toute la gamme. Le volume de génération reste le poste principal.
  • Le cache et le batch s'appliquent : entrée en cache à environ 10 % du tarif standard, remise Batch d'environ 50 %. Combinés, ils rendent le traitement de masse très bon marché.
  • La résidence régionale des données majore de 10 % sur les modèles éligibles.

Luna n'a pas d'équivalent tarifaire exact dans les générations précédentes : la 5.4 descendait plus bas encore avec mini à 0,75 $ / 4,50 $ et nano à 0,20 $ / 1,25 $. La génération 5.6 relevée sur la grille s'arrête à Luna.

03 Ce que ça sait faire

Ce que Luna apporte, et sa limite à connaître avant de l'employer, d'après les specs OpenAI et les benchmarks annoncés. Chaque chiffre est attribué.

✓ Ce qui est fort

  • Le moins cher et le plus rapide : 1 $ en entrée, 6 $ en sortie par million de tokens, pour le traitement de masse.
  • Environ 85 % de la qualité de Sol pour un cinquième du prix (selon OpenAI).
  • Bon niveau agentique pour son prix : Agents' Last Exam 50,3, quasi au niveau de Terra (50,4) et Sol (53,6), annoncé par OpenAI.
  • SWE-Bench Pro 62,7 % et 50,3 % sur l'épreuve d'agents, à trois dixièmes de Terra, pour le coût le plus bas des trois.
  • Taillé pour les pipelines : classification, résumé court, extraction en volume.

04 Ce que ça ne sait pas faire

Les limites du palier économique, qui sont le revers direct de son prix.

  • C'est le palier le plus bas de sa génération. Sol et Terra existent parce que Luna ne couvre pas leurs cas. Le prix se paie en capacité.
  • Des paliers plus bas existent, mais en 5.4. GPT-5.4 mini à 0,75 $ / 4,50 $ et nano à 0,20 $ / 1,25 $ descendent plus bas que Luna. Pour du volume extrême, la génération précédente reste moins chère.
  • La sortie coûte six fois l'entrée. À 6 $ par million de tokens générés, une tâche verbeuse annule une partie de l'économie du palier.
  • Le volume déplace la contrainte. À ce tarif, le coût par requête cesse d'être le problème principal : ce sont les limites de débit et la qualité sur les cas difficiles qui décident.
  • Il paie son score en calcul. Pour atteindre 50,3 %, OpenAI mesure 5 686 minutes de latence simulée et 6,87 M de jetons, contre 2 227 minutes et 2,20 M pour Sol à réglage moyen, qui obtient pourtant 51,9 %.
  • Ni le raisonnement maximal ni le mode Ultra. Ces options restent réservées à Sol.

05 Les versions

OpenAI garde des paliers de prix stables d'une génération à l'autre. La grille se lit par ligne, pas par nom.

Palier 1 $ / 6 $
GPT-5.6 Luna, le palier économique de la génération 5.6.
Palier 2,50 $ / 15 $
GPT-5.6 Terra et GPT-5.4, deux fois et demie Luna.
Palier 5 $ / 30 $
GPT-5.6 Sol et GPT-5.5, cinq fois Luna.
Encore moins cher
GPT-5.4 mini à 0,75 $ / 4,50 $ et GPT-5.4 nano à 0,20 $ / 1,25 $. Pour du volume extrême, la génération précédente descend plus bas que Luna.

06 Prix & accès

Le prix API annoncé par OpenAI, et les trois façons d'y accéder.

Tarifs en date de juillet 2026. Les prix, offres et quotas affichés correspondent à l'état documenté à cette date. Ils peuvent évoluer ; consulte la source officielle citée sur la page avant achat.

Entrée
1 $ / M tokens (prix API annoncé par OpenAI).
Sortie
6 $ / M tokens (prix API annoncé par OpenAI).
ChatGPT / Codex
Intégré aux deux, en plus de l'API. Model ID gpt-5.6-luna.
Cache & effort

La lecture en cache est facturée jusqu'à 90 % de moins, avec un cache minimum de 30 minutes, ce qui compte pour des pipelines répétés. L'effort de raisonnement est configurable de « none » à « high » et reste persistant d'un tour à l'autre. Le niveau « max » et le mode Ultra sont réservés à Sol. Le tarif peut évoluer : vérifie la grille officielle OpenAI.

07 Quand le choisir

Luna brille sur le volume et la vitesse, tant que la tâche ne demande pas de mémoriser de longs contextes.

  • Classification et étiquetage à grande échelle.
  • Résumés courts et extraction d'informations en masse.
  • Pipelines automatisés où le coût par appel est déterminant.
  • Prétraitement et tri avant d'envoyer les cas difficiles à Terra ou Sol.
  • À éviter dès que le temps de traitement compte : c'est lui qui consomme le plus de calcul pour son meilleur score.

08 Alternatives

Dès que la tâche gagne en profondeur ou implique des documents longs, monte d'un palier dans la famille GPT-5.6.

09 Verdict

Luna est le bon outil pour le volume : rapide, économique, et proche de ses grands frères sur le raisonnement agentique court (50,3 sur Agents' Last Exam). Mais il paie ce score en temps de calcul, et c'est mesuré par OpenAI : on ne le met pas sur des traitements sensibles au temps, ni sur de longs documents, où Terra reprend la main. Bien cadré, c'est un excellent moteur de pipeline.

  • Le meilleur coût par appel de la famille, pour le volume.
  • Le coût en calcul à réglage poussé : à ne pas ignorer.
  • Pour la profondeur ou les documents longs, passe à Terra.

10 Questions fréquentes

GPT-5.6 Luna, c'est quoi ?

Le palier rapide et abordable de la famille GPT-5.6 d'OpenAI, pensé pour le volume : classification, résumé, pipelines. Environ 85 % de la qualité de Sol pour un cinquième du prix, selon OpenAI.

Combien coûte GPT-5.6 Luna ?

Prix API annoncé par OpenAI : 1 $ par million de tokens en entrée, 6 $ en sortie. C'est le palier le moins cher de la famille. Tarifs en date de juillet 2026.

Peut-on le pousser à fond ?

Oui, rien ne l'en empêche. Sa vraie limite est ailleurs : à réglage poussé, il lui faut deux fois plus de temps qu'à Sol pour un score inférieur.

Luna ou Terra : lequel choisir ?

Luna pour le volume rapide et peu coûteux. Terra dès que la tâche demande de la profondeur ou l'analyse de documents longs.

Sources

Specs et benchmarks annoncés par OpenAI : Présentation de GPT-5.6 et Aperçu de GPT-5.6 Sol. Les chiffres cités sont ceux publiés par OpenAI ; nous n'avons pas mené de test interne.

Sol, Terra ou Luna ?

Compare les trois paliers GPT-5.6 côte à côte, ou regarde le palier équilibré dès que la tâche gagne en profondeur.