GPT-5.6 Sol vs Terra vs Luna : Quel modèle devriez-vous utiliser ?
Une comparaison basée sur la charge de travail entre GPT-5.6 Sol, Terra et Luna, avec les tarifs actuels, les schémas de routage, les conseils d'évaluation et des recommandations pratiques de modèles.

Choisir entre GPT-5.6 Sol, Terra et Luna n'est pas un concours pour désigner un gagnant universel. C'est un problème de routage : quelle quantité d'intelligence, de latence et de coût cette tâche spécifique justifie-t-elle ?
OpenAI définit Sol comme le modèle phare pour les travaux professionnels complexes, Terra comme l'équilibre entre intelligence et coût, et Luna comme l'option la plus abordable pour les charges de travail à volume élevé. Les trois prennent en charge les contrôles de raisonnement, une grande fenêtre de contexte, l'entrée de texte et d'images, ainsi que des outils dans les environnements API pris en charge. Leurs différences deviennent significatives lorsque l'on mesure des tâches complètes plutôt que des requêtes isolées.
La Décision en un Tableau
| Choisissez | Quand la charge de travail ressemble à | Prix actuel de l'API : entrée/sortie par 1M de tokens | | Sol | Travail difficile, ambigu, à fort impact, à long terme ou de révision finale | 4 $ / 20 $ | | Terra | Tâches professionnelles récurrentes nécessitant un bon équilibre qualité-coût | 2 $ / 12 $ | | Luna | Travail à volume élevé, sensible à la latence ou au budget, avec validation claire | 0,20 $ / 1,20 $ |
Voici les prix des jetons de texte publiés et vérifiés le 3 septembre 2026. L'entrée en cache, les prompts très longs, les outils, le mode Batch ou Fast peuvent modifier le coût final.
Commencez par le risque, pas par la taille du modèle
Avant de comparer les exemples, classez la tâche selon cinq dimensions :
- Impact de l'échec : Le résultat est-il consultatif, réversible ou destiné au client ?
- Ambiguïté : Existe-t-il plusieurs interprétations plausibles ?
- Vérification : Un logiciel ou un relecteur peut-il détecter facilement les erreurs ?
- Volume : Le système traitera-t-il dix requêtes ou dix millions ?
- Latence : L'utilisateur a-t-il besoin d'une réponse immédiate ?
Sol devient attrayant à mesure que l'ambiguïté et le coût de l'échec augmentent. Luna devient attrayant à mesure que le volume et la vérifiabilité augmentent. Terra occupe le large milieu.
Quand GPT-5.6 Sol est le bon choix
Sol est conçu pour les tâches où le jugement compte plus que le débit brut. Les exemples incluent la synthèse de preuves contradictoires, la planification d'une mise en œuvre en plusieurs étapes, la résolution d'un échec de débogage difficile, la révision d'un rapport à enjeux élevés ou la coordination de plusieurs outils sur une longue tâche.
C'est également le niveau d'escalade naturel. Un système peut envoyer un travail de routine à Luna ou Terra et demander à Sol d'examiner les cas qui enfreignent une règle, reçoivent un faible score de confiance ou ont un impact commercial plus important.
Bonnes charges de travail Sol
- Synthèse finale à travers de nombreux documents avec exigences de source.
- Modifications de code complexes couvrant l'architecture et les tests.
- Recherche multi-outils avec incertitude et preuves contradictoires.
- Direction créative finale qui doit concilier l'histoire, le public et les contraintes.
- Examen difficile de la continuité à travers un long scénario et une bible des personnages.
Où Sol peut être gaspilleur
Sol peut être inutile pour les transformations déterministes, l'extraction simple ou la classification en masse. Utiliser un modèle de raisonnement phare pour chaque requête peut masquer une architecture faible : un validateur de schéma, une table de correspondance ou un modèle plus petit pourrait résoudre les cas simples à moindre coût.
Quand GPT-5.6 Terra est le meilleur choix par défaut
Terra est souvent la référence la plus utile pour l'évaluation en production car elle n'impose pas les extrêmes. OpenAI la positionne comme un équilibre entre intelligence et coût, et son prix actuel via l'API se situe entre Sol et Luna.
Choisissez Terra lorsque les sorties nécessitent un jugement mais peuvent être révisées, retentées ou escaladées. Cela peut être un bon choix pour rédiger des rapports, résumer le contexte d’un projet, convertir des briefs en plans structurés, générer un premier jet de code, ou utiliser des outils dans un workflow délimité.
Pour une équipe créative, Terra peut transformer un brief narratif en fiches de scène, normaliser les attributs des personnages en un schéma réutilisable, ou générer des dialogues alternatifs tout en respectant une intrigue verrouillée. Une fois le plan approuvé, ces actifs structurés peuvent être transférés vers Elser AI pour la production visuelle.
L'avantage caché de Terra : la simplicité opérationnelle
Le routeur théoriquement le moins cher n'est pas toujours le moins cher en exploitation. Si Luna nécessite une gestion extensive des exceptions et que Sol est excessif, Terra peut réduire la complexité du routage. Un seul niveau intermédiaire performant peut être préférable jusqu'à ce que vous ayez suffisamment de trafic et de données d'évaluation pour justifier une cascade plus complexe.
Quand GPT-5.6 Luna gagne
Le prix bas du token Luna rend pratiques de nouvelles catégories de volume, mais les meilleures tâches Luna partagent une propriété : la qualité peut être vérifiée.
Voici des exemples : extraire des champs dans un schéma, taguer des messages de support, générer des variantes de métadonnées, reformater du contenu, rédiger de courtes descriptions ou effectuer une première passe dans un pipeline de révision. Luna peut également servir des interfaces interactives où la réactivité est plus importante qu'une réflexion approfondie.
Conception pour l'escalade
Ne demandez pas à Luna de décider si sa propre réponse incertaine est correcte en utilisant un score de confiance vague. Utilisez des signaux externes :
- échecs de validation de schéma ;
- citations manquantes ;
- désaccord entre deux passes ;
- catégories interdites ou inconnues ;
- règles métier liées au risque ;
- un petit modèle d'évaluation ou une vérification déterministe ;
- échantillonnage aléatoire humain.
Ne remontez que le sous-ensemble signalé à Terra ou Sol.
Le niveau du modèle et l'effort de raisonnement sont des paramètres distincts
Tous les niveaux de l'API GPT-5.6 prennent en charge none, low, medium, high, xhigh et max. Une erreur courante consiste à comparer Luna avec un effort faible et Sol avec un effort maximal, puis à attribuer toute la différence au niveau du modèle.
Comparez la configuration la moins coûteuse qui satisfait le seuil d'acceptation. Un raisonnement plus poussé doit gagner sa place par une amélioration mesurable.
Trois architectures de routage pratiques
Modèle 1 : Routage basé sur des règles
Envoyer les tâches aux niveaux en fonction des attributs connus. Les demandes courtes, structurées et réversibles vont à Luna. Les demandes longues ou ambiguës vont à Terra. Les catégories à fort impact vont directement à Sol.
Ce motif est transparent et facile à déboguer, mais ses règles nécessitent de la maintenance.
Modèle 2 : Générer, valider, escalader
Luna génère une réponse. Des vérifications déterministes l'inspectent. Les sorties échouées passent à Terra, et seuls les cas non résolus passent à Sol. Ceci est efficace pour les sorties structurées et la classification.
Modèle 3 : Rédaction et révision
Terra rédige ; Sol ne révise que certains livrables sélectionnés. Le relecteur doit recevoir la source, les critères d'acceptation et le brouillon — pas simplement une demande pour « améliorer ceci ». Demandez-lui d'identifier les échecs spécifiques et de ne modifier que ce qui est nécessaire.
La production créative peut utiliser la même approche. Terra rédige une liste de plans, Sol vérifie la continuité, et la séquence approuvée est produite dans Elser AI. Cela permet au modèle coûteux de se concentrer sur le jugement plutôt que sur le formatage de routine.
Un exemple de coût détaillé
Imaginez 100 000 requêtes, chacune avec 2 000 jetons d'entrée et 500 jetons de sortie. En ignorant la mise en cache et les outils :
- Luna utiliserait 200 millions de tokens d'entrée et 50 millions de tokens de sortie.
- Terra traiterait le même volume à des taux de jetons matériellement plus élevés.
- Sol coûterait encore plus cher.
Mais une comparaison valide doit ajouter les coûts d'échec et de révision. Si Luna envoie 20 % des cas aux humains tandis que Terra en envoie 3 %, Terra peut être moins cher dans l'ensemble. Créez un tableur en utilisant vos taux d'acceptation mesurés plutôt que de publier une conclusion basée uniquement sur les prix des jetons.
Recommandations par cas d'utilisation
Triage du support client
Commencez avec Luna plus des catégories strictes et une escalade. Utilisez Terra pour les conversations ambiguës et Sol pour l'examen sensible aux politiques.
Synthèse de la recherche
Commencez par Terra pour les résumés ordinaires. Utilisez Sol lorsque les sources sont en conflit, que l'analyse couvre de nombreuses dépendances ou que le résultat éclaire une décision importante.
Développement logiciel
Utilisez Terra pour la mise en œuvre de routine et la réparation des tests. Utilisez Sol pour l'architecture, la planification inter-dépôts et les échecs graves. Validez par des tests plutôt que de juger le code par sa fluidité.
Pré-production d'animation
Utilisez Luna pour les métadonnées et la mise en forme, Terra pour les découpages de scènes et les variantes de prompts, et Sol pour la continuité complexe ou la révision finale de l'histoire. Utilisez un outil d'animation dédié pour le rendu ; la qualité du raisonnement ne remplace pas les capacités de production multimédia.
FAQ
GPT-5.6 Sol est-il toujours le plus précis ?
Sol est le niveau phare et offre la plus grande marge de capacité, mais aucun modèle n'est le meilleur pour toutes les tâches. Évaluez des exemples représentatifs et incluez le coût de correction humaine.
Terra est-il équivalent à GPT-5.5 ?
OpenAI décrit Terra comme étant moins coûteuse avec des performances compétitives par rapport à GPT-5.5. Il s'agit d'une déclaration de positionnement au niveau de la famille, et non d'une garantie pour votre charge de travail.
Pourquoi Luna est-elle tellement moins chère ?
Luna est optimisée pour un travail abordable et à grand volume. Son faible prix élargit ses cas d'utilisation, mais les systèmes de production nécessitent toujours une vérification et une escalade.
Les utilisateurs ordinaires de ChatGPT peuvent-ils sélectionner les trois modèles ?
Pas nécessairement. ChatGPT standard, ChatGPT Work, Codex et l'API ont des disponibilités différentes. Les directives officielles actuelles indiquent que Terra et Luna ne sont pas sélectionnables dans les conversations ChatGPT payantes ordinaires, bien que Luna alimente les versions Free et Go.
Quel modèle une petite équipe devrait-elle tester en premier ?
Terra est une base de référence équilibrée et raisonnable. Ajoutez Luna pour tester les économies et Sol pour mesurer le plafond de qualité.
Conclusion
Sol, Terra et Luna ne sont pas trois versions de la même décision d'achat. Sol est le niveau de jugement, Terra la base de production et Luna le niveau d'échelle. La meilleure architecture utilise souvent plus d'un de ces niveaux.
Choisir avec preuves : définir des critères d'acceptation, maintenir un effort de raisonnement constant, inclure le coût de correction et orienter les cas difficiles vers le haut. C'est ainsi qu'une famille de modèles devient un avantage opérationnel plutôt qu'un menu déroutant.















































































