Free et Go utilisent désormais Luna comme modèle par défaut

OpenAI déploie GPT-5.6 Luna comme modèle par défaut de ChatGPT Free et Go. Luna est le modèle le plus rapide et le moins coûteux de la famille GPT-5.6, qui comprend également Terra et le modèle phare Sol.

Le changement le plus visible est l'extension des conversations texte sans limite de débit, sous réserve des protections contre les abus. Pour une utilisation classique faite de questions, rédaction, résumé ou échange conversationnel sans outil supplémentaire, le compteur de messages devient donc beaucoup moins central.

Il faut cependant lire la petite ligne qui change tout : OpenAI maintient des limites distinctes pour les téléversements de fichiers, la génération et l'utilisation d'images ainsi que les autres outils.

Think n'est pas un bouton gratuit vers GPT-5.6 Sol

Free et Go reçoivent également un bouton Think destiné aux questions plus difficiles. Techniquement, ce bouton donne davantage de temps de raisonnement à GPT-5.6 Luna.

OpenAI précise dans sa documentation actuelle que Think n'utilise pas GPT-5.6 Sol. Les utilisateurs Free et Go n'ont pas accès à Sol dans les conversations ChatGPT standard.

Cette différence est importante pour comprendre le produit. Le bouton permet au même niveau de modèle de consacrer davantage d'effort à une requête ; il ne remplace pas le niveau de capacité proposé aux offres payantes.

Sol reste associé aux niveaux de raisonnement supérieurs

Sur les forfaits éligibles, GPT-5.6 Sol alimente les options de raisonnement Medium et High. Les offres supérieures peuvent également disposer d'efforts supplémentaires, jusqu'à GPT-5.6 Sol Pro pour les tâches les plus difficiles.

OpenAI fournit également un réglage du niveau de réflexion sur les offres payantes concernées. L'utilisateur peut ainsi privilégier une réponse rapide ou demander davantage de calcul pour une tâche de programmation, de recherche, de planification ou de rédaction complexe.

Cette distinction rend le produit plus lisible que le simple choix entre un modèle gratuit et un modèle payant. Trois paramètres se superposent désormais : la famille de modèle, l'effort de raisonnement et l'accès aux outils.

Luna n'est pas présenté comme un modèle au rabais

Luna occupe le bas de la gamme GPT-5.6 en coût et en latence, mais OpenAI ne le positionne pas comme un simple modèle de secours. La société indique qu'il conserve une part importante des capacités de la génération 5.6 tout en visant les usages rapides et massifs.

Dans une évaluation interne portant sur des requêtes financières, médicales et juridiques demandant des détails factuels, OpenAI affirme que les réponses contenant au moins une erreur factuelle étaient environ 62 % moins fréquentes avec GPT-5.6 Luna qu'avec GPT-5.5 Instant.

Ce chiffre doit rester dans son contexte : il s'agit d'une évaluation interne d'OpenAI, sur un ensemble précis de requêtes, et non d'une garantie qu'une conversation avec Luna sera 62 % plus exacte dans tous les usages.

La réduction des coûts fait partie du produit

La possibilité de servir autant de conversations ne repose pas uniquement sur une décision commerciale. Toute la famille GPT-5.6 a été présentée par OpenAI autour d'un objectif d'efficacité, avec des modèles correspondant à différents compromis entre capacité, vitesse et coût.

OpenAI avait d'ailleurs réduit de 80 % le prix API de Luna le 30 juillet. Le tarif public est désormais de 0,20 dollar par million de tokens d'entrée et 1,20 dollar par million de tokens de sortie.

Ces prix API ne permettent pas de connaître le coût réel d'une conversation ChatGPT pour OpenAI. Ils montrent néanmoins que Luna a été conçu et commercialisé comme la couche à très faible coût de la génération GPT-5.6.

« Illimité » signifie surtout que les limites deviennent plus intelligentes

Pour un utilisateur gratuit, la conséquence quotidienne est positive et assez simple : une conversation textuelle peut durer beaucoup plus longtemps sans être interrompue par un quota classique.

Mais les ressources coûteuses ne deviennent pas gratuites pour autant. Les images, fichiers et outils possèdent toujours leurs propres plafonds, tandis que le raisonnement Sol reste réservé aux forfaits qui l'incluent.

La nouveauté n'est donc pas l'absence totale de limites. C'est le fait qu'OpenAI commence à faire correspondre ces limites au coût et à la complexité réels des différentes actions plutôt qu'à compter chaque message de la même manière.

Pour l'utilisateur, c'est probablement une meilleure abstraction : discuter devient la base, et ce sont désormais les opérations les plus lourdes qui rappellent qu'un chatbot à grande échelle reste avant tout un service informatique avec des ressources finies.