GPT-6 Sol et Luna : ce que la baisse de prix change

by PASCAL IAKOVOU
0 comments

Le 22 septembre, OpenAI a annoncé des tarifs divisés par deux pour Sol et Luna, ses modèles de travail courant. Le pourcentage est calculé sur des prix promotionnels, et le coût d’un dossier traité reste à mesurer.

Lire les montants avant le pourcentage

Par million de jetons, Sol passe de 4 à 2 dollars en entrée et de 20 à 10 dollars en sortie. Luna passe de 0,20 à 0,10 dollar en entrée et de 1,20 à 0,50 dollar en sortie. OpenAI annonce « 50 % moins cher » pour les deux. Le calcul est juste pour Sol et pour l’entrée de Luna, mais la sortie de Luna baisse d’environ 58 %.

Les prix de départ sont ceux des offres promotionnelles de GPT-5.6, non ses tarifs de liste, ce qu’OpenAI précise dans son propre texte. La société attribue la baisse à des améliorations de mise en cache et d’inférence, avec un rabais de 90 % sur la lecture d’entrées déjà mises en mémoire.

Depuis le lancement, la page porte une mise à jour du 29 septembre qui renvoie vers un modèle plus récent, GPT-6.1 Sol. L’annonce n’en dit rien de plus dans le texte que j’ai lu : il faudra donc vérifier si les tarifs et les comparaisons de cet article valent encore pour ce nouveau modèle.

Le coût d’une tâche, mesuré par le fournisseur

OpenAI préfère parler de coût par tâche. Sur AutomationBench, un banc de flux de travail d’entreprise, Sol au réglage « xhigh » obtient 33,2 % pour 0,27 dollar par tâche, contre 26,9 % pour Claude Opus 5 au maximum, à un coût que la société chiffre à plus de onze fois celui de Sol. Sur le banc DeepSWE, consacré à l’ingénierie logicielle, Sol est présenté à 68,8 %, à un peu plus d’un point du meilleur score de Claude Fable 5.

Ces chiffres viennent d’OpenAI, qui a choisi les épreuves et les réglages comparés. Elle indique reprendre les scores concurrents dans des rapports publics, et utiliser ceux de Claude Fable 5 lorsque ceux de la version 5.1 n’étaient pas disponibles. Les scores de la famille sur ce banc d’entreprise restent d’ailleurs modestes en valeur absolue.

Un niveau pour chaque tâche, à tester plutôt qu’à supposer

Ce qui suit est une lecture de l’auteur. Un travail de tri, comme repérer un dossier incomplet, n’appelle pas la même dépense qu’une analyse de provenance ou qu’un texte engageant la Maison. On peut donc imaginer un modèle économique pour le premier, un modèle plus exigeant pour les autres. Le nom du modèle ne prouve pas qu’il convient à la tâche.

Une équipe gagnerait à fixer ce qu’un résultat recevable contient avant de choisir : les informations indispensables, les erreurs tolérables, les cas qui remontent à une personne. Le passage de relais compte autant que la tarification. Un premier traitement bon marché qui efface ses sources ou masque ses doutes transmet un problème que l’étape suivante ne verra pas.

L’unité qui compte

Le tarif du jeton est un intrant, et la consommation d’une tâche dépend du niveau d’effort choisi. Pour arbitrer, dix dossiers réels passés à trois niveaux de modèle, avec une grille des erreurs qui comptent, donneraient le chiffre utile : le coût par dossier qu’une personne accepte sans le refaire. Aucune page de lancement ne peut le fournir.

LUXSURE LETTER

Le luxe, sélectionné plutôt que subi.

Recevez notre sélection éditoriale consacrée aux Maisons, aux idées et aux mutations qui façonnent le luxe contemporain.

RECEVOIR LUXSURE LETTER → DÉCOUVRIR LE MAGAZINE →

Related Articles