SSysDigest
GPT-6.1 Sol : OpenAI garde les prix mais divise le cache par deux

Photo : panumas nikhomkhai sur Pexels

Intelligence Artificielle

GPT-6.1 Sol : OpenAI garde les prix mais divise le cache par deux

OpenAI sort GPT-6.1 Sol une semaine après GPT-6 Sol, sans toucher aux prix d'entrée et de sortie mais en cassant le tarif de lecture de cache.

tarifsOpenAIintelligence artificiellemise à jour
Partager :

OpenAI vient de remplacer son modèle GPT-6 Sol, sorti le 22 septembre, par une version 6.1 à peine une semaine plus tard. Sur le papier, rien ne change : toujours 2 dollars le million de jetons en entrée et 10 dollars en sortie. Mais en creusant la grille tarifaire, un détail saute aux yeux : la lecture de cache, c'est-à-dire quand le modèle relit le début d'une requête déjà traitée, passe de 0,20 à 0,10 dollar le million de jetons. Autrement dit, OpenAI ne baisse pas le prix affiché, mais rend le cache deux fois moins cher à utiliser.

Illustration : ActuIA
Photo : ActuIA

Concrètement, ça change pas mal de choses pour les boîtes qui tournent des agents IA en continu avec beaucoup de contexte réutilisé. Sur une session type calculée par ActuIA, la facture passe de 1,74 à 1,67 dollar, soit 4% d'économie. Mais sur un usage plus intensif en cache façon Claude Opus d'Anthropic (beaucoup de contexte relu, peu de contenu neuf), le gain grimpe à 21%. Comparé au modèle haut de gamme GPT-6 Astra, GPT-6.1 Sol reste ultra compétitif : à peine 16 à 19% du coût selon les scénarios.

Il y a quand même un hic : GPT-6.1 Sol supprime les niveaux de raisonnement les plus légers ("none" et "minimal"), qui existaient sur GPT-6 Sol. Comme les jetons de raisonnement sont facturés au tarif sortie, le plus cher du barème, impossible désormais de désactiver ce raisonnement pour économiser sur les tâches simples. Sachant que la sortie représentait déjà 57% de la facture sur la session de référence, ce verrou pourrait bien gommer une partie des économies côté cache pour certains usages.

Au final, OpenAI communique sur la stabilité des prix tout en optimisant discrètement la structure tarifaire en faveur des usages très dépendants du cache — un choix malin pour séduire les développeurs d'agents IA, mais qui referme une porte pour ceux qui voulaient du raisonnement minimal et pas cher.

Ceci est un résumé rédigé par SysDigestLire l'article original sur ActuIA →

À lire aussi