
Un token OpenAI et un token Anthropic ne pèsent pas la même chose, et Thibault Sottiaux a mis le doigt cette semaine sur ce que ça change. Je vous propose donc de regarder ce que vous payez réellement quand vous payez au million de tokens.
Mais avant, le sommaire :
Token to me ?
Actualités
💳 Stripe s'offre OpenRouter
🎬 Alibaba sort Wan3.0 et lève 10 milliards
🧹 Un million de clics sur le bouton anti-slop
💰 Nvidia discute avec Perplexity à 30 milliards
🛡️ ChatGPT met les adolescents à part
🌍 Washington demande à ses partenaires de choisir
🧲 Meta débauche encore chez OpenAI
Outils
RTK
Token to me ?

Nous comparons les prix des modèles en dollars par million de tokens comme si le token était une unité standardisée, au même titre qu'un gramme ou un kilowattheure. Il n'en est rien. Deux modèles produisent exactement le même texte en découpant un nombre de morceaux différent, et un prix au token plus bas peut donc parfaitement se solder par une facture plus élevée.
Thibault Sottiaux, qui travaille sur Codex et ChatGPT chez OpenAI, résume ça avec une image de pizza. Deux pizzas identiques. La première est coupée en 8 parts à 2 $, la seconde en 16 parts à 1,25 $. La seconde enseigne affiche la part la moins chère, et la pizza entière vous coûte 20 $ au lieu de 16 $. Votre estomac, lui, se moque du nombre de parts. 🍕

Sur une comparaison couvrant de l'anglais, du texte technique, du multilingue et du numérique, le tokenizer de GPT-5.6 Sol a consommé 766 tokens là où Claude Opus 5 en aurait consommé 1 170 selon son estimation, soit 34,5 % de moins chez OpenAI pour un contenu strictement identique.
Reprenons alors les tarifs affichés. OpenAI vient de baisser GPT-5.6 Sol de plus de 20 % pour trois mois, à 4 $ le million de tokens en entrée et 20 $ en sortie, contre 5 $ et 30 $ auparavant. En face, Anthropic affiche Claude Opus 5 à 5 $ en entrée et Claude Fable 5 à 10 $. Sur l'étiquette, 25 % d'écart entre Sol et Opus 5. Appliquez l'échantillon de Sottiaux à ces prix, et la même page de texte revient presque deux fois plus cher en entrée chez Anthropic.
Prenez tout de même ces chiffres avec des pincettes. Sottiaux est employé par OpenAI, son échantillon est minuscule, et le nombre attribué à Claude est une estimation qu'il n'a pas mesurée directement. Surtout, aucun de ces calculs ne dit quel modèle résout votre problème du premier coup, et un modèle qui repart pour un troisième essai coûte bien plus cher que 34 % de tokens en trop.
À mes yeux, la bonne unité de mesure est le prix par tâche réussie, et elle ne figure sur aucune grille tarifaire. Prenez trois tâches représentatives de votre activité, faites-les tourner chez deux fournisseurs, comparez les factures et le taux de réussite. C'est fastidieux, ça prend du temps, et c'est le seul moyen de savoir ce que vous achetez.
Actualités
💳 Stripe s'offre OpenRouter
Stripe a annoncé le 19 août le rachat d'OpenRouter, la passerelle qui aiguille les requêtes des développeurs vers plus de 400 modèles issus de plus de 80 fournisseurs. Le montant reste confidentiel. La plateforme est déjà utilisée par NVIDIA, Zoom ou Lovable.
Stripe pousse depuis un an des produits comme Token Billing pour aider ses clients à maîtriser leurs coûts d'inférence. Patrick Collison décrit les tokens comme la monnaie centrale des entreprises qui construisent avec l'IA, pendant qu'Alex Atallah, patron d'OpenRouter, défend l'idée qu'aucun modèle unique ne sera optimal pour toutes les tâches.
🎬 Alibaba sort Wan3.0 et lève 10 milliards
Alibaba a officialisé le 24 août Wan3.0, son modèle de génération vidéo, capable de produire 30 secondes en une seule passe à partir de documents, de tableurs, de présentations ou de pages web. La bêta publique tournait depuis le 6 août et a déjà servi en production sur des courts métrages, de la publicité et de la promotion touristique.
Ces 30 secondes doublent la limite de Wan2.7-Video et autorisent des mouvements de caméra continus, sans raboutage de plans. Le modèle sort en revanche sans rapport technique, sans nombre de paramètres et sans mesure de référence publiée.
L'annonce tombe au lendemain d'un placement d'actions de 10,2 milliards de dollars à Hong Kong, la plus grosse opération de ce type jamais réalisée sur la place. Alibaba dit y affecter 100 % du produit à sa stratégie IA, alors que son bénéfice trimestriel a chuté de 75 % sous le poids des investissements. Le titre a perdu 8,5 % lundi car le marché veut voir les revenus avant les modèles… 📉
🧹 Un million de clics sur le bouton anti-slop
LinkedIn a ajouté fin juillet une option « On dirait de l’IA slop » dans le menu de chaque publication, et plus d'un million de personnes l'ont utilisée en deux semaines, selon le directeur produit Hari Srinivasan. Le déclencheur : une analyse de Pangram estimant que plus de 40 % des posts longs de la plateforme sortaient d'une IA.

La plateforme définit le slop comme un contenu à la présentation soignée mais sans substance. Les publications ainsi classées reçoivent désormais 40 % de vues en moins, et leurs auteurs voient s'afficher un message leur signalant que des membres ont trouvé le texte artificiel.
Le réseau qui proposait un bouton « améliorer avec l'IA » sur chaque brouillon demande maintenant à ses membres de signaler le résultat. Le signal reste déclaratif et repose sur l'intuition du lecteur, ce qui sanctionne autant un texte trop lisse qu'un texte creux !
💰 Nvidia discute avec Perplexity à 30 milliards
Nvidia négocie une entrée au capital de Perplexity dans un tour qui valoriserait le moteur de recherche à plus de 30 milliards de dollars, d'après The Information repris par Reuters le 23 août. Le bond dépasse 50 % par rapport aux 20 milliards de septembre 2025.
Le revenu annualisé est passé de moins de 250 millions en début d'année à plus de 750 millions, une accélération largement portée par Perplexity Computer, l'agent qui exécute des tâches bureautiques dans le cloud et qui consomme nettement plus de tokens qu'une simple recherche. Nvidia figure déjà parmi les actionnaires historiques, aux côtés de Jeff Bezos et SoftBank.
🛡️ ChatGPT met les adolescents à part
OpenAI a lancé le 18 août ChatGPT for Teens, une expérience qui s'active automatiquement lorsque le système estime l'utilisateur mineur, ou lorsque celui-ci déclare avoir entre 13 et 17 ans. L'objectif affiché est de réduire l'exposition aux contenus inadaptés tout en préservant l'usage scolaire.
Le mode restreint les échanges sur les sujets à risque, des conduites dangereuses aux standards de beauté, et ajoute des outils d'apprentissage : mode étude, quiz, rappels de devoirs, plages horaires dédiées. Les parents peuvent lier leur compte, définir des heures calmes, ajuster certains réglages et recevoir des notifications dans les situations préoccupantes.
L'entreprise attaquée par plusieurs familles estimant que ChatGPT a nui à leurs enfants avance ici sur un terrain juridique autant que produit. La détection de l'âge reste une estimation statistique, et OpenAI reconnaît que des garde-fous se contournent quand on cherche à les contourner.
🌍 Washington demande à ses partenaires de choisir
Le département d'État américain a préparé une lettre destinée aux 35 signataires de l'« AI Opportunity Statement » de juin, révélée par Reuters le 14 août. Le message est sans détour : rejoindre le cadre concurrent proposé par Pékin vaudra exclusion de la coalition menée par les États-Unis.
Le dispositif visé s'appelle Pax Silica, lancé en décembre 2025 pour sécuriser les chaînes d'approvisionnement en semi-conducteurs, en modèles d'IA et en minerais critiques. Une vingtaine de pays y ont adhéré, dont le Japon, l'Australie, la Corée du Sud et le Kazakhstan, ce dernier ayant également signé côté chinois. Le brouillon invite les capitales à choisir délibérément, au motif qu'appartenir à tout revient à n'appartenir à rien.
Pour l'Europe, l'exercice d'équilibre devient nettement plus coûteux. Acheter des GPU américains, faire tourner des modèles à poids ouverts chinois et défendre une troisième voie réglementaire était déjà compliqué. Washington ne va pas simplifier cela !
🧲 Meta débauche encore chez OpenAI
Meta a recruté le chercheur Luke Metz pour ses Superintelligence Labs, une information révélée par Axios le 24 août. Il avait quitté OpenAI en 2024 pour rejoindre Thinking Machines, la structure de Mira Murati, avant de revenir chez OpenAI plus tôt cette année. Il prend son poste cette semaine sous la responsabilité d'Alexandr Wang.
Meta a bâti ses Superintelligence Labs à coups de recrutements spectaculaires, à commencer par Wang lui-même, arrivé avec le rachat de Scale AI.
Outils
RTK
Vous laissez tourner un agent de code toute la journée et vous voyez votre quota fondre ? Une bonne part de vos tokens part dans du bruit : les 200 lignes que donne un cargo test, les 45 lignes d'un ls -la, la progression d'un git push. RTK, pour Rust Token Killer, est un binaire qui s'intercale entre l'agent et le shell, filtre la sortie et ne transmet que l'utile. Plus de 100 commandes couvertes, moins de 10 ms de surcoût, et une intégration transparente avec Claude Code, Codex, Cursor, Gemini CLI ou Copilot.
L'installation tient en deux lignes (brew install rtk, puis rtk init -g), le projet est sous licence Apache 2.0 et totalement gratuit. Cerise sur le gâteau, il est développé depuis Lille par Patrick Szymkowiak, et il affiche aujourd'hui 77 000 étoiles sur GitHub.

De mon côté, le compteur rtk gain affiche 4 906 commandes interceptées et 6,4 millions de tokens économisés, soit 42,5 % de la sortie que mon agent aurait dû avaler.
Conversation
Vous avez des idées à partager, des suggestions à proposer, des informations à échanger, ou vous souhaitez tout simplement discuter avec moi ?
Alors n'hésitez pas à répondre à cette newsletter !

