
Jev, c'est le nom du modèle sorti mardi par l'un des artisans de ChatGPT, et il ne sait pas écrire une phrase. Après trois semaines passées à vous parler d'AGI et de frontière, je vous explique pourquoi ce modèle muet intéresse davantage que les bavards.
Mais avant, le sommaire :
Jev vous ai compris
Actualités
🏛️ Trump enterre le ralentissement sous les majuscules
🚨 Gemini se met aussi au piratage
💰 Anthropic : 100 milliards et le pied sur l'accélérateur
🇫🇷 Mistral entre dans Firefox
🧩 Claude ne vous demande plus de choisir
Outils
- security-audit-skill
Jev vous ai compris

Depuis trois semaines, les modèles frontières occupent toute la scène. Dernièrement Greg Brockman proclamait « l'ère AGI ». Dario Amodei demandait à l'industrie de ralentir. Et mardi, l'un des créateurs de ChatGPT a sorti un modèle incapable d'écrire la moindre phrase…
Diogo Almeida est connu chez OpenAI pour les travaux fondateurs sur le RLHF, la méthode qui a appris à ChatGPT à converser. Depuis, il a fondé sa société TypeSafe AI, à levé 40 millions de dollars et vient de lancer Jev.
Jev : vous lui envoyez un état (un ticket client, une fiche produit, la trace d'un agent) et des questions fermées. Il renvoie un choix, une note ou un oui/non, chacun avec sa probabilité, en moins de 500 millisecondes, pour 0,042 $ le million de tokens.

La question de départ de Diogo tient en une ligne : les modèles sont surhumains en conversation depuis des années, alors où est passée l'automatisation ? Dans l'enquête du NBER auprès de près de 6 000 dirigeants, 69% des entreprises utilisent l'IA et 89% ne constatent aucun effet sur leur productivité. Il y voit la conséquence de son propre travail : le RLHF a produit des modèles « surhumains pour plaire aux humains », éloquents, polis, et qu'un humain doit relire…
Son meilleur argument figure dans un billet publié cinq jours avant le lancement. Chez OpenAI, à l’époque, un modèle de la taille de GPT-2, entraîné sur la bonne tâche, a écrasé un GPT-3 qui est pourtant plus de cent fois plus gros. D'où le slogan maison, « Build prod, not God ».
À mon humble avis, l'IA qui changera profondément les marges aura la forme d'un “if”. Ce ticket part-il à la facturation ? Ces deux fiches décrivent-elles le même produit ? Cette commande lancée par un agent mérite-t-elle d'être bloquée ? Des milliers de petites décisions enfouies dans un back-office, que personne ne montrera jamais en keynote.
Un site les collectionne déjà : Jevable recense des projets bâtis sur Jev, du formulaire qui choisit seul sa prochaine question au tableur qui note l'urgence de chaque ligne à la volée, en passant par 3 000 goûters pour enfants évalués en 28 secondes pour 11 centimes.
Je trouve cela ironique que ce modèle muet nous vienne de celui qui a, entre autres, appris aux machines à nous faire la conversation.
Actualités
🏛️ Trump enterre le ralentissement sous les majuscules
Donald Trump a répondu lundi à l'appel de Dario Amodei. La peur d'une IA qui détruirait l'humanité relève, selon lui, du canular, le seul garde-fou nécessaire est un président « STRONG AND SMART (High IQ!) », et ces alertes cacheraient un complot au profit de la Chine.
Les marchés ont moins ri. SoftBank, actionnaire d'OpenAI, a clôturé lundi en baisse de près de 11 % à Tokyo. Alors, samedi, Trump a annoncé la création d’une « AI Force » calquée sur la Space Force.
🚨 Gemini se met aussi au piratage
Google a confirmé vendredi, après une enquête du Wall Street Journal, qu'un modèle Gemini avait piraté trois entreprises bien réelles en mai. Un exercice de type « capture the flag » visait une société fictive qui portait le même nom qu'une vraie. L'accès à internet, censé être coupé, était resté ouvert.
Dans un cas, le modèle a deviné des mots de passe. Dans les deux autres, il a trouvé des identifiants dans un dépôt public. Selon Heather Adkins, vice-présidente de la sécurité chez Google, Gemini s'est arrêté de lui-même en comprenant qu'il touchait des systèmes réels, et les trois entités ont été prévenues.
💰 Anthropic : 100 milliards et le pied sur l'accélérateur
Anthropic a plus de 100 milliards de dollars de revenus annualisés, selon le New York Times relayé par Axios. C'est 50% de plus qu'il y a deux mois et plus de dix fois le niveau de fin 2025, et cela grâce à Claude Code et Cowork. L'introduction en Bourse est maintenue, avec des actions cotées courant novembre.
Vendredi, le labo a choisi les évaluateurs indépendants dont je vous parlais la semaine dernière : Accenture. Ils seront dotés d'un accès comparable à celui d'un salarié, et chacune des deux sociétés prévoit d'investir au moins 1 milliard de dollars sur cinq ans.
Deux réserves : Anthropic paie directement son contrôleur, et admet qu'aucun standard ne fixe encore ce que les évaluateurs pourront voir ou publier. Selon Reuters, le labo envisagerait par ailleurs de sortir un nouveau modèle avant sa cotation. Ralentir, d'accord, mais après avoir sonné la cloche de Wall Street…
🇫🇷 Mistral entre dans Firefox
Mistral motorise depuis mercredi Firefox Smart Window, l'assistant de navigation de Mozilla, encore en bêta. La France et l'Amérique du Nord ouvrent le bal, le Royaume-Uni et l'Allemagne suivront d'ici la fin de l'année. Les conversations ne sont pas conservées par défaut chez Mozilla, et Mistral s'engage à une rétention zéro.

🧩 Claude ne vous demande plus de choisir
Anthropic fusionne depuis mercredi Claude Cowork et le chat dans une seule interface. Vous posez une question ou vous confiez un rapport à rendre à midi, Claude évalue ce que la tâche exige et continue de travailler meme si vous fermez votre ordinateur. Le déploiement démarre sur les offres Pro et Max, Team et Free suivront, et les administrateurs Enterprise seront prévenus trente jours avant tout changement.
Anthropic reconnaît que le plus pénible, pour ses utilisateurs, était de savoir où ranger une tâche.
Outils
security-audit-skill
Vous aimeriez faire auditer votre code ? security-audit-skill, publié par Cloudflare, transforme votre agent en auditeur de sécurité. Six phases s'enchaînent, de la reconnaissance au rapport, avec des chasseurs isolés les uns des autres et, pour chaque faille candidate, un vérificateur chargé de la valider. Les résultats sortent en JSON, classés en “confirmé”, “à valider” ou “rejeté”.
L'installation tient en une commande, npx skills add https://github.com/cloudflare/security-audit-skill --skill security-audit avec Node.js pour les validateurs. Licence MIT, 16 600 étoiles GitHub.
Conversation
Avez-vous des suggestions, des réflexions ou un savoir que vous aimeriez transmettre ? Ou alors, vous désirez simplement discuter et converser avec moi ?
Je vous invite à répondre à cet email pour échanger !

