Mistral facture Large 4 au douzième du tarif de GPT-6 Astra d'OpenAI, un test LangChain réduisant de 64 % les coûts de codage

Mistral a listé Large 4 au douzième du prix de sortie de GPT-6 Astra, le routeur de LangChain a abaissé de 64 % le coût du codage sans perte de qualité, et Atlassian a empoché l'argent d'OpenAI tout en refusant de faire d'Astra son modèle par défaut. Tous les indices convergent : le péage se déplace du modèle vers la porte d'entrée.

Lire l’original

Vincent JiangVincent Jiang · 3 min read
Share
Le directeur général de Mistral AI, Arthur Mensch, rencontre le Premier ministre indien Narendra Modi à Paris
1 / 7Slide 1 of 7
Le directeur général de Mistral AI, Arthur Mensch, rencontre le Premier ministre indien Narendra Modi à Paris, en juin 2026. Sa société a lancé cette semaine Large 4 à une fraction des prix au token des modèles de pointe concurrents.

Rippling fait tourner ses agents IA en production sur une architecture LangChain : un agent superviseur y coordonne cinq à sept sous-agents spécialisés, construits sur Deep Agents et LangSmith, selon une étude de cas de LangChain dévoilée cette semaine 5. Aucun de ces sous-agents n'a besoin d'être coûteux. Voilà la vraie opération de la semaine, dissimulée dans une grille de prix et une expérimentation.

La couche des modèles vient de se tarifer comme une commodité

Mistral a lancé Large 4 le 6 octobre : un modèle à mélange d'experts de mille milliards de paramètres, facturé 1,36 dollar le million de tokens en entrée et 4,18 dollars le million en sortie 4. GPT-6 Astra facture les mêmes unités 10 et 50 dollars 4. Claude Opus 5.5, 4 et 20 dollars 4. En sortie, Large 4 se situe autour d'un cinquième du prix d'Opus 5.5, et le propre comparatif de Decrypt le place « environ au septième et au douzième » de la tarification d'Astra, en entrée comme en sortie 4. La version en poids ouverts (« open weights ») sera disponible fin octobre : les acheteurs pourront vérifier eux-mêmes les promesses de qualité plutôt que de se fier à la fiche de benchmarks du fournisseur 4.

Large 4 de Mistral listé au douzième du prix de sortie d'Astra

  • Entrée ($/M tokens)
  • Sortie ($/M tokens)
0204060GPT-6 AstraClaude Opus 5.5Mistral Large 41.36
Data
Entrée ($/M tokens)Sortie ($/M tokens)
GPT-6 Astra1050
Claude Opus 5.5420
Mistral Large 41.364.18
Tarifs publics en dollars américains par million de tokens, entrée et sortie, au 6 octobre 2026. Source : Decrypt, sur le lancement de Mistral Large 4.4

Le routeur a apporté ses preuves la même semaine

LangChain a publié le 1er octobre une expérience menée sur 973 fils de discussion, dans laquelle son routeur de modèles a réduit de 64 % le coût médian du codage par IA, sans différence statistiquement significative sur les résultats des fusions de code 1. Relisez bien : le routeur s'est engagé sur un seul modèle avant le déroulement de chaque conversation, et le code fusionné ne s'est pas dégradé 1. La même semaine, Atlassian a passé son temps à approfondir son partenariat avec OpenAI — « en pratique, un engagement de dépenses », selon un représentant d'OpenAI — tout en affirmant à VentureBeat que GPT-6 Astra n'est pas le modèle par défaut de Rovo : sa passerelle IA interne effectue un routage dynamique entre fournisseurs, tâche par tâche 3. Son serveur MCP reconstruit traite plus de 15 millions d'appels par jour sur plus de 220 outils, avec jusqu'à 25 % de tokens en moins que la version précédente 3. Un chiffre issu d'une enquête boucle la démonstration : seules 2 % des entreprises ont indiqué que le modèle était la principale raison de leur choix d'une plateforme d'agents IA 2.

La couche de routage absorbe tout ce qui se trouve en dessous

LangSmith Engine v2 est disponible depuis le 6 octobre 6. AWS a intégré la récupération agentique (« agentic retrieval ») au package langchain-aws, et sa base de connaissances managée s'arroge explicitement la couche de stockage ; à cinq résultats récupérés, un seul embedding ne couvrait que 4 des 6 sous-intentions d'une question comparative — raison pour laquelle AWS elle-même recommande de router selon la forme de la requête plutôt que de s'en tenir à un seul chemin de récupération 7. Chez CoreWeave, le nouveau Partner Network, annoncé le 6 octobre, recense LanceDB dans son segment des services de données — façon de survivre en figurant dans la distribution d'un tiers 8. Le schéma est constant : celui qui possède le client possède le routeur, et le routeur traite les modèles comme des pièces interchangeables.

Ce que cela change pour le carnet d'ordres de 2 000 milliards de dollars

Anthropic viserait une introduction en Bourse sur la base d'une valorisation d'environ 2 000 milliards de dollars, avec une levée de l'ordre de 60 à 100 milliards de dollars — en dépit de pertes nettes de près de 42 milliards de dollars en 2025, et d'un rythme annualisé qui avait franchi les 65 milliards fin juillet 2026 9. Cette demande date du 13 septembre, elle a déjà trois semaines, et le roadshow qui en découle se tiendra en octobre 9. Le multiple ne tient que si les tarifs des modèles de pointe tiennent. Or, la semaine même où l'opération est commercialisée auprès des investisseurs, les données publiées par la couche de routage elle-même établissent que le modèle est interchangeable, et que le moins cher des modèles compétents remporte la charge de travail 14. Un routeur optimisé pour le coût aura toutes les raisons de choisir Large 4 une fois ses poids ouverts téléchargeables, d'ici la fin du mois 4.

Le contrepoint et la porte ouverte

Le meilleur argument en faveur du prix fort : les capacités de pointe continuent de justifier une prime sur les tâches les plus ardues, et l'évaluation humaine en aveugle menée par Surge AI a donné 4,22 à Claude Opus 5, contre 3,74 à Large 4, en qualité de code 4. Mais le routage existe précisément pour n'acheter la prime que là où elle rapporte. Surveillez le roadshow d'octobre, et surveillez si les passerelles à la Atlassian continuent de tenir Astra à l'écart du statut de modèle par défaut une fois les poids livrés. Le péage se déplace du modèle vers la porte.

Deepdive

AI-generated from this story and its cited sources. Not investment advice.

Reader comments

0 comments

    Sign up

    Get your curated digest

    After email confirmation, you will receive a daily digest of the most relevant news that matter to your portfolio