Mistral оценила Large 4 в 12 раз ниже тарифа GPT-6 Astra от OpenAI — тест LangChain сократил расходы на программирование на 64%

Mistral выставила Large 4 по цене в одну двенадцатую тарифа GPT-6 Astra за выходные токены, роутер LangChain снизил расходы на программирование на 64% без потери качества, а Atlassian приняла деньги OpenAI, но отказалась сделать Astra моделью по умолчанию. Все улики указывают в одну сторону: турникет смещается от модели к входной двери.

Читать оригинал

Vincent JiangVincent Jiang · 3 min read
Share
Глава Mistral AI Артур Мэнш на встрече с премьер-министром Индии Нарендрой Моди в Париже
1 / 7Slide 1 of 7
Глава Mistral AI Артур Мэнш на встрече с премьер-министром Индии Нарендрой Моди в Париже, июнь 2026 года. На этой неделе компания Мэнша выпустила Large 4 — по цене за токены в разы ниже, чем у конкурентов на рынке frontier-моделей.

Боевые ИИ-агенты Rippling работают на архитектуре LangChain: один агент-супервизор координирует от пяти до семи специализированных субагентов, вся связка построена на Deep Agents и LangSmith. Об этом говорится в обнародованном на этой неделе кейсе LangChain 5. Ни один из этих субагентов не обязан быть дорогим. Вот и вся сделка недели — она прячется внутри прайс-листа и эксперимента.

Слой моделей только что назначил себе цену биржевого товара

6 октября Mistral запустила Large 4 — модель с 1 трлн параметров, построенную по схеме «смесь экспертов» (mixture of experts), — по цене $1,36 за 1 млн входных токенов и $4,18 за 1 млн выходных 4. За те же единицы GPT-6 Astra берет $10 и $50 4, Claude Opus 5.5 — $4 и $20 4. По выходным токенам Large 4 обходится примерно в одну пятую цены Opus 5.5, а собственное сравнение Decrypt дает «примерно одну седьмую и одну двенадцатую» цен Astra на входе и выходе соответственно 4. Версия с открытыми весами появится до конца октября: покупатели смогут сами проверить заявления о качестве, а не полагаться на бенчмарк-карточку вендора 4.

Цена Mistral Large 4 — одна двенадцатая выходного тарифа Astra

  • Входные: $/млн токенов
  • Выходные: $/млн токенов
0204060GPT-6 AstraClaude Opus 5.5Mistral Large 41.36
Data
Входные: $/млн токеновВыходные: $/млн токенов
GPT-6 Astra1050
Claude Opus 5.5420
Mistral Large 41.364.18
Опубликованные прайс-листы: доллары США за 1 млн входных и выходных токенов по состоянию на 6 октября 2026 года. Источник: данные Decrypt о запуске Mistral Large 4.4

В ту же неделю роутер получил доказательства

1 октября LangChain опубликовала эксперимент на 973 тредах: её роутер моделей снизил медианные расходы на ИИ-программирование на 64%, причём статистически значимых различий в результатах слияния кода не выявлено 1. Прочтите это дважды: роутер выбирал одну модель ещё до начала каждого диалога — и качество кода после слияний не ухудшалось 1. В ту же неделю Atlassian углубляла партнёрство с OpenAI, которое представитель OpenAI охарактеризовал как «фактически обязательство по расходам», — и одновременно рассказала VentureBeat, что GPT-6 Astra не является моделью по умолчанию в Rovo: внутренний ИИ-шлюз Atlassian динамически маршрутизирует запросы между провайдерами под каждую задачу 3. Перестроенный MCP-сервер Atlassian обрабатывает более 15 млн вызовов в сутки на 220 с лишним инструментах, расходуя до 25% меньше токенов, чем предыдущая версия 3. Цифра из опроса подытоживает картину: лишь 2% компаний назвали модель главной причиной выбора платформы для агентов 2.

Слой маршрутизации поглощает всё, что под ним

LangSmith Engine v2 вышла 6 октября 6. AWS опубликовала агентный поиск (agentic retrieval) в пакете langchain-aws — её управляемая база знаний явно закрепляет слой хранения за собой. При пяти извлечённых результатах один эмбеддинг покрывал лишь 4 из 6 субинтентов в сравнительном вопросе, поэтому сама AWS рекомендует маршрутизацию по форме запроса, а не выбор единственного пути извлечения данных 7. CoreWeave объявила 6 октября новую партнёрскую сеть, в сегменте дата-сервисов которой значится LanceDB — выживание через попадание в чужую дистрибуцию 8. Закономерность устойчива: кто владеет клиентом, владеет и роутером, а роутер обращается с моделями как с взаимозаменяемыми деталями.

Что это значит для книги заявок на $2 трлн

Как сообщается, Anthropic готовит IPO с оценкой около $2 трлн и рассчитывает привлечь примерно $60–100 млрд — при почти $42 млрд чистых убытков за 2025 год и годовом run rate, превысившем к концу июля 2026 года $65 млрд 9. Сам запрос датирован 13 сентября, ему уже три недели; подготовленное под него роудшоу придётся на октябрь 9. Мультипликатор устоит, только если устоят цены на frontier-модели. В ту же неделю, когда размещение продают инвесторам, собственные опубликованные данные слоя маршрутизации говорят: модель взаимозаменяема, и нагрузку забирает самая дешёвая из компетентных 14. Роутер, оптимизированный под стоимость, получит все основания выбрать Large 4, как только её открытые веса можно будет скачать к концу месяца 4.

Контраргумент и открытая дверь

Самый весомый довод в пользу наценки: на самых сложных задачах возможности уровня frontier по-прежнему продаются с премией, а по итогам проведённой Surge AI слепой оценки с участием людей Claude Opus 5 набрал 4,22 против 3,74 у Large 4 по качеству кода 4. Но маршрутизация ровно затем и существует, чтобы покупать премию только там, где она окупается. Следите за октябрьским роудшоу — и за тем, удержат ли ИИ-шлюзы в духе Atlassian Astra вне слота по умолчанию, когда выйдут веса. Турникет смещается от модели к входной двери.

Deepdive

AI-generated from this story and its cited sources. Not investment advice.

Reader comments

0 comments

    Sign up

    Get your curated digest

    After email confirmation, you will receive a daily digest of the most relevant news that matter to your portfolio