Mistral precifica Large 4 a 1/12 da tarifa da OpenAI para o GPT-6 Astra; teste da LangChain corta 64% do custo de programação

A Mistral listou o Large 4 a 1/12 do preço de saída do GPT-6 Astra; o roteador da LangChain cortou 64% do custo de programação sem perda de qualidade; e a Atlassian aceitou dinheiro da OpenAI, mas seguiu se recusando a fazer da Astra seu modelo padrão. As evidências apontam em uma só direção: o pedágio está migrando do modelo para a porta.

Ler o original

Vincent JiangVincent Jiang · 3 min read
Share
O CEO da Mistral AI, Arthur Mensch, reúne-se com o primeiro-ministro da Índia, Narendra Modi, em Paris
1 / 7Slide 1 of 7
O CEO da Mistral AI, Arthur Mensch, reúne-se com o primeiro-ministro da Índia, Narendra Modi, em Paris, em junho de 2026. A empresa de Mensch lançou nesta semana o Large 4 por uma fração dos preços de token cobrados pelos rivais de fronteira.

A Rippling roda seus agentes de IA em produção em uma arquitetura da LangChain, com um agente supervisor coordenando de cinco a sete subagentes especializados, construídos sobre Deep Agents e LangSmith, segundo um estudo de caso da LangChain divulgado nesta semana 5. Nenhum desses subagentes precisa ser caro. Esse é o negócio da semana — escondido em uma tabela de preços e em um experimento.

A camada de modelos acaba de se precificar como commodity

A Mistral lançou o Large 4 em 6 de outubro — um modelo de mistura de especialistas (mixture-of-experts) com 1 trilhão de parâmetros — a US$ 1,36 por milhão de tokens de entrada e US$ 4,18 por milhão de tokens de saída 4. Pelas mesmas unidades, o GPT-6 Astra cobra US$ 10 e US$ 50 4. O Claude Opus 5.5, US$ 4 e US$ 20 4. No preço de saída, o Large 4 fica em cerca de um quinto do valor do Opus 5.5 — e a própria comparação feita pelo Decrypt o coloca em "cerca de um sétimo e um doze avos" dos preços do Astra, na entrada e na saída, respectivamente 4. A versão de pesos abertos (open weights) chega até o fim de outubro, o que permite aos compradores testar por conta própria as afirmações de qualidade, em vez de confiar na ficha de benchmarks do fornecedor 4.

Large 4 da Mistral é listado a 1/12 do preço de saída do Astra

  • Entrada (US$/milhão de tokens)
  • Saída (US$/milhão de tokens)
0204060GPT-6 AstraClaude Opus 5.5Mistral Large 41.36
Data
Entrada (US$/milhão de tokens)Saída (US$/milhão de tokens)
GPT-6 Astra1050
Claude Opus 5.5420
Mistral Large 41.364.18
Preços de tabela publicados em dólares por milhão de tokens, entrada e saída, vigentes em 6 de outubro de 2026. Fonte: apuração do Decrypt sobre o lançamento do Mistral Large 4.4

O roteador apresenta provas na mesma semana

A LangChain publicou em 1º de outubro um experimento com 973 threads em que seu roteador de modelos cortou em 64% o custo mediano da programação com IA, sem diferença estatisticamente significativa nos resultados de mesclagem de código 1. Vale ler duas vezes: o roteador se comprometia com um único modelo antes de cada conversa se desenrolar — e o código mesclado não piorou 1. A Atlassian passou a mesma semana aprofundando a parceria com a OpenAI, arranjo que um representante da OpenAI descreveu como “na prática, um compromisso de gastos”, ao mesmo tempo em que dizia à VentureBeat que o GPT-6 Astra não é o padrão do Rovo — seu gateway interno de IA roteia dinamicamente entre provedores, tarefa por tarefa 3. O servidor MCP reconstruído da Atlassian processa mais de 15 milhões de chamadas por dia, em mais de 220 ferramentas, com até 25% menos tokens que a versão anterior 3. Um dado de pesquisa fecha o raciocínio: apenas 2% das empresas citaram o modelo como principal motivo para escolher uma plataforma de agentes 2.

A camada de roteamento absorve tudo o que está abaixo dela

O LangSmith Engine v2 foi lançado em 6 de outubro 6. A AWS publicou recuperação agêntica (agentic retrieval) no pacote langchain-aws, com sua base de conhecimento gerenciada assumindo explicitamente a propriedade da camada de armazenamento. Com cinco resultados recuperados, um único embedding cobriu apenas 4 das 6 subintenções de uma pergunta comparativa — razão pela qual a própria AWS recomenda rotear pelo formato da consulta, em vez de escolher um único caminho de recuperação 7. A nova Partner Network da CoreWeave, anunciada em 6 de outubro, lista a LanceDB em seu segmento de serviços de dados — sobreviver, aqui, é ser citada na distribuição de outra empresa 8. O padrão é consistente: quem é dono do cliente é dono do roteador, e o roteador trata os modelos como peças intercambiáveis.

O que isso significa para o book de US$ 2 trilhões

A Anthropic mira, segundo relatos, uma abertura de capital (IPO) a uma avaliação de cerca de US$ 2 trilhões, com captação de algo entre US$ 60 bilhões e US$ 100 bilhões — contra prejuízo líquido de quase US$ 42 bilhões em 2025 e uma taxa anualizada (run rate) que já havia passado de US$ 65 bilhões no fim de julho de 2026 9. Esse pedido data de 13 de setembro, tem três semanas, e o roadshow que ele prepara fica para outubro 9. O múltiplo só se sustenta se os preços de fronteira se sustentarem. Na mesma semana em que se vende a oferta ao mercado, os dados publicados pela própria camada de roteamento dizem que o modelo é intercambiável e que o mais barato dos competentes leva a carga de trabalho 14. Um roteador otimizado para custo terá todos os motivos para escolher o Large 4 assim que seus pesos abertos estiverem disponíveis para download até o fim do mês 4.

O contraponto e a porta aberta

O argumento mais forte a favor de pagar o ágio: a capacidade de fronteira ainda garante um prêmio nas tarefas mais difíceis, e a avaliação humana às cegas da Surge AI deu a Claude Opus 5 nota 4,22, contra 3,74 do Large 4, em qualidade de código 4. Mas o roteamento existe justamente para comprar esse prêmio apenas onde ele compensa. Resta acompanhar o roadshow de outubro — e verificar se gateways como o da Atlassian mantêm a Astra fora do posto de modelo padrão assim que os pesos chegarem. O pedágio está de mudança: do modelo para a porta.

Deepdive

AI-generated from this story and its cited sources. Not investment advice.

Reader comments

0 comments

    Sign up

    Get your curated digest

    After email confirmation, you will receive a daily digest of the most relevant news that matter to your portfolio