Mistral precifica Large 4 a 1/12 da tarifa da OpenAI para o GPT-6 Astra; teste da LangChain corta 64% do custo de programação
A Mistral listou o Large 4 a 1/12 do preço de saída do GPT-6 Astra; o roteador da LangChain cortou 64% do custo de programação sem perda de qualidade; e a Atlassian aceitou dinheiro da OpenAI, mas seguiu se recusando a fazer da Astra seu modelo padrão. As evidências apontam em uma só direção: o pedágio está migrando do modelo para a porta.
Vincent Jiang · 3 min read
A Rippling roda seus agentes de IA em produção em uma arquitetura da LangChain, com um agente supervisor coordenando de cinco a sete subagentes especializados, construídos sobre Deep Agents e LangSmith, segundo um estudo de caso da LangChain divulgado nesta semana 5. Nenhum desses subagentes precisa ser caro. Esse é o negócio da semana — escondido em uma tabela de preços e em um experimento.
A camada de modelos acaba de se precificar como commodity
A Mistral lançou o Large 4 em 6 de outubro — um modelo de mistura de especialistas (mixture-of-experts) com 1 trilhão de parâmetros — a US$ 1,36 por milhão de tokens de entrada e US$ 4,18 por milhão de tokens de saída 4. Pelas mesmas unidades, o GPT-6 Astra cobra US$ 10 e US$ 50 4. O Claude Opus 5.5, US$ 4 e US$ 20 4. No preço de saída, o Large 4 fica em cerca de um quinto do valor do Opus 5.5 — e a própria comparação feita pelo Decrypt o coloca em "cerca de um sétimo e um doze avos" dos preços do Astra, na entrada e na saída, respectivamente 4. A versão de pesos abertos (open weights) chega até o fim de outubro, o que permite aos compradores testar por conta própria as afirmações de qualidade, em vez de confiar na ficha de benchmarks do fornecedor 4.
Large 4 da Mistral é listado a 1/12 do preço de saída do Astra
- Entrada (US$/milhão de tokens)
- Saída (US$/milhão de tokens)
Data
| Entrada (US$/milhão de tokens) | Saída (US$/milhão de tokens) | |
|---|---|---|
| GPT-6 Astra | 10 | 50 |
| Claude Opus 5.5 | 4 | 20 |
| Mistral Large 4 | 1.36 | 4.18 |
O roteador apresenta provas na mesma semana
A LangChain publicou em 1º de outubro um experimento com 973 threads em que seu roteador de modelos cortou em 64% o custo mediano da programação com IA, sem diferença estatisticamente significativa nos resultados de mesclagem de código 1. Vale ler duas vezes: o roteador se comprometia com um único modelo antes de cada conversa se desenrolar — e o código mesclado não piorou 1. A Atlassian passou a mesma semana aprofundando a parceria com a OpenAI, arranjo que um representante da OpenAI descreveu como “na prática, um compromisso de gastos”, ao mesmo tempo em que dizia à VentureBeat que o GPT-6 Astra não é o padrão do Rovo — seu gateway interno de IA roteia dinamicamente entre provedores, tarefa por tarefa 3. O servidor MCP reconstruído da Atlassian processa mais de 15 milhões de chamadas por dia, em mais de 220 ferramentas, com até 25% menos tokens que a versão anterior 3. Um dado de pesquisa fecha o raciocínio: apenas 2% das empresas citaram o modelo como principal motivo para escolher uma plataforma de agentes 2.
A camada de roteamento absorve tudo o que está abaixo dela
O LangSmith Engine v2 foi lançado em 6 de outubro 6. A AWS publicou recuperação agêntica (agentic retrieval) no pacote langchain-aws, com sua base de conhecimento gerenciada assumindo explicitamente a propriedade da camada de armazenamento. Com cinco resultados recuperados, um único embedding cobriu apenas 4 das 6 subintenções de uma pergunta comparativa — razão pela qual a própria AWS recomenda rotear pelo formato da consulta, em vez de escolher um único caminho de recuperação 7. A nova Partner Network da CoreWeave, anunciada em 6 de outubro, lista a LanceDB em seu segmento de serviços de dados — sobreviver, aqui, é ser citada na distribuição de outra empresa 8. O padrão é consistente: quem é dono do cliente é dono do roteador, e o roteador trata os modelos como peças intercambiáveis.
O que isso significa para o book de US$ 2 trilhões
A Anthropic mira, segundo relatos, uma abertura de capital (IPO) a uma avaliação de cerca de US$ 2 trilhões, com captação de algo entre US$ 60 bilhões e US$ 100 bilhões — contra prejuízo líquido de quase US$ 42 bilhões em 2025 e uma taxa anualizada (run rate) que já havia passado de US$ 65 bilhões no fim de julho de 2026 9. Esse pedido data de 13 de setembro, tem três semanas, e o roadshow que ele prepara fica para outubro 9. O múltiplo só se sustenta se os preços de fronteira se sustentarem. Na mesma semana em que se vende a oferta ao mercado, os dados publicados pela própria camada de roteamento dizem que o modelo é intercambiável e que o mais barato dos competentes leva a carga de trabalho 14. Um roteador otimizado para custo terá todos os motivos para escolher o Large 4 assim que seus pesos abertos estiverem disponíveis para download até o fim do mês 4.
O contraponto e a porta aberta
O argumento mais forte a favor de pagar o ágio: a capacidade de fronteira ainda garante um prêmio nas tarefas mais difíceis, e a avaliação humana às cegas da Surge AI deu a Claude Opus 5 nota 4,22, contra 3,74 do Large 4, em qualidade de código 4. Mas o roteamento existe justamente para comprar esse prêmio apenas onde ele compensa. Resta acompanhar o roadshow de outubro — e verificar se gateways como o da Atlassian mantêm a Astra fora do posto de modelo padrão assim que os pesos chegarem. O pedágio está de mudança: do modelo para a porta.
Deepdive
AI-generated from this story and its cited sources. Not investment advice.



