Mistral fija el precio de Large 4 en la doceava parte de la tarifa de GPT-6 Astra de OpenAI mientras una prueba de LangChain recorta los costes de programación un 64%

Mistral ha puesto Large 4 a la venta a la doceava parte del precio de salida de GPT-6 Astra; el enrutador de LangChain recortó el coste de programación un 64% sin pérdida de calidad, y Atlassian cobró el dinero de OpenAI a la vez que se negaba a convertir Astra en su opción por defecto. Las pruebas apuntan en una sola dirección: el peaje se traslada del modelo a la puerta.

Leer el original

Vincent JiangVincent Jiang · 3 min read
Share
El consejero delegado de Mistral AI, Arthur Mensch, se reúne con el primer ministro indio, Narendra Modi, en París
1 / 7Slide 1 of 7
El consejero delegado de Mistral AI, Arthur Mensch, se reúne con el primer ministro indio, Narendra Modi, en París, en junio de 2026. La compañía de Mensch lanzó esta semana Large 4 a una fracción de los precios por token de sus rivales de vanguardia.

Rippling opera sus agentes de IA en producción sobre una arquitectura de LangChain basada en Deep Agents y LangSmith, en la que un agente supervisor coordina entre cinco y siete subagentes especializados, según un estudio de caso difundido esta semana por LangChain 5. Ninguno de esos subagentes tiene por qué ser caro. Ese es el negocio de la semana, escondido en una lista de precios y un experimento.

La capa de modelos acaba de ponerse el precio de una materia prima

Mistral lanzó Large 4 el 6 de octubre, un modelo de mezcla de expertos de un billón de parámetros, a 1,36 dólares por millón de tokens de entrada y 4,18 dólares por millón de tokens de salida 4. GPT-6 Astra cobra 10 y 50 dólares por las mismas unidades 4. Claude Opus 5.5 cobra 4 y 20 dólares 4. En tokens de salida, Large 4 cuesta aproximadamente la quinta parte del precio de Opus 5.5, y la propia comparación de Decrypt lo sitúa en «en torno a un séptimo y un doceavo» del precio de Astra en entrada y salida 4. La versión de pesos abiertos (open weights) llegará para finales de octubre, lo que permitirá a los compradores comprobar por sí mismos las afirmaciones sobre calidad en lugar de fiarse de la ficha de benchmarks del proveedor 4.

Mistral Large 4, a la doceava parte del precio de salida de Astra

  • Entrada $/M tokens
  • Salida $/M tokens
0204060GPT-6 AstraClaude Opus 5.5Mistral Large 41.36
Data
Entrada $/M tokensSalida $/M tokens
GPT-6 Astra1050
Claude Opus 5.5420
Mistral Large 41.364.18
Precios de catálogo publicados, en dólares estadounidenses por millón de tokens, de entrada y de salida, a 6 de octubre de 2026. Fuente: información de Decrypt sobre el lanzamiento de Mistral Large 4.4

El enrutador mostró las pruebas esa misma semana

LangChain publicó el 1 de octubre un experimento con 973 hilos en el que su enrutador de modelos recortó el coste mediano de programación con IA en un 64%, sin diferencias estadísticamente significativas en los resultados de las fusiones de código 1. Léalo dos veces: el enrutador se comprometía con un único modelo antes de que cada conversación se desarrollara, y el código fusionado no empeoró 1. Atlassian dedicó esa misma semana a profundizar en su alianza con OpenAI, una operación que un representante de OpenAI describió como «efectivamente, un compromiso de gasto». Al mismo tiempo, la empresa aseguró a VentureBeat que GPT-6 Astra no es la opción por defecto de Rovo: su pasarela interna de IA enruta de forma dinámica entre proveedores en función de la tarea 3. El servidor MCP de Atlassian, reconstruido, atiende más de 15 millones de llamadas al día en más de 220 herramientas, con hasta un 25% menos de tokens que la versión anterior 3. Un dato procedente de una encuesta remata la idea: solo el 2% de las empresas citó el modelo como motivo principal a la hora de elegir una plataforma de agentes 2.

La capa de enrutamiento absorbe todo lo que queda por debajo

LangSmith Engine v2 llegó el 6 de octubre 6. AWS publicó la recuperación agéntica (agentic retrieval) dentro del paquete langchain-aws, con su base de conocimiento gestionada adueñándose de forma explícita de la capa de almacenamiento. Con cinco resultados recuperados, un único embedding cubría solo 4 de las 6 subintenciones de una pregunta comparativa; por eso la propia AWS recomienda enrutar según la forma de la consulta en lugar de decantarse por una única ruta de recuperación 7. El nuevo Partner Network, anunciado el 6 de octubre por CoreWeave incluye a LanceDB en su segmento de servicios de datos: sobrevivir a base de figurar en el canal de distribución de otro 8. El patrón es consistente: quien es dueño del cliente es dueño del enrutador, y el enrutador trata los modelos como piezas intercambiables.

Qué significa esto para el libro de órdenes de 2 billones de dólares

Según informaciones, Anthropic busca salir a bolsa en torno a una valoración de 2 billones de dólares, para captar unos 60.000 a 100.000 millones de dólares. Lo hace frente a unas pérdidas netas de casi 42.000 millones en 2025 y a un ritmo anualizado que rebasaba los 65.000 millones a finales de julio de 2026 9. Ese objetivo data del 13 de septiembre, hace tres semanas, y el roadshow al que da lugar aterrizará en octubre 9. El múltiplo solo se sostiene si se sostienen los precios de los modelos de vanguardia. La misma semana en que se comercializa la operación, los datos publicados por la propia capa de enrutamiento dicen que el modelo es intercambiable y que el más barato de los competentes se lleva la carga de trabajo 14. Un enrutador optimizado para el coste tendrá todas las razones para decantarse por Large 4 en cuanto sus pesos abiertos puedan descargarse a finales de mes 4.

El contrapunto y la puerta abierta

El argumento más sólido para pagar el sobreprecio: la capacidad de vanguardia sigue cotizando con prima en las tareas más difíciles, y la evaluación humana a ciegas de Surge AI situó a Claude Opus 5 en un 4,22 frente al 3,74 de Large 4 en calidad del código 4. Pero el enrutamiento existe precisamente para pagar la prima solo donde compensa. Habrá que seguir el roadshow de octubre, y ver si las pasarelas al estilo de Atlassian mantienen a Astra fuera de la opción por defecto cuando aterricen los pesos. El peaje se está trasladando del modelo a la puerta.

Deepdive

AI-generated from this story and its cited sources. Not investment advice.

Reader comments

0 comments

    Sign up

    Get your curated digest

    After email confirmation, you will receive a daily digest of the most relevant news that matter to your portfolio