La empresa francesa de inteligencia artificial Mistral AI lanzó el 6 de octubre el Mistral Large 4 (ML4), un modelo multimodal con 1 billón de parámetros apodado 'le Chonk' —un humorístico referente a la cultura internet de un gato extremadamente gordo. El lanzamiento posiciona a la empresa europea como alternativa directa a los modelos cerrados americanos y a los modelos de pesos abiertos chinos, en línea con lo que el presidente francés Emmanuel Macron ha calificado como 'una tercera vía en IA'.
El modelo accesible vía API en fase de vista previa pública activa 49 mil millones de parámetros por consulta al utilizar una arquitectura híbrida de expertos esparsos (MoE). Esto significa que, aunque contiene 1 billón de parámetros en total, solo una fracción se activa durante la inferencia, haciendo que el modelo sea significativamente más eficiente en hardware que los modelos equivalentes que activan todos sus parámetros en cada solicitud. El precio del preview es de $1,36 por millón de tokens de entrada y $4,18 por millón de tokens de salida, significativamente más barato que competidores como Claude Opus 5.5 y GPT-6 Astra.
ML4 fue entrenado desde cero durante aproximadamente dos meses en 3.800 GPUs Nvidia Grace Blackwell en los propios centros de datos europeos de Mistral. Según la empresa, esto representa dos a tres veces menos hardware que los competidores chinos y significativamente menos que los rivales americanos de código cerrado. La fundación afirma haber entrenado el modelo en más de 160 idiomas, incluyendo todos los idiomas oficiales de la Unión Europea.
Los resultados preliminares de benchmarks muestran que ML4 alcanza 61,7% en DeepSWE v1.1, un benchmark de ingeniería de software de largo alcance; 28,3% en Terminal-Bench 4; 59,4% en SWE-Atlas-QnA; y 59,9% en AutomationBench, que prueba workflows empresariales en aplicaciones como Gmail, Google Sheets, Slack y Salesforce. Su Combined Coding Agent Index score de 49,8% lo coloca por delante de DeepSeek V4 Pro 0813 y Qwen3.8 Max. En el área de ciberseguridad, el modelo alcanzó 82% en una prueba que pide al modelo reproducir una vulnerabilidad real en software open source y luego corregirla — la mayor puntuación de cualquier modelo. También resolvió 93% de los desafíos del Cybench, un conjunto de 40 ejercicios retirados de competiciones de seguridad.
Mistral planea liberar los pesos del modelo hasta finales de octubre, tras un período de tres semanas de pruebas con desarrolladores, líderes de ciberseguridad y autoridades estatales. Los pesos serán licenciados bajo una licencia personalizada de Mistral. Durante el período de preview, la empresa continuará el aprendizaje por refuerzo y el refinamiento del checkpoint final antes de la liberación pública.
El lanzamiento llega en un momento crucial para la industria de IA europea. En septiembre, Mistral anunció una ronda Serie D de €3 mil millones con una valoración post-money por encima de €21 mil millones — la mayor ronda de capital de riesgo jamás completada por una empresa de tecnología europea, según Reuters. La empresa ahora afirma respaldar a más de 125 empresas globales, incluyendo Airbus, ASML y HSBC.
La estrategia de Mistral combina pesos abiertos con un stack empresarial soberano. El modelo fue optimizado específicamente para ciberseguridad, programación y diseño de chips — sectores fundamentales para dos de sus principales respaldadores: la gigante holandesa ASML, que lideró su Serie C, y Samsung, que lideró su Serie D el mes pasado. La empresa está apostando a que los pesos de los modelos se volverán cada vez más una commodity, mientras que el negocio de mayor valor se desplazará hacia los sistemas construidos a su alrededor.
Fuentes: Mistral AI, CNBC, WIRED
✓ Fuentes independientes cruzadas y verificadas antes de la publicación