← Home

Mistral lança modelo de 1 trilhão de parâmetros 'Le Chonk' para desafiar EUA e China

A empresa francesa de inteligência artificial Mistral AI lançou em 6 de outubro o Mistral Large 4 (ML4), um modelo multimodal com 1 trilhão de parâmetros apelidado de 'le Chonk' — uma referência humorística à cultura internet de um gato extremamente gordo. O lançamento posiciona a empresa europeia como alternativa direta aos modelos fechados americanos e aos modelos de pesos abertos chineses, em linha com o que o presidente francês Emmanuel Macron qualificou como 'uma terceira via em IA'.

O modelo acessível via API em fase de preview público ativa 49 bilhões de parâmetros por consulta ao utilizar uma arquitetura híbrida de especialistas esparsos (MoE). Isso significa que, apesar de conter um trilhão de parâmetros no total, apenas uma fração é ativada durante a inferência, tornando o modelo significativamente mais eficiente em hardware do que modelos equivalentes que ativam todos os parâmetros a cada solicitação. O preço do preview é de US$ 1,36 por milhão de tokens de entrada e US$ 4,18 por milhão de tokens de saída, significativamente mais barato que concorrentes como Claude Opus 5.5 e GPT-6 Astra.

ML4 foi treinado do zero durante aproximadamente dois meses em 3.800 GPUs Nvidia Grace Blackwell nos próprios data centers europeus da Mistral. Segundo a empresa, isso representa dois a três vezes menos hardware do que os concorrentes chineses e significativamente menos do que os rivais americanos de código fechado. A fundação afirma que treinou o modelo em mais de 160 idiomas, incluindo todos os idiomas oficiais da União Europeia.

Os resultados preliminares em benchmarks mostram o ML4 alcançando 61,7% no DeepSWE v1.1, um benchmark de engenharia de software de longo alcance; 28,3% no Terminal-Bench 4; 59,4% no SWE-Atlas-QnA; e 59,9% no AutomationBench, que testa workflows empresariais em aplicativos como Gmail, Google Sheets, Slack e Salesforce. Seu Combined Coding Agent Index score de 49,8% o coloca à frente de DeepSeek V4 Pro 0813 e Qwen3.8 Max. Na área de cibersegurança, o modelo alcançou 82% em um teste que pede ao modelo reproduzir uma vulnerabilidade real em software open source e depois corrigi-la — a maior pontuação de qualquer modelo. Também resolveu 93% dos desafios do Cybench, um conjunto de 40 exercícios retirados de competições de segurança.

A Mistral planeja liberar os pesos do modelo até o final do outubro, após um período de três semanas de testes com desenvolvedores, líderes de cibersegurança e autoridades estatais. Os pesos serão licenciados sob uma licença personalizada da Mistral. Durante o período de preview, a empresa continuará o aprendizado por reforço e o refinamento do checkpoint final antes da liberação pública.

O lançamento chega em um momento crucial para a indústria de IA europeia. Em setembro, a Mistral anunciou uma rodada Série D de €3 bilhões com uma avaliação pós-dinheo acima de €21 bilhões — a maior rodada de capital de risco já completada por uma empresa de tecnologia europeia, segundo a Reuters. A empresa agora afirma apoiar mais de 125 empresas globais, incluindo Airbus, ASML e HSBC.

A estratégia da Mistral combina pesos abertos com uma stack empresarial soberana. O modelo foi otimizado especificamente para cibersegurança, programação e design de chips — setores fundamentais para dois de seus principais apoiadores: a gigante holandesa ASML, que liderou sua Série C, e a Samsung, que liderou sua Série D no mês passado. A empresa está apostando que os pesos dos modelos se tornarão cada vez mais uma commodity, enquanto o negócio de maior valor se deslocará para os sistemas construídos ao seu redor.

Fontes: Mistral AI, CNBC, WIRED

✓ Fontes independentes cruzadas e verificadas antes da publicação