Mistral lança Large 4, modelo de 1 trilhão de parâmetros

Mistral lança Large 4, modelo de 1 trilhão de parâmetros

A Mistral AI, laboratório francês de inteligência artificial, apresentou nesta terça-feira, 6 de outubro de 2026, o Mistral Large 4 (ML4), um novo modelo multimodal de grande porte que a companhia posiciona como alternativa simultânea aos modelos fechados de origem americana e aos modelos abertos que hoje vêm majoritariamente da China. Apelidado internamente de "Le Chonk", em referência ao seu tamanho, o modelo trabalha com cerca de um trilhão de parâmetros e foi anunciado com a ambição explícita de dar um salto à frente de rivais dos dois lados do mundo.

O comunicado oficial está disponível na página da Mistral sobre o Mistral Large 4.

Uma terceira via em um mercado dividido

O lançamento acontece em um momento de acirramento da divisão entre modelos fechados — que podem ser desconectados por decisão de seus donos, como mostraram protestos recentes do setor de segurança cibernética contra restrições do governo americano a modelos da Anthropic, e modelos de pesos abertos, frequentemente desenvolvidos na China. É nesse espaço que a Mistral tenta se colocar como uma terceira opção, algo que o presidente francês, Emmanuel Macron, já descreveu como "uma terceira via na IA".

A aposta europeia é apresentada como forma de soberania tecnológica, e não apenas como escolha técnica.

Um trilhão de parâmetros, mas ainda sem pesos abertos

Apesar do nome "Large", o ML4 não é, por enquanto, um modelo de pesos abertos. Segundo a empresa, o acesso inicial se dá apenas por meio de um endpoint público com guardrails, e os pesos só devem ser liberados em cerca de três semanas, depois que os testes de segurança forem concluídos.

Pierre Stock, vice-presidente de Ciência da Mistral, afirmou à TechCrunch que, nesse intervalo, a empresa vai trabalhar com parceiros de confiança e com governos para assegurar que os pesos abertos possam ser usados para defesa, e não para ataques maliciosos.

A questão de segurança ganhou peso justamente entre o público central da Mistral, empresas e instituições. Nas últimas semanas, cresceram as preocupações desse grupo com modelos abertos.

Ao mesmo tempo, argumenta Stock, um modelo de pesos abertos é mais fácil de auditar, o que ajuda a equilibrar o debate entre risco e transparência.

Treinamento enxuto e foco em nichos estratégicos

Outro ponto destacado nos bastidores é a eficiência computacional. O ML4 foi treinado inteiramente na infraestrutura de computação da própria Mistral, com apenas 4 mil GPUs NVIDIA, volume que, segundo Stock, é duas a três vezes menor do que o usado pelos concorrentes chineses e significativamente menor do que o dos concorrentes de código fechado.

Os resultados de benchmarks ainda não foram divulgados. A expectativa declarada pela empresa é que o ML4 se torne a melhor opção entre os modelos de pesos abertos, sobretudo fora da China, mas não apenas nessa geografia.

Por causa do treinamento focado, a Mistral acredita que o modelo pode superar modelos fechados em áreas específicas que são decisivas para seus clientes e nas quais as capacidades multimodais agregam valor.

Entre os casos de uso otimizados estão segurança cibernética e finanças, além do design de chips, este último diretamente ligado a dois dos principais investidores da companhia. A holandesa ASML, gigante do setor de litografia, liderou a Série C da Mistral, enquanto a Samsung liderou a Série D, fechada no mês passado com valuation de 21 bilhões de euros, o equivalente a cerca de 24,39 bilhões de dólares.

A disputa pela fronteira tecnológica

O contexto societário ajuda a entender a estratégia. No momento do aumento de capital, a Mistral procurou deixar claro que sua decisão de hospedar modelos chineses não representava uma guinada para se tornar uma mera provedora de inferência.

Com o Le Chonk em seu portfólio, a empresa defende que continua sendo também um laboratório de fronteira, capaz de competir tanto com os grandes laboratórios fechados dos Estados Unidos quanto com os desenvolvedores chineses de pesos abertos.

O timing do anúncio reforça essa leitura: ao prometer pesos abertos em semanas, condicionados a testes de segurança, a Mistral tenta ocupar um terreno intermediário, em que transparência e controle caminham juntos. Resta saber se os benchmarks pendentes vão confirmar a promessa de liderança entre os modelos abertos e se a eficiência de treinamento com 4 mil GPUs se traduzirá em vantagem real de custo para empresas e governos que buscam alternativas fora do eixo Estados Unidos-China.

Fontes e links

Matéria publicada originalmente em TechCrunch

Últimas Notícias

Anthropic lança CVP ampliado com três níveis de acesso cibernético
Mistral Large 4: modelo de 1 trilhão de parâmetros em preview
Google lança EmbeddingGemma 2, modelo multimodal para dispositivos
Musubi lança PolicyLM-1.7B para moderação em tempo real