A Mistral anunciou hoje a prévia pública do Mistral Large 4 (ML4), seu novo modelo flagship com 1 trilhão de parâmetros, dos quais 49 bilhões são ativos por rodada de inferência. O modelo chega com promessa de desempenho de ponta em tarefas de codificação, fluxos agentic e compreensão multimodal, além de liderança inédita em benchmarks abertos de cibersegurança.

Desempenho e arquitetura

O ML4 foi treinado do zero em 3.800 GPUs NVIDIA Grace Blackwell, nas instalações próprias da Mistral na Europa. A empresa destaca o modelo como o maior e mais capaz já lançado sob pesos abertos, com resultados que rivalizam ou superam modelos fechados em tarefas específicas — especialmente em cibersegurança, área estratégica para o mercado europeu.

A arquitetura é nativamente multimodal, mas detalhes como janela de contexto e preços ainda não foram divulgados. O modelo já está disponível para testes via API no Mistral Studio, e a liberação dos pesos está prevista para o final de outubro.

Benchmarks: liderança em cibersegurança e codificação

Em cibersegurança, o ML4 se destacou no Artificial Analysis Cyber Index, onde figura entre os cinco melhores modelos do mundo e lidera com folga entre os abertos fora da China. No teste de reprodução e correção de vulnerabilidades reais, o ML4 marcou 82%, o maior índice já registrado. No Cybench, acertou 93% dos desafios, superando concorrentes abertos e até modelos fechados que recusam a tarefa por política de uso (Claude Opus 5.5, GPT-6 Astra).

Na codificação, o ML4 obteve 61,7% no DeepSWE v1.1, 59,4% no SWE-Atlas-QnA e 28,3% no Terminal-Bench 4. A média do Coding Agent Index ficou em 49,8%, à frente de DeepSeek V4 Pro 0813 e Qwen3.8 Max. Em avaliação cega feita por humanos via Surge AI, o ML4 Preview ficou em segundo lugar (3,74 de 5), atrás apenas do Claude Opus 5 (4,22) e à frente de Kimi K3 e GLM-5.3.

Foco em soberania e uso corporativo

A Mistral enfatiza a independência regulatória e operacional do ML4, com infraestrutura mantida integralmente na Europa e foco em clientes que exigem controle sobre dados e políticas de uso. O modelo foi treinado com dados em mais de 160 idiomas, incluindo todos os oficiais da União Europeia, e pode ser implementado em nuvem privada ou on-premise para setores como finanças, engenharia, logística e setor público.

A empresa destaca que, especialmente em cibersegurança, a possibilidade de rodar modelos avançados sob pesos abertos elimina riscos de bloqueio por recusas de provedores e dá autonomia para pesquisa e resposta a incidentes.

Próximos passos

Os pesos do ML4 serão liberados até o final de outubro. A Mistral promete detalhar arquitetura, benchmarks adicionais e métodos de pós-treinamento nas próximas semanas. O modelo servirá de base para futuras variantes especializadas.

Para o mercado brasileiro, o ML4 representa uma alternativa soberana e auditável para empresas com requisitos regulatórios ou de segurança, além de ampliar o leque de opções em IA multimodal de alto desempenho.

Tags
  • #mistral
  • #ml4
  • #open-weights
  • #cibersegurança