Em resumo

  • A Mistral lançou o Large 4 em 6 de outubro, um modelo de 1 trilhão de parâmetros que ativa 49 bilhões de parâmetros por consulta e custa US$ 1,36 por milhão de tokens de entrada e US$ 4,18 por milhão de tokens de saída.
  • O apelido "Le Chonk" segue o meme "Le Chaton Fat" de junho, e a Mistral diz que lançará os pesos do modelo até o final de outubro.
  • No Finance Agent v2, o gráfico de lançamento mostra o Large 4 em 54,7, à frente do GPT-6 Astra em 53,5, mas atrás do Claude Opus 5.5 em 58,6.

A Mistral AI, sediada em Paris, lançou na terça-feira o Mistral Large 4, um modelo de IA com 1 trilhão de parâmetros. Esse é o tipo de sistema por trás de chatbots como ChatGPT e Claude, pois os parâmetros são os números ajustáveis que ele calibra durante o treinamento—mais deles geralmente significa mais capacidade de aprendizado e mais caro de executar.

"[O Mistral Large 4] está na fronteira dos modelos abertos, e de longe o modelo de pesos abertos mais forte dos EUA ou da Europa", escreveu Guillaume Lample, cientista-chefe da Mistral AI, no X.

Myriad: Qual empresa abrirá capital a seguir? Clique para fazer sua previsão.
Myriad: Qual empresa abrirá capital a seguir? Clique para fazer sua previsão.

Nem todos esses parâmetros funcionam ao mesmo tempo. O Large 4 usa um design de "mistura de especialistas", o que significa que o modelo encaminha cada pergunta para algumas sub-redes especializadas, de modo que apenas 49 bilhões de parâmetros são ativados por resposta. O último modelo principal da Mistral, Large 3, fez o mesmo com 41 bilhões ativos de 675 bilhões.

Todo o apelido "Le Chonk" tem uma história de fundo. Em junho, depois que a Mistral renomeou seu assistente Le Chat para Vibe, fãs no Reddit e no X inventaram um modelo fictício chamado Le Chaton Fat—aproximadamente "o gatinho gordo"—com 30 trilhões de parâmetros, 1.000 miau por segundo e benchmarks falsos alegando que superou o Claude Fable 5.

O CEO Arthur Mensch entrou na brincadeira, respondendo que o modelo se chamava realmente "le gros chaton", francês para "o gatinho grande". A Mistral então adicionou um gato de desenho animado ao seu site Vibe. Seu post de lançamento real agora lista o modelo como, "muito oficialmente", le Chonk.

A Mistral vende "IA soberana"—modelos que um país ou empresa pode possuir e executar sem entregar seus dados a empresas externas. A HUMAIN, apoiada pelo Estado da Arábia Saudita, assinou em agosto um acordo no valor de centenas de milhões de euros com esta empresa exatamente por esse motivo.

A Mistral levantou uma Série D de €3 bilhões (US$3,37 bilhões)—uma rodada de financiamento que vende ações a investidores—em setembro, com uma avaliação acima de €21 bilhões (US$23,6 bilhões), liderada pela Samsung. A Mistral afirma que o Large 4 é o primeiro marco no roteiro que esse dinheiro financia.

BitcoinBTC · USD

$85,646+3.09%

29 de set1 de out3 de out4 de out6 de out

$86,8 mil$85,6 mil$84,3 mil$83,0 mil

Máx. 24hMáx.$86,648

Mín. 24hMín.$85,122

VolVol$1,1 bi

Projeções de mercadoProbabilidades por Myriad

Esta semanaAbaixo de $86.000Abaixo de $86 mil56% de chance

→

Compre Bitcoin com USDT

Desenvolvido por Jupiter

Dados de preço por CoinGeckoCoinGeckoMais notícias e projeções de Bitcoin →

O Le Chunk custa $1,36 por milhão de tokens de entrada e $4,18 por milhão de tokens de saída—os pedaços de texto, aproximadamente três quartos de uma palavra cada, pelos quais as empresas de IA cobram. O Claude Opus 5.5 cobra $4 e $20, enquanto o GPT-6 Astra cobra $10 e $50.

Isso coloca o Large 4 a cerca de um terço do preço do Opus 5.5 na entrada e um quinto na saída. Em comparação com o Astra, é aproximadamente um sétimo e um doze avos.

O que dizem os benchmarks

O anúncio da Mistral compara principalmente o Large 4 com modelos chineses de pesos abertos—DeepSeek V4 Pro, Kimi K3, GLM-5.3 e Qwen3.8 Max—e "pesos abertos" significa que qualquer pessoa pode baixar e executar o modelo. Claude e GPT aparecem em apenas algumas comparações, e o Claude mais recente, Opus 5.5, aparece apenas em uma alegação de cibersegurança.

Em uma avaliação humana cega da qualidade de codificação pela Surge AI, o Mistral Large 4 ficou em segundo lugar entre cinco modelos com 3,74 de 5, atrás do Claude Opus 5 com 4,22.

AutomationBench atribui a uma IA 657 tarefas em software empresarial simulado—finanças, RH, vendas, suporte—e pontua a proporção de metas de cada tarefa que ela conclui, com zero crédito se ela quebrar uma regra. O Large 4 marcou 59,9 pontos. No quadro da Artificial Analysis, o Claude Sonnet 5.5 atingiu 71,8, o Opus 5.5 atingiu 69,5, e o Gemini 4 Argon liderou a página com 77,5 nesse mesmo benchmark.

No DeepSWE 1.1, que é um dos benchmarks que os desenvolvedores verificam ao tentar avaliar quão bom um modelo é em codificação, o Large 4 marcou 62. Isso supera o GLM-5.3 com 61 e o DeepSeek V4 Pro com 57, mas fica atrás do Kimi K3 com 68. O próprio placar da Datacurve tem o GPT-6 Astra e o Claude Opus 5 com 74.

A Mistral diz que lançará os pesos do Large 4—os números treinados que fazem o modelo funcionar—até o final de outubro, o que permitiria a desenvolvedores externos baixar o modelo e testar essas alegações por conta própria.