A Mistral apresentou seu mais recente modelo de ponta, o Large 4. Segundo a empresa, o modelo possui capacidades excepcionais de programação e cibersegurança, sendo o modelo de código aberto mais poderoso já desenvolvido na Europa e nos EUA . O cientista-chefe Guillaume Lample declarou em uma coletiva de imprensa prévia: “Ele reduz a diferença para os melhores modelos de código aberto, incluindo todos os chineses.”
A pressão sobre a Mistral aumentou significativamente nos últimos meses. Os modelos predecessores da empresa francesa de IA, Large 3 e 3.5, foram ultrapassados por concorrentes da China e dos EUA. A IA escreveu no LinkedInPesquisador Niels RoggeO relatório afirma que o Large 3.5 é baseado em uma “arquitetura desatualizada” da Meta e é mais caro do que seu concorrente mais forte, o provedor chinês Deepseek. Consultores também disseram ao Handelsblatt que os modelos da Mistral têm apresentado uma demanda significativamente menor nos últimos meses em comparação com dois anos atrás.
O ML 4, abreviação do novo modelo, tem como objetivo mudar essa situação e tornar a Mistral competitiva novamente na disputa pela melhor tecnologia.
Isso é estrategicamente importante para a Europa. A Mistral é uma das poucas fornecedoras de IA que competem internacionalmente com os modelos mais poderosos. Um modelo europeu de alto desempenho poderia ser uma alternativa viável às principais fornecedoras americanas e chinesas, especialmente para empresas e governos.
Ao término da rodada de financiamento mais recente, em setembro, o diretor financeiro da Mistral, Johan Bergqvist, declarou ao Handelsblatt que os três bilhões de euros arrecadados seriam investidos principalmente no desenvolvimento e na expansão da capacidade computacional. O laboratório francês de IA pretende manter-se competitivo a longo prazo e oferecer uma alternativa de alto desempenho para clientes corporativos que desejam operar seus próprios modelos.
Adaptado às necessidades do cliente
Segundo Pierre Stock, desenvolvedor principal da Mistral, o Large 4 é “o melhor modelo de código aberto” e possui recursos de ponta em áreas importantes para os clientes. Isso inclui cibersegurança, manufatura e o setor financeiro. Além disso, o modelo é multimodal e pode processar imagens, bem como texto.Sebastian Matthes (à esquerda), Arthur Mensch: O editor-chefe do Handelsblatt em conversa com o CEO da Mistral sobre os riscos de segurança da IA.
Foto: Bits & Pretzels
O CEO da Mistral, Arthur Mensch, já havia revelado na semana passada, em conversa com o editor-chefe do Handelsblatt, Sebastian Matthes, na conferência de startups Bits & Pretzels, em Munique, que o modelo possui capacidades de atuação significativamente aprimoradas. Ele consegue executar tarefas complexas por horas e interagir com diversas ferramentas sem perder o contexto. As gerações anteriores de modelos não conseguiam fazer isso. Segundo Lample, o ML4 deverá, portanto, ser capaz de assumir tarefas que antes exigiam horas ou até mesmo dias de trabalho de especialistas.
A Mistral negociou com a ASML., Samsung e Airbus Nos últimos meses, a Mistral conquistou importantes clientes industriais e está colaborando com países como Luxemburgo e França. A empresa de IA adaptou as capacidades do modelo às necessidades de seus clientes. Segundo a Mistral, o ML4 foi treinado em mais de 160 idiomas, além de luxemburguês e coreano.
O sucesso do ML4 só será comprovado após extensos testes realizados por especialistas nas próximas semanas. Na terça-feira, a Mistral disponibilizou inicialmente uma versão prévia do modelo por meio de uma interface. Os pesos do modelo, que desenvolvedores do mundo todo poderão baixar, executar e personalizar, serão disponibilizados em 27 de outubro.
O Large 4 foi projetado para lidar com tarefas de programação complexas.
Um dos pontos fortes do modelo é sua capacidade de programação e cibersegurança. A equipe liderada por Lample e Stock trabalhou intensamente, principalmente, em suas capacidades de programação baseada em agentes. Isso permite que o ML4 analise projetos de software existentes ou adicione novas funções de forma independente. Segundo Mistral, o modelo preenche a lacuna de programação em relação aos principais modelos. Ele também apresenta um desempenho particularmente bom em tarefas relacionadas ao desenvolvimento e teste de semicondutores.
Tópicos relacionados
A Mistral também implementou melhorias específicas no ML4 na área de cibersegurança. Isso se deveu à alta demanda dos clientes, afirma Stock. Os clientes desejavam um modelo europeu para sanar lacunas de segurança, auditar protocolos, proteger-se contra ataques e detectar problemas de segurança em sua infraestrutura. A Mistral está ciente de que essas funcionalidades também podem ser usadas para ciberataques. Portanto, a empresa conta com mecanismos de proteção e monitora o tráfego de dados ao usar a interface.
Mistral planeja aprimorar continuamente o ML4. Lample afirma: “Temos uma receita realmente eficaz para melhorar o modelo continuamente”. O ML4 deverá estar mais poderoso até o final do mês, quando os pesos do modelo serão publicados.
