tradingkey.logo
tradingkey.logo
Pesquisar

O Muse Code da Meta vem com um registro de erros à prova de falhas, mas o Claude Opus 5 continua à frente nos testes de desempenho

Cryptopolitan6 de ago de 2026 às 10:31
facebooktwitterlinkedin
Ver todos os comentários0

A Meta lançou na quarta-feira o Muse Code (beta), um agente de codificação baseado em terminal. Os gráficos da própria empresa mostram que seu modelo supera o Codex da OpenAI e o Antigravity do Google na maioria dos testes de codificação, mas perde para o Claude Opus 5 da Anthropic em todos os benchmarks divulgados pela Meta.

Muse Code fica atrás do Opus 5, mas adiciona um registro de erros à prova de falhas

O Muse Code é baseado no Muse Spark 1.2, uma atualização do modelo de codificação que a Meta disponibilizou para desenvolvedores dos EUA em julho.

O Muse Spark 1.2 fica atrás do Opus 5 nos testes de desempenho de programação apresentados pela Meta, mas supera o Codex e o Antigravity na maioria deles. A Meta afirmou que o modelo representa seu "próximo passo rumo à vanguarda, com modelos maiores e muito mais capazes a caminho"

A empresa afirma que a versão 1.2 apresenta melhor desempenho na geração de código, depuração e compreensão de grandes bases de código, após ter aumentado a capacidade computacional dedicada às tarefas de codificação durante o treinamento.

Em um estudo de caso, o modelo reescreveu kernels de GPU para chips NVIDIA Hopper em mais de 1.000 chamadas de ferramentas e por até 24 horas, partindo de uma base que lhe foi instruída a não copiar de bibliotecas existentes.

O Muse Code mantém um registro de eventos local que grava todas as chamadas de modelo, execuções de ferramentas, aprovações e edições. "Essa fonte única de verdade torna o ambiente de execução extremamente preciso e seguro para reinicializações", escreveu a Meta em sua postagem no blog, referindo-se ao registro.

Se ocorrer uma falha, o agente pode retomar de onde parou. O agente também mantém subagentes em segundo plano em execução durante toda a sessão.

Mark Zuckerberg, CEO da Meta, escreveu em uma publicação: "Quando uma tarefa é grande o suficiente, ela se ramifica em subagentes separados que trabalham em paralelo em árvores de trabalho isoladas." Ele continuou: "Sua cópia de trabalho nunca é alterada. Em testes, conseguimos construir seis funcionalidades para um jogo simultaneamente, sem nenhuma colisão."

/plan, /grill e a aposta da Meta no custo

O Muse Code possui diversos comandos integrados. /plan transforma uma solicitação em um plano sujeito a aprovação, /grill testa a resistência desse plano até que ele seja implementado corretamente e /goal impulsiona a conclusão do objetivo estabelecido.

Os desenvolvedores podem instalar o agente no macOS ou Linux com um único comando curl. O Muse Spark 1.2 também está disponível através da API Meta Model.

O modelo e o agente funcionam em conjunto. O conjunto de ferramentas Muse Code mantém a compatibilidade entre eles.

Alguns dos dados de treinamento foram gerados pela versão mais antiga do Muse Spark, a 1.1, que criava problemas de programação fixa e classificava as respostas candidatas. Esse é um ciclo que, segundo a Meta, ajudou o modelo mais recente a seguir as instruções com precisão.

A Meta está informando aos investidores que espera gastar entre US$ 125 bilhões e US$ 145 bilhões este ano em chips, centros de dados e outras infraestruturas.

Com o Opus 5 fora de alcance nos benchmarks, a empresa está competindo com base no preço. Um modelo Meta AI maior, com o codinome Melancia, ainda está em treinamento.

Não se limite a ler notícias sobre criptomoedas. Compreenda-as. Assine nossa newsletter. É grátis.

Aviso legal: as informações fornecidas neste site são apenas para fins educacionais e informativos e não devem ser consideradas consultoria financeira ou de investimento.

Comentários (0)

Clique no botão $, digite o código do ativo e selecione para vincular uma ação, ETF ou outro ticker.

0/500
Diretrizes de comentários
Carregando...

Artigos recomendados

tradingkey.logo
Aviso de risco: Nosso site e aplicativo móvel fornecem apenas informações gerais sobre determinados produtos de investimento. A Finsights não oferece, e o fornecimento de tais informações não deve ser interpretado como se a Finsights estivesse oferecendo, aconselhamento financeiro ou recomendação para qualquer produto de investimento.
Os produtos de investimento estão sujeitos a riscos significativos, incluindo a possível perda do valor investido e podem não ser adequados para todos. O desempenho passado dos produtos de investimento não é indicativo de seu desempenho futuro.
A Finsights pode permitir que anunciantes ou afiliados realizem, ou forneçam anúncios em nosso site, ou aplicativo móvel, ou em qualquer parte deles e pode ser compensada por eles com base em sua interação com os anúncios.
 © Copyright: FINSIGHTS MEDIA PTE. LTD. Todos os direitos reservados.