Tecnologia

Meta lança Muse Glimmer: agente de IA de 30B que corre na sua GPU sem servidores

Adrian Kessler

Meta construiu um agente de IA de 30 mil milhões de parâmetros que funciona inteiramente em hardware consumer — e disponibilizou o código-fonte gratuitamente. O modelo, chamado Muse Glimmer, não encaminha as suas tarefas para os servidores da Meta. Executa localmente na sua própria GPU e, com uma pegada de memória quantizada de 18 a 20 gigabytes, cabe no envelope das actuais placas gráficas consumer de topo.

Isto é importante porque a geração anterior de modelos locais — as variantes de 7 mil milhões e 13 mil milhões de parâmetros que preencheram a biblioteca Ollama nos últimos dois anos — eram geradores de texto capazes, mas maus agentes autónomos. Tinham dificuldades com raciocínio multi-etapa, chamadas a ferramentas que falhavam a meio e tarefas que exigiam lembrar-se do que aconteceu três passos atrás. O Muse Glimmer foi especificamente concebido para esses fluxos de trabalho: programação, chamada de funções, gestão de agenda, organização de ficheiros e sequências de tarefas multi-etapa que recuperam automaticamente quando uma chamada a uma ferramenta falha.

A arquitectura subjacente é uma destilação do Muse Spark, o modelo comercial para o qual a Meta começou a vender acesso via API no mês passado. Através de destilação de logits e aprendizagem por reforço, a empresa comprimiu o seu carro-chefe fechado numa forma que cabe numa GPU de 24 gigabytes — a RTX 5090, o Apple M5 Max ou o M4 Max. A descodificação especulativa aumenta ainda mais o débito: a RTX 5090 executa o modelo 3,1 vezes mais rápido do que sem ela, o M5 Max 1,8 vezes, o M4 Max 1,5 vezes. Na prática, essa diferença é a linha entre um agente que parece responsivo e um que exige paciência.

O modelo processa texto e imagens intercalados — screenshots, documentos, entradas de conteúdo misto — e opera em mais de 100 línguas. Liga-se nativamente às frameworks que os utilizadores de IA local já usam: Ollama, LM Studio, llama.cpp, MLX. Se já descarrega modelos do Hugging Face e os executa no seu hardware, o Muse Glimmer encaixa-se nesse fluxo de trabalho sem ferramentas adicionais.

A licença é Apache 2.0, o que significa que não tem restrições comerciais. Indivíduos, empresas e investigadores podem usá-lo sem pagar à Meta. Isto coloca-o numa categoria diferente dos modelos da OpenAI e da Anthropic, que exigem pagamento por token mesmo para trabalho de desenvolvimento. Em comparação com o Gemma4-31B da Google e o Qwen3.6-27B da Alibaba — os seus concorrentes open-weight mais próximos em escala — a Meta posiciona o Muse Glimmer como forte para o seu tamanho em benchmarks de agentes e de modelos de linguagem geral, sem fazer afirmações mais específicas sobre em que tarefas vence.

O limiar de hardware continua selectivo. Encaixar 18 gigabytes de pesos do modelo numa GPU parece acessível até calcularmos que GPU isso exige. Uma RTX 5090 custa actualmente acima de dois mil dólares. As máquinas com Apple M5 Max começam perto dos três mil. Isto é IA local para um escalão de rendimento específico, não uma substituição da cloud para a maioria dos utilizadores. A versão quantizada é também uma irmã de fidelidade reduzida do Muse Spark: herda o sinal de treino do modelo comercial, mas não é o modelo comercial. A Meta continua a vender acesso à versão de maior capacidade.

O que muda com este lançamento é o patamar de agentes capazes em modelos locais. Executar um modelo de 30 mil milhões de parâmetros treinado para conclusão autónoma de tarefas é diferente de executar um modelo de chat com o mesmo número de parâmetros. A distinção está em como o modelo lida com falhas de ferramentas e sequências multi-etapa — não em quão bem completa uma única frase.

Os pesos estão disponíveis no Hugging Face desde 10 de Agosto, sob licença Apache 2.0. A Meta confirmou parcerias de optimização ao nível do dispositivo com AMD, Arm, Dell, Intel e Nvidia, com versões afinadas adicionais para configurações de hardware específicas a seguir. A comunidade de IA local irá testar o modelo exaustivamente dentro de dias, como faz com todos os lançamentos significativos — os resultados de benchmark dessa comunidade darão uma imagem mais clara de onde o Muse Glimmer realmente se encontra dentro de duas semanas a partir de hoje.

Etiquetas: , , , , ,

Discussão

Existem 0 comentários.