
Se ainda andas à procura do “Llama 4 mais recente da Meta”, tens uma notícia mais fresca para testar: o Muse Glimmer, lançado a 10 de agosto de 2026 — há poucos dias — sob licença Apache 2.0, totalmente grátis para descarregar e correr no teu próprio computador. Este artigo separa o que a Meta publicou oficialmente sobre o modelo do que ainda não sabemos, e explica porque é que “Muse Glimmer vs GPT-5.6” não é bem a pergunta certa, mesmo sendo a mais óbvia de fazer.
O que é o Muse Glimmer, ao certo?
É um modelo denso de 30 mil milhões de parâmetros, com um encoder de visão próprio (~1,8 mil milhões de parâmetros adicionais), destilado a partir do Muse Spark — o modelo maior que já move o assistente Meta AI. Ao contrário do Spark, este tem pesos abertos: podes descarregar, correr localmente e usar comercialmente sem pedir licença.
- Contexto: mais de 131.000 tokens
- Corte de conhecimento: 4 de janeiro de 2026
- Hardware necessário: uma GPU de consumidor com 24 GB de VRAM, ou um Mac com chip M4/M5 Max — a Meta comprime o modelo para ~4 bits, o que o faz caber em 20 GB, deixando espaço para a cache e o encoder de visão
- Velocidade: com a técnica DFlash (previsão de blocos de 16 tokens de cada vez), a Meta mediu um salto de 74,9 para 233,4 tokens/segundo numa RTX 5090 — 3,1x mais rápido que sem a técnica
É pensado sobretudo para agentes que ficam “sempre ligados” — a processar tarefas, usar ferramentas e manter memória ao longo de sessões longas — não para conversas casuais tipo ChatGPT.
Onde testar grátis
- Hugging Face: pesos em BF16, versões GGUF quantizadas e builds ExecuTorch, na coleção oficial da Meta
- Ollama ou LM Studio: a forma mais simples de correr localmente sem lidar com ficheiros de modelo à mão
- Requisito mínimo realista: GPU de 24 GB (ex.: RTX 4090) ou Mac Apple Silicon com pelo menos 24-32 GB de memória unificada
Se não tens hardware para isto, não há (ainda) uma versão hospedada gratuita equivalente ao chat.openai.com — é um modelo para descarregar, não para usar num browser sem instalar nada.
Os números que a Meta publicou
A Meta comparou o Muse Glimmer com dois modelos abertos do mesmo tamanho — Gemma4-31B e Qwen3.6-27B — não com o ChatGPT ou o Claude. Os resultados, tal como divulgados:
- MCP Atlas (uso de ferramentas/agente): Glimmer 75,5 — Gemma4 54,2 — Qwen3.6 62,5
- DeepSearch QA: Glimmer 74,6
- SWE-Bench Pro (código): Glimmer 51,2 — Qwen3.6 50,2 (quase empatados)
- AIME 2026 (raciocínio matemático): Glimmer 94,7
- IFBench: Glimmer 77,0
Mas o Glimmer não ganha em tudo: fica atrás do Qwen3.6-27B no OSWorld-Verified (65,9 vs 75,6) e no TerminalBench 2.1 (60,7, com o Qwen à frente) — tarefas de usar um computador e um terminal de forma autónoma. Vale reter isto: “o modelo mais forte da Meta” não significa “o melhor em tudo”, nem sequer dentro da própria categoria de modelos abertos de tamanho semelhante.
E como compara com o GPT-5.6?
Aqui é onde a maioria dos artigos sobre este tema inventa uma resposta. Nós não vamos. A Meta não publicou nenhum benchmark direto entre o Muse Glimmer e o GPT-5.6, o Claude ou qualquer outro modelo fechado. As duas tabelas de números acima existem em universos de teste diferentes — não é possível pegar no 75,5 do MCP Atlas e comparar diretamente com o que quer que seja que a OpenAI publique para o GPT-5.6.
O que sabemos sobre o GPT-5.6 Sol, lançado a 9 de julho de 2026: no Agents’ Last Exam — uma avaliação de fluxos de trabalho profissionais longos em 55 áreas, o proxy mais próximo de “lógica empresarial” que existe publicamente — o GPT-5.6 Sol marcou 53,6 pontos, a melhor pontuação registada até à data para esse teste específico. Tem uma janela de contexto de 1,05 milhões de tokens e custa 5 USD por milhão de tokens de entrada e 30 USD por milhão de saída via API.
A comparação honesta não é “qual pontua mais alto” — é esta: o Muse Glimmer é grátis, corre no teu hardware, e foi desenhado para agentes que precisam de ficar dentro da tua rede (útil em setores regulados: saúde, jurídico, financeiro). O GPT-5.6 é pago, corre na cloud da OpenAI, e lidera em tarefas de conhecimento profissional complexo e janelas de contexto muito maiores. Não competem exatamente pelo mesmo trabalho.
Para quem faz sentido cada um
- Muse Glimmer: empresas com requisitos de residência de dados ou compliance que impedem enviar informação para a cloud; equipas que querem automatizar tarefas repetitivas sem custo por token; developers a construir agentes locais ou desktop.
- GPT-5.6: trabalho de conhecimento complexo, análise de documentos muito longos, tarefas onde a qualidade da resposta pesa mais do que o custo por chamada, e onde correr na cloud não é um problema.
Vale ainda uma nota de cautela geral, válida para qualquer benchmark publicado por quem constrói o próprio modelo: números como estes tendem a sobrestimar o desempenho em tarefas reais, mais imprevisíveis do que os testes controlados. Antes de decidires com base nisto, testa com os teus próprios casos de uso.
Perguntas Frequentes
O Muse Glimmer é a mesma coisa que o Llama 4?
Não. O Llama 4 (Scout e Maverick) continua a existir e continua gratuito, mas é uma família separada, mais antiga (lançada em abril de 2025). O Muse Glimmer é o modelo aberto mais recente da Meta, da nova marca Muse. Detalhamos a diferença completa no guia sobre a família Muse.
Preciso de placa gráfica cara para correr o Muse Glimmer?
Precisas de pelo menos 24 GB de VRAM (uma RTX 4090, por exemplo) ou um Mac com chip Apple Silicon M4/M5 Max com memória unificada suficiente. Não corre bem em hardware muito mais modesto que isso.
Há alguma versão do Muse Glimmer para usar num browser, sem instalar nada?
Não diretamente — é um modelo para descarregar e correr localmente via Ollama, LM Studio ou Hugging Face. Para uso casual no browser, a Meta continua a oferecer o Meta AI, que usa o Muse Spark (esse sim, na cloud) em vez do Glimmer.
Fontes:
- Meta — Introducing Muse Glimmer (research.meta.ai, agosto 2026)
- MarkTechPost — Meta AI Releases Muse Glimmer: A 30B Open-Weights Agentic Model That Runs on One Consumer GPU
- Layer3Labs — Muse Glimmer Benchmarks: Business-Relevant Results Explained
- OpenAI — GPT-5.6: Frontier intelligence that scales with your ambition
- Coursiv — GPT-5.6 Sol: Benchmarks, API Pricing & Review