A AMD anunciou suporte desde o primeiro dia ao Muse Glimmer 30B, modelo aberto da Meta projetado para aplicações de IA agentic. A tecnologia pode rodar localmente em sistemas equipados com Ryzen AI Max+ ou uma Radeon AI PRO R9700, usando frameworks como o llama.cpp.
Além disso, testes preliminares da AMD indicam até 24 tokens por segundo no Ryzen AI Max+ 395 e até 53 tokens por segundo na Radeon AI PRO R9700 com dFlash ativado. Os números foram obtidos no Windows com llama.cpp, backend Vulkan e decodificação especulativa dFlash.

A proposta ganha força porque o Muse Glimmer 30B busca atender fluxos que exigem memória persistente, uso de ferramentas, contexto amplo e execução de múltiplas etapas. Entretanto, a execução local também oferece aos desenvolvedores maior controle sobre processamento de dados, privacidade e custos recorrentes de infraestrutura. O modelo utiliza licença Apache 2.0, permitindo uso comercial, modificação e redistribuição.
Por fim, o LM Studio permite baixar e executar o modelo em sistemas AMD compatíveis com mais de 32 GB de VRAM ou VGM. Já o Lemonade oferece uma alternativa para integrar o Muse Glimmer 30B diretamente a aplicativos por meio de uma API local compatível com OpenAI, usando um binário incorporável de aproximadamente 4 MB. Assim, a AMD amplia a proposta do chamado Agentic PC, levando processamento de IA mais avançado diretamente para o dispositivo.
