IA

Meta lancia Muse Glimmer: agente IA da 30B di parametri che funziona sul tuo GPU

Adrian Kessler

Meta ha costruito un agente AI da 30 miliardi di parametri che funziona interamente su hardware consumer, rilasciando il codice sorgente gratuitamente. Il modello, chiamato Muse Glimmer, non instrada i tuoi compiti attraverso i server di Meta. Viene eseguito localmente sulla tua GPU e, con un footprint di memoria quantizzato da 18 a 20 gigabyte, si inserisce nei limiti delle attuali schede grafiche consumer di fascia alta.

Questo è importante perché la precedente generazione di modelli locali — le varianti da 7 e 13 miliardi di parametri che hanno riempito la libreria Ollama negli ultimi due anni — erano generatori di testo capaci ma scarsi agenti autonomi. Faticavano con il ragionamento multi-step, chiamate a strumenti che fallivano a metà strada e compiti che richiedevano di ricordare cosa era successo tre passi prima. Muse Glimmer è specificamente progettato per questi flussi di lavoro: codifica, chiamate di funzioni, gestione del calendario, organizzazione di file e sequenze di attività multi-step che si riprendono automaticamente quando una chiamata a uno strumento si rompe.

L’architettura sottostante è una distillazione di Muse Spark, il modello commerciale per cui Meta ha iniziato a vendere l’accesso API il mese scorso. Attraverso la distillazione dei logit e l’apprendimento per rinforzo, l’azienda ha compresso il suo flagship chiuso in una forma che si adatta a una GPU da 24 gigabyte — la RTX 5090, Apple M5 Max o M4 Max. Il decoding speculativo spinge ulteriormente la produttività: la RTX 5090 esegue il modello 3,1 volte più velocemente rispetto a senza, M5 Max a 1,8 volte, M4 Max a 1,5 volte. In pratica, questa differenza è il confine tra un agente che sembra reattivo e uno che richiede pazienza.

Il modello elabora testo e immagini intervallati — screenshot, documenti, input con contenuti misti — e opera in oltre 100 lingue. Si collega nativamente ai framework che gli utenti di AI locale già utilizzano: Ollama, LM Studio, llama.cpp, MLX. Se già scarichi modelli da Hugging Face e li esegui sul tuo hardware, Muse Glimmer si inserisce in quel flusso di lavoro senza strumenti aggiuntivi.

La licenza è Apache 2.0, il che significa che non ci sono restrizioni commerciali. Privati, aziende e ricercatori possono usarlo senza pagare Meta. Questo lo colloca in una categoria diversa dai modelli di OpenAI e Anthropic, che richiedono il pagamento per token anche per lavori di sviluppo. Rispetto a Google Gemma4-31B e Alibaba Qwen3.6-27B — i suoi più vicini concorrenti a pesi aperti per scala — Meta posiziona Muse Glimmer come forte per le sue dimensioni nei benchmark agente e di linguaggio generale, senza fare affermazioni più specifiche su quali compiti vinca.

La soglia hardware rimane selettiva. Inserire 18 gigabyte di pesi del modello su una GPU sembra accessibile finché non si calcola quale GPU sia necessaria. Una RTX 5090 attualmente costa oltre duemila dollari. Le macchine Apple M5 Max partono da quasi tremila. Questa è AI locale per una specifica fascia di reddito, non un sostituto del cloud per la maggior parte degli utenti. La versione quantizzata è anche una sorella a fedeltà ridotta di Muse Spark: eredita il segnale di addestramento dal modello commerciale, ma non è il modello commerciale. Meta continua a vendere l’accesso alla versione con capacità superiori.

Ciò che cambia con questo rilascio è il livello di agente capace dei modelli locali. Eseguire un modello da 30 miliardi di parametri addestrato per il completamento autonomo di compiti è diverso dall’eseguire un modello chat con lo stesso numero di parametri. La distinzione sta in come il modello gestisce i fallimenti degli strumenti e le sequenze multi-step, non in quanto bene completa una singola frase.

I pesi sono disponibili su Hugging Face dal 10 agosto, con licenza Apache 2.0. Meta ha confermato partnership di ottimizzazione a livello di dispositivo con AMD, Arm, Dell, Intel e Nvidia, con ulteriori build ottimizzate per specifiche configurazioni hardware in arrivo. La comunità dell’AI locale metterà alla prova il modello entro pochi giorni, come fa con ogni rilascio significativo — i risultati dei benchmark di quella comunità forniranno un quadro più chiaro di dove si colloca realmente Muse Glimmer entro due settimane da oggi.

Tag: , , , , ,

Discussione

Ci sono 0 commenti.