Meta Muse Glimmer AI model ਇੱਕ 30 ਬਿਲੀਅਨ ਪੈਰਾਮੀਟਰ ਦਾ ਓਪਨ-ਵੇਟ ਏਜੰਟ ਮਾਡਲ ਹੈ ਜੋ 4-bit quantization ਅਤੇ DFlash speculative decoding ਨਾਲ ਸਿਰਫ਼ 24GB VRAM ਵਾਲੇ ਇੱਕ ਕੰਜ਼ਿਊਮਰ GPU ‘ਤੇ ਬਿਨਾਂ ਕਲਾਊਡ ਸਬਸਕ੍ਰਿਪਸ਼ਨ ਚੱਲਦਾ ਹੈ।
Meta Muse Glimmer AI model ਕੀ ਹੈ?
Meta Superintelligence Labs ਨੇ ਆਪਣੇ ਅਧਿਕਾਰਤ ਬਲੌਗ ਪੋਸਟ ਵਿੱਚ 10 ਅਗਸਤ 2026 ਨੂੰ Muse Glimmer ਨਾਂ ਦਾ ਇੱਕ 30 ਬਿਲੀਅਨ ਪੈਰਾਮੀਟਰ ਓਪਨ-ਵੇਟ AI ਮਾਡਲ ਜਾਰੀ ਕਰਨ ਦਾ ਐਲਾਨ ਕੀਤਾ। ਇਹ ਮਾਡਲ ਖ਼ਾਸ ਤੌਰ ‘ਤੇ ਆਟੋਨੋਮਸ ਏਜੰਟ ਕੰਮਾਂ — ਯੋਜਨਾ ਬਣਾਉਣ, ਟਾਸਕ ਲਾਗੂ ਕਰਨ, ਗ਼ਲਤੀ ਤੋਂ ਮੁੜ ਸੁਧਰਨ ਅਤੇ ਕਈ-ਪੜਾਵੀ ਕੰਮ ਪੂਰੇ ਕਰਨ — ਲਈ ਸਿਖਲਾਈ ਦਿੱਤਾ ਗਿਆ ਹੈ। ਇਹ Meta ਦੇ ਬੰਦ ਫਰੰਟੀਅਰ ਮਾਡਲ Muse Spark ਤੋਂ distill ਕੀਤਾ ਗਿਆ ਹੈ।
ਖ਼ਾਸ ਗੱਲ ਇਹ ਹੈ ਕਿ Muse Glimmer ਨੂੰ ਵੱਡੇ ਡਾਟਾ-ਸੈਂਟਰ ਜਾਂ ਕਲਾਊਡ GPU ਕਲੱਸਟਰ ਦੀ ਲੋੜ ਨਹੀਂ। ਇਹ ਇੱਕ ਆਮ ਕੰਜ਼ਿਊਮਰ-ਗ੍ਰੇਡ GPU ‘ਤੇ, ਲੈਪਟਾਪ ਜਾਂ ਡੈਸਕਟਾਪ ‘ਤੇ ਵੀ, ਬਿਨਾਂ ਇੰਟਰਨੈੱਟ ਕਨੈਕਸ਼ਨ ਦੇ ਚੱਲ ਸਕਦਾ ਹੈ। ਇਸੇ ਲਈ ਟੈੱਕ ਹਲਕਿਆਂ ਵਿੱਚ ਇਸਨੂੰ ਲੋਕਲ ਏਜੰਟ ਮਾਡਲਾਂ ਦੀ ਪਹਿਲੀ ਵੱਡੀ ਮਿਸਾਲ ਕਿਹਾ ਜਾ ਰਿਹਾ ਹੈ।
ਮੁੱਖ ਸਪੈਕਸ ਅਤੇ ਸਪੀਡ
ਪੂਰੀ ਸ਼ੁੱਧਤਾ (full precision) ‘ਤੇ 30 ਬਿਲੀਅਨ ਪੈਰਾਮੀਟਰ ਮਾਡਲ ਨੂੰ 55GB ਤੋਂ ਵੱਧ ਮੈਮਰੀ ਚਾਹੀਦੀ ਹੈ, ਜੋ ਕਿਸੇ ਵੀ ਕੰਜ਼ਿਊਮਰ GPU ਕੋਲ ਨਹੀਂ ਹੁੰਦੀ। MarkTechPost ਦੀ ਰਿਪੋਰਟ ਮੁਤਾਬਕ Meta ਨੇ 4-bit quantization ਵਰਤ ਕੇ ਮਾਡਲ ਦਾ ਆਕਾਰ 20GB ਤੋਂ ਹੇਠਾਂ ਲਿਆਂਦਾ, ਜਿਸ ਨਾਲ ਇਹ 24GB VRAM ਵਾਲੇ ਸਿੰਗਲ GPU ‘ਤੇ KV ਕੈਸ਼ ਅਤੇ ਵਿਜ਼ਨ ਏਨਕੋਡਰ ਸਮੇਤ ਆਰਾਮ ਨਾਲ ਚੱਲ ਸਕਦਾ ਹੈ।
ਸਪੀਡ ਲਈ ਮਾਡਲ DFlash ਨਾਂ ਦਾ speculative decoding ਸਿਸਟਮ ਵਰਤਦਾ ਹੈ, ਜੋ ਇੱਕ ਵਾਰ ਵਿੱਚ 16 ਟੋਕਨਾਂ ਦਾ ਬਲਾਕ ਪ੍ਰਸਤਾਵਿਤ ਕਰਦਾ ਹੈ ਅਤੇ ਮੁੱਖ ਮਾਡਲ ਉਹਨਾਂ ਨੂੰ ਸਮਾਨਾਂਤਰ ਤਸਦੀਕ ਕਰਦਾ ਹੈ। Meta ਦੇ ਆਪਣੇ ਟੈਸਟਾਂ ਮੁਤਾਬਕ ਇਸ ਨਾਲ RTX 5090 ‘ਤੇ ਡੀਕੋਡਿੰਗ ਸਪੀਡ 3.1 ਗੁਣਾ, M5 Max ‘ਤੇ 1.8 ਗੁਣਾ ਅਤੇ M4 Max ‘ਤੇ 1.5 ਗੁਣਾ ਵਧ ਜਾਂਦੀ ਹੈ।
ਸਮਰੱਥਾ ਅਤੇ ਬੈਂਚਮਾਰਕ
Muse Glimmer ਸਿਰਫ਼ ਤੇਜ਼ ਨਹੀਂ, ਸਗੋਂ ਭਰੋਸੇਯੋਗ ਵੀ ਬਣਾਇਆ ਗਿਆ ਹੈ। ਜੇ ਕੋਈ ਟੂਲ-ਕਾਲ ਫੇਲ੍ਹ ਹੋ ਜਾਵੇ, ਤਾਂ ਇਹ ਗ਼ਲਤੀ ਦੀ ਪਛਾਣ ਕਰਕੇ ਦੁਬਾਰਾ ਕੋਸ਼ਿਸ਼ ਕਰਦਾ ਹੈ, ਨਾ ਕਿ ਰੁਕ ਜਾਂਦਾ ਹੈ। ਇਹ ਸਕ੍ਰੀਨਸ਼ਾਟ ਅਤੇ ਦਸਤਾਵੇਜ਼ ਵਰਗੇ ਤਸਵੀਰੀ ਇਨਪੁੱਟ ਵੀ ਸਮਝ ਸਕਦਾ ਹੈ ਅਤੇ 100 ਤੋਂ ਵੱਧ ਭਾਸ਼ਾਵਾਂ ਦਾ ਸਮਰਥਨ ਕਰਦਾ ਹੈ।
Meta ਦੇ ਦਾਅਵੇ ਮੁਤਾਬਕ Muse Glimmer, MCP Atlas, DeepSearch QA ਅਤੇ SWE-Bench Pro ਵਰਗੇ ਏਜੰਟ ਬੈਂਚਮਾਰਕਾਂ ‘ਤੇ Gemma4-31B ਅਤੇ Qwen3.6-27B ਨਾਲੋਂ ਅੱਗੇ ਹੈ, ਪਰ OSWorld ਅਤੇ TerminalBench ਵਰਗੇ ਕੰਪਿਊਟਰ-ਵਰਤੋਂ ਟੈਸਟਾਂ ਵਿੱਚ Qwen3.6-27B ਹਾਲੇ ਵੀ ਅੱਗੇ ਹੈ। ਇਹ ਸਾਰੇ ਨਤੀਜੇ ਖ਼ੁਦ Meta ਵੱਲੋਂ ਰਿਪੋਰਟ ਕੀਤੇ ਗਏ ਹਨ, ਸੁਤੰਤਰ ਤਸਦੀਕ ਅਜੇ ਬਾਕੀ ਹੈ।
ਇਹ ਕਿਉਂ ਮਾਇਨੇ ਰੱਖਦਾ ਹੈ
Muse Glimmer ਦੀ ਸਭ ਤੋਂ ਵੱਡੀ ਗੱਲ ਇਹ ਹੈ ਕਿ ਇਹ Meta ਦੇ ਬੰਦ ਮਾਡਲ Muse Spark ਦੀ ਸਮਰੱਥਾ ਦਾ ਵੱਡਾ ਹਿੱਸਾ ਮੁਫ਼ਤ ਅਤੇ ਲੋਕਲ ਲੈ ਆਉਂਦਾ ਹੈ। Muse Spark ਦਾ ਪੇਡ API $4.25 ਪ੍ਰਤੀ ਮਿਲੀਅਨ ਆਊਟਪੁੱਟ ਟੋਕਨ ‘ਤੇ ਮੀਟਰ ਹੁੰਦਾ ਹੈ, ਜਦਕਿ Muse Glimmer ਨੂੰ ਇੱਕ ਵਾਰ ਡਾਊਨਲੋਡ ਕਰਕੇ ਬਿਨਾਂ ਕਿਸੇ ਪ੍ਰਤੀ-ਟੋਕਨ ਬਿੱਲ ਦੇ ਵਰਤਿਆ ਜਾ ਸਕਦਾ ਹੈ।
ਇਹ ਰਿਲੀਜ਼ Meta ਦੇ ਓਪਨ-ਸੋਰਸ ਵੱਲ ਵਾਪਸੀ ਨੂੰ ਵੀ ਦਰਸਾਉਂਦੀ ਹੈ, ਕਿਉਂਕਿ ਹਾਲ ਹੀ ਵਿੱਚ ਕੰਪਨੀ ਨੇ Muse Spark ਵਰਗੇ ਮਾਡਲ ਬੰਦ ਰੱਖੇ ਸਨ। ਜਿੱਥੇ Google ਦਾ Gemini 3.6 Flash ਵਰਗਾ ਮਾਡਲ ਕਲਾਊਡ API ‘ਤੇ ਨਿਰਭਰ ਰਹਿੰਦਾ ਹੈ, Muse Glimmer ਡਿਵੈਲਪਰਾਂ ਨੂੰ ਪੂਰੀ ਤਰ੍ਹਾਂ ਆਫ਼ਲਾਈਨ, ਪ੍ਰਾਈਵੇਟ ਏਜੰਟ ਬਣਾਉਣ ਦਾ ਰਾਹ ਦਿੰਦਾ ਹੈ।
ਸੁਰੱਖਿਆ ਪੱਖੋਂ Meta ਦੱਸਦਾ ਹੈ ਕਿ Muse Glimmer ਇਸ ਦੇ Advanced AI Scaling Framework ਤਹਿਤ ‘ਫਰੰਟੀਅਰ’ ਸ਼੍ਰੇਣੀ ਵਿੱਚ ਨਹੀਂ ਆਉਂਦਾ ਅਤੇ ਸਾਈਬਰ ਤੇ ਹੋਰ ਜੋਖਮ ਮੱਧਮ ਜਾਂ ਘੱਟ ਪੱਧਰ ‘ਤੇ ਹਨ। ਇਹ ਵੀ ਕੰਪਨੀ ਦਾ ਆਪਣਾ ਮੁਲਾਂਕਣ ਹੈ, ਬਾਹਰੀ ਆਡਿਟ ਨਾਲ ਇਸਦੀ ਪੁਸ਼ਟੀ ਅਜੇ ਨਹੀਂ ਹੋਈ।
ਉਪਲੱਬਧਤਾ ਅਤੇ ਲਾਇਸੈਂਸ
Muse Glimmer ਹੁਣੇ Hugging Face ‘ਤੇ Apache 2.0 ਲਾਇਸੈਂਸ ਹੇਠ ਮੁਫ਼ਤ ਡਾਊਨਲੋਡ ਲਈ ਉਪਲੱਬਧ ਹੈ, ਜੋ ਵਪਾਰਕ ਵਰਤੋਂ, ਸੋਧ ਅਤੇ ਮੁੜ-ਵੰਡ ਦੀ ਖੁੱਲ੍ਹ ਦਿੰਦਾ ਹੈ। ਆਉਣ ਵਾਲੇ ਦਿਨਾਂ ਵਿੱਚ llama.cpp, MLX ਅਤੇ ExecuTorch ਲਈ ਆਪਟੀਮਾਈਜ਼ਡ ਇੰਟੀਗ੍ਰੇਸ਼ਨ ਆਉਣਗੇ, ਅਤੇ Ollama, LM Studio ਅਤੇ OpenRouter ਵਰਗੇ ਪਲੇਟਫਾਰਮਾਂ ‘ਤੇ ਵੀ ਸਮਰਥਨ ਜਲਦੀ ਹੀ ਯੋਜਨਾਬੱਧ ਹੈ।
ਕੰਪਨੀ ਨੇ ਹਾਲੇ Muse Spark ਦੇ ਵੱਡੇ ਵਰਜ਼ਨ ਦੇ ਵੇਟ ਖੋਲ੍ਹਣ ਦੀ ਪੱਕੀ ਤਾਰੀਖ਼ ਨਹੀਂ ਦੱਸੀ, ਸਿਰਫ਼ ਕਿਹਾ ਕਿ ਇਹ ਜਲਦੀ ਹੋਵੇਗਾ। ਉਦੋਂ ਤੱਕ Muse Glimmer ਹੀ ਆਮ ਯੂਜ਼ਰ ਲਈ ਸਭ ਤੋਂ ਸ਼ਕਤੀਸ਼ਾਲੀ ਓਪਨ-ਵੇਟ ਏਜੰਟ ਮਾਡਲ ਬਣਿਆ ਰਹੇਗਾ।
