Workstation Logo
مصنوعات
AI لیبزOpenAI ایجنٹسClaude ایجنٹسGrok BotWorkstation CRM (WSL CRM)مارکیٹنگتمام مصنوعات
AI حل
AI ورک سٹیشنزAI SME Packagesپرائیویٹ AIGPU کلسٹرزایج AIانٹرپرائز AI لیبصنعت کے مطابق AI
خدمات
Platform ModernisationDigital EngineeringData Foundations & AIAutonomous OperationsAI مشاورتDevOps آٹومیشنسائبر سیکیورٹیسافٹ ویئر ڈیولپمنٹایجنٹ بلڈنگMLOps سیٹ اپ
ہمارے بارے میں
شراکت دارگاہکوں کی کہانیاں
مضامین
دستاویزات
WSL ProxyRing PromoterWSL VaultJobshoutSysOps 24/7
بلاگ
ہم سے رابطہ کریںLogin
Workstation

جدید کاروبار کے لیے AI ورک اسٹیشنز، AI ملٹی ایجنٹک سافٹ ویئر، GPU انفراسٹرکچر اور ذہین ایجنٹ حل۔

ہم سے رابطہ کریں

AI حل

AI ورک سٹیشنزAI SME Packagesپرائیویٹ AIGPU کلسٹرزایج AIانٹرپرائز AI لیبصنعت کے مطابق AI

مصنوعات

تمام مصنوعاتWSL CRM اور ERPمارکیٹنگOpenAI ایجنٹسWSL ProxyRing PromoterWSL VaultJobshoutSysOps 24/7

کمپنی

ہمارے بارے میںWorkstation کیوںشراکت دارگاہکوں کی کہانیاںقیمتیںرابطہ

وسائل

مضامیندستاویزاتبلاگتلاشسائٹ میپ
برطانیہ آفس
77-79 Marlowes, Hemel Hempstead HP1 1LFراستہ - M25 آؤٹر لندن سے جنکشن 20 لیںکمپنی نمبر: 11641870پیر - جمعہ: صبح 9:00 - شام 6:00 GMT
+44 7515 356 146
بیلجیم آفس
Workstation SRL, Rue Vanderkindere 34, 1180 Uccle, BrusselsBE 0751.518.683پیر - جمعہ: صبح 9:00 - شام 6:00 CET
+32 492 45 67 46
بھارت آفس
#159 Sector 9, Pocket 1, DDA Flats, 110077 Dwarka, New Delhi
+91 98881 98841

© 2026 Workstation AI۔ جملہ حقوق محفوظ ہیں۔

رازداریکوکیزسروس کی شرائطویب سائٹ سائٹ میپ
Home / Articles / Technology
AIMLOpsOpen Source

Ollama پر Muse Glimmer: ایک GPU پر ہمیشہ مقامی ایجنٹس

Workstation گہری غوطہ: فن تعمیر، Ollama ٹیگز/MLX، میٹا بینچ مارک میٹرکس بمقابلہ Gemma4-31B اور Qwen3.6-27B، تشخیص کا طریقہ کار، اور پروڈکشن چیک لسٹ

August 12, 2026Technology9 min read

Muse Glimmer میٹا کا 30-بلین پیرامیٹر کازل لینگویج ماڈل ہے جس میں ایک وقف شدہ پرسیپشن انکوڈر ہے، جو Muse Spark سے ڈسٹل ہے اور صارفین اور ورک سٹیشن ہارڈویئر پر خود مختار ایجنٹ ورک بوجھ کے لیے شائع کیا گیا ہے۔ کے ذریعے تقسیم کیا گیا۔ Ollama کے تحت Apache 2.0، یہ قابل اعتماد ٹول کے استعمال، طویل افق کے کاموں، ملٹی موڈل تفہیم، اور ناکامی کی بحالی کو نشانہ بناتا ہے — بغیر کلاؤڈ انفرنس کی ضرورت کے۔ یہ Workstation تکنیکی بریف مقامی ایجنٹوں کو بھیجنے والے انجینئرز کے لیے عوامی ماڈل کارڈ کو دوبارہ لکھتا اور پھیلاتا ہے۔

Muse Glimmer پر Ollama — Workstation تکنیکی گائیڈ

نیویگیشن ساتھی بلاگ: کاروبار کا خلاصہ. متعلقہ: کھلے وزن کو اپنانا, Mac Studio + Ollama, Apple Silicon / OpenClaw, MCP OAuth اور والٹ, Kubernetes پر LLMs.
ایجنٹ ڈائجسٹ۔
  • کلاس: 30B causal LM + پرسیپشن انکوڈر؛ Muse Spark سے کشید؛ وژن + ٹولز + سوچ۔
  • سرو کریں: ollama run muse-glimmer (~18GB، 128K، متن+تصویر)؛ Apple Silicon: muse-glimmer:30b-mlx (~21GB، DFlash)۔
  • فٹ: ایک GPU یا Mac Silicon پر ہمیشہ مقامی / ایئر گیپڈ ایجنٹس - ملٹی ٹی بی ایم او ای کلسٹر ماڈل نہیں۔
  • طاقت کا اشارہ: MCP-Atlas، DeepSearch QA، WildClawBench، SWE-Bench Pro، AA-LCR، Beam128K (اعلی استدلال) پر میٹا کے رپورٹ کردہ سائز-کلاس میٹرکس کی قیادت کرتا ہے۔
  • آپریشن: سہاروں کے ذریعے ollama launch (Claude Code, OpenCode, Hermes, OpenClaw); Evals، HITL، MCP auth کے ساتھ حکومت کریں۔

بنیادی ذرائع: Ollama لائبریری - muse-glimmer; میٹا تشخیص کا طریقہ کار - Muse Glimmer طریقہ کار. نمبر اور ٹیگ تبدیل خریداری سے پہلے لائیو ماڈل کارڈ کی تصدیق کریں۔

1. فن تعمیر اور ڈیزائن کا ارادہ

Muse Glimmer کو عام چیٹ MoE کے طور پر نہیں رکھا گیا ہے۔ میٹا کی فریمنگ ہے۔ آخر سے آخر تک ایجنٹی کام کی تکمیل ہارڈ ویئر پر آپ ڈیسک یا چھوٹے لیب ریک کے لیے خرید سکتے ہیں:

  • Causal LM بیک بون (30B) - طویل ورک فلو میں برقرار کثیر قدمی استدلال کی زنجیروں کے ساتھ اگلی ٹوکن نسل۔
  • سرشار پرسیپشن انکوڈر - انٹرلیوڈ ٹیکسٹ اور امیجز کو قبول کرتا ہے تاکہ ایجنٹ اسکرین شاٹس، چارٹس، اور دستاویزات کو ٹول ٹرانسکرپٹس کے طور پر اسی سیاق و سباق کی ونڈو میں استدلال کرسکیں۔
  • Muse Spark سے کشید — قابلیت کی منتقلی ایک ایسے نقش میں جو کہ صرف ڈیٹا سینٹر کی خدمت کے بجائے سنگل-GPU/صارف-طبقے کی تعیناتی کو نشانہ بناتی ہے۔
  • بحالی میں ناکامی کا رویہ — جب کوئی ٹول کال ناکام ہو جاتی ہے یا غیر متوقع پے لوڈ واپس کر دیتی ہے، تو ماڈل کو ایپی سوڈ کو روکنے کی بجائے تشخیص کرنے اور دوبارہ کوشش کرنے کے لیے تربیت دی جاتی ہے۔
  • قابل کنٹرول کوشش — استدلال کی طاقت قابل انتخاب ہے لہذا آپریٹرز فی روٹ کے معیار کے لیے تاخیر کی تجارت کر سکتے ہیں۔
  • کثیر لسانی تربیت کی کوریج - میٹا 100 سے زیادہ زبانوں کا تربیتی ڈیٹا بتاتا ہے۔

Workstation سٹیکس کے لیے، پروڈکٹ کا مطلب یہ ہے: Glimmer کو بطور ایک سمجھیں۔ ایجنٹ رن ٹائم دماغ MCP ٹولز، شیلز، براؤزرز اور فائل ایڈیٹرز کے پیچھے — ہر بند فرنٹیئر API کال کے لیے ڈراپ ان متبادل کے طور پر نہیں۔

مقامی ایجنٹ اسٹیک: سکیفولڈ، Ollama، Muse Glimmer، ٹولز، کنٹرول ہوائی جہاز

2. Ollama ڈسٹری بیوشن (ٹیگز، فٹ پرنٹ، I/O)

جیسا کہ Ollama لائبریری کارڈ پر شائع ہوا ہے (لائیو سائز کی تصدیق کریں):

ٹیگ تقریبا سائز سیاق و سباق ان پٹ نوٹس
muse-glimmer:latest / :30b~18GB128Kمتن، تصویرڈیفالٹ سنگل-GPU پاتھ
muse-glimmer:30b-mlx~21GB128Kمتن، تصویرOllama MLX انجن؛ DFlash + Apple Silicon پر تصویر
# Pull + interactive
ollama run muse-glimmer

# Apple Silicon (MLX)
ollama run muse-glimmer:30b-mlx

# HTTP chat (localhost Ollama)
curl http://localhost:11434/api/chat \
  -d '{"model":"muse-glimmer","messages":[{"role":"user","content":"Hello!"}]}'

# Scaffold launchers (from Ollama applications list)
ollama launch claude --model muse-glimmer
ollama launch opencode --model muse-glimmer
ollama launch hermes --model muse-glimmer
ollama launch openclaw --model muse-glimmer

Python/JS کلائنٹس کو وہ ٹیگ پن کرنا چاہیے جس کی آپ نے تصدیق کی ہے (muse-glimmer بمقابلہ :30b-mlx) تشکیل میں، ہارڈ کوڈ نہیں۔ latest پیداواری ایجنٹوں میں۔

3. صلاحیت کی سطح (انجینئرنگ ریڈنگ)

  • آخر سے آخر تک ایجنٹ کی تکمیل - میٹا ڈیپ سرچ QA، MCP-Atlas، τ3-Bench (بینکنگ)، اور SWE-Bench فیملی ٹاسکس پر مضبوط نتائج کا حوالہ دیتا ہے جو کہ سکیفولڈ ملٹی ٹرن کامیابی کی پیمائش کرتے ہیں، نہ کہ سنگل شاٹ ٹریویا۔
  • قابل اعتماد آلے کا استعمال - توسیع شدہ ورک فلو میں اسکیما کی درستگی کے ساتھ وسیع فنکشن کال کوریج (MCP ٹول فلیٹس کے لیے اہم)۔
  • کثیر الجہتی استدلال - طویل افق پر ہم آہنگی کی منصوبہ بندی؛ ٹرانسکرپٹ + دستاویز برقرار رکھنے کے لیے 128K سیاق و سباق کی ونڈو کے ساتھ جوڑے۔
  • ناکامی کی بازیابی۔ - غیر متوقع ٹول کے نتائج کی تشخیص کریں اور دوبارہ کوشش کریں۔ راتوں رات ملازمتوں میں "برٹل ایجنٹ" اسقاط کو کم کرتا ہے۔
  • کثیر الجہتی استدلال — پرسیپشن انکوڈر متن کے ساتھ منسلک اسکرین شاٹ/چارٹ/دستاویز کو قابل بناتا ہے (میٹا کے میٹرکس میں شامل GUI گراؤنڈنگ اور ڈاک پارس بینچ)۔
  • سکیفولڈ مطابقت - OpenClaw، Hermes Agent، اور اسی طرح کے آرکیسٹریشن پیٹرن؛ Ollama Claude Code اور OpenCode لانچرز کو فرسٹ کلاس ایپس کے طور پر درج کرتا ہے۔

4. بینچ مارک میٹرکس (میٹا رپورٹ شدہ، اعلیٰ استدلال)

میٹا Muse Glimmer-30B (اعلی استدلال) کا Gemma4-31B اور Qwen3.6-27B سے سوچنے کے انداز میں موازنہ کرتا ہے۔ Headline Workstation پڑھنا: Glimmer کئی لیڈز ایجنٹ پبلک سویٹس (MCP-Atlas, DeepSearch QA, WildClawBench, Gaia2, SWE-Bench Pro) کچھ ڈیسک ٹاپ-ایجنٹ اور GDP-val میٹرکس پر ساتھیوں کو پیچھے چھوڑتے یا باندھتے ہوئے۔ ہمیشہ دوبارہ چلائیں۔ آپ کا استعمال

زمرہ بینچ مارک Glimmer-30B Gemma4-31B Qwen3.6-27B
جنرل ایجنٹMCP-Atlas (عوامی)75.554.262.5
ڈیپ سرچ QA74.661.771.1
τ3-بینکنگ23.515.116.7
وائلڈ کلاؤ بینچ47.637.643.2
GDPVal-AA v29538111141
Gaia243.336.440.0
سکلز بنچ (ہنر کے ساتھ)44.332.446.6
OSWorld-Verified65.958.575.6
ایجنٹی کوڈنگSWE-Bench پرو51.236.950.2
SWE-Bench تصدیق شدہ76.066.677.2
ٹرمینل بینچ 2.151.743.460.7
سکائی کوڈ43.643.439.8
ملٹی موڈلCharXiv Reasoning78.877.778.4
اسکرین اسپاٹ پرو75.475.976.1
OmniDocBench v1.575.872.577.8
ایم ایم ایم یو پرو747375
استدلال / LCRآئی ایف بینچ77.076.070.8
AIME 202694.789.294.1
GPQA ڈائمنڈ (AA)83.585.784.2
HLE متن (AA)22.023.623.1
AA-LCR80.068.373.3
بیم 128K65.158.263.0

سیفٹی بینچز (CI Memories, Siren AgentDojo) تجارتی معاہدوں کو ظاہر کرتے ہیں: Glimmer مڈ پیک ASR کے ساتھ AgentDojo انجیکشن کے تحت اعلی افادیت کی اطلاع دیتا ہے۔ حفاظت کو تعیناتی کنٹرول کے مسئلے کے طور پر سمجھیں (پرامپٹ فائر والز، ٹول ایو لسٹ، ایچ آئی ٹی ایل) — حل شدہ ماڈل پراپرٹی نہیں۔ جج ماڈلز، کوششوں کی گنتی، اور احتیاطی تدابیر کے لیے میٹا کا طریقہ کار پی ڈی ایف دیکھیں۔

5. تشخیص کا طریقہ کار (نمبروں کا کیا مطلب ہے)

بورڈ ڈیک میں کسی بھی سیل کا حوالہ دینے سے پہلے میٹا کا طریقہ کار نوٹ ضروری ہے:

  • ہم مرتبہ کا انتخاب: سائز کے معیار کے کھلے ماڈل (Gemma4-31B، Qwen3.6-27B)؛ ساتھی خود رپورٹ شدہ یا اندرونی طور پر دوبارہ تیار کردہ اسکور استعمال کرسکتے ہیں۔ تینوں کے لیے دستیاب ہونے پر مصنوعی تجزیہ استعمال کیا جاتا ہے۔
  • نمونے لینے: درجہ حرارت=1.0/top_p=0.95/top_k=64; ساتھی وینڈر کی تجویز کردہ سوچ کی تشکیلات کا استعمال کرتے ہیں (کیوین کچھ ایجنٹ بینچوں پر ٹھنڈے وقت کا استعمال کرتا ہے)۔
  • استعمال کے تعصب کا انتباہ: میٹا نوٹ کرتا ہے کہ تھرڈ پارٹی ماڈلز کو میٹا کے ٹول/سسٹم پرامپٹس کے مطابق نہیں بنایا جا سکتا ہے — مطلق رینک ہم مرتبہ مقامی سہاروں کے تحت بدل سکتے ہیں۔
  • MCP-Atlas: 20+ MCP سرورز پر ملٹی ٹرن ٹول کا استعمال؛ 500 عوامی کاموں پر LLM-جج پاس کی شرح (تھریش ہولڈ 0.75)، اوسطاً 4 رنز سے زیادہ۔
  • ڈیپ سرچ QA: 900 سخت تحقیقی سوالات پر خود مختار براؤزنگ لوپ (تلاش/کھولنا/تلاش)؛ جج نکالنے کے ذریعے F1۔
  • WildClawBench / Gaia2: ایونٹ کے انجیکشن اور مکسڈ ڈیٹرمنسٹک/LLM گریڈنگ کے ساتھ OpenClaw طرز کے استعمال کے تحت لانگ ہوریزون ڈاکرائزڈ ایجنٹ کے کام۔
  • SWE-Bench: bash + فائل ٹولز اسکافولڈ؛ پرو اور تصدیق شدہ کا اوسط متعدد رنز پر ہوتا ہے — پرو موازنہ Qwen کے بہتر ٹاسک ویرینٹ سے گریز کرتا ہے۔
  • OSWorld-Verified: اسکرین شاٹس سے GUI صرف Ubuntu VM کنٹرول (کوئی براہ راست شیل نہیں)؛ ماڈلز کے درمیان ایکشن اسپیس فرق اہم ہے۔
  • Beam128K: غیر ایجنٹ طویل سیاق و سباق کی میموری پروب 128K پر - متعلقہ اگر آپ RAG کے بغیر سیاق و سباق میں بڑی نقلیں رکھیں۔

Workstation پالیسی: واقفیت کے لیے میٹا کا میٹرکس شائع کریں، پھر اندرونی گولڈن سیٹ پر گیٹ پروڈکشن (آپ کے MCP ٹولز، آپ کے ریپوز، آپ کی تاخیر کا SLO)۔

6. ہارڈ ویئر اور پیش کرنے والی حقیقت

  • سنگل GPU کلاس: ~18GB وزن کے نشان کا مطلب ایک جدید 24GB+ صارف/پرو GPU NVIDIA کی عملی منزل ہے جب KV کیشے اور وژن ایکٹیویشن پر غور کیا جاتا ہے۔ آپ کے زیادہ سے زیادہ سیاق و سباق اور سمورتی سیشن کے ساتھ پروفائل۔
  • Apple Silicon: ترجیح دیتے ہیں :30b-mlx (~21GB) Ollama کے MLX راستے کے لیے DFlash قیاس آرائی پر مبنی ضابطہ کشائی اور مقامی امیج ان پٹ کے ساتھ — Mac Studio/Mac mini Max کنفیگز فرسٹ کلاس SME نوڈس ہیں۔
  • Kimi-K3-کلاس نہیں: یہ ملٹی نوڈ MoE نہیں ہے۔ اگر آپ کو ٹریلین پیرامیٹر اوپن ایجنٹس کی ضرورت ہے تو ہمارے دیکھیں اوپن ویٹ گائیڈ; Glimmer مالک ہے ڈیسک سائیڈ ہمیشہ آن طاق
  • Kubernetes: پیکج Ollama یا ایک OpenAI کے موافق سائڈ کار فی نوڈ؛ ماڈل کو اپنی پرائیویٹ رجسٹری/کیشے میں رکھیں۔ Ollama کو انٹرنیٹ پر بے نقاب نہ کریں۔

7. ہمیشہ رہنے والے ایجنٹوں کے لیے سیکورٹی اور گورننس

مقامی وزن ڈیٹا کے اخراج کو کم کرتا ہے لیکن سمجھوتہ کرنے والے ایجنٹ کے میزبان کے دھماکے کے رداس کو بڑھاتا ہے۔ کم از کم Workstation بیس لائن:

  1. MCP OAuth 2.1 + مختصر مدت کے راز (والٹ لیز) - دیکھیں ایجنٹ سیکورٹی مضمون.
  2. ٹول کی اجازت دینے والی فہرستیں اور نیٹ ورک ایگریس پالیسیاں فی ایجنٹ کی شناخت۔
  3. ناقابل واپسی کارروائیوں پر HITL گیٹس (ادائیگی، مصنوعات کی تعیناتی، بڑے پیمانے پر ای میل)۔
  4. ٹول سے واپس آنے والے مواد پر فوری انجیکشن مانیٹرنگ (سائرن ایجنٹ ڈوجو طرز کا خطرہ ماڈل)۔
  5. آف لائن/ایئر-گیپ موڈ کا تجربہ فرسٹ کلاس رن بک کے طور پر کیا گیا، امید نہیں۔

8. پروڈکشن چیک لسٹ

  1. Ollama ٹیگ پن کریں (30b بمقابلہ 30b-mlx) اور GitOps میں ڈائجسٹ/ہیش ریکارڈ کریں۔
  2. ایک 20-50 ٹاسک گولڈن سویٹ بنائیں جو آپ کے MCP ٹولز اور کوڈنگ ورک فلو کو آئینہ دار بناتا ہے۔ ہر کوشش کی سطح پر pass@1 اور p95 لیٹنسی کو ٹریک کریں۔
  3. تار کا سہارہ (ollama launch … یا اپنی مرضی کے مطابق) ٹول کالز اور دوبارہ کوششوں کی تشکیل شدہ لاگنگ کے ساتھ۔
  4. ہائبرڈ راؤٹر کی وضاحت کریں: نجی RAG/ایجنٹس کے لیے گلیمر لوکل؛ اوور فلو / چوٹی IQ کے لیے کلاؤڈ فیل اوور۔
  5. دستاویز VRAM/یونیفائیڈ میموری ہیڈ روم 32K/64K/128K پر وژن آن کے ساتھ۔
  6. قانونی: آپ کے ڈسٹری بیوشن ماڈل کا Apache 2.0 جائزہ (عام طور پر سیدھا سادا بمقابلہ پابندی والے اوپن ویٹ لائسنس)۔
  7. رات بھر غیر حاضر ایجنٹوں کو فعال کرنے سے پہلے جہاز کا جائزہ لیں بوٹ + ایول گیٹس۔
Workstation فیصلہ۔ Muse Glimmer اپنے سائز کی کلاس میں سب سے واضح "ہمیشہ پر مقامی ایجنٹ" کھلی ریلیز ہے: Apache 2.0، Ollama- مقامی، وژن + ٹولز + ناکامی کی بحالی، اور مسابقتی میٹا رپورٹ شدہ ایجنٹ بینچ۔ اسے ہائبرڈ فن تعمیر کی نجی لین کے طور پر استعمال کریں۔ اسے اپنے سنہری کاموں پر ثابت کریں۔ اسے پروڈکشن سافٹ ویئر کی طرح کنٹرول کریں۔

کی طرف سے شائع Workstation. ماڈل کارڈ: ollama.com/library/muse-glimmer.

Share this article

More in Technology

Jobshout SEO Analyst AI Agent — Analyse Any Website & Fix SEO Issues Automatically

Jobshout SEO Analyst AI Agent — Analyse Any Website & Fix SEO Issues Automatically

Technical brief: SEO Analyst modes, real workstation.co.uk run (score 44), findings with fix prompts, Improve/Publish paths, and Jobshout supervised agents

Read more
WSLVault: Steal the Server. Not the Secrets.

WSLVault: Steal the Server. Not the Secrets.

Technical brief: AES-256-GCM envelope hierarchy, cryptographic tenant isolation, engines, identity/MFA, active/active regions, Kubernetes deploy, and video chapters

Read more
Workstation WSL Proxy — Docker Image Optimisation, Build Cache, Full Deploy Workflow, and Shipping It with AI Assistance

Workstation WSL Proxy — Docker Image Optimisation, Build Cache, Full Deploy Workflow, and Shipping It with AI Assistance

Technical brief: prebuilt OpenResty Dockerfile, Buildx/GHA cache, Ansible extract, delivery pipeline DEPLOY_MODE, and an operator+agent loop for finishing pipeline work

Read more