Workstation Logo
المنتجات
مختبرات الذكاء الاصطناعيوكلاء OpenAIوكلاء ClaudeGrok BotWorkstation CRM (WSL CRM)التسويقجميع المنتجات
حلول الذكاء الاصطناعي
محطات عمل الذكاء الاصطناعيAI SME Packagesذكاء اصطناعي خاصمجموعات GPUذكاء اصطناعي طرفيمختبر الذكاء الاصطناعي للمؤسساتالذكاء الاصطناعي حسب الصناعة
الخدمات
Platform ModernisationDigital EngineeringData Foundations & AIAutonomous Operationsاستشارات الذكاء الاصطناعيأتمتة DevOpsالأمن السيبرانيتطوير البرمجياتبناء الوكلاءإعداد MLOps
من نحن
الشركاءقصص العملاء
المقالات
الوثائق
WSL ProxyRing PromoterWSL VaultJobshoutSysOps 24/7
المدونة
اتصل بناLogin
Workstation

محطات عمل الذكاء الاصطناعي وبرمجيات الوكلاء المتعددة والبنية التحتية لوحدات GPU وحلول الوكلاء الأذكياء للشركات الحديثة.

اتصل بنا

حلول الذكاء الاصطناعي

محطات عمل الذكاء الاصطناعيAI SME Packagesذكاء اصطناعي خاصمجموعات GPUذكاء اصطناعي طرفيمختبر الذكاء الاصطناعي للمؤسساتالذكاء الاصطناعي حسب الصناعة

المنتجات

جميع المنتجاتWSL CRM و ERPالتسويقوكلاء OpenAIWSL ProxyRing PromoterWSL VaultJobshoutSysOps 24/7

الشركة

من نحنلماذا Workstationالشركاءقصص العملاءالأسعاراتصل

الموارد

المقالاتالتوثيقالمدونةبحثخريطة الموقع
مكتب المملكة المتحدة
77-79 Marlowes, Hemel Hempstead HP1 1LFالاتجاهات - اسلك المخرج 20 من الطريق M25 في لندن الخارجيةرقم الشركة: 11641870الاثنين - الجمعة: 9:00 ص - 6:00 م بتوقيت GMT
+44 7515 356 146
مكتب بلجيكا
Workstation SRL, Rue Vanderkindere 34, 1180 Uccle, BrusselsBE 0751.518.683الاثنين - الجمعة: 9:00 ص - 6:00 م بتوقيت CET
+32 492 45 67 46
مكتب الهند
#159 Sector 9, Pocket 1, DDA Flats, 110077 Dwarka, New Delhi
+91 98881 98841

© 2026 Workstation AI. جميع الحقوق محفوظة.

الخصوصيةملفات تعريف الارتباطشروط الخدمةخريطة الموقع الإلكتروني
Home / Articles / Technology
الذكاء الاصطناعيMLOpsOpen Source

Muse Glimmer على Ollama: الوكلاء المحليون المتواجدون دائمًا على GPU واحد

الغوص العميق في Workstation: البنية وعلامات Ollama/MLX ومصفوفة قياس الميتا مقابل Gemma4-31B وQwen3.6-27B ومنهجية التقييم وقائمة مراجعة الإنتاج

August 12, 2026Technology8 min read

Muse Glimmer هو نموذج لغة سببية مكون من 30 مليار معلمة من Meta مع برنامج تشفير إدراكي مخصص، مستخرج من Muse Spark وتم نشره لأحمال عمل الوكيل المستقل على أجهزة المستهلك ومحطات العمل. تم التوزيع عبر Ollama تحت Apache 2.0، فهو يستهدف الاستخدام الموثوق للأدوات، والمهام بعيدة المدى، والفهم متعدد الوسائط، والتعافي من الفشل - دون الحاجة إلى الاستدلال السحابي. يعيد هذا الموجز الفني لـ Workstation كتابة وتوسيع بطاقة النموذج العام للمهندسين الذين يقومون بشحن الوكلاء المحليين.

Muse Glimmer على Ollama — الدليل الفني لـ Workstation

ملاحة. مدونة رفيقة: ملخص الأعمال. متعلق ب: اعتماد الوزن المفتوح, زبر0X + زبر1X, Apple Silicon/OpenClaw, MCP OAuth & Vault, LLMs على Kubernetes.
ملخص الوكيل.
  • فصل: 30B السببية LM + التشفير الإدراكي ؛ مقطر من Muse Spark؛ الرؤية + الأدوات + التفكير.
  • يخدم: ollama run muse-glimmer (~18GB، 128 كيلو بايت، نص+صورة)؛ Apple Silicon: muse-glimmer:30b-mlx (~21GB، DFlash).
  • ملائم: عوامل محلية / معزولة بالهواء تعمل دائمًا على جهاز GPU أو Mac Silicon - وليس نموذج مجموعة MoE متعدد السل.
  • إشارة القوة: يقود مصفوفة فئة الحجم المُبلغ عنها من Meta على MCP-Atlas وDeepSearch QA وWildClawBench وSWE-Bench Pro وAA-LCR وBeam128K (الاستدلال العالي).
  • العمليات: سقالة عبر ollama launch (Claude Code، OpenCode، هيرميس، OpenClaw)؛ تحكم بالتقييمات، HITL، مصادقة MCP.

المصادر الأولية: مكتبة Ollama — بصيص الإلهام; منهجية التقييم التلوي — منهجية Muse Glimmer. تتغير الأرقام والعلامات؛ تحقق من بطاقة النموذج المباشر قبل الشراء.

1. العمارة والتصميم القصد

لم يتم وضع Muse Glimmer كدردشة عامة لوزارة التعليم. تأطير ميتا هو إكمال المهمة الوكيلة من البداية إلى النهاية على الأجهزة التي يمكنك شراؤها لمكتب أو رف مختبر صغير:

  • العمود الفقري السببي LM (30B) - الجيل التالي من الرموز المميزة مع سلاسل تفكير متعددة الخطوات مستدامة عبر سير العمل الطويل.
  • التشفير الإدراكي المخصص - يقبل النصوص والصور المشذرة حتى يتمكن الوكلاء من التفكير في لقطات الشاشة والمخططات والمستندات في نفس نافذة السياق مثل نصوص الأداة.
  • التقطير من Muse Spark - نقل القدرة إلى بصمة تستهدف النشر الفردي لـ GPU / فئة المستهلك بدلاً من خدمة مركز البيانات فقط.
  • سلوك التعافي من الفشل - عند فشل استدعاء الأداة أو إرجاع حمولة غير متوقعة، يتم تدريب/ضبط النموذج لتشخيص المشكلة وإعادة المحاولة بدلاً من إيقافها.
  • جهد يمكن السيطرة عليه — يمكن تحديد قوة الاستدلال حتى يتمكن المشغلون من استبدال زمن الاستجابة بالجودة لكل مسار.
  • تغطية تدريبية متعددة اللغات - بيانات التدريب على الحالات الفوقية من أكثر من 100 لغة.

بالنسبة لمكدسات Workstation، فإن المعنى الضمني للمنتج هو: التعامل مع Glimmer باعتباره وكيل وقت التشغيل الدماغ خلف أدوات MCP والأصداف والمتصفحات ومحررات الملفات - وليس كبديل مباشر لكل مكالمة API ذات حدود مغلقة.

مكدس الوكيل المحلي: السقالة، Ollama، Muse Glimmer، الأدوات، مستوى التحكم

2. توزيع Ollama (العلامات، البصمة، الإدخال/الإخراج)

كما هو منشور على بطاقة مكتبة Ollama (تحقق من الأحجام المباشرة):

علامة تقريبا. مقاس سياق مدخل ملحوظات
muse-glimmer:latest / :30b~18GB128 ألفنص، صورةالمسار الافتراضي الفردي GPU
muse-glimmer:30b-mlx~21GB128 ألفنص، صورةمحرك Ollama MLX؛ DFlash + الصورة على Apple Silicon
# Pull + interactive
ollama run muse-glimmer

# Apple Silicon (MLX)
ollama run muse-glimmer:30b-mlx

# HTTP chat (localhost Ollama)
curl http://localhost:11434/api/chat \
  -d '{"model":"muse-glimmer","messages":[{"role":"user","content":"Hello!"}]}'

# Scaffold launchers (from Ollama applications list)
ollama launch claude --model muse-glimmer
ollama launch opencode --model muse-glimmer
ollama launch hermes --model muse-glimmer
ollama launch openclaw --model muse-glimmer

يجب على عملاء Python/JS تثبيت العلامة التي قمت بالتحقق من صحتها (muse-glimmer مقابل :30b-mlx) في التكوين، وليس التعليمات البرمجية الثابتة latest في وكلاء الإنتاج.

3. سطح القدرة (القراءة الهندسية)

  • استكمال وكيل نهاية إلى نهاية — تستشهد Meta بنتائج قوية في DeepSearch QA وMCP-Atlas وτ3-Bench (الخدمات المصرفية) ومهام عائلة SWE-Bench التي تقيس النجاح المدعوم متعدد المنعطفات، وليس التوافه الفردية.
  • استخدام أداة موثوقة — تغطية واسعة لاستدعاء الوظائف مع دقة المخطط عبر مسارات العمل الممتدة (أمر بالغ الأهمية لأساطيل أدوات MCP).
  • التفكير متعدد الخطوات — تماسك الخطة على مدى آفاق طويلة؛ أزواج مع نافذة سياق 128 كيلو بايت للاحتفاظ بالنص + المستند.
  • استعادة الفشل — تشخيص نتائج الأداة غير المتوقعة وإعادة المحاولة؛ يقلل من إجهاض "العامل الهش" في الوظائف الليلية.
  • المنطق المتعدد الوسائط - يتيح برنامج تشفير الإدراك لقطة الشاشة/المخطط/المستند المتداخل مع النص (تأريض واجهة المستخدم الرسومية ومقاعد تحليل المستندات المضمنة في مصفوفة Meta).
  • التوافق سقالة — OpenClaw، وHermes Agent، وأنماط التنسيق المشابهة؛ يسرد Ollama مشغلات Claude Code وOpenCode كتطبيقات من الدرجة الأولى.

4. مصفوفة المعيار (الاستدلال الفوقي المُبلغ عنه)

يقارن Meta Muse Glimmer-30B (الاستدلال العالي) مع Gemma4-31B وQwen3.6-27B في وضع التفكير. قراءة عنوان Workstation: يقود Glimmer عدة وكيل الأجنحة العامة (MCP-Atlas وDeepSearch QA وWildClawBench وGaia2 وSWE-Bench Pro) أثناء تتبع أو ربط الأقران في بعض مقاييس وكيل سطح المكتب وقيمة إجمالي الناتج المحلي. قم بإعادة التشغيل دائمًا لك تسخير.

فئة المعيار بصيص-30B جيما4-31ب Qwen3.6-27B
وكيل عامMCP-Atlas (عام)75.554.262.5
ضمان الجودة في البحث العميق74.661.771.1
τ3-الخدمات المصرفية23.515.116.7
WildClawBench47.637.643.2
الناتج المحلي الإجماليVal-AA v29538111141
جايا243.336.440.0
SkillsBench (ث / المهارات)44.332.446.6
تم التحقق منه بواسطة OSWorld65.958.575.6
ترميز الوكيلSWE-Bench برو51.236.950.2
تم التحقق من SWE-Bench76.066.677.2
المحطة الطرفية 2.151.743.460.7
SciCode43.643.439.8
متعدد الوسائطمنطق CharXiv78.877.778.4
سكرين سبوت برو75.475.976.1
أومنيدوكبينش v1.575.872.577.8
MMMU برو747375
الاستدلال / LCRIFBench77.076.070.8
إيم 202694.789.294.1
GPQA الماس (AA)83.585.784.2
نص HLE (AA)22.023.623.1
أأ-لكر80.068.373.3
شعاع128K65.158.263.0

تظهر مقاعد الأمان (CI Memories، Siren AgentDojo) مقايضات: أفاد Glimmer عن فائدة عالية في ظل حقن AgentDojo مع ASR متوسط ​​الحجم؛ تعامل مع السلامة باعتبارها مشكلة تحكم في النشر (جدران الحماية السريعة، وقوائم الأدوات المسموح بها، وHITL) - وليست خاصية نموذجية تم حلها. راجع ملف PDF الخاص بمنهجية Meta للتعرف على نماذج التحكيم وعدد المحاولات ومحاذير الاستخدام.

5. منهجية التقييم (ماذا تعني الأرقام)

تعتبر مذكرة منهجية Meta ضرورية قبل أن تقتبس أي خلية في مجموعة اللوحة:

  • اختيار الأقران: نماذج مفتوحة من فئة الحجم (Gemma4-31B، Qwen3.6-27B)؛ يجوز للأقران استخدام النتائج التي تم الإبلاغ عنها ذاتيًا أو التي تم إعادة إنتاجها داخليًا؛ يتم استخدام التحليل الاصطناعي عندما يكون متاحًا لجميع الثلاثة.
  • أخذ العينات: تم الإبلاغ عن Glimmer بقوة تفكير عالية مع درجة حرارة = 1.0 / top_p = 0.95 / top_k = 64؛ يستخدم الأقران تكوينات التفكير الموصى بها من قبل البائع (يستخدم Qwen درجات حرارة أكثر برودة في بعض مقاعد الوكلاء).
  • تحذير من تحيز الحزام: قد لا يتم ضبط نماذج الطرف الثالث للملاحظات التعريفية على مطالبات أداة/نظام Meta - يمكن أن تتغير الرتب المطلقة ضمن السقالات الأصلية النظيرة.
  • MCP-Atlas: استخدام أداة متعددة الأدوار عبر أكثر من 20 خادم MCP؛ معدل نجاح القاضي LLM (الحد الأدنى 0.75) في 500 مهمة عامة، بمتوسط ​​أكثر من 4 أشواط.
  • ضمان الجودة في البحث العميق: حلقة تصفح مستقلة (بحث/فتح/العثور) على 900 سؤال بحثي صعب؛ F1 عن طريق استخراج القاضي.
  • وايلد كلاو بينش / جايا 2: مهام عامل Dockerised طويلة الأفق ضمن أحزمة نمط OpenClaw مع حقن الحدث والتصنيف الحتمي المختلط/LLM.
  • SWE-Bench: سقالة أدوات باش + الملف ؛ تم حساب متوسط ​​Pro وVerified عبر عمليات تشغيل متعددة - تتجنب مقارنات Pro متغير المهام المحسّنة في Qwen.
  • تم التحقق من OSWorld: تحكم Ubuntu VM بواجهة المستخدم الرسومية فقط من لقطات الشاشة (بدون غلاف مباشر)؛ الاختلافات في مساحة العمل بين النماذج مهمة.
  • شعاع 128 ك: مسبار الذاكرة طويلة السياق غير الوكيل بسرعة 128 كيلو بايت - مناسب إذا احتفظت بنصوص كبيرة في السياق بدون RAG.

سياسة Workstation: قم بنشر مصفوفة Meta للتوجيه، ثم بوابة الإنتاج على مجموعة ذهبية داخلية (أدوات MCP الخاصة بك، ومستودعات التخزين الخاصة بك، وSLO زمن الوصول الخاص بك).

6. الأجهزة وخدمة الواقع

  • فئة GPU واحدة: ~18GB بصمة الوزن تشير إلى 24GB+ مستهلك/محترف حديث GPU هو أرضية NVIDIA العملية بمجرد أخذ ذاكرة التخزين المؤقت KV وتنشيط الرؤية في الاعتبار؛ الملف الشخصي مع السياق الأقصى والجلسات المتزامنة.
  • Apple Silicon: يفضل :30b-mlx (~21GB) لمسار MLX الخاص بـ Ollama مع فك التشفير التخميني لـ DFlash وإدخال الصورة الأصلية - تعد تكوينات Mac Studio / Mac mini Max عقدًا للشركات الصغيرة والمتوسطة من الدرجة الأولى.
  • ليست فئة Kimi-K3: هذه ليست وزارة التعليم متعددة العقد. إذا كنت بحاجة إلى عوامل مفتوحة ذات تريليون معلمة، فراجع موقعنا دليل الأوزان المفتوحة; يمتلك جليمر جانب المكتب يعمل دائمًا المكانة.
  • كوبيرنيتيس: الحزمة Ollama أو عربة جانبية متوافقة مع OpenAI لكل عقدة؛ احتفظ بسحب النموذج في السجل/ذاكرة التخزين المؤقت الخاصة بك؛ لا تعرض Ollama غير المنضم إلى الإنترنت.

7. الأمن والحوكمة للوكلاء المتواجدين دائمًا

تعمل الأوزان المحلية على تقليل خروج البيانات ولكنها تزيد من نصف قطر الانفجار لمضيف الوكيل المخترق. الحد الأدنى لخط الأساس Workstation:

  1. MCP OAuth 2.1 + أسرار قصيرة العمر (إيجارات Vault) - راجع مقالة أمنية وكيلة.
  2. قوائم الأدوات المسموح بها وسياسات الخروج من الشبكة حسب هوية الوكيل.
  3. بوابات HITL على الإجراءات التي لا رجعة فيها (المدفوعات، ونشر المنتجات، والبريد الإلكتروني الجماعي).
  4. مراقبة الحقن الفوري للمحتوى الذي يتم إرجاعه بواسطة الأداة (نموذج التهديد بنمط Siren AgentDojo).
  5. تم اختبار وضع عدم الاتصال بالإنترنت / فجوة الهواء باعتباره دليل تدريب من الدرجة الأولى، وليس أملًا.

8. قائمة مراجعة الإنتاج

  1. دبوس علامة Ollama (30b مقابل 30b-mlx) وتسجيل الملخص/التجزئة في GitOps.
  2. أنشئ مجموعة ذهبية مكونة من 20 إلى 50 مهمة تعكس أدوات MCP وسير عمل الترميز؛ تتبع زمن الوصول pass@1 وp95 في كل مستوى من مستويات الجهد.
  3. سقالة الأسلاك (ollama launch … أو مخصص) مع التسجيل المنظم لاستدعاءات الأداة وإعادة المحاولة.
  4. تعريف جهاز التوجيه المختلط: Glimmer local لـ RAG/الوكلاء الخاصين؛ تجاوز الفشل السحابي لتجاوز معدل الذكاء/الذروة.
  5. قم بتوثيق VRAM/مساحة الرأس للذاكرة الموحدة عند 32K / 64K / 128K مع تشغيل الرؤية.
  6. قانوني: مراجعة Apache 2.0 لنموذج التوزيع الخاص بك (عادةً ما تكون تراخيص واضحة ومقيدة للوزن المفتوح).
  7. روبوت مراجعة السفينة + بوابات التقييم قبل تمكين الوكلاء الليليين غير المراقبين.
الحكم Workstation. Muse Glimmer هو أوضح إصدار مفتوح "للوكيل المحلي الدائم في صندوق واحد" في فئة الحجم: Apache 2.0، وOllama-native، والرؤية + الأدوات + استرداد الفشل، ومقاعد الوكلاء التنافسية المُبلغ عنها من قبل Meta. استخدمه كممر خاص للهندسة المعمارية الهجينة؛ أثبت ذلك في مهامك الذهبية؛ تحكمها مثل برامج الإنتاج.

نشرت من قبل Workstation. البطاقة النموذجية: ollama.com/library/muse-glimmer.

Share this article

More in Technology

Jobshout SEO Analyst AI Agent — Analyse Any Website & Fix SEO Issues Automatically

Jobshout SEO Analyst AI Agent — Analyse Any Website & Fix SEO Issues Automatically

Technical brief: SEO Analyst modes, real workstation.co.uk run (score 44), findings with fix prompts, Improve/Publish paths, and Jobshout supervised agents

Read more
WSLVault: Steal the Server. Not the Secrets.

WSLVault: Steal the Server. Not the Secrets.

Technical brief: AES-256-GCM envelope hierarchy, cryptographic tenant isolation, engines, identity/MFA, active/active regions, Kubernetes deploy, and video chapters

Read more
Workstation WSL Proxy — Docker Image Optimisation, Build Cache, Full Deploy Workflow, and Shipping It with AI Assistance

Workstation WSL Proxy — Docker Image Optimisation, Build Cache, Full Deploy Workflow, and Shipping It with AI Assistance

Technical brief: prebuilt OpenResty Dockerfile, Buildx/GHA cache, Ansible extract, delivery pipeline DEPLOY_MODE, and an operator+agent loop for finishing pipeline work

Read more