Key Takeaways
- ✅ جديد (25 أغسطس 2026): Mac mini M5 Pro بدءًا من 1,699 دولارًا (حتى 64 جيجابايت، 307 جيجابايت/ثانية) — أرخص جهاز Mac بشريحة M5 Pro على الإطلاق.
- ✅ مؤكَّد، يصل 22 سبتمبر 2026: Mac Studio M5 Max بدءًا من 2,499 دولارًا (حتى 128 جيجابايت، 614 جيجابايت/ثانية) وMac Studio M5 Ultra بدءًا من 5,499 دولارًا (حتى 512 جيجابايت — تصل تهيئة 512 جيجابايت أواخر أكتوبر 2026، بسعر أعلى بكثير من 10,000 دولار).
- لم يعد Mac Studio يقدّم فئة M5 Pro — أصبح يبدأ الآن بشريحة M5 Max. Mac mini هو المدخل الجديد إلى شريحة M5 Pro.
- يشترك MacBook Pro 16" M5 Max (المتاح منذ مارس 2026) بنفس عرض نطاق الذاكرة مع Mac Studio M5 Max: 460 جيجابايت/ثانية (GPU 32 نواة) و614 جيجابايت/ثانية (GPU 40 نواة) في كلا الشكلين.
- كل تهيئات M5 Pro/Max: عرض نطاق ذاكرة 307–614 GB/s. ويصل M5 Ultra حتى 1.2 تيرابايت/ثانية.
- تشغيل صامت: تنشط مراوح MacBook Pro أثناء الاستدلال؛ بينما نادرًا ما تدور مراوح Mac Studio وMac mini.
- MLX هو الأسرع على M5. ويستخدم Ollama خلفية MLX تلقائيًا على Apple Silicon.
- ذاكرة موحدة: من 24 جيجابايت (Mac mini M5 Pro الأساسي) حتى 512 جيجابايت (Mac Studio M5 Ultra) متاحة لأي نموذج.
أضاف تحديث Apple في 25 أغسطس 2026 شريحة M5 Pro إلى Mac mini (1,699 دولارًا) لأول مرة، وأكّد Mac Studio M5 Max (2,499 دولارًا، حتى 128 جيجابايت) وMac Studio M5 Ultra جديد (5,499 دولارًا، حتى 512 جيجابايت) — تصل جميعها في 22 سبتمبر 2026.
تستخدم أجهزة Mac بشريحة Apple Silicon ذاكرة موحدة — تشترك وحدة المعالجة المركزية وبطاقة الرسومات ومحرك الذكاء الاصطناعي في نفس مجموعة الذاكرة السريعة. M5 Max بسعة 128 جيجابايت يمكنه تحميل نموذج 70B كاملاً، وتذهب تهيئة 512 جيجابايت الجديدة من M5 Ultra إلى أبعد من ذلك.
🔄 تحديث 26 أغسطس 2026: أضاف تحديث Apple لعتاد 25 أغسطس 2026 شريحة M5 Pro إلى Mac mini لأول مرة (بدءًا من 1,699 دولارًا، حتى 64 جيجابايت) وأكّد Mac Studio M5 Max (بدءًا من 2,499 دولارًا، حتى 128 جيجابايت) إلى جانب Mac Studio M5 Ultra جديد (بدءًا من 5,499 دولارًا، حتى 512 جيجابايت — تصل تهيئة 512 جيجابايت أواخر أكتوبر 2026). لم يعد Mac Studio يتضمن فئة M5 Pro. لا توجد بعد اختبارات مرجعية مستقلة من طرف ثالث لأجهزة Mac mini وMac Studio الجديدة؛ تستند أرقام token/ثانية في هذا المقال إلى اختبارات MacBook Pro 16" M5 Max (المتاح منذ مارس 2026) ما لم يُذكر خلاف ذلك.
لماذا يهم Apple Silicon M5 لـ LLM المحلي
يمثّل Apple Silicon بنية مختلفة جذريًا لأحمال الذكاء الاصطناعي. إليك الأسباب التي تجعله مهمًا لمستخدمي LLM المحلي.
- بنية الذاكرة الموحدة: يتشارك M5 Pro وM5 Max مجموعة واحدة من الذاكرة السريعة (24 GB حتى 128 GB) يصل إليها في آن واحد CPU وGPU وNeural Engine. دون اختناق بين VRAM وRAM. تبقى النماذج في الذاكرة السريعة ويبقى الاستدلال سريعًا.
- عرض نطاق الذاكرة هو الاختناق الحقيقي: استدلال LLM الحديث محدود بالذاكرة، لا بالحوسبة. ينافس M5 Max عند 460–614 GB/s مباشرةً RTX 4090 (1008 GB/s عرض نطاق VRAM) رغم فارق السعة (24 GB مقابل 128 GB). الذاكرة الموحدة تستثمر كل بايت.
- Apple Fusion Architecture (جديدة في M5): يفصل M5 Pro وM5 Max بين CPU وGPU في رقاقتي 3 نانومتر متميزتين داخل حزمة واحدة، مما يتيح توسعًا مستقلًا وتحسينًا حراريًا. يحسّن هذا التصميم المعياري كفاءة الطاقة ويقلّل الحرارة الزائدة مقارنةً بالتصاميم الأحادية.
- Neural Accelerator في كل نواة GPU: تتضمن كل نواة GPU مسرّعات عصبية مخصصة لأحمال الذكاء الاصطناعي، مكمّلةً Neural Engine المشترك. تسرّع هذه البنية الموزَّعة عمليات تعلّم الآلة في كامل GPU، لا في الأنوية المتخصصة فقط، محسّنةً آليات transformer والانتباه في استدلال LLM.
- تحسّن الأداء مقابل M4: تؤكد Apple تحسنًا متعدد الخيوط يصل إلى 30% على M4 Pro وM4 Max. وتُظهر اختبارات استدلال LLM الحقيقية تحسنات بمقدار 2–3× بفضل المكاسب في عرض نطاق الذاكرة والتحسينات المعمارية.
- اتصال Thunderbolt 5 (M5 Pro/Max): يدمج M5 Pro وM5 Max منفذ Thunderbolt 5 بعرض نطاق أساسي 80 Gbps (ضعف Thunderbolt 4). يتيح تخزينًا خارجيًا عالي السرعة، ودعم شاشات متعددة، وتوسيع eGPU (عند دعم البرمجيات).
- Wi-Fi 7 وBluetooth 6 عبر شريحة Apple N1: تتضمن أنظمة M5 شريحة N1 اللاسلكية الجديدة بدعم Wi-Fi 7 (حتى 5.8 Gbps) وBluetooth 6.0 لاتصال منخفض زمن الاستجابة. يحسّن الاستجابة عند استخدام عملاء استدلال بعيد أو واجهات نماذج سحابية.
- إطار MLX ينضج بسرعة: يدعم إطار Apple المسمّى Metal Learning eXtended (MLX) بالفعل Llama 3.3 وQwen وMistral وGemma بأنوية محسَّنة. ويكتشف Ollama (مايو 2026) ويستخدم MLX على Apple Silicon تلقائيًا دون تهيئة يدوية.
- كفاءة الطاقة حقيقية: يُقدَّر M5 Max عند 65–100 واط تحت حمل استدلال كامل. شهر من الاستدلال المستمر (720 ساعة) يكلف 8–12 دولارًا كهرباء في الولايات المتحدة. أما RTX 4090 عند 350 واط فستكلف 40–60 دولارًا في الشهر نفسه.
- تشغيل صامت: مراوح Mac Studio M5 عند 30 ديسيبل في الخمول ونادرًا ما تتجاوز 40 ديسيبل تحت استدلال LLM مكثّف. ويبقى MacBook Pro باردًا بما يكفي للاستخدام على الحجر.
- قيمة إعادة بيع أفضل: تحتفظ أجهزة Mac المستعملة M1/M2/M3 بـ 50–60% من سعرها الأصلي بعد 2–3 سنوات. أما RTX 4090 المستعملة فتهبط إلى 40–50% بسبب تاريخ التعدين وتقادم إصدارات CUDA.
جدول مقارنة Apple Silicon M5
كل التهيئات أدناه أسعار فعلية أكّدتها Apple اعتبارًا من إعلان 25 أغسطس 2026 — لا شيء منها تقديري. تصل أجهزة Mac mini وMac Studio وMacBook Pro في 22 سبتمبر 2026، باستثناء تهيئة Mac Studio M5 Ultra بسعة 512 جيجابايت (أواخر أكتوبر 2026، بسعر أعلى بكثير من 10,000 دولار). لا توجد بعد اختبارات مرجعية مستقلة من طرف ثالث لأجهزة Mac mini وMac Studio الجديدة.
التهيئة | الشريحة | أنوية GPU | الذاكرة | عرض النطاق | السعر | مثالي لـ |
|---|---|---|---|---|---|---|
| Mac mini M5 Pro 24 GB | M5 Pro | 16 | 24 GB موحدة | 307 GB/s | 1,699 دولار | أرخص M5 Pro، 7B–13B |
| Mac mini M5 Pro 64 GB | M5 Pro | 20 | 64 GB موحدة | 307 GB/s | 2,699 دولار | نماذج 30B، أرخص 64 GB |
| Mac Studio M5 Max 36 GB | M5 Max | 32 | 36 GB موحدة | 460 GB/s | 2,499 دولار | مدخل سطح مكتب اقتصادي |
| Mac Studio M5 Max 128 GB | M5 Max | 40 | 128 GB موحدة | 614 GB/s | 5,099 دولار | 70B Q5، المستخدمون المتقدمون |
| Mac Studio M5 Ultra 96 GB | M5 Ultra | 64 | 96 GB موحدة | حتى 1.2 TB/s | 5,499 دولار | أكبر النماذج المحلية |
| Mac Studio M5 Ultra 512 GB | M5 Ultra | 80 | 512 GB موحدة | حتى 1.2 TB/s | 10,000+ دولار (تقديري) | نماذج ضخمة، أواخر أكتوبر |
| MacBook Pro 16" M5 Max 64 GB | M5 Max | 32 | 64 GB موحدة | 460 GB/s | 3,499 دولار | محمول، 70B Q4 |
| MacBook Pro 16" M5 Max 128 GB | M5 Max | 40 | 128 GB موحدة | 614 GB/s | 4,499 دولار | محمول، 70B Q5 |

Mac mini M5 Pro: نقطة دخول اقتصادية جديدة لـ LLM المحلي
في 25 أغسطس 2026، أضافت Apple شريحة M5 Pro إلى Mac mini لأول مرة — كانت متاحة سابقًا في MacBook Pro فقط. بسعر 1,699–2,699 دولار وذاكرة موحدة 24–64 GB، أصبح Mac mini M5 Pro أرخص طريقة لبلوغ حد 64 GB لشريحة M5 Pro، متفوقًا على MacBook Pro M5 Pro وعلى فكرة Mac Studio M5 Pro التي لم تعد قائمة (أصبح Mac Studio يبدأ بشريحة M5 Max). يصل في 22 سبتمبر 2026.
- CPU: 15 أو 18 نواة M5 Pro
- GPU: GPU M5 Pro بـ 16 أو 20 نواة
- الذاكرة: 24 GB أساسي، قابلة للتهيئة إلى 48 GB أو 64 GB DDR5 موحدة
- عرض نطاق الذاكرة: 307 GB/s (مطابق لـ M5 Pro في MacBook Pro)
- التخزين: SSD من 512 GB–2 TB (قابل للتهيئة)
- المنافذ: Thunderbolt 5 (جديد على Mac mini)
- الاتصال: Wi-Fi 7، Bluetooth 6
- السعر: 1,699 دولار (GPU 16 نواة، 24 GB)؛ 1,899 دولار (GPU 20 نواة، 24 GB)؛ +1,000 دولار للوصول إلى 64 GB
- الوصول: 22 سبتمبر 2026
Mac Studio M5 Max 36 GB: التهيئة الأساسية
مؤكَّد في 25 أغسطس 2026: تبدأ تهيئة Mac Studio M5 Max الأساسية من 2,499 دولارًا مع GPU بـ 32 نواة وذاكرة موحدة ثابتة 36 GB (دون خيار ترقية ذاكرة عند هذه الفئة؛ لمزيد من RAM يلزم الانتقال إلى فئة 40 نواة أدناه). يصل في 22 سبتمبر 2026. لم يعد Mac Studio يقدّم فئة M5 Pro إطلاقًا — هذا الآن أرخص Mac Studio.
- CPU: 18 نواة M5 Max
- GPU: GPU M5 Max بـ 32 نواة
- الذاكرة: 36 GB موحدة (ثابتة عند هذه الفئة)
- عرض نطاق الذاكرة: 460 GB/s (مطابق لـ M5 Max بـ 32 نواة في MacBook Pro)
- التخزين: SSD من 512 GB–8 TB (قابل للتهيئة)
- المنافذ: Thunderbolt 5
- السعر: 2,499 دولار
- الوصول: 22 سبتمبر 2026
Mac Studio M5 Max 48–128 GB: أفضل قيمة لـ LLM المحلي
مؤكَّد في 25 أغسطس 2026: يبدأ Mac Studio M5 Max بـ GPU 40 نواة من 3,099 دولارًا (48 GB) ويصل إلى 5,099 دولارًا عند تهيئة 128 GB. هذه هي الفئة التي تقدّم فعليًا أفضل قيمة لـ 70B؛ تتوفر تهيئة 64 GB بسعر 3,499 دولارًا ضمن هذه الفئة. يصل في 22 سبتمبر 2026.
- CPU: 18 نواة M5 Max
- GPU: GPU M5 Max بـ 40 نواة
- الذاكرة: 48 GB أساسي، قابلة للتهيئة إلى 64 GB أو 128 GB DDR5 موحدة
- عرض نطاق الذاكرة: 614 GB/s (مطابق لـ M5 Max بـ 40 نواة في MacBook Pro)
- التخزين: SSD من 512 GB–8 TB
- المنافذ: Thunderbolt 5
- السعر: 3,099 دولار (48 GB)؛ 3,499 دولار (64 GB)؛ 5,099 دولار (128 GB)
- الوصول: 22 سبتمبر 2026
Mac Studio M5 Ultra: فئة جديدة لأقصى أداء
جديد منذ 25 أغسطس 2026: Mac Studio M5 Ultra فئة جديدة فوق M5 Max، تبدأ من 5,499 دولارًا بذاكرة 96 GB وتتوسع حتى 512 GB. تصل تهيئة 512 GB أواخر أكتوبر 2026، ويُتوقع سعرها أعلى بكثير من 10,000 دولار. هذا أول Mac بشريحة M5 Ultra وأول Mac بذاكرة موحدة 512 GB.
- CPU: حتى 36 نواة M5 Ultra
- GPU: حتى 80 نواة M5 Ultra
- الذاكرة: 96 GB أساسي، قابلة للتهيئة إلى 256 GB الآن، و512 GB أواخر أكتوبر 2026
- عرض نطاق الذاكرة: حتى 1.2 تيرابايت/ثانية
- التخزين: SSD من 1 TB–16 TB
- المنافذ: Thunderbolt 5
- السعر: 5,499 دولار (96 GB)؛ يُتوقع سعر 512 GB أعلى بكثير من 10,000 دولار
- الوصول: 22 سبتمبر 2026 (96–256 GB)؛ أواخر أكتوبر 2026 (512 GB)
MacBook Pro 16" M5 Max: LLM محلي بصيغة محمولة
يقدّم MacBook Pro 16" M5 Max (3,499–4,499 دولار) الحوسبة نفسها لـ Mac Studio M5 Max في عامل شكل محمول. عرض نطاق الذاكرة متطابق بين الشكلين — 460 GB/s عند فئة GPU بـ 32 نواة و614 GB/s عند فئة 40 نواة، في كلا الهيكلين. خطر الخنق الحراري تحت الاستدلال المستدام هو التضحية مقابل المحمولية، لا عرض النطاق.
- CPU: 18 نواة M5 Max (6 فائقة + 12 نواة أداء)
- GPU: GPU M5 Max بـ 32 أو 40 نواة
- الذاكرة: 64 GB أو 128 GB من الذاكرة الموحدة
- الشاشة: 16.2 بوصة Liquid Retina XDR، 3456×2234
- عرض نطاق الذاكرة: 460 GB/s (64 GB) أو 614 GB/s (128 GB)
- التخزين: SSD من 512 GB–8 TB
- البطارية: 72.4 Wh ليثيوم-بوليمر (حتى 20 ساعة تشغيل فيديو؛ أقل تحت الاستدلال)
- الوزن: 2.14 كجم
- المنافذ: 3× Thunderbolt 4، HDMI 2.1، فتحة SD، مقبس سماعات
- السعر: 3,499 دولار (64 GB، GPU بـ 32 نواة) إلى 4,499 دولار (128 GB، GPU بـ 40 نواة). قد تتفاوت الأسعار حسب بلدك.
🏆 توصياتنا: أي جهاز Mac تشتري لـ LLM المحلي
بسّط الاختيار بهذه التوصيات الواضحة حسب حالة الاستخدام.
- 🏆 💰 أرخص M5 Pro: Mac mini M5 Pro (1,699 دولار، يصل 22 سبتمبر 2026) • لماذا: أول Mac mini بشريحة M5 Pro. يتفوق على أي طريقة سابقة للحصول على M5 Pro. 24 GB الأساسية تتعامل مع 7B–13B؛ هيّئ إلى 64 GB لـ 30B. • لمن: المشترون بميزانية محدودة المبتدئون في Apple Silicon. • احجز في Apple Store ←
- 🥇 أفضل قيمة لـ 70B: Mac Studio M5 Max 64 GB (3,499 دولار، يصل 22 سبتمبر 2026) • لماذا: يشغّل Llama 3.3 70B Q4 بأريحية. نفس السيليكون بعرض 614 GB/s كـ MacBook Pro، دون خنق حراري بفضل تبريد سطح المكتب. • لمن: المطورون الذين يعتمدون سير عمل 70B دون حاجة للمحمولية. • احجز في Apple Store ←
- 🔥 أقصى أداء: Mac Studio M5 Ultra 96 GB (5,499 دولار، يصل 22 سبتمبر 2026) • لماذا: فئة عليا جديدة. حتى 1.2 تيرابايت/ثانية — ضعف تقريبًا M5 Max. تصل تهيئة 512 GB أواخر أكتوبر 2026. • الحالة: شريحة جديدة تمامًا — لا توجد بعد اختبارات مرجعية مستقلة. • احجز في Apple Store ←
- **💼 أفضل خيار محمول: MacBook Pro 16" M5 Max 64 GB (3,499 دولار) [متاح الآن]** • لماذا: GPU وعرض نطاق مطابقان لـ Mac Studio M5 Max 64 GB. محمول بشاشة Liquid Retina XDR. يقبل خسارة أداء 10–15% بسبب الخنق الحراري — عرض النطاق نفسه ليس أقل. • البديل: Mac Studio M5 Max 64 GB (3,499 دولار، 22 سبتمبر 2026) بنفس السعر وتبريد أفضل للعمل المستدام إن لم تحتج المحمولية. • اشترِ من Apple Store ←
اختبارات أداء LLM المحلي المرجعية (MacBook Pro M5 Pro/M5 Max، متحقَّق منها)
تعكس الأرقام أدناه اختبارات على MacBook Pro 16" M5 Pro وM5 Max (متاح منذ مارس 2026) مع أرقام أداء معلنة من المصنّع. يصل Mac mini M5 Pro وMac Studio M5 Max وMac Studio M5 Ultra جميعًا في 22 سبتمبر 2026 (M5 Ultra بذاكرة 512 GB أواخر أكتوبر 2026) ولا توجد لها بعد اختبارات مرجعية مستقلة من طرف ثالث. ولأن شرائح M5 Pro وM5 Max هي نفس السيليكون عبر الهياكل المختلفة، تُعد الأرقام أدناه مؤشرًا معقولًا، لكنها ليست قياسات فعلية على تلك الأجهزة تحديدًا؛ أما أرقام M5 Ultra فغير متحقَّق منها إطلاقًا لأن هذه الشريحة لم تُطرح من قبل. كل الاختبارات: حجم دفعة 1، سياق 2048 token، أحدث تكميمات النماذج.
- ## Llama 3.1 8B (Q4_K_M) • M5 Pro 32 GB: 25–30 token/ثانية • M5 Pro 64 GB: 35–45 token/ثانية • M5 Max 64 GB: 50–65 token/ثانية • M5 Max 128 GB: 60–75 token/ثانية • المرجع (RTX 4090): 90–120 token/ثانية
- ## Llama 3.3 70B (Q4_K_M) • M5 Pro 32 GB: ذاكرة غير كافية • M5 Pro 64 GB: 4–6 token/ثانية • M5 Max 64 GB: 8–12 token/ثانية • M5 Max 128 GB: 12–18 token/ثانية • المرجع (RTX 4090): 6–10 token/ثانية (offloaded)
- ## Llama 3.3 70B (Q5_K_M) • M5 Pro 64 GB: ذاكرة غير كافية • M5 Max 64 GB: ذاكرة غير كافية • M5 Max 128 GB: 8–12 token/ثانية • المرجع (RTX 4090): غير ممكن (حد VRAM)
- ## Llama 3.3 70B (Q8_0) • M5 Max 128 GB: 8–12 token/ثانية • RTX 4090: غير ممكن (يتطلب offload متعدد GPU)
- ## Qwen 3 32B (Q4_K_M) • M5 Pro 64 GB: 15–22 token/ثانية • M5 Max 64 GB: 20–28 token/ثانية • M5 Max 128 GB: 22–30 token/ثانية
- ## Mistral Small 24B (Q4_K_M) • M5 Pro 64 GB: 20–28 token/ثانية • M5 Max 64 GB: 25–35 token/ثانية • M5 Max 128 GB: 28–38 token/ثانية
- ## المنهجية كل الاختبارات المرجعية عبر Ollama بخلفية MLX (الافتراضية منذ مايو 2026). تقيس الاختبارات معالجة المُدخل + توليد الـ tokens في عائلة Apple Silicon M5. خنق حراري في MacBook Pro بعد 3 ساعات فأكثر من الحمل المستدام. ويحافظ Mac Studio على أداء ثابت في تشغيلات 24 ساعة فأكثر. تتفاوت الأرقام بنسبة 10–15% حسب الحرارة، والعمليات في الخلفية، والإصدار الدقيق لتكميم النموذج.
Apple Silicon M5 مقابل محطة عمل PC لـ LLM المحلي
Apple Silicon وNVIDIA فلسفتان مختلفتان. إليك المقارنة الصادقة.
- ## يفوز Mac Studio M5 Max 128 GB في: • الذاكرة الموحدة: 128 GB متاحة لأي نموذج، دون حد VRAM • كفاءة الطاقة: 100 واط مقابل 600 واط فأكثر لـ PC مكافئ • تشغيل صامت: 40 ديسيبل تحت حمل كامل • منظومة macOS: تكامل مع MLX وMetal وCore ML • إجمالي تكلفة الملكية: إنفاق أقل على الكهرباء خلال 3 سنوات • بناء فاخر: دون ضوضاء مراوح، إدارة حرارية ممتازة
- ## تفوز محطة عمل PC (RTX 5090) في: • السرعة الخام في نماذج 7B–13B: 90–120 token/ثانية مقابل 60–75 لـ M5 Max • اتساع منظومة CUDA: نماذج وأدوات وكود بحثي أكثر • الضبط الدقيق: PyTorch + CUDA يهيمنان أمام MLX • مرونة الترقية: تبديل كروت الرسوميات، إضافة VRAM أكثر • السعر في المستويات الدنيا: RTX 4070 Ti بسعر 800–1,200 دولار تتفوق على M5 Pro • الذكاء الاصطناعي غير LLM: Stable Diffusion والتدريب ومتعدد الوسائط أسرع على NVIDIA
- ## الحكم الصادق للاستدلال الخالص لـ LLM بنماذج 30B–70B، ينافس Mac Studio M5 Max 128 GB (5,099 دولار) مباشرةً تهيئات PC بسعر 4,500 دولار فأكثر، ويرفع Mac Studio M5 Ultra السقف إلى نماذج تحتاج 256 GB أو 512 GB. ميزة الذاكرة الموحدة حقيقية وقابلة للقياس. لاستدلال 7B–13B، يتفوق PC بسعر 1,500 دولار بـ RTX 4070 Ti على Mac mini M5 Pro في السرعة الخام. تتقلص ميزة Apple مع النماذج الأصغر. للضبط الدقيق والتدريب وStable Diffusion على نطاق أو PyTorch في الإنتاج، يفوز PC + NVIDIA. MLX يتحسّن، لكن الفروق لا تزال قائمة.

MLX مقابل Ollama مقابل llama.cpp على Apple Silicon
ثلاثة محركات استدلال رئيسية تعمل على M5. أيها المناسب لك؟
- ## MLX (أصلي من Apple) • الأداء: أسرع token/ثانية على M5. تحسين Metal أصلي. • دعم النماذج: متنامٍ (Llama، Qwen، Mistral، Gemma متاحة) • الإعداد: محوره Python، يتطلب أُلفة بسطر الأوامر • مثالي لـ: المستخدمون المتقدمون الباحثون عن أقصى أداء • العيب: أقل سهولة استخدام من Ollama
- ## Ollama (متعدد المنصات، مايو 2026 + خلفية MLX) • الأداء: يستخدم MLX تلقائيًا على Apple Silicon (أبطأ بنسبة 5–10% فقط من MLX الخالص) • دعم النماذج: أكبر مكتبة نماذج. تُضاف نماذج جديدة كل أسبوع. • الإعداد: تثبيت بأمر واحد، يعمل من أول لحظة • مثالي لـ: المبتدئون ومعظم المطورين. REST API للتكامل. • العيب: عبء أداء 5–10% مقابل MLX الخالص
- ## llama.cpp (متعدد المنصات، تحكم بمستوى أدنى) • الأداء: تنافسي مع Ollama/MLX عند التحسين • التخصيص: تحكم أكبر في التكميم وبارامترات الاستدلال • الإعداد: يتطلب تجميعًا ومعرفة بسطر الأوامر • مثالي لـ: الباحثون، تدفقات عمل تكميم مخصصة • العيب: منحنى تعلّم أحدّ من Ollama
- ## التوصية حسب نوع المستخدم • المبتدئون: Ollama (يعمل فورًا، توثيق واسع) • المطورون: REST API لـ Ollama (سهل الدمج في التطبيقات) • المستخدمون المتقدمون: MLX مباشرةً (أقصى أداء) • الباحثون: llama.cpp (أقصى تخصيص)
إعداد سريع على macOS (10 خطوات)
أسرع طريق لتشغيل أول نموذج LLM محلي بـ 70B على Apple Silicon.
- 1اشترِ جهاز Mac
Why it matters: اختر بين Mac Studio M5 Max أو MacBook Pro 16" M5 Max حسب احتياجاتك من المحمولية. - 2الإعداد الأولي لـ macOS
Why it matters: استخدم مساعد الترحيل (انقل من جهاز Mac القديم) أو تثبيتًا نظيفًا. يُوصى بـ macOS Sonoma 15.2 فأحدث. - 3ثبّت Homebrew
Why it matters: /bin/bash -c "$(curl -fsSL https://raw.githubusercontent.com/Homebrew/install/HEAD/install.sh)" — مدير الحزم لكل ما تبقى. - 4ثبّت Ollama
Why it matters: brew install ollama — تثبيت بسيط بأمر واحد. - 5ابدأ خدمة Ollama
Why it matters: ollama serve (تعمل في المقدمة) أو استخدم Ollama.app من مجلد التطبيقات. - 6نزّل أول نموذج اختبار
Why it matters: ollama pull llama3.1:8b — تحقق من التثبيت بنموذج صغير (تنزيل نحو 4 GB). - 7اختبر الاستدلال الأساسي
Why it matters: ollama run llama3.1:8b "اشرح نماذج LLM المحلية في جملة" — ينبغي أن يردّ خلال 15–30 ثانية. - 8نزّل النموذج الكبير المستهدف
Why it matters: ollama pull llama3.1:70b-instruct-q4_K_M (تنزيل نحو 35 GB). يستغرق 20–40 دقيقة باتصال سريع. - 9راقب الأداء
Why it matters: asitop يعرض استخدام موارد Apple Silicon. افتحه في طرفية ثانية: brew install asitop && asitop. - 10اختياري: ثبّت LM Studio لواجهة رسومية
Why it matters: نزّل من lmstudio.ai. أسهل من سطر الأوامر لغير المطورين. متوافق تمامًا مع تسريع MLX في M5.
كيف تسرّع Ollama على Apple Silicon M5
معظم تثبيتات Ollama على Apple Silicon تستخدم المسار السريع افتراضيًا، لذا القائمة أدناه تتعلق بإزالة ما يبطئه بصمت، لا بضبط إعدادات نادرة.
تأكّد من أن Ollama يستخدم خلفية MLX/Metal عبر `ollama ps`، وقلّل طول السياق والتكميم إن لم تحتج الدقة الكاملة، وأغلق التطبيقات الثقيلة على الذاكرة، وأبقِ MacBook Pro موصولًا بالكهرباء ومرفوعًا عن السطح في الجلسات الطويلة.
Ollama سريع افتراضيًا على جهاز Mac بمعالج M5 في معظم الحالات — أغلب مشاكل السرعة سببها شيء آخر يستهلك ذاكرتك الموحّدة أو ارتفاع حرارة الجهاز المحمول، وليس إعدادًا نسيت تفعيله.
- تأكّد من أن النموذج يعمل فعليًا على Metal/MLX وليس على المعالج. شغّل `ollama ps` أثناء تحميل نموذج — يجب أن يظهر النموذج كاملًا على GPU. تستخدم Ollama خلفية MLX تلقائيًا على Apple Silicon منذ مايو 2026؛ الانتقال الجزئي إلى المعالج عادةً يعني أن النموذج لا يتّسع في ذاكرتك الموحّدة الحرّة، لا أن إعدادًا مفقود.
- حرّر الذاكرة الموحّدة قبل جلسة طويلة. الذاكرة الموحّدة مشتركة بين macOS والنموذج — متصفّح بعشرات علامات التبويب، أو Docker Desktop، أو Xcode في الخلفية قد يأخذ عدة GB من الذاكرة التي يمكن لـOllama تحميلها على GPU. أغلقها قبل تحميل نموذج كبير، وتحقّق من الذاكرة المتاحة عبر مراقب النشاط أو `asitop`.
- قلّل نافذة السياق إن لم تكن بحاجة إليها. يحجز `num_ctx` الافتراضي في Ollama ذاكرة وحسابًا لكامل طول السياق سواء استخدمته أم لا. اضبط `num_ctx` أصغر في ملف Modelfile أو في طلب API (مثلًا 4096 بدلًا من 32K) للمحادثات القصيرة — يقلّل ذلك ضغط ذاكرة `KV-cache` ويسرّع التوليد.
- اختر التكميم بما يناسب حاجتك الفعلية للجودة. تكميم `Q4_K_M` أسرع بوضوح من `Q8_0` أو `Q5_K_M` بتكلفة جودة صغيرة ومقبولة عادةً (راجع دليل التكميم). إذا كان نموذج ما أبطأ من أرقام الأداء أعلاه، جرّب نسخة `Q4` قبل افتراض أن الجهاز هو عنق الزجاجة.
- أبقِ MacBook Pro موصولًا بالكهرباء ومرفوعًا في الاستدلال الطويل. كما ورد في أرقام الأداء أعلاه، يفقد MacBook Pro 10-15% من الأداء بعد 2-3 ساعات من الحمل المستمر بسبب تراكم الحرارة في هيكله الأرفع. حامل يحسّن التهوية، والبقاء على التيار الكهربائي بدل البطارية، يؤخّران هذا الأثر. للجلسات الأطول من بضع ساعات، يحافظ تبريد Mac Studio على الأداء الكامل حيث لا يفعل MacBook Pro ذلك.
- حدّث macOS وOllama. تُصدر Apple تحسينات أداء Metal في التحديثات الفرعية، وتُصدر Ollama بانتظام نسخًا أسرع من خلفية MLX/llama.cpp. تشغيل نسخة قديمة من macOS أو Ollama على معالج M5 جديد قد يهدر أداءً حقيقيًا بلا سبب سوى عدم التحديث.
- تجنّب تشغيل عدة نماذج في آن واحد إلا عند الحاجة. كل نموذج محمّل يحجز نصيبه الخاص من الذاكرة الموحّدة. يتحكّم `OLLAMA_MAX_LOADED_MODELS` في عدد النماذج التي تبقيها Ollama محمّلة في آنٍ واحد — الإعداد الافتراضي يسمح بأكثر من نموذج، وهو مريح لكنه يقسّم عرض النطاق الترددي المتاح للذاكرة بين النماذج إذا استعلمت أكثر من واحد في الوقت نفسه.
# تحقّق مما إذا كان النموذج محمّلًا بالكامل على GPU
ollama ps
# شغّل بنافذة سياق أصغر (أسرع، ضغط ذاكرة أقل)
ollama run llama3.1:8b --verbose
# أو اضبطها في Modelfile: PARAMETER num_ctx 4096
# قصر Ollama على نموذج واحد محمّل في كل مرة
OLLAMA_MAX_LOADED_MODELS=1 ollama serveمصفوفة القرار: أي تهيئة Mac تشتري
استخدم هذه المصفوفة لإيجاد أفضل خيار حسب حالة استخدامك.
- 1. الميزانية أولًا، نماذج صغيرة (7–13B): Mac mini M5 Pro 24 GB (1,699 دولار) — أرخص M5 Pro
- 2. نماذج 30B على سطح مكتب اقتصادي: Mac mini M5 Pro 64 GB (2,699 دولار)
- 3. أريد تشغيل نماذج 70B بأريحية: Mac Studio M5 Max 64 GB (3,499 دولار)
- 4. أحتاج 70B Q5 بنوافذ سياق 32K فأكثر: Mac Studio M5 Max 128 GB (5,099 دولار)
- 5. أحتاج 256–512 GB لأكبر النماذج المحلية: Mac Studio M5 Ultra (5,499–10,000+ دولار)
- 6. LLM محلي محمول، مستعد لقبول الخنق الحراري: MacBook Pro 16" M5 Max 64 GB (3,499 دولار)
- 7. أنا بالفعل في منظومة macOS (Xcode، Final Cut Pro): أي متغير من Mac Studio M5
- 8. بحث/ضبط دقيق بتجارب MLX: Mac Studio M5 Max 128 GB أو M5 Ultra
- 9. أريد أقصى صمت وتشغيلًا في الخمول: Mac Studio (المراوح نادرًا ما تدور)
- 10. ميزانية 4,000 دولار فأكثر، أريد محمولية: MacBook Pro 16" M5 Max 128 GB (4,499 دولار)
- 11. النظر في بدائل: PC بـ RTX 4090 (3,000 دولار فأكثر) أو mini PC بـ AMD Ryzen AI Max+ (1,600–2,000 دولار)
متى لا يكون Apple Silicon M5 الخيار المناسب لـ LLM المحلي
Apple Silicon ممتاز، لكنه ليس شاملًا. تجنّب Mac لـ LLM المحلي في هذه السيناريوهات.
- تحتاج تدفقات عمل حصرية لـ CUDA: يعمل معظم استدلال LLM على Apple Silicon، لكن الضبط الدقيق بـ torch.cuda وأنوية CUDA الخاصة بـ vLLM وكود البحث المملوك لـ CUDA لا تعمل على MLX. إن كان 70% من عملك خاصًا بـ CUDA، اختر GPU RTX.
- تؤدي عملًا مكثّفًا بـ Stable Diffusion: تعمل نماذج الانتشار أبطأ بمقدار 2–3× على M5 منها على RTX 4090. إن مثّل توليد الصور 30% فأكثر من تدفق عملك، فإن PC + RTX خيار أفضل.
- الميزانية أولوية مطلقة: PC بسعر 1,500 دولار بـ RTX 4070 Ti يتفوق على Mac mini M5 Pro في سرعة الاستدلال لنماذج 7B–13B. إن كانت الميزانية وحدها المهمة، فإن PC أرخص.
- تحتاج قابلية الترقية في محطة عمل: ذاكرة وتخزين Mac Studio ثابتان وقت الشراء. تتيح أجهزة PC ترقيات تدريجية. لاستخدام 5 سنوات فأكثر، قد يكون PC أكثر اقتصادًا على المدى الطويل.
- تتطلب token/ثانية بثلاثة أرقام: RTX 4090 تبلغ 90–120 token/ثانية على Llama 8B. ويصل M5 Max إلى 60–75. للاستدلال عالي الإنتاجية (خدمة عدة مستخدمين)، لا تزال NVIDIA تفوز.
- لا تستخدم macOS عادةً: التحول عن منظومة من Windows/Linux لمجرد LLM المحلي لا يستحق العناء، إلا إن أردت أيضًا macOS لأسباب أخرى.
- تحتاج استدلال إنتاج على مدار الساعة: Mac Studio ممتاز لكنه مصمَّم لذروات الحمل. للاستدلال المستمر مع SLA، محطات عمل NVIDIA المؤسسية رهان أكثر أمانًا.
الأسئلة الشائعة
كيف أجعل Ollama أسرع على MacBook Pro بمعالج M5؟
تأكّد من أن النموذج يعمل على Metal/MLX عبر `ollama ps`، وأغلق التطبيقات الثقيلة على الذاكرة في الخلفية لتحرير الذاكرة الموحّدة، وقلّل `num_ctx` إن لم تحتج نافذة سياق طويلة، واستخدم تكميم `Q4_K_M` بدلًا من Q5/Q8، وأبقِ MacBook Pro موصولًا بالكهرباء ومرفوعًا في الجلسات الأطول من 2-3 ساعات لتأخير فقدان الأداء بسبب الحرارة. راجع قسم تسريع الأداء أعلاه للقائمة الكاملة.
هل يمكن لـ Mac Studio M5 Max تشغيل Llama 3.3 70B؟
نعم، كل تهيئات M5 Max قادرة على ذلك. تشغّل 64 GB نموذج 70B Q4 بسرعة 8–12 token/ثانية. وتشغّل 128 GB نموذج 70B Q5 بسرعة 8–12 token/ثانية (جودة أعلى، السرعة نفسها).
كيف يُقارن M5 Max بـ RTX 4090 لـ LLM المحلي؟
M5 Max أبطأ في النماذج الصغيرة (60–75 مقابل 90–120 token/ثانية لـ Llama 8B). تنافسي في النماذج الكبيرة (8–12 مقابل 6–10 token/ثانية لـ Llama 70B). يستهلك M5 Max ثلث الطاقة.
هل تكفي 64 GB من RAM أم أحتاج 128 GB؟
لنموذج 70B Q4 واحد: 64 GB كافية. أما لـ 70B Q5 أو عدة نماذج متزامنة أو الضبط الدقيق: فيُوصى بـ 128 GB.
ما الفرق بين M5 Pro وM5 Max لـ LLM؟
M5 Pro بـ GPU بـ 16/20 نواة، عرض نطاق 307 GB/s، حتى 64 GB. M5 Max بـ GPU بـ 32/40 نواة، 460/614 GB/s، حتى 128 GB. M5 Max أسرع بنسبة 30–50% في مستوى الذاكرة نفسه. أما M5 Ultra (حصريًا في Mac Studio) فيذهب أبعد: حتى 80 نواة، حتى 1.2 تيرابايت/ثانية، حتى 512 GB.
هل يعاني MacBook Pro من خنق حراري أثناء استدلال LLM المستدام؟
نعم، بعد 2–3 ساعات من الاستدلال المستمر، يخفض MacBook Pro الأداء بنسبة 10–15%. ويحافظ Mac Studio على أداء كامل على مدار الساعة.
هل يمكنني تشغيل Stable Diffusion على Apple Silicon؟
نعم، يعمل Stable Diffusion XL على M5 بسرعة 8–12 ثانية/صورة (بطيء مقابل RTX 4070 نحو 3 ثوانٍ). MLX يدعمه أصليًا.
هل MLX أسرع من Ollama على Mac؟
MLX أسرع بنسبة 5–10% في إنتاجية الـ tokens الخام. وOllama أكثر ملاءمة ويخسر أداءً طفيفًا فقط. اختر حسب تدفق العمل، لا حسب فارق السرعة الخام.
كم كهرباء يستهلك Mac Studio M5 لاستدلال LLM؟
Mac Studio M5 Max: 70–100 واط مستدام. شهر من الاستدلال على مدار الساعة (720 ساعة) ≈ 60 kWh ≈ 8–12 دولارًا كهرباء في الولايات المتحدة. أما RTX 4090 فستكلف 40–60 دولارًا في الشهر نفسه.
هل أصبح Mac mini يحتوي على شريحة M5 Pro الآن؟
نعم، مؤكَّد في 25 أغسطس 2026. يبدأ Mac mini M5 Pro من 1,699 دولارًا (24 GB، حتى 64 GB)، عرض نطاق 307 GB/s، Thunderbolt 5. يصل في 22 سبتمبر 2026 — أرخص Mac بشريحة M5 Pro على الإطلاق.
هل يقدّم Mac Studio ما زال تهيئة M5 Pro؟
لا. اعتبارًا من تحديث 25 أغسطس 2026، أصبح Mac Studio يبدأ بشريحة M5 Max (2,499 دولار). أصبح Mac mini هو المدخل إلى شريحة M5 Pro بدلًا منه.
ما هو Mac Studio M5 Ultra وكم يدعم من الذاكرة؟
M5 Ultra شريحة جديدة فوق M5 Max، حصرية لـ Mac Studio، تبدأ من 5,499 دولارًا (96 GB). تتوسع إلى 256 GB الآن و512 GB أواخر أكتوبر 2026 (يُتوقع سعرها أعلى بكثير من 10,000 دولار)، بعرض نطاق حتى 1.2 تيرابايت/ثانية.
هل يمكنني الضبط الدقيق للنماذج على Apple Silicon؟
نعم، يعمل الضبط الدقيق LoRA جيدًا. أما الضبط الدقيق بالأوزان الكاملة فأبطأ من كرت رسوميات سطح المكتب (لا يوجد دعم تدريب موزَّع بعد).
هل Apple Silicon جيد للاستدلال لكنه سيئ للتدريب؟
جزئيًا. الاستدلال ممتاز. التدريب/الضبط الدقيق يعمل، لكنه أبطأ من NVIDIA. إطار MLX يتحسّن بسرعة.
كيف يساعد Neural Engine في LLM؟
يسرّع Neural Engine (8 TOPS، 16 نواة) العمليات المكمَّمة (INT8، Q4). فائدة قابلة للقياس (نحو 10%) لنماذج Q4_K_M.
هل يمكنني تشغيل عدة نماذج في آن واحد على M5 Max 128 GB؟
نعم. تتيح 128 GB تشغيل نموذجي 32B أو نموذج 70B إضافةً إلى 13B في آن واحد بسرعة لائقة.
ما الوقت النموذجي للإعداد لـ LLM المحلي على Mac؟
15–30 دقيقة من جهاز Mac جديد حتى تشغيل أول نموذج 70B عبر Ollama (بما في ذلك 20–40 دقيقة لتنزيل النموذج باتصال جيد).
هل يعمل Apple Silicon مع كل أحدث النماذج (Llama 4، Qwen 3، إلخ)؟
حتى أغسطس 2026: Llama 3.3 ✓، Qwen 3 ✓، Mistral ✓، Gemma ✓، DeepSeek ✓. يتوسّع دعم MLX أسبوعيًا. راجع GitHub الخاص بـ MLX للقائمة المحدَّثة.
هل أشتري Mac mini M6 أم Mac mini M5 Pro لـ LLM المحلي؟
M6 فئة أساسية (899 دولار، حتى 32 GB، 170 GB/s) وغير مصمَّم لـ LLM المحلي فوق النماذج الصغيرة. M5 Pro (1,699 دولار، حتى 64 GB، 307 GB/s) هو الخيار الأنسب لـ LLM المحلي.
هل يستحق النظر في Mac Studio مُجدَّد؟
نعم. تتضمن منتجات Apple المُجدَّدة ضمانًا لسنة وتحتفظ بـ 90–95% من قيمتها الأصلية. وفّر 10–15%.
