TL;DR
- 16GB: نماذج 7B فقط (بالكاد)
- 36GB: 13B بأريحية، 34B Q4 بالكاد
- 64GB: 34B Q5 بأريحية
- 128GB: 70B Q5 بأريحية
- لا يمكنك الترقية بعد الشراء — اشترِ أقصى ذاكرة وقت الشراء
Key Takeaways
- الذاكرة الموحدة = مشتركة بين CPU و GPU — كلها متاحة لنماذج LLM.
- تمتلك RTX 4070 ذاكرة 12GB VRAM + 32GB RAM (منفصلة). أما Mac فلديه ذاكرة موحدة = كلها متاحة.
- يمتلك Mac بسعة 64GB نحو 56–60GB لنماذج LLM بعد عبء macOS (4–8GB).
- يوجد swap: يستخدم macOS الـ SSD إذا تجاوز النموذج الذاكرة المتاحة. يعمل لكن أبطأ بـ 5–10×.
- يختلف حجم النموذج بالـ GB حسب التكميم: Llama 3.3 8B هو 16GB بـ FP16، و5GB بـ Q4، و8.5GB بـ Q8.
- القاعدة: اشترِ أقصى ذاكرة — لا يمكنك ترقيتها بعد الشراء. تكلفة الذاكرة عند البيع 5–10%؛ واستبدال Mac بالكامل لاحقًا يكلف 100%.
للنماذج اللغوية المحلية على Apple Silicon: 16 جيجابايت لـ 7B فقط (ضيق)، 36 جيجابايت لـ 13B بشكل مريح، 64 جيجابايت لـ 70B Q3 (ضيق) أو 34B Q5 (مريح)، 128 جيجابايت لـ 70B Q5 بشكل مريح — اشترِ الحد الأقصى لأن الذاكرة لا يمكن ترقيتها لاحقاً.
الذاكرة الموحدة في Mac مشتركة بين CPU وGPU ومحرك الذكاء الاصطناعي. القاعدة: نموذج 7B بضغط Q4 يحتاج نحو 5 جيجابايت؛ و14B نحو 9 جيجابايت؛ و70B بضغط Q4 نحو 42 جيجابايت. أضف 8 جيجابايت لنظام التشغيل. إن لم يتسع النموذج يُصرف إلى القرص — أبطأ 100 مرة.
كيف تعمل الذاكرة الموحدة لنماذج LLM
تُشارَك الذاكرة الموحدة بين CPU و GPU — كلها متاحة للنموذج. وخلافًا لـ GPU المنفصلة (تمتلك RTX 4070 ذاكرة 12GB VRAM + 32GB RAM منفصلة)، تتشارك Apple Silicon مجمّعًا واحدًا. Mac بسعة 64GB = 64GB متاحة للنموذج. يستخدم macOS والتطبيقات 4–8GB، ما يترك 56–60GB لنموذج LLM.
هل الذاكرة الموحدة هي نفسها VRAM؟
نعم — في Apple Silicon، الذاكرة الموحدة هي VRAM الخاصة بوحدة معالجة الرسومات فعليًا. لا يوجد مجمّع VRAM ثابت ومنفصل كما في بطاقة رسومات منفصلة. يقرأ ويكتب CPU وGPU ومحرك Neural Engine في شريحة السلسلة M نفس الذاكرة الفعلية، لذا يكون كامل مجمّع الذاكرة الموحدة تقريبًا — وليس جزءًا منه فقط — متاحًا لوحدة الرسومات لتشغيل نموذج LLM.
- بطاقة رسومات منفصلة (RTX 4070): تُعد 12GB من VRAM سقفًا ثابتًا لأوزان النموذج، حتى لو كان الكمبيوتر يملك 64GB من ذاكرة النظام المنفصلة.
- Apple Silicon: يمكن لوحدة الرسومات الوصول إلى كامل مجمّع الذاكرة الموحدة ناقص عبء macOS (4–8GB) — يمنح Mac بسعة 64GB وحدة الرسومات نحو 56-60GB، وليس شريحة VRAM ثابتة بحجم 12-24GB.
- لهذا السبب يمكن لجهاز Mac بسعة 64GB تشغيل نموذج 34B بأريحية بينما لا يستطيع كمبيوتر بسعة 64GB مزود ببطاقة رسومات 12GB ذلك — فذاكرة الكمبيوتر المتاحة لوحدة الرسومات محدودة بسعة VRAM لا بإجمالي الذاكرة.
- يصف مصطلحا "الذاكرة المشتركة" و"الذاكرة الموحدة" البنية نفسها: مجمّع واحد يمكن لكل من CPU وGPU الوصول إليه، دون خطوة تخصيص يدوي لـ VRAM.
الجدول الرئيسي: مستوى الذاكرة مقابل حجم النموذج
| النموذج | المعاملات | Q3_K | Q4_K_M | Q5_K_M | Q8 | FP16 |
|---|---|---|---|---|---|---|
| Phi-4 | 3.8B | 2.1 GB | 2.5 GB | 2.9 GB | 4.0 GB | 7.6 GB |
| Mistral Small | 7B | 3.8 GB | 4.5 GB | 5.2 GB | 7.5 GB | 14 GB |
| Llama 3.3 8B | 8B | 4.2 GB | 5.0 GB | 5.8 GB | 8.5 GB | 16 GB |
| Llama 3.3 13B | 13B | 7.0 GB | 8.5 GB | 9.8 GB | 14 GB | 26 GB |
| Qwen3 34B | 34B | 17 GB | 20 GB | 24 GB | 36 GB | 68 GB |
| Llama 3.3 70B | 70B | 36 GB | 42 GB | 49 GB | 74 GB | 140 GB |
| Llama 3.3 405B | 405B | 200+ GB | 240 GB | 280 GB | 410 GB | 810 GB |
أضف 4-8 GB لعبء macOS عند حساب ما إذا كان النموذج يتسع في Mac لديك.
مصفوفة يتسع / لا يتسع
| النموذج + التكميم | 16GB | 36GB | 64GB | 128GB |
|---|---|---|---|---|
| Phi-4 Q4 (2.5 GB) | ✓ فائض | ✓ فائض | ✓ فائض | ✓ فائض |
| Llama 3.3 8B Q4 (5 GB) | ⚠️ بالكاد | ✓ مريح | ✓ فائض | ✓ فائض |
| Llama 3.3 8B Q8 (8.5 GB) | ✗ لا يتسع | ✓ مريح | ✓ فائض | ✓ فائض |
| Llama 3.3 13B Q4 (8.5 GB) | ✗ لا يتسع | ✓ مريح | ✓ فائض | ✓ فائض |
| Qwen3 34B Q4 (20 GB) | ✗ لا يتسع | ⚠️ بالكاد | ✓ مريح | ✓ فائض |
| Qwen3 34B Q5 (24 GB) | ✗ لا يتسع | ✗ لا يتسع | ✓ مريح | ✓ فائض |
| Llama 3.3 70B Q3 (36 GB) | ✗ لا يتسع | ✗ لا يتسع | ⚠️ بالكاد | ✓ مريح |
| Llama 3.3 70B Q4 (42 GB) | ✗ لا يتسع | ✗ لا يتسع | ⚠️ بالكاد جدًا | ✓ مريح |
| Llama 3.3 70B Q5 (49 GB) | ✗ لا يتسع | ✗ لا يتسع | ✗ لا يتسع | ✓ مريح |
| Llama 3.3 70B Q8 (74 GB) | ✗ لا يتسع | ✗ لا يتسع | ✗ لا يتسع | ✓ يتسع |
✓ فائض = 4+ GB متاحة | ✓ مريح = 2-4 GB متاحة | ⚠️ بالكاد = أقل من 2 GB متاحة | ✗ لا يتسع = يستخدم swap أو يفشل

ما الذي يتسع في كل مستوى ذاكرة (عمليًا)
- 116 GB (M5 base, MacBook Air)
Why it matters: Llama 3.3 8B Q4 يتسع (5GB نموذج + 8GB نظام = 13GB) ✓ لكن بالكاد. Llama 8B Q8 لا يتسع دون swap. Whisper small يتسع معه. - 236 GB (M5 Pro base)
Why it matters: Llama 3.3 8B Q8 يتسع بأريحية. Llama 13B Q4 يتسع. Qwen3 34B Q4 يتسع بالكاد (20GB + 8GB نظام = 28GB). متعدد النماذج: Whisper + LLaVA + TTS يتسع ✓ - 364 GB (M5 Pro max)
Why it matters: Qwen3 34B Q5 يتسع بأريحية (24GB). Llama 70B Q3 يتسع بالكاد. حزم النماذج المتعددة لديها مساحة وافرة. - 4128 GB (M5 Max)
Why it matters: أفضل نموذج لـ 128GB: Llama 3.3 70B Q5 (49GB) — أكبر نموذج شائع يتسع مع هامش وافر. 70B Q8 يتسع (74GB) بجودة شبه خالية من الفقدان. متعدد الوسائط: Whisper + نموذج رؤية 90B + LLM 8B يتسع في آن واحد ✓
متطلبات الذاكرة لحزم النماذج المتعددة
| حالة الاستخدام (الحزمة) | الذاكرة المطلوبة |
|---|---|
| LLM فقط (Llama 8B Q4) | 5 GB + نظام = 13 GB |
| LLM + STT (Llama 8B + Whisper large-v3) | 8 GB + نظام = 16 GB |
| LLM + STT + TTS (مساعد صوتي) | 9 GB + نظام = 17 GB |
| LLM + رؤية (Llama 8B + LLaVA 7B) | 11 GB + نظام = 19 GB |
| متعدد الوسائط كامل (LLM + رؤية + STT + TTS) | 14 GB + نظام = 22 GB |
| LLM + RAG (Llama 8B + embeddings + ChromaDB) | 8 GB + نظام = 16 GB |
| متعدد الوسائط ثقيل (Llama 70B Q4 + رؤية 90B) | 100+ GB |
تحتاج الحزم التي تتجاوز 22 GB إلى Mac بحد أدنى 36GB. وتحتاج التي تتجاوز 50 GB إلى 64GB كحد أدنى. وحزمة متعددة الوسائط الثقيلة تعمل فقط على M5 Max 128GB.
تضيف نافذة السياق عبئًا على الذاكرة
يتوسّع ذاكرة KV مع طول السياق — كلما كبرت نافذة السياق زاد استخدام النموذج للذاكرة وقت التشغيل. وهذا فخّ شائع قد يدفع التهيئة الضيّقة إلى الـ swap.
- Llama 3.3 8B بسياق 8K: +0.5 GB
- Llama 3.3 8B بسياق 32K: +2 GB
- Llama 3.3 8B بسياق 128K: +8 GB
- Llama 3.3 70B بسياق 32K: +6 GB
- Llama 3.3 70B بسياق 128K: +24 GB
اشترِ أقصى ذاكرة — وإليك السبب
- لا يمكنك ترقية ذاكرة Apple Silicon بعد الشراء.
- تتزايد أحجام النماذج: 8B اليوم → النقطة المثالية 13–34B في 2027.
- 16GB أصبحت هامشية لنماذج LLM — الحد الأدنى الموصى به 36GB.
- فرق السعر: 36GB→64GB يكلف ~200$ وقت الشراء، ويجنّبك شراء Mac جديد بعد عامين عندما تتجاوز النماذج 36GB.
- مثال: M5 Pro 36GB اليوم يكلف 999$؛ و64GB يكلف 1199$. شراء Mac جديد بعد عامين: 1500$+ للتهيئة نفسها M5 Pro 64GB.
- أرخص طريقة للحصول على 36GB+ من الذاكرة الموحدة: جهاز Mac mini بمعالج M5 Pro الأساسي (999$، 36GB) هو أرخص Mac يملك ذاكرة كافية لتشغيل نماذج 13B بأريحية — أرخص من أي تهيئة Mac Studio أو MacBook Pro بذاكرة مماثلة.

أثر التكميم على الجودة
Q4_K_M (4 بت): ~1–2% فقدان جودة مقابل FP16. غير محسوس لمعظم الاستخدامات. الخيار الافتراضي الأفضل.
Q5_K_M (5 بت): ~0.5–1% فقدان جودة. ضئيل. موصى به إذا كان لديك ذاكرة فائضة.
Q8 (8 بت): ~0.1% فقدان جودة. بلا فقدان فعليًا.
Q3_K (3 بت): 3–5% فقدان جودة. محسوس في الاستدلال المعقد. مقبول فقط في سيناريوهات المساحة المحدودة جدًا.
هل أختار 36GB أم 64GB؟
اختر 64GB إذا سمحت الميزانية (200$ إضافية). 36GB تعمل اليوم، لكنها ستصبح ضيّقة خلال 12 شهرًا مع تزايد أحجام النماذج. و64GB جاهزة للمستقبل حتى 2027–2028.
هل يمكنني ترقية الذاكرة لاحقًا؟
لا. ذاكرة Apple Silicon ملحومة وغير قابلة للترقية. اشترِ أقصى ذاكرة وقت الشراء.
لماذا 16GB غير كافية؟
16GB لنموذج LLM + 4–8GB لـ macOS = 8–12GB متاحة. يحتاج Llama 8B Q4 إلى 5GB، دون ترك مساحة لـ Whisper أو مهام أخرى. إنها ضيّقة جدًا.
هل أحتاج فعلًا إلى 128GB؟
فقط إذا كنت تشغّل نماذج 70B بانتظام أو تحتاج إلى رؤية + LLM + STT في آن واحد. وإلا فإن 64GB أكثر من كافية.
هل 48GB كافية لنماذج LLM المحلية؟
نعم — 48GB (متاحة في M4 Pro وبعض تهيئات M5 Pro) نقطة وسطى جيدة. تشغّل كل نماذج 34B، و70B Q3 عند الحد، وحزم متعددة الوسائط كاملة. أفضل من 36GB؛ وإذا أمكنك تحمّل 64GB، فإن الجاهزية للمستقبل تستحق ذلك.
كم أحتاج من ذاكرة لتشغيل Llama 3.3 70B محليًا؟
الحد الأدنى 48GB (تكميم Q3، فقدان جودة ملحوظ). الموصى به 64GB (تكميم Q4، مساحة ضيّقة). المريح 128GB (تكميم Q5/Q8، جودة عالية). يتطلب مستوى 64GB إدارة دقيقة للذاكرة؛ و128GB هي الخيار الوحيد الخالي من القلق لـ 70B.
هل أحتاج 128GB للذكاء الاصطناعي المحلي في 2026؟
فقط إذا كنت تشغّل نماذج 70B بانتظام أو تحتاج حزم رؤية + LLM + STT في آن واحد. للاستخدام اليومي لنماذج LLM (نماذج 8B–34B، RAG، مساعدة الكود)، يكون M5 Pro 64GB النقطة المثالية. و128GB تعني قفزة سعرية 2–3× بفائدة هامشية ما لم تحتج تحديدًا إلى 70B.
هل الذاكرة الموحدة في Apple Silicon هي نفسها VRAM؟
نعم. على عكس بطاقة رسومات منفصلة بذاكرة VRAM ثابتة ومنفصلة (مثل 12GB في RTX 4070)، تقرأ وحدة الرسومات في Apple Silicon وتكتب في نفس الذاكرة الفعلية التي يستخدمها المعالج المركزي. يمكن لوحدة الرسومات الوصول إلى كامل الذاكرة الموحدة تقريبًا — يمنح Mac بسعة 64GB وحدة الرسومات نحو 56-60GB بعد عبء macOS، وليس شريحة VRAM ثابتة.
ما أكبر نموذج LLM يتسع في 128GB من الذاكرة الموحدة؟
يُعد Llama 3.3 70B بتكميم Q5_K_M (49GB) أكبر نموذج شائع يتسع بأريحية، تاركًا نحو 70GB خالية للسياق والعبء الإضافي. وحتى بتكميم Q8 (74GB) يتسع مع هامش لـ macOS. يحتاج نموذج 405B إلى 240GB+ حتى بتكميم Q4 — وهو يتجاوز الذاكرة الموحدة لأي جهاز Mac، لذا يظل 70B السقف العملي لجهاز واحد.
كم مساحة تخزين يحتاجها نموذج LLM محلي، بمعزل عن الذاكرة؟
الذاكرة (RAM) ومساحة التخزين على القرص شيئان مختلفان: تحتفظ الذاكرة بالنموذج أثناء التشغيل؛ ويحتفظ التخزين بملف النموذج الذي تم تنزيله بشكل دائم. يحتاج نموذج 8B بتكميم Q4 إلى نحو 5GB من الذاكرة والقرص معًا. ويحتاج نموذج 70B Q5 إلى نحو 49GB من الذاكرة و49GB من مساحة القرص — الملف نفسه. تشغيل عدة نماذج محليًا (مثل 8B و34B و70B بالإضافة إلى نموذج رؤية) يتطلب 100-150GB من مساحة القرص الخالية، بمعزل عن مستوى ذاكرة جهاز Mac لديك.
