Skip to main content
PromptQuorumPromptQuorum
Home/Local LLMs/⁨Mac Mini M5⁩ كخادم ذكاء اصطناعي محلي ⁨2026⁩: ⁨LLM⁩ و⁨Whisper⁩ و⁨RAG⁩ ومساعد صوتي ⁨24/7⁩
Hardware & Performance

⁨Mac Mini M5⁩ كخادم ذكاء اصطناعي محلي ⁨2026⁩: ⁨LLM⁩ و⁨Whisper⁩ و⁨RAG⁩ ومساعد صوتي ⁨24/7⁩

·12 دقيقة قراءة·By Hans Kuepper · Founder of PromptQuorum, multi-model AI dispatch tool · PromptQuorum

Mac Mini M5 Pro بسعة 64 GB مقابل 1,199 دولارًا هو خادم الذكاء الاصطناعي دائم التشغيل الأفضل من حيث القيمة مقابل السعر في 2026. صامت (بلا مروحة تقريبًا)، استهلاك 25–55 واط، 26–39 دولارًا سنويًا للكهرباء. يشغّل نماذج Ollama 34B وWhisper STT وخط معالجة RAG ومساعدًا صوتيًا في آنٍ واحد. يسترد تكلفته مقابل 4 اشتراكات ChatGPT Plus خلال 15 شهرًا.

دليل شامل لاستخدام Mac Mini M5 Pro بسعة 64 GB كخادم ذكاء اصطناعي محلي صامت ودائم التشغيل. Ollama LLM، وWhisper STT، وخط معالجة RAG، ومنظومة مساعد صوتي. تكلفة الكهرباء 26–39 دولارًا سنويًا. إعداد خطوة بخطوة بأوامر حقيقية وحالات استخدام وتحليل تكاليف وتفصيل للتكلفة الإجمالية على مدى 5 سنوات.

لماذا يُعد Mac Mini M5 خادم الذكاء الاصطناعي المثالي

Mac Mini M5 Pro بسعة 64 GB مقابل 1,199 دولارًا هو العتاد الأفضل من حيث القيمة مقابل السعر في 2026 لخادم ذكاء اصطناعي محلي صامت ودائم التشغيل. يجمع بين الصمت شبه التام (بلا مروحة أو بمروحة بعدد دورات منخفض جدًا)، واستهلاك كهربائي منخفض (25–55 واط مقابل 300 واط+ لأجهزة PC بـ GPU)، وذاكرة موحدة كافية لتشغيل نماذج بـ 34B معامل أو عدة نماذج صغيرة في آنٍ واحد.

تكلفة الكهرباء السنوية 26–39 دولارًا مقابل 263–394 دولارًا للمكافئات المكتبية بـ GPU — أقل من شهرين من اشتراك واحد في ChatGPT Plus، كل عام، بشكل دائم.

الخاصيةMac Mini M5 ProDesktop + RTX 4070Raspberry Pi 5
تكلفة العتاد1,199 دولارًا1,200 دولارًا+80 دولارًا
الاستهلاك (خمول)8 واط50 واط5 واط
الاستهلاك (حمل LLM)25–55 واط200–300 واطغير متاح (صغير جدًا)
الكهرباء السنوية26–39 دولارًا263–394 دولارًا~5 دولارات
مستوى الضجيجصامتصاخب (3+ مراوح)صامت
أقصى حجم نموذج34B (Q5)8B (12 GB VRAM)1–3B فقط
موثوقية دائم التشغيلممتازةجيدةممتازة
الحجم المادي13×13 سمبرج كامل8×8 سم

توصية إعداد العتاد

M5 Pro 64 GB مقابل 1,199 دولارًا هو نقطة القيمة المثلى: يشغّل نماذج 34B، ويدعم منظومات مساعد صوتي متعددة الأنماط، ويترك هامشًا لـ 2–3 سنوات من نمو حجم النماذج. لا تشترِ أبدًا أقل من 36 GB للاستخدام كخادم ذكاء اصطناعي.

التهيئةالسعر (2026)الذاكرةمثالي لـالنماذج المتوافقة
Mac Mini M5 (أساسي)599 دولارًا16 GBاستخدام خفيف، مستخدم واحد7B Q4 فقط
Mac Mini M5 (32 GB)799 دولارًا32 GBاستخدام عام فرديحتى 13B Q4
Mac Mini M5 Pro 36 GB999 دولارًا36 GBمنظومة مساعد صوتي8B + Whisper + TTS
Mac Mini M5 Pro 64 GB ★1,199 دولارًا64 GBنقطة القيمة المثلى الموصى بهانماذج 34B بأريحية
Mac Mini M5 Pro 64 GB + 1 TB1,399 دولارًا64 GBتخزين نماذج كثيرة50+ نموذجًا على القرص

★ موصى به. تخطيط التخزين: Llama 3.3 8B Q4 ~5 GB لكل نموذج، Whisper large-v3 ~3 GB، نموذج embeddings ~0.5 GB، ChromaDB مع 10,000 مستند ~2 GB. تهيئة معتادة بـ 5 نماذج: 50–80 GB. الحد الأدنى 512 GB SSD؛ 1 TB للمستخدمين المتقدمين.

مستويات ذاكرة Mac Mini M5 مقارنة بالحد الأقصى لحجم النموذج: 16 GB لتشغيل 7B Q4 فقط، 32 GB حتى 13B Q4، 36 GB لمنظومة مساعد صوتي 8B مع Whisper وTTS، وفئة 64 GB Pro الموصى بها تشغّل نماذج 34B بأريحية.
مستويات ذاكرة Mac Mini M5 مقارنة بالحد الأقصى لحجم النموذج: 16 GB لتشغيل 7B Q4 فقط، 32 GB حتى 13B Q4، 36 GB لمنظومة مساعد صوتي 8B مع Whisper وTTS، وفئة 64 GB Pro الموصى بها تشغّل نماذج 34B بأريحية.

الإعداد الكامل للخادم (30 دقيقة من فتح العلبة إلى التشغيل)

تهيّئ هذه الخطوات Mac Mini M5 كخادم ذكاء اصطناعي دائم يمكن الوصول إليه عبر الشبكة. بعد إتمام جميع الخطوات، يمكن لأي جهاز في شبكتك المحلية LAN إرسال طلبات إلى API الخاص بـ Ollama على Mac Mini عبر المنفذ 11434.

الخطوة 1: تثبيت Homebrew وOllama

bash
# Install Homebrew (if not already installed)
/bin/bash -c "$(curl -fsSL https://raw.githubusercontent.com/Homebrew/install/HEAD/install.sh)"

# Install Ollama
brew install ollama

# Start as background service (auto-starts on reboot)
brew services start ollama

# Verify it's running
curl http://localhost:11434/api/version

الخطوة 2: تهيئة الوصول عبر الشبكة

افتراضيًا، يستمع Ollama على localhost فقط. تفتح هذه الإعدادات الوصول إلى شبكتك المحلية LAN وتهيّئ التخزين المؤقت متعدد النماذج.

bash
# Allow Ollama to listen on all interfaces (not just localhost)
echo 'export OLLAMA_HOST=0.0.0.0:11434' >> ~/.zshrc
echo 'export OLLAMA_MAX_LOADED_MODELS=3' >> ~/.zshrc
echo 'export OLLAMA_KEEP_ALIVE=1h' >> ~/.zshrc
source ~/.zshrc

# Restart Ollama with new settings
brew services restart ollama

# Verify listening on all interfaces
lsof -i :11434

الخطوة 3: تهيئة جدار حماية macOS

إعدادات النظام ← الشبكة ← جدار الحماية ← خيارات ← أضف مسار الملف التنفيذي لـ Ollama (/opt/homebrew/bin/ollama) ← اسمح بالاتصالات الواردة. يتيح هذا لأجهزة الشبكة المحلية LAN الوصول إلى المنفذ 11434 مع تفعيل جدار الحماية.

الخطوة 4: تنزيل النماذج الموصى بها

bash
# General-purpose LLM
ollama pull llama3.1:8b

# Alternative: faster, similar quality
ollama pull mistral:7b

# For coding tasks
ollama pull deepseek-coder-v2:16b

# Embedding model for RAG
ollama pull nomic-embed-text

الخطوة 5: تهيئة IP ثابت أو mDNS

mDNS (Bonjour) هو الخيار الأبسط — يمكن الوصول إلى Mac Mini لديك باسم المضيف على شبكتك المحلية دون أي تهيئة إضافية.

bash
# Find current local IP
ipconfig getifaddr en0

# Or use Bonjour - access at hostname.local
scutil --get LocalHostName
# Ejemplo: macmini → accesible en http://macmini.local:11434

الخطوة 6: منع وضع السكون (ضروري للتشغيل الدائم)

بدون هذه الإعدادات، سيدخل macOS في وضع السكون بعد فترة خمول، فيصبح الخادم غير قابل للوصول حتى يُعاد تنشيطه يدويًا.

bash
sudo pmset -a sleep 0
sudo pmset -a displaysleep 1
sudo pmset -a powernap 0
sudo pmset -a hibernatemode 0

# Verify settings
pmset -g

الخطوة 7: الاختبار من جهاز آخر على الشبكة المحلية LAN

bash
# Desde cualquier portátil/teléfono/tableta en la misma red:
curl http://macmini.local:11434/api/chat -d '{
  "model": "llama3.1:8b",
  "messages": [{"role": "user", "content": "¡Hola desde mi teléfono!"}]
}'

الوصول عن بُعد: استخدم خادم الذكاء الاصطناعي Mac Mini من أي مكان

خياران للوصول إلى خادم الذكاء الاصطناعي Mac Mini من خارج شبكتك المنزلية: Tailscale (موصى به للاستخدام الشخصي) وCloudflare Tunnel (لنقاط نهاية يمكن الوصول إليها عبر الويب).

bash
# Opción 1: Tailscale (Recomendado) — instalar en Mac Mini
brew install --cask tailscale
# Inicia sesión con la app de Tailscale — Mac Mini obtiene una IP privada
# Accede desde cualquier lugar con Tailscale instalado:
curl http://macmini.tailnet.ts.net:11434/api/chat -d '{...}'

# Opción 2: Cloudflare Tunnel (Acceso web)
brew install cloudflared
cloudflared tunnel create ai-server
cloudflared tunnel route dns ai-server ai.tudominio.com
# Accesible en https://ai.tudominio.com desde cualquier lugar

أربع حالات استخدام حقيقية لخادم الذكاء الاصطناعي Mac Mini

يغطي خادم الذكاء الاصطناعي Mac Mini أربع حالات استخدام رئيسية. كل واحدة هي سير عمل مستقل — يمكنك تشغيل الأربع في آنٍ واحد على M5 Pro 64 GB.

حالة الاستخدام 1: خادم ذكاء اصطناعي عائلي للمنزل

يوجد Mac Mini في خزانة يعمل 24/7. جميع أجهزة الشبكة المنزلية — هواتف وأجهزة لوحية وحواسيب محمولة — ترسل طلبات API إلى نفس نسخة Ollama. عائلة من 4 أفراد بأجهزة iPhone وiPad وMacBook يستخدمونه في آنٍ واحد.

تستخدم أجهزة iPhone تطبيق Atajos ← POST إلى macmini.local:11434. يستخدم مستخدمو MacBook إضافات Continue.dev أو Raycast. اضبط OLLAMA_NUM_PARALLEL=2 حتى يتمكن فردان من العائلة من المحادثة في آنٍ واحد مع Llama 3.3 8B.

يحل محل 4 اشتراكات ChatGPT Plus (80 دولارًا/شهر = 960 دولارًا/سنة). فترة استرداد تكلفة Mac Mini: ~15 شهرًا. من السنة الثانية إلى الخامسة: ادخار صافٍ.

حالة الاستخدام 2: خادم خاص للأسئلة والأجوبة على المستندات باستخدام RAG

المنظومة: Ollama (Llama 3.3 8B) + nomic-embed-text + ChromaDB. كل شيء يعمل على Mac Mini، يمكن الوصول إليه من الشبكة المحلية LAN. حالات الاستخدام: مستندات عائلية، عقود قانونية، أدلة تقنية، مكتبة وصفات، سجلات طبية، أوراق بحثية. كل شيء خاص. كل شيء قابل للبحث. كل شيء دون اتصال.

python
# Install ChromaDB via Docker
brew install --cask docker
docker run -d -p 8000:8000 -v ~/chromadb:/data chromadb/chroma

# Index documents (Python)
from langchain_community.embeddings import OllamaEmbeddings
from langchain_community.vectorstores import Chroma

embeddings = OllamaEmbeddings(
    model="nomic-embed-text",
    base_url="http://localhost:11434"
)
vectordb = Chroma.from_documents(
    documents=splits,
    embedding=embeddings,
    persist_directory="./chroma_db"
)

حالة الاستخدام 3: مساعد صوتي دائم التشغيل

المنظومة على Mac Mini: whisper.cpp لـ STT (مُسرّع بـ Metal)، Ollama Llama 3.3 8B للاستدلال، Piper TTS لإخراج الصوت، بروتوكول Wyoming للتكامل مع Home Assistant.

يُفعّل بكلمة تنشيط من أجهزة العميل (Apple HomePod عبر Home Assistant، أو مصفوفات ميكروفونات Raspberry Pi في كل غرفة). زمن الاستجابة من الطرف إلى الطرف على M5 Pro: 1.2 ثانية (STT 0.3 ث + LLM 0.7 ث + TTS 0.2 ث).

الكهرباء السنوية: 35 دولارًا. خدمة سحابية مماثلة (Alexa Plus بـ 20 دولارًا/شهر): 240 دولارًا/سنة. وفّر أكثر من 200 دولار سنويًا مع إبقاء جميع بيانات الصوت خاصة.

حالة الاستخدام 4: وكيل برمجي خاص (التكامل مع IDE)

هيّئ Continue.dev أو Cursor لاستخدام API الخاص بـ Mac Mini. يتفوق DeepSeek Coder V2 بحجم 16B على GitHub Copilot في عدة اختبارات أداء للغات — مع إبقاء كل الشيفرة خاصة ودون اتصال.

  • 0 دولار/سنة (مقابل GitHub Copilot بـ 10 دولارات/شهر لكل مستخدم)
  • الشيفرة لا تغادر شبكتك أبدًا
  • يعمل دون اتصال (الطائرات، المكاتب الآمنة)
  • يتفوق DeepSeek Coder V2 على Copilot في اختبارات أداء Go وPython وTypeScript
json
// ~/.continue/config.json
{
  "models": [{
    "title": "Mac Mini DeepSeek Coder",
    "provider": "ollama",
    "model": "deepseek-coder-v2:16b",
    "apiBase": "http://macmini.local:11434"
  }]
}

الاستهلاك الكهربائي والأداء الحراري

قياسات على Mac Mini M5 Pro 64 GB يشغّل Ollama بتسريع Metal. تُحسب تكلفة الكهرباء على أساس 0.15 دولار/كيلوواط ساعة.

  • درجة حرارة السطح تحت الحمل: 35–42 °م (دافئ عند اللمس)
  • درجة الحرارة الداخلية لـ CPU: 65–75 °م (أقل بكثير من عتبة الخفض)
  • المروحة: لا تعمل أبدًا في M5 الأساسي؛ تشغيل قصير بعدد دورات منخفض في M5 Pro أثناء الذروات
  • لا خفض حراري ملحوظ في اختبارات 30 يومًا من التشغيل المتواصل
  • التهوية: يُوصى بمساحة مفتوحة — لا تضعه في خزانة مغلقة
  • متانة SSD: 600 TBW نموذجيًا = ~30 سنة بأنماط كتابة خادم الذكاء الاصطناعي
عبء العملالاستهلاكالتكلفة السنوية (24/7، 0.15 دولار/ك.و.س)
خمول8 واط~10 دولارات/سنة
استدلال Llama 8B25–35 واط~39 دولارًا/سنة
استدلال Llama 34B40–55 واط~63 دولارًا/سنة
حمل مختلط معتاد15–25 واط~26 دولارًا/سنة

متوسط الكهرباء السنوية لحمل مختلط معتاد: 26–39 دولارًا. سنة كاملة من التشغيل 24/7 تكلّف أقل من شهر واحد من ChatGPT Plus.

استهلاك Mac Mini M5 Pro للطاقة حسب عبء العمل: 8 واط في الخمول، 25–35 واط عند استدلال Llama 8B، 40–55 واط عند استدلال Llama 34B — مقابل 200–300 واط لجهاز مكتبي بـ RTX 4070.
استهلاك Mac Mini M5 Pro للطاقة حسب عبء العمل: 8 واط في الخمول، 25–35 واط عند استدلال Llama 8B، 40–55 واط عند استدلال Llama 34B — مقابل 200–300 واط لجهاز مكتبي بـ RTX 4070.

المراقبة والصيانة للتشغيل 24/7

احفظ سكربت فحص السلامة هذا باسم ~/check-ai-server.sh — شغّله عبر cron أو launchd كل ساعة لإعادة تشغيل Ollama تلقائيًا إذا تعطّل.

  • شهريًا: حدّث Ollama بـ `brew upgrade ollama`
  • شهريًا: حدّث النماذج بـ `ollama pull llama3.1:8b` (ينزّل أحدث إصدار)
  • شهريًا: نظّف النماذج غير المستخدمة بـ `ollama list` ثم `ollama rm <model-name>`
  • شهريًا: طبّق تحديثات macOS من إعدادات النظام ← تحديث البرنامج
  • شهريًا: أعد تشغيل Mac Mini (تنظيف الذاكرة، يزيل أي حالة متراكمة)
bash
#!/bin/bash
echo "=== AI Server Health Check ==="
echo "Date: $(date)"

if pgrep -x "ollama" > /dev/null; then
    echo "✓ Ollama running"
else
    echo "✗ Ollama NOT running - restarting"
    brew services restart ollama
fi

if curl -s http://localhost:11434/api/version > /dev/null; then
    echo "✓ API responding"
else
    echo "✗ API NOT responding"
fi

df -h / | tail -1
uptime

تحليل التكلفة الإجمالية للملكية على مدى 5 سنوات

  • فترة الاسترداد لعائلة من 4 تستبدل ChatGPT Plus: ~15 شهرًا
  • وكيل برمجي (يستبدل Copilot بـ 10 دولارات/مستخدم/شهر) — مطوّر واحد: مُسترد خلال 12 شهرًا
  • وكيل برمجي — فريق من 4 مطوّرين: مُسترد خلال 3 أشهر
  • وكيل برمجي — فريق من 10 أشخاص: مُسترد خلال 1.2 شهر
السنةخادم الذكاء الاصطناعي Mac Mini4× ChatGPT Plusالفرق
السنة 11,199 دولارًا عتاد + 35 دولارًا كهرباء = 1,234 دولارًا960 دولارًا−274 دولارًا (Mac أغلى في السنة 1)
السنة 235 دولارًا (كهرباء فقط)960 دولارًا+925 دولارًا تم ادخارها
السنة 335 دولارًا960 دولارًا+925 دولارًا تم ادخارها
السنة 435 دولارًا960 دولارًا+925 دولارًا تم ادخارها
السنة 535 دولارًا960 دولارًا+925 دولارًا تم ادخارها
إجمالي 5 سنوات1,374 دولارًا4,800 دولارًا+3,426 دولارًا تم ادخارها

تفترض التكلفة الإجمالية 960 دولارًا/سنة (4× ChatGPT Plus بـ 20 دولارًا/شهر لكل منها). جميع البيانات خاصة، بلا تكلفة لكل استعلام، مع تضمين العمل دون اتصال.

هل Mac Mini M5 أكثر هدوءًا من البدائل؟

نعم. M5 الأساسي بلا مروحة تمامًا. نادرًا ما تدور مروحة M5 Pro، وعندما تدور تكون هادئة جدًا. أجهزة PC مكتبية بـ GPU: ~50–70 ديسيبل. Mac Mini M5: 0 ديسيبل في الخمول، 20–25 ديسيبل لفترة وجيزة تحت حمل مكثف بـ 34B+.

هل يمكنني الوصول إلى Mac Mini عن بُعد؟

نعم — عبر SSH من الطرفية، أو بمشاركة الشاشة (VNC) من إعدادات النظام ← المشاركة ← الإدارة عن بُعد. على الشبكة المحلية LAN: ssh user@macmini.local. للوصول عن بُعد: استخدم Tailscale أولًا ثم SSH عبر IP الخاص بـ Tailscale.

ماذا أفعل إذا احتجت أداءً أعلى؟

مسار الترقية: Mac Studio M5 Max (128 GB، ~2,000 دولار) لسرعة 2× ودعم نماذج 70B. Mac Studio M5 Ultra (متوقع في 2026) لسرعة 4×. لمزارع الخوادم، اربط عدة أجهزة Mac Mini في رف ووازِن الحمل بـ Nginx.

كم تدوم Mac Mini كخادم ذكاء اصطناعي 24/7؟

أجهزة Mac بشريحة Apple Silicon مصممة للتشغيل المتواصل. العمر المتوقع: 7–10 سنوات للاستخدام كخادم ذكاء اصطناعي. متانة SSD (600 TBW نموذجيًا) تغطي 25–30 سنة من أحمال الذكاء الاصطناعي. معدل فشل العتاد السنوي أقل من 0.5%.

هل يمكنني خدمة عدة مستخدمين في آنٍ واحد؟

نعم. اضبط OLLAMA_NUM_PARALLEL=2 (أو أكثر مع مزيد من الذاكرة) لإدارة الطلبات المتزامنة. يتعامل M5 Pro 64 GB بأريحية مع 2–3 مستخدمين متزامنين بنماذج 8B، أو مع مستخدم واحد بمنظومات متعددة النماذج (LLM + رؤية + STT).

ماذا يحدث إذا فقد Mac Mini التيار الكهربائي؟

بعد عودة التيار، يُقلع macOS تلقائيًا إذا فعّلت "البدء تلقائيًا بعد انقطاع التيار" في إعدادات النظام ← الطاقة. يُقلع Ollama كخدمة brew. تُعاد النماذج عند أول طلب (تأخير 5–15 ث في أول استجابة بعد إعادة التشغيل).

هل يمكنني إضافة GPU خارجي إلى Mac Mini لاستدلال أسرع؟

لا. لا تدعم Apple Silicon وحدات GPU خارجية لتسريع Metal/ML. بنية الذاكرة الموحدة هي التصميم — لا يمكن إضافة GPU منفصل. لمزيد من السرعة، رقِّ إلى Mac Studio M5 Max.

هل Mac Mini قوي جدًا أم غير كافٍ لخادم ذكاء اصطناعي؟

لمنازل من 1–4 أشخاص أو فرق صغيرة تشغّل نماذج 8B–34B: مناسب تمامًا. لنماذج 70B: غير كافٍ (يلزم Mac Studio M5 Max 128 GB). لنماذج صغيرة بميزانية هواة: قوي جدًا (Raspberry Pi 5 يغطي فقط نماذج 1–3B، غير كافٍ لأي استخدام عملي في 2026).

هل أنت مستعد لإعداد Ollama على Mac Mini M5 لديك؟ إليك دليل التثبيت الكامل.

Ollama على Mac — دليل الإعداد 2026 ←

A Note on Third-Party Facts

This article references third-party AI models, benchmarks, prices, and licenses. The AI landscape changes rapidly. Benchmark scores, license terms, model names, and API prices can shift between the time of writing and the time you read this. Before making deployment or compliance decisions based on this article, verify current figures on each provider’s official source: Hugging Face model cards for licenses and benchmarks, provider websites for API pricing, and EUR-Lex for current GDPR and EU AI Act text. This article reflects publicly available information as of May 2026.

هل لديك بالفعل خادم الذكاء الاصطناعي Mac Mini يعمل؟ قارن إجابات Llama أو DeepSeek المحلي لديك مع GPT-4 وClaude وGemini و22 نموذجًا آخر في إرسال واحد عبر PromptQuorum — تحقق من أن إعدادك المستضاف ذاتيًا يقدم إجابات بجودة السحابة لحالات استخدامك.

Join the PromptQuorum Waitlist →

← Back to Local LLMs