Skip to main content
PromptQuorum
الرئيسية/LLM المحلية المتقدمة/أفضل محطة عمل للذكاء الاصطناعي المحلي ⁨2026⁩: ثلاثة مستويات ميزانية
Overview & Reference

أفضل محطة عمل للذكاء الاصطناعي المحلي ⁨2026⁩: ثلاثة مستويات ميزانية

··بقلم Hans Kuepper · مؤسس PromptQuorum، أداة إرسال الذكاء الاصطناعي متعددة النماذج · PromptQuorum

**أفضل محطة عمل للذكاء الاصطناعي المحلي في 2026 لمعظم المستخدمين هي المبنية بنحو 20,600 درهم: RTX 4090 (24 GB VRAM) + Ryzen 9 9950X + 64 GB DDR5. تُشغّل نماذج 7B بسرعة 100–120 رمز/ثانية، و14B بتكميم Q8 بدون تفريغ، و30B Q4 بسرعة 25–35 رمز/ثانية. انتقل مباشرةً إلى المستوى: اقتصادي ~10,500 درهم · موصى به ~20,600 درهم · احترافي ~34,000 درهم.**

تحتوي هذه الصفحة على روابط مرجعية لمنتجات طرف ثالث. لا يشارك PromptQuorum في أي برنامج تابع — هذه روابط عادية لا تدر أي عمولة. النقر على الروابط والخطوات التالية تقع على عاتقك بالكامل. لا تمثل هذه الروابط أي تأييد أو تحقق من قِبَل PromptQuorum.

عرض مكونات الإعداد الاقتصادي →رابط منتج · مُفصح عنهعرض مكونات الإعداد الموصى به →رابط منتج · مُفصح عنهعرض مكونات الإعداد الاحترافي →رابط منتج · مُفصح عنه
أفضل محطة عمل للذكاء الاصطناعي المحلي ⁨2026⁩: ثلاثة مستويات ميزانية

النقاط الرئيسية

  • تظل RTX 4090 أفضل GPU استهلاكية مفردة للذكاء الاصطناعي المحلي في 2026: 24 GB VRAM، عرض نطاق ~1 TB/ثانية — وسعرها المستعمل انخفض قليلاً منذ الربيع
  • نقص الذاكرة العالمي في 2026 يثقل الميزانية أكثر من تغيّر سعر GPU — ارتفعت أسعار عبوات DDR5 سعة 64 جيجابايت 3–6 أضعاف منذ مايو
  • نماذج 70B Q4 تحتاج أكثر من 40 GB VRAM — تتطلب RTX 3090 مزدوجة أو CPU offloading
  • Ryzen 9 9950X (Zen 5، 16 نواة) هو المكوّن الوحيد الذي أصبح أرخص خلال هذه الفترة
  • NVMe PCIe Gen 4/5 يُحمّل نموذج 7B في أقل من ثانيتين، لكن قرص Gen 5 سعة 4 تيرابايت أصبح أغلى بكثير الآن
  • المستويان 1 و2 يتشاركان مقبس AM5 — قم بترقية GPU/RAM دون تغيير اللوحة الأم؛ المستوى 3 يتطلب TRX50

أي محطة عمل يجب أن تبني؟

اختر إعدادك حسب أكبر نموذج تحتاج فعلياً لتشغيله: 7B–14B → اقتصادي. 14B–32B → موصى به. 70B → احترافي. الأسعار أدناه هي إجمالي النظام الكامل، محدَّثة حتى 25 أغسطس 2026.

اقتصاديموصى بهاحترافي
السعر~10,500 درهم~20,600 درهم~34,000 درهم
GPURTX 3090 24GB (مستعملة)RTX 4090 24GB2× RTX 3090 (48GB)
CPURyzen 7 7700XRyzen 9 9950XThreadripper 7960X
RAM64GB DDR564GB DDR5-6000256GB DDR5 ECC
أكبر نموذج32B Q4 على GPU30B Q4 GPU / تفريغ 70B70B Q4 بسرعة GPU
الأنسب لـميزانية محدودة، 7B–14Bمعظم المستخدمين، 14B–32Bأعباء 70B، مستخدمون متعددون

كل إجمالي أدناه أعلى من الأسعار المذكورة في مصادر أخرى خلال 2026 — هذا بسبب نقص DDR5/NAND (انظر الملاحظة بعد جداول المستويات)، وليس خطأً. أما أسعار GPU فمستقرة أو منخفضة قليلاً.

عرض مكونات الإعداد الاقتصادي →رابط منتج · مُفصح عنهعرض مكونات الإعداد الموصى به →رابط منتج · مُفصح عنهعرض مكونات الإعداد الاحترافي →رابط منتج · مُفصح عنه

VRAM هو ما يحدد إعدادك

غير متأكد من المستوى الذي تحتاجه؟ ابدأ من أكبر نموذج تخطط فعلياً لاستخدامه، لا الذي قد تستخدمه يوماً ما.

حجم النموذجVRAM الموصى بهأفضل إعداد
7B8–12 GBاقتصادي (RTX 3090 بهامش كافٍ)
14B16–24 GBاقتصادي أو موصى به
32B Q4~20–24 GBموصى به (RTX 4090)
70B Q4~40 GB+احترافي (RTX 3090 مزدوجة) أو تفريغ على الموصى به
70B Q8~70 GB+GPU متعددة فقط — راجع دليل GPU

تريد GPU مفردة فقط (وليس إعداداً كاملاً)؟ راجع دليل شراء GPU.

المستوى 1: محطة عمل ذكاء اصطناعي اقتصادية بنحو 10,500 درهم

يستخدم الإعداد الاقتصادي RTX 3090 مستعملة (24 GB VRAM) كنواة. يُشغّل Llama 3.1 8B Q8 بسرعة 45–60 رمز/ثانية، وQwen3 14B Q8 بسرعة 20–28 رمز/ثانية، وQwen3 32B Q4 بسرعة 12–18 رمز/ثانية بالكامل على GPU. اختر هذا الإعداد إذا: ميزانيتك أقل من 11,500 درهم، وتستخدم أساساً نماذج 7B–32B، ولا تمانع شراء GPU مستعملة. تخطَّه إذا: كان 70B هو عبء العمل الرئيسي — التفريغ إلى CPU في هذا المستوى يعمل بسرعة 5–8 رمز/ثانية، عملي لكنه بطيء.

  • النماذج المتوافقة بسرعة GPU كاملة: 7B (أي تكميم)، 13B (Q4/Q8)، 14B (Q4/Q8)، 30B (Q4)
  • دعم 70B: يتطلب CPU offloading — ~5–8 رموز/ثانية، عملي لكن ليس مثالياً
  • استهلاك الطاقة: ~450 واط في الذروة (GPU 350 واط + CPU 65 واط + الباقي)
المكوّنالطرازالسعر (أغسطس 2026)
GPUNVIDIA RTX 3090 (مستعملة، 24 GB)~3,300 درهم
CPUAMD Ryzen 7 7700X~850 درهم
اللوحة الأمMSI MAG X670E Tomahawk WiFi~730 درهم
RAM64 GB DDR5-5600 (2×32 GB)~3,300 درهم (مايو: ~425 درهم)
التخزين2 TB PCIe Gen 4 NVMe~1,350 درهم (مايو: ~347 درهم)
مزود الطاقة850 واط معتمد 80+ Gold~425 درهم
الهيكلبرج متوسط ATX، 3+ فتحات مراوح~310 درهم
مبرد CPUAIO 240mm أو برج~270 درهم
الإجمالي~10,535 درهم
مقارنة بين ثلاث فئات من محطات عمل الذكاء الاصطناعي المحلي حسب العتاد: الفئة الاقتصادية تستخدم RTX 3090 (24 جيجابايت VRAM) لتشغيل نماذج 70B بسرعة 5-8 tok/s عبر تفريغ المعالج، الفئة الموصى بها تستخدم RTX 4090 (24 جيجابايت VRAM) بسرعة 10-15 tok/s، والفئة الاحترافية تستخدم بطاقتي RTX 3090 (48 جيجابايت VRAM إجمالاً) بسرعة 25-40 tok/s على المعالج الرسومي.
مقارنة بين ثلاث فئات من محطات عمل الذكاء الاصطناعي المحلي حسب العتاد: الفئة الاقتصادية تستخدم RTX 3090 (24 جيجابايت VRAM) لتشغيل نماذج 70B بسرعة 5-8 tok/s عبر تفريغ المعالج، الفئة الموصى بها تستخدم RTX 4090 (24 جيجابايت VRAM) بسرعة 10-15 tok/s، والفئة الاحترافية تستخدم بطاقتي RTX 3090 (48 جيجابايت VRAM إجمالاً) بسرعة 25-40 tok/s على المعالج الرسومي.

💡Tip: مستعملة مقابل جديدة: بطاقات RTX 3090 المستعملة توفّر 30–50% مقارنة بالمخزون الجديد القليل المتبقي، مقابل ضمان غير مؤكد. اختر بائعاً يقبل الإرجاع وتحقّق من علامات استخدامها في التعدين (ضوضاء المروحة، رائحة احتراق تحت الحِمل).

RTX 3090 مستعملة على eBay →رابط منتج · مُفصح عنهAMD Ryzen 7 7700X على noon →رابط منتج · مُفصح عنهعرض الإعداد الاقتصادي كاملاً →رابط منتج · مُفصح عنه

المستوى 2: محطة عمل ذكاء اصطناعي موصى بها بنحو 20,600 درهم

يتمحور الإعداد الموصى به حول RTX 4090 (24 GB، ~1 TB/ثانية عرض نطاق الذاكرة) مقرونةً بـAMD Ryzen 9 9950X (Zen 5، 16 نواة). RTX 4090 أسرع بنسبة 30–40% من RTX 3090 لكل جيجابايت VRAM. اختر هذا الإعداد إذا: تريد أفضل محطة عمل بمعالج رسومي واحد، وتستخدم نماذج 14B–32B بانتظام، وتُفرّغ 70B أحياناً. تخطَّه إذا: كان 70B عبء عملك اليومي الرئيسي — اختر الاحترافي لسرعة GPU مع 70B.

  • سرعة 7B Q4: ~105–125 رمز/ثانية في Ollama
  • سرعة 14B Q8: ~48–60 رمز/ثانية
  • سرعة 30B Q4: ~28–38 رمز/ثانية
  • 70B Q4 (تفريغ CPU): ~10–15 رمز/ثانية مع 64 GB RAM
  • استهلاك الطاقة: ~550 واط في الذروة
المكوّنالطرازالسعر (أغسطس 2026)
GPUNVIDIA GeForce RTX 4090 24 GB~8,500 درهم
CPUAMD Ryzen 9 9950X (16C/32T، Zen 5)~1,900 درهم
اللوحة الأمASUS ProArt X870E-Creator WiFi~2,000 درهم
RAM64 GB DDR5-6000 CL30 (2×32 GB)~3,450 درهم (مايو: ~560 درهم)
التخزين4 TB PCIe Gen 5 NVMe~3,100 درهم (مايو: ~770 درهم)
مزود الطاقة1000 واط معتمد 80+ Platinum~700 درهم
الهيكلبرج كامل ATX مع تدفق هواء جيد~540 درهم
مبرد CPUAIO 360mm~425 درهم
الإجمالي~20,615 درهم
RTX 4090 — تحقّق من السعر الحالي →رابط منتج · مُفصح عنهRyzen 9 9950X على noon →رابط منتج · مُفصح عنهعرض الإعداد الموصى به كاملاً →رابط منتج · مُفصح عنه

المستوى 3: محطة عمل احترافية لنماذج 70B بنحو 34,000 درهم

الإعداد الاحترافي موجّه للاستدلال على نماذج 70B بسرعة GPU (25–40 رمز/ثانية) باستخدام RTX 3090 مزدوجتين لإجمالي 48 GB VRAM. يُسرّع Ryzen Threadripper 7960X (24 نواة) CPU offloading. مع 256 GB DDR5 ECC، حتى النماذج 140B المكمّمة تُحمَّل بالكامل في RAM. اختر هذا الإعداد إذا: كان 70B عبء عملك الرئيسي، أو تحتاج 48 GB+ من VRAM، أو تخدم عدة مستخدمين متزامنين. تخطَّه إذا: لم تُشغّل قط نموذجاً أكبر من 32B — هذا المستوى مبالغ فيه في هذه الحالة.

  • سرعة 70B Q4: 25–40 رمز/ثانية (كلتا RTX 3090 نشيطتان عبر توازي الموترات في Ollama)
  • CPU offloading مع 256 GB RAM: يُشغّل نماذج 140B+ بسرعة 4–6 رموز/ثانية
  • استهلاك الطاقة: ~900 واط في الذروة
المكوّنالطرازالسعر (أغسطس 2026)
GPU ×22× NVIDIA RTX 3090 24 GB (مستعملة)~6,550 درهم
CPUAMD Ryzen Threadripper 7960X (24C)~5,400 درهم (متذبذب — لوحظ 3,700–8,600 درهم)
اللوحة الأمASUS Pro WS TRX50-SAGE WiFi~3,100 درهم
RAM256 GB DDR5-5200 ECC (8×32 GB)~10,800 درهم (مايو: ~2,500 درهم — تحقّق قبل الشراء)
التخزين8 TB PCIe Gen 4 NVMe (2×4 TB)~5,400 درهم (مايو: ~1,390 درهم)
مزود الطاقة1600 واط Platinum معياري~1,350 درهم
الهيكلبرج كامل HEDT ATX~850 درهم
مبرد CPUAIO 360mm + مراوح إضافية~580 درهم
الإجمالي~34,030 درهم
شجرة قرار لاختيار فئة محطة عمل الذكاء الاصطناعي المحلي حسب أكبر حجم نموذج: الإعدادات حتى 30B تقود إلى الفئة الاقتصادية (RTX 3090) أو الموصى بها (RTX 4090)، بينما إعدادات 70B تقود إلى الفئة الموصى بها عبر تفريغ المعالج (10-15 tok/s) أو إلى الفئة الاحترافية ببطاقتي RTX 3090 بسرعة كاملة للمعالج الرسومي (25-40 tok/s).
شجرة قرار لاختيار فئة محطة عمل الذكاء الاصطناعي المحلي حسب أكبر حجم نموذج: الإعدادات حتى 30B تقود إلى الفئة الاقتصادية (RTX 3090) أو الموصى بها (RTX 4090)، بينما إعدادات 70B تقود إلى الفئة الموصى بها عبر تفريغ المعالج (10-15 tok/s) أو إلى الفئة الاحترافية ببطاقتي RTX 3090 بسرعة كاملة للمعالج الرسومي (25-40 tok/s).

⚠️Warning: نقص DDR5 في 2026 أثّر بأشد قوة على ذاكرة الخوادم ECC/RDIMM — عبوات DDR5 ECC سعة 256 جيجابايت نادرة ومتقلبة السعر. احصل على عرض سعر مباشر لذاكرة مدرجة في قائمة QVL الخاصة باللوحة الأم قبل الطلب.

2× RTX 3090 على eBay →رابط منتج · مُفصح عنهRyzen Threadripper 7960X على noon →رابط منتج · مُفصح عنهعرض الإعداد الاحترافي كاملاً →رابط منتج · مُفصح عنه

عتاد لن نشتريه لهذا الاستخدام

  • GPU بذاكرة 8 GB إذا كان الهدف نماذج 32B — ستصطدم بحائط VRAM فوراً
  • CPU باهظة الثمن مع GPU غير كافية — سرعة الاستدلال يحددها GPU وVRAM أكثر بكثير من سرعة CPU
  • قرص SATA SSD لمحطة عمل ذكاء اصطناعي جديدة — تحميل النماذج أبطأ 5 مرات من PCIe Gen 4 NVMe مقابل فرق سعر بسيط
  • مزود طاقة غير كافٍ — تصل الفئة الاحترافية إلى ذروة قرابة 900 واط
  • 64GB RAM لتفريغ 70B جاد على CPU بذاكرة 32GB فقط — النموذج نفسه يحتاج نحو 40 GB فقط ليستقر في الذاكرة

هل تبني محطة عمل أم تستأجر GPU سحابية؟

محطة عمل محلية مقابل استئجار GPU سحابية

استخدم LLM محليًا إذا:

  • تستخدم النماذج المحلية أكثر من ساعتين يومياً
  • الخصوصية أو مكان تخزين البيانات مهم لعملك
  • تريد تكلفة ثابتة ومتوقعة على المدى الطويل
  • قررت بالفعل أحد المستويات أعلاه

استخدم نموذجًا سحابيًا إذا:

  • تستخدم النماذج المحلية أقل من ساعة يومياً
  • استخدامك عرضي أو متقطع (مهام دفعية، اختبارات)
  • لا تريد التعامل مع صيانة العتاد
  • تريد تجربة نموذج 70B+ قبل الاستثمار في العتاد

قرار سريع:

  • استخدام يومي مكثف ← ابنِ محطة العمل (راجع جداول المستويات أعلاه)
  • استخدام عرضي/تقييمي ← استأجر GPU سحابية
  • غير متأكد؟ راجع جدول فترة الاسترداد أدناه
  • قارن مزودي GPU السحابية ←

مكدس البرامج لأي إعداد

بعد تجميع الأجهزة، يستغرق تشغيل Ollama أقل من 10 دقائق:

  1. 1
    ثبّت Ubuntu 22.04 LTS أو Windows 11 (Ubuntu مفضّل لاستقرار CUDA)
  2. 2
    ثبّت تعريفات NVIDIA 550+ من nvidia.com أو بأمر ubuntu-drivers autoinstall
  3. 3
    ثبّت Ollama: curl -fsSL https://ollama.com/install.sh | sh
  4. 4
    حمّل نموذجاً: ollama pull qwen2.5:14b-instruct-q8_0
  5. 5
    شغّل كخادم شبكة: OLLAMA_HOST=0.0.0.0 ollama serve
  6. 6
    ثبّت Open WebUI للواجهة في المتصفح: docker run -d -p 3000:8080 --gpus all ghcr.io/open-webui/open-webui:cuda
  7. 7
    استخدم Tailscale للوصول الآمن عن بُعد من أي جهاز

مقارنة الأداء في الإعدادات الثلاثة

أداء العتاد لم يتغيّر منذ قياسات أوائل 2026 — الأسعار فقط هي التي تغيّرت.

النموذج + التكميماقتصادي (~10,500 درهم)موصى به (~20,600 درهم)احترافي (~34,000 درهم)
Llama 3.1 8B Q455–70 رمز/ثانية105–125 رمز/ثانية120–140 رمز/ثانية
Qwen3 14B Q820–28 رمز/ثانية48–60 رمز/ثانية55–70 رمز/ثانية
Qwen3 32B Q412–18 رمز/ثانية28–38 رمز/ثانية40–55 رمز/ثانية
Llama 3.3 70B Q45–8 رمز/ثانية (CPU)10–15 رمز/ثانية (CPU)25–40 رمز/ثانية (GPU)
Mixtral 8x22B Q415–22 رمز/ثانية32–45 رمز/ثانية45–60 رمز/ثانية

إجمالي تكلفة الملكية: محطة العمل مقابل GPU السحابية

ارتفعت تكلفة عتاد الإعداد الموصى به نحو 29% منذ مايو 2026 (RAM والتخزين، وليس GPU) — وتغيّرت فترة الاسترداد مقابل الاستئجار السحابي تبعاً لذلك.

الاستخدامتكلفة السحابة/سنة (A40 بسعر 0.44$/ساعة)تكلفة كهرباء محطة العمل/سنةالاسترداد مقابل السحابة
ساعتان/يوم~1,190 درهم~215 درهم~19 سنة — السحابة أفضل
4 ساعات/يوم~2,380 درهم~430 درهم~11 سنة
8 ساعات/يوم~4,760 درهم~860 درهم~5.5 سنة

عند أسعار العتاد المرتفعة في 2026، لا تتفوق محطة العمل بوضوح في حساب التكلفة الصرف إلا بدءاً من نحو 5 ساعات/يوم من الاستخدام. الخصوصية والاستقلالية عن توفر السحابة أسباب مستقلة لاختيار المحلي بغض النظر عن فترة الاسترداد.

هل من الأفضل بناء محطة عمل أم استئجار GPU سحابية لتشغيل نماذج 70B؟

للاستخدام المنتظم (6+ ساعات يومياً)، ابنِ محطة العمل. تكلّف A40 مخصصة بسعة 48 GB في RunPod 0.44 دولار/ساعة — بـ4 ساعات يومياً، هذا نحو 2,380 درهم سنوياً. عند أسعار العتاد المرتفعة في 2026، يسترد الإعداد الموصى به (~20,600 درهم) تكلفته خلال نحو 11 سنة بهذا المعدل، أو أقل من 5.5 سنة عند 8 ساعات يومياً. للاستخدام العرضي (أقل من ساعتين يومياً)، السحابة أكثر اقتصاداً.

لماذا كلّف هذا الإعداد أكثر بكثير من أدلة 2026 الأخرى؟

RAM وتخزين NVMe، وليس GPU. أدى نقص عالمي في DDR5/NAND خلال 2026 — إذ حوّلت شركات الذاكرة طاقتها الإنتاجية نحو شرائح HBM لمراكز بيانات الذكاء الاصطناعي — إلى ارتفاع أسعار عبوات DDR5 سعة 64 جيجابايت وأقراص NVMe سعة 4 تيرابايت بشكل حاد بين مايو وأغسطس. أسعار GPU، في المقابل، ظلت مستقرة أو انخفضت قليلاً خلال الفترة نفسها.

هل أشتري RTX 3090 مستعملة أم جديدة؟

المستعملة هي الخيار المعتاد في 2026 — توقف الإنتاج عام 2022، لذا "الجديدة" ما هي إلا مخزون قديم بسعر مرتفع. تحقّق من ضوضاء المروحة المفرطة أو رائحة الاحتراق تحت الحِمل (علامات استخدام في التعدين)، وفضّل بائعاً يقبل الإرجاع.

هل أحتاج إلى NVLink لتشغيل Ollama على GPU مزدوجة؟

لا. يستخدم Ollama توازي الموترات CUDA لتوزيع طبقات النموذج على عدة GPU عبر PCIe — NVLink غير مطلوب. إعداد RTX 3090 المزدوجة يعمل بشكل ممتاز بدون NVLink.

لماذا RTX 3090 مزدوجة بدلاً من RTX 4090 واحدة للإعداد الاحترافي؟

VRAM هو العامل الحاسم. RTX 3090 مزدوجتان بـ24 GB كل منهما = 48 GB إجمالاً، وهو كافٍ لـLlama 3.3 70B Q4 (~40 GB). RTX 4090 المفردة لديها 24 GB فقط — نموذج 70B Q4 لا يتسع بدون CPU offloading.

ترقيات تستحق الاستثمار إذا كنت تتوقع النمو

ثلاث ترقيات تستحق الإنفاق إذا كنت تعتقد أنك ستتجاوز مستواك الحالي خلال عام:

  • RAM: 64GB ← 128GB — مفيد لنماذج 70B المُفرَّغة على CPU في المستوى الموصى به
  • التخزين: 2TB ← 4TB — مفيد إذا كنت تحتفظ بأكثر من 3–4 نماذج كبيرة مثبّتة في آنٍ واحد
  • التبريد: AIO 240mm ← 360mm — أهم في المستويين الموصى به والاحترافي
عرض عبوات DDR5 سعة 128GB →رابط منتج · مُفصح عنهعرض أقراص NVMe سعة 4TB →رابط منتج · مُفصح عنه

أي محطة عمل يجب أن تشتري؟

لا تزال متردداً؟ ابدأ بالإعداد الموصى به RTX 4090 — يقدّم أفضل توازن بين الأداء وVRAM واستهلاك الطاقة وإمكانية الترقية لمعظم مستخدمي الذكاء الاصطناعي المحلي.

1

💰 أقل من 11,500 درهم — الإعداد الاقتصادي

~10,500 درهم · RTX 3090 24GB

يُشغّل أي نموذج حتى 32B Q4 بالكامل على GPU.

عرض الإعداد الاقتصادي →رابط منتج · مُفصح عنه
2

⭐ الأفضل إجمالاً — الإعداد الموصى به

~20,600 درهم · RTX 4090 24GB

أفضل توازن بين الأداء وVRAM والسعر لمعظم المستخدمين.

عرض الإعداد الموصى به →رابط منتج · مُفصح عنه
3

🚀 70B/احترافي — الإعداد الاحترافي

~34,000 درهم · RTX 3090 مزدوجة (48GB)

استدلال 70B بسرعة GPU (25–40 رمز/ثانية). فقط للاستخدام اليومي لنماذج 70B.

عرض الإعداد الاحترافي →رابط منتج · مُفصح عنه

قراءة ذات صلة

← العودة إلى LLM المحلية المتقدمة