Key Takeaways
- RTX 4090: 575W. تتطلب مزود طاقة 1200W وتدفق هواء ممتاز في الصندوق.
- RTX 4080: 320W. تتطلب مزود طاقة 850W وتدفق هواء جيد.
- RTX 4070 Ti: 290W. تتطلب مزود طاقة 750W وتدفق هواء كافٍ.
- M5 Max Mac: 25–35W للاستدلال (كفاءة عالية للغاية).
- تكلفة التشغيل على مدار الساعة: RTX 4090 = 50–70$ شهريًا، RTX 4070 Ti = 20–25$ شهريًا.
- اعتبارًا من أبريل 2026، التبريد أمر حاسم. تدفق الهواء الضعيف يقلّل العمر الافتراضي ويحدّ من الأداء.
كم تستهلك كل GPU من الطاقة في استدلال LLM؟
تستهلك RTX 4090 وRTX 5090 قدرة 575W عند الحمل الكامل — أعلى مستوى متاح لنماذج LLM المحلية. استهلاك طاقة GPU هو العامل المهيمن في اختيار مزود الطاقة وفي فاتورة الكهرباء.
ملاحظة: تمتلك RTX 4090 من NVIDIA قدرة TDP أساسية تبلغ 450W، لكن الاستدلال في الواقع قد يصل إلى 575W تحت الحمل المستمر. تأتي RTX 5090 بقدرة TDP أصلية تبلغ 575W. تُعد AMD RX 7900 XTX أقوى GPU منفصلة من غير NVIDIA لنماذج LLM المحلية بقدرة 355W و24 GB من ذاكرة VRAM. يستهلك Apple M5 Max طاقة أقل بـ10 مرات لكل token من RTX 4090 — الخيار الأكثر كفاءة للاستدلال المستمر على مدار الساعة.
| GPU | Consumo | Reposo | Fuente |
|---|---|---|---|
| RTX 5090 | 575W | 20W | 1200W+ |
| RTX 4090 | 450W (575W حد أقصى) | 10W | 1200W+ |
| RTX 5080 | 360W | 15W | 1000W |
| RTX 4080 | 320W | 8W | 850W+ |
| RTX 5070 | 250W | 12W | 800W |
| RTX 4070 Ti | 285W | 7W | 750W+ |
| RTX 4070 | 200W | 6W | 650W |
| AMD RX 7900 XTX | 355W | 25W | 850W |
| Apple M5 Max (GPU) | 25–35W | 1W | مدمج |
| Apple M5 Pro (GPU) | 20–28W | 1W | مدمج |
⚠️Warning: قدرة TDP لـRTX 5090: تُقيّمها NVIDIA بـ575W، لكن الذروات في الواقع قد تصل إلى 600W+ حسب إعداد حد الطاقة.
كم يستهلك حاسوب LLM محلي من الطاقة إجمالاً؟
ليست GPU المستهلك الوحيد للطاقة. ضع في اعتبارك أيضًا المعالج CPU وذاكرة RAM والتخزين واللوحة الأم:
| Componente | Consumo | Notas |
|---|---|---|
| GPU (RTX 4090) | 575W | ذروات عند استخدام 100% |
| CPU (Ryzen 9 7950X) | 170W | تحت الحمل |
| اللوحة الأم + RAM + SSD | 100W | نموذجي |
| مراوح التبريد، هامش مزود الطاقة | 50–100W | هامش أمان |
| إجمالي حمل النظام | ~895–945W | يتطلب مزود طاقة 1200W كحد أدنى |
•Keypoint: تمثّل GPU نسبة 60–65% من إجمالي استهلاك النظام. يشكّل المعالج والتبريد والاستهلاك الإضافي النسبة المتبقية البالغة 35–40%.
كم تبلغ تكلفة تشغيل LLM محلي على مدار الساعة؟
بافتراض 0.12$/kWh (متوسط الولايات المتحدة):
kWh (كيلوواط-ساعة): ألف واط من الطاقة مُستخدمة لمدة ساعة. بسعر 0.12$/kWh، يستهلك تشغيل RTX 4090 بقدرة 600W لمدة 24 ساعة 14.4 kWh، بتكلفة 1.73$ يوميًا.
| GPU | Costo diario | Mensual | Anual |
|---|---|---|---|
| RTX 4090 (600W متوسط) | 1.73$ | 52$ | 625$ |
| RTX 4080 (350W متوسط) | 1.01$ | 30$ | 360$ |
| RTX 4070 Ti (300W متوسط) | 0.86$ | 26$ | 315$ |
| M5 Max Mac (30W متوسط) | 0.09$ | 2.60$ | 32$ |
💡Tip: تحديد قدرة RTX 4090 عند 350W يوفّر 40% من الكهرباء بخسارة سرعة لا تتجاوز ~10% — النقطة المثلى للاستدلال الكفء على نطاق واسع.
ما التبريد الذي تحتاجه لاستدلال LLM المحلي؟
التبريد المناسب أمر حاسم لعمر GPU الافتراضي (5+ سنوات) ولتجنّب الخنق الحراري.
تدفق هواء مناسب في الصندوق: تسحب المراوح الأمامية الهواء البارد، وتطرد الخلفية/العلوية الهواء الساخن. تحتاج RTX 4090 إلى صندوق واسع به 3+ مراوح.
درجة حرارة المحيط: مثاليًا 18–24°C. في المناخات الحارة (30°C+)، يصبح التبريد حاسمًا.
المعجون الحراري: استبدله كل 2–3 سنوات لنقل حراري مثالي (إن انطبق).
المراقبة: استخدم GPU-Z أو nvidia-smi لمراقبة درجات الحرارة. أبقها أقل من 80°C بشكل مستمر.
الخنق الحراري: خفض تلقائي لسرعة الساعة عندما تكتشف GPU درجات حرارة غير آمنة، لحماية الرقاقة من تلف الحرارة على حساب سرعة الاستدلال.
⚠️Warning: تخنق GPU نفسها فوق 83°C — ينخفض الأداء بين 10–20%. يسبب تدفق الهواء الضعيف خنقًا مستمرًا حتى عند 75°C في الغرف الحارة.
🛠️Practice: استخدم `nvidia-smi -q -d TEMPERATURE` لمراقبة درجة حرارة GPU باستمرار. اضبط التنبيهات عند 75°C لمنع الخنق.
حقائق سريعة
- ذروة استهلاك RTX 4090: 575W (GPU فقط)
- مزود الطاقة المطلوب: 1200W لنظام بـRTX 4090
- تكلفة التشغيل على مدار الساعة بسعر 0.12$/kWh: ~52$ شهريًا (RTX 4090)
- إجمالي استهلاك Apple M5 Max: 25–35W
- نسبة الكفاءة: يستخدم M5 Max طاقة أقل بـ~10 مرات لكل token من RTX 4090
- درجة حرارة GPU الآمنة: أبقها أقل من 83°C للاستدلال المستمر
💡Tip: Apple Silicon مقابل NVIDIA: الفائز في الكفاءة. يحقق M5 Max 65–85 token/ثانية — أسرع بـ4 مرات من الجيل M4 بالطاقة نفسها البالغة 25–35W فقط، بينما تتطلب RTX 4090 قدرة 600W لتحقيق 150 token/ثانية على النموذج نفسه.
أخطاء شائعة في الطاقة والتبريد
- اختيار مزود طاقة أقل من اللازم. RTX 4090 مع مزود طاقة 750W ستسبب إيقاف تشغيل تحت الحمل. خصّص دائمًا ضعف استهلاك GPU.
- تجاهل تدفق هواء الصندوق. تدفق الهواء الضعيف يسبب خنقًا حراريًا (~10% خسارة في الأداء) ويقصّر عمر GPU.
- التشغيل على مدار الساعة دون مراعاة التكاليف. تكلّف RTX 4090 50$ شهريًا من الكهرباء. ليس عمليًا للاستخدام الشخصي ما لم تستخدم الاستدلال باستمرار.
- عدم مراقبة درجة حرارة GPU. قد تعاني البطاقات من خنق صامت بسبب الإجهاد الحراري. راقب باستخدام nvidia-smi.
- نسيان نفقات التبريد في حسابات TCO. التبريد هو ثاني أكبر تكلفة بعد GPU نفسها. تشغيل إعداد GPU مزدوج في مناخ حار (30°C+ محيط) يتطلب ~200–400$ سنويًا في تكاليف تكييف إضافية للحفاظ على درجة حرارة محيط 22°C. يلغي Apple Silicon ذلك: يستهلك M5 Max 30W وينتج حرارة ضئيلة، دون حاجة لتبريد إضافي.
⚠️Warning: مزود طاقة 750W + RTX 4090 = إيقاف تشغيل عشوائي تحت الاستدلال المستمر. ذروات الطاقة الحقيقية تتجاوز قدرة مزود الطاقة، مما يسبب إيقاف تشغيل تلقائي لحماية المكونات.
تكاليف الكهرباء حسب المنطقة
الاتحاد الأوروبي (ألمانيا/فرنسا): 0.30–0.40€/kWh — 3 أضعاف متوسط الولايات المتحدة. تشغيل RTX 4090 على مدار الساعة يكلّف 120–160€ شهريًا في ألمانيا. يشجّع نظام GDPR على النشر داخل المؤسسة، لكن تكاليف الطاقة تجعل Apple Silicon أو استدلال GPU بحد طاقة أمرًا أساسيًا لمستخدمي الاتحاد الأوروبي.
اليابان: 27–30¥/kWh (~0.18–0.20$/kWh). تكاليف الطاقة أعلى بنسبة 50–70% من متوسط الولايات المتحدة. تفضّل إرشادات كفاءة الذكاء الاصطناعي الصادرة عن METI لعام 2024 العتاد الكفء في استهلاك الطاقة لعمليات النشر المؤسسية.
الصين: 0.5–0.8¥/kWh (0.07–0.11$/kWh) في المدن الشرقية. تكاليف الكهرباء الأقل تفضّل عمليات نشر GPU من NVIDIA. تجعل متطلبات قانون أمن البيانات الصيني الاستدلال داخل المؤسسة أمرًا شائعًا في الشركات.
أسئلة شائعة حول الطاقة والتبريد
🔍Insight: الاستدلال بحد طاقة عند 60% من TDP ممارسة معتادة في مراكز البيانات. تقدّم RTX 4090 عند 350W (60% من 575W) 90% من الأداء الأقصى مع تكاليف كهرباء أقل بنسبة 40% وحمل تبريد أقل.
كم تستهلك من الطاقة لتشغيل LLM محلي؟
يعتمد استهلاك الطاقة على فئة GPU. RTX 4090: 575W ذروة (600W متوسط مع النظام). RTX 4080: 320W GPU (450W نظام). RTX 4070 Ti: 290W GPU (400W نظام). Apple M5 Max Mac: 25–35W إجمالاً — الخيار الأكثر كفاءة في استهلاك الطاقة بفارق كبير. تستخدم أحمال الاستدلال GPU بنسبة 90–100% بشكل مستمر.
كم تبلغ تكلفة تشغيل LLM محلي على مدار الساعة؟
بسعر 0.12$/kWh (متوسط الولايات المتحدة): يكلّف نظام RTX 4090 ~52$ شهريًا. نظام RTX 4080: ~30$ شهريًا. نظام RTX 4070 Ti: ~26$ شهريًا. Apple M5 Max Mac: ~2.60$ شهريًا. تختلف أسعار الكهرباء — في ألمانيا (~0.40$/kWh)، اضرب في 3. تشغيل الاستدلال خلال ساعات العمل فقط (8 ساعات/يوم) يقلّل التكاليف بنحو 67%.
ما قدرة مزود الطاقة التي أحتاجها لـRTX 4090؟
الحد الأدنى 1000W؛ يُوصى بـ1200W. تستهلك RTX 4090 قدرة 575W عند الذروة. أضف المعالج CPU (150–170W) واللوحة الأم/RAM/التخزين (100W) وهامش أمان 20% — يصل إجمالي حمل النظام إلى ~900W. سيسبب مزود طاقة 750W إيقاف تشغيل تحت حمل استدلال LLM المستمر. اشترِ دائمًا من علامات مزودات طاقة معروفة (Seasonic، Corsair، EVGA).
هل Apple Silicon أكثر كفاءة من NVIDIA لنماذج LLM المحلية؟
نعم — بفارق كبير. يُشغّل M5 Max (128 GB موحدة، مارس 2026) النماذج بحجم 7B بسرعة 65–85 token/ثانية بطاقة نظام إجمالية 25–35W. تُشغّل RTX 4090 النموذج نفسه بسرعة 150 token/ثانية بقدرة 600W. يستخدم M5 Max طاقة أقل بـ~10 مرات لكل token من RTX 4090، إضافة إلى توفير مجمّع ذاكرة أكبر بـ4 مرات (128 GB مقابل 32 GB) للنماذج بحجم 70B.
ما درجة حرارة GPU الآمنة للاستدلال المستمر لـLLM؟
أبقِ درجة حرارة GPU أقل من 83°C للاستدلال المستمر. يبدأ الخنق الحراري لـRTX 4090 عند 83°C، مما يقلّل سرعات الساعة وسرعة الاستدلال بين 10–20%. النطاق التشغيلي المثالي: 65–75°C. استخدم `nvidia-smi -q -d TEMPERATURE` للمراقبة. إذا تجاوزت درجات الحرارة 80°C، حسّن تدفق هواء الصندوق أو أضف/استبدل المعجون الحراري.
كيف أقلّل استهلاك الطاقة دون فقدان سرعة الاستدلال؟
حدّد طاقة GPU (NVIDIA) دون خفض سرعات الساعة. RTX 4090: ضبط حد الطاقة عند 350W (من 575W) يقلّل الطاقة بنسبة 40% بخسارة سرعة لا تتجاوز ~10% — النقطة المثلى للاستدلال الكفء. استخدم `nvidia-smi -pl 350` لضبط حد الطاقة. لا يحتاج مستخدمو Apple Silicon إلى ضبط، فالعتاد محسّن بالفعل.
ما هو TDP ولماذا يهم لنماذج LLM المحلية؟
TDP (الطاقة الحرارية التصميمية) هو أقصى حرارة تولّدها GPU عند الحمل الأقصى، مقيسة بالواط. تُقيّم NVIDIA قدرة TDP لـRTX 4090 بـ575W، لكن الاستدلال الحقيقي قد يصل إلى 600W+ حسب حدود الطاقة وسرعات الساعة. يهم TDP لأنه يحدّد الحجم الأدنى لمزود طاقتك ومتطلبات التبريد. TDP أعلى = مزود طاقة أكبر، تكلفة كهرباء أعلى، تبريد أكثر مطلوب.
هل يُتلف تشغيل LLM محلي بطاقة GPU الخاصة بي؟
لا — لن يُتلف الاستدلال المستمر GPU بحالة جيدة إذا كان التبريد مناسبًا. صُمّمت بطاقات GPU للعمل بنسبة 100% على مدار الساعة (تفعل مراكز البيانات ذلك). المخاطر الحقيقية هي: (1) التبريد السيئ يسبب خنقًا ويقصّر العمر الافتراضي، (2) ذروات الطاقة من مزود طاقة أقل من اللازم قد تسبب إيقاف تشغيل، (3) الغبار/تدفق الهواء الضعيف يُضعف الأداء مع السنوات. راقب درجات الحرارة وحافظ على تدفق هواء جيد، وستدوم GPU 5+ سنوات.
المصادر
- مواصفات طاقة GPU من NVIDIA
- أسعار الكهرباء في الولايات المتحدة — U.S. Energy Information Administration
- مراقبة درجة حرارة GPU باستخدام nvidia-smi
- كفاءة الطاقة تكسب السرعة، لكن السرعة لا تضمن جودة المخرجات. يمكن لضبط درجة الحرارة وأخذ العينات أن يعوّض استهلاك الطاقة بنتائج أفضل: درجة الحرارة وtop-p يشرح كيف توازن هذه المعاملات بين السرعة والاتساق.