Key Takeaways
- RTX 4090 متوقفة (EOL) منذ 2026 — كل بطاقة في السوق مستعملة، بسعر ~$2,000-2,600، ارتفاعًا حادًا من ~$999-1,299 في بداية العام.
- RTX 5090 ما زالت قيد الإنتاج، لكن نقص ذاكرة GDDR7 في 2026 رفع سعرها في السوق إلى $4,300-$5,000+، أكثر من ضعف سعرها الرسمي البالغ $1,999.
- RTX 5090 أسرع بـ ~30-50% من RTX 4090 لاستدلال LLM المحلي على النماذج الكبيرة (70B Q4). الفجوة أصغر (~20%) على نماذج 7B-13B.
- RTX 5090 لديها 32GB GDDR7 مقابل 24GB GDDR6X لـ RTX 4090 — الفارق البالغ 8GB مهم لنماذج 34B Q8 وتشغيل 70B Q4 بسياق طويل.
- RTX 4090 المستعملة (~$56-72 لكل مليون token) لا تزال أرخص لكل token مولَّد من RTX 5090 الجديدة بسعر السوق الحالي (~$83-96 لكل مليون token).
- لنماذج 7B-13B: 4090 مبالغ فيها بغض النظر عن السعر. ستصطدم بحدود CPU أو التبريد قبل أن تُشبع بطاقة الرسوم.
- لنماذج 70B: تتميّز 5090. يمكنها تشغيل 2-3 نماذج 70B بالتوازي أو نموذج 70B واحد بأحجام دفعات أكبر.
- RTX 5080 غالبًا ما تقدّم قيمة أفضل من 5090 لنماذج LLM المحلية، إلا إذا كنت تحتاج إلى إعدادات بطاقتي رسوم، رغم أنها معرضة أيضًا لتضخم الأسعار بسبب النقص.
تم إيقاف إنتاج RTX 4090 ولا تتوفر إلا في السوق المستعمل، بينما لا تزال RTX 5090 قيد الإنتاج لكن سعرها أكثر من ضعف السعر الرسمي بسبب نقص ذاكرة GDDR7؛ RTX 5090 أسرع بنسبة 30-50% على النماذج الكبيرة بذاكرة 32GB مقابل 24GB لـ4090، لكن RTX 4090 المستعملة لا تزال تولّد التوكنات بتكلفة أقل لكل دولار.
إذا كنت تملك بالفعل RTX 4090، فلا يوجد سبب كبير للترقية الآن -- فارق سعر RTX 5090 لا يوازي مكسب السرعة لمعظم استخدامات LLM المحلية. إذا كنت تشتري من الصفر وتحتاج بطاقة قادرة على تشغيل نماذج 70B، تبقى RTX 4090 المستعملة القيمة الأفضل رغم علاوة سعرها بسبب توقف إنتاجها، لأن سعر RTX 5090 نفسه ارتفع بسبب نقص الذاكرة.
ما الفروق الفعلية في السرعة؟
RTX 5090: 21,760 نواة CUDA، 1,457 TFLOPS، ~1,792 GB/ثانية عرض نطاق ذاكرة، 32GB GDDR7. السعر الرسمي $1,999، لكن سعر السوق $4,300-$5,000+ اعتبارًا من أغسطس 2026 بسبب نقص GDDR7.
RTX 4090: 16,384 نواة CUDA، 826 TFLOPS، ~1,008 GB/ثانية عرض نطاق ذاكرة، 24GB GDDR6X. متوقفة (EOL) — توقفت NVIDIA عن إنتاجها. كل بطاقة معروضة للبيع مستعملة، بسعر ~$2,000-2,600.
استدلال LLM في العالم الحقيقي (Llama 3.3 70B، Q4، batch=1): تبلغ RTX 5090 ~50-55 token/ثانية، وتبلغ RTX 4090 ~36 token/ثانية. أسرع بـ 40-50% على نماذج 70B. سرعات كل بطاقة لم تتغيّر بتغيّر الأسعار — ما تغيّر هو تكلفة الحصول عليها.
لنماذج 7B: تبلغ RTX 5090 ~90 token/ثانية، وRTX 4090 ~75 token/ثانية. أسرع بـ ~20%. الفجوة أصغر على النماذج الأصغر.

هل تهم VRAM بين 4090 و5090؟
RTX 5090 لديها 32 GB GDDR7. RTX 4090 لديها 24 GB GDDR6X. الفارق البالغ 8 GB مهم لأحجام نماذج معينة — هذه الحسابات لا تتأثر بتوقف إنتاج 4090 أو بالسعر الحالي لأي من البطاقتين.
أفضلية VRAM في 5090 حقيقية: 34B Q8 (~28 GB) يناسب 32 GB بارتياح لكنه ضيق في 24 GB. 70B Q4 (~38-40 GB) لا يناسب أيًا من البطاقتين بمفردها — تحتاج بطاقتي رسوم أو Apple Silicon لذلك. لنماذج 7B-13B، تكفي 24 GB بسهولة.
التكلفة لكل token: أيها أرخص فعلًا؟
- RTX 4090 مستعملة: ~$2,000-2,600 (EOL، متوفرة فقط في سوق المستعمل، ارتفاعًا من ~$999-1,299 في بداية 2026). تبلغ 36 token/ثانية على Llama 70B. التكلفة لكل token: ~$56-72 لكل مليون token.
- RTX 5090 جديدة: $4,300-5,000+ سعر السوق (السعر الرسمي $1,999، متضخم بسبب نقص GDDR7 في 2026). تبلغ ~52 token/ثانية على Llama 3.3 70B Q4. التكلفة لكل token: ~$83-96 لكل مليون token.
- الحكم: 4090 لا تزال أرخص لكل token مولَّد، حتى بعد ارتفاع سعرها بسبب التوقف — لأن علاوة الندرة في 5090 نمت أسرع من علاوة الندرة في 4090.

متى ينبغي أن تُرقّي فعلًا من 4090 إلى 5090؟
لا تُرقِّ أبدًا لاستدلال 7B-13B. 4090 مبالغ فيها لتلك النماذج بغض النظر عن السعر. ستكون محدودًا بـ CPU أو التبريد على أي حال.
إذا كنت تملك 4090 بالفعل: احتفظ بها. مع سعر 5090 عند $4,300-5,000+ في السوق، جدوى الترقية أسوأ من أي وقت مضى. انتقل فقط إذا احتجت أكثر من 40 token/ثانية على 70B أو 32 GB لـ 34B Q8 ولم تكن التكلفة عائقًا.
إذا كنت لا تملك أيًا منهما وتحتاج بطاقة قادرة على 70B: قارن العروض الحالية. 4090 مستعملة (~$2,000-2,600، EOL/مستعملة فقط) لا تزال تتفوق على 5090 جديدة (~$4,300-5,000+) في التكلفة لكل token، مقابل أداء أقل بـ 30-50%.
بديل البطاقتين تغيّر: أصبحت بطاقتا RTX 4090 مستعملتان تكلفان معًا ~$4,000-5,200 — قريب من سعر السوق لبطاقة 5090 واحدة — مقابل ~65-72 token/ثانية مجتمعة على 70B Q4 (مماثل أو أفضل من 5090 واحدة). المقايضة هي التوريد من السوق المستعمل فقط (بدون ضمان، وتوريد EOL) ومزيد من تعقيد الإعداد (التوازي بين البطاقات).
افتراضات شائعة حول 5090
- الاعتقاد بأن RTX 4090 لا تزال تُباع جديدة — ليس صحيحًا. أوقفت NVIDIA إنتاج سلسلة RTX 40 في 2026؛ كل 4090 في السوق مستعملة، بأسعار أعلى بكثير مما كانت عليه في بداية العام.
- الاعتقاد بأن السعر الرسمي لـ RTX 5090 البالغ $1,999 هو ما ستدفعه فعليًا — اعتبارًا من أغسطس 2026، سعر السوق هو $4,300-$5,000+ بسبب نقص GDDR7.
- الاعتقاد بأن 5090 أسرع بـ 2× من 4090 — هي أسرع بـ 40-50% فقط على 70B، و~20% فقط على نماذج 7B.
- افتراض تطابق VRAM بين البطاقتين — ليس صحيحًا. 5090 لديها 32 GB، و4090 لديها 24 GB. الفارق البالغ 8 GB مهم لنماذج 34B Q8.
- الاعتقاد بأنك تحتاج إلى 5090 لتشغيل نماذج 70B — تشغّلها 4090 جيدًا بـ 36 token/ثانية، وهو "كافٍ" لمعظم المستخدمين، وتبقى الأرخص لكل token حتى بعد ارتفاع سعرها بسبب التوقف.
الأسئلة الشائعة
هل RTX 4090 لا تزال تُباع جديدة في 2026؟
لا. أوقفت NVIDIA إنتاج سلسلة RTX 40 في 2026. كل بطاقة RTX 4090 معروضة للبيع الآن مستعملة، وارتفعت الأسعار إلى ~$2,000-2,600 بسبب ندرة التوقف بالإضافة إلى الطلب الناتج عن نقص GDDR7 الخاص بسلسلة RTX 50.
هل تستحق RTX 5090 العناء لتشغيل Llama 3.3 70B؟
يعتمد على السعر أكثر من أي وقت مضى. تمنحك 4090 نسبة ~36 token/ثانية بسعر ~$2,000-2,600 مستعملة. تمنحك 5090 نسبة ~52 token/ثانية لكن بسعر سوق $4,300-$5,000+ في أغسطس 2026. تستحق العناء للاستخدام المستمر لـ 70B؛ 4090 مستعملة هي الخيار العملي في غير ذلك.
هل أشتري RTX 5090 واحدة أم RTX 4090 اثنتين؟
بطاقتا 4090 مستعملتان (~$4,000-5,200 إجمالًا) تتفوقان على 5090 واحدة (~$4,300-5,000+ في السوق) في السرعة الخام على 70B (~72 token/ثانية مجتمعة مقابل ~52). لكن إعداد بطاقتين يضيف تعقيدًا — توازي البطاقات، وبدون ضمان لأنها مستعملة. 5090 أبسط وما زالت قيد الإنتاج، وتضيف 32 GB من VRAM موحدة لحالات استخدام 34B Q8.
هل لـ RTX 5090 ذاكرة VRAM أكثر من 4090؟
نعم. RTX 5090 لديها 32 GB GDDR7، وRTX 4090 لديها 24 GB GDDR6X. الفارق البالغ 8 GB يتيح تشغيل نماذج 34B Q8 (~28 GB مطلوبة) دون ضغط. لا تستوعب أي من البطاقتين 70B Q4 (~38-40 GB) دون التوزيع بين بطاقتين. هذا الفارق في VRAM لا علاقة له بتوقف إنتاج 4090.
هل RTX 5090 مبالغ فيها لنموذج 14B؟
نعم، في معظم الحالات. يحتاج نموذج 14B Q4 إلى ~9 GB من VRAM ويعمل بسرعة ~55-65 token/ثانية على 4090 — وهو سريع بالفعل. ستمنح 5090 نسبة ~65-75 token/ثانية، وهو تحسّن هامشي. 4090 المستعملة (أو حتى 3090) أكثر جدوى اقتصاديًا لاستدلال 14B، خاصة بأسعار 5090 الحالية.
هل لبطاقة RTX 5090 المخصصة للحواسيب المحمولة 32GB من VRAM؟
لا. تحتوي RTX 5090 Laptop GPU على 24GB GDDR7 (أقل من 32GB في نسخة سطح المكتب بسبب قيود الطاقة والحرارة). أبطأ بكثير من نسخة سطح المكتب لكنها لا تزال أسرع من 4090 في نفس المهمة.
هل ستنخفض أسعار 5090 إلى سعرها الرسمي البالغ $1,999؟
فقط عندما يخفّ نقص ذاكرة GDDR7 في 2026 — لا يوجد جدول زمني محدد. سعر السوق الحالي هو $4,300-$5,000+، أكثر من ضعف السعر الرسمي. يذكّرنا تاريخ أسعار 4090 بأن سوق المستعمل لا يتجه دائمًا للانخفاض: هبطت من $1,499 (إطلاق 2022) إلى أدنى مستوى ~$999 مستعملة، ثم ارتدت إلى ~$2,000-2,600 بعد توقف إنتاجها في 2026.
هل يمكنني استخدام RTX 5090 مع مزوّد طاقة 750 واط؟
بصعوبة. تستهلك RTX 5090 575 واط بمفردها. استخدم مزوّد طاقة 850 واط أو 1000 واط لتجنّب انخفاض الجهد تحت الحمل.
هل تقدّم RTX 5080 قيمة أفضل من 5090؟
غالبًا نعم — تبلغ 5080 نحو 80% من سرعة 5090 بسعر أقل بكثير، رغم أنها معرضة أيضًا لتضخم الأسعار الناتج عن نقص GDDR7 في 2026. لنماذج LLM المحلية، 5080 عادة ما تكون النقطة المثلى.
كم أسرع 5090 في النماذج متعددة الوسائط مثل Qwen-VL 70B؟
تحسّن مماثل بنسبة 20-25%. تظل الحوسبة متعددة الوسائط محدودة بالذاكرة، لذا تساعد أفضلية عرض النطاق في 5090، لكن ليس بشكل كبير.
المصادر
- المواصفات الرسمية لـ NVIDIA RTX 5090 و4090: أنوية CUDA، TFLOPS، عرض نطاق الذاكرة
- معيار MLCommons MLPerf Inference: سرعة توليد الـ tokens على LLaMA 70B ونماذج Mistral
- قاعدة بيانات بطاقات الرسوم في TechPowerUp: مقارنة استهلاك الطاقة وعرض نطاق الذاكرة RTX 5090 مقابل 4090
