النقاط الرئيسية
- Stable Diffusion هو عائلة نماذج مفتوحة الأوزان لتحويل النص إلى صورة، وليس تطبيقًا مستقلًا — تحتاج إلى واجهة منفصلة (AUTOMATIC1111 أو ComfyUI أو InvokeAI أو Fooocus) لتشغيله محليًا.
- صدر لأول مرة في 22 أغسطس 2022، بشكل مشترك بين Stability AI ومجموعة أبحاث CompVis في جامعة ميونخ وRunway ML، ودُرِّب جزئيًا على مجموعة بيانات الصور LAION-5B.
- تختلف شروط الترخيص حسب الإصدار: SD 1.5/2.1/SDXL تستخدم ترخيص CreativeML Open RAIL-M / RAIL++-M (الاستخدام التجاري مسموح، بلا سقف إيرادات)؛ SD 3/3.5 تستخدم Stability AI Community License (مجاني تحت مليون دولار من الإيرادات السنوية مع التسجيل، وترخيص Enterprise مطلوب فوق ذلك).
- تتصاعد متطلبات العتاد مع الإصدار: 4 GB من VRAM تكفي لـ SD 1.5، وSDXL يحتاج 8–12 GB، وSD 3.5 Large يحتاج تقريبًا 12–16 GB حسب الدقة.
- الاستضافة الذاتية مجانية بموجب الترخيص المعمول به؛ وتبيع Stability AI بشكل منفصل رصيد API مستضاف واشتراكًا مدفوعًا للقراء الذين لا يمتلكون وحدة معالجة رسومات (GPU) خاصة.
- يتصدّر FLUX (من Black Forest Labs) عمومًا في الواقعية الفوتوغرافية والالتزام بالتوجيه (prompt) في 2026؛ ويظل Stable Diffusion متصدرًا من حيث عمق النظام البيئي — أكبر عدد من نقاط التفتيش (checkpoints) وLoRA وأدوات ControlNet المجتمعية.
ما هو Stable Diffusion
Stable Diffusion هو نموذج انتشار كامن (LDM): يولّد الصور بإزالة الضوضاء تدريجيًا من تمثيل مضغوط لصورة، موجَّهًا بتوجيه نصي، بدلًا من العمل مباشرة على البكسلات بدقة كاملة. لهذا يمكنه العمل على وحدات معالجة رسومات (GPU) استهلاكية بدلًا من الحاجة إلى عتاد مراكز بيانات.
طوّرت النموذجَ مجموعةُ أبحاث CompVis (Computer Vision & Learning) في جامعة ميونخ (LMU)، بقيادة البروفيسور Björn Ommer، مع Robin Rombach (التحق لاحقًا بـ Stability AI) وPatrick Esser (Runway ML) كباحثين رئيسيين في بنية الانتشار الكامن الأساسية. مولت Stability AI الحوسبة، وأصدرت النسخة العامة الأولى في 22 أغسطس 2022 بالاشتراك مع CompVis وRunway ML.
استخدمت بيانات تدريب الإصدارات الأصلية مجموعات فرعية من LAION-5B، وهي مجموعة بيانات نصوص وصور عامة كبيرة جمّعتها منظمة LAION الألمانية غير الربحية — وهذه نقطة ذات صلة بالنقاش القانوني والأخلاقي المستمر حول موافقة أصحاب بيانات التدريب، الذي يؤثر على معظم نماذج الصور واسعة النطاق، وليس Stable Diffusion وحده.
من المهم فهم أن "Stable Diffusion" يشير إلى أوزان النموذج وكود الاستدلال، لا إلى تطبيق جاهز. لكتابة توجيه فعليًا ورؤية صورة، تحتاج إلى واجهة. أكثر الخيارات استخدامًا هي Stable Diffusion WebUI من AUTOMATIC1111، وComfyUI (قائم على العقد، تحكم أكبر)، وInvokeAI (واجهة احترافية متقنة)، وFooocus (مبسّط، أقل عدد من النقرات للوصول إلى أول صورة). ستغطي PromptQuorum كل واجهة من هذه الواجهات في مراجعات مخصصة؛ يركّز هذا المقال على النموذج الأساسي نفسه.
📍 في جملة واحدة
Stable Diffusion هو نموذج انتشار كامن (latent diffusion) مفتوح الأوزان يحوّل توجيهًا نصيًا (prompt) إلى صورة، ويُوزَّع كملفات نموذج وكود قابل للتحميل بدلًا من تطبيق استهلاكي.
💬 بعبارات بسيطة
تخيّله كمحرك، لا كسيارة — Stable Diffusion يولّد الصور، لكنك ما زلت تحتاج إلى لوحة تحكم (AUTOMATIC1111 أو ComfyUI أو InvokeAI أو Fooocus) لكتابة توجيه ورؤية النتيجة.
تاريخ إصدارات Stable Diffusion
SD 1.4 / SD 1.5
- تاريخ الإصدار:
- أغسطس–أكتوبر 2022
- عائلة الترخيص:
- CreativeML Open RAIL-M
- التغيير البارز:
- أول إصدار عام واسع الانتشار؛ لا يزال أساس آلاف نقاط التفتيش المجتمعية
SD 2.0 / SD 2.1
- تاريخ الإصدار:
- نوفمبر–ديسمبر 2022
- عائلة الترخيص:
- CreativeML Open RAIL++-M
- التغيير البارز:
- مُرمِّز نص جديد (OpenCLIP)؛ استقبال مجتمعي متباين مقارنة بنظام نقاط تفتيش 1.5
SDXL 1.0
- تاريخ الإصدار:
- يوليو 2023
- عائلة الترخيص:
- CreativeML Open RAIL++-M
- التغيير البارز:
- نموذج أساسي أكبر (~3.5 مليار معلمة)، تفاصيل وتكوين أوضح بدقة 1024×1024
SD 3 Medium
- تاريخ الإصدار:
- يونيو 2024 (الأوزان)
- عائلة الترخيص:
- Stability AI Community License
- التغيير البارز:
- بنية جديدة من محوّلات الانتشار متعددة الوسائط (MMDiT)، تحسين عرض النصوص والالتزام بالتوجيه
SD 3.5 (Large وLarge Turbo وMedium)
- تاريخ الإصدار:
- أكتوبر 2024
- عائلة الترخيص:
- Stability AI Community License
- التغيير البارز:
- Large (8 مليارات معلمة) يحسّن الجودة والتنوع؛ Large Turbo يضحّي ببعض الجودة مقابل سرعة توليد بـ 4 خطوات؛ Medium (2.5 مليار) يستهدف عتادًا بذاكرة VRAM أقل
تواريخ الإصدارات وأعداد المعلمات مُبلَّغ عنها على نطاق واسع من Stability AI ومصادر أخرى؛ تحقق من الأرقام الدقيقة والإصدارات الأحدث على Stability AI قبل الاستشهاد بها في مواصفات تقنية. آخر تحقّق: 2026-09-05.
كيفية تشغيل Stable Diffusion محليًا
يتبع تشغيل Stable Diffusion على وحدة معالجة الرسومات (GPU) الخاصة بك نفس النمط الأساسي بغضّ النظر عن الواجهة التي تختارها في النهاية.
- 1تحقّق من VRAM في وحدة معالجة الرسومات الخاصة بك
Why it matters: تأكّد من أن وحدة معالجة الرسومات لديك تحتوي على VRAM كافية للإصدار الذي تريده (انظر جدول العتاد أدناه) — هذا يحدد أي إصدار ودقّة من Stable Diffusion يمكنك تشغيلها فعليًا. - 2ثبِّت واجهة أمامية
Why it matters: حمِّل Stable Diffusion WebUI من AUTOMATIC1111، أو ComfyUI، أو InvokeAI، أو Fooocus — Stable Diffusion لا يملك مثبِّتًا خاصًا به، لذا هذه الخطوة إلزامية وليست اختيارية. - 3حمِّل أوزان النموذج
Why it matters: احصل على ملف نقطة التفتيش (checkpoint) (مثلًا من [Hugging Face](https://huggingface.co/stabilityai) أو موقع Stability AI) للإصدار المحدد الذي تريده — SD 1.5 أو SDXL أو SD 3.5 — وتأكد من شروط الترخيص لاستخدامك المقصود قبل التحميل. - 4ضع نقطة التفتيش في مجلد النماذج الخاص بواجهتك
Why it matters: تتوقّع كل واجهة وجود ملفات النموذج في دليل محدد (موثّق في دليل إعداد تلك الواجهة) حتى تتمكن من اكتشاف نقطة التفتيش وتحميلها عند بدء التشغيل. - 5اكتب توجيهًا وولّد الصورة
Why it matters: أدخل توجيهًا نصيًا، واضبط الدقة وخطوات أخذ العينات، ثم ولّد — عادة ما يكون التشغيل الأول أبطأ أثناء تحميل النموذج في VRAM. - 6أضف إضافات اختيارية عندما تشعر بالراحة
Why it matters: LoRA (تعديلات دقيقة خفيفة للأسلوب/الموضوع)، وControlNet (توجيه الوضعية والتكوين)، ونقاط التفتيش المخصصة كلها إضافات مجتمعية تُبنى فوق النموذج الأساسي، وليست جزءًا من Stable Diffusion نفسه.
ترخيص Stable Diffusion وشروط الاستخدام التجاري
يهم هذا التمييز أي شخص يخطط لاستخدام الصور المولَّدة في منتج تجاري. ترخيص CreativeML Open RAIL-M / RAIL++-M الأقدم، المستخدَم لـ SD 1.5 وSD 2.1 وSDXL، يسمح بالاستخدام التجاري بلا سقف إيرادات — قيوده قائمة على الاستخدام (عدم توليد محتوى ضار أو غير قانوني أو مُجرِّد من الإنسانية) وليست قائمة على الإيرادات، ويجب أن يحمل أي تعديل دقيق مشتق القيود نفسها.
أما SD 3 وSD 3.5 فتعملان بموجب Stability AI Community License الأحدث. وفقًا لنص الترخيص المنشور على Hugging Face، يتطلب الاستخدام التجاري أو المؤسسي التسجيل لدى Stability AI، وإذا حقّقتَ أنت أو الشركات التابعة لك أكثر من 1,000,000 دولار من الإيرادات السنوية الإجمالية، ينتهي الترخيص الممنوح بموجب الاتفاقية ويجب عليك طلب ترخيص Enterprise من Stability AI، الذي يُمنح وفق تقدير Stability AI بشروط تُتفاوَض بشكل منفصل.
لا يتطلب الاستخدام غير التجاري والبحثي لـ SD 3/3.5 تسجيلًا بموجب Community License. بشكل منفصل، تدير Stability AI أيضًا برنامج عضوية (Non-Commercial وProfessional وEnterprise) لواجهة API المستضافة وأدواتها — وهذه العضوية عرض تجاري مستقل عن شروط الاستضافة الذاتية المذكورة أعلاه، وقد يتغير كلا الشرطين، لذا تحقق من الصياغة الحالية مباشرة على stability.ai قبل بناء قرار عمل عليها.
📍 في جملة واحدة
تختلف شروط ترخيص Stable Diffusion حسب الإصدار: SD 1.5/2.1/SDXL تستخدم ترخيص CreativeML Open RAIL-M بلا سقف إيرادات تجارية، بينما تستخدم SD 3 وSD 3.5 ترخيص Stability AI Community License، المجاني فقط للمؤسسات التي تقل إيراداتها السنوية عن مليون دولار.
💬 بعبارات بسيطة
الإصدارات الأقدم من Stable Diffusion مناسبة للاستخدام التجاري دون شروط إضافية غير قيود سوء استخدام المحتوى؛ أما الإصدارات الأحدث فتطلب من الشركات الكبرى دفع ثمن ترخيص Enterprise.
SD 1.5، SD 2.1، SDXL 1.0
- الترخيص:
- CreativeML Open RAIL-M / RAIL++-M
- الاستخدام التجاري:
- مسموح، بلا حد أدنى للإيرادات
- الشرط الرئيسي:
- قيود قائمة على الاستخدام تمنع توليد محتوى ضار أو غير قانوني أو مضلل بوضوح؛ يجب أن تحمل الأعمال المشتقة القيود نفسها
SD 3، SD 3.5 (كل الإصدارات الفرعية)
- الترخيص:
- Stability AI Community License
- الاستخدام التجاري:
- مجاني تحت 1,000,000 دولار أمريكي من الإيرادات السنوية (إجمالًا، أنت والشركات التابعة)
- الشرط الرئيسي:
- يجب التسجيل لدى Stability AI للاستخدام التجاري؛ ينتهي الترخيص عند تجاوز حد المليون دولار، مما يتطلب ترخيص Enterprise منفصلًا
شروط الترخيص نص قانوني، وليست مادة تسويقية — يلخّص هذا القسم الشروط المنشورة علنًا حتى تاريخ 2026-09-05، لكنه ليس استشارة قانونية. اقرأ ملف الترخيص الفعلي للإصدار الذي تخطط لاستخدامه (مثل ملف LICENSE.md على صفحة Hugging Face لكل نموذج) قبل أي استخدام تجاري.
متطلبات العتاد لكل إصدار
SD 1.5
- الحد الأدنى من VRAM:
- 4 GB VRAM
- VRAM مريحة:
- 8 GB VRAM
- ملاحظات:
- يعمل على معظم وحدات معالجة الرسومات من العقد الماضي؛ أكبر نظام بيئي لنقاط التفتيش/LoRA بين كل الإصدارات
SDXL 1.0
- الحد الأدنى من VRAM:
- 8 GB VRAM (مع تحسينات ذاكرة)
- VRAM مريحة:
- 12–16 GB VRAM
- ملاحظات:
- مصمم لإخراج أصلي بدقة 1024×1024؛ أبطأ وأثقل لكل صورة من SD 1.5
SD 3.5 Medium
- الحد الأدنى من VRAM:
- ~6 GB VRAM (FP16)
- VRAM مريحة:
- 8–10 GB VRAM
- ملاحظات:
- أصغر إصدار فرعي من SD 3.5 (2.5 مليار معلمة)، موجَّه لعتاد بذاكرة VRAM أقل
SD 3.5 Large / Large Turbo
- الحد الأدنى من VRAM:
- ~11 GB VRAM (FP8)
- VRAM مريحة:
- 16 GB أو أكثر VRAM (FP16)
- ملاحظات:
- 8 مليارات معلمة؛ Large Turbo يضحّي ببعض الجودة مقابل سرعة توليد بـ 4 خطوات
يعتمد الاستخدام الدقيق لـ VRAM على الدقة وحجم الدفعة والدقة العددية (FP16 مقابل FP8/المُكمَّم) والتحسينات المفعَّلة في الواجهة (مثل تقسيم الانتباه attention slicing وتفريغ النموذج model offloading) — تعامل مع هذه الأرقام كنطاق تخطيط لا كضمان، وراجع الوثائق الحالية للواجهة المحددة.
السعر: الاستضافة الذاتية المجانية مقابل خطط Stability AI
الاستضافة الذاتية لـ Stable Diffusion مجانية — تدفع فقط ثمن عتادك وكهرباءك، بموجب الترخيص المطبَّق على الإصدار الذي تختاره (انظر قسم الترخيص أعلاه). لا توجد أي رسوم تتبعها PromptQuorum لتحميل الأوزان وتشغيلها بنفسك، ولا يلزم أي اشتراك للتوليد المحلي دون اتصال بالإنترنت.
تبيع Stability AI بشكل منفصل وصولًا مستضافًا للقراء الذين لا يريدون تشغيل وحدة معالجة رسومات خاصة بهم: مستوى عضوية Non-Commercial مجاني (للاستخدام الشخصي/البحثي)، ومستوى Professional مدفوع شهريًا (يتيح الاستخدام التجاري المستضاف ذاتيًا والوصول إلى API المستضافة)، ومستوى Enterprise بسعر مخصص للمؤسسات الكبيرة فوق حد إيرادات Community License. كما تقدّم Stability AI رصيد API بنظام الدفع حسب الاستخدام للتوليد عند الطلب دون اشتراك.
Stable Diffusion مقابل البدائل
Stable Diffusion (عبر AUTOMATIC1111/ComfyUI)
- الأفضل لـ:
- أكبر نظام بيئي لنقاط التفتيش/LoRA/ControlNet، تحكم محلي كامل
- قابل للاستضافة الذاتية:
- نعم — مجاني، وحدة معالجة رسومات خاصة بك
- الترخيص / التكلفة:
- RAIL-M (SD 1.5/2.1/SDXL، بلا سقف) أو Community License (SD 3/3.5، مجاني تحت مليون دولار من الإيرادات)
- المقايضة الرئيسية:
- يتطلب واجهة منفصلة؛ الإصدارات الأحدث تتطلب تسجيل ترخيص للاستخدام التجاري
FLUX (من Black Forest Labs)
- الأفضل لـ:
- واقعية فوتوغرافية والتزام بالتوجيه فور الإصدار
- قابل للاستضافة الذاتية:
- نعم — مجاني، وحدة معالجة رسومات خاصة بك
- الترخيص / التكلفة:
- FLUX.1 schnell مرخّص بموجب Apache 2.0 (بلا قيود)؛ FLUX dev/Kontext يتطلبان ترخيصًا مدفوعًا للاستخدام التجاري
- المقايضة الرئيسية:
- نظام بيئي مجتمعي أصغر من Stable Diffusion؛ يختلف الترخيص بشدة حسب الإصدار الفرعي
نقاط تفتيش SDXL المجتمعية (نسخ متفرعة مستضافة على Civitai مثل Pony Diffusion وJuggernaut XL)
- الأفضل لـ:
- نتائج خاصة بأسلوب معين (أنمي، رسم توضيحي، بعض الأنماط الفوتوغرافية الواقعية) دون هندسة توجيه
- قابل للاستضافة الذاتية:
- نعم — نفس واجهات Stable Diffusion الأساسي
- الترخيص / التكلفة:
- تختلف حسب نقطة التفتيش — يرث كثير منها شروط RAIL++-M، بينما يضيف البعض قيودًا خاصة
- المقايضة الرئيسية:
- تختلف الجودة ووضوح الترخيص حسب مؤلف المجتمع؛ تحقق من صفحة ترخيص كل نقطة تفتيش
Midjourney
- الأفضل لـ:
- جمالية افتراضية مميزة بأقل جهد في التوجيه، سير عمل عبر Discord/الويب
- قابل للاستضافة الذاتية:
- لا — سحابي فقط، يتطلب اشتراكًا
- الترخيص / التكلفة:
- مستويات اشتراك مدفوعة
- المقايضة الرئيسية:
- لا خصوصية محلية أو استخدام دون اتصال؛ لا يمكن الاستضافة الذاتية أو تعديل النموذج الأساسي
DALL-E 3 (عبر ChatGPT/API)
- الأفضل لـ:
- اتباع قوي للتعليمات البسيطة، متكامل مع ChatGPT
- قابل للاستضافة الذاتية:
- لا — سحابي فقط
- الترخيص / التكلفة:
- مضمّن في ChatGPT Plus/Pro أو API بالدفع حسب الاستخدام
- المقايضة الرئيسية:
- لا استخدام دون اتصال، لا تعديل دقيق، لا نظام بيئي لنقاط التفتيش
Adobe Firefly
- الأفضل لـ:
- ضمانات بيانات تدريب آمنة تجاريًا للفرق المؤسسية والإبداعية
- قابل للاستضافة الذاتية:
- لا — سحابي فقط
- الترخيص / التكلفة:
- اشتراك، ضمن Creative Cloud أو مستقل
- المقايضة الرئيسية:
- لا تحكم محلي أو استضافة ذاتية؛ يستبدل المرونة بالتعويض القانوني والتكامل مع تطبيقات Adobe
هذا ملخص تموضع، وليس ترتيبًا قائمًا على اختبارات أداء — راجع توليد الصور المحلي بالذكاء الاصطناعي مقابل السحابة لمقارنة أعمق بين FLUX وSD 3.5 وQwen-Image من حيث الترخيص وVRAM.
لمن يناسب Stable Diffusion
- القارئ الذي يريد أكبر نظام بيئي لنماذج الصور المحلية. لا يملك أي نموذج صور مفتوح آخر هذا العدد من نقاط التفتيش وLoRA وتكاملات ControlNet المجتمعية المبنية حوله.
- القارئ المستعد لتثبيت واجهة. إذا كنت مستعدًا بالفعل لإعداد AUTOMATIC1111 أو ComfyUI أو InvokeAI أو Fooocus، فإن Stable Diffusion يمنحك أوسع نطاق من الأساليب المُدرَّبة مسبقًا والتعديلات الدقيقة لتحميلها فيه.
- القارئ الذي يريد تحكمًا محليًا كاملًا وخصوصية. بعد التحميل، يحدث التوليد بالكامل على وحدة معالجة الرسومات الخاصة بك — لا تغادر أي صورة أو توجيه جهازك.
- الشركات الصغيرة أو الأفراد تحت حد المليون دولار من الإيرادات. تسمح كل من الإصدارات الأقدم المرخّصة بموجب RAIL-M وCommunity License الخاص بـ SD 3/3.5 (مع تسجيل مجاني) بالاستخدام التجاري دون اشتراك بهذا الحجم.
- الهواة أو الفنانون الذين يريدون تعديل أسلوب مخصص. يجعل حجم ونضج نظام Stable Diffusion البيئي لنقاط التفتيش وتدريب LoRA منه الخيار الأفضل توثيقًا لتدريب نموذج أسلوب شخصي.
لمن لا يناسب Stable Diffusion
- القارئ الذي يريد تطبيقًا بنقرة واحدة دون إعداد. Stable Diffusion هو أوزان وكود، وليس تطبيقًا — ما زال عليك تثبيت وضبط واجهة منفصلة أولًا. من يريد صفر إعداد يجب أن يفكر في أداة سحابية مثل Midjourney أو DALL-E 3 بدلًا من ذلك.
- القارئ ذو VRAM منخفضة ودون صبر للتحسين. يحتاج SDXL وSD 3.5 Large إلى 8 GB أو أكثر و12–16 GB أو أكثر من VRAM على التوالي؛ قد يحتاج أصحاب وحدات معالجة الرسومات القديمة أو المدمجة إلى نسخ مُكمَّمة/محسَّنة، أو الاكتفاء بـ SD 1.5، أو استخدام بديل سحابي.
- المؤسسات فوق حد المليون دولار من الإيرادات السنوية التي تخطط لاستخدام SD 3 أو SD 3.5. يتطلب Community License ترخيص Enterprise من Stability AI فوق هذا الحد — ضع هذه المفاوضة في الميزانية، أو استخدم إصدارًا أقدم مرخّصًا بموجب RAIL-M إذا كان يناسب حالة استخدامك.
- القارئ الذي يريد أفضل واقعية فوتوغرافية فور الإصدار بأقل جهد في التوجيه. عمومًا، تُصنِّف تقارير المجتمع والمقارنات في 2026 FLUX متقدمًا على Stable Diffusion الأساسي في الواقعية الفوتوغرافية والالتزام بالتوجيه افتراضيًا، رغم أن نقاط تفتيش Stable Diffusion المعدَّلة دقيقًا يمكن أن تقلّص هذه الفجوة كثيرًا لأساليب معينة.
- فريق مؤسسي يحتاج إلى تعويض ضد مطالبات متعلقة ببيانات التدريب. تعتمد بيانات تدريب Stable Diffusion، من بين مصادر أخرى، على مجموعة بيانات LAION-5B العامة؛ الفرق التي تحتاج إلى تعويض تعاقدي لهذه المخاطرة ينبغي أن تقيّم Adobe Firefly بدلًا من ذلك.
الأسئلة الشائعة
هل Stable Diffusion مجاني؟
نعم، للاستضافة الذاتية. أوزان النموذج والكود مجانية للتحميل من Hugging Face وGitHub، ولا يكلّف تشغيلها على وحدة معالجة الرسومات الخاصة بك شيئًا سوى عتادك وكهربائك. تبيع Stability AI بشكل منفصل عضوية مستضافة ورصيد API بالدفع حسب الاستخدام للقراء الذين لا يمتلكون وحدة معالجة رسومات خاصة — راجع أسماء المستويات والأسعار الحالية على stability.ai.
هل أحتاج إلى تطبيق خاص لتشغيل Stable Diffusion؟
نعم. يُوزَّع Stable Diffusion كأوزان نموذج وكود استدلال، وليس كتطبيق مستقل. لكتابة توجيه فعليًا وتوليد صورة، تحتاج إلى واجهة أمامية منفصلة مثل Stable Diffusion WebUI من AUTOMATIC1111، أو ComfyUI، أو InvokeAI، أو Fooocus مثبَّتة على جهازك.
هل يمكنني استخدام صور Stable Diffusion تجاريًا؟
يعتمد ذلك على الإصدار. تندرج الصور المولَّدة بواسطة SD 1.5 أو SD 2.1 أو SDXL ضمن ترخيص CreativeML Open RAIL-M / RAIL++-M، الذي يسمح بالاستخدام التجاري بلا سقف إيرادات (مع خضوعه لقيود محتوى قائمة على الاستخدام). أما الصور المولَّدة بواسطة SD 3 أو SD 3.5 فتندرج ضمن Stability AI Community License، الذي يتطلب التسجيل لدى Stability AI للاستخدام التجاري وهو مجاني فقط طالما بقيت إيرادات مؤسستك السنوية الإجمالية أقل من 1,000,000 دولار — وفوق ذلك يلزم ترخيص Enterprise من Stability AI.
من أنشأ Stable Diffusion؟
صدر Stable Diffusion علنًا لأول مرة في 22 أغسطس 2022، كجهد مشترك بين Stability AI (التي مولت الحوسبة)، ومجموعة أبحاث CompVis في جامعة ميونخ بقيادة البروفيسور Björn Ommer، وRunway ML. كان Robin Rombach وPatrick Esser من بين الباحثين الرئيسيين في بنية الانتشار الكامن الأساسية. استخدمت بيانات تدريب الإصدارات الأصلية مجموعات فرعية من مجموعة بيانات LAION-5B، التي جمّعتها منظمة LAION غير الربحية.
كم من VRAM يحتاج Stable Diffusion؟
يعتمد ذلك على الإصدار: يعمل SD 1.5 بـ 4 GB فقط من VRAM، ويحتاج SDXL تقريبًا 8–12 GB لاستخدام مريح، ويحتاج SD 3.5 Medium حوالي 6–10 GB، ويحتاج SD 3.5 Large تقريبًا 11 GB (FP8) إلى 16 GB أو أكثر (FP16). يختلف الاستخدام الدقيق حسب الدقة وحجم الدفعة والتحسينات التي تفعّلها الواجهة التي تختارها.
من أين أحمّل Stable Diffusion؟
تُنشَر أوزان النموذج الرسمية على Hugging Face ضمن منظمة stabilityai، ويوجد كود البحث الأصلي على GitHub في stability-ai/stablediffusion وstability-ai/generative-models. ستحتاج بشكل منفصل إلى واجهة مثل AUTOMATIC1111 أو ComfyUI أو InvokeAI أو Fooocus لتحميل الأوزان المُنزَّلة وتشغيلها.
هل Stable Diffusion أفضل من FLUX أو Midjourney؟
يعتمد ذلك على ما تقدّره. يتصدّر FLUX عمومًا الواقعية الفوتوغرافية والالتزام بالتوجيه فور الإصدار اعتبارًا من 2026، ويُعرَف Midjourney بجمالية افتراضية مميزة بأقل جهد في التوجيه، لكن لا يمكن استضافة أي منهما ذاتيًا على عتادك الخاص. تكمن ميزة Stable Diffusion في حجم نظامه البيئي المفتوح — أكبر عدد من نقاط التفتيش المجتمعية وتعديلات LoRA الدقيقة وأدوات ControlNet بين كل عائلات نماذج الصور المحلية — إضافة إلى تحكم محلي كامل، وفي الإصدارات الأقدم، بلا سقف للإيرادات التجارية.
ما الفرق بين SD 1.5 وSDXL وSD 3.5؟
SD 1.5 (2022) هو الأصغر والأخف، وله أكبر نظام بيئي لنقاط التفتيش المجتمعية بفارق كبير. SDXL (2023) نموذج أساسي أكبر مصمَّم لتفاصيل أوضح وإخراج أصلي بدقة 1024×1024. يستخدم SD 3.5 (2024) بنية محوّلات انتشار متعددة الوسائط أحدث مع تحسين عرض النصوص والالتزام بالتوجيه، لكنه ينتقل إلى Stability AI Community License بدلًا من ترخيص RAIL-M الأقدم المستخدَم في 1.5 وSDXL و2.1.
هل يمكنني تعديل نموذج Stable Diffusion الخاص بي؟
نعم. يُعدّ تدريب LoRA (تعديلات دقيقة خفيفة للأسلوب/الموضوع) ونقاط تفتيش مخصصة كاملة فوق Stable Diffusion من أكثر سير العمل توثيقًا في مجتمع توليد الصور مفتوح المصدر، وتدعمه أدوات مصمَّمة خصيصًا لهذا الغرض. يرث التعديل الدقيق الناتج قيود ترخيص النموذج الأساسي الذي دُرِّب منه.
الخلاصة
يكتسب Stable Diffusion مكانته كأساس لتوليد الصور المحلي والمفتوح — ليس لأن إصدارًا واحدًا هو الأفضل أداءً اليوم، بل بسبب عمق النظام البيئي الذي بُني حوله منذ 2022. يحصل القراء المستعدون لتثبيت واجهة مثل AUTOMATIC1111 أو ComfyUI أو InvokeAI أو Fooocus على وصول إلى أكبر مكتبة من نقاط التفتيش المجتمعية وتعديلات LoRA الدقيقة وأدوات ControlNet بين أي نموذج صور محلي، إضافة إلى تحكم كامل في عتادهم وبياناتهم الخاصة. المقايضة حقيقية: إنه ليس تطبيقًا بنقرة واحدة، وتتصاعد متطلبات العتاد بشكل ملموس حسب الإصدار، وتحوّل الترخيص من CreativeML Open RAIL-M المفتوح تمامًا (SD 1.5/2.1/SDXL) إلى Stability AI Community License المقيَّد بالإيرادات (SD 3/3.5) — وهو تمييز يستحق التحقق منه قبل أي نشر تجاري. ينبغي على من يريد أفضل واقعية فوتوغرافية فور الإصدار أيضًا تقييم FLUX؛ ومن يريد صفر إعداد ينبغي أن يفكر في أداة سحابية مثل Midjourney أو Adobe Firefly. لكل من يريد استضافة توليد الصور بنفسه والاستفادة من أكبر مجموعة أدوات محيطة، يظل Stable Diffusion نقطة الانطلاق المعقولة.
المصادر
- Stability AI — Community License — الإعلان الرسمي وشروط Stability AI Community License الخاصة بـ SD 3 وSD 3.5.
- Stability AI — الموقع الرسمي — صفحات المنتج ومستويات العضوية وأسعار API الحالية.
- Stable Diffusion 3.5 Large — LICENSE.md على Hugging Face — النص القانوني الكامل لـ Community License، بما في ذلك حد المليون دولار من الإيرادات.
- ترخيص CreativeML Open RAIL-M — GitHub الخاص بـ CompVis/stable-diffusion — النص القانوني الكامل للترخيص الذي يغطي SD 1.x وSD 2.x.
- نماذج Stability AI على Hugging Face — الأوزان الرسمية لكل إصدارات Stable Diffusion.
- stability-ai/stablediffusion على GitHub — مستودع كود البحث الأصلي.
- stability-ai/generative-models على GitHub — قاعدة كود النماذج التوليدية الحالية لدى Stability AI، بما في ذلك SD 3.x.
