Skip to main content
PromptQuorumPromptQuorum
Home/Local LLMs/أفضل نماذج ⁨LLM⁩ المحلية للكتابة الإبداعية في ⁨2026⁩: الروايات والشعر والمحتوى الطويل
Best Models

أفضل نماذج ⁨LLM⁩ المحلية للكتابة الإبداعية في ⁨2026⁩: الروايات والشعر والمحتوى الطويل

·8 دقائق للقراءة·By Hans Kuepper · Founder of PromptQuorum, multi-model AI dispatch tool · PromptQuorum

اعتباراً من أبريل 2026، أفضل نماذج LLM المحلية للكتابة الإبداعية هي Meta Llama 3.3 70B (أفضل جودة نثر)، وMistral Small 3.1 24B (أفضل جودة بأقل من 16 GB من RAM)، والنماذج المضبوطة من المجتمع مثل Fimbulvetr.

اعتباراً من أبريل 2026، أفضل نماذج LLM المحلية للكتابة الإبداعية هي Meta Llama 3.3 70B (أفضل جودة نثر)، وMistral Small 3.1 24B (أفضل جودة بأقل من 16 GB من RAM)، والنماذج المضبوطة من المجتمع مثل Fimbulvetr وMidnight-Rose (متخصصة في الروايات وتقمّص الأدوار). لا يُقاس أداء الكتابة الإبداعية جيداً بالاختبارات القياسية — يتطلب تقييم التماسك السردي والمدى الأسلوبي واتباع التعليمات في الموجّهات المفتوحة.

أفضل نماذج ⁨LLM⁩ المحلية للكتابة الإبداعية في ⁨2026⁩: الروايات والشعر والمحتوى الطويل

Key Takeaways

  • الاختبارات القياسية (MMLU، HumanEval) لا تقيس جودة الكتابة الإبداعية — قيّم النماذج بموجّهات العيّنة الخاصة بك.
  • أفضل نثر عموماً: Llama 3.3 70B — أكثر أسلوب سردي إنجليزي طبيعي على نطاق قابل للتشغيل محلياً.
  • الأفضل لـ 16 GB من RAM: Mistral Small 3.1 24B — مخرجات إبداعية قوية، أفضل بشكل ملحوظ من نماذج 7B للسرد الطويل.
  • الأفضل لـ 8 GB من RAM: Llama 3.3 8B — اتباع أفضل للتعليمات الإبداعية من Qwen3 7B لمهام الروايات بالإنجليزية.
  • النماذج المضبوطة من المجتمع (Fimbulvetr-11B، Midnight-Rose-70B) المدرَّبة خصيصاً على الروايات الإبداعية تتفوق على النماذج الأساسية في المهام السردية المستمرة.

كيف تقيّم جودة نموذج LLM محلي للكتابة الإبداعية؟

اعتباراً من أبريل 2026، لا يُقاس أداء الكتابة الإبداعية جيداً بالاختبارات القياسية (MMLU، HumanEval). لتقييم نموذج للكتابة الإبداعية، اختبره مباشرةً بأنواع الموجّهات التي تخطط لاستخدامها:

  • اختبار استمرارية النثر: أعطِ النموذج أول فقرتين من مشهد واطلب منه المتابعة لـ 500 كلمة. هل يحافظ على نبرة وصوت شخصية ومنطق سردي متسق؟
  • اختبار تعليمة الأسلوب: اطلب من النموذج كتابة فقرة "بأسلوب Raymond Carver" أو "بإيقاع رواية تشويق". هل يغيّر الأسلوب بشكل ملموس، أم ينتج مخرجات عامة؟
  • اختبار التماسك في المحتوى الطويل: اطلب قصة قصيرة من 1,000 كلمة بمنعطف نهائي محدد. هل يمهّد النموذج التحضير بشكل طبيعي ويقدّم الذروة؟
  • اختبار الحوار: اكتب مشهداً بشخصيتين بأنماط كلام مختلفة. هل تبدو كل شخصية مميزة، أم يبدو الحوار موحّداً؟
مقارنة نماذج LLM المحلية للكتابة الإبداعية: Llama 3.3 70B (40GB، أفضل نثر)، Mistral 24B (14GB، مستوى 16GB)، Llama 3.3 8B (6GB، مستوى الدخول).
مقارنة نماذج LLM المحلية للكتابة الإبداعية: Llama 3.3 70B (40GB، أفضل نثر)، Mistral 24B (14GB، مستوى 16GB)، Llama 3.3 8B (6GB، مستوى الدخول).

#1 Meta Llama 3.3 70B -- أفضل جودة نثر محلياً

يُنتج Llama 3.3 70B أكثر النثر الإنجليزي طبيعيةً وتنوعاً بين أي نموذج قابل للتشغيل محلياً. يمنحه تدريبه على مجموعة نصوص إنجليزية متنوعة أكبر مدى أسلوبي — من الروايات الأدبية البسيطة إلى إيقاع رواية التشويق النوعية. التماسك في المحتوى الطويل (1,000-3,000 كلمة) أفضل بشكل ملحوظ من أي نموذج 7B أو 13B.

القيد هو العتاد: 40 GB من RAM بصيغة Q4_K_M. لجلسات الكتابة الإبداعية (بدلاً من التوليد الدفعي)، سرعة التوليد الأبطأ (8-15 tok/ث على CPU) محتملة. على Apple M2 Ultra أو M5 Max بذاكرة موحدة 64+ GB، يصل التوليد إلى 20-35 tok/ث.

المواصفةالقيمة
الأفضل لـالروايات الطويلة، النثر الغني
RAM المطلوبة (Q4_K_M)~40 GB
مدى أسلوب النثرالأوسع بين النماذج المحلية
التماسك في المحتوى الطويلقوي (مشاهد 1K-3K كلمة)
أمر Ollamaollama run llama3.3:70b
طيف جودة الكتابة الإبداعية بنماذج LLM المحلية: 8B يتعامل مع قصص 500 كلمة، 24B حتى 2K كلمة، 70B يحافظ على مشاهد 1K-3K كلمة بأكبر مدى أسلوبي.
طيف جودة الكتابة الإبداعية بنماذج LLM المحلية: 8B يتعامل مع قصص 500 كلمة، 24B حتى 2K كلمة، 70B يحافظ على مشاهد 1K-3K كلمة بأكبر مدى أسلوبي.

#2 Mistral Small 3.1 24B -- أفضل كتابة إبداعية لـ 16 GB من RAM

يقدّم Mistral Small 3.1 24B جودة كتابة إبداعية أعلى بشكل ملحوظ من أي نموذج 7B، بينما يتسع في 14 GB من RAM. اتباعه للتعليمات دقيق بما يكفي للتعامل مع مواصفات أسلوب مفصّلة ("اكتب بضمير المخاطب، الزمن الحاضر، بجمل قصيرة ومباشرة") دون الانحراف بعد بضع فقرات.

للمستخدمين الذين يريدون قدرة سردية طويلة حقيقية دون جهاز من فئة محطة العمل، Mistral Small 3.1 هو الخيار العملي.

المواصفةالقيمة
الأفضل لـالسرد الطويل، تعليمة الأسلوب
RAM المطلوبة (Q4_K_M)~14 GB
مدى أسلوب النثرقوي — أعلى بشكل ملحوظ من فئة 7B
التماسك في المحتوى الطويلجيد (مشاهد 500-1,500 كلمة)
أمر Ollamaollama run mistral-small3.1

#3 Llama 3.3 8B -- أفضل كتابة إبداعية لـ 8 GB من RAM

في مستوى 8 GB من RAM، يتفوق Llama 3.3 8B على Qwen3 7B وMistral Small للكتابة الإبداعية بالإنجليزية. Qwen3 أقوى في البرمجة والمهام المنظمة، لكن توليده للنثر الإنجليزي أقل طلاقةً للأغراض السردية.

يتعامل Llama 3.3 8B مع الروايات القصيرة (حتى 500 كلمة) بموثوقية. للقصص التي تتجاوز 1,000 كلمة، تتدهور ثبات الجودة — يميل النموذج إلى الانحراف عن التفاصيل السردية الراسخة. هذا قيد جوهري لنماذج فئة 8B في العمل الإبداعي الطويل.

#4 النماذج المضبوطة من المجتمع للروايات وتقمّص الأدوار

يحافظ مجتمع LLM المحلي على نماذج مضبوطة متخصصة مدرَّبة على مجموعات روايات، تتفوق على النماذج الأساسية في المهام السردية المستمرة. متوفرة على Hugging Face ويمكن تحميلها في LM Studio أو Ollama (عبر Modelfiles مخصصة):

  • Fimbulvetr-11B — مضبوط على نثر فانتازيا وخيال علمي عالي الجودة. يُنتج تفاصيل حسية أكثر حيوية وصوت شخصية أكثر اتساقاً من Llama 3.3 8B الأساسي.
  • Midnight-Rose-70B — نموذج مضبوط من Llama 3.3 70B مركّز على الكتابة الإبداعية وسيناريوهات تقمّص الأدوار. تماسك سردي طويل أفضل من النموذج الأساسي.
  • Noromaid / متغيرات Openhermes — نماذج مضبوطة من المجتمع مركّزة على تقمّص الأدوار الحواري. جودة نثر أقل من Fimbulvetr لكنها أكثر استجابةً لتوجيه الشخصية.
  • نزّلها من Hugging Face (ابحث عن "creative writing GGUF") وحمّلها في متصفح النماذج بـ LM Studio أو عبر `ollama create` مع Modelfile مخصص.

نصائح الموجّهات التي تحسّن الكتابة الإبداعية بنماذج LLM المحلية

  • حدّد الأسلوب بشكل ملموس: "اكتب بأسلوب Cormac McCarthy — حوار شحيح، جمل وصفية طويلة، دون علامات اقتباس" يتفوق على "اكتب رواية أدبية."
  • أعطِ النموذج دوراً: "أنت روائي محترف. تابع هذا المشهد دون تلخيص، بالعرض فقط." يتحسن اتباع التعليمات عندما يكون للنموذج هوية محددة.
  • اضبط درجة الحرارة بين 0.9 و1.1: تستفيد المهام الإبداعية من درجة حرارة أعلى (عشوائية أكبر). درجة حرارة Ollama الافتراضية 0.8؛ وافتراضي LM Studio 0.7. ارفعها عبر شريط المعاملات.
  • استخدم موجّه نظام: ضع تعليمة أسلوب دائمة على مستوى الجلسة. "تكتب رواية رعب قوطي. حافظ على نثر مظلم وأجواء قاتمة في جميع الردود."
  • قسّم المهام الطويلة إلى أقسام: لفصل من 3,000 كلمة، ولّده في أقسام من 500 كلمة. يبقي هذا النموذج ضمن مدى تماسكه الموثوق.
  • قارن المخرجات المحلية والسحابية: استخدم PromptQuorum لإرسال نفس الموجّه الإبداعي إلى نموذج Ollama المحلي والنماذج السحابية في آن واحد — مفيد لمعايرة متى تكون الجودة المحلية كافية.
دليل درجة حرارة LLM للكتابة الإبداعية: 0.7 الافتراضي مسطّح جداً، 0.9-1.05 الأمثل للروايات، فوق 1.1 ينتج مخرجات غير متماسكة.
دليل درجة حرارة LLM للكتابة الإبداعية: 0.7 الافتراضي مسطّح جداً، 0.9-1.05 الأمثل للروايات، فوق 1.1 ينتج مخرجات غير متماسكة.

موجّه سيئ مقابل موجّه جيد

  • ❌ "اكتب قصة فانتازيا" ← ✅ "اكتب مشهد فانتازيا من 500 كلمة حيث يتفاوض مهرّب مع تنين حول قطع أثرية قديمة. استخدم تفاصيل حسية واجعل الحوار متوتراً."
  • ❌ "اكتب شيئاً مثيراً" ← ✅ "اكتب مشهداً افتتاحياً من 300 كلمة لسرقة تسوء. يكتشف البطل أن شريكه خانه في منتصف المهمة. استخدم جملاً قصيرة ومباشرة لمطابقة الإيقاع."
  • ❌ "اكتب لغزاً" ← ✅ "تابع مشهد المحقق هذا: [النص السابق]. يدرك المحقق أن المشتبه به يكذب بسبب تفصيل واحد. اعرض — لا تخبر — كيف تكتشف التناقض."
  • ❌ "اجعله أكثر إثارة" ← ✅ "أعد كتابة الفقرة السابقة لتبدو أكثر طابعاً نوار: حوار شحيح، مونولوج داخلي ساخر، تفاصيل حسية محددة (أصوات، روائح، ملمس)."

الكتابة الإبداعية بنماذج LLM المحلية: السياق الإقليمي

أوروبا (GDPR وإقامة البيانات): يتطلب GDPR بقاء البيانات الشخصية الحساسة (خلفيات الشخصيات، المحتوى الروائي للنشر) ضمن حدود الاتحاد الأوروبي عند معالجتها. يضمن تشغيل النماذج المحلية على عتاد مقره الاتحاد الأوروبي الامتثال. يلبّي LM Studio وOllama المنشوران على خوادم ألمانية أو فرنسية أو نمساوية اتفاقيات المعالج بموجب المادة 28 دون اعتماد على السحابة.

اليابان (التوطين وترميز الأحرف): تستخدم الكتابة الإبداعية اليابانية كتابات مختلطة (هيراغانا، كاتاكانا، كانجي)، وعلامات ترقيم معقدة، وقواعد تباعد دقيقة. تتعامل النماذج المضبوطة على الأدب الياباني مع هذه الأنماط بشكل أفضل من النماذج المحسّنة للإنجليزية. يدعم LM Studio UTF-8 وUnicode؛ ويعمل Ollama مع نماذج يابانية مثل Shisa-7B-v1 وWeblab-10B.

منطقة الخليج (السعودية والإمارات): للكتّاب والناشرين العرب الذين يديرون ملكية فكرية روائية خاصة، يضمن التشغيل المحلي بقاء المحتوى الإبداعي ضمن حدود الجهاز، بما يتوافق مع نظام حماية البيانات الشخصية السعودي (PDPL) ومتطلبات سيادة البيانات في الإمارات. للكتابة الإبداعية بالعربية الفصحى، تتوفر نماذج عربية سيادية مثل Jais وALLaM وFalcon بقدرة عربية أصلية أقوى من النماذج المحسّنة للإنجليزية. النشر المحلي مناسب للناشرين العرب ومطوّري الألعاب والمؤسسات.

هل يمكن لنموذج LLM محلي أن يحل محل مساعد كتابة مثل Claude أو GPT-5.5 للروايات؟

للمحتوى القصير (أقل من 500 كلمة)، ينتج نموذج محلي 13B+ مُوجَّه جيداً مخرجات يصعب تمييزها عن النماذج السحابية في الاختبارات العمياء. للروايات الطويلة (الروايات الكاملة، القصص الكاملة)، يحافظ Claude Opus 4.8 وGPT-5.5 على التماسك السردي بموثوقية أكبر عند أي مستوى عتاد. نموذج محلي بحجم 70B يقلّص هذه الفجوة بشكل كبير.

هل يتذكر النموذج أجزاءً سابقة من قصتي؟

فقط ضمن نافذة السياق الحالية. إذا تجاوز سجل المحادثة حد سياق النموذج (عادةً 4K-128K رمز)، تُنسى التفاصيل السابقة. للمشاريع الطويلة، قدّم بشكل دوري ملخصاً للقصة في بداية كل جلسة لإعادة ضبط السياق.

أي نموذج محلي ينتج النثر الأكثر حيوية؟

يُنتج Llama 3.3 70B بتكميم Q5_K_M أكثر التفاصيل الحسية حيوية وتدفق حوار طبيعي بشكل متسق. يحقق Mistral Small 3.1 24B 80-85% من هذه الجودة بـ 14 GB من RAM مقابل 45 GB لنموذج 70B. النموذج المضبوط Fimbulvetr-11B على قاعدة 13B يتفوق أيضاً في ثراء النثر ضمن موارد أصغر.

كيف أتعامل مع تناقضات صوت الشخصية عبر الفصول؟

قدّم بطاقة شخصية مفصّلة (الاسم، الخلفية، أنماط الكلام، الدوافع) في موجّه النظام. لكل فصل جديد، ابدأ الجلسة بـ: "تكتب بصفتك [الشخصية]. حافظ على الصوت والمنظور التاليين..." ثم الصق بطاقة الشخصية. يحافظ هذا على التماسك لأقسام من 500-2,000 كلمة.

هل التكميم (Q4، Q5، Q8) ملحوظ في الكتابة الإبداعية؟

نعم، بشكل قابل للقياس. FP16 (الدقة الكاملة) وQ8 ينتجان نثراً شبه متطابق. يُدخل Q5 تسطيحاً طفيفاً — صفات فريدة أقل، عبارات متكررة قليلاً (5-10% من المستخدمين يلاحظون ذلك). يخلق Q4 فقداناً واضحاً للجودة: أوصاف عامة، نقص في التفاصيل الحسية. للروايات، Q5_K_M هو الحد الأدنى الموصى به؛ وQ8_K_M هو المثالي.

هل يمكنني ضبط نموذج LLM محلي بدقة بأسلوب كتابتي الخاص؟

نعم. اجمع 500-2,000 مثال من نثرك بصيغة .jsonl (أزواج مدخلات/مخرجات)، ثم استخدم مكتبتي Unsloth أو Axolotl على GPU بسعة 24 GB لضبط نموذج 13B بدقة في 4-8 ساعات. التكلفة: ~5-15 دولاراً من GPU السحابية. النتيجة: نموذج يحاكي صوتك. الضبط بـ LoRA (التكيّف منخفض الرتبة) أسرع وأرخص من الضبط الكامل.

ما الفرق بين جودة الكتابة الإبداعية وجودة *الحوار* الإبداعي؟

يتطلب الحوار اقتصاداً أكثر إحكاماً في الكلمات وأصواتاً مميزة للشخصيات؛ ويتطلب النثر ثراءً حسياً وتدفقاً سردياً. يتفوق Llama 3.3 70B في كليهما. تنتج النماذج الأصغر (7B، 8B) غالباً حواراً مسطحاً وعاماً. إذا كانت الروايات كثيفة الحوار محور تركيزك، أعطِ الأولوية للنماذج ذات اتباع التعليمات الجيد على جودة النثر؛ تنافس جودة حوار Mistral Small جودة Llama 8B.

كم سياقاً (رموزاً) أحتاج لمخطط رواية كامل؟

مخطط مفصّل لرواية من 80,000 كلمة (الحبكة، الشخصيات، الفصول، الصراعات) عادةً 3,000-6,000 رمز. نموذج بسياق 128K (Llama 3.2، Phi-4) يتيح لك تحميل المخطط الكامل + الفصول السابقة في جلسة واحدة. للنماذج بسياق 4K-8K، قدّم ملخصاً متجدداً: ملخص الفصل السابق + مخطط الفصول الثلاثة التالية.

هل أحتاج إلى GPU لتشغيل نموذج LLM محلي محسّن للكتابة الإبداعية؟

لا، لكنها تسرّع التوليد بشكل كبير. نموذج 13B على CPU (8 أنوية): 10-15 رمزاً/ث. نفس النموذج على GPU بسعة 10GB (RTX 3060): 80-100 رمزاً/ث. للكتابة الإبداعية التكرارية (تجربة التنويعات، إعادة الكتابة)، تقلّص GPU وقت الجلسة من ساعتين إلى 15 دقيقة. CPU صالح للتوليد لمرة واحدة أو للمخططات.

أي نموذج LLM محلي أفضل لبناء عوالم الخيال العلمي؟

Llama 3.3 70B للاتساق في مخططات تتجاوز 50 صفحة. Qwen3 14B-32B للدقة التقنية (الفيزياء، الميكانيكا المدارية، الكيمياء). Fimbulvetr-11B للتفاصيل الوصفية الغنية للعالم. للإعدادات محدودة الميزانية، يوازن Mistral Small 3.1 24B بين تماسك العالم واستخدام الموارد. جرّب الثلاثة بوصف عيّنة قبل أن تقرر.

المصادر

أخطاء شائعة في الموجّهات للكتابة الإبداعية

  • موجّهات عامة لأهداف محددة: "اكتب قصة" ينتج مخرجات عامة. بدلاً من ذلك: "اكتب مشهداً افتتاحياً من 800 كلمة لسرقة. يكتشف البطل أن الخزنة فارغة بالفعل. اعرض — لا تخبر — رد فعله العاطفي عبر الوصف الجسدي."
  • تجاهل تأثيرات التكميم: تشغيل نموذج 13B بصيغة Q4 وتوقّع جودة نثر مكافئة للدقة الكاملة. يسطّح Q4 النثر بشكل ملحوظ. استخدم Q5_K_M كحد أدنى للكتابة الإبداعية؛ وQ8 لجودة قابلة للنشر.
  • إهمال درجة الحرارة ومعاملات أخذ العينات: استخدام درجة الحرارة الافتراضية (0.7-0.8) للمهام الإبداعية. ارفعها إلى 0.95-1.1 واضبط top_p على 0.85-0.9 لنثر أكثر تنوعاً وإثارة. عالية جداً (>1.2) تنتج عدم تماسك.
  • نسيان تدهور السياق: بعد 2,000-4,000 رمز في محادثة، حتى نماذج 70B تفقد أثر تفاصيل الشخصيات السابقة. أعد إدخال ملخصات الشخصيات بشكل دوري أو ابدأ جلسات جديدة.
  • معاملة النماذج المحلية كنماذج سحابية: تتفوق النماذج السحابية مثل Claude 4 في التخطيط الطويل والمهام متعددة الخطوات. تتفوق النماذج المحلية في التوليد مشهداً بمشهد بموجّهات صارمة. استخدم المحلي للتنفيذ والسحابة للمخططات.

A Note on Third-Party Facts

This article references third-party AI models, benchmarks, prices, and licenses. The AI landscape changes rapidly. Benchmark scores, license terms, model names, and API prices can shift between the time of writing and the time you read this. Before making deployment or compliance decisions based on this article, verify current figures on each provider’s official source: Hugging Face model cards for licenses and benchmarks, provider websites for API pricing, and EUR-Lex for current GDPR and EU AI Act text. This article reflects publicly available information as of May 2026.

Run PromptQuorum with a local LLM, your own API keys, or both — you pick the backend.

Join the PromptQuorum Waitlist →

← Back to Local LLMs