Key Takeaways
- الاختبارات القياسية (MMLU، HumanEval) لا تقيس جودة الكتابة الإبداعية — قيّم النماذج بموجّهات العيّنة الخاصة بك.
- أفضل نثر عموماً: Llama 3.3 70B — أكثر أسلوب سردي إنجليزي طبيعي على نطاق قابل للتشغيل محلياً.
- الأفضل لـ 16 GB من RAM: Mistral Small 3.1 24B — مخرجات إبداعية قوية، أفضل بشكل ملحوظ من نماذج 7B للسرد الطويل.
- الأفضل لـ 8 GB من RAM: Llama 3.3 8B — اتباع أفضل للتعليمات الإبداعية من Qwen3 7B لمهام الروايات بالإنجليزية.
- النماذج المضبوطة من المجتمع (Fimbulvetr-11B، Midnight-Rose-70B) المدرَّبة خصيصاً على الروايات الإبداعية تتفوق على النماذج الأساسية في المهام السردية المستمرة.
كيف تقيّم جودة نموذج LLM محلي للكتابة الإبداعية؟
اعتباراً من أبريل 2026، لا يُقاس أداء الكتابة الإبداعية جيداً بالاختبارات القياسية (MMLU، HumanEval). لتقييم نموذج للكتابة الإبداعية، اختبره مباشرةً بأنواع الموجّهات التي تخطط لاستخدامها:
- اختبار استمرارية النثر: أعطِ النموذج أول فقرتين من مشهد واطلب منه المتابعة لـ 500 كلمة. هل يحافظ على نبرة وصوت شخصية ومنطق سردي متسق؟
- اختبار تعليمة الأسلوب: اطلب من النموذج كتابة فقرة "بأسلوب Raymond Carver" أو "بإيقاع رواية تشويق". هل يغيّر الأسلوب بشكل ملموس، أم ينتج مخرجات عامة؟
- اختبار التماسك في المحتوى الطويل: اطلب قصة قصيرة من 1,000 كلمة بمنعطف نهائي محدد. هل يمهّد النموذج التحضير بشكل طبيعي ويقدّم الذروة؟
- اختبار الحوار: اكتب مشهداً بشخصيتين بأنماط كلام مختلفة. هل تبدو كل شخصية مميزة، أم يبدو الحوار موحّداً؟

#1 Meta Llama 3.3 70B -- أفضل جودة نثر محلياً
يُنتج Llama 3.3 70B أكثر النثر الإنجليزي طبيعيةً وتنوعاً بين أي نموذج قابل للتشغيل محلياً. يمنحه تدريبه على مجموعة نصوص إنجليزية متنوعة أكبر مدى أسلوبي — من الروايات الأدبية البسيطة إلى إيقاع رواية التشويق النوعية. التماسك في المحتوى الطويل (1,000-3,000 كلمة) أفضل بشكل ملحوظ من أي نموذج 7B أو 13B.
القيد هو العتاد: 40 GB من RAM بصيغة Q4_K_M. لجلسات الكتابة الإبداعية (بدلاً من التوليد الدفعي)، سرعة التوليد الأبطأ (8-15 tok/ث على CPU) محتملة. على Apple M2 Ultra أو M5 Max بذاكرة موحدة 64+ GB، يصل التوليد إلى 20-35 tok/ث.
| المواصفة | القيمة |
|---|---|
| الأفضل لـ | الروايات الطويلة، النثر الغني |
| RAM المطلوبة (Q4_K_M) | ~40 GB |
| مدى أسلوب النثر | الأوسع بين النماذج المحلية |
| التماسك في المحتوى الطويل | قوي (مشاهد 1K-3K كلمة) |
| أمر Ollama | ollama run llama3.3:70b |

#2 Mistral Small 3.1 24B -- أفضل كتابة إبداعية لـ 16 GB من RAM
يقدّم Mistral Small 3.1 24B جودة كتابة إبداعية أعلى بشكل ملحوظ من أي نموذج 7B، بينما يتسع في 14 GB من RAM. اتباعه للتعليمات دقيق بما يكفي للتعامل مع مواصفات أسلوب مفصّلة ("اكتب بضمير المخاطب، الزمن الحاضر، بجمل قصيرة ومباشرة") دون الانحراف بعد بضع فقرات.
للمستخدمين الذين يريدون قدرة سردية طويلة حقيقية دون جهاز من فئة محطة العمل، Mistral Small 3.1 هو الخيار العملي.
| المواصفة | القيمة |
|---|---|
| الأفضل لـ | السرد الطويل، تعليمة الأسلوب |
| RAM المطلوبة (Q4_K_M) | ~14 GB |
| مدى أسلوب النثر | قوي — أعلى بشكل ملحوظ من فئة 7B |
| التماسك في المحتوى الطويل | جيد (مشاهد 500-1,500 كلمة) |
| أمر Ollama | ollama run mistral-small3.1 |
#3 Llama 3.3 8B -- أفضل كتابة إبداعية لـ 8 GB من RAM
في مستوى 8 GB من RAM، يتفوق Llama 3.3 8B على Qwen3 7B وMistral Small للكتابة الإبداعية بالإنجليزية. Qwen3 أقوى في البرمجة والمهام المنظمة، لكن توليده للنثر الإنجليزي أقل طلاقةً للأغراض السردية.
يتعامل Llama 3.3 8B مع الروايات القصيرة (حتى 500 كلمة) بموثوقية. للقصص التي تتجاوز 1,000 كلمة، تتدهور ثبات الجودة — يميل النموذج إلى الانحراف عن التفاصيل السردية الراسخة. هذا قيد جوهري لنماذج فئة 8B في العمل الإبداعي الطويل.
#4 النماذج المضبوطة من المجتمع للروايات وتقمّص الأدوار
يحافظ مجتمع LLM المحلي على نماذج مضبوطة متخصصة مدرَّبة على مجموعات روايات، تتفوق على النماذج الأساسية في المهام السردية المستمرة. متوفرة على Hugging Face ويمكن تحميلها في LM Studio أو Ollama (عبر Modelfiles مخصصة):
- Fimbulvetr-11B — مضبوط على نثر فانتازيا وخيال علمي عالي الجودة. يُنتج تفاصيل حسية أكثر حيوية وصوت شخصية أكثر اتساقاً من Llama 3.3 8B الأساسي.
- Midnight-Rose-70B — نموذج مضبوط من Llama 3.3 70B مركّز على الكتابة الإبداعية وسيناريوهات تقمّص الأدوار. تماسك سردي طويل أفضل من النموذج الأساسي.
- Noromaid / متغيرات Openhermes — نماذج مضبوطة من المجتمع مركّزة على تقمّص الأدوار الحواري. جودة نثر أقل من Fimbulvetr لكنها أكثر استجابةً لتوجيه الشخصية.
- نزّلها من Hugging Face (ابحث عن "creative writing GGUF") وحمّلها في متصفح النماذج بـ LM Studio أو عبر `ollama create` مع Modelfile مخصص.
نصائح الموجّهات التي تحسّن الكتابة الإبداعية بنماذج LLM المحلية
- حدّد الأسلوب بشكل ملموس: "اكتب بأسلوب Cormac McCarthy — حوار شحيح، جمل وصفية طويلة، دون علامات اقتباس" يتفوق على "اكتب رواية أدبية."
- أعطِ النموذج دوراً: "أنت روائي محترف. تابع هذا المشهد دون تلخيص، بالعرض فقط." يتحسن اتباع التعليمات عندما يكون للنموذج هوية محددة.
- اضبط درجة الحرارة بين 0.9 و1.1: تستفيد المهام الإبداعية من درجة حرارة أعلى (عشوائية أكبر). درجة حرارة Ollama الافتراضية 0.8؛ وافتراضي LM Studio 0.7. ارفعها عبر شريط المعاملات.
- استخدم موجّه نظام: ضع تعليمة أسلوب دائمة على مستوى الجلسة. "تكتب رواية رعب قوطي. حافظ على نثر مظلم وأجواء قاتمة في جميع الردود."
- قسّم المهام الطويلة إلى أقسام: لفصل من 3,000 كلمة، ولّده في أقسام من 500 كلمة. يبقي هذا النموذج ضمن مدى تماسكه الموثوق.
- قارن المخرجات المحلية والسحابية: استخدم PromptQuorum لإرسال نفس الموجّه الإبداعي إلى نموذج Ollama المحلي والنماذج السحابية في آن واحد — مفيد لمعايرة متى تكون الجودة المحلية كافية.
موجّه سيئ مقابل موجّه جيد
- ❌ "اكتب قصة فانتازيا" ← ✅ "اكتب مشهد فانتازيا من 500 كلمة حيث يتفاوض مهرّب مع تنين حول قطع أثرية قديمة. استخدم تفاصيل حسية واجعل الحوار متوتراً."
- ❌ "اكتب شيئاً مثيراً" ← ✅ "اكتب مشهداً افتتاحياً من 300 كلمة لسرقة تسوء. يكتشف البطل أن شريكه خانه في منتصف المهمة. استخدم جملاً قصيرة ومباشرة لمطابقة الإيقاع."
- ❌ "اكتب لغزاً" ← ✅ "تابع مشهد المحقق هذا: [النص السابق]. يدرك المحقق أن المشتبه به يكذب بسبب تفصيل واحد. اعرض — لا تخبر — كيف تكتشف التناقض."
- ❌ "اجعله أكثر إثارة" ← ✅ "أعد كتابة الفقرة السابقة لتبدو أكثر طابعاً نوار: حوار شحيح، مونولوج داخلي ساخر، تفاصيل حسية محددة (أصوات، روائح، ملمس)."
الكتابة الإبداعية بنماذج LLM المحلية: السياق الإقليمي
أوروبا (GDPR وإقامة البيانات): يتطلب GDPR بقاء البيانات الشخصية الحساسة (خلفيات الشخصيات، المحتوى الروائي للنشر) ضمن حدود الاتحاد الأوروبي عند معالجتها. يضمن تشغيل النماذج المحلية على عتاد مقره الاتحاد الأوروبي الامتثال. يلبّي LM Studio وOllama المنشوران على خوادم ألمانية أو فرنسية أو نمساوية اتفاقيات المعالج بموجب المادة 28 دون اعتماد على السحابة.
اليابان (التوطين وترميز الأحرف): تستخدم الكتابة الإبداعية اليابانية كتابات مختلطة (هيراغانا، كاتاكانا، كانجي)، وعلامات ترقيم معقدة، وقواعد تباعد دقيقة. تتعامل النماذج المضبوطة على الأدب الياباني مع هذه الأنماط بشكل أفضل من النماذج المحسّنة للإنجليزية. يدعم LM Studio UTF-8 وUnicode؛ ويعمل Ollama مع نماذج يابانية مثل Shisa-7B-v1 وWeblab-10B.
منطقة الخليج (السعودية والإمارات): للكتّاب والناشرين العرب الذين يديرون ملكية فكرية روائية خاصة، يضمن التشغيل المحلي بقاء المحتوى الإبداعي ضمن حدود الجهاز، بما يتوافق مع نظام حماية البيانات الشخصية السعودي (PDPL) ومتطلبات سيادة البيانات في الإمارات. للكتابة الإبداعية بالعربية الفصحى، تتوفر نماذج عربية سيادية مثل Jais وALLaM وFalcon بقدرة عربية أصلية أقوى من النماذج المحسّنة للإنجليزية. النشر المحلي مناسب للناشرين العرب ومطوّري الألعاب والمؤسسات.
هل يمكن لنموذج LLM محلي أن يحل محل مساعد كتابة مثل Claude أو GPT-5.5 للروايات؟
للمحتوى القصير (أقل من 500 كلمة)، ينتج نموذج محلي 13B+ مُوجَّه جيداً مخرجات يصعب تمييزها عن النماذج السحابية في الاختبارات العمياء. للروايات الطويلة (الروايات الكاملة، القصص الكاملة)، يحافظ Claude Opus 4.8 وGPT-5.5 على التماسك السردي بموثوقية أكبر عند أي مستوى عتاد. نموذج محلي بحجم 70B يقلّص هذه الفجوة بشكل كبير.
هل يتذكر النموذج أجزاءً سابقة من قصتي؟
فقط ضمن نافذة السياق الحالية. إذا تجاوز سجل المحادثة حد سياق النموذج (عادةً 4K-128K رمز)، تُنسى التفاصيل السابقة. للمشاريع الطويلة، قدّم بشكل دوري ملخصاً للقصة في بداية كل جلسة لإعادة ضبط السياق.
أي نموذج محلي ينتج النثر الأكثر حيوية؟
يُنتج Llama 3.3 70B بتكميم Q5_K_M أكثر التفاصيل الحسية حيوية وتدفق حوار طبيعي بشكل متسق. يحقق Mistral Small 3.1 24B 80-85% من هذه الجودة بـ 14 GB من RAM مقابل 45 GB لنموذج 70B. النموذج المضبوط Fimbulvetr-11B على قاعدة 13B يتفوق أيضاً في ثراء النثر ضمن موارد أصغر.
كيف أتعامل مع تناقضات صوت الشخصية عبر الفصول؟
قدّم بطاقة شخصية مفصّلة (الاسم، الخلفية، أنماط الكلام، الدوافع) في موجّه النظام. لكل فصل جديد، ابدأ الجلسة بـ: "تكتب بصفتك [الشخصية]. حافظ على الصوت والمنظور التاليين..." ثم الصق بطاقة الشخصية. يحافظ هذا على التماسك لأقسام من 500-2,000 كلمة.
هل التكميم (Q4، Q5، Q8) ملحوظ في الكتابة الإبداعية؟
نعم، بشكل قابل للقياس. FP16 (الدقة الكاملة) وQ8 ينتجان نثراً شبه متطابق. يُدخل Q5 تسطيحاً طفيفاً — صفات فريدة أقل، عبارات متكررة قليلاً (5-10% من المستخدمين يلاحظون ذلك). يخلق Q4 فقداناً واضحاً للجودة: أوصاف عامة، نقص في التفاصيل الحسية. للروايات، Q5_K_M هو الحد الأدنى الموصى به؛ وQ8_K_M هو المثالي.
هل يمكنني ضبط نموذج LLM محلي بدقة بأسلوب كتابتي الخاص؟
نعم. اجمع 500-2,000 مثال من نثرك بصيغة .jsonl (أزواج مدخلات/مخرجات)، ثم استخدم مكتبتي Unsloth أو Axolotl على GPU بسعة 24 GB لضبط نموذج 13B بدقة في 4-8 ساعات. التكلفة: ~5-15 دولاراً من GPU السحابية. النتيجة: نموذج يحاكي صوتك. الضبط بـ LoRA (التكيّف منخفض الرتبة) أسرع وأرخص من الضبط الكامل.
ما الفرق بين جودة الكتابة الإبداعية وجودة *الحوار* الإبداعي؟
يتطلب الحوار اقتصاداً أكثر إحكاماً في الكلمات وأصواتاً مميزة للشخصيات؛ ويتطلب النثر ثراءً حسياً وتدفقاً سردياً. يتفوق Llama 3.3 70B في كليهما. تنتج النماذج الأصغر (7B، 8B) غالباً حواراً مسطحاً وعاماً. إذا كانت الروايات كثيفة الحوار محور تركيزك، أعطِ الأولوية للنماذج ذات اتباع التعليمات الجيد على جودة النثر؛ تنافس جودة حوار Mistral Small جودة Llama 8B.
كم سياقاً (رموزاً) أحتاج لمخطط رواية كامل؟
مخطط مفصّل لرواية من 80,000 كلمة (الحبكة، الشخصيات، الفصول، الصراعات) عادةً 3,000-6,000 رمز. نموذج بسياق 128K (Llama 3.2، Phi-4) يتيح لك تحميل المخطط الكامل + الفصول السابقة في جلسة واحدة. للنماذج بسياق 4K-8K، قدّم ملخصاً متجدداً: ملخص الفصل السابق + مخطط الفصول الثلاثة التالية.
هل أحتاج إلى GPU لتشغيل نموذج LLM محلي محسّن للكتابة الإبداعية؟
لا، لكنها تسرّع التوليد بشكل كبير. نموذج 13B على CPU (8 أنوية): 10-15 رمزاً/ث. نفس النموذج على GPU بسعة 10GB (RTX 3060): 80-100 رمزاً/ث. للكتابة الإبداعية التكرارية (تجربة التنويعات، إعادة الكتابة)، تقلّص GPU وقت الجلسة من ساعتين إلى 15 دقيقة. CPU صالح للتوليد لمرة واحدة أو للمخططات.
أي نموذج LLM محلي أفضل لبناء عوالم الخيال العلمي؟
Llama 3.3 70B للاتساق في مخططات تتجاوز 50 صفحة. Qwen3 14B-32B للدقة التقنية (الفيزياء، الميكانيكا المدارية، الكيمياء). Fimbulvetr-11B للتفاصيل الوصفية الغنية للعالم. للإعدادات محدودة الميزانية، يوازن Mistral Small 3.1 24B بين تماسك العالم واستخدام الموارد. جرّب الثلاثة بوصف عيّنة قبل أن تقرر.
المصادر
- إعلان إطلاق Llama 3.3 — المقال الرسمي للنموذج من Meta مع نتائج اختبارات الكتابة الإبداعية
- بطاقات نماذج Mistral AI — مواصفات Mistral Small 3.1 وأدلة التكميم
- مشروع Fimbulvetr — مجموعة نماذج الكتابة الإبداعية المضبوطة التي يحافظ عليها المجتمع
أخطاء شائعة في الموجّهات للكتابة الإبداعية
- موجّهات عامة لأهداف محددة: "اكتب قصة" ينتج مخرجات عامة. بدلاً من ذلك: "اكتب مشهداً افتتاحياً من 800 كلمة لسرقة. يكتشف البطل أن الخزنة فارغة بالفعل. اعرض — لا تخبر — رد فعله العاطفي عبر الوصف الجسدي."
- تجاهل تأثيرات التكميم: تشغيل نموذج 13B بصيغة Q4 وتوقّع جودة نثر مكافئة للدقة الكاملة. يسطّح Q4 النثر بشكل ملحوظ. استخدم Q5_K_M كحد أدنى للكتابة الإبداعية؛ وQ8 لجودة قابلة للنشر.
- إهمال درجة الحرارة ومعاملات أخذ العينات: استخدام درجة الحرارة الافتراضية (0.7-0.8) للمهام الإبداعية. ارفعها إلى 0.95-1.1 واضبط top_p على 0.85-0.9 لنثر أكثر تنوعاً وإثارة. عالية جداً (>1.2) تنتج عدم تماسك.
- نسيان تدهور السياق: بعد 2,000-4,000 رمز في محادثة، حتى نماذج 70B تفقد أثر تفاصيل الشخصيات السابقة. أعد إدخال ملخصات الشخصيات بشكل دوري أو ابدأ جلسات جديدة.
- معاملة النماذج المحلية كنماذج سحابية: تتفوق النماذج السحابية مثل Claude 4 في التخطيط الطويل والمهام متعددة الخطوات. تتفوق النماذج المحلية في التوليد مشهداً بمشهد بموجّهات صارمة. استخدم المحلي للتنفيذ والسحابة للمخططات.
