Key Takeaways
- الاختبارات القياسية (MMLU، HumanEval) لا تقيس جودة الكتابة الإبداعية — قيّم النماذج بموجّهات العيّنة الخاصة بك.
- أفضل نثر عموماً: Llama 3.3 70B — أكثر أسلوب سردي إنجليزي طبيعي على نطاق قابل للتشغيل محلياً.
- الأفضل لـ 16 GB من RAM: Mistral Small 3.1 24B — مخرجات إبداعية قوية، أفضل بشكل ملحوظ من نماذج 7B للسرد الطويل.
- الأفضل لـ 8 GB من RAM: Llama 3.1 8B — اتباع أفضل للتعليمات الإبداعية من Qwen3 7B لمهام الروايات بالإنجليزية.
- النماذج المضبوطة من المجتمع (Fimbulvetr-11B، Midnight-Rose-70B) المدرَّبة خصيصاً على الروايات الإبداعية تتفوق على النماذج الأساسية في المهام السردية المستمرة.
أفضل نماذج LLM المحلية للكتابة الإبداعية هي Meta Llama 3.3 70B لجودة النثر، وMistral Small 3.1 24B لأفضل جودة بأقل من 16 GB من RAM، والنماذج المضبوطة من المجتمع مثل Fimbulvetr وMidnight-Rose لأصوات متخصصة في الروايات وتقمّص الأدوار.
لا تقيس اختبارات الذكاء الاصطناعي القياسية الكتابة الإبداعية جيداً، إذ لا توجد إجابة صحيحة واحدة لموجّه قصصي. عملياً، يميل Llama 3.3 70B لإنتاج نثر أغنى إذا توفرت لديك الذاكرة اللازمة، ويُعد Mistral Small 3.1 24B الخيار الأفضل إذا كنت محدوداً بـ 16 GB، وغالباً ما تتفوق النماذج المضبوطة من المجتمع المدرّبة خصيصاً على الروايات وتقمّص الأدوار على النماذج العامة من حيث الصوت والنبرة.
كيف تقيّم جودة نموذج LLM محلي للكتابة الإبداعية؟
لا يُقاس أداء الكتابة الإبداعية جيداً بالاختبارات القياسية (MMLU، HumanEval). لتقييم نموذج للكتابة الإبداعية، اختبره مباشرةً بأنواع الموجّهات التي تخطط لاستخدامها:
- اختبار استمرارية النثر: أعطِ النموذج أول فقرتين من مشهد واطلب منه المتابعة لـ 500 كلمة. هل يحافظ على نبرة وصوت شخصية ومنطق سردي متسق؟
- اختبار تعليمة الأسلوب: اطلب من النموذج كتابة فقرة "بأسلوب Raymond Carver" أو "بإيقاع رواية تشويق". هل يغيّر الأسلوب بشكل ملموس، أم ينتج مخرجات عامة؟
- اختبار التماسك في المحتوى الطويل: اطلب قصة قصيرة من 1,000 كلمة بمنعطف نهائي محدد. هل يمهّد النموذج التحضير بشكل طبيعي ويقدّم الذروة؟
- اختبار الحوار: اكتب مشهداً بشخصيتين بأنماط كلام مختلفة. هل تبدو كل شخصية مميزة، أم يبدو الحوار موحّداً؟

#1 Meta Llama 3.3 70B -- أفضل جودة نثر محلياً
يُنتج Llama 3.3 70B أكثر النثر الإنجليزي طبيعيةً وتنوعاً بين أي نموذج قابل للتشغيل محلياً. يمنحه تدريبه على مجموعة نصوص إنجليزية متنوعة أكبر مدى أسلوبي — من الروايات الأدبية البسيطة إلى إيقاع رواية التشويق النوعية. التماسك في المحتوى الطويل (1,000-3,000 كلمة) أفضل بشكل ملحوظ من أي نموذج 7B أو 13B.
القيد هو العتاد: 40 GB من RAM بصيغة Q4_K_M. لجلسات الكتابة الإبداعية (بدلاً من التوليد الدفعي)، سرعة التوليد الأبطأ (8-15 tok/ث على CPU) محتملة. على Apple M2 Ultra أو M5 Max بذاكرة موحدة 64+ GB، يصل التوليد إلى 20-35 tok/ث.
المواصفة | القيمة |
|---|---|
| الأفضل لـ | الروايات الطويلة، النثر الغني |
| RAM المطلوبة (Q4_K_M) | ~40 GB |
| مدى أسلوب النثر | الأوسع بين النماذج المحلية |
| التماسك في المحتوى الطويل | قوي (مشاهد 1K-3K كلمة) |
| أمر Ollama | ollama run llama3.3:70b |

#2 Mistral Small 3.1 24B -- أفضل كتابة إبداعية لـ 16 GB من RAM
يقدّم Mistral Small 3.1 24B جودة كتابة إبداعية أعلى بشكل ملحوظ من أي نموذج 7B، بينما يتسع في 14 GB من RAM. اتباعه للتعليمات دقيق بما يكفي للتعامل مع مواصفات أسلوب مفصّلة ("اكتب بضمير المخاطب، الزمن الحاضر، بجمل قصيرة ومباشرة") دون الانحراف بعد بضع فقرات.
للمستخدمين الذين يريدون قدرة سردية طويلة حقيقية دون جهاز من فئة محطة العمل، Mistral Small 3.1 هو الخيار العملي.
المواصفة | القيمة |
|---|---|
| الأفضل لـ | السرد الطويل، تعليمة الأسلوب |
| RAM المطلوبة (Q4_K_M) | ~14 GB |
| مدى أسلوب النثر | قوي — أعلى بشكل ملحوظ من فئة 7B |
| التماسك في المحتوى الطويل | جيد (مشاهد 500-1,500 كلمة) |
| أمر Ollama | ollama run mistral-small3.1 |
#3 Llama 3.1 8B -- أفضل كتابة إبداعية لـ 8 GB من RAM
في مستوى 8 GB من RAM، يتفوق Llama 3.1 8B على Qwen3 7B وMistral Small للكتابة الإبداعية بالإنجليزية. Qwen3 أقوى في البرمجة والمهام المنظمة، لكن توليده للنثر الإنجليزي أقل طلاقةً للأغراض السردية.
يتعامل Llama 3.1 8B مع الروايات القصيرة (حتى 500 كلمة) بموثوقية. للقصص التي تتجاوز 1,000 كلمة، تتدهور ثبات الجودة — يميل النموذج إلى الانحراف عن التفاصيل السردية الراسخة. هذا قيد جوهري لنماذج فئة 8B في العمل الإبداعي الطويل.
#4 النماذج المضبوطة من المجتمع للروايات وتقمّص الأدوار
يحافظ مجتمع LLM المحلي على نماذج مضبوطة متخصصة مدرَّبة على مجموعات روايات، تتفوق على النماذج الأساسية في المهام السردية المستمرة. متوفرة على Hugging Face ويمكن تحميلها في LM Studio أو Ollama (عبر Modelfiles مخصصة):
- Fimbulvetr-11B — مضبوط على نثر فانتازيا وخيال علمي عالي الجودة. يُنتج تفاصيل حسية أكثر حيوية وصوت شخصية أكثر اتساقاً من Llama 3.1 8B الأساسي.
- Midnight-Rose-70B — نموذج مضبوط من Llama 3.3 70B مركّز على الكتابة الإبداعية وسيناريوهات تقمّص الأدوار. تماسك سردي طويل أفضل من النموذج الأساسي.
- Noromaid / متغيرات Openhermes — نماذج مضبوطة من المجتمع مركّزة على تقمّص الأدوار الحواري. جودة نثر أقل من Fimbulvetr لكنها أكثر استجابةً لتوجيه الشخصية.
- GLM-4 (Zhipu AI) — خيار آخر مفتوح الوزن يستحق التجربة للكتابة الإبداعية، خاصة إن كان لديك بالفعل تدفق عمل باللغة الصينية أو حالة استخدام تقمّص أدوار. متوفر على Hugging Face بصيغة GGUF؛ قارنه بـ Fimbulvetr وLlama 3.1 8B على موجّهاتك الخاصة قبل أن تقرر، إذ لم تتم مقارنته هنا مع النماذج أعلاه في جودة النثر الإنجليزي.
- نزّلها من Hugging Face (ابحث عن "creative writing GGUF") وحمّلها في متصفح النماذج بـ LM Studio أو عبر `ollama create` مع Modelfile مخصص.
نصائح الموجّهات التي تحسّن الكتابة الإبداعية بنماذج LLM المحلية
- حدّد الأسلوب بشكل ملموس: "اكتب بأسلوب Cormac McCarthy — حوار شحيح، جمل وصفية طويلة، دون علامات اقتباس" يتفوق على "اكتب رواية أدبية."
- أعطِ النموذج دوراً: "أنت روائي محترف. تابع هذا المشهد دون تلخيص، بالعرض فقط." يتحسن اتباع التعليمات عندما يكون للنموذج هوية محددة.
- اضبط درجة الحرارة بين 0.9 و1.1: تستفيد المهام الإبداعية من درجة حرارة أعلى (عشوائية أكبر). درجة حرارة Ollama الافتراضية 0.8؛ وافتراضي LM Studio 0.7. ارفعها عبر شريط المعاملات.
- استخدم موجّه نظام: ضع تعليمة أسلوب دائمة على مستوى الجلسة. "تكتب رواية رعب قوطي. حافظ على نثر مظلم وأجواء قاتمة في جميع الردود."
- قسّم المهام الطويلة إلى أقسام: لفصل من 3,000 كلمة، ولّده في أقسام من 500 كلمة. يبقي هذا النموذج ضمن مدى تماسكه الموثوق.
- قارن المخرجات المحلية والسحابية: استخدم PromptQuorum لإرسال نفس الموجّه الإبداعي إلى نموذج Ollama المحلي والنماذج السحابية في آن واحد — مفيد لمعايرة متى تكون الجودة المحلية كافية.
- تحميل هذه النماذج في LM Studio: يشغّل LM Studio وOllama نفس ملفات GGUF المكممة، لذا ينطبق الترتيب أعلاه دون تغيير — ابحث عن "Llama 3.3" أو "Mistral Small 3.1" أو "Fimbulvetr" في متصفح النماذج المدمج في LM Studio وحمّله مباشرة. لا يوجد "أفضل نموذج لـ LM Studio" منفصل — إنه نفس ملف النموذج محمّلاً عبر واجهة مختلفة.
أفضل نموذج LLM محلي للشعر
يحتاج الشعر إلى إعداد مختلف عن النثر: الشكل الصارم (الوزن، القافية، عدد المقاطع) يستفيد من درجة حرارة أقل من الروايات الحرة التدفق. للشعر المقيّد بشكل صارم (السوناتة، الهايكو، الفيلانيل)، اضبط درجة الحرارة بين 0.7 و0.85 -- مدى 0.9-1.1 الموصى به للنثر يكسر الوزن ونظام القافية أكثر مما يساعد. للشعر الحر، يظل مدى درجة حرارة النثر منطبقاً.
- الأفضل عموماً: Llama 3.3 70B لأغنى الصور وأوسع مفردات الأدوات الأدبية (الاستعارة، الجناس، التدوير).
- الأفضل للأشكال المنظمة: النموذج الأساسي Mistral Small 3.1 24B أو Llama 3.1 8B -- كلاهما يتتبع عدد المقاطع وأنظمة القافية بموثوقية أكبر من النماذج المضبوطة على الروايات مثل Fimbulvetr، المدرَّبة على النثر السردي وليس الشعر.
- نهج الموجّهات: حدّد الشكل صراحةً -- "اكتب هايكو (5-7-5 مقاطع) عن مطر الخريف" أو "اكتب سوناتة شكسبيرية (ABAB CDCD EFEF GG، وزن خماسي التفعيلة) عن الفقدان." الموجّهات الغامضة ("اكتب قصيدة عن الحب") تنتج شعراً حراً عاماً بغض النظر عن النموذج.
موجّه سيئ مقابل موجّه جيد
- ❌ "اكتب قصة فانتازيا" ← ✅ "اكتب مشهد فانتازيا من 500 كلمة حيث يتفاوض مهرّب مع تنين حول قطع أثرية قديمة. استخدم تفاصيل حسية واجعل الحوار متوتراً."
- ❌ "اكتب شيئاً مثيراً" ← ✅ "اكتب مشهداً افتتاحياً من 300 كلمة لسرقة تسوء. يكتشف البطل أن شريكه خانه في منتصف المهمة. استخدم جملاً قصيرة ومباشرة لمطابقة الإيقاع."
- ❌ "اكتب لغزاً" ← ✅ "تابع مشهد المحقق هذا: [النص السابق]. يدرك المحقق أن المشتبه به يكذب بسبب تفصيل واحد. اعرض — لا تخبر — كيف تكتشف التناقض."
- ❌ "اجعله أكثر إثارة" ← ✅ "أعد كتابة الفقرة السابقة لتبدو أكثر طابعاً نوار: حوار شحيح، مونولوج داخلي ساخر، تفاصيل حسية محددة (أصوات، روائح، ملمس)."
الكتابة الإبداعية بنماذج LLM المحلية: السياق الإقليمي
أوروبا (GDPR وإقامة البيانات): يتطلب GDPR بقاء البيانات الشخصية الحساسة (خلفيات الشخصيات، المحتوى الروائي للنشر) ضمن حدود الاتحاد الأوروبي عند معالجتها. يضمن تشغيل النماذج المحلية على عتاد مقره الاتحاد الأوروبي الامتثال. يلبّي LM Studio وOllama المنشوران على خوادم ألمانية أو فرنسية أو نمساوية اتفاقيات المعالج بموجب المادة 28 دون اعتماد على السحابة.
اليابان (التوطين وترميز الأحرف): تستخدم الكتابة الإبداعية اليابانية كتابات مختلطة (هيراغانا، كاتاكانا، كانجي)، وعلامات ترقيم معقدة، وقواعد تباعد دقيقة. تتعامل النماذج المضبوطة على الأدب الياباني مع هذه الأنماط بشكل أفضل من النماذج المحسّنة للإنجليزية. يدعم LM Studio UTF-8 وUnicode؛ ويعمل Ollama مع نماذج يابانية مثل Shisa-7B-v1 وWeblab-10B.
منطقة الخليج (السعودية والإمارات): للكتّاب والناشرين العرب الذين يديرون ملكية فكرية روائية خاصة، يضمن التشغيل المحلي بقاء المحتوى الإبداعي ضمن حدود الجهاز، بما يتوافق مع نظام حماية البيانات الشخصية السعودي (PDPL) ومتطلبات سيادة البيانات في الإمارات. للكتابة الإبداعية بالعربية الفصحى، تتوفر نماذج عربية سيادية مثل Jais وALLaM وFalcon بقدرة عربية أصلية أقوى من النماذج المحسّنة للإنجليزية. النشر المحلي مناسب للناشرين العرب ومطوّري الألعاب والمؤسسات.
هل يمكن لنموذج LLM محلي أن يحل محل مساعد كتابة مثل Claude أو GPT-5.6 للروايات؟
للمحتوى القصير (أقل من 500 كلمة)، ينتج نموذج محلي 13B+ مُوجَّه جيداً مخرجات يصعب تمييزها عن النماذج السحابية في الاختبارات العمياء. للروايات الطويلة (الروايات الكاملة، القصص الكاملة)، يحافظ Claude Opus 5 وGPT-5.6 على التماسك السردي بموثوقية أكبر عند أي مستوى عتاد. نموذج محلي بحجم 70B يقلّص هذه الفجوة بشكل كبير.
هل يتذكر النموذج أجزاءً سابقة من قصتي؟
فقط ضمن نافذة السياق الحالية. إذا تجاوز سجل المحادثة حد سياق النموذج (عادةً 4K-128K رمز)، تُنسى التفاصيل السابقة. للمشاريع الطويلة، قدّم بشكل دوري ملخصاً للقصة في بداية كل جلسة لإعادة ضبط السياق.
أي نموذج محلي ينتج النثر الأكثر حيوية؟
يُنتج Llama 3.3 70B بتكميم Q5_K_M أكثر التفاصيل الحسية حيوية وتدفق حوار طبيعي بشكل متسق. يحقق Mistral Small 3.1 24B 80-85% من هذه الجودة بـ 14 GB من RAM مقابل 45 GB لنموذج 70B. النموذج المضبوط Fimbulvetr-11B على قاعدة 13B يتفوق أيضاً في ثراء النثر ضمن موارد أصغر.
كيف أتعامل مع تناقضات صوت الشخصية عبر الفصول؟
قدّم بطاقة شخصية مفصّلة (الاسم، الخلفية، أنماط الكلام، الدوافع) في موجّه النظام. لكل فصل جديد، ابدأ الجلسة بـ: "تكتب بصفتك [الشخصية]. حافظ على الصوت والمنظور التاليين..." ثم الصق بطاقة الشخصية. يحافظ هذا على التماسك لأقسام من 500-2,000 كلمة.
هل التكميم (Q4، Q5، Q8) ملحوظ في الكتابة الإبداعية؟
نعم، بشكل قابل للقياس. FP16 (الدقة الكاملة) وQ8 ينتجان نثراً شبه متطابق. يُدخل Q5 تسطيحاً طفيفاً — صفات فريدة أقل، عبارات متكررة قليلاً (5-10% من المستخدمين يلاحظون ذلك). يخلق Q4 فقداناً واضحاً للجودة: أوصاف عامة، نقص في التفاصيل الحسية. للروايات، Q5_K_M هو الحد الأدنى الموصى به؛ وQ8_K_M هو المثالي.
هل يمكنني ضبط نموذج LLM محلي بدقة بأسلوب كتابتي الخاص؟
نعم. اجمع 500-2,000 مثال من نثرك بصيغة .jsonl (أزواج مدخلات/مخرجات)، ثم استخدم مكتبتي Unsloth أو Axolotl على GPU بسعة 24 GB لضبط نموذج 13B بدقة في 4-8 ساعات. التكلفة: ~5-15 دولاراً من GPU السحابية. النتيجة: نموذج يحاكي صوتك. الضبط بـ LoRA (التكيّف منخفض الرتبة) أسرع وأرخص من الضبط الكامل.
ما الفرق بين جودة الكتابة الإبداعية وجودة *الحوار* الإبداعي؟
يتطلب الحوار اقتصاداً أكثر إحكاماً في الكلمات وأصواتاً مميزة للشخصيات؛ ويتطلب النثر ثراءً حسياً وتدفقاً سردياً. يتفوق Llama 3.3 70B في كليهما. تنتج النماذج الأصغر (7B، 8B) غالباً حواراً مسطحاً وعاماً. إذا كانت الروايات كثيفة الحوار محور تركيزك، أعطِ الأولوية للنماذج ذات اتباع التعليمات الجيد على جودة النثر؛ تنافس جودة حوار Mistral Small جودة Llama 8B.
كم سياقاً (رموزاً) أحتاج لمخطط رواية كامل؟
مخطط مفصّل لرواية من 80,000 كلمة (الحبكة، الشخصيات، الفصول، الصراعات) عادةً 3,000-6,000 رمز. نموذج بسياق 128K (Llama 3.2، Phi-4) يتيح لك تحميل المخطط الكامل + الفصول السابقة في جلسة واحدة. للنماذج بسياق 4K-8K، قدّم ملخصاً متجدداً: ملخص الفصل السابق + مخطط الفصول الثلاثة التالية.
هل أحتاج إلى GPU لتشغيل نموذج LLM محلي محسّن للكتابة الإبداعية؟
لا، لكنها تسرّع التوليد بشكل كبير. نموذج 13B على CPU (8 أنوية): 10-15 رمزاً/ث. نفس النموذج على GPU بسعة 10GB (RTX 3060): 80-100 رمزاً/ث. للكتابة الإبداعية التكرارية (تجربة التنويعات، إعادة الكتابة)، تقلّص GPU وقت الجلسة من ساعتين إلى 15 دقيقة. CPU صالح للتوليد لمرة واحدة أو للمخططات.
أي نموذج LLM محلي أفضل لبناء عوالم الخيال العلمي وسرد القصص؟
Llama 3.3 70B للاتساق في مخططات تتجاوز 50 صفحة. Qwen3 14B-32B للدقة التقنية (الفيزياء، الميكانيكا المدارية، الكيمياء). Fimbulvetr-11B للتفاصيل الوصفية الغنية للعالم. للإعدادات محدودة الميزانية، يوازن Mistral Small 3.1 24B بين تماسك العالم واستخدام الموارد. جرّب الثلاثة بوصف عيّنة قبل أن تقرر.
ما أفضل نموذج LLM محلي للكتابة الإبداعية والروايات؟
يُنتج Llama 3.3 70B (40 GB) أغنى نثر وأكبر مدى أسلوبي. لـ 16 GB من VRAM، يقدّم Mistral Small 3.1 24B (14 GB) جودة سردية قوية بتماسك جيد في المحتوى الطويل. لميزانية 8 GB، يتعامل Llama 3.1 8B مع الروايات القصيرة (حتى 500 كلمة). النماذج المضبوطة من المجتمع مثل Fimbulvetr-11B تضيف تدريباً متخصصاً في الروايات ضمن موارد أصغر.
أي نماذج LLM محلية تعمل بأفضل شكل للكتابة بـ 8GB من VRAM فقط؟
Llama 3.1 8B Q4_K_M (~6 GB) هو أفضل خيار للكتابة الإبداعية بـ 8 GB من VRAM. يتعامل مع القصص القصيرة (حتى 500 كلمة) بموثوقية بنثر طبيعي. Mistral Small أسرع لكنه ينتج مخرجات إبداعية أكثر تسطيحاً. يتفوق Qwen3 7B في المحتوى التقني لكنه يفتقر إلى الطلاقة السردية. لـ 8 GB، تقبّل أن النماذج تعمل أبطأ؛ الجودة الإبداعية > السرعة في هذا المستوى.
ما أفضل نموذج LLM محلي للشعر؟
للشعر الحر والغني بالصور، يُنتج Llama 3.3 70B أوسع مدى من الأدوات الأدبية. للشعر المقيّد بشكل صارم (السوناتة، الهايكو)، استخدم نموذجاً أساسياً بدلاً من نموذج مضبوط للروايات، وخفّض درجة الحرارة إلى 0.7-0.85 -- النماذج المضبوطة مثل Fimbulvetr مدرَّبة على النثر السردي، وليس الشعر، ودرجات الحرارة الأعلى التي تفيد الروايات تكسر الوزن والقافية أكثر مما تساعد.
أي نموذج يجب أن أحمّله في LM Studio للكتابة الإبداعية؟
ينطبق نفس الترتيب: Llama 3.3 70B أو Mistral Small 3.1 24B أو Llama 3.1 8B، حسب مستوى RAM لديك. يشغّل LM Studio وOllama نفس ملفات GGUF المكممة، لذا لا يوجد "نموذج LM Studio" منفصل -- ابحث عن اسم النموذج في متصفح النماذج المدمج في LM Studio (أو نزّل GGUF من Hugging Face) وحمّله مباشرة. النماذج المضبوطة من المجتمع مثل Fimbulvetr-11B قابلة للتحميل أيضاً في متصفح نماذج LM Studio.
أي نموذج Ollama أفضل للكتابة الإبداعية وسرد القصص؟
ollama run llama3.3:70b لأفضل جودة نثر (40 GB من RAM)، وollama run mistral-small3.1 لمستوى 16 GB من RAM، أو ollama run llama3.2 لـ 8 GB من RAM. للروايات وسرد القصص تحديداً، تتفوق النماذج المضبوطة من المجتمع مثل Fimbulvetr-11B (المحمّلة عبر Modelfile مخصص لـ Ollama) على النماذج الأساسية في المهام السردية المستمرة.
هل GLM-4 خيار جيد للكتابة الإبداعية؟
GLM-4 (عائلة نماذج Zhipu AI مفتوحة الوزن) خيار آخر يستحق التجربة للكتابة الإبداعية، خاصة لتدفقات العمل باللغة الصينية أو حالات استخدام تقمّص الأدوار. لم تتم مقارنته هنا مع Llama 3.3 أو Mistral Small في جودة النثر الإنجليزي، لذا جرّبه مباشرة مقابل موجّهات العيّنة الخاصة بك قبل تغيير نموذجك الأساسي.
المصادر
- إعلان إطلاق Llama 3.3 — المقال الرسمي للنموذج من Meta مع نتائج اختبارات الكتابة الإبداعية
- بطاقات نماذج Mistral AI — مواصفات Mistral Small 3.1 وأدلة التكميم
- مشروع Fimbulvetr — مجموعة نماذج الكتابة الإبداعية المضبوطة التي يحافظ عليها المجتمع
أخطاء شائعة في الموجّهات للكتابة الإبداعية
- موجّهات عامة لأهداف محددة: "اكتب قصة" ينتج مخرجات عامة. بدلاً من ذلك: "اكتب مشهداً افتتاحياً من 800 كلمة لسرقة. يكتشف البطل أن الخزنة فارغة بالفعل. اعرض — لا تخبر — رد فعله العاطفي عبر الوصف الجسدي."
- تجاهل تأثيرات التكميم: تشغيل نموذج 13B بصيغة Q4 وتوقّع جودة نثر مكافئة للدقة الكاملة. يسطّح Q4 النثر بشكل ملحوظ. استخدم Q5_K_M كحد أدنى للكتابة الإبداعية؛ وQ8 لجودة قابلة للنشر.
- إهمال درجة الحرارة ومعاملات أخذ العينات: استخدام درجة الحرارة الافتراضية (0.7-0.8) للمهام الإبداعية. ارفعها إلى 0.95-1.1 واضبط top_p على 0.85-0.9 لنثر أكثر تنوعاً وإثارة. عالية جداً (>1.2) تنتج عدم تماسك.
- نسيان تدهور السياق: بعد 2,000-4,000 رمز في محادثة، حتى نماذج 70B تفقد أثر تفاصيل الشخصيات السابقة. أعد إدخال ملخصات الشخصيات بشكل دوري أو ابدأ جلسات جديدة.
- معاملة النماذج المحلية كنماذج سحابية: تتفوق النماذج السحابية مثل Claude 4 في التخطيط الطويل والمهام متعددة الخطوات. تتفوق النماذج المحلية في التوليد مشهداً بمشهد بموجّهات صارمة. استخدم المحلي للتنفيذ والسحابة للمخططات.
