Skip to main content
PromptQuorum
الرئيسية/LLM المحلية المتقدمة/مراجعة KoboldCpp 2026: ملف واحد، بلا تثبيت، مصمم للعب الأدوار
Overview & Reference

مراجعة KoboldCpp 2026: ملف واحد، بلا تثبيت، مصمم للعب الأدوار

·٨ دقائق للقراءة·بقلم Hans Kuepper · مؤسس PromptQuorum، أداة إرسال الذكاء الاصطناعي متعددة النماذج · PromptQuorum

KoboldCpp تطبيق نماذج لغوية محلي مجاني بملف تنفيذي واحد، مبني فوق llama.cpp، يشغّل نماذج GGUF دون أي خطوة تثبيت، ويأتي مزودًا بواجهة KoboldAI Lite على الويب — وهي محرر مخصص لكتابة القصص ولعب الأدوار وليس مجرد نافذة محادثة بسيطة. يخضع لرخصة AGPL 3.0، ويصونه مطور مجهول الهوية يُعرف باسم LostRuins، ويدعم تسريع المعالج الرسومي عبر CUDA وVulkan وROCm، إضافة إلى العمل بالمعالج المركزي فقط.

KoboldCpp هو ملف تنفيذي واحد يشغّل نماذج بصيغة GGUF دون الحاجة إلى مثبّت أو بيئة Python أو Docker، ويأتي مزودًا بمحرر مخصص لكتابة القصص ولعب الأدوار بدلاً من مجرد نافذة محادثة بسيطة.

مراجعة KoboldCpp 2026: ملف واحد، بلا تثبيت، مصمم للعب الأدوار

النقاط الرئيسية

  • رخصة AGPL 3.0 — استخدام مجاني، مع التزام النسخة المتروكة (copyleft) عند التعديل وإعادة التوزيع كخدمة شبكية
  • مبني في الخلفية على llama.cpp (رخصة MIT)، مع واجهته الخاصة وميزات إضافية فوقه
  • ملف تنفيذي واحد لكل منصة: ويندوز، لينكس x64، ماك أو إس ARM64 — بلا مثبّت
  • KoboldAI Lite، الواجهة المدمجة على الويب، مصممة لكتابة القصص ولعب الأدوار: مخرجات قابلة للتحرير، حقول Memory وWorld Info، وعدة أوضاع محادثة/مغامرة
  • تسريع المعالج الرسومي عبر CUDA (إنفيديا) أو Vulkan (متعدد الموردين، الطريق الموصى به لـ AMD)؛ توجد نسخة ROCm متجددة للينكس؛ العمل بالمعالج المركزي فقط مدعوم بالكامل أيضًا
  • يتضمن أيضًا توليد صور بتقنية Stable Diffusion ونسخًا صوتيًا بتقنية Whisper في الملف التنفيذي نفسه

📍 في جملة واحدة

KoboldCpp تطبيق نماذج لغوية محلي مجاني برخصة AGPL 3.0 بملف واحد، مبني على llama.cpp، يشغّل نماذج GGUF دون تثبيت ويأتي مزودًا بواجهة KoboldAI Lite على الويب لكتابة القصص ولعب الأدوار.

💬 بعبارات بسيطة

حمّل ملفًا واحدًا وانقر عليه نقرًا مزدوجًا، ليفتح تبويب متصفح فيه واجهة محادثة وتحرير قصصي جاهزة مسبقًا — بلا مثبّت منفصل، وبلا إعداد سطر أوامر، وبلا حاجة لتطبيق إضافي فوقه.

📌ملاحظة: مصدر التحميل الرسمي الوحيد هو صفحة GitHub Releases. أي ملف يحمل الاسم نفسه على موقع آخر لا يمكن التحقق من كونه النسخة الأصلية.

ما هو KoboldCpp؟

KoboldCpp برنامج مجاني بملف واحد يشغّل نماذج لغوية بصيغة GGUF محليًا، مبني على محرك استدلال llama.cpp ويصونه مطور مجهول الهوية يُعرف باسم LostRuins. يرث اصطلاحات واجهة مشروع KoboldAI الأصلي، مع تكييفها للعمل فوق خلفية llama.cpp بدلاً من مكدس استدلال قائم على Python.

يستضاف المشروع على github.com/LostRuins/koboldcpp ويُنشر بموجب رخصة GNU Affero العمومية العامة الإصدار 3 (AGPL 3.0) — وهي رخصة نسخة متروكة، تختلف عن رخصة MIT المتساهلة التي يستخدمها llama.cpp نفسه في الخلفية. تصدر الإصدارات بشكل متكرر؛ وكان الإصدار السائد وقت المراجعة (نهاية أغسطس 2026) هو v1.120.

  • يُوزَّع كملف تنفيذي واحد لكل منصة — koboldcpp.exe (ويندوز)، koboldcpp-linux-x64 (لينكس)، koboldcpp-mac-arm64 (ماك أو إس Apple Silicon)
  • لا يتطلب تشغيله مثبّتًا ولا بيئة Python ولا Docker
  • يعتمد على llama.cpp لاستدلال النموذج الفعلي، ثم يضيف فوقه خادمه الخاص وواجهته على الويب وطبقة واجهة برمجة التطبيقات
  • يوفر نسخة nocuda (بلا CUDA، متوافقة مع Vulkan) ونسخة oldpc (CUDA11 + AVX1) للعتاد القديم، إلى جانب النسخة الرئيسية المزودة بـ CUDA

ما هو KoboldAI Lite، وماذا يضيف؟

KoboldAI Lite هي واجهة الويب المدمجة مباشرة داخل الملف التنفيذي لـ KoboldCpp — تفتح تلقائيًا في تبويب متصفح بمجرد بدء تشغيل الخادم، دون خطوة تثبيت منفصلة. وهي مصممة خصيصًا للكتابة الطويلة ولعب الأدوار، وليس فقط للمحادثة بالتناوب.

  • مخرجات قابلة للتحرير: يمكن تعديل النص المولَّد مباشرة وليس فقط إعادة توليده — أمر مهم للكتابة القصصية التعاونية
  • حقلا Memory وWorld Info: كتل سياق دائمة يراها النموذج دومًا، تُستخدم للحفاظ على تفاصيل الشخصيات أو حقائق القصة متسقة عبر جلسة طويلة
  • أوضاع متعددة: محادثة عادية، ووضع "Story" للتأليف التعاوني، ووضع "Adventure" على طراز ألعاب المغامرات النصية
  • أدوات تحكم Author's Note وتنسيق instruct لتوجيه النبرة والأسلوب دون تعديل قالب الطلب الأساسي يدويًا
  • يعمل بالكامل من الملف التنفيذي نفسه والخادم المحلي نفسه — دون الحاجة لتطبيق واجهة أمامية أو إضافة متصفح منفصلة

كيف تُحمّل وتشغّل KoboldCpp؟

حمّل الملف المناسب لمنصتك من صفحة GitHub Releases الرسمية، ثم شغّله مباشرة — لا توجد خطوة تثبيت. اختيار النسخة المناسبة لعتادك هو القرار الحقيقي الوحيد المطلوب.

  1. 1
    انتقل إلى صفحة إصدارات KoboldCpp على GitHub — وهي مصدر التحميل الرسمي الوحيد.
  2. 2
    اختر نسخة منصتك: koboldcpp.exe لويندوز، koboldcpp-linux-x64 للينكس، أو koboldcpp-mac-arm64 لماك أو إس على Apple Silicon.
  3. 3
    اختر مسار المعالج الرسومي المناسب: تتضمن النسخة الرئيسية دعم CUDA من إنفيديا؛ ولمستخدمي AMD يوصي المشروع بتجربة خيار Vulkan في نسخة nocuda أولاً؛ وتوجد نسخة ROCm متجددة منفصلة للينكس؛ أما العتاد القديم الذي يفتقر لمجموعات التعليمات الحديثة فيجب أن يستخدم نسخة oldpc (CUDA11 + AVX1).
  4. 4
    حمّل ملف نموذج بصيغة GGUF (مثلًا من Hugging Face) إن لم يكن لديك واحد بالفعل.
  5. 5
    شغّل الملف التنفيذي، واختر ملف GGUF وكمية تفريغ الطبقات على المعالج الرسومي في نافذة التشغيل، ثم ابدأ الخادم.
  6. 6
    يفتح تبويب متصفح تلقائيًا على واجهة KoboldAI Lite، متصلة بالفعل بالخادم المحلي قيد التشغيل.

هل يتطلب KoboldCpp تثبيتًا؟

لا. إنه ملف تنفيذي واحد — حمّله وشغّله مباشرة. لا يوجد مثبّت، ولا بيئة Python منفصلة، ولا حاوية Docker.

هل يمكن تشغيل KoboldCpp دون معالج رسومي؟

نعم. العمل بالمعالج المركزي فقط مدعوم بالكامل؛ ووجود معالج رسومي (عبر CUDA أو Vulkan أو ROCm) يسرّع سرعة التوليد فقط، وليس شرطًا أبدًا.

ما المعالجات الرسومية والعتاد الذي يدعمه KoboldCpp؟

يدعم KoboldCpp إعدادات إنفيديا وAMD والمعالج المركزي فقط عبر نسخ بناء منفصلة، بدلًا من ملف تنفيذي واحد شامل يكتشف كل شيء تلقائيًا. اختيار النسخة المطابقة لعتادك ضروري لتفعيل تسريع المعالج الرسومي.

  • إنفيديا — تسريع CUDA مدمج في ملفات الإصدار الرئيسية
  • AMD — يوصي المشروع نفسه بتجربة خلفية Vulkan في نسخة nocuda أولاً لأنها الأوسع توافقًا؛ كما يُصان ملف ROCm متجدد منفصل للينكس
  • متعدد الموردين — تعمل خلفية Vulkan أيضًا على رسوميات إنتل وبطاقات إنفيديا/AMD الأقدم دون تعريفات خاصة بالموردين
  • العتاد القديم — نسخة oldpc موجهة لـ CUDA 11 والمعالجات المركزية التي تدعم AVX1 فقط، للأجهزة غير القادرة على تشغيل النسخة الحديثة القياسية
  • المعالج المركزي فقط — تعمل نسخة nocuda دون أي معالج رسومي، بسرعة أقل مقارنة بالاستدلال المسرَّع بالمعالج الرسومي

لمن يناسب KoboldCpp؟

استخدم KoboldCpp إذا كانت كتابة القصص أو لعب الأدوار أو ملف واحد بلا تثبيت أهم من الإنتاجية الخام أو الحجم الأدنى؛ واستخدم أداة أخرى إذا احتجت خدمة إنتاجية متعددة المستخدمين أو أصغر تحميل ممكن.

كيف يقارَن KoboldCpp بـ Ollama وأدوات محلية أخرى؟

أقرب مقارنات KoboldCpp هي أدوات أخرى مبنية على llama.cpp، إضافة إلى محركات إنتاجية موجهة لمهمة مختلفة تمامًا.

الأداة
الرخصة
الأفضل لـ
KoboldCppAGPL 3.0بلا تثبيت، واجهة لعب أدوار/كتابة مدمجة
llama.cppMITأوسع دعم للعتاد، تحكم مباشر
OllamaMITواجهة أوامر/API بسيطة، إدارة النماذج
LM Studioملكية خاصة (مجاني)واجهة سطح مكتب بلا طرفية
vLLMApache 2.0خدمة متعددة المستخدمين وعالية الإنتاجية
text-generation-webuiAGPL 3.0تخصيص عميق للواجهة، خلفيات كثيرة

أخطاء شائعة عند تقييم KoboldCpp

ينشأ معظم اللبس من التعامل مع KoboldCpp كتطبيق مثبَّت تقليدي، أو من تحميله من مصدر غير رسمي.

الأسئلة الشائعة

ما هو KoboldCpp؟

KoboldCpp تطبيق نماذج لغوية محلي مجاني بملف واحد، مبني على llama.cpp. يشغّل نماذج GGUF دون خطوة تثبيت، ويأتي مزودًا بواجهة KoboldAI Lite على الويب، المصممة لكتابة القصص ولعب الأدوار.

من يصون KoboldCpp؟

يصون KoboldCpp مطور مجهول الهوية يُعرف باسم LostRuins، على مستودع github.com/LostRuins/koboldcpp. تصدر الإصدارات بتكرار، وكان v1.120 هو السائد حتى نهاية أغسطس 2026.

هل KoboldCpp مجاني؟

نعم. KoboldCpp مجاني ومفتوح المصدر برخصة AGPL 3.0. لا توجد فئة مدفوعة ولا منتج مستضاف — كل نشر لـ KoboldCpp يعمل على عتاد يتحكم به المستخدم بنفسه.

ما الرخصة التي يُنشر بموجبها KoboldCpp؟

AGPL 3.0 (رخصة GNU Affero العمومية العامة الإصدار 3)، وهي رخصة نسخة متروكة. تختلف عن رخصة MIT التي يستخدمها llama.cpp، المحرك الذي يُبنى عليه KoboldCpp في الخلفية.

هل يتطلب KoboldCpp تثبيتًا؟

لا. يُوزَّع كملف تنفيذي واحد لكل منصة (ويندوز، لينكس، ماك أو إس ARM64) — حمّله وشغّله مباشرة، دون مثبّت أو بيئة Python أو حاوية Docker.

هل يدعم KoboldCpp معالجات AMD الرسومية؟

نعم، لكن ليس عبر نسخة CUDA الرئيسية. يوصي المشروع بخيار Vulkan داخل نسخة nocuda كمسار أول لـ AMD، إلى جانب نسخة ROCm متجددة تُصان بشكل منفصل للينكس.

ما هو KoboldAI Lite؟

KoboldAI Lite هي الواجهة على الويب المضمَّنة في الملف التنفيذي لـ KoboldCpp. تفتح تلقائيًا في المتصفح بمجرد بدء تشغيل الخادم، وتوفر مخرجات قابلة للتحرير، وحقلي Memory وWorld Info، وأوضاعًا مخصصة للمحادثة والقصة والمغامرة للعب الأدوار والكتابة التعاونية.

هل يستطيع KoboldCpp توليد صور أو نسخ الصوت؟

نعم. يضم الملف التنفيذي نفسه توليد صور بتقنية Stable Diffusion ونسخًا صوتيًا بتقنية Whisper، إلى جانب وظيفته الأساسية في توليد النصوص.

هل يصلح KoboldCpp للإنتاج أو الاستخدام متعدد المستخدمين؟

لا، فهذا ليس هدف تصميمه. صُمم KoboldCpp للاستخدام المحلي بمستخدم واحد مع واجهة كتابة غنية؛ أما لخدمة إنتاجية متعددة المستخدمين وعالية التزامن، فإن vLLM أو NVIDIA TensorRT-LLM هما الأداتان المناسبتان.

ما الفرق بين KoboldCpp وOllama؟

كلاهما يعتمد على llama.cpp، لكن Ollama يراهن على واجهة أوامر بسيطة وسجل نماذج بلا واجهة مدمجة، بينما يضم KoboldCpp واجهة كاملة للكتابة ولعب الأدوار داخل المتصفح (KoboldAI Lite) ضمن الملف التنفيذي الواحد نفسه.

المصادر

← العودة إلى LLM المحلية المتقدمة