النقاط الرئيسية
- Lemonade مفتوح المصدر بموجب رخصة Apache 2.0؛ مستودع الكود المصدري هو github.com/lemonade-sdk/lemonade
- تدعمه AMD؛ وفق ملف README على GitHub، يعمل مهندسو AMD على المشروع "لاستخراج أفضل أداء من أجهزة Ryzen AI وRadeon وStrix Halo" — ويصفه نفس الملف بأنه مبني من قِبل المجتمع، وليس منتجًا تملكه AMD
- تسريع NPU خاص بعتاد AMD Ryzen AI (وحدة NPU من طراز XDNA2)؛ الخادم نفسه يُثبَّت ويعمل أيضًا على بطاقات NVIDIA الرسومية (CUDA)، وApple Silicon (Metal)، والمعالجات العامة x86_64/ARM64
- يستخدم ثلاثة محركات استدلال حسب العتاد والنموذج: llama.cpp (المعالج، Metal، CUDA، Vulkan، ROCm)، وFastFlowLM لتسريع NPU، وONNX Runtime GenAI لأنواع معينة من النماذج
- يقدّم الدردشة والرؤية وتوليد الصور وتحويل الكلام إلى نص وتحويل النص إلى كلام عبر واجهة برمجية واحدة متوافقة مع OpenAI على العنوان
http://localhost:13305/v1 - يُثبَّت عبر مثبِّت MSI لويندوز، أو حزم لينكس (Ubuntu وDebian وFedora وArch وSnap)، أو Docker، أو
pip install lemonade-sdkلحزمة تطوير Python - نحو 5,700 نجمة و497 نسخة متفرعة (fork) على GitHub وقت كتابة هذه المراجعة
📍 في جملة واحدة
Lemonade خادم ذكاء اصطناعي محلي مجاني ومفتوح المصدر (رخصة Apache 2.0) تدعمه AMD، يوفر واجهة برمجية متوافقة مع OpenAI واستدلالًا مسرَّعًا بوحدة NPU على عتاد AMD Ryzen AI، مع كونه أيضًا قابلًا للتثبيت والتشغيل على أنظمة NVIDIA وApple Silicon والمعالجات العامة.
💬 بعبارات بسيطة
إذا كنت تملك حاسوبًا محمولًا أو مكتبيًا من طراز AMD Ryzen AI، يمكن لـ Lemonade تشغيل النماذج على شريحة NPU المخصصة بدلًا من المعالج أو بطاقة الرسوميات، ما يعني عادة استهلاكًا أقل للطاقة لنفس مهمة الدردشة أو الرؤية. بدون عتاد AMD، يستمر Lemonade في العمل — لكنه يعود إلى استخدام المعالج أو تسريع بطاقة الرسوميات الخاصة بك، تمامًا مثل معظم خوادم الذكاء الاصطناعي المحلية الأخرى.
📌ملاحظة: هذه المراجعة هي المرافق التفصيلي لسجل Lemonade في دليل برمجيات نماذج اللغة المحلية — راجع تلك الصفحة لمقارنة Lemonade بسرعة مع عشرات أدوات الذكاء الاصطناعي المحلية الأخرى.
ما هو Lemonade؟
Lemonade هو خادم ذكاء اصطناعي محلي: عملية تعمل في الخلفية تُحمِّل نموذجًا مرة واحدة ثم تقدّمه لأي تطبيق عبر واجهة برمجية متوافقة مع OpenAI، بدلًا من كونه نافذة دردشة أحادية الغرض. يصف وصفه على GitHub المشروع بأنه يساعد "المستخدمين على اكتشاف وتشغيل تطبيقات الذكاء الاصطناعي المحلية عبر تقديم نماذج لغوية مُحسَّنة مباشرة من بطاقات الرسوميات ووحدات NPU الخاصة بهم". يجمع بين واجهة رسومية وواجهة سطر أوامر وخادم واجهة برمجية في حزمة واحدة، بحيث يخدم نفس التثبيت من يريد فقط نافذة دردشة ومن يريد توجيه كوده الخاص إلى نقطة نهاية محلية.
- الوظيفة الأساسية: تحميل نموذج مرة واحدة، ثم تقديم طلبات الدردشة والرؤية والصور والكلام لأي عميل متوافق مع واجهة OpenAI عبر HTTP
- محركات الاستدلال: llama.cpp للمعالج وMetal وCUDA وVulkan وROCm، وFastFlowLM (FLM) لتسريع NPU من AMD، وONNX Runtime GenAI لأنواع معينة من النماذج — يختار Lemonade تلقائيًا بناءً على النموذج والعتاد المكتشَف
- الجهة الداعمة والمنظمة: تدعم AMD المشروع (جهة الاتصال المدرجة هي lemonade@amd.com في المستودع) وتساهم بجهد هندسي؛ منظمة GitHub التي تستضيف الكود هي lemonade-sdk
- المستودع الرسمي: github.com/lemonade-sdk/lemonade — الموطن النشط للكود المصدري والإصدارات ومتتبع المشكلات لـ Lemonade؛ يغطي مستودع مرتبط لكنه منفصل، lemonade-sdk/ryzenai-server، مكوّن خادم أقدم خاصًا بـ Ryzen AI، لذا تأكد أنك تنظر إلى المستودع الرئيسي
lemonadeللمشروع الحالي
هل يتطلب Lemonade عتاد AMD؟
لا — يُثبَّت Lemonade ويعمل على عتاد غير تابع لـ AMD، لكن مسار تسريع واحد محدد حصري لـ AMD. يعمل هذا التمييز بنفس الطريقة المتبعة في أدوات الذكاء الاصطناعي المحلية الأخرى من AMD: البرنامج مفتوح وعابر للمنصات، بينما تقتصر ميزة عتاد محددة الاسم على شرائح AMD الخاصة بها.
العتاد | هل يعمل Lemonade؟ | هل يحصل على تسريع NPU؟ |
|---|---|---|
| AMD Ryzen AI (وحدة NPU من طراز XDNA2) | نعم | نعم، عبر FastFlowLM |
| بطاقة AMD Radeon الرسومية / رسوميات Strix Halo المدمجة | نعم | لا (بدلًا من ذلك تسريع GPU عبر ROCm) |
| بطاقة NVIDIA الرسومية | نعم، عبر CUDA | لا |
| Apple Silicon | نعم، عبر Metal | لا |
| معالج عام x86_64 / ARM64 | نعم، عبر خلفية المعالج في llama.cpp | لا |
يعكس هذا الجدول دعم الخلفيات الموثق لـ Lemonade (github.com/lemonade-sdk/lemonade) وقت كتابة هذه المراجعة. يعني "تسريع NPU" تحديدًا توجيه الاستدلال عبر خلفية FastFlowLM إلى وحدة معالجة عصبية؛ تستمر كل الصفوف الأخرى في تشغيل مجموعة ميزات Lemonade الكاملة (الدردشة والرؤية والصور والكلام) — لكنها تستخدم المعالج أو أنوية الحوسبة الخاصة ببطاقة الرسوميات أو Metal/CUDA بدلًا من شريحة NPU مخصصة. لا تفترض أن Lemonade غير قابل للاستخدام بدون عتاد AMD، ولا تفترض أن كل شريحة من AMD تحصل على تسريع NPU — فهذا يقتصر فقط على معالجات Ryzen AI المزودة بوحدة NPU من طراز XDNA2.
كيف تثبّت Lemonade؟
يوفر Lemonade أربع طرق للتثبيت: مثبِّت MSI لويندوز، وحزم لينكس أصلية، وصورة Docker، وحزمة Python لحزمة التطوير. الروابط والأوامر أدناه مأخوذة من ملف README الرسمي على GitHub ومن lemonade-server.ai — تحقق دائمًا من هذه الصفحات مباشرة، لأن روابط الإصدارات وأسماء الحزم قد تتغير بين الإصدارات.
المنصة | طريقة التثبيت |
|---|---|
| ويندوز | مثبِّت lemonade.msi |
| لينكس (Ubuntu 24.04 وما بعده) | مستودع PPA على Launchpad — راجع lemonade-server.ai/docs/guide/install/ubuntu |
| لينكس (Debian وFedora وArch) | حزمة أصلية حسب التوزيعة — راجع أدلة التثبيت على lemonade-server.ai |
| macOS | مثبِّت PKG — راجع أدلة التثبيت على lemonade-server.ai |
| أي منصة (Python) | pip install lemonade-sdk لحزمة تطوير Python وواجهة سطر الأوامر |
| أي منصة (حاوية) | صورة Docker — راجع lemonade-server.ai/docs/guide/install/docker |
بعد التثبيت، يقوم الأمر lemonade run <model-name> بتنزيل نموذج وتشغيله من واجهة سطر الأوامر، وتربط أوامر مثل lemonade launch claude برنامج Lemonade بتطبيقات العميل المتوافقة. يستمع خادم الواجهة البرمجية المحلي على العنوان http://localhost:13305/v1 (ويمكن الوصول إليه أيضًا عبر /api/v1) ويقبل أي سلسلة نصية كمفتاح واجهة برمجية — تكفي قيمة نائبة مثل lemonade لإرضاء العملاء الذين يتطلبون حقل مفتاح غير فارغ، لأن Lemonade لا يفرض مصادقة حقيقية بمفتاح واجهة برمجية بشكل افتراضي.
ماذا يمكنك فعله مع Lemonade؟
تتمحور ميزات Lemonade حول تقديم النماذج عبر نقطة نهاية واحدة متوافقة مع OpenAI، مع اختيار تلقائي للخلفية بحسب العتاد. التفاصيل أدناه مستقاة من ملف README على GitHub الخاص بـ Lemonade ووثائقه.
- الدردشة وتوليد النصوص — تشغيل نماذج دردشة مفتوحة الأوزان محليًا والاستعلام عنها عبر نقطة النهاية المتوافقة مع OpenAI
/v1/chat/completions، وهي نفس صيغة الطلب التي تستخدمها أدوات وسكربتات لا حصر لها - الرؤية — تقديم نماذج رؤية-لغة قادرة على وصف الصور أو الإجابة عن أسئلة حولها، عبر نفس الواجهة البرمجية
- توليد الصور — توليد صور محليًا عبر خلفية مدمجة قائمة على Stable Diffusion
- الكلام — تحويل الصوت إلى نص (تحويل الكلام إلى نص، عبر خلفية قائمة على Whisper) وتوليد الكلام من النص (تحويل النص إلى كلام، عبر خلفية قائمة على Kokoro)
- التضمينات (Embeddings) — تقديم طلبات تضمين النصوص عبر نقطة النهاية المتوافقة مع OpenAI، لحالات استخدام الاسترجاع والبحث
- اختيار تلقائي للخلفية — يختار Lemonade تلقائيًا بين llama.cpp وFastFlowLM وONNX Runtime GenAI بناءً على صيغة النموذج والعتاد المكتشَف، بحيث لا يحتاج معظم المستخدمين إلى اختيار خلفية يدويًا أبدًا
- بلا تتبع بيانات — وفق تموضع Lemonade نفسه على lemonade-server.ai، لا يرسل الخادم بيانات استخدام بشكل مقصود
لمن يناسب Lemonade؟
يناسب Lemonade من يريد تحديدًا استخدام وحدة NPU من AMD للاستدلال المحلي، بالإضافة إلى أي شخص يريد خادمًا محليًا خفيفًا ومتوافقًا مع OpenAI بغض النظر عن ماركة العتاد.
Lemonade مقابل Ollama وLM Studio وDocker Model Runner
يتداخل Lemonade مع عدة خوادم ذكاء اصطناعي محلية أخرى تُتيح واجهة برمجية متوافقة مع OpenAI — والفرق يكمن في التحسين الخاص بالعتاد، واختيار الخلفية، والجهة الداعمة.
الأداة | الجهة الداعمة/الصانعة | الرخصة | الأنسب لـ |
|---|---|---|---|
| Lemonade | تدعمه AMD، مبني من قِبل المجتمع | Apache 2.0 | تسريع NPU من AMD Ryzen AI، وخيار احتياطي عابر للمنصات |
| Ollama | Ollama Inc. | MIT | مكتبة نماذج واسعة ومجتمع راسخ، وأبسط سير عمل عبر واجهة سطر الأوامر |
| LM Studio | Element Labs | مجاني، مغلق المصدر | واجهة رسومية متقنة لتصفح النماذج وتنزيلها والدردشة معها |
| Docker Model Runner | Docker, Inc. | مجاني مع Docker Desktop | الفرق التي توحّدت بالفعل على أدوات وسير عمل Docker |
تُتيح الأدوات الأربع جميعها واجهة برمجية متوافقة مع OpenAI ويمكنها تقديم نماذج مفتوحة الأوزان محليًا. Lemonade هو الوحيد من بين الأربعة الذي يمتلك خلفية تسريع موثقة وخاصة بوحدة NPU من AMD (FastFlowLM)؛ بينما توجّه الأدوات الثلاث الأخرى الاستدلال عبر المعالج أو بطاقة الرسوميات (CUDA/Metal/ROCm) أو بيئة تشغيل Docker الخاصة بها.
أخطاء شائعة عند تقييم Lemonade
الأسئلة الشائعة
هل Lemonade مجاني؟
نعم. Lemonade مجاني ومفتوح المصدر بموجب رخصة Apache 2.0، مع ترخيص بعض المكونات الخارجية المضمّنة بشكل منفصل كما هو مدرج في ملف NOTICE.md الخاص بالمستودع. لا توجد أي فئة مدفوعة.
هل يتطلب Lemonade عتاد AMD؟
لا. يُثبَّت Lemonade ويعمل على بطاقات NVIDIA الرسومية وApple Silicon والمعالجات العامة x86_64/ARM64 عبر خلفية llama.cpp الخاصة به. فقط الاستدلال المسرَّع بوحدة NPU، عبر خلفية FastFlowLM، خاص بمعالجات AMD Ryzen AI المزودة بوحدة NPU من طراز XDNA2.
ما الرخصة التي يستخدمها Lemonade؟
رخصة Apache 2.0، وفق ملف LICENSE في مستودع GitHub الرسمي (github.com/lemonade-sdk/lemonade)، مع خضوع بعض المكونات المضمّنة لرخصها الخاصة كما هو مدرج في NOTICE.md.
هل يمتلك Lemonade واجهة برمجية متوافقة مع OpenAI؟
نعم. يقدّم Lemonade واجهة برمجية محلية متوافقة مع OpenAI على العنوان http://localhost:13305/v1، تغطي نقاط نهاية إكمال الدردشة والرؤية وتوليد الصور والكلام والتضمينات. يمكن لأي مكتبة عميل متوافقة مع OpenAI التوجه إلى هذا العنوان.
كيف تثبّت Lemonade؟
عبر مثبِّت MSI لويندوز، أو حزم لينكس أصلية (Ubuntu وDebian وFedora وArch)، أو صورة Docker، أو pip install lemonade-sdk لحزمة تطوير Python وواجهة سطر الأوامر. الطرق الأربع جميعها موثقة على lemonade-server.ai.
من يطوّر Lemonade؟
Lemonade مشروع مفتوح المصدر مبني من قِبل المجتمع وتدعمه AMD. يساهم مهندسو AMD بتحسينات لعتاد Ryzen AI وRadeon وStrix Halo، لكن المشروع يصف نفسه بأنه مبني لكل حاسوب، وليس منتجًا حصريًا لـ AMD.
ما مدى شعبية Lemonade؟
يُظهر مستودع Lemonade على GitHub نحو 5,700 نجمة وحوالي 497 نسخة متفرعة (fork) وقت كتابة هذه المراجعة.
ما البدائل الرئيسية لـ Lemonade؟
Ollama (رخصة MIT، مكتبة نماذج واسعة ومجتمع راسخ)، وLM Studio (تطبيق مجاني مغلق المصدر بواجهة رسومية متقنة)، وDocker Model Runner (مدمج مع Docker Desktop) هي أقرب بدائل خوادم محلية بواجهة برمجية متوافقة مع OpenAI.
