النقاط الرئيسية
- Parlor (github.com/fikrikarim/parlor) مساعد ذكاء اصطناعي متعدد الوسائط مجاني ومفتوح المصدر يعمل على الجهاز مباشرة وفي الوقت الفعلي — وهو معاينة بحثية، وليس منتجاً نهائياً
- أنشأه المطوّر Fikri Karim، الذي بنى أيضاً مشروعاً منفصلاً مستضافاً للذكاء الاصطناعي الصوتي يُدعى Bule AI؛ ونشأ Parlor من الرغبة في بديل محلي بالكامل بعد تجربة GPT-Live من OpenAI
- مرخّص بموجب Apache 2.0، وتم تأكيد ذلك عبر ملف LICENSE في مستودع GitHub
- يشغّل Gemma 4 (من Google DeepMind)، وتحديداً نسخة E4B افتراضياً، عبر llama.cpp لفهم مشترك للكلام والرؤية
- أكثر من 2,000 نجمة على GitHub و271 فرعاً (forks) وقت إعداد هذه المراجعة
- إصداران معلّمان (tagged releases) حتى الآن: v1.0.0 (29 يوليو 2026) وv2.0.0 (2 أغسطس 2026)
📍 في جملة واحدة
Parlor مساعد ذكاء اصطناعي صوتي ومرئي مجاني ومفتوح المصدر يعمل على الجهاز مباشرة وفي الوقت الفعلي، بناه مطوّر واحد كمعاينة بحثية، ويشغّل Gemma 4 عبر llama.cpp على جهاز Mac بمعالج Apple Silicon أو جهاز Linux بوحدة معالجة رسومية مدعومة، بأكثر من 2,000 نجمة على GitHub.
💬 بعبارات بسيطة
Parlor برنامج تثبّته وتشغّله بنفسك، يتيح لك التحدث بصوت مسموع مع مساعد ذكاء اصطناعي، مع إمكانية مراقبة كاميرا الويب اختيارياً، وكل ذلك على جهاز الكمبيوتر الخاص بك بالكامل افتراضيًا — دون اشتراك صوتي سحابي، ودون حساب، ودون تكلفة لكل دقيقة، ما لم تُفعّل ميزة البحث السحابي الاختيارية. يحتاج إلى جهاز Mac أو Linux قوي نسبياً مزوّد بوحدة معالجة رسومية، لأنه يشغّل نموذج الذكاء الاصطناعي محلياً.
📌ملاحظة: تستند هذه المراجعة إلى مستودع Parlor على GitHub، وملف README الخاص به، وسجل إصداراته عبر واجهة برمجة تطبيقات GitHub. لا تدّعي هذه المراجعة أن PromptQuorum أعادت إنتاج مقاييس زمن الاستجابة المنشورة لـ Parlor بشكل مستقل — تلك الأرقام خاصة بالمشروع نفسه، وقيست على جهاز Apple M3 Pro.
ما هو Parlor؟
Parlor معاينة بحثية مجانية ومفتوحة المصدر لمساعد ذكاء اصطناعي يعمل على الجهاز مباشرة وفي الوقت الفعلي، يستمع، ويرى عبر الكاميرا، ويتحدث معك — وهو مماثل من حيث المفهوم لـ GPT-Live من OpenAI، لكنه يعمل محلياً بدلاً من السحابة. يصف ملف README الخاص به صراحةً بأنه "معاينة بحثية" ويحذّر من توقّع نقاط خشنة وأخطاء.
- نوع المنتج: تطبيق ويب محلي ذاتي الاستضافة — تشغّل خادماً على جهازك الخاص وتفتحه في متصفح
- المُنشئ: المطوّر Fikri Karim، يعمل بمفرده؛ ويذكر ملف README أن قاعدة الكود كُتبت "بمساعدة قوية من Claude، مع قيادة البشر للأفكار والاختبار وتصحيح الأخطاء"
- المستودع: github.com/fikrikarim/parlor، أُنشئ في 5 أبريل 2026
- الترخيص: Apache 2.0، وتم تأكيده عبر ملف LICENSE في المستودع
- التمويل: لم يُعثر على أي جولة تمويل أو مستثمر أو دعم تجاري لهذه المراجعة — تعامل مع Parlor كمشروع بحثي مستقل من مطوّر واحد، وليس شركة ممولة
- الحجم: أكثر من 2,000 نجمة على GitHub، و271 فرعاً (forks)، وقت إعداد هذه المراجعة
كيف يعمل Parlor فعلياً؟
يستخدم Parlor خط أنابيب متسلسلاً (cascade pipeline)، وليس نموذجاً صوتياً واحداً من طرف إلى طرف: يبثّ متصفحك صوت الميكروفون وإطارات الكاميرا عبر WebSocket إلى خادم FastAPI محلي، والذي يشغّل كشف انتهاء الدور، ونموذج رؤية-لغة، وتحويل النص إلى كلام كمراحل منفصلة.
- كشف انتهاء الدور: يرصد كاشف نشاط الصوت Silero VAD في المتصفح الصمت، ثم يحكم نموذج smart-turn-v3 من Pipecat (نحو 20 ملي ثانية) فيما إذا كنت قد أنهيت الحديث فعلاً، بحيث لا يُساء فهم التوقفات في منتصف الجملة على أنها نهاية دورك
- الفهم والتوليد: يعالج Gemma 4 (من Google DeepMind)، وتحديداً نسخة E4B افتراضياً، عبر llama.cpp بتقنية التكميم QAT رباعي البت، الصوت وإطارات الكاميرا معاً ويبثّ رداً
- معالجة الإجراءات: يقرر طلب JSON منفصل مُجبَر نحوياً من النموذج نفسه أمور المؤقتات، وتبديل الأوضاع، أو طلبات البحث، بحيث لا تتسرب تعليمات التحكم إلى الرد المنطوق
- إخراج الصوت: يتحدث محرك Kokoro للتحويل من نص إلى كلام (بواجهة MLX على macOS، وONNX على Linux) بالرد جملةً جملة أثناء استمرار النموذج في التوليد
- المقاطعة أثناء الحديث (Barge-in): يمكنك التحدث فوق Parlor لمقاطعته — يُلغى التوليد من جانب الخادم بدلاً من مجرد كتم التشغيل
- البحث السحابي الاختياري: إذا ضبطت
REASONER_API_KEY، يمكن لـ Parlor تسليم أسئلة بحث مفتوحة (مثل "ابحث عن أفضل بيتزا في روما الآن") إلى نموذج متطور عبر نقطة نهاية متوافقة مع OpenAI مثل OpenRouter، بينما تستمر المحادثة المحلية؛ ودون ضبط هذا المفتاح، يبقى Parlor على الجهاز بالكامل
ماذا يمكنك أن تفعل باستخدام Parlor؟
يدعم Parlor المحادثة الصوتية اليدين الحرتين (hands-free) مع إدخال كاميرا اختياري، بالإضافة إلى مجموعة من الأوضاع المسمّاة لمهام محددة.
- محادثة بلا استخدام لليدين: لا يوجد زر ضغط للتحدث — يكتشف Parlor متى تبدأ وتنهي الحديث بنفسه
- إجابات واعية بالكاميرا: وجّه كاميرا الويب نحو شيء ما واسأل عنه؛ تُبَث الإطارات إلى جانب كلامك إلى النموذج المحلي نفسه
- المؤقتات: قل "اضبط مؤقتاً لثلاث دقائق للمعكرونة" — يمتلك الخادم نفسه ساعة العد التنازلي (وليس نموذج اللغة)، لذا يستمر رنين المؤقت حتى أثناء دور صامت، وتتابعه شارة عد تنازلي قابلة للإلغاء على الشاشة
- وضع الترجمة الفورية: قل "ترجم كل ما أقوله إلى الإنجليزية" ويصبح Parlor مترجماً تتابعياً، يعرض كل جملة بعد وقفة قصيرة، بأي لغة يفهمها Gemma 4، حتى تقول "توقف عن الترجمة"
- وضع الاستماع فقط: قل "استمع فقط لفترة، أريد التفكير بصوت عالٍ" ويكتب Parlor كل شيء على الشاشة دون الرد صوتياً، حتى تخاطبه مجدداً
- البحث في الخلفية: مع ضبط مفتاح واجهة برمجة تطبيقات سحابية اختياري، يمكن لـ Parlor تفويض أسئلة البحث المفتوحة إلى نموذج منفصل بينما تستمر المحادثة المحلية، ثم ينطق الإجابة بمجرد وصولها
المنصة والتسعير والترخيص
المنصة
- ما يذكره Parlor:
- تطبيق ويب محلي ذاتي الاستضافة، يُستخدَم عبر المتصفح. يعمل على macOS بمعالج Apple Silicon، أو Linux بوحدة معالجة رسومية مدعومة. لا يوجد إصدار لنظام Windows.
التكلفة
- ما يذكره Parlor:
- مجاني ومفتوح المصدر، دون اشتراك أو حساب. تتم كل معالجة الذكاء الاصطناعي محلياً افتراضياً؛ وتتطلب ميزة البحث السحابي الاختيارية مفتاح واجهة برمجة تطبيقات خاصاً بك لمزود منفصل.
الترخيص
- ما يذكره Parlor:
- Apache 2.0، وتم تأكيده عبر ملف LICENSE في مستودع GitHub.
العتاد
- ما يذكره Parlor:
- نحو 6 غيغابايت من ذاكرة الوصول العشوائي الحرة لنموذج Gemma 4 E4B الافتراضي؛ وتحتاج النسخة الأصغر E2B نحو 4 غيغابايت؛ ويحتاج خيار 12B الأكبر نحو 8 غيغابايت.
الحالة
- ما يذكره Parlor:
- وُصِف صراحةً بأنه "معاينة بحثية" في ملف README الخاص به — توقّع نقاطاً خشنة وأخطاء، وفقاً للمشروع نفسه.
تحقّق من متطلبات العتاد والمنصة الحالية مباشرة على github.com/fikrikarim/parlor قبل التثبيت، إذ يمكن أن تتغير هذه المتطلبات بين الإصدارات لمشروع في مرحلة معاينة بحثية.
تثبيت Parlor
يُثبَّت Parlor من الكود المصدري عبر مدير حزم بايثون uv؛ ولا يوجد مثبّت جاهز لأي منصة.
مستودع GitHub (الكود المصدري، Apache 2.0)
المتطلبات
- Link:
- Python 3.12 أو أحدث، llama.cpp (إصدار b9503 أو أحدث)، macOS بمعالج Apple Silicon أو Linux بوحدة معالجة رسومية مدعومة
أمر التثبيت
- Link:
git clone https://github.com/fikrikarim/parlor.git، ثمuv syncوuv run parlor
التشغيل الأول
- Link:
- افتح
http://localhost:8000، وامنح صلاحيات الكاميرا والميكروفون؛ تُحمَّل النماذج (نحو 5.7 غيغابايت) تلقائياً
يتطلب Parlor طرفية، وبيئة بايثون، وتثبيت llama.cpp محلي (brew install llama.cpp على macOS) — لا يوجد مثبّت بواجهة رسومية.
Parlor مقابل Voxa
كلا Parlor وVoxa مساعدان صوتيان مفتوحا المصدر وفي الوقت الفعلي، لكن Parlor محلي فقط عمداً بينما Voxa هجين بالتصميم.
موقع المعالجة
- Parlor:
- على الجهاز فقط افتراضياً؛ والبحث السحابي اختياري ومنفصل عن المحادثة نفسها
- Voxa:
- هجين — يوجّه المحادثات عبر نماذج سحابية فورية (Gemini Live، OpenAI Realtime) أو عبر خدمة محلية ذاتية الاستضافة تضبطها بنفسك
إدخال الكاميرا
- Parlor:
- نعم — تغذّي إطارات الكاميرا النموذج نفسه الذي يعالج كلامك، لإجابات واعية بالرؤية
- Voxa:
- ليست جزءاً من مجموعة ميزاته الأساسية وفقاً لتوثيقه الخاص
دعم المنصات
- Parlor:
- macOS بمعالج Apple Silicon، أو Linux بوحدة معالجة رسومية مدعومة؛ لا يوجد إصدار لنظام Windows
- Voxa:
- تطبيق سطح مكتب مبني بإطار Tauri v2، متعدد المنصات بتصميم ذلك الإطار
الواجهة
- Parlor:
- تطبيق ويب محلي يعمل في المتصفح
- Voxa:
- كرة عائمة بلا إطار وفوق كل النوافذ تضغط عليها لبدء محادثة
النضج
- Parlor:
- وُصِف صراحةً بأنه "معاينة بحثية"؛ وله إصداران معلّمان حتى وقت إعداد هذه المراجعة
- Voxa:
- يُقدَّم كمساعد سطح مكتب قابل للاستخدام وليس معاينة بحثية موصوفة كذلك
كلاهما مفتوح المصدر ومجاني. اختر Parlor إذا أردت معالجة واعية بالكاميرا ومحلية بالكامل افتراضياً على Mac أو Linux؛ واختر Voxa إذا أردت كرة سطح مكتب أخف مع خيار الرجوع إلى نماذج صوت سحابية فورية. راجع مراجعة Voxa لمزيد من التفاصيل.
لمن يناسب Parlor؟
يناسب Parlor المطورين والمستخدمين ذوي الخبرة التقنية على Mac أو Linux الذين يريدون تجربة مساعد صوتي محلي بالكامل وواعٍ بالكاميرا، ومستعدون لتحمّل النقاط الخشنة الخاصة بمعاينة بحثية.
ما لا يناسبه Parlor
Parlor ليس مناسباً إذا كنت تحتاج إلى دعم Windows، أو تثبيتاً بنقرة واحدة، أو أداة إنتاج مستقرة بدلاً من معاينة بحثية متطورة.
- ليس لمستخدمي Windows — فقط macOS بمعالج Apple Silicon أو Linux بوحدة معالجة رسومية مدعومة مدعومان
- ليس تطبيقاً جاهزاً بنقرة واحدة — يتطلب التثبيت طرفية، وPython 3.12 أو أحدث، وuv، وبناء llama.cpp عاملاً
- ليس منتجاً نهائياً ومُرقّماً بإصدارات — يصفه ملف README الخاص به بأنه معاينة بحثية ويحذّر من توقّع أخطاء
- ليس متعدد المستخدمين ولا مستضافاً للآخرين — صُمِّم للعمل محلياً لشخص واحد على جهازه الخاص
- ليس مدعوماً من شركة أو جولة تمويل استطاعت هذه المراجعة التحقق منها — تعامل معه كمشروع مستقل من مطوّر واحد
أخطاء شائعة عند تقييم Parlor
معظم الالتباس حول Parlor ينشأ من توقّع منتج تجاري جاهز، أو الاستهانة بمتطلباته من العتاد والمنصة.
المنافسون والبدائل
Parlor يُقارَن بشكل مباشر أكثر بمشاريع أخرى مفتوحة المصدر للصوت في الوقت الفعلي والمساعدين الشخصيين التي تركّز على المعالجة المحلية أو الهجينة بدلاً من الاشتراك السحابي البحت.
Tool | Best known for | Link |
|---|---|---|
| Voxa | كرة مساعد صوتي مفتوح المصدر لسطح المكتب، بتوجيه صوت هجين محلي/سحابي في الوقت الفعلي | مراجعة Voxa |
| Jarvis (Mac) | تطبيق مساعد صوتي مخصص لـ Mac مبني حول خلفيات ذكاء اصطناعي محلية وقابلة للتهيئة | مراجعة Jarvis Mac |
| nanobot | وكيل ذكاء اصطناعي شخصي ذاتي الاستضافة بذاكرة دائمة، نصي أولاً وليس صوتياً أولاً | مراجعة nanobot |
| OpenAI GPT-Live | منتج صوتي سحابي فوري قائم على اشتراك، ذُكر كمصدر إلهام لـ Parlor | openai.com/index/introducing-gpt-live |
تعكس هذه القائمة أدوات تُقارَن عادةً بـ Parlor في مجال المساعدين الصوتيين المحليين، وليست ترتيباً مستقلاً من PromptQuorum — تحقّق من دعم المنصة الحالي ومجموعة الميزات لكل أداة قبل الاختيار.
الأسئلة الشائعة
ما هو Parlor؟
Parlor (github.com/fikrikarim/parlor) معاينة بحثية مجانية ومفتوحة المصدر (Apache 2.0) لمساعد صوت ورؤية بالذكاء الاصطناعي يعمل على الجهاز مباشرة وفي الوقت الفعلي، بناه مطوّر واحد ليعمل بالكامل على جهاز Mac أو Linux.
هل Parlor مجاني؟
نعم، Parlor مجاني ومفتوح المصدر. لا يتطلب اشتراكاً أو حساباً. تحتاج ميزة البحث في الخلفية الاختيارية إلى مفتاح واجهة برمجة تطبيقات خاص بك لمزود سحابي منفصل إذا اخترت تفعيلها.
هل يعمل Parlor على Windows؟
لا. يتطلب Parlor macOS بمعالج Apple Silicon أو Linux بوحدة معالجة رسومية مدعومة. لا يوجد إصدار لنظام Windows.
هل يرسل Parlor بيانات صوتي أو كاميرتي إلى السحابة؟
لا، افتراضياً — تُعالَج بيانات الميكروفون وإطارات الكاميرا محلياً عبر نموذج يعمل على جهازك الخاص. لا تغادر البيانات جهازك إلا إذا ضبطت صراحةً REASONER_API_KEY لتفعيل ميزة البحث في الخلفية الاختيارية.
كيف أثبّت Parlor؟
استنسخ مستودع GitHub، وثبّت مدير حزم بايثون uv وllama.cpp، ثم شغّل uv sync يليه uv run parlor. افتح http://localhost:8000 في متصفح وامنح صلاحيات الكاميرا والميكروفون.
ما نموذج الذكاء الاصطناعي الذي يستخدمه Parlor؟
Gemma 4 من Google DeepMind، يعمل محلياً عبر llama.cpp — نسخة E4B افتراضياً، مع خيارات أصغر (E2B) وأكبر (12B) متاحة حسب عتادك.
من أنشأ Parlor؟
بنى المطوّر Fikri Karim مشروع Parlor كمعاينة بحثية فردية، بعد أن استضاف سابقاً بنفسه مشروعاً منفصلاً دائم الاتصال للذكاء الاصطناعي الصوتي يُدعى Bule AI.
كم ذاكرة وصول عشوائي يحتاجها Parlor؟
نحو 6 غيغابايت من ذاكرة وصول عشوائي حرة لتهيئة نموذج E4B الافتراضية؛ وتحتاج النسخة الأصغر E2B نحو 4 غيغابايت، ويحتاج خيار 12B الأكبر نحو 8 غيغابايت.
هل يستطيع Parlor الرؤية عبر كاميرتي؟
نعم. يمكنك توجيه كاميرا ويب نحو شيء ما وسؤال Parlor عنه — تُبَث إطارات الكاميرا إلى النموذج المحلي نفسه إلى جانب كلامك.
هل Parlor منتج نهائي؟
لا. يصفه ملف README الخاص به صراحةً بأنه "معاينة بحثية" ويطلب من المستخدمين توقّع نقاط خشنة وأخطاء. له إصداران معلّمان حتى الآن.