• Tech Support ⤴
  • Projects
  • Services
    • AI Development
    • UI/UX Design
    • Web Development
    • Technology Support
    • Mobile App Development
    • Banking ATM Interfaces
    • Process Automation
    • Security Auditing
    • Local AI Servers
  • odoo ERP
get in touchStart with Eva
logo
Tech Support ⤴
Projects
Services
AI DevelopmentUI/UX DesignWeb DevelopmentTechnology SupportMobile App DevelopmentBanking ATM InterfacesProcess AutomationSecurity AuditingLocal AI Servers
odoo ERP
get in touchStart with Eva
Loading…
logo

Transforming businesses through AI-powered digital innovation and creative excellence.

Quick Links

BlogAinexProjectsContact us

Contact Us

pinDubai Digital Park, A5, DTEC - Silicon Oasisemail[email protected]phone+971 55 7538087
© 2026 aratech. All rights reserved.
Privacy PolicyTerms of ServiceCookie Policy
الرئيسية \ المدونة \ Voicebox: استوديو الصوت AI مفتوح المصدر الذي ينافس ElevenLabs

Voicebox: استوديو الصوت AI مفتوح المصدر الذي ينافس ElevenLabs

Voicebox is the open-source AI voice studio that runs entirely on your machine — no cloud, no API keys, no character limits. Here's why it's a game-changer for

10 يوليو 2026 - 7 دقائق للقراءة
Voicebox: استوديو الصوت AI مفتوح المصدر الذي ينافس ElevenLabs

ما هو صندوق الصوت؟

Voicebox هو تطبيق سطح مكتب (تم إنشاؤه باستخدام Tauri وReact وFastAPI) يحول جهاز الكمبيوتر الخاص بك إلى استوديو صوتي كامل الميزات يعمل بتقنية الذكاء الاصطناعي. إنه يعمل على أنظمة التشغيل macOS، وWindows، وLinux، ويحتوي على استنساخ الصوت، وإنشاء تحويل النص إلى كلام، والإملاء على مستوى النظام، وحتى خادم MCP لعملاء الذكاء الاصطناعي - كل ذلك محليًا.

فكر في الأمر باعتباره Ollama للذكاء الاصطناعي الصوتي. مثلما جلبت شركة Ollama نماذج لغات كبيرة إلى سطح المكتب لديك، فإن Voicebox يوفر إمكانات صوتية احترافية لجهازك، مجانًا وخاصة.

استنساخ الصوت خلال 3 ثوانٍ فقط

يعد استنساخ الصوت هو الميزة الرئيسية، وهو بسيط بشكل ملحوظ. يمكنك تغذيته بالصوت بثلاث طرق:

  • تحميل مقطع - قم بسحب وإفلات ملفات WAV، أو MP3، أو FLAC، أو WebM
  • التسجيل من الميكروفون — معاينة حية للشكل الموجي، لمدة تصل إلى 30 ثانية
  • التقاط صوت النظام — استنساخ صوت من مقطع فيديو على YouTube، أو بودكاست، أو أي تطبيق يقوم بتشغيل الصوت

من خلال ثلاث ثوانٍ** من الصوت، يقوم Voicebox بإنشاء ملف تعريف صوتي يمكنك استخدامه عبر جميع محركاته. الاستنساخ بدون إطلاق النار يعني عدم وجود عملية تدريب طويلة - ما عليك سوى تقديم عينة وإنشاءها.

سبعة محركات تحويل النص إلى كلام (TTS)، واجهة واحدة

Voicebox لا يحبسك في نموذج واحد. يأتي مزودًا بـ سبعة محركات TTS، لكل منها نقاط قوة مختلفة:

المحركالمطورالحجمأبرز الأحداث
Qwen3-TTSعلي بابا1.7ب/0.6ب10 لغات، تعليمات التسليم (النغمة، السرعة، العاطفة عبر اللغة الطبيعية)
صندوق الثرثرةتشبه منظمة العفو الدوليةالإنتاج23 لغة، استنساخ بدون إطلاق النار، التحكم في المبالغة في المشاعر
** صندوق الدردشة توربو **تشبه منظمة العفو الدولية350 مسريع وخفيف الوزن ويدعم العلامات غير اللغوية مثل [ضحك] [تنهد] [لهث]
لوكس تي تي اسالرمز البريديصغير150 مرة في الوقت الفعلي على وحدة المعالجة المركزية، وإخراج 48 كيلو هرتز، وذاكرة VRAM بسعة 1 جيجابايت تقريبًا
كوين CustomVoiceعلي بابا1.7ب/0.6ب9 مكبرات صوت متميزة مُعدة مسبقًا، وتعليمات بنمط اللغة الطبيعية
** تادا **هيوم منظمة العفو الدولية3ب/1بنموذج لغة الكلام، أكثر من 700 ثانية صوت متماسك، 10 لغات
كوكوروهيكسجراد82 مترخيص Apache 2.0، الوقت الفعلي لوحدة المعالجة المركزية (CPU)، ذاكرة VRAM لا تذكر

ويعني هذا الاتساع أنك تختار الأداة المناسبة لهذه المهمة. هل تحتاج إلى تكرارات سريعة وبجودة عالية؟ لوكس تي تي إس. هل تحتاج إلى خطاب معبر مع التحكم العاطفي؟ Chatterbox أو TADA. هل تعمل على جهاز منخفض الموارد؟ يعمل Kokoro على أي شيء تقريبًا.

بالنسبة للنسخ، يجمع Voicebox بين Whisper وWhisper Turbo (99 لغة، والأخيرة أسرع 8 مرات)، بالإضافة إلى أن نموذج اللغة Qwen3 يعمل على تنظيف النص والردود الشخصية.

الإملاء على مستوى النظام: مساعد الكتابة بالذكاء الاصطناعي

واحدة من أكثر الميزات العملية هي الإملاء على مستوى النظام. باستخدام مفتاح التشغيل السريع العام (Cmd+Opt على نظام macOS، وCtrl+Alt على نظام Windows) يمكنك التحدث إلى أي تطبيق وإظهار النص عند المؤشر. لا مزيد من الصراع مع ملحقات متصفح تحويل الكلام إلى نص، فهي تعمل في كل مكان، بدءًا من برامج تحرير التعليمات البرمجية وحتى تطبيقات الدردشة.

هذه هي نفس التجربة التي يتقاضاها WisprFlow، المضمنة في تطبيق مجاني مفتوح المصدر.

خادم MCP: امنح كل وكيل للذكاء الاصطناعي صوتًا

إذا كنت تستخدم وكلاء MCP مثل Claude Code أو Cursor أو Cline، فإن Voicebox يعرض خادم MCP باستخدام استدعاء أداة voicebox.speak واحد. يمكن لأي وكيل التحدث إليك من خلال الصوت الذي قمت باستنساخه — مكتملًا بملفات التعريف الصوتية لكل وكيل.

يمكنك جعل Claude Code يتحدث بصوت واحد، والمؤشر بصوت آخر، ومعرفة العميل الذي يتحدث دون النظر إلى الشاشة. يُظهر كل خطاب يبدأه العميل حبة مرئية، لذلك لا توجد خلفية صامتة لتحويل النص إلى كلام.

REST API وWebSocket للمطورين

يعرض Voicebox نقاط نهاية REST API وWebSocket المحلية لكل محرك تقوم بتنزيله. هذا يعني:

  • الألعاب — أنشئ حوارًا بين الشخصيات غير القابلة للعب (NPC) سريعًا باستخدام أصوات شخصياتك
  • التطبيقات — أنشئ تطبيقات تدعم الصوت دون دفع رسوم لكل حرف
  • النصوص البرمجية — فصول الكتب الصوتية التي يتم إنتاجها على دفعات، وأتمتة مقدمات البودكاست، وتوصيلها إلى مجموعة البث الخاصة بك

لا توجد مفاتيح API، ولا حدود للمعدلات، ولا رسوم لكل حرف. مجرد عنوان URL للمضيف المحلي.

الشخصيات: أصوات ذات شخصيات

الميزة الإبداعية بشكل خاص هي نظام Persona. يمكنك إعطاء أي ملف تعريف صوتي وصفًا حرًا للشخصية ("محقق نوير في الأربعينيات. مرهق من العالم، ساخر...")، ثم:

  • إعادة الكتابة — أعد صياغة النص بصوت تلك الشخصية مع الحفاظ على الأفكار
  • التأليف — اسمح للشخصية بارتجال الخطوط الأصلية من البداية

يعد هذا بمثابة الذهب لحوار اللعبة والدبلجة والسرد الطويل وأي مشروع إبداعي حيث يكون صوت الشخصية المتسق مهمًا.

الخصوصية وسيادة البيانات

كل شيء يعمل محليا. يقوم Voicebox بتنزيل النماذج على جهازك ويحتفظ بجميع عمليات المعالجة على الجهاز. لا يتم إرسال أي مقاطع صوتية إلى خادم سحابي، ولا توجد ملفات تعريف صوتية تغادر جهاز الكمبيوتر الخاص بك، ولا توجد مكالمات قياس عن بعد ترسل بيانات الاستخدام إلى المنزل.

في عصر يبدو فيه أن كل أداة من أدوات الذكاء الاصطناعي تريد شريحة من بياناتك، فإن التزام Voicebox بالعملية المحلية أولاً يعد أمرًا منعشًا حقًا.

كيف تتنافس مع ElevenLabs

ميزةصندوق الصوتأحد عشر مختبرا
التكلفةمجاني ومفتوح المصدرالاشتراك + التسعير لكل حرف
استضافةآلة محليةالقائم على السحابة
الخصوصيةغير متصل بالكاملمعالجة الصوت على خوادم
استنساخ الصوتصفر طلقة من 3Sيتطلب التحميل على السحابة
** محركات تحويل النص إلى كلام **7 محركاتالملكية (1-2 نماذج)
اللغات10-23 حسب المحرك29 لغة
الإملاءمدمج على مستوى النظامغير متوفر
واجهة برمجة التطبيقاتREST المحلي + WebSocketواجهة برمجة تطبيقات Cloud REST
** دعم MCP **خادم MCP مدمجغير متوفر
التخصيص7 محركات، شخصياتVoiceLab، التحكم بالأسلوب
الترخيصمعهد ماساتشوستس للتكنولوجيا / أباتشي 2.0الملكية

لا تزال ElevenLabs تفوز بجودة الصوت الهائلة وعدد اللغات المدعومة. لكن Voicebox يتنافس بشدة على المرونة والخصوصية والتكلفة - وبالنسبة للعديد من حالات الاستخدام، وخاصة سير عمل المطورين، فهو بالفعل الخيار الأفضل.

البدء

يتوفر Voicebox الآن على voicebox.sh أو على GitHub. قم بتنزيل التطبيق لمنصتك، واختر المحركات التي تريدها، وستقوم بإنشاء الكلام في غضون دقائق.

يحتوي المشروع أيضًا على رمز Solana المميز (VOICEBOX) لأولئك الذين يرغبون في دعمه، لكن التطبيق نفسه يظل مجانيًا ومفتوح المصدر إلى الأبد - لا يلزم وجود رمز مميز.

الخلاصة

يمثل Voicebox تحولًا في طريقة تفكيرنا في أدوات الذكاء الاصطناعي الصوتية. من خلال جلب كل شيء محليًا، واحتضان مبادئ مفتوحة المصدر، ودعم نظام بيئي واسع لمحركات TTS، فإنه يعمل على تمكين المستخدمين بطريقة لا تستطيع خدمات الحدائق المسورة القيام بها أبدًا.

إذا كنت مترددًا في استخدام الذكاء الاصطناعي الصوتي بسبب التكلفة، أو مخاوف الخصوصية، أو تقييد البائع، فإن Voicebox هو الحل. إنه صوت أولاما - وهو يتحسن فقط.

مواصلة القراءة: للحصول على تعمق تقني أعمق في إعداد Voicebox لاستخدام الإنتاج، راجع الوثائق الرسمية على voicebox.sh/docs.

جدول المحتويات

  • ↗ما هو صندوق الصوت؟
  • ↗استنساخ الصوت خلال 3 ثوانٍ فقط
  • ↗سبعة محركات تحويل النص إلى كلام (TTS)، واجهة واحدة
  • ↗الإملاء على مستوى النظام: مساعد الكتابة بالذكاء الاصطناعي
  • ↗خادم MCP: امنح كل وكيل للذكاء الاصطناعي صوتًا
  • ↗REST API وWebSocket للمطورين
  • ↗الشخصيات: أصوات ذات شخصيات
  • ↗الخصوصية وسيادة البيانات
  • ↗كيف تتنافس مع ElevenLabs
  • ↗البدء
  • ↗الخلاصة

مقالات ذات صلة

رسم سايبربانك مظلم لمساعد ذكاء اصطناعي يتم التلاعب به من قبل مهاجمين رقميين بدوائر نيون بنفسجية وزرقاء

Microsoft Copilot CoSnitch: عندما يصبح مساعد الذكاء الاصطناعي كاشف أسراره بنفسه

اكتشف مختبر Varonis Threat Labs ثلاث ثغرات متسلسلة في Microsoft Copilot Personal تسمح بسرقة البيانات بنقرة واحدة من تطبيقات متصلة مثل Gmail و Google Drive. أُطلق عليها اسم 'CoSnitch' (CVE-2026-24301)، وهي ملحوظة لأن الذكاء الاصطناعي نفسه كشف كيفية استغلاله.

Necolas HamwiNecolas Hamwi
19 أغسطس 2026 - 7 دقائق للقراءة
Cyberpunk data center with neon purple and cyan energy flows through massive server infrastructure

رهان إنفيديا بقيمة 105 مليارات دولار على مراكز البيانات

إنفيديا ضمنت تمويلاً يصل إلى 105 مليارات دولار لمركز بيانات أووبن آي الضخم في أوهايو واستثمرت 1.5 مليار دولار في SB Energy. سيوفر مشروع PORTS-Pike طاقة حوسبة ذكاء اصطناعي بقدرة 8 جيجاواط.

Necolas HamwiNecolas Hamwi
18 أغسطس 2026 - 7 دقائق للقراءة
تصور سايبربانك لإشعارات اختراق البيانات متتالية مع شبكة عصبية للذكاء الاصطناعي في المركز

471 مليون إشعار في 6 أشهر: الذكاء الاصطناعي يغذي وباء اختراق البيانات

إشعارات اختراق البيانات في النصف الأول من 2026 تجاوزت بالفعل كل عام 2025. IBM تفيد بأن واحدًا من كل أربعة اختراقات خبيثة مدعوم بالذكاء الاصطناعي، بتكلفة $6 مليون في المتوسط.

Necolas HamwiNecolas Hamwi
17 أغسطس 2026 - 7 دقائق للقراءة