الصق نصك، واختر صوتًا سمعته مسبقًا، وحدّد اللغة، واحصل على ملف MP3 طبيعي خلال ثوانٍ. أكثر من 80 صوتًا من ElevenLabs و18 لغة وحتى 5,000 حرف في كل عملية توليد.
أربع خطوات في شاشة واحدة. إليك المشروع نفسه، وهو سرد فيديو قصير عن مزرعة بن، من السطر الأول من النص حتى ملف MP3 الذي تم تنزيله.
اكتبه كما ينبغي أن يُقال: الفواصل والنقاط تحدد مواضع التوقف، وعلامة الاستفهام ترفع نبرة الجملة. تقبل عملية التوليد الواحدة حتى 5,000 حرف، وهو ما يكفي لعدة دقائق من السرد، ويُظهر لك عدّاد مباشر أين وصلت.
اترك اللغة على الوضع التلقائي وسيستنتجها النموذج من نصك. ثبّتها عندما قد تُقرأ جملة قصيرة بلكنة خاطئة. تتوفر 18 لغة، من الإنجليزية والإسبانية والفرنسية إلى اليابانية والكورية والهندية والعربية والصينية الماندرين.
كل صوت في القائمة يشغّل عيّنة قبل أن تنفق أي شيء. أكثر من 80 صوتًا من ElevenLabs، رجالية ونسائية، من رواة هادئين إلى مقدمين مفعمين بالحيوية. هل استنسخت صوتك؟ ستجده في القائمة نفسها تحت أصواتي المستنسخة.
تظهر التكلفة التقديرية قبل أن تضغط على توليد. يصلك الصوت في مشغّل بموجة صوتية، ويُحفظ في مكتبتك، ويُنزَّل كملف MP3 جاهز لمحرر الفيديو أو البودكاست أو العرض التقديمي.
كانت أنظمة تحويل النص إلى كلام القديمة تقرأ الكلمات واحدة تلو الأخرى. أما مولد الصوت بالذكاء الاصطناعي من ClipNova فيعمل بنموذج ElevenLabs Eleven v4، وهو نموذج كلام يقرأ الجمل كاملة كما يفعل الإنسان: يتنفس عند الفواصل، ويبطئ عند الكلمة المهمة، وترتفع نبرته عند السؤال. لهذا يمنحك نص واحد تعليقًا صوتيًا قابلًا للاستخدام بدلًا من مسودة تحتاج إلى إعادة تسجيل.
كتالوج الأصوات هو نفسه المستخدم في بقية ClipNova، لذا يمكن أن يكون راوي فيديوهاتك بالذكاء الاصطناعي وراوي ملف MP3 مستقل هو الشخص نفسه. ويستطيع الصوت نفسه قراءة نصك بأي من اللغات الـ 18، ما يسهّل نشر النص نفسه لعدة أسواق.
إذا لم يناسبك أي صوت جاهز، فاستنسخ صوتك باستخدام استنساخ الصوت بالذكاء الاصطناعي ضمن خطة مدفوعة: سجّل عيّنة قصيرة مرة واحدة وسيظهر صوتك في قائمة الأصوات، جاهزًا لقراءة أي نص تكتبه.
امنح كل فيديو الراوي الثابت نفسه دون تسجيل لقطة واحدة، وغيّر اللغة لقناة ثانية.
غيّر سطرًا واحدًا من النص وأعد التوليد خلال ثوانٍ بدلًا من حجز جلسة جديدة في الاستوديو.
حوّل نص الدرس إلى صوت واضح بإيقاع متوازن، ثم صحّح جملة لاحقًا دون إعادة تسجيل الوحدة.
استخدم راويًا بالذكاء الاصطناعي للقصص القصيرة ومقدمات البودكاست وإعلانات المنتجات أو الصوت المخصص لإمكانية الوصول.
أداة تحوّل النص المكتوب إلى صوت منطوق بصوت واقعي، وتُسمى أيضًا تحويل النص إلى كلام بالذكاء الاصطناعي (AI TTS) أو الراوي بالذكاء الاصطناعي. في ClipNova تكتب نصًا، وتختار صوتًا ولغة، ثم تنزّل النتيجة كملف MP3.
أكثر من 80 صوتًا من ElevenLabs، رجالية ونسائية، لكل منها عيّنة يمكنك تشغيلها، بـ 18 لغة: الإنجليزية والإسبانية والفرنسية والألمانية والإيطالية والبرتغالية والروسية واليابانية والكورية والصينية الماندرين والعربية والهندية والإندونيسية والهولندية والبولندية والتركية والفيتنامية والسويدية.
حتى 5,000 حرف في كل عملية توليد، أي عدة دقائق من الكلام. وللنص الأطول، قسّمه عند نهاية فقرة وولّد كل جزء بالصوت نفسه.
نعم. استنسخه باستخدام استنساخ الصوت بالذكاء الاصطناعي (متضمن في الخطط المدفوعة) من عيّنة مدتها بين 5 و60 ثانية. سيظهر صوتك المستنسخ بعدها في قائمة الأصوات داخل مولد الصوت بالذكاء الاصطناعي ويمكنه التحدث بـ 10 لغات.
ملف MP3. يُشغَّل في المتصفح فورًا، ويُحفظ في مكتبتك على ClipNova، ويمكن تنزيله لأي محرر أو منصة بودكاست أو أداة عروض تقديمية.
يُحتسب توليد الصوت بالأرصدة حسب طول نصك، وتظهر التكلفة التقديرية قبل التوليد. يبدأ كل حساب جديد بـ 70 رصيدًا مجانيًا دون الحاجة إلى بطاقة؛ وتبدأ الخطط المدفوعة من $19 شهريًا وتشمل حقوق الاستخدام التجاري الكاملة.
علامات الترقيم تحدد الإيقاع: الفواصل للتوقفات القصيرة، والنقاط للتوقفات الأطول. اكتب الأرقام كما تُنطق، وثبّت اللغة عندما قد تُقرأ جملة قصيرة بلكنة خاطئة.
انضم إلى صناع المحتوى الذين يحولون الأفكار إلى فيديوهات توقف التمرير، دون فريق أو برامج أو منحنى تعلم.