تحويل النص إلى كلام

الصق النص، اختر صوتًا واضغط الزر. كل التوليد يجري داخل المتصفّح: صوت النظام يبدأ فورًا، والصوت العصبي يحتاج تنزيلًا واحدًا، لكنه يبدو نفسه على كل جهاز ويمكن حفظه ملفًا.

  • 0عدد الأحرف
  • 0المدة التقريبية
  • 0الأصوات المتاحة

لا يمكن حفظ صوت النظام: يرسله المتصفّح إلى بطاقة الصوت مباشرة دون أن يمنح الصفحة تدفّقًا صوتيًا. أمّا الصوت العصبي فيُولَّد على جهازك، ولذلك يمكن تنزيله ملف WAV.

طريقة الاستخدام

  1. الصق النص المراد قراءته أو اكتبه.
  2. إن أردت صوتًا متماثلًا على كل جهاز وملفًا تحتفظ به، فشغّل الصوت العصبي: يُنزَّل النموذج مرّة واحدة ويبقى في المتصفّح.
  3. اختر صوتًا — تأتي القائمة من اللغات المثبّتة على جهازك.
  4. اضبط السرعة وطبقة الصوت إن كانت القراءة الافتراضية سريعة أو رتيبة.
  5. اضغط «انطق النص»؛ ويمكنك الإيقاف المؤقّت والمتابعة من الموضع نفسه.

معلومات مفيدة

من أين تأتي الأصوات

لا يحمل المتصفّح أصواتًا خاصة به، بل يطلبها من نظام التشغيل. لذلك تختلف القائمة من جهاز إلى آخر: في الهاتف عادةً عدّة أصوات لكل لغة، وفي لينكس المكتبي قد لا يوجد أي صوت حتى تُثبَّت حزمة نطق. وهذا يعني أيضًا: لا حدّ للأحرف ولا اشتراك — فالعمل تقوم به برمجيات تملكها أصلًا.

صوتان ولكل منهما ثمنه

صوت النظام لا يكلّف شيئًا للبدء: هو مثبّت أصلًا ويتكلّم بمجرّد الضغط — غير أنّ طريقة نطقه تتبع الجهاز، وقد لا يوجد أي صوت على سطح مكتب لينكس المجرّد. أمّا الصوت العصبي فنموذج يُنزَّل ويُحسب على جهازك: للعربية نستخدم Piper بحجم ستين ميغابايت تقريبًا. في الحالتين يبقى النص عندك، ويمكن حفظ النتيجة بصيغة WAV.

النص الطويل يُقرأ على أجزاء

إذا سُلِّم للمحرّك مقال كامل، استسلم في منتصف الطريق: يتوقّف Chrome بعد نحو خمس عشرة ثانية ما لم تُدفع الطابور، ويُسقط Safari كل ما بعد بضع مئات من الأحرف. لذلك يُقطَّع النص عند حدود الجُمل ويوضع في الطابور جملةً جملة. أمّا القطع بعدد الأحرف فيقع داخل الكلمة، ويُسمَع ذلك تلعثمًا.

الأسئلة الشائعة

هل أنزّل الصوت ملفًا؟

نعم، مع الصوت العصبي: فهو يبني الصوت داخل الصفحة نفسها، ولذلك يظهر بجوار المشغّل زر «تنزيل WAV». أمّا صوت النظام فلا يمكن حفظه — يرسله المتصفّح إلى بطاقة الصوت مباشرة دون أن يمنح الصفحة تدفّقًا صوتيًا، فلا مادة لتكوين ملف.

لا أصوات في القائمة. ماذا أفعل؟

معناه أن النظام خالٍ منها. في ويندوز تُضاف من إعدادات اللغة، وفي أندرويد وiOS من إمكانية الوصول، وفي لينكس بتثبيت حزمة أصوات لـspeech-dispatcher. ثم أعد تحميل الصفحة: تُقرأ القائمة عند التحميل.

لماذا يبدو النص نفسه مختلفًا في متصفّح آخر؟

لأن الصوت من النظام، أمّا اختيار الصوت الافتراضي ومعالجة الوقفات والإيقاع الدقيق فمن شأن المتصفّح. ويقدّم Chrome كذلك أصواتًا شبكية تبدو أنعم وتحتاج اتصالًا.

هل يُرسل النص إلى خادم؟

الصفحة لا ترسل النص إلى أي جهة. الصوت العصبي يُنزّل نموذجه من huggingface مرّة واحدة ثم يعمل دون شبكة، والكلمات التي تلصقها لا تغادر الجهاز. أمّا صوت النظام الموسوم بأنه شبكي فقد يطلب الصوت من الشركة المصنّعة، ولهذا تُفضَّل هنا الأصوات المحلّية.

أدوات ذات صلة