تخطَّ إلى المحتوى

ReadSpeaker speechCloud API

واجهة برمجة تطبيقات لتحويل النص إلى كلام لأي تطبيق أو جهاز أو سير عمل

أرسِل النص إلى نقطة نهاية REST واحدة، واستقبل كلامًا طبيعيًا بـ 90 لغة و300 صوت. SSML ونطق مخصّص وست صيغ صوتية، جاهزة للإنتاج من أول استدعاء.

هل أنت عميل بالفعل؟ سجّل الدخول إلى بوابة العملاء
  • 90 لغة
  • 300 صوت
  • مقرّها في الاتحاد الأوروبي، اللائحة العامة لحماية البيانات، ISO 27001

موضع ثقة 12,000 عميل حول العالم

شعار شريك، عنصر نائب 1
شعار شريك، عنصر نائب 2
شعار شريك، عنصر نائب 3
شعار شريك، عنصر نائب 4
شعار شريك، عنصر نائب 5
شعار شريك، عنصر نائب 6
شعار شريك، عنصر نائب 7
شعار شريك، عنصر نائب 8

جرّب صوتًا

استمع إلى ما ستعيده واجهة برمجة التطبيقات لديك

أربعة أصوات بأربع لغات. المحرّك نفسه الذي ستدمجه عبر واجهة برمجة التطبيقات.

Adam

ذكر

English (United Kingdom)

Roxane

أنثى

Français (France)

Lena

أنثى

Deutsch (Deutschland)

Sayaka

أنثى

日本語 (Japan)

هل تريد صوتًا مخصّصًا أو لغة غير مدرجة؟ تصفّح جميع الأصوات الـ 300 →

قصص العملاء

علامات تجارية تبني منتجات صوتية مع ReadSpeaker

Sonos

نهج ReadSpeaker في الأصوات المخصّصة مبتكر وبالغ الدقة، وهو تحديدًا ما احتجنا إليه في هذا المشروع.

Joseph Dureauنائب الرئيس لتجربة الصوت · Sonos
اقرأ القصة كاملة

توليد الكلام عبر السحابة

آنيًا أو بالجملة، أينما احتاج منتجك إلى صوت

speechCloud API خدمة تحويل نص إلى كلام قائمة على السحابة تعمل من خادم إلى خادم. استدعِها داخل تطبيقك الخاص لتوليد الصوت فورًا للمستخدمين النهائيين، أو لإنتاج الصوت بالجملة لتشغيله لاحقًا. وهي تحلّ محل التسجيلات اليدوية المكلفة وتعمل على مدار الساعة، فلا تستضيف محرّك تحويل نص إلى كلام ولا توسّعه بنفسك أبدًا.

التطبيقات والأجهزة الآنية

أضِف تحويل النص إلى كلام إلى تطبيق جوال أو سيارة متصلة أو جهاز طبي أو صناعي أو جهاز يُرتدى أو كشك خدمة. بثّ الصوت عند الطلب دون تضمين محرّك تحويل نص إلى كلام على الجهاز، فتبقى البصمة واستهلاك البطارية منخفضين. احصل على كلام طبيعي بـ 90 لغة باستدعاء REST واحد.

  • الجوال
  • إنترنت الأشياء
  • أكشاك الخدمة
  • الأجهزة التي تُرتدى
  • السيارات المتصلة
  • الأجهزة الطبية

إنتاج الصوت بالجملة

أنتج ملفات صوتية بالجملة لمقررات التعلّم الإلكتروني والتقييمات والمحتوى التدريبي والكتب الصوتية والأدلة الصوتية والحوارات في الأفلام أو الرسوم المتحركة. ويمكن إعادة تقديم الصوت المبثوث إلى المستخدمين النهائيين من بنيتك التحتية عندما يسمح عقدك بذلك. وتضمن قواميس النطق المخصّصة قراءة أسماء العلامات التجارية والمصطلحات التقنية قراءة صحيحة في كل مقطع.

  • e-learning
  • الكتب الصوتية
  • التقييمات
  • التدريب
  • الأدلة الصوتية
  • الأفلام والرسوم المتحركة

الاتصالات الهاتفية والرد الصوتي التفاعلي والوكلاء الصوتيون

زوّد أنظمة الهاتف ومراكز الاتصال والوكلاء الصوتيين المدعومين بنماذج لغوية كبيرة بأصوات طبيعية. وصيغتا الإخراج A-law وμ-law هما ترميزا G.711 المستخدمان في أنظمة الاتصالات الهاتفية. استخدم SSML للتحكم في الإيقاع، وتبديل اللغة داخل النص، ونطق أسماء العلامات التجارية عبر قاموسك المخصّص. وتتوسع القنوات الآنية المتزامنة وفق عقدك.

  • الرد الصوتي التفاعلي
  • G.711
  • الوكلاء الصوتيون
  • SSML
  • A-law / μ-law

الميزات

تحويل نص إلى كلام بجودة الإنتاج، من البداية إلى النهاية

كل ما يحتاجه منتجك ليردّ بصوته.

90 لغة و300 صوت

اختر من كتالوج أصوات احترافي وغني لكل لغة. وتُرخَّص الأصوات فرديًا؛ ويمكنك إضافة المزيد في أي وقت.

إدخال SSML

استخدم SSML للوقفات والنسخ الصوتي وتبديل الصوت أو اللغة داخل نص واحد. ويُدعم ترميز SSML القياسي.

قواميس نطق مخصّصة

يمكن لكل عميل تحرير قاموس خاص بكل صوت في بوابة العملاء، للتحكم في طريقة نطق أسماء العلامات التجارية والمصطلحات التقنية والكلمات غير المألوفة. ويمكن للغويي ReadSpeaker تصحيح الأخطاء في النطق عند الطلب.

بيانات التوقيت (RSDS)

يعيد RSDS الصوت وعلامات التوقيت في استجابة واحدة، فيوفّر الأرصدة مقارنة باستدعاءين منفصلين. وهو مفيد لتظليل الكلمات والجمل في واجهتك. ومتاح بصيغة MP3 بمعدل 48 كيلوبت/ثانية فقط، وليس على كل الأصوات.

ست صيغ لإخراج الصوت

MP3 (16 و24 و32 و48 و64 و128 كيلوبت/ثانية)، وOgg VBR، وμ-law، وA-law، وPCM خام، وWAV. وتتوفر PCM وWAV عند 22050 أو 16000 أو 8000 هرتز بعمق 16 بت. تُحدَّد لكل طلب عبر معاملات واجهة برمجة التطبيقات.

بثّ أو تنزيل

اضبط streaming=1 لبدء التشغيل فور جهوزية الصوت، وهو مثالي للاستخدام المباشر. أو خذ الملف الجاهز في تنزيل واحد.

واجهة برمجة تطبيقات REST عبر HTTPS

يُرفق مفتاح واجهة برمجة التطبيقات مع كل استدعاء. استعلم عن اللغات والأصوات المتاحة والاستخدام الحالي والأرصدة المتبقية عبر واجهة REST نفسها.

بوابة عملاء SCAPI

حرّر قاموس النطق الخاص بك، وتابع الاستخدام والأرصدة المتبقية، وأصدر مفتاح واجهة برمجة تطبيقات جديدًا فور الاشتباه بسوء استخدام، كل ذلك من بوابة واحدة.

بنية تحتية مستضافة ومكرّرة

مستضاف لدى ReadSpeaker في بيئة عالية الأمان مع تكرار وتحويل عند الأعطال. لا شيء يُنزَّل أو يُثبَّت.

جرّبه في منظومتك

من النص إلى الصوت بطلب واحد

نظرة على شكل الاستدعاء بأربع لغات. تتم المصادقة بمفتاح واجهة برمجة التطبيقات الخاص بك، ويُرسل مع كل طلب.

# Synthesise a sentence to MP3 (48 kbps)
curl -X POST "https://tts.readspeaker.com/a/eg/v2.0" \
  -d "key=YOUR_API_KEY" \
  -d "voice=Adam" \
  -d "lang=en_uk" \
  -d "audioformat=mp3" \
  -d "audiobitrate=48" \
  -d "text=Welcome to ReadSpeaker." \
  --output speech.mp3

# With SSML, switching language inline
curl -X POST "https://tts.readspeaker.com/a/eg/v2.0" \
  -d "key=YOUR_API_KEY" \
  -d "voice=Adam" \
  -d "lang=en_uk" \
  -d "input=ssml" \
  --data-urlencode 'text=<speak>Hello, <voice name="Roxane" xml:lang="fr-FR">bonjour</voice>.</speak>' \
  --output greeting.mp3

شكل نقطة النهاية توضيحي. راجع أحدث مواصفات المنتج and the Customer Portal documentation for the current endpoint URL and parameter names.

المواصفات التقنية

كل مواصفة ستسأل عنها مراجعتك الأمنية

المصادقة والنقل وتغطية اللغات وحدود الإنتاجية وصيغ الصوت. الإجابات التي يحتاجها فريقا الأمن والتشغيل لديك قبل التكامل.

المواصفات التقنية لـ speechCloud API
SpecificationValue
المصادقةمفتاح واجهة برمجة التطبيقات، يُرفق مع كل طلب
النقلREST عبر HTTPS
اللغات المدعومة90 لغة
الأصوات المتاحة300 صوت
الحد الأقصى للنص في كل طلب5,000 حرف (باستثناء المسافات)، القيمة الافتراضية
حد الاستخدام المتوقع≤ 25,000 طلب/يوم · ذروات ≤ 2,000 طلب خلال ساعة واحدة
صيغ إخراج الصوتMP3 · Ogg VBR · μ-law · A-law · PCM · WAV
معدلات بت MP316 و24 و32 و48 و64 و128 كيلوبت/ثانية
معدلات أخذ العينات لـ PCM / WAV22050 و16000 و8000 هرتز بدقة 16 بت
ترميز الإدخاليوصى بترميز UTF-8؛ ومعظم الترميزات الشائعة مدعومة
دعم SSMLنعم، الوقفات والنسخ الصوتي وتبديل الصوت واللغة داخل النص
بيانات التوقيت (RSDS)الصوت والتوقيت في استجابة واحدة · حاليًا MP3 بمعدل 48 كيلوبت/ثانية فقط · لا تدعمه كل الأصوات
وضع البثّstreaming=1 (default) → redirect to streaming server; streaming=0 → file delivered after full generation
قواعد تخزين الصوتلا تخزين ولا إعادة استخدام ولا إعادة توزيع ما لم يُتفق على ذلك صراحة في تأكيد الطلب
التكامل مع الاتصالات الهاتفيةصيغتا الإخراج A-law وμ-law (بترميزات G.711)
الوثائقمواصفات المنتج (PDF)

التسعير

ادفع مقابل ما تولّده، وتوسّع عند الحاجة

يستخدم speechCloud API نموذج الأرصدة. وتُطلب أرصدة الإنتاج عبر مدير حسابك في ReadSpeaker ويضيفها فريق دعم ReadSpeaker إلى حسابك. وتحصل الحسابات الجديدة عادة على قدر محدود من الأرصدة التجريبية للاختبار الأولي.

اطلب عرض سعر

ابدأ مجانًا: تحصل الحسابات الجديدة عادة على أرصدة تجريبية. اطلب الوصول عبر نموذج التواصل.

Credits

speechCloud API

نموذج الأرصدةرصيد واحد = حرف واحد، باستثناء المسافات

كيف تعمل الأرصدة

  • رصيد واحد = حرف واحد، باستثناء المسافات، وشاملًا أي تغييرات ناتجة عن مدخلات قاموس النطق
  • صيغة الاحتساب بالثانية من الكلام available via order confirmation for predictable cost on long audio
  • أرصدة تجريبية عند فتح الحساب so you can evaluate before committing

تُقاس السعة المرخّصة بـ

  • عدد الحروف over the contract period
  • عدد الطلبات and total speech time
  • قنوات آنية متزامنة for telephony and live use cases
  • سرعة التوليد when responsiveness is critical

الامتثال

امتثال يمكنك تسليمه إلى مدقّقك مباشرة

ReadSpeaker مؤسسة حاصلة على شهادة ISO/IEC 27001:2022، ومتوافقة مع اللائحة العامة لحماية البيانات، وتعتمد البنود التعاقدية النموذجية لعمليات نقل البيانات عبر الحدود.

  • ISO/IEC 27001:2022 (ISO/IEC 27001:2022: إدارة أمن المعلومات)

    مؤسسة ReadSpeaker

  • اللائحة العامة لحماية البيانات (اللائحة العامة لحماية البيانات)

    إشعار الخصوصية منشور

  • EU SCCs (البنود التعاقدية النموذجية للاتحاد الأوروبي)

    لعمليات النقل عبر الحدود

  • مقرّها في الاتحاد الأوروبي (مؤسسة مقرّها في الاتحاد الأوروبي)

    المقر الرئيسي في السويد (ReadSpeaker AB، أوبسالا)

الأسئلة الشائعة

أسئلة حول speechCloud API

  • speechCloud API (SCAPI) واجهة برمجة تطبيقات REST لتحويل النص إلى كلام مستضافة سحابيًا من ReadSpeaker. ترسل النص إلى خوادم ReadSpeaker عبر HTTPS وتستقبل صوتًا عالي الجودة بالصيغة التي تختارها (MP3 أو Ogg أو PCM أو WAV أو A-law أو μ-law). وهي تدعم 90 لغة و300 صوت وترميز SSML وقواميس نطق مخصّصة وبيانات توقيت للتظليل المتزامن. وهي قائمة على الخوادم دون أي برنامج يُثبَّت؛ ويتم التكامل عبر مفتاح واجهة برمجة التطبيقات وطلبات HTTP.

  • webReader وdocReader منتجان موجّهان للمستخدم النهائي ولكل منهما واجهته الخاصة. webReader puts a Listen button on the HTML pages of your website; docReader does the same for the documents you publish. speechCloud API has no user interface. You call it server-to-server from your application to generate audio. Use it for connected devices, telephony and IVR, mobile apps, e-learning platforms that produce audio, audiobooks, or any product where you need text-to-speech inside your own software.

  • يعيد speechCloud API الصوت بست صيغ: MP3 (بمعدل بت قابل للضبط: 16 أو 24 أو 32 أو 48 أو 64 أو 128 كيلوبت/ثانية)، وOgg VBR، وμ-law، وA-law، وPCM خام، وWAV. وتدعم PCM وWAV معدلات أخذ عينات 22050 أو 16000 أو 8000 هرتز بعمق 16 بت. ويُحدَّد اختيار الصيغة ومعاملات الصوت لكل طلب عبر معاملات واجهة برمجة التطبيقات.

  • يستوعب كل طلب حتى 5,000 حرف افتراضيًا، مع احتساب كل شيء عدا المسافات. والخدمة القياسية مُهيّأة لما يصل إلى 25,000 طلب يوميًا، بذروات ساعية تصل إلى 2,000. هل تتوقع حركة أعلى أو مستمرة؟ تحدّث مع ReadSpeaker بشأن تهيئة مخصّصة مبنية على حجم استخدامك.

  • نعم. إدخال SSML مدعوم، بما في ذلك الوقفات والنسخ الصوتي وتبديل الصوت أو اللغة داخل نص واحد. وتتوفر أيضًا قواميس نطق مخصّصة: إذ يمكن لكل عميل تحرير قاموس خاص بكل صوت في بوابة العملاء للتحكم في طريقة نطق أسماء العلامات التجارية أو المصطلحات التقنية أو الكلمات غير المألوفة.

  • نعم. يستطيع speechCloud API إعادة تنسيق RSDS الذي يجمع الصوت ومعلومات التوقيت في استجابة واحدة، فيوفّر الأرصدة مقارنة بطلبين منفصلين. وRSDS متاح حاليًا مع MP3 بمعدل 48 كيلوبت/ثانية وليس متاحًا لكل لغة أو صوت؛ تواصل مع ReadSpeaker للحصول على القائمة الحالية.

  • يعمل speechCloud API بالأرصدة: رصيد واحد يغطي حرفًا واحدًا، مع احتساب كل شيء عدا المسافات، إضافة إلى أي حروف يضيفها قاموس النطق لديك. وتطلب أرصدة الإنتاج عبر مدير حسابك في ReadSpeaker، وتبدأ الحسابات الجديدة عادة بأرصدة تجريبية. ويتوفر نموذج احتساب بالثانية من الكلام عند الطلب. ويمكن ترخيص السعة بالحروف أو الطلبات أو زمن الكلام أو القنوات المتزامنة أو سرعة التوليد. تواصل مع ReadSpeaker للحصول على عرض سعر يناسب حجم استخدامك.

  • ReadSpeaker كمؤسسة حاصلة على شهادة ISO/IEC 27001:2022، ومتوافقة مع اللائحة العامة لحماية البيانات. وتستخدم كل حركة واجهة برمجة التطبيقات بروتوكول HTTPS. وبالنسبة إلى عملاء الاتحاد الأوروبي وعمليات نقل البيانات عبر الحدود، تعتمد ReadSpeaker على البنود التعاقدية النموذجية (SCCs). ووفق إشعار الخصوصية الخاص بـ ReadSpeaker، فإن الأصوات المركّبة لدى ReadSpeaker هي نماذج صوتية مدمجة لا تُعدّ معلومات شخصية بموجب اللائحة العامة لحماية البيانات. ويجب عدم تخزين البيانات الصوتية أو إعادة استخدامها أو إعادة توزيعها ما لم يُتفق على ذلك صراحة في تأكيد الطلب.

  • يدعم speechCloud API الحالات الآنية. فافتراضيًا، تستخدم الطلبات وضع البثّ (streaming=1)، حيث تُعاد توجيه الاستجابة إلى خادم بثّ يبدأ بتسليم الصوت في أسرع وقت ممكن، لأقصر زمن حتى أول صوت. وللتسليم بالجملة، اضبط streaming=0 ليُعاد الملف بعد توليده كاملًا. وعدد القنوات الآنية المتزامنة جزء من سعتك المرخّصة ويمكن توسيعه في تأكيد الطلب.

  • أنشئ حسابًا لدى ReadSpeaker. تحصل الحسابات الجديدة عادة على قدر محدود من الأرصدة التجريبية لتتمكن من تقييم speechCloud API. ويتوفر مفتاح واجهة برمجة التطبيقات الخاص بك في بوابة عملاء SCAPI، ويجب إرفاقه مع كل طلب. كما تتوفر في البوابة إرشادات التنفيذ والاستخدام، وأمثلة كود بلغات البرمجة الشائعة، وقاموس النطق القابل للتحرير الخاص بك. تواصل مع ReadSpeaker to start your account.

VoiceLab

هل تحتاج إلى صوت خاص بعلامتك التجارية؟

يأتي speechCloud API مع كتالوج أصواتنا الاحترافي.

موهبة صوتية تسجّل أمام ميكروفون استوديو

صوت لعلامتك التجارية نبنيه معك في الاستوديو

وللحصول على صوت مخصّص بالكامل لعلامتك التجارية نبنيه معك في الاستوديو، استكشف VoiceLab. فقد ظل اللغويون الحاسوبيون في ReadSpeaker يصوغون أصوات العلامات التجارية منذ عام 1999.

هل أنت مستعد لإضافة صوت إلى منتجك؟

تُقدَّم أرصدة تجريبية عادة عند إنشاء الحساب لتتمكن من التقييم قبل الالتزام. ويساعدك فريقنا على تحديد حجم الاستخدام واللغات والقنوات الآنية المتزامنة للإنتاج. حاصلة على شهادة ISO/IEC 27001:2022، ومتوافقة مع اللائحة العامة لحماية البيانات عبر البنود التعاقدية النموذجية للاتحاد الأوروبي.

Find your ReadSpeaker solution

Opening the conversation…

Search

    Searching…

    No results for

    Try another wording, or start from one of these.

    Search is not available right now.

    You can still reach the pages below.