Adam
ذكرEnglish (United Kingdom)
ReadSpeaker speechCloud API
أرسِل النص إلى نقطة نهاية REST واحدة، واستقبل كلامًا طبيعيًا بـ 90 لغة و300 صوت. SSML ونطق مخصّص وست صيغ صوتية، جاهزة للإنتاج من أول استدعاء.
هل أنت عميل بالفعل؟ سجّل الدخول إلى بوابة العملاءموضع ثقة 12,000 عميل حول العالم
جرّب صوتًا
أربعة أصوات بأربع لغات. المحرّك نفسه الذي ستدمجه عبر واجهة برمجة التطبيقات.
English (United Kingdom)
Français (France)
Deutsch (Deutschland)
日本語 (Japan)
هل تريد صوتًا مخصّصًا أو لغة غير مدرجة؟ تصفّح جميع الأصوات الـ 300 →
قصص العملاء
توليد الكلام عبر السحابة
speechCloud API خدمة تحويل نص إلى كلام قائمة على السحابة تعمل من خادم إلى خادم. استدعِها داخل تطبيقك الخاص لتوليد الصوت فورًا للمستخدمين النهائيين، أو لإنتاج الصوت بالجملة لتشغيله لاحقًا. وهي تحلّ محل التسجيلات اليدوية المكلفة وتعمل على مدار الساعة، فلا تستضيف محرّك تحويل نص إلى كلام ولا توسّعه بنفسك أبدًا.
أضِف تحويل النص إلى كلام إلى تطبيق جوال أو سيارة متصلة أو جهاز طبي أو صناعي أو جهاز يُرتدى أو كشك خدمة. بثّ الصوت عند الطلب دون تضمين محرّك تحويل نص إلى كلام على الجهاز، فتبقى البصمة واستهلاك البطارية منخفضين. احصل على كلام طبيعي بـ 90 لغة باستدعاء REST واحد.
أنتج ملفات صوتية بالجملة لمقررات التعلّم الإلكتروني والتقييمات والمحتوى التدريبي والكتب الصوتية والأدلة الصوتية والحوارات في الأفلام أو الرسوم المتحركة. ويمكن إعادة تقديم الصوت المبثوث إلى المستخدمين النهائيين من بنيتك التحتية عندما يسمح عقدك بذلك. وتضمن قواميس النطق المخصّصة قراءة أسماء العلامات التجارية والمصطلحات التقنية قراءة صحيحة في كل مقطع.
زوّد أنظمة الهاتف ومراكز الاتصال والوكلاء الصوتيين المدعومين بنماذج لغوية كبيرة بأصوات طبيعية. وصيغتا الإخراج A-law وμ-law هما ترميزا G.711 المستخدمان في أنظمة الاتصالات الهاتفية. استخدم SSML للتحكم في الإيقاع، وتبديل اللغة داخل النص، ونطق أسماء العلامات التجارية عبر قاموسك المخصّص. وتتوسع القنوات الآنية المتزامنة وفق عقدك.
الميزات
كل ما يحتاجه منتجك ليردّ بصوته.
اختر من كتالوج أصوات احترافي وغني لكل لغة. وتُرخَّص الأصوات فرديًا؛ ويمكنك إضافة المزيد في أي وقت.
استخدم SSML للوقفات والنسخ الصوتي وتبديل الصوت أو اللغة داخل نص واحد. ويُدعم ترميز SSML القياسي.
يمكن لكل عميل تحرير قاموس خاص بكل صوت في بوابة العملاء، للتحكم في طريقة نطق أسماء العلامات التجارية والمصطلحات التقنية والكلمات غير المألوفة. ويمكن للغويي ReadSpeaker تصحيح الأخطاء في النطق عند الطلب.
يعيد RSDS الصوت وعلامات التوقيت في استجابة واحدة، فيوفّر الأرصدة مقارنة باستدعاءين منفصلين. وهو مفيد لتظليل الكلمات والجمل في واجهتك. ومتاح بصيغة MP3 بمعدل 48 كيلوبت/ثانية فقط، وليس على كل الأصوات.
MP3 (16 و24 و32 و48 و64 و128 كيلوبت/ثانية)، وOgg VBR، وμ-law، وA-law، وPCM خام، وWAV. وتتوفر PCM وWAV عند 22050 أو 16000 أو 8000 هرتز بعمق 16 بت. تُحدَّد لكل طلب عبر معاملات واجهة برمجة التطبيقات.
اضبط streaming=1 لبدء التشغيل فور جهوزية الصوت، وهو مثالي للاستخدام المباشر. أو خذ الملف الجاهز في تنزيل واحد.
يُرفق مفتاح واجهة برمجة التطبيقات مع كل استدعاء. استعلم عن اللغات والأصوات المتاحة والاستخدام الحالي والأرصدة المتبقية عبر واجهة REST نفسها.
حرّر قاموس النطق الخاص بك، وتابع الاستخدام والأرصدة المتبقية، وأصدر مفتاح واجهة برمجة تطبيقات جديدًا فور الاشتباه بسوء استخدام، كل ذلك من بوابة واحدة.
مستضاف لدى ReadSpeaker في بيئة عالية الأمان مع تكرار وتحويل عند الأعطال. لا شيء يُنزَّل أو يُثبَّت.
جرّبه في منظومتك
نظرة على شكل الاستدعاء بأربع لغات. تتم المصادقة بمفتاح واجهة برمجة التطبيقات الخاص بك، ويُرسل مع كل طلب.
# Synthesise a sentence to MP3 (48 kbps)
curl -X POST "https://tts.readspeaker.com/a/eg/v2.0" \
-d "key=YOUR_API_KEY" \
-d "voice=Adam" \
-d "lang=en_uk" \
-d "audioformat=mp3" \
-d "audiobitrate=48" \
-d "text=Welcome to ReadSpeaker." \
--output speech.mp3
# With SSML, switching language inline
curl -X POST "https://tts.readspeaker.com/a/eg/v2.0" \
-d "key=YOUR_API_KEY" \
-d "voice=Adam" \
-d "lang=en_uk" \
-d "input=ssml" \
--data-urlencode 'text=<speak>Hello, <voice name="Roxane" xml:lang="fr-FR">bonjour</voice>.</speak>' \
--output greeting.mp3# Python 3, requests library
import requests
resp = requests.post(
"https://tts.readspeaker.com/a/eg/v2.0",
data={
"key": "YOUR_API_KEY",
"voice": "Adam",
"lang": "en_uk",
"audioformat": "mp3",
"audiobitrate": 48,
"text": "Welcome to ReadSpeaker.",
},
)
if resp.status_code == 200:
with open("speech.mp3", "wb") as f:
f.write(resp.content)
else:
print("Error:", resp.status_code, resp.text)// Node.js 18+, native fetch + fs/promises
import { writeFile } from "node:fs/promises";
const body = new URLSearchParams({
key: "YOUR_API_KEY",
voice: "Adam",
lang: "en_uk",
audioformat: "mp3",
audiobitrate: "48",
text: "Welcome to ReadSpeaker.",
});
const resp = await fetch("https://tts.readspeaker.com/a/eg/v2.0", {
method: "POST",
body,
});
if (!resp.ok) throw new Error(`SCAPI ${resp.status}`);
await writeFile("speech.mp3", Buffer.from(await resp.arrayBuffer()));<?php
// PHP 8, cURL
$ch = curl_init("https://tts.readspeaker.com/a/eg/v2.0");
curl_setopt_array($ch, [
CURLOPT_POST => true,
CURLOPT_POSTFIELDS => http_build_query([
"key" => "YOUR_API_KEY",
"voice" => "Adam",
"lang" => "en_uk",
"audioformat" => "mp3",
"audiobitrate" => 48,
"text" => "Welcome to ReadSpeaker.",
]),
CURLOPT_RETURNTRANSFER => true,
]);
$audio = curl_exec($ch);
$code = curl_getinfo($ch, CURLINFO_HTTP_CODE);
curl_close($ch);
if ($code === 200) {
file_put_contents("speech.mp3", $audio);
} else {
error_log("SCAPI error: $code");
}شكل نقطة النهاية توضيحي. راجع أحدث مواصفات المنتج and the Customer Portal documentation for the current endpoint URL and parameter names.
المواصفات التقنية
المصادقة والنقل وتغطية اللغات وحدود الإنتاجية وصيغ الصوت. الإجابات التي يحتاجها فريقا الأمن والتشغيل لديك قبل التكامل.
| Specification | Value |
|---|---|
| المصادقة | مفتاح واجهة برمجة التطبيقات، يُرفق مع كل طلب |
| النقل | REST عبر HTTPS |
| اللغات المدعومة | 90 لغة |
| الأصوات المتاحة | 300 صوت |
| الحد الأقصى للنص في كل طلب | 5,000 حرف (باستثناء المسافات)، القيمة الافتراضية |
| حد الاستخدام المتوقع | ≤ 25,000 طلب/يوم · ذروات ≤ 2,000 طلب خلال ساعة واحدة |
| صيغ إخراج الصوت | MP3 · Ogg VBR · μ-law · A-law · PCM · WAV |
| معدلات بت MP3 | 16 و24 و32 و48 و64 و128 كيلوبت/ثانية |
| معدلات أخذ العينات لـ PCM / WAV | 22050 و16000 و8000 هرتز بدقة 16 بت |
| ترميز الإدخال | يوصى بترميز UTF-8؛ ومعظم الترميزات الشائعة مدعومة |
| دعم SSML | نعم، الوقفات والنسخ الصوتي وتبديل الصوت واللغة داخل النص |
| بيانات التوقيت (RSDS) | الصوت والتوقيت في استجابة واحدة · حاليًا MP3 بمعدل 48 كيلوبت/ثانية فقط · لا تدعمه كل الأصوات |
| وضع البثّ | streaming=1 (default) → redirect to streaming server; streaming=0 → file delivered after full generation |
| قواعد تخزين الصوت | لا تخزين ولا إعادة استخدام ولا إعادة توزيع ما لم يُتفق على ذلك صراحة في تأكيد الطلب |
| التكامل مع الاتصالات الهاتفية | صيغتا الإخراج A-law وμ-law (بترميزات G.711) |
| الوثائق | مواصفات المنتج (PDF) |
التسعير
يستخدم speechCloud API نموذج الأرصدة. وتُطلب أرصدة الإنتاج عبر مدير حسابك في ReadSpeaker ويضيفها فريق دعم ReadSpeaker إلى حسابك. وتحصل الحسابات الجديدة عادة على قدر محدود من الأرصدة التجريبية للاختبار الأولي.
ابدأ مجانًا: تحصل الحسابات الجديدة عادة على أرصدة تجريبية. اطلب الوصول عبر نموذج التواصل.
Credits
نموذج الأرصدةرصيد واحد = حرف واحد، باستثناء المسافات
كيف تعمل الأرصدة
تُقاس السعة المرخّصة بـ
الامتثال
ReadSpeaker مؤسسة حاصلة على شهادة ISO/IEC 27001:2022، ومتوافقة مع اللائحة العامة لحماية البيانات، وتعتمد البنود التعاقدية النموذجية لعمليات نقل البيانات عبر الحدود.
ISO/IEC 27001:2022 (ISO/IEC 27001:2022: إدارة أمن المعلومات)
مؤسسة ReadSpeaker
اللائحة العامة لحماية البيانات (اللائحة العامة لحماية البيانات)
إشعار الخصوصية منشور
EU SCCs (البنود التعاقدية النموذجية للاتحاد الأوروبي)
لعمليات النقل عبر الحدود
مقرّها في الاتحاد الأوروبي (مؤسسة مقرّها في الاتحاد الأوروبي)
المقر الرئيسي في السويد (ReadSpeaker AB، أوبسالا)
وفق إشعار الخصوصية الخاص بـ ReadSpeaker، فإن الأصوات المركّبة لدى ReadSpeaker هي نماذج صوتية مدمجة لا تُعدّ معلومات شخصية بموجب اللائحة العامة لحماية البيانات.
الأسئلة الشائعة
speechCloud API (SCAPI) واجهة برمجة تطبيقات REST لتحويل النص إلى كلام مستضافة سحابيًا من ReadSpeaker. ترسل النص إلى خوادم ReadSpeaker عبر HTTPS وتستقبل صوتًا عالي الجودة بالصيغة التي تختارها (MP3 أو Ogg أو PCM أو WAV أو A-law أو μ-law). وهي تدعم 90 لغة و300 صوت وترميز SSML وقواميس نطق مخصّصة وبيانات توقيت للتظليل المتزامن. وهي قائمة على الخوادم دون أي برنامج يُثبَّت؛ ويتم التكامل عبر مفتاح واجهة برمجة التطبيقات وطلبات HTTP.
webReader وdocReader منتجان موجّهان للمستخدم النهائي ولكل منهما واجهته الخاصة. webReader puts a Listen button on the HTML pages of your website; docReader does the same for the documents you publish. speechCloud API has no user interface. You call it server-to-server from your application to generate audio. Use it for connected devices, telephony and IVR, mobile apps, e-learning platforms that produce audio, audiobooks, or any product where you need text-to-speech inside your own software.
يعيد speechCloud API الصوت بست صيغ: MP3 (بمعدل بت قابل للضبط: 16 أو 24 أو 32 أو 48 أو 64 أو 128 كيلوبت/ثانية)، وOgg VBR، وμ-law، وA-law، وPCM خام، وWAV. وتدعم PCM وWAV معدلات أخذ عينات 22050 أو 16000 أو 8000 هرتز بعمق 16 بت. ويُحدَّد اختيار الصيغة ومعاملات الصوت لكل طلب عبر معاملات واجهة برمجة التطبيقات.
يستوعب كل طلب حتى 5,000 حرف افتراضيًا، مع احتساب كل شيء عدا المسافات. والخدمة القياسية مُهيّأة لما يصل إلى 25,000 طلب يوميًا، بذروات ساعية تصل إلى 2,000. هل تتوقع حركة أعلى أو مستمرة؟ تحدّث مع ReadSpeaker بشأن تهيئة مخصّصة مبنية على حجم استخدامك.
نعم. إدخال SSML مدعوم، بما في ذلك الوقفات والنسخ الصوتي وتبديل الصوت أو اللغة داخل نص واحد. وتتوفر أيضًا قواميس نطق مخصّصة: إذ يمكن لكل عميل تحرير قاموس خاص بكل صوت في بوابة العملاء للتحكم في طريقة نطق أسماء العلامات التجارية أو المصطلحات التقنية أو الكلمات غير المألوفة.
نعم. يستطيع speechCloud API إعادة تنسيق RSDS الذي يجمع الصوت ومعلومات التوقيت في استجابة واحدة، فيوفّر الأرصدة مقارنة بطلبين منفصلين. وRSDS متاح حاليًا مع MP3 بمعدل 48 كيلوبت/ثانية وليس متاحًا لكل لغة أو صوت؛ تواصل مع ReadSpeaker للحصول على القائمة الحالية.
يعمل speechCloud API بالأرصدة: رصيد واحد يغطي حرفًا واحدًا، مع احتساب كل شيء عدا المسافات، إضافة إلى أي حروف يضيفها قاموس النطق لديك. وتطلب أرصدة الإنتاج عبر مدير حسابك في ReadSpeaker، وتبدأ الحسابات الجديدة عادة بأرصدة تجريبية. ويتوفر نموذج احتساب بالثانية من الكلام عند الطلب. ويمكن ترخيص السعة بالحروف أو الطلبات أو زمن الكلام أو القنوات المتزامنة أو سرعة التوليد. تواصل مع ReadSpeaker للحصول على عرض سعر يناسب حجم استخدامك.
ReadSpeaker كمؤسسة حاصلة على شهادة ISO/IEC 27001:2022، ومتوافقة مع اللائحة العامة لحماية البيانات. وتستخدم كل حركة واجهة برمجة التطبيقات بروتوكول HTTPS. وبالنسبة إلى عملاء الاتحاد الأوروبي وعمليات نقل البيانات عبر الحدود، تعتمد ReadSpeaker على البنود التعاقدية النموذجية (SCCs). ووفق إشعار الخصوصية الخاص بـ ReadSpeaker، فإن الأصوات المركّبة لدى ReadSpeaker هي نماذج صوتية مدمجة لا تُعدّ معلومات شخصية بموجب اللائحة العامة لحماية البيانات. ويجب عدم تخزين البيانات الصوتية أو إعادة استخدامها أو إعادة توزيعها ما لم يُتفق على ذلك صراحة في تأكيد الطلب.
يدعم speechCloud API الحالات الآنية. فافتراضيًا، تستخدم الطلبات وضع البثّ (streaming=1)، حيث تُعاد توجيه الاستجابة إلى خادم بثّ يبدأ بتسليم الصوت في أسرع وقت ممكن، لأقصر زمن حتى أول صوت. وللتسليم بالجملة، اضبط streaming=0 ليُعاد الملف بعد توليده كاملًا. وعدد القنوات الآنية المتزامنة جزء من سعتك المرخّصة ويمكن توسيعه في تأكيد الطلب.
أنشئ حسابًا لدى ReadSpeaker. تحصل الحسابات الجديدة عادة على قدر محدود من الأرصدة التجريبية لتتمكن من تقييم speechCloud API. ويتوفر مفتاح واجهة برمجة التطبيقات الخاص بك في بوابة عملاء SCAPI، ويجب إرفاقه مع كل طلب. كما تتوفر في البوابة إرشادات التنفيذ والاستخدام، وأمثلة كود بلغات البرمجة الشائعة، وقاموس النطق القابل للتحرير الخاص بك. تواصل مع ReadSpeaker to start your account.
VoiceLab
يأتي speechCloud API مع كتالوج أصواتنا الاحترافي.

وللحصول على صوت مخصّص بالكامل لعلامتك التجارية نبنيه معك في الاستوديو، استكشف VoiceLab. فقد ظل اللغويون الحاسوبيون في ReadSpeaker يصوغون أصوات العلامات التجارية منذ عام 1999.