Adam
VīriešuAngļu (Apvienotā Karaliste)
ReadSpeaker speechCloud API
Nosūtiet tekstu uz vienu REST galapunktu un saņemiet atpakaļ dabisku runu 90 valodās un 300 balsīs. SSML, pielāgota izruna un seši audio formāti, gatavi ražošanai jau no pirmā izsaukuma.
Jau esat klients? Pierakstieties klientu portālāMums uzticas 12 000 klientu visā pasaulē
Izmēģiniet balsi
Četras balsis četrās valodās. Tas pats dzinējs, ko integrēsiet, izmantojot API.
Angļu (Apvienotā Karaliste)
Français (France)
Deutsch (Deutschland)
日本語 (Japan)
Vēlaties pielāgotu balsi vai valodu, kas nav sarakstā? Pārlūkot visas 300 balsis →
Klientu stāsti
Mākonī balstīta runas ģenerēšana
speechCloud API ir mākonī balstīts, servera un servera teksta pārveides runā pakalpojums. Izsauciet to savā lietojumprogrammā, lai ģenerētu audio gala lietotājiem reāllaikā vai lai ražotu audio lielos apjomos vēlākai atskaņošanai. Tas aizstāj dārgus manuālus ierakstus un darbojas visu diennakti, tāpēc jums pašam nekad nav jāmitina vai jāmērogo teksta pārveides runā dzinējs.
Pievienojiet teksta pārveidi runā mobilajai lietotnei, savienotai automašīnai, medicīnas vai rūpniecības iekārtai, valkājamai ierīcei vai kioskam. Straumējiet audio pēc pieprasījuma, neiekļaujot TTS dzinēju pašā ierīcē, tāpēc izmērs un akumulatora patēriņš paliek zems. Saņemiet dabisku runu 90 valodās ar vienu REST izsaukumu.
Ģenerējiet audio lielos apjomos e-mācību kursiem, pārbaudījumiem, apmācību saturam, audiogrāmatām, audiogidiem un dialogiem filmām vai animācijām. Straumēto audio var nodot gala lietotājiem no jūsu pašu infrastruktūras, ja to atļauj jūsu līgums. Pielāgotas izrunas vārdnīcas nodrošina, ka zīmolu nosaukumi un tehniskie termini tiek nolasīti pareizi katrā ierakstā.
Nodrošiniet telefonu sistēmas, kontaktu centrus un uz lielajiem valodu modeļiem balstītus balss aģentus ar dabiskām balsīm. A-law un μ-law izvades formāti ir G.711 kodeki, ko izmanto telefonijas sistēmās. Izmantojiet SSML, lai kontrolētu tempu, mainītu valodu teksta vidū un izrunātu zīmolu nosaukumus, izmantojot savu pielāgoto vārdnīcu. Vienlaicīgo reāllaika kanālu skaits mainās atbilstoši jūsu līgumam.
Funkcijas
Viss, kas nepieciešams, lai jūsu produkts atbildētu ar balsi.
Izvēlieties no plaša profesionāla balsu kataloga katrā valodā. Balsis tiek licencētas atsevišķi; papildu balsis varat pievienot jebkurā brīdī.
Izmantojiet SSML pauzēm, fonētiskajām transkripcijām un balss vai valodas maiņai viena teksta ietvaros. Tiek atbalstīts standarta SSML marķējums.
Katrs klients var rediģēt konkrētai balsij paredzētu vārdnīcu klientu portālā, lai kontrolētu, kā tiek izrunāti zīmolu nosaukumi, tehniskie termini un neparasti vārdi. ReadSpeaker valodnieki pēc pieprasījuma var izlabot nepareizas izrunas.
RSDS atgriež audio un laika marķierus vienā atbildē, tādējādi ietaupot kredītus salīdzinājumā ar diviem atsevišķiem izsaukumiem. Noderīgi vārdu un teikumu izcelšanai jūsu saskarnē. Pieejams tikai MP3 48 kbps formātā un ne visām balsīm.
MP3 (16, 24, 32, 48, 64, 128 kbit/s), Ogg VBR, μ-law, A-law, neapstrādāts PCM, WAV. PCM un WAV ar 22050, 16000 vai 8000 Hz, 16 bitu dziļumu. Iestatāms katram pieprasījumam, izmantojot API parametrus.
Iestatiet streaming=1, lai atskaņošana sāktos, tiklīdz audio ir gatavs, kas ir ideāli piemērots tiešraidei. Vai arī saņemiet gatavo failu kā vienu lejupielādi.
API atslēga ir iekļauta katrā izsaukumā. Pieprasiet pieejamās valodas, balsis, pašreizējo lietojumu un atlikušos kredītus, izmantojot to pašu REST saskarni.
Rediģējiet savu izrunas vārdnīcu, sekojiet lietojumam un atlikušajiem kredītiem un nomainiet API atslēgu, tiklīdz rodas aizdomas par ļaunprātīgu izmantošanu, viss no viena portāla.
Mitina ReadSpeaker augstas drošības vidē ar dublēšanu un rezerves pārslēgšanu. Nekas nav jālejupielādē vai jāinstalē.
Izmēģiniet to savā vidē
Ieskats tajā, kā izsaukums izskatās četrās valodās. Autentificējieties ar savu API atslēgu, kas tiek nosūtīta ar katru pieprasījumu.
# Synthesise a sentence to MP3 (48 kbps)
curl -X POST "https://tts.readspeaker.com/a/eg/v2.0" \
-d "key=YOUR_API_KEY" \
-d "voice=Adam" \
-d "lang=en_uk" \
-d "audioformat=mp3" \
-d "audiobitrate=48" \
-d "text=Welcome to ReadSpeaker." \
--output speech.mp3
# With SSML, switching language inline
curl -X POST "https://tts.readspeaker.com/a/eg/v2.0" \
-d "key=YOUR_API_KEY" \
-d "voice=Adam" \
-d "lang=en_uk" \
-d "input=ssml" \
--data-urlencode 'text=<speak>Hello, <voice name="Roxane" xml:lang="fr-FR">bonjour</voice>.</speak>' \
--output greeting.mp3# Python 3, requests library
import requests
resp = requests.post(
"https://tts.readspeaker.com/a/eg/v2.0",
data={
"key": "YOUR_API_KEY",
"voice": "Adam",
"lang": "en_uk",
"audioformat": "mp3",
"audiobitrate": 48,
"text": "Welcome to ReadSpeaker.",
},
)
if resp.status_code == 200:
with open("speech.mp3", "wb") as f:
f.write(resp.content)
else:
print("Error:", resp.status_code, resp.text)// Node.js 18+, native fetch + fs/promises
import { writeFile } from "node:fs/promises";
const body = new URLSearchParams({
key: "YOUR_API_KEY",
voice: "Adam",
lang: "en_uk",
audioformat: "mp3",
audiobitrate: "48",
text: "Welcome to ReadSpeaker.",
});
const resp = await fetch("https://tts.readspeaker.com/a/eg/v2.0", {
method: "POST",
body,
});
if (!resp.ok) throw new Error(`SCAPI ${resp.status}`);
await writeFile("speech.mp3", Buffer.from(await resp.arrayBuffer()));<?php
// PHP 8, cURL
$ch = curl_init("https://tts.readspeaker.com/a/eg/v2.0");
curl_setopt_array($ch, [
CURLOPT_POST => true,
CURLOPT_POSTFIELDS => http_build_query([
"key" => "YOUR_API_KEY",
"voice" => "Adam",
"lang" => "en_uk",
"audioformat" => "mp3",
"audiobitrate" => 48,
"text" => "Welcome to ReadSpeaker.",
]),
CURLOPT_RETURNTRANSFER => true,
]);
$audio = curl_exec($ch);
$code = curl_getinfo($ch, CURLINFO_HTTP_CODE);
curl_close($ch);
if ($code === 200) {
file_put_contents("speech.mp3", $audio);
} else {
error_log("SCAPI error: $code");
}Galapunkta struktūra ir tikai ilustratīva. Skatiet jaunāko Produkta specifikācija and the Customer Portal documentation for the current endpoint URL and parameter names.
Tehniskās specifikācijas
Autentifikācija, transports, valodu pārklājums, caurlaidspējas ierobežojumi un audio formāti. Atbildes, kas jūsu drošības un darbības komandām nepieciešamas pirms integrācijas.
| Specification | Value |
|---|---|
| Autentifikācija | API atslēga, iekļauta katrā pieprasījumā |
| Transports | REST pa HTTPS |
| Atbalstītās valodas | 90 valodas |
| Pieejamās balsis | 300 balsis |
| Maksimālais teksta apjoms vienā pieprasījumā | 5000 rakstzīmes (neieskaitot atstarpes), noklusējums |
| Paredzētais lietojuma ierobežojums | ≤ 25 000 pieprasījumu dienā · maksimums ≤ 2000 pieprasījumu vienas stundas laikā |
| Audio izvades formāti | MP3 · Ogg VBR · μ-law · A-law · PCM · WAV |
| MP3 bitu pārraides ātrumi | 16, 24, 32, 48, 64, 128 kbit/s |
| PCM / WAV iztveršanas frekvences | 22050, 16000, 8000 Hz @ 16 biti |
| Ievades kodējums | Ieteicams UTF-8; tiek atbalstīti lielākā daļa izplatīto kodējumu |
| SSML atbalsts | Jā: pauzes, fonētiskās transkripcijas, balss vai valodas maiņa teksta vidū |
| Laika dati (RSDS) | Audio un laika dati vienā atbildē · pašlaik tikai MP3 48 kbit/s · ne visām balsīm |
| Straumēšanas režīms | streaming=1 (default) → redirect to streaming server; streaming=0 → file delivered after full generation |
| Audio glabāšanas noteikumi | Nav glabāšanas, atkārtotas izmantošanas vai izplatīšanas, ja vien tas nav skaidri norunāts pasūtījuma apstiprinājumā |
| Telefonijas integrācija | A-law un μ-law izvades formāti (G.711 kodeki) |
| Dokumentācija | Produkta specifikācija (PDF) |
Cenas
speechCloud API izmanto kredītu modeli. Ražošanas kredītus pasūta ar jūsu ReadSpeaker klientu vadītāja starpniecību, un ReadSpeaker atbalsta komanda tos pievieno jūsu kontam. Jauni konti parasti saņem ierobežotu izmēģinājuma kredītu apjomu sākotnējai testēšanai.
Sāciet bez maksas: jauni konti parasti saņem izmēģinājuma kredītus. Pieprasiet piekļuvi, izmantojot saziņas veidlapu.
Credits
Kredītu modelis1 kredīts = 1 rakstzīme, neieskaitot atstarpes
Kā darbojas kredīti
Licencētā jauda tiek mērīta pēc
Atbilstība
ReadSpeaker ir organizācija ar ISO/IEC 27001:2022 sertifikātu, kas atbilst VDAR un izmanto standarta līgumklauzulas pārrobežu datu pārsūtīšanai.
ISO/IEC 27001:2022 (ISO/IEC 27001:2022, informācijas drošības pārvaldība)
ReadSpeaker organizācija
VDAR (Vispārīgā datu aizsardzības regula)
Publicēts privātuma paziņojums
ES standarta līgumklauzulas (ES standarta līgumklauzulas)
Pārrobežu datu pārsūtīšanai
Bāzēts ES (Eiropas Savienībā bāzēta organizācija)
Galvenais birojs Zviedrijā (ReadSpeaker AB, Upsāla)
Saskaņā ar ReadSpeaker privātuma paziņojumu ReadSpeaker sintezētās balsis ir sajauktie balss modeļi, kas nav uzskatāmi par personas datiem VDAR izpratnē.
Biežāk uzdotie jautājumi
speechCloud API (SCAPI) ir ReadSpeaker mākonī mitināts teksta pārveides runā REST API. Jūs nosūtāt tekstu uz ReadSpeaker serveriem pa HTTPS un saņemat atpakaļ augstas kvalitātes audio jūsu izvēlētajā formātā (MP3, Ogg, PCM, WAV, A-law vai μ-law). Tas atbalsta 90 valodas un 300 balsis, SSML marķējumu, pielāgotas izrunas vārdnīcas un laika datus sinhronizētam izcēlumam. Tas ir serverī balstīts, un nekas nav jāinstalē; integrācija notiek ar API atslēgu un HTTP pieprasījumiem.
webReader un docReader ir gala lietotāja produkti ar savu lietotāja saskarni. webReader puts a Listen button on the HTML pages of your website; docReader does the same for the documents you publish. speechCloud API has no user interface. You call it server-to-server from your application to generate audio. Use it for connected devices, telephony and IVR, mobile apps, e-learning platforms that produce audio, audiobooks, or any product where you need text-to-speech inside your own software.
speechCloud API atgriež audio sešos formātos: MP3 (konfigurējams bitu pārraides ātrums 16, 24, 32, 48, 64 vai 128 kbit/s), Ogg VBR, μ-law, A-law, neapstrādāts PCM un WAV. PCM un WAV atbalsta iztveršanas frekvences 22050, 16000 vai 8000 Hz ar 16 bitu dziļumu. Formāta un audio parametru izvēle tiek iestatīta katram pieprasījumam ar API parametriem.
Katrs pieprasījums pēc noklusējuma pieņem līdz 5000 rakstzīmju, skaitot visu, izņemot atstarpes. Standarta pakalpojums ir mērogots līdz 25 000 pieprasījumu dienā, ar stundas maksimumu līdz 2000. Nepieciešams lielāks vai nepārtraukts apjoms? Sazinieties ar ReadSpeaker par īpašu konfigurāciju, kas veidota jūsu apjomam.
Jā. SSML ievade tiek atbalstīta, tostarp pauzes, fonētiskās transkripcijas un balss vai valodas maiņa viena teksta ietvaros. Pieejamas arī pielāgotas izrunas vārdnīcas: katrs klients var rediģēt konkrētai balsij paredzētu vārdnīcu klientu portālā, lai kontrolētu, kā tiek izrunāti zīmolu nosaukumi, tehniskie termini vai neparasti vārdi.
Jā. speechCloud API var atgriezt RSDS, kas apvieno audio un laika informāciju vienā atbildē, tādējādi ietaupot kredītus salīdzinājumā ar diviem atsevišķiem pieprasījumiem. RSDS pašlaik ir pieejams ar MP3 48 kbit/s un nav pieejams katrai valodai vai balsij; sazinieties ar ReadSpeaker, lai saņemtu aktuālo sarakstu.
speechCloud API darbojas ar kredītiem: viens kredīts sedz vienu rakstzīmi, skaitot visu, izņemot atstarpes, kā arī visas rakstzīmes, ko pievieno jūsu izrunas vārdnīca. Ražošanas kredītus pasūtāt ar sava ReadSpeaker klientu vadītāja starpniecību, un jauni konti parasti sākas ar izmēģinājuma kredītiem. Pēc pieprasījuma ir pieejams arī modelis ar maksu par runas sekundi. Jaudu var licencēt pēc rakstzīmēm, pieprasījumiem, runas laika, vienlaicīgiem kanāliem vai ģenerēšanas ātruma. Sazinieties ar ReadSpeaker, lai saņemtu jūsu apjomam atbilstošu piedāvājumu.
ReadSpeaker kā organizācija ir sertificēta pēc ISO/IEC 27001:2022 un atbilst VDAR. Viss API datplūsmas apjoms izmanto HTTPS. ES klientiem un pārrobežu datu pārsūtīšanai ReadSpeaker balstās uz standarta līgumklauzulām (SCC). Saskaņā ar ReadSpeaker privātuma paziņojumu ReadSpeaker sintezētās balsis ir sajauktie balss modeļi, kas nav uzskatāmi par personas datiem VDAR izpratnē. Audio datus nedrīkst glabāt, izmantot atkārtoti vai izplatīt, ja vien tas nav skaidri norunāts pasūtījuma apstiprinājumā.
speechCloud API atbalsta reāllaika lietojuma gadījumus. Pēc noklusējuma pieprasījumi izmanto straumēšanas režīmu (streaming=1), kurā atbilde tiek novirzīta uz straumēšanas serveri, kas sāk piegādāt audio pēc iespējas ātrāk, nodrošinot īsāko laiku līdz skaņai. Pakešu piegādei iestatiet streaming=0, un fails tiek atgriezts, kad tas ir pilnībā ģenerēts. Vienlaicīgo reāllaika kanālu skaits ir daļa no jūsu licencētās jaudas, un to var mainīt pasūtījuma apstiprinājumā.
Izveidojiet kontu ReadSpeaker. Jauni konti parasti saņem ierobežotu izmēģinājuma kredītu apjomu, lai varētu novērtēt speechCloud API. Jūsu API atslēga ir pieejama SCAPI klientu portālā, un tā jāiekļauj katrā pieprasījumā. Portālā ir pieejamas arī ieviešanas un lietotāja instrukcijas, koda paraugi populārās programmēšanas valodās un jūsu rediģējamā izrunas vārdnīca. Sazinieties ar ReadSpeaker to start your account.
VoiceLab
speechCloud API tiek piegādāts ar mūsu profesionālo balsu katalogu.

Ja vēlaties pilnībā pielāgotu zīmola balsi, kas radīta kopā ar jums studijā, iepazīstiet VoiceLab. ReadSpeaker datorlingvisti veido zīmolu balsis kopš 1999. gada.