Adam
MiesEnglanti (Iso-Britannia)
ReadSpeaker speechCloud API
Lähetä teksti yhteen REST-päätepisteeseen ja saa takaisin luonnollista puhetta 90 kielellä ja 300 äänellä. SSML, mukautettu ääntämys ja kuusi äänimuotoa, tuotantovalmiina ensimmäisestä kutsusta alkaen.
Oletko jo asiakas? Kirjaudu asiakasportaaliin12 000 asiakkaan luottamus maailmanlaajuisesti
Kokeile ääntä
Neljä ääntä neljällä kielellä. Sama moottori, jonka integroit rajapinnan kautta.
Englanti (Iso-Britannia)
Français (France)
Deutsch (Deutschland)
日本語 (Japan)
Haluatko räätälöidyn äänen tai kielen, jota ei ole luettelossa? Selaa kaikkia 300 ääntä →
Asiakastarinat
Pilvipohjainen puheentuotanto
speechCloud API on pilvipohjainen, palvelimelta palvelimelle toimiva puhesynteesipalvelu. Kutsu sitä oman sovelluksesi sisältä tuottaaksesi ääntä lennossa loppukäyttäjille tai tuottaaksesi ääntä suurina erinä myöhempää toistoa varten. Se korvaa kalliit manuaaliset äänitykset ja toimii ympäri vuorokauden, joten sinun ei koskaan tarvitse ylläpitää tai skaalata puhesynteesimoottoria itse.
Lisää puhesynteesi mobiilisovellukseen, verkkoon kytkettyyn autoon, lääketieteelliseen tai teolliseen laitteeseen, puettavaan laitteeseen tai asiakaspäätteeseen. Suoratoista ääntä tarpeen mukaan ilman puhesynteesimoottorin pakkaamista laitteeseen, jolloin muistijalanjälki ja akunkulutus pysyvät pieninä. Saat luonnollista puhetta 90 kielellä yhdellä REST-kutsulla.
Tuota ääntä suurina erinä verkkokursseille, arviointeihin, koulutussisältöihin, äänikirjoihin, äänioppaisiin ja elokuvien tai animaatioiden dialogeihin. Suoratoistettua ääntä voidaan tarjota loppukäyttäjille omasta infrastruktuuristasi, kun sopimuksesi sen sallii. Mukautetut ääntämissanakirjat varmistavat, että brändinimet ja tekniset termit luetaan oikein jokaisella raidalla.
Anna puhelinjärjestelmille, yhteyskeskuksille ja kielimallipohjaisille puheagenteille luonnolliset äänet. A-law- ja μ-law-ulostulomuodot ovat puhelinjärjestelmissä käytetyt G.711-koodekit. SSML:n avulla voit hallita rytmiä, vaihtaa kieltä kesken tekstin ja ääntää brändinimet mukautetun sanakirjasi kautta. Samanaikaiset reaaliaikaiset kanavat skaalautuvat sopimuksesi mukaan.
Ominaisuudet
Kaikki, mitä tuotteesi tarvitsee vastatakseen puheella.
Valitse laajasta, ammattimaisesta äänivalikoimasta kullekin kielelle. Äänet lisensoidaan erikseen, ja voit ottaa lisää käyttöön milloin tahansa.
Käytä SSML:ää taukoihin, foneettisiin transkriptioihin ja äänen tai kielen vaihtamiseen yhden tekstin sisällä. Standardin mukaista SSML-merkintää tuetaan.
Jokainen asiakas voi muokata äänikohtaista sanakirjaa asiakasportaalissa ja hallita näin brändinimien, teknisten termien ja harvinaisten sanojen ääntämystä. ReadSpeakerin kielitieteilijät voivat korjata virheellisiä ääntämyksiä pyynnöstä.
RSDS palauttaa äänen ja ajoitusmerkit yhdessä vastauksessa, mikä säästää krediittejä kahteen erilliseen kutsuun verrattuna. Hyödyllinen sanojen ja lauseiden korostuksessa käyttöliittymässäsi. Saatavilla vain MP3-muodossa 48 kbit/s, ei kaikilla äänillä.
MP3 (16, 24, 32, 48, 64, 128 kbit/s), Ogg VBR, μ-law, A-law, raaka PCM, WAV. PCM ja WAV taajuuksilla 22050, 16000 tai 8000 Hz, 16 bitin syvyydellä. Asetetaan pyyntökohtaisesti API-parametreilla.
Aseta streaming=1 aloittaaksesi toiston heti kun ääni on valmis, ihanteellinen suoraan käyttöön. Tai ota valmis tiedosto yhtenä latauksena.
API-avain sisältyy jokaiseen kutsuun. Kysele käytettävissä olevia kieliä, ääniä, nykyistä käyttöä ja jäljellä olevia krediittejä saman REST-rajapinnan kautta.
Muokkaa ääntämissanakirjaasi, seuraa käyttöä ja jäljellä olevia krediittejä ja vaihda uusi API-avain heti, kun epäilet väärinkäyttöä, kaikki yhdestä portaalista.
ReadSpeakerin ylläpitämä korkean tietoturvan ympäristö, jossa on kahdennus ja vikasietoisuus. Mitään ei tarvitse ladata tai asentaa.
Kokeile omassa ympäristössäsi
Katsaus siihen, miltä kutsu näyttää neljällä ohjelmointikielellä. Tunnistaudu API-avaimellasi, joka lähetetään jokaisen pyynnön mukana.
# Synthesise a sentence to MP3 (48 kbps)
curl -X POST "https://tts.readspeaker.com/a/eg/v2.0" \
-d "key=YOUR_API_KEY" \
-d "voice=Adam" \
-d "lang=en_uk" \
-d "audioformat=mp3" \
-d "audiobitrate=48" \
-d "text=Welcome to ReadSpeaker." \
--output speech.mp3
# With SSML, switching language inline
curl -X POST "https://tts.readspeaker.com/a/eg/v2.0" \
-d "key=YOUR_API_KEY" \
-d "voice=Adam" \
-d "lang=en_uk" \
-d "input=ssml" \
--data-urlencode 'text=<speak>Hello, <voice name="Roxane" xml:lang="fr-FR">bonjour</voice>.</speak>' \
--output greeting.mp3# Python 3, requests library
import requests
resp = requests.post(
"https://tts.readspeaker.com/a/eg/v2.0",
data={
"key": "YOUR_API_KEY",
"voice": "Adam",
"lang": "en_uk",
"audioformat": "mp3",
"audiobitrate": 48,
"text": "Welcome to ReadSpeaker.",
},
)
if resp.status_code == 200:
with open("speech.mp3", "wb") as f:
f.write(resp.content)
else:
print("Error:", resp.status_code, resp.text)// Node.js 18+, native fetch + fs/promises
import { writeFile } from "node:fs/promises";
const body = new URLSearchParams({
key: "YOUR_API_KEY",
voice: "Adam",
lang: "en_uk",
audioformat: "mp3",
audiobitrate: "48",
text: "Welcome to ReadSpeaker.",
});
const resp = await fetch("https://tts.readspeaker.com/a/eg/v2.0", {
method: "POST",
body,
});
if (!resp.ok) throw new Error(`SCAPI ${resp.status}`);
await writeFile("speech.mp3", Buffer.from(await resp.arrayBuffer()));<?php
// PHP 8, cURL
$ch = curl_init("https://tts.readspeaker.com/a/eg/v2.0");
curl_setopt_array($ch, [
CURLOPT_POST => true,
CURLOPT_POSTFIELDS => http_build_query([
"key" => "YOUR_API_KEY",
"voice" => "Adam",
"lang" => "en_uk",
"audioformat" => "mp3",
"audiobitrate" => 48,
"text" => "Welcome to ReadSpeaker.",
]),
CURLOPT_RETURNTRANSFER => true,
]);
$audio = curl_exec($ch);
$code = curl_getinfo($ch, CURLINFO_HTTP_CODE);
curl_close($ch);
if ($code === 200) {
file_put_contents("speech.mp3", $audio);
} else {
error_log("SCAPI error: $code");
}Päätepisteen muoto on havainnollistava. Katso uusin Tuotespesifikaatio and the Customer Portal documentation for the current endpoint URL and parameter names.
Tekniset tiedot
Tunnistautuminen, tiedonsiirto, kielten kattavuus, läpimenorajat ja äänimuodot. Vastaukset, joita tietoturva- ja ylläpitotiimisi tarvitsevat ennen integraatiota.
| Specification | Value |
|---|---|
| Tunnistautuminen | API-avain, mukana jokaisessa pyynnössä |
| Tiedonsiirto | REST HTTPS:n yli |
| Tuetut kielet | 90 kieltä |
| Saatavilla olevat äänet | 300 ääntä |
| Tekstin enimmäismäärä pyyntöä kohden | 5 000 merkkiä (ilman välilyöntejä), oletus |
| Suunniteltu käyttöraja | ≤ 25 000 pyyntöä/vrk · piikit ≤ 2 000 pyyntöä yhden tunnin sisällä |
| Äänen ulostulomuodot | MP3 · Ogg VBR · μ-law · A-law · PCM · WAV |
| MP3-bittinopeudet | 16, 24, 32, 48, 64, 128 kbit/s |
| PCM- ja WAV-näytteenottotaajuudet | 22050, 16000, 8000 Hz @ 16 bittiä |
| Syötteen merkistökoodaus | UTF-8 suositeltu, useimpia yleisiä merkistökoodauksia tuetaan |
| SSML-tuki | Kyllä: tauot, foneettiset transkriptiot, äänen ja kielen vaihto kesken tekstin |
| Ajoitustiedot (RSDS) | Ääni ja ajoitustiedot samassa vastauksessa · tällä hetkellä vain MP3 48 kbit/s · ei kaikilla äänillä |
| Suoratoistotila | streaming=1 (default) → redirect to streaming server; streaming=0 → file delivered after full generation |
| Äänen tallennussäännöt | Ei tallennusta, uudelleenkäyttöä tai edelleenjakelua, ellei siitä ole nimenomaisesti sovittu tilausvahvistuksessa |
| Puhelinjärjestelmäintegraatio | A-law- ja μ-law-ulostulomuodot (G.711-koodekit) |
| Dokumentaatio | Tuotespesifikaatio (PDF) |
Hinnoittelu
speechCloud API käyttää krediittimallia. Tuotantokrediitit tilataan ReadSpeaker-asiakasvastaavaltasi, ja ReadSpeakerin tukitiimi lisää ne tilillesi. Uudet tilit saavat tyypillisesti rajallisen määrän kokeilukrediittejä alkutestausta varten.
Aloita ilmaiseksi: uudet tilit saavat tyypillisesti kokeilukrediittejä. Pyydä pääsyä yhteydenottolomakkeella.
Credits
Krediittimalli1 krediitti = 1 merkki, ilman välilyöntejä
Miten krediitit toimivat
Lisensoitua kapasiteettia mitataan seuraavasti
Vaatimustenmukaisuus
ReadSpeaker on ISO/IEC 27001:2022 -sertifioitu organisaatio, joka on GDPR-yhteensopiva ja käyttää vakiosopimuslausekkeita rajat ylittäviin tiedonsiirtoihin.
ISO/IEC 27001:2022 (ISO/IEC 27001:2022, tietoturvan hallinta)
ReadSpeaker-organisaatio
GDPR (Yleinen tietosuoja-asetus)
Tietosuojailmoitus julkaistu
EU:n vakiosopimuslausekkeet (EU:n vakiosopimuslausekkeet)
Rajat ylittäviin siirtoihin
EU-pohjainen (Euroopan unionissa toimiva organisaatio)
Pääkonttori Ruotsissa (ReadSpeaker AB, Uppsala)
ReadSpeakerin tietosuojailmoituksen mukaan ReadSpeakerin syntetisoidut äänet ovat sekoitettuja äänimalleja, jotka eivät ole GDPR:n tarkoittamia henkilötietoja.
Usein kysytyt kysymykset
speechCloud API (SCAPI) on ReadSpeakerin pilvessä ylläpitämä puhesynteesin REST-rajapinta. Lähetät tekstin ReadSpeakerin palvelimille HTTPS:n yli ja saat takaisin korkealaatuista ääntä valitsemassasi muodossa (MP3, Ogg, PCM, WAV, A-law tai μ-law). Se tukee 90 kieltä ja 300 ääntä, SSML-merkintöjä, mukautettuja ääntämissanakirjoja ja ajoitustietoja synkronoitua korostusta varten. Se on palvelinpohjainen, eikä ohjelmistoa tarvitse asentaa. Integraatio tehdään API-avaimella ja HTTP-pyynnöillä.
webReader ja docReader ovat loppukäyttäjätuotteita, joilla on oma käyttöliittymä. webReader puts a Listen button on the HTML pages of your website; docReader does the same for the documents you publish. speechCloud API has no user interface. You call it server-to-server from your application to generate audio. Use it for connected devices, telephony and IVR, mobile apps, e-learning platforms that produce audio, audiobooks, or any product where you need text-to-speech inside your own software.
speechCloud API palauttaa äänen kuudessa muodossa: MP3 (säädettävä bittinopeus 16, 24, 32, 48, 64 tai 128 kbit/s), Ogg VBR, μ-law, A-law, raaka PCM ja WAV. PCM ja WAV tukevat näytteenottotaajuuksia 22050, 16000 tai 8000 Hz 16 bitin syvyydellä. Muoto ja ääniparametrit valitaan pyyntökohtaisesti API-parametreilla.
Jokainen pyyntö ottaa oletuksena enintään 5 000 merkkiä, ja laskentaan lasketaan kaikki paitsi välilyönnit. Vakiopalvelu on mitoitettu enintään 25 000 pyynnölle päivässä, tuntipiikkien ollessa enintään 2 000. Onko liikennettä enemmän tai jatkuvasti? Keskustele ReadSpeakerin kanssa volyymillesi rakennetusta omasta kokoonpanosta.
Kyllä. SSML-syötettä tuetaan, mukaan lukien tauot, foneettiset transkriptiot ja äänen tai kielen vaihto yhden tekstin sisällä. Myös mukautetut ääntämissanakirjat ovat käytettävissä: jokainen asiakas voi muokata äänikohtaista sanakirjaa asiakasportaalissa ja hallita näin brändinimien, teknisten termien tai harvinaisten sanojen ääntämystä.
Kyllä. speechCloud API voi palauttaa RSDS:n, joka yhdistää äänen ja ajoitustiedot yhteen vastaukseen ja säästää näin krediittejä kahteen erilliseen pyyntöön verrattuna. RSDS on tällä hetkellä saatavilla MP3-muodossa 48 kbit/s, eikä se ole käytettävissä jokaisella kielellä tai äänellä. Ota yhteyttä ReadSpeakeriin saadaksesi ajantasaisen luettelon.
speechCloud API toimii krediiteillä: yksi krediitti kattaa yhden merkin, ja laskentaan lasketaan kaikki paitsi välilyönnit sekä ääntämissanakirjasi lisäämät merkit. Tilaat tuotantokrediitit ReadSpeaker-asiakasvastaavaltasi, ja uudet tilit aloittavat yleensä kokeilukrediiteillä. Puhesekuntiin perustuva malli on saatavilla pyynnöstä. Kapasiteetti voidaan lisensoida merkkien, pyyntöjen, puheajan, samanaikaisten kanavien tai tuotantonopeuden mukaan. Ota yhteyttä ReadSpeakeriin saadaksesi volyymiisi sovitetun tarjouksen.
ReadSpeaker on organisaationa ISO/IEC 27001:2022 -sertifioitu ja GDPR-yhteensopiva. Kaikki rajapintaliikenne käyttää HTTPS:ää. EU-asiakkaiden ja rajat ylittävien tiedonsiirtojen osalta ReadSpeaker nojaa vakiosopimuslausekkeisiin. ReadSpeakerin tietosuojailmoituksen mukaan ReadSpeakerin syntetisoidut äänet ovat sekoitettuja äänimalleja, jotka eivät ole GDPR:n tarkoittamia henkilötietoja. Äänidataa ei saa tallentaa, käyttää uudelleen tai jakaa edelleen, ellei siitä ole nimenomaisesti sovittu tilausvahvistuksessa.
speechCloud API tukee reaaliaikaisia käyttötapauksia. Oletuksena pyynnöt käyttävät suoratoistotilaa (streaming=1), jolloin vastaus ohjautuu suoratoistopalvelimelle, joka alkaa toimittaa ääntä mahdollisimman pian ja lyhentää näin viivettä ensimmäiseen ääneen. Eräajotoimitusta varten aseta streaming=0, jolloin tiedosto palautetaan vasta kun se on kokonaan tuotettu. Samanaikaisten reaaliaikaisten kanavien määrä on osa lisensoitua kapasiteettiasi, ja sitä voidaan skaalata tilausvahvistuksessa.
Luo ReadSpeaker-tili. Uudet tilit saavat tyypillisesti rajallisen määrän kokeilukrediittejä, jotta voit arvioida speechCloud APIa. API-avaimesi on saatavilla SCAPI-asiakasportaalissa, ja se on sisällytettävä jokaiseen pyyntöön. Portaalista löytyvät myös toteutus- ja käyttöohjeet, koodiesimerkit suosituilla ohjelmointikielillä sekä muokattava ääntämissanakirjasi. Ota yhteyttä ReadSpeakeriin to start your account.
VoiceLab
speechCloud API toimitetaan ammattimaisen äänivalikoimamme kanssa.

Jos haluat täysin räätälöidyn brändiäänen, joka rakennetaan kanssasi studiossa, tutustu VoiceLabiin. ReadSpeakerin laskennallisen kielitieteen asiantuntijat ovat muotoilleet brändiääniä vuodesta 1999.