Adam
ManEngelska (Storbritannien)
ReadSpeaker speechCloud API
Skicka text till en enda REST-endpoint och få tillbaka naturligt tal på 90 språk och 300 röster. SSML, anpassat uttal och sex ljudformat, redo för produktion från första anropet.
Redan kund? Logga in i kundportalenAnlitat av 12 000 kunder världen över
Prova en röst
Fyra röster på fyra språk. Samma motor som du integrerar via API:et.
Engelska (Storbritannien)
Français (France)
Deutsch (Deutschland)
日本語 (Japan)
Vill ni ha en skräddarsydd röst eller ett språk som inte finns med i listan? Bläddra bland alla 300 röster →
Kundberättelser
Molnbaserad talgenerering
speechCloud API är en molnbaserad text-till-tal-tjänst från server till server. Anropa den inifrån er egen applikation för att generera ljud direkt till slutanvändare, eller för att producera ljud i stor skala för senare uppspelning. Den ersätter kostsamma manuella inspelningar och körs dygnet runt, så att ni aldrig själva behöver drifta eller skala en text-till-tal-motor.
Lägg till text-till-tal i en mobilapp, en uppkopplad bil, en medicinsk eller industriell apparat, en bärbar enhet eller en kiosk. Strömma ljud vid behov utan att paketera en TTS-motor på enheten, så att fotavtryck och batteriförbrukning förblir låga. Få naturligt tal på 90 språk med ett enda REST-anrop.
Generera ljud i stor skala för e-lärandekurser, prov, utbildningsinnehåll, ljudböcker, ljudguider och dialog för film eller animation. Strömmat ljud kan levereras vidare till slutanvändare från er egen infrastruktur när ert avtal tillåter det. Anpassade uttalslexikon ser till att varumärkesnamn och facktermer läses korrekt i varje spår.
Driv telefonisystem, kontaktcenter och LLM-drivna röstagenter med naturliga röster. Utdataformaten A-law och μ-law är de G.711-kodekar som används i telefonisystem. Använd SSML för att styra tempot, byta språk i flödet och uttala varumärkesnamn via ert anpassade lexikon. Antalet samtidiga realtidskanaler skalar med ert avtal.
Funktioner
Allt din produkt behöver för att svara med röst.
Välj ur en djup, professionell röstkatalog per språk. Röster licensieras individuellt; lägg till fler när som helst.
Använd SSML för pauser, fonetiska transkriptioner och byte av röst eller språk inom en och samma text. Standardmärkning i SSML stöds.
Varje kund kan redigera ett röstspecifikt lexikon i kundportalen för att styra hur varumärkesnamn, facktermer och ovanliga ord uttalas. ReadSpeakers lingvister kan rätta felaktiga uttal på begäran.
RSDS returnerar ljud och tidsmarkörer i ett och samma svar, vilket sparar krediter jämfört med två separata anrop. Användbart för markering av ord och meningar i ert gränssnitt. Finns endast i MP3 48 kbit/s, och inte för alla röster.
MP3 (16, 24, 32, 48, 64, 128 kbit/s), Ogg VBR, μ-law, A-law, rå PCM, WAV. PCM och WAV i 22050, 16000 eller 8000 Hz, 16 bitars djup. Ställs in per förfrågan via API-parametrar.
Sätt streaming=1 för att starta uppspelningen så snart ljudet är klart, perfekt för direktanvändning. Eller hämta den färdiga filen som en enda nedladdning.
API-nyckel ingår i varje anrop. Fråga efter tillgängliga språk, röster, aktuell användning och återstående krediter via samma REST-gränssnitt.
Redigera ditt uttalslexikon, följ användning och återstående krediter och byt ut API-nyckeln så snart missbruk misstänks, allt från en och samma portal.
Driftas av ReadSpeaker i en högsäkerhetsmiljö med redundans och failover. Inget att ladda ner eller installera.
Prova det i er miljö
En titt på hur ett anrop ser ut på fyra språk. Autentisera med din API-nyckel, som skickas med varje förfrågan.
# Synthesise a sentence to MP3 (48 kbps)
curl -X POST "https://tts.readspeaker.com/a/eg/v2.0" \
-d "key=YOUR_API_KEY" \
-d "voice=Adam" \
-d "lang=en_uk" \
-d "audioformat=mp3" \
-d "audiobitrate=48" \
-d "text=Welcome to ReadSpeaker." \
--output speech.mp3
# With SSML, switching language inline
curl -X POST "https://tts.readspeaker.com/a/eg/v2.0" \
-d "key=YOUR_API_KEY" \
-d "voice=Adam" \
-d "lang=en_uk" \
-d "input=ssml" \
--data-urlencode 'text=<speak>Hello, <voice name="Roxane" xml:lang="fr-FR">bonjour</voice>.</speak>' \
--output greeting.mp3# Python 3, requests library
import requests
resp = requests.post(
"https://tts.readspeaker.com/a/eg/v2.0",
data={
"key": "YOUR_API_KEY",
"voice": "Adam",
"lang": "en_uk",
"audioformat": "mp3",
"audiobitrate": 48,
"text": "Welcome to ReadSpeaker.",
},
)
if resp.status_code == 200:
with open("speech.mp3", "wb") as f:
f.write(resp.content)
else:
print("Error:", resp.status_code, resp.text)// Node.js 18+, native fetch + fs/promises
import { writeFile } from "node:fs/promises";
const body = new URLSearchParams({
key: "YOUR_API_KEY",
voice: "Adam",
lang: "en_uk",
audioformat: "mp3",
audiobitrate: "48",
text: "Welcome to ReadSpeaker.",
});
const resp = await fetch("https://tts.readspeaker.com/a/eg/v2.0", {
method: "POST",
body,
});
if (!resp.ok) throw new Error(`SCAPI ${resp.status}`);
await writeFile("speech.mp3", Buffer.from(await resp.arrayBuffer()));<?php
// PHP 8, cURL
$ch = curl_init("https://tts.readspeaker.com/a/eg/v2.0");
curl_setopt_array($ch, [
CURLOPT_POST => true,
CURLOPT_POSTFIELDS => http_build_query([
"key" => "YOUR_API_KEY",
"voice" => "Adam",
"lang" => "en_uk",
"audioformat" => "mp3",
"audiobitrate" => 48,
"text" => "Welcome to ReadSpeaker.",
]),
CURLOPT_RETURNTRANSFER => true,
]);
$audio = curl_exec($ch);
$code = curl_getinfo($ch, CURLINFO_HTTP_CODE);
curl_close($ch);
if ($code === 200) {
file_put_contents("speech.mp3", $audio);
} else {
error_log("SCAPI error: $code");
}Endpointens form är illustrativ. Se den senaste Produktspecifikation and the Customer Portal documentation for the current endpoint URL and parameter names.
Tekniska specifikationer
Autentisering, transport, språktäckning, genomströmningsgränser och ljudformat. Svaren som era säkerhets- och driftteam behöver före integrationen.
| Specification | Value |
|---|---|
| Autentisering | API-nyckel, som ingår i varje förfrågan |
| Transport | REST över HTTPS |
| Språk som stöds | 90 språk |
| Tillgängliga röster | 300 röster |
| Max text per förfrågan | 5 000 tecken (exklusive blanksteg), standard |
| Avsedd användningsgräns | ≤ 25 000 förfrågningar/dag · toppar ≤ 2 000 förfrågningar inom en enskild timme |
| Format för ljudutdata | MP3 · Ogg VBR · μ-law · A-law · PCM · WAV |
| MP3-bithastigheter | 16, 24, 32, 48, 64, 128 kbit/s |
| Samplingsfrekvenser för PCM/WAV | 22050, 16000, 8000 Hz @ 16 bitar |
| Teckenkodning för indata | UTF-8 rekommenderas; de flesta vanliga teckenkodningar stöds |
| Stöd för SSML | Ja, pauser, fonetiska transkriptioner och byte av röst eller språk i flödet |
| Tidsdata (RSDS) | Ljud + tidsdata i ett och samma svar · för närvarande endast MP3 48 kbit/s · inte alla röster |
| Strömningsläge | streaming=1 (default) → redirect to streaming server; streaming=0 → file delivered after full generation |
| Regler för lagring av ljud | Ingen lagring, återanvändning eller vidaredistribution om det inte uttryckligen avtalats i orderbekräftelsen |
| Telefoniintegration | Utdataformaten A-law och μ-law (G.711-kodekar) |
| Dokumentation | Produktspecifikation (PDF) |
Prissättning
speechCloud API använder en kreditmodell. Produktionskrediter beställs genom er ReadSpeaker Account Manager och läggs till på ert konto av ReadSpeakers supportteam. Nya konton får normalt en begränsad mängd testkrediter för inledande tester.
Börja kostnadsfritt: nya konton får normalt testkrediter. Begär åtkomst via kontaktformuläret.
Credits
Kreditmodell1 kredit = 1 tecken, exklusive blanksteg
Så fungerar krediterna
Licensierad kapacitet mäts i
Efterlevnad
ReadSpeaker är en organisation certifierad enligt ISO/IEC 27001:2022, GDPR-förenlig, med standardavtalsklausuler för dataöverföringar över landsgränser.
ISO/IEC 27001:2022 (ISO/IEC 27001:2022, ledningssystem för informationssäkerhet)
Organisationen ReadSpeaker
GDPR (Dataskyddsförordningen)
Integritetspolicy publicerad
EU:s standardavtalsklausuler (EU:s standardavtalsklausuler)
För överföringar över landsgränser
Baserad i EU (Organisation baserad i Europeiska unionen)
Huvudkontor i Sverige (ReadSpeaker AB, Uppsala)
Enligt ReadSpeakers integritetspolicy är ReadSpeakers syntetiserade röster blandade röstmodeller som inte utgör personuppgifter enligt GDPR.
Vanliga frågor
speechCloud API (SCAPI) är ett molndriftat REST-API för text-till-tal från ReadSpeaker. Du skickar text till ReadSpeakers servrar via HTTPS och får tillbaka ljud av hög kvalitet i det format du väljer (MP3, Ogg, PCM, WAV, A-law eller μ-law). Det stöder 90 språk och 300 röster, SSML-märkning, anpassade uttalslexikon och tidsdata för synkroniserad markering. Det är serverbaserat utan någon programvara att installera; integrationen sker via API-nyckel och HTTP-förfrågningar.
webReader och docReader är slutanvändarprodukter med ett eget användargränssnitt. webReader puts a Listen button on the HTML pages of your website; docReader does the same for the documents you publish. speechCloud API has no user interface. You call it server-to-server from your application to generate audio. Use it for connected devices, telephony and IVR, mobile apps, e-learning platforms that produce audio, audiobooks, or any product where you need text-to-speech inside your own software.
speechCloud API returnerar ljud i sex format: MP3 (konfigurerbar bithastighet 16, 24, 32, 48, 64 eller 128 kbit/s), Ogg VBR, μ-law, A-law, rå PCM och WAV. PCM och WAV stöder samplingsfrekvenserna 22050, 16000 eller 8000 Hz med 16 bitars djup. Val av format och ljudparametrar sätts per förfrågan via API-parametrarna.
Varje förfrågan tar som standard upp till 5 000 tecken, där allt utom blanksteg räknas. Standardtjänsten är dimensionerad för upp till 25 000 förfrågningar per dag, med timtoppar upp till 2 000. Har ni högre eller ihållande trafik? Prata med ReadSpeaker om en dedikerad konfiguration byggd för er volym.
Ja. Indata i SSML stöds, inklusive pauser, fonetiska transkriptioner och byte av röst eller språk inom en och samma text. Anpassade uttalslexikon finns också: varje kund kan redigera ett röstspecifikt lexikon i kundportalen för att styra hur varumärkesnamn, facktermer eller ovanliga ord uttalas.
Ja. speechCloud API kan returnera RSDS, som kombinerar ljudet och tidsinformationen i ett och samma svar och sparar krediter jämfört med två separata förfrågningar. RSDS finns för närvarande med MP3 i 48 kbit/s och är inte tillgängligt för alla språk eller röster; kontakta ReadSpeaker för den aktuella listan.
speechCloud API bygger på krediter: en kredit täcker ett tecken, där allt utom blanksteg räknas, plus eventuella tecken som ert uttalslexikon lägger till. Ni beställer produktionskrediter genom er ReadSpeaker Account Manager, och nya konton börjar vanligtvis med testkrediter. En modell per talad sekund finns på begäran. Kapaciteten kan licensieras efter tecken, förfrågningar, taltid, samtidiga kanaler eller genereringshastighet. Kontakta ReadSpeaker för en offert anpassad till er volym.
ReadSpeaker är som organisation certifierat enligt ISO/IEC 27001:2022 och GDPR-förenligt. All API-trafik använder HTTPS. För EU-kunder och dataöverföringar över landsgränser förlitar sig ReadSpeaker på standardavtalsklausuler (SCC). Enligt ReadSpeakers integritetspolicy är ReadSpeakers syntetiserade röster blandade röstmodeller som inte utgör personuppgifter enligt GDPR. Ljuddata får inte lagras, återanvändas eller vidaredistribueras om det inte uttryckligen avtalats i orderbekräftelsen.
speechCloud API stöder användningsfall i realtid. Som standard använder förfrågningar strömningsläge (streaming=1), där svaret omdirigeras till en strömningsserver som börjar leverera ljud så snart som möjligt, för kortast möjliga tid till ljud. För satsvis leverans, sätt streaming=0, så returneras filen när den är helt genererad. Antalet samtidiga realtidskanaler ingår i er licensierade kapacitet och kan skalas i orderbekräftelsen.
Skapa ett konto hos ReadSpeaker. Nya konton får vanligtvis en begränsad mängd testkrediter så att du kan utvärdera speechCloud API. Din API-nyckel finns i SCAPI-kundportalen och måste skickas med varje förfrågan. Instruktioner för implementering och användning, exempelkod i populära programmeringsspråk och ditt redigerbara uttalslexikon finns också i portalen. Kontakta ReadSpeaker to start your account.
VoiceLab
speechCloud API levereras med vår professionella röstkatalog.

För en helt skräddarsydd varumärkesröst som byggs tillsammans med dig i studio, utforska VoiceLab. ReadSpeakers datorlingvister har skapat varumärkesröster sedan 1999.