Adam
MandEngelsk (Storbritannien)
ReadSpeaker speechCloud API
Send tekst til ét REST-endpoint, og få naturlig tale tilbage på 90 sprog og med 300 stemmer. SSML, tilpasset udtale og seks lydformater, klar til produktion fra det første kald.
Er du allerede kunde? Log ind på kundeportalen12.000 kunder verden over har tillid til os
Prøv en stemme
Fire stemmer på fire sprog. Samme motor, som I integrerer via API'et.
Engelsk (Storbritannien)
Français (France)
Deutsch (Deutschland)
日本語 (Japan)
Ønsker I en skræddersyet stemme eller et sprog, der ikke står på listen? Gennemse alle 300 stemmer →
Kundehistorier
Skybaseret talegenerering
speechCloud API er en skybaseret tekst-til-tale-tjeneste fra server til server. Kald den inde i jeres egen applikation for at generere lyd i farten til slutbrugerne, eller for at producere lyd i store mængder til senere afspilning. Den erstatter dyre manuelle indspilninger og kører døgnet rundt, så I aldrig selv skal hoste eller skalere en tekst-til-tale-motor.
Tilføj tekst-til-tale til en mobilapp, en opkoblet bil, et medicinsk eller industrielt apparat, en wearable eller en kiosk. Stream lyd efter behov uden at pakke en TTS-motor ind på enheden, så fodaftryk og batteriforbrug forbliver lave. Modtag naturlig tale på 90 sprog med ét enkelt REST-kald.
Generér lyd i store mængder til e-læringskurser, prøver, træningsindhold, lydbøger, lydguider og dialog til film eller animationer. Streamet lyd kan leveres videre til slutbrugerne fra jeres egen infrastruktur, når jeres kontrakt tillader det. Tilpassede udtaleordbøger sikrer, at mærkenavne og fagtermer læses korrekt op i hvert eneste spor.
Driv telefonsystemer, kontaktcentre og LLM-drevne stemmeagenter med naturlige stemmer. A-law- og μ-law-outputformaterne er de G.711-codecs, der bruges i telefonisystemer. Brug SSML til at styre tempoet, skifte sprog undervejs og udtale mærkenavne via jeres egen ordbog. Antallet af samtidige realtidskanaler skalerer med jeres kontrakt.
Funktioner
Alt, hvad jeres produkt har brug for for at kunne svare med tale.
Vælg fra et dybt og professionelt stemmekatalog pr. sprog. Stemmer licenseres enkeltvis; I kan tilføje flere når som helst.
Brug SSML til pauser, fonetiske transskriptioner og skift af stemme eller sprog undervejs i den samme tekst. Standard SSML-markup understøttes.
Hver kunde kan redigere en stemmespecifik ordbog i kundeportalen for at styre, hvordan mærkenavne, fagtermer og usædvanlige ord udtales. ReadSpeakers lingvister kan rette fejludtale efter anmodning.
RSDS returnerer lyd og timingmarkører i ét enkelt svar og sparer kreditter sammenlignet med to separate kald. Nyttigt til fremhævning af ord og sætninger i jeres brugerflade. Findes kun i MP3 48 kbps og ikke på alle stemmer.
MP3 (16, 24, 32, 48, 64, 128 kbit/s), Ogg VBR, μ-law, A-law, rå PCM, WAV. PCM og WAV ved 22050, 16000 eller 8000 Hz, 16-bit dybde. Angives pr. anmodning via API-parametre.
Sæt streaming=1 for at starte afspilningen i samme øjeblik lyden er klar, ideelt til live brug. Eller hent den færdige fil som én download.
API-nøgle medsendes ved hvert kald. Forespørg på tilgængelige sprog, stemmer, aktuelt forbrug og resterende kreditter via den samme REST-grænseflade.
Redigér jeres udtaleordbog, følg forbrug og resterende kreditter, og udsted en ny API-nøgle i samme øjeblik I har mistanke om misbrug, alt sammen fra én portal.
Hostet af ReadSpeaker i et miljø med høj sikkerhed, redundans og failover. Intet at downloade eller installere.
Prøv det i jeres stack
Et kig på, hvordan et kald ser ud på fire sprog. Godkend med jeres API-nøgle, som sendes med hver anmodning.
# Synthesise a sentence to MP3 (48 kbps)
curl -X POST "https://tts.readspeaker.com/a/eg/v2.0" \
-d "key=YOUR_API_KEY" \
-d "voice=Adam" \
-d "lang=en_uk" \
-d "audioformat=mp3" \
-d "audiobitrate=48" \
-d "text=Welcome to ReadSpeaker." \
--output speech.mp3
# With SSML, switching language inline
curl -X POST "https://tts.readspeaker.com/a/eg/v2.0" \
-d "key=YOUR_API_KEY" \
-d "voice=Adam" \
-d "lang=en_uk" \
-d "input=ssml" \
--data-urlencode 'text=<speak>Hello, <voice name="Roxane" xml:lang="fr-FR">bonjour</voice>.</speak>' \
--output greeting.mp3# Python 3, requests library
import requests
resp = requests.post(
"https://tts.readspeaker.com/a/eg/v2.0",
data={
"key": "YOUR_API_KEY",
"voice": "Adam",
"lang": "en_uk",
"audioformat": "mp3",
"audiobitrate": 48,
"text": "Welcome to ReadSpeaker.",
},
)
if resp.status_code == 200:
with open("speech.mp3", "wb") as f:
f.write(resp.content)
else:
print("Error:", resp.status_code, resp.text)// Node.js 18+, native fetch + fs/promises
import { writeFile } from "node:fs/promises";
const body = new URLSearchParams({
key: "YOUR_API_KEY",
voice: "Adam",
lang: "en_uk",
audioformat: "mp3",
audiobitrate: "48",
text: "Welcome to ReadSpeaker.",
});
const resp = await fetch("https://tts.readspeaker.com/a/eg/v2.0", {
method: "POST",
body,
});
if (!resp.ok) throw new Error(`SCAPI ${resp.status}`);
await writeFile("speech.mp3", Buffer.from(await resp.arrayBuffer()));<?php
// PHP 8, cURL
$ch = curl_init("https://tts.readspeaker.com/a/eg/v2.0");
curl_setopt_array($ch, [
CURLOPT_POST => true,
CURLOPT_POSTFIELDS => http_build_query([
"key" => "YOUR_API_KEY",
"voice" => "Adam",
"lang" => "en_uk",
"audioformat" => "mp3",
"audiobitrate" => 48,
"text" => "Welcome to ReadSpeaker.",
]),
CURLOPT_RETURNTRANSFER => true,
]);
$audio = curl_exec($ch);
$code = curl_getinfo($ch, CURLINFO_HTTP_CODE);
curl_close($ch);
if ($code === 200) {
file_put_contents("speech.mp3", $audio);
} else {
error_log("SCAPI error: $code");
}Endpointets form er vejledende. Se den seneste Produktspecifikation and the Customer Portal documentation for the current endpoint URL and parameter names.
Tekniske specifikationer
Godkendelse, transport, sprogdækning, gennemstrømningsgrænser og lydformater. De svar, jeres sikkerheds- og driftsteam har brug for før integrationen.
| Specification | Value |
|---|---|
| Godkendelse | API-nøgle, medsendt ved hver anmodning |
| Transport | REST over HTTPS |
| Understøttede sprog | 90 sprog |
| Tilgængelige stemmer | 300 stemmer |
| Maks. tekst pr. anmodning | 5.000 tegn (eksklusive mellemrum), standard |
| Forventet forbrugsgrænse | ≤ 25.000 anmodninger/dag · spidser ≤ 2.000 anmodninger inden for én time |
| Lydoutputformater | MP3 · Ogg VBR · μ-law · A-law · PCM · WAV |
| MP3-bitrater | 16, 24, 32, 48, 64, 128 kbit/s |
| PCM- og WAV-samplingsfrekvenser | 22050, 16000, 8000 Hz @ 16-bit |
| Inputkodning | UTF-8 anbefales; de fleste almindelige kodninger understøttes |
| SSML-understøttelse | Ja, pauser, fonetiske transskriptioner og skift af stemme eller sprog undervejs |
| Timingdata (RSDS) | Lyd og timingdata i ét svar · i øjeblikket kun MP3 48 kbit/s · ikke alle stemmer |
| Streamingtilstand | streaming=1 (default) → redirect to streaming server; streaming=0 → file delivered after full generation |
| Regler for lagring af lyd | Ingen lagring, genbrug eller videredistribution, medmindre det udtrykkeligt er aftalt i ordrebekræftelsen |
| Telefoniintegration | A-law- og μ-law-outputformater (G.711-codecs) |
| Dokumentation | Produktspecifikation (PDF) |
Priser
speechCloud API bruger en kreditmodel. Produktionskreditter bestilles gennem jeres ReadSpeaker Account Manager og tilføjes jeres konto af ReadSpeakers supportteam. Nye konti får typisk et begrænset antal prøvekreditter til den indledende test.
Start gratis: nye konti får typisk prøvekreditter. Anmod om adgang via kontaktformularen.
Credits
Kreditmodel1 kredit = 1 tegn, eksklusive mellemrum
Sådan fungerer kreditter
Den licenserede kapacitet måles på
Overholdelse
ReadSpeaker er en ISO/IEC 27001:2022-certificeret organisation, GDPR-kompatibel og med standardkontraktbestemmelser til dataoverførsler på tværs af grænser.
ISO/IEC 27001:2022 (ISO/IEC 27001:2022, styring af informationssikkerhed)
ReadSpeaker som organisation
GDPR (Databeskyttelsesforordningen)
Privatlivspolitik offentliggjort
EU SCC'er (EU's standardkontraktbestemmelser)
Til overførsler på tværs af grænser
Baseret i EU (Organisation hjemmehørende i Den Europæiske Union)
Hovedkontor i Sverige (ReadSpeaker AB, Uppsala)
Ifølge ReadSpeakers privatlivspolitik er ReadSpeakers syntetiserede stemmer blandede stemmemodeller, der ikke udgør personoplysninger i henhold til GDPR.
FAQ
speechCloud API (SCAPI) er en skyhostet REST-API til tekst-til-tale fra ReadSpeaker. I sender tekst til ReadSpeakers servere via HTTPS og modtager lyd af høj kvalitet retur i det format, I vælger (MP3, Ogg, PCM, WAV, A-law eller μ-law). Den understøtter 90 sprog og 300 stemmer, SSML-markup, tilpassede udtaleordbøger og timingdata til synkroniseret fremhævning. Den er serverbaseret uden software at installere; integrationen sker via API-nøgle og HTTP-anmodninger.
webReader og docReader er slutbrugerprodukter med deres egen brugerflade. webReader puts a Listen button on the HTML pages of your website; docReader does the same for the documents you publish. speechCloud API has no user interface. You call it server-to-server from your application to generate audio. Use it for connected devices, telephony and IVR, mobile apps, e-learning platforms that produce audio, audiobooks, or any product where you need text-to-speech inside your own software.
speechCloud API returnerer lyd i seks formater: MP3 (bitrate kan konfigureres til 16, 24, 32, 48, 64 eller 128 kbit/s), Ogg VBR, μ-law, A-law, rå PCM og WAV. PCM og WAV understøtter samplingsfrekvenser på 22050, 16000 eller 8000 Hz ved 16-bit dybde. Valget af format og lydparametre angives pr. anmodning via API-parametrene.
Hver anmodning rummer som standard op til 5.000 tegn, hvor alt undtagen mellemrum tælles med. Standardtjenesten er dimensioneret til op til 25.000 anmodninger om dagen med timespidser på op til 2.000. Har I større eller vedvarende trafik? Tal med ReadSpeaker om en dedikeret konfiguration bygget til jeres volumen.
Ja. SSML-input understøttes, herunder pauser, fonetiske transskriptioner og skift af stemme eller sprog undervejs i den samme tekst. Der findes også tilpassede udtaleordbøger: hver kunde kan redigere en stemmespecifik ordbog i kundeportalen for at styre, hvordan mærkenavne, fagtermer eller usædvanlige ord udtales.
Ja. speechCloud API kan returnere RSDS, som kombinerer lyden og timingoplysningerne i ét enkelt svar og sparer kreditter sammenlignet med to separate anmodninger. RSDS findes i øjeblikket med MP3 ved 48 kbit/s og er ikke tilgængelig for alle sprog eller stemmer; kontakt ReadSpeaker for den aktuelle liste.
speechCloud API kører på kreditter: én kredit dækker ét tegn, hvor alt undtagen mellemrum tælles med, plus de tegn jeres udtaleordbog tilføjer. I bestiller produktionskreditter gennem jeres ReadSpeaker Account Manager, og nye konti starter som regel med prøvekreditter. En model pr. sekund tale er tilgængelig på forespørgsel. Kapaciteten kan licenseres efter tegn, anmodninger, taletid, samtidige kanaler eller genereringshastighed. Kontakt ReadSpeaker for et tilbud, der matcher jeres volumen.
ReadSpeaker er som organisation ISO/IEC 27001:2022-certificeret og GDPR-kompatibel. Al API-trafik bruger HTTPS. For EU-kunder og dataoverførsler på tværs af grænser bygger ReadSpeaker på standardkontraktbestemmelser (SCC'er). Ifølge ReadSpeakers privatlivspolitik er ReadSpeakers syntetiserede stemmer blandede stemmemodeller, der ikke udgør personoplysninger i henhold til GDPR. Lyddata må ikke lagres, genbruges eller videredistribueres, medmindre det udtrykkeligt er aftalt i ordrebekræftelsen.
speechCloud API understøtter anvendelser i realtid. Som standard bruger anmodninger streamingtilstand (streaming=1), hvor svaret omdirigerer til en streamingserver, der begynder at levere lyd hurtigst muligt, for den korteste tid til lyd. Til batchlevering sættes streaming=0, og filen returneres, når den er fuldt genereret. Antallet af samtidige realtidskanaler er en del af jeres licenserede kapacitet og kan skaleres i ordrebekræftelsen.
Opret en konto hos ReadSpeaker. Nye konti får typisk et begrænset antal prøvekreditter, så du kan evaluere speechCloud API. Din API-nøgle findes i SCAPI-kundeportalen og skal medsendes ved hver anmodning. Implementerings- og brugervejledninger, eksempelkode i populære programmeringssprog og din redigerbare udtaleordbog er også tilgængelige fra portalen. Kontakt ReadSpeaker to start your account.
VoiceLab
speechCloud API leveres med vores professionelle stemmekatalog.

For en helt skræddersyet brandstemme skabt sammen med jer i studiet, udforsk VoiceLab. ReadSpeakers computerlingvister har skabt brandstemmer siden 1999.