Naar de inhoud

ReadSpeaker speechCloud API

Tekst-naar-spraak-API voor elke app, elk apparaat of elke workflow

Stuur tekst naar één REST-endpoint en krijg natuurlijke spraak terug in 90 talen en 300 stemmen. SSML, eigen uitspraken en zes audioformaten, klaar voor productie vanaf de eerste call.

Al klant? Meld u aan bij het Customer Portal
  • 90 talen
  • 300 stemmen
  • Gevestigd in de EU, AVG, ISO 27001

Vertrouwd door 12.000 klanten wereldwijd

Plaatshouder partnerlogo 1
Plaatshouder partnerlogo 2
Plaatshouder partnerlogo 3
Plaatshouder partnerlogo 4
Plaatshouder partnerlogo 5
Plaatshouder partnerlogo 6
Plaatshouder partnerlogo 7
Plaatshouder partnerlogo 8

Probeer een stem

Beluister wat uw API zal teruggeven

Vier stemmen in vier talen. Dezelfde engine die u via de API integreert.

Adam

Man

Engels (Verenigd Koninkrijk)

Roxane

Vrouw

Français (France)

Lena

Vrouw

Deutsch (Deutschland)

Sayaka

Vrouw

日本語 (Japan)

Wilt u een maatwerkstem of een taal die niet in de lijst staat? Bekijk alle 300 stemmen →

Klantverhalen

Merken die spraakproducten bouwen met ReadSpeaker

Sonos

De aanpak van ReadSpeaker voor maatwerkstemmen is innovatief en bijzonder grondig, precies wat wij voor dit project nodig hadden.

Joseph DureauVice President, Voice Experience · Sonos
Lees het volledige verhaal

Cloudgebaseerde spraakgeneratie

Realtime of in batch, overal waar uw product een stem nodig heeft

speechCloud API is een cloudgebaseerde tekst-naar-spraakdienst van server naar server. Roep die aan binnen uw eigen toepassing om ter plekke audio te genereren voor eindgebruikers, of om audio in bulk te produceren voor latere weergave. Het vervangt dure handmatige opnames en draait de klok rond, zodat u nooit zelf een tekst-naar-spraakengine hoeft te hosten of op te schalen.

Realtime apps en apparaten

Voeg tekst-naar-spraak toe aan een mobiele app, een connected car, een medisch of industrieel apparaat, een wearable of een kiosk. Stream audio op aanvraag zonder een TTS-engine op het apparaat zelf mee te leveren, zodat footprint en batterijverbruik laag blijven. Ontvang natuurlijke spraak in 90 talen met één REST-call.

  • Mobiel
  • IoT
  • Kiosken
  • Wearables
  • Connected cars
  • Medische apparaten

Batchproductie van audio

Genereer audio in bulk voor e-learningcursussen, toetsen, opleidingsmateriaal, audioboeken, audiogidsen en dialogen voor films of animaties. Gestreamde audio kan vanuit uw eigen infrastructuur aan eindgebruikers worden geleverd wanneer uw contract dat toestaat. Eigen uitspraakwoordenboeken zorgen ervoor dat merknamen en vaktermen in elk fragment correct worden voorgelezen.

  • e-learning
  • Audioboeken
  • Toetsen
  • Opleiding
  • Audiogidsen
  • Film en animatie

Telefonie, IVR en spraakagenten

Geef telefoonsystemen, contactcenters en spraakagenten op basis van LLM's natuurlijke stemmen. De uitvoerformaten A-law en μ-law zijn de G.711-codecs die in telefoniesystemen worden gebruikt. Gebruik SSML om het tempo te sturen, inline van taal te wisselen en merknamen uit te spreken via uw eigen woordenboek. Het aantal gelijktijdige realtime kanalen schaalt mee met uw contract.

  • IVR
  • G.711
  • Spraakagenten
  • SSML
  • A-law / μ-law

Functies

Tekst-naar-spraak in productie, van begin tot eind

Alles wat uw product nodig heeft om terug te praten.

90 talen, 300 stemmen

Kies uit een uitgebreide, professionele stemmencatalogus per taal. Stemmen worden afzonderlijk gelicentieerd; u kunt er op elk moment meer bij nemen.

SSML-invoer

Gebruik SSML voor pauzes, fonetische transcripties en het inline wisselen van stem of taal binnen één tekst. Standaard SSML-markup wordt ondersteund.

Eigen uitspraakwoordenboeken

Elke klant kan in het klantenportaal een stemspecifiek woordenboek bewerken om te bepalen hoe merknamen, vaktermen en ongebruikelijke woorden worden uitgesproken. Taalkundigen van ReadSpeaker kunnen op verzoek verkeerde uitspraken corrigeren.

Timinggegevens (RSDS)

RSDS geeft audio en timingmarkeringen terug in één respons, wat credits bespaart ten opzichte van twee afzonderlijke calls. Handig voor markering van woorden en zinnen in uw interface. Alleen beschikbaar in MP3 48 kbps, niet op alle stemmen.

Zes audio-uitvoerformaten

MP3 (16, 24, 32, 48, 64, 128 kbit/s), Ogg VBR, μ-law, A-law, raw PCM, WAV. PCM en WAV op 22050, 16000 of 8000 Hz, 16 bits diep. Per verzoek in te stellen via API-parameters.

Streamen of downloaden

Zet streaming=1 om het afspelen te starten zodra de audio klaar is, ideaal voor live gebruik. Of neem het afgewerkte bestand als één download.

REST-API via HTTPS

Bij elke call wordt een API-sleutel meegestuurd. Via dezelfde REST-interface vraagt u de beschikbare talen, stemmen, het huidige verbruik en de resterende credits op.

SCAPI-klantenportaal

Bewerk uw uitspraakwoordenboek, volg het verbruik en de resterende credits, en vervang een API-sleutel zodra u misbruik vermoedt, allemaal vanuit één portaal.

Gehoste en redundante infrastructuur

Gehost door ReadSpeaker in een zwaarbeveiligde omgeving met redundantie en failover. Niets te downloaden of te installeren.

Probeer het in uw stack

Van tekst naar audio in één verzoek

Een blik op hoe een call eruitziet in vier talen. Authenticeer met uw API-sleutel, die bij elk verzoek wordt meegestuurd.

# Synthesise a sentence to MP3 (48 kbps)
curl -X POST "https://tts.readspeaker.com/a/eg/v2.0" \
  -d "key=YOUR_API_KEY" \
  -d "voice=Adam" \
  -d "lang=en_uk" \
  -d "audioformat=mp3" \
  -d "audiobitrate=48" \
  -d "text=Welcome to ReadSpeaker." \
  --output speech.mp3

# With SSML, switching language inline
curl -X POST "https://tts.readspeaker.com/a/eg/v2.0" \
  -d "key=YOUR_API_KEY" \
  -d "voice=Adam" \
  -d "lang=en_uk" \
  -d "input=ssml" \
  --data-urlencode 'text=<speak>Hello, <voice name="Roxane" xml:lang="fr-FR">bonjour</voice>.</speak>' \
  --output greeting.mp3

De vorm van het endpoint is illustratief. Raadpleeg de meest recente Productspecificatie and the Customer Portal documentation for the current endpoint URL and parameter names.

Technische specificaties

Elke specificatie waar uw securityreview naar zal vragen

Authenticatie, transport, taaldekking, doorvoerlimieten en audioformaten. De antwoorden die uw security- en opsteams nodig hebben vóór de integratie.

Technische specificaties van speechCloud API
SpecificationValue
AuthenticatieAPI-sleutel, meegestuurd bij elk verzoek
TransportREST via HTTPS
Ondersteunde talen90 talen
Beschikbare stemmen300 stemmen
Maximale tekst per verzoek5.000 tekens (spaties niet meegerekend), standaard
Beoogde gebruikslimiet≤ 25.000 verzoeken per dag · pieken ≤ 2.000 verzoeken binnen één uur
Audio-uitvoerformatenMP3 · Ogg VBR · μ-law · A-law · PCM · WAV
MP3-bitrates16, 24, 32, 48, 64, 128 kbit/s
PCM-/WAV-samplefrequenties22050, 16000, 8000 Hz bij 16 bits
InvoercoderingUTF-8 aanbevolen; de meeste gangbare coderingen worden ondersteund
SSML-ondersteuningJa, pauzes, fonetische transcripties, inline wisselen van stem/taal
Timinggegevens (RSDS)Audio en timing in één respons · momenteel alleen MP3 48 kbit/s · niet alle stemmen
Streamingmodusstreaming=1 (default) → redirect to streaming server; streaming=0 → file delivered after full generation
Regels voor het opslaan van audioGeen opslag, hergebruik of herdistributie tenzij uitdrukkelijk overeengekomen in de orderbevestiging
Telefonie-integratieA-law- en μ-law-uitvoerformaten (G.711-codecs)
DocumentatieProductspecificatie (PDF)

Prijzen

Betaal voor wat u genereert, schaal op wanneer u het nodig hebt

speechCloud API werkt met een creditmodel. Productiecredits worden besteld via uw ReadSpeaker Account Manager en door het supportteam van ReadSpeaker aan uw account toegevoegd. Nieuwe accounts krijgen doorgaans een beperkt aantal proefcredits voor de eerste tests.

Vraag een offerte aan

Begin gratis: nieuwe accounts krijgen doorgaans proefcredits. Vraag toegang aan via het contactformulier.

Credits

speechCloud API

Creditmodel1 credit = 1 teken, spaties niet meegerekend

Hoe credits werken

  • 1 credit = 1 teken, spaties niet meegerekend, inclusief eventuele wijzigingen door vermeldingen in het uitspraakwoordenboek
  • Variant per seconde spraak available via order confirmation for predictable cost on long audio
  • Proefcredits bij het openen van het account so you can evaluate before committing

De gelicentieerde capaciteit wordt gemeten in

  • Aantal tekens over the contract period
  • Aantal verzoeken and total speech time
  • Gelijktijdige realtime kanalen for telephony and live use cases
  • Generatiesnelheid when responsiveness is critical

Conformiteit

Conformiteit die u rechtstreeks aan uw auditor kunt overhandigen

ReadSpeaker is een organisatie met ISO/IEC 27001:2022-certificering, AVG-conform, met modelcontractbepalingen voor grensoverschrijdende doorgiften van gegevens.

  • ISO/IEC 27001:2022 (ISO/IEC 27001:2022: beheer van informatiebeveiliging)

    De organisatie ReadSpeaker

  • AVG (Algemene verordening gegevensbescherming)

    Privacyverklaring gepubliceerd

  • EU SCCs (EU-modelcontractbepalingen)

    Voor grensoverschrijdende doorgiften

  • Gevestigd in de EU (Organisatie gevestigd in de Europese Unie)

    Hoofdkantoor in Zweden (ReadSpeaker AB, Uppsala)

FAQ

Vragen over speechCloud API

  • speechCloud API (SCAPI) is een REST-API voor tekst-naar-spraak van ReadSpeaker die in de cloud wordt gehost. U stuurt tekst via HTTPS naar de servers van ReadSpeaker en krijgt audio van hoge kwaliteit terug in het formaat van uw keuze (MP3, Ogg, PCM, WAV, A-law of μ-law). Het ondersteunt 90 talen en 300 stemmen, SSML-markup, eigen uitspraakwoordenboeken en timinggegevens voor gesynchroniseerde markering. Het is servergebaseerd, zonder software om te installeren; de integratie verloopt via een API-sleutel en HTTP-verzoeken.

  • webReader en docReader zijn producten voor eindgebruikers met een eigen gebruikersinterface. webReader puts a Listen button on the HTML pages of your website; docReader does the same for the documents you publish. speechCloud API has no user interface. You call it server-to-server from your application to generate audio. Use it for connected devices, telephony and IVR, mobile apps, e-learning platforms that produce audio, audiobooks, or any product where you need text-to-speech inside your own software.

  • speechCloud API geeft audio terug in zes formaten: MP3 (instelbare bitrate van 16, 24, 32, 48, 64 of 128 kbit/s), Ogg VBR, μ-law, A-law, raw PCM en WAV. PCM en WAV ondersteunen samplefrequenties van 22050, 16000 of 8000 Hz bij 16 bits diepte. Het formaat en de audioparameters worden per verzoek via de API-parameters ingesteld.

  • Elk verzoek verwerkt standaard tot 5.000 tekens, waarbij alles behalve spaties meetelt. De standaarddienst is gedimensioneerd voor maximaal 25.000 verzoeken per dag, met pieken tot 2.000 per uur. Draait u meer of aanhoudend verkeer? Bespreek met ReadSpeaker een speciale configuratie voor uw volume.

  • Ja. SSML-invoer wordt ondersteund, inclusief pauzes, fonetische transcripties en het inline wisselen van stem of taal binnen één tekst. Er zijn ook eigen uitspraakwoordenboeken beschikbaar: elke klant kan in het klantenportaal een stemspecifiek woordenboek bewerken om te bepalen hoe merknamen, vaktermen of ongebruikelijke woorden worden uitgesproken.

  • Ja. speechCloud API kan RSDS teruggeven, dat de audio en de timinginformatie in één respons combineert, wat credits bespaart ten opzichte van twee afzonderlijke verzoeken. RSDS is momenteel beschikbaar met MP3 op 48 kbit/s en niet voor elke taal of stem; neem contact op met ReadSpeaker voor de actuele lijst.

  • speechCloud API werkt op credits: één credit dekt één teken, waarbij alles behalve spaties meetelt, plus de tekens die uw uitspraakwoordenboek toevoegt. U bestelt productiecredits via uw ReadSpeaker Account Manager, en nieuwe accounts beginnen doorgaans met proefcredits. Een model per seconde spraak is op verzoek beschikbaar. De capaciteit kan worden gelicentieerd op tekens, verzoeken, spreektijd, gelijktijdige kanalen of generatiesnelheid. Neem contact op met ReadSpeaker voor een offerte op maat van uw volume.

  • ReadSpeaker is als organisatie ISO/IEC 27001:2022-gecertificeerd en AVG-conform. Al het API-verkeer verloopt via HTTPS. Voor klanten in de EU en grensoverschrijdende doorgiften van gegevens steunt ReadSpeaker op de modelcontractbepalingen (SCC's). Volgens de privacyverklaring van ReadSpeaker zijn de gesynthetiseerde stemmen van ReadSpeaker gemengde stemmodellen die geen persoonsgegevens vormen in de zin van de AVG. Audiogegevens mogen niet worden opgeslagen, hergebruikt of opnieuw verspreid tenzij dit uitdrukkelijk is overeengekomen in de orderbevestiging.

  • speechCloud API ondersteunt realtime toepassingen. Standaard gebruiken verzoeken de streamingmodus (streaming=1), waarbij de respons doorverwijst naar een streamingserver die zo snel mogelijk begint met het leveren van audio, voor de kortste tijd tot de eerste klank. Voor levering in batch zet u streaming=0 en wordt het bestand teruggegeven zodra het volledig is gegenereerd. Het aantal gelijktijdige realtime kanalen maakt deel uit van uw gelicentieerde capaciteit en kan in de orderbevestiging worden opgeschaald.

  • Maak een account aan bij ReadSpeaker. Nieuwe accounts krijgen doorgaans een beperkt aantal proefcredits zodat u speechCloud API kunt evalueren. Uw API-sleutel is beschikbaar in het SCAPI-klantenportaal en moet bij elk verzoek worden meegestuurd. Ook de implementatie- en gebruikersinstructies, voorbeeldcode in populaire programmeertalen en uw bewerkbare uitspraakwoordenboek zijn via het portaal toegankelijk. Neem contact op met ReadSpeaker to start your account.

VoiceLab

Hebt u een eigen merkstem nodig?

speechCloud API wordt geleverd met onze professionele stemmencatalogus.

Een stemacteur die opneemt voor een studiomicrofoon

Een merkstem die samen met u in de studio wordt opgebouwd

Voor een volledig op maat gemaakte merkstem die samen met u in de studio wordt opgebouwd, ontdek VoiceLab. De computerlinguïsten van ReadSpeaker maken al sinds 1999 merkstemmen.

Klaar om een stem in uw product te brengen?

Bij het aanmaken van een account worden doorgaans proefcredits verstrekt zodat u kunt evalueren voordat u zich vastlegt. Ons team helpt u het volume, de talen en het aantal gelijktijdige realtime kanalen voor productie af te bakenen. ISO/IEC 27001:2022-gecertificeerd, afgestemd op de AVG met de EU-modelcontractbepalingen.

Find your ReadSpeaker solution

Opening the conversation…

Search

    Searching…

    No results for

    Try another wording, or start from one of these.

    Search is not available right now.

    You can still reach the pages below.