Siirry sisältöön

ReadSpeaker speechCloud API

Puhesynteesirajapinta mihin tahansa sovellukseen, laitteeseen tai työnkulkuun

Lähetä teksti yhteen REST-päätepisteeseen ja saa takaisin luonnollista puhetta 90 kielellä ja 300 äänellä. SSML, mukautettu ääntämys ja kuusi äänimuotoa, tuotantovalmiina ensimmäisestä kutsusta alkaen.

Oletko jo asiakas? Kirjaudu asiakasportaaliin
  • 90 kieltä
  • 300 ääntä
  • EU-pohjainen, GDPR, ISO 27001

12 000 asiakkaan luottamus maailmanlaajuisesti

Kumppanilogon paikanvaraaja 1
Kumppanilogon paikanvaraaja 2
Kumppanilogon paikanvaraaja 3
Kumppanilogon paikanvaraaja 4
Kumppanilogon paikanvaraaja 5
Kumppanilogon paikanvaraaja 6
Kumppanilogon paikanvaraaja 7
Kumppanilogon paikanvaraaja 8

Kokeile ääntä

Kuuntele, mitä rajapintasi palauttaa

Neljä ääntä neljällä kielellä. Sama moottori, jonka integroit rajapinnan kautta.

Adam

Mies

Englanti (Iso-Britannia)

Roxane

Nainen

Français (France)

Lena

Nainen

Deutsch (Deutschland)

Sayaka

Nainen

日本語 (Japan)

Haluatko räätälöidyn äänen tai kielen, jota ei ole luettelossa? Selaa kaikkia 300 ääntä →

Asiakastarinat

Brändit, jotka rakentavat ääntä hyödyntäviä tuotteita ReadSpeakerin kanssa

Sonos

ReadSpeakerin lähestymistapa räätälöityyn ääneen on innovatiivinen ja erittäin perusteellinen, juuri sitä mitä tähän projektiin tarvitsimme.

Joseph DureauVice President, Voice Experience · Sonos
Lue koko tarina

Pilvipohjainen puheentuotanto

Reaaliaikaisesti tai eräajona, kaikkialla missä tuotteesi tarvitsee äänen

speechCloud API on pilvipohjainen, palvelimelta palvelimelle toimiva puhesynteesipalvelu. Kutsu sitä oman sovelluksesi sisältä tuottaaksesi ääntä lennossa loppukäyttäjille tai tuottaaksesi ääntä suurina erinä myöhempää toistoa varten. Se korvaa kalliit manuaaliset äänitykset ja toimii ympäri vuorokauden, joten sinun ei koskaan tarvitse ylläpitää tai skaalata puhesynteesimoottoria itse.

Reaaliaikaiset sovellukset ja laitteet

Lisää puhesynteesi mobiilisovellukseen, verkkoon kytkettyyn autoon, lääketieteelliseen tai teolliseen laitteeseen, puettavaan laitteeseen tai asiakaspäätteeseen. Suoratoista ääntä tarpeen mukaan ilman puhesynteesimoottorin pakkaamista laitteeseen, jolloin muistijalanjälki ja akunkulutus pysyvät pieninä. Saat luonnollista puhetta 90 kielellä yhdellä REST-kutsulla.

  • Mobiili
  • IoT
  • Asiakaspäätteet
  • Puettavat laitteet
  • Verkkoon kytketyt autot
  • Lääkinnälliset laitteet

Äänen eräajotuotanto

Tuota ääntä suurina erinä verkkokursseille, arviointeihin, koulutussisältöihin, äänikirjoihin, äänioppaisiin ja elokuvien tai animaatioiden dialogeihin. Suoratoistettua ääntä voidaan tarjota loppukäyttäjille omasta infrastruktuuristasi, kun sopimuksesi sen sallii. Mukautetut ääntämissanakirjat varmistavat, että brändinimet ja tekniset termit luetaan oikein jokaisella raidalla.

  • e-learning
  • Äänikirjat
  • Arvioinnit
  • Koulutus
  • Äänioppaat
  • Elokuvat ja animaatiot

Puhelinliikenne, IVR ja puheagentit

Anna puhelinjärjestelmille, yhteyskeskuksille ja kielimallipohjaisille puheagenteille luonnolliset äänet. A-law- ja μ-law-ulostulomuodot ovat puhelinjärjestelmissä käytetyt G.711-koodekit. SSML:n avulla voit hallita rytmiä, vaihtaa kieltä kesken tekstin ja ääntää brändinimet mukautetun sanakirjasi kautta. Samanaikaiset reaaliaikaiset kanavat skaalautuvat sopimuksesi mukaan.

  • IVR
  • G.711
  • Puheagentit
  • SSML
  • A-law / μ-law

Ominaisuudet

Tuotantotason puhesynteesi, alusta loppuun

Kaikki, mitä tuotteesi tarvitsee vastatakseen puheella.

90 kieltä, 300 ääntä

Valitse laajasta, ammattimaisesta äänivalikoimasta kullekin kielelle. Äänet lisensoidaan erikseen, ja voit ottaa lisää käyttöön milloin tahansa.

SSML-syöte

Käytä SSML:ää taukoihin, foneettisiin transkriptioihin ja äänen tai kielen vaihtamiseen yhden tekstin sisällä. Standardin mukaista SSML-merkintää tuetaan.

Mukautetut ääntämissanakirjat

Jokainen asiakas voi muokata äänikohtaista sanakirjaa asiakasportaalissa ja hallita näin brändinimien, teknisten termien ja harvinaisten sanojen ääntämystä. ReadSpeakerin kielitieteilijät voivat korjata virheellisiä ääntämyksiä pyynnöstä.

Ajoitustiedot (RSDS)

RSDS palauttaa äänen ja ajoitusmerkit yhdessä vastauksessa, mikä säästää krediittejä kahteen erilliseen kutsuun verrattuna. Hyödyllinen sanojen ja lauseiden korostuksessa käyttöliittymässäsi. Saatavilla vain MP3-muodossa 48 kbit/s, ei kaikilla äänillä.

Kuusi äänen ulostulomuotoa

MP3 (16, 24, 32, 48, 64, 128 kbit/s), Ogg VBR, μ-law, A-law, raaka PCM, WAV. PCM ja WAV taajuuksilla 22050, 16000 tai 8000 Hz, 16 bitin syvyydellä. Asetetaan pyyntökohtaisesti API-parametreilla.

Suoratoisto tai lataus

Aseta streaming=1 aloittaaksesi toiston heti kun ääni on valmis, ihanteellinen suoraan käyttöön. Tai ota valmis tiedosto yhtenä latauksena.

REST-rajapinta HTTPS:n yli

API-avain sisältyy jokaiseen kutsuun. Kysele käytettävissä olevia kieliä, ääniä, nykyistä käyttöä ja jäljellä olevia krediittejä saman REST-rajapinnan kautta.

SCAPI-asiakasportaali

Muokkaa ääntämissanakirjaasi, seuraa käyttöä ja jäljellä olevia krediittejä ja vaihda uusi API-avain heti, kun epäilet väärinkäyttöä, kaikki yhdestä portaalista.

Ylläpidetty ja kahdennettu infrastruktuuri

ReadSpeakerin ylläpitämä korkean tietoturvan ympäristö, jossa on kahdennus ja vikasietoisuus. Mitään ei tarvitse ladata tai asentaa.

Kokeile omassa ympäristössäsi

Tekstistä ääneksi yhdellä pyynnöllä

Katsaus siihen, miltä kutsu näyttää neljällä ohjelmointikielellä. Tunnistaudu API-avaimellasi, joka lähetetään jokaisen pyynnön mukana.

# Synthesise a sentence to MP3 (48 kbps)
curl -X POST "https://tts.readspeaker.com/a/eg/v2.0" \
  -d "key=YOUR_API_KEY" \
  -d "voice=Adam" \
  -d "lang=en_uk" \
  -d "audioformat=mp3" \
  -d "audiobitrate=48" \
  -d "text=Welcome to ReadSpeaker." \
  --output speech.mp3

# With SSML, switching language inline
curl -X POST "https://tts.readspeaker.com/a/eg/v2.0" \
  -d "key=YOUR_API_KEY" \
  -d "voice=Adam" \
  -d "lang=en_uk" \
  -d "input=ssml" \
  --data-urlencode 'text=<speak>Hello, <voice name="Roxane" xml:lang="fr-FR">bonjour</voice>.</speak>' \
  --output greeting.mp3

Päätepisteen muoto on havainnollistava. Katso uusin Tuotespesifikaatio and the Customer Portal documentation for the current endpoint URL and parameter names.

Tekniset tiedot

Kaikki tiedot, joita tietoturvatarkastuksesi kysyy

Tunnistautuminen, tiedonsiirto, kielten kattavuus, läpimenorajat ja äänimuodot. Vastaukset, joita tietoturva- ja ylläpitotiimisi tarvitsevat ennen integraatiota.

speechCloud APIn tekniset tiedot
SpecificationValue
TunnistautuminenAPI-avain, mukana jokaisessa pyynnössä
TiedonsiirtoREST HTTPS:n yli
Tuetut kielet90 kieltä
Saatavilla olevat äänet300 ääntä
Tekstin enimmäismäärä pyyntöä kohden5 000 merkkiä (ilman välilyöntejä), oletus
Suunniteltu käyttöraja≤ 25 000 pyyntöä/vrk · piikit ≤ 2 000 pyyntöä yhden tunnin sisällä
Äänen ulostulomuodotMP3 · Ogg VBR · μ-law · A-law · PCM · WAV
MP3-bittinopeudet16, 24, 32, 48, 64, 128 kbit/s
PCM- ja WAV-näytteenottotaajuudet22050, 16000, 8000 Hz @ 16 bittiä
Syötteen merkistökoodausUTF-8 suositeltu, useimpia yleisiä merkistökoodauksia tuetaan
SSML-tukiKyllä: tauot, foneettiset transkriptiot, äänen ja kielen vaihto kesken tekstin
Ajoitustiedot (RSDS)Ääni ja ajoitustiedot samassa vastauksessa · tällä hetkellä vain MP3 48 kbit/s · ei kaikilla äänillä
Suoratoistotilastreaming=1 (default) → redirect to streaming server; streaming=0 → file delivered after full generation
Äänen tallennussäännötEi tallennusta, uudelleenkäyttöä tai edelleenjakelua, ellei siitä ole nimenomaisesti sovittu tilausvahvistuksessa
PuhelinjärjestelmäintegraatioA-law- ja μ-law-ulostulomuodot (G.711-koodekit)
DokumentaatioTuotespesifikaatio (PDF)

Hinnoittelu

Maksa siitä, mitä tuotat, ja skaalaa tarvittaessa

speechCloud API käyttää krediittimallia. Tuotantokrediitit tilataan ReadSpeaker-asiakasvastaavaltasi, ja ReadSpeakerin tukitiimi lisää ne tilillesi. Uudet tilit saavat tyypillisesti rajallisen määrän kokeilukrediittejä alkutestausta varten.

Pyydä tarjous

Aloita ilmaiseksi: uudet tilit saavat tyypillisesti kokeilukrediittejä. Pyydä pääsyä yhteydenottolomakkeella.

Credits

speechCloud API

Krediittimalli1 krediitti = 1 merkki, ilman välilyöntejä

Miten krediitit toimivat

  • 1 krediitti = 1 merkki, ilman välilyöntejä, mukaan lukien ääntämissanakirjan merkintöjen aiheuttamat muutokset
  • Puhesekuntiin perustuva vaihtoehto available via order confirmation for predictable cost on long audio
  • Kokeilukrediitit tilin avauksessa so you can evaluate before committing

Lisensoitua kapasiteettia mitataan seuraavasti

  • Merkkien määrä over the contract period
  • Pyyntöjen määrä and total speech time
  • Samanaikaiset reaaliaikaiset kanavat for telephony and live use cases
  • Tuotantonopeus when responsiveness is critical

Vaatimustenmukaisuus

Vaatimustenmukaisuus, jonka voit antaa suoraan auditoijallesi

ReadSpeaker on ISO/IEC 27001:2022 -sertifioitu organisaatio, joka on GDPR-yhteensopiva ja käyttää vakiosopimuslausekkeita rajat ylittäviin tiedonsiirtoihin.

  • ISO/IEC 27001:2022 (ISO/IEC 27001:2022, tietoturvan hallinta)

    ReadSpeaker-organisaatio

  • GDPR (Yleinen tietosuoja-asetus)

    Tietosuojailmoitus julkaistu

  • EU:n vakiosopimuslausekkeet (EU:n vakiosopimuslausekkeet)

    Rajat ylittäviin siirtoihin

  • EU-pohjainen (Euroopan unionissa toimiva organisaatio)

    Pääkonttori Ruotsissa (ReadSpeaker AB, Uppsala)

Usein kysytyt kysymykset

Kysymyksiä speechCloud APIsta

  • speechCloud API (SCAPI) on ReadSpeakerin pilvessä ylläpitämä puhesynteesin REST-rajapinta. Lähetät tekstin ReadSpeakerin palvelimille HTTPS:n yli ja saat takaisin korkealaatuista ääntä valitsemassasi muodossa (MP3, Ogg, PCM, WAV, A-law tai μ-law). Se tukee 90 kieltä ja 300 ääntä, SSML-merkintöjä, mukautettuja ääntämissanakirjoja ja ajoitustietoja synkronoitua korostusta varten. Se on palvelinpohjainen, eikä ohjelmistoa tarvitse asentaa. Integraatio tehdään API-avaimella ja HTTP-pyynnöillä.

  • webReader ja docReader ovat loppukäyttäjätuotteita, joilla on oma käyttöliittymä. webReader puts a Listen button on the HTML pages of your website; docReader does the same for the documents you publish. speechCloud API has no user interface. You call it server-to-server from your application to generate audio. Use it for connected devices, telephony and IVR, mobile apps, e-learning platforms that produce audio, audiobooks, or any product where you need text-to-speech inside your own software.

  • speechCloud API palauttaa äänen kuudessa muodossa: MP3 (säädettävä bittinopeus 16, 24, 32, 48, 64 tai 128 kbit/s), Ogg VBR, μ-law, A-law, raaka PCM ja WAV. PCM ja WAV tukevat näytteenottotaajuuksia 22050, 16000 tai 8000 Hz 16 bitin syvyydellä. Muoto ja ääniparametrit valitaan pyyntökohtaisesti API-parametreilla.

  • Jokainen pyyntö ottaa oletuksena enintään 5 000 merkkiä, ja laskentaan lasketaan kaikki paitsi välilyönnit. Vakiopalvelu on mitoitettu enintään 25 000 pyynnölle päivässä, tuntipiikkien ollessa enintään 2 000. Onko liikennettä enemmän tai jatkuvasti? Keskustele ReadSpeakerin kanssa volyymillesi rakennetusta omasta kokoonpanosta.

  • Kyllä. SSML-syötettä tuetaan, mukaan lukien tauot, foneettiset transkriptiot ja äänen tai kielen vaihto yhden tekstin sisällä. Myös mukautetut ääntämissanakirjat ovat käytettävissä: jokainen asiakas voi muokata äänikohtaista sanakirjaa asiakasportaalissa ja hallita näin brändinimien, teknisten termien tai harvinaisten sanojen ääntämystä.

  • Kyllä. speechCloud API voi palauttaa RSDS:n, joka yhdistää äänen ja ajoitustiedot yhteen vastaukseen ja säästää näin krediittejä kahteen erilliseen pyyntöön verrattuna. RSDS on tällä hetkellä saatavilla MP3-muodossa 48 kbit/s, eikä se ole käytettävissä jokaisella kielellä tai äänellä. Ota yhteyttä ReadSpeakeriin saadaksesi ajantasaisen luettelon.

  • speechCloud API toimii krediiteillä: yksi krediitti kattaa yhden merkin, ja laskentaan lasketaan kaikki paitsi välilyönnit sekä ääntämissanakirjasi lisäämät merkit. Tilaat tuotantokrediitit ReadSpeaker-asiakasvastaavaltasi, ja uudet tilit aloittavat yleensä kokeilukrediiteillä. Puhesekuntiin perustuva malli on saatavilla pyynnöstä. Kapasiteetti voidaan lisensoida merkkien, pyyntöjen, puheajan, samanaikaisten kanavien tai tuotantonopeuden mukaan. Ota yhteyttä ReadSpeakeriin saadaksesi volyymiisi sovitetun tarjouksen.

  • ReadSpeaker on organisaationa ISO/IEC 27001:2022 -sertifioitu ja GDPR-yhteensopiva. Kaikki rajapintaliikenne käyttää HTTPS:ää. EU-asiakkaiden ja rajat ylittävien tiedonsiirtojen osalta ReadSpeaker nojaa vakiosopimuslausekkeisiin. ReadSpeakerin tietosuojailmoituksen mukaan ReadSpeakerin syntetisoidut äänet ovat sekoitettuja äänimalleja, jotka eivät ole GDPR:n tarkoittamia henkilötietoja. Äänidataa ei saa tallentaa, käyttää uudelleen tai jakaa edelleen, ellei siitä ole nimenomaisesti sovittu tilausvahvistuksessa.

  • speechCloud API tukee reaaliaikaisia käyttötapauksia. Oletuksena pyynnöt käyttävät suoratoistotilaa (streaming=1), jolloin vastaus ohjautuu suoratoistopalvelimelle, joka alkaa toimittaa ääntä mahdollisimman pian ja lyhentää näin viivettä ensimmäiseen ääneen. Eräajotoimitusta varten aseta streaming=0, jolloin tiedosto palautetaan vasta kun se on kokonaan tuotettu. Samanaikaisten reaaliaikaisten kanavien määrä on osa lisensoitua kapasiteettiasi, ja sitä voidaan skaalata tilausvahvistuksessa.

  • Luo ReadSpeaker-tili. Uudet tilit saavat tyypillisesti rajallisen määrän kokeilukrediittejä, jotta voit arvioida speechCloud APIa. API-avaimesi on saatavilla SCAPI-asiakasportaalissa, ja se on sisällytettävä jokaiseen pyyntöön. Portaalista löytyvät myös toteutus- ja käyttöohjeet, koodiesimerkit suosituilla ohjelmointikielillä sekä muokattava ääntämissanakirjasi. Ota yhteyttä ReadSpeakeriin to start your account.

VoiceLab

Tarvitsetko oman brändiäänen?

speechCloud API toimitetaan ammattimaisen äänivalikoimamme kanssa.

Ääninäyttelijä äänittää studiomikrofonin edessä

Brändiääni, joka rakennetaan kanssasi studiossa

Jos haluat täysin räätälöidyn brändiäänen, joka rakennetaan kanssasi studiossa, tutustu VoiceLabiin. ReadSpeakerin laskennallisen kielitieteen asiantuntijat ovat muotoilleet brändiääniä vuodesta 1999.

Valmiina tuomaan äänen tuotteeseesi?

Kokeilukrediittejä annetaan tyypillisesti tilin luonnin yhteydessä, jotta voit arvioida palvelun ennen sitoutumista. Tiimimme auttaa mitoittamaan volyymin, kielet ja samanaikaiset reaaliaikaiset kanavat tuotantoa varten. ISO/IEC 27001:2022 -sertifioitu, GDPR:ää ja EU:n vakiosopimuslausekkeita noudattava.

Find your ReadSpeaker solution

Opening the conversation…

Search

    Searching…

    No results for

    Try another wording, or start from one of these.

    Search is not available right now.

    You can still reach the pages below.