Gå til innholdet

ReadSpeaker speechEngine SDK

SDK for tekst til tale på enheten, offline, for skrivebords- og PC-apper

Installer talemotoren rett på målmaskinen, der den genererer lyd lokalt uten nettverkskall. 150+ AI-stemmer på 50+ språk, med native bindinger for C, C++ og Java på Windows og Linux, og C# på Windows.

  • C/C++ · C# · Java
  • Windows 10/11 + Linux
  • På enheten

Kundehistorie

Innebygd i programvaren som leveres, på selve enheten

Soft Leaf

Å bruke ReadSpeakers TTS-plug-in sparte oss for utallige utviklingstimer og brakte oss nærmere visjonen vår om et virkelig tilgjengelig spill.

Conor BradleyGrunnlegger og direktør, Soft Leaf Studios · Stories of Blossom
Les hele historien om Soft Leaf

Funksjoner

Stemme på enheten, laget for utviklere

Alt teamet deres trenger for å legge naturtro stemme inn i en skrivebords- eller PC-applikasjon, med motoren kjørende lokalt.

Lever stemme som aldri forlater enheten

Motoren kjører på kundens egen maskin og genererer lyd uten et eneste nettverkskall. Det passer godt for utrullinger uten nettforbindelse, i regulerte miljøer eller der offline er utgangspunktet og dataene skal bli værende internt.

150+ AI-stemmer på 50+ språk

Naturlige, menneskelignende AI-stemmer, med nye stemmer og språk som legges jevnlig til i katalogen. Velg aksenten og tonen som passer hvert marked, og lever dem med et fotavtrykk som holder seg lett på disken.

Teamet deres skriver i sine egne verktøy

Native bindinger for C og C++ på Windows og Linux, C# på Windows, og Java på Windows og Linux. Eksempelkode, dokumentasjon og implementeringsstøtte fra teamet vårt gjør integrasjonen enkel.

Finjustert stemmekontroll med SSML

Bytt stemme og språk midt i en setning, styr prosodien, sett inn pauser og fonetiske transkripsjoner. Speech Synthesis Markup Language (SSML) støttes fullt ut som inndata, i UTF-8.

Uttal merkenavn og fagsjargong riktig

Bygg uttaleordbøker per språk for produktnavn, forkortelser og egennavn, med flere ordbøker per språk. Bruk IPA-transkripsjon når du trenger presis fonetisk kontroll.

Lydformater for enhver arbeidsflyt

16-bits lineær PCM, 8-bits A-law og μ-law for telefoni, Dialogic ADPCM for eldre IVR-systemer. Lever formatet arbeidsflyten din forventer, rått eller pakket i WAV.

Finjuster hver ytring

Still inn talehastighet, tonehøyde og volum etter situasjonen, fra rolig fortellerstemme til hastevarsler. Konfigurer dem etter behov for hver utrulling.

Forutsigbar lisensiering

En lisensfil som installeres sammen med SDK-en, låser stemmene og lisensperioden du har bestilt. Ingen uventede oppgraderinger, ingen bruksbasert fakturering, ingen bekymring for revisjon.

Ekte mennesker hjelper dere i mål

ReadSpeakers supportteam jobber sammen med utviklerne deres gjennom hele integrasjonen. Eksempelkode, dokumentasjon og direkte kontakt gjør at dere aldri sitter fast med en wiki klokka to om natta.

Prøv det i systemene deres

Et enkelt integrasjonseksempel i C++

Native bindinger leveres for C og C++ på Windows og Linux, C# på Windows, og Java på Windows og Linux. Kall motoren i samme prosess og syntetiser tekst til en lokal lydfil, uten nettverkskall.

// Representative example. The exact API and headers ship with the licensed SDK.
#include "speechengine.h"

int main() {
    SpeechEngine engine;
    engine.init("./license.lic");          // license file enforces voices + term
    engine.selectVoice("en_US-neural");       // 150+ voices, 50+ languages
    engine.setSpeechRate(90);                 // tune rate, pitch and volume per request

    // Synthesise plain text or SSML to a local audio file, no server calls
    engine.synthesizeToFile("Welcome to ReadSpeaker.", "welcome.wav");

    engine.release();                          // free the engine
    return 0;
}

Tekniske spesifikasjoner

Alle spesifikasjoner utvikler- og driftsteamet deres vil spørre om

Dimensjonert for utrulling på enheten og offline: lite fotavtrykk, bred OS-støtte, lyd klar for telefoni.

Tekniske spesifikasjoner for speechEngine SDK 4.5
SpecificationDetail
ProgrammeringsspråkC / C++ (Windows/Linux) · C# (Windows) · Java (Windows/Linux)
Windows-operativsystemWindows 10 og 11
Linux-operativsystemCentOS Stream 9.x til 10.x · Ubuntu 18.x til 24.x · RHEL 7.x til 9.x · Andre operativsystemer på forespørsel
CPUIntel x86/64, 1 GHz eller høyere. AVX kreves på x64-arkitekturer (kontakt ReadSpeaker hvis miljøet deres mangler AVX-støtte).
RAM6 til 30 MB
Fotavtrykk per stemme9 til 35 MB per stemme (Deep Neural Networks-teknologi)
Minne under kjøring20 til 30 MB (Neural Standard)
InndataformaterRen tekst (flerbyte) · SSML (UTF-8)
Lydformater ut16-bits lineær PCM (rå/WAV) · 8-bits PCM A-law/μ-law (rå/WAV) · 8-bits usignert lineær PCM Wave · 4-bits Dialogic ADPCM
DokumentasjonProduktspesifikasjon (PDF)

Utrullingsmodell

Kjører på infrastrukturen deres, under lisensfilen deres

speechEngine SDK installeres lokalt på målmaskinen. TTS-motoren kjører uten serverkall. Lisensavtalen og lisensfilen håndhever lisensiert plattform, stemmer og periode. For dokumentasjon om samsvar på selskapsnivå (ISO/IEC 27001, GDPR, EUs SCC-er), se ReadSpeakers personvernerklæring og Om oss-sidene.

  • På enheten (Motoren installeres på målmaskinen)

    Installert lokalt

  • Ingen nettverkskall (Lyd genereres uten turer til serveren)

    Motoren kjører lokalt

  • Håndheving via lisensfil (Lisensfil leveres med SDK-en)

    Stemmer + periode

  • Levering av SDK (SDK bygget for plattformen i bestillingen)

    Per kundeordre

Vanlige spørsmål

Spørsmål om speechEngine SDK

  • speechEngine SDK er en SDK for tekst til tale på enheten, for utviklere som bygger skrivebords- og PC-baserte applikasjoner. Motoren installeres lokalt på målmaskinen og støtter 150+ AI-stemmer på 50+ språk. Den kjører uten nettverkstilkobling, noe som passer for miljøer uten nettforbindelse og personvernsensitive miljøer.

  • speechEngine SDK leveres med native bindinger for C og C++ på Windows og Linux, C# på Windows, og Java på Windows og Linux. SDK-en leveres for den plattformen som er angitt i kundens bestilling.

  • speechEngine SDK kjører på Windows 10 og 11, og på Linux-distribusjoner som CentOS Stream 9.x til 10.x, Ubuntu 18.x til 24.x og RHEL 7.x til 9.x. Andre operativsystemer støttes på forespørsel. CPU: Intel x86/64 på 1 GHz eller høyere (AVX kreves på x64). RAM: 6 til 30 MB.

  • Ja. TTS-motoren installeres lokalt på målmaskinen og genererer lyd uten nettverkskall, noe som passer for personvernsensitive utrullinger og utrullinger uten nettforbindelse. For ARM-, mobil- eller IoT-mål, se speechEngine SDK Embedded.

  • speechEngine SDK leverer fire lydformater: 16-bits lineær PCM (rå/WAV), 8-bits PCM A-law/μ-law (rå/WAV), 8-bits usignert lineær PCM Wave og 4-bits Dialogic ADPCM. A-law- og μ-law-utdata egner seg særlig godt for telefoniintegrasjon.

  • Ja. speechEngine SDK tar imot ren tekst (flerbyte) og SSML (UTF-8), slik at applikasjonen deres kan merke opp den talen den trenger. Med SSML kan dere bytte stemme og språk innenfor én og samme tekst, endre prosodien, sette inn pauser og bruke fonetiske transkripsjoner.

  • speechEngine SDK styres av en lisensavtale som definerer den lisensierte plattformen, stemmene og den tillatte bruken. En lisensfil som leveres med SDK-en, håndhever teknisk de lisensierte stemmene og perioden, altså varigheten på den tillatte bruken.

  • Ja. Implementeringsstøtte fra ReadSpeakers supportteam er inkludert. Teamet hjelper kundene med å forstå og gjennomføre integrasjonen i tråd med dokumentasjonen og eksempelkoden som følger med.

Klar til å gi skrivebordsappen din en stemme?

Fortell oss om plattformen og målspråkene deres. Teamet vårt finner riktige stemmer, leveranse og lisensvilkår, og sender deretter SDK-en med eksempelkode og implementeringsstøtte.

Find your ReadSpeaker solution

Opening the conversation…

Search

    Searching…

    No results for

    Try another wording, or start from one of these.

    Search is not available right now.

    You can still reach the pages below.