Gå til indhold

ReadSpeaker speechEngine SDK

Offline tekst-til-tale-SDK på selve enheden til desktop- og pc-apps

Installér talemotoren direkte på målmaskinen, hvor den genererer lyd lokalt uden netværkskald. 150+ AI-stemmer på 50+ sprog, med native bindings til C, C++ og Java på Windows og Linux samt C# på Windows.

  • C/C++ · C# · Java
  • Windows 10/11 og Linux
  • På selve enheden

Kundehistorie

Indbygget i færdig software, på selve enheden

Soft Leaf

Brugen af ReadSpeakers TTS-plug-in sparede os for utallige udviklingstimer og bragte os tættere på vores vision om et spil, der er tilgængeligt for alle.

Conor BradleyStifter og direktør, Soft Leaf Studios · Stories of Blossom
Læs hele historien om Soft Leaf

Funktioner

Stemme på selve enheden, bygget til udviklere

Alt, hvad jeres team har brug for for at lægge naturligt klingende tale ind i et desktop- eller pc-program, med motoren kørende lokalt.

Send en stemme med, der aldrig forlader enheden

Motoren kører på jeres kundes maskine og genererer lyd uden et eneste netværkskald. Det passer godt til lukkede, regulerede eller offline-først-udrulninger, hvor data bliver internt.

150+ AI-stemmer på 50+ sprog

Naturlige AI-stemmer, der lyder menneskelige, og hvor nye stemmer og sprog løbende tilføjes til kataloget. Vælg den accent og tone, der passer til hvert marked, og send dem med et fodaftryk, der fylder lidt på disken.

Jeres team skriver i deres egen stack

Native bindings til C og C++ på Windows og Linux, C# på Windows samt Java på Windows og Linux. Eksempelkode, dokumentation og implementeringssupport fra vores team gør integrationen enkel.

Finjusteret stemmestyring med SSML

Skift stemme og sprog midt i en sætning, styr prosodien, og indsæt pauser og fonetiske transskriptioner. Input i Speech Synthesis Markup Language (SSML) understøttes fuldt ud, i UTF-8.

Udtal mærkenavne og fagjargon korrekt

Byg udtaleordbøger pr. sprog til produktnavne, forkortelser og egennavne, med flere ordbøger pr. sprog. Brug IPA-transskription, når I har brug for præcis fonetisk kontrol.

Lydformater til enhver pipeline

16-bit lineær PCM, 8-bit A-law og μ-law til telefoni, Dialogic ADPCM til ældre IVR. Få output i det format, jeres pipeline forventer, rå eller pakket i WAV.

Finjustér hver eneste ytring

Indstil talehastighed, toneleje og lydstyrke, så det passer til situationen, fra rolig fortælling til hastevarsler. Konfigurér dem efter behov for hver udrulning.

Forudsigelig licensering

En licensfil, der installeres sammen med SDK'et, låser de stemmer og den løbetid, I har bestilt. Ingen uventede opgraderinger, ingen forbrugsbaseret fakturering, ingen bekymringer ved revision.

Rigtige mennesker hjælper jer i mål

ReadSpeakers supportteam arbejder sammen med jeres udviklere gennem hele integrationen. Eksempelkode, dokumentation og direkte kontakt betyder, at I aldrig sidder fast i en wiki klokken to om natten.

Prøv det i jeres stack

Et enkelt eksempel på C++-integration

Der følger native bindings med til C og C++ på Windows og Linux, C# på Windows samt Java på Windows og Linux. Kald motoren i samme proces, og syntetisér tekst til en lokal lydfil uden netværkskald.

// Representative example. The exact API and headers ship with the licensed SDK.
#include "speechengine.h"

int main() {
    SpeechEngine engine;
    engine.init("./license.lic");          // license file enforces voices + term
    engine.selectVoice("en_US-neural");       // 150+ voices, 50+ languages
    engine.setSpeechRate(90);                 // tune rate, pitch and volume per request

    // Synthesise plain text or SSML to a local audio file, no server calls
    engine.synthesizeToFile("Welcome to ReadSpeaker.", "welcome.wav");

    engine.release();                          // free the engine
    return 0;
}

Tekniske specifikationer

Alle de specifikationer, jeres udvikler- og driftsteam vil spørge om

Dimensioneret til offline udrulning på selve enheden: lille fodaftryk, bred understøttelse af styresystemer og lyd, der er klar til telefoni.

Tekniske specifikationer for speechEngine SDK 4.5
SpecificationDetail
ProgrammeringssprogC / C++ (Windows/Linux) · C# (Windows) · Java (Windows/Linux)
Windows-styresystemWindows 10 og 11
Linux-styresystemCentOS Stream 9.x til 10.x · Ubuntu 18.x til 24.x · RHEL 7.x til 9.x · Andre styresystemer på forespørgsel
CPUIntel x86/64, 1 GHz eller derover. AVX er påkrævet på x64-arkitekturer (kontakt ReadSpeaker, hvis jeres miljø ikke understøtter AVX).
RAM6 til 30 MB
Stemmens fodaftryk9 til 35 MB pr. stemme (Deep Neural Networks-teknologi)
Hukommelse under kørsel20 til 30 MB (Neural Standard)
InputformaterRen tekst (multibyte) · SSML (UTF-8)
Lydoutputformater16-bit lineær PCM (rå/WAV) · 8-bit PCM A-law/μ-law (rå/WAV) · 8-bit unsigned lineær PCM Wave · 4-bit Dialogic ADPCM
DokumentationProduktspecifikation (PDF)

Udrulningsmodel

Kører på jeres infrastruktur, under jeres licensfil

speechEngine SDK installeres lokalt på målmaskinen. TTS-motoren kører uden serverkald. Licensaftalen og licensfilen håndhæver den licenserede platform, stemmerne og løbetiden. For dokumentation om virksomhedens overholdelse (ISO/IEC 27001, GDPR, EU SCC'er), se ReadSpeakers privatlivspolitik og Om-sider.

  • På selve enheden (Motoren installeres på målmaskinen)

    Installeret lokalt

  • Ingen netværkskald (Lyd genereret uden kald frem og tilbage til en server)

    Motoren kører lokalt

  • Håndhævelse via licensfil (Licensfil leveret sammen med SDK'et)

    Stemmer og løbetid

  • Levering af SDK (SDK bygget til den platform, der står på ordren)

    Pr. kundeordre

FAQ

Spørgsmål om speechEngine SDK

  • speechEngine SDK er et tekst-til-tale-SDK på selve enheden til udviklere, der bygger desktop- og pc-baserede applikationer. Motoren installeres lokalt på målmaskinen og understøtter 150+ AI-stemmer på 50+ sprog. Den kører uden netværksforbindelse, hvilket passer til fysisk adskilte og privatlivsfølsomme miljøer.

  • speechEngine SDK leveres med native bindings til C og C++ på Windows og Linux, C# på Windows samt Java på Windows og Linux. SDK'et leveres til den platform, der er angivet i kundens ordre.

  • speechEngine SDK kører på Windows 10 og 11 og på Linux-distributioner, herunder CentOS Stream 9.x til 10.x, Ubuntu 18.x til 24.x og RHEL 7.x til 9.x. Andre styresystemer understøttes på forespørgsel. CPU: Intel x86/64 1 GHz eller derover (AVX påkrævet på x64). RAM: 6-30 MB.

  • Ja. TTS-motoren installeres lokalt på målmaskinen og genererer lyd uden netværkskald, hvilket passer til privatlivsfølsomme og fysisk adskilte udrulninger. For ARM-, mobil- eller IoT-mål, se speechEngine SDK Embedded.

  • speechEngine SDK leverer fire lydformater: 16-bit lineær PCM (rå/WAV), 8-bit PCM A-law/μ-law (rå/WAV), 8-bit unsigned lineær PCM Wave og 4-bit Dialogic ADPCM. A-law- og μ-law-output er særligt velegnet til telefoniintegration.

  • Ja. speechEngine SDK accepterer input i ren tekst (multibyte) og SSML-input (UTF-8), så jeres applikation kan markere den tale, den har brug for. SSML lader jer skifte stemme og sprog inden for den samme tekst, ændre prosodien, indsætte pauser og anvende fonetiske transskriptioner.

  • speechEngine SDK er omfattet af en licensaftale, der fastlægger den licenserede platform, stemmerne og den tilladte anvendelseskontekst. En licensfil, der leveres sammen med SDK'et, håndhæver teknisk de licenserede stemmer og løbetiden, altså varigheden af den tilladte brug.

  • Ja. Implementeringssupport fra ReadSpeakers supportteam er inkluderet. Teamet hjælper kunderne med at forstå og gennemføre integrationen i henhold til den leverede dokumentation og eksempelkode.

Klar til at lægge en stemme ind i jeres desktop-app?

Fortæl os om jeres platform og målsprog. Vores team afgrænser de rigtige stemmer, leveringsform og licensvilkår og sender derefter SDK'et med eksempelkode og implementeringssupport.

Find your ReadSpeaker solution

Opening the conversation…

Search

    Searching…

    No results for

    Try another wording, or start from one of these.

    Search is not available right now.

    You can still reach the pages below.