Brugen af ReadSpeakers TTS-plug-in sparede os for utallige udviklingstimer og bragte os tættere på vores vision om et spil, der er tilgængeligt for alle.
Læs hele historien om Soft LeafReadSpeaker speechEngine SDK
Offline tekst-til-tale-SDK på selve enheden til desktop- og pc-apps
Installér talemotoren direkte på målmaskinen, hvor den genererer lyd lokalt uden netværkskald. 150+ AI-stemmer på 50+ sprog, med native bindings til C, C++ og Java på Windows og Linux samt C# på Windows.
- C/C++ · C# · Java
- Windows 10/11 og Linux
- På selve enheden
Kundehistorie
Indbygget i færdig software, på selve enheden
Funktioner
Stemme på selve enheden, bygget til udviklere
Alt, hvad jeres team har brug for for at lægge naturligt klingende tale ind i et desktop- eller pc-program, med motoren kørende lokalt.
Send en stemme med, der aldrig forlader enheden
Motoren kører på jeres kundes maskine og genererer lyd uden et eneste netværkskald. Det passer godt til lukkede, regulerede eller offline-først-udrulninger, hvor data bliver internt.
150+ AI-stemmer på 50+ sprog
Naturlige AI-stemmer, der lyder menneskelige, og hvor nye stemmer og sprog løbende tilføjes til kataloget. Vælg den accent og tone, der passer til hvert marked, og send dem med et fodaftryk, der fylder lidt på disken.
Jeres team skriver i deres egen stack
Native bindings til C og C++ på Windows og Linux, C# på Windows samt Java på Windows og Linux. Eksempelkode, dokumentation og implementeringssupport fra vores team gør integrationen enkel.
Finjusteret stemmestyring med SSML
Skift stemme og sprog midt i en sætning, styr prosodien, og indsæt pauser og fonetiske transskriptioner. Input i Speech Synthesis Markup Language (SSML) understøttes fuldt ud, i UTF-8.
Udtal mærkenavne og fagjargon korrekt
Byg udtaleordbøger pr. sprog til produktnavne, forkortelser og egennavne, med flere ordbøger pr. sprog. Brug IPA-transskription, når I har brug for præcis fonetisk kontrol.
Lydformater til enhver pipeline
16-bit lineær PCM, 8-bit A-law og μ-law til telefoni, Dialogic ADPCM til ældre IVR. Få output i det format, jeres pipeline forventer, rå eller pakket i WAV.
Finjustér hver eneste ytring
Indstil talehastighed, toneleje og lydstyrke, så det passer til situationen, fra rolig fortælling til hastevarsler. Konfigurér dem efter behov for hver udrulning.
Forudsigelig licensering
En licensfil, der installeres sammen med SDK'et, låser de stemmer og den løbetid, I har bestilt. Ingen uventede opgraderinger, ingen forbrugsbaseret fakturering, ingen bekymringer ved revision.
Rigtige mennesker hjælper jer i mål
ReadSpeakers supportteam arbejder sammen med jeres udviklere gennem hele integrationen. Eksempelkode, dokumentation og direkte kontakt betyder, at I aldrig sidder fast i en wiki klokken to om natten.
Prøv det i jeres stack
Et enkelt eksempel på C++-integration
Der følger native bindings med til C og C++ på Windows og Linux, C# på Windows samt Java på Windows og Linux. Kald motoren i samme proces, og syntetisér tekst til en lokal lydfil uden netværkskald.
// Representative example. The exact API and headers ship with the licensed SDK.
#include "speechengine.h"
int main() {
SpeechEngine engine;
engine.init("./license.lic"); // license file enforces voices + term
engine.selectVoice("en_US-neural"); // 150+ voices, 50+ languages
engine.setSpeechRate(90); // tune rate, pitch and volume per request
// Synthesise plain text or SSML to a local audio file, no server calls
engine.synthesizeToFile("Welcome to ReadSpeaker.", "welcome.wav");
engine.release(); // free the engine
return 0;
}Tekniske specifikationer
Alle de specifikationer, jeres udvikler- og driftsteam vil spørge om
Dimensioneret til offline udrulning på selve enheden: lille fodaftryk, bred understøttelse af styresystemer og lyd, der er klar til telefoni.
| Specification | Detail |
|---|---|
| Programmeringssprog | C / C++ (Windows/Linux) · C# (Windows) · Java (Windows/Linux) |
| Windows-styresystem | Windows 10 og 11 |
| Linux-styresystem | CentOS Stream 9.x til 10.x · Ubuntu 18.x til 24.x · RHEL 7.x til 9.x · Andre styresystemer på forespørgsel |
| CPU | Intel x86/64, 1 GHz eller derover. AVX er påkrævet på x64-arkitekturer (kontakt ReadSpeaker, hvis jeres miljø ikke understøtter AVX). |
| RAM | 6 til 30 MB |
| Stemmens fodaftryk | 9 til 35 MB pr. stemme (Deep Neural Networks-teknologi) |
| Hukommelse under kørsel | 20 til 30 MB (Neural Standard) |
| Inputformater | Ren tekst (multibyte) · SSML (UTF-8) |
| Lydoutputformater | 16-bit lineær PCM (rå/WAV) · 8-bit PCM A-law/μ-law (rå/WAV) · 8-bit unsigned lineær PCM Wave · 4-bit Dialogic ADPCM |
| Dokumentation | Produktspecifikation (PDF) |
Udrulningsmodel
Kører på jeres infrastruktur, under jeres licensfil
speechEngine SDK installeres lokalt på målmaskinen. TTS-motoren kører uden serverkald. Licensaftalen og licensfilen håndhæver den licenserede platform, stemmerne og løbetiden. For dokumentation om virksomhedens overholdelse (ISO/IEC 27001, GDPR, EU SCC'er), se ReadSpeakers privatlivspolitik og Om-sider.
På selve enheden (Motoren installeres på målmaskinen)
Installeret lokalt
Ingen netværkskald (Lyd genereret uden kald frem og tilbage til en server)
Motoren kører lokalt
Håndhævelse via licensfil (Licensfil leveret sammen med SDK'et)
Stemmer og løbetid
Levering af SDK (SDK bygget til den platform, der står på ordren)
Pr. kundeordre
FAQ
Spørgsmål om speechEngine SDK
speechEngine SDK er et tekst-til-tale-SDK på selve enheden til udviklere, der bygger desktop- og pc-baserede applikationer. Motoren installeres lokalt på målmaskinen og understøtter 150+ AI-stemmer på 50+ sprog. Den kører uden netværksforbindelse, hvilket passer til fysisk adskilte og privatlivsfølsomme miljøer.
speechEngine SDK leveres med native bindings til C og C++ på Windows og Linux, C# på Windows samt Java på Windows og Linux. SDK'et leveres til den platform, der er angivet i kundens ordre.
speechEngine SDK kører på Windows 10 og 11 og på Linux-distributioner, herunder CentOS Stream 9.x til 10.x, Ubuntu 18.x til 24.x og RHEL 7.x til 9.x. Andre styresystemer understøttes på forespørgsel. CPU: Intel x86/64 1 GHz eller derover (AVX påkrævet på x64). RAM: 6-30 MB.
Ja. TTS-motoren installeres lokalt på målmaskinen og genererer lyd uden netværkskald, hvilket passer til privatlivsfølsomme og fysisk adskilte udrulninger. For ARM-, mobil- eller IoT-mål, se speechEngine SDK Embedded.
speechEngine SDK leverer fire lydformater: 16-bit lineær PCM (rå/WAV), 8-bit PCM A-law/μ-law (rå/WAV), 8-bit unsigned lineær PCM Wave og 4-bit Dialogic ADPCM. A-law- og μ-law-output er særligt velegnet til telefoniintegration.
Ja. speechEngine SDK accepterer input i ren tekst (multibyte) og SSML-input (UTF-8), så jeres applikation kan markere den tale, den har brug for. SSML lader jer skifte stemme og sprog inden for den samme tekst, ændre prosodien, indsætte pauser og anvende fonetiske transskriptioner.
speechEngine SDK er omfattet af en licensaftale, der fastlægger den licenserede platform, stemmerne og den tilladte anvendelseskontekst. En licensfil, der leveres sammen med SDK'et, håndhæver teknisk de licenserede stemmer og løbetiden, altså varigheden af den tilladte brug.
Ja. Implementeringssupport fra ReadSpeakers supportteam er inkluderet. Teamet hjælper kunderne med at forstå og gennemføre integrationen i henhold til den leverede dokumentation og eksempelkode.