Å bruke ReadSpeakers TTS-plug-in sparte oss for utallige utviklingstimer og brakte oss nærmere visjonen vår om et virkelig tilgjengelig spill.
Les hele historien om Soft LeafReadSpeaker speechEngine SDK
SDK for tekst til tale på enheten, offline, for skrivebords- og PC-apper
Installer talemotoren rett på målmaskinen, der den genererer lyd lokalt uten nettverkskall. 150+ AI-stemmer på 50+ språk, med native bindinger for C, C++ og Java på Windows og Linux, og C# på Windows.
- C/C++ · C# · Java
- Windows 10/11 + Linux
- På enheten
Kundehistorie
Innebygd i programvaren som leveres, på selve enheten
Funksjoner
Stemme på enheten, laget for utviklere
Alt teamet deres trenger for å legge naturtro stemme inn i en skrivebords- eller PC-applikasjon, med motoren kjørende lokalt.
Lever stemme som aldri forlater enheten
Motoren kjører på kundens egen maskin og genererer lyd uten et eneste nettverkskall. Det passer godt for utrullinger uten nettforbindelse, i regulerte miljøer eller der offline er utgangspunktet og dataene skal bli værende internt.
150+ AI-stemmer på 50+ språk
Naturlige, menneskelignende AI-stemmer, med nye stemmer og språk som legges jevnlig til i katalogen. Velg aksenten og tonen som passer hvert marked, og lever dem med et fotavtrykk som holder seg lett på disken.
Teamet deres skriver i sine egne verktøy
Native bindinger for C og C++ på Windows og Linux, C# på Windows, og Java på Windows og Linux. Eksempelkode, dokumentasjon og implementeringsstøtte fra teamet vårt gjør integrasjonen enkel.
Finjustert stemmekontroll med SSML
Bytt stemme og språk midt i en setning, styr prosodien, sett inn pauser og fonetiske transkripsjoner. Speech Synthesis Markup Language (SSML) støttes fullt ut som inndata, i UTF-8.
Uttal merkenavn og fagsjargong riktig
Bygg uttaleordbøker per språk for produktnavn, forkortelser og egennavn, med flere ordbøker per språk. Bruk IPA-transkripsjon når du trenger presis fonetisk kontroll.
Lydformater for enhver arbeidsflyt
16-bits lineær PCM, 8-bits A-law og μ-law for telefoni, Dialogic ADPCM for eldre IVR-systemer. Lever formatet arbeidsflyten din forventer, rått eller pakket i WAV.
Finjuster hver ytring
Still inn talehastighet, tonehøyde og volum etter situasjonen, fra rolig fortellerstemme til hastevarsler. Konfigurer dem etter behov for hver utrulling.
Forutsigbar lisensiering
En lisensfil som installeres sammen med SDK-en, låser stemmene og lisensperioden du har bestilt. Ingen uventede oppgraderinger, ingen bruksbasert fakturering, ingen bekymring for revisjon.
Ekte mennesker hjelper dere i mål
ReadSpeakers supportteam jobber sammen med utviklerne deres gjennom hele integrasjonen. Eksempelkode, dokumentasjon og direkte kontakt gjør at dere aldri sitter fast med en wiki klokka to om natta.
Prøv det i systemene deres
Et enkelt integrasjonseksempel i C++
Native bindinger leveres for C og C++ på Windows og Linux, C# på Windows, og Java på Windows og Linux. Kall motoren i samme prosess og syntetiser tekst til en lokal lydfil, uten nettverkskall.
// Representative example. The exact API and headers ship with the licensed SDK.
#include "speechengine.h"
int main() {
SpeechEngine engine;
engine.init("./license.lic"); // license file enforces voices + term
engine.selectVoice("en_US-neural"); // 150+ voices, 50+ languages
engine.setSpeechRate(90); // tune rate, pitch and volume per request
// Synthesise plain text or SSML to a local audio file, no server calls
engine.synthesizeToFile("Welcome to ReadSpeaker.", "welcome.wav");
engine.release(); // free the engine
return 0;
}Tekniske spesifikasjoner
Alle spesifikasjoner utvikler- og driftsteamet deres vil spørre om
Dimensjonert for utrulling på enheten og offline: lite fotavtrykk, bred OS-støtte, lyd klar for telefoni.
| Specification | Detail |
|---|---|
| Programmeringsspråk | C / C++ (Windows/Linux) · C# (Windows) · Java (Windows/Linux) |
| Windows-operativsystem | Windows 10 og 11 |
| Linux-operativsystem | CentOS Stream 9.x til 10.x · Ubuntu 18.x til 24.x · RHEL 7.x til 9.x · Andre operativsystemer på forespørsel |
| CPU | Intel x86/64, 1 GHz eller høyere. AVX kreves på x64-arkitekturer (kontakt ReadSpeaker hvis miljøet deres mangler AVX-støtte). |
| RAM | 6 til 30 MB |
| Fotavtrykk per stemme | 9 til 35 MB per stemme (Deep Neural Networks-teknologi) |
| Minne under kjøring | 20 til 30 MB (Neural Standard) |
| Inndataformater | Ren tekst (flerbyte) · SSML (UTF-8) |
| Lydformater ut | 16-bits lineær PCM (rå/WAV) · 8-bits PCM A-law/μ-law (rå/WAV) · 8-bits usignert lineær PCM Wave · 4-bits Dialogic ADPCM |
| Dokumentasjon | Produktspesifikasjon (PDF) |
Utrullingsmodell
Kjører på infrastrukturen deres, under lisensfilen deres
speechEngine SDK installeres lokalt på målmaskinen. TTS-motoren kjører uten serverkall. Lisensavtalen og lisensfilen håndhever lisensiert plattform, stemmer og periode. For dokumentasjon om samsvar på selskapsnivå (ISO/IEC 27001, GDPR, EUs SCC-er), se ReadSpeakers personvernerklæring og Om oss-sidene.
På enheten (Motoren installeres på målmaskinen)
Installert lokalt
Ingen nettverkskall (Lyd genereres uten turer til serveren)
Motoren kjører lokalt
Håndheving via lisensfil (Lisensfil leveres med SDK-en)
Stemmer + periode
Levering av SDK (SDK bygget for plattformen i bestillingen)
Per kundeordre
Vanlige spørsmål
Spørsmål om speechEngine SDK
speechEngine SDK er en SDK for tekst til tale på enheten, for utviklere som bygger skrivebords- og PC-baserte applikasjoner. Motoren installeres lokalt på målmaskinen og støtter 150+ AI-stemmer på 50+ språk. Den kjører uten nettverkstilkobling, noe som passer for miljøer uten nettforbindelse og personvernsensitive miljøer.
speechEngine SDK leveres med native bindinger for C og C++ på Windows og Linux, C# på Windows, og Java på Windows og Linux. SDK-en leveres for den plattformen som er angitt i kundens bestilling.
speechEngine SDK kjører på Windows 10 og 11, og på Linux-distribusjoner som CentOS Stream 9.x til 10.x, Ubuntu 18.x til 24.x og RHEL 7.x til 9.x. Andre operativsystemer støttes på forespørsel. CPU: Intel x86/64 på 1 GHz eller høyere (AVX kreves på x64). RAM: 6 til 30 MB.
Ja. TTS-motoren installeres lokalt på målmaskinen og genererer lyd uten nettverkskall, noe som passer for personvernsensitive utrullinger og utrullinger uten nettforbindelse. For ARM-, mobil- eller IoT-mål, se speechEngine SDK Embedded.
speechEngine SDK leverer fire lydformater: 16-bits lineær PCM (rå/WAV), 8-bits PCM A-law/μ-law (rå/WAV), 8-bits usignert lineær PCM Wave og 4-bits Dialogic ADPCM. A-law- og μ-law-utdata egner seg særlig godt for telefoniintegrasjon.
Ja. speechEngine SDK tar imot ren tekst (flerbyte) og SSML (UTF-8), slik at applikasjonen deres kan merke opp den talen den trenger. Med SSML kan dere bytte stemme og språk innenfor én og samme tekst, endre prosodien, sette inn pauser og bruke fonetiske transkripsjoner.
speechEngine SDK styres av en lisensavtale som definerer den lisensierte plattformen, stemmene og den tillatte bruken. En lisensfil som leveres med SDK-en, håndhever teknisk de lisensierte stemmene og perioden, altså varigheten på den tillatte bruken.
Ja. Implementeringsstøtte fra ReadSpeakers supportteam er inkludert. Teamet hjelper kundene med å forstå og gjennomføre integrasjonen i tråd med dokumentasjonen og eksempelkoden som følger med.