TCP/IP
TCP/IP-protokol
Forbind jeres applikation direkte til speechServer-motoren via en TCP/IP-kommunikationsprotokol.
ReadSpeaker speechServer
Kør ReadSpeakers tekst-til-tale-motor på jeres egne Windows Server- eller Linux-maskiner. Jeres applikationer anmoder om tale via TCP/IP, kommandolinjeværktøjet, REST-API'et eller SDK'erne til C, Java og .NET.
INDE I speechServer
ReadSpeaker speechServer er en netværksbaseret tekst-til-tale-server i klient-server-arkitektur. I installerer den på jeres egen infrastruktur, og jeres applikationer anmoder om talesyntese over netværket. Den passer til teams, der har brug for tekst-til-tale inde i deres eget miljø, fra virtuelle assistenter og notifikationsplatforme til uddannelsesapplikationer og andre serverbaserede systemer, der genererer lyd efter behov.
SÅDAN FORBINDES DET
Jeres applikation taler med speechServer på den måde, der passer til jeres stack. Forbind via en direkte netværksprotokol, kommandolinjeværktøjet, en web-API eller et klient-SDK i jeres eget programmeringssprog.
TCP/IP
Forbind jeres applikation direkte til speechServer-motoren via en TCP/IP-kommunikationsprotokol.
CLI
Styr talesyntese fra scripts og serverprocesser med det medfølgende kommandolinjeværktøj.
REST
Kald speechServer via en REST-API, når den kører bag en CGI-aktiveret webserver som Apache.
SDK
Integrér med klient-SDK'er til C, Java og .NET, der håndterer kommunikationen mellem jeres applikation og speechServer.
# direct socket connection
connect speechserver:5555
synth "Welcome"speechserver --voice Emma \
--text "Hello" --out out.wavPOST /synthesize
{ "voice": "Emma", "text": "Hi" }// .NET client SDK
var client = new SpeechServer();
client.Synthesize("Welcome");Kodeeksemplerne er vejledende. Se brugerdokumentationen for den præcise API-syntaks.
KØR DET PÅ JERES MÅDE
Installér speechServer på den platform, jeres drift allerede kører.
Installér speechServer på jeres Windows Server-maskiner sammen med de tjenester, jeres drift allerede kører.
Installér speechServer på de Linux-distributioner, jeres infrastruktur er bygget på, fra fysiske servere til virtuelle maskiner.
LYDOUTPUT
speechServer streamer lyd tilbage til jeres applikation i det format, jeres pipeline forventer, fra kodninger i telefonikvalitet til almindelige medieformater.
STEMMER
speechServer bruger ReadSpeakers katalog med mere end 150 AI-stemmer på over 50 sprog, og nye stemmer og sprog tilføjes regelmæssigt. Hvert licenseret sprog omfatter en brugerordbog, så I kan finjustere udtalen af fagspecifikke termer.
Global dækning
FINJUSTERING
Form oplæsningen af jeres tekst helt ned til det enkelte ord, med de styringsmuligheder jeres indhold allerede bærer.
Skift til en anden stemme eller et andet sprog midt i teksten ved hjælp af SSML-instruktioner i jeres input. Justér talehastighed, toneleje og lydstyrke efter behov.
Definér egne udtaler for ord og mønstre med brugerordbøger pr. sprog og IPA-transskription, så fagtermer læses korrekt op.
Indsæt henvisninger til lydklip i jeres inputtekst. speechServer placerer den henviste lyd det rigtige sted i det streamede output.
Modtag markeringsinformation sammen med lyden til hændelsesudløsere ved tekstpositioner, synkronisering af enhed og brugerflade samt tekstfremhævning, der følger afspilningen.
UDRULNING
speechServer kører udelukkende på jeres egne servere, så tekst og lyd bliver inde i jeres netværk.
speechServer kører udelukkende på jeres egne servere, så tekst og lyd bliver inde i jeres netværk. Den installeres med speechServer-installationsprogrammet, og enhver licenseret ReadSpeaker-stemme kan tilføjes. Brugen reguleres af en licensfil, der fastsætter jeres stemmer, samtidige porte, syntesehastighed, antal servere og løbetid.
speechServer over for OPEN SOURCE
Open source-projekter kan køre tekst-til-tale lokalt, men I vedligeholder selv motoren, stemmerne og integrationen. speechServer giver jer en kommerciel server med support og et vedligeholdt stemmekatalog.
| ReadSpeaker speechServer | Open-source do-it-yourself | |
|---|---|---|
| Type | Kommercielt produkt med support | Gratis open source, vedligeholdt af fællesskabet |
| Stemmekatalog | 150+ AI-stemmer, 50+ sprog | Medbring jeres egen, varierer |
| Integration | TCP/IP, kommandolinje, REST, SDK'er til C/Java/.NET | Gør det selv-opkobling |
| Support | ReadSpeakers supportteam, installation og implementering | Fællesskab |
| Licensering | Licensfil med fastlagte vilkår | Projektlicens, ingen SLA |
| Stemmeopdateringer | Tilføjes løbende | Gør det selv |
FAQ
ReadSpeaker speechServer er en on-premise, netværksbaseret tekst-til-tale-server. I hoster den på jeres egne Windows Server- eller Linux-maskiner, og jeres applikationer anmoder om talesyntese over netværket. Den leverer ReadSpeakers tekst-til-tale-motor, en server-API og værktøjer som et komplet serverside-runtime.
speechServer er selvhostet og ikke skybaseret: den kører på jeres egne Windows Server- eller Linux-maskiner, og jeres tekst og den lyd, den genererer, bliver inde i jeres eget netværk i stedet for at gå gennem en tredjepartstjeneste. Foretrækker I i stedet en hostet cloud-API, ReadSpeaker speechCloud API is the hosted option.
Klientapplikationer forbinder til speechServer via en TCP/IP-kommunikationsprotokol, et kommandolinjeværktøj eller en REST-API, når den kører bag en CGI-aktiveret webserver som Apache. Der følger også klient-SDK'er til C, Java og .NET med.
speechServer leverer klient-SDK'er til C, Java og .NET, der håndterer kommunikationen mellem jeres applikation og serveren, så I integrerer talesyntese i jeres egen kode i stedet for at koble protokollen sammen i hånden. De understøttede udviklingssprog er C og C++, Java samt C#/.NET på Windows.
speechServer kører på Windows Server og på Linux. Bed vores team om den aktuelle liste over understøttede og testede versioner til jeres miljø.
speechServer leverer 16-bit lineær PCM, PCM Wave-varianter, 8-bit A-law- og μ-law-PCM, 4-bit Dialogic ADPCM, mp3 via LAME-pakken og OGG. Dette udvalg dækker både telefonikvalitet og almindelig medieafspilning.
speechServer understøtter ReadSpeakers katalog med mere end 150 AI-stemmer på over 50 sprog. Nye stemmer og sprog tilføjes regelmæssigt. Hvert licenseret sprog omfatter en brugerordbog og IPA-understøttelse til egne udtaler.
speechServer er et kommercielt produkt med support, med et vedligeholdt katalog på 150+ AI-stemmer, fire integrationsveje og installationssupport fra ReadSpeakers supportteam. Open source-projekter kan køre lokalt, men I vedligeholder selv motoren, stemmerne og integrationen, uden en SLA.
speechServer integreres direkte via TCP/IP, kommandolinje, REST eller SDK'er til C, Java og .NET, til almindelige serverbaserede applikationer. ReadSpeaker speechServer MRCP uses the MRCP protocol for standards-based telephony and IVR platforms.
Brugen af speechServer reguleres af en licensfil. Den fastsætter de licenserede stemmer, antallet af samtidige tekst-til-tale-porte, den tilladte syntesehastighed, antallet af dækkede servere og licensperioden. Samtidigheden er kun begrænset af jeres licenserede porte og de tilgængelige systemressourcer.