TCP/IP
TCP/IP-protokoll
Anslut din applikation direkt till speechServer-motorn via ett TCP/IP-protokoll.
ReadSpeaker speechServer
Kör ReadSpeakers text-till-tal-motor på era egna Windows Server- eller Linux-maskiner. Era applikationer begär tal över TCP/IP, kommandoradsverktyget, REST-API:et eller SDK:erna för C, Java och .NET.
INUTI speechServer
ReadSpeaker speechServer är en nätverksbaserad text-till-tal-server i klient-server-arkitektur. Ni installerar den på er egen infrastruktur, och era applikationer begär talsyntes över nätverket. Den passar team som behöver text-till-tal i sin egen miljö, från virtuella assistenter och aviseringsplattformar till utbildningsapplikationer och andra serverbaserade system som genererar ljud vid behov.
SÅ KOPPLAS DET IHOP
Er applikation talar med speechServer på det sätt som passar er miljö. Anslut över ett direkt nätverksprotokoll, kommandoradsverktyget, ett webb-API eller ett klient-SDK i ert eget språk.
TCP/IP
Anslut din applikation direkt till speechServer-motorn via ett TCP/IP-protokoll.
CLI
Styr talsyntesen från skript och serverprocesser med det medföljande kommandoradsverktyget.
REST
Anropa speechServer via ett REST-API när den körs bakom en CGI-aktiverad webbserver som Apache.
SDK
Integrera med klient-SDK:er för C, Java och .NET som sköter kommunikationen mellan din applikation och speechServer.
# direct socket connection
connect speechserver:5555
synth "Welcome"speechserver --voice Emma \
--text "Hello" --out out.wavPOST /synthesize
{ "voice": "Emma", "text": "Hi" }// .NET client SDK
var client = new SpeechServer();
client.Synthesize("Welcome");Kodexemplen är illustrativa. Se användardokumentationen för den exakta API-syntaxen.
KÖR DET PÅ DITT SÄTT
Installera speechServer på den plattform er drift redan kör.
Installera speechServer på era Windows Server-maskiner, tillsammans med de tjänster er drift redan kör.
Installera speechServer på de Linux-distributioner som er infrastruktur bygger på, från fysiska servrar till virtuella maskiner.
LJUDUTGÅNG
speechServer strömmar tillbaka ljudet till er applikation i det format er pipeline förväntar sig, från kodningar av telefonikvalitet till vanliga medieformat.
RÖSTER
speechServer använder ReadSpeakers katalog med över 150 AI-röster på fler än 50 språk, med nya röster och språk som läggs till löpande. Varje licensierat språk innehåller ett användarlexikon så att ni kan finjustera uttalet av fackspecifika termer.
Global täckning
FINJUSTERAD KONTROLL
Forma framförandet av din text ända ner till ordet, med de reglage ditt innehåll redan bär med sig.
Byt till en annan röst, eller ett annat språk, mitt i texten med SSML-instruktioner i din indata. Justera talhastighet, tonhöjd och volym efter behov.
Definiera egna uttal för ord och mönster med användarlexikon per språk och inmatning av IPA-transkription, så att fackuttryck läses korrekt.
Lägg in referenser till ljudklipp i din indatatext. speechServer placerar det refererade ljudet på rätt position i det strömmade utdataflödet.
Ta emot markeringsinformation tillsammans med ljudet för händelseutlösare vid textpositioner, synkronisering av enhet och gränssnitt, och textmarkering i takt med uppspelningen.
DRIFTSÄTTNING
speechServer körs helt på era egna servrar, så text och ljud stannar i ert nätverk.
speechServer körs helt på era egna servrar, så text och ljud stannar i ert nätverk. Den installeras med speechServer-installationsprogrammet, och vilken licensierad ReadSpeaker-röst som helst kan läggas till. Användningen regleras av en licensfil som anger era röster, samtidiga portar, syntetiseringshastighet, antal servrar och löptid.
speechServer mot ÖPPEN KÄLLKOD
Projekt med öppen källkod kan köra text-till-tal lokalt, men då underhåller ni motorn, rösterna och integrationen själva. speechServer ger er en kommersiell server med support och en underhållen röstkatalog.
| ReadSpeaker speechServer | Open-source do-it-yourself | |
|---|---|---|
| Typ | Kommersiell produkt, med support | Fri öppen källkod, underhållen av en community |
| Röstkatalog | 150+ AI-röster, 50+ språk | Egen lösning, varierar |
| Integration | TCP/IP, kommandorad, REST, SDK:er för C/Java/.NET | Egenbyggd koppling |
| Support | ReadSpeakers supportteam, installation och implementering | Community |
| Licensiering | Licensfil med definierade villkor | Projektlicens, inget SLA |
| Röstuppdateringar | Läggs till löpande | Bygg själv |
Vanliga frågor
ReadSpeaker speechServer är en nätverksbaserad text-till-tal-server i egen drift. Ni driftar den på era egna Windows Server- eller Linux-maskiner, och era applikationer begär talsyntes över nätverket. Den levererar ReadSpeakers text-till-tal-motor, ett server-API och verktyg som en komplett körmiljö på serversidan.
speechServer driftas i egen regi, inte i molnet: den körs på era egna Windows Server- eller Linux-maskiner, och er text och det ljud den genererar stannar i ert eget nätverk i stället för att passera en tredjepartstjänst. Om ni hellre vill ha ett hanterat moln-API, ReadSpeaker speechCloud API is the hosted option.
Klientapplikationer ansluter till speechServer via ett TCP/IP-protokoll, ett kommandoradsverktyg eller ett REST-API när den körs bakom en CGI-aktiverad webbserver som Apache. Klient-SDK:er för C, Java och .NET medföljer också.
speechServer tillhandahåller klient-SDK:er för C, Java och .NET som sköter kommunikationen mellan er applikation och servern, så att ni integrerar talsyntesen i er egen kod i stället för att koppla protokollet för hand. Utvecklingsspråk som stöds är C och C++, Java samt C#/.NET på Windows.
speechServer körs på Windows Server och på Linux. Fråga vårt team om den aktuella listan över versioner som stöds och har testats för er miljö.
speechServer levererar 16-bitars linjär PCM, PCM Wave-varianter, 8-bitars A-law- och μ-law-PCM, 4-bitars Dialogic ADPCM, mp3 via LAME-paketet och OGG. Det spannet täcker både telefonikvalitet och vanlig medieuppspelning.
speechServer stöder ReadSpeakers katalog med över 150 AI-röster på fler än 50 språk. Nya röster och språk läggs till löpande. Varje licensierat språk innehåller ett användarlexikon och stöd för IPA för egna uttal.
speechServer är en kommersiell produkt med support, en underhållen katalog med 150+ AI-röster, fyra integrationsvägar och installationsstöd från ReadSpeakers supportteam. Projekt med öppen källkod kan köras lokalt, men då underhåller ni motorn, rösterna och integrationen själva, utan något SLA.
speechServer integreras direkt via TCP/IP, kommandorad, REST eller SDK:er för C, Java och .NET, för allmänna serverbaserade applikationer. ReadSpeaker speechServer MRCP uses the MRCP protocol for standards-based telephony and IVR platforms.
Användningen av speechServer regleras av en licensfil. Den anger licensierade röster, antalet samtidiga text-till-tal-portar, tillåten syntetiseringshastighet, antalet servrar som omfattas och licensens löptid. Samtidigheten begränsas bara av era licensierade portar och tillgängliga systemresurser.