TCP/IP
Protokół TCP/IP
Połącz swoją aplikację bezpośrednio z silnikiem speechServer przez protokół komunikacyjny TCP/IP.
ReadSpeaker speechServer
Uruchom silnik syntezy mowy ReadSpeaker na własnych maszynach z systemem Windows Server lub Linux. Twoje aplikacje żądają mowy przez TCP/IP, narzędzie wiersza poleceń, API REST albo zestawy SDK dla C, Javy i .NET.
WEWNĄTRZ speechServer
ReadSpeaker speechServer to sieciowy serwer syntezy mowy w architekturze klient-serwer. Instalujesz go na własnej infrastrukturze, a Twoje aplikacje żądają syntezy mowy przez sieć. Sprawdza się w zespołach, które potrzebują syntezy mowy we własnym środowisku, od asystentów wirtualnych i platform powiadomień po aplikacje edukacyjne i inne systemy serwerowe generujące dźwięk na żądanie.
JAK TO SIĘ ŁĄCZY
Twoja aplikacja komunikuje się ze speechServer w sposób pasujący do Twojego środowiska. Połącz się bezpośrednim protokołem sieciowym, przez narzędzie wiersza poleceń, przez API internetowe albo przez zestaw SDK w Twoim własnym języku.
TCP/IP
Połącz swoją aplikację bezpośrednio z silnikiem speechServer przez protokół komunikacyjny TCP/IP.
CLI
Steruj syntezą mowy ze skryptów i procesów serwerowych za pomocą dołączonego narzędzia wiersza poleceń.
REST
Wywołuj speechServer przez API REST, gdy działa za serwerem WWW z obsługą CGI, takim jak Apache.
SDK
Integruj się za pomocą zestawów SDK po stronie klienta dla C, Javy i .NET, które obsługują komunikację między Twoją aplikacją a speechServer.
# direct socket connection
connect speechserver:5555
synth "Welcome"speechserver --voice Emma \
--text "Hello" --out out.wavPOST /synthesize
{ "voice": "Emma", "text": "Hi" }// .NET client SDK
var client = new SpeechServer();
client.Synthesize("Welcome");Przykłady kodu mają charakter poglądowy. Dokładną składnię API znajdziesz w dokumentacji użytkownika.
URUCHOM PO SWOJEMU
Zainstaluj speechServer na platformie, z której już korzysta Twój zespół utrzymania.
Zainstaluj speechServer na swoich maszynach z systemem Windows Server, obok usług, które już prowadzi Twój zespół utrzymania.
Zainstaluj speechServer w dystrybucjach Linuksa, na których zbudowana jest Twoja infrastruktura, od maszyn fizycznych po wirtualne.
WYJŚCIE AUDIO
speechServer odsyła dźwięk strumieniem do Twojej aplikacji w formacie, którego oczekuje Twój potok, od kodowań klasy telefonicznej po standardowe formaty multimedialne.
GŁOSY
speechServer korzysta z katalogu ReadSpeaker obejmującego ponad 150 głosów AI w ponad 50 językach, a nowe głosy i języki są dodawane regularnie. Każdy licencjonowany język obejmuje słownik użytkownika, dzięki czemu możesz dopracować wymowę terminów branżowych.
Zasięg globalny
PRECYZYJNA KONTROLA
Kształtuj sposób odczytania tekstu aż do pojedynczego słowa, korzystając z informacji, które Twoje treści już zawierają.
Zmieniaj głos lub język w trakcie tekstu za pomocą instrukcji SSML w danych wejściowych. Dostosuj tempo mowy, wysokość i głośność według potrzeb.
Zdefiniuj własną wymowę słów i wzorców w słownikach użytkownika dla każdego języka, z zapisem w IPA, aby terminy branżowe były czytane poprawnie.
Wstawiaj odwołania do klipów audio w tekście wejściowym. speechServer umieszcza wskazany dźwięk w odpowiednim miejscu strumienia wyjściowego.
Otrzymuj wraz z dźwiękiem znaczniki informacyjne do wyzwalania zdarzeń w określonych miejscach tekstu, synchronizacji urządzeń i interfejsu oraz podświetlania tekstu zgodnego z odtwarzaniem.
WDROŻENIE
speechServer działa w całości na Twoich własnych serwerach, więc tekst i dźwięk pozostają w Twojej sieci.
speechServer działa w całości na Twoich własnych serwerach, więc tekst i dźwięk pozostają w Twojej sieci. Instaluje się go instalatorem speechServer i można dodać dowolny licencjonowany głos ReadSpeaker. Użytkowanie reguluje plik licencji, który określa Twoje głosy, liczbę równoczesnych portów, szybkość syntezy, liczbę serwerów i okres obowiązywania.
speechServer a OPEN SOURCE
Projekty open source mogą uruchamiać syntezę mowy lokalnie, ale silnik, głosy i integrację utrzymujesz samodzielnie. speechServer daje Ci komercyjny serwer ze wsparciem i utrzymywanym katalogiem głosów.
| ReadSpeaker speechServer | Open-source do-it-yourself | |
|---|---|---|
| Typ | Produkt komercyjny ze wsparciem | Bezpłatne rozwiązanie open source, utrzymywane przez społeczność |
| Katalog głosów | Ponad 150 głosów AI, ponad 50 języków | Rozwiązanie własne, różnie |
| Integracja | TCP/IP, wiersz poleceń, REST, zestawy SDK dla C, Javy i .NET | Samodzielne łączenie elementów |
| Wsparcie | Zespół wsparcia ReadSpeaker, instalacja i wdrożenie | Społeczność |
| Licencjonowanie | Plik licencji z określonymi warunkami | Licencja projektowa, bez umowy SLA |
| Aktualizacje głosów | Dodawane regularnie | Rozwiązanie własne |
Najczęstsze pytania
ReadSpeaker speechServer to sieciowy serwer syntezy mowy działający na własnej infrastrukturze. Hostujesz go na swoich maszynach z systemem Windows Server lub Linux, a Twoje aplikacje żądają syntezy mowy przez sieć. Dostarcza silnik syntezy mowy ReadSpeaker, serwerowe API i narzędzia jako kompletne środowisko uruchomieniowe po stronie serwera.
speechServer jest hostowany samodzielnie, a nie w chmurze: działa na Twoich własnych maszynach z systemem Windows Server lub Linux, a Twój tekst i generowany dźwięk pozostają w Twojej sieci, zamiast przechodzić przez usługę podmiotu trzeciego. Jeśli wolisz zarządzane API w chmurze, ReadSpeaker speechCloud API is the hosted option.
Aplikacje klienckie łączą się ze speechServer przez protokół komunikacyjny TCP/IP, narzędzie wiersza poleceń lub API REST, gdy serwer działa za serwerem WWW z obsługą CGI, takim jak Apache. Dostarczane są również zestawy SDK po stronie klienta dla C, Javy i .NET.
speechServer udostępnia zestawy SDK po stronie klienta dla C, Javy i .NET, które obsługują komunikację między Twoją aplikacją a serwerem, dzięki czemu integrujesz syntezę mowy we własnym kodzie, zamiast ręcznie obsługiwać protokół. Obsługiwane języki programowania to C i C++, Java oraz C# i .NET w systemie Windows.
speechServer działa w systemie Windows Server i w systemie Linux. Poproś nasz zespół o aktualną listę obsługiwanych i przetestowanych wersji dla Twojego środowiska.
speechServer generuje 16-bitowy liniowy PCM, warianty PCM Wave, 8-bitowy A-law i μ-law PCM, 4-bitowy Dialogic ADPCM, mp3 przez pakiet LAME oraz OGG. Ten zakres obejmuje zarówno formaty klasy telefonicznej, jak i standardowe odtwarzanie multimediów.
speechServer korzysta z katalogu ReadSpeaker obejmującego ponad 150 głosów AI w ponad 50 językach. Nowe głosy i języki są dodawane regularnie. Każdy licencjonowany język obejmuje słownik użytkownika i obsługę IPA dla własnej wymowy.
speechServer to komercyjny produkt ze wsparciem, utrzymywanym katalogiem ponad 150 głosów AI, czterema ścieżkami integracji i pomocą przy instalacji od zespołu wsparcia ReadSpeaker. Projekty open source mogą działać lokalnie, ale silnik, głosy i integrację utrzymujesz samodzielnie, bez umowy SLA.
speechServer integruje się bezpośrednio przez TCP/IP, wiersz poleceń, REST albo zestawy SDK dla C, Javy i .NET, z myślą o ogólnych aplikacjach serwerowych. ReadSpeaker speechServer MRCP uses the MRCP protocol for standards-based telephony and IVR platforms.
Użytkowanie speechServer reguluje plik licencji. Określa on licencjonowane głosy, liczbę równoczesnych portów syntezy mowy, dozwoloną szybkość syntezy, liczbę objętych serwerów oraz okres obowiązywania licencji. Liczba równoczesnych zadań ograniczona jest wyłącznie liczbą licencjonowanych portów i dostępnymi zasobami systemowymi.