Przejdź do treści

ReadSpeaker speechServer

Serwer syntezy mowy dla Twojej własnej sieci

Uruchom silnik syntezy mowy ReadSpeaker na własnych maszynach z systemem Windows Server lub Linux. Twoje aplikacje żądają mowy przez TCP/IP, narzędzie wiersza poleceń, API REST albo zestawy SDK dla C, Javy i .NET.

  • Ponad 150 głosów AI
  • Ponad 50 języków
  • Hostowane samodzielnie na Windows Server lub Linux

WEWNĄTRZ speechServer

Serwer syntezy mowy, który hostujesz samodzielnie

ReadSpeaker speechServer to sieciowy serwer syntezy mowy w architekturze klient-serwer. Instalujesz go na własnej infrastrukturze, a Twoje aplikacje żądają syntezy mowy przez sieć. Sprawdza się w zespołach, które potrzebują syntezy mowy we własnym środowisku, od asystentów wirtualnych i platform powiadomień po aplikacje edukacyjne i inne systemy serwerowe generujące dźwięk na żądanie.

JAK TO SIĘ ŁĄCZY

Cztery sposoby integracji aplikacji

Twoja aplikacja komunikuje się ze speechServer w sposób pasujący do Twojego środowiska. Połącz się bezpośrednim protokołem sieciowym, przez narzędzie wiersza poleceń, przez API internetowe albo przez zestaw SDK w Twoim własnym języku.

TCP/IP

Protokół TCP/IP

Połącz swoją aplikację bezpośrednio z silnikiem speechServer przez protokół komunikacyjny TCP/IP.

CLI

Narzędzie wiersza poleceń

Steruj syntezą mowy ze skryptów i procesów serwerowych za pomocą dołączonego narzędzia wiersza poleceń.

REST

API REST

Wywołuj speechServer przez API REST, gdy działa za serwerem WWW z obsługą CGI, takim jak Apache.

SDK

Zestawy SDK dla C, Javy i .NET

Integruj się za pomocą zestawów SDK po stronie klienta dla C, Javy i .NET, które obsługują komunikację między Twoją aplikacją a speechServer.

# direct socket connection
connect speechserver:5555
synth "Welcome"

Przykłady kodu mają charakter poglądowy. Dokładną składnię API znajdziesz w dokumentacji użytkownika.

URUCHOM PO SWOJEMU

Działa na Windows Server i Linux

Zainstaluj speechServer na platformie, z której już korzysta Twój zespół utrzymania.

Windows Server

Zainstaluj speechServer na swoich maszynach z systemem Windows Server, obok usług, które już prowadzi Twój zespół utrzymania.

Linux

Zainstaluj speechServer w dystrybucjach Linuksa, na których zbudowana jest Twoja infrastruktura, od maszyn fizycznych po wirtualne.

WYJŚCIE AUDIO

Strumieniuj format audio, którego potrzebuje Twój system

speechServer odsyła dźwięk strumieniem do Twojej aplikacji w formacie, którego oczekuje Twój potok, od kodowań klasy telefonicznej po standardowe formaty multimedialne.

PCM

16-bitowy liniowy

PCM Wave

16-bitowy liniowy i warianty

A-law

8-bitowy PCM

μ-law

8-bitowy PCM

ADPCM

4-bitowy Dialogic

mp3

przez pakiet LAME

OGG

otwarty kontener

GŁOSY

Ponad 150 głosów AI w ponad 50 językach

speechServer korzysta z katalogu ReadSpeaker obejmującego ponad 150 głosów AI w ponad 50 językach, a nowe głosy i języki są dodawane regularnie. Każdy licencjonowany język obejmuje słownik użytkownika, dzięki czemu możesz dopracować wymowę terminów branżowych.

Zasięg globalny

Ponad 150 głosów AI w ponad 50 językach

Poznaj wszystkie głosy

Available languages

PRECYZYJNA KONTROLA

Kontroluj, jak wymawiane jest każde słowo

Kształtuj sposób odczytania tekstu aż do pojedynczego słowa, korzystając z informacji, które Twoje treści już zawierają.

Zmiana głosu i języka przez SSML

Zmieniaj głos lub język w trakcie tekstu za pomocą instrukcji SSML w danych wejściowych. Dostosuj tempo mowy, wysokość i głośność według potrzeb.

Słownik użytkownika i IPA

Zdefiniuj własną wymowę słów i wzorców w słownikach użytkownika dla każdego języka, z zapisem w IPA, aby terminy branżowe były czytane poprawnie.

Wstawianie klipów audio

Wstawiaj odwołania do klipów audio w tekście wejściowym. speechServer umieszcza wskazany dźwięk w odpowiednim miejscu strumienia wyjściowego.

Znaczniki informacyjne

Otrzymuj wraz z dźwiękiem znaczniki informacyjne do wyzwalania zdarzeń w określonych miejscach tekstu, synchronizacji urządzeń i interfejsu oraz podświetlania tekstu zgodnego z odtwarzaniem.

WDROŻENIE

Twoja synteza mowy pozostaje w Twojej sieci

speechServer działa w całości na Twoich własnych serwerach, więc tekst i dźwięk pozostają w Twojej sieci.

Zainstalowane, licencjonowane i obsługiwane przez Ciebie

speechServer działa w całości na Twoich własnych serwerach, więc tekst i dźwięk pozostają w Twojej sieci. Instaluje się go instalatorem speechServer i można dodać dowolny licencjonowany głos ReadSpeaker. Użytkowanie reguluje plik licencji, który określa Twoje głosy, liczbę równoczesnych portów, szybkość syntezy, liczbę serwerów i okres obowiązywania.

  • Wsparcie przy instalacji i wdrożeniu zapewnia zespół wsparcia ReadSpeaker w ramach usługi.

speechServer a OPEN SOURCE

Wspierana alternatywa dla samodzielnie budowanej syntezy mowy

Projekty open source mogą uruchamiać syntezę mowy lokalnie, ale silnik, głosy i integrację utrzymujesz samodzielnie. speechServer daje Ci komercyjny serwer ze wsparciem i utrzymywanym katalogiem głosów.

ReadSpeaker speechServer w porównaniu z samodzielnie budowaną syntezą mowy open source
ReadSpeaker speechServerOpen-source do-it-yourself
TypProdukt komercyjny ze wsparciemBezpłatne rozwiązanie open source, utrzymywane przez społeczność
Katalog głosówPonad 150 głosów AI, ponad 50 językówRozwiązanie własne, różnie
IntegracjaTCP/IP, wiersz poleceń, REST, zestawy SDK dla C, Javy i .NETSamodzielne łączenie elementów
WsparcieZespół wsparcia ReadSpeaker, instalacja i wdrożenieSpołeczność
LicencjonowaniePlik licencji z określonymi warunkamiLicencja projektowa, bez umowy SLA
Aktualizacje głosówDodawane regularnieRozwiązanie własne

Najczęstsze pytania

Pytania o speechServer

  • ReadSpeaker speechServer to sieciowy serwer syntezy mowy działający na własnej infrastrukturze. Hostujesz go na swoich maszynach z systemem Windows Server lub Linux, a Twoje aplikacje żądają syntezy mowy przez sieć. Dostarcza silnik syntezy mowy ReadSpeaker, serwerowe API i narzędzia jako kompletne środowisko uruchomieniowe po stronie serwera.

  • speechServer jest hostowany samodzielnie, a nie w chmurze: działa na Twoich własnych maszynach z systemem Windows Server lub Linux, a Twój tekst i generowany dźwięk pozostają w Twojej sieci, zamiast przechodzić przez usługę podmiotu trzeciego. Jeśli wolisz zarządzane API w chmurze, ReadSpeaker speechCloud API is the hosted option.

  • Aplikacje klienckie łączą się ze speechServer przez protokół komunikacyjny TCP/IP, narzędzie wiersza poleceń lub API REST, gdy serwer działa za serwerem WWW z obsługą CGI, takim jak Apache. Dostarczane są również zestawy SDK po stronie klienta dla C, Javy i .NET.

  • speechServer udostępnia zestawy SDK po stronie klienta dla C, Javy i .NET, które obsługują komunikację między Twoją aplikacją a serwerem, dzięki czemu integrujesz syntezę mowy we własnym kodzie, zamiast ręcznie obsługiwać protokół. Obsługiwane języki programowania to C i C++, Java oraz C# i .NET w systemie Windows.

  • speechServer działa w systemie Windows Server i w systemie Linux. Poproś nasz zespół o aktualną listę obsługiwanych i przetestowanych wersji dla Twojego środowiska.

  • speechServer generuje 16-bitowy liniowy PCM, warianty PCM Wave, 8-bitowy A-law i μ-law PCM, 4-bitowy Dialogic ADPCM, mp3 przez pakiet LAME oraz OGG. Ten zakres obejmuje zarówno formaty klasy telefonicznej, jak i standardowe odtwarzanie multimediów.

  • speechServer korzysta z katalogu ReadSpeaker obejmującego ponad 150 głosów AI w ponad 50 językach. Nowe głosy i języki są dodawane regularnie. Każdy licencjonowany język obejmuje słownik użytkownika i obsługę IPA dla własnej wymowy.

  • speechServer to komercyjny produkt ze wsparciem, utrzymywanym katalogiem ponad 150 głosów AI, czterema ścieżkami integracji i pomocą przy instalacji od zespołu wsparcia ReadSpeaker. Projekty open source mogą działać lokalnie, ale silnik, głosy i integrację utrzymujesz samodzielnie, bez umowy SLA.

  • speechServer integruje się bezpośrednio przez TCP/IP, wiersz poleceń, REST albo zestawy SDK dla C, Javy i .NET, z myślą o ogólnych aplikacjach serwerowych. ReadSpeaker speechServer MRCP uses the MRCP protocol for standards-based telephony and IVR platforms.

  • Użytkowanie speechServer reguluje plik licencji. Określa on licencjonowane głosy, liczbę równoczesnych portów syntezy mowy, dozwoloną szybkość syntezy, liczbę objętych serwerów oraz okres obowiązywania licencji. Liczba równoczesnych zadań ograniczona jest wyłącznie liczbą licencjonowanych portów i dostępnymi zasobami systemowymi.

Gotowi, aby prowadzić własny serwer syntezy mowy?

Opowiedz nam o swoim środowisku i o głosach, których potrzebujesz. Nasz zespół pomoże Ci dobrać skalę speechServer, wybrać ścieżkę integracji i zaplanować wdrożenie na Twojej infrastrukturze z systemem Windows Server lub Linux.

Find your ReadSpeaker solution

Opening the conversation…

Search

    Searching…

    No results for

    Try another wording, or start from one of these.

    Search is not available right now.

    You can still reach the pages below.