TCP/IP
Protocolo TCP/IP
Ligue a sua aplicação diretamente ao motor speechServer através de um protocolo de comunicação TCP/IP.
ReadSpeaker speechServer
Execute o motor de conversão de texto em voz da ReadSpeaker nas suas próprias máquinas Windows Server ou Linux. As suas aplicações pedem voz através de TCP/IP, da ferramenta de linha de comandos, da API REST ou dos SDK para C, Java e .NET.
DENTRO DO speechServer
O ReadSpeaker speechServer é um servidor de conversão de texto em voz em rede, com arquitetura cliente-servidor. Instala-o na sua própria infraestrutura e as suas aplicações pedem a síntese de voz através da rede. Serve equipas que precisam de conversão de texto em voz dentro do seu próprio ambiente, de assistentes virtuais e plataformas de notificação a aplicações educativas e a outros sistemas de servidor que geram áudio a pedido.
COMO SE LIGA
A sua aplicação fala com o speechServer da forma que melhor se adapta à sua infraestrutura. Ligue-se através de um protocolo de rede direto, da ferramenta de linha de comandos, de uma API Web ou de um SDK de cliente na sua própria linguagem.
TCP/IP
Ligue a sua aplicação diretamente ao motor speechServer através de um protocolo de comunicação TCP/IP.
CLI
Comande a síntese de voz a partir de scripts e de processos de servidor, com a ferramenta de linha de comandos incluída.
REST
Chame o speechServer através de uma API REST quando este funciona atrás de um servidor Web com CGI ativado, como o Apache.
SDK
Integre com os SDK do lado do cliente para C, Java e .NET, que tratam da comunicação entre a sua aplicação e o speechServer.
# direct socket connection
connect speechserver:5555
synth "Welcome"speechserver --voice Emma \
--text "Hello" --out out.wavPOST /synthesize
{ "voice": "Emma", "text": "Hi" }// .NET client SDK
var client = new SpeechServer();
client.Synthesize("Welcome");Os exemplos de código são ilustrativos. Consulte a documentação do utilizador para conhecer a sintaxe exata da API.
FAÇA À SUA MANEIRA
Instale o speechServer na plataforma que as suas operações já utilizam.
Instale o speechServer nas suas máquinas Windows Server, ao lado dos serviços que as suas operações já utilizam.
Instale o speechServer nas distribuições Linux em que assenta a sua infraestrutura, do hardware dedicado às máquinas virtuais.
SAÍDA DE ÁUDIO
O speechServer devolve áudio à sua aplicação no formato que o seu pipeline espera, das codificações de qualidade telefónica aos formatos de média correntes.
VOZES
O speechServer usa o catálogo ReadSpeaker de mais de 150 vozes de IA em mais de 50 idiomas, com novas vozes e novos idiomas acrescentados regularmente. Cada idioma licenciado inclui um dicionário de utilizador, para que possa afinar a pronúncia de termos específicos do domínio.
Cobertura mundial
CONTROLO FINO
Molde a leitura do seu texto até ao nível da palavra, com os comandos que o seu conteúdo já traz.
Mude de voz, ou de idioma, no meio do texto, com instruções SSML na sua entrada. Ajuste o ritmo de leitura, o tom e o volume conforme necessário.
Defina pronúncias personalizadas para palavras e padrões com dicionários de utilizador por idioma e entrada de transcrição IPA, para que os termos do domínio sejam lidos corretamente.
Insira referências a excertos de áudio no texto de entrada. O speechServer coloca o áudio referenciado na posição certa da saída transmitida.
Receba informação de marcas juntamente com o áudio, para acionar eventos em posições do texto, sincronizar dispositivos e interfaces, e alinhar o realce do texto com a reprodução.
IMPLEMENTAÇÃO
O speechServer funciona inteiramente nos seus próprios servidores, pelo que o texto e o áudio ficam dentro da sua rede.
O speechServer funciona inteiramente nos seus próprios servidores, pelo que o texto e o áudio ficam dentro da sua rede. Instala-se com o instalador do speechServer e pode acrescentar-se qualquer voz ReadSpeaker licenciada. A utilização é regida por um ficheiro de licença que define as suas vozes, as portas em simultâneo, a velocidade de síntese, o número de servidores e o prazo.
speechServer face ao CÓDIGO ABERTO
Os projetos de código aberto podem executar conversão de texto em voz localmente, mas é a si que cabe manter o motor, as vozes e a integração. O speechServer dá-lhe um servidor comercial, com suporte e com um catálogo de vozes mantido.
| ReadSpeaker speechServer | Open-source do-it-yourself | |
|---|---|---|
| Tipo | Produto comercial, com suporte | Código aberto gratuito, mantido pela comunidade |
| Catálogo de vozes | Mais de 150 vozes de IA, mais de 50 idiomas | Traga o seu, variável |
| Integração | TCP/IP, linha de comandos, REST, SDK para C/Java/.NET | Montagem feita por si |
| Suporte | Equipa de suporte da ReadSpeaker, instalação e implementação | Comunidade |
| Licenciamento | Ficheiro de licença com condições definidas | Licença de projeto, sem SLA |
| Atualizações de vozes | Adicionadas regularmente | Feito por si |
FAQ
O ReadSpeaker speechServer é um servidor de conversão de texto em voz em rede, instalado nas suas instalações. Aloja-o nas suas máquinas Windows Server ou Linux, e as suas aplicações pedem a síntese de voz através da rede. Fornece o motor de conversão de texto em voz da ReadSpeaker, uma API de servidor e ferramentas, como ambiente de execução completo do lado do servidor.
O speechServer é alojado por si, não está na nuvem: funciona nas suas máquinas Windows Server ou Linux, e o seu texto e o áudio que ele gera ficam dentro da sua própria rede, em vez de passarem por um serviço de terceiros. Se preferir uma API gerida na nuvem, ReadSpeaker speechCloud API is the hosted option.
As aplicações cliente ligam-se ao speechServer através de um protocolo de comunicação TCP/IP, de uma ferramenta de linha de comandos ou de uma API REST quando este funciona atrás de um servidor Web com CGI ativado, como o Apache. São também fornecidos SDK para o lado do cliente em C, Java e .NET.
O speechServer fornece SDK do lado do cliente para C, Java e .NET, que tratam da comunicação entre a sua aplicação e o servidor, para que integre a síntese de voz no seu próprio código em vez de montar o protocolo à mão. As linguagens de desenvolvimento suportadas são C e C++, Java, e C# / .NET em Windows.
O speechServer funciona em Windows Server e em Linux. Peça à nossa equipa a lista atual de versões suportadas e testadas para o seu ambiente.
O speechServer produz PCM linear de 16 bits, variantes PCM Wave, PCM A-law e μ-law de 8 bits, ADPCM Dialogic de 4 bits, mp3 através do pacote LAME, e OGG. Esta gama abrange tanto a qualidade telefónica como a reprodução de média corrente.
O speechServer suporta o catálogo ReadSpeaker de mais de 150 vozes de IA em mais de 50 idiomas. São acrescentadas regularmente novas vozes e novos idiomas. Cada idioma licenciado inclui um dicionário de utilizador e suporte de IPA para pronúncias personalizadas.
O speechServer é um produto comercial, com suporte, com um catálogo mantido de mais de 150 vozes de IA, quatro caminhos de integração e apoio à instalação da equipa de suporte da ReadSpeaker. Os projetos de código aberto podem funcionar localmente, mas é a si que cabe manter o motor, as vozes e a integração, sem qualquer SLA.
O speechServer integra-se diretamente através de TCP/IP, da linha de comandos, de REST ou dos SDK para C, Java e .NET, para aplicações gerais assentes em servidor. ReadSpeaker speechServer MRCP uses the MRCP protocol for standards-based telephony and IVR platforms.
A utilização do speechServer é regida por um ficheiro de licença. Define as vozes licenciadas, o número de portas de conversão de texto em voz em simultâneo, a velocidade de síntese permitida, o número de servidores abrangidos e o prazo da licença. A concorrência é limitada apenas pelas portas que licenciou e pelos recursos do sistema disponíveis.