TCP/IP
Protocolo TCP/IP
Conecte su aplicación directamente al motor speechServer mediante un protocolo de comunicación TCP/IP.
ReadSpeaker speechServer
Ejecute el motor de síntesis de voz de ReadSpeaker en sus propias máquinas Windows Server o Linux. Sus aplicaciones solicitan la voz por TCP/IP, por la herramienta de línea de comandos, por la API REST o mediante los SDK para C, Java y .NET.
DENTRO DE speechServer
ReadSpeaker speechServer es un servidor de síntesis de voz en red con arquitectura cliente-servidor. Usted lo instala en su propia infraestructura y sus aplicaciones solicitan la síntesis de voz a través de la red. Encaja con equipos que necesitan síntesis de voz dentro de su propio entorno, desde asistentes virtuales y plataformas de notificaciones hasta aplicaciones educativas y otros sistemas de servidor que generan audio bajo demanda.
CÓMO SE CONECTA
Su aplicación habla con speechServer de la forma que encaje con su infraestructura. Conéctese mediante un protocolo de red directo, la herramienta de línea de comandos, una API web o un SDK de cliente en su propio lenguaje.
TCP/IP
Conecte su aplicación directamente al motor speechServer mediante un protocolo de comunicación TCP/IP.
CLI
Controle la síntesis de voz desde scripts y procesos de servidor con la herramienta de línea de comandos incluida.
REST
Llame a speechServer mediante una API REST cuando se ejecute detrás de un servidor web con CGI habilitado, como Apache.
SDK
Integre con los SDK de cliente para C, Java y .NET que gestionan la comunicación entre su aplicación y speechServer.
# direct socket connection
connect speechserver:5555
synth "Welcome"speechserver --voice Emma \
--text "Hello" --out out.wavPOST /synthesize
{ "voice": "Emma", "text": "Hi" }// .NET client SDK
var client = new SpeechServer();
client.Synthesize("Welcome");Los ejemplos de código son ilustrativos. Consulte la documentación de usuario para conocer la sintaxis exacta de la API.
EJECÚTELO A SU MANERA
Instale speechServer en la plataforma que ya utiliza su equipo de operaciones.
Instale speechServer en sus máquinas Windows Server, junto a los servicios que ya utiliza su equipo de operaciones.
Instale speechServer en las distribuciones de Linux sobre las que se apoya su infraestructura, desde servidores físicos hasta máquinas virtuales.
SALIDA DE AUDIO
speechServer devuelve el audio a su aplicación en el formato que espera su cadena de procesamiento, desde codificaciones de calidad telefónica hasta formatos multimedia estándar.
VOCES
speechServer utiliza el catálogo de ReadSpeaker de más de 150 voces de IA en más de 50 idiomas, y se añaden nuevas voces e idiomas con regularidad. Cada idioma con licencia incluye un diccionario de usuario para que pueda afinar la pronunciación de los términos específicos de su sector.
Cobertura mundial
CONTROL PRECISO
Module la lectura de su texto hasta el nivel de la palabra, con los controles que su contenido ya incorpora.
Cambie a otra voz, o a otro idioma, en mitad del texto con instrucciones SSML en su entrada. Ajuste la velocidad de habla, el tono y el volumen según convenga.
Defina pronunciaciones personalizadas para palabras y patrones con diccionarios de usuario por idioma y entrada de transcripción IPA, para que los términos del sector se lean correctamente.
Inserte referencias a clips de audio en el texto de entrada. speechServer coloca el audio referenciado en la posición correcta dentro del flujo de salida.
Reciba la información de marcas junto con el audio para disparar eventos en posiciones del texto, sincronizar el dispositivo y la interfaz, y resaltar el texto al ritmo de la reproducción.
DESPLIEGUE
speechServer funciona íntegramente en sus propios servidores, así que el texto y el audio se quedan dentro de su red.
speechServer funciona íntegramente en sus propios servidores, así que el texto y el audio se quedan dentro de su red. Se instala con el instalador de speechServer y se puede añadir cualquier voz de ReadSpeaker que tenga licenciada. El uso se rige por un archivo de licencia que define sus voces, los puertos simultáneos, la velocidad de síntesis, el número de servidores y la duración.
speechServer frente al CÓDIGO ABIERTO
Los proyectos de código abierto pueden ejecutar síntesis de voz en local, pero el mantenimiento del motor, de las voces y de la integración corre por su cuenta. speechServer le ofrece un servidor comercial y con soporte, con un catálogo de voces mantenido.
| ReadSpeaker speechServer | Open-source do-it-yourself | |
|---|---|---|
| Tipo | Producto comercial, con soporte | Código abierto gratuito, mantenido por la comunidad |
| Catálogo de voces | Más de 150 voces de IA, más de 50 idiomas | Aporte el suyo, variable |
| Integración | TCP/IP, línea de comandos, REST, SDK para C/Java/.NET | Montaje hecho en casa |
| Soporte | Equipo de soporte de ReadSpeaker, instalación e implementación | Comunidad |
| Licencias | Archivo de licencia con condiciones definidas | Licencia de proyecto, sin acuerdo de nivel de servicio |
| Actualizaciones de voces | Se añaden con regularidad | Hágalo usted mismo |
FAQ
ReadSpeaker speechServer es un servidor de síntesis de voz en red instalado en sus instalaciones. Usted lo aloja en sus propias máquinas Windows Server o Linux y sus aplicaciones solicitan la síntesis de voz a través de la red. Proporciona el motor de síntesis de voz de ReadSpeaker, una API de servidor y un conjunto de herramientas como entorno de ejecución completo del lado del servidor.
speechServer es autoalojado, no está en la nube: funciona en sus propias máquinas Windows Server o Linux, y su texto y el audio que genera se quedan dentro de su propia red en lugar de pasar por un servicio de terceros. Si prefiere una API en la nube gestionada, ReadSpeaker speechCloud API is the hosted option.
Las aplicaciones cliente se conectan a speechServer mediante un protocolo de comunicación TCP/IP, una herramienta de línea de comandos o una API REST cuando se ejecuta detrás de un servidor web con CGI habilitado, como Apache. También se proporcionan SDK de cliente para C, Java y .NET.
speechServer ofrece SDK de cliente para C, Java y .NET que gestionan la comunicación entre su aplicación y el servidor, de modo que usted integra la síntesis de voz en su propio código en lugar de implementar el protocolo a mano. Los lenguajes de desarrollo admitidos son C y C++, Java y C# / .NET en Windows.
speechServer funciona en Windows Server y en Linux. Pida a nuestro equipo la lista actual de versiones compatibles y probadas para su entorno.
speechServer genera PCM lineal de 16 bits, variantes PCM Wave, PCM A-law y μ-law de 8 bits, ADPCM Dialogic de 4 bits, mp3 mediante el paquete LAME y OGG. Esta gama cubre tanto la calidad telefónica como la reproducción multimedia estándar.
speechServer admite el catálogo de ReadSpeaker de más de 150 voces de IA en más de 50 idiomas. Se añaden nuevas voces e idiomas con regularidad. Cada idioma con licencia incluye un diccionario de usuario y compatibilidad IPA para pronunciaciones personalizadas.
speechServer es un producto comercial con soporte, con un catálogo mantenido de más de 150 voces de IA, cuatro vías de integración y soporte de instalación del equipo de soporte de ReadSpeaker. Los proyectos de código abierto pueden funcionar en local, pero el mantenimiento del motor, de las voces y de la integración corre por su cuenta, sin acuerdo de nivel de servicio.
speechServer se integra directamente por TCP/IP, línea de comandos, REST o los SDK para C, Java y .NET, para aplicaciones de servidor de uso general. ReadSpeaker speechServer MRCP uses the MRCP protocol for standards-based telephony and IVR platforms.
El uso de speechServer se rige por un archivo de licencia. Define las voces licenciadas, el número de puertos simultáneos de síntesis de voz, la velocidad de síntesis permitida, el número de servidores cubiertos y la duración de la licencia. La concurrencia solo está limitada por los puertos que tenga licenciados y por los recursos disponibles del sistema.