Ir al contenido

ReadSpeaker speechEngine SDK Embedded

Síntesis de voz en el dispositivo para sistemas embebidos y móviles

ReadSpeaker speechEngine SDK Embedded añade voces de IA naturales a dispositivos basados en ARM, aplicaciones móviles y sistemas embebidos. Funciona íntegramente en el dispositivo, sin necesidad de conexión de red. Más de 150 voces de IA en más de 50 idiomas para iOS, Android y Linux embebido.

  • Funciona íntegramente en el dispositivo
  • ARM de 32/64 bits
  • Más de 150 voces · más de 50 idiomas

Por qué en el dispositivo

Voz que funciona con conexión y sin ella

Muchos dispositivos no pueden depender de la nube. Un monitor médico, un coche o un controlador industrial tienen que hablar en el momento en que se les necesita, siempre. speechEngine SDK Embedded sintetiza la voz íntegramente en el dispositivo, de modo que la salida de audio se mantiene constante e inmediata incluso sin red. Sus datos nunca salen del hardware y la latencia nunca depende de la cobertura.

Pensado para sistemas embebidos

Voz natural en hardware donde la mayoría de los TTS no caben

Una huella reducida, por diseño

Cada voz ocupa de 6 a 35 MB de almacenamiento y funciona con entre 20 y 30 MB de memoria. Eso encaja en el hardware limitado sobre el que se construyen los productos embebidos, desde controladores ARM de 32 bits hasta chips móviles de 64 bits, sin renunciar a un sonido natural.

Más de 150 voces de IA en más de 50 idiomas

speechEngine SDK Embedded se apoya en el catálogo de ReadSpeaker de más de 150 voces de IA en más de 50 idiomas. Se añaden nuevas voces e idiomas con regularidad, así que el mismo SDK puede llevar un producto a un solo mercado o a cincuenta.

Ajuste cada palabra que lee

Ajuste la velocidad de habla, el tono y el volumen al dispositivo. Use SSML (Speech Synthesis Markup Language) para insertar pausas, cambiar de voz o de idioma a mitad de frase y añadir transcripciones fonéticas. Un diccionario de usuario por idioma con compatibilidad IPA le permite corregir la pronunciación de nombres de producto y términos del sector una sola vez, en todas partes.

Especificaciones técnicas

Pensado para hardware con recursos limitados

speechEngine SDK Embedded está diseñado para sistemas de huella reducida. Las cifras siguientes le permiten dimensionar su hardware antes de comprometerse.

Especificaciones técnicas de speechEngine SDK Embedded
SpecificationValue
Sistemas operativosiOS · Android · Linux embebido (otros SO embebidos a petición)
CPUARM de 32/64 bits. Neural Standard: 1 GHz o más (solo 64 bits) · Neural Lite: 800 MHz o más
RAMDe 6 a 30 MB
Memoria en ejecuciónDe 20 a 30 MB (Neural Lite y Neural Standard)
Huella de la vozDe 6 a 32 MB (Neural Lite) · de 9 a 35 MB (Neural Standard), tecnología de redes neuronales profundas
Salida de audio8 formatos: PCM lineal de 16 bits, A-law de 8 bits, μ-law de 8 bits, PCM lineal sin signo de 8 bits Wave, ADPCM Dialogic de 4 bits y variantes Wave
Entrada de textoTexto sin formato (multibyte) · SSML (UTF-8)
DocumentaciónEspecificación de producto (PDF)

Neural Standard y Neural Lite

Dos niveles de voz, un solo SDK

Elija el equilibrio que encaja con su hardware. Neural Standard funciona en ARM de 64 bits a 1 GHz o más, con voces de 9 a 35 MB para el sonido más rico. Neural Lite funciona en ARM desde 800 MHz, con voces de 6 a 32 MB para los dispositivos más ajustados. Ambos usan tecnología de redes neuronales profundas.

Neural Lite y Neural Standard comparados
Neural LiteNeural Standard
CPUARM de 800 MHz o másARM de 1 GHz o más (solo 64 bits)
Huella de la vozDe 6 a 32 MBDe 9 a 35 MB
TecnologíaRedes neuronales profundasRedes neuronales profundas

Plataformas

Integre en el lenguaje que ya utiliza

speechEngine SDK Embedded se entrega con las API, el código de ejemplo y la documentación para integrarlo rápidamente. Desarrolle en C/C++ sobre Linux embebido, en Objective-C en iOS o en Java en Android. Cada entrega incluye las bibliotecas del motor de voz, los archivos de voz y la documentación de integración de la plataforma que tenga licenciada, además del soporte de nuestro equipo.

Plataformas compatibles y sus lenguajes de integración
PlatformLanguage
Embedded LinuxC / C++
iOSObjective-C
AndroidJava

Integración

Unas pocas llamadas hasta la primera voz

Inicialice el motor, cargue una voz y sintetice. El SDK se encarga del resto en el dispositivo.

/* Illustrative - confirm exact API against the SDK docs before use */
#include "rs_embedded_tts.h"

int main() {
    rsEngine *engine = rsEngineCreate("license.dat");
    rsEngineLoadVoice(engine, "en-US-neural-standard");
    rsEngineSetRate(engine, 1.0);
    rsEngineSpeak(engine, "Welcome aboard.", RS_AUDIO_PCM16);
    rsEngineDestroy(engine);
    return 0;
}

Forma ilustrativa únicamente. Consulte la documentación del SDK y el código de ejemplo para conocer las firmas exactas de la API de la plataforma que reciba.

Dónde funciona

Voces para dispositivos críticos

Desde aplicaciones móviles hasta hardware crítico, speechEngine SDK Embedded da a los productos una voz fiable allá donde funcionen, incluidos entornos de defensa y otros entornos restringidos.

Sistemas de megafonía

Salida de voz clara para sistemas de alarma y notificación de emergencias.

Dispositivos móviles

Audiolibros, aprendizaje de idiomas y aplicaciones móviles que hablan sin conexión, sin necesidad de red.

FAQ

Preguntas sobre speechEngine SDK Embedded

  • Sí. speechEngine SDK Embedded sintetiza la voz íntegramente en el dispositivo, sin necesidad de conexión de red. Todo el procesamiento y los datos permanecen en el hardware, de modo que la salida de voz es inmediata y constante incluso en entornos sin conexión o con recursos limitados.

  • Admite iOS, Android y Linux embebido de serie. Otros sistemas operativos embebidos se pueden admitir a petición. Escriba a nuestro equipo indicando su plataforma de destino.

  • Funciona en procesadores ARM de 32 y 64 bits. Las voces Neural Standard necesitan una CPU ARM de 64 bits a 1 GHz o más; las voces Neural Lite funcionan desde 800 MHz. El SDK usa de 6 a 30 MB de RAM y de 20 a 30 MB en ejecución.

  • Cada voz ocupa de 6 a 32 MB en Neural Lite y de 9 a 35 MB en Neural Standard. Ambos niveles usan tecnología de redes neuronales profundas, así que obtiene un sonido natural con una huella apta para sistemas embebidos.

  • speechEngine SDK Embedded admite más de 150 voces de IA en más de 50 idiomas. Se añaden nuevas voces e idiomas con regularidad. La lista completa está disponible en el sitio web de ReadSpeaker.

  • Puede integrar en C/C++ sobre Linux embebido, Objective-C en iOS y Java en Android. Cada paquete del SDK incluye las API, el código de ejemplo y la documentación para empezar.

  • Sí. Use SSML para ajustar la prosodia, insertar pausas, añadir transcripciones fonéticas y cambiar de voz o de idioma a mitad de texto. Un diccionario de usuario por idioma con compatibilidad IPA le permite definir pronunciaciones personalizadas para términos específicos del sector.

  • Genera 8 formatos de audio, entre ellos PCM lineal de 16 bits, A-law y μ-law de 8 bits, ADPCM Dialogic de 4 bits y varias variantes Wave. Así puede ajustarse a la cadena de audio del dispositivo de destino.

  • speechEngine SDK Embedded está pensado para sistemas de huella reducida que funcionan en el dispositivo, sobre hardware ARM y móvil. speechEngine SDK targets desktop and PC-based applications on Windows and Linux. See speechEngine SDK if you're building for desktop.

¿Preparado para dar voz a su dispositivo?

Cuéntenos su hardware, sus idiomas de destino y sus plazos. Nuestro equipo de sistemas embebidos le ayudará a definir las voces, la huella y la plataforma adecuadas para su producto.

Find your ReadSpeaker solution

Opening the conversation…

Search

    Searching…

    No results for

    Try another wording, or start from one of these.

    Search is not available right now.

    You can still reach the pages below.