Vai al contenuto

ReadSpeaker speechEngine SDK Embedded

Sintesi vocale sul dispositivo per sistemi embedded e dispositivi mobili

ReadSpeaker speechEngine SDK Embedded aggiunge voci IA naturali a dispositivi basati su ARM, app mobili e sistemi embedded. Funziona interamente sul dispositivo, senza bisogno di connessione di rete. Oltre 150 voci IA in più di 50 lingue per iOS, Android ed Embedded Linux.

  • Funziona interamente sul dispositivo
  • ARM 32/64 bit
  • Oltre 150 voci · oltre 50 lingue

Perché sul dispositivo

Una voce che funziona con o senza connessione

Molti dispositivi non possono contare sul cloud. Un monitor medicale, un'auto o un controller industriale devono parlare nel momento esatto in cui serve, ogni volta. speechEngine SDK Embedded sintetizza la voce interamente sul dispositivo, così l'uscita audio resta costante e immediata anche senza rete. I suoi dati non lasciano mai l'hardware e la latenza non dipende mai dal segnale.

Pensato per l'embedded

Voce naturale su hardware in cui la maggior parte delle sintesi vocali non entra

Un ingombro ridotto, per scelta progettuale

Ogni voce occupa da 6 a 35 MB di spazio e funziona con 20-30 MB di memoria. Rientra nell'hardware limitato su cui sono costruiti i prodotti embedded, dai controller ARM a 32 bit ai chip mobili a 64 bit, senza rinunciare al suono naturale.

Oltre 150 voci IA in più di 50 lingue

speechEngine SDK Embedded attinge al catalogo ReadSpeaker di oltre 150 voci IA in più di 50 lingue. Nuove voci e nuove lingue vengono aggiunte regolarmente, così lo stesso SDK può portare un prodotto in un mercato o in cinquanta.

Regoli ogni parola che legge

Regoli velocità di lettura, intonazione e volume in base al dispositivo. Usi SSML (Speech Synthesis Markup Language) per inserire pause, cambiare voce o lingua a metà frase e aggiungere trascrizioni fonetiche. Un dizionario utente per lingua con supporto IPA le permette di correggere una volta per tutte la pronuncia di nomi di prodotto e termini di settore, ovunque.

Specifiche tecniche

Pensato per hardware con risorse limitate

speechEngine SDK Embedded è progettato per sistemi a basso ingombro. I valori qui sotto le permettono di dimensionare l'hardware prima di impegnarsi.

Specifiche tecniche di speechEngine SDK Embedded
SpecificationValue
Sistemi operativiiOS · Android · Embedded Linux (altri sistemi operativi embedded su richiesta)
CPUARM 32/64 bit. Neural Standard: 1 GHz o più (solo 64 bit) · Neural Lite: 800 MHz o più
RAMda 6 a 30 MB
Memoria in esecuzioneda 20 a 30 MB (Neural Lite e Neural Standard)
Ingombro della voceda 6 a 32 MB (Neural Lite) · da 9 a 35 MB (Neural Standard), tecnologia Deep Neural Networks
Uscita audio8 formati: PCM lineare a 16 bit, A-law a 8 bit, μ-law a 8 bit, PCM lineare senza segno a 8 bit Wave, Dialogic ADPCM a 4 bit e varianti Wave
Input di testoTesto semplice (multibyte) · SSML (UTF-8)
DocumentazioneScheda tecnica di prodotto (PDF)

Neural Standard e Neural Lite

Due livelli di voce, un solo SDK

Scelga l'equilibrio adatto al suo hardware. Neural Standard funziona su ARM a 64 bit da 1 GHz in su, con voci da 9 a 35 MB per il suono più ricco. Neural Lite funziona su ARM da 800 MHz, con voci da 6 a 32 MB per i dispositivi più compatti. Entrambi usano la tecnologia Deep Neural Network.

Neural Lite e Neural Standard a confronto
Neural LiteNeural Standard
CPUARM 800 MHz o piùARM 1 GHz o più (solo 64 bit)
Ingombro della voceda 6 a 32 MBda 9 a 35 MB
TecnologiaDeep Neural NetworksDeep Neural Networks

Piattaforme

Integri nel linguaggio che già usa

speechEngine SDK Embedded viene fornito con le API, il codice di esempio e la documentazione per integrare rapidamente. Sviluppi in C/C++ su Embedded Linux, Objective-C su iOS o Java su Android. Ogni consegna comprende le librerie del motore vocale, i file delle voci e la documentazione di integrazione per la piattaforma in licenza, oltre al supporto del nostro team.

Piattaforme supportate e relativi linguaggi di integrazione
PlatformLanguage
Embedded LinuxC / C++
iOSObjective-C
AndroidJava

Integrazione

Poche chiamate fino alla prima voce

Inizializzi il motore, carichi una voce e sintetizzi. Al resto pensa l'SDK, sul dispositivo.

/* Illustrative - confirm exact API against the SDK docs before use */
#include "rs_embedded_tts.h"

int main() {
    rsEngine *engine = rsEngineCreate("license.dat");
    rsEngineLoadVoice(engine, "en-US-neural-standard");
    rsEngineSetRate(engine, 1.0);
    rsEngineSpeak(engine, "Welcome aboard.", RS_AUDIO_PCM16);
    rsEngineDestroy(engine);
    return 0;
}

Forma puramente indicativa. Faccia riferimento alla documentazione dell'SDK e al codice di esempio per le firme esatte dell'API della piattaforma che le viene consegnata.

Dove funziona

Voci per dispositivi mission critical

Dalle app mobili all'hardware mission critical, speechEngine SDK Embedded dà ai prodotti una voce affidabile ovunque funzionino, anche nella difesa e in altri ambienti con risorse limitate.

Sistemi di annunci

Voce nitida per i sistemi di allarme e di notifica d'emergenza.

Dispositivi mobili

Audiolibri, apprendimento delle lingue e app mobili che parlano offline, senza bisogno di connessione di rete.

FAQ

Domande su speechEngine SDK Embedded

  • Sì. speechEngine SDK Embedded sintetizza la voce interamente sul dispositivo, senza bisogno di connessione di rete. Tutta l'elaborazione e tutti i dati restano sull'hardware, quindi l'uscita vocale è immediata e costante anche in ambienti offline o con risorse limitate.

  • Supporta iOS, Android ed Embedded Linux già di serie. Altri sistemi operativi embedded possono essere supportati su richiesta. Contatti il nostro team indicando la sua piattaforma di destinazione.

  • Funziona su processori ARM a 32 e 64 bit. Le voci Neural Standard richiedono una CPU ARM a 64 bit da 1 GHz o superiore; le voci Neural Lite funzionano a partire da 800 MHz. L'SDK usa da 6 a 30 MB di RAM e da 20 a 30 MB in esecuzione.

  • Ogni voce occupa da 6 a 32 MB per Neural Lite e da 9 a 35 MB per Neural Standard. Entrambi i livelli usano la tecnologia Deep Neural Network, quindi ottiene un suono naturale con un ingombro adatto all'embedded.

  • speechEngine SDK Embedded supporta oltre 150 voci IA in più di 50 lingue. Nuove voci e nuove lingue vengono aggiunte regolarmente. L'elenco completo è disponibile sul sito ReadSpeaker.

  • Può integrare in C/C++ su Embedded Linux, Objective-C su iOS e Java su Android. Ogni pacchetto SDK comprende le API, il codice di esempio e la documentazione per cominciare.

  • Sì. Usi SSML per regolare la prosodia, inserire pause, aggiungere trascrizioni fonetiche e cambiare voce o lingua a metà testo. Un dizionario utente per lingua con supporto IPA le permette di definire pronunce personalizzate per i termini di settore.

  • Produce 8 formati audio, tra cui PCM lineare a 16 bit, A-law e μ-law a 8 bit, Dialogic ADPCM a 4 bit e diverse varianti Wave. Così può allinearsi alla catena audio del dispositivo di destinazione.

  • speechEngine SDK Embedded è pensato per sistemi sul dispositivo a basso ingombro, su hardware ARM e mobile. speechEngine SDK targets desktop and PC-based applications on Windows and Linux. See speechEngine SDK if you're building for desktop.

Pronto a dare una voce al suo dispositivo?

Ci racconti il suo hardware, le lingue di destinazione e i suoi tempi. Il nostro team embedded la aiuterà a individuare voci, ingombro e piattaforma giusti per il suo prodotto.

Find your ReadSpeaker solution

Opening the conversation…

Search

    Searching…

    No results for

    Try another wording, or start from one of these.

    Search is not available right now.

    You can still reach the pages below.