Gå til indhold

ReadSpeaker speechEngine SDK Embedded

Tekst-til-tale på selve enheden til indlejrede og mobile enheder

ReadSpeaker speechEngine SDK Embedded tilføjer naturlige AI-stemmer til ARM-baserede enheder, mobilapps og indlejrede systemer. Det kører udelukkende på enheden, uden krav om netværksforbindelse. 150+ AI-stemmer på 50+ sprog til iOS, Android og Embedded Linux.

  • Kører udelukkende på enheden
  • ARM 32/64-bit
  • 150+ stemmer · 50+ sprog

Hvorfor på selve enheden

Tale, der virker med eller uden forbindelse

Mange enheder kan ikke regne med skyen. En medicinsk monitor, en bil eller en industriel styreenhed skal kunne tale i det øjeblik, det er nødvendigt, hver gang. speechEngine SDK Embedded syntetiserer tale udelukkende på enheden, så lyden forbliver ensartet og øjeblikkelig, også uden netværk. Jeres data forlader aldrig hardwaren, og forsinkelsen afhænger aldrig af et signal.

Bygget til indlejrede systemer

Naturlig stemme på hardware, hvor de fleste TTS-løsninger ikke kan være

Et lille fodaftryk, helt bevidst

Hver stemme fylder 6 til 35 MB lagerplads og kører i 20 til 30 MB hukommelse. Det passer til den begrænsede hardware, indlejrede produkter bygges på, fra ARM 32-bit-controllere til 64-bit mobilchips, uden at gå på kompromis med den naturlige lyd.

150+ AI-stemmer på 50+ sprog

speechEngine SDK Embedded trækker på ReadSpeakers katalog med mere end 150 AI-stemmer på over 50 sprog. Nye stemmer og sprog tilføjes regelmæssigt, så det samme SDK kan sende et produkt på markedet i ét land eller i halvtreds.

Finjustér hvert ord, den læser

Justér talehastighed, toneleje og lydstyrke, så det passer til enheden. Brug SSML (Speech Synthesis Markup Language) til at indsætte pauser, skifte stemme eller sprog midt i en sætning og tilføje fonetiske transskriptioner. En brugerordbog pr. sprog med IPA-understøttelse lader jer rette udtalen af produktnavne og fagtermer én gang, med virkning overalt.

Tekniske specifikationer

Bygget til hardware med begrænsede ressourcer

speechEngine SDK Embedded er konstrueret til systemer med lille fodaftryk. Tallene nedenfor lader jer dimensionere jeres hardware, før I binder jer.

Tekniske specifikationer for speechEngine SDK Embedded
SpecificationValue
StyresystemeriOS · Android · Embedded Linux (andre indlejrede styresystemer på forespørgsel)
CPUARM 32/64-bit. Neural Standard: 1 GHz eller derover (kun 64-bit) · Neural Lite: 800 MHz eller derover
RAM6 til 30 MB
Hukommelse under kørsel20 til 30 MB (Neural Lite og Neural Standard)
Stemmens fodaftryk6 til 32 MB (Neural Lite) · 9 til 35 MB (Neural Standard), Deep Neural Networks-teknologi
Lydoutput8 formater: 16-bit lineær PCM, 8-bit A-law, 8-bit μ-law, 8-bit unsigned lineær PCM Wave, 4-bit Dialogic ADPCM og Wave-varianter
TekstinputRen tekst (multibyte) · SSML (UTF-8)
DokumentationProduktspecifikation (PDF)

Neural Standard og Neural Lite

To stemmeniveauer, ét SDK

Vælg den balance, der passer til jeres hardware. Neural Standard kører på 64-bit ARM fra 1 GHz og opefter med stemmer fra 9 til 35 MB for den rigeste lyd. Neural Lite kører på ARM fra 800 MHz med stemmer fra 6 til 32 MB til de mest begrænsede enheder. Begge bruger Deep Neural Network-teknologi.

Neural Lite og Neural Standard sammenlignet
Neural LiteNeural Standard
CPUARM 800 MHz+ARM 1 GHz+ (kun 64-bit)
Stemmens fodaftryk6 til 32 MB9 til 35 MB
TeknologiDeep Neural NetworksDeep Neural Networks

Platforme

Integrér i det programmeringssprog, I allerede bruger

speechEngine SDK Embedded leveres med API'erne, eksempelkoden og dokumentationen til en hurtig integration. Byg i C/C++ på Embedded Linux, Objective-C på iOS eller Java på Android. Hver levering omfatter talemotorens biblioteker, stemmefilerne og integrationsdokumentationen til jeres licenserede platform samt support fra vores team.

Understøttede platforme og deres integrationssprog
PlatformLanguage
Embedded LinuxC / C++
iOSObjective-C
AndroidJava

Integration

Få kald til den første tale

Initialisér motoren, indlæs en stemme, og syntetisér. SDK'et klarer resten på enheden.

/* Illustrative - confirm exact API against the SDK docs before use */
#include "rs_embedded_tts.h"

int main() {
    rsEngine *engine = rsEngineCreate("license.dat");
    rsEngineLoadVoice(engine, "en-US-neural-standard");
    rsEngineSetRate(engine, 1.0);
    rsEngineSpeak(engine, "Welcome aboard.", RS_AUDIO_PCM16);
    rsEngineDestroy(engine);
    return 0;
}

Kun vejledende form. Se SDK-dokumentationen og eksempelkoden for de præcise API-signaturer på den platform, I har fået leveret.

Hvor den kører

Stemmer til forretningskritiske enheder

Fra mobilapps til forretningskritisk hardware giver speechEngine SDK Embedded produkter en pålidelig stemme, uanset hvor de kører, også inden for forsvar og andre miljøer med begrænsede ressourcer.

Transport

Navigation, sving-for-sving-vejvisning og beskeder i bilen, der forbliver hurtige, selv når køretøjet mister signalet.

Se løsninger til transport

Udkaldssystemer

Tydelig stemmeoplæsning til alarm- og beredskabsvarslingssystemer.

Mobile enheder

Lydbøger, sprogindlæring og mobilapps, der taler offline, uden krav om netværksforbindelse.

FAQ

Spørgsmål om speechEngine SDK Embedded

  • Ja. speechEngine SDK Embedded syntetiserer tale udelukkende på enheden, uden krav om netværksforbindelse. Al behandling og alle data bliver på hardwaren, så taleoutputtet er øjeblikkeligt og ensartet, også i offline miljøer eller miljøer med begrænsede ressourcer.

  • Det understøtter iOS, Android og Embedded Linux fra start. Andre indlejrede styresystemer kan understøttes på forespørgsel. Kontakt vores team med jeres målplatform.

  • Det kører på ARM 32/64-bit-processorer. Neural Standard-stemmer kræver en 64-bit ARM-CPU på 1 GHz eller derover; Neural Lite-stemmer kører fra 800 MHz. SDK'et bruger 6 til 30 MB RAM og 20 til 30 MB under kørsel.

  • Hver stemme fylder 6 til 32 MB for Neural Lite og 9 til 35 MB for Neural Standard. Begge niveauer bruger Deep Neural Network-teknologi, så I får naturlig lyd med et indlejret fodaftryk.

  • speechEngine SDK Embedded understøtter mere end 150 AI-stemmer på over 50 sprog. Nye stemmer og sprog tilføjes regelmæssigt. En komplet liste findes på ReadSpeakers websted.

  • I kan integrere i C/C++ på Embedded Linux, Objective-C på iOS og Java på Android. Hver SDK-pakke indeholder API'erne, eksempelkode og dokumentation til at komme i gang.

  • Ja. Brug SSML til at justere prosodien, indsætte pauser, tilføje fonetiske transskriptioner og skifte stemme eller sprog midt i teksten. En brugerordbog pr. sprog med IPA-understøttelse lader jer definere egne udtaler for fagspecifikke termer.

  • Det leverer output i 8 lydformater, heriblandt 16-bit lineær PCM, 8-bit A-law og μ-law, 4-bit Dialogic ADPCM samt flere Wave-varianter. Det gør det muligt at ramme lydpipelinen på jeres målenhed.

  • speechEngine SDK Embedded er bygget til systemer med lille fodaftryk på selve enheden, på ARM- og mobilhardware. speechEngine SDK targets desktop and PC-based applications on Windows and Linux. See speechEngine SDK if you're building for desktop.

Klar til at lægge en stemme ind i jeres enhed?

Fortæl os om jeres hardware, jeres målsprog og jeres tidsplan. Vores team for indlejrede systemer hjælper jer med at finde de rigtige stemmer, det rigtige fodaftryk og den rigtige platform til jeres produkt.

Find your ReadSpeaker solution

Opening the conversation…

Search

    Searching…

    No results for

    Try another wording, or start from one of these.

    Search is not available right now.

    You can still reach the pages below.