Gå til innholdet

ReadSpeaker speechEngine SDK Embedded

Tekst til tale på enheten for innebygde og mobile enheter

ReadSpeaker speechEngine SDK Embedded gir naturlige AI-stemmer til ARM-baserte enheter, mobilapper og innebygde systemer. Den kjører fullt ut på enheten, uten krav om nettverkstilkobling. 150+ AI-stemmer på 50+ språk for iOS, Android og Embedded Linux.

  • Kjører fullt ut på enheten
  • ARM 32/64-bits
  • 150+ stemmer · 50+ språk

Hvorfor på enheten

Tale som fungerer med eller uten tilkobling

Mange enheter kan ikke stole på skyen. En medisinsk monitor, en bil eller en industriell styringsenhet må kunne snakke i det øyeblikket det trengs, hver gang. speechEngine SDK Embedded syntetiserer tale helt og holdent på enheten, slik at lyden forblir jevn og umiddelbar selv uten nettverk. Dataene dine forlater aldri maskinvaren, og forsinkelsen avhenger aldri av dekning.

Laget for innebygde systemer

Naturlig stemme på maskinvare der de fleste TTS-løsninger ikke får plass

Lite fotavtrykk, helt bevisst

Hver stemme bruker 6 til 35 MB lagringsplass og kjører på 20 til 30 MB minne. Det passer til den begrensede maskinvaren innebygde produkter bygges på, fra 32-bits ARM-kontrollere til 64-bits mobilbrikker, uten å gå på akkord med naturlig lyd.

150+ AI-stemmer på 50+ språk

speechEngine SDK Embedded bygger på ReadSpeakers katalog med mer enn 150 AI-stemmer på over 50 språk. Nye stemmer og språk legges til jevnlig, så den samme SDK-en kan sende et produkt ut i ett marked eller i femti.

Finjuster hvert ord den leser

Juster talehastighet, tonehøyde og volum etter enheten. Bruk SSML (Speech Synthesis Markup Language) til å sette inn pauser, bytte stemme eller språk midt i en setning og legge til fonetiske transkripsjoner. En brukerordbok per språk med IPA-støtte lar deg rette uttalen av produktnavn og fagtermer én gang, med virkning overalt.

Tekniske spesifikasjoner

Laget for begrenset maskinvare

speechEngine SDK Embedded er konstruert for systemer med lite fotavtrykk. Tallene nedenfor lar dere dimensjonere maskinvaren før dere forplikter dere.

Tekniske spesifikasjoner for speechEngine SDK Embedded
SpecificationValue
OperativsystemeriOS · Android · Embedded Linux (andre innebygde operativsystemer på forespørsel)
CPUARM 32/64-bits. Neural Standard: 1 GHz eller høyere (kun 64-bits) · Neural Lite: 800 MHz eller høyere
RAM6 til 30 MB
Minne under kjøring20 til 30 MB (Neural Lite og Neural Standard)
Fotavtrykk per stemme6 til 32 MB (Neural Lite) · 9 til 35 MB (Neural Standard), Deep Neural Networks-teknologi
Lydutgang8 formater: 16-bits lineær PCM, 8-bits A-law, 8-bits μ-law, 8-bits usignert lineær PCM Wave, 4-bits Dialogic ADPCM og Wave-varianter
Tekst innRen tekst (flerbyte) · SSML (UTF-8)
DokumentasjonProduktspesifikasjon (PDF)

Neural Standard og Neural Lite

To stemmenivåer, én SDK

Velg balansen som passer maskinvaren deres. Neural Standard kjører på 64-bits ARM fra 1 GHz og oppover, med stemmer fra 9 til 35 MB for den fyldigste lyden. Neural Lite kjører på ARM fra 800 MHz, med stemmer fra 6 til 32 MB for de mest begrensede enhetene. Begge bruker teknologi med dype nevrale nettverk.

Neural Lite og Neural Standard sammenlignet
Neural LiteNeural Standard
CPUARM 800 MHz+ARM 1 GHz+ (kun 64-bits)
Fotavtrykk per stemme6 til 32 MB9 til 35 MB
TeknologiDeep Neural NetworksDeep Neural Networks

Plattformer

Integrer i språket du allerede bruker

speechEngine SDK Embedded leveres med API-ene, eksempelkoden og dokumentasjonen som trengs for rask integrasjon. Bygg i C/C++ på Embedded Linux, Objective-C på iOS eller Java på Android. Hver leveranse inneholder bibliotekene til talemotoren, stemmefilene og integrasjonsdokumentasjonen for plattformen dere har lisensiert, i tillegg til support fra teamet vårt.

Plattformer som støttes, og integrasjonsspråkene deres
PlatformLanguage
Embedded LinuxC / C++
iOSObjective-C
AndroidJava

Integrasjon

Noen få kall til første tale

Initialiser motoren, last inn en stemme, og syntetiser. SDK-en håndterer resten på enheten.

/* Illustrative - confirm exact API against the SDK docs before use */
#include "rs_embedded_tts.h"

int main() {
    rsEngine *engine = rsEngineCreate("license.dat");
    rsEngineLoadVoice(engine, "en-US-neural-standard");
    rsEngineSetRate(engine, 1.0);
    rsEngineSpeak(engine, "Welcome aboard.", RS_AUDIO_PCM16);
    rsEngineDestroy(engine);
    return 0;
}

Formen er kun illustrerende. Se SDK-dokumentasjonen og eksempelkoden for de nøyaktige API-signaturene på plattformen som leveres til dere.

Hvor den kjører

Stemmer for virksomhetskritiske enheter

Fra mobilapper til virksomhetskritisk maskinvare gir speechEngine SDK Embedded produkter en pålitelig stemme uansett hvor de kjører, også innen forsvar og andre begrensede miljøer.

Transport

Navigasjon, veibeskrivelser sving for sving og meldinger i kjøretøyet som svarer raskt selv når bilen mister dekning.

Se løsninger for transport

Kunngjøringssystemer

Tydelig taleutgang for alarm- og nødvarslingssystemer.

Mobile enheter

Lydbøker, språklæring og mobilapper som snakker offline, uten nettverkstilkobling.

Vanlige spørsmål

Spørsmål om speechEngine SDK Embedded

  • Ja. speechEngine SDK Embedded syntetiserer tale helt og holdent på enheten, uten krav om nettverkstilkobling. All behandling og alle data blir værende på maskinvaren, slik at talen kommer umiddelbart og jevnt selv i offline eller begrensede miljøer.

  • Den støtter iOS, Android og Embedded Linux rett ut av esken. Andre innebygde operativsystemer kan støttes på forespørsel. Ta kontakt med teamet vårt og oppgi målplattformen deres.

  • Den kjører på 32- og 64-bits ARM-prosessorer. Neural Standard-stemmer krever en 64-bits ARM-CPU på 1 GHz eller høyere, mens Neural Lite-stemmer kjører fra 800 MHz. SDK-en bruker 6 til 30 MB RAM og 20 til 30 MB under kjøring.

  • Hver stemme bruker 6 til 32 MB for Neural Lite og 9 til 35 MB for Neural Standard. Begge nivåene bruker teknologi med dype nevrale nettverk, så du får naturlig lyd med et innebygd fotavtrykk.

  • speechEngine SDK Embedded støtter mer enn 150 AI-stemmer på over 50 språk. Nye stemmer og språk legges til jevnlig. En fullstendig liste finnes på ReadSpeakers nettsted.

  • Dere kan integrere i C/C++ på Embedded Linux, Objective-C på iOS og Java på Android. Hver SDK-pakke inneholder API-ene, eksempelkoden og dokumentasjonen dere trenger for å komme i gang.

  • Ja. Bruk SSML til å justere prosodien, sette inn pauser, legge til fonetiske transkripsjoner og bytte stemme eller språk midt i teksten. En brukerordbok per språk med IPA-støtte lar deg definere egne uttaler for fagspesifikke termer.

  • Den leverer 8 lydformater, blant annet 16-bits lineær PCM, 8-bits A-law og μ-law, 4-bits Dialogic ADPCM og flere Wave-varianter. Dermed kan du treffe lydkjeden på målenheten din.

  • speechEngine SDK Embedded er laget for systemer med lite fotavtrykk som kjører på enheten, på ARM- og mobilmaskinvare. speechEngine SDK targets desktop and PC-based applications on Windows and Linux. See speechEngine SDK if you're building for desktop.

Klar til å gi enheten din en stemme?

Fortell oss om maskinvaren, målspråkene og tidsplanen deres. Teamet vårt for innebygde systemer hjelper dere med å finne riktige stemmer, riktig fotavtrykk og riktig plattform for produktet deres.

Find your ReadSpeaker solution

Opening the conversation…

Search

    Searching…

    No results for

    Try another wording, or start from one of these.

    Search is not available right now.

    You can still reach the pages below.