Hoppa till innehållet

ReadSpeaker speechEngine SDK Embedded

Text-till-tal på enheten för inbyggda och mobila enheter

ReadSpeaker speechEngine SDK Embedded lägger till naturliga AI-röster i ARM-baserade enheter, mobilappar och inbyggda system. Det körs helt på enheten, utan att någon nätverksanslutning krävs. 150+ AI-röster på 50+ språk för iOS, Android och inbyggd Linux.

  • Körs helt på enheten
  • ARM 32/64-bitars
  • 150+ röster · 50+ språk

Varför på enheten

Tal som fungerar med eller utan uppkoppling

Många enheter kan inte förlita sig på molnet. En medicinsk monitor, en bil eller en industristyrenhet måste tala i samma ögonblick det behövs, varje gång. speechEngine SDK Embedded syntetiserar tal helt på enheten, så ljudet förblir enhetligt och omedelbart även utan nätverk. Era data lämnar aldrig hårdvaran, och fördröjningen beror aldrig på en signal.

Byggt för inbyggda system

Naturlig röst på hårdvara där de flesta TTS inte får plats

Litet fotavtryck, med avsikt

Varje röst tar 6 till 35 MB lagringsutrymme och körs i 20 till 30 MB minne. Det ryms i den begränsade hårdvara som inbyggda produkter bygger på, från 32-bitars ARM-styrkretsar till 64-bitars mobilchipp, utan att naturligt ljud offras.

150+ AI-röster på 50+ språk

speechEngine SDK Embedded bygger på ReadSpeakers katalog med över 150 AI-röster på fler än 50 språk. Nya röster och språk läggs till löpande, så samma SDK kan leverera en produkt till en marknad eller femtio.

Finjustera varje ord den läser

Justera talhastighet, tonhöjd och volym så att de passar enheten. Använd SSML (Speech Synthesis Markup Language) för att lägga in pauser, byta röst eller språk mitt i en mening och lägga till fonetiska transkriptioner. Ett användarlexikon per språk med stöd för IPA gör att du kan rätta uttalet av produktnamn och fackuttryck en gång, överallt.

Tekniska specifikationer

Byggt för begränsad hårdvara

speechEngine SDK Embedded är konstruerat för system med litet fotavtryck. Siffrorna nedan låter er dimensionera er hårdvara innan ni binder er.

Tekniska specifikationer för speechEngine SDK Embedded
SpecificationValue
OperativsystemiOS · Android · inbyggd Linux (andra inbyggda operativsystem på begäran)
CPUARM 32/64-bitars. Neural Standard: 1 GHz eller högre (endast 64-bitars) · Neural Lite: 800 MHz eller högre
RAM6 till 30 MB
Minne under körning20 till 30 MB (Neural Lite och Neural Standard)
Röstens fotavtryck6 till 32 MB (Neural Lite) · 9 till 35 MB (Neural Standard), Deep Neural Networks-teknik
Ljudutgång8 format: 16-bitars linjär PCM, 8-bitars A-law, 8-bitars μ-law, 8-bitars osignerad linjär PCM Wave, 4-bitars Dialogic ADPCM och Wave-varianter
TextinmatningOformaterad text (flerbyte) · SSML (UTF-8)
DokumentationProduktspecifikation (PDF)

Neural Standard och Neural Lite

Två röstnivåer, ett SDK

Välj den balans som passar er hårdvara. Neural Standard körs på 64-bitars ARM från 1 GHz och uppåt, med röster från 9 till 35 MB för det fylligaste ljudet. Neural Lite körs på ARM från 800 MHz, med röster från 6 till 32 MB för de snålaste enheterna. Båda använder teknik med djupa neurala nätverk.

Neural Lite och Neural Standard jämförda
Neural LiteNeural Standard
CPUARM 800 MHz+ARM 1 GHz+ (endast 64-bitars)
Röstens fotavtryck6 till 32 MB9 till 35 MB
TeknikDeep Neural NetworksDeep Neural Networks

Plattformar

Integrera på det språk du redan använder

speechEngine SDK Embedded levereras med API:erna, exempelkoden och dokumentationen för att integrera snabbt. Bygg i C/C++ på inbyggd Linux, Objective-C på iOS eller Java på Android. Varje leverans innehåller talmotorns bibliotek, röstfilerna och integrationsdokumentationen för er licensierade plattform, plus stöd från vårt team.

Plattformar som stöds och deras integrationsspråk
PlatformLanguage
Inbyggd LinuxC / C++
iOSObjective-C
AndroidJava

Integration

Några få anrop till det första talet

Initiera motorn, ladda en röst och syntetisera. SDK:n sköter resten på enheten.

/* Illustrative - confirm exact API against the SDK docs before use */
#include "rs_embedded_tts.h"

int main() {
    rsEngine *engine = rsEngineCreate("license.dat");
    rsEngineLoadVoice(engine, "en-US-neural-standard");
    rsEngineSetRate(engine, 1.0);
    rsEngineSpeak(engine, "Welcome aboard.", RS_AUDIO_PCM16);
    rsEngineDestroy(engine);
    return 0;
}

Endast illustrativ form. Se SDK-dokumentationen och exempelkoden för de exakta API-signaturerna för den plattform som levererats till er.

Var den körs

Röster för affärskritiska enheter

Från mobilappar till affärskritisk hårdvara ger speechEngine SDK Embedded produkter en pålitlig röst var de än körs, inklusive i försvarsmiljöer och andra begränsade miljöer.

Transport

Navigation, vägbeskrivningar steg för steg och meddelanden i fordonet som förblir följsamma även när fordonet tappar täckning.

Se lösningar för transport

Meddelandesystem

Tydlig röstutgång för larm- och nödmeddelandesystem.

Mobila enheter

Ljudböcker, språkinlärning och mobilappar som talar offline, utan att någon nätverksanslutning krävs.

Vanliga frågor

Frågor om speechEngine SDK Embedded

  • Ja. speechEngine SDK Embedded syntetiserar tal helt på enheten, utan att någon nätverksanslutning krävs. All bearbetning och alla data stannar på hårdvaran, så talet levereras omedelbart och enhetligt även i offline-miljöer eller begränsade miljöer.

  • Det stöder iOS, Android och inbyggd Linux direkt ur lådan. Andra inbyggda operativsystem kan stödjas på begäran. Hör av dig till vårt team med din målplattform.

  • Det körs på 32- och 64-bitars ARM-processorer. Neural Standard-röster kräver en 64-bitars ARM-CPU på 1 GHz eller högre; Neural Lite-röster körs från 800 MHz. SDK:n använder 6 till 30 MB RAM och 20 till 30 MB under körning.

  • Varje röst tar 6 till 32 MB för Neural Lite och 9 till 35 MB för Neural Standard. Båda nivåerna använder teknik med djupa neurala nätverk, så du får naturligt ljud i ett inbyggt fotavtryck.

  • speechEngine SDK Embedded stöder över 150 AI-röster på fler än 50 språk. Nya röster och språk läggs till löpande. En komplett lista finns på ReadSpeakers webbplats.

  • Ni kan integrera i C/C++ på inbyggd Linux, Objective-C på iOS och Java på Android. Varje SDK-paket innehåller API:erna, exempelkoden och dokumentationen för att komma igång.

  • Ja. Använd SSML för att justera prosodin, infoga pauser, lägga till fonetiska transkriptioner och byta röst eller språk mitt i texten. Ett användarlexikon per språk med stöd för IPA låter dig definiera egna uttal för fackspecifika termer.

  • Det levererar 8 ljudformat, bland annat 16-bitars linjär PCM, 8-bitars A-law och μ-law, 4-bitars Dialogic ADPCM och flera Wave-varianter. Det gör att du kan matcha ljudkedjan i din målenhet.

  • speechEngine SDK Embedded är byggt för system på enheten med litet fotavtryck, på ARM- och mobilhårdvara. speechEngine SDK targets desktop and PC-based applications on Windows and Linux. See speechEngine SDK if you're building for desktop.

Redo att lägga en röst i er enhet?

Berätta om er hårdvara, era målspråk och er tidsplan. Vårt team för inbyggda system hjälper er att avgränsa rätt röster, fotavtryck och plattform för er produkt.

Find your ReadSpeaker solution

Opening the conversation…

Search

    Searching…

    No results for

    Try another wording, or start from one of these.

    Search is not available right now.

    You can still reach the pages below.