Przejdź do treści

ReadSpeaker speechEngine SDK Embedded

Synteza mowy na urządzeniu, dla systemów wbudowanych i urządzeń mobilnych

ReadSpeaker speechEngine SDK Embedded dodaje naturalne głosy AI do urządzeń opartych na ARM, aplikacji mobilnych i systemów wbudowanych. Działa w całości na urządzeniu, bez potrzeby połączenia z siecią. Ponad 150 głosów AI w ponad 50 językach dla iOS, Androida i Embedded Linux.

  • Działa w całości na urządzeniu
  • ARM 32/64-bit
  • 150+ głosów · 50+ języków

Dlaczego na urządzeniu

Mowa, która działa z połączeniem i bez niego

Wiele urządzeń nie może polegać na chmurze. Monitor medyczny, samochód czy sterownik przemysłowy muszą przemówić dokładnie wtedy, gdy trzeba, za każdym razem. speechEngine SDK Embedded generuje mowę w całości na urządzeniu, dzięki czemu dźwięk pozostaje spójny i natychmiastowy nawet bez sieci. Twoje dane nigdy nie opuszczają sprzętu, a opóźnienie nigdy nie zależy od zasięgu.

Stworzone dla systemów wbudowanych

Naturalny głos na sprzęcie, w którym większość syntezy mowy się nie mieści

Mały rozmiar, z założenia

Każdy głos zajmuje od 6 do 35 MB pamięci masowej i działa w 20 do 30 MB pamięci operacyjnej. To mieści się w ograniczonych zasobach sprzętu, na którym powstają produkty wbudowane, od 32-bitowych kontrolerów ARM po 64-bitowe układy mobilne, bez rezygnacji z naturalnego brzmienia.

Ponad 150 głosów AI w ponad 50 językach

speechEngine SDK Embedded korzysta z katalogu ReadSpeaker obejmującego ponad 150 głosów AI w ponad 50 językach. Nowe głosy i języki są dodawane regularnie, więc to samo SDK pozwala wprowadzić produkt na jeden rynek albo na pięćdziesiąt.

Dopracuj każde odczytane słowo

Dostosuj tempo mowy, wysokość i głośność do urządzenia. Użyj SSML (Speech Synthesis Markup Language), aby wstawiać pauzy, zmieniać głos lub język w środku zdania i dodawać transkrypcje fonetyczne. Słownik użytkownika dla każdego języka, z obsługą IPA, pozwala raz poprawić wymowę nazw produktów i terminów branżowych, od razu wszędzie.

Dane techniczne

Stworzone z myślą o sprzęcie o ograniczonych zasobach

speechEngine SDK Embedded został zaprojektowany dla systemów o małych zasobach. Poniższe wartości pozwalają dobrać sprzęt przed podjęciem decyzji.

Specyfikacja techniczna speechEngine SDK Embedded
SpecificationValue
Systemy operacyjneiOS · Android · Embedded Linux (inne wbudowane systemy operacyjne na życzenie)
CPUARM 32/64-bit. Neural Standard: 1 GHz lub więcej (tylko 64-bit) · Neural Lite: 800 MHz lub więcej
RAMOd 6 do 30 MB
Pamięć w czasie działaniaOd 20 do 30 MB (Neural Lite i Neural Standard)
Rozmiar głosuOd 6 do 32 MB (Neural Lite) · od 9 do 35 MB (Neural Standard), technologia głębokich sieci neuronowych
Wyjście audio8 formatów: 16-bitowy liniowy PCM, 8-bitowy A-law, 8-bitowy μ-law, 8-bitowy liniowy PCM Wave bez znaku, 4-bitowy Dialogic ADPCM oraz warianty Wave
Wprowadzanie tekstuZwykły tekst (wielobajtowy) · SSML (UTF-8)
DokumentacjaSpecyfikacja produktu (PDF)

Neural Standard i Neural Lite

Dwa poziomy głosów, jedno SDK

Wybierz wariant pasujący do Twojego sprzętu. Neural Standard działa na 64-bitowym ARM o taktowaniu od 1 GHz, z głosami od 9 do 35 MB i najbogatszym brzmieniem. Neural Lite działa na ARM od 800 MHz, z głosami od 6 do 32 MB, dla urządzeń o najmniejszych zasobach. Oba warianty korzystają z technologii głębokich sieci neuronowych.

Porównanie Neural Lite i Neural Standard
Neural LiteNeural Standard
CPUARM 800 MHz lub więcejARM 1 GHz lub więcej (tylko 64-bit)
Rozmiar głosuOd 6 do 32 MBOd 9 do 35 MB
TechnologiaGłębokie sieci neuronoweGłębokie sieci neuronowe

Platformy

Integruj w języku, którego już używasz

speechEngine SDK Embedded jest dostarczany z interfejsami API, przykładowym kodem i dokumentacją pozwalającą szybko przeprowadzić integrację. Twórz w C/C++ na Embedded Linux, w Objective-C na iOS albo w Javie na Androidzie. Każda dostawa obejmuje biblioteki silnika mowy, pliki głosów i dokumentację integracyjną dla licencjonowanej przez Ciebie platformy, a także wsparcie naszego zespołu.

Obsługiwane platformy i języki integracji dla nich
PlatformLanguage
Embedded LinuxC / C++
iOSObjective-C
AndroidJava

Integracja

Kilka wywołań do pierwszej wypowiedzi

Zainicjuj silnik, wczytaj głos i wygeneruj mowę. Resztą zajmuje się SDK na urządzeniu.

/* Illustrative - confirm exact API against the SDK docs before use */
#include "rs_embedded_tts.h"

int main() {
    rsEngine *engine = rsEngineCreate("license.dat");
    rsEngineLoadVoice(engine, "en-US-neural-standard");
    rsEngineSetRate(engine, 1.0);
    rsEngineSpeak(engine, "Welcome aboard.", RS_AUDIO_PCM16);
    rsEngineDestroy(engine);
    return 0;
}

Kształt wyłącznie poglądowy. Dokładne sygnatury API dla dostarczonej Ci platformy znajdziesz w dokumentacji SDK i w przykładowym kodzie.

Gdzie działa

Głosy dla urządzeń o znaczeniu krytycznym

Od aplikacji mobilnych po sprzęt o znaczeniu krytycznym, speechEngine SDK Embedded daje produktom niezawodny głos wszędzie tam, gdzie pracują, także w obronności i innych środowiskach o ograniczonych zasobach.

Transport

Nawigacja, wskazówki krok po kroku i komunikaty w pojeździe, które pozostają responsywne nawet wtedy, gdy pojazd traci zasięg.

Zobacz rozwiązania dla transportu

Systemy zapowiedzi

Wyraźny głos dla systemów alarmowych i powiadamiania ratunkowego.

Urządzenia mobilne

Audiobooki, nauka języków i aplikacje mobilne, które mówią offline, bez połączenia z siecią.

Najczęstsze pytania

Pytania o speechEngine SDK Embedded

  • Tak. speechEngine SDK Embedded generuje mowę w całości na urządzeniu, bez potrzeby połączenia z siecią. Całe przetwarzanie i wszystkie dane pozostają na sprzęcie, więc mowa jest natychmiastowa i spójna nawet w środowiskach offline lub o ograniczonych zasobach.

  • Obsługuje iOS, Androida i Embedded Linux od razu po instalacji. Inne wbudowane systemy operacyjne mogą być obsługiwane na życzenie. Skontaktuj się z naszym zespołem i podaj swoją platformę docelową.

  • Działa na procesorach ARM 32- i 64-bitowych. Głosy Neural Standard wymagają 64-bitowego procesora ARM o taktowaniu 1 GHz lub wyższym; głosy Neural Lite działają od 800 MHz. SDK zajmuje od 6 do 30 MB pamięci RAM i od 20 do 30 MB w czasie działania.

  • Każdy głos zajmuje od 6 do 32 MB w wersji Neural Lite i od 9 do 35 MB w wersji Neural Standard. Oba poziomy korzystają z technologii głębokich sieci neuronowych, więc otrzymujesz naturalne brzmienie przy rozmiarze odpowiednim dla systemów wbudowanych.

  • speechEngine SDK Embedded obsługuje ponad 150 głosów AI w ponad 50 językach. Nowe głosy i języki są dodawane regularnie. Pełna lista jest dostępna w witrynie ReadSpeaker.

  • Możesz integrować w C/C++ na Embedded Linux, w Objective-C na iOS i w Javie na Androidzie. Każdy pakiet SDK zawiera interfejsy API, przykładowy kod i dokumentację potrzebne, aby zacząć.

  • Tak. Użyj SSML, aby dostosować prozodię, wstawiać pauzy, dodawać transkrypcje fonetyczne i zmieniać głosy lub języki w trakcie tekstu. Słownik użytkownika dla każdego języka, z obsługą IPA, pozwala zdefiniować własną wymowę terminów branżowych.

  • Generuje 8 formatów audio, w tym 16-bitowy liniowy PCM, 8-bitowy A-law i μ-law, 4-bitowy Dialogic ADPCM oraz kilka wariantów Wave. Dzięki temu dopasujesz go do potoku audio urządzenia docelowego.

  • speechEngine SDK Embedded powstał z myślą o systemach działających na urządzeniu, o małych zasobach, na sprzęcie ARM i mobilnym. speechEngine SDK targets desktop and PC-based applications on Windows and Linux. See speechEngine SDK if you're building for desktop.

Gotowi, aby dodać głos do swojego urządzenia?

Opowiedz nam o swoim sprzęcie, językach docelowych i harmonogramie. Nasz zespół od systemów wbudowanych pomoże Ci dobrać właściwe głosy, rozmiar i platformę dla Twojego produktu.

Find your ReadSpeaker solution

Opening the conversation…

Search

    Searching…

    No results for

    Try another wording, or start from one of these.

    Search is not available right now.

    You can still reach the pages below.