Hoppa till innehållet

ReadSpeaker speechEngine SDK

SDK för text-till-tal på enheten, offline, för skrivbords- och PC-appar

Installera talmotorn direkt på målmaskinen, där den genererar ljud lokalt utan nätverksanrop. 150+ AI-röster på 50+ språk, med inbyggda bindningar för C, C++ och Java på Windows och Linux, samt C# på Windows.

  • C/C++ · C# · Java
  • Windows 10/11 + Linux
  • På enheten

Kundberättelse

Inbyggt i levererad programvara, på enheten

Soft Leaf

Att använda ReadSpeakers TTS-plug-in sparade oss oräkneliga utvecklingstimmar och förde oss närmare vår vision om ett verkligt tillgängligt spel.

Conor BradleyGrundare och direktör, Soft Leaf Studios · Stories of Blossom
Läs hela berättelsen om Soft Leaf

Funktioner

Röst på enheten, byggd för utvecklare

Allt ert team behöver för att lägga naturligt klingande röst i en skrivbords- eller PC-applikation, med motorn körd lokalt.

Leverera röst som aldrig lämnar enheten

Motorn körs på er kunds maskin och genererar ljud helt utan nätverksanrop. Det passar bra för driftsättningar som är luftgapade, reglerade eller offline i första hand, där data stannar internt.

150+ AI-röster på 50+ språk

Naturliga, mänskligt klingande AI-röster, med nya röster och språk som läggs till i katalogen löpande. Välj den dialekt och ton som passar varje marknad och leverera dem med ett fotavtryck som förblir lätt på disken.

Ert team skriver i sin egen miljö

Inbyggda bindningar för C och C++ på Windows och Linux, C# på Windows och Java på Windows och Linux. Exempelkod, dokumentation och implementeringsstöd från vårt team gör integrationen enkel.

Finjusterad röststyrning med SSML

Byt röst och språk mitt i en mening, styr prosodin, infoga pauser och fonetiska transkriptioner. Indata i Speech Synthesis Markup Language (SSML) stöds fullt ut, i UTF-8.

Uttala varumärkesnamn och jargong korrekt

Bygg uttalslexikon per språk för produktnamn, förkortningar och egennamn, med flera lexikon per språk. Använd IPA-transkription när du behöver exakt fonetisk kontroll.

Ljudformat för alla pipelines

16-bitars linjär PCM, 8-bitars A-law och μ-law för telefoni, Dialogic ADPCM för äldre IVR. Leverera det format din pipeline förväntar sig, rått eller inkapslat i WAV.

Finjustera varje yttrande

Ställ in talhastighet, tonhöjd och volym efter situationen, från lugn berättarröst till brådskande larm. Konfigurera dem efter behov för varje driftsättning.

Förutsägbar licensiering

En licensfil som installeras tillsammans med SDK:n låser de röster och den löptid du beställt. Inga oväntade uppgraderingar, ingen användningsbaserad fakturering, ingen oro inför revision.

Riktiga människor hjälper er i mål

ReadSpeakers supportteam arbetar tillsammans med era utvecklare genom hela integrationen. Exempelkod, dokumentation och direktkontakt gör att ni aldrig sitter fast och läser en wiki klockan två på natten.

Prova det i er miljö

Ett enkelt integrationsexempel i C++

Inbyggda bindningar levereras för C och C++ på Windows och Linux, C# på Windows och Java på Windows och Linux. Anropa motorn i processen och syntetisera text till en lokal ljudfil, utan nätverksanrop.

// Representative example. The exact API and headers ship with the licensed SDK.
#include "speechengine.h"

int main() {
    SpeechEngine engine;
    engine.init("./license.lic");          // license file enforces voices + term
    engine.selectVoice("en_US-neural");       // 150+ voices, 50+ languages
    engine.setSpeechRate(90);                 // tune rate, pitch and volume per request

    // Synthesise plain text or SSML to a local audio file, no server calls
    engine.synthesizeToFile("Welcome to ReadSpeaker.", "welcome.wav");

    engine.release();                          // free the engine
    return 0;
}

Tekniska specifikationer

Alla specifikationer era utvecklings- och driftteam kommer att fråga om

Dimensionerat för driftsättning på enheten, offline: litet fotavtryck, brett OS-stöd, telefoniklart ljud.

Tekniska specifikationer för speechEngine SDK 4.5
SpecificationDetail
ProgrammeringsspråkC / C++ (Windows/Linux) · C# (Windows) · Java (Windows/Linux)
Windows-operativsystemWindows 10 och 11
Linux-operativsystemCentOS Stream 9.x till 10.x · Ubuntu 18.x till 24.x · RHEL 7.x till 9.x · Övriga operativsystem på begäran
CPUIntel x86/64, 1 GHz eller högre. AVX krävs på x64-arkitekturer (kontakta ReadSpeaker om er miljö saknar stöd för AVX).
RAM6 till 30 MB
Röstens fotavtryck9 till 35 MB per röst (Deep Neural Networks-teknik)
Minne under körning20 till 30 MB (Neural Standard)
IndataformatOformaterad text (flerbyte) · SSML (UTF-8)
Format för ljudutdata16-bitars linjär PCM (rå/WAV) · 8-bitars PCM A-law/μ-law (rå/WAV) · 8-bitars osignerad linjär PCM Wave · 4-bitars Dialogic ADPCM
DokumentationProduktspecifikation (PDF)

Driftsättningsmodell

Körs på er infrastruktur, under er licensfil

speechEngine SDK installeras lokalt på målmaskinen. TTS-motorn körs utan serveranrop. Licensavtal och licensfil styr licensierad plattform, röster och löptid. För dokumentation om regelefterlevnad på företagsnivå (ISO/IEC 27001, GDPR, EU:s standardavtalsklausuler), se ReadSpeakers integritetspolicy och sidorna om företaget.

  • På enheten (Motorn installeras på målmaskinen)

    Installerad lokalt

  • Inga nätverksanrop (Ljud som genereras utan anrop till servern)

    Motorn körs lokalt

  • Licensfilen styr rättigheterna (Licensfil levereras med SDK:n)

    Röster + löptid

  • Leverans av SDK (SDK byggd för plattformen i ordern)

    Per kundorder

Vanliga frågor

Frågor om speechEngine SDK

  • speechEngine SDK är ett SDK för text-till-tal på enheten, för utvecklare som bygger skrivbords- och PC-baserade applikationer. Motorn installeras lokalt på målmaskinen och stöder 150+ AI-röster på 50+ språk. Den körs utan nätverksanslutning, vilket passar luftgapade och integritetskänsliga miljöer.

  • speechEngine SDK levererar inbyggda bindningar för C och C++ på Windows och Linux, C# på Windows och Java på Windows och Linux. SDK:n levereras för den plattform som anges i kundens order.

  • speechEngine SDK körs på Windows 10 och 11, och på Linux-distributioner som CentOS Stream 9.x till 10.x, Ubuntu 18.x till 24.x och RHEL 7.x till 9.x. Andra operativsystem stöds på begäran. CPU: Intel x86/64 1 GHz eller högre (AVX krävs på x64). RAM: 6 till 30 MB.

  • Ja. TTS-motorn installeras lokalt på målmaskinen och genererar ljud utan nätverksanrop, vilket passar integritetskänsliga och luftgapade driftsättningar. För ARM-, mobil- eller IoT-mål, se speechEngine SDK Embedded.

  • speechEngine SDK levererar fyra ljudformat: 16-bitars linjär PCM (rå/WAV), 8-bitars PCM A-law/μ-law (rå/WAV), 8-bitars osignerad linjär PCM Wave och 4-bitars Dialogic ADPCM. Utdata i A-law och μ-law passar särskilt väl för telefoniintegration.

  • Ja. speechEngine SDK tar emot oformaterad text (flerbyte) och SSML (UTF-8), så att er applikation kan märka upp det tal den behöver. SSML låter er byta röst och språk inom en och samma text, ändra prosodin, infoga pauser och tillämpa fonetiska transkriptioner.

  • speechEngine SDK regleras av ett licensavtal som anger licensierad plattform, röster och tillåten användningskontext. En licensfil som levereras med SDK:n styr tekniskt de licensierade rösterna och löptiden, alltså hur länge användningen är tillåten.

  • Ja. Implementeringsstöd från ReadSpeakers supportteam ingår. Teamet hjälper kunderna att förstå och genomföra integrationen enligt den dokumentation och exempelkod som tillhandahålls.

Redo att lägga en röst i er skrivbordsapp?

Berätta om er plattform och era målspråk. Vårt team avgränsar rätt röster, leverans och licensvillkor, och levererar sedan SDK:n med exempelkod och implementeringsstöd.

Find your ReadSpeaker solution

Opening the conversation…

Search

    Searching…

    No results for

    Try another wording, or start from one of these.

    Search is not available right now.

    You can still reach the pages below.