Att använda ReadSpeakers TTS-plug-in sparade oss oräkneliga utvecklingstimmar och förde oss närmare vår vision om ett verkligt tillgängligt spel.
Läs hela berättelsen om Soft LeafReadSpeaker speechEngine SDK
SDK för text-till-tal på enheten, offline, för skrivbords- och PC-appar
Installera talmotorn direkt på målmaskinen, där den genererar ljud lokalt utan nätverksanrop. 150+ AI-röster på 50+ språk, med inbyggda bindningar för C, C++ och Java på Windows och Linux, samt C# på Windows.
- C/C++ · C# · Java
- Windows 10/11 + Linux
- På enheten
Kundberättelse
Inbyggt i levererad programvara, på enheten
Funktioner
Röst på enheten, byggd för utvecklare
Allt ert team behöver för att lägga naturligt klingande röst i en skrivbords- eller PC-applikation, med motorn körd lokalt.
Leverera röst som aldrig lämnar enheten
Motorn körs på er kunds maskin och genererar ljud helt utan nätverksanrop. Det passar bra för driftsättningar som är luftgapade, reglerade eller offline i första hand, där data stannar internt.
150+ AI-röster på 50+ språk
Naturliga, mänskligt klingande AI-röster, med nya röster och språk som läggs till i katalogen löpande. Välj den dialekt och ton som passar varje marknad och leverera dem med ett fotavtryck som förblir lätt på disken.
Ert team skriver i sin egen miljö
Inbyggda bindningar för C och C++ på Windows och Linux, C# på Windows och Java på Windows och Linux. Exempelkod, dokumentation och implementeringsstöd från vårt team gör integrationen enkel.
Finjusterad röststyrning med SSML
Byt röst och språk mitt i en mening, styr prosodin, infoga pauser och fonetiska transkriptioner. Indata i Speech Synthesis Markup Language (SSML) stöds fullt ut, i UTF-8.
Uttala varumärkesnamn och jargong korrekt
Bygg uttalslexikon per språk för produktnamn, förkortningar och egennamn, med flera lexikon per språk. Använd IPA-transkription när du behöver exakt fonetisk kontroll.
Ljudformat för alla pipelines
16-bitars linjär PCM, 8-bitars A-law och μ-law för telefoni, Dialogic ADPCM för äldre IVR. Leverera det format din pipeline förväntar sig, rått eller inkapslat i WAV.
Finjustera varje yttrande
Ställ in talhastighet, tonhöjd och volym efter situationen, från lugn berättarröst till brådskande larm. Konfigurera dem efter behov för varje driftsättning.
Förutsägbar licensiering
En licensfil som installeras tillsammans med SDK:n låser de röster och den löptid du beställt. Inga oväntade uppgraderingar, ingen användningsbaserad fakturering, ingen oro inför revision.
Riktiga människor hjälper er i mål
ReadSpeakers supportteam arbetar tillsammans med era utvecklare genom hela integrationen. Exempelkod, dokumentation och direktkontakt gör att ni aldrig sitter fast och läser en wiki klockan två på natten.
Prova det i er miljö
Ett enkelt integrationsexempel i C++
Inbyggda bindningar levereras för C och C++ på Windows och Linux, C# på Windows och Java på Windows och Linux. Anropa motorn i processen och syntetisera text till en lokal ljudfil, utan nätverksanrop.
// Representative example. The exact API and headers ship with the licensed SDK.
#include "speechengine.h"
int main() {
SpeechEngine engine;
engine.init("./license.lic"); // license file enforces voices + term
engine.selectVoice("en_US-neural"); // 150+ voices, 50+ languages
engine.setSpeechRate(90); // tune rate, pitch and volume per request
// Synthesise plain text or SSML to a local audio file, no server calls
engine.synthesizeToFile("Welcome to ReadSpeaker.", "welcome.wav");
engine.release(); // free the engine
return 0;
}Tekniska specifikationer
Alla specifikationer era utvecklings- och driftteam kommer att fråga om
Dimensionerat för driftsättning på enheten, offline: litet fotavtryck, brett OS-stöd, telefoniklart ljud.
| Specification | Detail |
|---|---|
| Programmeringsspråk | C / C++ (Windows/Linux) · C# (Windows) · Java (Windows/Linux) |
| Windows-operativsystem | Windows 10 och 11 |
| Linux-operativsystem | CentOS Stream 9.x till 10.x · Ubuntu 18.x till 24.x · RHEL 7.x till 9.x · Övriga operativsystem på begäran |
| CPU | Intel x86/64, 1 GHz eller högre. AVX krävs på x64-arkitekturer (kontakta ReadSpeaker om er miljö saknar stöd för AVX). |
| RAM | 6 till 30 MB |
| Röstens fotavtryck | 9 till 35 MB per röst (Deep Neural Networks-teknik) |
| Minne under körning | 20 till 30 MB (Neural Standard) |
| Indataformat | Oformaterad text (flerbyte) · SSML (UTF-8) |
| Format för ljudutdata | 16-bitars linjär PCM (rå/WAV) · 8-bitars PCM A-law/μ-law (rå/WAV) · 8-bitars osignerad linjär PCM Wave · 4-bitars Dialogic ADPCM |
| Dokumentation | Produktspecifikation (PDF) |
Driftsättningsmodell
Körs på er infrastruktur, under er licensfil
speechEngine SDK installeras lokalt på målmaskinen. TTS-motorn körs utan serveranrop. Licensavtal och licensfil styr licensierad plattform, röster och löptid. För dokumentation om regelefterlevnad på företagsnivå (ISO/IEC 27001, GDPR, EU:s standardavtalsklausuler), se ReadSpeakers integritetspolicy och sidorna om företaget.
På enheten (Motorn installeras på målmaskinen)
Installerad lokalt
Inga nätverksanrop (Ljud som genereras utan anrop till servern)
Motorn körs lokalt
Licensfilen styr rättigheterna (Licensfil levereras med SDK:n)
Röster + löptid
Leverans av SDK (SDK byggd för plattformen i ordern)
Per kundorder
Vanliga frågor
Frågor om speechEngine SDK
speechEngine SDK är ett SDK för text-till-tal på enheten, för utvecklare som bygger skrivbords- och PC-baserade applikationer. Motorn installeras lokalt på målmaskinen och stöder 150+ AI-röster på 50+ språk. Den körs utan nätverksanslutning, vilket passar luftgapade och integritetskänsliga miljöer.
speechEngine SDK levererar inbyggda bindningar för C och C++ på Windows och Linux, C# på Windows och Java på Windows och Linux. SDK:n levereras för den plattform som anges i kundens order.
speechEngine SDK körs på Windows 10 och 11, och på Linux-distributioner som CentOS Stream 9.x till 10.x, Ubuntu 18.x till 24.x och RHEL 7.x till 9.x. Andra operativsystem stöds på begäran. CPU: Intel x86/64 1 GHz eller högre (AVX krävs på x64). RAM: 6 till 30 MB.
Ja. TTS-motorn installeras lokalt på målmaskinen och genererar ljud utan nätverksanrop, vilket passar integritetskänsliga och luftgapade driftsättningar. För ARM-, mobil- eller IoT-mål, se speechEngine SDK Embedded.
speechEngine SDK levererar fyra ljudformat: 16-bitars linjär PCM (rå/WAV), 8-bitars PCM A-law/μ-law (rå/WAV), 8-bitars osignerad linjär PCM Wave och 4-bitars Dialogic ADPCM. Utdata i A-law och μ-law passar särskilt väl för telefoniintegration.
Ja. speechEngine SDK tar emot oformaterad text (flerbyte) och SSML (UTF-8), så att er applikation kan märka upp det tal den behöver. SSML låter er byta röst och språk inom en och samma text, ändra prosodin, infoga pauser och tillämpa fonetiska transkriptioner.
speechEngine SDK regleras av ett licensavtal som anger licensierad plattform, röster och tillåten användningskontext. En licensfil som levereras med SDK:n styr tekniskt de licensierade rösterna och löptiden, alltså hur länge användningen är tillåten.
Ja. Implementeringsstöd från ReadSpeakers supportteam ingår. Teamet hjälper kunderna att förstå och genomföra integrationen enligt den dokumentation och exempelkod som tillhandahålls.