Das TTS-Plug-in von ReadSpeaker hat uns unzählige Entwicklungsstunden gespart und uns unserer Vision eines wirklich barrierefreien Spiels nähergebracht.
Die ganze Geschichte von Soft Leaf lesenReadSpeaker speechEngine SDK
Offline-Text-to-Speech-SDK auf dem Gerät für Desktop- und PC-Anwendungen
Installieren Sie die Sprach-Engine direkt auf dem Zielrechner, wo sie Audio lokal erzeugt, ohne Netzwerkaufrufe. 150+ KI-Stimmen in 50+ Sprachen, mit nativen Bindungen für C, C++ und Java unter Windows und Linux sowie C# unter Windows.
- C/C++ · C# · Java
- Windows 10/11 + Linux
- Auf dem Gerät
Kundengeschichte
Eingebaut in ausgelieferte Software, direkt auf dem Gerät
Funktionen
Sprachausgabe auf dem Gerät, gemacht für Entwicklerinnen und Entwickler
Alles, was Ihr Team braucht, um natürlich klingende Sprache in eine Desktop- oder PC-Anwendung zu bringen, mit lokal laufender Engine.
Liefern Sie Sprachausgabe aus, die das Gerät nie verlässt
Die Engine läuft auf dem Rechner Ihres Kunden und erzeugt Audio ganz ohne Netzwerkaufrufe. Gut geeignet für abgeschottete, regulierte oder offline-first betriebene Umgebungen, in denen die Daten im Haus bleiben.
150+ KI-Stimmen in 50+ Sprachen
Natürliche, menschlich klingende KI-Stimmen, mit regelmäßig neuen Stimmen und Sprachen im Katalog. Wählen Sie Akzent und Tonfall passend zu jedem Markt und liefern Sie sie mit einem Speicherbedarf aus, der gering bleibt.
Ihr Team schreibt in seiner Umgebung
Native Bindungen für C und C++ unter Windows und Linux, C# unter Windows sowie Java unter Windows und Linux. Beispielcode, Dokumentation und Unterstützung bei der Implementierung durch unser Team machen die Integration einfach.
Feine Stimmsteuerung mit SSML
Wechseln Sie Stimme und Sprache mitten im Satz, steuern Sie die Prosodie, fügen Sie Pausen und phonetische Transkriptionen ein. Die Eingabe per Speech Synthesis Markup Language (SSML) wird vollständig unterstützt, in UTF-8.
Markennamen und Fachjargon korrekt aussprechen
Erstellen Sie Aussprachewörterbücher je Sprache für Produktnamen, Abkürzungen und Eigennamen, mit mehreren Wörterbüchern pro Sprache. Nutzen Sie die IPA-Transkription, wenn Sie präzise phonetische Kontrolle brauchen.
Audioformate für jede Pipeline
16-Bit-Linear-PCM, 8-Bit-A-law und μ-law für Telefonie, Dialogic ADPCM für ältere IVR-Systeme. Geben Sie das Format aus, das Ihre Pipeline erwartet, roh oder als WAV verpackt.
Jede Äußerung feinjustieren
Stellen Sie Sprechgeschwindigkeit, Tonhöhe und Lautstärke passend zur Situation ein, von ruhiger Erzählung bis zur dringenden Warnung. Konfigurieren Sie sie für jede Bereitstellung nach Bedarf.
Berechenbare Lizenzierung
Eine zusammen mit dem SDK installierte Lizenzdatei fixiert die bestellten Stimmen und die Laufzeit. Keine überraschenden Upgrades, keine nutzungsabhängige Abrechnung, keine Sorge vor Audits.
Echte Menschen helfen Ihnen beim Ausliefern
Das Supportteam von ReadSpeaker begleitet Ihre Entwicklerinnen und Entwickler durch die Integration. Beispielcode, Dokumentation und direkter Kontakt bedeuten, dass Sie nie um 2 Uhr nachts in einem Wiki festhängen.
In Ihrer Umgebung ausprobieren
Ein einfaches Integrationsbeispiel in C++
Native Bindungen werden für C und C++ unter Windows und Linux, C# unter Windows sowie Java unter Windows und Linux ausgeliefert. Rufen Sie die Engine im selben Prozess auf und synthetisieren Sie Text in eine lokale Audiodatei, ohne Netzwerkaufrufe.
// Representative example. The exact API and headers ship with the licensed SDK.
#include "speechengine.h"
int main() {
SpeechEngine engine;
engine.init("./license.lic"); // license file enforces voices + term
engine.selectVoice("en_US-neural"); // 150+ voices, 50+ languages
engine.setSpeechRate(90); // tune rate, pitch and volume per request
// Synthesise plain text or SSML to a local audio file, no server calls
engine.synthesizeToFile("Welcome to ReadSpeaker.", "welcome.wav");
engine.release(); // free the engine
return 0;
}Technische Spezifikationen
Jede Angabe, nach der Ihre Entwicklungs- und Betriebsteams fragen werden
Ausgelegt für den Offline-Einsatz auf dem Gerät: geringer Speicherbedarf, breite Betriebssystemunterstützung, telefoniefähiges Audio.
| Specification | Detail |
|---|---|
| Programmiersprachen | C / C++ (Windows/Linux) · C# (Windows) · Java (Windows/Linux) |
| Windows-Betriebssystem | Windows 10 und 11 |
| Linux-Betriebssystem | CentOS Stream 9.x bis 10.x · Ubuntu 18.x bis 24.x · RHEL 7.x bis 9.x · Weitere Betriebssysteme auf Anfrage |
| CPU | Intel x86/64, 1 GHz oder höher. Auf x64-Architekturen ist AVX erforderlich (wenden Sie sich an ReadSpeaker, wenn Ihre Umgebung AVX nicht unterstützt). |
| RAM | 6 bis 30 MB |
| Speicherbedarf der Stimmen | 9 bis 35 MB pro Stimme (Deep-Neural-Networks-Technologie) |
| Arbeitsspeicher zur Laufzeit | 20 bis 30 MB (Neural Standard) |
| Eingabeformate | Reiner Text (Multibyte) · SSML (UTF-8) |
| Audioausgabeformate | 16-Bit-Linear-PCM (raw/WAV) · 8-Bit-PCM A-law/μ-law (raw/WAV) · 8-Bit-Unsigned-Linear-PCM Wave · 4-Bit-Dialogic-ADPCM |
| Dokumentation | Produktspezifikation (PDF) |
Bereitstellungsmodell
Läuft auf Ihrer Infrastruktur, gemäß Ihrer Lizenzdatei
speechEngine SDK wird lokal auf dem Zielrechner installiert. Die TTS-Engine läuft ohne Serveraufrufe. Lizenzvertrag und Lizenzdatei setzen die lizenzierte Plattform, die Stimmen und die Laufzeit durch. Unterlagen zur Konformität des Unternehmens (ISO/IEC 27001, DSGVO, EU-Standardvertragsklauseln) finden Sie in der Datenschutzerklärung von ReadSpeaker und auf den Seiten über das Unternehmen.
Auf dem Gerät (Engine auf dem Zielrechner installiert)
Lokal installiert
Keine Netzwerkaufrufe (Audio wird ohne Serveranfragen erzeugt)
Die Engine läuft lokal
Durchsetzung über die Lizenzdatei (Lizenzdatei wird mit dem SDK ausgeliefert)
Stimmen + Laufzeit
SDK-Auslieferung (SDK, gebaut für die im Auftrag genannte Plattform)
Je Kundenauftrag
FAQ
Fragen zu speechEngine SDK
speechEngine SDK ist ein Text-to-Speech-SDK für den Einsatz auf dem Gerät, für Entwicklerinnen und Entwickler von Desktop- und PC-Anwendungen. Die Engine wird lokal auf dem Zielrechner installiert und unterstützt 150+ KI-Stimmen in 50+ Sprachen. Sie läuft ohne Netzverbindung, was zu abgeschotteten und datenschutzsensiblen Umgebungen passt.
speechEngine SDK liefert native Bindungen für C und C++ unter Windows und Linux, C# unter Windows sowie Java unter Windows und Linux. Das SDK wird für die im Kundenauftrag genannte Plattform ausgeliefert.
speechEngine SDK läuft unter Windows 10 und 11 sowie auf Linux-Distributionen wie CentOS Stream 9.x bis 10.x, Ubuntu 18.x bis 24.x und RHEL 7.x bis 9.x. Weitere Betriebssysteme werden auf Anfrage unterstützt. CPU: Intel x86/64 mit 1 GHz oder höher (auf x64 ist AVX erforderlich). RAM: 6 bis 30 MB.
Ja. Die TTS-Engine wird lokal auf dem Zielrechner installiert und erzeugt Audio ohne Netzwerkaufrufe, was zu datenschutzsensiblen und abgeschotteten Umgebungen passt. Für Ziele auf ARM, Mobilgeräten oder im IoT siehe speechEngine SDK Embedded.
speechEngine SDK gibt vier Audioformate aus: 16-Bit-Linear-PCM (raw/WAV), 8-Bit-PCM A-law/μ-law (raw/WAV), 8-Bit-Unsigned-Linear-PCM Wave und 4-Bit-Dialogic-ADPCM. Die Ausgabe in A-law und μ-law eignet sich besonders für die Telefonie-Integration.
Ja. speechEngine SDK nimmt reinen Text (Multibyte) und SSML (UTF-8) entgegen, sodass Ihre Anwendung die gewünschte Sprachausgabe auszeichnen kann. Mit SSML wechseln Sie Stimme und Sprache innerhalb eines Textes, verändern die Prosodie, fügen Pausen ein und wenden phonetische Transkriptionen an.
speechEngine SDK unterliegt einem Lizenzvertrag, der die lizenzierte Plattform, die Stimmen und den zulässigen Nutzungskontext festlegt. Eine mit dem SDK ausgelieferte Lizenzdatei setzt die lizenzierten Stimmen und die Laufzeit, also die Dauer der erlaubten Nutzung, technisch durch.
Ja. Unterstützung bei der Implementierung durch das ReadSpeaker-Supportteam ist inbegriffen. Das Team hilft Kunden dabei, die Integration gemäß der bereitgestellten Dokumentation und dem Beispielcode zu verstehen und umzusetzen.