Zum Inhalt springen

ReadSpeaker speechEngine SDK

Offline-Text-to-Speech-SDK auf dem Gerät für Desktop- und PC-Anwendungen

Installieren Sie die Sprach-Engine direkt auf dem Zielrechner, wo sie Audio lokal erzeugt, ohne Netzwerkaufrufe. 150+ KI-Stimmen in 50+ Sprachen, mit nativen Bindungen für C, C++ und Java unter Windows und Linux sowie C# unter Windows.

  • C/C++ · C# · Java
  • Windows 10/11 + Linux
  • Auf dem Gerät

Kundengeschichte

Eingebaut in ausgelieferte Software, direkt auf dem Gerät

Soft Leaf

Das TTS-Plug-in von ReadSpeaker hat uns unzählige Entwicklungsstunden gespart und uns unserer Vision eines wirklich barrierefreien Spiels nähergebracht.

Conor BradleyGründer und Direktor, Soft Leaf Studios · Stories of Blossom
Die ganze Geschichte von Soft Leaf lesen

Funktionen

Sprachausgabe auf dem Gerät, gemacht für Entwicklerinnen und Entwickler

Alles, was Ihr Team braucht, um natürlich klingende Sprache in eine Desktop- oder PC-Anwendung zu bringen, mit lokal laufender Engine.

Liefern Sie Sprachausgabe aus, die das Gerät nie verlässt

Die Engine läuft auf dem Rechner Ihres Kunden und erzeugt Audio ganz ohne Netzwerkaufrufe. Gut geeignet für abgeschottete, regulierte oder offline-first betriebene Umgebungen, in denen die Daten im Haus bleiben.

150+ KI-Stimmen in 50+ Sprachen

Natürliche, menschlich klingende KI-Stimmen, mit regelmäßig neuen Stimmen und Sprachen im Katalog. Wählen Sie Akzent und Tonfall passend zu jedem Markt und liefern Sie sie mit einem Speicherbedarf aus, der gering bleibt.

Ihr Team schreibt in seiner Umgebung

Native Bindungen für C und C++ unter Windows und Linux, C# unter Windows sowie Java unter Windows und Linux. Beispielcode, Dokumentation und Unterstützung bei der Implementierung durch unser Team machen die Integration einfach.

Feine Stimmsteuerung mit SSML

Wechseln Sie Stimme und Sprache mitten im Satz, steuern Sie die Prosodie, fügen Sie Pausen und phonetische Transkriptionen ein. Die Eingabe per Speech Synthesis Markup Language (SSML) wird vollständig unterstützt, in UTF-8.

Markennamen und Fachjargon korrekt aussprechen

Erstellen Sie Aussprachewörterbücher je Sprache für Produktnamen, Abkürzungen und Eigennamen, mit mehreren Wörterbüchern pro Sprache. Nutzen Sie die IPA-Transkription, wenn Sie präzise phonetische Kontrolle brauchen.

Audioformate für jede Pipeline

16-Bit-Linear-PCM, 8-Bit-A-law und μ-law für Telefonie, Dialogic ADPCM für ältere IVR-Systeme. Geben Sie das Format aus, das Ihre Pipeline erwartet, roh oder als WAV verpackt.

Jede Äußerung feinjustieren

Stellen Sie Sprechgeschwindigkeit, Tonhöhe und Lautstärke passend zur Situation ein, von ruhiger Erzählung bis zur dringenden Warnung. Konfigurieren Sie sie für jede Bereitstellung nach Bedarf.

Berechenbare Lizenzierung

Eine zusammen mit dem SDK installierte Lizenzdatei fixiert die bestellten Stimmen und die Laufzeit. Keine überraschenden Upgrades, keine nutzungsabhängige Abrechnung, keine Sorge vor Audits.

Echte Menschen helfen Ihnen beim Ausliefern

Das Supportteam von ReadSpeaker begleitet Ihre Entwicklerinnen und Entwickler durch die Integration. Beispielcode, Dokumentation und direkter Kontakt bedeuten, dass Sie nie um 2 Uhr nachts in einem Wiki festhängen.

In Ihrer Umgebung ausprobieren

Ein einfaches Integrationsbeispiel in C++

Native Bindungen werden für C und C++ unter Windows und Linux, C# unter Windows sowie Java unter Windows und Linux ausgeliefert. Rufen Sie die Engine im selben Prozess auf und synthetisieren Sie Text in eine lokale Audiodatei, ohne Netzwerkaufrufe.

// Representative example. The exact API and headers ship with the licensed SDK.
#include "speechengine.h"

int main() {
    SpeechEngine engine;
    engine.init("./license.lic");          // license file enforces voices + term
    engine.selectVoice("en_US-neural");       // 150+ voices, 50+ languages
    engine.setSpeechRate(90);                 // tune rate, pitch and volume per request

    // Synthesise plain text or SSML to a local audio file, no server calls
    engine.synthesizeToFile("Welcome to ReadSpeaker.", "welcome.wav");

    engine.release();                          // free the engine
    return 0;
}

Technische Spezifikationen

Jede Angabe, nach der Ihre Entwicklungs- und Betriebsteams fragen werden

Ausgelegt für den Offline-Einsatz auf dem Gerät: geringer Speicherbedarf, breite Betriebssystemunterstützung, telefoniefähiges Audio.

Technische Spezifikationen von speechEngine SDK 4.5
SpecificationDetail
ProgrammiersprachenC / C++ (Windows/Linux) · C# (Windows) · Java (Windows/Linux)
Windows-BetriebssystemWindows 10 und 11
Linux-BetriebssystemCentOS Stream 9.x bis 10.x · Ubuntu 18.x bis 24.x · RHEL 7.x bis 9.x · Weitere Betriebssysteme auf Anfrage
CPUIntel x86/64, 1 GHz oder höher. Auf x64-Architekturen ist AVX erforderlich (wenden Sie sich an ReadSpeaker, wenn Ihre Umgebung AVX nicht unterstützt).
RAM6 bis 30 MB
Speicherbedarf der Stimmen9 bis 35 MB pro Stimme (Deep-Neural-Networks-Technologie)
Arbeitsspeicher zur Laufzeit20 bis 30 MB (Neural Standard)
EingabeformateReiner Text (Multibyte) · SSML (UTF-8)
Audioausgabeformate16-Bit-Linear-PCM (raw/WAV) · 8-Bit-PCM A-law/μ-law (raw/WAV) · 8-Bit-Unsigned-Linear-PCM Wave · 4-Bit-Dialogic-ADPCM
DokumentationProduktspezifikation (PDF)

Bereitstellungsmodell

Läuft auf Ihrer Infrastruktur, gemäß Ihrer Lizenzdatei

speechEngine SDK wird lokal auf dem Zielrechner installiert. Die TTS-Engine läuft ohne Serveraufrufe. Lizenzvertrag und Lizenzdatei setzen die lizenzierte Plattform, die Stimmen und die Laufzeit durch. Unterlagen zur Konformität des Unternehmens (ISO/IEC 27001, DSGVO, EU-Standardvertragsklauseln) finden Sie in der Datenschutzerklärung von ReadSpeaker und auf den Seiten über das Unternehmen.

  • Auf dem Gerät (Engine auf dem Zielrechner installiert)

    Lokal installiert

  • Keine Netzwerkaufrufe (Audio wird ohne Serveranfragen erzeugt)

    Die Engine läuft lokal

  • Durchsetzung über die Lizenzdatei (Lizenzdatei wird mit dem SDK ausgeliefert)

    Stimmen + Laufzeit

  • SDK-Auslieferung (SDK, gebaut für die im Auftrag genannte Plattform)

    Je Kundenauftrag

FAQ

Fragen zu speechEngine SDK

  • speechEngine SDK ist ein Text-to-Speech-SDK für den Einsatz auf dem Gerät, für Entwicklerinnen und Entwickler von Desktop- und PC-Anwendungen. Die Engine wird lokal auf dem Zielrechner installiert und unterstützt 150+ KI-Stimmen in 50+ Sprachen. Sie läuft ohne Netzverbindung, was zu abgeschotteten und datenschutzsensiblen Umgebungen passt.

  • speechEngine SDK liefert native Bindungen für C und C++ unter Windows und Linux, C# unter Windows sowie Java unter Windows und Linux. Das SDK wird für die im Kundenauftrag genannte Plattform ausgeliefert.

  • speechEngine SDK läuft unter Windows 10 und 11 sowie auf Linux-Distributionen wie CentOS Stream 9.x bis 10.x, Ubuntu 18.x bis 24.x und RHEL 7.x bis 9.x. Weitere Betriebssysteme werden auf Anfrage unterstützt. CPU: Intel x86/64 mit 1 GHz oder höher (auf x64 ist AVX erforderlich). RAM: 6 bis 30 MB.

  • Ja. Die TTS-Engine wird lokal auf dem Zielrechner installiert und erzeugt Audio ohne Netzwerkaufrufe, was zu datenschutzsensiblen und abgeschotteten Umgebungen passt. Für Ziele auf ARM, Mobilgeräten oder im IoT siehe speechEngine SDK Embedded.

  • speechEngine SDK gibt vier Audioformate aus: 16-Bit-Linear-PCM (raw/WAV), 8-Bit-PCM A-law/μ-law (raw/WAV), 8-Bit-Unsigned-Linear-PCM Wave und 4-Bit-Dialogic-ADPCM. Die Ausgabe in A-law und μ-law eignet sich besonders für die Telefonie-Integration.

  • Ja. speechEngine SDK nimmt reinen Text (Multibyte) und SSML (UTF-8) entgegen, sodass Ihre Anwendung die gewünschte Sprachausgabe auszeichnen kann. Mit SSML wechseln Sie Stimme und Sprache innerhalb eines Textes, verändern die Prosodie, fügen Pausen ein und wenden phonetische Transkriptionen an.

  • speechEngine SDK unterliegt einem Lizenzvertrag, der die lizenzierte Plattform, die Stimmen und den zulässigen Nutzungskontext festlegt. Eine mit dem SDK ausgelieferte Lizenzdatei setzt die lizenzierten Stimmen und die Laufzeit, also die Dauer der erlaubten Nutzung, technisch durch.

  • Ja. Unterstützung bei der Implementierung durch das ReadSpeaker-Supportteam ist inbegriffen. Das Team hilft Kunden dabei, die Integration gemäß der bereitgestellten Dokumentation und dem Beispielcode zu verstehen und umzusetzen.

Bereit, Ihrer Desktop-Anwendung eine Stimme zu geben?

Nennen Sie uns Ihre Plattform und Ihre Zielsprachen. Unser Team bestimmt die passenden Stimmen, die Auslieferung und die Lizenzkonditionen und liefert das SDK dann mit Beispielcode und Unterstützung bei der Implementierung aus.

Find your ReadSpeaker solution

Opening the conversation…

Search

    Searching…

    No results for

    Try another wording, or start from one of these.

    Search is not available right now.

    You can still reach the pages below.