TCP/IP
TCP/IP-Protokoll
Verbinden Sie Ihre Anwendung über ein TCP/IP-Kommunikationsprotokoll direkt mit der speechServer-Engine.
ReadSpeaker speechServer
Betreiben Sie die Text-to-Speech-Engine von ReadSpeaker auf Ihren eigenen Windows-Server- oder Linux-Maschinen. Ihre Anwendungen fordern Sprache über TCP/IP, das Kommandozeilenwerkzeug, die REST-API oder die SDKs für C, Java und .NET an.
IM INNEREN VON speechServer
ReadSpeaker speechServer ist ein netzbasierter Text-to-Speech-Server in Client-Server-Architektur. Sie installieren ihn auf Ihrer eigenen Infrastruktur, und Ihre Anwendungen fordern die Sprachsynthese über das Netz an. Er passt zu Teams, die Text-to-Speech in ihrer eigenen Umgebung brauchen, von virtuellen Assistenten und Benachrichtigungsplattformen bis zu Bildungsanwendungen und anderen serverbasierten Systemen, die Audio bei Bedarf erzeugen.
SO WIRD VERBUNDEN
Ihre Anwendung spricht mit speechServer auf dem Weg, der zu Ihrer Umgebung passt. Verbinden Sie sich über ein direktes Netzwerkprotokoll, das Kommandozeilenwerkzeug, eine Web-API oder ein Client-SDK in Ihrer eigenen Programmiersprache.
TCP/IP
Verbinden Sie Ihre Anwendung über ein TCP/IP-Kommunikationsprotokoll direkt mit der speechServer-Engine.
CLI
Steuern Sie die Sprachsynthese aus Skripten und Serverprozessen mit dem mitgelieferten Kommandozeilenwerkzeug.
REST
Rufen Sie speechServer über eine REST-API auf, wenn er hinter einem Webserver mit CGI-Unterstützung wie Apache läuft.
SDK
Integrieren Sie mit clientseitigen SDKs für C, Java und .NET, die die Kommunikation zwischen Ihrer Anwendung und speechServer übernehmen.
# direct socket connection
connect speechserver:5555
synth "Welcome"speechserver --voice Emma \
--text "Hello" --out out.wavPOST /synthesize
{ "voice": "Emma", "text": "Hi" }// .NET client SDK
var client = new SpeechServer();
client.Synthesize("Welcome");Die Codebeispiele dienen der Veranschaulichung. Die genaue API-Syntax finden Sie in der Benutzerdokumentation.
BETREIBEN SIE ES NACH IHREN VORSTELLUNGEN
Installieren Sie speechServer auf der Plattform, die Ihr Betrieb bereits nutzt.
Installieren Sie speechServer auf Ihren Windows-Server-Maschinen, neben den Diensten, die Ihr Betrieb bereits nutzt.
Installieren Sie speechServer auf den Linux-Distributionen, auf denen Ihre Infrastruktur aufbaut, von Bare Metal bis zur virtuellen Maschine.
AUDIOAUSGABE
speechServer streamt das Audio in dem Format an Ihre Anwendung zurück, das Ihre Pipeline erwartet, von telefoniefähigen Kodierungen bis zu gängigen Medienformaten.
STIMMEN
speechServer nutzt den ReadSpeaker-Katalog mit mehr als 150 KI-Stimmen in über 50 Sprachen, und neue Stimmen und Sprachen kommen regelmäßig hinzu. Jede lizenzierte Sprache umfasst ein Benutzerwörterbuch, mit dem Sie die Aussprache für Fachbegriffe feinjustieren können.
Weltweite Abdeckung
FEINE STEUERUNG
Gestalten Sie den Vortrag Ihres Textes bis auf das einzelne Wort, mit den Steuerungen, die Ihr Inhalt bereits mitbringt.
Wechseln Sie mitten im Text zu einer anderen Stimme oder einer anderen Sprache, mit SSML-Anweisungen in Ihrer Eingabe. Passen Sie Sprechgeschwindigkeit, Tonhöhe und Lautstärke nach Bedarf an.
Legen Sie mit Benutzerwörterbüchern je Sprache und IPA-Transkription eigene Aussprachen für Wörter und Muster fest, damit Fachbegriffe korrekt vorgelesen werden.
Fügen Sie in Ihren Eingabetext Verweise auf Audioclips ein. speechServer setzt das referenzierte Audio an der richtigen Stelle in den gestreamten Ausgabestrom.
Erhalten Sie zusammen mit dem Audio Markierungsinformationen für Ereignisauslöser an Textpositionen, für die Synchronisation von Gerät und Oberfläche und für eine zur Wiedergabe passende Texthervorhebung.
BEREITSTELLUNG
speechServer läuft vollständig auf Ihren eigenen Servern, sodass Text und Audio in Ihrem Netz bleiben.
speechServer läuft vollständig auf Ihren eigenen Servern, sodass Text und Audio in Ihrem Netz bleiben. Die Installation erfolgt über den speechServer-Installer, und jede lizenzierte ReadSpeaker-Stimme lässt sich hinzufügen. Die Nutzung regelt eine Lizenzdatei, die Ihre Stimmen, gleichzeitigen Ports, die Synthesegeschwindigkeit, die Zahl der Server und die Laufzeit festlegt.
speechServer gegen OPEN SOURCE
Quelloffene Projekte können Text-to-Speech lokal betreiben, aber Sie pflegen Engine, Stimmen und Integration selbst. speechServer gibt Ihnen einen kommerziellen Server mit Support und einem gepflegten Stimmenkatalog.
| ReadSpeaker speechServer | Open-source do-it-yourself | |
|---|---|---|
| Typ | Kommerzielles Produkt, mit Support | Kostenlos, quelloffen, von der Community gepflegt |
| Stimmenkatalog | 150+ KI-Stimmen, 50+ Sprachen | Eigene Lösung, variiert |
| Integration | TCP/IP, Kommandozeile, REST, SDKs für C/Java/.NET | Verkabelung in Eigenregie |
| Support | ReadSpeaker-Supportteam, Installation und Implementierung | Community |
| Lizenzierung | Lizenzdatei mit festgelegten Konditionen | Projektlizenz, ohne SLA |
| Aktualisierungen der Stimmen | Regelmäßig ergänzt | Eigenbau |
FAQ
ReadSpeaker speechServer ist ein netzbasierter Text-to-Speech-Server für die eigene Infrastruktur. Sie betreiben ihn auf Ihren eigenen Windows-Server- oder Linux-Maschinen, und Ihre Anwendungen fordern die Sprachsynthese über das Netz an. Er liefert die ReadSpeaker-Text-to-Speech-Engine, eine Server-API und Werkzeuge als vollständige serverseitige Laufzeitumgebung.
speechServer wird selbst betrieben und läuft nicht in der Cloud: Er läuft auf Ihren eigenen Windows-Server- oder Linux-Maschinen, und Ihr Text sowie das erzeugte Audio bleiben in Ihrem eigenen Netz, statt durch einen Dienst Dritter zu laufen. Wenn Sie stattdessen eine verwaltete Cloud-API bevorzugen, ReadSpeaker speechCloud API is the hosted option.
Client-Anwendungen verbinden sich mit speechServer über ein TCP/IP-Kommunikationsprotokoll, ein Kommandozeilenwerkzeug oder eine REST-API, wenn er hinter einem Webserver mit CGI-Unterstützung wie Apache läuft. Client-seitige SDKs für C, Java und .NET stehen ebenfalls bereit.
speechServer bietet clientseitige SDKs für C, Java und .NET, die die Kommunikation zwischen Ihrer Anwendung und dem Server übernehmen, sodass Sie die Sprachsynthese in Ihrem eigenen Code integrieren, statt das Protokoll von Hand zu verdrahten. Unterstützte Entwicklungssprachen sind C und C++, Java sowie C# / .NET unter Windows.
speechServer läuft unter Windows Server und unter Linux. Fragen Sie unser Team nach der aktuellen Liste der unterstützten und getesteten Versionen für Ihre Umgebung.
speechServer gibt 16-Bit-Linear-PCM, PCM-Wave-Varianten, 8-Bit-A-law- und μ-law-PCM, 4-Bit-Dialogic-ADPCM, MP3 über das LAME-Paket und OGG aus. Diese Bandbreite deckt sowohl telefoniefähige Formate als auch die gängige Medienwiedergabe ab.
speechServer unterstützt den ReadSpeaker-Katalog mit mehr als 150 KI-Stimmen in über 50 Sprachen. Neue Stimmen und Sprachen kommen regelmäßig hinzu. Jede lizenzierte Sprache umfasst ein Benutzerwörterbuch und IPA-Unterstützung für eigene Aussprachen.
speechServer ist ein kommerzielles Produkt mit Support, mit einem gepflegten Katalog von 150+ KI-Stimmen, vier Integrationswegen und Unterstützung bei der Installation durch das ReadSpeaker-Supportteam. Quelloffene Projekte können lokal laufen, aber Sie pflegen Engine, Stimmen und Integration selbst, ohne SLA.
speechServer lässt sich direkt über TCP/IP, die Kommandozeile, REST oder die SDKs für C, Java und .NET integrieren, für allgemeine serverbasierte Anwendungen. ReadSpeaker speechServer MRCP uses the MRCP protocol for standards-based telephony and IVR platforms.
Die Nutzung von speechServer regelt eine Lizenzdatei. Sie legt die lizenzierten Stimmen, die Zahl gleichzeitiger Text-to-Speech-Ports, die zulässige Synthesegeschwindigkeit, die Zahl der abgedeckten Server und die Laufzeit fest. Die Gleichzeitigkeit ist allein durch Ihre lizenzierten Ports und die verfügbaren Systemressourcen begrenzt.