Usare il plug-in di sintesi vocale di ReadSpeaker ci ha risparmiato innumerevoli ore di sviluppo e ci ha avvicinati alla nostra idea di un gioco davvero accessibile.
Legga la storia completa di Soft LeafReadSpeaker speechEngine SDK
SDK di sintesi vocale offline, sul dispositivo, per applicazioni desktop e PC
Installi il motore vocale direttamente sulla macchina di destinazione, dove genera l'audio in locale senza chiamate di rete. Oltre 150 voci IA in più di 50 lingue, con binding nativi per C, C++ e Java su Windows e Linux, e C# su Windows.
- C/C++ · C# · Java
- Windows 10/11 e Linux
- Sul dispositivo
Storia cliente
Integrato nel software che distribuisce, direttamente sul dispositivo
Funzionalità
Voce sul dispositivo, pensata per gli sviluppatori
Tutto ciò che serve al suo team per mettere una voce dal suono naturale dentro un'applicazione desktop o PC, con il motore che funziona in locale.
Distribuisca una voce che non lascia mai il dispositivo
Il motore funziona sulla macchina del suo cliente e genera l'audio senza alcuna chiamata di rete. Una buona scelta per i deployment isolati dalla rete, regolamentati o offline-first, dove i dati restano in casa.
Oltre 150 voci IA in più di 50 lingue
Voci IA naturali e simili all'umano, con nuove voci e nuove lingue aggiunte regolarmente al catalogo. Scelga l'accento e il tono adatti a ciascun mercato e li distribuisca con un ingombro su disco che resta leggero.
Il suo team scrive nella sua infrastruttura
Binding nativi per C e C++ su Windows e Linux, C# su Windows e Java su Windows e Linux. Codice di esempio, documentazione e supporto all'implementazione del nostro team rendono l'integrazione semplice.
Controllo vocale di precisione con SSML
Cambi voce e lingua a metà frase, controlli la prosodia, inserisca pause e trascrizioni fonetiche. L'input Speech Synthesis Markup Language (SSML) è pienamente supportato, in UTF-8.
Pronunci correttamente nomi di marca e gergo tecnico
Crei dizionari di pronuncia per lingua per nomi di prodotto, acronimi e nomi propri, con più dizionari per ciascuna lingua. Usi la trascrizione IPA quando le serve un controllo fonetico preciso.
Formati audio per qualsiasi pipeline
PCM lineare a 16 bit, A-law e μ-law a 8 bit per la telefonia, Dialogic ADPCM per gli IVR legacy. Produce il formato atteso dalla sua pipeline, raw o incapsulato in WAV.
Regoli ogni enunciato
Regoli velocità di lettura, intonazione e volume in base al momento, dalla narrazione pacata agli avvisi urgenti. Li configuri come serve per ogni deployment.
Licenze prevedibili
Un file di licenza installato accanto all'SDK blocca le voci e la durata che ha ordinato. Nessun aggiornamento a sorpresa, nessuna fatturazione a consumo, nessuna ansia da audit.
Persone vere la aiutano a rilasciare
Il team di supporto ReadSpeaker segue i suoi sviluppatori lungo tutta l'integrazione. Codice di esempio, documentazione e contatto diretto fanno sì che non si ritrovi mai a leggere un wiki alle 2 di notte.
Lo provi nella sua infrastruttura
Un semplice esempio di integrazione in C++
I binding nativi sono forniti per C e C++ su Windows e Linux, C# su Windows e Java su Windows e Linux. Chiami il motore in-process e sintetizzi il testo in un file audio locale, senza chiamate di rete.
// Representative example. The exact API and headers ship with the licensed SDK.
#include "speechengine.h"
int main() {
SpeechEngine engine;
engine.init("./license.lic"); // license file enforces voices + term
engine.selectVoice("en_US-neural"); // 150+ voices, 50+ languages
engine.setSpeechRate(90); // tune rate, pitch and volume per request
// Synthesise plain text or SSML to a local audio file, no server calls
engine.synthesizeToFile("Welcome to ReadSpeaker.", "welcome.wav");
engine.release(); // free the engine
return 0;
}Specifiche tecniche
Ogni specifica che i suoi team di sviluppo e operations chiederanno
Dimensionato per un deployment offline sul dispositivo: ingombro ridotto, ampio supporto dei sistemi operativi, audio pronto per la telefonia.
| Specification | Detail |
|---|---|
| Linguaggi di programmazione | C / C++ (Windows/Linux) · C# (Windows) · Java (Windows/Linux) |
| Sistema operativo Windows | Windows 10 e 11 |
| Sistema operativo Linux | CentOS Stream 9.x to 10.x · Ubuntu 18.x to 24.x · RHEL 7.x to 9.x · Altri sistemi operativi su richiesta |
| CPU | Intel x86/64, 1 GHz o superiore. AVX richiesto sulle architetture x64 (contatti ReadSpeaker se il suo ambiente non supporta AVX). |
| RAM | da 6 a 30 MB |
| Ingombro della voce | da 9 a 35 MB per voce (tecnologia Deep Neural Networks) |
| Memoria in esecuzione | da 20 a 30 MB (Neural Standard) |
| Formati di input | Testo semplice (multibyte) · SSML (UTF-8) |
| Formati di uscita audio | PCM lineare a 16 bit (raw/WAV) · PCM A-law/μ-law a 8 bit (raw/WAV) · PCM lineare senza segno a 8 bit Wave · Dialogic ADPCM a 4 bit |
| Documentazione | Scheda tecnica di prodotto (PDF) |
Modello di deployment
Funziona sulla sua infrastruttura, sotto il suo file di licenza
speechEngine SDK si installa in locale sulla macchina di destinazione. Il motore TTS funziona senza chiamate al server. Il contratto e il file di licenza impongono piattaforma, voci e durata in licenza. Per la documentazione di conformità aziendale (ISO/IEC 27001, GDPR, SCC dell'UE), veda l'informativa sulla privacy di ReadSpeaker e le pagine About.
Sul dispositivo (Motore installato sulla macchina di destinazione)
Installato in locale
Nessuna chiamata di rete (Audio generato senza andata e ritorno verso il server)
Il motore funziona in locale
Applicazione del file di licenza (File di licenza consegnato con l'SDK)
Voci e durata
Consegna dell'SDK (SDK creato per la piattaforma indicata nell'ordine)
Per ordine del cliente
FAQ
Domande su speechEngine SDK
speechEngine SDK è un SDK di sintesi vocale sul dispositivo per sviluppatori che realizzano applicazioni desktop e per PC. Il motore si installa in locale sulla macchina di destinazione e supporta oltre 150 voci IA in più di 50 lingue. Funziona senza connessione di rete, il che si adatta agli ambienti isolati dalla rete e sensibili alla riservatezza.
speechEngine SDK fornisce binding nativi per C e C++ su Windows e Linux, C# su Windows e Java su Windows e Linux. L'SDK viene consegnato per la piattaforma indicata nell'ordine del cliente.
speechEngine SDK funziona su Windows 10 e 11 e sulle distribuzioni Linux tra cui CentOS Stream da 9.x a 10.x, Ubuntu da 18.x a 24.x e RHEL da 7.x a 9.x. Altri sistemi operativi sono supportati su richiesta. CPU: Intel x86/64 da 1 GHz o superiore (AVX richiesto su x64). RAM: 6-30 MB.
Sì. Il motore TTS si installa in locale sulla macchina di destinazione e genera l'audio senza chiamate di rete, il che si adatta ai deployment isolati dalla rete e sensibili alla riservatezza. Per destinazioni ARM, mobili o IoT, veda speechEngine SDK Embedded.
speechEngine SDK produce quattro formati audio: PCM lineare a 16 bit (raw/WAV), PCM A-law/μ-law a 8 bit (raw/WAV), PCM lineare senza segno a 8 bit Wave e Dialogic ADPCM a 4 bit. L'uscita A-law e μ-law è particolarmente adatta all'integrazione telefonica.
Sì. speechEngine SDK accetta input in testo semplice (multibyte) e input SSML (UTF-8), così la sua applicazione può marcare la voce di cui ha bisogno. SSML permette di cambiare voce e lingua all'interno di un unico testo, modificare la prosodia, inserire pause e applicare trascrizioni fonetiche.
speechEngine SDK è regolato da un contratto di licenza che definisce la piattaforma, le voci in licenza e il contesto d'uso consentito. Un file di licenza consegnato con l'SDK applica tecnicamente le voci in licenza e la durata, cioè il periodo di utilizzo consentito.
Sì. Il supporto all'implementazione del team di supporto ReadSpeaker è incluso. Il team aiuta i clienti a comprendere e a realizzare l'integrazione seguendo la documentazione e il codice di esempio forniti.