Vai al contenuto

ReadSpeaker speechEngine SDK

SDK di sintesi vocale offline, sul dispositivo, per applicazioni desktop e PC

Installi il motore vocale direttamente sulla macchina di destinazione, dove genera l'audio in locale senza chiamate di rete. Oltre 150 voci IA in più di 50 lingue, con binding nativi per C, C++ e Java su Windows e Linux, e C# su Windows.

  • C/C++ · C# · Java
  • Windows 10/11 e Linux
  • Sul dispositivo

Storia cliente

Integrato nel software che distribuisce, direttamente sul dispositivo

Soft Leaf

Usare il plug-in di sintesi vocale di ReadSpeaker ci ha risparmiato innumerevoli ore di sviluppo e ci ha avvicinati alla nostra idea di un gioco davvero accessibile.

Conor BradleyFondatore e direttore, Soft Leaf Studios · Stories of Blossom
Legga la storia completa di Soft Leaf

Funzionalità

Voce sul dispositivo, pensata per gli sviluppatori

Tutto ciò che serve al suo team per mettere una voce dal suono naturale dentro un'applicazione desktop o PC, con il motore che funziona in locale.

Distribuisca una voce che non lascia mai il dispositivo

Il motore funziona sulla macchina del suo cliente e genera l'audio senza alcuna chiamata di rete. Una buona scelta per i deployment isolati dalla rete, regolamentati o offline-first, dove i dati restano in casa.

Oltre 150 voci IA in più di 50 lingue

Voci IA naturali e simili all'umano, con nuove voci e nuove lingue aggiunte regolarmente al catalogo. Scelga l'accento e il tono adatti a ciascun mercato e li distribuisca con un ingombro su disco che resta leggero.

Il suo team scrive nella sua infrastruttura

Binding nativi per C e C++ su Windows e Linux, C# su Windows e Java su Windows e Linux. Codice di esempio, documentazione e supporto all'implementazione del nostro team rendono l'integrazione semplice.

Controllo vocale di precisione con SSML

Cambi voce e lingua a metà frase, controlli la prosodia, inserisca pause e trascrizioni fonetiche. L'input Speech Synthesis Markup Language (SSML) è pienamente supportato, in UTF-8.

Pronunci correttamente nomi di marca e gergo tecnico

Crei dizionari di pronuncia per lingua per nomi di prodotto, acronimi e nomi propri, con più dizionari per ciascuna lingua. Usi la trascrizione IPA quando le serve un controllo fonetico preciso.

Formati audio per qualsiasi pipeline

PCM lineare a 16 bit, A-law e μ-law a 8 bit per la telefonia, Dialogic ADPCM per gli IVR legacy. Produce il formato atteso dalla sua pipeline, raw o incapsulato in WAV.

Regoli ogni enunciato

Regoli velocità di lettura, intonazione e volume in base al momento, dalla narrazione pacata agli avvisi urgenti. Li configuri come serve per ogni deployment.

Licenze prevedibili

Un file di licenza installato accanto all'SDK blocca le voci e la durata che ha ordinato. Nessun aggiornamento a sorpresa, nessuna fatturazione a consumo, nessuna ansia da audit.

Persone vere la aiutano a rilasciare

Il team di supporto ReadSpeaker segue i suoi sviluppatori lungo tutta l'integrazione. Codice di esempio, documentazione e contatto diretto fanno sì che non si ritrovi mai a leggere un wiki alle 2 di notte.

Lo provi nella sua infrastruttura

Un semplice esempio di integrazione in C++

I binding nativi sono forniti per C e C++ su Windows e Linux, C# su Windows e Java su Windows e Linux. Chiami il motore in-process e sintetizzi il testo in un file audio locale, senza chiamate di rete.

// Representative example. The exact API and headers ship with the licensed SDK.
#include "speechengine.h"

int main() {
    SpeechEngine engine;
    engine.init("./license.lic");          // license file enforces voices + term
    engine.selectVoice("en_US-neural");       // 150+ voices, 50+ languages
    engine.setSpeechRate(90);                 // tune rate, pitch and volume per request

    // Synthesise plain text or SSML to a local audio file, no server calls
    engine.synthesizeToFile("Welcome to ReadSpeaker.", "welcome.wav");

    engine.release();                          // free the engine
    return 0;
}

Specifiche tecniche

Ogni specifica che i suoi team di sviluppo e operations chiederanno

Dimensionato per un deployment offline sul dispositivo: ingombro ridotto, ampio supporto dei sistemi operativi, audio pronto per la telefonia.

Specifiche tecniche di speechEngine SDK 4.5
SpecificationDetail
Linguaggi di programmazioneC / C++ (Windows/Linux) · C# (Windows) · Java (Windows/Linux)
Sistema operativo WindowsWindows 10 e 11
Sistema operativo LinuxCentOS Stream 9.x to 10.x · Ubuntu 18.x to 24.x · RHEL 7.x to 9.x · Altri sistemi operativi su richiesta
CPUIntel x86/64, 1 GHz o superiore. AVX richiesto sulle architetture x64 (contatti ReadSpeaker se il suo ambiente non supporta AVX).
RAMda 6 a 30 MB
Ingombro della voceda 9 a 35 MB per voce (tecnologia Deep Neural Networks)
Memoria in esecuzioneda 20 a 30 MB (Neural Standard)
Formati di inputTesto semplice (multibyte) · SSML (UTF-8)
Formati di uscita audioPCM lineare a 16 bit (raw/WAV) · PCM A-law/μ-law a 8 bit (raw/WAV) · PCM lineare senza segno a 8 bit Wave · Dialogic ADPCM a 4 bit
DocumentazioneScheda tecnica di prodotto (PDF)

Modello di deployment

Funziona sulla sua infrastruttura, sotto il suo file di licenza

speechEngine SDK si installa in locale sulla macchina di destinazione. Il motore TTS funziona senza chiamate al server. Il contratto e il file di licenza impongono piattaforma, voci e durata in licenza. Per la documentazione di conformità aziendale (ISO/IEC 27001, GDPR, SCC dell'UE), veda l'informativa sulla privacy di ReadSpeaker e le pagine About.

  • Sul dispositivo (Motore installato sulla macchina di destinazione)

    Installato in locale

  • Nessuna chiamata di rete (Audio generato senza andata e ritorno verso il server)

    Il motore funziona in locale

  • Applicazione del file di licenza (File di licenza consegnato con l'SDK)

    Voci e durata

  • Consegna dell'SDK (SDK creato per la piattaforma indicata nell'ordine)

    Per ordine del cliente

FAQ

Domande su speechEngine SDK

  • speechEngine SDK è un SDK di sintesi vocale sul dispositivo per sviluppatori che realizzano applicazioni desktop e per PC. Il motore si installa in locale sulla macchina di destinazione e supporta oltre 150 voci IA in più di 50 lingue. Funziona senza connessione di rete, il che si adatta agli ambienti isolati dalla rete e sensibili alla riservatezza.

  • speechEngine SDK fornisce binding nativi per C e C++ su Windows e Linux, C# su Windows e Java su Windows e Linux. L'SDK viene consegnato per la piattaforma indicata nell'ordine del cliente.

  • speechEngine SDK funziona su Windows 10 e 11 e sulle distribuzioni Linux tra cui CentOS Stream da 9.x a 10.x, Ubuntu da 18.x a 24.x e RHEL da 7.x a 9.x. Altri sistemi operativi sono supportati su richiesta. CPU: Intel x86/64 da 1 GHz o superiore (AVX richiesto su x64). RAM: 6-30 MB.

  • Sì. Il motore TTS si installa in locale sulla macchina di destinazione e genera l'audio senza chiamate di rete, il che si adatta ai deployment isolati dalla rete e sensibili alla riservatezza. Per destinazioni ARM, mobili o IoT, veda speechEngine SDK Embedded.

  • speechEngine SDK produce quattro formati audio: PCM lineare a 16 bit (raw/WAV), PCM A-law/μ-law a 8 bit (raw/WAV), PCM lineare senza segno a 8 bit Wave e Dialogic ADPCM a 4 bit. L'uscita A-law e μ-law è particolarmente adatta all'integrazione telefonica.

  • Sì. speechEngine SDK accetta input in testo semplice (multibyte) e input SSML (UTF-8), così la sua applicazione può marcare la voce di cui ha bisogno. SSML permette di cambiare voce e lingua all'interno di un unico testo, modificare la prosodia, inserire pause e applicare trascrizioni fonetiche.

  • speechEngine SDK è regolato da un contratto di licenza che definisce la piattaforma, le voci in licenza e il contesto d'uso consentito. Un file di licenza consegnato con l'SDK applica tecnicamente le voci in licenza e la durata, cioè il periodo di utilizzo consentito.

  • Sì. Il supporto all'implementazione del team di supporto ReadSpeaker è incluso. Il team aiuta i clienti a comprendere e a realizzare l'integrazione seguendo la documentazione e il codice di esempio forniti.

Pronto a dare una voce alla sua applicazione desktop?

Ci dica la sua piattaforma e le lingue di destinazione. Il nostro team individua voci, modalità di consegna e condizioni di licenza giuste, poi le consegna l'SDK con codice di esempio e supporto all'implementazione.

Find your ReadSpeaker solution

Opening the conversation…

Search

    Searching…

    No results for

    Try another wording, or start from one of these.

    Search is not available right now.

    You can still reach the pages below.