تخطَّ إلى المحتوى

ReadSpeaker speechEngine SDK

حزمة تطوير لتحويل النص إلى كلام على الجهاز ودون اتصال لتطبيقات سطح المكتب والحاسوب الشخصي

ثبّت محرّك الكلام على الجهاز المستهدف مباشرة، حيث يولّد الصوت محليًا دون أي اتصال بالشبكة. أكثر من 150 صوتًا بالذكاء الاصطناعي بأكثر من 50 لغة، مع ارتباطات أصلية للغات C وC++ وJava على Windows وLinux، ولـ C# على Windows.

  • C/C++ · C# · Java
  • Windows 10/11 + Linux
  • على الجهاز

قصة عميل

مدمج في برمجيات تُشحن فعليًا، على الجهاز

Soft Leaf

وفّر علينا استخدام إضافة تحويل النص إلى كلام من ReadSpeaker ساعات لا تُحصى من التطوير، وقرّبنا من رؤيتنا للعبة متاحة للجميع حقًا.

Conor Bradleyالمؤسس والمدير، Soft Leaf Studios · Stories of Blossom
اقرأ قصة Soft Leaf كاملة

الميزات

صوت على الجهاز، مصمَّم للمطوّرين

كل ما يحتاجه فريقك لإدخال صوت طبيعي داخل تطبيق سطح مكتب أو حاسوب شخصي، مع تشغيل المحرّك محليًا.

اشحن صوتًا لا يغادر الجهاز أبدًا

يعمل المحرّك على جهاز عميلك ويولّد الصوت دون أي اتصال بالشبكة. وهو مناسب لعمليات النشر المعزولة عن الشبكة أو الخاضعة للتنظيم أو التي تعطي الأولوية للعمل دون اتصال، حيث تبقى البيانات داخليًا.

أكثر من 150 صوتًا بالذكاء الاصطناعي بأكثر من 50 لغة

أصوات طبيعية بالذكاء الاصطناعي قريبة من الصوت البشري، مع إضافة أصوات ولغات جديدة إلى الكتالوج بانتظام. اختر اللهجة والنبرة المناسبتين لكل سوق، واشحنهما ببصمة تبقى خفيفة على القرص.

فريقك يكتب في منظومته

ارتباطات أصلية للغتي C وC++ على Windows وLinux، ولـ C# على Windows، ولـ Java على Windows وLinux. وتجعل الأمثلة البرمجية والوثائق ودعم التنفيذ من فريقنا التكامل سهلًا.

تحكّم دقيق في الصوت عبر SSML

بدّل الصوت واللغة في منتصف الجملة، وتحكّم في التنغيم، وأدرِج الوقفات والنسخ الصوتي. ويُدعم إدخال لغة ترميز تركيب الكلام (SSML) دعمًا كاملًا، بترميز UTF-8.

انطق أسماء العلامات التجارية والمصطلحات المتخصّصة نطقًا صحيحًا

أنشئ قواميس نطق لكل لغة لأسماء المنتجات والاختصارات وأسماء الأعلام، مع إمكانية إنشاء عدة قواميس لكل لغة. واستخدم النسخ بالأبجدية الصوتية الدولية IPA عندما تحتاج إلى تحكّم صوتي دقيق.

صيغ صوتية تناسب أي سلسلة عمل

PCM خطي 16 بت، وA-law وμ-law بدقة 8 بت للاتصالات الهاتفية، وADPCM من Dialogic لأنظمة الرد الصوتي القديمة. أخرِج الصيغة التي تتوقعها سلسلة عملك، خامًا أو مغلّفة في WAV.

اضبط كل عبارة منطوقة

اضبط سرعة النطق وطبقة الصوت ومستواه بما يلائم الموقف، من السرد الهادئ إلى التنبيهات العاجلة. واضبطها حسب الحاجة في كل عملية نشر.

ترخيص قابل للتوقع

يثبَّت ملف ترخيص إلى جانب حزمة التطوير ليحدّد الأصوات والمدة اللذين طلبتهما. لا ترقيات مفاجئة، ولا فوترة حسب الاستخدام، ولا قلق من التدقيق.

بشر حقيقيون يساعدونك على الإطلاق

يعمل فريق الدعم لدى ReadSpeaker مع مطوّريك طوال مرحلة التكامل. فالأمثلة البرمجية والوثائق والتواصل المباشر تعني أنك لن تجد نفسك عالقًا أمام صفحة ويكي في الثانية صباحًا.

جرّبه في منظومتك

مثال بسيط على التكامل بلغة C++

تُشحن ارتباطات أصلية للغتي C وC++ على Windows وLinux، ولـ C# على Windows، ولـ Java على Windows وLinux. استدعِ المحرّك داخل العملية نفسها وركّب النص إلى ملف صوتي محلي، دون أي اتصال بالشبكة.

// Representative example. The exact API and headers ship with the licensed SDK.
#include "speechengine.h"

int main() {
    SpeechEngine engine;
    engine.init("./license.lic");          // license file enforces voices + term
    engine.selectVoice("en_US-neural");       // 150+ voices, 50+ languages
    engine.setSpeechRate(90);                 // tune rate, pitch and volume per request

    // Synthesise plain text or SSML to a local audio file, no server calls
    engine.synthesizeToFile("Welcome to ReadSpeaker.", "welcome.wav");

    engine.release();                          // free the engine
    return 0;
}

المواصفات التقنية

كل مواصفة سيسأل عنها فريقا التطوير والتشغيل لديك

مُهيّأ للنشر على الجهاز ودون اتصال: بصمة صغيرة، ودعم واسع لأنظمة التشغيل، وصوت جاهز للاتصالات الهاتفية.

المواصفات التقنية لـ speechEngine SDK 4.5
SpecificationDetail
لغات البرمجةC / C++ (Windows/Linux) · C# (Windows) · Java (Windows/Linux)
نظام تشغيل WindowsWindows 10 و11
نظام تشغيل LinuxCentOS Stream 9.x إلى 10.x · Ubuntu 18.x إلى 24.x · RHEL 7.x إلى 9.x · أنظمة تشغيل أخرى عند الطلب
CPUIntel x86/64 بتردد 1 غيغاهرتز فأعلى. وتُشترط AVX على معماريات x64 (تواصل مع ReadSpeaker إذا كانت بيئتك تفتقر إلى دعم AVX).
الذاكرةمن 6 إلى 30 ميغابايت
بصمة الصوتمن 9 إلى 35 ميغابايت لكل صوت (بتقنية الشبكات العصبية العميقة)
ذاكرة التشغيلمن 20 إلى 30 ميغابايت (Neural Standard)
صيغ الإدخالنص عادي (متعدد البايتات) · SSML (UTF-8)
صيغ إخراج الصوتPCM خطي 16 بت (خام/WAV) · PCM بترميز A-law/μ-law 8 بت (خام/WAV) · PCM خطي غير موقّع 8 بت بصيغة Wave · ADPCM من Dialogic بدقة 4 بت
الوثائقمواصفات المنتج (PDF)

نموذج النشر

يعمل على بنيتك التحتية، بموجب ملف الترخيص الخاص بك

يُثبَّت speechEngine SDK محليًا على الجهاز المستهدف. ويعمل محرّك تحويل النص إلى كلام دون استدعاءات للخادم. وتفرض اتفاقية الترخيص وملف الترخيص المنصة المرخّصة والأصوات والمدة. وللاطلاع على وثائق الامتثال المؤسسي (ISO/IEC 27001 واللائحة العامة لحماية البيانات والبنود التعاقدية النموذجية للاتحاد الأوروبي)، راجع إشعار الخصوصية وصفحات «من نحن» لدى ReadSpeaker.

  • على الجهاز (المحرّك مثبَّت على الجهاز المستهدف)

    مثبَّت محليًا

  • لا اتصالات بالشبكة (صوت يُولَّد دون رحلات ذهاب وإياب إلى الخادم)

    المحرّك يعمل محليًا

  • فرض ملف الترخيص (ملف ترخيص يُسلَّم مع حزمة التطوير)

    الأصوات + المدة

  • تسليم حزمة التطوير (حزمة تطوير مبنية للمنصة المحدّدة في الطلب)

    بحسب طلب كل عميل

الأسئلة الشائعة

أسئلة حول speechEngine SDK

  • speechEngine SDK حزمة تطوير لتحويل النص إلى كلام على الجهاز موجّهة للمطوّرين الذين يبنون تطبيقات سطح المكتب والحواسيب الشخصية. ويُثبَّت المحرّك محليًا على الجهاز المستهدف ويدعم أكثر من 150 صوتًا بالذكاء الاصطناعي عبر أكثر من 50 لغة. وهو يعمل دون اتصال بالشبكة، وهو ما يناسب البيئات المعزولة عن الشبكة والحساسة للخصوصية.

  • يشحن speechEngine SDK ارتباطات أصلية للغتي C وC++ على Windows وLinux، ولـ C# على Windows، ولـ Java على Windows وLinux. وتُسلَّم حزمة التطوير للمنصة المحدّدة في طلب العميل.

  • يعمل speechEngine SDK على Windows 10 و11، وعلى توزيعات Linux منها CentOS Stream 9.x إلى 10.x، وUbuntu 18.x إلى 24.x، وRHEL 7.x إلى 9.x. وتُدعم أنظمة تشغيل أخرى عند الطلب. المعالج: Intel x86/64 بتردد 1 غيغاهرتز فأعلى (وتُشترط AVX على x64). الذاكرة: من 6 إلى 30 ميغابايت.

  • نعم. يُثبَّت محرّك تحويل النص إلى كلام محليًا على الجهاز المستهدف ويولّد الصوت دون أي اتصال بالشبكة، وهو ما يناسب عمليات النشر الحساسة للخصوصية والمعزولة عن الشبكة. أما للأجهزة القائمة على ARM أو الجوال أو إنترنت الأشياء، فراجع speechEngine SDK Embedded.

  • يُخرج speechEngine SDK أربع صيغ صوتية: PCM خطي 16 بت (خام/WAV)، وPCM بترميز A-law/μ-law 8 بت (خام/WAV)، وPCM خطي غير موقّع 8 بت بصيغة Wave، وADPCM من Dialogic بدقة 4 بت. والإخراج بترميزي A-law وμ-law مناسب بوجه خاص للتكامل مع الاتصالات الهاتفية.

  • نعم. يقبل speechEngine SDK إدخال النص العادي (متعدد البايتات) وإدخال SSML (بترميز UTF-8)، فيستطيع تطبيقك وسم الكلام الذي يحتاج إليه. ويتيح لك SSML تبديل الصوت واللغة داخل نص واحد، وتعديل التنغيم، وإدراج الوقفات، وتطبيق النسخ الصوتي.

  • يخضع speechEngine SDK لاتفاقية ترخيص تحدّد المنصة المرخّصة والأصوات وسياق الاستخدام المسموح به. ويفرض ملف ترخيص يُسلَّم مع حزمة التطوير تقنيًا الأصوات المرخّصة والمدة، أي مدة الاستخدام المسموح به.

  • نعم. دعم التنفيذ من فريق دعم ReadSpeaker مشمول. ويساعد الفريق العملاء على فهم التكامل وتنفيذه وفق الوثائق والأمثلة البرمجية المقدّمة.

هل أنت مستعد لإضافة صوت إلى تطبيق سطح المكتب لديك؟

أخبرنا بمنصتك ولغاتك المستهدفة. ويحدّد فريقنا الأصوات وطريقة التسليم وشروط الترخيص المناسبة، ثم يشحن حزمة التطوير مع أمثلة برمجية ودعم للتنفيذ.

Find your ReadSpeaker solution

Opening the conversation…

Search

    Searching…

    No results for

    Try another wording, or start from one of these.

    Search is not available right now.

    You can still reach the pages below.