تخطَّ إلى المحتوى

ReadSpeaker speechEngine SDK Embedded

تحويل النص إلى كلام على الجهاز للأجهزة المدمجة والمحمولة

يضيف ReadSpeaker speechEngine SDK Embedded أصواتًا طبيعية بالذكاء الاصطناعي إلى الأجهزة القائمة على ARM وتطبيقات الجوال والأنظمة المدمجة. وهو يعمل بالكامل على الجهاز، دون الحاجة إلى اتصال بالشبكة. أكثر من 150 صوتًا بالذكاء الاصطناعي عبر أكثر من 50 لغة لأنظمة iOS وAndroid وEmbedded Linux.

  • يعمل بالكامل على الجهاز
  • ARM بنسختي 32 و64 بت
  • أكثر من 150 صوتًا · أكثر من 50 لغة

لماذا على الجهاز

كلام يعمل مع الاتصال أو بدونه

لا تستطيع أجهزة كثيرة الاعتماد على السحابة. فجهاز المراقبة الطبي أو السيارة أو المتحكم الصناعي يجب أن ينطق في اللحظة التي يُحتاج فيها إليه، في كل مرة. ويركّب speechEngine SDK Embedded الكلام بالكامل على الجهاز، فيبقى الإخراج الصوتي متسقًا وفوريًا حتى دون شبكة. ولا تغادر بياناتك العتاد أبدًا، ولا يتوقف زمن الاستجابة يومًا على قوة الإشارة.

مصمَّم للأنظمة المدمجة

صوت طبيعي على عتاد لا تتسع له معظم حلول تحويل النص إلى كلام

بصمة صغيرة، بحكم التصميم

يستهلك كل صوت من 6 إلى 35 ميغابايت من مساحة التخزين ويعمل ضمن 20 إلى 30 ميغابايت من الذاكرة. وهذا يناسب العتاد محدود الموارد الذي تُبنى عليه المنتجات المدمجة، من متحكمات ARM بنسخة 32 بت إلى شرائح الجوال بنسخة 64 بت، دون التضحية بالصوت الطبيعي.

أكثر من 150 صوتًا بالذكاء الاصطناعي بأكثر من 50 لغة

يستفيد speechEngine SDK Embedded من كتالوج ReadSpeaker الذي يضم أكثر من 150 صوتًا بالذكاء الاصطناعي عبر أكثر من 50 لغة. وتُضاف أصوات ولغات جديدة بانتظام، فتستطيع حزمة التطوير نفسها إطلاق منتج في سوق واحدة أو في خمسين سوقًا.

اضبط كل كلمة يقرأها

اضبط سرعة النطق وطبقة الصوت ومستواه بما يناسب الجهاز. استخدم SSML (لغة ترميز تركيب الكلام) لإدراج وقفات، وتبديل الأصوات أو اللغات في منتصف الجملة، وإضافة نسخ صوتي. ويتيح لك قاموس مستخدم لكل لغة بدعم IPA تصحيح نطق أسماء المنتجات ومصطلحات المجال مرة واحدة، في كل مكان.

المواصفات التقنية

مصمَّم للعتاد محدود الموارد

speechEngine SDK Embedded مصمَّم هندسيًا للأنظمة ذات البصمة الصغيرة. وتتيح لك الأرقام أدناه تحديد حجم عتادك قبل الالتزام.

المواصفات التقنية لـ speechEngine SDK Embedded
SpecificationValue
أنظمة التشغيلiOS · Android · Embedded Linux (أنظمة تشغيل مدمجة أخرى عند الطلب)
CPUARM بنسختي 32 و64 بت. Neural Standard: 1 غيغاهرتز فأعلى (64 بت فقط) · Neural Lite: 800 ميغاهرتز فأعلى
الذاكرةمن 6 إلى 30 ميغابايت
ذاكرة التشغيلمن 20 إلى 30 ميغابايت (Neural Lite وNeural Standard)
بصمة الصوتمن 6 إلى 32 ميغابايت (Neural Lite) · من 9 إلى 35 ميغابايت (Neural Standard)، بتقنية الشبكات العصبية العميقة
إخراج الصوت8 صيغ: PCM خطي 16 بت، وA-law 8 بت، وμ-law 8 بت، وPCM خطي غير موقّع 8 بت بصيغة Wave، وADPCM من Dialogic بدقة 4 بت، ومشتقات Wave
إدخال النصنص عادي (متعدد البايتات) · SSML (UTF-8)
الوثائقمواصفات المنتج (PDF)

Neural Standard وNeural Lite

فئتا أصوات، وحزمة تطوير واحدة

اختر التوازن الذي يناسب عتادك. تعمل Neural Standard على ARM بنسخة 64 بت بتردد 1 غيغاهرتز فأعلى، بأصوات من 9 إلى 35 ميغابايت لأغنى صوت. وتعمل Neural Lite على ARM ابتداءً من 800 ميغاهرتز، بأصوات من 6 إلى 32 ميغابايت لأشد الأجهزة محدودية. وتستخدم الفئتان تقنية الشبكات العصبية العميقة.

مقارنة بين Neural Lite وNeural Standard
Neural LiteNeural Standard
CPUARM بتردد 800 ميغاهرتز فأعلىARM بتردد 1 غيغاهرتز فأعلى (64 بت فقط)
بصمة الصوتمن 6 إلى 32 ميغابايتمن 9 إلى 35 ميغابايت
التقنيةالشبكات العصبية العميقةالشبكات العصبية العميقة

المنصات

ادمجه باللغة التي تستخدمها بالفعل

يأتي speechEngine SDK Embedded مع واجهات البرمجة والأمثلة البرمجية والوثائق للتكامل السريع. ابنِ بلغة C/C++ على Embedded Linux، أو Objective-C على iOS، أو Java على Android. ويتضمن كل تسليم مكتبات محرّك الكلام وملفات الأصوات ووثائق التكامل الخاصة بمنصتك المرخّصة، إضافة إلى دعم من فريقنا.

المنصات المدعومة ولغات التكامل الخاصة بها
PlatformLanguage
Embedded LinuxC / C++
iOSObjective-C
AndroidJava

التكامل

بضعة استدعاءات حتى أول نطق

هيّئ المحرّك، وحمّل صوتًا، ثم ركّب الكلام. وتتولى حزمة التطوير الباقي على الجهاز.

/* Illustrative - confirm exact API against the SDK docs before use */
#include "rs_embedded_tts.h"

int main() {
    rsEngine *engine = rsEngineCreate("license.dat");
    rsEngineLoadVoice(engine, "en-US-neural-standard");
    rsEngineSetRate(engine, 1.0);
    rsEngineSpeak(engine, "Welcome aboard.", RS_AUDIO_PCM16);
    rsEngineDestroy(engine);
    return 0;
}

الشكل توضيحي فقط. راجع وثائق حزمة التطوير والأمثلة البرمجية لمعرفة التواقيع الدقيقة لواجهة برمجة التطبيقات في المنصة المسلّمة إليك.

أين يعمل

أصوات للأجهزة الحرجة للمهام

من تطبيقات الجوال إلى العتاد الحرج للمهام، يمنح speechEngine SDK Embedded المنتجات صوتًا موثوقًا أينما عملت، بما في ذلك بيئات الدفاع وغيرها من البيئات محدودة الموارد.

النقل

الملاحة والتوجيهات خطوة بخطوة والرسائل داخل المركبة التي تبقى سريعة الاستجابة حتى عندما تفقد المركبة الإشارة.

اطّلع على حلول النقل

أنظمة الإعلانات

إخراج صوتي واضح لأنظمة الإنذار والإخطار في حالات الطوارئ.

الأجهزة المحمولة

الكتب الصوتية وتعلّم اللغات وتطبيقات الجوال التي تنطق دون اتصال، بلا حاجة إلى شبكة.

الأسئلة الشائعة

أسئلة حول speechEngine SDK Embedded

  • نعم. يركّب speechEngine SDK Embedded الكلام بالكامل على الجهاز، دون الحاجة إلى اتصال بالشبكة. وتبقى كل المعالجة والبيانات على العتاد، فيكون إخراج الكلام فوريًا ومتسقًا حتى في البيئات غير المتصلة أو محدودة الموارد.

  • يدعم iOS وAndroid وEmbedded Linux جاهزًا. ويمكن دعم أنظمة تشغيل مدمجة أخرى عند الطلب. تواصل مع فريقنا وأخبرنا بمنصتك المستهدفة.

  • يعمل على معالجات ARM بنسختي 32 و64 بت. وتحتاج أصوات Neural Standard إلى معالج ARM بنسخة 64 بت بتردد 1 غيغاهرتز فأعلى؛ أما أصوات Neural Lite فتعمل ابتداءً من 800 ميغاهرتز. وتستخدم حزمة التطوير من 6 إلى 30 ميغابايت من ذاكرة الوصول العشوائي ومن 20 إلى 30 ميغابايت أثناء التشغيل.

  • يستهلك كل صوت من 6 إلى 32 ميغابايت في فئة Neural Lite ومن 9 إلى 35 ميغابايت في فئة Neural Standard. وتستخدم الفئتان تقنية الشبكات العصبية العميقة، فتحصل على صوت طبيعي ببصمة مناسبة للأنظمة المدمجة.

  • يدعم speechEngine SDK Embedded أكثر من 150 صوتًا بالذكاء الاصطناعي عبر أكثر من 50 لغة. وتُضاف أصوات ولغات جديدة بانتظام. وتتوفر قائمة كاملة على موقع ReadSpeaker.

  • يمكنك التكامل بلغة C/C++ على Embedded Linux، وبلغة Objective-C على iOS، وبلغة Java على Android. وتتضمن كل حزمة تطوير واجهات البرمجة والأمثلة البرمجية والوثائق اللازمة للبدء.

  • نعم. استخدم SSML لضبط التنغيم وإدراج الوقفات وإضافة النسخ الصوتي وتبديل الأصوات أو اللغات في منتصف النص. ويتيح لك قاموس مستخدم لكل لغة بدعم IPA تحديد نطق مخصّص لمصطلحات المجال.

  • يُخرِج 8 صيغ صوتية، منها PCM خطي 16 بت، وA-law وμ-law بدقة 8 بت، وADPCM من Dialogic بدقة 4 بت، وعدة مشتقات من Wave. وهذا يتيح لك مطابقة سلسلة معالجة الصوت في جهازك المستهدف.

  • speechEngine SDK Embedded مبني للأنظمة العاملة على الجهاز وذات البصمة الصغيرة على عتاد ARM والجوال. speechEngine SDK targets desktop and PC-based applications on Windows and Linux. See speechEngine SDK if you're building for desktop.

هل أنت مستعد لإضافة صوت إلى جهازك؟

أخبرنا عن عتادك ولغاتك المستهدفة وجدولك الزمني. وسيساعدك فريق الأنظمة المدمجة لدينا على تحديد الأصوات والبصمة والمنصة المناسبة لمنتجك.

Find your ReadSpeaker solution

Opening the conversation…

Search

    Searching…

    No results for

    Try another wording, or start from one of these.

    Search is not available right now.

    You can still reach the pages below.