أطلقت شركة Speechmatics نموذج ثنائي اللغة عربي إنجليزي جاهزاً للاستخدام الفعلي، يعالج اللهجات العربية والإنجليزية في آنٍ واحد، وذلك في 10 مارس 2026. يحقق النموذج معدل خطأ في الكلمات بنسبة 6.3% على معايير الكلام المختلط، متفوقاً على أقرب منافس بنسبة 35%.
يتضمن الإطلاق كذلك أول نموذج طبي ثنائي اللغة في العالم باللغتين العربية والإنجليزية. تم تدريب هذه النسخة السريرية على ضعف مفردات النموذج الطبي الإنجليزي الحالي للشركة، وتشمل المصطلحات السريرية بكلتا اللغتين، إلى جانب الاختلافات اللهجية الحقيقية والكلام المسجّل في بيئات سريرية فعلية.
معالجة التبديل اللغوي في منطقة الشرق الأوسط وشمال إفريقيا
في منطقة الشرق الأوسط وشمال إفريقيا، يتنقل المتحدثون بشكل اعتيادي بين العربية والإنجليزية داخل الجملة الواحدة. تُسبب هذه الظاهرة، المعروفة بالتبديل اللغوي، أخطاءً في نسب الكلمات وحذف المصطلحات في نماذج الذكاء الاصطناعي أحادية اللغة. وفي مراكز الاتصال والبيئات السريرية، تُعدّ هذه الأخطاء قاعدةً لا استثناءً.
صُمّم نموذج ثنائي اللغة عربي إنجليزي للتعامل مع هذه المشكلة مباشرةً. في اختبارات معيارية، سجّلت Speechmatics معدل خطأ في الكلمات أقل بنسبة 35% من Google في مهام التبديل اللغوي، محققةً 6.3% مقابل 9.7% لدى Google. يتضمن النموذج أيضاً تحديد هوية المتحدث والتركيز عليه، مما يضمن نسب كل كلمة إلى المتحدث الصحيح طوال الجلسة.

تغطية اللهجات عبر المنطقة
تتباين اللغة العربية بشكل ملحوظ عبر المنطقة، إذ تحمل لهجات الخليج ومصر وبلاد الشام مفرداتٍ وأصواتاً وإيقاعاتٍ مختلفة. تُقدّم النماذج المدرّبة على اللغة العربية الفصحى الحديثة فحسب أداءً ضعيفاً في المحادثات الحقيقية.
على صعيد النسخ باللغة العربية فقط، تحقق Speechmatics معدل خطأ في الكلمات أقل بنسبة 24% من Google، مسجّلةً 4.5% مقابل 5.9%. وقالت الشركة إن نموذجها يتفوق أيضاً على OpenAI Whisper وAssemblyAI وDeepgram وAmazon وMicrosoft في هذا المعيار.
النشر المؤسسي وسيادة البيانات
تفرض متطلبات سيادة البيانات في منطقة الشرق الأوسط وشمال إفريقيا، بما فيها لوائح المملكة العربية السعودية والإمارات العربية المتحدة، التزاماتٍ صارمة بشأن مكان معالجة البيانات الصوتية وتخزينها. يدعم النموذج النشر عبر منصات SaaS السحابية والأنظمة المحلية والأجهزة، ويعمل على بنية NVIDIA للذكاء الاصطناعي مع تحسين عبر NVIDIA Dynamo-Triton لمعالجة البيانات بكفاءة عالية وزمن استجابة منخفض. يُحافظ النموذج على زمن استجابة أقل من ثانية عبر جميع أنماط النشر.
يعمل البث المباشر والنسخ المُجمَّع على النموذج ذاته، مما يُزيل التنازل عن الدقة المعتاد عند التبديل بين الوضعين. تُعدّ هذه البنية ذات صلة بمتطلبات الأمن السيبراني والامتثال في القطاعات الخاضعة للتنظيم.
نموذج ثنائي اللغة عربي إنجليزي في البيئات السريرية
في بيئات الصحة والتقنية عبر منطقة الشرق الأوسط وشمال إفريقيا، تظهر أسماء الأدوية الإنجليزية والإجراءات والجرعات باستمرار داخل الكلام العربي. تُسيء النماذج العامة التعامل مع هذه المصطلحات، وقد تنتقل الأخطاء الناتجة إلى سجلات المرضى. ينسخ النموذج الطبي ثنائي اللغة رموز ICD-10-CM وأسماء الأدوية والجرعات والاختصارات السريرية بدقة بصرف النظر عن اللغة التي تحملها.
“كان هذا الأمر بالغ الأهمية لتحقيق نتائج ملموسة للعملاء في جميع أنحاء المنطقة الذين استمروا في وصف التحدي نفسه. ففي مستشفى بالقاهرة أو مركز اتصال بالرياض، تتدفق اللغتان العربية والإنجليزية في آنٍ واحد — يصل اسم الدواء باللغة الإنجليزية، وبقية الجملة باللغة العربية. وكان تحقيق تأثير ملموس يعني إزالة هذا التداخل من التفاعلات الصوتية. لقد تدربنا على أصوات حقيقية ولهجات حقيقية ومصطلحات طبية حقيقية — لأن هذه هي الطريقة الوحيدة لبناء نظام فعّال حقاً في بيئة استخدامه.”
Katy Wigdahl، الرئيس التنفيذي، Speechmatics
أجرت Sully.ai، منصة التوثيق السريري الموسّعة نشاطها في منطقة الشرق الأوسط وشمال إفريقيا، تقييماتٍ شاملة على الصوت السريري المعقد، بما في ذلك التبديل اللغوي والاستشارات التي تعتمد على اللهجات.
“كان نموذج Speechmatics الطبي ثنائي اللغة هو النموذج الوحيد الذي استوفى معايير الأداء التي نحتاجها للحفاظ على جودة عالية في التوثيق السريري مع توسعنا إقليمياً. وقد جعل هذا التوافق الشراكة خياراً مناسباً لتوسعنا.”
Patrick Nguyen، رئيس قسم الهندسة، منطقة الشرق الأوسط وشمال إفريقيا، Sully.ai
كلا النسختين القياسية والطبية من نموذج ثنائي اللغة عربي إنجليزي متاحتان الآن. تجعل خيارات النشر المحلي وعلى الأجهزة كلا النموذجين قابلَين للتطبيق في البيئات الخاضعة للتنظيم حيث تُبنى تطبيقات الذكاء الاصطناعي السريرية والمؤسسية في جميع أنحاء المنطقة.




