تطبيق Numo لجمع البيانات يعالج تحدياً كبيراً في تطوير الذكاء الاصطناعي من خلال جمع معلومات حقيقية لتدريب نماذج الذكاء الاصطناعي من الجيل القادم. أطلقت شركة Poseidon تطبيق Numo كتطبيق وصول مبكر مصمم لتمكين أي شخص من المساهمة في البيانات مع كسب مكافآت على مشاركته.
يجمع التطبيق بيانات صوتية عبر لغات متعددة، بما في ذلك البنغالية والهندية والتاميل والتيلوغو والإنجليزية. من المقرر إضافة لغات إضافية في التحديثات المستقبلية. يساعد المساهمون على تحسين نماذج الذكاء الاصطناعي من خلال توفير بيانات أصيلة يتم جمعها في ظروف حقيقية بدلاً من البيئات التجريبية المضبوطة.
كيفية عمل تطبيق Numo لجمع البيانات
يمكن للمستخدمين الانضمام إلى Numo من خلال الوصول المبكر والبدء في المساهمة بالتسجيلات الصوتية فوراً. تعوّض المنصة المشاركين عن كل إرسال بيانات، مما يخلق هيكل حافز مباشر للمشاركة المستمرة. يسمح هذا النموذج لشركة Numo بتوسيع جهود جمع البيانات بينما تعوّض المساهمين بشكل عادل عن وقتهم وجهودهم.
تخدم البيانات المجمعة من خلال تطبيق Numo أغراضاً متعددة في تطوير الذكاء الاصطناعي. تلتقط عينات الكلام الحقيقية أنماط الكلام الطبيعية والنطقات والضوضاء الخلفية والتنويعات اللغوية التي لا يمكن للبيانات التدريبية الاصطناعية أن تكررها. يعزز هذا التنوع قدرة نماذج الذكاء الاصطناعي على العمل بدقة عبر مجموعات سكان مختلفة وبيئات متنوعة.
معالجة الفجوات في بيانات تدريب الذكاء الاصطناعي
تواجه صناعة الذكاء الاصطناعي تحديات مستمرة في الحصول على بيانات تدريب متنوعة وعالية الجودة، خاصة للغات التي يتحدث بها السكان بشكل أساسي في جنوب آسيا ومناطق أخرى ممثلة بشكل ناقص في مجموعات البيانات الموجودة. يعالج Numo هذه الفجوة من خلال الاستفادة من مجتمعات الناطقين الأصليين الذين يمكنهم توفير سياق لغوي وثقافي أصيل.
لغات جنوب آسيا بما في ذلك البنغالية والهندية والتاميل والتيلوغو تمثل مليارات المتحدثين عالمياً. على الرغم من استخدامهم على نطاق واسع، حصلت هذه اللغات تاريخياً على اهتمام محدود في نماذج اللغات الكبيرة وأنظمة التعرف على الكلام. يعكس تركيز Numo على هذه اللغات محاولة لمعالجة عدم التوازن في موارد تدريب الذكاء الاصطناعي.
تطبيق Numo لجمع البيانات والشراكات الصناعية
يعمل Numo بالشراكة مع Story Protocol و Poseidon، وهما منظمتان تركزان على بنية البيانات والتكنولوجيا اللامركزية. تعكس هذه الشراكات اتجاهات أوسع في صناعة الذكاء الاصطناعي نحو نماذج تعاونية لجمع البيانات ومشاركتها.
تمثل المنصة تحولاً من طرق جمع البيانات المركزية والحاصة إلى نهج موزعة أكثر تعوّض المساهمين بشكل مباشر. مع استمرار التطبيقات المبنية على نماذج اللغات الكبيرة في التوسع عالمياً، من المرجح أن يزداد الطلب على بيانات التدريب المتنوعة والممثلة عبر قطاع التكنولوجيا.
النظرة المستقبلية
تسمح مرحلة الوصول المبكر لشركة Numo بتحسين عمليات جمع البيانات الخاصة بها وتوسيع دعم اللغات بناءً على تعليقات المستخدمين والطلب. يخطط التطبيق لإضافة لغات أكثر من اللغات الخمس الأولية، مما قد يمتد إلى مجموعات لغوية أخرى ممثلة بشكل ناقص في مجموعات بيانات تدريب الذكاء الاصطناعي.
قد ينجح Numo في التأثير على كيفية قيام مطوري الذكاء الاصطناعي بجمع البيانات عالمياً، مما يحول نماذج الحوافز وهياكل الملكية حول بيانات التدريب. يمكن للمستخدمين المهتمين بالمساهمة الانضمام إلى برنامج الوصول المبكر للمنصة للبدء في كسب المكافآت مع دعم تطوير أنظمة ذكاء اصطناعي أكثر شمولاً.
المصدر: X (@daniviecmii)




