مجموعة بيانات الكلام

مجموعة بيانات شيتاغونيا

مجموعة بيانات عالية الجودة للمحادثة العامة باللغة الشيتاغونية و TTS لنماذج الذكاء الاصطناعي والكلام

مجموعة بيانات شيتاغونيا

نظرة عامة

  • اللغةشيتاجونيان
  • أنواع مجموعات البياناتالمحادثة العامة، تحويل النص إلى كلام
  • الدولةبنغلادش

الوصف

محادثة هاتفية اصطناعية غير مكتوبة بين "المتحدث 1" و "المتحدث 2"، مدة الصوت التقريبية (النطاق) 5-15 دقيقة.

أبرز ما في مجموعة البيانات

  • اللغةشيتاجونيان
  • معدل العينة16 كيلو هرتز / 44 كيلو هرتز
  • مجموع الساعاتساعة 900
  • القنواتبالأبيض والأسود
  • نطاق المدة5 - 15 دقائق

استخدم حالات

  • سياسة
  • الشؤون الحالية
  • محليات
  • دين
  • الاقتصاد والمالية
  • والسياحة

مواصفات مجموعة البيانات النموذجية

نوع مجموعة البياناتمحادثة عامةتحويل النص إلى كلام
معدل أخذ العينات44 كيلو هرتز16 كيلو هرتز
قناةبالأبيض والأسودبالأبيض والأسود
مجموع الساعاتساعة 100ساعة 800

الفوائد الرئيسية

  • متنوعة وممثلةتغطية واسعة النطاق للمتحدثين من أجل ذكاء اصطناعي شامل وواقعي.
  • صوت عالي الجودةتسجيلات نقية ومتوازنة لأداء نموذج موثوق.
  • جاهز للذكاء الاصطناعي/التعلم الآليمنظم ومُشروح لضمان التكامل السلس.
  • قابلة للتطوير ومرنةتتوفر مدد زمنية ومتحدثون ومجالات متعددة لتناسب احتياجاتك.

التفاصيل التقنية

  • منصة التسجيلتطبيق الموبايل
  • تنسيق الصوت. الرعايا
  • تنسيق النسخ.json
  • WER (٪)5
  • الفئة العمرية18-50

عملاء متميزون

موثوق به من قبل فرق الذكاء الاصطناعي الرائدة والشركات في جميع أنحاء العالم.

  • Microsoft
  • أمازون ويب سيرفيسز
  • جوجل

لا تستطيع أن تجد ما تبحث عنه؟

يتم جمع مجموعات بيانات جاهزة جديدة عبر جميع أنواع البيانات

اتصل بنا الآن للتخلص من مخاوفك المتعلقة بجمع بيانات التدريب على الصوت / الكلام

  • هذا الحقل لأغراض التحقق من صحة وينبغي أن تترك دون تغيير.
  • بالتسجيل ، أنا أتفق مع Shaip سياسة الخصوصية و شروط الخدمة وأقدم موافقتي على تلقي اتصالات تسويقية B2B من Shaip.