نحن نفخر بتقديم
مجموعات بيانات الكلام Olewave من المستودع
شفافية مقرها في الولايات المتحدة،
نطاق لا مثيل له وفعالة من حيث التكلفة.
-
المستوى الأول — بدون نسخ: تسميات اللغة والموضوع (بالإضافة إلى الخيارات SNR والنسبة الخطابية والملخصات).
-
المستوى الثاني — النسخ الزائفة: تسميات المستوى الأول + نسخ آلية مع طوابع زمنية على مستوى الكلمة والجملة ودرجات الثقة.
-
المستوى الثالث — HITL-Transcribed: تسميات المستوى الأول + نسخ من صنع الإنسان مع التحقق من معايير المستوى الثاني.
-
المستوى الرابع — Advanced-Labeled: الأكثر شمولاً — المستوى الثالث + تحولات المتحدثين والفصل والمواضيع والتعليقات المخصصة.
-
جاهز للمؤسسات وفعال من حيث التكلفة: SLAs قوية · متوافق مع AB 2013 · مسارات تدقيق من الطرف إلى الطرف · أرخص بما يصل إلى 10 مرات من مجموعات البيانات التقليدية
API خدمة معالجة وتنظيف بيانات الكلام
إلى بيانات جاهزة للإنتاج للتدريب والتقييم،
باستخدام خط أنابيب OTS الخاص بنا.
-
تنظيف: إزالة الضوضاء والصمت والنسخ المكررة والأجزاء غير ذات الصلة
-
التعليق: تنتج النماذج المخصصة تسميات دقيقة في الممر الأول، ثم يقوم المراجعون البشريون بالتحقق والتحسين لجودة الإنتاج
-
التحقق: يمسك التحقق الملكي الخاص بنا بأخطاء التعليق
-
الترتيب: يمكننا حتى جمع من مصادرك المعينة
-
الأمان: تقليل مخاطر اختراق البيانات من خلال الحد من تورط الإنسان
-
تسليم: بيانات your والشكل على البنية الأساسية الخاصة بك
مجموعة بيانات الصوت المحادثة مفتوحة المصدر
نصوص مصدقة وتحولات المتحدثين،
مجاني للبحث العلمي.
-
المصدر: البودكاست وبرامج الحوار والمؤتمرات عن بعد والمحادثات الطبيعية
-
التحقق من النص: درجات ثقة على مستوى الكلمة بدون هلوسة
-
تصحيح النص: طرق ملكية للكيانات المسماة — الأسماء والمنظمات والمواقع والأوقات
-
توقيت دقيق: طوابع زمنية على مستوى الكلمة والهاتف مع تحولات المتحدثين
-
تعليق 360 درجة: أسماء المتحدثين والتحولات والـ SNR والمواضيع والأوصاف
-
تخصيص التسميات: الاختيار من التسميات المسبقة أو طلب تسميات جديدة
-
الترتيب مدى الحياة: تحسين التسميات المستمر بدون تكلفة إضافية
-
من إنتاج Olign: محرك محاذاة الكلام إلى النص الملكي الخاص بنا
-
مجموعة البيانات الكاملة المتاحة للشراء: اتصل بنا للحصول على ترخيص تجاري
