よくある質問
よくある質問
どのような音声データを提供していますか?
事前ラベル付き音声データセットの4つのティアを提供しています - メタデータタグ付きの未転記オーディオ(Tier I)から、スピーカーターン、話者分離、カスタムラベル付きの完全に注釈されたトランスクリプトデータ(Tier IV)まで。言語、アクセント、ドメインは50以上の言語をカバーしています。
商用利用のためにデータをライセンスできますか?
はい。当社のデータセットは商用トレーニング用に完全にライセンスされています。オープンソース サンプル (OleSpeech-IV) は非商用研究専用です。完全なティアは商用契約の下で利用可能です。商用ライセンスは米国企業にのみ利用可能です。
カスタム音声AIモデルを構築していますか?
はい。カスタム TTS、STT、音声クローン、スピーカー埋め込みモデルなどを構築し、あなたのドメインに合わせてチューニングし、あなたのインフラストラクチャにデプロイします - オンプレミスまたはクラウドアカウント内。当社が提供するコードの IP の100%を保有できます。
あなたの音声クローニングの品質はどのくらいですか?
当社の独自の微調整された音声クローニングは、元のスピーカーにほぼ同一の音声を生成します。サンプルを聞く、またはお問い合わせしてプライベートデモを手配してください。
データプライバシーとNDAはどのように処理していますか?
すべてのエンゲージメントは厳密なNDAでカバーされています。あなたのデータパイプラインでの人間関与を最小化して侵害リスクを低減し、エンドツーエンドの監査証跡を維持し、AB 2013およびその他の適用規制に準拠しています。
音声AI戦略についてコンサルティングしてもらえますか?
はい。技術と市場の評価、戦略的ビジネス計画、構築対購入評価をNDAの下で提供しています。詳細は技術コンサルティングを参照してください。
どのように始めればよいですか?
典型的なエンゲージメントは短いメールやりとりで始まります - 機密情報は不要 - その後、NDAまたはmNDAが続きます。コンサルティングエンゲージメントには無料の30分間のキックオフセッションが含まれます。
当社のデータセットとサービスは組織のみが利用可能で、個人消費者向けではありません。
