常见问题
常见问题解答
你们提供什么类型的语音数据?
我们提供四个层级的预标注语音数据集——从无转录音频带元数据标签(第一层)到完整注释的会话数据,包括说话人轮转、分割和自定义标签(第四层)。语言、口音和领域涵盖50多种语言。
我可以授权数据用于商业用途吗?
可以。我们的数据集完全授权用于商业培训。开源样本(OleSpeech-IV)仅限非商业研究用途;完整层级在商业协议下可用。商业许可证仅适用于美国实体。
你们建立定制语音AI模型吗?
可以。我们构建自定义TTS、STT、语音克隆、说话人嵌入模型等,针对您的领域调整并部署在您的基础设施上——本地或在您的云账户中。您对我们交付的代码拥有100%的IP。
你们的语音克隆质量如何?
我们的专有微调语音克隆产生几乎与原始说话者相同的语音。收听样本,或联系我们安排私人演示。
你们如何处理数据隐私和保密协议?
每项合作都由严格的保密协议覆盖。我们最大程度地减少了数据管道中的人工参与以降低泄露风险,维护端到端审计跟踪,并遵守AB 2013和其他适用法规。
你们可以为我们的语音AI战略提供咨询吗?
可以。我们提供技术和市场评估、战略业务规划以及保密协议下的自主开发与外包评估。查看技术咨询以了解详情。
我如何开始?
典型的合作通常始于短电子邮件交流——不需要保密信息——随后是保密协议或互相保密协议。咨询合作包括免费的30分钟启动会议。
我们的数据集和服务仅对组织开放,不对个人消费者开放。
