日本PKSHA Technology株式会社(以下简称PKSHA)于19日正式推出了集成多种语音AI引擎、实现选择与应用最优化的平台——“PKSHA Voice KIT”。

PKSHA Voice KIT是一款能够通过单一API统一使用和管理国内外主流语音AI引擎的平台。

PKSHA凭借自主研发的“PKSHA Voice AI”引擎,在AI SaaS产品领域已成功服务超过2000家企业。基于这一丰富经验,PKSHA Voice KIT无需针对特定系统进行复杂定制,能够根据不同用途和环境灵活切换引擎,打造高效的语音AI基础设施。

PKSHA Voice KIT

不仅支持PKSHA自有的Voice AI引擎,用户还可以通过统一API访问其他最新的语音AI引擎。这样,用户无需关注各引擎的接入差异,能够根据需求比较引擎的识别精度和功能,降低未来切换引擎的成本,实现企业内部语音数据的无缝共享。

平台支持根据具体需求和环境实时切换最适合的AI引擎。由于采用统一API连接,切换引擎时无需重新开发,能够灵活跟进技术进步。

此外,PKSHA Voice KIT还提供针对行业术语和企业专有词汇的词典功能及构建支持。构建的词典可跨引擎持续使用,进一步提升语音识别的准确性,促进语音数据的高效利用。

转录后的文本可结合PKSHA提供的“PKSHA机器学习模块”和“PKSHA大语言模型模块”进行处理,支持“个人信息去除”、“摘要提取”、“情感分析”等高级业务自动化功能。同时,集成于“PKSHA Speech Insight”的引擎也可通过该平台调用。

PKSHA表示,除了单独提供引擎外,还将根据业务需求支持引擎评估、词典设计及后续的摘要、分类和知识管理等语音AI基础设施的整体设计。未来,PKSHA计划持续扩展PKSHA Voice KIT支持的引擎数量,并推动其在客户服务中心的质量提升、实时会议记录等多种语音数据应用场景中的广泛应用。