AI资讯能够多语言再现情感与语调的AI配音模型「Dubbing v2」
ElevenLabs发布了可自然翻译和配音视频及音频内容的AI模型「Dubbing v2」,支持90多种语言和方言。
按标签聚合查看文章内容。
AI资讯ElevenLabs发布了可自然翻译和配音视频及音频内容的AI模型「Dubbing v2」,支持90多种语言和方言。
AI资讯美国谷歌公司于3月26日(当地时间)正式发布了最新的实时语音生成模型“Gemini 3.1 Flash Live”。该模型被认为是谷歌迄今为止质量最高的实时语音AI模型。 “Gemini 3.1 Flash Live”是继承自“Gemini 2.5 Flash Native Audio”的新一代语音生成模型。相比前代产品,它在响应延迟和语音理解准确度方面都有显著提升。 例如,在评估多步骤函数调用