#多语言支持

按标签聚合查看文章内容。

谷歌翻译应用在日本推出通过耳机实现AI语音翻译的“实时翻译”功能AI资讯

谷歌翻译应用在日本推出通过耳机实现AI语音翻译的“实时翻译”功能

谷歌(Google)宣布,在日本正式推出Google翻译应用的“实时翻译”功能。该功能通过耳机让AI实现语音翻译,支持Android和iOS版本。 该实时翻译功能利用了Gemini的语音对译技术,能够在保持说话者语调、重音和节奏的同时,输出翻译后的语音。设计上主要配合耳机或耳塞使用,方便用户清晰辨别不同说话者的内容。该功能适用于不同语言的对话交流、海外演讲或讲座的听讲,以及观看外语电视节目和电影等

Google翻译应用的实时翻译功能扩展至日本及70多个地区AI资讯

Google翻译应用的实时翻译功能扩展至日本及70多个地区

2024年3月27日,日本时间,Google宣布在iOS和Android版的“Google翻译”应用中,扩大了通过耳机实时听取翻译内容的直播翻译功能的适用区域。 用户只需佩戴耳机并开启应用中的直播翻译功能,即可实时听到同步翻译的语音。该功能利用了Google最新的Gemini语音对译技术,AI能够生成包含说话者语调、重音和抑扬顿挫的合成语音,帮助用户更轻松地理解“谁说了什么”。这项技术适用于日常

Spotify的AI DJ现支持法语、德语、意大利语和巴西葡萄牙语AI资讯

Spotify的AI DJ现支持法语、德语、意大利语和巴西葡萄牙语

Spotify周四宣布,其互动式AI DJ功能现已支持法语、德语、意大利语和巴西葡萄牙语四种新语言。此前,该功能仅支持英语和西班牙语。用户可以通过该功能请求歌曲,并获得由AI生成的语音评论。 公司表示,不同语言版本的AI DJ拥有各自的名字和个性,分别是Maia、Ben、Alex和Dani。 除了新增语言支持外,Spotify还将该功能推广至奥地利、巴西、法国、德国、意大利、葡萄牙、韩国和瑞士。目

图像生成的范式转变:OpenAI发布“ChatGPT Images 2.0”的进化目标AI资讯

图像生成的范式转变:OpenAI发布“ChatGPT Images 2.0”的进化目标

2026年4月21日,日本国家OpenAI发布了全新图像生成模型“ChatGPT Images 2.0”。该模型在处理复杂视觉任务方面有显著提升,能够生成“即用型”的高质量图像。用户可以通过ChatGPT和Codex等平台使用该功能,且在日本市场迅速走红。 尽管OpenAI已将重心从面向消费者的视频生成AI“天空(Sora)”转向企业市场,但在图像生成领域的投入和强化力度依然显著。此前,谷歌的N

Mistral发布全新开源语音生成模型AI资讯

Mistral发布全新开源语音生成模型

法国人工智能公司Mistral于周四发布了一款全新的开源文本转语音(TTS)模型,适用于语音助手及企业场景,如客户支持等。该模型帮助企业构建销售和客户互动的语音代理,直接与ElevenLabs、Deepgram和OpenAI等公司竞争。 这款名为Voxtral TTS的新模型支持九种语言,包括英语、法语、德语、西班牙语、荷兰语、葡萄牙语、意大利语、印地语和阿拉伯语。 Mistral AI科学运营副

谷歌Chrome中“Gemini”支持语言扩展 至50多种语言包括日语AI资讯

谷歌Chrome中“Gemini”支持语言扩展 至50多种语言包括日语

美国谷歌公司于3月13日(当地时间)宣布对“Gemini in Chrome”进行更新,新增支持包括日本国家日语在内的50多种语言。此次更新使得用户不仅在美国,还能在加拿大、新西兰和印度使用该AI交互功能。 通过在“Google Chrome”浏览器的侧边栏打开“Gemini”,用户无需切换标签页即可实现文章摘要、解读以及特定信息搜索等功能。此外,还支持邮件和社交媒体发布内容的草稿撰写,以及在网

ElevenLabs推出可在曲目中途切换风格的新一代音乐生成模型AI资讯

ElevenLabs推出可在曲目中途切换风格的新一代音乐生成模型

语音AI公司ElevenLabs发布了其音乐生成模型的全新版本Music v2,该模型能够在一首曲目中途切换不同音乐风格。该公司表示,这款模型不仅能处理复杂的声乐表现,还能应对多样的作曲需求。此次发布距离该初创公司推出首个音乐生成模型版本已近10个月。 ElevenLabs指出,Music v2可以在歌剧与重金属之间自由切换,快速说唱时保持连贯性,并能在曲目中加入非音乐的音效。艺术家们可以选择歌曲

谷歌发布次世代语音输入功能“Rambler”,AI自动整理口语中的停顿与修正AI资讯

谷歌发布次世代语音输入功能“Rambler”,AI自动整理口语中的停顿与修正

谷歌宣布推出集成于键盘应用“Gboard”的全新语音输入功能“Rambler”。该功能利用生成式AI“Gemini”的语言理解能力,能够从人类自然的口语中剔除多余词汇,整理重点内容并转化为文本。 消除“口语”与“书面语”的差距 谷歌指出,虽然现有语音输入技术在速度和准确性上表现优异,但人类自然对话中常包含“嗯”、“那个”等填充词以及频繁的自我修正。Rambler突破了传统“逐字输入”的模式,借助A

日本乌弗鲁推出可直接利用现有网站和PDF资料的AI知识服务“AI窗口服务”AI资讯

日本乌弗鲁推出可直接利用现有网站和PDF资料的AI知识服务“AI窗口服务”

日本乌弗鲁株式会社于19日宣布,面向地方政府和旅游行业推出“AI窗口服务”,该服务能够利用现有的网页和PDF资料,无需制作FAQ,即可引入支持多语言的生成式AI聊天机器人。该服务作为乌弗鲁数据连接平台“CUCON(キューコン)”的新增功能提供,同时也支持单独引入“AI窗口服务”。 “AI窗口服务”通过自动利用地方政府或组织已拥有的资料作为AI知识库,轻松实现多语言生成式AI聊天机器人的部署。用户只

Google Workspace Studio支持日语 - 无需编码即可创建AI代理工具AI资讯

Google Workspace Studio支持日语 - 无需编码即可创建AI代理工具

美国Google公司于2026年5月7日(当地时间)宣布,旗下无需编码即可使用的AI代理创建工具「Google Workspace Studio」大幅扩展了支持的语言范围。除了此前提供的英语外,现新增包括日语在内的7种语言,所有功能均可使用。 「Google Workspace Studio」利用了「Gemini 3」的推理能力及多模态(文本、图像、视频)理解技术,使用户无需编写代码即可创建定制

用语音模式深入思考复杂问题AI资讯

用语音模式深入思考复杂问题

有些问题无法通过打字轻松解决。语音模式适合练习重要的推介会议、在多个选择中做决定、大声回顾自己的思路,或进行头脑风暴。 一个能跟上你思路的交流伙伴 今年早些时候我们推出了免提对话功能后,用户开始用语音模式处理更多复杂问题,而不仅仅是简单提问。他们通过语音而非文字,进行更长时间的真实业务讨论。但之前语音模式仅支持Claude Haiku模型,虽然响应快速,但深度有限。 现在,专为解决复杂问题设计的