AI资讯谷歌Chrome中“Gemini”支持语言扩展 至50多种语言包括日语
美国谷歌公司于3月13日(当地时间)宣布对“Gemini in Chrome”进行更新,新增支持包括日本国家日语在内的50多种语言。此次更新使得用户不仅在美国,还能在加拿大、新西兰和印度使用该AI交互功能。 通过在“Google Chrome”浏览器的侧边栏打开“Gemini”,用户无需切换标签页即可实现文章摘要、解读以及特定信息搜索等功能。此外,还支持邮件和社交媒体发布内容的草稿撰写,以及在网
按标签聚合查看文章内容。
AI资讯美国谷歌公司于3月13日(当地时间)宣布对“Gemini in Chrome”进行更新,新增支持包括日本国家日语在内的50多种语言。此次更新使得用户不仅在美国,还能在加拿大、新西兰和印度使用该AI交互功能。 通过在“Google Chrome”浏览器的侧边栏打开“Gemini”,用户无需切换标签页即可实现文章摘要、解读以及特定信息搜索等功能。此外,还支持邮件和社交媒体发布内容的草稿撰写,以及在网
AI资讯语音AI公司ElevenLabs发布了其音乐生成模型的全新版本Music v2,该模型能够在一首曲目中途切换不同音乐风格。该公司表示,这款模型不仅能处理复杂的声乐表现,还能应对多样的作曲需求。此次发布距离该初创公司推出首个音乐生成模型版本已近10个月。 ElevenLabs指出,Music v2可以在歌剧与重金属之间自由切换,快速说唱时保持连贯性,并能在曲目中加入非音乐的音效。艺术家们可以选择歌曲
AI资讯美国谷歌公司于7月8日宣布,将“Google 幻灯片”内容转换为视频的功能——“Google Vids”支持的语言扩展至包括日语在内的七种语言。 通过“Google Vids”,用户可以将基于幻灯片的演示文稿转换成视频,AI会自动生成视频脚本、旁白、背景音乐和动画效果。此前该功能仅支持英语演示文稿和账户,现已新增支持日语、韩语、法语、德语、意大利语、葡萄牙语和西班牙语。 使用该功能时,用户只需打
AI资讯OpenAI推出具备思考能力的全新图像生成模型,支持多语言,提升非拉丁文字渲染表现。
AI资讯美国Google公司于2026年5月7日(当地时间)宣布,旗下无需编码即可使用的AI代理创建工具「Google Workspace Studio」大幅扩展了支持的语言范围。除了此前提供的英语外,现新增包括日语在内的7种语言,所有功能均可使用。 「Google Workspace Studio」利用了「Gemini 3」的推理能力及多模态(文本、图像、视频)理解技术,使用户无需编写代码即可创建定制
AI资讯谷歌于周四为其视频编辑应用Vids推出了多项新功能,包括通过文本提示指挥和定制虚拟形象、支持Veo 3.1模型、可将视频导出至YouTube以及通过Chrome扩展进行录制。 用户现在可以使用自然语言提示来指导虚拟形象在场景中“表演”,例如让虚拟形象与产品、道具或设备互动。谷歌表示,尽管输出内容动态多变,Vids依然保证了角色的一致性。 此外,用户还能根据视频主题,通过调整虚拟形象的外观、服装以及
AI资讯Google在Google Chat的Gemini功能中,新增了多种非英语语言支持,提升多语言沟通效率。
AI资讯KDDI携手AKT与建設ヘルステック协会,推出专为建筑工地设计的在线医疗服务,提升建筑行业健康管理效率。
AI资讯USEN&U-NEXT集团旗下USEN-ALMEX推出搭载AI代理的诊所导览机器人ATOI-PLUS,实现从接待登记到问诊、预约及结算的自动化,助力减轻医护人员工作负担。
AI资讯法国人工智能公司Mistral于周四发布了一款全新的开源文本转语音(TTS)模型,适用于语音助手及企业场景,如客户支持等。该模型帮助企业构建销售和客户互动的语音代理,直接与ElevenLabs、Deepgram和OpenAI等公司竞争。 这款名为Voxtral TTS的新模型支持九种语言,包括英语、法语、德语、西班牙语、荷兰语、葡萄牙语、意大利语、印地语和阿拉伯语。 Mistral AI科学运营副
AI资讯2024年3月27日,日本时间,Google宣布在iOS和Android版的“Google翻译”应用中,扩大了通过耳机实时听取翻译内容的直播翻译功能的适用区域。 用户只需佩戴耳机并开启应用中的直播翻译功能,即可实时听到同步翻译的语音。该功能利用了Google最新的Gemini语音对译技术,AI能够生成包含说话者语调、重音和抑扬顿挫的合成语音,帮助用户更轻松地理解“谁说了什么”。这项技术适用于日常
AI资讯Google最新文本转语音模型Gemini 3.1 Flash TTS发布,支持多语言和多说话人,提升音质与表达能力。