AI资讯谷歌发布最新实时语音翻译模型“Gemini 3.5 Live Translate”
谷歌推出支持70多种语言的实时语音翻译新模型,提升多语言交流体验。
按标签聚合查看文章内容。
AI资讯谷歌推出支持70多种语言的实时语音翻译新模型,提升多语言交流体验。
AI资讯OpenAI于周四宣布,其API现已新增多项语音智能功能,旨在帮助开发者打造能够与用户对话、转录及翻译交流内容的应用程序。 公司推出了全新的GPT‑Realtime‑2语音模型,该模型能够生成逼真的语音模拟并与用户进行对话。与前代产品GPT-Realtime-1.5相比,GPT‑Realtime‑2采用了GPT‑5级别的推理能力,能够处理更复杂的用户请求。 此外,OpenAI还发布了GPT‑Rea
AI资讯INMO GO3智能眼镜结合AI技术,支持实时翻译、会议辅助等多种功能,7月30日上市。
AI资讯Meta宣布推出AI智能眼镜“Ray-Ban Meta”系列的新款“Ray-Ban Meta Optics Styles”,专为配戴度数镜片的用户设计。该系列将于美国时间4月14日正式发售,售价从499美元起。同时,Meta确认将在包括日本在内的新市场展开销售,并支持包括日语在内的20种语言的实时翻译功能。 适配度数镜片的新设计 “Optics Styles”系列针对需要视力矫正的用户,提供两种镜
AI资讯OpenAI今日推出了全新的对话语音模型,名为GPT-Live-1和GPT-Live-1 mini,声称这些模型的语音更加自然,且在对话轮换上表现更佳。这些模型支持全双工功能,意味着它们可以同时说话和聆听,允许用户自然打断对话,并支持实时翻译等功能。 公司还宣布将默认用GPT-Live-1 mini替代ChatGPT中现有的高级语音模式。付费用户则可以使用更强大的GPT-Live-1模型。此前的语
AI资讯DeepL宣布与美国旧金山的超低延迟实时音频平台Mixhalo合作,提升其实时语音翻译解决方案的性能。
小米键盘升级为AI智能交互平台,融合HyperOS 4设计语言,新增AI聊天和实时翻译功能,支持多语言自动识别,彻底革新传统输入体验。
AI资讯DeepL,这家以文本翻译工具闻名的公司,近日推出了一套语音到语音的翻译解决方案,涵盖会议、移动和网页对话,以及通过定制应用支持一线工作人员的群组交流。与此同时,DeepL还发布了API,允许外部开发者和企业基于其技术打造定制化应用场景,如呼叫中心等。 DeepL首席执行官Jarek Kutylowski在接受采访时表示:“经过多年专注于文本翻译,语音翻译是我们的自然延伸。我们在文本和文档翻译方面
AI资讯美国谷歌公司于2026年6月9日(当地时间)正式发布了最新的实时语音翻译模型“Gemini 3.5 Live Translate”,以纪念其翻译服务“Google 翻译”诞生20周年。 “Gemini 3.5 Live Translate”支持70多种语言,能够在保持说话者语调、语速和音高的同时,几乎实时生成翻译语音。传统的语音翻译多采用“轮流翻译”方式,即需等待说话者说完后再进行翻译,而该模型
AI资讯随着人工智能的普及,语言障碍正在迅速减少。上周,有两件值得关注的事件发生。 首先,全球智能眼镜市场领先的Meta公司正式宣布将在数月内将其“Ray-Ban Meta”等产品引入日本市场。这些智能眼镜配备了实时翻译功能,有望促进不同语言之间的交流。 其次,社交媒体平台X(原Twitter)开始自动应用自动翻译功能,使得面向其他国家的帖子能够像日语帖子一样流入用户时间线,极大地促进了跨语言内容的传播
谷歌翻译的“Live Translate”功能现已支持iOS,实现低延迟跨语言对话,支持多种耳机,极大降低使用门槛。
AI资讯Meta携手意大利EssilorLuxottica发布支持AI功能的Meta Glasses智能眼镜,具备多样款式和多语言实时翻译功能。