#实时翻译

按标签聚合查看文章内容。

OpenAI在其API中推出全新语音智能功能AI资讯

OpenAI在其API中推出全新语音智能功能

OpenAI于周四宣布,其API现已新增多项语音智能功能,旨在帮助开发者打造能够与用户对话、转录及翻译交流内容的应用程序。 公司推出了全新的GPT‑Realtime‑2语音模型,该模型能够生成逼真的语音模拟并与用户进行对话。与前代产品GPT-Realtime-1.5相比,GPT‑Realtime‑2采用了GPT‑5级别的推理能力,能够处理更复杂的用户请求。 此外,OpenAI还发布了GPT‑Rea

Meta推出适配度数镜片的AI智能眼镜“Ray-Ban Meta”系列,将在日本发售并支持日语实时翻译AI资讯

Meta推出适配度数镜片的AI智能眼镜“Ray-Ban Meta”系列,将在日本发售并支持日语实时翻译

Meta宣布推出AI智能眼镜“Ray-Ban Meta”系列的新款“Ray-Ban Meta Optics Styles”,专为配戴度数镜片的用户设计。该系列将于美国时间4月14日正式发售,售价从499美元起。同时,Meta确认将在包括日本在内的新市场展开销售,并支持包括日语在内的20种语言的实时翻译功能。 适配度数镜片的新设计 “Optics Styles”系列针对需要视力矫正的用户,提供两种镜

OpenAI发布全新语音模型,实现更自然的实时对话体验AI资讯

OpenAI发布全新语音模型,实现更自然的实时对话体验

OpenAI今日推出了全新的对话语音模型,名为GPT-Live-1和GPT-Live-1 mini,声称这些模型的语音更加自然,且在对话轮换上表现更佳。这些模型支持全双工功能,意味着它们可以同时说话和聆听,允许用户自然打断对话,并支持实时翻译等功能。 公司还宣布将默认用GPT-Live-1 mini替代ChatGPT中现有的高级语音模式。付费用户则可以使用更强大的GPT-Live-1模型。此前的语

DeepL从文本翻译迈向语音翻译新时代AI资讯

DeepL从文本翻译迈向语音翻译新时代

DeepL,这家以文本翻译工具闻名的公司,近日推出了一套语音到语音的翻译解决方案,涵盖会议、移动和网页对话,以及通过定制应用支持一线工作人员的群组交流。与此同时,DeepL还发布了API,允许外部开发者和企业基于其技术打造定制化应用场景,如呼叫中心等。 DeepL首席执行官Jarek Kutylowski在接受采访时表示:“经过多年专注于文本翻译,语音翻译是我们的自然延伸。我们在文本和文档翻译方面

谷歌发布实时语音翻译模型“Gemini 3.5 Live Translate”AI资讯

谷歌发布实时语音翻译模型“Gemini 3.5 Live Translate”

美国谷歌公司于2026年6月9日(当地时间)正式发布了最新的实时语音翻译模型“Gemini 3.5 Live Translate”,以纪念其翻译服务“Google 翻译”诞生20周年。 “Gemini 3.5 Live Translate”支持70多种语言,能够在保持说话者语调、语速和音高的同时,几乎实时生成翻译语音。传统的语音翻译多采用“轮流翻译”方式,即需等待说话者说完后再进行翻译,而该模型

AI推动语言壁垒降低:Meta智能眼镜与X自动翻译的影响AI资讯

AI推动语言壁垒降低:Meta智能眼镜与X自动翻译的影响

随着人工智能的普及,语言障碍正在迅速减少。上周,有两件值得关注的事件发生。 首先,全球智能眼镜市场领先的Meta公司正式宣布将在数月内将其“Ray-Ban Meta”等产品引入日本市场。这些智能眼镜配备了实时翻译功能,有望促进不同语言之间的交流。 其次,社交媒体平台X(原Twitter)开始自动应用自动翻译功能,使得面向其他国家的帖子能够像日语帖子一样流入用户时间线,极大地促进了跨语言内容的传播