AI资讯谷歌推出便捷的自我深度换脸功能
“这是为那些想将自己融入内容中,但又不想亲自拍摄的创作者准备的,”Roman说道。 这种以社交为核心、自拍风格的深度换脸技术让人联想到OpenAI已停运的Sora应用中的经典功能——谷歌称之为“头像”,而非简单的客串或角色。这些头像同样可以通过Gemini应用和YouTube使用。谷歌在加州山景城举办的年度I/O开发者大会上宣布了这一新功能。 去年,谷歌在其实验性Labs部门推出了Flow。“谷歌
按标签聚合查看文章内容。
AI资讯“这是为那些想将自己融入内容中,但又不想亲自拍摄的创作者准备的,”Roman说道。 这种以社交为核心、自拍风格的深度换脸技术让人联想到OpenAI已停运的Sora应用中的经典功能——谷歌称之为“头像”,而非简单的客串或角色。这些头像同样可以通过Gemini应用和YouTube使用。谷歌在加州山景城举办的年度I/O开发者大会上宣布了这一新功能。 去年,谷歌在其实验性Labs部门推出了Flow。“谷歌
AI资讯美国谷歌(Google)研究部门Google Research于3月24日发布了一种全新的量化算法“TurboQuant”,旨在大幅降低大规模语言模型(LLM)和向量搜索引擎的内存消耗。该技术有望解决AI响应速度的瓶颈问题,实现AI及搜索基础设施的显著效率提升。 开发背景及AI内存挑战 AI理解信息的基本单位是向量,随着向量维度增加,用于捕捉图像特征或语言含义的复杂信息,所需的内存也急剧增加。这导
AI资讯谷歌不仅提供了专属的vibe-coding工具来支持Android应用开发,还宣布将推出一系列工具,帮助AI代理如Claude Code、OpenAI的Codex,以及谷歌自家的Antigravity和Gemini在Android Studio中加速Android应用的开发。 在年度Google I/O开发者大会上,谷歌宣布其Android命令行界面(CLI)已稳定发布1.0版本。无论开发者使用何
AI资讯我们常常会在谷歌地图上打开街景视图,向朋友展示童年故居的模样,或者把那个小人图标拖到巴黎街头,看看自己预订的酒店是否位于一个有趣的街区。想象一下,如果这种体验变得更加沉浸和互动,不仅能真实模拟街道及其周边环境,还能调整天气,甚至模拟类似《后天》电影中的极端气候场景,那将会是怎样的体验? 这正是谷歌最新整合的目标之一。自今日起,谷歌DeepMind将街景视图与其通用世界模型“Project Geni
AI资讯2024年3月12日,美国谷歌公司宣布推出一项名为“Groundsource”的新技术,该技术通过人工智能分析公开数据,构建历史洪水数据集,专注于城市中短时间内发生的突发洪水(又称“铁炮水”)的预测模型开发。 该方法利用AI对公开的报告和记录进行深入分析,将灾害发生相关信息整理成高质量数据。借助谷歌的Gemini技术,解析了数十年间的公开报告,识别出覆盖150多个国家的超过260万起洪水事件。
AI资讯谷歌宣布其AI内容检测技术将覆盖更多平台,包括Chrome浏览器和谷歌搜索,提升AI生成内容的透明度。
AI资讯谷歌最新推出的Lyria 3音乐生成模型,支持多模态输入,能够快速生成高质量音乐作品。本文详细介绍了Lyria 3的功能、使用方法、版权问题及未来发展。
AI教程探索谷歌最新的先进图像模型,擅长理解、合成和编辑图像,带来更高效、更精准的AI图像处理体验。
AI教程了解Project Genie如何通过简单的提示,将图像和文本转化为可探索的AI虚拟世界。
AI资讯谷歌于周二发布了Gemini 3.5 Flash,这是一款公司迄今为止最强大的AI模型,专注于编程和自主AI代理。该模型在谷歌年度开发者大会Google I/O上亮相,能够独立执行编程流程、管理研究项目,并在内部测试中实现从零开始构建操作系统。 此次发布标志着谷歌从将AI定位为对话工具,转向将AI视为具备自主行动能力的工具。它不仅能回答问题,更能在极少人工干预下进行规划、构建和迭代实际工作。 De
AI资讯谷歌于周三宣布推出Lyria 3 Pro音乐生成模型,此举距离Lyria 3发布仅一个月。新模型支持用户创作最长三分钟的音乐作品,相较于Lyria 3仅支持30秒的时长有了显著提升。 除了延长音乐时长,Lyria 3 Pro还提供了更强的创作控制和个性化定制功能。用户在提示中可以指定音乐作品的不同部分,如前奏、主歌、副歌和桥段,模型对曲目结构的理解也优于前代产品。 此前,谷歌已通过Lyria 3将
AI资讯YouTube正在试验一款新的AI搜索工具,支持视频和文本双重结果,现向Premium用户开放体验。