#视频生成

按标签聚合查看文章内容。

谷歌Gemini Omni:将图像、音频和文本转化为视频,这仅仅是开始AI资讯

谷歌Gemini Omni:将图像、音频和文本转化为视频,这仅仅是开始

三年前,谷歌推出了Gemini,目标是打造一个多模态大型语言模型——一个能够处理文本、图像、音频和视频,并能生成任意格式内容的单一神经网络。 如今,在谷歌I/O开发者大会上,谷歌迈出了实现这一目标的重要一步,发布了Gemini Omni。这是一系列多模态模型,谷歌CEO桑达尔·皮查伊表示,Gemini Omni能够“从任何输入创造任何内容”。 Gemini Omni首先聚焦于视频生成。用户可以将图

字节跳动全新AI视频生成模型Dreamina Seedance 2.0登陆CapCutAI资讯

字节跳动全新AI视频生成模型Dreamina Seedance 2.0登陆CapCut

OpenAI可能正在减少其在视频生成市场的投入,近期关闭了其Sora应用,但字节跳动周四确认,其最新的音视频生成模型Dreamina Seedance 2.0已开始在其视频编辑平台CapCut中逐步推出。 字节跳动表示,该模型允许创作者通过提示词、图片或参考视频来草拟、编辑并同步视频和音频内容。 此次分阶段上线将首先覆盖巴西、印度尼西亚、马来西亚、墨西哥、菲律宾、泰国和越南的CapCut用户,未来

OpenAI宣布终止视频生成应用“Sora”服务AI资讯

OpenAI宣布终止视频生成应用“Sora”服务

OpenAI近日宣布将停止提供视频生成应用“Sora”。该消息通过该服务的官方X账号公开发布。 根据官方发布的内容,未来将会详细说明作品的保存方式,以及应用程序和API的相关时间表。 官方推文中写道:“我们将告别Sora应用。感谢所有使用Sora创作、分享并建立社区的用户。你们通过Sora创造的内容非常重要,我们理解这一消息可能让人失望。我们将很快分享更多信息,包括应用和API的时间安排及相关细节

AI视频只是序章?Runway CEO认为世界模型才是未来AI资讯

AI视频只是序章?Runway CEO认为世界模型才是未来

AI生成的视频技术几乎在一夜之间从新奇变成了创作工具,而Runway正处于这一变革的前沿。这家总部位于纽约的公司已筹集近8.6亿美元,估值达到53亿美元,其模型能够与谷歌和OpenAI等全球资金最充足的实验室正面竞争。 这项技术远不止于制作视频:Runway正积极推进通用世界模型的研发,应用领域涵盖游戏、机器人技术,甚至可能接近通用智能。 在TechCrunch的Equity播客最新一期中,主持人

OpenAI为何真正关闭了SoraAI资讯

OpenAI为何真正关闭了Sora

OpenAI上周决定关闭其AI视频生成工具Sora,这一决定在该工具发布仅六个月后便引发了广泛猜测。Sora允许用户上传自己的面部图像,这让人怀疑这是否是一次精心策划的数据收集行动。然而,根据《华尔街日报》最新调查,真正的原因其实相当平淡:Sora成了一个烧钱的“黑洞”,用户数量稀少,维持其运营反而拖慢了OpenAI在AI领域的竞争步伐。 那么,具体发生了什么?Sora在发布初期引起轰动,全球用户

独家报道:Runway推出1000万美元基金及Builders计划,支持早期AI初创企业AI资讯

独家报道:Runway推出1000万美元基金及Builders计划,支持早期AI初创企业

Runway正从单纯开发AI视频模型,转向引导基于这些模型的创新应用。该AI视频生成初创公司宣布设立一支1000万美元的风险投资基金,专注投资早期阶段的AI、媒体及世界模拟领域的企业。此外,Runway还推出了Builders计划,为种子轮至C轮的初创企业提供免费API额度,旨在打造围绕“视频智能”的生态系统。 作为AI视频生成领域的领先者,Runway的工具已广泛应用于电影、广告和市场营销。去年

Google发布Gemini应用多项改进:个人AI助手、每日新闻摘要及macOS版本AI资讯

Google发布Gemini应用多项改进:个人AI助手、每日新闻摘要及macOS版本

美国Google于2026年5月19日(当地时间)在年度技术大会“Google I/O 2026”上,宣布了Gemini应用的多项改进。 主要更新包括全天候运行的个人AI助手“Gemini Spark”、每日个性化新闻摘要“Daily Brief”、支持文本、图片和视频输入生成视频的新AI模型“Gemini Omni”,以及macOS版本的发布。 Gemini界面与用户体验重新设计 Gemini