谷歌图片虽然不常成为头条新闻,但它拥有跨越数十年的丰富历史。为庆祝谷歌图片25周年,我采访了谷歌Lens联合创始人Lou Wang,探讨谷歌视觉搜索的发展历程及两项即将推出的新功能。

2001年7月,谷歌推出了图片搜索工具,灵感源自2000年格莱美奖上詹妮弗·洛佩兹穿着标志性绿色范思哲礼服引爆网络。随后十年,谷歌图片搜索从基于文字的图片查询发展到支持上传图片或URL的反向图片搜索。

2017年,谷歌视觉搜索迈出重要一步,推出了谷歌Lens。Lens最初集成于谷歌相册和谷歌助手,后移至主搜索框。随着多模态搜索(Multisearch,结合文字和图片输入)和“圈选搜索”(Circle to Search,支持在不切换应用的情况下对图片进行上下文搜索)的推出,谷歌为用户带来了用相机而非单纯文字进行搜索的新方式。

过去两年AI技术爆发,AI模式集成、实时搜索功能、由Gemini模型驱动的视觉推理、时尚搭配“寻找风格”以及多图像输入等功能,使得基于图像的搜索更加自然和直观。

谷歌图片的新探索与创作方式

除了视觉搜索的发展历程,Lou Wang透露谷歌图片和搜索将推出两项新功能。

可浏览的谷歌图片主页

谷歌将推出一个可浏览的谷歌图片主页,展示动态、实时更新的图片画廊,内容根据用户兴趣定制,并配备标签式收藏夹,方便用户保存和管理灵感。

类似于Pinterest的看板或TikTok的收藏夹,用户可以将主题相似的图片集中保存。例如,计划去马来西亚旅行时,可以创建名为“马来西亚”的收藏标签,将所有旅行灵感集中管理。

该功能将在未来几周内于美国桌面端英文版本上线。

AI概览中的图像生成

谷歌还将在搜索的AI概览中引入直接图像生成。借助最新的Nano Banana模型,用户通过文字提示即可生成高质量定制图片,帮助实现创意。

例如,想为卧室选择墙面颜色时,可以输入“生成一张对比主卧黄色金色墙面和鼠尾草绿色墙面的视觉图”,AI概览将生成相应图片辅助决策。

此功能将在支持AI模式图像生成的地区逐步推出,初期仅支持英文。

Lou Wang表示,用户需求不断推动技术突破,谷歌致力于通过语音、文字和视觉的任意组合,创造自然直观的复杂问题解答方式。

“尤其是借助这些AI模型,我们能够更好地实现问题的自然直观表达,”他说,“这正是我们的核心目标:让用户能够直观地表达问题,并尽最大努力为他们提供最佳答案。”