生成式人工智能让内容生产变得更加便捷,但也使得内容管理变得更加复杂。随着视频、录音和文档的不断积累,Adobe、苹果、谷歌以及越来越多的初创公司开始利用AI技术让这些文件变得可搜索。目前尚不清楚这项技术会催生新的独立软件类别,还是会成为现有产品的标准功能。
总部位于旧金山的初创公司Clipto认为,市场上仍有独立产品的空间。该公司在新加坡和香港也设有团队,最近完成了一轮全股权融资,筹集了1500万美元,估值达到2.5亿美元。投资方包括HSG(前身为红杉中国)、GL Ventures、EnvisionX Capital、Palm Drive Capital、Hans Tung、Lu Zhang和522 Ventures。
Clipto能够对用户电脑中的视频、音频、图片、会议记录及其他文件进行索引。用户无需翻阅文件夹,只需描述所需内容,或者让ChatGPT、Claude等AI工具帮忙搜索即可找到目标文件。
创始人Henry Kang在相关领域已有近20年经验。2006年,他在卡内基梅隆大学攻读博士期间,曾研究机器人如何记录环境、识别物体并记忆位置。后来,他将这一理念应用于首个创业项目,利用AI管理用户衣橱并推荐穿搭。第二家公司Zenvideo专注于简化视频制作,2020年被腾讯收购。
Kang指出:“在AI时代,我们并不缺乏内容,恰恰相反,内容过剩。大量视频素材存储在电脑中却未被有效利用。”
基于这一观察,Kang于2023年与前创业团队成员共同创立了Clipto。与其他专注于生成新内容的AI公司不同,Clipto致力于帮助用户查找并重新利用已有文件。
最初,Clipto的产品主要面向管理分散在电脑和外部硬盘上的视频素材的视频创作者。但现在,创作者仅占用户的四分之一到三分之一,其他用户包括律师、医生、研究人员、市场营销人员、人力资源专家、教授和学生。

公司表示,自产品发布以来,已有超过3000万人使用,付费用户数达数十万。虽然Kang未透露具体订阅用户数和平均收入,但他表示相当一部分用户的订阅时间超过两年。
截至2026年初,Clipto实现了1500万美元的年经常性收入,并保持净利润状态。公司员工约20人,分布在旧金山湾区、香港和新加坡。
大约两周前,Clipto支持了模型上下文协议(Model Context Protocol,MCP),这是一种允许AI应用连接外部信息源的标准。Kang强调,访问索引文件需用户主动授权,AI应用只能在用户指定范围内检索数据,且所有处理均在用户设备本地完成,无需云端服务。
Clipto进入的是一个由大型公司主导的数据和软件市场。Adobe在Premiere中已提供AI驱动的搜索功能,苹果和谷歌的照片应用也支持通过自然语言描述查找照片和视频。
Kang表示,Clipto能够跨视频、音频、图片和文档进行搜索,而Adobe、苹果和谷歌的产品通常仅限于自家服务中的文件。Clipto还允许用户将选定信息开放给ChatGPT、Claude等AI工具使用。公司相信,将这些功能整合于一体的产品能帮助其在竞争中脱颖而出。
新一轮融资将用于开发适配消费级硬件的AI模型和计算基础设施,以及与更多AI代理的集成。


