总部位于纽约的AI检测初创公司Pangram致力于应对互联网中泛滥的AI生成内容问题。该公司刚刚完成了900万美元的融资,投资者包括Menlo Ventures领投,Haystack、ScOp、Script Capital和Cadenza等跟投。Pangram相信,区分人类创作内容和AI生成文本的工具需求将持续增长。

此次融资之际,Pangram推出了其新一代AI文本检测模型Pangram 4和AI图像检测模型Pangram Image。新文本检测模型在识别AI辅助写作及混合人机内容方面准确率超过99%,并且能更有效地检测AI人性化程序。AI图像检测模型目前处于研究预览阶段,预计未来几周内将更广泛发布。

Pangram由斯坦福大学AI与机器学习专业毕业生Max Spero和Bradley Emi于两年前创立。ChatGPT的推出引发了网络上大量机器人、AI生成的SEO内容以及Spero所称的“基于大型语言模型的俄罗斯虚假信息和阿联酋影响的推特活动”。

Spero向TechCrunch表示:“知道你看到的内容是否由AI生成非常重要,尤其是文本内容,因为这会影响人们的阅读态度。你是否需要对内容中的幻觉信息保持怀疑,还是可以信任这是经过真实记者认真调查的?”

Pangram的AI检测系统基于一个大型机器学习模型,训练数据包括数千万份已知的人类文档。公司为每份文档创建了“合成镜像”,复制主题、长度和语气,但由前沿大型语言模型撰写。

Spero解释说:“我们的模型学习AI在风格和表达上的一致性差异,从而高置信度地判断内容是否由AI生成。检测过程不依赖复制粘贴的元数据或隐藏水印。”

Pangram不仅识别完全由AI生成的文本,还能区分不同程度的AI辅助,例如作者自己写作后用AI进行编辑或润色。Spero认为,只要作者披露使用AI辅助,AI辅助写作是可以接受的。

Pangram检测界面

随着AI使用日益普及,相关失误也引发关注。例如,加拿大一名政治家在议会演讲中误读AI提示词而遭嘲笑;某些律师因使用ChatGPT生成的虚假引用被处罚和罚款。

这种反弹也体现在机构规则上。今年,开放获取论文库arXiv出台新政策,若提交的论文中发现作者未审查大型语言模型输出(如虚假引用或元评论),将面临一年投稿禁令。

Pangram并非唯一看好AI检测市场的公司,Winston AI、Originality.ai、Copyleaks和GPTZero等竞争者也在开发类似产品。

尽管技术尚不完美,Pangram有望助力抵制泛滥的AI生成内容,保护互联网、法庭及学术论文的真实性。

用户可通过每月20美元的订阅服务访问Pangram网站,或安装Chrome扩展程序,实时标注X、LinkedIn、Substack、Reddit和Medium上的帖子,并提供人类与AI内容比例的健康评分。

Pangram还通过API向客户提供技术支持。Substack近期已将Pangram技术集成到平台,向读者展示哪些作者使用AI撰写通讯。其他客户包括Quora、学校、出版社、代理机构和招聘方。

Pangram效果如何?

Pangram检测示例

Spero表示,Pangram模型误将人类文档判定为AI的概率约为万分之一。经过测试,文本检测模型表现出色但非完美。它能轻松识别由ChatGPT和Claude完全生成的新闻文章,且不易被我通过编辑使AI文本更具人类风格的尝试所欺骗。但Pangram有时会将我完全重写的句子误判为AI生成,也未被我引导ChatGPT和Claude规避检测的尝试所蒙蔽。

我还让ChatGPT和Claude润色我的文章,Pangram给出了13%的AI辅助评分,较为准确。模型能检测出部分细微的词汇变化,但对部分句子则忽略了AI辅助痕迹,有时也将人类写作的句子误判为AI辅助。值得注意的是,当我将整篇文章原文提交给Pangram时,评分为100%人类写作。

考虑到新闻文章风格较为单调,容易被误判为AI,我又测试了自己风格更鲜明的个人Substack通讯。Pangram基本能准确区分人类与AI写作内容。

我对Pangram新推出的图像检测模型的测试同样印象深刻。

Pangram图像检测热力图

Pangram的AI图像检测系统能识别多种AI模型生成的图像,不同于OpenAI或Google DeepMind基于水印的检测方法,这些方法主要识别自家生成的图像。Pangram通过像素级分布学习真实照片与AI生成图像的细微统计差异,甚至能检测出嵌入真实照片中的AI图像。

测试中,无论是逼真的照片风格还是卡通风格,模型都能轻松识别AI生成图像。它还能准确标记照片中出现的AI图像(热力图明显显示),但有一次误将AI生成图像的照片判定为人类内容。

Spero表示,他不希望技术成为针对使用AI写作者的“猎巫”工具,但必须有机制抵制低质内容泛滥。

他说:“未来AI内容将持续激增。我们获得新GPU的速度快于新生人口增长。如果不主动支持人类内容,AI内容将淹没所有人类信号。”