
日本Konoe Intelligence公司与一般社团法人日本Nyx Foundation共同启动了无幻觉AI的联合研究项目。
该公司指出,判断AI答案是否正确,不应仅看答案本身,而应关注其逻辑推理过程。为了确保AI推理的每一步都能被机械化验证,建立一套可验证推理过程的机制至关重要。尽管现代AI具备强大的推理能力,但推理能力强并不等同于推理过程的正确性,因此必须进行验证。迄今为止,唯一能够证明推理正确性的手段是“数学”。基于此,双方宣布将开发基于数学的超智能AI,致力于实现无幻觉的AI。
作为AI安全性的终极形态,单纯依靠事后检测和过滤AI输出的对症疗法无法确保AI的安全。真正的AI安全应当是结构上杜绝错误发生的AI系统。为此,研究团队计划构建一个以数学证明而非概率为基础的AI输出保障框架。
通过此次合作,Konoe Intelligence表示将挑战将AI安全性从“概率管理”提升至“数学保障”的新高度。首批应用目标包括金融、汽车、航空、半导体等对质量和可靠性要求极高的行业,重点在于对这些行业的规格书和协议进行形式化验证,开发能够结构性排除幻觉现象的高质量模型。
在过去六个月的成果指标中,团队在PutnamBench(大学级难题集)上取得了显著进步。此外,针对AI在将问题文本翻译为数学表达式时可能产生的误解,研究团队开发了机械检测技术,并利用Nyx独有技术将误差率降低至原来的一半。


