Ornith-1.5模型示意图

如今,我们已经进入了一个可以免费且商用无忧地拥有与Claude Opus 4.8相媲美的AI模型的时代。日本发布的高性能AI模型“Ornith-1.5”于8月19日正式亮相。该模型基于MIT许可证发布,允许无限制的商业和研究使用。

Ornith-1.5是在基于日本Qwen 3.5和Gemma 4开发的“Ornith-1.0”基础上,通过扩展自我改进循环到任务生成和脚手架构建等环节而打造的升级版本。Ornith-1.0本身是在Qwen 3.5和Gemma 4基础上,经过持续的预训练、中间训练和后期训练开发而成。

其中最大规模的“Ornith-1.5-397B”在Terminal-Bench 2.1测试中获得86.1分,在DeepSWE测试中获得56分,表现与Claude Opus 4.8(分别为85分和59分)不相上下,且超越了GLM-5.2(81分和46.2分)及DeepSeek-V4-Flash-0731(82.7分和54.4分)。

此外,Ornith团队还发布了35B MoE和9B Dense版本模型。经过量化优化的“Ornith-1.5-9B-Mobile”版本甚至可以在智能手机上运行,其性能超过了Gemma 4 31B和Qwen 3.6-35B-A3B等模型。

Ornith-1.5性能对比图