Thinking Machines实验室近日发布了其首款AI模型Inkling。该模型从零开始训练,能够理解音频、视频以及文本输入。虽然Inkling在主流基准测试中并非表现最佳,但它在多项任务中表现出色,具备高级推理和编程能力。与许多开源权重模型类似,Inkling规模庞大,拥有9750亿参数,需要在专用芯片集群上运行。
值得注意的是,Thinking Machines利用Inkling自身进行了微调和自我改进,体现了AI模型在构建AI方面的潜力。训练过程中出现了一个有趣现象:Inkling在复杂推理时通常会给出自然语言解释,但随着训练进展,其“思维链”变得更加简洁,减少了语法负担,同时保持了可理解性和最终回答的准确性。
此次开源模型的发布,有助于Thinking Machines在竞争激烈且资金充裕的AI领域中确立自身地位。开源模型因运行成本较低且易于针对不同任务进行修改而备受欢迎。目前表现最好的开源权重模型多来自中国,但Thinking Machines表示Inkling的性能可与这些模型媲美。
发布开源权重模型也契合了Thinking Machines此前提出的AI愿景:技术不应被少数公司垄断,而应去中心化,让更多人能够利用自己的数据构建模型。

Thinking Machines成立于2025年2月,由多位来自OpenAI的知名高管和研究人员创立,包括曾任OpenAI首席技术官及短暂担任CEO的Mira Murati,OpenAI联合创始人兼ChatGPT关键开发者John Schulman,以及曾任OpenAI副总裁、负责安全与机器人项目的Lilian Weng。
该初创公司获得了史上最大规模的种子轮融资,估值高达120亿美元。此前,Thinking Machines已发布了用于模型微调的工具Tinker,展示了自然语音交互工具,并发表了多项机器学习研究成果。
虽然OpenAI凭借ChatGPT引领了AI热潮,但由前OpenAI成员创立的公司如Thinking Machines和Anthropic也迅速崛起。Anthropic近期提交了IPO申请,估值可能超过万亿美元,其模型Claude因强大的编程能力受到众多企业青睐。
(2026年7月15日更新:本文对模型训练过程相关引用进行了澄清。)


