Base44 是一个面向所有人的编程平台,无论技术水平如何,都能用它来构建全栈应用和网站。它的用户涵盖了没有开发人员的小型企业,也有利用平台打造完整SaaS产品的公司。

Base44的首位员工、现任产品负责人Yoav Orlev表示,工作中最令人满足的部分是看到小企业借助平台完成了他们原本缺乏时间、预算或技术能力才能实现的项目,比如搭建数字店铺或餐厅员工排班应用。他们团队的使命是不断扩展产品功能,同时保持易用性。

Base44的产品和工程团队一直以快速迭代著称,尤其是在发布小型或中等规模功能时。但涉及平台核心、多个相互依赖部分的改动,只能交给最资深的工程师来完成。

其中一个瓶颈是Base44的系统提示(system prompt)及其数百种变体,这些变体根据用户是首次使用还是多次使用、免费用户还是付费订阅者,以及所构建应用的类别和功能不同而变化。另一个瓶颈是原生移动基础设施的改动,这只有具备移动端专业知识的工程师才能胜任。

Orlev提到,早期的Claude模型(自2025年初Base44上线以来一直驱动其应用生成引擎)并不可靠。比如当模型遇到错误时,它会一直在当前代码位置尝试修复,而不会意识到修复可能已存在于代码的其他部分并去寻找它。

“决定下一步做什么非常关键,但大多数早期模型采取的往往是比较简单的做法,”他说。

Claude Fable 5是团队测试过的第一个能够像理解软件构建一样进行推理的模型。

信任Fable 5处理最复杂的产品和工程任务

Base44会对每个新Claude模型进行多种应用类型的评测,衡量延迟、成本和构建错误。团队还会通过构建Minecraft克隆等测试,观察模型如何处理游戏物理和机制。

Claude Fable 5表现突出:它用更少的步骤完成任务,并且从首次提示就能构建更完整的应用,包括早期模型忽略的边缘情况。

因此,团队将它用于之前只交给最资深工程师的任务——重建Base44系统提示。经过约一小时的反复提问,Claude Fable 5独立运行四小时后,交付了90%到95%符合需求的成果。利用A/B测试基础设施,团队当天下午就测量并发布了这些改动。更重要的是,Claude Fable 5还指出了Base44自身评测中的盲点:团队未测试缓存命中率,而提示变更可能破坏缓存,数百万用户规模下会增加成本。模型发现并纠正了这一问题。

当Claude Fable 5在修改Base44应用内代理的底层代码时遇到困难,它推理出同样的问题可能已在代码库其他地方解决,主动去调查并带回了修复方案。Orlev说:“这种‘问题可能已在别处解决,我应该去那儿调查’的推理能力,在其他模型中很少见。”

Orlev将与Claude Fable 5的合作比作与一位资深工程师共事。初级工程师需要详细指导和频繁检查,而资深工程师只需了解目标和原因即可。

这类工作也超出了工程团队的范畴。当产品经理希望将原生移动应用构建纳入Base44时,他让Claude Fable 5承担此任务,约两小时半后,模型交付了约90%可用于生产的工作环境。

在Claude Fable 5之前,这类任务只能等待Base44的前三名工程师或专家空闲。现在,模型执行任务,Orlev团队负责审核、测试并批准代码后发布。

Base44团队与Claude Fable 5合作

未来展望

随着Claude模型能力的提升,Base44团队对平台的目标也在不断扩展。团队计划将Base44从一个构建应用的工具,转变为帮助用户管理和发展其应用的综合平台。Base44 Superagents现已公开,能够围绕这些应用运行工作流程。

有了对Fable 5处理复杂任务的信任,Orlev鼓励产品经理和设计师敢于触及平台中之前因担心破坏而不敢动的部分。

“Fable让我们有信心在业务上做出更大胆的尝试,”Orlev说,“它将产品带入了一个全新的领域,开启了我们之前不敢涉足的可能性。”

想要开始使用 Claude Fable 5