AI 是怎么把一个功能做对的
AI 不是靠"一次写对"的。ForgeaX 用一条可观测、可回溯的流水线,让每个功能一步步收敛到正确。
七步闭环
在引擎内部,每个功能都经过同一条流水线 —— 需求进、可用产物出,中间每一步都留下可读的记录:
- 需求 —— 把要做什么写清楚,带验收标准。
- 研究 —— 查历史、约束与可选方案。
- 计划 —— 定策略,拆成可执行任务。
- 实现 —— 写代码 + 测试。
- 验证 —— 多方独立检查,任一不过就拦下。
- 验收 —— 人来把最后一关。
- 合入 —— 通过后并进主干。
编排者 + 子 agent
一个"编排者"推进这条状态机,决定每一步派哪个子 agent、并检查它的产物;子 agent 各有角色、各自独立上下文。人类只在两个出入点注入判断:提需求和做验收。
不让"看起来过了"溜过去
验证步里有两道 AI 关卡:一个以 AI 用户视角静态扫文档与 API,抓"承诺了却没实现";另一个在隔离沙箱里真跑 demo、截图,再回头核对画面对不对 —— 防止"测试假绿、画面却是黑的"。
越跑越稳
每个功能跑完,过程里遇到的痛点会沉淀成反馈,反过来升级流水线本身。下一个功能自动用上更新后的版本 —— 流水线吃自己的产物,越跑越懂。
结果是:AI 写出来的不是"demo 级"代码,而是经过验证、可重放、能被人接手的功能。