一、上下文不够不是模型唯一的问题
长任务失败时,很多人第一反应是换更大的模型。Trellis 的思路是把需求、研究、实现和验收拆成可恢复的阶段,让每次会话只携带当前需要的上下文。
二、分层 Spec 让指令保持稳定
项目级约束放在根 Spec,功能约束放在任务 Spec,临时决策写进工作记录。Agent 每次进入阶段都读取同一份最小上下文,不会因为聊天变长而忘记验收标准。
三、四 Agent 调度
Research 负责查资料,Planner 负责拆任务,Builder 负责落地,Reviewer 负责回归。四者通过结构化文件交接,而不是依赖主 Agent 复述整段对话。
- Research 只写事实和链接。
- Planner 输出可勾选的任务清单。
- Builder 不修改 Spec 之外的文件。
- Reviewer 用验证结果反向更新清单。
四、Hook 把质量门禁自动化
提交前自动运行格式化、类型检查和关键测试;失败就把日志交回当前 Agent。Hook 不替代审查,但能阻止明显错误进入下一阶段。
bash
# 每个阶段完成后运行
npm run lint
npm run typecheck
npm test五、Research 与并行开发
并行只适用于没有写冲突的任务。先划分目录边界,再让不同 Agent 独立工作,最后由 Reviewer 统一合并。