你只需要说出你想要什么,剩下的交给系统。
想象一下:你有一个想法,但不知道怎么实现。你告诉这个系统"我需要一个客户入驻系统",它会:
- 理解你的想法 — 把模糊的需求翻译成清晰的任务定义
- 生成完整项目 — 自动生成包含7层+2横切+进化的可运行项目,每层都有可执行产物
- 分配专业角色 — 自动创建一组 AI 代理,各司其职
- 编排执行 — 规划谁先做、谁后做、谁并行做
- 验证结果 — 自动检查产出是否达标
- 越用越聪明 — 每次犯错都会让系统变得更好
- 自我进化 — 系统会主动优化自己的规则、流程和代理配置,进化规则本身也会进化
- 推陈出新 — 需求完成后,系统会主动发现可以改进的地方,提出超越原始需求的创新建议
一句话:这是一个"会进化、会创新的 AI 代理管理系统"——它确保 AI 代理干活靠谱,越来越靠谱,还能超越你的期望。
你不需要懂代码。你只需要在 AI 编程工具中打开这个项目,然后告诉它你想做什么。
支持的工具和上下文加载方式:
| 工具 | 规则文件 | 加载方式 | 你需要做什么 |
|---|---|---|---|
| Trae | AGENTS.md |
✅ 自动加载 | 打开项目即可 |
| Claude Code | CLAUDE.md |
✅ 自动加载 | 打开项目即可 |
| Cursor | .cursorrules |
✅ 自动加载 | 打开项目即可(scaffold.py 自动生成 .cursorrules 重定向到 AGENTS.md) |
| 其他 AI 工具 | — | 在对话中手动发送 AGENTS.md 的内容作为上下文 |
关键:AI 必须读到规则文件才能按管道工作。 如果 AI 没读到规则,它就会跳过管道直接干活——这不是我们想要的。
示例——你只需要说:
- "我需要一个客户入驻系统"
- "帮我做一个竞品价格监控工具"
- "我想自动化每周报告的生成"
- "做一个自由职业者发票管理的 SaaS"
AI 会自动读取项目规则(不需要你手动操作),然后:
- 解析你的需求
- 生成适合这个任务的完整可运行项目(7层+2横切+进化)
- 创建专门的代理来执行
- 验证结果是否达标
- 在需求满足后,主动提出创新建议
你需要做的只有两件事:
- 说出你想要什么(越模糊越好,系统会帮你理清)
- 确认假设(系统会列出它做的假设,你只需确认或纠正)
这个项目是一个 自举的元 Harness——它不是给某个项目用的 harness,而是生成 harness 的 harness。
核心公式:
Agent = Model + Harness
- Model 提供智能
- Harness 让智能可靠地发挥作用
- 更好的 Harness 往往比更好的 Model 更重要
生成工厂模式:
模糊意图 → [解释器] → 结构化任务定义
↓
[Harness 生成器] → 完整可运行项目(7层+2横切+进化)
↓ 每层都有可执行产物(Python脚本、YAML配置、JSON Schema)
[Agent 工厂] → 专用代理拓扑(动态生成,非预设选择)
↓
[编排器] → 执行计划(跨所有层协调)
↓
代理在生成的 harness 中执行 → 结果
↓
失败反馈 → 元 Harness 改进 → 进化引擎优化
↓
需求满足 → 创新引擎 → 推陈出新(超越原始需求)
快速开始:
- 在 Trae / Claude Code 中打开这个项目
- 对 AI 说你想做什么(例如:"我需要一个客户入驻系统")
- AI 自动读取项目规则,按管道执行
- 确认 AI 列出的假设
- AI 生成完整的 harness 项目并执行
- 需求满足后,AI 会主动提出创新建议
命令行使用:
# v2 生成流程(scaffold 脚本 → LLM 填充 slot → validate 门禁)
python scripts/scaffold.py --task task.yaml --output generated/<project-name>
python scripts/validate-harness.py generated/<project-name>
# 验证生成的项目是否完整(7+2层检查)
python scripts/verify-generation.py <generated-project-dir>
# 运行进化引擎
python scripts/evolve.py --project-root <generated-project-dir>
# 运行创新引擎(推陈出新)
python seeds/evolution/innovation-engine.py --project-root <generated-project-dir>
# 在生成的项目中运行创新周期
python orchestrator.py --innovate管道控制(v3.1,事件日志驱动):
# 初始化 / 解释意图(锁定验收标准)
python meta/meta-orchestrator.py --status
python meta/meta-orchestrator.py --interpret-intent "<原始意图>"
# 推进阶段(GENERATE→FACTORY 有 validate-harness 门禁,由 hooks 强制执行)
python meta/meta-orchestrator.py --advance [--no-auto-run]
# 阻塞/解除(解除必须记录 code + reason);暂停/恢复
python meta/meta-orchestrator.py --fail "<错误>"
python meta/meta-orchestrator.py --unblock --code <code> --reason <reason>
python meta/meta-orchestrator.py --pause | --resume
# 审计与完整性
python meta/meta-orchestrator.py --events # 追加式事件日志(真相源)
python meta/meta-orchestrator.py --check-invariants # fail-closed 不变量检查
python meta/meta-orchestrator.py --compact # 以锁标记重新生成 resume briefREADME.md ← 你正在读的这个文件
README_EN.md ← 英文版
AGENTS.md ← ⚡ AI IDE 自动加载的项目规则(Trae 入口)
CLAUDE.md ← ⚡ AI IDE 自动加载的项目规则(Claude Code 入口)
META.md ← 系统的 DNA(完整管道规格)
.gitignore ← Git 忽略规则(generated/ 等)
│
meta/ ← 编译管道的四个阶段
interpreter.md 第 1 步:意图 → 结构化任务
harness-generator.md 第 2 步:任务 → 可执行 Harness 项目(7+2+evolution)
agent-factory.md 第 3 步:Harness → 代理拓扑
orchestrator.md 第 4 步:代理 → 执行计划(跨所有层协调)
examples/ 参考示例(非预设模板)
topologies.md 代理拓扑示例
│
evolution/ ← 元级自我进化系统
framework.md 进化算法(基因组、适应度、变异、选择)
(genome.yaml / log.yaml 在 seeds/evolution/ 作为生成种子)
│
templates/ ← 已删除(v1 领域模板,被 v2 的动态 domain-brief 取代)
│
seeds/ ← 种子产物(每层的可执行模板文件,由 scaffold.py 复制)
context/ loader.py, knowledge-index.yaml
tools/ schemas.yaml, sandbox.yaml, permissions.yaml, mcp-config.json
memory/ snapshot.py, compression-rules.yaml
planning/ dag-builder.py, flow-control.yaml, sub-agent-dispatch.yaml, budget.yaml
verification/ consistency-check.py, security-guardrails.yaml, self-check.py
feedback/ error-capture.py, retry-config.yaml, mistake-to-constraint.py, human-interface.yaml
constraints/ architecture-rules.yaml, linter-config.yaml, entropy-reduction.py, cost-budget.yaml
security/ sandbox-config.yaml, encryption-rules.yaml, audit-log.yaml
observability/ tracing.yaml, metrics-dashboard.yaml, session-replay.yaml, versioning.yaml
evolution/ framework.md, genome.yaml, log.yaml
innovation-engine.py ← 创新引擎(推陈出新)
product-analyzer.py ← 产品状态分析器
domain-advancements.yaml ← Web 应用领域进阶模式
domain-advancements-api.yaml ← API 服务领域进阶模式
orchestrator.py ← 生成的项目入口(编排器)
│
generated/ ← 生成输出(每次编译的结果,git-ignored)
memory/ ← 元知识(跨项目积累,越用越强)
generation-log.yaml 每次生成的记录(由执行管道维护,人类与机器可读)
meta-mistakes.md 生成失败 → 管道改进
task-patterns.md 已知任务模式(加速解释)
decisions.md 架构决策记录
progress.md 执行进度
│
scripts/ ← 可执行脚本(跨平台 Python)
scaffold.py v2 生成骨架:任务 → harness 目录 + 通用原语 + LLM slot 清单
verify-generation.py 验证生成项目的7+2层完整性
evolve.py 证据驱动进化引擎
Harness 是围绕 AI 代理构建的约束+工具+验证系统。就像赛马需要缰绳(harness)才能跑对方向,AI 代理需要 harness 才能可靠地产出。
没有 harness 的代理:可能做对,可能做错,你不知道是哪种。 有 harness 的代理:做错了会被拦住,做对了会被验证,结果可预测。
旧模式(描述框架):生成 markdown 文件 → AI 读 markdown 按规则干活 新模式(生成工厂):生成完整可运行项目 → 每层都有可执行产物(Python脚本、YAML配置、JSON Schema)
| 层 | 生成的可执行产物 |
|---|---|
| 1. 上下文工程 | AGENTS.md + 上下文加载脚本 + 知识索引 |
| 2. 工具集成 | 工具 schema + 沙箱配置 + 权限清单 + MCP 配置 |
| 3. 记忆与状态 | 会话状态文件 + 长期记忆结构 + 快照脚本 + 压缩规则 |
| 4. 规划与编排 | DAG 构建脚本 + 流控配置 + 子 agent 调度 + 预算配置 |
| 5. 验证与护栏 | 格式校验器 + 一致性检查脚本 + 安全护栏 + 自验证循环脚本 |
| 6. 反馈与自愈 | 错误捕获器 + 重试策略 + 错误→约束闭环脚本 + 人工介入接口 |
| 7. 约束与熵 | 架构规则 + 代码强制配置 + 熵减脚本 + 成本约束 |
| 安全与隔离 | 沙箱配置 + 加密规则 + 审计日志 |
| 可观测性 | 追踪配置 + 指标面板 + 会话回放 + 版本管理 |
| 自我进化 | 进化框架 + 基因组 + 进化日志 + 创新引擎 + 产品分析器 |
每次生成失败,根因分析会被记录到 memory/meta-mistakes.md,然后改进生成管道。这形成了一个复利反馈环:
错误 → 根因分析 → 约束改进 → 未来生成更好 → 更少错误
用得越多,系统越聪明。这是和传统模板库的根本区别。
系统根据任务分析合成最优的代理图,而非从预设模式中选择:
- 识别工作单元(每个约束、工作流步骤、领域)
- 映射依赖关系
- 确定并行性
- 分配角色(合并紧耦合的,拆分超上下文的)
- 添加验证层(永远必须有独立的验证者)
- 定义交接点
这是最激进的设计。系统不仅能从错误中学习,还能主动优化自己:
三层基因组(什么可以进化):
- Harness 基因组:约束、工作流、技能、验证规则
- Agent 基因组:拓扑结构、角色范围、交接格式、上下文预算
- 进化基因组(元进化):变异算子、选择标准、适应度权重、变异率
进化循环:
收集证据 → 测量适应度 → 提出变异 → 测试变异 → 选择或拒绝 → 更新基因组
↓
元进化:更新变异/选择规则本身
安全约束(防止"癌症"和"自杀"):
- 永远不能删除验证层(否则系统会接受错误结果——"癌症")
- 永远不能删除进化系统本身(否则系统停止进化——"自杀")
- 变异率永远不超过 30%(否则系统陷入混乱)
- 所有变异必须可逆(保留上一版基因组)
当所有验收标准满足后,创新引擎启动。它不再"自动发现"创新——创新提案由
执行管道的 agent 按 INNOVATE 提示词契约(prompt-contracts/innovate/)产出,
引擎负责校验(schema + 证据溯源,fail-closed)、分级(🔒/🟢)与记录:
需求满足 → 产品机械事实(product-analyzer,kind: fact)
→ INNOVATE 契约提案(每条可溯源或显式标注 assumption)
→ 引擎校验 + 审批分级 → 人工确认(高危)→ 记录 evolution/innovation-log.yaml
四阶段进阶模型(阶段判定基于机械事实,不再有"空产品=Solid"的 bug):
| 阶段 | 判定依据(事实) | 说明 |
|---|---|---|
| Basic | 满足需求但证据不足 | 核心功能实现 |
| Solid | >5 个有内容文件 + 有测试 | 生产可用 |
| Advanced | >10 个文件 + >10 个测试 | 竞品水准 |
domain-advancements.yaml 是示例库(参考方向/措辞),不是提案的真相源。
安全机制:
- 高工作量或安全相关的创新需要人工确认(🔒 NEEDS APPROVAL)
- 低工作量且非安全的创新可自动执行(🟢 AUTO-APPROVED)
- 创新提案保存在
evolution/innovation-log.yaml,全程可追溯
v3.0 把 DeepSeek Harness(DSH)中可迁移的核心理念落地到本框架(不引入 Node/Cordis 运行时,全部以 Python + YAML + Markdown 实现):
| DSH 理念 | 本框架落地 |
|---|---|
| 会话日志即真相(model-visible ⟺ logged) | meta/event-log.yaml 追加式事件日志是唯一真相源;pipeline-state.yaml 与 PHASE_BRIEF.md 都是派生投影,带 asOfSeq 水位 |
| fail-closed 设计 | scripts/log_invariant.py:未知日志版本/事件类型/seq 断裂/过期 brief/孤儿压缩 → 显式 FAIL |
| 并发写保护(CAS) | 每次变更带 expected_revision,陈旧写者被拒而非静默覆盖 |
| 目标语义(goal) | 持久 phase 与 auto_advance 分离;blocked_code/blocked_reason;同 code 连续拒绝 3 次才阻塞;rounds/max_rounds 约束自动继续;--pause/--resume |
| 事件分发模式(bail/emit) | hooks/pre-advance/*.py 是 bail 门禁(可拒绝推进,GENERATE 门禁即其一);`hooks/phase-complete |
| 能力接缝(Definition/Provider/Consumer) | 生成的 harness 带 seams/(workitem-source/executor/ci/sandbox),validate-harness 校验三角色齐全,残缺接缝报错 |
| 声明式组合 + 补丁(profile/patch) | 生成项目带 harness-composition.yaml(命名行)+ harness-patch.yaml(按 id 覆盖,未知 id 拒绝);scripts/compose.py |
| 技能注册表 + 目录 | 生成项目带 skills/catalog.yaml;`context/loader.py skill list |
| 压缩(compaction) | --compact 以 compaction/start/summary/end 锁标记重生成 brief,崩溃(孤儿 start)可检测 |
| 溢出(spill) | 超大产物落 meta/artifacts/,状态只存 locator;失败 best-effort 非致命 |
| postmortem 文化 | memory/postmortems/NNNN-<slug>.md(什么坏了/根因/为何逃过门禁/持久教训),由 mistake-to-constraint 生成且幂等 |
| 权限单调收紧 + 审批 | tools/permissions.yaml 显式模式(read-only/workspace-write/full)+ 预设;guard.py --permission 拒绝即最终;enforce-permission.py 把"沙箱拒绝"(126) 与"任务失败"分开 |
| 可回滚自我修改 + 审批分级 | scripts/evolve.py:变异带 evidence_refs;变异前自动快照、--rollback 字节级还原;NEEDS_APPROVAL 变异默认不落地;genome 按代版本化 |
三条机械不变量(有脚本断言,非提示词要求):
- 模型可见 ⟺ 已记录:
--check-invariants校验 brief/state 的水位与日志一致。 - fail-closed:未知形状显式 FAIL,绝不静默猜测。
- 门禁带回归测试:
tests/test_state_fold.py、test_orchestrator.py、test_compose.py、test_events.py、test_integration.py每个门禁都有 "删掉门禁必红"的回归测试。
脚本不会假装语义判断;语义判断走显式提示词契约(meta/prompt-contracts/),
脚本只做机械且真实的事。 分三档:
| 档位 | 含义 | 覆盖 |
|---|---|---|
| 🟢 mechanical(可靠) | 确定性算法,测试可证,不做语义判断 | 事件日志/投影/不变量、编排器、scaffold、compose、DAG 环检测、拓扑排序、快照/回滚、契约校验器 validate_contract.py |
| 🟡 heuristic(启发式) | 正则/词频扫描,能抓明显违规,可误报可绕过 | interpret.py 基线分类、guard.py --check 计划文本、anti-mock-check.py、quality-gate.py、fitness 计算 |
| 🔵 prompt-contract(语义,LLM 承担) | 脚本出脚手架/做校验,判断由执行管道的 agent 按契约完成 | JUDGE 裁决、AUDIT 审计、INNOVATE 提案、DEEPEN 深化、PLAN-REVIEW、EVOLVE 提案 |
关键约定(v3.1):
judge.py的 PROVEN 必须基于真实执行的 verify/test 记录(证据账本)—— 手写状态文件不再算证据;无证据 =INSUFFICIENT_EVIDENCE。- 创新引擎不再从预写清单自动"提出创新":
domain-advancements.yaml是示例库, 提案必须来自 INNOVATE 契约且每条可溯源或显式标注assumption。 guard.py --scan对真实工作树跑反 mock/质量扫描,是代码质量的机械门禁;--check的计划文本检查是启发式辅助。
生成的项目遵循以下编排循环:
┌─→ EXECUTE: 实现下一个验收标准
│ ↓
│ PROVE: 收集证据,验证每个标准是否满足
│ ↓
│ JUDGE: 所有标准都满足了吗?
│ ↓ ↓
│ YES NO → 根因分析 → 回到 EXECUTE
│ ↓
│ EVOLVE: 进化引擎优化系统
│ ↓
│ INNOVATE: 创新引擎提出超越需求的建议
│ ↓
└── LOOP: 持续改进
当 JUDGE 判定所有标准满足时,系统不会停止——它会进入 EVOLVE 阶段优化自身,然后进入 INNOVATE 阶段提出创新建议。
验证分两层:
| 层 | 文件 | 作用 |
|---|---|---|
| 生成完整性 | scripts/verify-generation.py |
验证生成的项目是否7+2层完整 |
| 运行时验证 | 生成项目的 verification/(self-check / anti-mock / quality-gate / run-tests)+ orchestrator.py --verify |
项目内真实执行检查,证据进账本 |
代理在每个阶段后运行生成项目自己的验证门禁;人类可直接跑 Python 脚本。
- 读
META.md— 它包含完整的编译管道 - 按顺序跟随管道阶段:
meta/interpreter.md— 把用户意图解析为结构化任务meta/harness-generator.md— 生成任务专用 harness(7+2+evolution,每层有可执行产物)meta/agent-factory.md— 生成代理拓扑(从分析生成,非预设选择)meta/orchestrator.md— 规划执行(跨所有层协调)
- 输出到
generated/[project-name]/ - 运行
scripts/verify-generation.py验证7+2层完整性 - 记录每次生成到
memory/generation-log.yaml - 记录每次失败到
memory/meta-mistakes.md - 需求满足后,运行创新引擎 —
python seeds/evolution/innovation-engine.py --project-root <dir>
- 没有解释就不执行 — 先运行解释器
- 没有 Harness 就不代理 — 每个代理在约束内操作
- 没有原因就不约束 — 每条规则必须追溯到需求
- 没有验证就不完成 — 改动后运行生成项目的验证门禁(如
verification/self-check.py/orchestrator.py --verify) - 生成可执行系统,不是文档 — 每层必须有可执行产物
- 代理拓扑从任务分析生成,不从预设选择
- 上下文文件不超过 60 行
- 进化不能删除验证层(防癌症)
- 进化不能删除进化系统本身(防自杀)
- 所有变异必须可逆
- 需求满足后必须运行创新引擎(推陈出新)
- 读
generated/[project]/AGENTS.md— 那是项目专用 harness - 遵循其中定义的工作流
- 在其中定义的约束内工作
- 每次改动后运行验证
- 所有验收标准满足后,运行
python orchestrator.py --innovate获取创新建议