Atlas / Skills / jnmetacode / Executing Plans

Executing PlansSAFE

skills/jnmetacode/executing-plans

🦸 AI 编程超能力 · 中文增强版 — superpowers(250k+ ⭐)完整汉化 + 4 个中国原创 skills,让 Claude Code / Copilot CLI / Hermes Agent / Cursor / Windsurf / Kiro / Gemini CLI / Qoder 等 26 款 AI 编程工具真正会干活

Verdict
SAFE
Grade
B
Trust score
89 /100
Version
1.0.0
Hosts
—
License
MIT
Stars
8,267
01

Overview

🦸 AI 编程超能力 · 中文增强版 — superpowers(250k+ ⭐)完整汉化 + 4 个中国原创 skills,让 Claude Code / Copilot CLI / Hermes Agent / Cursor / Windsurf / Kiro / Gemini CLI / Qoder 等 26 款 AI 编程工具真正会干活

Read from source at commit 61f7309eda3eOBSERVED · 2026-10-07
02

What it tells the agent

The instruction file, verbatim from the audited commit — this is the text the model reads, and the surface the audit's instruction layer examines. Quoted here so you can judge it without cloning anything.

---
name: executing-plans
description: 当你要在当前会话里亲自担任实现者执行一份实现计划时使用——你的人类伙伴选择了内联执行,或者没有可用的子智能体工具
version: "1.0.0"
license: MIT
metadata:
  hermes:
    tags: [execution, planning]
---

# 执行计划

在本会话里亲自执行计划,一个任务接一个任务:不为每个任务派实现子智能体,也不为每个任务派审查者。只在最后对整个分支做一次全新上下文的审查。

**为什么内联:** 子智能体驱动开发为每个任务付一个全新实现者和一个全新审查者的钱,每一个都要从零重读代码库。内联执行只付一个上下文(你自己的)外加最后一个审查者。它放弃的是每个任务一份全新上下文、每个任务第二双眼睛。本技能用别的办法保住那两样东西换来的好处:简报就是规格,账本就是你的记忆,TDD 是每个任务的关卡,最终审查者就是第二双眼睛。

**核心原则:** 计划已经把该想的都想过了。严格照它执行,每一步都用一个你亲眼看着失败、又亲眼看着通过的测试来证明,并留下一份在你自己遗忘之后依然存在的记录。

**旁白:** 工具调用之间最多说一句简短的旁白——账本和工具结果本身就是记录。

**持续执行:** 不要在任务之间停下来向你的人类伙伴确认。他们选内联执行是为了少花钱,不是为了每做完一个任务就回答一次"我该继续吗?"。不间断地执行计划里的所有任务。

**做裁决,不要停摆。** 冲突、歧义、计划缺陷——你自己定。规格是有约束力的权威,计划是它的论证,两者都答不上来的部分由你的判断来定。每个决定都以 `Ruling: <你决定了什么> — <为什么> — <如果错了代价是什么>` 记进账本,然后继续。没有记进账本的裁决就偏离计划,等于一个暗中做出的决定。

只有四件事会让你停下,也只有这四件:不可逆或破坏性的操作;涉及安全的动作;这个工作树之外、按惯例应当先问一声的副作用(合并、推送到共享分支、发布);以及一个坏到每条前进路径都只能靠猜的计划。遇到这四类,停下来问。

## 何时使用

- 你有一份来自 writing-plans 的计划,而你的人类伙伴在交接时选择了内联执行。
- 你的运行环境没有子智能体工具(见 `../using-superpowers/references/` 下的各平台参考)。绝不编造一次分派;就在这里执行计划。
- 任务基本相互独立——与 subagent-driven-development 的前提相同。

一份写得完整的计划,会让内联执行变成"照抄 + 测试":它在中档的会话模型上就能跑得很好,而最强模型唯一值回票价的地方是最终审查——本技能会单独分派它。你的人类伙伴选择内联时,把这一点告诉他们。

当你的人类伙伴希望每个任务都有一道审查关卡,或者计划长到后面的任务会在压缩过的上下文上运行时,优先选 subagent-driven-development。在长计划上内联执行依然可行——账本让它可以恢复——但最后那几个任务分到的是最少的你。

## 流程

```dot
digraph process {
    rankdir=TB;

    subgraph cluster_per_task {
        label="每个任务";
        "task-start: 简报 + BASE; 读简报" [shape=box];
        "按顺序做各步: TDD, 跑每个验证, 读每份输出" [shape=box];
        "步骤输出与计划的 Expected 一致?" [shape=diamond];
        "计划错了? 裁决并记账。代码错了? systematic-debugging" [shape=box];
        "按计划的提交步骤提交" [shape=box];
        "完成契约满足?" [shape=diamond];
        "task-done: 跑测试, 结果记进账本; 标记待办完成" [shape=box];
    }

    "准备: 工作树、工作区 + 账本、读计划 + 规格、起飞前扫描" [shape=box];
    "还有任务?" [shape=diamond];
    "最终整分支审查 (有条件就用全新审查者)" [shape=box];
    "重新定级, 然后: Critical/Important → 一轮修复, 每个修复 RED→GREEN + 全套件绿; Minor → 账本" [shape=box];
    "最终审查干净: 删除本计划的工作区" [shape=box];
    "使用 finishing-a-development-branch" [shape=box style=filled fillcolor=lightgreen];

    "准备: 工作树、工作区 + 账本、读计划 + 规格、起飞前扫描" -> "task-start: 简报 + BASE; 读简报";
    "task-start: 简报 + BASE; 读简报" -> "按顺序做各步: TDD, 跑每个验证, 读每份输出";
    "按顺序做各步: TDD, 跑每个验证, 读每份输出" -> "步骤输出与计划的 Expected 一致?";
    "步骤输出与计划的 Expected 一致?" -> "计划错了? 裁决并记账。代码错了? systematic-debugging" [label="否"];
    "计划错了? 裁决并记账。代码错了? systematic-debugging" -> "按顺序做各步: TDD, 跑每个验证, 读每份输出";
    "步骤输出与计划的 Expected 一致?" -> "按计划的提交步骤提交" [label="是, 最后一步"];
    "按计划的提交步骤提交" -> "完成契约满足?";
    "完成契约满足?" -> "按顺序做各步: TDD, 跑每个验证, 读每份输出" [label="否 - 把任务做完"];
    "完成契约满足?" -> "task-done: 跑测试, 结果记进账本; 标记待办完成" [label="是"];
    "task-done: 跑测试, 结果记进账本; 标记待办完成" -> "还有任务?";
    "还有任务?" -> "task-start: 简报 + BASE; 读简报" [label="是"];
    "还有任务?" -> "最终整分支审查 (有条件就用全新审查者)" [label="否"];
    "最终整分支审查 (有条件就用全新审查者)" -> "重新定级, 然后: Critical/Important → 一轮修复, 每个修复 RED→GREEN + 全套件绿; Minor → 账本";
    "重新定级, 然后: Critical/Important → 一轮修复, 每个修复 RED→GREEN + 全套件绿; Minor → 账本" -> "最终审查干净: 删除本计划的工作区";
    "最终审查干净: 删除本计划的工作区" -> "使用 finishing-a-development-branch";
}
```

## 准备

确保工作发生在一个隔离的工作区里:用 using-git-worktrees 创建一个,或者核实已有的那个。未经你的人类伙伴明确同意,绝不在 main/master 分支上开始实现。

会话记忆无法在上下文压缩(compaction)中存活。一个丢失了位置的内联执行者,会重新实现那些提交早已存在的任务——和控制者重新分派它们是同一种失败,只不过代价付在你自己的上下文里。把进度记在一个账本文件里,而不只是记在待办里。运行环境的待办只是实时视图;账本才是记录。

工作区和账本与 subagent-driven-development 共用——同一个目录、同一种格式——所以一个计划可以在执行中途换执行方式,新的执行者从同一个账本接着做。

- **每个计划拥有自己的工作区:** 技能启动时,运行 `../subagent-driven-development/scripts/sdd-workspace PLAN_FILE`——它会打印这个计划专属的、被 git 忽略的目录(`<repo-root>/.superpowers/sdd/<计划文件名>/`),**本计划**的一切产物都放在那里:账本、简报、审查包。别的计划的目录不属于你,不读也不写。
- 到 `<工作区>/progress.md` 查本计划的账本。如果它的第一行点名的是你的计划文件,那么带有 `Task <N>: complete` 行的任务就是**已完成**——不要重做;从第一个没有该行的任务处继续。即使你的上下文已经不记得做过它们,它们的提交也确实存在于 git 中:压缩之后,相信账本和 `git log`,而不是你自己的记忆。如果账本第一行点名的是另一个计划文件,那是另一个计划的进度:原地别动,另起你自己的新账本。
- 创建账本时,把它的身份写在第一行:`# SDD ledger — plan: <计划文件路径>`。
- `git clean -fdx` 会毁掉工作区(它是被 git 忽略的草稿区);如果发生了,从 `git log` 恢复。

把计划**读一遍**,记下它的上下文和全局约束,并为每个任务建一条待办。如果计划点名了一份规格(Spec),把规格也读了:规格是计划据以论证的权威,计划内部的冲突要拿它来裁。计划里找不到可达的规格,就在账本里记一条说明——没有规格作出的裁决都是临时的。

**必需子技能:** 现在、在任务 1 之前,加载 test-driven-development。它管着下面每个任务的每一步;一份步骤里已经写着"先写失败的测试"的计划,并不能让你免于读它。

任务 1 之前,扫描计划中任务之间的冲突。计划的 Interfaces 块告诉你该看哪里:每个消费前序任务产出的任务,对应账本里的一行——两个任务、一方产出的东西对照另一方消费的东西、以及你的发现。什么都不共享的任务不占行;任务之间什么都不共享的计划,只记一行 `Pre-flight: no shared interfaces`。以规格为有约束力的权威,对每一行翻出的冲突作出裁决,把裁决记在那一行旁边,然后开始任务 1。每个任务自身的文本在你读它的简报时再检查,不在这里。

## 任务循环

你打印的一切、每一个工具结果,都会在会话剩下的时间里常驻在你的上下文中。把冗长的测试输出重定向到工作区里的文件,只读它的末尾;读简报,而不是整个计划。

### 1. 接下任务

- 运行本技能的 `scripts/task-start PLAN_FILE N`。它一次调用就打印出简报路径和 BASE(这个任务的范围从哪个提交切出)。每个任务都要读简报,包括你在准备阶段就记得的那些:你记得的是摘要,简报里有精确的取值、签名和测试用例。
- 把该任务的待办标为 in_progress。

每一次工具调用都是一轮,要把你的整个上下文重读一遍。记账顺着干活一起做——账本追加和提交放在同一次调用里,绝不单独占一次调用。

### 2. 做各个步骤

计划的步骤已经是 RED-GREEN 的顺序;在准备阶段加载的 test-driven-development 之下,按这个顺序做。测试步骤的代码先写、先跑。看着它失败是一个步骤,不是走过场——一个在实现还不存在时就通过的测试,本身就是一条关于这个测试的发现。

每个会运行命令的步骤都有一行 `Expected:`。运行命令,读它的输出,然后对照。三种结果:

- **一致。** 下一步。
- **代码错了。** 使用 systematic-debugging。找到原因;绝不为了让步骤输出对上而去修补症状。
- **计划错了**——某一步与规格矛盾、前序任务的接口与本任务消费的不一致、一条根本跑不通的命令。对能满足规格的最小改动作出裁决,以 `Task <N>: Ruling: <发现> — <你决定了什么,以及为什么>` 记进账本,然后继续。裁决是被携带的,而不是被记住的:后面碰同一个接口的任务,从账本里读到它。

按计划的提交步骤提交。一个任务跨好几个提交没问题;审查范围从 BASE 切出,绝不用 `HEAD~1`。

### 3. 完成契约

在一个任务写账本行之前,下面各项都必须为真,并且在本会话中有证据——而不是因为 diff 看起来没问题就推断出来:

- 简报点名的每一个测试都存在、都在本任务中跑过,并且你读了输出。
- 本任务最后一次测试运行通过了——`task-done` 就是那次运行,它会把命令和结果写进账本行。
- 简报里的每一行 `Expected:` 都和真实输出对照过。
- 每一处对简报的偏离,在账本里都有一行 `Ruling:`。

**必需子技能:** 这个声明由 verification-before-completion 管辖。任何一项缺失,任务就没有完成:把它做完。

### 4. 完成任务

运行本技能的 `scripts/task-done PLAN_FILE N BASE -- <测试命令>`,测试命令用简报为整个任务点名的那一条。它会跑测试、把完整输出保存在工作区、打印末尾,并且——只有在测试通过时——往账本追加完成行:

`Task <N>: complete (commits <base7>..<head7>, tests: <command> → <result>)`

失败的运行什么都不记录;任务没有完成。记录成功后,把待办标为完成,接下一个任务。

## 最终审查

运行 `../subagent-driven-development/scripts/review-package PLAN_FILE MERGE_BASE HEAD`(MERGE_BASE = 分支起点的那个提交,例如 `git merge-base main HEAD`),并基于它打印出的文件做审查。

**有子智能体工具时:** 在可用的最强模型上分派审查者—
03

Trust audit

SAFEgrade B · trust 89/100 Nothing in the source contradicts what it says it does. Grade A is reserved for packages that have also passed the behavioural sandbox.

LayerWhat it checksResult
L0Provenance & inventoryPASS
L1Static analysis of the codeNA
L2Instruction surface (what it tells the agent)PASS
L3Class-specific surfacePASS
L4Behavioural (sandbox)SKIPPED

What the source does

Filesystem
none-observed
Network
none-observed
Shell
none-observed
Dependencies
pinned
Secrets in source
none-found

Findings (1)

LOWInventory / provenance · inv.symlink · CWE-1104
AGENTS.md
AGENTS.md
Why it matters. link not followed

Gates applied: no_behavioural_pass.

Audited 2026-10-07 · audit v0.4.1 · source sha 61f7309eda3efull audit observations/trust-audit/skill/jnmetacode__executing-plans.json · Report an issue / request a re-scan
04

Audit history

Every audit this skill has had.

DateSourceVerdictGradeScoreChange
2026-10-0761f7309eda3eSAFEB89first audit
05

Questions

What does the Executing Plans skill do?

🦸 AI 编程超能力 · 中文增强版 — superpowers(250k+ ⭐)完整汉化 + 4 个中国原创 skills,让 Claude Code / Copilot CLI / Hermes Agent / Cursor / Windsurf / Kiro / Gemini CLI / Qoder 等 26 款 AI 编程工具真正会干活

Is Executing Plans safe to install?

The audit found nothing in the source that contradicts what it says it does, and graded it B (89/100). Grade A is held back for packages that have also passed a sandboxed behavioural run, which is why a clean skill reads B.

What can Executing Plans access on my machine?

The audit observed no filesystem, network or shell use at all in its source.

How current is this page?

The grade is for one exact copy of the source (61f7309eda3e), read on 2026-10-07. The repository is watched, and a new audit runs when it changes — this is the first audit.

Advertisement