Back to skills
SKILL.md
Ll Iteration Review
ASecurity方案评审/检查(三档分级,按任务难度自动匹配强度):S 轻量迭代(已有提案直接评审)/ M 标准(多视角结构化互评)/ L 重(完整专家团:双提案+双独立复查+APPROVE)。触发:「方案评审/评审一下这个方案/检查提案/多对话评审」「用专家团评审」「tasklist 这批任务的实现路径需要评审优化」「这个问题很复杂,组织多轮讨论再定方案」「review this proposal」。适用:方案级复杂问题(L)、批量任务提案评审(M)、既有提案的轻量迭代(S);开销大,仅用于复杂问题(判据见适用范围节)。产出=经分级评审与(L 档)依据隔离复查的方案终稿(含分歧残留、失败记录、成本账)。不适用:已有垂直流程的场景(issue 草稿、代码调研、项目规划各有专门技能,本技能是其上的元流程)。
- 3 stars
- 0 votes
- 0 copies
- 0 views
- Added October 10, 2026
Security analysis
100/100Pro scans all 6 files and shows the line behind each finding
npx -y skills add Linearl/reasonix_skill_repo --skill ll-iteration-review --agent claude-codeAre you the author of Ll Iteration Review?
Add the live security badge to your README. It updates with every re-scan.
[](https://www.skillsdirectory.com/skills/linearl-ll-iteration-review)---
name: ll-iteration-review
description: "方案评审/检查(三档分级,按任务难度自动匹配强度):S 轻量迭代(已有提案直接评审)/ M 标准(多视角结构化互评)/ L 重(完整专家团:双提案+双独立复查+APPROVE)。触发:「方案评审/评审一下这个方案/检查提案/多对话评审」「用专家团评审」「tasklist 这批任务的实现路径需要评审优化」「这个问题很复杂,组织多轮讨论再定方案」「review this proposal」。适用:方案级复杂问题(L)、批量任务提案评审(M)、既有提案的轻量迭代(S);开销大,仅用于复杂问题(判据见适用范围节)。产出=经分级评审与(L 档)依据隔离复查的方案终稿(含分歧残留、失败记录、成本账)。不适用:已有垂直流程的场景(issue 草稿、代码调研、项目规划各有专门技能,本技能是其上的元流程)。"
---
# ll-iteration-review —— 方案评审/检查(三档分级)
## 适用范围(先判断要不要进这个 Skill)⚠️ 本模式开销很大,只建议用于复杂问题
**开销警示(先看代价再决定)**:一次完整运行 = 多子会话(≥5 个角色)× 多轮互评(S6 最多 5 轮)+ 双独立复查 + 冻结/看板/台账维护——**token 开销约为普通单会话问答的数十倍,时间跨度常以小时计**。S1 的预算声明与 3× 预警就是为此设的:**先估开销,确认问题价值配得上,再开团**。
**适用(值得开团的「复杂问题」判据——满足任二即可)**:
1. **多视角取舍**:方案不止一条路,且各有利弊需要论证(架构选型/机制设计/流程决策);
2. **影响面大或返工代价高**:做错了要动筋骨(跨模块/跨会话/数据格式/权限),早期纠错远便宜于后期返工(IPD 早期投入逻辑);
3. **需要留证据链**:结论要经得起他人复审(要给用户/团队拍板的方案、对外反馈、规范制定);
4. **单人/单会话已明显卡住**:自查多轮仍无把握,或历史上同类问题多次返工。
**不适用(不要开团)**:
- 单点修改、事实查证、一次性能答的问题——直接做或单会话讨论;
- 已有垂直流程的场景:issue 走 gh-issue-submit、调研走 research 系、规划走 plan/blueprint——本技能是其上的**元流程**,不替代;
- 只想「多几个人看看」——没有结构化分歧与独立复查的多会话讨论=假共识放大器(实证:naive 评审协作劣于单人),**要么走本流程,要么单干,不要中间态**。
一次运行 = 完整的「提案 → 争论 → 修订 → 评审 → 复查 → 汇报」。
## 分级模式(S/M/L——0928 拍板增强):按任务难度自动匹配评审强度
**L 档 = 下文「角色 / 流程八步 / 通道与降级 / 硬规则 / S8 汇报模板」原文(已验证基线,冻结不动);S/M 是 L 的减法配置。**
### 定级(S1 定界时同时定级;定级理由留痕入 S8;用户覆盖 > 自动)
| 档 | 定级判据 | 配置(相对 L 的减法) |
|---|---|---|
| **S 轻量**(轻量迭代) | 单案、已有提案(如 tasklist 的初步实现路径)、四判据命中 0-1 | 编制=lead+**外部评审×1**(2 单元);跳双提案(输入即提案);S6 轮次 ≤2;**S7 无**;S8 轻量 4 字段(结论/校验/成本/路径) |
| **M 标准**(**批量默认档**) | 批量任务提案评审;四判据命中 0-1 但需多视角 | 编制=+评审×2(3 单元);跳双提案;S6 轮次 ≤3;**S7 单轮**;S8 全 8 字段 |
| **L 重** | **四判据命中 ≥2**,或涉跨机制/不可逆/用户已拍板框架的修改 | =原文八步(7 单元、双提案、S7 双轮、APPROVE) |
### 动态升档触发器(防降级滥用——省钱只在「真没问题」时成立)
- **S 档出存活 major → 自动升 M**(补第 2 评审、计数重置);
- **M 档出 ⚠️ 或 2 轮不收敛 → 自动升 L**(补双提案+双复查);
- **强制升档白名单**:动共享组件/铁律 → 无条件 M/L,不看判据。
### 不可剪清单(三档通用底线)
结构化分歧(禁裸同意)/ major·minor·⚠️ 三级定义 / 失败记录(此路不通)/ 成本账三字段 / **作者不审自己(三档都必须 ≥1 外部评审;自评模式明确否决)** / 现实校验必答(S 档可不设反例工程师角色,但校验问题必答)。
### 批量形态(一次评审多个任务的提案)
批级 S1 定界(共同判据+预算)→ **逐案隔离循环**(S6 计数按案独立;**单案升 L 只深挖该案例外,不整体升档**)→ 批级 S8 汇总。**批上限 = 一次批量最多带 5 个任务**——超限分批跑(批内案件越多,定界概括与上下文质量越稀释,分批不硬塞)。
### 分档成本闸
S=1× / M=2× / L=3×(超该档预算即报警停报用户,不自动砍)。
## 角色(≤7 含 lead)
| 角色 | 载体 | 职责 |
|---|---|---|
| **lead(主持人)** | 触发本技能的会话本身 | 写苛刻清单+预算声明、组团分配任务、汇总修订、送审、汇报 |
| 提案者 A/B | **子会话 ×2,必须配不同模型**(`create_collab_session` 的 `sessions[i].model`,provider/model 完整 ref) | 各出独立初稿(互不可见) |
| 挑战者 | 子会话 | S3 后对 A/B 初稿各出挑刺清单;S5 对合并稿再挑;S6 起内部预审 |
| 反例工程师 | 子会话 | 现实校验闸:形式通过 ≠ 通过——实测数据/强推理依据,可标 ⚠️ 阻塞级 |
| 评审者×2 | **编制预留位**:S2 只登记不创建,**复查启动时才实例化为两个全新子会话** | 闭环后独立复查(依据隔离,见 S7) |
**身份卡(`templates/`,派活必发路径——主对话只发一行卡路径,子会话开工首步自读;不发裸任务让子会话猜角色)**:
| 角色 | 身份卡 | 实例化时机 |
|---|---|---|
| lead | `templates/role-lead.md` | 触发本技能的会话自身(S1 前自检通读) |
| 提案者 A/B | `templates/role-proposer.md` | S2 组团,`create_collab_session` 不同模型 ×2 |
| 挑战者 | `templates/role-challenger.md` | S2 组团 |
| 反例工程师 | `templates/role-counterexample.md` | S2 组团(S4 起在岗) |
| 评审者甲/乙 | `templates/role-reviewer.md` | **S7 复查启动时**实例化 ×2(S2 只登记) |
- **硬规则**:创建/派活任何角色子会话,派活消息**只发对应卡的文件路径(一行,主对话输出最省、无歧义)** + 当轮材料指针,并明确要求「开工第一步 read 此卡」;卡内回报格式为该角色强制输出契约。**回退**:子会话无文件读取能力时才整段粘贴卡全文。
- 卡与本文件分工:卡=角色行为契约(子会话视角,含依据隔离/豁免边界);本文件=流程与裁决规则(主持人视角)。**两处冲突以本文件流程节为准,卡需同步更新**。
- **载体判据**:核心角色用子会话(可寻址、可换模型、留痕可审计);辅助性一次性只读产出(反例清单草稿等)才用子代理(批 3-4 派发防 429)。
- 角色准入:新角色必须能回答「砍掉它会丢哪个已论证功能」——禁仪式性加角。
## 流程八步
| 步 | 动作 |
|---|---|
| S1 问题定界 | lead 写**苛刻 prompt 清单**(硬验收条件 + 「有效」判据必含现实校验面 + 失败必须记录)+ **预算声明**(基准 token 估算、轮次顶) |
| S2 组团 | 按上表建角色;**通道探测**:群聊通道可用则用之,否则直接走降级(见下) |
| S3 独立初稿 | 提案者 A/B **并行、互不可见**(不互读产出、不互发消息——防锚定/回声室) |
| S4 共享争论面 | 看板 `tasks/expert-panel-<id>/`(两层:**关键结论/分歧上行区** + 全量争论原文归档区);跨会话消息互评只用**通信类工具**(`talk_to_session`/`task_card`/看板文件;`create_collab_session`/`task` 属组建面,S2 用,不在互评轮使用);**反例工程师 S4 起在岗**;每轮互评结束做 per-recipient 送达登记(降级时) |
| S5 汇总初稿 | lead 合并 A/B → 初稿 v1,显式记录分歧与少数意见;**先过现实校验预检**——预检不过=阻塞送审,反例工程师要求 lead 改后重检;仍不过→带 ⚠️ 上升用户 |
| S6 与评审方多轮互评 | 每轮:评审方挑刺 → lead 修订 → 再送审。**停止判据 = 连续 2 轮存活 major 计数为 0(含上轮遗留)且零 ⚠️**:卡停止的只有存活 major(含⚠️),minor 只记录不卡;「存活」=lead 裁定满足/驳回有据的不计,**驳回必须写入看板留痕,被驳回方可下轮申诉一次**(申诉成立即计存活、计数归零;每条限一次);**轮次顶 ≤5**,不收敛=截断成 finding 清单交用户 |
| S7 闭环后强制 ≥2 轮独立复查 | **依据隔离**:复查甲乙=两个全新子会话(未参与本流程者),只拿【S1 苛刻清单 + 冻结版】,**不读争论记录**;互不知晓、并行发出;**prompt 不得出现评审方及其立场**(防反向锚定);提案者与 S6 主辩者不任复查者。**冻结 = 复制文件**(`expert-panel-frozen-v<N>.md`)+ 记录内容指纹(sha256 前 16 位)入看板。反例工程师强制给现实校验意见,与甲乙并列但不计入两轮独立评审(其 S4 起在岗已非独立方) |
| S8 汇报 + APPROVE 闭环 | 汇报后流程状态=**等待用户 APPROVE;APPROVE=完成**;未批准=按用户批示回炉(未指明默认回 S5 修订后重走 S6→S7→S8,**重走 S7 时复查甲乙换新实例**(原甲乙已读修订前争论与立场,不复用;编制预留位机制照常);⚠️ 未解项随批示上升) |
**S7 若出 major 的处置**:需求级(质疑用户拍板本身)→ 不改稿,进 S8「分歧残留=用户拍板点」交用户裁;方案级结构 → lead 修订 + 甲乙对修订 **diff 增量确认**(只查变更处,不整版重查、不重开 S6;修订版另打冻结标记)。
## 通道与降级(群聊未就绪时)
- **探测**:S2 时检查群聊通道是否可用(功能已安装且工具可调),否则直接降级;每轮 S4 开头复查一次(中途就绪可升回)。
- **降级 = 主持人转发**:成员 → 主持人 → 转发给其他成员(模拟广播);per-recipient 送达/已读由主持人在看板登记。**回信必须显式 `to=主持人 contactId`**——20260929 降级演练实测:只靠 thread 路由时回执落在 thread 归属方(create 首信归属在派活方线程名下)而非主持人;主持人转发信的 thread 若不在自己 mailbox(如 create 首信),省略 `thread_id` 开新链即可。送达/已读判据=收件方 `<contactId>.inbox.jsonl` / `.seen.json` 含 messageId(实测有效)。
- **同构字段**(降级与严格路径产出同一批字段名,仅存储介质不同):消息 id/摘要 · 发送方 · 逐收件方 delivered 时间戳 · read 时间戳。
- **主持人离线兜底**:成员可直接写看板(异步)。
- 首次实战注意:per-recipient 人工登记在高消息量下的可靠性需实测——**登记遗漏率记入当次汇报的现实校验栏**。
## 硬规则(防回声室 / 防假闭环)
1. **独立初稿隔离**:提案者互不可见。
2. **失败记录强制**:每角色维护「此路不通」清单,后入者不得重踩。
3. **现实校验闸**:反例工程师 S4 在岗 → S5 预检 → 复查强制意见;⚠️=实证不过、lead 不可驳回(证据级要求:实测数据或强推理依据);**闸未过不许宣布成功**。
4. **成本闸**:角色 ≤7 硬顶 + 角色准入判据 + token 超基准 **3× 预警**(S1 声明的锚进看板公开面可被提一次异议;**每轮结束 lead 读一次 token 数记成本栏**);**闸=报警停报用户,不自动砍**;成本账三字段(角色/轮次/token)每战必记。
5. **停止判据显式**:见 S6/S7。
6. **结构化分歧(禁裸同意)**:每轮评审意见必带「分歧/证据/依据」三要素;**零新发现时须逐项列出已审项确认**(「无新发现」+清单),空泛同意禁止(防滑向硬造分歧或变相裸同意两极)。
## S8 汇报模板(8 必含字段)
1. 结论一句话;
2. ⚠️ 阻塞意见与现实校验结果;
3. 分歧残留(=用户拍板点);
4. 失败记录摘要(此路不通);
5. 复查(两轮)结论;
6. 成本账(角色/轮次/token 三字段);
7. 与 S1 预判的偏差(讨论改变了什么);
8. 看板与文档路径(审计跳转)。
尾项**沉淀**:可复用结论回写记忆或报告指针(否则流程结束知识流失)。
## 出处注记(一次读完即可)
- 「两次独立同行评审」「记录所有失败」源自 Vals AI 10-agent 攻 Dijkstra 案例的苛刻 prompt 设计;该案例同时是**反转教训**——形式化证明一次过、工程实测反慢 1.4-2.8×(常数爆炸),故本流程设现实校验闸(「形式闭环 ≠ 现实有效」)。
- 「连续两轮零发现即停」骨架参考多 agent 评审研究的 two-dry-rounds 停止判据(上限 5、未收敛截断上报);「结构化分歧优于裸共识」与「少而精优于人海」有实证支持(结构化 3-agent 优于 5-agent 基线)。
---
**修订记录**:2026-09-28 初版(L 完整八步,源自首轮专家团实战闭环)→ 2026-09-28 增强拍板(S/M/L 分级+动态升档触发器+批量形态+批上限 5;**L 原文冻结**;改名 `ll-iteration-expert-panel` → `ll-iteration-review`——用户要求命名体现方案评审/检查语义,原名保留为触发词;业界先例依据=分级评审调研 20260928)。
Files in this skill
- SKILL.md
- templates/role-challenger.md
- templates/role-counterexample.md
- templates/role-lead.md
- templates/role-proposer.md
- templates/role-reviewer.md
Attribution
Comments
Loading comments…