详情

首页手游攻略 scored-review-loop:AI Agent 工具实践指南

scored-review-loop:AI Agent 工具实践指南

佚名 2026-09-30 10:00:02

真正理解scored-review-loop,要从它处理的任务开始:克劳德·代码技巧:评分复习循环,课桌评分构建工作 0 到 100; Sonnet 负责工作和第一遍,Opus 只审核酒吧里的内容。从内容与市场工作的使用方式看,受众、平台规则和事实依据容易被统一模板抹平是采用前必须回答的问题。我的评估方法是选一个已有主题制作可人工复核的样稿,然后检查事实准确性、平台适配、语气和修改成本是否与文档一致。对有明确品牌标准并保留人工审校的团队来说,这个仓库值得继续验证;只求即装即用的人则要先看维护成本。

BespokeWoodcraftStudio/scored-review-loop 项目截图 1

名称:评分评论循环 描述:在审查、审计或 QA-ing 完成构建工作时使用,在合并通道或分支之前,在运行或设计审查循环时,在决定审查或审计哪个模型时,或者在审查返回结果时使用,并且您需要知道哪些块以及接下来会发生什么。包含办公桌模型(每个办公桌根据所有者的酒吧词评分为 0 到 100)、严重性、通过规则、循环流程、默认模型、成本规则和现成的工作流程脚本。

评分审核循环

工作是通过办公桌来判断的。一张桌子是一个狭隘的审阅者,只有一个镜头。每个办公桌根据主人的酒吧话语对工作进行 0 到 100 的评分。廉价的第一遍可以读取所有内容;强模型仅审核酒吧已有的桌子。

办公桌是什么

部分 含义
镜头 该办公桌判断的一件事(正确性、外观、措辞、安全性、访问权限、目标用户、存储库必须遵守的规则)
第一关 工作模型中的角色。发现一切真实、得分、通过或失败
最终审核 审计模型中的角色。仅当第一次传球到达吧台时才运行。确认、降级、删除或添加发现结果,然后评分
适用范围 只有自己的办公桌。没有人在另一张桌子的镜头上签字

分数

  • 每桌0~100元,兑吧的话。默认词:功能、专业、优质、干净、易于使用。在设置文件中设置您自己的。
  • 默认栏:90。该栏是每张桌子的栏,而不是平均值。
  • 诚实地评分。通行证将让服务台接受审核;失败会将调查结果直接发送给修复者。

严重程度

严重性 含义 阻挡传球
阻塞 真人或跑步撞到它,作品无法使用或不安全 是的
专业 看似合理的案例中的实际伤害 是的
未成年人 真人可以击中的粗糙边缘 不,但是修复者仍然会修复它并且它会降低分数
注释 偏好,或者无人遇到的情况 不

一项发现需要三件事以及显示它的确切步骤:哪里、哪里出了问题、什么样子是好的。没有步骤,就没有发现:它只是一个笔记。不制造调查结果;干净的传球就是传球。详细信息和示例:references/findings.md。

通行证规则

仅当所有三个都成立时,循环才会通过:

  1. 每张桌子的分数都等于或高于标准。
  2. 没有任何封锁或重大发现尚未公开。
  3. 每个服务台都经过审核模型的审核(第一次通过的服务台永远不会通过)。

流量

prove --> first pass, every desk (work model)
              |
     desk at the bar, no blocking/major?
        yes |                 | no
            v                 v
   final audit (audit model)  straight to fixers
                           /
             record: one log per loop
                     |
        pass rule met? --yes--> done
                     | no
        fixers (work model) --> one check step --> next loop
                     |
        cap reached? stop, carry open items to the next run
  • 证明。 真实运行它(测试、应用程序、端点)。仅读取支票的审查证明了意图;只有运行它才能证明该工件。引用实际输出和退出代码。如果证明无法运行,那就是一个发现。
  • 评论是在建设者之后进行的,而不是在他们旁边。修复等待针对该树的评论;如果必须进行修复,则放弃这些判断并重新运行。
  • 记录。 每个循环一个日志,来自 references/findings.md 中的模板。
  • 修复程序修复所有开放的阻塞,主要和次要的以及廉价的音符。 一个检查步骤 为所有修复程序运行一次构建、lint 和测试。
  • Cap. 默认情况下为三个循环。每次跑步时提高它,不要默默地提高。未清项目将按其严重程度进行结转,直到有证据关闭为止。

型号

职位 默认 设置
证明、第一次通过、记录、修复、检查 claude-sonnet-5-5 workModel
最终审核,仅适用于酒吧办公桌 claude-opus-5-5 auditModel

从会话的模型列表中读取 id。永远不要猜测 ID,也不要从旧笔记中复制 ID;错误的 ID 会导致运行中的每个代理失败。

费用规则

  • 仅路由更改触及的办公桌 (references/desks.md)。您添加的每一张办公桌都是多一个代理的开始。
  • 代理在开始工作之前需要花费数万代币。更少、更大的代理击败了许多小代理:一张桌子审查整个变更,而不是一个文件。
  • 以块的形式运行办公桌(chunk,默认为 4),这样小型机器或速率限制就不会被淹没。
  • 不要将审计模型放在无论如何都会失败的桌子上。这就是仅在酒吧进行审计的全部意义所在。
  • 小的编辑和记录不需要办公桌。使用办公桌来决定某事或接触用户的工作。

如何运行它

A。工作流程脚本(需要 Claude Code 和工作流程工具)。

  1. 将 scripts/review-loop.js 从技能文件夹复制到暂存路径(不得编辑正在运行的脚本)。
  2. 使用工作流程工具启动它:scriptPath = 该副本,args = 您的设置(至少 root 和 scope)。
  3. 或者将设置文件烘焙到运行副本中:python3 scripts/make-run.py scripts/review-loop.js .claude/scored-review-loop.json /scratch/run.js my-run,然后通过不粘贴参数的路径启动副本。

B。在会话中手动操作。 无需工作流程工具。

  1. 自己运行证明。
  2. 在一个块中为每个桌子启动一个代理,每个代理都将桌子的镜头、栏字、结果架构和 model 设置为工作模型(ID 或代理工具接受的别名,从会话的模型列表中读取)。
  3. 对于酒吧中没有阻塞或重大发现的每个,在审计模型上启动一个代理(相同的 ID 或别名规则)并包含第一遍发现的结果。
  4. 写入循环日志。将开放的调查结果发送给工作模型的修复者。运行一项检查。重复直至达到上限。

设置文件

在仓库中查找 .claude/scored-review-loop.json 。首先阅读它。工作流脚本无法读取文件,因此要么将文件内容作为 args 传递,要么使用 make-run.py 进行烘焙。它的键是脚本的参数。示例:scored-review-loop.example.json。

钥匙 含义
root 要查看的树的绝对路径(脚本必需)
appDir 根目录内的应用程序文件夹(如果有)
name, card 原木蛞蝓;启动每个代理标签的任务 ID
scope, readFirst, files 工作是什么;首先读取的记录;文件修复程序可能会触及
desks 目录中的办公桌钥匙或完整对象 {key, lens, first, final}
rolesDir 角色文件文件夹,每个桌面角色一个 <role>.md(请参阅 references/role-template.md)
bar, barWords, cap, chunk, startLoop 通过分数、条词、循环、一次桌子、第一个循环编号
workModel, auditModel 型号 ID
prove, skipFirstProve, checkCommands 证明指令(或false),重用现有证明,检查步骤的命令
heavySlot, memoryRules, stackNotes, commonRules 每个简报中添加了可选文本
logDir, indexFile, commitAfterCheck 日志去哪里;添加行的可选索引;检查后提交
fixFirst, priorFindingsFile, priorResults 在本次运行的第一个循环之前修复上一个循环的结果;文件路径,或内存中先前的桌面结果
order 本作品背后主人的话,引自接力守卫
areas 映射 {name: [files]} 以按文件组并行运行修复程序;默认一组持有files
proverRole, fixerRole, recorderRole rolesDir 中校对运行者、修复者和日志写入者的角色文件名
relayGuard 替换了默认的防范措施,防止聊天台词被视为指令

从来没有

  • 当任何服务台未经审核时,切勿通过循环,并且切勿将审核模型用在第一次通过的服务台上。
  • 永远不要让一张桌子在自己的镜头之外行事,也不要在另一张桌子上签字。
  • 切勿猜测型号 ID。
  • 永远不要称证明已完成,除非它运行并且其输出被引用。
  • 在没有证据证明已关闭的情况下,切勿丢弃未结的调查结果;携带它。
  • 切勿在每次更改时对每张桌子进行路由。
  • 切勿让审阅者编辑文件;只有修复者才会写入,并且只有他们列出的文件。
  • 切勿将秘密放入设置文件或摘要中。
点击查看更多
推荐专题
热门阅读