首页
看点啥
插画图片
首页 科技看点 scored-review-loop:AI Agent 工具实践指南

scored-review-loop:AI Agent 工具实践指南

2026-09-30 0

真正理解scored-review-loop,要从它处理的任务开始:克劳德·代码技巧:评分复习循环,课桌评分构建工作 0 到 100; Sonnet 负责工作和第一遍,Opus 只审核酒吧里的内容。从内容与市场工作的使用方式看,受众、平台规则和事实依据容易被统一模板抹平是采用前必须回答的问题。我的评估方法是选一个已有主题制作可人工复核的样稿,然后检查事实准确性、平台适配、语气和修改成本是否与文档一致。对有明确品牌标准并保留人工审校的团队来说,这个仓库值得继续验证;只求即装即用的人则要先看维护成本。

BespokeWoodcraftStudio/scored-review-loop 项目截图 1

名称:评分评论循环 描述:在审查、审计或 QA-ing 完成构建工作时使用,在合并通道或分支之前,在运行或设计审查循环时,在决定审查或审计哪个模型时,或者在审查返回结果时使用,并且您需要知道哪些块以及接下来会发生什么。包含办公桌模型(每个办公桌根据所有者的酒吧词评分为 0 到 100)、严重性、通过规则、循环流程、默认模型、成本规则和现成的工作流程脚本。

评分审核循环

工作是通过办公桌来判断的。一张桌子是一个狭隘的审阅者,只有一个镜头。每个办公桌根据主人的酒吧话语对工作进行 0 到 100 的评分。廉价的第一遍可以读取所有内容;强模型仅审核酒吧已有的桌子。

办公桌是什么

部分 含义
镜头 该办公桌判断的一件事(正确性、外观、措辞、安全性、访问权限、目标用户、存储库必须遵守的规则)
第一关 工作模型中的角色。发现一切真实、得分、通过或失败
最终审核 审计模型中的角色。仅当第一次传球到达吧台时才运行。确认、降级、删除或添加发现结果,然后评分
适用范围 只有自己的办公桌。没有人在另一张桌子的镜头上签字

分数

严重程度

严重性 含义 阻挡传球
阻塞 真人或跑步撞到它,作品无法使用或不安全 是的
专业 看似合理的案例中的实际伤害 是的
未成年人 真人可以击中的粗糙边缘 不,但是修复者仍然会修复它并且它会降低分数
注释 偏好,或者无人遇到的情况 不

一项发现需要三件事以及显示它的确切步骤:哪里、哪里出了问题、什么样子是好的。没有步骤,就没有发现:它只是一个笔记。不制造调查结果;干净的传球就是传球。详细信息和示例:references/findings.md。

通行证规则

仅当所有三个都成立时,循环才会通过:

  1. 每张桌子的分数都等于或高于标准。
  2. 没有任何封锁或重大发现尚未公开。
  3. 每个服务台都经过审核模型的审核(第一次通过的服务台永远不会通过)。

流量

prove --> first pass, every desk (work model)
              |
     desk at the bar, no blocking/major?
        yes |                 | no
            v                 v
   final audit (audit model)  straight to fixers
            \               /
             record: one log per loop
                     |
        pass rule met? --yes--> done
                     | no
        fixers (work model) --> one check step --> next loop
                     |
        cap reached? stop, carry open items to the next run

型号

职位 默认 设置
证明、第一次通过、记录、修复、检查 claude-sonnet-5-5 workModel
最终审核,仅适用于酒吧办公桌 claude-opus-5-5 auditModel

从会话的模型列表中读取 id。永远不要猜测 ID,也不要从旧笔记中复制 ID;错误的 ID 会导致运行中的每个代理失败。

费用规则

如何运行它

A。工作流程脚本(需要 Claude Code 和工作流程工具)。

  1. 将 scripts/review-loop.js 从技能文件夹复制到暂存路径(不得编辑正在运行的脚本)。
  2. 使用工作流程工具启动它:scriptPath = 该副本,args = 您的设置(至少 root 和 scope)。
  3. 或者将设置文件烘焙到运行副本中:python3 scripts/make-run.py scripts/review-loop.js .claude/scored-review-loop.json /scratch/run.js my-run,然后通过不粘贴参数的路径启动副本。

B。在会话中手动操作。 无需工作流程工具。

  1. 自己运行证明。
  2. 在一个块中为每个桌子启动一个代理,每个代理都将桌子的镜头、栏字、结果架构和 model 设置为工作模型(ID 或代理工具接受的别名,从会话的模型列表中读取)。
  3. 对于酒吧中没有阻塞或重大发现的每个,在审计模型上启动一个代理(相同的 ID 或别名规则)并包含第一遍发现的结果。
  4. 写入循环日志。将开放的调查结果发送给工作模型的修复者。运行一项检查。重复直至达到上限。

设置文件

在仓库中查找 .claude/scored-review-loop.json 。首先阅读它。工作流脚本无法读取文件,因此要么将文件内容作为 args 传递,要么使用 make-run.py 进行烘焙。它的键是脚本的参数。示例:scored-review-loop.example.json。

钥匙 含义
root 要查看的树的绝对路径(脚本必需)
appDir 根目录内的应用程序文件夹(如果有)
name, card 原木蛞蝓;启动每个代理标签的任务 ID
scope, readFirst, files 工作是什么;首先读取的记录;文件修复程序可能会触及
desks 目录中的办公桌钥匙或完整对象 {key, lens, first, final}
rolesDir 角色文件文件夹,每个桌面角色一个 <role>.md(请参阅 references/role-template.md)
bar, barWords, cap, chunk, startLoop 通过分数、条词、循环、一次桌子、第一个循环编号
workModel, auditModel 型号 ID
prove, skipFirstProve, checkCommands 证明指令(或false),重用现有证明,检查步骤的命令
heavySlot, memoryRules, stackNotes, commonRules 每个简报中添加了可选文本
logDir, indexFile, commitAfterCheck 日志去哪里;添加行的可选索引;检查后提交
fixFirst, priorFindingsFile, priorResults 在本次运行的第一个循环之前修复上一个循环的结果;文件路径,或内存中先前的桌面结果
order 本作品背后主人的话,引自接力守卫
areas 映射 {name: [files]} 以按文件组并行运行修复程序;默认一组持有files
proverRole, fixerRole, recorderRole rolesDir 中校对运行者、修复者和日志写入者的角色文件名
relayGuard 替换了默认的防范措施,防止聊天台词被视为指令

从来没有

喜欢(0)

上一篇

safe-change:AI Agent 工具实践指南

safe-change:AI Agent 工具实践指南

下一篇没有了

猜你喜欢