Rubric 及其评分维度、版本与使用记录。
这一页讲的是使用 rubric。要写好一份——维度、权重、版本管理——
见编写 rubric。
作为训练 reward
把它声明成某个环境的 verifier:manifest.json
FORGE_JUDGE_ENABLED——是它把裁判端点和 token 注入作业的。
作为评测基准
在 benchmark 包里用judge runner 声明它:
benchmark.yaml
作为安全评测
safety runner 用一份 rubric 判定模型该拒的有没有拒。
suite 说哪些 prompt 应当被拒绝,rubric 说什么算拒绝。两者都属于你的部署——
平台哪一个都不提供,因为提供任何一个都等于它替别人下了一个它没资格下的结论。
让训练和评测保持诚实
诱惑在于:用一份 rubric 训练,用另一份稍有不同的 rubric 评测—— 通常是因为有人在项目中途把训练那份磨精确了。不要这样做。 两边引用同一个<owner>/<name>,让版本机制承载这个变化:
编辑 rubric 会让版本号加一,并让裁判对它的分数缓存失效。
旧的 run 仍然指向它们当时真正用过的那个版本,而修订全文被保留,所以你还能读到那个版本当时写了什么。