PJC 使用指南
文档状态:Research Preview v0.6
用途:帮助个人或团队运行一个完整的前瞻判断校准周期。
不构成:绩效考核制度、自动决策系统或有效性证明。
1. 先判断任务是否适合
PJC 适合同时满足以下条件的任务:
- 判断在结果揭晓之前形成;
- 结果会在一个可接受的时间窗口内出现;
- 可以预先指定结果来源;
- 相似判断会重复发生,允许跨周期校准。
如果结果无法观察、标准只能事后定义,或记录会被直接用于惩罚个人,不应使用 PJC。
2. 写出可结算的判断
一条判断应当是将来可以被结果支持、反驳或判为不可判定的命题。
弱判断:“这个方案应该不错。”
可结算判断:“在 2026-09-30 前,新引导流程会使首次成功创建画布的用户比例达到 45% 以上;数据源为生产环境事件统计。”
判断中至少需要包含:
- 命题;
- 观察窗口;
- 结果来源;
- 判定阈值。
3. 完成前瞻记录
在结果揭晓前填写:
- 判断主体和时间;
- 判断命题;
- 置信程度;
- 主要依据;
- 至少一个替代解释;
- 观察窗口与结果来源;
- 反证条件;
- 停止条件。
置信程度表达“这条命题成立的主观概率”,不是完成任务的信心,也不是对个人能力的评分。
4. 提交并冻结
记录进入 Committed 状态后:
- 原字段不可覆盖;
- 新信息只能以追加说明的方式加入;
- 追加内容必须保留作者和时间;
- 不得使用结果出现后的信息解释原始判断。
如果提交时结果已经部分泄露,记录应标为 Invalidated,不进入校准统计。
5. 执行与等待
PJC 不规定具体执行方法。Agent 可以参与研究、实现和检查,但原始判断必须归属于明确的人类判断主体。
等待期间可以追加:
- 新证据;
- 环境变化;
- 执行偏差;
- 对观察窗口的外部影响。
追加说明不能修改原命题、置信程度或结算标准。
6. 进行结果结算
观察窗口结束后,根据预先指定的来源选择一种状态:
| 状态 | 含义 |
|---|---|
| Supported | 结果支持原判断 |
| Contradicted | 结果反驳原判断 |
| Inconclusive | 信息不足,无法判定 |
| Invalidated | 记录受到泄露、规则变化或数据失效影响 |
结算时同时记录:
- 实际结果;
- 结果证据;
- 与阈值的比较;
- 不可判定或失效原因;
- 下一周期需要调整的内容。
7. 做时间校准
单条记录只能说明一次判断发生了什么。至少积累一组相似判断后,再检查:
- 70% 置信区间内的判断实际成立比例;
- 哪类依据反复失效;
- 哪些任务频繁不可判定;
- 是否总在高负荷阶段过度自信;
- Agent 参与是否改变了判断质量,而不只是产出速度。
v0.6 不规定统一评分公式。不同任务的可比性尚未建立前,不应把所有记录压缩成一个总分。
8. 常见失效模式
结果后补写
如果结果已经可知,记录不再具有前瞻性。应标为失效,而不是补齐一条“看起来完整”的记录。
模糊结果标准
“用户喜欢”“质量更高”无法稳定结算。应提前指定数据、观察者或评审协议。
把完成当作正确
Agent 完成动作不等于判断成立。结算对象是原命题,不是任务清单。
只保留成功记录
选择性保留会破坏校准。所有已提交记录都应进入历史,包括失败和不可判定。
让 Agent 代写判断
Agent 可以帮助整理依据,但判断主体必须确认命题、置信程度和反证条件,并承担提交动作。
用于绩效惩罚
一旦记录直接决定奖惩,参与者会优化记录而不是校准判断。PJC 默认用于学习和方法审查。
9. 最小启动方式
第一次使用时:
- 选择一种重复发生的低风险判断;
- 连续记录 10 条以上;
- 不设置复杂评分;
- 检查不可结算率和字段完成率;
- 修订命题与结果来源;
- 再决定是否扩大范围。
PJC 的第一项验证不是“是否提高正确率”,而是“是否能诚实、稳定地形成可结算记录”。