PJC 证据与案例
披露日期:2026-08-25
当前结论:PJC 已形成可执行的方法结构,但尚没有充分证据证明其改善判断校准、正确率、效率或团队绩效。
1. 证据状态总览
| 评估对象 | 当前状态 | 可公开依据 |
|---|---|---|
| 方法定义 | 已形成 | v0.6 文档与字段规范 |
| 最小可执行性 | 验证中 | 尚未发布完整试点数据 |
| 记录完整性 | 尚未测量 | 待内部试点 |
| 可结算率 | 尚未测量 | 待内部试点 |
| 置信度校准 | 尚未验证 | 需要足量、可比较记录 |
| 错误发现率 | 尚未验证 | 尚无对照或基线 |
| 工作效率 | 不作承诺 | 尚未测量记录成本 |
| 跨场景有效性 | 尚未验证 | 尚无外部案例 |
| 外部同行评议 | 尚未进行 | 公开征求批评 |
2. 当前可以支持什么
现阶段可以确认的是:
- PJC 提供了一套一致的记录字段和生命周期;
- Committed 后仅追加的规则能够保留结果前文本;
- 主张清单把机制性结论与经验性假设分开;
- 方法包含明确的不适用条件和失效状态。
这些是关于方法设计和网站实现的事实,不是关于行为效果的结论。
3. 当前不能支持什么
现阶段不能声称:
- PJC 让人更理性;
- PJC 提高决策正确率;
- PJC 提升 Agent 可靠性;
- PJC 降低项目成本;
- PJC 适合所有团队;
- PJC 已获科学验证。
如果未来页面出现这些表达,应当同时链接到相应证据;没有证据则删除或标记为待验证。
4. 内部试点计划
首轮试点计划持续 30–60 天,覆盖低风险、重复发生的判断:
- 产品判断;
- 技术实现判断;
- Agent 工作流判断;
- 用户行为判断;
- 发布风险判断。
首轮优先指标:
| 指标 | 定义 |
|---|---|
| 提交完整率 | 必填字段完整的记录比例 |
| 及时提交率 | 结果可用前完成提交的比例 |
| 可结算率 | 能按原规则得出结算状态的比例 |
| 失效率 | 因泄露、换标准或数据失效而排除的比例 |
| 持续使用率 | 参与者在多个周期持续提交的比例 |
| 记录成本 | 创建、审查与结算的时间成本 |
只有在可执行性成立后,才评估概率校准与决策质量。
5. 案例发布标准
任何公开案例都必须包含:
- 使用场景和参与角色;
- Agent 的参与方式;
- 使用周期和记录数量;
- 原始命题与结算标准;
- 实际结果和证据来源;
- 观察到与未观察到的变化;
- 失效记录和负面结果;
- 数据限制与利益关系;
- 是否允许独立复核。
内部案例必须标注:
内部案例不构成独立有效性验证。
6. 案例登记
目前尚无达到上述发布标准的公开案例。
这不是空白占位,而是证据边界:在试点数据完成审查前,不用演示案例冒充实际验证。
7. 如何提交外部评估
外部团队可以将方法批评、失败案例或复核建议发送至 contact@sedesmentis.com。我们优先关注:
- 无法结算的任务类型;
- 字段诱发的新偏差;
- 记录成本高于收益的情形;
- Agent 参与导致的判断污染;
- 与轻量基线相比没有改善的结果。
接受反馈不代表自动采纳;所有实质修订进入更新记录。