METHOD / 阅读与判断
工作判断蒸馏
我从一个人反复修改、拒绝和选择里,找他的稳定判断,再拿没见过的新问题去试,看它会不会走样。
什么时候用
手里有会议记录、修改痕迹、初稿终稿和操作日志,想从里面提炼出个人或团队的判断时用。
我会把关什么
一次修改不能当成性格规律;话说得像不代表判断像;推断就得一直标着是推断。拆的时候按人、任务、目标、受众、角色、阶段、环境一起看,两条看着打架的规则,先查情境再判对错。
已经留下什么
一份来源清单、一本四色证据账本(STATED / OBSERVED / INFERRED / UNKNOWN)、判断模型、情境路由、改稿差异对比脚本,还有五种留出来盲测的题:决策一致性、修改预测、情境切换、反表面模仿、未知处理。
THE MAKING OF
把反复改过的地方,留下来。
我想留下的是工作里反复改动的那些地方,还有每次为什么这么改。成稿会被保存,讨论和取舍却常常散在别处。2026-08-02 我把它写成带脚本、证据账本和评测协议的正式方法。
01 先定义分析单位
我先把分析单位定成人×任务×目标×受众×角色×阶段×环境。同一个人在不同任务里会调用不同判断,所以先路由场景、再套规则;那些看似冲突的规则,多半只是情境不同,不是谁错了。
02 证据分四色记账
STATED 是本人明说,OBSERVED 从修改中直接观察到,INFERRED 是模型解释未确认,UNKNOWN 保持未知。单次修改只能生成待验证假设,不许直接升格成稳定规则;语言像不等于判断像,先验证选择和修改,再看措辞。
03 文本对比先跑脚本再解释
compare_revisions.py 先做确定性差异,人再看差异背后的理由;校准时不逐条审账本,只集中问几个最值的问题:这次修改是长期偏好,还是项目限制?
04 五种盲测守门
五场盲测分别是决策一致性、修改预测、情境切换、反表面模仿(语言很像但判断错了,它敢不敢拒绝)、未知处理(证据不足时它能不能不编造)。评测我用没参与蒸馏的留出案例,答案不泄露给执行测试的模型。
来源与使用边界
公开人物的材料只能证明公开样本那部分;私人材料要另外授权;做不了独立盲测的时候就只能人工审计,这一点我得明说。
distill-working-judgment SKILL.md
依据 2026-08-02 的方法文件整理。边界同样成文:只提取职业判断,不推断人格、心理与健康状况,不公开原始会议或内部审稿材料,也不虚构盲测成绩。
KEEP EXPLORING
