附录:一份能够接续的概率记录
2026.09.13从一个实际问题开始使用
本附录是一组记录结构,不是已经填好的概率答案。使用时先选一个实际需要判断的问题,按相应关系保存;简单任务可简写,材料含混或评价复杂时再展开。
表中的字段说明用于组织读者自己的记录,不要求每一项都必须有数值。未取得、未采用和待核查,应如实保存,不为填满表格制造内容。模板空位与判断概率为零不是一回事。
澄湾全部数量和人物是虚构。案例索引用于核对本书连续性,不能成为读者真实任务的样本。公式只对满足相应条件的输入工作,不替输入取得真实性。
事件卡:先让结果能够裁决
| 关系 | 应保存的内容 | 重点检查 |
|---|---|---|
| 对象 | 请求或任务标识、具体条件版本 | 相同名称是否仍指同一内容 |
| 肯定事件 | 足以判成立的明确条件 | 是否把几个不同阶段混在一起 |
| 窗口 | 起点、截止、相关时间规则 | 后来核查是否被误当收到截止 |
| 材料位置 | 接受哪个来源或渠道作为依据 | 发出、到达、查看是否有区别 |
| 否定裁决 | 原窗口结束后怎样判断未成立 | 未看到是否真的有充分覆盖支持 |
| 未决状态 | 窗口未到、资料缺失或含混 | 是否提前填成未成立 |
| 关联对象 | 修改版或后续任务如何另存 | 是否覆盖了旧版本与旧结果 |
先试问另一位读者,拿到这些条件后能否用同一份材料作裁决。若仍会回答不同问题,补定义;若定义已经明确而材料不足,就保留材料缺口,不继续通过改宽事件来得到答案。
R17的肯定事件是原窗口收到对保存第一版范围、支付条件及接收时段的明确完整接受,窗口包含周五十七点这一边界时点。支付到账、修补完成与值得承接是别的对象,不能用它们的后来结果替代这张卡。
材料页:原件与用途分开
| 字段 | 使用说明 |
|---|---|
| 原件标识 | 使摘要能返回同一消息、表或文件 |
| 陈述主体 | 谁在说哪一方的条件或状态 |
| 对应对象 | 请求、版本、窗口与具体争点 |
| 原内容 | 保留影响用途的完整片段,不只留方向标签 |
| 取得时点 | 当前记录者何时实际获得与核清 |
| 来源关系 | 原件、转述、复读或独立新增 |
| 用途 | 支持哪项判断,不能支持哪项判断 |
| 质量状态 | 已核、含混、缺失、矛盾或需回查 |
一份材料可以支持一个较窄事实,又不足以支持更宽结论。主体直接不意味着用途无限,时点较新不意味着自动压过旧材料。争议先按主体、版本、时间和原话核查,再决定采用。
多人复读同一原件可以增加用途核查,但不增加原件数量。新原件也可能共享同一条件,不能只因条数增加就假定数学独立。
样本页:集合和分母有位置
记录进入范围、取得范围、适用范围及对应结果分类。若有展示材料或查找筛选,再说明它们怎样形成。不同范围可能重叠,数量不能不加辨认便相加。
| 范围 | 澄湾设定 | 当前限制 |
|---|---|---|
| 原历史登记 | R01至R16共十六项 | 不是十六份完整事前概率预测 |
| 成果展示 | 八张完成展示卡 | 不因数量相同就等于可比八项 |
| 原材料可取得 | R01至R12共十二项 | 与展示可能重叠,不合计二十项 |
| 原材料缺失 | R13至R16共四项 | 原因与结果未补齐,不填失败 |
| 当前比较范围 | R01至R08共八项 | 保留第一版、起点和窗口对应 |
| 其余可得四项 | R09至R12 | 阶段或窗口不同,不直接并入 |
适用排除应有对象或字段理由,不按结果是否有利决定。若后来补回材料,再注明取得与分类依据;新范围可以形成新表,旧表保持原位置。
历史可比八项中A五项、非A三项。非A包括两项窗口内未取得完整确认与一项提出修改,不能统称明确拒绝,也不替每个编号分配未给出的具体原因。
条件表:核对同一分类规则
| 历史编号 | 粗B | 原窗口A |
|---|---|---|
| R01、R02、R03 | 是 | 是 |
| R04 | 是 | 否 |
| R05、R06 | 否 | 是 |
| R07、R08 | 否 | 否 |
B指各自周四十点之后截至十一点二十分,约定渠道收到明确称清单收到的消息。八项均有足以分类B的材料,不把缺失误填为非B。
表中B组四项三次A,非B组四项两次A。它是描述性条件表,不自行证明要求回复导致确认。历史逐项A与B实际收到顺序、时间待定的完整字段,书末仍未补齐;短窗口标签不代替时序核查。
采用页:把实际报告从候选中分出
| 关系 | 记录要求 |
|---|---|
| 采用者与发出 | 谁实际采用、何时保存或交出 |
| 信息截止 | 发出使用哪些实际取得材料 |
| 对象 | 指向相应事件卡,不只写任务名称 |
| 报告内容 | 点值、范围或原方向性陈述 |
| 数字身份 | 历史频率、条件情景或主观判断 |
| 假定 | 模型值、权重、外推与未取得条件 |
| 质量限制 | 样本、适用、来源或量化支持的缺口 |
| 范围含义 | 敏感性、逻辑界限或正式统计方法 |
| 重开事项 | 哪种新材料或对象变化影响采用 |
可以用一段话交出:截至所记时点,对指定事件,暂采用所记报告;依据与额外假定可返回,未决限制具体列出,出现所记变化时重开。格式不是保证,内容要对应真实任务。
R17首次实际点值是周四二十一点二十分发出的0.5,信息截至二十一点。两个主观工作模型暂值3/4与1/4,各权1/2;后者与等权未经统计验证。它不是上午十点预测,也不是历史候选直接移植。
较高模型权重在1/4至3/4之间变化、两模型值保持时,加权结果3/8至5/8是本次敏感性范围。权重边界是检查选择,不是经过证明的真实范围,更不叫置信区间。
裁决页:结果与核查时点分开
保存原窗口、收到范围、原内容、裁决依据、核查时点及未决状态。已充分成立可以记成立;未充分成立且窗口未结束,不提前判整段未来未成立。截止后资料不足,也不随手补否。
若补回原材料显示裁决错误,生成更正关系;若只是后来发生新事件,另记后续,不延长旧窗口。更正裁决会影响相应评分,但不改变原预测当时知道什么。
| R17主要位置 | 主线状态 |
|---|---|
| 周四十点 | 建立事件与信息边界,无实际数值采用 |
| 周四十一点 | 取得历史比较统计 |
| 周四十一点二十分 | 第一条原回复:收到清单,时间待核对 |
| 周四十三点二十分至四十分 | 找到并核清九点四十分写入的站方备注 |
| 周四二十点二十分 | 第二条原回复:接收时间还不能定 |
| 周四二十一点二十分 | 首次实际采用0.5,公开主观模型与权重 |
| 周五十六点二十分 | 第三条原回复:原时段用不了,请下周再谈 |
| 周五十六点四十分 | 暂停沿用旧数为当前采用,未另发数值 |
| 周五十七点 | 原收到窗口结束 |
| 周五十七点二十分 | 核查充分收到记录,原A未成立 |
| 周五十七点四十分 | 交出结果、原预测与未决问题 |
主线明确设定相应接收记录完整,无遗漏窗口内相关内容,三条原回复均未完整接受第一版,故Y=0。核查时间不等于收到截止,下周提议尚未形成第二版。历史缺口也不因当前裁决解决。
修订与交接:写清变化对象
修订记录先指出受影响层次:材料用途、事件版本、模型输入、数值、适用范围或采用状态。再写新增依据、现行状态、旧版关系与下一问。不能只写情况变差而让接手者猜改了什么。
| 交接层次 | 应能返回什么 |
|---|---|
| 当前目标 | 已裁决、待核或新对象尚未形成 |
| 历史采用 | 实际发出版本、信息位置与原假定 |
| 原材料 | 主体、原话、取得及处理来路 |
| 方法 | 公式约定、分组与评价版本规则 |
| 未决 | 影响哪项用途、需要哪类材料 |
| 行动另问 | 目标、约束、代价、投入与退出尚需判断 |
接手者可以接收原报告而不独立认可,也可以另形成新采用。共识保持对象与检查关系,不强迫所有人报相同数字。原结果已有支持时,也不为显示独立而否认材料。
公式速查:条件不能省略
条件概率P(A|B)=P(A且B)/P(B),要求P(B)>0。条件分母只包含满足B的对象,不能把A中有多少B误读为B中有多少A。
设p=P(A)、q=P(B|A)、r=P(B|非A),则在分母为正且这些条件对应时,P(A|B)=pq/[pq+(1-p)r]。历史表p=5/8、q=3/5、r=1/3,结果3/4,是同表一致演算,不是独立验证。
当0<p<1、r>0且更新条件适用,可写后验几率等于先验几率乘q/r。几率为p/(1-p),相对证据q/r来自两类条件下B的比较,不是B绝对出现率。零概率边界需另处理,不将有限样本零格直接当不可能。
非B使用自己的相对证据(1-q)/(1-r),条件成立时再更新。历史例为3/5,不是B相对证据9/5的倒数。多个来源合用要检查联合条件,不能默认把边际权重全部相乘。
二选校准在本书采用的概率框架中写为P(Y=1|p)=p。有限分组频率是诊断材料,不直接等同性质已获证明。总体均值相合不替每个概率组或事前条件子组完成检查。
本书单项Brier损失为(p-Y)²,平均为相应单项之和除以报告数,较小为好。二选全部类别平方差和是它的两倍,不能混尺度或方向。R17实际p=0.5、Y=0,单项为0.25。
评分中的q另指记录者认真采用的肯定概率,与前述条件公式的q角色不同。按q比较的期望损失为q(1-p)²+(1-q)p²=(p-q)²+q(1-q),在固定q下p=q唯一最小。它不保证每次实际结果都赢,也不证明q已经准确。
一手资料入口
| 资料 | 本书核对用途 |
|---|---|
| Cornell CS2800,2017秋季条件概率讲义 | 条件分母、全概率与贝叶斯公式 |
| MIT 18.05,2022春季第十二讲 | 几率、相对证据及条件更新 |
| MIT概率课程教材摘录 | 条件独立与边际独立的区别 |
| 加拿大统计局,2009版样本设计指南 | 非概率选择向总体推断的额外假设;资料为归档版本 |
| Pearl,2009因果推断概览 | 关联、改变过程、反事实与潜在结果的位置 |
| Ranjan与Gneiting,2010概率预测组合 | 二选校准与严格适当损失的定义 |
| Gneiting与Raftery,2007严格适当评分 | 二次评分、方向与尺度约定 |
| NIST统计手册,置信区间说明 | 重复抽样的区间覆盖意义 |
这些链接帮助核对具体技术关系,不是为案例数量提供外部真实性。使用资料中的方法时仍需检查任务与前提;本书没有搬用其中医疗、行业或其他经验统计作为澄湾依据。
保存后做一次最小复核
先确认一个数对应一个明确事件与发出时点,再确认材料何时取得、结果怎样裁决。若有更新,检查旧版仍可返回;若有范围,检查名称与形成规则一致。
准备汇总时,说明全体进入、实际采用、已裁决、待决与排除范围。多人或多次预测要同时辨认不同事件数,不由行数直接推独立样本量。分组和权重变化都保留来路。
最后检查修订有没有针对具体关系。已有充分反面结果不移出记录,原因未知不填隐藏故事,当前采用不变成行动许可。完成这些关系以后,再决定需要何种更细统计工具。
本附录不能使所有任务立即有答案。它让没有答案的位置也能交出,让已有答案的位置有依据,让后续材料进入时知道应该改变什么。这是连续记录能够接续的最低要求。