第九章 一条消息区分了什么
2026.09.13这句话听起来已经很积极
唐可仍然觉得“清单收到”是个好消息。至少委托方回应了,而且愿意继续核对接收时间。顾宁承认它比完全没有对应材料多出信息,却问:如果最后没有在原窗口完整确认,这种消息会不会也出现。
上一章让两种条件方向分开,本章进一步比较同一消息在两类结果中的出现。若只看确认者中它常见,仍不知道它是否同样常见于未确认者。消息带有积极语气,不等于它能显著区分结果。
R04已经提供一个有限提醒:它满足较早时窗的清单收到消息条件,却没有满足原窗口完整确认。这个对象没有使B完全无用,也没有让顾宁获得一条绝不出错的信号。它要求比较两组,而不是只凭一句话作全部判断。
本章继续虚构澄湾修补站的思想实验,历史对象仍为R01至R08,主线R17仍未确认。我们不补新的真实行业规律,而是说明一项已经取得的材料,究竟怎样支持或限制当前判断。
先固定要比较的两个结果
A仍表示原窗口内收到对所保存第一版的完整确认;非A表示这一事件未满足。非A不等于明确拒绝,也不等于后来永不合作。两项未取得完整确认、一项提出修改的旧说明保持,不重新按编号分配具体原因。
B仍表示相应周四十点之后截至十一点二十分,约定渠道收到明确称清单收到的消息。这个条件没有包含范围逐项核对、支付条件接受或接收时段已经可用。R17的完整原话比B还多一句待核对说明,不能假定它的全部内容已经在历史B中得到对应。
本章先比较粗B,是因为上一章已经有同一对象的四格记录。若换成完整原句、特定语气或回复长度,需要另查历史材料;不能换条件名称却沿用四项满足B的数量。
结果与消息类型都固定,才能问如果属于A,B有多容易出现;如果属于非A,B又有多容易出现。这里的如果是模型里的给定范围,不是顾宁已经知道R17的未来结果。
同一消息在两组中的比例
历史A组有五项,R01、R02、R03有B,R05、R06没有B,所以B的出现频率为五分之三。非A组有三项,其中R04有B,R07、R08没有B,所以出现频率为三分之一。
| 原窗口结果组 | 有B消息 | 无B消息 | 组内合计 | B的历史出现比例 |
|---|---|---|---|---|
| A:完整确认成立 | 3 | 2 | 5 | 3/5 |
| 非A:原窗口事件未满足 | 1 | 2 | 3 | 1/3 |
不能直接拿三项有B与一项有B相比,说消息支持确认是三倍。两类结果组本来大小不同,原始数量既含组内消息频率,也含结果组份额。要隔开这两层,先分别除以各自组内数量。
五分之三与三分之一来自同一八项的描述性经验分布。它们不是两次独立研究,也没有因为使用两个分母就增加样本。原五次确认的总体结构仍在,当前讨论只是消息在两类结果里的相对出现。
似然怎样把观察放到模型里
把B作为已经观察的消息,分别在A与非A的给定条件下考察它出现的概率,就是此处比较的两项似然。关注的是同一观察在不同结果假设下是否容易取得,不是先把观察直接翻译成结果概率。
在两类给定条件的概率均可定义、且分母中的消息概率大于零时,可以写这项消息相对支持A对非A的似然比:
$$ L_B=\frac{P(B\mid A)}{P(B\mid \neg A)} $$
这里的非A是A的补事件;比值两边都必须来自同一比较设定。用似然之比描述证据作用,可参照麻省理工学院18.05课程第十二讲,其中将其与更新前后的几率相接。本章先说明比值含义,完整更新留下一章。
若以原八项等权描述历史,五分之三除以三分之一,得到五分之九,即一点八。这个数大于一,表示在这张历史表对应的两组内,B在A组出现的比例高于非A组。
一点八不是百分之一百八十的确认概率,也不是原概率应直接乘一点八。它比较两项消息概率;要得到目标概率,还要接入原来两类结果的份额并进行相应换算。第八章的百项比较已经说明,相同组内消息比例可对应很不同的反向结果。
相对支持不等于排除另一结果
在这张表里,非A组仍有三分之一出现B。观察到B没有排除非A,因此不能把一点八说成已经证明R17将确认。相对支持描述的是两类给定条件的比较,不是对任何一个个体未来作保证。
它也不等于消息有八成可靠。可靠可以指原话是否准确、渠道是否对应、记录是否完整,或者长期预测质量;这些都不是一点八直接测得的量。需要说明用哪个词表达哪一层,避免把一个比值扩成全方位信用。
若将比较方向改为非A对A,同一B的似然比就是一点八的倒数,即九分之五。方向改了,观察没有改。两种写法相互对应,但表述应固定哪一类在分子,不让使用者把较大数字一律理解为好消息。
顾宁可以说这张有限历史表使B相对偏向A,同时保留它在非A组也出现的事实。一个支持不强到足以排除另一结果,不因此成为零支持;不保证未来,也不等于任何判断都同样合适。
很常见的消息可能没有区分作用
另作一项明确假设的比较:某种通用回执在A组出现概率为十分之九,在非A组也为十分之九。它很常见,取得后可以说明渠道发回了这类回执,但对这两类结果的似然比是一。
比值为一表示在这个模型给定的两类下,这项观察同样容易出现,不改变二者的相对支持。它可以减少收到回执没有的事实空白,却不必减少目标结果的不确定;信息增加与这次目标区分不能直接等同。
这并不说通用回执在所有任务都无价值。若目标改为判断渠道是否正常,或材料显示两组回执概率其实不同,需要另立问题。当前用途里没有区分力,不能变成消息在任何用途永久无意义。
唐可于是能分开两句说明:我们确实得到了一条回复;这条回复对是否在原窗口完整确认提供多大相对支持。第一句成立,不替第二句自动填一个乐观数字。
稀有线索也不自动更有力
再作另一项假设比较:某种细线索在A下出现概率为五分之一,在非A下为五十分之一,似然比是十。它在A下并不常见,却比刚才两类都很常见的回执更能区分这两个给定结果。
决定比值的不是线索总体多罕见,而是两类条件下的相对出现。如果线索在A与非A下都为百分之一,比值仍是一。罕见可以令人印象深,却不单独提供偏向哪一类的根据。
这两个比较不是澄湾取得的新信号,也不说明B应该按十更新。它们把常见程度与区分程度分开。顾宁不能为了提高相对支持,替一条普通消息虚构在非A组几乎不出现的概率。
同样,一个比值大于一百,也不是百倍确定。它可能与很小的初始结果份额相接;也可能依赖不可靠的分母假设。大小有意义,但意义始终连着模型和输入,不能只展示最大那个数。
没有B要重新比较
若在指定时窗没有收到B,观察改成了非B。原A组五项里两项非B,比例为五分之二;非A组三项里两项非B,比例为三分之二。非B相对支持A对非A的比值为五分之三,即零点六。
这不是B似然比一点八的倒数。倒数仍在比较同一B,只是交换结果方向;此处改变了观察,从有消息变成无该类消息,所以要分别取同组内的补数后再相除。
零点六小于一,说明这张表里的非B相对偏向非A,但不排除A。R05、R06就是没有早时窗B仍确认的历史对象。无B没有自动变成完全不联系,也没有变成明确拒绝。
R17已经满足B,本段不是把它改记为非B。比较无消息,是为了说明一项证据的缺席需要自己的模型条件,不能用某个现成比值随意反转来省去核对。
缺席的解释依赖观察办法
如果约定渠道材料缺失,顾宁只知道没有看见B,不能据此断定指定时窗没有收到B。判断非B,需要有足够材料裁决消息状态;与第五章的未知区分相接,缺失并非否定观察。
作一个观察办法的比较:一种整理只保存明确确认消息,不保存中途回执,那么在它的档案中找不到B,并不说明原沟通没有B。另一种保存完整时窗沟通,才可能支持指定时窗无该类消息的裁决。
若采用两种办法的对象被混到一起,有记录与无记录可能首先反映保存方式。此时比值比较的已不纯是原消息出现,而包括消息能否被观察到。顾宁需回查来源并说明采集限制,不能让形式正确掩住观察机制。
本书八项已有可裁决B的明确设定,所以本章能算非B。R13至R16仍缺原材料,不能以同一个零点六直接处理它们;R09至R12的阶段或窗口不同,也不借来增加两组数量。
零次出现为什么容易制造极端支持
假如另一张很小的历史表里,非A组没有任何B,简单组内频率便是零。将它当作模型中的确切零概率,B似然比的通常有限比值写法就会遇到零分母,观察B还可能在该假设模型中排除非A。
但没有在少量历史中看到,与今后任何同类对象都不可能出现不同。前者是有限记录,后者是更强模型假设;不能让一个计数零自动替后者成立。数学处理极端输入的结果,不验证输入来自哪里。
顾宁可以报告零次出现及组大小,说明直接比值没有取得有限值。若需建立非零概率模型,应清楚给出额外估计方法与理由;不能偷偷补一次来使数字温和,也不能偷偷将未知删去来使比值更大。
本章原非A组有一次B,不出现零分母。讨论零,是给后续应用留下边界,而不是声称当前一点八已经经过某种平滑、区间或误差修正。
粗消息不能代表完整回复
回到R17,原消息还说我还要核对接收时间。B只记录清单收到,并未包含待核对接收时间这部分。顾宁若想比较完整消息的作用,需要辨认相应历史中待核对条件怎样出现,不能用B的比值替整句计算。
待核对既可能只是正常推进中的剩余步骤,也可能显示窗口内接收受限。两种解释都可以作为候选,当前没有足够对应材料裁决相对出现。不能因语气顺畅只保留第一种,也不能因还有空白直接定为负面。
因此本章给B一点八的历史相对比例,并不等于给当前完整原话一点八的模型权重。表征压缩让计算可开始,也可能遗漏重要部分,第六章的边界说明应在这里保持生效。
叶澄可以继续查找对应字段,但新资料尚未取得以前,顾宁先保留这个缺口。保存有限证据作用,不是拒绝以后更新,而是避免把一条可算的粗信号冒充一条已完全理解的消息。
已用过的信息不能再次当成新消息
若某一版判断已经以满足B的历史组为参考,B已进入那一版的条件。再拿同一B的似然比乘一次,就可能重复使用同一观察。顾宁应先回到旧判断到底给定了哪些材料,再说明本次新增什么。
相反,未分组的八项起点与B条件更新可以在一个明确模型里相接,但不能将组内四分之三当起点,又假装B第一次出现。这不涉及多个人转述,还只是同一条消息在记录中被用两遍。
若以后取得C,比较应说明是在已经给定B的条件下,C在A与非A里怎样出现;是否可以用未给定B的两个C比例,需要另查依赖关系。第十一章将展开来源和共同条件,此处先保留旧信息的接口。
证据作用说明因而不能只写一点八。还应写明它针对哪个观察、比较哪些结果、与什么旧信息相接。比值离开这些对象,就容易在一次又一次转述中被重复累计成确信。
证据作用也有资料质量
比值把两个输入压成一个数,可能使读者只关注相对大小。然而两项输入若来自不同时间、不同对象范围,或者其中一项由印象猜出,较大的比值仍可能缺乏可采用的依据。
顾宁可以分别保存来源与估计状态:历史直接计数、当前另立的模型假设、尚缺材料的候选解释。它们都能进入讨论,但不能统一称为已经验证的似然。计算精细不使猜测取得记录身份。
一点八也压缩了原五项与三项的数量限制。非A组只有三项,其比例可能对单项裁决很敏感;本章不从这种敏感直接推出误差区间,也不称八项足以证明稳定规律。后续材料仍可能使相对关系收缩甚至改向。
材料冲突时,先核对内容、时间和来源,而不是挑能产生最大比值的一份。第十二章再具体处理争议;这里先承认证据强度与输入质量应一起交付,不能用一个数替代全部支持说明。
两项似然不需要相加为一
唐可注意到五分之三与三分之一相加不是一,问是否漏掉了另一种结果。顾宁指向两个不同分母:前者在五项A中数B,后者在三项非A中数B。它们不是在同一总体内分割两个互斥结果,所以没有必须相加为一的要求。
需要相加为一的是同一个给定结果组里B与非B的概率。A组五分之三与五分之二相加为一;非A组三分之一与三分之二也相加为一。固定分母后,才能检查是否覆盖了该组所有消息状态。
如果直接把两项似然相加,再用五分之三除以这个和,会得到十四分之九。这个算式可以作为另一个明确假设模型中等份额两类的推算步骤,却不是原八项表的有B者确认比例。原表两类份额是五比三,不能在归一时默默换成一比一。
所以两项消息概率不和为一,不表示条件表遗漏;将它们强行按同等份额归一,也不自动得到正确更新。下一章将展开真正相接的步骤,此处先让读者知道,似然与结果概率处在不同给定范围中。
非A内部的构成可能改变
非A是原窗口事件未满足,它包含不同来路。前文两项没有取得完整确认,一项提出修改;这些来路可能与早期消息有不同对应,但本书尚未按编号和原因补出交叉表,不能计算各自B概率。
作一个机制比较,如果另一个对象范围里未成立主要来自需要改范围,而另一个主要来自无法在时窗接收,两者的早期清单收到消息可能有不同出现模式。这只是候选解释,不是澄湾已经取得的统计差别。
即使A的目标文字保持,非A内部的构成变化也可能影响整体P(B给定非A)。因此,原表三分之一并非一个只由非A这个名称决定的恒定参数。向新范围迁移,需要关注两组过程是否仍有足够对应。
顾宁不必在当前就为每项未成立寻得完整原因,才允许报告历史比值。但她应保留这一限制,避免接手者把粗两类表当作所有未成立机制都已识别。模型能够先用有限分组,也必须允许后来发现重要差别后重开。
给消息编码也要接受复核
证据作用计算依赖B怎样被辨认。若整理者把“收到,稍后看”算作B,却把“清单已经收到了”排除,仅凭措辞是否相同可能形成不一致;若又将“已核对,全部同意”统统压进B,需要另留它包含更强内容的事实。
顾宁可以先保存原话,再说明是否满足有限清单收到条件及理由。含混消息暂不裁决,不为填满四格而勉强判定。两个整理者若意见不同,回查的是内容与口径,不是看哪个分类能让似然比更大。
这项复核不是要求所有人必须使用同一句模板。条件关注可辨认含义,语言可以不同;但共同分类要说明哪些内容足够、哪些还不能对应。原表本章已设八项可裁决,编码争议只作应用比较,不记成叶澄已经误判。
有限证据说明于是多了一道入口:原句可以返回,分类能够解释,数量可以重算。它没有证明委托方所说都真实,也没有消除采集误差,却使可发现的表征错误不必永久隐藏在一点八背后。
若修补站以后统一要求每个委托方先回复清单收到,消息的取得过程也变了。新流程可能使B在两组都更常见,原比值未必继续适用。顾宁需要记录主动询问及流程变化,而不是只保存答复文字;同样的句子在不同取得办法下,可能对应不同结果关系。这里不预测新流程的实际效果,只说明证据模型依赖观察如何形成,不能将改变后的沟通机械接到旧频率上。
把好消息换成有限作用说明
周四十二点二十分,顾宁保存本章的证据作用说明。B在原五项确认中出现三次,在原三项未成立中出现一次;等权历史似然比为一点八。它只描述该表相对关系,不是R17最终概率。
说明另留非B的零点六,并写清这不是一点八的倒数;完整原话中的接收时间待核对没有取得额外历史权重。主线没有新增确认或支付,原消息时点和十二点取得历史表保持,十点信息不回填。
RC 将认知视为有限表征的继续生成。落实到此处,促进判断收敛的不是让积极语言被反复赞同,而是把同一观察放到不同可能结果下比较,并允许反面对象进入。有限模型仍需校准,不由似然比验证基础哲学。
本章得到的判断是,证据作用取决于两类给定条件下观察的相对出现,而不只取决于消息常见、稀有或令人安心。顾宁知道B怎样提供有限相对支持,也知道完整回复、迁移和旧信息仍须核对。
下一章将让基准与证据在同一假设模型内真正相接,展示更新为什么需要归一化,也展示算式正确以后还有哪些输入没有因此得到验证。我们已经有证据作用的对象,接下来才计算它怎样改变一项明确的概率表征。