四个4D迷思,认真检验一次。
人人都「知道」8888不会开、某个开彩日比较旺、安慰奖号码长得不一样、万能的机器有自己的脾气。我们把这四个说法一次过放到完整档案里检验。以下是全部数字。
1. 特殊形态号码
8888这类号码真的比普通号码少开吗?
每个4位数的机会都是一万分之一,所以一组号码应该正好按其数量占到相应比例的开出次数。这里统计了所有运营商历来公布过的每一个奖位 —— 共 714,579 个 —— 再逐组与应得比例对照。
| 号码组 | 占10,000个 | 理论值 | 实际值 | 实际 / 理论 | p |
|---|---|---|---|---|---|
| 四同(豹子)AAAA · 8888 | 10= 10 | 715 | 735 | 1.029 | 0.456 |
| 三同AAAB · 8887 | 360= 10 × 9 × 4 | 25,725 | 25,543 | 0.993 | 0.250 |
| 两对AABB · 1212 | 270= C(10,2) × 6 | 19,294 | 19,380 | 1.004 | 0.531 |
| 一对AABC · 1123 | 4,320= 10 × C(9,2) × 12 | 308,698 | 308,782 | 1.000 | 0.842 |
| 四位全异ABCD · 1234 | 5,040= 10 × 9 × 8 × 7 | 360,148 | 360,139 | 1.000 | 0.984 |
| 回文ABBA · 1221 | 90= 10 × 9 | 6,431 | 6,530 | 1.015 | 0.218 |
| 双双对AABB · 1122 | 90= 10 × 9 | 6,431 | 6,480 | 1.008 | 0.545 |
| 交替ABAB · 1212 | 90= 10 × 9 | 6,431 | 6,370 | 0.990 | 0.447 |
| 顺序递增A,A+1,A+2,A+3 · 1234 | 7= 7 | 500 | 499 | 0.998 | 0.975 |
| 顺序递减A,A-1,A-2,A-3 · 4321 | 7= 7 | 500 | 516 | 1.032 | 0.494 |
四同、三同、两对、一对与四位全异互不重叠,合计正好10,000个 —— 所以可以放进同一个拟合优度检验。ABBA、AABB、ABAB 都属于两对形态(90 × 3 = 270),单独列出只是因为彩民会分开称呼它们。每一组都用带连续性校正的双侧二项检验。
2. 开彩日
星期三开出的号码,跟星期六、星期日或特别开彩不一样吗?
传统运营商在星期日、三、六开彩,另加财政部批准的特别开彩 —— 历史上几乎都在星期二。各组号码彼此对照,既比逐位数字,也比数字形态。
| 开彩日 | 开彩日期数 | 号码数 |
|---|---|---|
| 星期日 | 2,054 | 21,897 |
| 星期三 | 1,863 | 21,318 |
| 星期六 | 2,150 | 22,542 |
| 特别开彩 | 1,411 | 7,572 |
档案中按星期几识别出 1,411 个特别开彩日期。人工整理的2026年特别开彩清单只涵盖其中 6 个,因为该清单只收录当年 —— 用星期几而不是用清单来划分组别,正是这项检验能一路回溯到1985年的原因。
豪龙、9 Lotto 与天天好运每晚都开彩,因此完全排除在外;把它们混进来等于在比开彩排程而不是比号码。一个必须承认的瑕疵:特别开彩组还包含万能与多多1995年之前的星期一、星期四排程,所以它混合的不只是日子,也混合了年代。
3. 奖级差异
头奖号码跟安慰奖号码长得不一样吗?
同一晚同一台机器开出板上每一个奖位,所以头奖的尾数与数字形态,应该跟安慰奖号码分不出差别。五个奖级全部对照。
| 奖级 | 公布号码数 |
|---|---|
| 头奖 | 31,081 |
| 二奖 | 31,081 |
| 三奖 | 31,081 |
| 特别奖 | 310,660 |
| 安慰奖 | 310,676 |
各奖级的样本量差很多 —— 一晚三个位对二十个位 —— 卡方本身可以处理,但这确实意味着两个大奖级主导了总量。同一板上的号码也是不放回抽取的,这个约万分之二十三的相依性在这里小到不影响结果,而且偏保守。
4. 运营商指纹
万能的机器跟多多的机器不一样吗?
把每家运营商的前三奖号码拆成数字,再让各家彼此对照。检验做两次:一次涵盖所有历史足够长的运营商,一次只比万能、多多与大马彩 —— 档案最长、监管最严,也正是这个说法真正点名的三家。
| 运营商 | 统计数字个数 | 偏离10%最大幅度 |
|---|---|---|
| Magnum 4D | 81,804 | 0.24 pp出现在数字 0 |
| Da Ma Cai 1+3D | 71,856 | 0.23 pp出现在数字 8 |
| SportsToto 4D | 68,244 | 0.29 pp出现在数字 3 |
| Lucky Hari Hari 7:30PM | 35,652 | 1.80 pp出现在数字 4 |
| Grand Dragon | 27,228 | 2.10 pp出现在数字 1 |
| Special CashSweep | 18,468 | 0.32 pp出现在数字 3 |
| Sandakan 4D | 18,408 | 2.06 pp出现在数字 4 |
| Singapore 4D | 17,760 | 0.48 pp出现在数字 4 |
| Sabah 88 4D | 16,776 | 0.55 pp出现在数字 8 |
| Lucky Hari Hari 3:30PM | 16,368 | 1.99 pp出现在数字 4 |
| 9 Lotto | 408 | 3.87 pp出现在数字 1 |
这是最容易被样本量影响的一项检验。万能的档案从1985年开始,豪龙从2020年开始,而卡方值随观测数增长,所以同样大小的差异,历史越长p值越小。因此每一行都同时列出该运营商数字占比与均匀10%之间的最大差距 —— 一个用百分点表示、不会因为多加几年数据就变大的量。
怎么读这些数字
p值只回答一个问题:如果这个说法不成立、开彩是公平的,那么纯靠运气看到至少这么反常的数据会有多频繁?p小表示在公平前提下很意外。它不是「这个迷思为真」的概率。
我们在同一批次里跑了 17 项检验。即使数据完全公平,大约每二十项检验就有一项会落在 p = 0.05 以下,所以做这么多检验,必然会有几个「显著」结果纯属噪音。因此标记线定在 p < 2.9e-3 —— 0.05 除以检验数 —— 高于这条线的一律不当作发现。
每个p值旁边都印着效应量。Cramér's V 衡量两件事关联有多强,范围0到1,并且不会随样本量变大;单格最大差距则是两个比例之间以百分点表示的最大差异。极小的p配上0.01的V,意味着这是一个真实但极其微小、只因为档案够大才被看见的差异 —— 不是一个大差异。
这四项检验预期的结果都是「什么都没有」,而「什么都没有」本身就是值得公开的结果。诚实地做完检验、结果没有发现效应,正是这个页面存在的意义:这才让我们有资格说这个流行说法不成立,而不只是嘴上断言。