四个4D迷思,认真检验一次。

人人都「知道」8888不会开、某个开彩日比较旺、安慰奖号码长得不一样、万能的机器有自己的脾气。我们把这四个说法一次过放到完整档案里检验。以下是全部数字。

迷思本身都没站住 —— 但并非每项检验都完全干净。 本批次一共跑了 17 项统计检验,其中 3 项落在标记阈值 p < 2.9e-3 之下;该阈值已按整批检验做Bonferroni校正。这条线刻意严格:做这么多检验,必然会纯靠运气冒出几个 p < 0.05 的结果。
被标记代表什么 —— 以及不代表什么。被标记只表示存档数据与零假设模型不吻合。第一嫌疑永远是数据,而不是运营商。这里两处标记都指向同样两家运营商 —— 豪龙与山打根 —— 而且仅此而已:把这两家剔除后,奖级形态检验从 p = 5.1×10⁻⁴ 变成 p = 0.11,全运营商数字检验从 p ≈ 10⁻⁵⁴ 变成 p = 0.025,两者都不会被标记。这两家运营商公布号码的数字分布已在2026年8月调查过,并与它们官方存档逐一核对(豪龙128个日期全对、山打根123个日期全对,另有一份独立收集的593期数据重现同样偏斜),所以这不是我们这边的采集失误 —— 但这仍然不是指控,因为公布号码分布不均匀可以有很平常的机械原因。完整说明见随机性审计页。其余每家运营商都通过,包括监管最严的三家。

1. 特殊形态号码

8888这类号码真的比普通号码少开吗?

迷思不成立

每个4位数的机会都是一万分之一,所以一组号码应该正好按其数量占到相应比例的开出次数。这里统计了所有运营商历来公布过的每一个奖位 —— 共 714,579 个 —— 再逐组与应得比例对照。

号码组占10,000个理论值实际值实际 / 理论p
四同(豹子)AAAA · 888810= 107157351.0290.456
三同AAAB · 8887360= 10 × 9 × 425,72525,5430.9930.250
两对AABB · 1212270= C(10,2) × 619,29419,3801.0040.531
一对AABC · 11234,320= 10 × C(9,2) × 12308,698308,7821.0000.842
四位全异ABCD · 12345,040= 10 × 9 × 8 × 7360,148360,1391.0000.984
回文ABBA · 122190= 10 × 96,4316,5301.0150.218
双双对AABB · 112290= 10 × 96,4316,4801.0080.545
交替ABAB · 121290= 10 × 96,4316,3700.9900.447
顺序递增A,A+1,A+2,A+3 · 12347= 75004990.9980.975
顺序递减A,A-1,A-2,A-3 · 43217= 75005161.0320.494
五种形态整体检验
χ² = 2.28(df 4)· p = 0.685

四同、三同、两对、一对与四位全异互不重叠,合计正好10,000个 —— 所以可以放进同一个拟合优度检验。ABBA、AABB、ABAB 都属于两对形态(90 × 3 = 270),单独列出只是因为彩民会分开称呼它们。每一组都用带连续性校正的双侧二项检验。

2. 开彩日

星期三开出的号码,跟星期六、星期日或特别开彩不一样吗?

迷思不成立

传统运营商在星期日、三、六开彩,另加财政部批准的特别开彩 —— 历史上几乎都在星期二。各组号码彼此对照,既比逐位数字,也比数字形态。

开彩日开彩日期数号码数
星期日2,05421,897
星期三1,86321,318
星期六2,15022,542
特别开彩1,4117,572
各组数字分布
χ² = 29.5(df 27)· p = 0.335 · Cramér's V = 0.0058 · 单格最大差距 0.33 个百分点
各组数字形态
χ² = 20.8(df 12)· p = 0.053 · Cramér's V = 0.0097 · 单格最大差距 1.46 个百分点

档案中按星期几识别出 1,411 个特别开彩日期。人工整理的2026年特别开彩清单只涵盖其中 6 个,因为该清单只收录当年 —— 用星期几而不是用清单来划分组别,正是这项检验能一路回溯到1985年的原因。

豪龙、9 Lotto 与天天好运每晚都开彩,因此完全排除在外;把它们混进来等于在比开彩排程而不是比号码。一个必须承认的瑕疵:特别开彩组还包含万能与多多1995年之前的星期一、星期四排程,所以它混合的不只是日子,也混合了年代。

3. 奖级差异

头奖号码跟安慰奖号码长得不一样吗?

需再查看

同一晚同一台机器开出板上每一个奖位,所以头奖的尾数与数字形态,应该跟安慰奖号码分不出差别。五个奖级全部对照。

奖级公布号码数
头奖31,081
二奖31,081
三奖31,081
特别奖310,660
安慰奖310,676
各奖级尾数
χ² = 106.2(df 36)· p = 7.5e-9 · Cramér's V = 0.0061 · 单格最大差距 0.67 个百分点
各奖级数字形态
χ² = 117.0(df 16)· p = 2.1e-17 · Cramér's V = 0.0064 · 单格最大差距 1.21 个百分点

各奖级的样本量差很多 —— 一晚三个位对二十个位 —— 卡方本身可以处理,但这确实意味着两个大奖级主导了总量。同一板上的号码也是不放回抽取的,这个约万分之二十三的相依性在这里小到不影响结果,而且偏保守。

4. 运营商指纹

万能的机器跟多多的机器不一样吗?

需再查看

把每家运营商的前三奖号码拆成数字,再让各家彼此对照。检验做两次:一次涵盖所有历史足够长的运营商,一次只比万能、多多与大马彩 —— 档案最长、监管最严,也正是这个说法真正点名的三家。

运营商统计数字个数偏离10%最大幅度
Magnum 4D81,8040.24 pp出现在数字 0
Da Ma Cai 1+3D71,8560.23 pp出现在数字 8
SportsToto 4D68,2440.29 pp出现在数字 3
Lucky Hari Hari 7:30PM35,6521.80 pp出现在数字 4
Grand Dragon27,2282.10 pp出现在数字 1
Special CashSweep18,4680.32 pp出现在数字 3
Sandakan 4D18,4082.06 pp出现在数字 4
Singapore 4D17,7600.48 pp出现在数字 4
Sabah 88 4D16,7760.55 pp出现在数字 8
Lucky Hari Hari 3:30PM16,3681.99 pp出现在数字 4
9 Lotto4083.87 pp出现在数字 1
全部运营商
χ² = 712.6(df 90)· p = 1.5e-97 · Cramér's V = 0.0146 · 单格最大差距 3.52 个百分点
万能 vs 多多 vs 大马彩
χ² = 33.7(df 18)· p = 0.014 · Cramér's V = 0.0087 · 单格最大差距 0.26 个百分点

这是最容易被样本量影响的一项检验。万能的档案从1985年开始,豪龙从2020年开始,而卡方值随观测数增长,所以同样大小的差异,历史越长p值越小。因此每一行都同时列出该运营商数字占比与均匀10%之间的最大差距 —— 一个用百分点表示、不会因为多加几年数据就变大的量。

怎么读这些数字

p值只回答一个问题:如果这个说法不成立、开彩是公平的,那么纯靠运气看到至少这么反常的数据会有多频繁?p小表示在公平前提下很意外。它不是「这个迷思为真」的概率。

我们在同一批次里跑了 17 项检验。即使数据完全公平,大约每二十项检验就有一项会落在 p = 0.05 以下,所以做这么多检验,必然会有几个「显著」结果纯属噪音。因此标记线定在 p < 2.9e-3 —— 0.05 除以检验数 —— 高于这条线的一律不当作发现。

每个p值旁边都印着效应量。Cramér's V 衡量两件事关联有多强,范围0到1,并且不会随样本量变大;单格最大差距则是两个比例之间以百分点表示的最大差异。极小的p配上0.01的V,意味着这是一个真实但极其微小、只因为档案够大才被看见的差异 —— 不是一个大差异。

这四项检验预期的结果都是「什么都没有」,而「什么都没有」本身就是值得公开的结果。诚实地做完检验、结果没有发现效应,正是这个页面存在的意义:这才让我们有资格说这个流行说法不成立,而不只是嘴上断言。