当前位置:首页 > 每日看点 > 正文内容

为什么银行存款、河流长度等集合的首位数字更容易出现 1 而不是 9?

卡卷网7个月前 (03-24)每日看点138

楼上已有回答说了本福特定律,这里我来大概解释一下它的原理。

事实上,这个问题分为两部分:数学部分和非数学部分,数学部分又分为两部分:动力系统部分和统计学部分。

动力系统部分

数学上这是一个有关随机整数列首位分布的问题。在Stein的 Fourier Analysis 中有讲过Weyl等分布定理(Weyl's euqidistribution theorem)。在遍历论/动力系统中也有一个相关的定理,叫Birkhoff遍历定理(Birkhoff’s Ergodic Theorem)。下面我们来大概梳理一下它们之间的关系。

Weyl等分布定理

下面这位学长曾经写过详细的文章来介绍这件事情:

元亨利贞:{sin(n^p)}稠密性,Weyl准则,等分布序列Equidistributed Sequence

Birkhoff遍历定理

内容表述:对于保测动力系统 为什么银行存款、河流长度等集合的首位数字更容易出现 1 而不是 9?  第1张 ,若系统是遍历的(即不存在非平凡的 为什么银行存款、河流长度等集合的首位数字更容易出现 1 而不是 9?  第1张 -不变集),则对任意可积函数 为什么银行存款、河流长度等集合的首位数字更容易出现 1 而不是 9?  第1张 ,时间平均几乎处处收敛于空间平均:

为什么银行存款、河流长度等集合的首位数字更容易出现 1 而不是 9?  第1张

Ergodic theory - Wikipedia

这是Weyl等分布定理的推广。至于为什么是推广,如果有空了再写()

本福特定律

我们用一个例子来说明什么是本福特定律。

考察数列

为什么银行存款、河流长度等集合的首位数字更容易出现 1 而不是 9?  第1张

记录它们的首位数字,直观上我们会觉得这是一个随机的排列,从而首位数字为 为什么银行存款、河流长度等集合的首位数字更容易出现 1 而不是 9?  第1张

的概率都相等,即均为 为什么银行存款、河流长度等集合的首位数字更容易出现 1 而不是 9?  第1张 然而事实并非如此。

事实上,映射

为什么银行存款、河流长度等集合的首位数字更容易出现 1 而不是 9?  第1张

是遍历的(ergodic),即满足

为什么银行存款、河流长度等集合的首位数字更容易出现 1 而不是 9?  第1张

这个网页中有所说明。

从而,Weyl等分布定理或者Birkhoff遍历定理告诉我们如下性质:

命题 . 在上述数列中,以 为什么银行存款、河流长度等集合的首位数字更容易出现 1 而不是 9?  第1张 为首位数字的概率是

为什么银行存款、河流长度等集合的首位数字更容易出现 1 而不是 9?  第1张

为什么银行存款、河流长度等集合的首位数字更容易出现 1 而不是 9?  第12张

感兴趣的小伙伴可以编程来验证

这直接地告诉我们:用等比数列生成的随机数并不是真随机数,而是一种伪随机数

我们着重考察具有这种性质的数据,引入如下定义:

定义 . 一组数据如果满足首位数字的概率

为什么银行存款、河流长度等集合的首位数字更容易出现 1 而不是 9?  第1张

则称其满足本福特定律

注记 . 本福特定律事实上是一个定义而非定理!!!后面会再次重复。

注记 . 还可以对位数进行扩展,譬如 为什么银行存款、河流长度等集合的首位数字更容易出现 1 而不是 9?  第1张 作为第 为什么银行存款、河流长度等集合的首位数字更容易出现 1 而不是 9?  第1张 位数字的概率是

为什么银行存款、河流长度等集合的首位数字更容易出现 1 而不是 9?  第1张

数学部分就到此结束了。事实上数学也只能证明这么多。

统计学部分

本福特定律需要检验

那么(终于)问题来了,题主说的银行存款、河流长度为什么满足本福特定律呢?事实上,本福特定律是一个后验定义,即我们并不能知道哪些数据事实上满足本福特定律,当然,如果给定了数学表达式。我们可以推导,然而问题是现实生活中的数据往往没有准确的公式来表达。下面是两个例子:

为什么银行存款、河流长度等集合的首位数字更容易出现 1 而不是 9?  第17张

给npy阅读课小论文中用的例子

感谢评论区指正,注意上述数据来源于List of tallest buildings and structures - Wikipedia,这里的表格指的是按照不同材料/建筑方式建筑的最高高度!(更新于2025/3/17)

也并非所有的数列都满足本福特定律,例如:

为什么银行存款、河流长度等集合的首位数字更容易出现 1 而不是 9?  第18张

给npy阅读课小论文中用的例子

那么最重要的问题就是:什么样的序列满足本福特定律?

因为本福特定律事实上是一个定义而非定理,我们可以考虑用特定的方式检验数据,从而判断其为真随机还是伪随机,如果是真随机,那么就不满足本福特定律,如果是伪随机,且满足本福特分布,才有的谈!

统计学中,常见的检验方式有二:Kolmogorov-Smirnov test 和 Kuiper's test,详见如下两个链接(均来自Wikipedia):

Kolmogorov–Smirnov test - WikipediaKuiper's test - Wikipedia

题主的问题

所以说,在给定一些银行存款,河流长度的数据后,可以使用特定方法检验它是否符合本福特定律的分布。

非数学部分

至于为什么那么多数据都满足本福特定律的分布,乃至于可以检验选举投票、税务、经济发展数据是否造假呢?(见Benford's Law | Brilliant Math & Science Wiki的最后一段)

——暂不清楚,这可能是个哲学问题吧

扫描二维码推送至手机访问。

版权声明:本文由卡卷网发布,如需转载请注明出处。

本文链接:https://www.kajuan.net/ttnews/2025/03/11996.html

分享给朋友:

相关文章

无意中发现技术主管写的代码,大家帮忙看看什么水平?

无意中发现技术主管写的代码,大家帮忙看看什么水平?

虽然很多答主用了诸如“典范级”、“心旷神怡” 的形容, 赞美这段代码, 但这里, 出于技术讨论的动机, 我说说不同看法.栈, 如果善于利用栈来处理树结构, 那么可以写出更简洁的代码, 根本不需要 recuresiveFn 这种方法. 泛型,...

你见过哪些有趣的偏微分方程组?

你见过哪些有趣的偏微分方程组?

说说我一直在做的一个偏微分方程系统吧,该模型为生物领域的趋化性(chemotaxis)模型,也叫Keller-Segel模型,由该二人于1971年左右提出,用于刻画细胞或者细菌的趋化机制。解释一下趋化性(chemotaxis):趋化性是指单...

客观的讲,华为是不是真的遥遥领先?

客观的讲,华为是不是真的遥遥领先?

最近,华为上市了最新款的三折叠屏手机,于是很多大V们把这款手机吹上了天,吹成是技术上遥遥领先于全世界。谁要是敢质疑华而不实,就会被人扣上一顶汉奸卖国贼美狗的帽子。把一个商品捧成了宗教和菩萨,你只能说好,不能说不好。其实这个世界上,只要是人和...

本专业是电气的,请问入门plc 必须要从电工接线开始吗,我怕被公司骗了,想请教各位?

本专业是电气的,请问入门plc 必须要从电工接线开始吗,我怕被公司骗了,想请教各位?

开关接线图PART 01一开单控开关接线图二三开连体单控开关接线图四开连体单控开关接线图一开五孔单控插座接线图二开五孔单控插座接线图一开双控开关接线图二三开单控开关接线图四开单控开关接线图一开五孔单控插座接线图二三开双控开关接线图一开多控开...

为什么程序员们愿意在GitHub上开源自己的成果给别人免费使用和学习?

开源可以垄断。人类最高的权力不是什么国家而是意识形态,能够控制别人的思维方式。你把你的东西开源出来了,其他人就会懒于思考,在这一个思考上使用你的方式。比如容器编排,经过了K8s后谁还会去开发那些奇奇怪怪的编排手段,直接用不就行了。形成了生态...

高德地图靠什么赚钱?

高德地图靠什么赚钱?

10年前,马云不惜花了88亿把高德地图收入囊中,其实他根本就不想买,因为觉得自己根本用不到,考虑到互联网电商离不开地图导航,犹豫再三还是买下了!业内的很多人觉得他就是一个接盘侠,等着看他笑话。如今,高德日活跃用户数远超1亿,成为大家出行必备...

发表评论

访客

看不清,换一张

◎欢迎参与讨论,请在这里发表您的看法和观点。