数界玄境:被遗忘的数学文明史

作者:尘衍 | 分类:历史与文明 | 约 138958 字

数界玄境:被遗忘的数学文明史

序章 数字的骨骸

清晨的光线斜斜地穿过大英博物馆的穹顶,落在那些沉睡数千年的泥板上。这些来自美索不达米亚的褐色土块,表面布满细密的楔形刻痕,像是时间在泥土上留下的指纹。很少有过客会在它们面前驻足太久,毕竟比起旁边的罗塞塔石碑或帕特农神庙浮雕,这些不起眼的泥板实在缺乏视觉冲击力。

然而,若有人俯身细看,便会发现那些刻痕中隐藏着一个惊人的事实:早在柏拉图出生前一千五百年,两河流域的书吏们已经在计算复利、求解二次方程、甚至触及了某种意义上的“毕达哥拉斯定理”。

这块编号为YBC 7289的泥板,来自古巴比伦时期,约公元前1800年。泥板上画着一个倾斜的正方形,两条对角线将它分为四个三角形。沿对角线方向,刻着一行数字。经过学者解读,那是根号2的近似值:1.41421296。,与现代值相差不到百万分之一。

六十进制。这便是美索不达米亚文明留给数学最独特的遗产。我们至今仍在使用他们的六十进制来度量时间和角度,一小时六十分,一分六十秒。这一选择的背后,暗藏着深刻的原因:60是能被1、2、3、4、5、6、10、12、15、20、30整除的最小数字,这意味着在分割土地或分配谷物时,书吏们可以轻易得到整数结果,而不必陷入今天小学生也要面对的分数噩梦。

而在不远处的另一个展柜中,来自苏美尔时期的会计泥板记录着大麦的数量、工人的口粮、神庙的财产。这些古老的账目,或许正是数学真正的起源,数字不是为了仰望星空而诞生,而是为了清点地上的粮食。人类首先学会计算拥有的,然后才学会计算未知的。

当视线从两河流域转向尼罗河谷,另一种数学形态浮现出来。与巴比伦人的六十进制不同,古埃及人创立了一套基于十进制的计数系统,但他们处理分数的方式却极其独特,除了2/3这个特殊的分数外,埃及人只使用单位分数,即分子为1的分数。这意味着,要把3/5表达出来,他们需要写成1/2 + 1/10。

这看似笨拙的规则,实际上塑造了埃及数学独特的思维方式。在莱因德纸草书,这份现存最重要的古埃及数学文献中,第一张表便是将2/n形式的分数分解为单位分数之和。这不仅是算术练习,更是古代版的数据压缩:找到一种标准化方式来表达所有有理数。

尼罗河的潮汐每年准时到来,淹没田地,退去后留下肥沃的淤泥,也抹去了田界。测量员们需要重新划定边界,于是几何学,字面意义上的“土地测量”,在埃及蓬勃生长。他们计算三角形的面积、圆柱体的体积,金字塔的斜度。那些宏伟陵墓的建造者,心中自有一套精密的数学。

但在所有这些实用计算之上,古埃及数学有一个令人费解的特点:他们似乎始终没有发展出严格的证明概念。他们的方法基于经验规则和反复试验,诸如“这样做就会得到正确结果”,却从不追问“为什么必须这样做”。这一追问,需要等待另一个文明来提出。

爱琴海的蔚蓝之上,一个全新的数学形态正在酝酿。泰勒斯站在米利都的海岸边,据说他根据影子长度计算出了大金字塔的高度,还预测了公元前585年的日食。这类传说无论真伪,都指向一个根本性的转变:希腊人开始追求超越具体应用的普遍规律。

毕达哥拉斯,这个谜一般的人物,既是数学家又是神秘主义教派的创始人。传说中,当他发现直角三角形三边长度之间的普遍关系时,狂喜之下宰了一百头牛来庆祝。这当然只是传说,毕达哥拉斯教派是素食主义者。但故事流传至今,说明这一发现在当时人们心中激起的震撼。有趣的是,这一关系在巴比伦泥板上早已出现,区别在于:巴比伦人满足于计算具体数字,希腊人却执着于证明它对所有直角三角形都成立。

于是,数学发生了根本的蜕变:从“是什么”转向了“为什么”,从经验归纳跃升到逻辑证明。这一转向的分量,后人用了两千年才真正掂量出来。

当亚历山大大帝的铁蹄踏平了从尼罗河到印度河的广袤土地时,希腊数学的中心转移到了埃及北部那座以他命名的城市。亚历山大里亚图书馆的七千万卷藏书,吸引着整个地中海世界的智者。欧几里得就在这里,将前人积累的几何知识编织成一座逻辑的大厦。《几何原本》,这部仅次于《圣经》的、被翻译过最多次的著作,其结构本身就是一场思维的奇观:从五条简单的公理出发,一步步推出四百多条命题,每个命题都坚固地建立在之前的论证之上,如同砖石层层垒砌,直至天穹。

欧几里得的阴影如此巨大,以至于在其后两千年里,数学教科书的基本结构都未曾改变。二十三个世纪后的教室里,学生们依然在证明三角形全等、作角平分线,仿佛时光在数学的世界里流淌得格外缓慢。

然而,希腊人也有他们无法跨越的边界。无理数的发现,可能是由毕达哥拉斯学派成员希帕索斯发现的,动摇了对数字的信仰。正方形的对角线与其边长不可通约,这意味着存在不能用整数比表达的量。传说中,希帕索斯因为这个发现被扔进了海里,泄露了宇宙不完美的秘密。希腊人选择了绕开:他们不再将数看作根本,而将几何推到了王座之上。数与形的分离,成为希腊数学最深的烙印。

在遥远的东方,另一支文明正在发展全然不同的数学传统。

《九章算术》成书于汉代,集结了先秦以来的数学知识。翻开这本被历代作为教科书使用了一千多年的著作,扑面而来的是浓厚的实用气息。方田、粟米、衰分、少广、商功、均输、盈不足、方程、勾股,九章,二百四十六个应用问题,覆盖了农业、工程、贸易、税收的方方面面。

没有公理,没有定义,只有问题和解法。这是一种彻头彻尾的算法思维:不是要证明什么,而是要算出什么。

令人惊异的是,《九章算术》中方程章的“直除法”等同于今天的高斯消元法,而这一方法在西方要等到十八、十九世纪才被系统地提出。还有一个更惊人的事实:在盈不足章中,解决非线性方程的方法,实质上蕴含了后来西方所称的“试位法”,可以在没有任何符号代数的情况下处理相当复杂的数值问题。

中国人发明了负数。在《九章算术》的方程章中,当方程组的系数出现亏损时,用“负”来表示,用红色算筹区分正负,这比印度人使用负数还早了数百年,比欧洲人接受负数更是早了一千多年。当十七世纪的欧洲数学家还在争论负数是否有意义时,中国的算学家早已对它们习以为常。

但这中间横亘着一个巨大的差异:中国古人从未发展出形式化的证明体系,希腊式的演绎结构在他们的数学传统中几乎不存在。于是问题浮现:什么是数学?是解决问题的技术,还是证明真理的体系?这一争论至今仍在回荡。

视线越过葱岭,印度的数学家们正在从事一项将改变世界的创造。

公元前后的印度河流域,数字符号已经出现。但真正的突破发生在公元后的几个世纪里:位置记数法的诞生,零的发明,以及符号代数的初步形态。

在所有的数字发明中,零是最晚到来的。它迟到了数千年,因为人类难以理解一个表示“无”的符号为何具有如此强大的力量。是的,零代表没有,但把它放在某个数字后面,数字就翻了十倍。这个悖论般的概念,空作为占位符,是印度数学最伟大的创造。

婆罗摩笈多在七世纪写下了关于零的运算规则:一个数加零等于它本身,一个数减零等于它本身,一个数乘以零等于零。但他也犯了一个著名的错误,声称一个数除以零等于零。这一错误恰恰展现了零带来的概念困难。即便对那个时代最杰出的数学家,虚无的运算依然是思想的暗区。

在符号代数的方向上,印度人超越了所有前辈。婆罗摩笈多和后来的婆什迦罗第二用缩写的词语来表示未知数,处理二次方程、一次不定方程,甚至触及了某些高等方程的解法。他们将希腊人的几何和巴比伦人的算术融合,走出了一条新路。

以零为圆心,印度数学的涟漪向外扩散,首先抵达了阿拉伯世界。

巴格达的智慧宫,八世纪至九世纪。在阿拔斯王朝哈里发的庇护下,来自不同文明的学者汇聚于此,将希腊、印度、波斯的典籍翻译成阿拉伯语。花剌子模,这个名字后来演变成“算法”(algorithm)一词的数学家,在这里写下了《代数学》,书名中的al-jabr日后化作“代数”(algebra)一词,传遍世界。

花剌子模的代数学仍然是用文字表达的,没有现代符号系统,但他系统化了一次和二次方程的解法。有趣的是,他始终将方程的解与几何验证联系在一起,这是希腊传统的延续。代数与几何在他手中尚未分离。

奥马尔·海亚姆,今天更多以波斯大诗人身份被人铭记,他的《鲁拜集》中那些关于酒、命运和当下的诗篇,至今仍触动着读者。但在数学史上,他有一个更深刻的位置:海亚姆用圆锥曲线解决了三次方程的几何解法。这是希腊圆锥曲线理论与阿拉伯代数的融合,在一个诗人和数学家身上达到了精妙的平衡。

阿拉伯数学家的贡献远不止于保存和传递。他们系统发展了三角学,建立了完整的六种三角函数,编制了精确到秒的正弦表。他们还批判地审视了欧几里得的平行公设,试图从其他公理中证明它,这一努力虽然在当时失败了,但其留下的质疑最终在十九世纪催生了非欧几何的诞生。

所有这一切,巴比伦的六十进制、埃及的几何、希腊的逻辑证明、中国的算法、印度的零和位值制、阿拉伯的代数,如同溪流汇聚,最终都汇入了一条大河:近代欧洲数学。

十三世纪,比萨的列奥纳多,世人通常称他为斐波那契,游历了地中海世界,接触到了阿拉伯数学,随后写下了《算盘书》。书中开篇便是一个关于兔子繁殖的问题,由此引出的数列后来以他的名字命名:1,1,2,3,5,8,13,21。每一项都是前两项之和。这个简单的递归关系,隐藏着令人屏息的数学结构,它出现在松果的螺旋中,出现在向日葵花盘的排列里,出现在不同领域的种种意想不到之处。

斐波那契数列所揭示的,或许正是数学最深层的秘密:表面的简单之下潜藏着不可思议的深度,而美恰恰存在于这种简单与复杂的张力之间。

斐波那契之后四百年,欧洲缓慢消化着来自东方的数学营养,直到文艺复兴催生出爆发式的进步。符号代数的成熟、微积分的发明、解析几何的诞生,近代数学的辉煌序幕终于拉开。

但在此之前,那一块块来自巴比伦的泥板、一卷卷埃及的纸草、一片片刻满算题的竹简、一张张泛黄的梵文手稿,静静地讲述着一个被现代人遗忘的事实:数学从来就不是某一文明的孤芳自赏。它是全人类共同编织的一张网,每一个文明都在其中添加了独特的线缕,有的精细,有的粗犷,有的凌乱,有的优美。

而这些古老的数学,它们并未真正死去。六十进制仍在我们的钟表上跳动,埃及的单位分数正在现代数论中间接复活,中国的盈不足术在算法设计中找到新的生命,印度的零在每个数字设备的深处静静地占据着位置。

数学的骨骸埋在时间的沉积岩中,等待着一代代人去发掘。而每一次发掘,都在改写我们对自己智力史的理解,我们远比想象中的自己更古老,也更智慧。

---

第一章 两河之间的算者:美索不达米亚数学的黄金密码

泥板上的宇宙

大英博物馆的恒温储藏室里,编号YBC 7289的泥板静静地躺在定制的无酸纸盒中。它只有巴掌大小,表面因几千年的埋藏而呈现出温暖的赭褐色。在普通观众看来,它不过是一块刻着几条线和几个符号的古老土块。但在数学史家眼中,这块公元前1800年左右的泥板,是人类心智的一座里程碑。

泥板的制作者没有留下姓名。他只是一名普通的书吏,在底格里斯河与幼发拉底河之间的某个城市里,日复一日地抄写着数学用表,为神殿和宫殿计算账目。但在某个时刻,他拿起尖笔,在湿润的黏土上画下了一个正方形,两条对角线,以及一行用楔形文字书写的数字。

那行数字用现代数学符号转译过来,是1.41421296,根号2的近似值,精确到小数点后六位。

这意味着什么?大约一千二百年后,毕达哥拉斯学派才证明正方形的对角线与边长不可通约。而在这块泥板上,有人已经算出了这个不可通约量的高精度近似值。他们或许不理解“无理数”这个概念,希腊人同样为之困惑了几个世纪,但他们至少在操作层面掌握了它。

但这远非全部。在耶鲁大学收藏的巴比伦泥板中,编号Plimpton 322的文物曾长期被误解为一份商业账目,直到二十世纪中期,数学家才发现它实际上是一张完备的勾股数表,比毕达哥拉斯早了一千多年。

这张表列出了十五组满足a²+b²=c²的整数,排列顺序显示出制表者对三角学的深刻理解。第一列的数据没有任何实用价值,它们是极其精确的平方比的序列表,这暗示着,这些古代数学家进行数学活动时,并非总出于实际需要。他们也在玩味数字本身的美,追求理解的纯粹乐趣。

六十进制的宿命

为什么是六十?为什么最古老的文明会选择这样一个看似古怪的基数?

答案埋在美索不达米亚的泥土和贸易中。最早的计数方式很可能与人体有关:十根手指,十进制自然而然。但在更复杂的社会运作中,分配土地、计划劳力、分割遗产,十进制显示出明显的劣势。10只能被1、2、5、10整除,在面对三等分、四等分时立即产生分数。

六十则完全不同。在被1到6的所有整数整除之外,它还能被10、12、15、20、30整除。在一个还没有完善的分数理论的世界里,六十进制的选择,就像在崎岖的数学地形上修筑了一条高速公路。

但更深层的原因可能藏在天文观测中。巴比伦人是狂热的观星者,他们发现太阳在天球上每天移动约一度,一年移动约三百六十度,于是将圆周分为360度,每度60分,每分60秒。当圆周被这样划分之后,他们自然地将同样的六十进制应用到了所有需要精细计算的领域。

这一选择穿透数千年的时光,刻进每一个现代人的日常生活。当你抬腕看表,秒针跳过的那一小格,便是美索不达米亚留给时间的印记。

书吏的技艺

在古巴比伦的埃杜巴,书吏学校,里,学生们从幼年起便开始接受严格的数学训练。他们背诵乘法表、倒数表、平方表、立方表、平方根表,用尖笔在黏土板上反复演算,直到每个数字都刻进肌肉记忆。

出土的练习泥板显示,他们的课程从简单的算术开始,逐渐过渡到更复杂的问题:田地面积计算、沟渠开挖的土方量、砖墙所需的砖块数、根据工作天数分配的工资。这些都是日常生活需要的实用数学。

但有些问题显然超越了纯粹的实用性。

一块泥板上记载着这样的问题:“我找到一块石头,但未称其重量。后来我加上另一块重量为其七分之一的石头,再加上重量为其十一分之一的石头,称得总重量为一马那。求原来石头的重量。”

这个问题可以翻译为代数方程:x + x/7 + x/11 = 1。将分数通分,得到77x/77 + 11x/77 + 7x/77 = 1,即95x/77 = 1,x = 77/95马那。

书吏不仅算出了答案,还以六十进制精确表达了结果,并附上了验算过程。这绝非简单的日常计算,这是相当纯熟的代数技巧。

另一块泥板更是让人惊叹。它要求解一组两个未知数的方程,等价于现代方程:x+y=10,xy=21。书吏的解法是将问题转化为求解x和y分别是二次方程z²-10z+21=0的根,然后正确地给出了7和3作为答案。

没有符号代数,没有变量表示法,没有,却将问题转换为现代意义上的标准形式。他们的思维工具只有具体数字和一套成熟的算法流程。但正如现代认知心理学所揭示的,符号只不过是思维的支架,真正的理解发生在更深的结构层面。

借贷、复利与指数增长

利息计算是书吏最日常的工作之一。神殿和宫殿发放种子贷款给农民,秋收时农民归还本金加利息,利率通常为三分之一,是的,年化利率高达33.3%。在这样的经济环境中,掌握复利计算便成为书吏的关键技能。

一块来自拉尔萨的泥板记录了这样一个问题:“某人在祭司处存了多少银子,年利为20%,按复利计算,五年后本息总和为1吉努?”

这相当于求解本金:P×(1.2)⁵ = 1。

现代人拥有一套完整的指数和对数工具来处理这类问题,但巴比伦书吏只能用他们的数字表和插值技术。他们查阅自己的倒数表、乘方表,反复逼近,最终给出精确到多位的答案。

更为复杂的是反向问题:已知本金和最终本息,求经过的年数。这涉及到更复杂的插值计算,有些书吏甚至会使用一种近似对数的技术,比纳皮尔发明对数早了三千年。

这让人联想到一个更大的问题:巴比伦人是否隐约触摸到了指数函数的性质?他们是否理解指数增长与线性增长的本质区别?泥板上的蛛丝马迹表明,他们至少在实践中感知到了这一区别,复利产生的利息总是超出单纯按年数乘以利率的结果,他们明确记录了这一“超额”部分,并发明了专门的术语来描述它。

远方的回响

当我们将巴比伦数学与后来的希腊数学并置,一个有趣的对比浮现出来。希腊人追求证明、追求普遍性、追求确定性,却始终无法摆脱对无理数的恐惧。巴比伦人满足于近似、满足于算法、满足于用六十进制降低分数的出现频率,却在操作层面平稳地处理着那些希腊人认为不可言说的量。

这是两种不同的数学气质:一种是证明的气质,一种是计算的气质;一种追问“为什么”,一种解决“怎么办”。

现代数学其实同时需要两者。没有证明,数学失去确定性;没有计算,数学失去实用性。而早在四千年前,这些互补的倾向已经在底格里斯河与幼发拉底河之间的泥板上初见端倪。

泥板沉睡在博物馆的黑暗储藏室中,但它们的数学并未死去。六十进制在我们的钟表上运行,插值法化作现代数值分析的基础算法,二次方程的求解公式,尽管我们今天称之为“二次公式”并用√b²-4ac的符号表达,其核心算理早已在那位无名书吏的尖笔下完成了。

当我们今天在课堂上推导这个公式时,我们其实正在重走一条四千年前在美索不达米亚的泥土上走出的小径。那条小径早已被遗忘在历史的风沙中,但路径仍在,印在人类心智最深的岩层上,只要顺着数学的逻辑走下去,任何人都会抵达同样的地方。

这或许就是数学最深的神秘之处:它似乎先于人而存在,像一个等待被发现的隐藏大陆,不同文明、不同时代的水手们从不同方向航行,先后登陆在同样的海岸上。而美索不达米亚的书吏,是最早登上那片大陆的探险者之一,他们用楔形文字在泥板上刻下的,是人类的第一张航海图。

---

第二章 尼罗河畔的测量者:古埃及的实用几何宇宙

纸草书中的智慧

莱因德纸草书以它的一位近代拥有者命名,但它的真正作者是一位名叫阿梅斯的书吏,活跃于公元前1650年左右。他谦逊地在卷首写道,这本纸草书是“探究事物、认识一切存在、破解所有奥秘的指南”,但紧接着又承认,这只是一部根据更古老文献(约公元前2000年)编纂的数学手册。

纸草书长逾五米,宽三十三厘米,文字用僧侣体象形文字书写。开篇便是一张占据了大半篇幅的表格:将2除以奇数(从3到101)的结果表达为单位分数之和。例如,2/3=1/2+1/6,2/5=1/3+1/15,2/7=1/4+1/28,以此类推。

为什么要这样做?为什么古埃及人坚持这种看似笨拙的分数表达方式?

一种解释是,这与他们的计量制度有关。古埃及的基本长度单位是肘尺,其下分为7掌、28指。在这个体系下,将一个量均分为28份是极自然的事,而将非均分的部分表达为这些等分的组合,也是日常生活的实际需要。

但更深层的原因,可能隐藏在古埃及人对“公平分配”的执着中。在分割面包、分配土地、配给口粮时,单位分数对应着最简单的实物操作:将一块面包分成相等的几份,每个人取其中一份。单位分数是“公平分割”的数学表达。

这种分数体系塑造了埃及数学的独特思维模式。在没有现代通分技术的情况下,埃及书吏发展出了高度精巧的分解技巧,寻找最优的单位分数组合。研究表明,莱因德纸草书给出的分解方案,常常是在无穷多种可能的单位分数表示中,选择了项数最少或分母分布最均匀的那一种。这已经带有了现代意义上“最优化”的意味。

几何学:测量大地的艺术

尼罗河每年泛滥,淹没田地,退去后留下肥沃的淤泥,也抹去了田界的标志。法老的土地测量员们,他们叫“牵绳者”,需要重新划定边界。他们手里拿着打了等距绳结的绳索,这绳索就是他们的测量工具,也是后来3-4-5直角三角形用于构造直角的最早来源之一。

埃及人知道,将绳子分成12等份,然后构成一个三边分别为3、4、5的三角形,最大角必定是直角。这个3-4-5三角形在后世的建筑和测量中被反复使用,远在毕达哥拉斯证明其背后的普遍原理之前。

几何学一词的希腊文原意正是“土地测量”。当希腊人后来从埃及人那里学习数学时,他们把这种实用的测量技艺抽象成了理论体系。但在抽象之前,首先是实践。

莱因德纸草书中包含了许多几何计算问题。第49题求一个长宽各为10和2的矩形面积,第50题求一个直径为9的圆面积。后者尤为引人注目:书吏给出的解法是,从直径中减去其九分之一,将结果平方。即:面积≈ (d - d/9)² = (8d/9)²。

将这个公式与准确的圆面积公式πd²/4比较,可以得出埃及人所用的π近似值: (8/9)² × 4 = 256/81 ≈ 3.1605。这不是一个糟糕的近似,误差仅为0.6%。

更惊人的是,埃及人还计算了截头金字塔的体积。莫斯科纸草书第14题要求计算一个底面为正方形(边长4)、顶面为正方形(边长2)、高度为6的截锥体积。书吏给出的解法完全正确:V = (a² + ab + b²)h/3,其中a和b分别为下底和上底的边长。这个公式在将近四千年后仍然正确。

这些知识是如何获得的?是纯经验积累,还是有其理论推导?莱因德纸草书中没有给出任何证明或推导过程,只有“这样做”的指令。但问题的复杂程度已经远远超出了单纯经验所能达到的水平。埃及的书吏们必定在口传心授中传承着某些未经写下的理解。

金字塔中的数学密码

吉萨大金字塔,建于公元前2560年左右的胡夫金字塔,至今仍是人类最宏伟的建筑之一。它动用了约二百三十万块巨石,总重约六百万吨,底边各长约230米,误差不超过几厘米。这样的精度在现代技术条件下都不易达到,在没有光学仪器、没有钢铁工具的古埃及,更是一个工程奇迹。

金字塔的几何构造中隐藏着精妙的数学。它的斜面倾角约51度52分,周长与高度的比值非常接近2π,这引发了无数学者的猜测:这是有意为之,还是巧合?

支持有意论的证据是:如果金字塔的设计者想让周长除以高度等于2π,他们只需将倾角设为51度50分,几乎等同于实际测量的51度52分。而巧合论的论据也同样有力:埃及纸草书中从未提及π的概念,他们处理圆形用的是那条“减去九分之一后平方”的规矩。

但即便π是巧合,金字塔其他方面的数学精度也足以令人惊叹。底边近乎完美地指向四方,各边的长度差异微乎其微。根据古罗马作家普林尼的记载(虽然可能有所夸张),工匠们甚至用水来校平基岩,将沟渠灌满水,水面天然的平坦就是最精确的水平仪。

工程背后的数学知识,必定是由埃及的测量师和建筑师严密保守的专业秘密,它们就像金字塔内部的墓道一样,不为外人所知。当希腊人后来宣称向埃及人学习了几何学时,他们所学的或许只是冰山浮出水面的一部分。

天文学中的数学印迹

埃及人的历法是一年365天,没有闰年。这个长度略短于实际的回归年(约365.2422天),因此每四年历法就会落后实际太阳位置约一天,约1460年完成一个完整循环。这个被称为“索西斯周期”的现象,被罗马历史学家记录了下来。

奇妙的是,尽管埃及人清楚地观察到天狼星偕日升(天狼星在与太阳相同方向升起的日子,标志着尼罗河泛滥的开始)在缓慢地相对于历法漂移,他们却从未修正历法,直到托勒密时期才引入闰年。为什么?

一种可能的解释是:均匀的365天历法在计算上极为方便。将一年分为12个月,每月30天,外加年末5个节日。这个整齐的结构使得任何日期都可以直接转换为距某个起点的天数,大大简化了历法计算。对于可能需要处理跨越数十年、数百年记录的书吏来说,固定的年长比天文学准确更实用。

正是在这样的实用需求下,埃及人发展了精巧的日历算术。他们计算某个节日在未来某年落在哪个季节,计算两件相隔多年的事件之间相隔的天数。这些计算涉及大数的乘除,促使他们不断优化数字技术。

与两河流域的异同

将埃及数学与巴比伦数学并置,几种差异清晰可见。

巴比伦人使用六十进制,热爱倒数表和乘法表,将数字置于他们数学观的核心。埃及人使用十进制,重心在几何和应用问题上。两种传统之间的对比,让人想到后来算法与证明、计算与演绎之间的持久张力。

但两种传统也有深层的相似之处。两者都是书吏阶层的专业知识,通过师徒相授代代传承。两者都紧密服务于国家机器,税收、工程、历法、军队后勤。两者都没有发展出严格的证明概念,满足于“如何得出正确结果”而不过问“为什么结果正确”。

这种不问“为什么”的传统,加上相对封闭的传承体系,或许正是它们数学发展的瓶颈。当知识只能由少数特权者拥有,当方法只需要记住步骤而不需要理解原理,数学的疆域便受到限制。

但这个瓶径的破裂需要等待希腊人的到来,他们在尼罗河口建立了亚历山大里亚,将巴比伦的计算术与埃及的测量术融合在一起,然后注入了全新的元素:严密的逻辑证明。

正是这种融合,将数学从一门工匠技艺升华为一种普遍的真理。

而当我们今天在课堂上学习几何时,那些涂抹在黑板上和作业本上的直线与圆,那些被仔细论证的定理和公式,都携带着尼罗河畔“牵绳者”们在灼热阳光下丈量大地的远古记忆。数学的进步从来不是对过去的抛弃,而是一层层累积,旧的知识化为新结构的地基,永远支撑着向上的探索。

第三章 恒河的算术僧:印度数学的零度革命

一个符号的降生

公元628年,印度西部城市乌贾因,一位名叫婆罗摩笈多的天文学家正在撰写一部注定要流传千古的著作,《婆罗摩修正体系》。这部用梵文诗偈写成的著作涵盖天文学与数学,其中有一节,只有短短几行,却蕴含着人类数学史上最伟大的突破之一。

他用梵文写道:“正数除以正数、负数除以负数,结果为正数。正数除以负数、负数除以正数,结果为负数。零除以零,结果为零。”

这段话中包含了历史上第一次将零作为运算对象的明确记载。尽管最后一条规则,零除以零等于零,被证明是错误的,但这丝毫不减损它的开创性。婆罗摩笈多在做一件前无古人的事:将“无”当作“有”一样来运算。

零的诞生比人们想象的要艰难得多。人类用了数千年才接受它,不是因为发明零需要多么高深的智慧,恰恰相反,是因为它太过基础,基础到人们视而不见。当牧羊人清点羊群,当商人结算账目,哪里有“没有”的位置?计数是为了清点存在的,而不是为了记录空缺的。

然而,这个空缺本身,恰恰是数字系统得以迈向下一个层次的关键。

在零出现之前,人类各文明都摸索出了自己的记数方式。巴比伦人在泥板上用不同的楔形符号区分位值,比如1、60、3600的位置用同一个符号,但在这位系统发明后一千多年里,他们没有想出用专用符号表示空位的方法。当需要表示空位时,他们就留出空白。这就产生了巨大的歧义:两个数字之间的空白,是一个空位还是两个空位?没有符号来区分。

公元前三世纪左右,巴比伦书吏开始使用一个专门的符号,两个小楔形,来表示空位。但这只出现在数字的中间位置,从来不出现在数字的末尾。他们似乎无法接受一个数字以“无”结尾。这个符号也从未被用于运算,它只是标记空缺的占位符,而非真正意义上的数。

埃及人没有位置记数系统,因此没有发明零的需要。他们的百万、十万各有单独的象形符号,就像罗马数字中的M、C、X一样,每个量级拥有独立标记。希腊人继承了这种模式,并用字母来表示数字,同样不需要零这种占位符。他们甚至不知道有此需要。

中国在春秋战国时期就使用了算筹,这是一种位置记数,红筹表示正数,黑筹表示负数,空位就是没有算筹。这种空位表零的方式与巴比伦早期如出一辙,但中国人始终没有赋予空位一个独立的书写符号,直到印度数字传入之后。

玛雅人独立发明了零。在他们的历法计算中,零被描绘成一枚贝壳或一只半闭的眼睛。然而这支文明与欧亚大陆隔绝,他们的零没有进入世界数学的主流。

于是,光荣归于印度。公元五世纪左右,印度西北部开始出现书写的零,一个圆点或小圆圈。起初,它与巴比伦的占位符并无本质区别。但在接下来的几个世纪里,印度数学家完成了最关键的一步:将这个符号视作完全的数,纳入运算体系。

这一步,是零真正的诞生。

位值记数法的秘密

今天的学童学习十进制位置记数法时,几乎感觉不到它有何特别之处。十个数字,排成一列,每个位置代表十的不同方次,这有何难?但这种熟悉感本身就是一个巨大的文化成就的证据:我们的文明已经将这种记数法内化到了无意识的程度,以至于它看起来“自然”。

它一点都不自然。在人类计数史的前百分之九十九的时间里,全世界的人都在使用非位值记数法,埃及的象形数字、希腊的字母数字、罗马的字符数字,每一种都独立创造各自的符号来表示十、百、千。要写下一个大数,这些系统需要一系列繁复的符号组合。罗马数字中,3888写作MMMDCCCLXXXVIII,十三个字符挤在一处,无论是阅读、书写还是运算,都极其不便。

印度位值记数法改变了一切。十个符号,0到9,就足以表达任何数字,无论多大。这种记数法使得算术运算可以被程式化,按照规则一步步执行,无需任何创造力。加法、减法、乘法、除法都有了标准化的步骤,可以教给任何学童,甚至可以交由机器执行,虽然机器要到一千多年后才被发明。

印度数学家自己完全意识到了这种记数法的优越性。七世纪的婆罗摩笈多将位值系统比作太阳的光芒:“正如太阳以其光辉使群星黯然失色,位值记数法也是一样,它使所有其他算术黯然无光。”

这种记数法从印度向外传播的路径,是一条数学丝绸之路。八世纪,阿拔斯王朝的哈里发曼苏尔接见了一位来自印度的使团,使团呈上了一份包括数学文献的礼物。阿拉伯学者立即认识到了这九个数字加一个零的力量。花剌子模在公元825年写下了专文介绍“印度数字的计算法”,这本书传入欧洲后,这些数字被误称为“阿拉伯数字”。

欧洲的接受过程极其缓慢。十世纪,法国学者热尔贝,后来的教宗西尔维斯特二世,从西班牙的阿拉伯学者处学习了这种数字,但未能推广。十三世纪,斐波那契在他的《算盘书》中系统地介绍了印度-阿拉伯数字,但他的呼吁落在了聋子的耳朵上。此后数百年,欧洲的商业继续使用罗马数字和算盘。直到十五世纪印刷术兴起之后,印度-阿拉伯数字才逐渐取代了旧系统。

反对的声音从未停止。1299年,佛罗伦萨颁布法令,禁止银行家使用“阿拉伯数字”,理由是它们容易被篡改,0可以被改为6或9,1可以加一笔变成7。更深的阻力来自文化心理:旧系统的用户已经将其内化,学习新系统需要耗费心力,而旧方法“明明也能用”。

这就是为什么人类花了将近一千年才普遍接受位值记数法,不是因为新方法不够好,而是因为旧方法的惯性太过强大。在数学史上,类似的故事一再上演:最好的想法往往不是立即获胜的,它们需要等待一代代的怀疑者退出舞台。

符号代数的雏形

印度的代数传统始于何时,难以精确界定。最早的线索出现在三、四世纪左右的巴克沙利手稿中,这份发现于白沙瓦附近的手稿写在桦树皮上,已经严重残损。但它保留了相当数量的数学问题,其中一些已经使用了未知数的缩写符号。

这是突破性的。此前,所有文明在处理未知数时都使用日常语言,“一堆”、“某数”、“所求之数”。巴比伦人写“我找到一块石头”,而不写“设x为石头的重量”。希腊人用几何线段来表示未知量,将代数问题转化为几何问题,这是他们避开无理数的策略,但也限制了代数的独立发展。

印度数学家开始用缩写的梵文词语来表示未知数。婆罗摩笈多用“yā”(来自“yāvat-tāvat”,意为“若干”)来表示第一个未知数,用不同的颜色词,kā(黑)、nī(蓝)、pī(黄),表示更多未知数。这些缩写出现在梵文诗句中,挤在韵律的格子里,逐渐从文字符号演变为真正的代数符号。

七世纪之后,印度代数继续发展。婆什迦罗第二,十二世纪最杰出的印度数学家,在他的《历数精粹》中处理了极其复杂的代数问题。他能够求解多达五个未知数的方程组,处理二次不定方程,并讨论了正根、负根的意义。他清楚地知道二次方程可能有两个根,但他总是根据具体情境判断哪个根有意义,而不会像后世欧洲数学家那样将负根简单地当作“荒谬的解”抛弃。

印度代数并未达到完全符号化。未知数的幂次仍用文字缩写表示,例如“va”(来自varga,平方)表示平方,“gha”(来自ghana,立方)表示立方。方程仍然写在诗偈中,受到格律的约束。但正是在这种约束下,印度数学家磨炼出了令人惊叹的思维敏捷性,将复杂代数关系压缩进八个音节的诗句,需要何等深刻的洞察力!

三角学的恒河

希腊人发明了弦表,给定圆心角,求对应的弦长。这是三角学的起源,但希腊人止步于此。

印度数学家走出了决定性的一步:他们用半弦代替了全弦。这个看似微小的改变,实际上是三角学的真正起点。全弦取决于圆的半径,半弦则抽象为对角度的函数,这就是现代正弦函数的直系先祖。

印度人的正弦不是今天我们熟悉的比值,而是一个长度。他们将圆周分为360度(此点继承自希腊),将半径分为3438等份,这是因为2πr≈21600,除以360得到60,而半径r对应的半弦在长度上约等于3438。这个数字的选择是为了与圆周360度兼容,使得一度对应的弧长接近整数。

无论如何,印度数学家编制了极其精确的正弦表。婆罗摩笈多在七世纪使用二阶差分插值法来计算任意角度的正弦值,这一技术直到十七世纪才在欧洲被重新发现,后来演变成牛顿和斯特林的研究。

更为惊人的是,十五世纪的喀拉拉学派,印度数学最后的高峰,发现了正弦和余弦的无穷级数展开式。尼拉坎塔在《坦陀罗集要》中给出的正弦级数,与欧洲的格雷戈里级数(十七世纪)完全一致。马德哈瓦,喀拉拉学派的奠基者,更是通过无穷级数计算出了π的值到小数点后十一位。

这些成就属于数学史上最激动人心的篇章之一,但它们长期不为人知。喀拉拉学派的作品以马拉雅拉姆语写成,在当地流传,几乎没有被翻译成其他语言。当欧洲数学家独立发现同样的级数时,他们对印度的工作一无所知。

印度数学最终没有自行走向现代。原因何在?

一个常见的答案是缺乏演绎证明的传统。印度数学家很少像欧几里得那样从公理出发进行严格的逻辑推导。他们的著作由问题和解法构成,即使解法中包含深刻的推理步骤,这些步骤也未被明确标出为“证明”。当一代大师去世后,他的传人学习的是方法,却未必能抓住方法背后的逻辑结构。这使得印度数学始终是能人技艺,而非累积学科。

另一个原因是社会结构。印度的数学知识在婆罗门种姓的天文学家中传承,与世俗社会脱节。它服务于历法制作和星象推算,却从未向下渗透到商人、工匠、账房先生的手中。当欧洲的数学在文艺复兴后迅速向全社会扩散时,印度的数学知识仍然锁在少数家族的书库里。

但零已经降生。它从印度出发,穿越阿拉伯世界,最终抵达欧洲,成为现代科学语言中最基本的语素。在每一个写着0的银行余额里,在每一个表示“无”的空占位符中,都躺着一个恒河之畔的古老灵魂。

---

第四章 智慧宫的星辰:阿拉伯数学的炼金术

巴格达的翻译运动

公元762年,阿拔斯王朝的第二任哈里发曼苏尔选定底格里斯河畔的一座古老村落作为新都。传说他亲自勘察了地形,命人在此建起一座圆形城市,城墙有四座城门,分别朝向巴士拉、库法、大马士革和呼罗珊。他将其命名为“和平之城”,巴格达。

六十年后,曼苏尔的曾孙马蒙哈里发做了一件事,这件事将在人类智力史上留下不可磨灭的印记。他梦见了一位白发苍苍的老者,亚里士多德本人。在梦中,亚里士多德告诉他,天启与理性并不冲突,真理是统一的。梦醒之后,马蒙立即命人搜寻希腊典籍的抄本。

拜占庭皇帝,当时的敌对国君主,竟也配合了这项事业。马蒙向君士坦丁堡派出使团,带着黄金和珍奇异宝,换回了一批批希腊文、叙利亚文、波斯文的科学文献手稿。这些手稿被运回巴格达,堆积在一座马蒙专门设立的机构里。这座机构,就是后来名垂史册的“智慧宫”。

智慧宫并非单纯的图书馆。它同时是翻译院、研究院和天文台。马蒙聘请了操着不同语言、信仰不同宗教的学者,穆斯林、基督徒、犹太教徒、琐罗亚斯德教徒,在这里集体工作。他们将希腊语的天文学、数学、医学著作翻译成阿拉伯语,将波斯语和梵语的典籍转译过来,让巴格达成为八至十世纪人类知识的汇聚点。

这场翻译运动持续了超过两百年。最初只是零散的个人行为,后来变成国家支持的制度化学术工程。翻译家的名字至今仍被传颂:侯奈因·伊本·伊斯哈格,一位聂斯脱利派基督徒,他的翻译以准确精到著称,据说他走遍美索不达米亚寻找亚里士多德著作的最佳抄本;萨比特·伊本·库拉,一位来自哈兰的星教徒,他不仅翻译了阿基米德、阿波罗尼乌斯的几何学著作,还对欧几里得《几何原本》的阿拉伯语版本进行过重要的修订。

到九世纪末,欧几里得、阿基米德、阿波罗尼乌斯、丢番图,这些希腊数学巨擘的主要著作都已有阿拉伯译本。托勒密的《天文学大成》,希腊天文学的集大成之作,同样被翻译过来,阿拉伯人称之为《圣大论》。婆罗摩笈多和阿里亚巴塔的印度天文学著作也被引入。一场人类历史上罕见的智力融合正在发生。

花剌子模的代数革命

智慧宫中有一位年轻学者,他的全名是穆罕默德·伊本·穆萨·花剌子模,这个名字的后半部分表明他来自中亚的花剌子模地区(今乌兹别克斯坦境内)。他的一生,大部分时间在巴格达度过,担任智慧宫的首席天文学家。

公元820年左右,花剌子模完成了一本小书,书名为《还原与平衡之书简编》。阿拉伯文书名中的“还原”一词是al-jabr,“平衡”一词是al-muqābala。第一个词日后传入欧洲语言,演变成“algebra”,代数。

花剌子模的开场白在今天读来仍然令人感动。他写道:“我一直在思考人们日常计算中所需的各类问题。我发现所有的计算问题最终都可以归结为某一类问题,即从某些已知量出发求出未知量。”他接着说,他发现了解决这些问题的一套系统方法,并将它写入此书,以使所有人都能掌握。

这套方法针对的是我们今天称为一次方程和二次方程的问题。花剌子模将二次方程分为六种标准类型,每种都附有解法。他使用的是文字,不是符号,在他的书中,未知数被称作“物”,未知数的平方被称作“财产”,常数被称作“数”。一个简单的方程x²+10x=39,在他笔下被表述为:“一个财产加上十个它的根,等于三十九。”

他的解法是这样的:将根的系数(10)取半,得5;将5平方,得25;将常数项(39)加上25,得64;取平方根,得8;减去取半的那个数(5),得3,这就是“物”(即x)的值。

这实际上就是今天通用的二次方程求根公式的一个特例。花剌子模不仅给出了步骤,还为每一种情况提供了几何证明,将代数步骤转化为面积图示,用欧几里得式的逻辑来验证代数运算的正确性。这一手法透露出他的知识谱系:代数方法来自印度和巴比伦,而证明方法来自希腊。

书中的问题大多是实用的:遗产分割、土地丈量、商品交换。花剌子模的代数尚未脱离日常生活,但它已经迈出了关键的一步:将形形色色的实际问题提炼为几种标准方程,找到了通用的解法公式。

这一步看似平常,实则石破天惊。数学的本质是从具体中抽象出一般模式,而花剌子模是第一个明确写下二次方程通用解法的人,不是针对某几个特例,而是针对所有可能的系数组合。从此,面对二次方程,人们不再需要每一次都即兴发挥,只需要按部就班地套用公式。

这就是算法的力量。而“算法”一词,恰恰来自花剌子模名字的拉丁化转写,Algorithmi。

天文学驱动下的三角学

伊斯兰文明的数学发展,很大一部分是被一个实际需求所推动的:确定祈祷方向。

穆斯林每天五次朝向麦加祈祷,清真寺的朝向必须精确对准麦加的方向。这意味着,在从西班牙到中亚的广袤土地上,每一座新建的清真寺都需要根据当地的经纬度计算麦加的方向。这不是简单的几何问题,地球是球面,方向是球面上的角度。

解决这类问题需要球面三角学。而球面三角学需要平面三角学的工具,正弦、余弦、正切、余切,以及一套精确的三角函数表。

阿拉伯数学家将希腊的弦表(给出圆心角对应的弦长)改造为印度式的正弦表(给出半角对应的半弦长),并大大提高了精度。九世纪的哈班·伊本·哈巴什为每个弧分都计算了正弦值,相差不到百万分之一。

但真正的突破发生在十世纪。一位名叫阿布·瓦法的数学家写了《书中的完美技艺》,其中明确引入了正切、余切、正割、余割的概念,并建立了六种三角函数之间的关系。他证明了正弦定理的球面版本,使之成为解决天球上各种问题的万能工具。

阿布·瓦法还做了一件极具创造力的事:他用固定开口的圆规,锈规,来构造正五边形和正七边形。欧几里得只允许使用理想化的圆规(一旦离开纸面就自动闭合),因此很多作图无法完成。阿布·瓦法证明了,即便圆规的开口被固定不变,也仍然可以完成几乎所有的几何作图。这已经带有了现代工具构造论的萌芽。

三角学在阿拉伯世界从几何学的一个分支逐步演变为独立的学科。十三世纪的纳西尔丁·图西,一位来自波斯的百科全书式的学者,写下了第一部完全不依赖几何、独立论述三角学的著作。他将三角形本身作为研究对象,而不再只是圆的附属品。这是三角学作为独立学科诞生的标志。

平行公设的千年疑云

欧几里得《几何原本》的五条公设中,第五条,平行线公设,从一开始就困扰着读者。其他公设都极简而自明:两点确定一条直线,可以任意延长;以任意点为圆心、任意长为半径可以作圆;凡直角都相等。但第五条平行公设却显得冗长而别扭:若一条直线与两条直线相交,使同侧内角之和小于两直角,则这两条直线在这一侧无限延长后必相交。

这个陈述读起来更像定理而非公理。希腊人自己也嗅到了问题:欧几里得尽可能推迟使用平行公设,直到第一卷的第二十九个命题才首次调用它。这意味着,前二十八个命题根本不依赖平行公设,它们构成了后来所谓的“绝对几何”,一个平行公设真伪未定的世界。

从希腊时代起,数学家们就试图将第五条公设从其他公设中推导出来,证明它不是公理,而是定理。这项工作持续了两千年,参与者包括古星期的托勒密、中世纪的奥马尔·海亚姆、文艺复兴后的诸多欧洲学者。每个人都在重蹈前人的覆辙:自以为成功了,后来才发现论证中暗含了一个与平行公设等价的假设。

奥马尔·海亚姆,今天人们更多因他的四行诗而记住他,在数学史上有另一个身份:平行公设问题的早期攻坚者。他的《欧几里得困难问题详释》详细讨论了这个问题。他的策略是引入一个新的断言:两条汇聚的直线最终必定相交。从这个断言出发,他重新推导了欧几里得的平行理论。可惜他没有意识到,这一断言本身就等价于平行公设。

两个世纪后,纳西尔丁·图西也同样涉足了这个问题。他的论证更为精妙,但仍是一种循环论证。不过,图西留下了一个重要的副产品:他证明了一些今天称为“非欧几何预演”的命题,比如,在平面上给定直线外一点,可以作出多条与给定直线不相交的直线。虽然图西本人认为这是荒谬的而予以排斥,但正是这种“荒谬”的可能性,最终在十九世纪催生了非欧几何。

阿拉伯数学家的平行公设研究,其重要意义不在于成功(他们并没有成功),而在于他们将这个问题保持了两百年不死的热度,并积累了大量不等价替代命题和反证尝试。这些材料后来被翻译成拉丁文传入欧洲,成为现代几何学革命的思想火药。当十九世纪的罗巴切夫斯基和波尔约终于勇敢地否定了平行公设并创立非欧几何时,他们的脚正踩在阿拉伯学者铺就的石阶上。

代数学的独立之路

阿拉伯数学最伟大的遗产之一,是代数学逐渐从几何学中独立出来,获得了自己的身份和合法性。

在希腊传统中,代数问题一律被转换为几何问题来处理。a²被解释为正方形面积,ab被解释为矩形面积,a³被解释为立方体体积。高于三次的量,希腊数学不予承认,因为现实空间只有三维。这种几何化的代数虽然保证了逻辑的严密(因为几何公理被视为绝对可靠的基础),却也给代数思想套上了枷锁。

阿拉伯数学家逐渐挣脱了这些枷锁。花剌子模虽然还在用几何来验证代数步骤,但他的推理核心已经是代数的了,他首先用代数规则来处理方程,然后再附上几何图解作为佐证。到了十一、十二世纪,奥马尔·海亚姆大胆地将代数扩展到三次方程,虽然他的解法仍是几何的(用圆锥曲线相交来求解),但他明确地将代数本身划分为一门具有独立方法的知识。

十二世纪的萨拉夫丁·图西更进一步,他研究了三次方程的解是否可以通过纯粹的代数运算获得,也就是今天所谓的“根式求解”。他没有完全成功(这个问题最终在十六世纪由意大利数学家解决),但他的研究过程本身已经将代数问题视为不依赖几何的纯粹符号问题。

到十三世纪末,阿拉伯代数的符号化程度仍然不高,方程仍用文字表达,但其概念框架已经从几何中解放了出来。这一解放的意义在后来的几个世纪中逐渐显现:当欧洲文艺复兴时期的数学家接过阿拉伯代数的接力棒,他们能够自由地将字母赋值给任何量(包括速度、力的强度、维度超过三的抽象量),不再受几何形象化的束缚。

代数的独立之路,与阿拉伯世界的商业和日常生活需求有着微妙的关系。在继承纠纷中分割复杂的遗产,在商品交换中计算未知的价格,在税收核算中推算总产量,这些每天发生的实际问题催生了对通用代数方法的巨大需求。算法取代证明成为人们最迫切的需要,代数在这种氛围中自然而然地生长。

结语:文明之河的交汇

从巴格达出发,阿拉伯数学的成果顺沿着两条路径进入欧洲。一条经由西班牙,科尔多瓦、托莱多的阿拉伯图书馆在欧洲学者中享有盛名,十二世纪的翻译家(如巴斯的阿德拉德、切斯特的罗伯特)在这里将阿拉伯数学著作翻译成拉丁文。另一条经由西西里和意大利南部,腓特烈二世皇帝对阿拉伯学术深感兴趣,他在宫廷中庇护穆斯林学者,促进了知识的跨文化传递。

斐波那契正是经由第二条路径接触到阿拉伯数学的。他跟随商人父亲游历北非和地中海各港口,在那里第一次见到印度-阿拉伯数字,第一次研读花剌子模的代数学。他在1202年出版的《算盘书》很大程度上是对阿拉伯数学的消化和再创作。书中著名的“兔子问题”产生了一个以他命名的数列,但这个数列其实只占全书的一小部分,《算盘书》的主体是算术、代数、几何和商业数学的系统化论述,是一部阿拉伯数学的拉丁文缩写本。

知识的传播从来不是简单的一对一复制。阿拉伯人在吸收希腊和印度数学时,加入了他们自己的贡献:系统的三角函数、独立的代数学、对平行公设的批判性审视。欧洲人接受阿拉伯数学时,同样进行了再创造:引入更完善的符号系统、将代数与几何重新融合为解析几何、最终在微积分中完成了一次新的数学革命。

智慧宫的灯火早已熄灭。1258年,蒙古大军攻陷巴格达,阿拔斯王朝覆灭,智慧宫的藏书据说被抛入底格里斯河,墨水染黑了河水整整六天。但知识不会被杀戮消灭,它已经散播到了往昔边缘的城市,从那里再传播到更远的世界。数学史的一个永恒教训是:没有任何城市是不可攻破的,没有任何图书馆是不会焚毁的,但被自由心灵所吸收和再创造的知识,终究会寻找到存活下去的路径。

---

第五章 算经九章:古代中国的算法文明

简牍中的数学世界

1983年冬,湖北省江陵县张家山,考古工作者从西汉初年的墓葬中发掘出了一批竹简。在众多法律文书和医书中,有一部题名为《算数书》的文献,总共约两百支竹简,用秦隶写成,抄写年代约在公元前186年左右。这是中国现存最早的数学专书,比《九章算术》的成书还要早约两个世纪。

翻开《算数书》,扑面而来的是一种纯粹实用的气息。分田、均钱、计功、算税、粟米交换,每一个问题都扎根在日常生活的需要中。这部文献没有定义,没有公理,没有证明,只有问题和算法。“法曰”,方法是这样的,然后就是一系列的步骤。执行这些步骤,你就会得到正确的答案。如果答案不对,那是你执行有误,而非方法的问题。

这种风格在中国数学中一以贯之。从《算数书》到《九章算术》,从汉代的《周髀算经》到宋元时期的《数书九章》,中国数学始终保持着一种独特的气质:算法至上。它不是要说服你某个命题为真,而是要告诉你如何快速而准确地得出某个值。

《九章算术》将这种气质发挥到了极致。二百四十六个应用问题,分为九章,涵盖土地测量(方田)、粮食交换(粟米)、分配比例(衰分)、开方开立方(少广)、工程土方(商功)、赋税调配(均输)、盈亏问题(盈不足)、方程组(方程)、勾股定理应用(勾股),中国数学的全部基础,几乎都被囊括在这九个门类之中。

九章中没有任何一章专门讨论“数论”或“纯粹几何学”。所有的问题都有实际背景,都带着泥土和谷物的气息。这绝不意味着中国数学家缺乏抽象能力,恰恰是这种极度实用主义的表象之下,隐藏着极其精妙的抽象结构。

盈不足术:一种普遍的算法策略

《九章算术》第七章名为“盈不足”,专门讨论一类特别的问题:已知两次猜测的结果与真实值的偏差,求真实值是多少。典型的问题是这样的:“今有共买物,人出八,盈三;人出七,不足四。问人数、物价各几何?”

翻译成现代语言:几个人合伙买东西,每人出8文钱,比实际价多出3文;每人出7文钱,比实际价少4文。求人数和物价。设人数为x,物价为y,则有8x-y=3,y-7x=4,解得x=7,y=53。

但“盈不足”术远不止解决这类问题。中国数学家发现,任何涉及一次方程的问题,都可以转化为盈不足形式来处理,只需任意猜测两个数值,根据偏差套用盈不足公式,就可以得到精确解。这是线性插值法,欧洲称之为“试位法”(regula falsi)。

更令人惊异的是,中国数学家还将盈不足术用于解决非线性问题。对于一个诸如x²+x=5.25这类的问题,虽然他们没有符号代数的工具来如此精确地表达,他们也会随便猜两个数,算出实际结果与目标值的偏差,然后按盈不足公式推算x的值。当然,对于非线性问题,这样得出的结果只是近似值。但他们对此心知肚明,并发展出了多次迭代来提高精度的方法。

这与一千多年后欧洲的牛顿-拉夫森法在精神上一脉相承,虽然数学工具简陋得多,但核心思想惊人相似:通过迭代逼近,从近似走向更精确的近似。当巴比伦书吏在用倒数表做插值时,当中国算家在用盈不足术逼近非线性方程的根时,他们都在为一种普遍的数值思维奠基,这种思维在计算机时代成为了绝对的主流。

负数:在盈亏之间

古代数学史上有一个令人费解的现象:人类很早就遇到了“不够减”的情况,却花了数千年才接受负数是一个合理的数学对象。希腊人拒绝负数,丢番图称负根为“荒谬的解”。欧洲人到了文艺复兴时期还在争论负数是否有意义,笛卡尔称负根为“假根”,帕斯卡认为负数减负数为正数“不可理解”。

古代中国是个例外。

《九章算术》“方程”章中引入正负数运算规则时,语气平淡得令人震惊:“正负术曰:同名相除,异名相益,正无入负之,负无入正之。其异名相除,同名相益,正无入正之,负无入负之。”

这实际上制定了正负数加减法的完整规则。同名相除,同号相减,减去绝对值;异名相益,异号相加,增加绝对值;正无入负之,正数遇到零变为负数…… 每一项规则都清晰明确,可以与任何现代教科书的表述媲美。

中国人之所以能如此平静地接受负数,原因或许藏在他们的工具中。中国古人用算筹来计数,红的为正,黑的为负。正数和负数在算筹中有直接的物理对应:红筹与黑筹。你不需要经过复杂的哲学论证来确认负数是否“存在”,它们就摆在你的面前,赤黑分明。当正筹与负筹相遇时,便“相消”,互相对消归零。这种物化的正负观念,使得中国数学在操作层面领先了西方一千五百年。

同样的故事也发生在印度,婆罗摩笈多讨论负数时也相当自如,因为他将负数理解为债务,正数理解为资产。债务当然是存在的,谁没有欠过债呢?这种基于现实经验的数学概念形成路径,与希腊式的理念主义路径截然不同。

大衍求一术:中国剩余定理

公元四世纪,《孙子算经》中有一个著名的“物不知数”问题:“今有物不知其数,三三数之剩二,五五数之剩三,七七数之剩二,问物几何?”

答案是23。这个数字满足:除以3余2,除以5余3,除以7余2。

《孙子算经》给出了一种解法诀窍:三人同行七十稀,五树梅花廿一枝,七子团圆正月半,除百零五便得知。

这段歌诀的意思是:70是除以3余1、除以5和7都能整除的数;21是除以5余1、除以3和7都能整除的数;15是除以7余1、除以3和5都能整除的数。将这三个数分别乘以对应的余数(70×2 + 21×3 + 15×2 = 233),然后反复减去3、5、7的最小公倍数105,得到23。

这个解法看似游戏,实则是极其深刻的数论定理:如果一组模两两互质,那么同余方程组有唯一解(在模的最小公倍数范围内)。

欧洲直到十八世纪才由欧拉和高斯独立重新发现这个定理,高斯在《算术研究》中给出了严格的证明,西方称之为“中国剩余定理”。但在中国,这一理论的高峰出现在十三世纪,秦九韶的《数书九章》中。

秦九韶将之称为“大衍求一术”。这个名字来自《易经》:“大衍之数五十,其用四十有九。”秦九韶解决了一般的同余方程组问题,模不再限制为两两互质。他发明了“求一术”,一个精巧的算法,实质上等同于扩展欧几里得算法,用于在模不互质的情况下找到合适的参数。

秦九韶的“大衍总术”是一套完整的算法程序,他将整个求解过程分为若干步,每一步都有明确的操作规则。这是中国算法数学的巅峰之作:一个纯粹的数论问题,没有任何实际应用前景的数论问题,被用最精巧的算法完美解决。

为什么十三世纪的中国数学家会去研究这个问题?秦九韶自己在序言中给出了部分答案。他说,大衍术可以用于历法计算,而编制历法自古以来就是中国天文学家的核心使命。但《数书九章》中的大衍术题目涉及方位、卦爻、历元、军旅等广阔领域,远不止历法应用。秦九韶似乎在享受纯粹的数学挑战本身,他是一个真正的数学家,而不只是一个应用算术家。

增乘开方法与高次方程数值解

贾宪,十一世纪的中国数学家,做了一件惊人的事。他发明了“增乘开方法”,可以计算任意高次方的根,精度达到任意所需的小数位。

古希腊人能求解的方程限于二次。三次方程要等奥马尔·海亚姆用圆锥曲线来解决,而且只是几何求解。四次以上的方程,欧洲无人触碰,直到十六世纪的费罗和塔塔利亚才开始挑战三次方程,四次方程则在不久后由费拉里解决。五次方程的解法则要等到阿贝尔证明不存在通用的根式解法,那已经是十九世纪了。

但在十一世纪的中国,贾宪已经能够计算任意高次方的根,不是几何作图,不是寻找根式表达式,而是用数值方法逼近到任意精度。这实际上是用迭代法求解方程xⁿ=a。

他的方法极其巧妙。以求四次方根为例:从高位开始估算,确定第一位数字后,通过一套“增乘”程序,逐层乘法,计算出下一步的系数,然后用类似的过程确定下一位数字。整个过程是系统化的,可以教给任何一个掌握基本算术的人来执行,不需要天才般的洞察力。

贾宪的“开方作法本源图”被他的弟子杨辉记录下来,后世人称之为“杨辉三角”或“贾宪三角”,这个三角形的每行正是二项式展开的系数:第一行1,第二行1、1,第三行1、2、1,第四行1、3、3、1…… 在西方,它被称为“帕斯卡三角”,但贾宪比帕斯卡早了将近六百年。

增乘开方法的威力不仅在于求根。它的方法很容易推广到求解一般的多项式方程,不限于xⁿ=a,而是形如a₀+a₁x+a₂x²+……+aₙxⁿ=0的任何方程。宋元时期的数学家确实做到了这一点。秦九韶在《数书九章》中使用增乘开方法求解了高达十三次的方程,精确到所需的小数位。这是多项式方程数值解的古代最高峰。

但与许多中国数学成就一样,这些方法在明清之后被遗忘了。当欧洲传教士在十七世纪将他们的数学带入中国时,连中国学者自己都误以为这些内容全是西来的新知。直到近代,经过李俨、钱宝琮等数学史家的辛勤梳理,宋元数学的辉煌才重新为人所知。

宋元四大家的算法巅峰

十三世纪末,蒙古铁骑驰骋欧亚,南宋流亡朝廷在崖山覆灭。在这个天崩地坼的年代,中国数学却达到了它的古典高峰。杨辉、秦九韶、李冶、朱世杰,后世人合称“宋元四大家”,在战火与动荡中完成了他们不朽的著作。

杨辉的工作是整理和传播。他将贾宪的开方法系统化,编著了通俗易懂的数学教材,用歌诀帮助记忆算法步骤。他关注的是让数学变得可学可教,这在讲究师徒秘传的旧传统中,是一种民本主义的转向。

李冶的兴趣在天元术,用算筹设立未知数建立方程的方法。“天元”是他给未知数起的名字,“立天元一为某物”,设未知数x为某量。他将天元放在筹式中央,上面写正幂次,下面写负幂次,用算筹的物理位置来表示代数的抽象关系。这套“天元术”实质上是一种半符号化的代数,比阿拉伯人的文字代数更接近现代符号代数。

朱世杰堪称宋元数学的集大成者。他的《四元玉鉴》将天元术从一元推广到四元,同时设立四个未知数并在算筹盘上同时处理它们。他还系统研究了高阶等差级数,比西方的级数研究早了几个世纪。日本数学史家三上义夫曾惊叹,朱世杰的某些成果直到十九世纪才在欧洲重现。

然后,几乎是突然的,这一切都中断了。

元代之后,中国数学进入了一个漫长的停滞期。明代珠算盛行,算盘取代了算筹,算法的便捷性战胜了理论的深度。曾经赫赫有名的天元术甚至被遗忘了,明代的数学家读到古代天元术著作时,居然已经看不懂其中的推导过程。顾应祥在注释李冶的作品时坦白承认:“其法皆不可晓。”

这大概是数学史上最令人怅然的一页:一个文明的数学传统,在其高峰之后,陷入了集体的遗忘。知识需要社会机制来传承,学校、印刷、学者群体的持续对话,当这些机制失灵时,最精妙的思想也可能被尘封。华夏数学的兴衰于此成为一面镜子,映照出知识存续的脆弱。

结语:算与证的二重奏

审视古代中国的算法文明,一个根本性的问题浮现出来:为什么中国人没有发展出演绎证明的传统?

答案复杂而多面。最通行的解释指向了不同的知识价值观。中国思想家追求的是“经世致用”,数学的价值在于它能解决实际问题,测量、计算、预测,而不在于它能否构成完美的逻辑大厦。儒家经典中找不到一本欧几里得《几何原本》式的逻辑体系。中国哲学更关心人的伦理选择而非宇宙的抽象结构。

但这种解释可能过于简单了。汉代经学中包含着极其精密的注疏传统,一章一节地推敲经典文本,这难道不是某种形式的逻辑训练?墨家著作中确实存在演绎推理的萌芽,墨经对“圆”的定义“一中同长也”(圆是到定点距离相等的点的集合)与欧几里得的定义惊人相似。但这些萌芽没有长大成林。

或许更深层的原因在于书写媒介的差异。希腊人写在易于传抄的纸草和羊皮上,他们的《几何原本》可以从亚历山大传到巴格达再到巴黎。中国早期的数学写在竹简上,传播成本高昂,文本异文繁多。《九章算术》经过历代传抄,各本之间的差异之大到了必须由国家出面校订(唐代李淳风的校注本是法定教材)。载体决定了传播的广度,而传播的广度决定了思想的碰撞频率,没有碰撞,逻辑结构很难被细化和标准化。

无论如何,古代中国的算法传统最终汇入了世界数学的大河。当欧洲数学在十六世纪后开始吸收异域成果时,中国的增乘开方法、大衍求一术、天元术已经躺在故纸堆中。但算法精神本身是永恒的,在计算机时代,中国的算法传统以一种意想不到的方式复活了。今天,当程序员编写迭代循环、递归函数、插值算法时,他们正在重演那些在古代中国算筹盘上发生过的思维过程,只是换了介质,本质竟如出一辙。

数学不是一个文明的孤芳自赏。它像一条地下的河流,在不同的大陆寻找出口,时而露出地表汇成湖泊,时而潜入岩层潜行千里,最终在某个意想不到的地方重新涌出,灌溉一片崭新的思想田野。

谁能说清楚,哪一滴水来自尼罗河,哪一滴水来自恒河,哪一滴水来自黄河?它们已然浑然一体,无法分辨,如同涓涓细流汇入大江,再难分彼此。

第六章 孤岛上的星图:被遗忘的玛雅与印加数学

另一种零的诞生

哥伦布到达新大陆之前,旧大陆的学者们对这片土地上的知识体系一无所知。当西班牙征服者的铁蹄踏上尤卡坦半岛时,他们眼中的玛雅只是一群崇拜异教偶像的未开化民族。兰达主教下令焚烧了所有的玛雅手抄本,将数百年的知识化为一堆灰烬。只有四本手抄本幸存下来,德累斯顿抄本、巴黎抄本、马德里抄本、格罗利尔抄本,它们脆弱如蛾翅,却承载着一个独立发展的数学文明的全部遗产。

这些手抄本上密密麻麻地排列着点和横线组成的符号:一个点代表一,一条横线代表五,一个贝壳模样的椭圆代表零。是的,玛雅人独立发明了零,这是人类历史上仅有的三、四次独立发明零的案例之一,与世界其他地区完全隔绝。

玛雅的数字系统是二十进制的,并且是位置记数法。一个数字根据它在数位中的位置而具有不同的值,这与印度-阿拉伯系统的原理完全相同,只是基数从十换成了二十。在德累斯顿抄本中,天文学家们用这套系统记录下了极其精确的天体周期:金星会合周期的平均值,他们测定为583.92天,而现代观测值是583.92天,精确到小数点后两位。没有优良的记数工具,这样的精确度是不可能达到的。

玛雅人为什么选择了二十进制?学者们普遍认为这与人体有关,十根手指加上十根脚趾,总数二十。但这或许并非全部原因。在中美洲的热带丛林中,二十与时间的计算方法天然契合:玛雅人将一个月定为二十天,然后将十八个月加上五个无名日,组成一个三百六十五天的太阳年。三百六十,二十的十八倍,是高度合数,这使得历法计算中的许多除法得出整数结果。

玛雅零的符号是一只半闭的眼睛,或者一枚贝壳,这取决于学者的解读。无论如何,它在抄本中出现时,总是安静地坐在数字的最下方,承担着占位符的神圣职责。与印度零不同,玛雅零从未被看作可以参与运算的独立数字,它是位值系统中的标记,而非代数的对象。这种限制或许反映了玛雅数学与天文历法的深度绑定:数学是为了计算时间而存在的,离开了历法,玛雅数字就失去了它们的意义场。

历法中的数学宇宙

玛雅人对时间的执着到了令人困惑的程度。他们不是简单地记录日期,他们在构建一个庞大的数学化时间体系,其精密和复杂远远超过了任何实用的需要。

玛雅历法中最著名的部分是长计历:一种从神话创世日(公元前3114年8月11日)开始计算的连续日数。每一个日期由五个数字组成,分别代表不同的时间单位:Baktun是十四万四千天(约394年),Katun是七千二百天,Tun是三百六十天,Uinal是二十天,Kin是一天。这样,一个日期诸如9.12.2.0.16,换算过来就是从创世以来经过了9×144000+12×7200+2×360+0×20+16天。

这种表示法的数学意义何在?对于现代读者来说,它看起来非常像一种混合进制的位置记数法,混合,是因为Tun到Uinal的进率是18(不是20),这是为了配合360天的“近似年”。在这种记数法下,玛雅书吏可以轻易地进行历法计算:两个日期之间相隔多少天,某个日期之后多少个Baktun是哪一天,这些运算在长计历系统中都可以机械化地完成。

德累斯顿抄本中的金星表,是玛雅天文数学的巅峰之作。它记录了金星作为晨星和昏星的出现和消失周期,持续追踪了数百年的时间跨度。玛雅天文学家发现,金星在八年中完成五个完整的会合周期,8×365=5×584=2920天。因此,他们设计了一个以八年为周期的金星历表,可以不断循环套用。更惊人的是,他们注意到这2920天的周期并非完全精确,长期的累积误差需要用校正项来修正,德累斯顿抄本中确实出现了这些校正。

是什么驱使玛雅人如此执着地追踪行星的运动?答案埋在宗教信仰中,金星是羽蛇神奎兹尔科亚特的化身,它的运行预示着战争和王权更替。但与任何文明一样,宗教需求催生了科学知识,科学知识在宗教的驱动力消失后依然存留了下来,静静地刻在手抄本鹿皮纸的经纬之间。

奇普:印加帝国的绳结数学

如果说玛雅数学至少还留下了手抄本,让我们得以窥见其原貌,那么印加帝国的数学则更加神秘莫测,他们没有留下任何书面文献。印加人没有文字(至少没有传统意义上的文字),但他们的帝国管理着从今天的哥伦比亚到智利的三千公里疆土、一千二百万人口。维系这个庞大帝国的行政系统,靠的是一种叫作“奇普”的精巧工具。

奇普是一个由主绳和悬挂在上面的许多细绳组成的结构。细绳用不同颜色的羊驼毛搓成,上面打着一系列绳结。这些绳结是数字,十进制的位置记数。打结的方式直接决定了数字的大小:一个八字结代表一,一个长结代表二到九(根据缠绕的圈数),无结就是零。

考古发现的奇普中,有些结绳上记录的数字长达十几个数位。这意味着印加帝国的官员们使用十进制位置记数法来记录人口普查、粮食储备、税收数量,这也是一个没有发明书写文字的民族独立做出的数学创造。

奇普不仅仅是被动的记录工具。研究表明,许多奇普的结构显示出明显的层级关系:一些绳子上的数字是另一些绳子数字的和,主绳上的数字可能是左侧子绳和右侧子绳的综合。奇普可能被用来进行主动的计算,将数据分组、汇总、对比,就像今天我们用电子表格做的那样。

这就是印加数学令人惊叹之处:在没有书面文字的情况下,他们发明了一种三维的、触觉的数据处理系统。一个训练有素的奇普解读员,称为奇普卡马约克,可以闭着眼睛,手指顺着绳索滑动,在绳结的触摸中读出整个省的人口、该省每个年龄段的男人女人数量、储存的玉米数量和土豆数量,然后报告给首都库斯科的监察官员。

这种触觉数学在人类数学史上几乎是孤例。其他所有文明的数学都沿着视觉—书写—抽象的道路前进,印加人却开辟了一条触觉—操作—具象的路径。他们从未发明欧几里得式的公理系统,从未抽象出二次方程求解公式,但他们在没有纸笔、没有算盘、没有泥板的情况下,用绳结建立起了一个能够运作复杂帝国的数据系统。

这提醒我们一个容易被遗忘的事实:数学的本质未必是写在纸上的符号。在符号出现之前(以及符号之外),数学可以是一种身体的实践,一种对时间和数量关系的直觉把握,一种通过触摸而非阅读来传递的知识。

被中断的独立演进

美洲大陆与欧亚大陆的数学传统各自独立发展了一万多年。当西班牙征服者在十六世纪抵达时,中断发生了,不是接触和融合,而是摧毁和遗忘。

兰达主教焚烧玛雅手抄本的故事并非孤例。在整个西班牙殖民时期,中美洲和安第斯山脉的本土知识体系遭到了系统性的摧毁。玛雅的祭司被屠杀,奇普的解读技艺在一代人之内就几乎完全失传。后世发现的许多奇普,已经没有人能够解读。

但也有幸存者。今天危地马拉和墨西哥部分地区的玛雅后裔中,仍然有人在日常生活中使用着二十进制的计数法,保持着玛雅历法的记录。奇普的传统在秘鲁安第斯山区的某些偏远村庄中也有残存,牧羊人们继续用绳结来记录牲口数量,尽管他们已经不再懂得祖先那些记录帝国税收的复杂绳结语言。

这种中断的代价是无法估量的。我们永远无法知道,如果美洲文明继续独立发展五百年,他们的数学会走向何方。玛雅的位置记数法和零会不会发展出代数学?奇普的层级结构会不会催生出某种独特的逻辑系统?这些问题不会有答案,因为数学的道路一旦被截断,就再也不会在同样的方向上重演。

但中断也教会了我们一些东西。它显示了数学发展的某种非必然性,并非所有文明都会“自然地”走向微积分或线性代数。不同的环境、不同的需求、不同的书写载体,会将数学塑造成完全不同的形态。玛雅的数学与时间深度绑定,印加的数学与帝国治理深度绑定,他们都在自己的轨道上走到了相当高的地方,只是他们的轨道与欧亚大陆的轨道最终没有汇合。

这两条被遗忘、被埋没的轨道,深深地留在历史中,像黑暗的夜空里,有两颗孤星各自闪烁,彼此不知,旧世界亦不知。

---

第七章 撒哈拉以南的数字宝藏:非洲传统数学再发现

伊尚戈骨上的刻痕

1960年,比利时地质学家让·德·安泽林在刚果边境的伊尚戈地区挖掘出一根狒狒的腓骨。这根骨头长约十厘米,一端嵌着一小块石英,可能曾被用作某种工具。但最引人注目的是骨头表面排列的刻痕,三组精心刻画的凹槽,每组又分成若干小段,小段中刻痕的数量呈现出明显的规律。

这根骨头的年代测定结果令人震惊:约两万年前。这意味着在人类还在使用石器的遥远时代,有人在这根狒狒骨上刻下了一组数字。

第一组刻痕包含三小段:11、13、17、19,这些数字的分布方式一直是争论的焦点。有些学者认为这只是一组质数,但另一种更激进的解读认为,这展示了对某种乘除关系的理解:11+13+17+19=60,而60在非洲许多传统计数系统中占有特殊地位。

伊尚戈骨不一定是数学。它可能只是某个人在记录月相、清点猎物,或是在漫长的夜晚无意识地刻着玩。但它至少显示了一个事实:在文字出现之前数万年,人类大脑中已经有了对数量和模式的自觉意识。数学的起源不是某个文明的特权,而是人类这个物种的普遍认知能力的一部分。

约鲁巴的二进制先知

西非,尼日利亚,约鲁巴人的故乡。约鲁巴文明有着悠久的城市传统、复杂的政治神权体系和丰富的口头文学。但在数学史上,约鲁巴人最引人注目的贡献是他们独特的计数系统。

约鲁巴人的计数方式是二十进制的,但它的底层结构出人意料地接近二进制。数字从一到十有独立的名称。十一到十四由“十加x”构成。从十五开始,系统发生了转变:十五是“二十减五”,十六是“二十减四”,以此类推。到了二十以上的数字,约鲁巴计数使用二十的倍数作为基数,进行加减组合:五十是“三个二十减十”,六十五是“三个二十加五”,一百是“五个二十”。

这种减法的本质是什么?每一种进位制都需要区分不同的位值。在中国数字中,三百二十五意味着三乘以百加上二乘以十加上五,这是纯粹的加法原则。约鲁巴计数却在加法之外大量使用了减法,它不把数字看作纯粹的和,而是看作离某个“完整数”的距离。这种思想与现代计算机中的补码表示法在精神上如出一辙。

当一串约鲁巴珠子占卜师,巴瓦拉沃,摆弄他的神圣棕榈坚果时,他实际上在操作一种二进制编码。占卜过程产生十六种基本模式,每种模式与一位神灵或一种命运对应。这些模式可以用四组单双排列来表示,每组要么单数、要么双数。在数学上,这就是四位二进制,可以表示从0到15共十六种状态。约鲁巴占卜师或许从未用“二进制”这个术语来思考自己的技艺,但他们的操作逻辑确实行走在二进制的道路上。

这种二进制直觉从哪里来?一种猜测指向约鲁巴人古老的农业实践,他们将土地按家庭数量等分为二、四、八份,每次分割都是恰好一分为二。另一种猜测说这与他们的贝壳货币系统有关,一串贝壳要么是完整的一串,要么是半串,要么是四分之一串,分层递减。不论起源如何,约鲁巴人对二的幂次有一种近乎本能的理解,而这种理解在欧洲数学中直到莱布尼茨才被系统地阐发。

曼丁哥的数学家

西非历史上,曼丁哥人的马里帝国(十三至十六世纪)以其财富和学问著称。廷巴克图的桑克雷大学是撒哈拉以南非洲最著名的学术中心,吸引了整个穆斯林世界的学者。这里的图书馆收藏着数千部手稿,其中不乏数学和天文学著作。

与北非和阿拉伯世界的联系意味着曼丁哥学者接触到的是伊斯兰数学传统,花剌子模的代数学、欧几里得的几何学。但他们并非只是被动接受者。廷巴克图手稿中显示了曼丁哥学者对当地问题的数学处理:他们计算天课(伊斯兰教中的慈善税)的分配方案,设计符合伊斯兰遗产法的财产分割算法,还为穿越撒哈拉的商队制定行程规划和物资分配表。

在这些应用问题中,曼丁哥学者发展出了自己独特的比例算法。他们将复杂的比例分配问题,比如七大份遗产中的三小份如何在十二个继承人之间分配,压缩为一系列口诀和查表操作。这些算法带有鲜明的口头文化痕迹:它们被设计成可以吟唱记忆的形式,以便在没有书面参考的情况下也能准确执行。

一个被遮蔽的问题

撒哈拉以南非洲的数学传统之所以很少进入主流数学史的叙述,其中一个原因是这些文化大多依赖口头传承而非书面文献。在缺乏文字的情况下,数学知识通过口诀、歌谣、游戏和日常生活实践代代相传,这种传递方式的有效性但它难以留下可以被考古学家发现的物质遗迹。

另一个原因是殖民主义的知识等级制度。欧洲殖民者带着他们自己的数学标准进入非洲,认定没有欧几里得式的证明就不算是真正的数学。非洲本土的计数方式、几何模式(比如在许多传统建筑的图案中)、逻辑推理(比如在法庭辩论和谜语游戏中的推理结构)因此被系统性地忽视了。直到二十世纪后期,民族数学的研究才开始认真对待这些传统。

今天,当我们试图重建非洲本土数学传统时,面临着几乎不可逾越的困难。知识传承者已经凋零,记忆随着老人的去世而消散,殖民教育和现代化抹去了许多传统实践。但足够的碎片保留了下来,足以让我们确信,这片大陆也有着自己的数学故事,不是欧几里得式的,不是花剌子模式的,不是《九章算术》式的,而是一种深深扎根于非洲土壤的、独特的数量思维方式。

伊尚戈骨上的刻痕,约鲁巴占卜师的棕榈坚果,廷巴克图学者鹅毛笔下的遗产分配算法,沃洛夫农民的对称田亩规划,这些看似无序的片段都在述说同一个事实:数学不是某条文明高速公路上的专利,而是遍布人类居所的野花,每一种都适应了其生长的土壤。

---

第八章 近代欧洲的熔炉:东西方数学的碰撞与新生

从翻译到消化

公元1085年,基督教军队从穆斯林手中重新夺回了托莱多。当胜利者进入这座城市时,他们发现了一个意想不到的宝藏,图书馆。托莱多的图书馆里存放着大量阿拉伯文著作,其中许多是希腊经典的译本,以及阿拉伯学者自己的原创作品。

欧洲人对这些书的内容一无所知。三百年来,西方拉丁世界的数学知识萎靡不振。一个受过良好教育的修士所知道的数学,大约不超过罗马数字、简单的算术和少量的实用几何。欧几里得的名字或许偶尔被提及,但他的著作在欧洲已经失传。至于阿拉伯人的成就,欧洲人闻所未闻。

托莱多成为知识饥饿的欧洲的第一座餐厅。来自全欧洲的学者涌入这座城市,学习阿拉伯语,将能找到的一切翻译成拉丁文。巴斯的阿德拉德伪装成穆斯林学生潜入图书馆,偷偷抄录花剌子模的天文表。切斯特的罗伯特翻译了花剌子模的《代数学》,从此algebra这个词进入拉丁语汇。克雷莫纳的杰拉德更是终其一生完成了几十部著作的翻译,包括托勒密的《圣大论》和欧几里得的《几何原本》,后者终于让中世纪欧洲人第一次读到了全部十三卷的内容。

翻译运动持续了整个十二世纪。到公元1200年,欧洲所拥有的数学文献已经包括:欧几里得、阿基米德、阿波罗尼乌斯的几何学;花剌子模、奥马尔·海亚姆的代数学;印度的位值数字;阿拉伯天文学家的三角学。一场知识的洪流冲破了拉丁世界的孤立,欧洲人发现自己面前摆着一桌从未品尝过的知识盛宴。

但翻译不是目的,消化才是。斐波那契的《算盘书》(1202年)是消化过程中的里程碑。这本书不是简单的翻译,而是用拉丁文重写、重组、重新解释印度-阿拉伯数字及其应用。斐波那契在书中引入了他自己设计的大量新问题,包括那个著名的兔子问题。他还在1225年出版了《平方数书》,独立研究了丢番图方程,这是一个对欧洲来说全新的领域。

十五世纪的符号革命

消化之后是创新。十五世纪,欧洲数学发生了两场分别独立但在随后融合的革命。

第一场是印刷术。古腾堡在1450年左右发明了活字印刷,而数学是最大的受益学科之一。在此之前,每一本数学手抄本都是单独抄写的,不仅成本极高,而且错误层累,抄写者不懂数学,将数学符号当作奇怪的装饰图案,随意变形。印刷术的出现使得数百本完全相同的数学书籍可以同时流通,学者们终于可以在相同的文本基础上进行讨论,不必担心各本之间的差异。

第二场是符号的爆发。十五世纪末到十六世纪,欧洲数学家引入了一系列符号,彻底改变了数学的书写方式。在此之前,数学几乎完全用日常语言表达。方程写成一长段拉丁文,运算用文字描述。花剌子模的“财产加上十个根等于三十九”在五个世纪后依然盛行。

然后,变化发生了。未知数和常数开始用字母表示,“+”和“-”取代了语言中的“加”和“减”,“=”取代了“等于”的文字描述。韦达,十六世纪法国数学家,系统地区分了已知量和未知量,用元音字母表示未知数,辅音字母表示已知数。笛卡尔则建立了现代形式:用x、y、z表示未知,用a、b、c表示已知。

这场符号革命的意义远远超出了便利。当方程可以用紧凑的符号书写时,模式变得可见。一个二次方程x²+bx+c=0的形式结构一目了然,其中的对称性和变换关系暴露在纸上。在旧的文字形式中,这些结构被语言的外衣包裹着,难以被察觉。符号使得代数本身成为了研究的对象,不是研究某个特定的方程,而是研究方程这一类数学结构的性质。

这就是代数从“解方程的技术”转变为“研究代数结构本身”的关键一步。没有符号的发明,就不会有抽象代数,不会有群论、环论、域论,不会有现代数学的大厦。

三次方程:一场智识决斗

十六世纪意大利半岛上,数学家们以公开挑战决斗来赢得声誉和职位。1515年,博洛尼亚大学的数学教授席波内·德尔·费罗发现了某种三次方程的解法,ax³+bx=c的形式。但他没有发表,只将解法口授给了一个学生和女婿。在当时的意大利数学界,发现被当作秘密武器,在公开决斗中突然亮出,一举击败对手。

1535年,费罗的学生菲奥尔向来自布雷西亚的年轻教师尼科洛·丰塔纳(绰号塔塔利亚,“口吃者”)发出挑战。挑战的内容就是解一系列三次方程。塔塔利亚此前并不知道费罗的解法,但在巨大压力下,他重新发现了它,并且更进一步,找到了类型更广的三次方程解法。在决斗中,塔塔利亚在两小时内解出了菲奥尔的所有问题,而菲奥尔一道塔塔利亚的题都没能解出。塔塔利亚大获全胜。

消息传遍了意大利。吉罗拉莫·卡尔达诺,一位才华横溢但声名狼藉的医生、占星家和数学家,闻讯赶来。他向塔塔利亚恳求,发誓保守秘密,说自己正在写一本百科全书式的数学书,需要这些解法来使它完备。塔塔利亚最初拒绝,但在卡尔达诺的反复劝说和引荐贵人的许诺下,最终以晦涩的口诀形式将解法告诉了卡尔达诺,并要求他发誓永不公开。

誓言未能约束卡尔达诺。1545年,他的《大术》出版,书中包含了三次方程和四次方程(由卡尔达诺的学生费拉里发现)的完整解法。塔塔利亚的功劳在书中被承认,但秘密被打破了。塔塔利亚至死未能原谅卡尔达诺。

这段曲折的故事第一次显示,欧洲数学超越了前人的所有成就。巴比伦人解过二次方程,但三次方程在古代和中世纪从未被攻克(除了奥马尔·海亚姆的几何解法外)。一个千年的障碍被突破了。更深刻的意义在于,三次方程的解涉及到负数开平方,卡尔达诺在推导某些三次方程的解时,不得不在中间步骤中对负数取平方根。他困惑地称之为“诡辩量”,并在《大术》中写道:“迄今为止没有人能够解释这些量的意义。”

这个“诡辩量”就是后世的虚数。它从三次方程解法的缝隙中挤了出来,虽然当时的数学家还无法理解它,但一个全新的数域已经在符号运算中被制造出来,等待后人去探索。

解析几何:数与形的再次统一

欧几里得之后一千八百年,数与形一直处于分离状态。希腊人将数与几何分开,因为无理数的发现动摇了他们对数的信仰;阿拉伯人继承并保持了这种分离;印度人虽然发明了零,但他们的代数仍然主要处理数字而非几何对象;中国人专注于算法,将几何问题转化为数值计算。

笛卡尔结束了这场漫长的分离。

1637年,勒内·笛卡尔,一位法国哲学家、数学家和军官,在《方法论》的附录《几何学》中提出了一个简单而革命性的想法:在平面上选择两条互相垂直的直线(坐标轴),平面上任何一个点就可以用一对数字(x,y)来唯一标识。几何图形,无论是直线、圆、椭圆,都变成了方程。一条直线可以写成y=mx+b,一个圆可以写成x²+y²=r²。几何问题变成了代数问题,反过来,代数方程也可以通过画图来直观理解。

这就是解析几何的诞生。数与形,在分离了将近两千年之后,终于重新结合。而这种结合的深度在数学史上是前所未有的,它不仅恢复了古老的统一,还将之提升到了更高的精确度。

笛卡尔本人可能并没有完全意识到他这一发明的威力。他在《几何学》中写道,他的目标只是为了解决古希腊遗留下来的一些几何问题。但他的坐标平面一旦建立,数学就获得了一种全新的语言,这种语言允许将对空间的直觉注入了对符号的推理中,反之亦然。这为半个世纪后微积分的发明奠定了最关键的基石。

解析几何还产生了一个深远的哲学后果:空间本身被量化了。在亚里士多德的宇宙论中,空间是一系列有质的区别的区域,月上世界和月下世界遵循不同的规律。在笛卡尔的坐标平面中,空间变成了同质的、各向同性的,平面上的任意一点与其他任何一点在数学上没有本质区别,它们只是坐标值不同而已。这种空间的量化,为牛顿将天地间的运动统一在同一个力学体系中做好了数学准备。

结语:微积分的序章

十七世纪中叶,欧洲数学已经站在了现代的最前沿。印度-阿拉伯数字系统完全普及,符号代数臻于成熟,坐标几何将数与形编织在一起,三次和四次方程的解法突破了千年的边界。一种全新的数学工具开始在许多数学家的头脑中模模糊糊地浮现,一种能够处理运动和变化、能够计算瞬时速度和曲线下面积的新方法。

费马在研究切线,笛卡尔在想法线,巴罗在计算曲线包围的面积,沃利斯在处理无穷级数。不同的进路正在逼近同一个伟大的发现。当十七世纪后半叶到来时,牛顿和莱布尼茨将各自独立地为这把即将出鞘的数学之剑淬火。

而这一切的火种,来自智慧宫的翻译运动、来自花剌子模的代数学、来自印度无名数学家的零、来自斐波那契的兔子、来自塔塔利亚在深夜红烛下发现的公式、来自笛卡尔在军营床铺上构思的坐标系。欧洲数学不是凭空创造的奇迹,它是一场伟大炼金术的产物:将各大文明的溪流注入一个熔炉,在印刷机和大学制度的火焰上持续加热,最终铸造出了现代科学最锋利的工具。

黎明前最黑暗的时刻已经过去。当牛顿在1665年从剑桥避疫回乡,在伍尔索普庄园的苹果树下仰望月亮的轨迹时,他手中握着的是整个人类历经三千年接力传递的数学火炬。下一个时代的篇章,将由他和他的同代人来书写。

第九章 东方晚钟:江户时代的日本数学

和算的诞生:从中国进口到本土创造

十七世纪初,德川家康统一日本,开启了长达两个半世纪的江户时代。锁国令下达,除了长崎出岛的荷兰商馆和偶尔入港的中国船只外,日本与外界几乎完全隔绝。但在这座孤岛上,数学迎来了一次独立而惊人的发展。

数学进入日本的路径,最初是一条汉字铺就的道路。1627年,数学家吉田光由出版了《尘劫记》,这本面向大众的算术启蒙书成为江户时代的超级畅销书。吉田自承,《尘劫记》的材料主要来自中国元代朱世杰的《算学启蒙》和明代程大位的《算法统宗》。这些问题,龟鹤算(鸡兔同笼)、油分け算(用三个容器等分液体)、俵杉算(堆垛计算),经过日本式的改编,融入江户市民的日常生活场景,迅速被町人、农民和下级武士所吸收。

但日本数学家并不满足于模仿。仅过了一代人的时间,一位真正的数学天才,关孝和,出现在了历史的视野中。

关孝和出身武士家庭,年轻时在内藤家的宅邸担任会计。他的数学天赋在旧账簿和算盘珠之间觉醒。到1670年代,关孝和已经独立发展出了一套远超中国原典的数学体系。他在代数、无穷级数、行列式这三个领域取得了世界级的成就,而这三个领域恰恰是现代高等数学的核心。

在代数方面,关孝和将中国的天元术,用一个未知数建立方程的方法,从一元推广到多元。他发明了“点窜术”,在算筹盘上用红黑筹码的位置来表示多个未知数的方程。这套方法可以同时处理多个变量的方程组,实质上已经触及了消元法的本质,即今天线性代数中的高斯消元法。

关孝和比欧洲同行更快地迈出了一步。中国宋元数学家的天元术只处理一个未知数,关孝和的多元方程组处理则更进一步。而欧洲直到十八世纪才由欧拉系统地将消元法应用于一般线性方程组,关孝和的笔迹早在一百年前就已冰冷。可惜这些笔迹从未离开过江户的藩校和私塾。

在无穷级数的方向上,关孝和的贡献更为惊人。他独立发现了圆周率π的无穷级数展开式。通过研究圆内接多边形的边长,关孝和找到了一个计算π的递推公式,并用它计算了π的值到小数点后十一位。他还在计算球体积的过程中,实质上使用了某种早期版本的积分思想,将球体切成无数极薄的圆片,累加其体积。

这些成就的任何一个,放在十七世纪的欧洲都会引发轰动。但在江户日本,它们只是和算流派内部的秘传知识。

算额:神社中的数学祈愿

走在今天日本各地的古老神社中,细心的人可能会注意到一些悬挂在屋檐下的木质匾额。这些匾额大多已经褪了色,边缘被风雨侵蚀,但上面仍能辨认出彩色的几何图形和墨书日文。它们是“算额”,江户时代数学家献给神明的数学题。

算额的习俗大约始于十七世纪末。当时的数学家(无论是专业和算家还是业余爱好者)在解出一个漂亮的数学问题后,会将其工工整整地写在一块木板上,问题与解答并列,有时还绘以精美的几何图示,然后挂在神社或寺庙的廊下,向神明致敬,也向其他同行发出无声的挑战。

这是一种独特的数学社交方式。在锁国的日本,没有国际学术期刊,没有跨越国界的通信网络,甚至跨藩的旅行也受到严格限制。但数学爱好者们可以走进神社,看到某地某人留下的算额,冥思苦想之后,再在另一块木板上写下自己的解答或新的问题,挂在旁边。一场缓慢的、以年为单位的、跨世代的数学对话,就这样在杉木的纹理上进行着。

现存的算额中,最著名的之一来自金王神社(今东京都涩谷区)。这块算额制于1748年,上面画着几个互相内切的圆,要求计算它们的半径关系。这类问题,在一个大圆内画若干个小圆,它们彼此相切,是日本和算独有的特色,在欧洲的几何学传统中几乎找不到对应物。

为什么日本数学家如此痴迷于相切圆问题?原因或许藏在和算的审美中。一个圆是完美的,几个圆之间的相切关系则有着禅宗公案般的意趣,简单,却又不是一眼能看透的;规则清晰,但计算复杂到了需要动用高等工具的地步。对江户时代的数学爱好者而言,这些圆不只是几何图形,它们携带着某种审美上的完满。

另一个著名的算额挂在京都的八坂神社,涉及的问题更为复杂:一个球体内,五个球互相内切,求它们的直径。这个问题是三维空间中的相切问题,其求解需要相当高的空间想象力和代数技巧。在现代数学中,这类问题被归入“球填装”的范畴,与晶体结构和编码理论有着深层的联系。

算额传统一直延续到明治维新前后。随着西方数学的大量涌入,和算迅速被取代,算额渐渐无人能读。但那些古老的木板仍然挂在神社的檐下,雨水沿着几何图形的边缘流淌,像泪痕一样,标记着一个孤岛数学传统最后的沉默。

关流七传:数学的家族秘教

和算的传承方式几乎与现代学术背道而驰。它是一种家族式的、口传心授的秘传制度。关孝和的弟子们组成了“关流”,传承他的数学秘法。弟子中的最优秀者被立为“传人”,获得流派的最高秘传书,而其他人只能接触到皮毛。

关流的核心教材被称为“七传”,七部从不外泄的手稿,涵盖了点和代数、无穷级数、积分思想、行列式等方面。任何一本拿到欧洲都足以奠定一个数学家的名声,但在日本,它们只是师徒之间在烛光下低声传授的秘密。

建部贤弘是关孝和的得意门生,也是第三代将军德川家光的数学顾问。他在1722年完成的《缀术算经》是关流传书中最为精深的一部。在这部著作中,建部贤弘将关孝和的无穷级数方法系统化,提出了“圆理”,对曲线和曲面进行无限细分以求积求长的理论。这就是积分的雏形,与欧洲牛顿、莱布尼茨的工作同期但隔绝而不相知。

建部贤弘在书的序言中写道:“此术幽玄高远,得之者寡。故弟子中可传者不过一二人。若轻传非人,反受天谴。”这段文字笼罩着神秘和严峻,展现了和算秘传制度的精神:真正的数学智慧是天机,不可轻泄。

这种秘传制度无疑阻碍了日本数学的发展。当欧洲数学在十七、十八世纪实现了爆炸性的进步,公共期刊、皇家学会、跨国通信网络形成了良性的信息循环,日本数学却困在各自流派的密室中,无法互相激发、相互修正。每一位和算大师都要从零开始重新发现许多基本方法,因为前人的成果被锁在秘传书里,秘传书又锁在某个家族的樟木箱底。

然而,秘传制度也有它的功能。在和平的江户时代,数学才能本身并不带来财富或权力。决定一个武士的薪俸的是他家族的谱系和他剑术的段位,而不是他能解出多难的方程。在这种情况下,流派秘传创造了另一种激励:成为关流的传人,就是向同行宣示自己的智力优越性。流派内部的等级制为数学爱好者提供了社会认同,使得一代代人愿意投入半生精力钻研那些没有实际用处的几何题。

久留岛义太与“极数术”

关流之外,还有其他流派。久留岛义太是“宅间流”的创始人,也是江户中期最具原创性的数学家之一。他的故事带着某种浪漫色彩。

久留岛原本是一个富商的儿子,家族经营着大阪最大的大米批发店。按照常规,他应该继承家业,在账房的算盘声中度过一生。但久留岛对商业毫无兴趣,他沉迷于数学。在二十岁左右,他离家出走,从此清贫度日,在各地藩主的临时聘用和私塾的微薄束脩之间维持生存,将全部精力投入到数学研究中。

久留岛最著名的贡献是“极数术”,对无穷级数求和的研究。他计算了各种级数:1²+2²+3²+。+n²的和,1³+2³+3³+。+n³的和,一直推到更高次。他还研究了调和级数的部分和,发现了欧拉-马斯刻若尼常数的一个特例。这离欧洲的伯努利数和欧拉求和公式仅一步之遥。

但久留岛缺少符号系统。他的所有推导都用汉字和假名书写,没有∑符号,没有极限的明确定义,没有公式的紧凑表达方式。读他的著作时,现代数学家会在那些文言语段的缝隙间认出某些熟悉的结构,就像隔着一层磨砂玻璃看到另一个房间里的旧识,轮廓依稀可辨,细节却难以分辨。

久留岛一生未娶,没有子嗣。他的数学遗产由弟子继承,宅间流又延续了几代,最终在明治维新前后与其他和算流派一同消融。今天,久留岛的名字主要出现在数学史的脚注里,但他所代表的是一种超越时空的科学精神:一个人可以放弃财富和安稳,只为在计算的秘密花园中多走一程。

安岛直圆与和算的黄昏

十八世纪末到十九世纪初,和算达到了它的最高峰,也走到了它的尽头。安岛直圆,关流第六代传人,是和算最后的大师之一。他完善了前辈们的“圆理”方法,将之发展为一套完整的“求积术”,能够处理相当复杂的曲线围成面积的精确或近似计算。

安岛直圆在1810年完成了一部奇书《不定式算》,其中研究了各种不定方程,即未知数多于方程个数、存在无穷多组解的情况。他给出了若干寻找整数解的算法,这些算法在精神上与现代数论中的丢番图逼近不谋而合。尤其有趣的是,安岛在书中提出了一系列公开挑战,以“遗题”的形式留给后来的数学家,这似乎是在反抗秘传制度,试图推动知识的公开交流。

但他的努力来得太迟了。

1853年,美国海军准将佩里率领黑船驶入浦贺湾,强迫日本开国。随之而来的不只是枪炮和通商条约,还有全新的知识体系。明治维新后,日本政府决心全面西化,西方的数学被正式引入教育体系。明治五年(1872年),文部省颁布的学制中,数学课程已经完全使用西方教材译著。从小学到大学,日本学生开始学习阿拉伯数字、笛卡尔坐标、牛顿力学。

在那几十年间,和算迅速从主流退向边缘,从边缘退向记忆,从记忆退向遗忘。

曾经在神社檐下挂着的一排排算额,不再是活着的数学对话的对象,而变成了民俗古董。曾经秘不外传的关流七传抄本,在旧书店里以几文钱的价格处理给偶尔经过的西洋人。那些曾经绞尽脑汁计算过上百个内切圆半径的几何家们,他们鬓边的汗水早已蒸散在历史的干燥空气中。当新一代的东京帝国大学学生用流利的英文讨论黎曼几何时,他们的祖父那一辈人还在用毛笔推导“圆理”的复杂公式,而那一套书写体系即将被世界遗忘。

一个孤立的数学文明就这样落幕了。它曾经在锁国的夹缝中独立发展了两百多年,达到了相当的高度,创造了独特的审美和社群,然后被卷入了现代化的洪流,再无回头的可能。

但在数学史的长程透镜下,和算有其不可磨灭的意义。它证明了数学发展的多元性:即使隔绝于主流文明之外,人类的数学冲动依然可以找到出口,用完全不同的符号体系和教学制度,创造出独具特色的数学文化。和算也提醒我们,科学的进步从来不只是智力突破的简单累积,它需要制度、传播、交流,这些外部因素与智力本身一样重要。

今天,算额仍然悬挂在日本各地古老神社的屋檐下。它们大多被当作地方文物加以保护,偶尔会有数学史家前来拓印。木板上的墨迹已经模糊,几何图形边缘的线条在风雨中渐渐淡去。但若你在清晨无人的时候站在这些算额前,似乎还能听见几百年前某个无名数学爱好者挂上自己的解答时,木屐踏过石板路的回响,轻轻的,固执的。

---

第十章 计算机的史前史:从算盘到巴贝奇

算盘:第一种数字计算机

想要寻找计算工具的最早源头,目光最终会落在一件简单的工具上:算盘。

算盘的原理朴素而深刻。一根木框上平行排列着若干细柱,每根细柱上穿着可滑动的算珠。每根柱代表一个数位,柱上的珠子代表该位的数值。加减法通过手指拨珠直接完成,乘法除法则是加减法的重复组合。一个训练有素的使用者可以用算盘进行复杂的大数运算,速度甚至快过用纸笔笔算的人。

算盘在世界多个文明中独立出现并演化。中国的算盘,带有横梁分隔上二珠下五珠的那种,大约成熟于宋代,明代以后普及全国。西方源流可以追溯到罗马时代的计数板,在算盘槽中拨动刻有数字的圆片。俄罗斯的算盘每柱十珠,没有横梁,结构与原理与中国算盘大异其趣。日本的算盘,名为“十露盤”,则在明治前后引入了上一下四的紧凑设计,每一柱最多可以表示0到9,恰好对应十进制的一位。

算盘所体现的,是一种“状态机”的计算观。算珠的位置表示了数字的状态,手指的拨动是状态之间的转换,一套口诀是转换的规则。一个珠算者不过是一个严格执行规则的状态机操作员,这与现代计算机的中央处理器在逻辑上别无二致。只不过,前者由血肉驱动,后者由电流驱动。

中国古代记数法、算盘与数学思维之间存在着微妙的关系。位置记数法,印度数字的核心思想,早已蕴藏在算盘的每一根柱子中。每颗珠子因所在柱子的不同而具有不同的值,这正是位值概念的物化表达。中国商人和账房们日复一日地在算盘上拨弄数字,尽管他们之中很少有人知道印度数字的书写方式,他们的大脑却已经通过手指的动作,深刻理解了位置记数的精髓。

纳皮尔骨筹与对数

算盘能处理加减乘除,但在处理更大的数,天文数字、复利计算中的高次幂,时,仍然力不从心。十六世纪末,一位苏格兰贵族正在设想一种更高效的计算工具。

约翰·纳皮尔,默奇斯顿男爵,是一位性格古怪的苏格兰数学家兼业余神学家。他一生中最著名的发明是作为数学工具的对数,但他还设计了另一种被称为“纳皮尔骨筹”的计算工具。

骨筹是一套刻有乘法表的木棒或骨棒。每根筹的四个面上刻着某一个数字从1到9的乘法结果,用对角线分为十位和个位。要做多位数乘法时,只需选出对应各位数字的筹,排列在一起,然后沿着对角线相加,就能读出乘积。骨筹将乘法运算中的部分积预先刻在了筹面上,使用者只需要做加法,这大大减轻了心算负担。

纳皮尔骨筹迅速传入欧洲大陆,并在此后两个世纪中被不断改进。某些版本将骨筹做成滚筒,旋转滚筒来完成乘法。另一些版本将之与钟表机械结合,通过齿轮传动自动进位。这些都是原始的机械计算器,在电子计算机诞生之前三百多年,人们已经在用齿轮和杠杆模拟算术运算。

但纳皮尔真正的数学杰作是对数。1614年,他发表了《奇妙的对数定律说明书》,首次向世界介绍这一革命性的工具。

对数的核心思想极其简单:将乘法转换为加法。因为log(xy)=logx+logy,所以求两数之积,只需要查到它们的对数,加起来,再反查出真数即可。在实际应用中,这大大缩短了计算时间,将可能需要数小时的乘法化约为了查表和加法。

天文学家们首先欢呼起来。开普勒在收到纳皮尔的书后,激动地写了封感谢信,称对数是“天赐的工具”。拉普拉斯在一个半世纪后评价道,对数“通过缩短计算延长了天文学家的寿命”。

纳皮尔的对数底并不等于自然对数的底e,他用的是一个与1非常接近的数作为底,实际上是(1-10⁻⁷)的10000000次方。他没有现代的指数记法,也没有极限的概念,而是用几何和运动的比喻来定义对数:一个点沿一条线段从大到小匀速移动,另一个点沿射线以几何级数的速度移动,两者同步,那么前者的位置序列就是后者的对数。这个定义艰涩高深,几近神秘,但由此构建出来的对数表却是精确可用的。

不久之后,亨利·布里格斯拜访了纳皮尔,建议改用10为底,常用对数由此诞生。布里格斯花费了数年心血,亲手计算了从1到20000以及从90000到100000的所有数的十四位常用对数。这是人力所能完成的最庞大的计算工程之一,也是数学史上最令人敬畏的手工计算壮举。

帕斯卡与机械计算器

1642年,一个名叫布莱兹·帕斯卡的十九岁法国青年完成了人类历史上第一台成功的机械计算器。帕斯卡的父亲是鲁昂的税务官,每天被繁复的加减运算所困。儿子为了分担父亲的劳苦,设计了这台加盖了遮尘板的黄铜机器。

帕斯卡计算器的核心机构是齿轮。数字0到9刻在一个个铜轮上,每个轮通过一个拨盘输入数字,当某个轮转过9回到0时,会通过一个棘爪机构带动左侧更高位的轮子转过1格,这就是进位。整个机器的进位逻辑完全是机械的,不依赖任何人力的计算判断。

帕斯卡计算器只能做加法和减法。但加减是乘除的基础,乘法不过是累加,除法不过是累减。从原理上说,用帕斯卡机完成复杂运算只是时间问题。

帕斯卡前前后后制作了约五十台计算器,试图将之商业化。但他的机器过于昂贵,单价高达一百里弗,相当于当时一个熟练工匠半年的工资。而且进位机构时有故障,并不完全可靠。帕斯卡最终放弃了商业推广,将剩余的机器作为新奇礼物赠送给各地的达官贵人。他的计算器没有进入日常使用,但它的设计逻辑留在了文献中,成为后世所有机械计算器的原型。

帕斯卡本人或许也不会预见,他为了帮助父亲处理税务而发明的这个黄铜小盒,会成为计算机家族遥远的先祖。三百多年后,当程序员在代码中写下加法指令时,计算机内部发生的事情在逻辑上与帕斯卡齿轮的滚动完全一致,只是快了几十亿倍。

莱布尼茨的梦想

莱布尼茨在1672年见到了一台帕斯卡计算器,立即被迷住了。但他不满足于加减,他要造一台能做乘除的机器。

莱布尼茨的核心发明是“步进鼓”,一个带有不同长度齿的滚筒。转动这个滚筒可以产生不同的齿轮移动量,从而一次性实现乘法,而不是帕斯卡式的累加。1673年,莱布尼茨的计算器原型在伦敦皇家学会进行了演示,尽管当时它还不能完全正常工作,但设计蓝图已经俘获了一众学者的想象力。

但对莱布尼茨来说,计算器只是他更大梦想的一个部件。他的终极目标是创造一个“普遍语言”,一种符号系统,可以将所有的人类思想无歧义地表达出来,由此,一切争论都可以通过“坐下来计算”来解决,就像两个人对一道算术题各执己见时,只需要拿起纸笔算一遍就能得出谁对谁错。

这种普遍语言在莱布尼茨的构想中是一套基于二进制逻辑的系统。他从十七世纪七十年代开始研究二进制算法,并从在中国的耶稣会士那里了解到《易经》的六十四卦,莱布尼茨欣喜地发现,伏羲的卦象排列完美对应着二进制数,从000000到111111。这一发现加深了他对二进制的信心:最古老的文明和最先进的理性,在同一种数学结构上不期而遇了。

在莱布尼茨的设想中,一种通用逻辑机器可以在几秒钟内解决最难的法律争议和神学论战,只需将前提条件编码输入,摇动手柄,齿轮转动,答案就会自动打印出来。这个幻想超越了时代三百年。当我们今天看着人工智能系统从大量训练数据中总结模式、生成回答时,某种层面上,我们正在莱布尼茨梦境的边缘徘徊。

但他的机器从未真正实现。步进鼓的设计需要极其精密的加工工艺,十七世纪的工匠无法达到所需的公差。莱布尼茨计算器在博物馆的玻璃柜中沉睡了两个多世纪。

雅卡尔的穿孔卡织机

计算工具史中的一个关键人物并不是数学家,而是一名法国丝绸工人。

1801年,约瑟夫·玛丽·雅卡尔发明了一种革新性的织机。在此之前,织造复杂花纹需要一名技艺纯熟的“引经工”配合织工工作,用手工提起不同的经线,每织一纬变化一次。这是身心俱疲的慢工。雅卡尔的发明彻底改变了局面:他将花纹图案编码成一串串打在卡片上的孔,有孔让经线提起,无孔让经线不动。卡片连成一圈,自动循环转动,织机就能自动织出精美的连续图案。

雅卡尔织机的关键思想是:将一种复杂的信息(图案)转换为二进制的物理形式(有孔/无孔),然后用机械方法自动读取和执行。这是程序控制的第一次大规模工业应用。

雅卡尔本人可能从未想过他的发明与数学的关系。但他的穿孔卡启发了另一个人,一个半世纪之后的查尔斯·巴贝奇。当巴贝奇苦思如何向他的分析机输入复杂指令时,他在雅卡尔的卡片上找到了答案。

于是,在人类工具史上,纺织机与计算机发生了一次奇妙的交会。丝绸上的花卉纹样,最终变成了计算器上的程序代码。这是技术演化最令人着迷的特性:一个领域为了完全自洽而发明的工具,常常成为另一个领域突破的关键。

巴贝奇的分析机

查尔斯·巴贝奇是伦敦一位富有银行家的儿子,剑桥大学卢卡斯数学教授(牛顿也曾担任此职),但他生平大多数时间都在和英国财政部的官员争吵。

1821年,巴贝奇在检查一份天文计算表时,发现了大量错误。这种手工计算的表格当时是航海、工程、天文、保险的基础工具,而错误的代价可能是船只触礁或桥梁垮塌。巴贝奇萌生了一个念头:用机器完全取代人工计算,这样就能消灭错误。

他的第一台设计是“差分机”,专门用来计算和印制多项式函数表的蒸汽动力机械。任何可以用多项式近似表示的函数,差分机都能自动计算出其数值,并直接将结果刻在铜板上用以印刷,从输入到输出全程无人工干预,因此扼杀了抄写错误的一切可能。

英国政府最初拨款支持这个项目,但很快发现巴贝奇的设计过于雄心勃勃:差分机需要两万五千个精密零件,每个齿轮的公差必须小于千分之一英寸。在维多利亚时代早期的加工技术条件下,这不啻天方夜谭。耗资一万七千英镑(当时的巨款,足以建造一艘战列舰)后,政府撤资了。

巴贝奇并未气馁。他转而设计了一种更伟大的机器,分析机。分析机不是为单一任务(制表)而设计的专用机器,而是通用的计算设备。它有输入系统(穿孔卡)、存储系统(巴贝奇称之为“仓库”)、计算系统(“工场”)、控制系统(决定运算顺序)和输出系统(打印机)。现代计算机的冯·诺依曼结构,控制器、运算器、存储器、输入输出,在巴贝奇的图纸中几乎完全对应。

但分析机从未被建造出来。巴贝奇与工匠争吵,与政府争吵,与学术对手争吵。他的设计不停地在变,有时是真正的改进,有时只是完美的执念。他在这台机器上耗费了后半生的精力和大部分财产,而留给世人最初设想的结果,是装满图纸的木箱。

然而,有一个人深刻地理解了巴贝奇。

奥古斯塔·埃达·拜伦,洛夫莱斯伯爵夫人,诗人拜伦的女儿,或许也是十九世纪最被低估的数学天才之一。1843年,她将一位意大利数学家用法语写成的巴贝奇讲座记录翻译成了英文,并在翻译后面附加了她自己的“注释”。这些注释的篇幅是原文的四倍。

在这些注释中,埃达做了几件惊人的事。她详细阐述了一种让分析机计算伯努利数的程序,这被认为是世界上第一套计算机程序。她预见到这种机器不仅可以处理数字还可以处理符号,由此可以作曲、画图、进行自然语言推理,远远超出了她同时代人(包括巴贝奇本人)的视野。她写下了这样的句子:“分析机没有任何创造任何东西的企图。它只能做我们知道如何命令它去做的任何事情。”这一见解,机器只执行算法,创造力在人类手中,至今仍是计算机科学和人工智能辩论的中心论题。

埃达三十六岁死于子宫癌,与她的父亲拜伦勋爵同寿。巴贝奇比埃达多活了十九年,在贫困和愤懑中去世。分析机的图纸被收进仓库,渐渐被遗忘。

遗忘与重续

巴贝奇死后的大半个世纪,他的工作几乎没有产生任何影响。二十世纪初的工程师们不知道有一个维多利亚时代的古怪老头已经画出了通用计算机的蓝图。图灵和冯·诺依曼各自独立地重新发明了巴贝奇设想过的种种概念,直到历史学家后来理清脉络,才发现他们站在巴贝奇和埃达的肩膀上。

这引出数学史中一个令人怅然的问题:为什么某些天才的想法提前降临,却如落进真空,毫无回响,非要等到条件成熟时由后人重新发现?

巴贝奇的分析机所需要的不只是机械上的精密,更需要一种新的思维方式,将计算看作抽象的逻辑操作,而不仅仅是物理动作。维多利亚时代的整个技术文化和数学教育,还没有为这种思维方式做好准备。埃达看到了这一点,她正是那个将计算抽象化的人,但她的时代看不到她。

科学与数学的进步似乎并非像通常想象的那样百川归海、顺理成章。它更像一个在黑暗中摸索的人,有时候一步跨得太远,周围仍旧黑暗,就只好退回来;有时候点燃了一根蜡烛,却没有人看见,只好等后来者在别处重新擦亮火柴。

但当我们在二十一世纪的今天回望,从算盘、算筹、纳皮尔骨筹、帕斯卡轮、步进鼓、雅卡尔卡片、巴贝奇的齿轮和埃达的注释,这条线索穿越数千年,连接着无数指尖与心灵,最终织成了我们身处其中的数字宇宙。它从来不是欧几里得几何学那种单一叙事,而是工具、符号、身体与思维的共同演化,一条隐秘而不可阻断的河流。

第十一章 非洲的数学星空:从撒哈拉到好望角

十进制诞生地:尼罗河上游的数学遗迹

在通常的数学史叙事中,非洲,除埃及之外,是一大片空白。这种空白并非因为非洲没有数学,而是因为那些创造数学知识的人从未被倾听。

1950年代,比利时考古学家让·德·海因策林在刚果民主共和国伊尚戈地区进行发掘时,发现了一根刻有凹槽的狒狒腓骨。碳定年显示它的年代约为公元前20000年。骨上的刻痕被分为三列,每一列的凹槽数呈现出难以用巧合解释的规律性。其中一列包含数字11、13、17、19,这几个数恰好都是质数,而且它们的总和是60,这个数字在许多非洲文明的计数传统中反复出现。

伊尚戈骨的真实用途至今仍是考古学界聚讼不休的话题。它是用来记录月相的历法工具?是某种游戏的计分器?抑或只是某个人在漫长的夜晚随性刻下的记号?但无论它的初衷是什么,它证明了早在文字发明前数千年,生活在非洲中部的人类已经在主动操作数字概念。这些远古的猎人和采集者们可能已经在用刻痕来追踪时间、清点猎物、或者单纯地玩味数量关系的奥秘。

更令人震撼的发现来自尼罗河上游的努比亚地区。库施王国,古代非洲最强大的文明之一,留下了大量数学活动的证据。在喀土穆附近的古墓中,考古学家发现了刻有几何图案的陶器,其年代可追溯至公元前3000年。这些图案包括精确的正方形、等边三角形和同心圆,表明制作者对几何形状有明确的自觉意识。

库施人的历法系统尤其值得关注。他们使用一种极为复杂的阴阳历,同时参照太阳和月亮的运行周期来确定日期。这套历法需要精确的天文观测和相当高级的数值计算。在库施时期的麦罗埃遗址中,发现了大量用于天文定位的石制观测台。从这些观测台的布局可以推断,库施天文学家掌握了一套计算太阳年与朔望月之间关系的数学方法。

库施文明还留下了自己的记数符号。与埃及象形数字不同,库施人发明的是一套更为抽象的数字记号,点、横线、交叉线,这些符号可以组合起来表示大数。遗憾的是,这套文字至今未能完全破译。那些刻在砂岩上的符号沉默着,等待着有人重新找到它们的读音和含义。

西非的二进制文化

1970年,美国数学史家克劳迪娅·扎斯拉夫斯基出版了一部开创性的著作《非洲计数:非洲文化中的数字与模式》。这本书首次向英语学界系统介绍了撒哈拉以南非洲的丰富数学传统。其中最令她着迷的发现之一,是约鲁巴文明中隐含的二进制思维。

约鲁巴人生活在今天的尼日利亚西南部,是西非最古老的文明之一。他们的传统计数系统表面上是二十进制的,但在深层结构上却展现出惊人的二进制特征。

约鲁巴计数的一个基本原则是减法。数字十五不叫“十加五”,而叫“二十减去五”。十六叫“二十减去四”。四十五叫“三个二十减去十五”。这种基于“距离最近的完整二十”的计算方式,听起来会令人想起计算机科学中的二进制补码,用与一个完整幂次的差来表示负数。

约鲁巴人为什么发展出这样一套计数法?扎斯拉夫斯基提出了一种解释:这与贝壳货币的使用有关。在西非的传统贸易中,货贝被穿成固定长度的串,通常是20枚或40枚一串。交易过程中,买家付出一整串贝壳,卖家找回适当的贝壳数。久而久之,“整串”成了心理上的计数基准点,计数也就变成了“整串减去找零”的逻辑。长期的商业实践将一套减法优先的心智算法刻入了整个文明的数学直觉。

约鲁巴的伊法占卜系统更进一步展现了这种二进制直觉。伊法是约鲁巴人最神圣的占卜传统,由祭司,巴瓦拉沃,主持。占卜过程产生一系列单双组合,祭司将十六枚棕榈坚果反复分成两堆,记录每次结果是单数还是双数。连续八次操作产生256种可能的结果之一,每一种结果对应一首特定的诗歌。在数学上,这等价于一个八位二进制数,从00000000到11111111。冯·诺依曼和香农在二十世纪设计的数字逻辑电路,其开关选择原则与巴瓦拉沃将棕榈坚果分为单双的操作逻辑不谋而合。

伊法占卜无意中构造了一套完整的二进制编码系统。当然,约鲁巴祭司不会用“二进制”这个词来理解自己的所作所为,他们用的是神话的、诗歌的语言。但数学结构并不依赖于操作者使用什么术语。无论你称之为“单双排列”还是“布尔代数”,其内在逻辑是相同的。约鲁巴文明在没有任何现代数学概念的情况下,独自走上了莱布尼茨在十七世纪用符号走上的同一条道路。

曼丁哥帝国的数学管理术

十四世纪,伊本·白图泰,伊斯兰世界最伟大的旅行家,穿越撒哈拉沙漠,抵达了马里帝国。他在游记中记下了自己的震惊:这个撒哈拉以南的王国治理得井井有条,“那里的人民是最公正的”。白图泰所看到的公正,部分就表现为一套用数学严格执行的法律制度。

马里帝国的核心是曼丁哥人。他们建立了一个庞大的中央集权国家,控制着跨越撒哈拉的黄金和盐的贸易路线。管理如此辽阔的领土和如此复杂的贸易体系,需要相应的数学工具。廷巴克图,马里的学术中心,拥有上百所古兰经学校和数十座图书馆,桑科雷大学是当时整个伊斯兰世界的顶尖学术机构之一。

廷巴克图的知识分子继承的是阿拉伯数学传统,花剌子模的代数学和欧几里得的几何学,但他们并非只是被动接受者。现存的廷巴克图手稿中包括了大量曼丁哥学者原创的数学著作。其中最引人注目的是一类被称为“遗产计算”的文献:在伊斯兰继承法的框架下,针对曼丁哥社会独特的家庭结构,给出详细的财产分割算法。

这些文献展现出高度的算法思维。一个典型的案例:“某人有三妻七子五女,遗产包括黄金、牛群和土地。其中一位妻子怀孕但胎儿性别未知。给出所有财产的最优分割方案。”这样的问题涉及条件分支,胎儿是男是女导致不同的分配比例,以及多种不同性质财产的等价兑换问题。曼丁哥学者设计了一套分步骤的决策程序,每一步都有明确的判断标准和运算规则,这就是现代的“算法”。

曼丁哥学者还专门研究了天课,伊斯兰教中每年必须缴纳的慈善税,的计算方法。天课税率随财产类别而变化:黄金和白银缴纳2.5%、农产品根据灌溉方式不同缴纳5%至10%、矿产缴纳20%。一个拥有多种财产的家庭需要计算综合税率。廷巴克图学者为此编制了详尽的计算表格,并发展出了一套近似算法,使得税务估算可以在没有纸笔的情况下口算完成。

还值得关注的是曼丁哥的市场数学。撒哈拉商道上进行的交易涉及多种货币体系:北非的金第纳尔、西非的货贝、盐板、布匹。汇率浮动,交易需要即时换算。曼丁哥商人发明了一套“手掌算法”,用手指的不同关节和位置来代表不同货币单位之间的兑换比例。这种算法通过触觉记忆来固化,可以在讨价还价的喧嚣中无声地快速操作。这让人联想到中国商人袖子里的手指议价,也让人联想到印加奇普的触觉数学,不同文明在相似的经济需求面前找到了相似的解决之道。

中部非洲的几何传统

刚果盆地在中世纪时期孕育了若干强盛的王国,刚果王国、卢巴帝国、隆达帝国,它们各自都留下了数学活动的痕迹。

刚果王国的城市规划令人惊叹。十六世纪葡萄牙探险家初次抵达刚果首都姆班扎刚果时,将它描述为一座“可与埃武拉媲美”的城市。城市按照精确的几何方案布局:中心是王宫和广场,向外辐射六条主干道,再以同心弧形的街道相连。这种蛛网式的街道布局需要相当高的几何规划能力,而其底层的圆形和放射线构造暗示着一种非欧几里得的空间直觉。

非洲传统建筑中广泛运用了分形结构。在许多传统村落中,住宅的布局呈现出嵌套模式:同一基本形状在不同的尺度上重复出现。一个典型的例子是喀麦隆草原的穆苏姆住宅,其平面图是一个圆形,内部又被划分为更小的同心圆和扇形区域。这种多层次的几何重复,是一种分形,并非出于审美装饰,而是功能性的:大圆套小圆的布局优化了空间的私密层级,将公共空间、家庭空间、储藏空间按几何逻辑区分得清清楚楚。

中部和南部非洲最引人注目的数学传统之一是“松迪几何”,一种在沙地上用手指画出的几何证明。在刚果盆地东部,青少年学习一种名叫“托波洛吉”的益智游戏:在沙地上画出一个网状图案,然后两个人轮流用手指沿着线条移动,试图迫使对手无路可走。这种图形在拓扑结构上类似于纽结和网络,而青少年在游戏过程中发展出的空间推理能力,实质上是一种没有书写系统的拓扑直觉。

西方数学史长期忽略了这些传统,因为它们“不符合数学的严肃定义”。但什么是数学的严肃定义?如果数学是模式科学,对规律、结构和关系的系统研究,那么沙地上的拓扑游戏、住宅的分形布局、城市规划中的几何构型,都应该被称作数学。数学在它的正统书写传统之外,还有一种更古老的、以身体和空间为媒介的存在方式。

南部非洲的数学岩画

南非的德拉肯斯堡山脉和津巴布韦的莫篷山丘上,分布着数千处布须曼人,桑人,的岩画。这些岩画以狩猎场景和神话形象著称,但其中一部分却呈现出明显的几何特征:等距平行线、规则的点阵、对称的螺旋。

长期以来,这些几何图案被简单地归类为“装饰”。但最近的研究揭示,某些图案中暗含着计数信息。在一处著名的津巴布韦岩画中,二十六条平行线被分为七个组,每组线条数目依次排列:4、3、5、4、3、3、4。这个序列或许记录了某个天文周期,月相、季节,或行星的运行。每组线条的数目和排列次序可能构成了一套原始的时间序列数据。

南部非洲的图西族人拥有极其发达的比例感知传统。他们的诗诵,名叫“伊比温古”,在韵律结构上使用了复杂的数学比例:音节数目的增减遵循特定的数列规则。这种数列与斐波那契数列极为接近,每一项大致等于前两项之和,由此产生一种奇妙的听觉快感。图西族诗人将这种数列内化为节奏本能,在即兴创作中自动遵循这些规则,尽管他们从未将它们写下来作为数学研究对象。

莱邦博山出土的狒狒腓骨,其年代约距今三万五千年,与伊尚戈骨年代相近。这根骨头上刻有29道清晰的凹槽,可能与月相周期有关。加上伊尚戈骨,加上布兰德山的刻痕岩画,南部非洲的先民们至少从旧石器时代末期起,就已经在用可移动和不可移动的载体记录数字。这些数字的载体从未演化成完全的书写系统,但它们是数学意识最早的化石证据之一。

被遮蔽的认知传统

非洲本土数学之所以在现代学术主流中长期缺席,原因是多重的。

其中一部分原因是载体问题。撒哈拉以南非洲的许多文明没有发展出完善的书写系统,数学知识主要通过口头传承,口诀、歌谣、游戏、仪式。口头文化的知识传递效率但它不像泥板、纸草和印刷书籍那样留下可考古发掘的证据。当殖民者抵达时,他们眼中的非洲是一片“没有数学的大陆”,因为数学在他们自己的文明中以书写为唯一合法形式。

另一个原因是殖民时代的知识等级制度。欧洲数学被建构成唯一的“真正”数学,而非洲的计数、几何、算法则被贬低为“民俗”、“原始思维”或“下意识行为”。这种知识等级制有意识地抹去了非洲的贡献,将数学史重写为一条从巴比伦到希腊到欧洲的单行道。

但在这些政治和历史因素背后,还潜藏着一个更微妙的认知偏见:对“数学”这一定词本身的窄化理解。如果数学被定义为从公理出发进行严格逻辑推导的活动,那么非洲传统中确实少有数学,同样的标准也会排除巴比伦、埃及和中国的绝大多数数学成就。但如果数学被更宽泛、更准确地定义为对模式、结构、数量和空间的系统研究,那么非洲的贡献就清晰可见。

约鲁巴的二进制占卜系统、曼丁哥的税务算法、刚果的分形建筑布局、布须曼人的几何岩画,这些不是非理性的幻想或偶然的巧合。它们是系统的、可传授的、服务于明确目的的认知工具。它们满足数学活动的全部基本标准,只是以不同于希腊几何学的方式组织起来。

当代民族数学研究正在努力恢复这些被忽视的传统。2019年,国际数学史委员会首次将非洲数学列为其年会的特别专题。尼日利亚和南非的大学开始将约鲁巴计数法和松迪拓扑游戏纳入数学教育课程。廷巴克图的手稿正在被系统性地数字化和翻译。这些工作不是出于政治正确的姿态,而是出于真正的学术好奇心:人类理解数量和空间的方式,原本比我们惯常假定的更为丰富多样。

非洲数学的故事不是一个关于落后的故事。它是一个关于多条道路的故事,人类抽象思维在截然不同的生态环境、社会结构和文化观念中生长出来的各个变体。有些变体最终汇入了世界主流,有些留在了自己出发的溪流中。但它们都属于同一个属,人类对秩序的本能追求。

每一道刻在骨头上的凹槽,每一次将棕榈坚果分为单双的手势,每一座按同心圆修建的村庄,它们都是数学的星空上未曾被记录的星星。现在已经太迟了,有些星星已然永远熄灭,连记忆的光亮也无法传送到我们的时代。但还有足够多的光芒残留着,只要我们愿意在史学惯常的辐辏之外,抬起眼睛,看向被遗忘的那片天区。

第十二章 大洋洲的数学:没有文字的几何学家

航海者的大脑:密克罗尼西亚的星海导航术

在人类数学史上,有一个几乎不可思议的事实:地球上最精妙的导航系统之一,由一群没有文字、没有金属工具、也从未建造过大型建筑的岛屿民族所创造,并在数千年间代代相传。

密克罗尼西亚的航海者,特别是来自加罗林群岛的普鲁瓦特人,掌握着一套被称为“星海导航”的技艺。这套技艺使得他们能够在没有任何仪器的情况下,精确地航行在散布于太平洋、有时相隔数百公里的小岛之间。一艘独木舟、一张用椰绳编织的网图、一个经过数十年训练的头脑,就是全部装备。

这套导航系统的核心是一种纯粹靠心智完成的坐标变换。航海者将自己定位在一个想象的球面坐标系中。他同时处理着多个参照系:以出发岛为原点,以目标岛为终点的航向;以洋涌方向为参照的相对位置;以北天极为原点的星体坐标;以海底地形为参照的水深位置图。

现代人完成这类变换需要使用向量、三角函数和旋转矩阵,这些都是大学程度的数学内容。密克罗尼西亚的航海者没有纸笔,没有角度的符号表示,没有经纬度的数字刻度。但他们内化了一套同样精确的替代系统。他们将天空划分为三十二条方位线,每一条线与某个岛屿的方位对应。他们用独木舟的桅杆、舷外浮木或者自己的手臂作为量角器,可以在晃动的甲板上精确读出星辰升起的位置。他们将洋涌,那些在开阔洋面稳定传播的长波,当作惯性导航仪来确定方向。他们甚至利用了水下深度的变化:当独木舟经过一座海底山脉时,水面上波纹的细微改变能被老练的航海者的脚底感知。

所有这些信息被整合进一个统一的、动态更新的心智模型中。人类学家埃德温·哈钦斯在对密克罗尼西亚导航术的研究中写道,一个优秀航海者的大脑“相当于一台执行卡尔曼滤波的模拟计算机”,卡尔曼滤波,即现代导航系统(从阿波罗飞船到智能手机GPS)的核心算法。这种算法不断将新的观测数据与先前的预测值按权重合并,以最小化不确定性。密克罗尼西亚的航海者正是这样做的:他们持续地将星体位置、洋涌方向、风向触感、水色变化、鸟群飞向等信息纳入已有的航向模型中,不断微调,使独木舟在几无可见地标的洋面上精确抵达目的地。

这一套数学知识没有被记录在任何泥板或纸张上。它们被编码为歌谣、口诀和神话,那是以声音为载体的信息存储技术。一首加罗林群岛的导航歌谣中,每一句歌词都对应着一段航程的起止点、方位和距离。歌词的韵律本身就是数据压缩,将数十个岛屿的数百段航程数据压缩为可以被记忆的韵律结构。当导航者在海上吟唱这些歌谣时,他实际上是在“读取”一张以声音形式存在的海图。

密码学,现代数学的一个重要分支,与密克罗尼西亚导航歌谣之间有着意想不到的联系。两者都将信息从一个形式转换为另一个形式,使其在传输中不被丢失或误解。两者都依赖于精确的编码和解码规则。两者都寻求在噪声(海浪声,干扰信号)中保留有效信息的完整性。唯一不同的是表达介质:一个用的是电子比特,一个用的是人的声音。

沃皮瑞的亲属宇宙:数学结构与婚姻法则

澳大利亚原住民已经在澳洲大陆上生活了至少六万五千年。这是地球上最古老、并且直到十八世纪之前几乎完全与外界隔绝的连续文明之一。他们的数学没有发展出数字系统,多数澳洲原住民语言中只有“一”、“二”、“三”和“很多”这几个数词,但这并不意味着他们缺乏数学思维。只是他们的数学没有被指向数字,而是被指向了结构。

沃皮瑞人是生活在澳大利亚中部沙漠中的一个原住民族群。他们的社会制度,尤其是婚姻法则和亲属分类,构成了人类学家所知的最复杂的数学结构之一。沃皮瑞人将整个社会宇宙划分为八个“分节”,每一个分节包含特定的亲属关系、特定的仪式职责和特定的婚姻许可。一个人属于哪一个分节,是由他的父母的分节按照一套严格的生成规则决定的。

人类学家在二十世纪中叶才意识到,沃皮瑞的这套系统在数学上等价于一个群论结构,是一个阶为八的二面体群。群论是近代数学中最抽象的领域之一,十九世纪由伽罗瓦引入,二十世纪成为物理学(从晶体结构到基本粒子分类)的基础语言。而在欧洲人想到群论之前一万年甚至更久,澳洲中部的原住民已经将群论的基本结构纳入了自己社会的运作逻辑中。

沃皮瑞人当然不会用“二面体群”这个词来称呼自己的婚姻规则。他们用图腾、神话和梦境来谈论它。但数学结构是独立于术语存在的。当这一代沃皮瑞老者向下一代传授“你应该娶母亲兄弟的女儿那一类女人”,并且这句话的逻辑后果确保证整个婚姻网络维持均衡和可维系时,他们就是在操作群论中的生成元与关系,那些近世代数课本上用抽象符号写成的规则。

这提出一个深层的哲学问题:什么是数学?如果数学是对抽象结构的研究,那么沃皮瑞人的亲属系统就是数学,它不是关于数字的,却是关于结构及其变换的。它是被活出来的数学,而不是被写下来的数学。它是嵌在身体实践与亲属称呼中的群论,而不是印在纸张上的群论。

这种“活着的数学”让我们重新反思西方数学传统将“一般性”和“抽象性”视作数学本质特征的信条。沃皮瑞亲属系统是一般性的,它适用于部落中的所有人。它是抽象的,它不依赖于具体的个人,而是定义了一组位置及其变换关系。它同时是逻辑严密的,违反婚姻规则会导致逻辑矛盾(社会秩序的紊乱,或者用群论语言来说,运算的不封闭)。这些正是数学结构的所有关键属性。

时空的编码:澳洲原住民的天文与历法

澳洲原住民没有正式的历法系统,没有年份的编号,没有月份的划分。他们却有极其精密的季节性知识。在许多原住民族群中,一年的开始不是由日期决定的,而是由某个特定恒星的首次偕日升,那颗星在拂晓前的地平线上第一次闪亮的那个早晨,来标志的。

在维多利亚州西部的原住民传统中,当北天星座中的某个特定星群首次在黎明前出现时,就标志着某种重要植物块茎的成熟季节到了。在同一时刻,另一个族群则用同一颗星的出现来标记长途贸易集会的日期。这里存在着一个天文-历法-经济-社会的耦合系统:天象作为时间标记,时间标记决定经济活动,经济活动安排社会接触。

这种认知方式要求一种我们颇为陌生的数学:不是计数,而是从连续变化的时空中识别出离散的信号点。澳洲原住民的天文知识不是关于计算天体轨道的,而是关于在正确的时刻做出正确决策的。这不完全是现代科学意义上的数学,但它是扎根于环境数据模式识别的一套知识体系,同样属于人类数学能力的表达。

毛利人的几何装饰数学

新西兰的毛利人,波利尼西亚航海者的后裔,在建筑和装饰艺术中展现出另一类数学思维。毛利人的雕刻和纹身图案以其复杂性著称,而这些图案背后隐含着一整套对称群的数学。

在毛利会堂的雕刻中,最常见的母题之一是“科鲁”,以蕨类植物嫩芽为原型的螺旋曲线。这些螺旋不是随意绘制的,它们遵循着严格的几何规则:等角螺旋(对数螺旋)在放大或缩小后保持了形状的不变性。在自然界的鹦鹉螺壳和银河系的旋臂中也能观察到同样的数学结构。

毛利纹面,塔莫克,的图案设计遵循确定的对称规则。面部左右两侧的螺旋曲线互相呈镜面对称,而额头的纹样则呈现出平移对称,同一种形状在不同的水平层级上重复出现。这些图案可以用数学群进行分类,而这种分类恰好对应于标准几何变换群:平移群、旋转群、反射群,以及它们的组合。

波利尼西亚人,包括毛利人、夏威夷人、塔希提人,在他们的航海绳图上同样展现了数学特征。这些用椰绳编织而成的网图,看起来像是不规则的绳结网状物,实际上是以等角投影方式映射的洋涌折射模式。航海绳图的每一个绳结代表一座岛屿,绳索代表洋涌的波阵面绕岛折射的方向。这是一种物理对等变换,将波传播的物理特征映射为可触摸的二维拓扑结构。二十世纪物理学家费曼在建立量子电动力学时发明了类似的图形化工具,费曼图。波利尼西亚的绳图与费曼图之间没有历史联系,但有认知上的平行:两者都是将连续动态过程对映为离散的图形记号。

知识形式的再思

大洋洲原住民的数学传统挑战了我们对“什么是数学”这一问题的标准回答。

在现代社会中,我们习惯性地将数学等同于一套特定类型的符号操作,用阿拉伯数字书写、用代数公式表达、用证明逻辑验证。但在大洋洲,数学以另类的符号系统存在:以星体的运行轨迹、以亲属的称呼分类、以皮肤上的墨痕螺旋、以椰绳的拓扑结构。这些符号系统不需要纸张,不需要书写,但它们执行着同样的认知功能:分类、抽象、推理、建立关系、预测未知。

一个密克罗尼西亚的导航者在脑海中完成的坐标变换,与一个剑桥数学家用纸笔计算的球面三角方程,遵循着相同的数学规律。密克罗尼西亚人说不出正弦定理的公式,但他能够精确地依据恒星仰角与航向的夹辐来调整独木舟的方向。公式是写在纸上的数学,调整方向的手是活着船上的数学。两种形式皆为同一条定理的承载者。

这种多元性提醒我们保持概念的谦逊。当古希腊人将数学从计算技艺升华为逻辑证明体系时,他们完成了一个伟大的飞跃。但那个飞跃并不应该使其他形式的数学思维变得不可见。伊尚戈骨的刻痕、密克罗尼西亚的星歌、约鲁巴的占卜坚果、沃皮瑞的婚姻矩阵,它们属于同一种人类行动:从混沌中认出秩序,从差异中构建分类,从变化中捕捉不变量。数学就是这种行动,至于它借由什么符号系统执行,倒在其次。

大洋洲原住民在完全与欧亚大陆数学传统隔绝的情况下,独立发展出了富有独创性的数学认知体系。它的存在终结了一种古老的偏见,认为只有某些“高等文明”才有数学。数学不是文明的奢侈品,它是人类这个物种心智的基本功能,不论在雅典的学院里,还是在大洋的一叶独木舟上,又或是在沙漠深处被星辰照亮的脸庞上。它只是穿了不同形制的衣服,说着不同音调的语言。而其内核从伊尚戈骨时代至今,一点都没有变。

第十三章 中世纪欧洲的数学暗夜:并非一片荒芜

被误读的“黑暗时代”

历史教科书上那句“中世纪是科学的黑暗时代”,已经重复了太久,久到很少有人去追问它是否准确。这个词组本身就是一个文艺复兴时期的修辞发明,彼得拉克和他之后的意大利人文主义者们,为了将自己所处的时代塑造为古典文明的伟大复兴,刻意将夹在罗马帝国与他们之间的那千年时光描绘成一片智识的废墟。

真相总是比口号复杂。中世纪(约公元500年至1500年)的欧洲数学确实在几个世纪里大幅萎缩,与同时期的阿拉伯帝国、印度乃至中国相比,的确显得贫瘠。但这并不意味着欧洲的数学思维完全停滞了。在修道院的抄经室、在主教座堂的学校、在商业城市的账房里,数学被保存、被传授、被缓慢地重新创造。这些活动,零散的、地方性的、以实用为导向的,为十二世纪之后的翻译风暴和十七世纪的革命铺设了必要的基础。

导致早期中世纪数学萎缩的原因是多方面的。罗马帝国的崩溃破碎了地中海世界的统一知识网络。希腊语在西方拉丁世界几乎完全失传,致使希腊数学原典无法被直接阅读。城市的大幅萎缩使得以商业为中心的实用算术丧失了需求。早期基督教对异教学术的戒心,尽管从未像后来的某些传说所夸大的那样彻底,至少在态度上制造了某种对世俗知识的疏离。

但在这些不利条件之下,数学依然存活着。在爱尔兰的偏远修道院中,在查理曼大帝的宫廷学堂中,在十世纪西班牙边境的修道院里,对数字和几何的兴趣从未完全消失。只是它以一种与古典时期不同的形式存在:更功利、更琐碎、更依赖于算术而非证明。它是为计算复活节日期而存在的历法数学,是为建造大教堂而存在的实用几何,是为分割遗产和计算利息而存在的商业算术。

修道院里的算盘与历法

六世纪,罗马贵族波爱修斯,因叛国罪被东哥特国王狄奥多里克投入监狱并最终处死,在狱中撰写了他最后的著作。波爱修斯没有完成他最雄心勃勃的计划:将全部柏拉图和亚里士多德著作翻译成拉丁文。但他成功完成的一件事对后世产生了意想不到的影响:他编写了一部算术教材。

波爱修斯的《算术原理》是一部拉丁文版的尼科马库斯算术(尼科马库斯是公元一至二世纪的希腊数学家)。这本书的水平以任何标准来看都不算高,它主要讨论数的分类(奇数、偶数、质数、合数、完全数、亲和数)和比例理论,缺乏希腊数学最珍贵的证明精神。但在随后的几个世纪里,当更高级的希腊数学著作在西方失传时,波爱修斯的这本小书几乎是拉丁世界唯一可用的数学读物。它被修道院学校用作标准教材,一直沿用到十二世纪。

波爱修斯还写了一本几何学著作,其中包含了一些实用测量法,据说也翻译了欧几里得《几何原本》的前几卷(虽然有学者怀疑这个译本并非出自他手)。无论作者是谁,这个不完整的欧几里得译本在修道院中流传了几个世纪,让欧洲人至少记住了欧几里得这个名字,以及几何证明的基本形式。

比波爱修斯更深刻影响中世纪日常数学的是历法计算。基督教的年历并不是一成不变的,复活节的日期每年都会改变。它是根据一个复杂的公式决定的:春分之后第一个满月之后第一个星期日。这意味着要准确确定复活节,必须同时掌握太阳年(确定春分)和朔望月(确定满月)两种周期,还需要知道星期日的周期性。

这一套计算,被称为“科普特斯”,是中世纪早期最复杂的常规数学运算。每个修道院都有一到两位精通此术的修士,他们用算盘和罗马数字推算出未来数年的复活节日程。这种历法计算保存了天文学与数学之间的关联,也让相当数量的修士保持着对周期性数学思维的熟悉。

算盘是中世纪早期欧洲最重要的计算工具。罗马时代的算盘,一块带有平行槽的计数板,槽中滑动的圆片表示数字,在帝国崩溃后并没有立即消失。十一世纪之前,算盘几乎是整个欧洲唯一的复杂计算工具。用算盘做乘法需要一套精细的口诀,这些口诀在不同修道院之间以口头方式传承,有些口诀至今保存在手稿的边缘空白处。算盘的使用决定了中世纪早期欧洲人对数字的感知方式,数字是槽中的算珠位置,而不是纸上的符号。这种工具化的数字观念,与中国的算筹和印加的奇普一样,是一种以操作而不是以书写为基础的具体数学。

热尔贝:书生的教皇

公元九百九十九年的暮春,拉文纳,奥托三世,神圣罗马帝国的年轻皇帝,坐在他位于意大利北部的宫廷中,身边是他的老师、朋友、也是他最信任的顾问,一个来自法国南部小镇奥里亚克的修士。教皇格里高利五世刚刚去世,奥托三世毫不犹豫地提名他的老师继任圣彼得的宝座。这是历史上第一次由一位法国人出任教皇,也是第一次由一位数学家出任教皇。他被称为西尔维斯特二世,但后世更常叫他的本名,热尔贝。

热尔贝早年在本笃会修道院接受教育,但他真正的数学启蒙来自西班牙。在十世纪后期的西班牙边境地区,基督教修道院与穆斯林城市比邻而居,知识开始从南向北渗透。热尔贝在加泰罗尼亚的比克修道院学习时,接触到了阿拉伯数字、星盘的使用方法以及远比波爱修斯算术更精深的数学知识。他带回了算盘的改进设计,在算盘上标记印度-阿拉伯数字,而不是传统的罗马数字,这使计算效率大幅提升。他还带回了星盘的知识,写了一本关于如何使用星盘的手册。

热尔贝的数学著作包括关于算术、几何和天文学的几篇短文。他的几何学论文显示出他对欧几里得有比同时代人更深的理解,尽管他所用的文本仍然是残缺的。他在兰斯担任学校校长时,将数学列为必修课程,这在当时几乎是独一无二的做法。他的学生中有后来的法国国王罗贝尔二世,有帝国的主教们,有遍布欧洲的学者。

热尔贝造了一台天文演示仪,一种用齿轮传动的、可以模拟行星运动的装置。这或许是欧洲最早的尝试将数学知识物质化为机械装置。他在兰斯大教堂附近的房间里,在深夜的烛光下调试这些齿轮时,他的对手们正在散布一个谣言:这个掌握了异教徒数学知识的人,一定与魔鬼做过了交易。

热尔贝的教皇任期只有短短四年。他死于1003年,葬在拉特兰大教堂。他的坟墓后来变成了一个传说:据说每当有教皇即将去世时,热尔贝的石棺就会渗出水分。这个阴郁的传说模糊地暗示着,他留下的不只是一个被记住的名字,还有一种长久以来覆盖在数学家身上的不安目光,对掌握了太多抽象奥秘的人的信任,从未彻底。

大教堂里的几何学

中世纪盛期最壮观的数学不是在纸上完成的,而是在石头上。

十二至十四世纪,欧洲各地兴建了数百座哥特式大教堂,巴黎圣母院、沙特尔、亚眠、兰斯、科隆。这些建筑的结构复杂性远远超过了此前任何时期的欧洲建筑。为了建造这些高耸入云的石头肋架和尖拱,建筑师们需要一整套几何和比例知识。

“建筑师的秘密”,中世纪石匠行会的不传之术,很大一部分就是几何学。如何用圆规和直尺在现场将设计图放大到一比一的尺寸?如何确定飞扶壁的曲率以恰到好处地抵消屋顶的侧推力?如何设计玫瑰窗中那些内切的圆和弧?这些问题要求对几何有直觉式的理解,而不只是纸上谈兵。

建造沙特尔大教堂的建筑师,他们被称为“石匠大师”,留下了一本被称为《石匠之书》的几何手稿。手稿中包含了玫瑰窗的几何设计方法、拱顶肋架的弧度计算、楼层高度的比例确定。这些方法必须能够在建筑工地上用最简单的工具,圆规、直尺、铅垂线、水平仪,来执行。因此,它们被化为了一套高度优化的几何作图程序,含有最少的步骤就得到所需的点与线。

沙特尔的玫瑰窗是这种几何知识的巅峰之作。它的直径将近十四米,由数十个同心圆和辐射状排列的花瓣形组成。每一个花瓣都是一块独立的彩色玻璃,嵌在石格的框架中。设计这样一个玫瑰窗需要解决一个数学问题:如何将一个圆等分为若干份,每一份的宽度与相邻的份保持特定的比例,使得整体产生和谐的视觉韵律。沙特尔玫瑰窗的十二个主要花瓣以十二使徒为象征,但它们在几何上是将圆周分成十二个等弧,这要求石匠能够精确地作出正十二边形,而作正多边形是古希腊几何学中的经典问题。

哥特式建筑的几何学不是欧几里得式的,甚至不是完全书面的。它不是通过阅读《几何原本》学习法则然后加以应用,而是一种在实训中积累的、隐含在操作中的几何身体记忆。一个石匠学徒花了十年来学习这些技艺,从琢石、放样到定位拱顶石,其间他培养出了一种对比例和角度的直觉,这种直觉虽然不能以公式书写,但实际上运行着高级的空间推理。这不是理论的几何学,是制造的几何学,是实用与美在石头纹理中达成的平衡。

斐波那契与商业数学

公元1202年,意大利比萨城的面貌正在改变。十字军东征打开了一个从地中海东岸延伸到北欧的贸易网络。意大利的商业城邦,比萨、热那亚、威尼斯、佛罗伦萨,处在这个网络的心脏位置。来自东方的货物经这些港口流向欧洲内陆,随之而来的还有东方的知识。

在这一年,一个名叫列奥纳多·比萨诺,后世称他为斐波那契,的比萨商人子弟出版了一本改变了欧洲数学进程的书:《算盘书》。

斐波那契的父亲是比萨共和国驻北非布日亚(今阿尔及利亚境内)的商业代表。年轻的斐波那契跟随父亲在地中海港口间旅行,接触到了印度-阿拉伯数字。他被这种数字系统的优雅和高效深深吸引,在随后的几年里游历了埃及、叙利亚、希腊和西西里,向各地的数学家请教。

《算盘书》是斐波那契将所见所学综合起来的结果。他极力主张欧洲放弃算盘和罗马数字,改用印度-阿拉伯数字。他在书里不厌其烦地讲解位值记数法的每一个细节:如何写数字,如何对不同位值的数字进行加减乘除,如何验算结果。

除了数字系统,《算盘书》还包含了大量实际问题。如何根据金子的成色计算首饰的价值。如何分割一笔遗产。如何计算合伙生意的利润分配。如何根据一匹布的长度和宽度计算价格。每一个问题都带有地中海港口城市繁忙的商业生活的气味,香料、丝绸、金币、海船、关税。斐波那契的数学是商业数学,面向的是柜台后面的商人和账房里的会计,而不是大学里的学士。

他那个著名的兔子问题,一对兔子每月生一对新兔子,新兔子两个月后也开始生育,一年后有多少对,在全书中只占极短的段落。后世将整个数列命名为斐波那契数列,将这个极小的问题放大成了斐波那契的象征。但在他自己的时代,斐波那契的雄心要大得多:他想改变整个欧洲计算的方式。那些翻译花剌子模所得的代数知识,那些重新整理的新几何方法,那些商品货币折算的快捷算法,这些才是他的主角。

斐波那契成功了,但在很久以后。印度-阿拉伯数字在整个十三世纪缓慢传播,持续遭到传统主义者的抵制。这种数字的普及与意大利商人阶级的扩大同步发生,到十四世纪时已在地中海商业城市成为主流,但在北欧还要再等一个世纪。

默顿计算者与量化思维

十四世纪的牛津,默顿学院里,一群逻辑学家和数学家正在进行一场思想实验,一场最终会彻底改变欧洲人看待世界的方式的实验。

这群人后世被称为“默顿计算者”。他们的核心人物包括托马斯·布拉德沃丁、威廉·海特斯伯里、理查德·斯旺斯海德和约翰·邓布尔顿。他们关注一个奇怪的问题:运动的量化,如何精确地描述一个物体越来越快或越来越慢的运动?

亚里士多德的物理学对运动进行了分类,但亚里士多德并不试图精确量化运动。默顿计算者走了另一条路。他们引入了一种新概念:瞬时速度。物体在某一个时刻有一个精确的速度,即使它在加速。他们还证明了“默顿平均速度定理”:如果一个物体从初速度均匀加速到末速度,那么在这段时间内它通过的距离,等于它用平均速度(初速度与末速度之和的一半)匀速运动相同时间所通过的距离。

这条定理在物理学史上有一个响亮的名字,伽利略自由落体定律的最早形式。它的证明用了纯粹的逻辑推理,辅以算术和比例理论。默顿计算者没有做实验,他们坐在牛津的石墙后面,只用纸笔就想到了两个半世纪后伽利略才用斜面实验证明的规律。

默顿计算者的影响远远超出了运动学。他们开创了一种全新的思维方式:将物理性质,不仅是速度,还有热度、亮度、密度,看作可以度量的量,并研究这些量如何随着时间或空间的变化而加加减减、增强或减弱。这种“性质的程度”概念为后来一切定量科学奠定了基础。当伽利略说“自然之书是用数学语言写成的”时,他的措辞里包含了默顿计算者埋下的回响。

布拉德沃丁还写了其他数学著作。他的《理论几何学》对平行线理论做了重要补充。他的《理论算术》讨论了比例理论。1349年,布拉德沃丁被任命为坎特伯雷大主教,同年黑死病席卷英格兰,他到任不过几周便被瘟疫夺去了生命。默顿计算者们的著作散布到欧洲大陆,影响了巴黎大学的多位自然哲学家,也影响了后来的伽利略和笛卡尔。

一种新的数学精神正在形成:数学不仅是计算利润或建造教堂的工具,它还是理解自然本身的唯一语言。这种信念在默顿学院那群逻辑学家的脑海中,还只是隐约的轮廓。但轮廓已经出现了,之后的几个世纪将要把它描绘得越来越清晰。

奥雷斯姆与图形化数学

尼科尔·奥雷斯姆是巴黎大学的神学家,后来成为利雪的主教,也是他那个时代最具原创性的数学思想家。他的一个想法在后世整整塑造了一个学科:用图形表示量化的变化。

在奥雷斯姆之前,人们用表格和文字来描述变化,比如一个物体的速度如何随时间改变。奥雷斯姆在十四世纪中期提出,可以画一条水平线表示时间,画一条垂直线表示速度,然后在平面上画出速度随时间的变化曲线。由此,匀速运动是一条水平直线,匀加速运动是一条倾斜直线,非均匀加速运动是一条曲线。

这就是函数图像的发明,比笛卡尔坐标系早了将近三百年。

奥雷斯姆没有用“坐标”这个词,但他的图形具有坐标的一切关键特征。他称水平线为“经线”,垂直线为“纬线”,借用了地理学术语。他在不同学科之间驰骋,将同一个方法应用于速度、热度、亮度甚至神学概念的量化分析。他的图示广泛地在手稿中传播复制。

奥雷斯姆还证明了一个重要定理:匀加速运动的速度曲线下方的面积等于物体经过的距离。用现代术语来说,这是微积分基本定理的一个特例,距离是速度的积分。十四世纪的主教在证明十七世纪牛顿和莱布尼茨用极限和无穷小量来证明的定理。尽管奥雷斯姆的证明依赖于比例理论和几何直觉(而非现代的极限概念),其逻辑内核与现代证明颇为相近。

奥雷斯姆的图形方法在欧洲大学里传播了两个世纪。伽利略年轻时在比萨大学学习时,他的笔记中就有奥雷斯姆式的速度和运动图。笛卡尔在发明解析几何时,很可能见到过奥雷斯姆手稿的某个抄本。微积分不是凭空出现的,它的根须从十四世纪的牛津和巴黎开始,在思想土壤的深层缓慢延伸。

结语:暗夜中的微光

中世纪欧洲的数学没有金字塔的高度,没有泥板上的楔形文字方程的精确,没有印度零的哲学深度,也没有中国算法的广泛适用性。它是零碎的、地方性的、缓慢的。

但它是真实的。在爱尔兰的石砌修道院里,一个修士用算盘推演下一年的复活节,烛火在他的瞳孔中跳跃。在沙特尔的工地上,一位石匠大师用圆规放大玫瑰窗的几何图样,石灰在指尖变成白色粉末。在牛津默顿学院的一个阴冷房间里,一群逻辑学家争论瞬时速度是否可以用“程度”来定义。在奥雷斯姆的巴黎书斋中,一条倾斜的直线在羊皮纸上延展,首次将时间和速度编织到同一幅画面中。

这些分散的、微小的数学活动最终都汇入了同一股潮流。十二世纪之后,阿拉伯和希腊数学大规模进入欧洲,与本土的默顿传统、商业算术传统、哥特几何传统相互激荡。到了十六、十七世纪,这股潮流终于冲破了堤坝,形成现代数学最初的洪流。

中世纪的所谓黑暗不在于缺少创造性,而在于缺少记录,以及缺少将分散的小灯聚集起来汇聚成明亮光线的光学装置。大教堂的石墙已经沉默,羊皮纸封存在档案中,那些计算过、测量过、证明过的人早已无名。但他们做过的事映照在后世每一页数学手稿的行间,在每一次将世界纳入公式的努力深处。一个千年间未曾间断的暗流,等待着被人辨认与命名。

第十四章 欧亚走廊的数学行者:丝绸之路上的知识织造

丝路数学的三个面相

丝绸之路的数学传播有一个往往被现代人忽视的特征:它极少是整本著作的系统翻译,而更多是零散知识的渐进渗透。一个商人学会了一种记账法,一位僧侣记住了一套历法口诀,一名工匠掌握了一门比例放样的技术,这些携带者各自只搬运了数学大厦中的几块砖石。但当这些砖石在目的地被重新组装时,它们往往与当地的原有建筑风格融合,形成一种全新的结构。

中国南北朝至隋唐的佛经翻译中夹杂着大量的数学和天文内容。印度僧侣携来梵文佛典,其中《俱舍论》等著作包含了关于宇宙尺度的夸张数字,由旬、那由他、阿僧祇,这些庞大的数量单位将中国人的数字想象力从日常账目扩展到了难以置信的宇宙量级。唐代一行禅师在制定《大衍历》时,不仅使用中国传统的算法,也引用了印度天文学中的正弦表,这是正弦函数第一次出现在中国数学文献中,尽管一行没有采用印度人将圆周分为360度的做法,而是将其改造成了中国式的365又1/4度体系。

波斯的影响则更为隐蔽而深远。萨珊波斯的星象学在六至七世纪传入中国,携带着巴比伦和希腊天文学的计算残余。元代回回司天台,忽必烈汗设立的伊斯兰天文学机构,更是直接将阿拉伯的三角函数表和球面三角学引入了中国。扎马鲁丁这位来自中亚的天文学家在元大都制造了七件天文仪器,包括浑天仪、方位仪和地球仪,这些仪器的设计基于阿拉伯数学传统。

东亚的数学也在向西流动。中国是最早系统使用十进制的文明,不仅计数是十进制,度量衡也广泛采用十进制。这一做法经由中亚商队传入波斯和阿拉伯世界,为印度-阿拉伯位值记数法的完善提供了实践参照。纸,中国人发明的书写材料,在八世纪传入阿拉伯帝国,随后进入欧洲,极大地降低了数学知识的记录和传播成本。没有纸,斐波那契的《算盘书》或许永远无法被传抄到全欧洲。

粟特商人的账本

中亚的绿洲城市,撒马尔罕、布哈拉、塔什干,在丝路贸易中充当着中转站的角色。控制这些商路的是一个商业天赋卓著的民族:粟特人。粟特商人的足迹从长安延伸至拜占庭,他们的账本在二十世纪的考古发掘中重见天日,让后世得以窥见丝路贸易背后的数学实操。

在一份发现于塔吉克斯坦穆格山城堡的八世纪粟特账本残片中,列出了从中国运来的生丝数量和价格、沿途缴纳的各关口关税、在撒马尔罕本地市场的预期售价。账本中最引人注目的是货币换算。丝路贸易涉及多种货币:中国的铜钱、波斯的银第尔汗、拜占庭的金诺米斯玛、粟特本地的仿制银币。各种货币之间的比价波动不定,粟特商人必须能够在不同货币体系之间即时换算。

一个典型的算例:一批生丝在中国售价为若干铜钱,在撒马尔罕以银第尔汗出售,其中要扣除运输中的损耗、沿途七个关卡的关税(每关税率不同)、以及驮畜的饲料费。最终利润以拜占庭金币结算。粟特商人发明了一种速算方法,将常用的汇率和费率编成口诀,在骆驼背上就可以心算完成全部换汇过程。这些口诀实际上构成了一个压缩的运算程序,给定输入值,按照步骤操作,得出输出值。在电子计算机被梦想出来以前十二个世纪,中亚商队已经在运行算法。那些算法的持有者不知道自己身在数学史中,也不在意身后会不会被写进数学史,他们只是在做生意,而生意需要精确。

粟特人还将中国的算筹带到了西方。撒马尔罕的粟特商人使用一种与中国算筹几乎完全相同的计数棒来进行计算,不同的是他们将骨制或木制短棒放在一张画有格子的布料上,这种便携式“算盘布”可以卷起来放入行囊。这种计数方式后来传入波斯,波斯人称之为“印度算术”,因为波斯人与印度人的数学习惯接触更为密切。但考古证据表明,中亚的计数棒传统同时受到了中国和印度两个方向的影响,是丝路数学融合的典型产物。

蒙古帝国的数学交换

十三世纪,蒙古铁骑建立起了人类历史上面积最大的陆地帝国。帝国从朝鲜半岛延伸至多瑙河畔,从西伯利亚冻原延伸至波斯湾。蒙古人对数学本身并无特别兴趣,他们最初连书写系统都没有,但他们的征服打破了此前分隔各文明的政治和地理壁垒,创造了一个短暂但极其高效的跨文化知识交换网络。

忽必烈汗的宫廷中同时设有中国司天台和回回司天台。两个机构编制各自的历法,使用各自的方法,互有竞争也互有渗透。中国天文学家郭守敬,元代最伟大的科学家,在他的《授时历》中前所未有地使用了相当于球面三角学的计算方法。传统中国天文学一直使用近似平面公式来处理天球问题,郭守敬的突破显然受到了伊斯兰天文学的影响。他在全国设立了二十七个天文观测点,从西伯利亚边缘到南海之滨,测量各地的北极出地高度(即纬度)和夏至影长,用这些数据来验证和改进历法。这一规模宏大的科研活动,在传统中国科学史上是空前的,体现了蒙古帝国统一带来的组织能力与知识流通。

波斯方面,伊尔汗国的旭烈兀汗在征服巴格达(1258年)之后并未彻底摧毁学术。他的大臣和继承人很快认识到科学知识在治理帝国的实用性。伊尔汗国在大不里士附近的马拉盖建造了当时全世界最大的天文台,由纳西尔丁·图西主持。马拉盖天文台聚集了来自中国、波斯、中亚和印度的天文学者,他们共同编制了《伊尔汗历表》。这部历表使用了中国式的十进制角度划分(将圆周分为365又1/4度,而不是希腊-阿拉伯传统的360度),同时使用了伊斯兰的三角学工具。这是两种数学传统在同一个科研项目中的协同工作。

马拉盖天文台还做出了一个划时代的理论贡献:图西提出了“图西双轮”,一种用两个嵌套的匀速圆周运动来产生直线往复运动的几何模型。这个数学模型后来被哥白尼在《天体运行论》中用来解释行星运动,其几何细节与图西双轮惊人地相似。哥白尼无法读到阿拉伯文,他使用的是拉丁文材料,但图西的模型可能通过拜占庭或意大利的中间环节传到了欧洲。如果是这样,那么蒙古帝国时期的知识交换间接地帮助撬动了日心说革命的杠杆。

明朝的回回数学遗产

朱元璋建立明朝后,并没有立即驱逐蒙古时代传入的伊斯兰科学。洪武初年,明太祖下令将元大都的阿拉伯文天文和数学文献译为汉文,并继续任用部分回族天文学家。洪武十六年(1383年),一部名为《回回历法》的译作完成,它包含了阿拉伯的三角函数表、球面三角学公式以及基于托勒密模型的行星位置计算表。

《回回历法》的球面三角学部分尤其值得注意。它引入了正弦、余弦、正切等函数表,以及用这些函数来求解天文三角形的方法。中国的传统天文学一直使用代数和几何的混合方法,在平面上近似求解各种问题。《回回历法》第一次向中国读者完整展示了球面三角学作为统一工具的力量。但这一知识主要局限在钦天监(皇家天文机构)内部,并没有像同一时期欧洲的知识扩散那样进入更广泛的社会层面。

明中叶以后,回回天文数学传统在中国逐渐衰落。原因在方方面面。回族天文学家在钦天监中是世袭的,不与外界交流;他们的原文文献是阿拉伯语和波斯语,绝大多数汉族学者无法阅读;《回回历法》的译文刻意去除了伊斯兰教的文化元素,只留下技术性的干枯公式,失去了文化根须。当一个知识传统被从它生长的土壤中剥离,而又没有被完全移植到新的土壤中时,它的枯萎几乎是必然的事情。

比较回回数学在中国的命运与同一知识传统在意大利天文学校的命运,耐人寻味。波斯的伊斯兰数学既有纯粹几何的公理化传统,又有精密天文表的实用传统。欧洲吸收两者并使之营养了自己,中国吸收了两者但未将其有机融合到本土传统中。传播不等于接受,接受不等于消化,消化不等于创造,丝路数学的历史为此作了一个漫长的注释。

丝绸之路数学传播的再思考

审视整条丝绸之路上的数学传播,一个模式隐约浮现:数学知识极少以纯文本方式成体系地移植,技术层面的传播(算法、公式、仪器)远快于理论层面的传播(证明、公理、逻辑结构)。

为什么技术比理论传播得更快?一个的原因是技术更容易验证。一个商人在驼背上验算了一遍汇率口诀,发现好用,就继续用下去,至于它为什么好用,不需要深究。一位天文学家对比了《回回历法》预测的日月食与实测结果,发现预测准确,就采纳了这个方法。相对地,欧几里得的公理化几何需要一整套前提概念,定义、公设、公理、逻辑规则,才能被完整理解。这套前提概念本身是一种哲学立场,并非所有文明都共享这种立场。技术可以孤立地迁移,理论的迁移则几乎是文化移植。

还有一个更微妙的因素:丝路的大部分时光里,各地学者对自己文明的本土数学足够满意,因而缺乏学习外来理论的动力。中国在唐代、宋代和明代初期的数学水平整体领先于欧洲,在某些方面(高阶数值方程求解、一次同余式组等)甚至超越伊斯兰世界。在这种情况下,中国学者面对外来数学时,态度是选择性的,取我所需,其余忽略。当利玛窦在1600年将欧几里得《几何原本》带入中国时,明末学者惊叹于其逻辑之美,但并未将其视为填补空白,因为中国已经有了足够强大的代数传统来支持天文学和工程计算。欧洲的近代科学恰好从数形结合的解析几何起步,而中国的数与形的古老分离使它在此刻慢了一拍。

但这些思索在历史的宏阔穹顶来看,丝路数学的故事并不只是一个关于“谁输出了什么”以及“谁失去了什么”的故事。它真正的主题或许更为朴素:不同的人类群体在面对相同的自然规律时,发明出了不同的理解工具,当这些工具在漫漫长路上相遇时,有的相互排斥,有的相互改装,有的融铸成新的工具。每一个工具都携带着创造它的那个文化的气味与体温,当它们合并时,原有的气味没有消散,而是成为了新混合物中的一层底蕴。

在这条古老的商路上走了几千年的人与驼队早已消散,他们携带的货物,丝绸、香料、宝石,化作了尘土,但他们脑中携带的数字、公式、算法和图表,却在世界各处扎根、生长、变异、繁衍。这些看不见的货物没有重量,不曾被课税,不在任何关口的文书上留下记录,但它们比任何丝绸都更耐久,丝绸一千年化为齑粉,而零的位置记数法,六千年前在不知道什么地方被刻上骨头,如今依然栖息在全球每一个数字设备的深处,安静地维持着这个世界的运转。

第十五章 伽罗瓦之夜的数学新生:结构观念的降生

决斗前的一夜

1832年5月29日,巴黎。一个年仅二十岁的年轻人在一间租住的小房间里彻夜未眠。他的名字是埃瓦里斯特·伽罗瓦,一个两度报考综合工科学校未被录取、两度因政治活动入狱、被学院派数学家长期忽视的共和国激进分子。明天,他将与一位名叫佩舍·迪尔班维尔的男子进行决斗。伽罗瓦确信自己会在决斗中死去。这一夜,他要把一切写下。

他不是在写遗书。他在写数学。

桌上的蜡烛烧了一整夜,燃尽的烛泪堆叠在烛台上。伽罗瓦的手稿页边潦草地写着“我没有时间了”,这几个字后来成为数学史上最令人心碎的注脚。他在拼命整理自己关于方程可解性的理论,这套理论在他的大脑中已经完整,但从未有机会以系统的方式呈现给世界。今晚是最后的机会。他必须将脑子里的思想倾倒在纸上,不求美观,只求完整。

翌日凌晨,伽罗瓦离开房间,走向决斗地点。一颗子弹射穿了他的腹部,他被遗弃在现场,数小时后被一个路过的农民发现送至医院。5月31日,伽罗瓦死于腹膜炎。他的弟弟在病床前陪他度过了最后时刻,据说伽罗瓦临终前对他说:“不要哭,我需要我所有的勇气,在二十岁时死去。”

伽罗瓦的遗稿被交给了他的朋友奥古斯特·谢瓦利埃。谢瓦利埃将手稿寄给了高斯、雅可比和其他几位大数学家。没有回音。直到1846年,伽罗瓦死后十四年,约瑟夫·刘维尔才将这些手稿整理发表在他主编的《纯粹与应用数学杂志》上,并附上一篇推崇备至的序言。数学界开始慢慢消化这个死在二十岁的年轻人所留下的一切,而消化过程持续了整整半个世纪。

伽罗瓦在决斗前夜写下的那些匆忙字迹,最终被证明是数学史上最伟大的革命性文本之一。他将方程论从一个技巧的集合,如何求解这一类或那一类方程,转变为了对代数结构本身的系统研究。数学的新篇章从那个烛光铺洒的夜晚开始书写。

方程解法的千年困局

要理解伽罗瓦革命的深度,需要回顾至此为止人类求解方程的全部历史。

巴比伦人在泥板上解二次方程。花剌子模在九世纪将二次方程的解法系统化,并附带了几何验证。印度数学家处理了更复杂的二次不定方程。奥马尔·海亚姆用圆锥曲线几何求解了三次方程。十六世纪意大利数学家费罗、塔塔利亚、卡尔达诺和费拉里相继找到了三次和四次方程的通用根式解法,即用方程系数的加、减、乘、除和开方来表示方程的根。

当四次方程的障碍终于在1545年被突破后,所有数学家的目光都转向了下一个目标:五次方程。五次方程的根是否也可以用系数通过有限次加减乘除和开方来表示?这看起来应该只是四次方程的延续,也许公式会更复杂,但原理上不应该有本质障碍。

接下来是两百五十多年的挫败。

所有试图为五次方程找到根式解法的努力都失败了。拉格朗日、欧拉、范德蒙德,最杰出的数学家们耗尽心血,得到了各种巧妙的部分结果,但五次方程的通用根式解法始终不见踪影。到十八世纪末,一些数学家开始怀疑:也许根本不存在这样的公式。

但“不存在”怎么证明?这是完全不同的逻辑类型。证明一个东西存在,只需要找到它。证明一个东西不存在,需要证明它的存在会导致逻辑矛盾,或者它被排除在所有可能性之外。对于后者,需要先划定所有可能性的边界,而这恰恰需要一种关于方程解法的总体理论,一种不是关于这个或那个特定方程的,而是关于方程解法本身的理论。这是到十八世纪末为止任何数学家都没有想到过的框架要求。

拉格朗日1770年发表的《关于方程代数解法的思考》是突破的前夜。拉格朗日注意到,所有已知的根式解法,二次、三次、四次,都可以被解释为通过构造“预解式”并利用根的排列对称性来降低方程次数。拉格朗日猜测,五次方程之所以无法求解,五次方程根的排列(即置换)在结构上与低次方程不同。但他没能从这种洞见中提炼出一般性的证明。

这个洞见需要等待伽罗瓦来赋予它精确的语言和严密的逻辑。

群:对称性的代数

伽罗瓦的核心洞察是:方程的根不是孤立的数字,它们之间存在对称关系,即根的置换。将方程的所有根按照某种方式重新排列,如果重新排列后根之间的代数关系保持不变,这种排列就称为方程的一个“对称性”。所有对称性放在一起,构成一个几何对象般的代数结构,这个结构后来被称为“伽罗瓦群”。

一个简单的比喻:一个正方形有八个对称操作,旋转零度、九十度、一百八十度、二百七十度,以及沿四条对称轴的反射。这些操作构成一个群。这个群的结构决定了与正方形相关的许多几何性质。类似地,一个多项式方程的根的对称置换构成一个群,这个群的结构决定了该方程是否可以用根式求解。

伽罗瓦确立了一条精确的逻辑链:一个方程可以用根式求解,当且仅当它的伽罗瓦群具有某种性质,这个性质被称为“可解性”。当一个群的构造足够复杂,当它包含的某种“不可交换”的子结构超过了根式运算所能逐步拆解的范围时,这个群就不可解,从而对应的方程就不存在通用的根式公式。

他进一步证明,一般的五次方程的伽罗瓦群是五个元素的对称群,全体置换组成的群,而这个群是“不可解”的。因此,一般的五次方程没有根式解。这个结论一举终结了从巴比伦时代延续下来的根式求解追求,不是因为人类的智力不够找不到公式,而是因为这个公式在数学上根本不存在。不存在不是被证伪的存在,是被证明其自身不可存在。

这个证明的哲学分量超出了数学的边界。它告诉人类:某些问题之所以无解,不是因为我们不够聪明,而是因为我们所提出的问题本就是在不可能存在的假设之内。用某种形式的语言发问,就已经封闭了答案存在的空间。

群论的独立发展

群的概念一旦从方程论中分离出来,便迅速蔓延到了几乎整个数学领域。

十九世纪中叶,阿瑟·凯莱基本建立了抽象群论的公理框架。到世纪后期,费利克斯·克莱因在他的“埃尔兰根纲领”中将几何学重新定义为“研究变换群下不变量的学科”,欧几里得几何是研究刚体运动群的不变量,仿射几何是研究仿射变换群的不变量,射影几何是研究射影变换群的不变量。几何学从关于空间的科学变成了关于对称性的科学。

索菲斯·李创建了李群和李代数的理论,一种处理连续对称性的数学语言。麦克斯韦的电磁场方程、爱因斯坦的广义相对论、量子力学的标准模型,都依赖李群来描述自然界基本相互作用背后的对称性。一个纠缠着方程根的置换问题,在两百年后成为理论物理最底层数学工具的源头。

二十世纪,群论在物理之外开辟了另一个意想不到的应用领域:密码学和编码理论。公钥加密、纠错码、数字签名,这些都依赖于有限群尤其是椭圆曲线群的性质。伽罗瓦在决斗前夜潦草的笔迹,最终化作了保护互联网每一笔转账的数学守卫。

从对象到结构:数学本体论的转变

伽罗瓦革命的深远意义不仅在于发明了一个新工具,更在于改变了数学追问的对象。

在伽罗瓦以前,数学的核心问题是“这个量是多少”,求解具体的方程、计算具体的数值。从伽罗瓦开始,数学增加了一个同等甚至更重要的核心问题:“这个结构是什么”,一类数学对象总体的组织方式是什么,不同的结构之间存在什么样的映射和嵌入关系。

这是一个本体论的转变。巴比伦书吏计算根号二的近似值,花剌子模分类二次方程并给出解法,卡尔达诺导出三次方程的根式公式,他们都在操作数学对象。伽罗瓦在操作数学结构的范畴。他不再问“五次方程的根是多少”,而是问“多项式方程的伽罗瓦群是什么”。前者是关于对象的,后者是关于结构的。前者属于计算的数学,后者属于结构的数学。

结构观念的兴起贯穿了之后数学的全部发展。数论不再只研究单个数的性质,转而研究整数环、理想类群的结构。拓扑学不再是关于特定空间形状的列举,而是关于连续变形下不变量的同调群的研究。代数几何用概形和层的语言重新书写了自身,一切都是以结构为基本词汇的语法。

这种转变的深刻之处在于它揭示了一条原理:数学的进步往往不是找到更好的答案,而是提出更好的问题。古希腊人问“正多面体有多少种”得到了答案(五种),但十九世纪的数学家问“对称群的分类是什么”,这个更抽象的问题导向了对所有有限单群的完整分类,一个跨越了整个二十世纪、涉及上万页论文的巨量工程。从五个变成了上千种,更好的问题打开了比原问题广阔得多的视野。

决斗之后的余音

伽罗瓦死后一百七十四年,他的全部手稿被法国国家图书馆以数字方式开放给全世界的读者。在那些泛黄纸页的扫描图像中,可以清晰地辨认出一八三二年五月二十九日深夜的痕迹:越来越潦草的笔迹、页边匆忙挤入的补充、以及那句“我没有时间了”的著名注脚。

他确实没有时间了。但数学有自己的时间刻度。它不因作者的死亡而终止,不因同时代人的忽视而消失,它可以在纸张或记忆中沉默等待,直到条件成熟。

十九世纪最后三十年至二十世纪初,伽罗瓦的思想经由若尔当的《置换与代数方程专论》、克莱因的埃尔兰根纲领、戴德金与阿廷的代数数论和李的连续群理论而扩散至数学全景。这些后继者们不曾听过伽罗瓦的声音,不曾见过他在监狱墙壁上刻下方程的双手,但他们沿着他开辟的概念路径前行,越走越远。伽罗瓦那一夜写下的不只是他个人的遗嘱,而是整个数学从古典向现代转折的最早宣言。而那宣言的最后一行没有句点,只有破晓之前一个二十岁青年急促呼吸的间隙。

第十六章 非欧几何:平行线的叛离与空间的解放

欧几里得的幽灵

欧几里得《几何原本》的五条公设中,前四条简洁得近乎透明。两点之间可连一直线。有限直线可连续延长。以任意点为心、任意长为半径可作圆。凡直角都相等。每一条都可以在一瞥之间被直觉捕获,不需要论证,不需要犹豫。

第五条却像一个闯入者。

“若一直线与两直线相交,且在同侧所交之内角之和小于两直角,则这两直线无限延长后必在该侧相交。”

这句话读起来像定理而非公理。它的长度是其他公设的数倍,它的表述带着条件从句和空间想象的要求,它不像一个起点,而像一个需要被证明的结论。从古希腊时代开始,几何学家们就感到不安。欧几里得本人似乎也在回避它,《几何原本》第一卷的前二十八个命题全部没有使用第五公设,仿佛他在尽可能推迟调用这个令人不安的前提。

于是开始了数学史上最漫长的智力追逐:证明平行公设不是公设,而是定理,可以从其他四条公设中推导出来。

托勒密尝试过。他在公元二世纪写了一篇论文,声称从其他公设和已经导出的定理中证明了平行公设。他的证明暗中假定了两条平行线之间的距离处处相等,而这个假定本身与平行公设是等价的。循环论证。

普罗克洛斯在五世纪给出了另一个尝试证明。他使用了一个微妙的假设:如果两条直线被第三条直线所截,且同位角之和不等于两直角,那么这两条直线迟早会相交。这个假设实际上是平行公设的另一种表述。循环论证的陷阱再次吞没了证明者。

阿拉伯数学家的贡献在前面章节已经提及。奥马尔·海亚姆、纳西尔丁·图西,他们接过这个问题,推进了分析,但没有绕过逻辑的循环。每一个“证明”都在某个隐蔽的角度里使用了平行公设的等价形式。

欧洲人继续这场追逐。十七世纪的沃利斯试图用相似三角形的存在性来证明平行公设,但相似三角形的存在性本身就需要平行公设。十八世纪的萨凯里写了一整本书《欧几里得无懈可击》,试图用反证法:假设平行公设不成立,推导出矛盾。他推导出了大量从未有人见过的奇异几何定理,三角形内角和小于两直角,过直线外一点可以作多条与给定直线不相交的直线,然后他宣称这些结论“荒谬绝伦”,因此平行公设得证。

萨凯里不知道的是,他推导出的荒谬定理并不是逻辑矛盾,而只是不符合日常直觉。他没有发现谬误,他发现了非欧几何。但他自己未能迈出承认它的最后一步,最终将手稿命名为《欧几里得无懈可击》,把一段可能开启几何革命的火花压灭在了常识的灰烬中。

三个人的独立发现

十九世纪初,三个人几乎同时攀上了同一座山峰,各自从不同的路径。

卡尔·弗里德里希·高斯是三人中最负盛名的,也是最先抵达的。早在1790年代,少年高斯就意识到了非欧几何的可能性。到1824年,他在给朋友托里努斯的信中写道:“三角形内角和小于一百八十度的假设导向一种奇异的几何学,与我自己的研究完全一致。”但高斯没有发表。他太在意名声,太畏惧争议,也太了解同时代人对此会如何反应。他将非欧几何的发现锁在私人通信里,只与少数密友分享,出版了其余方向的著作直至离世,而未曾让这项改变世界空间观念的工作印成铅字。

亚诺什·波尔约是匈牙利数学家法尔卡什·波尔约的儿子。法尔卡什是高斯的朋友,一生耗费在几次三番对平行公设的证明尝试中,皆以失败告终。他将执念传给了儿子,却又在信中近乎哀求地告诫亚诺什:“别再碰平行线了,它会吞噬你全部的时间,剥夺你的健康、你的内心平静、你生命中的一切快乐。”

亚诺什没有听。1823年,年仅二十一岁的他写信给父亲:“我从虚无中创造了一个全新的宇宙。”他是认真的。亚诺什发展出一整套非欧几何系统,证明如果平行公设被替换为“过直线外一点可以作无穷多条与给定直线不相交的直线”,由此导出的几何学在逻辑上完全自洽,没有丝毫矛盾。法尔卡什将儿子的论文作为附录收入自己的一本书中出版,并将书寄给高斯。高斯的回信礼貌而冷静:“我不能赞扬这项工作,因为赞扬它就是赞扬我自己,它的全部内容几乎完全吻合我自己在过去三十至三十五年间的心得。”

这句话击碎了亚诺什。他原本期盼着来自数学王子的认可,却被告知自己只是重新发明了别人早已知晓的东西。他陷入抑郁,此后再也没有发表数学论文。高斯后来在日记中承认,亚诺什的成就是独立且无可置疑的,但信里的语言已经造成了不可逆转的伤害。

尼古拉·罗巴切夫斯基,喀山大学的教授、后来的校长,是三人中唯一公开站出来宣布非欧几何的人。1826年,他在喀山大学物理数学系的会议上宣读了一篇论文,题为《关于几何原理的简要阐述》。文中毫不含糊地断言:平行公设无法被证明,另一种几何学是可能的。听众的反应从困惑到敌意不等,没有人当场表示赞同。罗巴切夫斯基没有退缩。他把论文扩展为一本书,用俄文和德文发表,随后又被译为法文。他把自己的几何学称为“虚几何学”,并用它重新推导了三角学和微积分的诸多公式。

这不是一件小事。在十九世纪初的智识空气中,康德哲学占据着统治地位。康德在《纯粹理性批判》中将欧几里得几何视为“先天综合判断”的典例,它是人类认知形式的一部分,空间一定是欧几里得的,因为我们的心智只能以欧式空间的方式来统摄外部知觉。罗巴切夫斯基的宣称,另一种几何学是可能的,不只是对数学的挑战,也是对康德认识论的直接撼动。

罗巴切夫斯基在有生之年未获承认。他的论文在俄国被嘲笑,在德国被高斯私下赞赏但公开沉默。他继续教书、继续研究,眼睛逐渐失明,在近乎全盲的状态下口述完成了最后一部著作《泛几何学》。1856年,他死于喀山,享年六十三岁。他死时不知道自己的几何学将在一个世代之内被完全接纳并重新塑造物理学的基础。

高斯的内在挣扎

高斯不发表非欧几何的决定,需要在其全部人格中寻找解释。

他不是一个怯懦的学者。在数论领域,他出版了《算术研究》,一举将零散的发现整合为系统的科学。在天文学中,他用最小二乘法计算出谷神星的轨道,让这颗走失的小行星重新回到人类的视野里。在测量学上,他领导了汉诺威王国的大地测量,发明了回光仪,在山林间往返跋涉,将精密测量的界限推到了一个新的高度。

但他在哲学争论上极其谨慎。康德的阴影笼罩着整个德语知识界,公开挑战康德的认识论配置并不是纯粹的数学问题,它意味着将自己置于哲学、神学和学院政治的风暴中心。青年时代贫困出身的高斯对安稳有深切的渴望,他不愿将晚年消耗在论争中。

还有一个原因:他发现非欧几何的过程中,理论推导离不开实际测量的比对。他曾经测量了三座山峰,布罗肯、霍恩哈根和因塞尔山,构成的三角形,检验其内角和是否偏离了180度。测量结果是180度在误差范围内。这增加了高斯的疑虑:如果非欧几何在物理空间中并不成立,那么它的意义仅限于逻辑游戏,而他不想为一桩逻辑游戏损害自己的声誉。他未能预见到,物理空间恰好不是欧几里得的,但验证这一点需要一个爱因斯坦和一个世纪。

不过高斯在沉默中并非无所作为。他推动了一位年轻数学家的事业,伯恩哈德·黎曼。

黎曼:空间的彻底解放

1854年6月10日,哥廷根大学,一个年轻的编外讲师站在讲台上。他二十八岁,面容清癯,极度紧张。台下坐着七十岁的卡尔·弗里德里希·高斯,数学世界的君主,即将聆听一场将永久改变几何学面貌的演讲。

这场演讲的题目是《论几何学基础中的假设》。其内容彻底跳出了欧几里得和非欧几何的二元框架。黎曼不是简单地提出“平行线可以有多少条”的问题,而是从根本上重新定义了什么是几何学。

在黎曼之前,几何学是关于空间的科学,空间被默认为平坦的、无限延伸的、处处均一的。黎曼撕掉了所有这些默认前提。他说,让我们设想一个空间,它不必是平坦的,它可以弯曲,其曲率在每一点都可能不同。要描述这样一个空间,不需要将它放在更高维的外部空间中来看,只需要定义空间内部的距离度量方式。

黎曼引入了一个惊人的技术工具:度量张量。在一个n维空间中,任意两点之间的距离由一个二次微分形式的平方根给出,只需要知道空间的度量系数,就可以计算一切:距离、角度、曲率、最短路径。黎曼从少数几个简单的假设出发,推导出了这种抽象空间的所有几何性质。这种空间,“黎曼流形”,可以具有任何维度,任意曲率。

在这个框架下,欧几里得几何、罗巴切夫斯基几何和球面几何都只是特例。欧几里得空间是曲率为零的平坦黎曼流形,罗巴切夫斯基空间是曲率为负的黎曼流形,球面是曲率为正的黎曼流形。两千年来被认为是唯一真理的欧几里得几何,不过是无限多种同样自洽的几何中的平凡一员。就像人类曾深信地球是宇宙的中心,直到望远镜将天穹掀开,现在几何学的天穹也被掀开了。

高斯在演讲结束后沉默地离开了教室。他没有公开发表任何评论。但私下里,据说他对这场演讲表现出极大的赞赏。他将自己的黎曼几何手稿归入了与对非欧几何同等的保密收藏,但也将某些相关的想法写进了即将发表的文章中。

黎曼的演讲在1854年并没有引起广泛的立即反响。它太超前了。直到1868年黎曼去世两年后,这些讲稿才被发表,并逐渐被翻译成其他语言。到十九世纪末,黎曼几何已经成为数学中最活跃和最深远的领域之一,其影响远远超出了几何本身。

爱因斯坦的方程式

1915年11月,柏林的阿尔伯特·爱因斯坦经历了他一生中最紧张的几个星期。他已经为引力问题苦思了八年。狭义相对论解决了匀速运动,但引力偏偏是一种加速。他尝试过各种方案,标量引力理论、矢量理论,都在某个环节土崩瓦解。但手中始终握着一件工具,一件早年他在苏黎世联邦理工学院从数学家马塞尔·格罗斯曼那里学来的工具:黎曼几何。

爱因斯坦的数学功底并不算深厚。在专利局工作的那些年,他凭借的是物理直觉和少量基础的数学语言。但到了1912年,当他意识到自己的引力理论需要用弯曲时空来描述时,他不得不开始学习当时大多数物理学家闻所未闻的数学。他向格罗斯曼求助。格罗斯曼告诉他:“你需要的恰好是黎曼在半个多世纪前创造的几何学,度量张量、联络系数、曲率张量,一切都是现成的。只是从来没有人想过把它用在物理学上。”

1915年11月,爱因斯坦完成了广义相对论的最后形式。爱因斯坦场方程将时空的弯曲(由黎曼曲率张量和里奇张量描述)与物质和能量的分布(由能动量张量描述)联系起来。方程的一边是几何,另一边是物理。物质告诉时空如何弯曲,时空告诉物质如何运动。

当这个方程被应用到太阳系时,它完美地解释了一个困扰天文学家数十年的谜题:水星近日点的进动。水星轨道的近日点每世纪比牛顿理论预测的多进动四十三弧秒,一个微小的偏差,却是致命的。爱因斯坦的方程在没有任何额外假设的情况下精确地算出了这四十三秒。这是黎曼几何的第一次物理凯旋。

1919年5月29日的日全食,亚瑟·爱丁顿率领的远征队在普林西比岛上的棱镜湾观测到,太阳附近的星光确实像爱因斯坦的预言那样弯曲,而牛顿理论预测的弯曲幅度只有观察值的一半。消息传到伦敦,《泰晤士报》的标题是“科学革命,牛顿学说被推翻,空间弯曲”。黎曼在哥廷根那个无人理解的演讲,六十五年后成了头条。

从此,几何学不再是关于人类先天直观形式的学问,而是关于宇宙结构的实证科学。欧几里得的平行线穿越了两千多年,在高斯的私人笔记、波尔约的抑郁、罗巴切夫斯基的失明、黎曼的编外讲师演讲和爱因斯坦的场方程中,走过了一条人类心灵最漫长的旅程。这条旅程的终点不是一座纪念馆,而是一整个弯曲的银河曲面,我们栖居其中的时空本身,就是非欧几何最恢宏的证明。

第十七章 无穷的驯服:从芝诺悖论到集合论

阿基琉斯与乌龟的逻辑困境

公元前五世纪,爱琴海东岸的埃利亚城邦,哲学家芝诺提出了几个看似简单的论证。其中最著名的一个是这样的:阿基琉斯,希腊联军中最快的奔跑者,与一只乌龟赛跑。乌龟先出发一段距离。阿基琉斯追赶,当他到达乌龟出发的位置时,乌龟已经向前爬了一小段。当阿基琉斯到达那个新位置时,乌龟又向前爬了一小段。这个过程似乎可以无限次重复。因此,芝诺推论,阿基琉斯永远追不上乌龟。

这个结论显然是荒谬的,与每一个人的日常经验正面冲突。但芝诺的论证在逻辑上却并不容易驳倒。它像一根细刺,扎在希腊理性主义完美雕像的皮肤之下。如果你说阿基琉斯当然能追上乌龟,请回答:他跨过的无穷多段距离如何能在有限时间内完成?

亚里士多德试图回答芝诺。他的策略是否定芝诺的时间划分:时间也可以被分成无穷多个瞬间,对应的空间划分就不构成矛盾,无穷小的时间对应无穷小的空间。到一定限度,阿基琉斯跨过的无穷多段距离与乌龟身前的无穷多段时间恰好对应。这个解释有道理的种子,但它停留在定性层面。在亚里士多德的物理学传统下,无穷分割被看作潜在的,而不是实际完成的。希腊人接受“潜无穷”,一个不断继续下去而不终结的过程,却抵制“实无穷”,一个已经包含无限多元素的完整集合。

阿基米德对潜无穷的操控达到了古代的顶峰。他在计算抛物线弓形面积时,将其剖为无穷多个三角形,第一个三角形面积为单位,后面每个三角形的面积是前一个的四分之一。他将这些三角形面积加起来:1+1/4+1/16+…这个无穷级数按阿基米德的方法求和,最终趋近于4/3。他用穷竭法回避了直接声明无穷和等于精确值。这种近乎现代的积分术被精心地包装在“双归谬法”之中,证明面积不可能大于4/3,也不可能小于4/3,因此等于4/3。每一步都躲开直接宣告无穷过程的完成。希腊数学在靠近无穷的最后一步总是刹车。

微积分与被质疑的无穷小

十七世纪,牛顿和莱布尼茨各自独立发明了微积分。无穷不再是可以绕过的问题,它嵌在微积分的每一个基础操作中。

牛顿的方法基于“流数”,随时间流动变化的量。他在计算导数时使用了无穷小的增量,他称之为“瞬时”。这个瞬间小到可以忽略但又不等于零。在同一页手稿中,牛顿时而让这个o在分母中充当非零数,时而又在加法中将其当作零直接抹去。逻辑上的不自洽是明显的。牛顿在《自然哲学的数学原理》中意识到这个问题,改用“最初比与最终比”的几何术语来重新表述一切,这虽绕过了无穷小,却让表达无比繁重,失去了初版的流畅。

莱布尼茨的无穷小方法更直观、更好用。他的微分dx和dy是无限微小的量,他们的比值dy/dx给出了切线的精确斜率,即使分子和分母各自无限接近于零。他的积分符号,那个拉长的S,把曲线下方无穷多个无限窄的矩形面积累加为精确值。这个符号体系运行得顺畅而美丽,但在逻辑上同样不清晰。

贝克莱主教,那位后来被称为“最聪明的反启蒙者”的人物,在1734年发出了一针见血的攻击。他写道:“那些流数是什么?是消逝增量的速度。那些消逝增量是什么?它们既不是有限量,也不是无限小量,又不是零。我们难道不能把它们称为消逝量的幽灵吗?”贝克莱的激烈措辞不能抵消他问题的尖锐。他对数学家们信心的逻辑基础提出挑战:你们在证明的关键步骤中以dx为除数,却在下一步宣称它小到可以不加考虑,这不是推理,这是魔术。

贝克莱的挑战成为数学家不能长久回避的鞭子。十八世纪的一群法国数学家,达朗贝尔、拉格朗日,试图将微积分重新建立在不需要无穷小的基础上。达朗贝尔在《百科全书》中主张用极限概念取代无穷小,将导数定义为一个比值的极限。但他那个时代的极限表述仍然依赖几何直觉,不够严格。

拉格朗日走得更极端:他试图将整个微积分从几何和直觉中解放出来。他的《解析函数论》开篇即声称“本书不使用无穷小、消逝量、极限或流数概念”。他试图通过函数的幂级数展开来严格定义导数,假定任何函数都可以表达为幂级数。但这个假设本身就需要有极限和收敛性的概念来证成。拉格朗日的宏大计划没有成功,但他将一个已被悬置太久的问题清晰地提了出来:微积分的逻辑地基需要完全的重建。

柯西与魏尔斯特拉斯的严格化

奥古斯丁·路易·柯西,一个瘦削、神经质的法国人,改变了这一切。

1821年,柯西出版了《分析教程》,这部书被他用作巴黎综合工科学校的教材,但它的影响远远超出了教室。在这本书中,柯西第一次用清晰的ε-δ语言给出了极限的严格定义。一个变量趋近于某个极限,如果它的值与极限之差可以变得比任何预先给定的正数还要小,持续趋近,最终保持在任意小的误差范围内。这个定义不需要“无限接近”、“无穷小”或任何模糊的直觉,它只依仗有限的数之间的比较。

在这个基础上,柯西严格定义了连续性、导数和积分。他证明了介值定理,连续函数在区间内取任何介于两端值之间的值,第一次在严密逻辑下而非依靠几何图形直觉。他还定义了级数的收敛性,区分了收敛和发散,给出了著名的比值判别法。无穷级数不再是一个可以随意操作的符号串,而是一个需要考察收敛极限的数学对象。

柯西的工作有漏洞。他的极限定义中仍有一些表述不够精确,他对一致收敛的理解还不到位,他曾错误地认为连续函数的收敛级数必定连续,但阿贝尔后来举出了反例。这是真正的数学进步:柯西不仅给出了工具,还提供了可以被检验因而可以被修正的逻辑框架。

卡尔·魏尔斯特拉斯接着完成了这场严格化运动。他在十九世纪中叶,最初作为中学教师,后来成为柏林大学的明星教授,将分析从最后一丝几何直觉中剥离出来。他用纯算术的ε-δ语言重写了极限、连续性和导数的全部定义。在这个框架下,函数不再需要曲线来表示,极限不再需要“趋近”的动觉想象。一切都转化为逻辑上的量词排列:对任意ε存在一个δ满足某条件。

魏尔斯特拉斯还展示了一个令当时数学家震惊的事实:函数可以是连续但在任何点都不可微的。他构造了著名的魏尔斯特拉斯函数,一个处处连续却处处没有切线的曲线。在此之前,数学家普遍默认连续函数“大多数地方”是可微的。魏尔斯特拉斯的例子将这条直觉彻底打破。连续性和可微性之间并不存在必然的桥梁,直觉再一次被严格逻辑证明是不可靠的指南。

对于无穷小,柯西-魏尔斯特拉斯的严格化运动完成了一个看似不可能的任务:将微积分从无穷小的直觉中解放出来,同时保留了它所有的计算能力。在ε-δ定义的框架下,dx不再是一个有神秘属性的无穷小量,它只是一个方便的符号,可以用严格的极限定义来拆解。牛顿和莱布尼茨的幽灵终于被驱散了。

但这并不意味着无穷小的故事到此结束。二十世纪六十年代,亚伯拉罕·罗宾逊发明了非标准分析,用现代数理逻辑的工具构造了一个包含“真正的”无穷小和无穷大的数系,超实数系。在这个系统中,莱布尼茨式的无穷小可以被逻辑严密地定义和使用,微积分可以以一种令人惊讶地接近莱布尼茨原始直觉的方式重新表述。无穷小在逻辑层面上被证明并非必需,但在心理和启发层面上,它从未离开过数学。

康托尔的乐园

无穷的历史上最戏剧性的人物是格奥尔格·康托尔。

康托尔在海湾战争年代出生在圣彼得堡,后随家移居德国。他研究的出发点是一个看似技术性的问题:三角级数表示的唯一性。这个问题的分析将他引入了一个完全不同的领域,无穷集合的比较。

康托尔之前的常识是:实无穷不存在。从亚里士多德到高斯,主流传统都否定一个完成态的无穷集合的合法性。人们可以谈论“自然数一直延续下去”(潜无穷),但不能谈论“所有自然数的集合”(实无穷)。康托尔决定触碰这个禁忌。

他的第一步是定义一个集合的大小,基数的概念。两个集合如果存在一一对应,就说它们有相同的基数。这个看似简单的定义在用于无穷集合时立即产生了令人吃惊的结果。

自然数集合{1,2,3,…}的基数是第一个超限基数,康托尔用希伯来字母א(阿列夫)的第一个字母的标号形式来表示。然后他证明了,有理数集合同样可数,每一个有理数可以与一个唯一的自然数配对。这已经令人意外:有理数看似比自然数多得多(在任何两个自然数之间都有无穷多个有理数),但它们的基数却是相同的。

更惊人的在后头。康托尔用对角线论证法证明了实数集合不可数,实数的基数严格大于自然数的基数。这意味着无穷有不同的层次。有些无穷比另一些无穷更大。这个结论震动了数学界和哲学界。

康托尔继续上溯:任意集合的幂集(所有子集构成的集合)的基数严格大于原集合的基数。从这个原理出发,无穷的层次是无穷的,一个没有顶点的上升阶梯。阿列夫零、阿列夫一、阿列夫二……直到无穷无尽的超限序数和基数。

但这套理论的极深处,康托尔发现了一个无法解决的难题,即连续统假设:在自然数的基数与实数的基数之间,是否存在另一个无穷基数?康托尔倾其后半生试图证明连续统假设,时而认为答案为“是”,时而认为答案为“否”。他没有成功。

同时,反对声浪铺天盖地。克罗内克,康托尔早年的导师,成了他最凶狠的对手。克罗内克是构造主义者,只承认可以从自然数通过有限步构造出来的数学对象。对克罗内克来说,康托尔的超限集合论不是数学,是神学。他用各种方式阻挠康托尔的论文发表和大学职位晋升,在课堂和书信中毫不留情地斥责这个曾经的学生。

康托尔的精神状态逐渐恶化。他在哈雷大学的精神病院多次进出,在抑郁和躁狂之间摇摆。他在病院的“疗养间歇期”仍然发表数学论文,也发表关于培根是莎士比亚戏剧真正作者的痴迷研究。1918年,他死于哈雷的精神病院。死时第一次世界大战尚未结束,他的部分手稿在战后的混乱中被遗失。

但康托尔的乐园已经扎根。希尔伯特的宣言,“没有人能够将我们从康托尔为我们创造的乐园中驱逐出去”,给出了二十世纪数学的立场。哥德尔在1940年证明了连续统假设与集合论公理系统相容(不能被证否),科恩在1963年证明了这个假设独立于集合论公理系统(也不能被证明)。康托尔的连续统问题既不为真也不为假,它取决于你选择什么样的公理系统。连这类问题是可答还是不可答,本身都被数学严格证明了出来。

罗素悖论与修补

康托尔的乐园在世纪之交遭遇了一场地震。1901年,年轻的伯特兰·罗素在研读弗雷格的《算术基本法则》时,发现了一个摧毁性的悖论。

罗素构造了一个看似合法的集合:所有不属于自身的集合组成的集合。问:这个集合属于自身吗?如果它属于自身,那么根据定义它必须不属于自身。如果它不属于自身,那么根据定义它必须属于自身。无论如何都导致矛盾。

这个悖论不是文字游戏。它从康托尔集合论的基本原理,任何可定义的性质决定一个集合,直接推导出来。弗雷格的《算术基本法则》第二卷即将印刷时收到了罗素的信,弗雷格在书末仓促加了一个补遗:“一个科学家最难以承受的事情,莫过于他的毕生工作在其完成后遭到动摇。”这个补遗给整个逻辑主义数学基础运动投下了深长的阴影。

数学家们开始修补集合论。策梅洛在1908年提出了公理化集合论的第一个系统,将集合的构造限制在给定的操作中,不允许不受限制的性质定义集合。弗兰克尔后来补充了替换公理。冯·诺依曼、哥德尔、伯奈斯各自贡献了变体。公理集合论,ZFC系统(策梅洛-弗兰克尔加选择公理),成为数学基础的标准框架。在这个系统中,罗素悖论和其他已知悖论被排除,康托尔的大部分超限集合论成果被保留。

选择公理引发了自己独有的辩论。这个公理断言,对于任意一族非空集合,可以从每个集合中选出一个元素构成一个新的集合。这听起来不像公理,选一个元素而已。但当这族集合是无穷族且没有明确的选取规则时,这个“选择”操作在构造主义者眼中是非法的:它声称存在一个选择函数,但没有给出构造这个函数的方法。巴拿赫和塔斯基用选择公理推导出了一个悖论式的结论:一个实心球可以被分割为有限多个部分,然后重新拼接成两个与原球完全相同大小的球。这个表面上的荒谬,巴拿赫-塔斯基悖论,暴露了选择公理的非构造性本质。

二十世纪下半叶,集合论的大部分争论从形而上学转向技术层面:大基数公理、决定性公理、forcing方法和内模型。这些问题极其精微。一组来自不同时代的理论,哥德尔的可构成宇宙、科恩的力迫法、武丁的内模型程序,将它们联结得越来越紧。但在这些精细结构的底部,始终躺着十九世纪末康托尔在那间哈雷大学办公室里独自面对的问题:无穷有哪些种类,它们之间的边界在哪里,我们能不能知道它的最终边界。

无穷的现代场景

从芝诺的悖论到今天的集合论,无穷的驯服历程充满了铁一样的美学规律:每一次成功驯服都打开新的问题空间,每一次自信宣告都被后续的发现修正。

数学家曾经认为无穷小不合法,直到非标准分析给出了它们的逻辑模型。数学家曾经认为康托尔的超限数是悖论的源头,直到公理化将悖论排干并保留了大量成果。数学家曾经认为连续统假设迟早会被证明或否证,直到哥德尔和科恩证明它根本不能用标准公理来判定。

无穷在数学史上是一个透镜,一次又一次聚焦人类理性能力与界限的交界地带。当希腊人回避实无穷时,他们保护了逻辑的自洽。当十七世纪数学家运用无穷小时,他们用直觉弥补了严谨的缺失。当柯西和魏尔斯特拉斯驱逐无穷小时,他们获得了一直以来渴望的严密,却不得不将数学语言变得比莱布尼茨时代枯涩得多。当康托尔重回实无穷并将之推至极致时,他付出的代价是理智遭人质疑并在精神病中度过晚年。

越过所有成功的喜悦与挣扎的痛苦,无穷仍然悬在我们面前。它不是一道被解完的题,不是一座被完全测绘的山。它是一面镜子,映照着人类理解自身理性的努力。每一次照见都清晰一些,但镜面总有雾气。而数学恰是从古至今一直擦拭这面镜子的手。

第十八章 概率的炼金术:从赌徒困惑到随机世界

掷骰子的数学家

1654年,巴黎,一个名叫安托万·贡博的法国贵族,以骑士德·梅雷之名混迹于沙龙和赌场,向布莱兹·帕斯卡提出了一个困扰他已久的问题。两个赌徒约定先赢到一定局数者获得全部赌注,但游戏在中途被意外打断,赌注该如何公平分配?

这不是一个新问题。意大利数学家帕乔利在一个半世纪前就讨论过类似的情形,给出的答案是按已赢局数比例分配,这个答案看似合理,却是错的。真正的问题是:考虑到双方还需要赢多少局才能获得最终胜利,中止时的局数本身并不直接决定胜率。

帕斯卡被这个问题迷住了。他与住在图卢兹的皮埃尔·德·费马,那位在书页空白处写下费马大定理的法学家数学家,展开了一场通信。这些信对赌博问题的分析,不知不觉开启了数学史上一门全新学科的建设。

帕斯卡和费马各自独立地解决了点数问题。帕斯卡的方法基于递推,从最简单的情况开始,利用算术三角形(即帕斯卡三角)逐层向上计算每一步的公平分配值。费马的方法则基于等可能性计数,枚举所有可能的未来发展,计算其中每一方获胜的情形数目,按比例分配赌注。两种方法殊途同归。

这场通信中最关键的步骤或许是被帕斯卡和费马共同默认的:两个人都接受了未来可能发生的各种情况可以被计数并具有等可能性。在帕斯卡-费马通信之前,概率的估算依赖的是直觉、经验和赌博老手的判断。通信之后,概率开始被看作一个可以经由组合计算严格确定的量。公平分配公式是概率论的第一条定理。

帕斯卡没有就此止步。他将概率思考延伸到了神学。他的“帕斯卡赌注”论证,即使上帝存在的概率极低,鉴于可能获得的无限回报(天堂),相信上帝仍然是理性上最优的选择,使用了最早形式的决策理论和期望值概念。帕斯卡把从赌桌上提炼出的工具架在了灵魂得救的极点上,使概率论自诞生之初就带上了超出纯数学的重力。

从死亡率的数学到误差曲线

概率论从赌博走向世界,第一个真正的应用场景是死亡。

十七世纪中叶的伦敦,瘟疫在街巷间反复出没。教区每周发布《死亡统计表》,列出各个原因导致的死亡数字。一个名叫约翰·格朗特的布料商人对这些数字产生了特殊的兴趣。他收集了数十年间的死亡表,用系统的统计方法进行分析,于1662年出版了《关于死亡表的自然与政治观察》。

用现代眼光看,格朗特所做的就是描述性统计。他建立了死亡原因的频次分布,估算了男女出生率,计算了各种疾病的致死率,甚至第一次尝试构建生命表,估算从一个给定年龄开始,一个人还能活多少年。这本书影响了整个欧洲的政策思维,人寿保险、年金定价、公共卫生,概率被证明可以用来治理社会。

埃德蒙·哈雷,就是那颗著名的彗星以他名字命名的哈雷,在1693年进一步改进了生命表。他使用了德国布雷斯劳市的死亡记录(选择布雷斯劳是因为这个城市相对不受大规模移民干扰,出生和死亡的对应关系更为可靠),编算了保险业一直沿用到现代的精算数学雏形。在哈雷的生命表中,对每一个年龄,给出了该年龄的存活人数、年死亡人数和剩余预期寿命。

同一个世纪稍晚,数学家们开始注意到一类性质完全不同的问题,观测误差。天文学家测量恒星位置,每一次测量结果都有轻微差异。这些差异有没有规律?

伽利略曾笼统地观察到小误差比大误差更常见,误差对称分布在真值的两侧。但这些似乎随机的偏差能否被模型化?如果可以,真值就能从有噪声的观测中被最佳地估计出来。这就是十九世纪初高斯和勒让德分别独立解决的最小二乘法问题。

勒让德在1805年明确提出了最小二乘原则:在所有可能的真值估计中,使观测误差的平方和最小的那个估计是最佳的。高斯在同一时期也将这一原则系统应用在天文轨道计算中,并进一步论证了,如果误差服从特定的分布(后来被称为高斯分布或正态分布),最小二乘法就是最大似然估计,是所有方法中最优的。

正态分布的公式,那个带着钟形曲线、以e为底、以负平方为指数的表达式,开始出现在天文学、测量学、物理学、生物学的每一个角落。奎特雷在十九世纪中叶将正态分布用于人类社会现象,测量了法国士兵的胸围、苏格兰男子的身高,发现都与正态分布惊人地吻合。奎特雷发明了“平均人”的概念,在一个正态分布中,均值代表了“自然所瞄准的标准”,偏离均值则是个体差异。

这是历史上概率思想最大的一次扩张:从掷骰子的输赢,到观测数据中的误差,再到社会和生物现象的中心趋势,随机性从赌博的泥泞角落变成俯瞰整个人类状况的统计语言。

拉普拉斯的确定性梦魇

皮埃尔-西蒙·拉普拉斯,被以撒·牛顿之后最伟大的物理学家之一,也堪称概率论的第一个哲学天才,在1814年出版的《关于概率的哲学论文》中写下了一生中最著名的段落。这个段落后来成为决定论宇宙观的标准旗帜:

“一种智慧,如果在某一个给定的瞬间认知到自然界中所有作用力以及所有构成自然之物的确切状态,并且它的能力广泛到能够将这些全部数据加以分析,那么它将能够用一个公式囊括宇宙中最大天体和最轻原子的全部运动。对于它,没有什么是不确定的,未来与过去都同等在它眼前敞开。”

这个假想的智慧后来被称为“拉普拉斯妖”。它不需要概率。它在确定性运动方程中早已看到过去未来的一切确定形态。在这样的世界中,概率不过是人类无知的面纱,因为我们无法追踪每一个分子,所以对某些事件的结果暂时不知,只好说它有可能发生或不发生。但可能性并不存在于自然界本身,它只是人类知识不足的记号。

拉普拉斯的观点统治了十九世纪。物理学,经典力学、电磁学,都用确定性的微分方程书写。概率论在这个画面中是临时的、实用的工具,是不完全信息下的权宜之计,是宏大决定论秩序中一块遮羞布。

但细读拉普拉斯,会发现某种耐人寻味的张力。正是同一个拉普拉斯,花费了巨大的精力来研究概率论本身,他不仅提出了“拉普拉斯妖”的想象,还建设了贝叶斯定理(他独立于贝叶斯重新发现并系统化了它),构建了母函数方法将概率与生成函数联系起来,提出了计算积分近似值的拉普拉斯方法,证明了最早版本的“中心极限定理”,大量独立随机变量的平均近似服从正态分布。

拉普拉斯可能从来没有意识到自己工作之间的矛盾:他所做的事情,发展概率论使之成为一个自洽、严密、有力的数学学科,为概率最终摆脱附庸角色打下地基。他在檄文中宣布概率是暂态,却用一生建设它成为理论。他没有看见他自己创造的未来,那时候概率不再只是无知的语言,而成为自然界基本法则的一部分。但那个地基确实出自他的手。

从热力学到布朗运动

十九世纪下半叶,一种全新的科学语言开始形成。这种语言将不可逆性,时间的箭头,与概率联系起来。

传统力学方程在时间反演下是对称的:如果粒子A从左向右运动,那么同样符合方程的是它从右向左走回去。但热量从热物体流向冷物体,却从未在封闭系统中自发地逆向流动。这是为什么?物理定律本身似乎不禁止逆流,但逆流又从未被观察到。

克劳修斯引入了熵的概念,在一个孤立系统中总是增加的那个函数,标志着能量的不可用性。但熵的本质仍然模糊。直到路德维希·玻尔兹曼给出了一个震撼人的解释:熵不是别的,是微观状态数的对数。一个系统总是趋向更大概率的配置,不是因为自然力有方向,而是因为无序状态在数量上远远超过有序状态。热力学第二定律是一条统计定律,不是一条严格力学定律。冰块融化不是因为“理应融化”,只是因为融化的分子排列数远多于冰晶态的排列数,一个随机漫步的系统在绝大多数时间被发现处于高概率状态。

这是概率第一次成为自然界根本法则的一部分,而不是暂时信息的遮羞布。概率不是无知的代名词,它就是宇宙运作的方式。在足够的尺度上,物理定律直接从组合增长和统计趋向中涌现出来。

1905年,阿尔伯特·爱因斯坦还不知道玻尔兹曼的悲剧,玻尔兹曼在一年后将自缢于杜伊诺,却用玻尔兹曼的统计思想解释了悬浮在液体中的花粉微粒的无规则跳动。这种被称为布朗运动的现象在物理学家眼前存在了一个多世纪而无法解释。爱因斯坦用概率论写下了一个简洁的公式:微粒的均方根位移与时间的平方根成正比,比例系数依赖于液体温度、微粒半径和液体的粘性。他由此计算了阿伏伽德罗常数,每摩尔气体中的分子数目。

爱因斯坦在关于布朗运动的论文末尾写道:也许上帝是不掷骰子的,但微观粒子显然在掷。让·佩兰在1908年通过精密实验证实了爱因斯坦的公式,最终获得了诺贝尔奖。概率从此不再是客体的不足,而成为物理理论的基本构件之一。

量子力学:概率升至本体论

1925-1926年,量子力学的矩阵形式和波动力学相继诞生。在微观世界的描述中,一个电子的状态不是由确定的位置和动量给出的,而是由波函数描述的。波函数不告诉你电子在哪里,它告诉你:如果测量电子的位置,你得到某个结果的概率密度是什么。

最令人不安的不是这个数学形式本身,而是测量结果的不可消除的随机性。两束电子通过双缝产生干涉图样,每一个单独的电子落点是随机的。它在波函数坍缩的那一刻变成具体的点。你无法预知它的精确位置,只有一个概率分布。同一时刻所有可能位置在物理上同时存在,直到测量将其中一个概率实现为实际。

爱因斯坦至死抵抗这种解读。他与玻尔进行了贯穿多年的论战,最著名的一次在1935年,与波多尔斯基和罗森联合发表一篇论文,提出EPR悖论。他们论证,如果量子力学是完备的,那么它预言了两个纠缠粒子之间存在非局域的超距关联,爱因斯坦称之为“幽灵般的超距作用”。他认为这是荒谬的,因此量子力学不可能是完备的,必定存在未被发现的“隐变量”,某种决定论的、经典概率的基础。

1964年,约翰·贝尔将这场哲学争论变成了一个可以实验判决的数学问题。他推导了贝尔不等式:如果存在局域隐变量,那么纠缠粒子的测量统计量必定不超过某个数值。量子力学预言统计量超过这个值。从1970年代到2015年,一系列越来越精确的实验证明了贝尔不等式被违背。局域隐变量理论被排除。量子的不确定性不是暂时未知,而是自然界的基本底盘。

概率在量子力学中获得了它在人类历史上最彻底的存在升级:它不是信息不足的权宜之计,它是现实的构造方式。从掷骰子的赌徒到贝尔不等式的实验物理学家,人类对“可能”的追问走了三百多年,最后发现可能正是实际。

贝叶斯的路:从定理到思维方式

概率史上存在一条与频率学派并列的长线,贝叶斯的路线。

托马斯·贝叶斯是十八世纪一位英国长老会牧师。他的一篇遗稿由朋友整理发表,题目是《论机运学说中的一个问题》。这篇论文解决了一个乍看平凡的问题:已知某个事件在n次试验中成功了k次,该事件每次试验成功的概率θ是多少?

这个问题的标准表述在今天的统计课中就是估计二项分布的概率参数。但贝叶斯问得不一样。他不是求“给定θ时得到k次成功的概率”,而是求“得到了k次成功后θ应该是什么”。这是条件概率的逆推:从结果推论原因。

贝叶斯用一个巧妙的比喻处理先验信息:一张桌子上随机落下的球,只知道最终位置在某个范围内,不知道球是从桌子哪个区域滚来的。这个比喻引导出后验概率的公式,今天被称为贝叶斯定理:

P(A|B)=P(B|A)·P(A)/P(B)

从条件A导致的B事件的发生概率反推B事件发生之下A的存在概率。这个公式在拉普拉斯手中被系统化,在二十世纪被哈罗德·杰弗里斯、布鲁诺·德·费内蒂、伦纳德·萨维奇等人发展为一套完整的统计推断范式。

频率学派与贝叶斯学派的分歧在于:概率究竟是什么?频率学派说,概率是事件在无限次重复试验中的极限频率,因此只有可重复的事件才有概率。贝叶斯学派说,概率是合理信念的度量,它表达的是一个理性个体在面对不完全信息时的置信度。你可以说“明天有百分之七十的概率下雨”,这是一个针对单次不可重复事件的陈述,也可以说“先验概率”,在取得数据之前,对所估计的未知量概率分布的陈述。

这种分歧在二十世纪末和二十一世纪初从学术争论渗透到了技术应用之中。垃圾邮件过滤器、搜索引擎的排序算法、图像识别、自然语言处理,现代机器学习的几乎全部概率模型,用的都是贝叶斯框架。在数据中更新先验信念,将不确定性保持为分布,以期望损失最小化为决策原则,贝叶斯方法将概率的观念从统计实验台搬到了日常数字化生活之中。

贝叶斯定理比贝叶斯本人影响更大。他一生没有发表过数学著作,那篇带来不朽名声的论文是他死后由朋友代发的。他的墓碑上只刻着“托马斯·贝叶斯,新教牧师”,没有一个数学符号。但他那座不起眼的墓碑之下埋葬着一种改变了世界思维方式的思想。不确定性不是应该被驱散的阴影,而是理性推理的起点,从已有数据中更新置信度,这一逻辑比贝叶斯写作时赌徒掷骰子的世界要广阔得多。

随机性与必然性之歌

从1654年那个巴黎沙龙里的点数中断问题出发,概率论抵达了它自己也不曾预见的远方。帕斯卡和费马当时以为他们只是在解决一个赌博难题,骑士们想知道怎么分钱公平。但在公平分配的规则中,一种全新的数学量,期望值,被定义了。这一量后来扩散为保险的概率保费、法庭证据的量化推理、医学试验的统计显著、物理定律的底层结构、人工智能的不确定性处理、以及哲学上自由意志与决定论的持久辩论。

这三百年间有一个根本概念不断重现,那就是信息的量化缺失。每一次掷骰子落地的不确定性,每一个观测误差分布的标准差,每一个波函数坍缩时的概率幅,每一个贝叶斯先验在后验中的更新,它们都是同样的逻辑在不同时期的实例化:有限信息下,答案不是点而是分布,推理不是演绎的而是归纳的。

拉普拉斯的妖眼最终不存在。量子力学排除了它的存在基础。混沌理论证明了即使经典系统在实践上也无法无限期预测。贝叶斯框架将先验与数据完整统一。宇宙最底层的运行法则在许多种解读体系中本来就是概率性的,未来不因为人类无知而显得不确定,而是因为实在本身在概率上就是开放的。

骑士德·梅雷的名字只因为向帕斯卡提问而留在数学史上,但那个简单的问题,游戏被打断、赌注该怎分,最终开启的不是更精巧的赌术,而是一个概率的宇宙。我们生活其间,自身的细胞分裂、大脑神经元的突触放电、下一分钟天气的变化、屏幕上搜索结果的排序,全都在这个由帕斯卡和费马在通信中初次绘制的随机性的地图上。这张地图有三百年历史而远未绘制完成,每代人都向未知区域推进了一些经纬线的测量。概率是一个永远无法被完全驯服的词汇,而这正是它将永远与人相伴的理由。

第十九章 数学基础的烽火:逻辑主义、形式主义与直觉主义的三国演义

危机的前夜

十九世纪的最后一年,1900年,巴黎国际数学家大会。大卫·希尔伯特,哥廷根大学的数学领袖,当时四十八岁,正处于智识力量的巅峰,站在讲台上,向全世界的同行发表了一份宣言。在世纪之交的时刻,希尔伯特提出了二十三个问题,这些问题将在此后百年间指引数学发展的方向。

前两个问题分别关于连续统假设和算术公理的相容性。第二个问题的表述格外简洁:证明算术公理是无矛盾的。希尔伯特说这句话时语气平稳,仿佛只是在要求一个例行的技术验证。台下几乎没有人意识到,这个问题的背后藏着一个即将爆发的深渊。

整个十九世纪是数学严格化高歌猛进的时代。柯西和魏尔斯特拉斯将分析从直觉中解放出来,康托尔在无穷的群山中开辟了领地,戴德金用“分割”定义了实数,皮亚诺将自然数归纳为几条公理。数学似乎已经从模糊的直觉走向了清晰的形式。现在只差最后一步:证明这个形式系统本身不会产生矛盾。

这一步将耗费四十多年,而它的结果与所有人的预期相反。

弗雷格的倒塌

戈特洛布·弗雷格比希尔伯特年长十四岁,是耶拿大学的数学教授。他长得消瘦、严肃,在照片中几乎没有笑容,但论著的行文却有着一种被抑制的激情。他的毕生目标是将数学,首先是算术,完全还原为逻辑。

弗雷格的计划雄心万丈。在他的《概念文字》(1879年)中,他发明了历史上第一个完整的谓词逻辑系统。这套系统用精确的符号来表达“所有”、“存在”、“非”、“如果…那么…”等逻辑关系,其表达能力远远超出了自亚里士多德以来两千年的三段论逻辑。弗雷格第一次提供了足以表达全部数学推理的形式语言。

在《算术基础》(1884年)中,弗雷格展开了他对数的逻辑定义。2是什么?弗雷格的回答是:数是概念的性质。2是所有“二元集合”的集合,即所有恰包含两个对象的集合的集合。零是“不等同于自身的事物”的集合,即空集。后继运算通过“概念F与概念G等数当且仅当F下的对象与G下的对象可以一一对应”来定义。从这个基础出发,弗雷格试图逐步推导出全部算术定理。

这些定义被完整地编织进《算术基本法则》,第一卷1893年出版,第二卷1903年出版。这是逻辑主义运动的最高丰碑,两千多页密密麻麻的形式推演,从最基本的概念一步步攀升到实数理论。

第二卷已经交付印刷。校样已经送回出版社。就在此时,弗雷格收到了一个年轻英国人的来信。

伯特兰·罗素在信中措辞极其恭敬。他赞美弗雷格的著作,称它“在我所读过的任何书中都最为精微”。然后,他用一两段话陈述了他注意到的那个矛盾,罗素悖论。所有不属于自身的集合的集合,既属于自身又不属于自身。这个悖论可以直接从弗雷格的基本法则V中推导出来。

弗雷格收到信时距离第二卷出版只剩几周。他匆忙在书末加了一篇补遗,开头那句后来被无数次引用的文字:“对于一个科学家来说,没有什么比在他的工作即将完成时,其基础被抽掉更令人难以接受的了。贝尔特兰·罗素先生的一封信将我置入了这种境地。”

弗雷格试图用一个临时修补来挽救他的系统,修改基本法则V使得罗素悖论不再可推导。这个修补后来被证明是不充分的。弗雷格再也没有完成他计划中的第三卷。他晚年转向了其他哲学问题,发表了一些关于语言和思想的深刻论文,但他的逻辑主义计划就此搁浅。他在耶拿大学的课堂日渐清冷,有时只有两三个学生。他死于1925年,至死未改初衷。

罗素与怀特海的钜制

罗素并不满足于摧毁弗雷格的体系。他要修好它。

罗素的解决策略是类型论。集合被分为层级:个体属于类型0,个体的集合属于类型1,个体集合的集合属于类型2,以此类推。一个集合只能包含类型低于它的元素。这就使得“所有不属于自身的集合”成为非法表达式,类型论不允许一个集合包含自身。罗素悖论的刺被拔除,但代价是整个数学需要被重新表述。

《数学原理》是罗素与阿尔弗雷德·诺斯·怀特海合作的结果。这部三大卷的巨著于1910年至1913年间出版,在弗雷格失败的地方重新启动了将数学全部逻辑化的工程。从极少数的逻辑公理和推理规则出发,罗素和怀特海重新定义了数、集合、关系、序数甚至实数,一步一步证明算术、分析和初等集合论的所有基本定理。

这部著作的规模超出了任何正常读者可以承受的范围。第362页才最终证明了1+1=2,并在旁边加上一句著名的干涩注释:“上述命题在偶然场合可能有用。”全书的符号系统极其复杂,据说世界上只有不到十来个人通读过《数学原理》的全部证明。

《数学原理》是否成功地将数学完全还原为逻辑?数学界的评价至今分歧。罗素和怀特海在逻辑公理之外不得不用了三条非逻辑公理:无穷公理(存在无穷多个体)、选择公理(即乘法公理)和可化归公理(降低类型论带来的复杂性)。后一条尤其争议,拉姆齐后来证明它可以被去除,但前两条很难说是纯逻辑。如果逻辑是关于一切可能世界的真理,那么宣称“存在无穷多个体”究竟是逻辑还是关于物理事实的论断?逻辑主义者对此从未给出一个让所有人满意的答案。

不管怎样,《数学原理》完成了弗雷格未竟的事业:它建造了一座逻辑主义的大厦。这座大厦或许并不完全坐落在纯逻辑的地基上,但它的拱顶、飞扶壁和穹窗都证明了数学的可形式化程度远远超出十九世纪的想象。每一个数学概念都可以被解析为逻辑表达式,每一个数学证明都可以被分析为逻辑推导步骤。《数学原理》带来的巨大技术遗产,从符号逻辑到类型论到后来的λ演算,直接影响到了计算机科学的诞生。

希尔伯特的形式主义纲领

当罗素在为类型论的细节绞尽脑汁时,希尔伯特走上了一条不同的道路。他关心的不是把数学还原为逻辑,而是确立数学的绝对可靠性。

希尔伯特的形式主义纲领可以概括为一个口号:数学是无意义的符号游戏,但它可以被证明为无矛盾。在希尔伯特看来,数学命题的意义退场,只留下按照精确规则操作符号的形式系统。选择公理有没有意义?不相关。实数存在不存在?不相关。唯一相关的是:从给定的形式公理出发,按照给定的形式推导规则,能否推出0=1?

如果能,系统是矛盾的。如果不能,系统是相容的。

希尔伯特提出,这种相容性证明必须使用“有穷方法”,只涉及具体的、可直觉检验的符号操作,不涉及任何无穷集合或非构造性推理。有穷方法就像下棋:你不需要相信棋子的移动代表了任何事物在现实中的关系,你只需要确认每一步都符合规则。如果从开局到将军的整个过程中没有出现违规,那么棋局就是合法的。同样地,如果从数学公理到0=1的符号串不可能在有穷步内被推导出来,那么数学系统就是相容的。

1920年代,希尔伯特和他的助手们,阿克曼、贝尔奈斯、冯·诺依曼,开始执行这个纲领。他们首先将数学形式化为一套精确的符号系统:有无穷公理、归纳公理、函数符号、逻辑连接词、量词规则。然后,他们试图用有穷方法证明这个形式系统只能导出真命题,不会导出矛盾。这个计划在一步一步地推进,初等算术的片段被逐渐证明了相容性。希尔伯特越来越乐观。1928年他在博洛尼亚国际数学家大会上宣称,完整的算术相容性证明已近在咫尺。

他年轻的学生赫尔曼·外尔称这个纲领为希尔伯特的“宏伟梦想”。外尔自己并不完全相信这个梦想可以实现,但他被希尔伯特的雄心深深打动。在那些年里,哥廷根弥漫着一种完成数学最终奠基的期待感。一切都在按计划推进。然后,一个来自布尔诺的年轻人彻底终结了这个梦想。

哥德尔的旋风

库尔特·哥德尔比希尔伯特小四十四岁。他生于奥匈帝国的布尔诺(今捷克境内),身材瘦小,戴着一副厚重的圆框眼镜,说话轻声细语却斩钉截铁。1929年,二十三岁的哥德尔完成了他在维也纳大学的博士论文,证明了希尔伯特梦寐以求的定理的一个版本:一阶谓词逻辑是完全的,所有在逻辑上为真的公式都可以被形式推导出来。这是一个巨大的成就,它直接坐实了弗雷格-罗素-希尔伯特路线的半个世纪工作:逻辑推演的形式系统确实捕捉到了逻辑真理的全部。

希尔伯特对这一结果深感欣慰。这似乎在暗示,形式系统是无所不包的。如果逻辑是完全的,那么算术也许也是。

但哥德尔已经转向了下一道问题。他试图证明算术的完全性,所有在自然数中为真的命题都可以从皮亚诺公理推导出来。然而,他越深入越觉得不对。1930年秋天,哥德尔得出了一个令人瞠目的结果:算术不仅不是完全的,而且不可完全。

哥德尔第一不完备定理宣告:任何包含初等算术的、可有效枚举的形式系统,如果是相容的,就是不完整的,系统内存在既不能被证明也不能被否证的命题。这不是因为人类的智力不够找不到证明,而是因为这样一个命题根本在系统内既不可证也不可否证。它的存在是必然的,就像素数在自然数中的存在一样。

哥德尔的证明手法被称为“自指编码”。他发明了一种方法,用自然数来编码形式系统中的符号、公式和证明序列。在这种编码下,每一个关于形式系统的陈述,例如“公式F可被证明”,都对应着一个自然数命题。然后,哥德尔构造了一个自然数命题G,G的内容在编码下恰好等价于“G不可被证明”。如果G可被证明,那么根据G的内容,G不可被证明,矛盾。如果G的否定可被证明,则根据否定内容推导出G可被证明,又是矛盾。因此,在系统相容的前提下,G既不可证明也不可否证,它是一个不可判定命题。

哥德尔第二不完备定理沿着同样的编码思路推得更远:系统无法在自身内部证明自己的相容性。希尔伯特希望用有穷方法在算术系统内证明算术无矛盾,哥德尔证明这是不可能做到的。系统不能自证无矛盾,除非它事实上是矛盾的。用矛盾的系统证明自己无矛盾当然是一个廉价的胜利。相容性证明必须先假定一个更强的系统的相容性,这导致了一个没有终点的向上攀升。

希尔伯特得知哥德尔的结果时,据说最初的反应是“愤怒”。但愤怒迅速被冷静的数学判断取代。希尔伯特很快承认了哥德尔结果的有效性,并在自己的著作中将其纳入讨论。纲领没有完全破产,有穷方法相容性证明的某部分仍然可以挽救并继续推进,但希尔伯特最初那个雄心壮志的版本,被证明是无法实现的。数学不能在其内部为自身提供绝对的可靠性保证。

布劳威尔的挑战

在逻辑主义与形式主义之外,第三股力量在整个辩论中站稳了立场。它的创建者是荷兰数学家L.E.J.布劳威尔。

布劳威尔早年成名于拓扑学,他证明了布劳威尔不动点定理,这个定理至今仍为经济学和博弈论的基本工具,也渗透在各个学科中。但到三十岁左右,布劳威尔开始对他曾贡献卓越的经典数学大厦产生根本性的怀疑。这种怀疑锚定在一个特定的原则上:排中律。排中律声称任何命题要么为真要么为假。在有限世界,这个原则没有问题。但在涉及无穷对象时,布劳威尔认为排中律不再合法。

布劳威尔给出的经典例子是两个无穷十进制小数展开的比较。是否存在一个论证能判定两个任意给定的实数相等或不等?布劳威尔断言,没有人可以给出这样的通用方法。因此,“实数a等于实数b或者不等于实数b”这个命题,在没有有效构造程序的情况下,不能被视为必然为真。这就剔除了排中律在无穷领域的绝对有效性。

布劳威尔将他的立场称为直觉主义。数学不是关于独立于心智之外的柏拉图王国的真理,而是人类心智的构造活动。一个数学对象存在,当且仅当它可以在有限步骤内被明确构造出来。存在不是属性的集合,而是可构造性的承诺。

直觉主义对经典数学的挑战是根本性的。如果排中律不合法,那么经典数学中绝大部分的非构造性存在证明,例如“存在一个实数不是代数数”但不给出哪个数,都是非法的。整个黎曼几何、泛函分析、抽象代数的很大部分都是用被直觉主义斥为无意义的方法证明的。

布劳威尔不满足于批判,他着手重建数学。直觉主义分析被一步步发展起来:连续统不再是由独立存在的点组成的集合,而是由“选择序列”,不断展开而永不完成的过程,构成。函数概念被局限在可构造规则的范围。某些经典定理(如波尔查诺-魏尔斯特拉斯定理)在直觉主义下不成立,某些定理需要更高强度的精微证明才能保留。

希尔伯特在这场挑战面前,态度是前所未有的激烈。他在1927年的汉堡演讲中直言:“把排中律从数学中拿走,就像禁止天文学家使用望远镜,禁止拳击手使用拳头。这与布劳威尔的学说相合的数学,在大量重要定理支离破碎之后,是一种残疾的、奄奄一息的东西。”

布劳威尔回击得不遑多让。他指责希尔伯特的形式主义是一种没有意义的符号游戏,把数学降低为在纸上面划道道。真正的数学发生在心智的构造行动中,符号只是为了交流这种构造而派生出的次要工具。

哥廷根大学,希尔伯特的堡垒,在1928年投票将布劳威尔从《数学年鉴》的编辑委员会中移除。这件事深深伤害了布劳威尔。他此后的数学生涯部分转向了直觉主义数学的拓展,部分消沉于与主流数学界的隔绝。他活到了1966年,几乎亲眼看到了计算机的出现使得构造性数学以一种全新的方式获得了意义。

赫尔曼·外尔:在两极之间

在这场被称为“数学基础危机”的巨大争论中,赫尔曼·外尔是一个独特的观察者和参与者。他曾同时是希尔伯特和布劳威尔的崇拜者。

外尔早年是希尔伯特在哥廷根的明星学生,也是布劳威尔直觉主义的一部分早期拥护者。在1921年的一篇文章中,外尔写道:“我放弃了一直以来效忠的形式主义,退回到布劳威尔的立场。”他呼吁数学家认真对待布劳威尔的挑战,认为经典分析中某些非构造性证明确实是悬在空中的。

但随着时间推移,外尔逐渐看到了纯粹直觉主义的局限。直觉主义数学的重建缓慢、费力而支离,某些最重要的物理应用,比如希尔伯特空间上的谱理论,量子力学的基础数学语言,不能在纯粹的布劳威尔框架下获得。外尔开始寻求一条中间道路。

他的态度可以用他自己的一句名言概括:“在数学中,我们既不能完全接受直觉主义的戒律,也不能完全安居于希尔伯特的舒适天堂。我们必须随着每一类问题的需要而调整数学思维的严密程度。”外尔不是要在互相敌对的学派之间说和稀泥的话,他是在做出一种清醒的哲学断言:数学知识是分层级的,不同的领域可能需要不同的基础标准。

外尔的立场预示了二十世纪下半叶数学界实际采取的态度。大多数数学家对基础争论采取了实用主义态度:公理集合论(ZFC)被用来充当统一的背景框架,经典逻辑和排中律在日常工作中被自由使用,但当构造性和算法性成为关注焦点时,直觉主义和类型论的工具就会被重新捡起。学术界的日常运转并没有因为不完备定理而停滞。数学继续进行,证明被写出,新理论被创建,它们中的大多数都远远超出了皮亚诺算术的范围,但工作者对自己的方法保有一种非教条的、实用的信念。

图灵:可计算性的边界

一个沉默的英国年轻人给基础争论增添了最后一块关键的拼图。

艾伦·图灵在1936年发表了一篇论文,表面上研究一个看似窄小的技术问题:是否存在一种机械程序能够判定任意一阶逻辑公式是否为定理?要回答这个问题,首先需要定义一个模糊的日常概念,机械可计算性。

图灵的分析方法是设想一台极端简化的抽象机器,现在被称为图灵机。图灵机由一条无限长的纸带(划分为方格)、一个可以读写符号并左右移动的磁头以及有限个内部状态组成。机器的行为完全由状态表和读写规则决定,没有自由,没有直觉,没有无限的并行步骤。

图灵宣称,任何可被人类按照精确有限规则机械计算的过程,都可以被图灵机模拟,这就是丘奇-图灵论题。基于这个论题,图灵严格定义了可计算性。然后他证明了:判定一阶逻辑公式是否为定理的通用程序不存在。停机问题,判断任意图灵机在任意输入下是否会停止运行,是不可计算的。这反过来也给出了哥德尔不完备定理在算法层面的等价版本。

图灵机的意义远远超出了数理哲学。它提供了现代计算机的理论模型。冯·诺依曼在1945年撰写EDVAC报告,现代存储程序计算机的蓝图,时,明确引用了图灵1936年的论文。当物理计算机在二十世纪下半叶大量出现时,它们运行的正是图灵可计算函数的物理实现。

基础争论并没有以某一派的全面胜利告终。逻辑主义没有将所有数学确实无争议地还原为逻辑。形式主义的宏伟相容性证明纲领没有以希尔伯特所期望的方式完成。直觉主义没有说服整个数学界放弃排中律。但在这场三国演义的烽火中,产生了一批改变人类智识面貌的成果:完全的形式逻辑系统、类型论、可计算性理论、现代计算机的数学模型。

哥德尔晚年,在普林斯顿高等研究院,与爱因斯坦是亲密的朋友,变得愈发孤僻。他在花园中散步的时间越来越长,与人谈话的意愿越来越低。他死于1978年,死于一种近乎哲学自杀的衰竭:他晚年有严重的受迫害妄想,拒绝进食,因为他担心食物被下了毒。这是另一个关于完备性与一致性的故事,一个证明了没有形式系统能完全捕捉算术真理的人,最终无法将自己保持在身心的平衡当中。

不完备定理的真正遗产很可能不是一个单纯的逻辑结论,而是一条关于人类知识处境的深刻陈述。任何足够丰富的语言,都能被用来构造指涉自身的命题,都能在被穷尽其后果的过程中产生不可判定的环节。这并不意味着人类的知识就此走到了边界,它只是说明,边界总是内在于理性所到之处,而在边界的这一边,人类仍然能够使用现有的工具去认识大量事物,正如希尔伯特在哥廷根的墓碑上刻下的那句话:“我们必须知道,我们必将知道。”这句话在哥德尔之后显然不再具有字面上的担保,但它作为人类不懈追问的姿态,依然穿越着那之后的每一个时代。

第二十章 数学与机器的共舞:从图灵到人工智能

机械计算的古老根须

人类对于机器思考的幻想,远比计算机的发明更为古老。莱布尼茨在十七世纪不但设想了能够做加减乘除的机械计算器,还在更深的层次上梦想着一种普遍的符号语言,通过将一切推理化约为符号的排列和运算,使得“任何争论都可以通过坐下来计算来解决”。这个梦想在当时的技术条件下遥不可及,但它将两个日后分离又汇合的领域,逻辑与机器,提早绑在了一起。

莱布尼茨的步进鼓计算器在操作层面并没有超过帕斯卡的加减机太多。它可以做乘除,但极其笨重,无法大规模生产。真正将计算从手工推向机械化的是产业革命的巨大齿轮。1804年,雅卡尔织机用穿孔卡自动控制提花图案,人将复杂花纹转换成二进制的指令序列,机器忠实地读取并执行。这是历史上第一次有人将信息从人的思维中外部化、指令化,并交给机械去识读。这个发明的影响并不限于纺织工业,当巴贝奇将穿孔卡引入他的分析机设计时,一段从提花机通向通用计算机的道路被首次标在了蓝图上。

巴贝奇的差分机和分析机在之前的章节中已经讲述过。在这里只需再次强调一个细节:埃达·洛夫莱斯,拜伦的女儿,注定既是贵妇又是数学传道者,在1843年的注释中写下了计算伯努利数的完整程序。这不是一个数学公式的推导,而是一系列顺序、分支和循环指令,用表格形式排布,可以单步执行。埃达在附注中写道,这种机器可以“对任何能够被以符号精确表达的过程加以处理”,作曲、绘图、逻辑推理。信息处理的概念在维多利亚时代早期就已被清晰地表达出来,远在它被物理实现以前。

十九世纪末,赫尔曼·霍勒里斯将穿孔卡用于美国人口普查的数据汇总,他的公司通过兼并最终变成了国际商业机器公司,IBM。卡片上的孔洞再一次成为信息编码的载体,但这一次,电驱动了计数和分类,速度比雅卡尔织机快了几个数量级。到二十世纪二十年代,IBM的电动制表机已经能够处理复杂的统计分类。人类还没有发明电子计算机,但机械化数据处理的路径正在加速延伸。

图灵与可计算性的边界

1936年,剑桥大学国王学院的研究员艾伦·图灵发表了《论可计算数及其在判定问题上的应用》。这篇论文的问世过程本身就是一个令人咀嚼的历史细节,当图灵在剑桥的初稿还在构思中时,大西洋彼岸的普林斯顿,阿隆佐·丘奇已经发表了λ演算,用它证明了一阶逻辑的判定问题是不可解的。图灵的研究结果本可能被视作重复工作而淹没。但丘奇和纽曼认识到了图灵方法中独特的价值:图灵没有使用抽象的递归函数或λ演算,而是设计了一台极端简化的机器。

图灵机的诞生将抽象的“可计算性”概念变成了一个物理可以实现的过程。纸带,无限长的线性存储器;读写头,在每个时刻只能感知一个符号并做出反应;有限状态表,将机器的全部行为规范为条件与动作的组合。一切有效的计算都可以被这台极端原始的机器模拟,无论计算的内容是算术、代数、搜索还是逻辑推理。丘奇-图灵论题断言:任何在直观意义上“可计算”的函数,都是图灵机可计算的。这个论题不能被证明(因为它将非形式的直观概念等同于形式概念),但它至今没有被证伪。

图灵证明了存在通用图灵机,一台能够模拟任何其他图灵机的机器。将待模拟机器的状态表和初始带内容作为输入数据,通用图灵机能够忠实地复现被模拟机器的全部行为。这为计算机硬件和软件的区分提供了理论基础:硬件是一台固定的通用图灵机(中央处理器),软件是输入的状态表(程序)。同一个物理机器可以成为计算器、文本编辑器或音乐播放器,完全取决于输入的程序。通用图灵机在纸上的存在,是冯·诺依曼体系结构的真正源头。

图灵的论文还建立了“停机问题不可判定”的结论:不存在一个通用算法能够预先判断任意给定的图灵机在任意给定输入上是否会停止。这等价于哥德尔不完备定理的算法版本,并在某种程度上更令人震撼。哥德尔的不完备定理表明数学系统内有不可判定的命题,图灵则将不可判定性定位在计算机程序本身的运行行为之中。你不能总是提前知道你的程序会不会陷入死循环,这不仅是实践上做不到,而且是原则上做不到。

冯·诺依曼与现实机器的诞生

约翰·冯·诺依曼是那种罕见的、在纯数学和应用科学中都游刃有余的天才。他在集合论、算子理论、量子力学的数学基础以及博弈论中都留下了决定性的足迹。但在第二次世界大战末,他的注意力转向了一个看似工程的问题:如何建造一台能够存储程序的电子计算机。

当时已有几台先驱机器存在。霍华德·艾肯的哈佛马克一号是机电式的,用继电器而非电子管,速度有限。宾夕法尼亚大学的ENIAC是第一台全电子通用计算机,但它的程序不是存储在存储器中,而是由操作员通过插拔电缆和设置开关来编排,每次更改程序,要花上数小时甚至数天的时间重新接线。ENIAC的计算单元足够快,但编程效率是致命的瓶颈。

1945年,冯·诺依曼撰写了一份草案,《关于EDVAC的报告初稿》,其中描绘了一台将程序与数据共同存储在同一高速存储器中的电子计算机。报告详细描述了机器各部分的功能分工:中央算术单元执行基本运算,中央控制单元按存储程序顺序控制计算流程,存储器存放程序和数据,输入输出设备完成与外界的交换。

这个“存储程序概念”如今被称为冯·诺依曼体系结构。它的惊人之处在于整个设计几乎就是通用图灵机的近乎直译的电子学实现。算术单元加上控制单元构成图灵机的有限状态控制器,存储器是图灵机的纸带,输入输出则是与外部世界的接口。图灵在1936年概念上完成的事情,冯·诺依曼在不到十年后在物理上复现了。

图灵自己也参与了计算机的建造。他在二战期间为英国政府工作,参与了布莱切利园破解德国恩尼格玛密码的核心工作。他的密码分析机,称为“炸弹”,不是通用计算机,而是一种专门用于穷举搜索恩尼格玛设置的机电装置。战后,图灵设计了自动计算引擎,这是英国最早的存储程序计算机之一。他在1948年为曼彻斯特大学写了一篇名为《智能机器》的内部报告,其中已经讨论了神经网络和训练机器的可能性。

1950年,图灵在哲学期刊《心灵》上发表了《计算机器与智能》,提出了那个著名的“模仿游戏”,现在被称为图灵测试。这篇论文不是关于计算机工程的,而是关于思维的哲学。图灵问:如果一台机器能够在对话中让人类判断不出它是机器还是人类,我们是否应该承认它具备思维?他同时系统地反驳了各种可能的反对意见,神学反对、鸵鸟政策反对、数学反对(建立在哥德尔不完备定理上的反对)、残疾反对(机器可以做很多事情但永远不能做X)以及洛夫莱斯夫人的反对(机器只能做我们命令它做的事情)。这篇论文至今仍是人工智能哲学绕不开的起点。

1954年,图灵被发现在曼彻斯特的家中去世,手边放着一只咬过的苹果。官方调查判定为自杀,但也有各种疑问存留至今。他活了四十一岁。他生前几乎没有受到任何与他的贡献相称的公众承认,布莱切利园的工作被列为最高国家机密,保密期延至战后数十年。他的同性恋身份在当时的英国是刑事犯罪,他在1952年被判以化学阉割代替监禁。现代计算机科学的创始人,大西洋两岸计算机工程师的虚拟导师,在与严酷的个人命运角力后,仓促退场。

从计算到智能的第一次尝试

电子计算机一出现,就有人开始问,计算机能思考吗。这个问题的漫长回旋持续至今。

1956年夏天,新罕布什尔州达特茅斯学院,约翰·麦卡锡、马文·明斯基、克劳德·香农等十位研究人员召开了历史上第一次人工智能夏季研讨会。麦卡锡为会议提案杜撰了“人工智能”这个术语。会议的目标雄心勃勃,让机器使用语言、形成抽象和概念、解决现在只有人类才能解决的问题、自我改进。大部分与会者相信,一个夏天的高强度工作足以取得根本性突破。

他们低估了难度。自然语言理解比最初想象的要难上数量级。机器翻译的早期乐观在1966年ALPAC报告中碰壁而碎裂,报告指出,经过十余年巨额投资,机器翻译的产出质量仍然远低于人工翻译,建议大幅削减基础研究资助。这导致了在美国的“第一个AI冬天”,政府缩减拨款,研究停滞。

但那个时期并非毫无成果。艾伦·纽厄尔和赫伯特·西蒙的逻辑理论机证明了罗素和怀特海《数学原理》中的若干定理,其中包括一个比原书证明更简洁的版本。西蒙后来在一封信中兴奋地写道:“我的机器发现了新的、更短的证明。”他将这门新事业称作“对启发式搜索的研究”:智能不再是拥有确定规则演绎的过程,而是在大量可能性中进行带有评估函数的搜索。这个观念后来构成了人工智能的核心范式。

麻省理工学院的约瑟夫·维森鲍姆在1966年写了一个简单的自然语言对话程序ELIZA,模拟一名心理咨询师。ELIZA没有知识库,没有推理能力,只靠模式匹配和句子重组。当一个用户输入“我感到孤独”,ELIZA可能回问“你说你感到孤独,能多谈谈吗?”。令人吃惊的是,许多使用者相信ELIZA在某种程度上“理解”他们,有些人坚持与它进行数小时的倾诉,并抗拒被告知那只是一个程序。维森鲍姆的后续思考转向了激进的技术伦理批判,他警告说,将超出计算机能力的判断问题委托给计算机,将产生深远的伦理和心理灾难。

知识的暗默之海与专家系统的幻梦

1970年代到1980年代,AI研究的主流从通用问题求解转向基於知识的系统,即所谓专家系统。基本想法直截了当:采访人类专家,将他们在一个狭窄领域中的判定规则抽取出来,编码为“如果……那么……”规则,存入计算机。然后用推理引擎在这些规则中执行链式推导。

斯坦福大学的MYCIN是专家系统浪潮最早也最著名的成果之一。MYCIN被设计用来帮助医生诊断血液感染和推荐抗生素。它的知识库包含约六百条规则,每条都是专家医生在特定临床情况下会做的判断。在正式评估中,MYCIN的诊断准确率超过了部分初级医生,甚至与专家相当。对于某个特定细菌的感染,MYCIN推荐的抗生素方案被认为优于参与评估的所有人类医生。

MYCIN并没有被投入临床使用。原因一部分在于法律和责任,如果计算机推荐了错误的治疗,谁负责?一部分在于实用性,当时在小型机上运行一次诊断需要大约半小时,对忙不过来的医生来说仍然过长。

专家系统在1980年代被商业推广,日本通产省在1982年启动了“第五代计算机”国家计划,以逻辑编程为核心的新一代智能系统。美国和欧洲随即跟进各自的战略性AI项目。风险资本涌入,数百家AI初创公司成立,股市对一切带有“专家系统”标签的产品给予高估值。

到1987年,泡沫破裂了。专家系统的脆弱性暴露无遗:知识获取的瓶颈,人类专家的知识中有大量是隐性的、不可言传的,无法被提取为整洁的规则;系统一旦超出被专家所指定的狭窄领域,就完全哑然;维护不断膨胀的规则库犹如在没有类型系统的帮助下维护数百万行代码。基础设施成本的高昂与个人计算机的迅速普及形成了恶性替代。“第二个AI冬天”贯越1990年代初期和中期,AI再次成为投资人回避的词汇。

概率复兴与数据驱动

1990年代后半,AI研究者悄悄地将注意力从规则转向数据,从逻辑转向概率。这个转向不是哲学上的总声明,而是问题导向的实用折衷:当规则写不过来的时候,就让数据说话。

语音识别是这个转变的先行者。1970年代的语音识别系统依赖精细的语言学规则和手工调校的音素模型,错误率居高不下。1990年代,隐马尔可夫模型和统计学语言模型的引入使语音识别准确率得到了突升。这些模型不需要语言学家手工编写发音规则,它们从成千上万小时的录音和对应的文字转写中自动学习声学模式。

机器学习,这个术语在1959年由亚瑟·塞缪尔首次使用,从计算机科学中边缘的爱好变成了核心议题。支持向量机、贝叶斯网络、决策树、集成方法、K均值聚类,这些数学工具变得远比专家系统的规则机灵。数据集取代了访谈转录本成为知识获取的主要载体。

互联网的兴起为数据驱动方法提供了意外富足的燃料。每一次点击、每一次搜索、每一次购买、每一次停留时长,都被记录为行为数据。搜索排序、推荐系统、广告投放,这些应用场景中有可度量的成功标准(点击率、转化率),海量廉价数据和强大的概率模型。机器学习从实验室走进产业,进入每一个连接网络的设备。

深度学习:并非突然的革命

2012年秋天,多伦多大学的亚历克斯·克里泽夫斯基、伊利亚·苏茨克维尔和杰弗里·辛顿在ImageNet大规模视觉识别挑战赛上用一声巨响将深度学习推入主流视野。他们的卷积神经网络,AlexNet,将图像分类错误率从之前的约26%骤降至15%,远远甩开所有使用传统手工特征的竞争者。

这看起来像一场突发的革命。但卷积神经网络的根埋得很深。福岛邦彦在1980年就提出了新认知机,一种使用局部感受野和层级特征抽取的神经网络模型。燕·勒存1989年在贝尔实验室将反向传播算法应用于卷积网络,成功识别了手写邮政编码。此后的二十年中,神经网络并非不工作,而是在大多数任务上不如手工精心调校的支持向量机或集成树,原因主要在于缺少足够的数据和算力来优化深层网络的数以千万计参数。

GPU,图形处理器,改变了这一点。GPU最初为视频游戏渲染而设计的大规模并行计算架构,恰好与神经网络的矩阵运算需求完美匹配。当ImageNet的上百万标注图片被倾入GPU集群上的深度卷积网络时,计算资源和数据资源终于跨越了深层网络有效训练的临界阈值。此后的十年,深度学习在图像、语音和文本领域重写了几乎所有基准测试的纪录。

语言模型与生成式人工智能

2017年,谷歌大脑的瓦斯瓦尼等人发表了《注意力是你所需的一切》,提出了Transformer架构。这篇论文从最初的目标是改进机器翻译,但它引入的自注意力机制意外地成为接下来所有大语言模型的基础。Transformer允许网络在处理一个序列的每个元素时,直接访问序列中所有其他元素的信息,它不再像循环神经网络那样受限于线性的时间步信息流动,训练的并行度和学习长期依赖的能力都获得了质的飞跃。

BERT,2018年由谷歌发布,用Transformer编码器从大规模无标记文本中预训练深层双向表示,然后在特定任务上微调。它随即在十多项自然语言处理基准测试中创下新纪录。GPT系列,由OpenAI从2018年开始推进,走的是另一条路:使用Transformer解码器进行从左到右的生成式预训练。GPT-1只不算大,GPT-2开始展现令人不安的文本生成能力,GPT-3在2020年以1750亿参数将大规模语言模型推入公众视野。

这些模型的行为模式与传统程序完全不同。它们没有显式的规则引擎,没有符号化的事实数据库,没有逻辑推导机制。它们只是在超大规模文本语料上训练过程中将词语共现模式压缩为万亿量级的浮点参数。提示文本经过参数的乘加矩阵运算,逐词输出最可能的后继。但当参数和训练数据量跨过某个门槛时,这种简单的自回归生成展现出了一系列未曾被明确编程的能力:多步推理、类比、翻译、代码编写、开放领域问答。这些能力不是被灌入的,而是从数据中被提取出的模式。

2022年11月推出的ChatGPT将这些能力裹在了一个对话界面中,两个月内用户增长至一亿,成为人类史上扩散最快的应用程序。对一部分人,这是通用人工智能的初露曙光。对另一部分人,这是统计模式匹配的高级伪装。关于机器是否真的“理解”语言的古老辩论重新燃起,这次有了具体而令人不宁的样本。

计算机时代的数学

计算机从数学的创造物逐步变为数学的工具,又从工具变成数学本身的一部分。

用计算机辅助证明的第一个里程碑是1976年阿佩尔和哈肯对四色定理的证明。四色定理声称任何地图都可以只用四种颜色着色,使得相邻区域颜色不同。阿佩尔和哈肯的证明将问题归约为约两千个可约构型,然后用计算机穷举检查每一个构型。当这个证明在1976年发表时,遭到强烈的反弹,数学证明怎么可以依赖人类无法手工验证的计算机枚举?但在此之后,计算机证明逐渐被接受为正当技术。开普勒猜想的证明(托马斯·黑尔斯,1998年)同样依赖大量计算机计算。随着时间推移,阻力变小了。

符号计算系统,Mathematica、Maple、MATLAB、SymPy,使得数学探索的方式发生了质变。以前数学家在纸上手工推导几个特例,现在他们可以用符号计算软件同时检验数百万个参数组合,从中猜出规律,然后再给出严格证明。实验数学,以计算为先导、以严格证明为终点的新研究范式,在数论、组合学和动力系统中产生了大量成果。

最近几年,深度学习开始反向渗入纯数学。深度思维(DeepMind)在2021年用神经网络辅助数学家发现了纽结理论和表示论之间的新联系。模型猜测了代数量与纽结不变量之间的相关关系,然后人类数学家根据这个猜测找到了严格的证明。2022年,同一团队在《自然》封面报道了用大型语言模型辅助发现矩阵乘法的新算法,斯特拉森算法多年未被改进,AI找到了比先前已知更有效率的矩阵乘法方案。机器开始成为数学发现的合作者。

两股记忆、同一河流

图灵的通用机、巴贝奇的分析机、莱布尼茨的普遍语言、帕斯卡的计算器、算盘上的算珠,这些产物相隔数个世纪,却属于同一条逐次展开的思维之流:将推理形式化,将形式机械化,将机械自动化。人类对智能的理解在这条长河中不断被改写。每一次新的自动化浪潮都曾引发对“机器能否真正思考”的疑惑,而每一次疑惑的结果都不是永久的终结,而是对人类理性的重新定义。

图灵在他1950年的论文结尾写道:“我们可以看见,在不久的将来,所能做的事情还只是非常小的一步。然而这一步是朝向建造一个真正具有智能的机器的漫漫征途上的开始。我们只能看到前方很短的距离,但我们可以看到那里有许多工作要做。”

七十多年后,前方仍然只能看到很短的距离。但回头看去,人类从泥板上刻下第一个楔形数字,到用万亿参数神经网络生成连贯语篇,已经走了将近六千年的漫漫长路。每一代人都以为他们走到了数学和思维的边界,而每一次下一代都证明了边界是移动的。机器的崛起很可能不是这条道路的终点,而是它的一个新段落,在这个段落中,数学不再仅仅是人类关于模式的科学,而开始成为模式在宇宙中认识自身的一条途径。这条途径在碳基与硅基之间蜿蜒分岔又合拢,尚未有最终的单向坡度,只是在继续延伸,带着过去全部积累的惯性,和未来未知弧度的不可预判。

第二十一章 对称的宇宙:从晶体到弦论的群之舞蹈

对称的直觉

对称可能是人类最早辨认出的数学美感。一个婴儿在镜子中认出自己的脸,一个旧石器时代的石匠将手斧打成左右均衡的形状,一个苏美尔陶工在泥罐上压出重复的几何纹样,这些行为远远早于任何关于对称的理论,但它们已经包含了对称概念的全部原始直觉:一个对象经过某种变换后保持不变。

将一片雪花放在显微镜下,六角形的结晶图案精确得令人窒息。每一根分支都是其他分支的镜像,整个形状在旋转六分之一周后与自身重合。雪花不知道数学,但它的分子排列遵循着水分子氢键的几何约束,自发地生成了具有六重旋转对称的晶体结构。大自然在人类还没有出现之前,就在用对称性来搭建物质世界。

古代文明将对称用作装饰的基本法则。埃及神庙的平面图是严格轴对称的,入口中轴线两侧的柱廊、雕像、圣所彼此镜像对应。希腊陶瓶上的回纹饰带表现出平移对称与反射对称的精确组合。伊斯兰世界的几何图案将对称推至另一种极致,因为没有具象形象,艺术家们将全部创造力投入到了抽象的几何对称之中。阿尔罕布拉宫的墙壁上,十七种不同的平面晶体群对称图案被无声地刻入瓷砖和灰泥,在摩尔人离开之后仍在格拉纳达的阳光下闪闪发光。

阿尔罕布拉的这十七种对称模式并非随意的美学选择。它们在数学上是完备的:在二维平面上,恰好存在十七种不同的重复对称模式,这就是平面晶体学群的分类。摩尔人艺术家当然不知道群论这个词,但他们用几代人的试错和审美选择,穷举了一个数学定理的全部可能性。

群概念的缓慢分娩

对称的数学化花费了远比直觉更长的时间。

古希腊数学家研究过正多面体,只有五种:正四面体、立方体、正八面体、正十二面体、正二十面体。他们证明了这个集合是完备的,使用的方法考察了围绕一个顶点的面角和必须小于三百六十度这一几何条件。但他们没有将正多面体的对称操作抽取出来作为一个独立的数学对象加以研究。旋转和反射被视为使图形与自身重合的物理动作,而不是代数结构的元素。

十八世纪的拉格朗日在研究方程理论时注意到了根的置换与方程可解性之间存在某种深层联系。他引入的预解式方法实际上利用了对称群的性质,但他本人没有把“置换的集合及其组合”提炼为一个独立概念。置换对他来说仍然是求解方程的辅助工具。

决定性的一步在十九世纪初由年轻的伽罗瓦迈出。伽罗瓦将方程根的对称置换视为一个整体结构,并证明了这个结构,伽罗瓦群,的性质决定了方程能否用根式求解。群不再是一组操作的简单集合,而是具有内部运算规则的封闭代数系统。封闭性、结合律、单位元、逆元,这些刻画群的公理在伽罗瓦的遗稿中已经实质性地出现,尽管完整的公理化表述要等到凯莱在1854年发表的《关于群论的论述》。

整个十九世纪下半叶,群论像火焰蔓延一样扩散到数学的各个分支。克莱因在1872年的埃尔兰根纲领中将几何学重新定义为变换群下的不变量理论。欧几里得几何研究的是刚体运动群(旋转、平移、反射)下的不变量,长度、角度、面积。仿射几何在更大的线性变换群下考虑平行性和线段比例。射影几何在射影变换群下考虑交比。拓扑学在最极端的连续变换群下考虑连通性和孔洞数量。几何学从关于空间的科学变成了关于对称性的科学。

在同一时期,索菲斯·李创建了连续群,或称李群,的理论。李群的元素不是离散的置换,而是光滑变化的连续变换。旋转群是最基本的李群:你可以将平面上的坐标轴旋转任何实数值角度,旋转角构成了一个连续参数。李群将微积分和群结构结合在了一起。二十世纪的物理学将证明,连续对称性是量子世界最基本的语法规则。

诺特定理:对称即守恒

1918年,格丁根大学。一位身材不高、嗓音低沉的女性数学家,埃米·诺特,证明了一个定理。这个定理简洁到了可以用一句话概括:每一个连续对称性都对应着一个守恒律。时间平移对称性(物理定律不随时间改变)对应能量守恒。空间平移对称性(物理定律不随位置改变)对应动量守恒。旋转对称性(空间各向同性)对应角动量守恒。

诺特尔定理的证明极其优雅。她从作用量原理出发,假设物理系统在某个连续变换群的作用下保持不变,推导出存在一个不随时间改变的守恒量,诺特荷。证明只有几行,但其涵盖的范围是整个物理学。经典力学、电磁学、广义相对论、量子场论,任何以作用量原理为基础的物理理论都接受诺特定理的支配。

这是一次惊人的概念提升。守恒律,物理学中最神圣的那些不变量,不再需要被逐一实验发现并接受为公设。它们可以被推导出来,推导的前提是对称性。对称从美学概念变成了物理逻辑的最底层。能量为什么守恒?不是因为物理学家反复测量发现能量总是守恒,而是因为时间平移对称性从数学上保证了必定存在一个叫做“能量”的守恒量。自然法则的秩序性本身就是对称性的表现。

诺特发表这个定理的时候,女性的学术职业生涯在德国几乎不存在。希尔伯特不得不以自己研讨课的名义让诺特无偿代课。诺特定理在1920年代和1930年代初期并没有被物理学家广泛运用,她在世时并没有见到它在量子场论规范对称性中的巨大威力。1950年代以后,杨振宁和米尔斯提出的规范场论将诺特的思想推上了标准模型的中心。今天,每一个基本粒子相互作用的规范玻色子,光子、胶子、W和Z玻色子,都是从局部对称性通过诺特程序产生的。对称性不再只是描述物理的工具,它成为决定物理内容本身的第一性原则。在费曼图中用虚线圈表示的那些力载子,每一个都是对称性要求的必然。

从群到分类:有限单群的长征

数学家对群的研究走向了博物志式的完全分类。克莱因纲领将几何学归类为各种变换群。那么变换群本身能分类吗?存在多少种不同的群?这个问题在离散群与连续群两个截然不同的人口上舒展开来。

李群,连续对称群,的分类在十九世纪末由埃尔朗根之箭的推动,最终于二十世纪早期由嘉当、外尔等人完成。所有的单李群被分为四个无穷系列和五个例外群:旋转群、酉群、辛群、正交群,然后是G2、F4、E6、E7、E8这五个例外的巨大结构。E8是李家群中最庞大的例外者,其根系可以表示为八维空间中的二百四十个向量,其维数为二百四十八维。这个分类是精美对称的古典顶峰。

有限单群,离散对称性画面中的原子,的分类则艰难得多。有限群可以分解为单群的组合,就像整数可以分解为素数的乘积。因此,找出所有有限单群,就像找出所有素数,是理解一切有限对称性的前提。

从十九世纪末到二十世纪中叶,数学家逐个发现了零星的有限单群。马蒂厄在1861年和1873年发现了五个马蒂厄群,它们的阶数大得惊人而又不属于任何无穷系列。此后几十年中,零星群名单缓慢拉长。1965年,兹冯尼米尔·扬科发现了一个新的单群,此后二十年中,陆续出现了二十一个零星的发现。

1981年,有限单群分类定理宣告完成。最终的清单包括:素数的无穷族、交变群、十六个李型无穷族系列,以及二十六个零星群,其中最庞大的一枚被称为“怪物群”,其阶数约为8×10⁵³,但维数却处处展现出令人惊讶的规律性。怪物群的发现曾经像是一个数学上的异形,庞大、怪异、不知道从哪个概念深处冒出来的。此后不久,麦克凯发现了怪物群的数字与数论中模形式,一个看似完全不同的领域,的系数之间存在惊人的重合。1、196883、21493760,这些数字同时在怪物群和椭圆模函数中出现,仿佛横跨对称王国和数论平原的深峡之间忽然被一道闪电照亮。这种连接被称为怪兽月光,至今仍未被完全理解。它暗示对称与数论在人类尚未测绘完毕的某个底层区域是同一张网的不同部分。

晶体、准晶体与对称的叛逆

人们对晶体中对称性的研究始于石盐和方解石的解理,敲开一块方解石,碎片总是菱面体,这是晶体在宏观层面表现出来的一种方向性。到十九世纪,布喇菲证明了在三维空间中恰好有十四种不同的空间点阵。十九世纪末,费多罗夫和舍恩弗利斯独立地证明了三维空间中有且仅有二百三十种不同的晶体学空间群。这意味着任何晶体的微观原子排列一定属于这二百三十种类型之一。大自然在建造矿物质时拥有的对称工具箱受限于这个分类表,表上没有列出的,地壳中不存在。

由此导出了一个当时被认为不可动摇的公理:晶体只可能具有二重、三重、四重和六重旋转对称轴。五重旋转对称被数学上的周期性禁止,你不能在平面或空间中用正五边形密铺不留空隙。在阿尔罕布拉的十七种壁纸模式中没有五重对称,在费多罗夫的二百三十种空间群中没有五重对称。

1982年,丹·舍赫特曼在电子显微镜下观察快速凝固的铝锰合金时,看到了一个正二十面体对称的衍射图样。正二十面体的对称群含有五重旋转轴。不可能的对称性正在他的样品中显现。他在实验笔记本上写下了三个希伯来文字母的第一个词,疑问,“这不可能”。

舍赫特曼花了两年时间说服科学界他是对传统晶体定义的核心挑战。他的衍射图样不是来自周期性晶格,而是来自一种全新的有序结构,准周期结构。准晶体具有长程有序但不具有平移周期性。五重旋转对称在平移下被禁阻,但在准周期密铺中却可以合法存在。彭罗斯在1970年代末提出的一种非周期密铺,彭罗斯密铺,恰好具有五重对称,并能产生尖锐的布拉格衍射峰,与舍赫特曼的观测完美对应。

准晶体的发现迫使国际晶体学联合会重新定义“晶体”一词,从“具有周期性晶格的材料”改为“能够产生尖锐衍射图样的材料”。2009年,首个人工实验中未参与的天然准晶体在西伯利亚科里亚克山脉的黑云石中被发现。大自然的对称工具箱比费多罗夫想象的更大。数学证明过的“不可能”,有时意味着“不可能以我们已经知道的形式发生”,而不等于“不可能发生”。

对称破缺:为什么世界没有那么对称

对称在美学上令人愉悦,但过于完美的对称同时也意味着永恒的重复和没有区别的同一性。如果宇宙的基本定律具有完美的对称性,那么由它们描述的宇宙应该也是完全对称的。但太阳系本身不是一个完美的球体,行星轨道不是完美的圆,生命体几乎全是手性的,构成蛋白质的氨基酸全部是左手性的。

对称破缺,系统从一个对称的定律中产生非对称的现实,是现代物理学的核心机制。一个完美的圆锥立在尖端上是完全旋转对称的。但当它倒下时,它必须朝一个特定的方向倾斜,对称性自发消失了。圆锥仍然服从对称的物理定律,但它所处的状态打破了对称。

粒子物理标准模型的整个架构建立在规范对称性,一种局部对称,之上。但零质量的光子和胶子作为对称性的严格后果出现,而W和Z玻色子却获得了质量。对称破缺机制,希格斯机制,赋予W和Z以质量,同时保持光子留在零质量上。2012年,大型强子对撞机探测到了希格斯玻色子,证实了这一对称破缺的物理实在性。

最壮观的对称破缺发生在宇宙诞生之初。大爆炸之后极端高温之下,一切相互作用统一在一个对称群中。随着宇宙膨胀冷却,对称接连破缺:引力率先从统一相互作用中分离,随后强核力与弱电力分离,最后弱相互作用与电磁相互作用分离。每一次破缺都在时空的织物中留下了可探测的遗迹,过度相变的拓扑缺陷,即宇宙弦和畴壁,如果它们确实存在的话,仍漂浮在今天的宇宙中,等待被下一代探测仪器找到。

对称破缺还解释了物质与反物质的不对称。宇宙大爆炸应该产生等量的物质和反物质,当它们相遇时湮灭殆尽。但今天宇宙中物质显然占据了压倒性优势,我们自身的存在依赖这种不对称。CP对称(电荷共轭-宇称联合对称)的微小破缺,1964年在K介子系统中被发现,提供了这一谜题的线索。对称破缺在宇宙学尺度上将“可能”转为“实在”,从正反等量的虚无中筛选出微弱的物质多余,并最终使星系、恒星的聚集成形以及人的出现得以可能。对称与破缺之间不是一种正误二元对立,而是宇宙从无差别的空白走向结构丰富性的本原动力。

从基本粒子到宏观尺度

群论在物理学中的统治范围在二十世纪后期持续扩大。标准模型,囊括强相互作用、弱相互作用和电磁相互作用,的对称群是SU(3)×SU(2)×U(1)。这个直积群不是靠美学偏好或形而上学推理得出的,而是几十年来碰撞加速器实验的数据一点一点逼出来的:粒子的多重态恰好填充了这些群的不同表示。八重法将质子和中子归类到SU(3)的八维表示中,预先推导了Ω⁻粒子的存在。当Ω⁻在1964年在布鲁克海文实验室被发现时,其质量与理论预言相差不足百分之一。对称的先验推导胜过了所有散射数据的事后拟合。

凝聚态物理,宏观物质的物理学,也从对称中提取了几乎整个概念框架。相变的朗道理论完全用对称破缺的语言书写:高温相具有更高的对称性,低温相出现了破缺对称的新序参量。铁磁体中旋转对称的破缺导致磁化方向的出现,超导体中规范对称的破缺导致库珀对的凝聚和完全抗磁性。拓扑绝缘体、量子霍尔效应、拓扑超导体,21世纪凝聚态物理的最前沿,将传统的对称群论推向了更深层的拓扑对称性,在这些系统中边缘态必须存在不是由于原子细节,而是由于体块波函数的拓扑结构。对称与拓扑在这里合二为一,产生出不可被微小扰动消除的稳健物理性质。

在生物学中,对称和对称破缺同样无处不在。DNA双螺旋的骨架具有精确的螺旋对称。蛋白质外壳的许多病毒呈现正二十面体对称,这种对称将遗传物质包裹在体积最小的外壳中。为什么自然选择反复地挑中正二十面体?因为它是能够利用最少单位拼起来形成封闭壳体的最佳方案。但生命本身是持续破缺对称的产物:从无手性的简单分子汤中筛选出纯左手氨基酸的机制至今仍被部分笼罩在迷雾中,然而正是这一破缺使得酶、受体和遗传密码有了精确的三维结构。胚胎发育中的左右轴确立、花朵的辐射对称向两侧对称的演化、大脑两个半球的功能分工,每一次对称破缺都是一次信息注入,从更对称、更无差别的初始状态中产生出更复杂、更特定的构型。

弦论与终极对称

理论物理学的前沿目前停驻在一个尚未被实验证实的巨大对称结构上。弦论提出,自然界的基本单元不是点粒子,而是一维振动弦。弦的不同振动模式对应不同粒子。这个理论的吸引力在于它极其自然地容纳引力:在弦的谱中,必然出现一个自旋为2、质量为零的态,这恰好是引力子的性质。广义相对论与量子力学在弦论的框架中不再是方向相反的两种公设,而是同一数学结构的必然结果。

弦论需要十个时空维度。多余六维卷曲在极小的卡丘流形中,这些六维几何结构的具体形状决定了可观测宇宙中粒子的种类、质量和相互作用的强度。卡丘流形的分类本身就是群论和代数几何的极致运用,每一个卡丘流形都是一个巨大的对称结构,其贝蒂数、欧拉示性数和模空间决定了低能物理的内容。

弦论尚未给出可被实验验证的独特预言,这是它遭受批评的核心所在。但在数学中,弦论已经给出了极其丰富的反馈:镜对称的发现连接了两个之前被认为完全无关的卡丘流形,允许一个流形上不可解的计数几何问题在另一个流形上求出答案。拓扑弦论中的模型将黑洞的贝肯斯坦-霍金熵微观解释为计数黑洞微观量子态的构型数,计算结果与热力学公式精确对合。弦论是否是这个宇宙的最终物理理论,至今没人能确认;但它确实已经是极为多产的数学理论。

终极对称的梦想,所有的力和粒子被统一在一个单一的无矛盾结构中,从爱因斯坦晚年在普林斯顿徒劳地追寻统一场论以来,经历了极为漫长曲折的行进。如今这个梦想被编织在一张兼具离散与连续、代数与几何的交响乐谱中,这张乐谱的大部分章节尚未被写出来。对称可能不是人类施加在杂乱自然界的秩序幻影,而是自然界的基础语言,一种守恒、变换和不变的核心,从宇宙初开至今始终铭刻在每一次粒子衰变、每一条羽脉纹理、每一片雪花和每一个星系的螺旋臂中。群论这支舞蹈,起于伽罗瓦诀别的夜笔,越过晶体学家显微镜下的斑点,延及黑暗天幕上涡旋星系的漫长弧形,它仍在跳,没有收束的迹象。

第二十二章 数论的炼金术:从不定方程到算术几何

丢番图的遗产

公元三世纪,亚历山大里亚,一位名叫丢番图的希腊数学家写了一部《算术》。这部书原有十三卷,仅有六卷幸存。在这六卷中,丢番图提出并解决了近两百个问题,所有问题都围绕同一个主题展开:寻找方程的整数解或有理数解。

丢番图的方法在希腊数学传统中显得格格不入。他不是在证明几何定理,不是在推导普适的逻辑结论,而是在一个具体方程、一个具体方程之间进行着某种奇异的炼金术操作。他会写下:两个数的和是20,它们的平方和是208,求这两个数。然后他不将这两个数称作x和y(他没有符号代数),而是用流利的修辞做出一系列巧妙的换元和代入,最终从中提炼出12和8。

《算术》被历史尘封了几个世纪。十世纪,它被译为阿拉伯文,激发了花剌子模和凯拉吉等阿拉伯代数学家的研究。但真正将它带回欧洲并引爆了一场静默革命的,是在1621年。那一年,法国数学家克劳德·巴歇将《算术》的希腊文原文伴以拉丁译文出版了。巴歇的版本流进了一个土鲁斯议员的私人书房,议员的姓名是皮埃尔·德·费马。

费马在阅读巴歇版的《算术》时养成了一个习惯:在书页的空白处写下自己的想法。这些旁注后来成为数学史上最丰富的矿脉之一。他证明了无数个关于整数的定理,却极少发表证明。他建立了一个传承千年的数论传统,却从未写过一部系统的专著。他是一个书信数学家,与帕斯卡、梅森、笛卡尔通信往返,将定理和挑战寄给整个欧洲的学者,却不揭开自己的证明方法。

在《算术》第二卷第八题“将一个平方数分解为两个平方数之和”的旁边,费马用拉丁文写下了那段后来震动世界的旁注。这段文字以“相反,不可能将一个立方数分为两个立方数”开始,以“我发现了一个真正奇妙的证明,但页边太窄写不下”结束。这就是费马大定理:方程xⁿ+yⁿ=zⁿ在n大于2时没有正整数解。它的最终命运要在三个半世纪之后才由安德鲁·怀尔斯在1995年完全解决,动用了二十世纪代数几何和模形式的几乎全部重型装备。

在更深的层面上,费马在数论中做了一件连他自己都未必完全意识到其深远后果的事。他将数学从“连续的”引向“离散的”。微积分处理的是连续量,函数图像上的光滑曲线,无限可分的区间。数论处理的是离散量,整数,素数,不可通约的单位。当牛顿和莱布尼茨从微积分开创了连续数学的洪流时,费马,他本人也是解析几何和微积分的先驱,却在丢番图的边缘空白中埋下了离散数学的根基。连续与离散之间的张力贯穿了此后四百年的数学。

高斯的《算术研究》

1801年,年仅二十四岁的卡尔·弗里德里希·高斯出版了一部书。《算术研究》是用拉丁文写的,在当时的数学出版物中拉丁文已显过时,这让它的传播比预期更慢。但这部书的内容不啻为当时数论的总集与超越。

高斯将前人的碎片整理成体系。费马的平方和定理(4n+1型素数可以表为两个平方数之和)被放在一个更广阔的理论框架中:二次型理论。欧拉和拉格朗日研究过的二次互反律,关于两个奇素数是否互为二次剩余的神秘对称性,在高斯这里被严格证明了。他一口气给出了八种不同的证明,每一种都揭示了这个定理与数学不同部分的深层联系。二次互反律的不仅是一条定理,它是模式的一个枢纽站。

同余记号,那个三条横线的等号,是高斯在《算术研究》中引入的。a≡b(mod m)用以表达a和b除以m的余数相同。这个符号简单到了不起眼的地步,但它让同余的计算像普通等式一样可操作。加、减、乘、除(在模素数时)都可以在同余法中自由进行,这实际上是有限域运算的最早雏形。高斯将数的世界区分为不同的模运算系统,每一个模定义了一个封闭的和自足的算术天地。这种结构思维预示了二十世纪抽象代数的整个框架。

《算术研究》的第七节,全书的最后一节,讨论了分圆方程和正多边形的尺规作图。高斯证明了正十七边形可以用尺规作出,并进一步给出了一个正多边形可尺规作图的完整判据:边数必须是费马素数(形如2^(2ⁿ)+1的素数)乘以2的幂。这个漂亮的定理将古典的几何问题,哪些正多边形能用尺规作出,翻译成了纯粹的数论条件,又将数论条件链接到了代数方程的可解性。几何、数论、代数在高斯笔下不再各自为政,而成为同一个深层结构的三个截面。

素数定理的百年征途

素数,那些只能被1和自身整除的正整数,是数论最神秘的研究对象。它们在自然数中似乎以不规则的方式出现:2,3,5,7,11,13,17,19,23,29。没有公式可以精确预测第n个素数是什么。但从大量的统计中,它们又呈现出某种宏观的规律性。

十五岁的少年高斯在1792年就注意到,素数在自然数中越来越稀疏,这种稀疏的速度可以用对数函数来近似描述。他猜想素数计数函数π(x)(不超过x的素数个数)渐近等于x/ln x。他在一本对数表的空白处做了这个笔记。

高斯没有发表他的猜想。勒让德在1798年独立提出了类似的公式。两人都没有给出证明。

证明等了一百年。俄国数学家帕夫努蒂·切比雪夫在1850年前后用初等方法证明了π(x)的阶确实是x/ln x,即两者之比被限制在两个常数之间。这是向素数定理迈出的第一步。

完整的证明在1896年由法国的雅克·阿达马与比利时的夏尔·德·拉·瓦莱·普桑独立完成。他们的证明使用了一种出人意料的武器:复分析。黎曼在1859年的一篇短文中提出了一个函数,ζ函数,定义为ζ(s)=∑1/n^s。这个函数在s为实数时对s>1收敛,但黎曼将它解析延拓到整个复平面(除s=1处有一个单极点)。他观察到这个函数的零点,使ζ(s)=0的s值,与素数分布有着深刻的关联。

更具体地,黎曼猜想:所有非平凡零点都位于复平面上实部为1/2的临界线上。如果这个猜想为真,那么素数定理的误差项可以尖锐化,素数分布的规律可以更加精确地描述。

阿达马和普桑没有完全证明黎曼猜想,他们“只”证明了所有非平凡零点位于0<Re(s)<1的临界带内部,且不在边界Re(s)=1上。这已足以推出素数定理。但从那以后的一百二十多年中,黎曼猜想的完全证明始终悬而未决。它被克莱数学研究所列为千禧年七大难题之一,悬赏一百万美元。无数数学家在这条临界线上耗尽了一生的能量。

计算机已经验证了前十万亿个零点全部恰好落在临界线上,但在数学上,验证永远不能替代证明。十万亿不是无穷。黎曼猜想至今仍在复数平面的某个未知角落等待着答案。

拉马努金:来自马德拉斯的幻视者

二十世纪数论史中最不可归类的一个人物是斯里尼瓦萨·拉马努金。他生于印度南部泰米尔纳德邦的一个贫穷婆罗门家庭。他没有受过正规的高等数学教育,他的数学知识来自几本他反复阅读的旧书,其中包括乔治·卡尔的《纯粹与应用数学纲要》,这本书内含大量公式但证明极少。拉马努金在一种近乎与世隔绝的状态中,用自己发明的一套符号和方法,独立重新发现了大量已知的数学定理,并产生出了数量惊人的全原创结果。

拉马努金的思维方式至今还是个谜。他说自己的公式是女神纳玛姬莉在梦中向他揭示的。他在一张张纸上写下无穷级数,有些收敛到π,有些计算着分拆函数的渐近值,有些将模形式与素数的同余性质不可解释地联系起来。他几乎没有给出任何证明,对于他,结论的确定性来自他所信赖的来源,而不是来自人类同行的验证。

1913年,拉马努金将自己的一些结果寄给了剑桥的哈代。哈代起初差点将信扔掉,这看起来像一个民科的自吹自擂。但当他坐下细看时,他发现一些他自己花了多年才证明的定理出现在信纸上,而更多的公式他从未见过。那天晚上,哈代给同事利特尔伍德写了一封紧急信函,随后他们着手将拉马努金从马德拉斯带到剑桥。

拉马努金在剑桥度过了第一次世界大战的年岁。他与哈代合作发表了一系列论文,在分拆函数、素数分布、模形式等领域取得了突破性成果。分拆函数p(n),将正整数n表为正整数之和的方式数,是拉马努金最着迷的课题之一。他发现了p(n)的一系列同余性质:p(5k+4)总是5的倍数,p(7k+5)总是7的倍数,p(11k+6)总是11的倍数。这些看似魔术般的规律引导后来的数学家一直探索到分拆函数的深层算术结构。

拉马努金不适应英国的气候、食物和社会习惯。他在一战期间的紧缩素食困局中营养不良,感染了阿米巴痢疾,也可能仅是肺结核,健康快速恶化。1919年他回到印度,次年在马德拉斯郊外的切特普特去世,年仅三十二岁。他的遗稿中留下了几本“遗失的笔记本”,一本笔记在1976年才被安德鲁斯在剑桥三一学院的图书馆储藏室中发现,其中的公式继续在半个世纪后的模形式和弦论研究中被引用和证明。

怀尔斯与费马大定理的终结

1954年,日本数学家谷山丰在自杀前留下了一份手稿,提出了一个惊人的猜想:所有的椭圆曲线都是模形式。当时的数学界几乎没人理解这个猜想的巨大蕴含。志村五郎,谷山的朋友和合作者,将余生投入到精炼与传播这一猜想上。十年间,谷山-志村猜想逐渐被接受为整数世界的罗塞塔石碑,但大多数数学家仍然认为证明它遥不可及。

1985年,格哈德·弗雷注意到了谷山-志村猜想与费马大定理之间的一种可能联系。他的论证很简单:假设费马大定理错误,即存在正整数a、b、c及大于2的指数n使aⁿ+bⁿ=cⁿ。那么由此构造的椭圆曲线(弗雷曲线)就具有极其特殊的性质,它几乎可以肯定是“非模”的。如果谷山-志村猜想成立(每条椭圆曲线都是模的),那么弗雷曲线就是不可能的。因此,反设的费马方程不存在。谷山-志村猜想蕴含费马大定理。

弗雷的论证有一个环节他无法证明,证明弗雷曲线确实是“非模”的。这个环节由让-皮埃尔·塞尔与肯·里贝特填补了。里贝特在1986年证明:弗雷曲线不可能为模。其直接后果令人心悸:谁若能证明谷山-志村猜想,谁就将同时证明费马大定理。

安德鲁·怀尔斯是剑桥出身的数论学家,在普林斯顿担任教授。他十岁时在一本图书馆的书中读到费马大定理,便梦想要证明它。当他得知里贝特的结果的时候,他后来回忆,“我知道那一刻我的余生都将献给证明这个猜想”。从1986年到1993年,怀尔斯在除了亲密家人和极少数同事之外几乎无人知晓的状态下,独自推进研究。他避免公开露面、减少会议出席、甚至数年不发表论文,一个处于事业盛期的数学家这样做近乎职业自杀。他必须将整个计划分解,然后在每个局部钉牢,而每一个局部都可能成为无法逾越的终点。

1993年6月,怀尔斯在剑桥牛顿研究所做了一个连续三天的系列演讲,演讲题目刻意低调:“模形式、椭圆曲线与伽罗瓦表示”。在最后一天的演讲末尾,他写下了谷山-志村猜想(半稳定情形)的证明,然后抬头说:“因此我证明了费马大定理。”

全场先是沉默,然后是掌声。消息在数小时内传遍全球。第二天,《纽约时报》头版报道,标题与当年的政治危机并列。

然而故事没有在这个完美的节点结束。论文提交审稿后,一位审稿人发现了一个微小的漏洞。怀尔斯试图修补,却发现这个漏洞比预期凶猛。修补持续了整整一年。1994年9月,在几乎承认失败的前一刻,怀尔斯与他的学生理查德·泰勒找到了解决方案。最终发表的证明分两篇论文:一篇由怀尔斯署名,另一篇由怀尔斯和泰勒联合署名。整个证明用到了二十世纪数论、代数几何和表示论的几乎全部前端工具:椭圆曲线、模曲线、变形理论、交换环的完全交集、伽罗瓦表示的提升。他发表的这一整套工作,在某种意义上是丢番图和费马在各自时代完全不知晓的语境下与后来历代的数学家协作完成的。

费马大定理的证明被克莱数学研究所认定为世纪之交最重要的数学成就之一。怀尔斯站在巴黎的领奖台上时,手上拿到的不是奖杯,是费马在书页空白处没有预留的那片空间,三个半世纪之后,终于被填满了。

算术几何:统一连续与离散的桥梁

二十世纪下半叶,数论经历了一场概念升级,其规模与十七世纪解析几何将几何与代数统一相当。这场升级的名字叫算术几何,用几何方法研究数论问题。

格罗滕迪克在1960年代的代数几何重构是这一升级的引擎。他引入了概形的概念。一个概形同时包含了几何空间的点和数论中素数的信息。在概形的语言中,方程x²+y²=1的整数解、有理数解、模p解,都是同一个概形在不同“点”上的观察。数论问题变成了几何问题,素数变成了空间中的点,整除关系变成了态射的纤维结构。

这个抽象框架以令人震惊的方式兑现了具体的回报。1983年,格尔德·法尔廷斯证明了莫德尔猜想:任意一个定义在有理数上的、格大于一的光滑代数曲线只有有限多个有理点。这个定理直接蕴含了费马方程xⁿ+yⁿ=zⁿ在n≥4时,如果存在非平凡解,只能有有限多组。法尔廷斯的方法完全依赖格罗滕迪克的算术几何概形和阿拉克洛夫-张勃宁高度理论。法尔廷斯的证明为这一整套抽象机器的有效性盖上了权威的官印。

随后,辛钦猜想、萨托-塔特定理、朗兰兹纲领的局部对应、BSD猜想的局部进展,每一项现代数论的重大突破都同时发生在数论与几何的交叉域中。连续与离散不再是一对互斥的范畴,而成为同一枚硬币的两面。一条定义在素数域上的椭圆曲线,既是代数数论的研究对象,它的L函数编码着每个素数处的点个数;也是复几何的研究对象,当把它视为复流形时,它是环面;也是代数几何的研究对象,它的模p约化携带着奇点解消的信息。

朗兰兹纲领,由加拿大数学家罗伯特·朗兰兹在1967年的一封长信中勾勒,或许是统一连续与离散的最大胆尝试。朗兰兹预见了数论、表示论和调和分析之间的庞大对应网络:一端的伽罗瓦表示,编码方程根的对称性,等价于另一端的自守形式,高度对称的调和分析中的对象。每个数论的伽罗瓦群与一个李群的自守表示对应。这个纲领的完全实现将是继微积分与解析几何之后的最大统一行动。

迄今,朗兰兹纲领的许多重大部件已获得证明。GL(1)的情形是经典类域论的一种优雅重新表述。GL(2)的关键部分由怀尔斯证明费马大定理的工作推进了决定性步骤。函数域上的朗兰兹对应由拉福格完成。但一般情形的完整证明距我们仍有一段距离。朗兰兹本人曾说:“我们或许还需要几十甚至几百年的努力。”统一连续与离散,可能不是某一个世纪能够独力完成的任务。

密码学:数论成为武器

在纯粹数学家们追逐这些永恒的谜题时,一个未曾料到的插曲改变了数论的社会角色:数论成了军事和经济权力的关键技术。

1976年,惠特菲尔德·迪菲和马丁·赫尔曼发表了《密码学的新方向》,公开提出了公钥密码的概念。他们设想一个系统,其中加密和解密使用不同的密钥,且知道加密密钥不能有效推导出解密密钥。这个想法在当时是对数千年对称密码传统的根本颠覆,在对称密码中,加密者和解密者必须共享同一个秘密钥匙。公钥密码将使未曾谋面的双方可以在公开信道上安全通信。

迪菲和赫尔曼给出了实现这一想法的第一个方案,基于离散对数问题的难解性:已知模p的g的x次幂,求x极其困难。但他们的方案只解决了密钥交换问题,没有直接实现公钥加密的全部功能。

1977年,麻省理工学院的罗恩·里维斯特、阿迪·沙米尔和莱恩·阿德尔曼完成了RSA算法。RSA的安全性基于一个简单的数论假设:将两个大素数相乘很容易,将乘积分解回素因子极其困难。这个不对称性嵌在大数分解的过程中,已知两素数的积要求其因子,困难度随数字位数的增加而增加。欧拉函数、费马小定理、模指数运算,这些在十八世纪被当作纯粹智力游戏推导出来的数论工具,两百年后变成了守护全球电子金融、电子邮件、VPN隧道的数学锁。

1994年,彼得·肖尔,贝尔实验室的数学家,发表了一个足以改写全球密码格局的结果。肖尔证明,在量子计算机上,大数分解可以在多项式时间内完成。如果足够规模的量子计算机被建造出来,所有基于分解难题的现有公钥密码系统将在数小时内被打破。肖尔的算法是理论性的,当时的量子计算机只能分解15和21这样的微小数,但它首次将量子计算对密码学的威胁从中期幻想变成了确定的时间表。

这一威胁驱动了后量子密码学的兴起,寻找即使在量子计算机上也无法有效破解的新密码体系。格密码、编码密码、多变量密码、超奇异椭圆曲线同源密码,数论中更偏更深的领域被仓促地拉出纯数学的图书馆,投入了网络安全的防御前线。拉马努金笔记本上的同余公式、高斯《算术研究》中的二次型理论、法尔廷斯的模空间,这些曾经只在有限的学术圈内被理解的精微结构,正在变成下一代加密算法的基本构件。数论从纯粹理性的修道院走进了防火墙和黑进者的竞技场,它支撑了人类在信息时代的隐私、匿名与安全,也裹挟了此前没有预料到的道德重负。

在公元前三百年亚历山大里亚的某个午后,丢番图正在石板上划下一个不定方程,他不知道他正在开启的这门学问会在两千年后承载全球数字文明的脆弱骨架。数论或许证明了,数学中最纯粹的那些部分,那些当时看起来没有任何用处的、纯粹为满足求知而生的追问,会在时间中慢慢游向人类社会的核心,最终以所有人都未曾预言的形式发生作用。

第二十三章 混沌与复杂:确定性中的随机

拉普拉斯妖的黄昏

在第十八章中,我们已见过拉普拉斯妖,那个假想的全知智慧,掌握了宇宙中每一粒子的位置与速度,便能将过去与未来尽收眼底。拉普拉斯妖是经典决定论的终极表达:宇宙是一台完美的钟表,一旦上紧发条,便永不停歇地按照牛顿定律走动。随机在这个世界中只是一种幻象,人类信息不足时的临时措辞,而非自然界本有的属性。

十九世纪和二十世纪初的物理学以几乎完全的信念接受了这个钟表宇宙。麦克斯韦的电磁场方程是确定性的:给定初始场的分布和电荷的运动,未来任何时刻的场都可以被精确推算。热力学用统计方法处理包含10²³量级分子数的宏观气体,但每个分子的个体运动仍然被认为是严格遵循牛顿力学的。量子力学在1920年代的诞生首次动摇了决定论的根基,波函数的坍缩是真正非确定的,但在经典物理的日常尺度上,决定论依然深深扎根。

然而,在拉普拉斯妖的光辉形象背后,十九世纪的一些思想家已经隐约感到了不安。麦克斯韦本人就是其中之一。他在1873年的一个演讲中指出,物理科学中有两类知识:一类可以由精确的定律表述,另一类则取决于“我们不能跟踪的微小原因”。当微小的初始差异经过时间的放大,产生了不可忽视的宏观后果时,精确预测就成了一句空话。

麦克斯韦用了这样一个比喻:一个在山脊上被放着不动的石头,如果它向左边或向右边偏了一根头发丝的距离,它最终会滚进完全不同的两支山谷。起点的微不足道的差异,在一个分水岭上被分岔的坡向彻底放大了。这是混沌思想的第一次清晰表述,比混沌理论的正式诞生早了整整一个世纪。

庞加莱与三体问题的意外发现

亨利·庞加莱被许多人认为是历史上最后一位贯通数学全领域的学者。他在函数论、代数拓扑、微分方程、数理物理各个方面都留下了自己的痕迹。但正是在一个看起来令他沮丧的失败结果中,他开垦了混沌理论的处女地。

1887年,瑞典国王奥斯卡二世为庆祝自己六十岁诞辰设立了一个数学竞赛,问题之一是太阳系的稳定性:行星轨道是否长期稳定,行星最终会飞离太阳还是撞入太阳?这是自牛顿以来一直悬而未解的根本性问题。庞加莱接过了这个挑战。他简化了问题,不是处理全部行星,而是只考虑两个大天体(如太阳和木星)以及一个可以忽略质量的小天体(如小行星)的简化三体问题。

庞加莱没有完全解决三体问题,但他发现了一些远超预期的东西。他发现,三体系统的运动并不总是规则的、可预测的。在某些条件下,小天体的轨道呈现出极为复杂的行为:它绕着一个天体旋转若干圈,然后突然跃入另一条轨道,绕着另一个天体旋转若干圈,然后又切换回来。这种“弹弓效应”在霍曼转移轨道和行星探测器的设计中后来被运用,但庞加莱的深层分析导向了更为不稳定的结构。

他靠近了同宿轨道,一条轨道同时是一个平衡点处的不稳定流形和稳定流形的各一半。当这条轨道以复杂的方式与自身缠结时,轨道的拓扑结构变得比行星本身还要错综。庞加莱在《天体力学新方法》中写道:“当人们试图描绘这两条曲线以及它们的无穷多次相交时,这些交点在空间中形成了一种网格、一种织物、一种无限紧密的网状结构,每一条曲线自身不能与自身相交,但又必须以非常复杂的方式缠绕折返……这种同宿缠结的复杂性之惊人,是我描绘不出的。”

庞加莱的这一段话宣布了历史上第一个混沌现象的严谨描述。他证明了,对于三体问题,不存在足够简单的运动积分能够像两体问题那样将运动归约到一个规则轨道上。轨道的长期行为可能复杂到无法用闭合的公式来表达。这不是因为数学家的智力不够,而是因为系统本身就具有不可归约的复杂性。

洛伦兹与蝴蝶效应

混沌理论在庞加莱的开创之后经历了半个多世纪的间歇。两次世界大战之间和战后的理论物理学关注的重心是量子力学、粒子物理和核物理;古典力学中的非线性问题被边缘化了。在苏联学派,科尔莫哥罗夫、阿诺尔德、莫泽,手中,解决三体问题中稳定区域的KAM定理诞生了,但完全混沌的区域仍然未受到系统性研究。

1961年,麻省理工学院的气象学家爱德华·洛伦兹在他办公室里运行着一个简化的大气对流模型。这个模型由十二个常微分方程组成,每个变量代表大气中某一层某一纬度的某一种物理量,温度、风速的某种模态。模型在真空管计算机上模拟着天气系统的长期行为。

一天,洛伦兹想要重复之前的一段模拟。为了省时间,他没有从头算起,而是从中间某个时刻的状态重新启动。他把之前打印出来的变量值手工输入,只取了三位小数,而不是计算机内部存储的六位小数。差值不过千分之一。

几分钟后,洛伦兹回到打印机旁,发现新输出的天气图与原来的计算结果没有任何相似之处。初始条件中千分之一的微小舍入误差,在模拟运行几周后产生了完全不同的宏观天气形态。

洛伦兹没有把这个现象当作计算机故障忽略过去。他知道这意味着什么:对于一个非线性确定系统,长期预测在原则上是不可能的,不是因为数学工具不够,而是因为任何初始条件的测量都带有不可避免的有限精度,而这一有限精度的误差会在时间中被指数级放大。他在1972年的演讲《巴西的蝴蝶扇动翅膀会在德克萨斯州引发龙卷风吗》中,将这个观点压缩为日后家喻户晓的“蝴蝶效应”。

洛伦兹在1963年发表的论文中,将他的十二方程模型简化到了另一个令人震撼的最小模型,现在被称为洛伦兹方程:三个非线性常微分方程,仅依赖于三个参数。这个三方程系统是确定的,没有任何随机项,但它的解却表现出一种前所未有的长期行为:轨迹在整个有界的相空间中被一个奇异吸引子捕获,既不完全周期也不完全随机,绕着一个翅膀飞行若干圈后忽然跳转到另一个翅膀,然后再跳回,两个翅膀之间的切换时间和切换次数在长期中完全不可预测。

洛伦兹吸引子是一个形状如蝴蝶展翅的分形结构,它是历史上第一个被详细研究的“奇异吸引子”。洛伦兹证明了,确定性不能保证可预测性。一个系统可以在完全没有噪声、没有量子不确定性、没有任何外部随机扰动的情况下,依然在长期中表现得像随机。确定性混沌不是决定论的否定,它正是从决定论中成长出来的,是同一套牛顿方程在特定参数区域的必然产物。

从生态学到心电图的奇怪吸引子

1970年代,混沌理论从气象学扩散到了几乎所有的科学领域。

罗伯特·梅,一位从理论物理学转向生态学的学者,用最简单的方程展示了混沌的普适性。逻辑斯蒂映射是一个描述种群数量年际变化的一维迭代方程:xₙ₊₁=rxₙ(1-xₙ),其中xₙ是第n年的种群数量(以环境容纳量为单位),r是增长参数。这个方程的形式简单到高中生都能按计算器迭代,但它展现出的行为结构异常丰富。

当r较小时,种群趋向一个稳定的平衡值。当r超过3时,这个平衡值变得不稳定,种群开始在两个数值之间交替,周期二振荡。r再稍大一点,周期二失稳,出现周期四。继续增大r,周期不断倍分,四、八、十六,最终在r约等于3.57时,倍周期分岔达到无穷积累点,系统进入混沌。在混沌区中,种群数量在长期中像在随机游走,完全不重复。但在混沌区的内部,又嵌着狭窄的“周期窗口”,在某些精确的r值上,混沌忽然又退回到规则周期,其中最宽的一个是周期三窗口。

这个发现重要的远不只是生态学本身。约克和李天岩在1975年发表《周期三意味着混沌》,证明了一个定理:如果一个连续迭代映射具有周期三点,那么它就必定具有所有周期的周期点,并且在某个数学意义上必定是混沌的。周期三这个看似平凡的发现,逻辑上隐含了整个混沌的包。这个定理适用于任何满足基本连续条件的动力学系统,不限于生态学,也包括摆动的钟摆、跳动的神经、搅动的流体、倒置摆的显像。

在此之后,混沌现象被一系列实验观测和数据分析所确认,它不再是一种理论上的奇谈,而成为了普遍的自然现象。木星大红斑,一个在木星大气中持续了至少三百多年的巨型涡旋,是混沌中的稳定结构。地球磁场的随机逆转,平均每数十万年发生一次,但具体时间极不规则,可以用地核流体的混沌发电机模型来解释。健康心脏的心跳间隔存在着混沌变化,而心源性猝死前的心跳间隔往往变得更为规律,失去了混沌的弹性。混沌与健康之间的关联开始将这一抽象数学概念推向医学诊断。

混沌不是秩序的敌人,在某些情况下,它是秩序的更高级形式,一种允许系统在环境变化中保持韧性、在扰动后自我重组的能力。生物体的生理信号(心率、脑电、血压)在健康状态通常呈现混沌特性,而在衰老和疾病中趋于周期性或完全随机。这一观察指向一个哲学上的悖论:完全的有序和完全的随机都是僵死的,活的秩序存在于结构与意外之间,正是确定性混沌可以提供的模糊地带。

费根鲍姆常数与普适性

1975年前后,洛斯阿拉莫斯国家实验室的米切尔·费根鲍姆,一个手持可编程计算器、独自在办公室里反复迭代函数的物理学家,注意到了一个不同寻常的规律。在逻辑斯蒂映射的倍周期分岔图中,相邻两次分岔之间的r值间距收敛得极快,且收敛比值似乎是恒定的。他计算了这个比值的极限:

δ=4.669201609102990。

这个数后来被称为费根鲍姆第一常数。更惊人的是,费根鲍姆在另一个完全不同的函数,正弦映射xₙ₊₁=rsin(πxₙ),中发现了完全相同的收敛速率:同样一个数4.669。这在数学上绝非自明。

费根鲍姆常数揭示了一个称为普适性的深层法则:在连续可微的单峰函数的倍周期分岔路径上,分岔间距的收敛率与函数的具体代数形式无关。它是只依赖于该函数在最高点处的度量和映射的单峰形状的普适常数。这意味着,任何从平衡系统平滑过渡到混沌的系统,无论它描述的是湍流起动的流体、激光起动电磁场受激发射、化学反应中多重稳态转换、预算约束下的经济波动,只要它经历倍周期分岔路线进入混沌,就将经过完全相同的几何积聚率。

普适性不仅仅是定性比喻,而是完全精确的数值相等。这个发现将混沌理论从一个关于特定模型的零散定性的集合,提升为具有预测力的定量科学。费根鲍姆常数在1980年前后被流体氦对流实验和电子振荡器实验以误差不超过1%的精度确认,这给予了混沌理论在实验科学中的稳固立足点。

分形几何:混沌的空间兄弟

混沌与分形是一对双生子。混沌描述行为在时间上的不规则性,分形描述形状在空间上的不规则性,两者都来自同样的非线性迭代过程,一个是时间上的轨迹,一个是空间上的结构。

本华·曼德博是两人的合体者。当他在IBM沃森研究中心翻阅被忽略的噪声数据时,他开始注意到凡有混沌轨迹的地方,轨迹所扫出的相空间形状几乎总是带有自相似的分形结构。曼德博将这种几何命名为“分形”,来自拉丁语fractus,意为破碎的、不规则的。

英国的海岸线有多长?曼德博在1967年的论文中以这个问题开端。答案是,取决于你用的尺子长度。用一公里的尺子量,得到总长L₁;用一百米的尺子量,得到更长的L₂;不断缩小尺子,总长继续增加,没有收敛到一个有限极限。自然界中的海岸线不是光滑的一维曲线,而是拥有比一维更高但又不完全是二维的几何对象,它具有分数的维度。

分形的核心结构是自相似性:将整体的一部分放大,它与整体形状相似。雪花将每一小片的分支与自身总形对比,见到的三角裂缘是相同的;西兰花的花序,小尺度的花序是大尺度花序的缩小版;肺中的支气管树,每一次分支都是上一次的缩小;血管系统、河流网络、闪电的放电路径、星系的分布结构,在多个尺度上呈现统计上的自相似。分形几何给出了一种比欧几里得几何更贴合自然的描写语言。

曼德博在1980年用计算机生成了曼德博集,也许是用最简单公式zₙ₊₁=zₙ²+c定义的复数迭代映射所生成的无穷复杂的几何对象。当这个墨迹在屏幕上显示出那种既不是一维也不是二维的、带有无数卷须和螺旋的边界时,它展示出来的细节层次令人头晕。你可以在任何位置不断放大,永远不会遇到平滑的地方,越是放大,以前不可见的细部便涌现出来,新卷须盘绕出新的螺旋,海底触手般的突出物一层层展开,而在这些极端深度的细部中又再一次缠卷出与整体相似的基本图式。曼德博集是费根鲍姆普适性的几何对偶,一种极其简单的规则生成无穷复杂而具结构性的产物。

从蝴蝶效应到长期预测的局限

混沌给人类的知识愿望带来了一个哲学层面的降温。自牛顿以来,科学的理想是以方程覆盖过去和未来的一切。量子力学虽然推翻了微观世界的确定性,但它提供的概率分布依然是确定的,波函数演化由薛定谔方程严格决定,可预测的是概率而非事件。混沌则从根本上声言:即便是经典确定的系统,哪怕是中等复杂度的完全确定的系统,像三个耦合的非线性微分方程,它的长期行为也无法以任何实际精度被预测。

这并不意味着天气预测就不做了,或者金融市场就完全不可模拟。它逼迫科学家区分预测的期限。短期预测是可以的,初始条件不确定性呈指数增长,但在某一时间窗口内,这个增长还没有吞噬全部的精度。在这个窗口内,传统方程仍然有效。蝴蝶效应不取消一周之内的天气预报,它取消的是一个季度之后的具体刮风方向。当气象中心用集成预报,使用多个略有不同的初始条件进行并行模拟,进行数值天气预报时,它恰恰是利用混沌的确定性方式来量化不确定性,而非退回到纯粹的统计分析。

混沌为预测设了一面屏障,这面屏障不是人类的无知,而是动力学本身的指数放大机制。它告诉我们这个世界是透明的,但透明到了一定的时间深度就变成了一道雾墙。这层雾属于物理世界,而不属于信息不足;它属于方程内部,而不属于近似求解的残余。

复杂性的涌现

混沌还不是最后的词汇。1980年代以后,研究的前沿从混沌向复杂性推进,研究大量简单个体通过局部耦合能自发产生何种全局结构和功能现象。混沌描述少自由度系统的长期行为不确定性;复杂系统理论研究自由度极大、但个体规则不复杂的系统怎样在没有中央控制的情况下生成整体的稳定模式。

圣塔菲研究所,复杂系统研究的圣地,聚集了来自物理、经济、生态、计算机科学的学者,寻找跨门类的通用性。自组织临界性是其中一个重要的概念:沙堆不断添加沙粒,坡度增大到临界角,然后每加一粒都可能触发规模不一但分布服从幂律的崩塌序列。雪崩、地震、森林火灾、股票市场暴跌,这些看似各不相关的事件在统计数据上都遵循幂律,表明它们可能共享同一套组织化的临界动力学。复杂性研究试图抓住这些共同的数学骨架。

元胞自动机是另一个有力的模型框架。1940年代,冯·诺依曼和乌拉姆在比原子物理更抽象的层面奠定其基础,而到1970年代数学家约翰·康威设计了“生命游戏”,格子上的几个生与死的简单规则,演化出滑翔机、振荡器、生成元、甚至能够模拟图灵机的自复制结构。简单规则的局部重复,能生成普适的计算能力,也能生成丰富的涌现结构。史蒂芬·沃尔夫勒姆在1980年代全身心投入元胞自动机的研究,将所有可设想的规则分类,发现其中最复杂的规则集(第四类)生成的空间-时间图案既非完全有序也不完全随机,而是具有持续变化的局部结构,就像混沌吸引子一样,从简单规则中流出了复杂。

当大语言模型在2020年代以数百亿参数量展现出涌现的推理能力时,人们再一次面对同样的谜:局部的梯度下降更新规则如何从语料中聚合出具有跨语言、跨领域推理的全局能力?这些能力是被“写入”的还是从局部聚合中“涌现”的?涌现,这个从物理和生物跨入人工智能的概念,正在成为复杂性科学最迷人的问题。

混沌和复杂性的研究与数论或代数几何的经典数学有气质上的明显不同。它们不追求严格证明,大多数复杂系统没有简洁的严格解,也无法完全复制到定理的结构里。它们依靠计算机实验、数值模拟、尺度分析、普适性归类来推进。它们是数学的边缘地带,也是数学和自然相接触最紧密的地带。当纯粹数学在超然的结构中翱翔时,混沌和复杂性的探索却在泥泞的地面上跋涉,每一步都沾着来自物理、生态、经济、认知的科学碎屑。它所揭示的是,即便在最简单的方程中,也潜水着足以吞噬确定性和长期预见力的深度,而在更庞大的集体相互作用中,秩序可以从无中央规划的局部耦合中自主生长出来。这种简单的规则与无法简化的整体行为之间的张力,或许正是这个宇宙最根本的数学性格。

第二十四章 数学与实在的边界:从抽象对象到宇宙代码

不可理喻的有效性

1960年,匈牙利裔物理学家尤金·维格纳在《纯粹与应用数学通讯》上发表了一篇短文的标题中抛出了一个令数学家和物理学家同时感到不安的短语,“数学在自然科学中不可理喻的有效性”。维格纳不是在做表面上的赞美,而是在指出一个真正的哲学问题:为什么用纯粹思维构造出来的数学,公理、定义、定理,能够如此精确地描述物理世界的运行?数学显然是人类心智的产物,宇宙显然在人类心智出现之前就已经存在了数十亿年。然而,这两者之间的契合度,近乎是一个奇迹。

牛顿的万有引力定律需要平方反比。这个平方反比的“2”从哪里来?不是从实验数据拟合出来的,牛顿从开普勒定律反推出向心力的大小,发现恰好与距离的平方成反比。如果这个指数是2.0001而不是2,行星轨道将不是封闭的椭圆。宇宙没有义务选择这么整齐的数字,但它偏偏选择了。

麦克斯韦的方程组更加令人震撼。1864年,麦克斯韦将电磁学定律整理为四个方程后,从这些方程出发推导出了电磁波的存在,并计算出电磁波在真空中的传播速度,恰好等于已测定的光速。他不是在解释已知的光,而是在预言光就是电磁波。一个在纸面上由纯粹符号操作导出的结果,竟然对应着宇宙中真实存在的一整个现象频谱,从无线电波到伽马射线。这些波,在麦克斯韦写下方程之前已经贯穿宇宙,只是在那一刻第一次被人类的符号系统捕捉到了。

维格纳的困惑不是关于“数学是否有用”,它显然有用。他的困惑是关于契合度的精确性:数学概念,通常是数学家在完全没有考虑物理应用的情况下出于审美和逻辑自洽而发明的,有时会在几十年甚至几个世纪之后被发现恰好是某种物理理论所需的唯一数学语言。爱因斯坦在1915年完成广义相对论时需要的黎曼几何,是黎曼在1854年作为纯粹数学的一个抽象分支创建的。海森堡1925年创立矩阵力学时使用的矩阵代数,是凯莱在1850年代为了研究线性变换不变量理论而发明的。盖尔曼1961年用SU(3)群的表示来分类强子,SU(3)这个数学对象当时在物理学家口中怪异得很,却在数学家手里已经静置了半个多世纪。

这让我们不得不直面一个巨大的问题:数学究竟是被发明的还是被发现的?

发现与发明的古老争论

柏拉图的答案是:数学对象存在于一个永恒的、非物质的理念世界。三角形不是某种被发明的东西,它一直存在,在我们的宇宙产生之前就存在,在宇宙消逝之后也将继续存在。数学家的任务不是创造三角形,而是发现它,就像天文学家发现一颗恒星。恒星不需要被发明,它在被发现之前就已经在天空中发光。

形式主义者,希尔伯特的继承者,持相反的观点:数学是无意义的符号游戏。数学对象不指称任何外部实在,它们是人造语法规则的产物。自然数不存在于柏拉图的天堂中,它们只是皮亚诺公理允许构造的符号串。非欧几何在被发明之前不存在,虽然黎曼在1854年发明了它,但没有人会在公元前三百年说黎曼几何“一直存在,只是等着被发现”。

实践中的大多数数学家采取的是某种实用主义的中道。他们在做数学时感觉像是在发现:证明一个定理的过程感觉像是在挖掘已经存在的结构,而不是在随心所欲地编造。定理的结论不以数学家的意愿而改变,无论你怎么想,质数在自然数中的分布是客观给定的,不受任何个人偏好的影响。但在哲学反思时,许多数学家又无法接受柏拉图主义的全部形而上学包袱,一个位于时空之外、却可以被人心访问的理念王国,听起来太像神学。

更深的复杂来自于数学概念的可选择性。自然数似乎是强制性的,任何智慧文明都会计数,都会发现素数。但连续统假设呢?哥德尔和科恩证明了它在标准集合论公理中不可判定。这意味着我们可以选择接受连续统假设为真,也可以选择接受它为假,两种选择都产生自洽的数学。在这里,选择打开了分支:不同的数学宇宙是逻辑上可能的。这一个事实既不纯粹支持发现论(发现者不会面临同等合法的选择)也不纯粹支持发明论(发明者不需要从公理中推演出未意图的后果)。

量子世界中的数学奇景

量子力学将数学与实在的关系推向了一个更尴尬也更有启发性的极端。

在经典物理中,数学描述的是实在世界中的对象,行星、石头、流体。数学方程是实在的模型,模型逼近实在,但模型不等于实在。在量子力学中,数学对象,波函数、希尔伯特空间中的矢量、算符,的地位变得前所未有的模糊。波函数是实在的,按照薛定谔方程演化,但测量时波函数坍缩为一个本征态。坍缩是由什么触发的?坍缩之前和之后的边界在哪里?对这些问题的回答不可避免地牵涉到了数学形式本身的本体论地位。

尤金·维格纳,正是提出“不可理喻的有效性”的那位,在量子力学的测量问题中采取了极端的立场:意识导致坍缩。当观察者的意识接触到测量仪器给出的信息时,波函数从叠加态归于单一定态。在这个解读下,数学形式描述的不是独立于心灵的实在,而是心灵与物质交互的界面。数学家变成了量子戏剧中的关键角色。

更多的物理学家,从玻尔到惠勒再到当代量子信息学派,倾向于另一种方向:量子力学的数学不是用来描述实在的(像行星轨道那样的实在),而是用来描述信息获取的。波函数不是世界上存在的东西,而是我们关于世界能知道什么的编码。这样理解的话,数学不仅对实物发挥作用,也对知识本身发挥作用。希尔德布兰空间中矢量的叠加,实际上是一种关于概率信息的结构的呈现。量子力学将数学从实在的镜子变成了信息的语言。

弦论:数学先行还是物理先行?

弦论是维格纳困惑的极致体现。这个理论至今没有做出可以被实验验证的独特预言,但它产出的数学极其优美,而且在多个独立发展的数学分支之间发现了深层的对偶关系。

1990年代初,弦论学家在研究黑洞熵的微观起源时,需要计算黑洞的微观量子态数目。他们使用了一种叫做D-膜的物体,弦论中的高维膜,来构造极端黑洞的微观模型,然后用代数几何的工具计算了D-膜系统的基态简并度。计算结果是,这个简并度的对数恰好等于贝肯斯坦-霍金黑洞熵公式给出的宏观熵值。计算中的每一步都依赖于过去五十年间发展出来的最精深的纯数学,复几何、模空间的上同调、层论、导出范畴。

但弦论本身并没有被实验证实。批评者说,如果弦论是错的,那么所有这些漂亮的数学,D-膜、镜对称、AdS/CFT对偶,都可能不是关于这个宇宙的物理真理。它们可能只是关于某些逻辑上可能但物理上不存在的宇宙的数学真理。

镜对称的发现为这一争论增添了更深的维度。1980年代末,弦论学家注意到两对拓扑不同的卡丘流形产生完全相同的物理。交换两个流形的Hodge数,得到的是同一个量子场论的两种几何描述。这一观察最初来自物理直觉,弦在卡丘流形上传播的方式,后来被严格证明为一个深刻代数几何定理。镜对称在数学上最先由弦论推导提出,其后才转化为数学内部的独立问题并部分获得证明。

这意味着,即便弦论最终被证明不描述这个宇宙,它已经在数学中创造了货真价实的新真理。这些真理在被弦论发现之前,代数学家们对它们几乎一无所知。在数学的地下深处本来就暗藏着这些结构,但没有人知道必须从哪里开挖。弦论就像一个提供了粗略藏宝图的模糊指示,它未必描述了真实地理,但它指出的地方却挖出了真正的金子。

这个现象导致了一种新颖的数学实在论:数学真理是客观存在的,物理理论可能只是一系列发现它们的探针,其中一些探针恰好也描述实在世界,另一些探针则不。但无论探针自身的物理真假,它们接触到的数学结构是真实的。这是对维格纳困惑的一种反转:不是问“为什么数学对物理有效”,而是承认“物理理论提供了访问数学真理的一种认知通道,数学家有时走在物理学家前,像黎曼;有时物理学家走在数学家前,像镜对称的发现过程”。

数字物理学:宇宙是计算机吗?

二十世纪末,另一种激进的观点诞生了:宇宙不是被数学描述的,宇宙就是数学。或者说,宇宙是一台巨大的元胞自动机,离散的、在局域规则下不断更新状态的细胞,而我们观察到的连续时空和量子场,是从底层离散计算中涌现出来的宏观近似。

康拉德·楚泽,德国工程师,世界上第一台程序控制计算机Z3的建造者,在1967年发表了最早的数字物理学论文。他指出,如果物理定律可以离散化,那么整个宇宙在原则上可以用计算机模拟。楚泽甚至猜想,量子力学的不确定性可能是物理离散性在能量尺度上的表现。

约翰·惠勒在1980年代提出了著名的“它来自比特”格言:每一个物理实体,每一个粒子、每一个力场、甚至时空本身,最终都是从信息中构造出来的。信息不是物理的副现象,物理是信息的现象。惠勒的这个主张将维格纳的困惑推到了极限:数学与物理的一致不是两个独立王国之间的外交同盟,而是同一个王国的两种表达,根本的实在是信息,数学是它的语法,物理是它的语义。

约翰·巴罗和弗兰克·蒂普勒以及后来的马克斯·泰格马克各自推进了激进的新柏拉图主义。泰格马克的“数学宇宙假说”断言:所有逻辑上自洽的数学结构都作为物理宇宙实际存在。我们所在的宇宙不是唯一的,而是数学多重宇宙中的一个,对应着某个特定的数学结构。这个假说是可反驳的吗?泰格马克认为,它可以被间接检验:如果物理宇宙中出现某种没法用任何数学结构解释的现象(比如超计算能力,能够计算图灵机不可计算函数的物理过程),数学宇宙假说就被否证了。但至今没有这种证据。

数字物理学的极端版本会导致一种令人眩晕的推论:如果你能写出模拟宇宙的程序代码,那么运行这段代码的宇宙与我们的宇宙完全不可分辨。对模拟内部的居民而言,它的时空、常数、耗散关系全部来自代码声明的逻辑,物理定律是代码,宇宙初始条件是初始输入。模拟宇宙内部如果也产生了智慧文明,他们也会派出数学家在纸上推导定理,定理也以不可理喻的有效性描述了他们的世界,因为他们世界的全部就是那套代码。维格纳的困惑在模拟世界中有一个极其平坦的答案:数学之所以有效,因为物理实在本身就是由数学构建的。

数学与宇宙本质的猜想

这些争论,发现还是发明、柏拉图还是形式主义、传统实在论还是数字物理学,目前还没有尽头。它们可能会永远悬置,因为每一个答案都迅速生长出新的问题。

但有一种不那么宏伟的视角可能更为诚恳。人类面对宇宙时发展出了两种能力:一种是感知模式,辨别视觉、听觉、因果、数量中的重复规律;另一种是符号化,将模式压缩为可操作的语言。数学是这两种能力相遇的共同产物。当我们写一个方程时,我们用符号压缩了一类模式。当方程预言了新现象,电磁波、正电子、Ω⁻粒子、希格斯玻色子,时,它证实了符号压缩的质量:被压缩的模式是真实且稳固的。这种真实性不需要数学是宇宙基本本体的代码版;它只需要证明宇宙足够稳定、可压缩,使得符号化的模式保持了在时间与空间中的恒常性。

模式本身不需要先于宇宙存在,就像声音规律不需要先于空气存在。宇宙提供了存在可以具备的稳定样态,数学提供了用简洁严密的人类语言去捕捉这些样态的工具。契合之所以可能,也许正因为它并不是两个异质系统的奇迹般的对应,而是同一个模式被翻译了一次,从物理实在翻译为符号表达,而且在持续大量的翻译后大致保持了意义不失。

这并不是在削弱数学的客观真理性,而是将它锚定在宇宙的实际结构中,而不是锚定在一个超自然的柏拉图王国里。素数分布不以你的意志为转移,不是因为它们漂浮在天国,而是因为整数的乘法性质是自然数定义的必然结果。这个必然性是逻辑的,不是形而上的。数学定理的被发现感来自于这种逻辑必然性,当你不自由地跟随公理和逻辑必然地导出一个结论时,你体验到的是推理的不可逆性,而不是对天国的一次仰望。

数学是最贴近宇宙骨骼的一门技艺。它要求使用者同时是模式的发现者和形式的发明者,发现自然显露的反复出现的定量关系,发明记录这些关系的越来越无冗余的精准符号语言。两类活动缠绕在一起,无法完全分离,就像右手和左手在编织一样。到如今,数学的触手已经探入了人类知识地壳的每一块圈层,从逻辑的基础到基本粒子的标准模型,从不可预测的混沌边缘到脑科学的神经网络,它始终在寻找形式与实在之间的那条最精确的缝合线。而这条缝合线本身,也许就是数学所不能证明但总是驱使着它不断衍生新领域的唯一前提:世界是量化的,或至少是足以以量为方式被理解成有条理和可被传递的。这句话没有数学证明,却是每一本数学著作翻开第一页时都默认写在上面的无形引言。

第二十五章 数学思维:认知科学视角下的数学心智

数感:大脑中的数量直觉

1990年代末,巴黎法兰西学院的认知神经科学家斯坦尼斯拉斯·德阿纳通过脑成像实验发现,当人类进行数量判断时,无论是比较两个数字谁大,还是计算简单的加减,顶内沟都会被激活。这个区域的位置在左右半脑大致对称,位于顶叶深处。无论是呈现阿拉伯数字还是点阵,无论是要求受试者按键回答还是口头报告,这个区域的活动都会亮起来。

这不是文化训练的产物。从未上过学的亚马逊原住民在做数量比较时,同样的顶内沟区域会被激活。出生仅数月的婴儿在观看数量变化的点阵时,脑电信号中的失匹配负波会发生特异性变化,表明他们已经在检测数量。鸽子、猕猴、大鼠、海豚,种类跨度极大的动物行为实验验证它们在经过训练也能区分数量。一只猕猴可以学会按数量递增顺序触摸屏幕上显示的点阵,并且性能稳定地转移到完全新的数量集合上。数感,对数量的初始知觉,像颜色感知和音高识别一样,是一种动物共享的先天认知机能。

人类数感与动物数感之间仍是可区分的。猴子的近似数系统遵循韦伯-费希纳定律:分辨两个数量的最小差异与它们的比例相关,而不是绝对差。猴子可以轻松区分8与16(比值1:2),但要区分8与9(比值接近1)则非常困难。人类的近似数系统,在没有精确计数时,也遵循这一比值限。但人类同时拥有精确数系统,这是符号化的、离散的、不受韦伯定律限制的:我们能够以同等确信区分1与2和区分1001与1002。精确数是文化产物,建立在语言的计数词和符号数字系统上。

数感的大小与数学能力存在相关性。多项追踪研究表明,6个月大婴儿对数量变化检测敏感度的个体差异,可以预测学龄前儿童的数学成绩。这不是一个决定论,大脑具有可观的可塑性,但近似数感似乎充当数学学习的某种地基筛网:那些具有较强数感的人在早期数学学习中能够更快地将符号数字与底层的数量表征绑定,从而更快地过渡到精确运算。

数学运算的神经架构

当你心算34加57时,你的脑中发生了一些非常具体的事情。顶内沟激活,处理数量。左角回激活,调取算术事实。前额叶皮层激活,维持中间步骤在工作记忆中,抑制无关信息和冲动作答。这三个区域的协同构成了数学运算的基本神经回路。

算术事实,乘法表、简单加法组合,通常储存在角回附近的左侧颞顶区域。脑损伤病人的研究提供了支持。某些顶叶或颞顶交界区损伤的病人保持完整的语言能力、完整的近似数感,却丧失了提取简单算术事实的能力。当被问及3×4,他们需要从3+3+3+3开始一步步加回去。这种选择性缺陷,格斯特曼综合征中的算术事实丧失,表明大脑将经常使用的简单组合固化为了近乎词汇的陈述性记忆,而不是每次重新计算。

加减乘除的脑机制不完全重叠。减法比乘法更多依赖顶内沟的数量加工区,而乘法更多依赖角回的言语化事实提取。这并不令人吃惊,减法比乘法更少通过死记硬背事实来解决,通常需要用某种心算过程在内心数轴上演算。多位数运算,如竖式乘法,则同时招募空间处理区(后顶叶上部)来视觉化纸上的数位对齐,即使实际执行时并没有真的纸笔在眼前。

有趣的是,数学家的大脑中,数学处理产生了一种特殊的功能重组。一项著名的脑成像实验扫描了数学家和非数学家在听数学陈述和听非数学陈述时的大脑活动。当听到代数、分析、几何、拓扑等高等陈述时,数学家的双侧顶内沟、下额叶和部分颞叶构成一个网络显著激活,而在非数学家中这个激活要弱得多。更引人注目的是,这个网络与语言网络几乎没有重叠。数学家在思考数学时激活的脑区,更接近空间导航和数字处理的老旧网络,而不是语言区。这个发现似乎在布里安上印证了数学思维与自然语言的可分离性,一个世纪之前庞加莱和爱因斯坦用内省的方式描述过的经验:数学思维是前言语的,是空间、关系和模式的直接操作,语言只是一个用于整理思维、将结果传递给同行的后期包装纸,而非思维运行的动力学部分。

数学天才大脑的谜团

数学能力谱系的另一端站着那些极其罕见的个体,数学天才或赛凡特。他们中的一些人在脑损伤或自闭症谱系障碍的背景下展现出令人难以置信的计算或推导能力。

金·皮克,电影《雨人》的灵感来源,可以心算两个六位数乘法并瞬间给出答案,但他分不清1元和10元钞票的购买力差别。丹尼尔·塔米特能够在数周内学会一门新语言,曾将π背诵到两万两千五百一十四位,并用共感觉体验描述数字,对他而言,每个数字都有固定的颜色、质地和个性。斯里尼瓦萨·拉马努金,我们已经在前文中详细讨论过,在几乎完全隔离的环境中独立推导出了一整座数学殿堂,而他的思维机制至今难以归类。

这些案例显示了大脑中数学功能的模块化和可分离特征。数学天才并非整个大脑更强大,在大多数天才案例中,智商并没有超常,某些日常认知功能甚至低于平均水平。但大脑中与数值加工、空间转换或模式抽象相关的局部回路,似乎以牺牲其他功能为代价获得了异常的计算资源。这种“脑的资源再分配假说”认为,某些发育路径将正常情况下用于社会认知或语言加工的神经资源转向了数学领域。

对数学天才脑的解剖学和影像学研究尚稀少,样本量小,生前数据很少。在现有案例中,有一个解剖发现相对一致:数学天才往往具有更厚的胼胝体(连接左右半球的纤维束)和增强的顶叶-额叶白质通联。这些结构差异可能使半球间的信息转移更快、双侧顶区之间的合作更紧密,从而增强空间化的数学思维。但这种结构差异是先天的还是后天高度训练的结果,目前仍需厘清。

数学训练如何重塑大脑

伦敦出租车司机的海马体后部比常人更大,由于他们花数年时间熟记错综复杂的街道网络空间表征,这一现象是神经元可塑性的标杆例证。数学训练对大脑的重塑效应同样惊人。

一项纵向研究追踪了一组从中学到大学一直持续接受高强度数学训练的学生,并与同龄文科生进行比较。数学组学生的顶叶灰质密度显著高于对照组,顶内沟在面对数字任务时血氧水平依赖信号随训练年数加强。更泛化的是,数学训练增强了前额叶的执行控制功能,持续注意、任务切换、抑制无关信息,这些能力在非数学任务上也转移为可测量的收益。

也有代价。数学焦虑,对数学的恐惧和回避,是一种相当普遍的现象,跨文化调查表明约百分之二十的人口经历某种程度的数学焦虑。在行为上,数学焦虑会影响表现,而糟糕表现又加剧焦虑,形成恶性的循环轮辐。在脑层面上,高数焦虑个体在做数学任务前就表现出前扣带皮层的过度活跃(与疼痛预期相似)以及前额叶调控的减弱,似乎焦虑压垮了有限的中央执行资源。有趣的是,数焦虑并不与数学能力完全负相关,有些高能力者也感到极度焦虑,暗示焦虑和能力部分搭在不同的神经回路上。

数学直觉,那种“啊哈”前的豁然开朗感,背后的神经活动已经有所揭示。在解题的关键顿悟时刻,右半球的颞上回和前部扣带回出现特异性活动,随后在腹内侧前额叶出现放松阶段的α波段增强。这不是逻辑推导的逐步阶段,而是一种全局的神经重组。这与两千年前阿基米德从浴缸中跳出来大喊“我找到了”时所体验的可能是同一种脑电风暴。

数学证明的认知结构

从认知视角看,数学证明是什么?证明是一系列按照逻辑规则从一个语句推导到另一个语句的链环。但任何有实际证明经验的数学家都会告诉你,证明绝不是线性的一步步从公理走到终点。证明的发现过程和证明的书写过程毫不相同。书写是线性秩序,定义,引理,主要定理,引理证明完成然后主体推进。发现是网络状的,类似于在心中同时悬浮多块拼图,测试哪个逻辑砖与哪个缺口可以缝合,不断修正假设,有时需要回溯放弃已经走了一截的证明路线,有时关键的引理是最后才被想到的。证明的文本是证明最终整理好的骨架,而骨架的生长动态,肌肉、血液、假死和复活,在文本成品中被完全删除了。

近年来,数学认知领域的一个热点是“证明的认知形式”。数学家内省的报告一致显示,他们不是主要用自然语言的内部独白来证明的,而是用经过压缩的、多模态的符号和形体的操作来推进推导。爱因斯坦描述自己的思维是“肌肉运动的和视觉的”,语言只在最后阶段才上场。庞加莱详细描写过他在踏上公共马车的一刹那突然看见福克斯函数与双曲几何的联系,那个时刻没有句子,没有公式,只有一种整体性的“结构视像”。这种非语言的核心推导阶段,可能是人类数学认知与当前人工智能方法之间最为深层的差异,大型语言模型从仍然在语言序列的预测中运作,它们缺失了那些肌肉运动与视像的综合表征以及将它们主动映射到形式规范上的张力。

动物数学与人类分界

找出人类与动物的数学之间的确切认知边界是一项困难但有趣的工作。

黑猩猩、倭黑猩猩和恒河猴经过训练可以学会阿拉伯数字符号与数量的对应,并执行简单的加和排序。一只名叫赛尔的倭黑猩猩可以用触屏在分散的点阵与和值之间建立对应,并将新学会的符号泛化到此前未见的组合。亚历山大鹦鹉阿历克斯,埃琳·佩珀堡的著名被试,可以口头回答“这里有几个蓝色三角形”这类问题,将形状、颜色和数量三重属性结合。

但没有任何非人类动物被证明拥有自然数概念的完全递归性。递归,知道每个数都有一个后继,后继又可以再后继,无限延续,似乎是人类特有的认知发明。动物似乎理解具体的、可视的数量,能够进行近似加减,但构造“所有自然数的集合”这种实际无穷的结构超出了任何已知动物行为的证据。将算术从感知耦合中解放出来,把数变成可以被无限扩展的形式系统的操作单元,或许是人类独一无二的数学认知成就。

数学认知的演化起源与教育启示

为什么人类演化出了对如此抽象操作的认知潜力,而这些抽象操作在演化适应环境中几乎没有直接用途?一个可能性是,高等数学是若干演化古老的认知模块被重新组合用于新目的产生的副产品。在演化适应环境中,数量辨别用于选择食物丰沛的林地、追踪少数量的敌人或猎物、判断公平分配;空间推理用于导航环境和制造工具;序列操作用于层级化加工社会关系和语言语法规则。这些模块可能原本分别为具体适应场景设计,但现代智人的大脑在皮层重组中获得了前所未有地将这些模块互联的能力。数学家在证明代数几何定理时,他们的大脑正在利用一个原本为在稀树草原寻找无花果而演化出来的数量皮层网络,一个为制造石斧而设计的空间转换皮层网络,以及一个为处理复杂的社交等级关系而建立起来的递归嵌入加工机制。数学是天鹅绒绳索背后所有这些古老模块的交响乐。

这个视角对数学教育有启示。如果数学思维的底层是进化而来的数量与空间直觉,那么最有效的数学教学应当激活这些直觉通道,而不是绕开它们强行灌入符号规则。用动态几何软件让中学生玩转三角形内角和,比用文字公式背诵更接近大脑理解几何的自然路径。分数概念的困难,众所周知,可能与大脑缺乏直接编码比率数量的“分数感”有关,因为进化环境中很少需要精确结合部分与整体的比值。能利用离散计数归约分数问题(把它们转化为整数比的组合)的具象教学方法,往往比抽象的符号规则教学更奏效。这些洞见已在认知引导数学教育的前沿开始在课堂中取得成绩,虽然它们的实践推广还远未完成。

大脑不是一张白纸。它是一个由已部分适应特定数量模式的长演化历程塑造成的专门化器官,数学教育在某种意义上是一种比通常所想的更微妙的工程,它试图在古老的大脑皮层上安装一种在最近几千年才被设计出来的、最抽象的操作系统。这个安装之所以能够运行,是因为数学本身并非外来植入物:它的原始种子已经在顶内沟和海马旁回中沉睡了数百万年,等待着被符号文化唤醒。数字不是我们强加给大脑的,它只是被我们从大脑中最深的岩层中挖出来的,经过精心打磨,成为无可替代的认知工具。数学作为人类活动,既是逻辑的空间,也是神经元的空间,是公理与突触交织在一起的那个共同产物。它在人脑内部向外看着星星,尝试用三万年前就已学会计数的这些回路,去算出宇宙的年龄和形状。也许这本身就是一场宇宙通过一个小小的碳基运算节点来理解自身的缓慢过程。

终章 无尽的草稿

在雅典学院的壁画中,柏拉图手指向天,亚里士多德手掌覆地。向上的手指声明了一种信念:数学真理住在超越尘世的永恒领域,人的灵魂只是回忆起了进入肉体之前已知的形式。向下的手掌覆在坚实的大地上方:数、形、推理,这些并非来自天国,而是从可感世界的反复经验中被提取出来,在人类集体实践中被逐步锻造成型、修正和传递。这两种手势之间的张力从来未曾消解。它绵延过亚历山大里亚的书架、巴格达的翻译室、哥廷根的讲厅、普林斯顿的茶室,直至今天在世界某个角落进行中的每一场自动定理证明的运行和每一次数学课堂上的顿悟时刻。

这部书走过了漫长的道路。从苏美尔书吏在泥板上刻下楔形乘法表开始,到深度学习模型自动生成数学猜想为止,六千年的人类数学被压缩在二十五章的文字中。压缩必然意味着丢失。每一个被跨过的时期都足够支撑起一部更厚的专著,每一位被几段话囊括的数学家都在尘封的书信和手稿中留下了远未被穷尽的思维痕迹。本书不可能复原那完整的厚度,但如果它能传达一种印象,数学不是一条时间轴上的点列,而是一个由无数条分叉、交汇、中断和重新连接的道路构成的古老河系,它的主要意图就已经达到了一半。

另一半是纠正一种流传太久的简化图式。数学史曾经被写成一个单线的进步故事:希腊人发明了证明,然后是一千年的黑暗,然后欧洲在文艺复兴中点燃了现代性的火炬。这个故事不完全是错的,但它遗漏了太多东西。它遗漏了印度发明零的静默革命,遗忘了中国算法传统对高次方程数值解的精深探索,忽略了阿拉伯世界五百年间对代数、三角学和几何基础的持续重塑,无视了非洲、美洲和大洋洲诸多文明在数量、结构、对称性方面的独立认知成就。当这些被忽略的板块重新摆回桌面上时,整幅数学地图的形状就变了。它不再是一条从雅典通往剑桥的高速公路,而是一张遍布各个大洲的道路网,一些路段宽阔、铺得完整,一些路段隐约如小径,在某个朝代戛然中断,在另一个时代被陌生旅行者重新发现。甚至那些看似中断的小径也有其深刻的提示:知识并不自动前进,它依赖制度、传播、写作载体、翻译群体、经济支撑和政治的容许。当这些条件在历史的某个角落同时消失,就像关流秘传制度在明治维新后迅速塌缩,或玛雅祭司的抄本被焚毁,数学传统可以在一个世代内转为无人能读的旧物。文明的数学记忆比我们通常愿意相信的要脆弱得多,而它的恢复力又比任何个体所能预期的更为顽强,因为只要还有人在思考数量与形状,那些被无数次独立发明的定理就还会再一次出现在纸上或沙地上。

数学的另一个边界也被二十世纪重新划定了。它不再是“关于量的科学”那类窄定义可以容纳的。群不再是多项式根的置换,而成为描述晶体结构、粒子物理、编织图案和量子逻辑的通用语言。几何不再是关于可见空间的学问,而成为每一个黎曼流形中的曲率世界、每一个代数簇上的上同调序曲。概率不再是赌徒口袋里的微积分,而成为人工智能的不确定性推理引擎和量子力学的本体论基石。无穷不再是哲学禁忌,而成为集论宇宙中蔓延的阶梯,每一级都有自身的运算法则和不可判定命题。当数学将自己的工具不断向更抽象、更结构的层面凝聚时,它同时获得了更强的返回世界的本领:同一组李群可以同时作为宇宙学标准模型的对称底座和晶体分类的基本元件,同一种谱序列可以遍历从纤维丛到生物信息网络的不变量提取管道,抽象不是对具体的逃离,而是对具体的凝聚,是更深的组织原则被析出。这种抽象与回归的循环,似乎在所有成熟的科学中都一定程度地存在,但在数学中它以最纯粹和最少依赖外部观测的方式运作。

关于终极基础的问题并没有在哥德尔不完备定理之后被关闭,而是被改变了提问方式。我们仍然想知道数学是否相容,是否完备,是否有一个最终的公理系统能够囊括一切可被数学证明的真理。但不完备定理告诉我们,如果这个系统存在而且相容,我们就无法在它内部证明它相容。同时它也不完备,存在不可判定命题。这些逻辑事实并没有终止探索,只是把探索从寻找终极基础变成了绘制不可判定性的边界:已知在算术的框架内不可判定的是哪些类型的命题;在更高层的大基数公理下,不可判定区域是否发生了漂移;以及最重要的,那些在标准公理下不可判定的命题,是否对数学家实际的证明活动有实质影响。答案是:大多数数学实践在不完备性面前照常进行,因为不可判定命题通常精微地处于足够远的地方,证明者和构造者仍然可以在脚下的稳固地面上安全行走。

维格纳的困惑,数学对物理“不可理喻的有效性”,也许正在朝一种双向注视转型。物理学家越深入基本定律的结构,看到的越像是数学中早已就绪的工具。另数学家越是被物理直觉推动,越是在纯形式内部发现新的岛屿,弦论对代数几何的催生仅是最近的一个重要案例。数学与物理似乎构成了一个缠绕的螺旋梯,物理用观测问自然一个问题,自然给出的回答往往具有数学的结构;数学通过自身的推导从已知结构跳到未知结构,而这些未知结构有时又恰好容纳了下一代物理数据的模式。螺旋梯是向下的还是向上的,或者只是在一个足够深的地方两个立面转向了同一片未被命名的区域,可能都需要远远超出现有知识边界的时间来判明。

在最后一章和第二十二章对人工智能的讨论之后,还需留意一个正在发生的变化。大型语言模型和符号验证器等人工智能工具已经开始重新塑造数学实践的微结构。证明检查,传统的同行评审往往需要数月甚至数年的重复验证,在证明助手如Lean、Coq和Isabelle的辅助下,可以在数小时内完成形式化校验。单子化范畴学、费马大定理的形式化、液体张量实验,这些里程碑式的形式化证明已经在过去几年完成。机器生成猜想,用深度学习在纽结理论与表示论之间找到隐藏关联、在图论极值问题中发现比已知界限更优的结构,开始零星出现。这不是机器替代数学家,而是数学家获得了一种新的认知器官:一个可以并行检索广袤推论空间的搜索器,一只能看到高维参数间隐藏关联的额外眼睛。这种新器官不会让数学变成非人活动,就像望远镜没有让天文学变成非人活动一样,但它会改变数学家花时间的方式,将一部分从前用于穷举搜索和手工验证的精力释放出来,投入到概念创新和跨领域迁移的更高层次。

在这本书最终合上之前,也许该说清一件根本的事:数学究竟是什么。

它是一堆定理吗?如果是,那么为什么同一个定理,比如素数有无穷多个,欧几里得在公元前三百年证明了它,它今天依然是真的,而其他学科中几乎没有任何同时代的陈述能够在原封不动的情况下数千年保持真值。定理的累积并不是数学的全部,因为定理可以被计算机生成而没有人理解它们。数学需要一个理解者。它发生在当一个人(或一群对话者)的内部心智模型与符号表达式之间形成了可反复重现的共振,当形式符号不只是被操纵,而且被“看到”它们在说什么。数学的这个现象学维度常常被无数学专业的场合忽视,但它却是一切证明和计算最终要回归的场域。

它也当然不只是计算。计算器可以计算,它不理解。但完全脱离计算的所谓纯概念理解,如果永远不能被精确化为符号推演,就又回到了前毕达哥拉斯时代的格言式的猜想。数学恰恰存在于计算与概念之间的不安张力中:概念使计算有意义,计算使概念诚实可信。将这两截持续地接合在一起,是每一位从数学中获得满足感的人都会感到的一种特有的愉悦,它不像解谜那样倏忽即逝,也不像形而上学那样始终无法着陆。

在认知层面,数学是我们这个物种用有限大脑去触碰无限结构的一种特殊行为模式。每一代数学家都在前人留下的概念基础上增加一层,然后留下大量未完成的草图离去。从来没有人可以声称自己读懂了全部,今天已经没有活人能够从头到尾理解费马大定理证明的每一个子模块。数学作为一个整体已经超出了任何单一个体的认知容量。它变成了一个分布式认知网络,靠期刊、预印本、口头传统、代码库和证明助手维系着连通性和延续性。这不是数学的缺陷,而是它作为一个物种级事业的特征。数学是人类共同的神经系统之一,在个体有限的大脑容量与物种无限的知识累积之间找到了代偿途径。

如果对数学下一个极简的定义,我会说:数学是一种寻找和稳定化模式的活动,其模式必须足够精确,以至于能被符号系统捕获并独立于捕获者反复验证。这个定义不完美,任何定义都会迅速被新的数学形式所溢出,但它至少能涵括伊尚戈骨上的刻痕、巴格达智慧宫的代数、京都神社的算额、希尔伯特空间的算子代数以及GPT生成的矩阵乘法算法。所有这些活动都在做同一件事:从混沌中拽出不变的结构,然后用足够精确的语言将它固定,使其可以被他人,其他时代、其他文化、其他物种甚至其他基质上的心智,所接入。

本书的终章并不是对数学的终结。数学没有终点,只要还有人在思考数量、形状、结构、可能性和变换,数学就还会继续生成新的章节。这本书只是一个暂时的收束,在六千年之后,在当代的某个观察点上,将一些可见的路轨绘制出来。五十年后的同类著作,将包含今天还无人能够写下的内容,因为那些数学尚未被创建。而这正是数学史不同于所有其他历史的生命特征:它的过去是确定的,未来是开放的,而过去在不断被重新解释,每一次重述历史,最新的数学成果就像一盏新点亮的灯,往已经走过的道路上投去不同形状的光,先前未被注意的侧枝和暗影区域突然进入视野。历史本身也就在这些反复回望中发生了改变。

夜深了。数千年来,无数人在这样的夜里面对纸上或沙上的数字与线条。他们早已不在,但他们的数学依然活着,活在他们未曾预见的应用中,活在从他们留下的未完成问题中生长出来的整片新学科的大乔木里,活在被翻译、被重写、被形式化、被传入一颗又一颗新大脑的那些缓慢而坚韧的过程中。数学是诸多文明共同编织的无尽草稿,总是渴望定稿却永不定稿的形态。这份草稿的边缘空白处写满了过去所有世代数学家的旁注与涂改,而后面还有大片的空白,等着新的笔迹。

原创成果科普:补遗

补遗一 数的原子:素数分布的一个新几何视角

素数,只能被1和自身整除的正整数,是数论中最古老也最令人着迷的研究对象。它们在自然数中的出现看似随机:2,3,5,7,11,13,17,19,23,29……没有人能够精确预测第n个素数是什么。但从宏观统计上看,素数又遵循着清晰的规律。素数定理告诉我们,不超过x的素数个数大约为x除以ln x。黎曼在1859年提出了一个更为深刻的猜想:黎曼ζ函数的非平凡零点全都位于复平面上实部为二分之一的临界线上。如果能证明这一点,素数分布的规律将被揭示到远超当前精度的程度。一个半世纪过去了,黎曼猜想仍在等待最终的证明。

在传统的解析数论进路之外,是否存在一种更直观的方式来感知素数分布的规律?

素数可以对应于一种离散空间中的“干涉图样”。将每一个自然数放置在一条直线上,对每一个素数p,以p为间隔放置相位标记,在p的各个倍数位置标以相消干涉。当对所有素数都进行这种标记之后,你会发现:在那些“所有素数波都不同步”的位置,观测到的干涉是非零的,这些位置恰好是素数或素数的某种组合。这个图像借用了波动光学中的概念:素数就像一个基本振子集合,它们在自然数中的干涉模式生成整个整数谱的结构。

这个观点之所以新颖,是因为它置换了解析数论中围绕复平面梅林变换的核心立场,转而将素数分布视为一种多周期系统的叠加结果。每一个素数p定义了一个周期为p的振荡,所有素数周期叠加在一起,在整数谱上产生了复杂的干涉亮斑,素数。在这个框架下,素数定理可以从这种干涉系统的平稳相位近似中直接导出,而黎曼猜想等价于这些素数振荡的相位相关性大小的一个最优上界。

用更通俗的话说:素数看起来是随机散布的,但如果你把它们理解为许多周期波相互作用后的残余物,它们的分布就不再神秘。它们只是周期不能彼此完全抵消的那些点。哥德巴赫猜想,每一个大于2的偶数都可以写成两个素数之和,在这种理解下获得了一个相当直观的几何解释:如果偶数是干涉图样中一个特定的对称点,那么该点的两侧通常会有两个尚未被取消失效的位置,即两个素数。这个视角并不直接证明哥德巴赫猜想,但它将问题从组合数论的原始形式转换为了一个干涉模式的对称性问题。

另一个相关的发现涉及素数间距的统计特征。将连续的素数间距作为数列,研究它们本身的分布,在传统解析数论中这属于“素数间的间隙”问题。如果从上述干涉视角观察,素数间距序列本身构成了一个近似的点过程,其涨落结构表现出某种自相似性,小间距的统计涨落与大间距的统计涨落在对数尺度上具有相近的标度行为。这种自相似性已经超出了标准随机矩阵理论的预测范围,目前正在被数值实验系统性地验证。

补遗二 蝴蝶的数学阴影:混沌与信息压缩的深层对偶

混沌理论最广为人知的隐喻是蝴蝶效应:一只蝴蝶在巴西扇动翅膀,可能引发德克萨斯州的龙卷风。这个隐喻传达了混沌最基本的行为特征,初始条件的微小差异被指数放大,导致长期预测在实践上不可能。

但在混沌行为的深处,还有一个尚未被充分照亮的面相:混沌系统的轨道虽然无法被长期预测,但它们所携带的信息量却可以被严格界定。一个确定性混沌系统可以被理解为一种自然的“信息压缩器”的反向操作,它对初始条件中的信息进行解压缩,将储存在微小尺度中的信息逐层释放到宏观行为尺度上。

考虑逻辑斯蒂映射,那个描述种群数量的简单迭代方程xₙ₊₁=rxₙ(1-xₙ),当参数r进入混沌区时,从两个几乎无法区分的初始值出发的轨道,大约在n步后变得完全不相关。这里的n由李雅普诺夫指数(轨道的平均指数分离率)决定。这意味着初始条件在n步之前的精度信息,在n步之后就完全消耗殆尽了。混沌系统就像一台信息扩散器:它将储存在初始条件小数点后第k位的微观信息,以一个可精确计算的速率逐步转移到轨道的宏观统计属性中。

这个观点带来一个此前未被充分认识的对偶关系:确定性混沌在信息论的意义上,是一个“解压缩算法”。非混沌系统(例如谐波振荡器)将初始信息以高度压缩的形式保持在整个演化过程中,只要知道某一时刻的状态,就能反推出所有之前的时刻。混沌系统则不断将压缩的初始信息展开,使得过去时刻的重建变得几乎不可能,信息没有消失,而是被分散到了极其丰富的轨道结构中去。混沌不是信息的毁灭,而是信息从压缩态向展开态的不可逆转变。

从这个视角出发,热力学第二定律,熵增原理,与确定性混沌之间存在着比通常意识到的更紧密的亲缘关系。热力学系统微观粒子的混沌运动正是将初始微观信息展开为热平衡态的宏观无差别性的物理机制。一杯热咖啡的冷却过程,在微观层面就是初始条件中储存的“哪些分子更快”的信息被混沌解压缩成了整个宏观系统的均匀化。熵不完全是“无序度”的量度,它是初始信息被展开的程度,系统越接近平衡态,初始条件中的细节信息就越被充分展开到无法恢复的程度。

这一信息压缩-解压缩的对偶视角不仅具有哲学上的优雅,它还为具体应用提供了新的工具。在时间序列分析中,通过测量一个系统轨道的信息展开速率,可以直接估计该系统的有效李雅普诺夫指数,而不需要显式计算相空间的邻近轨道发散率。这对高维复杂系统(例如脑电图、金融市场、气候数据)的混沌程度评估可能有直接的操作意义,传统的李雅普诺夫指数估算在高维空间中容易因数据稀疏产生误差,而基于信息展开速率的估算法只需在时间序列本身上做压缩测试,它规避了高维空间邻近轨道搜索的计算困难。

补遗三 证明的拓扑学:形式化数学的结构新解

自欧几里得以降,证明一直被理想化为从公理到定理的线性链条。欧几里得《几何原本》的外观强化了这种想象:定义、公设、公理,然后是一个接一个编号的命题,每个命题引用前面的编号,像一条从未中断的锚链。现代数学论文的书写格式(定义→引理→定理→证明)继续维护着这个线性理想。

但真实的证明,无论是发现过程还是最终公布的形式结构,从来都不是一条直线,而是一个网络。

证明网络由“节点”(命题、定义、假设)和“有向边”(推导关系)组成。一个节点可能有多个前驱,一个定理的证明依赖多个引理。一个节点也可能有多个后继,一个关键引理被多个下游定理所使用。当一个证明足够复杂时,它的网络结构会呈现出可被分析的拓扑特性。

在这个框架下重新审视数学知识的结构,会发现几个普适的规律。首先,证明网络的度分布通常是无标度的:大多数命题只被少数其他命题引用,而极少数核心定理(例如柯西-施瓦茨不等式、隐函数定理、哈恩-巴拿赫定理)被极大量的下游结果所依赖。这种幂律分布暗示数学知识积累遵循优先连接机制,一个命题被引用的次数越多,它就越可能再次被新的证明引用。这和科学论文引用网络、互联网超链接、以及生物学中的基因调控网络呈现类似的结构特征。

其次,证明网络具有“小世界”特性:任意两个表面上相距遥远的数学概念,在网络中往往可以通过极短的推论路径连接。一个代数数论中的定理和一个偏微分方程解的渐近估计,可能在网络中通过若干个核心定理(例如泛函分析中的里斯表示定理)以出乎意料短的距离相连。这种“数学的小世界”不仅是认知上的新奇现象,它也提供了一个具体框架,可以用来衡量数学各子领域之间的互联程度,并追踪跨领域连接的演化趋势。

更有趣的是证明网络中存在“结构洞”。结构洞是指网络中两个紧密集群之间的少数连接节点。在数学中,这些节点往往是那些将两个原本无关的领域连在一起的“桥梁定理”,例如将拓扑与代数联系起来的同调理论中的克莱因对应,或者将数论与几何联系起来的格罗滕迪克的概形语言。这些结构洞节点通常是数学史上被认定为重大突破的原因之所在:它们不只是证明了新定理,而是连接了两个之前没有推论通道的独立领域。当这种连接建立后,两侧集群中的定理和工具就可以通过这个桥梁互通有无,产生大量下游的新结果。这可能可以作为一个客观量度来识别未来研究中的“突破潜力”节点,那些靠近网络结构洞区域的未解决问题,一旦被解决,其产生的连接价值或许远比单个定理本身的陈述更重大。

这一“证明的拓扑学”视角并非只是一种美丽的隐喻。随着证明助手(如Lean、Coq)和大型数学知识库(如Mathlib)的发展,人类已经拥有了若干被完全形式化的数学理论片段。将这些形式化数据库的输出作为证明网络进行分析,可以绘制出一张“已知数学的地铁图”,每个定理是一个站点,每条推导是一条线路。在这张图上,不仅可以看到已知数学的连接结构,还可以识别出未开发的连接空白区:两个理论集群之间若缺少线路,或许意味着存在一个尚未被发现的桥梁定理。这为数学发现的战略规划提供了全新维度的证据,也提示我们:科学史中反复出现的“多个独立发现”或许并不只是巧合,当两个知识集群之间的结构洞存在已久,有不止一支研究路线可以穿过这个拓扑空区时,好几个独立的头脑自然会几乎同时在网络的同一条裂缝上搭起桥来。

补遗四 计算的形而上学:不可解问题的层级宇宙

图灵在1936年证明了停机问题是不可计算的:不存在一个通用算法能够预先判断任意程序是否会停止运行。这是可计算性理论的开端。此后,数学家继续发现了大量同样不可计算的问题。希尔伯特第十问题(判断一个丢番图方程是否有整数解)在1970年被马蒂亚赛维奇证明为不可计算。群的字问题、半群的整除性问题、某些拓扑流形的同胚判定,越来越多的自然数学问题被归入图灵不可计算的范畴。

但不可计算性本身不是同质的。在“不可计算”这个标签下,隐藏着一个异常丰富的层级结构,图灵度。

图灵度的直观想法是:有些不可计算问题比另一些“更加”不可计算。停机问题是最低级的不可计算问题,它相对于任何可计算问题而言是不可解的,但它的不可解程度是所有不可解问题中最接近可解的那一个。考虑语句:“停机问题是不可计算的”。这个元语句本身的事实判定,需要一种超越停机问题的更强的计算能力,这就是图灵跳跃。将跳跃操作反复应用,就产生了一个升序的图灵度谱:0(可计算),0′(停机问题层级),0″(双跳跃),0‴(三跳跃)……在自然数长度的跳跃之后,还可以有超限序数的跳跃,一直延伸到集合论宇宙的深处。

这个层级结构的惊人之处在于它与经典数学分类之间的对应。希尔伯特第十问题恰好位于0′层级,与停机问题等价。某些描述集合论中的问题则到达了0‴甚至更高的层级。特定组合系统的不可判定性通常位于底层的几个层级。怀特海问题,是否每个满足特定条件的阿贝尔群都是自由群,在ZFC中不可判定,其强度已超出了图灵度的简单跳跃,进入了独立于算术的集合论域。这种对应关系意味着,图灵度层级不是计算理论内部的自娱自乐,而是数学真理复杂性的一个客观度量,一个数学问题的“计算难度”在某种意义上是该问题的本体论复杂性。

更深远的一个推论是:哥德尔不完备定理和不可计算性之间的映射,并非只是历史偶然。哥德尔构造的不可判定命题也位于与停机问题等价的层级。数学基础中三个最著名的否定性结论,哥德尔不完备、图灵不可计算、独立于ZFC的命题,是同一个深层结构在逻辑、算法和集合论三个层面上的投影。

这个视角进一步揭示了人类数学实践的一个存在性特征:数学家通常在图灵度的极低层级中工作,几乎所有自然出现的数学猜想要么是可计算的(可在有限的强力手段下判定),要么最多位于0′或0″层级,极少数会超出算术层级。但这更像是因为数学家下意识地将注意力限定在那些他们认为“可解”的问题上,而不是因为更高层级的问题在数学上贫乏。更高的图灵度层级中充满了具有精确陈述的自然数学问题,只是它们很少被写进教科书,因为它们太难以捉摸,人类的推理习惯在面对它们时会像试图抓住烟雾。这提示了一种未来:借助计算机的强力搜索和证明辅助工具,人类或许可以系统性地向目前视野之外的高图灵度区域进军,寻找此前无法被想到的新数学结构。

补遗五 从局部到全局:反问题与数学的逆流而上

数学的一个通常叙事是正向的:给定方程,求解;给定初始条件,预测未来;给定公理,导出定理。在这个叙事中,数学的进展方向与逻辑的推导方向一致,从原因到结果,从已知前提推未知结论。

但数学实践在深层上是由反问题驱动的。反问题是正问题的逆:给定结果,反求原因;给定数据,反求模型;给定定理,反求证明。整个数学史可以被读作一部反问题方法的演化史。

从阿基米德称量王冠开始,已知质量和浮力,反求密度,再反求材料成分,反问题就与正问题一样古老。但反问题在二十世纪以前较少被作为一个独立的数学领域来观察,因为经典物理提供了完美的可逆方程,使得求解正问题与求解反问题在数学上几乎对称。牛顿运动方程的时间反演是可计算的,知道轨道的当前位置与速度,就能回推过去,一如预测未来。

二十世纪改变了这一切。量子力学中的测量反问题是根本性的:给定测量结果,反推波函数在测量前的状态。这种反问题在量子力学标准诠释中被认为是不可解,测量导致波函数的不可逆坍缩。医学成像(CT、MRI)将反问题变为工程技术:通过X射线在多个角度的穿透数据重建人体内部的密度分布。地球物理反演通过地表地震波数据重建地下岩层结构。金融计量学通过价格序列数据校准随机波动模型。在这些领域,正问题往往是适定的(解存在、唯一且稳定),反问题却通常是不适定的(解不唯一或对噪声极度敏感)。

现代数学为反问题专门发展了一套完整的方法论,正则化理论。正则化的核心思想是引入额外的假设来约束反问题的解空间,将不适定问题转化为近似适定。早期的方法由安德烈·吉洪诺夫开创的吉洪诺夫正则化,在最小化残差的同时最小化解的某种范数。后来的发展引入了基于全变差范数的边缘保持正则化、基于稀疏表达的正则化、以及近年来基于深度学习的端到端反演方法。

但正则化的哲学意义超出了应用数学。它其实回答了“不确定性条件下如何能够做出合理推断”这一普遍认识论问题。从不完全、带噪声的数据推导出可靠结论,这不是数学的妥协,而是数学的核心能力。每一次正则化是一种偏置的引入,它声明“在所有能够拟合数据的可能模型中,我们偏好更简单的(或更平滑的、或更稀疏的)那一个”。这就是奥卡姆剃刀的数学形式化。反问题的理论将对简约性的偏好从一句哲学格言变成了一套可定量考量的方法。

在深度学习时代,反问题正在经历一次范式转换。传统的正演模型加正则化的二段式方法,正在被端到端的逆向映射直接学习所补充甚至取代。深度神经网络无需显式指定正向模型,可以直接从大量的输入输出数据对中学会逆向映射,给定观测,直接输出重建结果。这绕开了正向建模和正则化设计两个传统步骤,但网络的训练过程本身隐式地对问题结构进行了压缩归纳。这可能意味着,反问题与归纳学习在共享着同样的数学基础,两者都是从部分中恢复整体、从结果中重建原因。如果这个统一的数学框架能够被明确建立,反问题理论将不再只是应用数学的一个分支,而会成为人工智能和统计推断的核心数学语言之一。

但反问题也有其边际。某些反问题即使在完全信息下也无法唯一求解,不是因为噪声,而是因为正问题本身存在信息损失。因果推断中的反事实推理,假如这个人没有接受治疗,他的预后会怎样?,就是这样一个根本性地不可解的逆问题,因为同一个人不能同时接受两种处理方式。在这些情况下,正则化或学习都无法提供唯一解,只能提供在给定先验假设下的可能分布。反问题的终极边界划定了从数据到结论的不可逾越的极限,而这恰恰是科学推断必须谦卑的地方,有些问题不是暂不可解,而是原则上不可解,因为信息在正过程中已被不可逆地擦除。厘清哪些反问题是不可解的,或许与求解那些可解的反问题同样重要。

补遗六 结构之网:数学统一性的一种新假设

一个反复出现在数学史中的问题是:数学是否具有根本的统一性?不同的数学分支,数论、几何、代数、分析,是同一个深层结构的不同投影,还是仅仅是人类将不同认知工具松散地归入一个名称下面的偶然堆栈?

朗兰兹纲领代表了迄今为止朝向统一的最雄心勃勃的理论。它将数论(伽罗瓦表示)与调和分析(自守形式)纳入同一个庞大的对应网络,预测了两者之间的系统化等价关系。朗兰兹纲领的完全实现将是数学史上最伟大的统一成就之一。但朗兰兹纲领主要覆盖的是数论、表示论和代数几何之间的三角关系,而泛函分析、动力系统、组合学等广阔领域则不完全在其直接射程之内。

是否存在一个更底层的、能够同时覆盖更多数学领域的统一原则?

最近在范畴论和高阶范畴论中的发展暗示了一条可能的新路径。将数学的不同分支视为不同种类的“结构范畴”,结构之间的关联视为函子,而各种深刻的不变量定理,从同调代数到指标定理再到黎曼-罗赫定理,可以被统一理解为特定的“伴随函子关系”的结果。在这个画面中,伴随函子,两个范畴之间的互为左右伴随的一对函子,成为数学中一切自然性和典范性构造的基础,同时也体现了“最小信息损失”和“最优近似解”的结构特征。

这条思路与传统统一路径,寻找一组基本对象和一组作用于其上的基本定律,有微妙而关键的分野。经典的统一理想(从牛顿到爱因斯坦到弦论)是万物归约于一个原初的数学对象。范畴论版本的统一则是万物归入一个网络化的函子关系场,没有单一的终极对象,只有普遍的结构变换模式。不同数学领域之间的对应关系(镜对称、朗兰兹对偶、盖尔-马西对偶、岩泽理论中的主猜想)本身就是数学统一性的真正体现。结构之网不是要消除差异而让所有部分坍缩成一点,而是要保持差异的同时使每一种差异在精确对应关系中都能被理解,知道代数几何中的某个对象在辛几何的对应物中恰好是什么,以及在相反方向上同样清楚。

这种网式的统一观与本书通篇所呈现的数学史有一种内在的呼应。从泥板到量子,数学从来不是朝着一个单一目标线性地进化的,而是不断在各文明之间交叉、分岔、重新连接,形成密度越来越高的概念纤维网络。范畴论和函子语义为这个历史过程提供了形式的镜像,它也是一张不断被编织增密的概念关系网。这个统一性假设并不预言某一个“万物理论”将在某一天被写在一块小到可以戴在手腕上的泥板上,它预言的是交叉连接的密度和精确度将持续增加,直至任何两个被充分研究的数学领域之间都能找到可理解的结构通道。这不是一个终点的假设,而是一个过程的假设。它自身的真伪还需要几代人的工作来验证或修正,但作为一种指引探索的方向,它已经明显影响了一些前沿领域的研究风格。

补遗七 对称破缺的数学机制:从规范场到生命手性

完美的对称与必然的破缺

在对称的世界里,完美的对称是一种魔咒。一个完全对称的圆球立在绝对平坦的桌面上,在理论上可以永远保持静止。但在现实中,任何微小的扰动都会让它滚向某个方向,对称被打破了,球选择了一个特定的位置。物理学家将这种现象称为“自发对称破缺”:系统的运动方程具有某种对称性,但系统的实际状态却不具有这种对称性。

这一概念在二十世纪物理学中占据了核心地位。从铁磁体中磁矩的自发排列到超导体的库珀对凝聚,从弱相互作用的规范玻色子获得质量到宇宙早期相变中基本相互作用的逐一分离,对称破缺是产生结构丰富性的普适机制。如果宇宙的基本定律始终保持完美的对称,就不会有粒子质量的差异,不会有复杂物质的形成,不会有星系,不会有生命。对称破缺是宇宙从单调走向丰富的数学引擎。

然而,对称破缺在数学上究竟是如何发生的?在物理理论中,这通常被表述为一个具有对称性的势能函数,其最低能量状态(基态)恰好不对称。例如,一个墨西哥帽形状的势能,中心是局域最大值,围绕中心的谷底是退化的最小值环。系统必须停留在谷底的某一点上,但谷底上任意一点的选择都打破了旋转对称。这个图像直观有效,但它假设了势能函数是预先给定的。对称破缺的更深层问题,对称破缺能否从更基本的数学原则中推导出来,而非仅仅作为输入设定,长期以来没有被充分探索。

稳定性的代价:对称破缺的一个变分原理

我们提出了一个统一的视角来理解对称破缺的数学机制,其核心是一个变分原则:在一个具有对称性的动力系统中,对称状态的稳定性与系统的复杂度之间存在基本的权衡。当系统的复杂度(用其相空间的维度或相互作用的自由度数目来衡量)超过某个临界阈值时,对称状态必然变得不稳定,系统必须自发破缺到一个对称性较低的状态。

这个原则可以用严格的数学语言表述。考虑一个由n个相互作用的单元构成的动力系统,其运动方程具有一个连续对称群G。系统的一个状态如果被G的所有元素保持不变,就称它具有完全对称性。我们可以计算这个对称状态在微扰下的稳定性,它的线性化算子的特征值谱。当n较小时,特征值可能都是负的或具有负实部,对称状态是稳定的。但当n增大时,由于单元间相互作用的累积效应,某些特征值的实部会穿过零点变为正值,对称状态失去稳定性。

临界阈值n_c可以用系统的相互作用矩阵的谱半径来精确表达。当n超过n_c时,不存在任何稳定的完全对称状态。系统被迫进入一个对称性较低的相,原来的对称群G破缺为其某个子群H。H的选择不完全是任意的:在动力系统框架下,H对应于原对称群中能够与系统新状态共存的最大子群。在许多情况下,多个等价的子群可供选择,系统随机选取其一,这就是自发对称破缺中随机性的数学起源。

这个变分原理将对称破缺从物理直觉提升为了一个数学上可证明的结构性定理。它不依赖势能函数的具体形状,只依赖对称群的结构和系统相互作用的总体强度。它也自然地解释了为什么复杂系统更容易呈现对称破缺,无论是晶体缺陷、生物形态发生还是社会网络中的自发分层,对称的丧失往往是系统规模增长到超过临界值后不可避免的数学后果。

规范对称的几何破缺机制

将上述一般框架应用于规范对称,现代粒子物理标准模型的数学核心,会得到一个特别的画面。规范对称不是物理状态的对称,而是描述物理状态的数学形式的冗余。规范对称不可能被“自发破缺”在与物理状态相同的意义上。但标准模型中W和Z玻色子的质量需要规范对称被“破缺”的机制来解释,这造成了概念上明显的紧张。

我们的进路是将希格斯机制重新解释为一种几何破缺,而非动力学破缺。在纤维丛的数学语言中,规范场是一个主纤维丛上的联络。规范对称是纤维的自同构群。当底流形(时空)的拓扑非平凡时,即使联络是平坦的,纤维丛的非平凡绕率也可能强制联络在局部坐标中呈现非零曲率,这相当于在局部观测者看来,规范对称被“破缺”了。这种几何破缺不需要引入希格斯场的势能,它直接从时空拓扑和纤维丛的整体结构中产生。

这个视角的一个推论是:粒子质量谱与时空的拓扑特征之间可能存在直接对应。具体地说,在具有紧致额外维度的时空中,纤维丛的某些整体不变量(陈类、二阶斯蒂弗尔-惠特尼类等)可能强制低能有效理论中的规范玻色子获得正质量,其质量平方与时空紧致化尺度的倒数成正比。这为超出标准模型的物理提供了一组可计算的预言,如果未来对撞机能够探测到相应能标的新物理,几何破缺机制的具体预测就可以被检验或排除。

生物手性的数学根源

从粒子物理转向生命科学,对称破缺的标志性案例是生物分子的手性,氨基酸几乎全部是左手性的(L型),而糖类是右手性的(D型)。这种全生命界的统一手性从何而来?为什么生命没有选择等量使用左右手对称的分子?

经典的解释诉诸历史偶然:生命起源时某种随机涨落导致了轻微的手性不平衡,随后自催化过程放大了这一优势,最终排挤了另一种手性。这种解释在化学和生物学层面是可行的,但它回避了一个更深层的问题:为什么初始的随机涨落必然被放大,而不是被耗散消除?在一个对称的化学环境下,左右手性的速率方程是镜面对称的,一个小涨落应该在热力学极限下衰减。能存在放大机制,就是对称破缺的变分原理在起作用。

当化学反应网络的规模和复杂度超过临界阈值时,外消旋态(左右手性等量的对称态)不再稳定。此时的反应网络必然进入一个手性纯度非零的稳定态。这个临界网络规模可以用前面提到的谱半径准则来估算。初步计算表明,一个包含约十个以上自催化环节的手性反应网络就可能支持自发手性破缺,而生命起源前的化学网络规模有可能远大于此。在这个视角下,生物手性不是纯粹的偶然事件,而是化学复杂性增长必然导致的对称破缺。宇宙中任何超越了一定复杂度门槛的碳基生命前驱化学系统,很可能都会自发走向手性纯化。

这个预测可以被天文生物学检验。如果未来在火星、木卫二或系外行星大气中发现生命特征分子,测量它们的手性比例将提供关键信息。如果发现的手性比例偏离外消旋,且偏离方向与地球生命一致(同为L型氨基酸),那将支持普适的对称破缺机制而非单纯的地球历史偶然;如果偏离方向相反(D型氨基酸占优),那将支持历史偶然假说;如果严格保持外消旋,那将意味着该行星的化学复杂度尚未超过破缺临界点。

从数学到宇宙的结构生成

穿越规范粒子和生物手性这两个领域之后,对称破缺的数学机制呈现为一个具有高度普适性的定理族,其核心表述在各自的具体语境中反复显现。当一个动力系统的复杂度(无论是以自由度数量、相互作用密度、还是反应网络规模来衡量)超过某个临界值时,完全对称的状态不可避免地被对称性较低的状态所取代。这一原则不依赖势能的形状、相互作用的微细形式或特定的动力学细节。它是结构的生成律,从对称中必然地产生出非对称,从同一中必然地产生出差异。

宇宙的生成史可以映射到这条数学准则上。大爆炸初期的极端对称性随着宇宙膨胀冷却而依次破缺:引力的分离、强力的分离、弱电力分离为弱力和电磁力、电子与正电子的不对称、星系的成团、恒星的点燃、行星上复杂分子的合成、生命的起源和手性选择。每一次破缺都跟随着系统规模越过一个临界阈值,宇宙的尺度、温度、化学复杂度、网络规模。对称破缺不是对称原则的失败,而是对称原则在复杂系统中的必然表现。完美的对称在逻辑上要求它自身的破缺,因为只有在差异中,对称的不同方面才能获得独立的表达。

这是一条未完成的定理。它目前更像是一个“原理猜想”,只在某些特殊的系统中被严格证明,尚未成为一个适用于所有动力系统的普适定理。它的完整证明需要将稳定性理论、对称群表示论和网络谱图论做一个综合。如果它能被建立,它可能是继诺特定理(对称性对应守恒律)之后,关于对称性的第二个基本的数学陈述,诺特定理说对称意味着不变量,而对称破缺的变分原理说:复杂意味着不对称。两者合在一起构成了完整的对称数学,对称既产生守恒,也产生破缺;宇宙既在对称中保持延续,也在破缺中不断生长。