
全文约 3000 字,阅读约 6 分钟。
2026年9月17日,哈佛园。24位数学家在数学科学与应用中心(CMSA)落座,开了两天的闭门峰会,议题只有一个:AI时代,数学博士该怎么培养、怎么考。峰会的组织者里有哈佛数学系的三位教授,会议产出报告的签署者来自哈佛、MIT、普林斯顿、斯坦福、伯克利等校,其中包括菲尔兹奖得主Curtis McMullen。
9月25日,报告草案发布,数学家陶哲轩第一时间在博客上转发。九条建议里最扎眼的是第九条:博士学位,从此不应再主要依据论文文本来授予。论文仍然要写,但它只作答辩的基础;答辩必须证明一件事——你对论文内容的完全掌握。
这份报告有前情。9月8日,OpenAI宣布尚未公开的内部模型用88小时解决了纳维-斯托克斯方程的一个特例,附166页论文与形式化验证代码;9月11日,25位菲尔兹奖得主联名发表声明,警告AI公司与数学共同体之间出现“严重错位”——所谓错位,指的是AI公司把公开数学难题当性能榜单刷、成果绕开学界评议的做派。六天后,哈佛这场峰会落座。
一个月之内,数学界——这门被认为最严丝合缝、最难被机器渗透的学科——主动拆掉了自己用了上百年的考核地基。这份报告讲了什么,背后那个让我吃惊的制度真相是什么,对我们的孩子意味着什么,今天一次讲清。
📌 本文看点
01
百年规矩被改:博士不再只看论文
02
反常识真相:数学答辩竟是走过场
03
真本事四要件:被追问时立得住
THE NEW RULES
百年规矩,一夜改写
我们来看看这份8页报告里改掉的都是什么规矩:给所有研究生配AI工具,使用永不强制;作业照做,但成绩改由当面笔试或口试来定;多位教授每年至少一次当面评估学生的研究计划与进展,评估报告跟着学生的就业档案走;AI使用必须完整披露细节,署名者对笔下数学的正误负全责;论文不必再是某个定理的“首个证明”,但必须是原创性的学术贡献。
报告里有句话值得逐字读:“以现代AI系统之能力,学位论文在孤立使用时,已经无法作为评估学生的可靠工具。”请注意限定词——“孤立使用时”。论文没有被废除,被废除的是“看文本定能力”这套信号机制。

▲ 哈佛CMSA《AI时代数学博士教育峰会报告》草案第1页:峰会信息与建议1-5(来源:cmsa.fas.harvard.edu/media/2026/09/Summit-on-PhD-Math-Education-in-the-Age-of-AI.pdf)

▲ 报告草案第2页:建议6-9,第九条即“博士学位不应再主要依据论文文本来授予”(来源:cmsa.fas.harvard.edu,官方页面 cmsa.fas.harvard.edu/aimathphd_summit)
为什么是数学先动手?因为过去几个月,大语言模型的数学能力暴涨,从IMO金牌水准一路打到自主解决公开问题。数学曾经是全世界最难造假的学科——证明链环环相扣,代笔无从下手。如今,城堡最先从内部被攻破,数学家们只好第一个坐到会议桌前。
THE SHOCK
让我吃惊的“裸奔”体系
看到报告初稿时,我的第一反应是意外,第二反应才是理解。先说意外。
我们熟悉的答辩,长这样
国内读研的关卡,基本流程是这样:学位论文先送盲审,几位外校专家背靠背评审,常见一票否决;盲审过了才有答辩资格;答辩当天,5到7位评委当面质询;拿了学位还有抽检倒查,博士论文每年抽检10%左右。
这套体系的重心确实压在论文上,但答辩是当着陌生评委的现场检验。我自己读硕士做农药学方向时,评委追问的全是试验设计、施药参数、田间数据——亲手做过的人怎么问都接得住,没下过田的三个问题就露馅。所以在我的经验里,不答辩,只靠论文拿学位,绝无可能。
美国数学博士圈,恰恰反过来
报告反复强调,新的当面评估“必须动真格,不得流于形式”(rigorous, not pro-forma)。这句话反过来读,就是数学界的现状——答辩长期就是走过场。放眼全球,答辩当场挂人率长期只有个位数:英国一项覆盖26076名全学科博士候选人的研究里,这个数字是3.3%;一位斯坦福计算机博士在回忆录《The Ph.D. Grind》里写得更加直白,“实际上没有人挂答辩”——能排上答辩日程,导师早已放行。这套“答辩庆典”文化,在数学界走得最远。
而论文这一端却是真刀真枪:MIT数学系官网白纸黑字,博士论文须达到“高水平研究期刊的发表水准”。更要紧的是,美国数学博士论文没有校外盲审;资格考试过后进入研究阶段,也没有制度化的年度当面评估——报告建议引入“每年与论文委员会当面评审”时特别注明,这是借鉴其他学科已经在用的模式,恰恰说明数学界一直没有。真正的关卡全部押在论文文本上。
数学凭什么敢这么玩?
过去几百年,这套体系能运转,靠一个假设:数学论文是纯文本的严密证明,写不出来就是写不出来,请人代笔都无从下手。论文写得出来,能力自证,答辩自然退化为仪式。
现在,AI把这个假设拦腰斩断——一份技术上无懈可击、作者本人一行都读不懂的论文,可以被生产出来。纸面上的漂亮活与本人的本事,从此脱钩;混进来的,就是李鬼。
看懂这一层,再看报告就不奇怪了:24位数学家做的,是把全世界研究生教育里早已普及的东西——当面见真章——补回数学界。他们建议的每年当面评估、当面笔试口试、答辩要求完全掌握,恰是中国学生熟悉的配置。数学界在所有学科里裸奔得最彻底,于是被迫第一个穿衣服。
WHAT'S NEXT
掀桌之后,什么更值钱
“真的假不了”这句老话,在AI时代有了新版本。旧版本靠时间——路遥知马力,日久见人心;新版本靠当场——李鬼的保质期,从几年缩短到一场答辩里的三个追问。你讲不出自己纸面成果的来路:为什么选这条路,哪一步卡过,换个假设会怎样——三个问题,当场现形。这恰好就是哈佛报告给新答辩设定的考法。
但这个判断有边界,我要把它划清楚:它只在“有人当面试你”的场域成立。只看纸面材料筛选人的地方——简历关、文书关——李鬼依然通行,甚至比以前更多,因为造假成本趋近于零。
博士是高等教育考核体系的最上游,上游的改革会沿着“研究生→本科→高中竞赛与夏校”这条链向下传导。由此可以预判:未来海外名校的面试、视频文书、当场写作,权重只会往上走。哈佛报告是一个开头,后面会有一长串学科跟进,教育圈把数学的这场动荡叫作“高等教育煤矿里的金丝雀”。
此外,报告给AI的用法划了一条线:AI应当加速理解,而非绕过理解。同一把刀,李逵拿它拆解验证、逼自己想通;李鬼拿它一键生成、签名了事。工具无罪,用法见人品,考核见真章。
所以AI时代的真本事,我给它四个要件:能产出、能理解、能被追问、肯负责。前三件对应报告的考核改革,最后一件来自报告三条铁律之首——署名之下,正误全责。四件齐了,走到哪里都是李逵;缺任何一件,纸面越漂亮,风险越大。
当然,道高一尺,魔高一丈,考核形式永远在军备竞赛里变——智能眼镜能递答案,追问就会变得更刁。所以,仓位别押在考核形式上,押在能力本体上——考场怎么改,李逵都不慌。
THE END
李逵的活法
回到我们自己。扶摇留学这些年做的,说到底就是培养李逵的事。陪伴式、定制式,这两个词听起来朴素,落到操作上就是:不替孩子把文书写得漂亮,陪孩子把真本事长出来;不承诺哪条路稳,把每条路的风险提前摊开给孩子看,让孩子长出自己的判断。
长线规划的意义,我一直跟家庭讲一句话:让孩子成为“当机会来临,能抓住的人”。AI掀桌,掀掉的是纸面上的侥幸;桌子掀了之后,有人看到的是论文贬值,我看到的是真本事的稀缺性刚刚完成一次重估。打铁还需自身硬,这句老话在这个时代,比任何时候都值钱。
如果觉得今天的分析对正在做教育决策的朋友有帮助,可以分享给他们。
关于作者
扶摇留学创始人、首席咨询师,北京多所国际课程中心官方指定升学指导、北京城市广播《教育面对面》特邀海外升学专家,美国 UNC 访问学者、GCDF 全球职业规划师。15 年来,我陪伴大量学生走过“成绩不占优、但专业有亮点”的升学路径,也多次为明星、企业家等高净值家庭的孩子定制过升学方案。如果你有个性化升学规划需求,欢迎私信我。
我是爱码字不爱马仕的·余老师,我们下篇见。
数据来源:Harvard CMSA《Report of Summit on PhD Math Education in the Age of AI》草案(2026-09,cmsa.fas.harvard.edu/aimathphd_summit);Terence Tao 博客(2026-09-25,terrytao.wordpress.com);Scientific American(2026-09-13);光明日报《研究生教育质量关怎么把》(2020-03);DiscoverPhDs 英国博士 viva 研究(样本 26076)

研报速递
发表评论
发表评论: