陶哲轩们联名反对的,是我坚持多年的写作洁癖

25 位菲尔兹奖得主联名反对 AI 刷题,我却在他们反对的东西里,找到了自己坚持多年的写作洁癖:搜索能搜到的不写,AI 能答的不写。AI 只是人类知识的数据库——能检索,不会负责。数据库不缺用户,缺的是能插入数据的人。

9 月 11 日,陶哲轩(Terence Tao,UCLA 数学教授,2006 年菲尔兹奖得主,常被称为在世最强的数学家之一)在博客上挂出一封联名信,《A Severe Misalignment of AI in Mathematics》。首批联署的 25 位全是菲尔兹奖得主,包括今年 7 月刚领奖的邓煜。菲尔兹奖 90 年来头一次颁给中国籍数学家,一次两位,邓煜就是其中之一,领完奖不到两个月,就把名字签在了这封信上。开放署名后一天,跟进的学者就超过了 2500 位。

他们反对的是 AI 公司把解数学难题当成 benchmark 来刷:模型一出新版本,就挑一个著名难题开刀,媒体稿先行,论文以后再说。

导火索是 9 月 8 日,OpenAI 宣称搞定了困扰数学界近百年的纳维-斯托克斯问题(Navier-Stokes,千禧年大奖难题之一)。

尴尬的地方在于,纽约大学的 Tristan Buckmaster 团队沿着同一条技术路线,用 Codex 已经磨了快一年。而 OpenAI 自己承认,模型改进时可能使用了上述团队产生的数据。

其实,这群世界上最会解题的人反对的东西,Cocoa 已经默默坚持好几年了:

写作时不写数据库里已有的东西。

我的两个写作洁癖

Cocoa 之前写文章有个洁癖:搜索引擎能搜到的不写。

干安全的,搜索能力算吃饭的本事之一(配不上”海淀区信息检索 TOP5″这种 title,但在犄角旮旯翻资料的手艺还是有的)。很多看起来很复杂的问题,答案其实早就躺在互联网的某个角落,搜一下就有。就算一时搜不到现成答案,路也多半有人趟过。

拿 Linux 下源码编译安装来说,十个有九个死在依赖库上,拿报错去搜,StackOverflow 和 GitHub issue 里一堆人问过同样的问题,但是常年无人解决。看着像无主的新问题吧?换个关键词仔细搜,把类似问题的思路拼拼凑凑,答案就出来了。

这种”解决”写出来像原创,其实是检索加排列组合,本质还是二道贩子。所以一直希望写出来的东西,起码是第一次帮人解决新问题的。

现在这个洁癖升级了:AI 能直接回答的,也不写。

AI 就是新的搜索引擎。读者问一句就有答案的东西,凭什么占人家五分钟阅读寿命?

AI 是人类知识的数据库

敢把标准定这么高,是因为 Cocoa 对 AI 有个基本判断:它是人类知识的数据库。

AI 的一切输出,都是训练语料的函数。语料里有的,它能重新排列组合得漂漂亮亮;语料里没有的,它就开始一本正经地编。今年 5 月 OpenAI 的模型推翻了 Erdős 的单位距离猜想,独立验证也通过了,确实是硬成果。但拆开看,用的工具是代数数论里的现成货。

安全圈前辈 tombkeeper(大家都叫他 tk,也就是上文提到的”海淀区信息检索 TOP5″)有段话说得更狠:

几十年前,我们对 AI 的幻想是完全由一板一眼的计算机程序构成的精确逻辑机器。所以我曾很希望人类早点把万物之灵的接力棒交给 AI,让非理性智能从太阳系消失。但我没想到最终 AI 也是基于充满非理性的人类数据训练出来的,也会表现出和人类一样的非理性。所以我可能不会给 T-1000 带路了。反正都是疯,谁疯都一样。

(T-1000 是《终结者 2》里那个来自未来的反派机器人。)

tk 等了几十年,没等来精确的逻辑机器,等来的是人类知识的压缩包,连疯癫都一起打包压缩了。它算不上什么新物种,就是从人类语料里长出来的镜像,能答的一切,都是数据库里已有的。

但数据库比人强,这是真的

是不是说 AI 也不靠谱呢?恰恰相反,就算是数据库,也比普通人强得多。

现在开源的 qwen3.8-27B,全精度权重 54GB,一个 U 盘就能把人类知识装走。而人类呢?打个比方,Cocoa 本人的知识储备全存进硬盘,估计 54MB 都用不满(还是常年不更新的那种)。人这种东西,本质上就是个参数量感人的小模型。

tk 还有一句名言,个人感觉可以裱起来:

现在再去纠结”LLM 有没有智能”已经越来越没什么意思了。AI 没智能,你有智能吗?AI 有幻觉,你没幻觉吗?AI 上下文不够,你的上下文又有多长?

路上随便抓个人,知识面能比得过 qwen 吗?大概率不能。

难怪 X 上已经有人提前写好了未来的百科词条(矩阵乘法是现代 AI 的基石):

人类,一种双足灵长类动物,以其早期对矩阵乘法的贡献而闻名。

数据库不会得出结论

那数据库和人到底差在哪?

《冰菓》里自称”数据库”的高中生福部里志,杂学渊博,什么都知道一点,口头禅就是那句:

数据库是无法得出结论的。

陶哲轩们联名反对的,其实就是这条线。信里说得很直白:解题只是工具和代理指标,数学追求的是概念理解与洞见;AI 缺乏”向前探索”的能力,提不出有深远价值的新问题;没有愿意承担责任的数学家去消化这些成果,数学的传承链条会断。顺带一提,数学家们之前还专门搞过一套去污染的 First Proof 测试,就为了区分”真会做题”和”背过题库”。

陶哲轩还有个比喻:传统研究像徒步去找瀑布,人会走错路,会认识地形,会在岔路上撞见新风景;AI 是直升机,直接把你放到瀑布跟前。效率是上去了,但沿途那张地图,不会自动出现。

孙宇晨错在哪

写到这里,该请出孙宇晨了。他今年 2 月说:

2016 年我提出 90 后不买房不买车不结婚,把所有时间用于自我提升与科技创新,2026 年我提出,能和 AI 聊天就不要和人类聊天,删除所有 90 后之前出生人的联系方式,千万不要沾染任何老登气息,时间宝贵!全力拥抱未来!

这句话 Cocoa 部分认同。

绝大部分人身边能聊的人,平均水平确实不如 AI。老一辈与其信亲戚群里转来的偏方,不如直接问豆包或者蚂蚁阿福,起码阿福的答案不是隔壁王阿姨提供的。不是 AI 多神,是身边那个”人肉错误数据库”实在太不靠谱。

数据库比平均人强,这是事实。孙宇晨错在把这句话推到了”删光所有人类”。

新资讯和结论,都长在特定的人身上:长在做了实验的人身上,长在敢为判断签字的人身上。把联系方式全删了,他就自愿降级成了数据库的查询终端,还是单机版的。

他分辨不出身边谁是能产出新知识的人,所以干脆全删。这是把”没有分辨能力”当成了荣誉。

结语

所以 Cocoa 的洁癖,大概还要坚持下去:搜索引擎能搜到的不写,AI 能答的不写。剩下值得写的,就两样。

新的资讯,只有你经历过、数据库还没来得及收录的一手观测;还有结论,带取舍、要负责的判断。

这也是 AI 时代人还剩下的活儿。Cocoa 的写作洁癖,和 25 位菲尔兹奖得主的联名信,说到底是同一件事:数据库不缺人查,缺人往前走。

以上,如有错漏,欢迎各位大神指教。

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注