← 返回AI 前沿
AI 前沿

一个能做微积分、写论文、写代码的AI,被一道"9.11和9.9谁大"的小学题难倒了——问题不出在AI笨,出在它看世界的方式

老师有没有告诉你,AI能解奥数,却分不清9.11和9.9谁大

2026-08-27 · 🕐 约 8 分钟

丢笔哥 发布

🖊️ 老师有没有告诉你…

你问AI九点一一大还是九点九大,它一本正经地告诉你:九点一一更大。

老师有没有告诉你,AI能解奥数,却分不清9.11和9.9谁大

啪——老师把笔丢在桌上。

"来,考你一道题。"他说,"9.11和9.9,哪个大?"

"9.9大。"你脱口而出。

"很好。"老师笑了笑,"那如果我问现在最聪明的AI,它会怎么答?"

他顿了顿:"它会一本正经地告诉你,9.11更大。"

你可能会愣住:一个能做微积分、能写代码、能帮人写论文的AI,居然比不出一道小学题?今天我们就来拆开这个反常识,看看AI的眼睛,到底是怎么"看"世界的。

会解奥数的AI,栽在小学题上

这不是段子,是真实发生过的事。

2024年,有网友随手问了当时最先进的几款大模型一个最简单的问题:9.11和9.9,哪个大?结果,好几款模型都答错了,坚持说9.11更大。理由还头头是道:因为11比9大啊。

更早之前,还有一个著名的"草莓测试":问AI,"strawberry"这个单词里有几个字母r?不少模型斩钉截铁地说:两个。正确答案其实是三个。

一边是能通过数学竞赛、能解释量子力学的大脑,一边是连小数大小、连字母个数都数不对的"迷糊"。这种反差,恰恰是理解AI的一把钥匙。

AI不是"看"数字,是"拆"文字

答案,藏在一个你可能没听过的词里:分词。

人看到"9.11",脑子里自动反应:这是一个数,9点11,比9.9大一点点?不,比9.9小。我们会把它当成一个整体,放进"数值"的世界里去比较。

AI不是这样。它读到的每一个字、每一个符号,都被切成一小块一小块的"碎片",这些碎片叫token。对AI来说,"9.11"很可能不是"一个数",而是三块拼起来的碎片:"9"、"."、"11"。

它没有先"算",而是先"猜":看到"9.11和9.9哪个大"这个问题,它开始预测最可能的下一段话。它见过太多"11比9大"的文本,于是顺着这个熟悉的模式,滑向了错误答案。

换句话说,AI不是在算数学,它是在做一种高级的"接话"。

数不清草莓,是同一个道理

草莓测试也是这么回事。

你问AI"strawberry里有几个r",你以为它会像小学生一样,把单词拆成一个一个字母去数。但它不是。它看到的是几个token,比如"straw"和"berry"这样的碎片。它压根没有"逐个字母扫描"这个过程。

所以它答错,不是因为它笨,也不是因为它不认识草莓,而是因为它从根上就没有"数数"这个动作。它的强大,来自另一套完全不同的机制——预测下一个词。

它读过几乎全人类的文字,学会了"什么样的文字后面,通常跟着什么样的文字"。当你给它一个问题,它就在海量的模式里,找出最像答案的那一串词,拼给你看。

这就是AI最反常识的地方:它说得越流利、越自信,不代表它真的"懂",只代表它见过的模式足够多。

这个问题,不会因为AI变大而消失

你可能以为:这是不是早期模型的毛病?等AI再长大一点、再聪明一点,是不是就好了?

答案是:不会自动好。

因为"把文字切碎再预测"这套机制,是几乎所有大模型与生俱来的工作方式。模型越大,只是"见过的文字模式越多",但"它不是真的在算数学"这件事,并没有改变。

这就好比一个背下了整本菜谱的人,你问他"三勺盐加两勺盐一共几勺",他可能张口就答错——因为他脑子里存的是一道道菜的完整做法,而不是一个随时能用的计算器。

AI的短板,不是"没学好",而是"它压根不是这么工作的"。明白了这一点,你就不会对它抱错期待。

**📖 真实故事:一份被AI算错的报价单** 一个做外贸的朋友,让AI帮他核对一份报价单,几十个数字,加起来总共多少钱。AI几秒钟就给出了一个总数,还煞有介事地列了算式。 他差点就信了。好在他多留了个心眼,用表格重新加了一遍——AI算出来的总数,和真实结果差了整整两位。 "它列算式的时候,特别自信,跟真的一样。"他后来心有余悸,"要是我直接把那个数发给客户,这单生意就黄了。" 问题就出在:AI不是"算了"一遍,而是"猜"了一个它觉得最像正确答案的数。算式是它现编的,不是它真算出来的。

反过来想:这恰恰是AI的聪明之处

说到这儿,你可能觉得AI挺不靠谱。但换个角度,你会发现一件更有意思的事。

正是这种"模糊"和"会猜",让AI能听懂人类的语言。

人说话,从来不是精确的。你说"帮我看看这个方案行不行",AI不需要先把"行不行"定义成一个精确的公式,它能从海量的文字模式里,猜出你想要的大概意思。

精确的计算,交给计算器;模糊的理解,交给AI。它俩本来就不是一个物种。你非要用尺子去称重量,自然会得出"尺子没用"的错误结论。

分清AI"擅长猜"和"不擅长算",你才算真正会用它。

懂了这一层,你就不会被AI唬住

那普通人该怎么办?记三句话就行。

第一,AI是"预测大师",不是"计算器"。需要精确计算、精确数数的事,别盲信它,让它用工具、或自己算一遍。

第二,AI越自信的时候,越要打个问号。它不会脸红,错了也理直气壮,因为它自己并不知道自己错了。

第三,把AI当"看过很多书、但偶尔会睁眼说瞎话的实习生",而不是"无所不知的神"。你负责判断,它负责提供素材。

啪——老师把笔捡了起来。

"下次看到AI解出奥数、写出论文,别急着喊'它真聪明'。"他说,"也别忘了它连9.11和9.9都比不清。聪明的从来不是机器,是懂得机器会错在哪儿的人。"

🧠 课后小测验

读完文章,测测你记住了多少?
点击选项,看看对不对

Q1.为什么AI能解奥数,却会把9.11和9.9比错?
Q2.问AI草莓这个词里有几个字母r,它常常答错,根本原因是什么?
Q3.AI生成文字的本质,最接近下面哪一种描述?
🖊️

关于丢笔哥

丢笔哥不是一个具体的人——它是一种态度。在信息爆炸的时代,用最直白的语言,把硬核知识讲透。覆盖金融证券、AI 前沿、Web3、东方智慧。

一支笔丢在桌上,一堂课就此开始。

📬 订阅丢笔哥 →

📖 继续阅读

📈 金融证券
老师有没有告诉你,央行「印钱」的时候——印钞机根本没开过
你脑中「央行印钱」的画面大概是这样:行长一拍桌子,「开机!」然后印刷厂的机器轰隆隆转起来,一车一车的钞票运出去。来,把这个画面从你脑子里删掉。真实的「印钱」,连一张纸都不需要。
01-道可道非常道-老子看透AI
02-上善若水-最成功的人像水一样没用

📬 不想错过下一堂丢笔课?

每周一篇硬核科普,用最好玩的方式讲最硬核的知识。
不卖课、不荐股、不画饼。

💬 讨论区