最近,谷歌搜索在一个简单问题上翻车了。
有用户发现,升级 AI 能力后的谷歌搜索,在面对「google 里面有几个 P」这样的问题时,给出了错误答案。问题本身并不复杂,甚至带着一点玩笑意味——Google 这个单词里当然没有 P。但搜索结果里的 AI 并没有稳定识别出来。
更尴尬的是,这类错误并不只发生在英文提问里。即使用中文问,谷歌搜索也可能答错,有时还会自行延展,给出更离谱的解释,比如把 Pixel 也牵扯进来,并误称其中有两个 P。
这不是一个孤立的拼写事故。类似的字母计数、词内字符识别问题,已经在多个词、多个语境中反复出现。甚至一些纯中文问题,也可能被 AI 搜索错误理解。
表面看,这是 AI 又一次「犯傻」。但真正值得追问的是:为什么一个被包装成下一代搜索入口的系统,会在如此基础的问题上失手?以及,当谷歌把 AI 放进搜索框,它到底改变了搜索,还是放大了大模型自身的缺陷?
搜索被 AI 接管,问题也被放大
要理解这次翻车,必须先看谷歌最近做了什么。
在今年 5 月的 Google I/O 2026 大会上,谷歌宣布对搜索进行一次重大改版,并将其称为「搜索框 25 年来最大升级」。新版搜索的核心,是重新设计后的「智能搜索框」:AI Overview 与 AI Mode 被整合进同一套搜索流程,用户输入问题后,AI 会直接生成答案,并支持继续追问。
传统链接仍然存在,但它不再是交互的中心。搜索从「给你一组可能有用的网页」,转向「我先替你总结一个答案」。
谷歌搜索负责人 Liz Reid 将这次变化定义为过去 25 年来搜索框最大的一次升级。这个判断并不夸张。面对 OpenAI、Perplexity 等 AI 搜索产品的冲击,谷歌不可能只把 AI 当作附属功能。它需要证明,搜索入口仍然属于自己。
但搜索被 AI 化之后,问题也随之进入前台。
几周前,用户在谷歌搜索框输入「disregard」(无视)这个词时,AI 并没有像传统搜索那样给出词典解释,而是把它理解成一条指令,回应称已经忽略之前的信息,并询问用户有什么新问题。谷歌很快修复了这个 bug。
现在,拼写和字母计数问题又出现了。
TechCrunch 就此咨询谷歌相关人士,对方给出的回应相当直接:在词内部数字母,一直是大语言模型的已知难题,谷歌正在修复这个特定问题。

这句话的关键不在于「正在修复」,而在于「已知难题」。换句话说,这不是一次偶然的产品疏忽,而是大模型能力结构里的老问题,被谷歌搜索这个高频入口重新放大了。
AI 不是在读字母,而是在处理 token
为什么 AI 连一个单词里有没有 P 都可能判断错?
原因并不在于它「不聪明」,而在于它理解文字的方式和人类不一样。
人类看到 Google,会自然地把它拆成 G-O-O-G-L-E。我们读一个词时,能直接感知它由哪些字母组成。字母、笔画、形状,是阅读过程的一部分。
但大语言模型并不是这样工作。它处理文本的基本单位通常不是字母,而是 token。可以把 token 理解为一种更粗粒度的语言碎片。一个 token 可能是一个完整单词,也可能是半个单词,甚至是几个词的组合。
以 OpenAI 的分词器为例,「Strawberry」会被切成「Str」「aw」「berry」三个 token。对模型来说,它接收到的不是 11 个字母,而是三个被编码后的语言单元。你问它里面有几个 r,它需要先从这些 token 里反推出字母信息,再完成计数。
问题在于,这并不是模型最擅长的任务。大模型主要被训练来预测语言、理解语义、生成上下文合理的回答,而不是像程序一样逐字符扫描。
「Google」也类似。在常见分词方案下,它很可能被当作一个整体 token 处理。此时,词内部的字母信息已经被压缩进一个抽象编号里。用户问「里面有几个 P」,相当于要求模型从一个语义编码里还原字符细节。





