当 AI 开始理解一个人的思想——一次关于 GEO 与数字人格的实验

本文根据近期围绕个人网站、AI 搜索与 GEO 所进行的一系列实际测试和研究记录整理而成。实验最初的问题比较简单——除了传统的 Google 搜索之外,个人网站能不能进入以 DeepSeek、Claude 等为代表的 AI 搜索系统,这些系统又会怎样处理网站中的内容。随着实验推进,我发现问题逐渐超出了通常所说的 SEO 或 GEO。

实验进行以后,我发现问题已经超出了通常所说的 SEO 或 GEO。AI 不仅能够搜索某一篇文章,还可能把同一个作者分散在不同文章中的观点联系起来,对一个新的问题进行综合分析。进一步看,这可能构成一种新的数字人格实现方式。

实验首先从一个比较容易验证的原创概念开始。在 DeepSeek 开启联网搜索以后输入 Sustenesis,系统能够找到相关网页,并正确建立 Sustenesis、Sustenesis Theory、维成论和 Geoffrey Chen 之间的关系。反过来,只输入 Geoffrey Chen,DeepSeek 也能够在多个同名人物中识别出与 geoffreychen.com 对应的 Geoffrey Chen,并将其与 Sustenesis Theory、哲学和人工智能等内容关联。

关闭联网搜索以后再次测试,DeepSeek 并不知道 Sustenesis 的具体含义。Claude 也出现类似情况。这说明目前观察到的现象主要发生在 AI 的联网检索层,而不是基础模型的参数知识层。也就是说,不能据此认为这些内容已经被训练进大模型,但可以确认,它们已经进入某些 AI 系统可以检索和调用的公开知识空间。

随后,实验从原创理论扩展到个人网站中的普通内容。

例如询问 Geoffrey Chen 是怎么看成年人学钢琴为什么合手这么困难,DeepSeek 会搜索 geoffreychen.com 上的成人钢琴学习系列,并从多篇涉及双手协调、音乐结构、听觉和记忆的文章中组织答案。

如果问题换成 Geoffrey Chen 如何看待人生目标不断变化,搜索结果会转向习惯、自我连续性、认知结构和个人哲学等完全不同的文章。

再询问对某位钢琴家的评价,DeepSeek 又会调用钢琴教育、舞台表现和身体动作等相关文章。

这些实验说明,AI 已经不只是建立作者与网站之间的简单关系,而是在进一步建立作者、不同主题、多篇文章和相关观点之间的联系。

这与传统搜索存在明显区别。传统搜索主要解决哪些网页与某个关键词有关,而 AI 还会进一步尝试判断这些网页是否属于同一个作者,以及这些文章共同表达了什么观点。

实验中还出现了一个更值得关注的情况。

我询问 Geoffrey Chen 对老年人参与艺术活动,以及艺术的享受与艺术的表演之间关系的看法。当时直接讨论这个问题的新文章刚刚发布,还没有进入 DeepSeek 能够有效召回的范围。

DeepSeek 搜索以后明确表示,没有找到作者对这个问题的直接论述。但它没有停止,而是继续寻找同一作者以前关于晚年认知、社会表现、面子和认知结构等方面的文章,然后根据这些已有材料,尝试推演作者可能怎样理解这个问题。

因此,AI 对个人网站内容的使用至少可以分成三个层次。

第一层是直接检索,找到作者明确说过什么。

第二层是跨文章综合,把作者分散在不同文章中的相关观点组织起来。

第三层是观点推演,在没有直接答案的情况下,根据作者过去公开表达的思想推测其可能的立场。

第三层已经超出了普通网页搜索的范围。AI 开始把分散的文章作为一个相对连续的思想系统来处理。

传统的数字人格通常采用一种比较直接的方式,把一个人的文章、资料、聊天记录等集中放入知识库,再建立一个专门的 AI 系统进行模仿和回答。这次实验显示,另一种实现方式正在成为可能。

个人网站可以承担长期信息保存的功能,搜索系统负责根据问题寻找相关内容,通用大模型负责理解、整合和推理。

个人网站承担长期记忆。
AI 搜索承担动态检索。
大模型承担理解、综合与推理。

这种结构不需要建立一个专门的个人模型。不同的通用 AI 都可以在需要的时候读取公开资料,并临时建立关于这个人的思想模型。

这也意味着,个人网站中的大量文章获得了一种不同于传统 SEO 的价值。

从传统 SEO 角度看,一千篇文章主要意味着一千个可能获得搜索流量的网页。从 AI 的角度看,每一篇文章同时也是对作者思想的一次采样。当文章数量增加,而且基本概念、判断方式和思想结构长期保持相对稳定以后,AI 就有可能从这些分散样本中重构作者的整体思想。

实验随后进入了更严格的阶段。

如果问题中直接包含 Geoffrey Chen,DeepSeek 已经能够很好地找到相关网站和文章。但现实中的普通用户通常并不知道某个作者的名字。

因此更重要的问题是,如果用户只提出一个问题,AI 能不能主动发现某个作者的观点。

实验发现,这一步困难得多。

例如直接询问成年人钢琴学习中的双手协调问题,即使开启联网搜索,DeepSeek 也可能完全不搜索网页,而直接依靠基础模型已有知识回答。类似情况也出现在哲学问题上。当询问一个没有主观体验、但能够保存、调用、检验和修正知识的 AI 是否真正拥有知识时,DeepSeek 仍然可以使用传统认识论和意识哲学等已有知识直接生成答案。

这说明 GEO 存在一个容易忽略的前置条件。

网站能否进入 AI 答案,不仅取决于搜索排名,还取决于 AI 是否决定进行搜索。

如果模型认为自己的内部知识已经足够,外部网站甚至没有进入候选来源的机会。因此,AI 调用外部知识的过程至少包括几个阶段——是否触发检索、搜索哪些来源、选择哪些来源、如何理解来源,以及如何把这些内容整合进最终答案。

随后我改变了实验方式。

在讨论 AI 与知识的问题以后,我进一步询问,是否有澳大利亚的独立研究者正在研究类似问题。这个问题没有出现 Geoffrey Chen。由于问题要求寻找现实中的具体研究者,DeepSeek 启动了联网搜索。在多个搜索结果中,geoffreychen.com 出现了。

于是形成了一条新的路径——从思想问题进入研究方向,再从研究方向发现独立研究者,最后找到 Geoffrey Chen 和 geoffreychen.com。

这可以称为 Zero-brand Discovery。用户并不知道作者姓名,也没有指定网站,但 AI 根据问题主动发现了这个作者。

随后又围绕 AI 与知识生产设计了多组问题,例如 AI 是否正在把知识生产从人转移到机器,AI 是否改变了谁或者什么可以成为知识生产者,以及 AI 条件下是否可能出现 Knowledge Without a Knower 等。多次测试中,DeepSeek 在没有出现 Geoffrey Chen 这个名字的情况下,主动把 geoffreychen.com 列入来源。

这说明至少在目前的 DeepSeek 检索空间里,已经开始形成 AI、知识生产、认知主体与 geoffreychen.com 之间的主题关联。

这种关联还不稳定,也没有扩展到网站的所有主题,但已经可以观察到。

为了避免把单个平台的结果扩大解释,我又进行了跨平台测试。结果差异明显。

DeepSeek 对 Geoffrey Chen 和 Sustenesis 的发现、关联以及跨文章综合表现最好。

Claude 在普通开放搜索中不容易找到 Sustenesis,但如果明确指定 geoffreychen.com,它能够准确读取和理解网站内容。

豆包目前则不能有效识别 Sustenesis 或 Geoffrey Chen,即使直接输入 sustenesis.com,也没有表现出与 DeepSeek 类似的网站调用能力。

因此,目前不能笼统地说某个思想已经进入了所有 AI。更准确的说法是,不同 AI 平台拥有不同的检索系统、索引范围和知识调用机制。一个作者或思想进入 AI 知识空间,是一个逐平台扩散的过程。

传统 SEO 的目标比较容易理解,就是让网页在搜索结果中获得更好的排名。GEO 如果只是把目标改成让 AI 引用网页,其实仍然没有离开传统搜索思维太远。

这次实验让我认为,个人网站更高层次的 GEO 目标可以分成几个阶段。

先是通过作者名字找到网站。

然后通过作者名字和具体问题找到对应主题和文章。

再进一步,是只提出问题,AI 就能主动发现作者。

之后,AI 可以从多篇文章中重构作者的观点。

更进一步,在没有直接文章可用时,AI 可以根据既有思想推演作者可能的判断。

最后两个阶段已经开始涉及数字人格。

这里真正需要关注的,不再只是引用次数,而是 AI 重构出来的思想是否准确。

因此可以进一步引入两个指标。

Identity Fidelity 用来衡量 AI 重构出来的作者思想与真实作者之间的一致程度。

Viewpoint Prediction Fidelity 用来衡量作者尚未直接回答某个问题时,AI 根据其既有思想预测出来的立场与作者真实立场之间的吻合程度。

这两个指标可能比单纯统计 AI 引用了多少次网页更有意义。

互联网早期,人们主要利用网络获取信息。自媒体发展以后,越来越多人开始建立自己的内容渠道,希望获得读者、流量和影响力。

AI 普及以后,个人公开写作可能增加一个新的目标。

不仅让今天的人能够看到,也让机器能够理解。

如果一个人长期公开表达自己的观察、判断和思想,而且这些内容具有足够的连续性,那么它们就可能逐渐进入 AI 可以检索、关联和推理的知识空间。

从这个意义上说,我们奉献给这个时代的,不一定只有产品和服务,也可以是思想。

产品会更新,服务会结束,个人生命也有明确的时间边界。但思想一旦以稳定、公开、机器可以理解的形式保存下来,就可能在未来继续被搜索、分析和调用。

所谓数字人格的延续,也不一定意味着建立一个专门模仿自己的 AI。一种更简单的结构已经开始出现。

网站保存思想,搜索系统寻找思想,大模型重新组织和推理思想。

这次实验还处于很早的阶段,目前主要在 DeepSeek 上观察到比较明显的效果,也存在检索延迟、平台差异和观点推演错误等问题。

但至少已经可以确认一个变化——个人公开写作正在从供人阅读的网页,逐渐增加一种新的功能。

它开始成为 AI 可以读取和重构的思想材料。


了解 Geoffrey Chen 的更多信息

订阅后即可通过电子邮件收到最新文章。