做深度研究,ChatGPT、Gemini与Perplexity分别适合什么?

《AI工具怎样选?》· 第二篇

假如要研究“澳大利亚成年人为什么重新学习钢琴”,你可能希望知道市场规模、学习动机、课程形式和中途放弃的原因。把问题交给深度研究工具,几分钟或十几分钟以后,一份结构完整、带着许多引用的报告便会出现。

这项能力很容易给人一种错觉:原来需要数天的研究已经完成了。更准确的说法是,一部分搜索、筛选和初步综合被迅速委托了出去。报告可能帮助你发现资料,也可能把来源性质不同的内容写进同一段,把一个行业预测和官方统计放在近似的位置。引用数量很多,不等于研究问题已经获得可靠答案。

所以,比较ChatGPT、Gemini与Perplexity的深度研究,不能只看哪一份报告最长,也不宜只数引用。真正需要观察的是:研究开始以前,用户能否限定资料;运行过程中能否改变方向;报告完成以后,依据是否容易检查;结果又怎样进入下一步工作。

三种工具正在完成相似任务,但起点不同

三者都已经远远超过“搜索一次,摘要几个网页”的阶段。它们会把问题拆分,连续搜索,在发现新线索后继续查找,然后形成一份较长的报告。相似之处很明显,差异主要藏在来源入口与后续去向里。

工具 研究前的主要控制 研究中的可见性 报告的后续去向
ChatGPT Deep Research 公开网页、上传文件、连接的应用;可限制或优先指定网站,并编辑研究计划 可查看进度,中途打断并调整焦点或来源 带引用和活动记录的报告,可下载为Markdown、Word或PDF
Gemini Deep Research 默认使用Google Search,也可加入或改用Gmail、Drive、上传文件和Gemini Notebook;可编辑计划 研究完成后在对话与Canvas中查看 可复制、分享、导出到Google Docs,并可衍生音频或可视化内容
Perplexity Research 面向公开网页,也能处理上传文档;Research模式自动选择所需模型 显示研究进展与阶段性发现,可在运行中追加问题 报告可编辑、分享,并导出为文档、PDF或Perplexity Page

表格描述的是官方产品设计,并不能证明某个工具会在所有主题上找到更好的来源。深度研究的实际质量还受问题表述、网页可访问性、语言、地区、主题专业程度和当时可用模型影响。

当你已经知道“应当去哪里找”

有些研究并不是开放地寻找尽可能多的网页。法律、公共政策、产品规范和机构历史往往有一组优先来源。研究澳大利亚失业定义,应先看Australian Bureau of Statistics的方法文件,而不是让博客数量决定答案;分析某个软件功能,官方文档和发布记录通常比比较网站更接近事实。

ChatGPT Deep Research目前允许用户指定网站,并选择只搜索这些网站,或在保留全网搜索时优先使用它们。研究计划可以在开始前编辑,运行时也能中断并调整。这种结构适合一个常见处境:问题复杂,但你对证据等级已经有初步判断,希望系统扩大阅读量,却不希望它自行改变资料边界。

这里的优势不是“ChatGPT一定更准确”。来源限制也会产生新的盲点。如果你指定的机构本来就遗漏了关键争议,系统只在这些网站中搜索,会把人的选择偏差稳定地延续下去。更稳妥的做法是把来源分成两轮:第一轮限定原始资料,确认制度事实;第二轮开放搜索,寻找批评、反例与尚未纳入的研究。工具提供控制,使用者仍要对控制方式负责。

ChatGPT完成后的报告可以下载为Markdown、Word或PDF。对需要进入本地文件、版本管理或正式编辑流程的人,这种交付方式减少了一次格式搬运。它不会自动保证文章可发表,却为后续核查保留了较清楚的工作对象。

当资料本来就在Google的世界里

Gemini Deep Research默认以Google Search为来源。用户也可以加入个人Gmail、Drive、上传文件与Gemini Notebook;不需要公开网页时,还可以取消Google Search。它同样会先形成研究计划,允许用户修改后再开始。

这种设计的价值很容易在一般排行榜里消失。假如你正在准备一个项目回顾,关键材料散落在Drive文档、往来邮件和已有Notebook里,研究的难点并非找到更多公开网页,而是把内部时间线与外部变化放在一起。一个能够在授权范围内接近这些材料的工具,会减少下载、上传和反复说明背景的劳动。

Gemini的报告可以进入Google Docs。这看似只是一个导出按钮,对于本来就在Docs中协作、评论和修订的团队,它决定了报告会不会成为真正的工作文档。音频概览和可视化适合学习与演示,但不应代替来源核查。图表越容易生成,越要检查其中数字是否来自同一口径。

Google生态的便利也带来边界问题。个人Google AI计划与Workspace组织账户的权益并不完全相同,某些来源连接、管理和数据条件取决于账户类型。选择以前要确认的不是宣传页上有没有某项功能,而是自己的账户、地区和管理员设置能否实际使用它。

当研究从快速追踪公开网页开始

Perplexity长期把搜索放在产品中心。Research模式会执行多轮搜索、阅读大量来源并形成报告。2026年更新后的Advanced Deep Research还增加了上传文档处理、代码沙箱、研究过程显示、运行中的追问以及可编辑报告等能力。Research模式自动选择模型,用户不能在这个模式中指定某一个模型。

如果工作从“网上现在有什么可靠材料”开始,并且需要快速改变问题方向,Perplexity的产品结构很自然。普通搜索、追问、Research和Spaces处于相近的使用路径中。一个主题可以先通过较轻的查询摸清关键词与主要来源,再把真正复杂的问题交给Research。研究完成后,报告还能转成可分享页面。

但“搜索原生”不能被简化为“来源天然可靠”。搜索系统擅长找到可访问、可索引的内容,而最重要的资料可能藏在数据库、附件、扫描文件、付费服务或不容易抓取的网页里。排名靠前、被多个网页重复引用的说法,也可能共同来自同一个未经核实的源头。Perplexity提供引用和进度,使用者仍需打开那些决定结论的材料。

速度同样要放在正确位置。Perplexity官方说明多数Research任务可以在几分钟内形成报告。快速适合探索与迭代,不代表较慢工具一定更深入,也不能证明较快结果已经达到发表标准。研究时间应计算到关键来源被核对、冲突被处理、结论能够承担用途为止。

引用看起来正确,仍可能支持不了那句话

深度研究最常见的误判,是看到句末有链接便认为事实已经得到证明。引用至少可能出现四种问题。

链接确实谈到同一主题,却没有支持句子中的具体数字;来源支持相关关系,报告写成了因果;网页引用另一份报告,真正的方法与样本并不在当前页面;或者原文有地域和时间限制,综合报告把限制删掉了。

核查不需要平均检查每一行。先找出承重主张:如果这句话错了,结论是否会改变?市场规模、法律门槛、风险比例和产品价格通常属于这一类。打开原始来源,确认单位、日期、样本和限定。然后抽查几条非核心引用,观察系统是否存在一贯的夸大倾向。若发现问题,不要只修一句话,还应重新检查同类主张。

研究工具也可能提供很长的来源清单,却在正文中只使用其中一部分。来源数量不应成为质量指标。更好的报告让读者知道哪些证据支撑了哪些判断,并把找不到可靠答案的地方保留下来。

三类任务,各自更自然的起点

如果研究对象具有明确的权威来源层级,而你希望在开始前控制网站范围、修改计划,并把报告带入本地或Word编辑流程,ChatGPT Deep Research是值得优先尝试的起点。这个建议来自工作流结构,不是对所有主题准确率的总评。

如果核心资料已经位于Gmail、Drive、Docs或Gemini Notebook,研究还需要回到Google文档继续协作,Gemini减少资料搬运的能力更有实际意义。选择前应核实个人账户与Workspace账户的具体可用性。

如果主要工作是追踪公开网页、迅速建立某个新领域的资料地图,并在连续追问中调整焦点,Perplexity Research的搜索中心结构比较顺手。后续若要正式发表或作出高风险决定,仍应把关键来源另行保存与核查。

还有很多任务不该立刻使用深度研究。一个明确事实可能用普通搜索更快;只分析三份指定文件时,来源型Notebook或Project更合适;问题尚未形成时,先与普通聊天工具澄清概念,可以避免自动生成一份回答了错误问题的长报告。

一个更可靠的使用顺序

深度研究开始以前,先写一小段“研究委托书”:问题是什么,用于什么决定,适用哪个地区与时间,哪些来源必须优先,哪些内容需要被明确区分。让工具提出计划以后,不要只看目录是否漂亮,要检查它是否遗漏反方证据、方法文件和关键定义。

报告生成后,先读结论与来源,不急着润色。把承重主张做成一张简短核查表,并记录无法确认的部分。只有事实范围稳定以后,才进入写作、演示或决策。研究工具可以在第一轮承担大量寻找与整理,却不应同时成为唯一的作者、证据保管者和最终审查者。

结论:选择你需要控制的那一段

ChatGPT、Gemini与Perplexity都能生成令人印象深刻的深度研究报告。三者之间更有用的区别,不是报告外观,而是你需要控制研究链的哪一段。

已经知道可信资料在哪里,就重视来源限制与计划编辑;材料生活在Google服务中,就计算整合减少了多少真实劳动;面对快速变化的公开网页,需要反复探索与追问,搜索中心的环境更自然。无论选择哪一个,引用都只提供核查入口,不替用户完成核查。

深度研究最好的用途,是把人从重复搜索中释放出来,使注意力能够转向来源判断、矛盾处理和问题修正。若它只让我们更快得到一份没有认真检查的长报告,速度增加了,研究本身并没有完成。

主要资料

继续阅读:《AI工具怎样选?》系列目录


了解 Geoffrey Chen 的更多信息

订阅后即可通过电子邮件收到最新文章。