返回主报告
分析对象:Perplexity Research / Advanced Deep Research 的任务入口、交互时序、报告形态与商业分层
证据基线:Perplexity 官网与帮助中心,读取日期 2026-08-24
专题结论:Perplexity 已把 Deep Research 从“等待一个长回答”升级为“可澄清、可观察、可中途纠偏、可编辑和可分享的长任务工作台”。当前产品应参照这条产品链路,但以证据版本、计划可重放和冲突审计建立更高门槛。
1. Deep Research 的真正产品单元
Research mode 将它定义为自动执行几十次搜索、阅读数百来源、迭代推理并生成综合报告的模式;模型由系统自动组合,用户不能在该模式中手选具体模型。
2026 年 7 月更新的 Advanced Deep Research 增加:
- 宽泛问题开始前的澄清;
- 研究仍在运行时追加问题;
- 展示正在阅读哪些来源、学到了什么、报告如何形成;
- 研究过程中提前呈现 key findings;
- 报告流式写入一个可编辑、完善和分享的文件;
- 更强代码沙箱与数据分析;
- 直接处理上传文档;
- 浏览更难访问的网页来源。
这些变化表明,Deep Research 的产品单元已经从 prompt → answer 变成以下工作流。
抽象示例(根据公开产品交互归纳,并非竞品源码)
Research Brief
→ Plan
→ Running Research Session
→ Progressive Findings
→ Editable Report File
→ Follow-up / Rewrite / Export / Share
这条链路比“用了多少个 Agent”更重要。
2. 用户时序拆解
阶段 A:任务定界
用户从统一搜索框选择 Research。对宽泛问题,系统先问澄清问题,再决定来源、分析深度和输出格式。
可借鉴点:
- 把“行业、地区、时间窗、受众、所需结论、禁止范围、输出格式”整理为研究 brief;
- 让用户一次确认,减少深度任务完成后发现方向错误;
- brief 应可保存、复制和版本化,便于重复研究。
Perplexity 官方没有说明 brief 是否形成可持久化结构化对象,这是当前产品可超越的地方。
阶段 B:长任务运行
官方材料显示系统会迭代搜索、阅读、推理和调整下一步。Advanced Deep Research 把来源阅读、学到的内容和报告形成过程显示出来。
一个有效的运行时界面至少应展示:
| 信息 | 用户问题 | 不应暴露的噪声 |
|---|---|---|
| 当前阶段 | 是在规划、检索、阅读、核对还是写作? | 每个 token 或内部 chain-of-thought |
| 来源进度 | 读了哪些类型/哪些关键来源? | 未经筛选的全部 URL 流 |
| 阶段发现 | 到目前为止出现了哪些高价值事实或冲突? | 未验证草稿结论伪装成最终结论 |
| 证据缺口 | 哪些子问题仍缺权威来源? | 只显示百分比但不解释剩余工作 |
| 成本与时间 | 预计还需多久,是否接近预算? | 用“搜索次数多”制造质量幻觉 |
阶段 C:运行中纠偏
Perplexity 允许研究未完成时追加追问。这解决了长任务的核心痛点:用户看到阶段发现后可以补充边界,而不用等最终结果再重跑。
当前产品应进一步区分三种中途操作:
- 补充:增加一个子问题,不改变既有步骤;
- 约束:只用特定来源/时间/地区,可能使后续计划变化;
- 纠正:发现研究对象、实体或口径错误,需要作废或重跑受影响步骤。
每种操作都应产生 plan revision,并标出哪些 findings 被保留、作废或待复核。
阶段 D:报告成为工作文件
Perplexity 把结果流式写入可编辑文件,并支持分享;Research mode 还支持导出 PDF/文档或转换为 Perplexity Page。Session 帮助 说明常规会话可导出 PDF、Markdown 或 DOCX。
可借鉴点:
- 报告在生成过程中即可阅读,不必等全部结束;
- 报告是独立资产,有编辑、分享和导出生命周期;
- 追问应能局部更新报告,而不是继续在下方堆聊天消息;
- 研究历史按模式和时间可检索。
当前产品应额外保留“机器生成版本—人工编辑版本—证据更新后的修订版本”,避免编辑后引用失配。
3. Deep Research 与 Pro Search 的产品分层
| 维度 | Pro Search | Deep Research | 对当前产品的建议 |
|---|---|---|---|
| 任务 | 复杂问题的深入答案 | 多维、开放性、需要完整报告的研究 | 按结果形态和风险分层,不只按回答长度 |
| 时延 | 秒级到较短等待 | 官方多页口径约 2–5 分钟,非稳定 SLA | 明示 P50/P95 与预计完成时间 |
| 检索 | 多次搜索、几十来源 | 几十次搜索、数百来源、迭代计划 | 设最大步骤、来源预算、停止条件 |
| 模型 | Pro 用户可选择 | 系统自动选择组合 | 模型对用户可隐藏,但运行记录必须保存版本 |
| 工具 | 搜索、代码解释等 | 更强网页浏览、文件、代码和数据分析 | 所有工具输出都必须能成为证据或可复算结果 |
| 输出 | 带引用答案,可追问 | 综合报告、可编辑/分享文件 | 三档:Answer、Research Note、Decision Report |
Perplexity 的产品价值来自“同一入口中自然升级深度”,不是为 Deep Research 创建一套完全割裂的产品。
4. 速度、深度与质量的口径风险
不同官方页面对耗时使用了“under 3 minutes”“around 4 to 5 minutes”“2–4 minutes”等口径,应理解为产品体验目标,而不是可依赖 SLA。Advanced Deep Research 更新后又增加更多来源、文档与代码能力,实际时间显然会随任务变化。
同样,“几十次搜索”“数百来源”描述的是执行规模,不自动代表:
- 找到了领域最权威的一手材料;
- 对每个重要结论都有足够证据;
- 发现并解释了冲突;
- 数字口径一致;
- 报告没有引用漂移或过时信息。
当前产品不应把搜索次数做成核心营销数字,而应展示:
- 关键来源覆盖;
- claim 引用覆盖;
- 冲突和未证实项数量;
- 来源权威与时效分布;
- 引用原文定位成功率;
- 研究 brief 中各问题的完成状态。
5. 报告结构建议
Deep Research 的默认报告不应只追求篇幅。建议固定以下可审计区块:
- 研究任务与边界:目标、受众、时间窗、来源范围、排除项;
- 执行摘要:3–7 条最影响决策的结论;
- 关键判断:每条 claim 有置信度与内联引用;
- 证据与反证:支持材料、冲突来源、口径差异;
- 数字与计算:输入、公式、单位、代码/表格结果和可复算记录;
- 未验证项:因权限、时效、资料缺失或冲突无法确认的事项;
- 决策影响:结论会影响哪些假设、风险、选择或后续监控;
- 研究运行摘要:使用的来源类型、时间、计划修订和质量指标。
6. 交互状态与异常
长任务产品需要覆盖比普通聊天更多的状态:
| 状态 | 用户应看到什么 | 建议操作 |
|---|---|---|
| 等待澄清 | 系统理解到的范围和仍有歧义的字段 | 回答、接受默认值或取消 |
| 运行中 | 当前阶段、关键来源、阶段发现、预计时间 | 追加、约束、纠正、停止 |
| 来源受限 | 哪个来源被 robots、登录、付费墙或权限阻断 | 替换来源、上传文件、使用连接器 |
| 证据不足 | 哪个子问题没有足够材料 | 降低结论强度或标为未验证 |
| 来源冲突 | 冲突的数字/日期/观点和各自来源 | 选择口径、保留分歧或追加研究 |
| 部分失败 | 哪些步骤成功、哪些失败 | 只重试失败步骤 |
| 用户停止 | 已完成发现与未完成范围 | 保存草稿、稍后继续 |
| 完成 | 报告、证据覆盖、未验证项和版本 | 编辑、导出、分享、设监控 |
Perplexity 的公开帮助页主要展示成功路径,没有完整披露这些异常如何处理。当前产品可以通过更强状态模型形成专业可信感。
7. 商业包装观察
方案对比 把 Research 查询次数、Pro Search、文件/应用创建、上传、组织资料库、隐私和支持作为分层资源。2026 年 7 月公开口径中,Enterprise Pro 为每席位 40 美元/月或 400 美元/年,Enterprise Max 为 325 美元/月或 3,250 美元/年;Research 月度额度从 Enterprise Pro 的 50 到 Enterprise Max 的 500。价格和额度可能变化,实际以官方当前页和合同为准。
产品含义:
- 深度研究不是单独采购的大型咨询模块,而是从个人到企业逐级增加额度与模型/工具能力;
- 免费和低价模式承担获客,Deep Research、文件交付和企业资料库承担升级;
- 计算资源通过配额分层,用户容易理解;
- 对当前产品而言,可把专业信源、深度研究额度、组织资料库、治理和工作流包分开定价,但不应让证据质量因套餐降低。
8. 当前产品的三档模式建议
| 模式 | 目标时延 | 默认范围 | 产物 | 使用场景 |
|---|---|---|---|---|
| 快速核验 | 10–30 秒 | 1–3 个高权威来源,一轮搜索 | 带 EvidenceSpan 的短答案 | 数字、定义、最新事件 |
| 结构化研究 | 1–3 分钟 | 3–8 个子问题,多源交叉核验 | 可编辑 Research Note | 竞品比较、公司/政策概览 |
| 深度审计 | 5–30 分钟或后台任务 | 研究 brief、计划修订、代码/表格、冲突与未验证项 | Decision Report + Evidence Ledger | 尽调、战略、合规、投资备忘录 |
三档共享同一 Source/Claim/Evidence 模型,避免快速模式和深度模式形成两套不可互用的数据。
9. 可借鉴与不可照搬
建议重点参照
- 同一入口的模式分层;
- 研究前主动澄清;
- 运行中追加问题与纠偏;
- 来源和阶段发现的渐进展示;
- 上传文档、网页与代码/数据工具统一进入研究任务;
- 报告流式生成并成为可编辑、可分享资产;
- 系统自动选择模型,用户关注任务而非模型品牌。
需要增强
- brief 与研究计划版本化;
- 中途纠偏产生影响范围,而不是无记录地改变后续结果;
- 所有来源固定版本并保存抽取片段;
- 人工编辑后自动检测 claim—citation 失配;
- 冲突、未验证和权限受限成为一等状态;
- 报告可以被决策、监控和情景模拟复用。
不建议照搬
- 用“几分钟、几百来源”替代质量承诺;
- 只展示正向进度,不展示证据缺口;
- 把内部 chain-of-thought 直接作为“可解释性”;
- 让用户每次都从空白 prompt 开始;
- 只保留最终文件而不保留 ResearchRun 和 Evidence Ledger。
10. 明确结论
| 维度 | 结论 | 理由 | 前提与限制 |
|---|---|---|---|
| 引入 | 不建议把 Perplexity Deep Research 直接作为当前产品核心研究运行时 | 报告和引用体验强,但运行计划、网页版本、冲突与决策血缘不可控 | 可作为质量对照基准或外部辅助工具;不得把输出直接升格为审计证据 |
| 参照 | 建议重点参照其产品形态 | 研究前—运行中—报告后的完整交互已经成熟,显著降低长任务门槛 | 需补齐版本化证据、可重放计划、异常状态和决策复用 |
11. 官方证据索引
- Research mode 的迭代研究、报告、导出和模型自动选择
- Advanced Deep Research 的新能力和交互
- Pro Search 的模型选择、来源模式与交互追问
- Session 的历史、来源和导出交互
- 套餐、Research 额度、组织资料库与隐私分层
- Enterprise 公开席位价格