.docx 或 .pdf),每个结论都能追到来源链接,并且整个过程的花费可以事先估算出来。
选这个场景开篇是因为它把袋袋最容易被低估的三件事叠在了一起:搜索的钱花在读结果上而不是发起搜索、产物必须落到文件里才算交付、没有引用的调研等于没做。这三点在任何信息类任务里都成立,你在这篇里踩过一遍,后面的场景就都通了。
你会得到什么
前置条件
1
确认沙盒可用
调研要写文件,所以必须有沙盒。新会话第一次让专家写文件时会自动启动,你只需要确认右侧工作区面板能看到文件树。沙盒模式为「无沙盒」的专家不能做这件事。
2
确认余额足够
按下面「成本估算」一节算出预期消耗,账户余额至少留 2 倍余量。余额不足会在中途中断,已经写进文件的部分不会丢,但你需要重新发起后续步骤。
3
准备竞品清单
自己先列出 3-8 个竞品名称和官网域名。让模型「顺便找出所有竞品」会让搜索次数不可控,也容易把不相关的公司拉进来。
步骤
第 1 步:先定框架,不要先搜
直接说「帮我调研 A/B/C 三个竞品」会得到一份没有骨架的堆砌。先让专家把评估维度确定下来:第 2 步:分维度搜索并落盘
框架确认后,按维度逐个搜索,并且每搜完一个维度就写文件:第 3 步:识别并处理搜不到的部分
搜索工具只能拿到公开可抓取的内容。定价页经常在登录后才展示、或者用 JavaScript 动态渲染,这时候需要换工具:第 4 步:交叉验证,标注矛盾
第 5 步:生成正式文档
.docx 时专家会用 docx 技能的脚本链路。具体的排版能力边界见 Word 文档;如果你更需要一份能直接发出去的排版稿,改要 .pdf(见 PDF 生成)。
第 6 步:验收
打开文件,逐项检查:- 随机抽 5 个数据点,点开脚注里的 URL,确认页面上真的有这个数字
- 确认「矛盾与不确定项」章节还在,而且不是空的
- 确认对比矩阵里没有 “N/A” 之外的空格——空格意味着模型跳过了这一格而没告诉你
- 确认没有出现你没提供、也没在来源文件里出现过的第三方公司名
成本估算
这个流程的开销结构值得单独算一遍,因为它和直觉相反:
真正的大头是搜索结果的正文进入上下文所产生的输入 token,而不是「搜了几次」。所以控制成本的有效手段是减少每次带回的正文量(分维度、限定来源类型),而不是减少搜索次数。
平台侧对搜索结果有截断保护,但那是防止上下文被打爆的最后一道防线,不是省钱机制。计费口径详见 计费公式 与 联网搜索。
边界与失败态
变体
做成定期跟踪
做成定期跟踪
把第 2-5 步的指令固化成一段提示词,然后创建定时任务按周执行,产出「本周竞品变化」增量报告。注意定时任务会在你没看着的时候花钱,先算清单次成本再定频率——详见 每日简报。
产出可复用技能
产出可复用技能
如果这套调研流程你会反复用,让专家把它写成一个技能(
skill_manage),下次只需要给竞品名单。技能的归属与作用范围见 技能目录。输出成网页而不是文档
输出成网页而不是文档
对比矩阵在网页上比在 Word 里好看得多。让专家把结论做成一个可分享的站点,见 发布一个站点。
相关页面
联网搜索
搜索的计费口径与截断保护
Word 文档
docx 生成的能力边界
浏览器自动化
三层浏览器架构与登录态边界
计费公式
五种计费单位的完整算法

