一家两个人的 Shopify 小店,差一点付给代理商约 3000 美元,审计品牌在 ChatGPT 和 Gemini 里的呈现,之后再每月 400 美元持续盯着。店主注意到现在已经有工具用零头价格做差不多的事,于是问:代理商能做什么是工具做不了的?八十一条回复之后,有用的那几条三句话就能装下,它们就是这篇文章的骨架。
下面依次是:把这份报价和回答引擎真正点名的那些工具放在一起,价格本周从各厂商页面抄录;我们把同一个问题拿去问 ChatGPT 和 Google AI Mode 后发生了什么;以及一步一步的「自己做」版本,包括 Orkas 内置的 SeoGeoAgent 替你干掉哪些琐碎部分。
那 3000 美元到底买到了什么
把方案书的包装剥掉,代理商审计和软件审计是同一个形状:一组提问、一份引擎清单、一张「你在哪些回答里被提到或被引用」的表、取代你出现的竞品,以及一份修改清单。变的只是谁写的提问、问了几个引擎、有没有人去执行那份清单。
价格这件事,帖子里自己给出了答案。一位代理商老板回复说,他们做完整审计收 450 英镑,之后每月 50 英镑。另一位读者说,代理商只有在审计变成你自己做不了的活时才配拿溢价:修产品数据、扩来源覆盖、写缺失的对比内容,以及衡量这些有没有带来合格流量或销售。第三位建议先挑二三十个真实客户购买前会问的问题,自己手动测一遍。
所以面对任何报价,要问的不是「你们会报告什么」,而是「你们会改什么」。一份你花 299 美元就能生成、或者在某个工具的试用里免费看到的报告,不值 3000 美元。六周的页面重写和外联,也许值。
价格表
下表价格于 2026 年 9 月 16 日从各厂商自己的页面抄录。厂商改档位很随意,买之前再核一遍。
| 选项 | 你付多少 | 你得到什么 | 止于哪里 |
|---|---|---|---|
| 帖子里的代理商报价 | 审计 3000 美元,之后每月 400 美元 | 审计品牌在 ChatGPT 和 Gemini 里的呈现,外加持续监测 | 止于建议,除非执行被写进范围 |
| 同一帖里的代理商反报价 | 审计 450 英镑,之后每月 50 英镑 | 发帖的代理商老板所说的「完整审计」 | 交付物形状相同;两份报价相差约六倍 |
| CiteScore | 免费 20 题扫描;一次性审计 299 美元;追踪每月 69 美元起(50 题)或 149 美元(100 题);「Fix Sprint」1500 美元 | 299 美元的审计在 ChatGPT、Gemini、Claude、Perplexity 上跑 100 题,绘制引用图谱,审计 25 个页面,约 30 分钟给出 90 天计划。Fix Sprint 追加六周的页面重写、文章和引用外联 | 自助;执行是 1500 美元那一档 |
| Otterly.AI | 每月 29 美元 15 题;189 美元 100 题;489 美元 400 题;有免费试用 | 在 ChatGPT、Google AI Overviews、Perplexity、Copilot 上每日追踪。Gemini 和 Google AI Mode 是每月 9 美元起的加购,Claude 每月 29 美元起 | 只监测;提问和修改都得你自己来 |
| AppearAI(Shopify 应用商店) | 免费版;19.90 美元一次性完整报告 | 一个 AI 可见性得分、20 个买家问题、竞品快照、每题的内容建议,在 Shopify 后台里完成 | 仅限 Shopify;2026 年 6 月上架,写稿时只有一条评价 |
| Profound | 免费试用:ChatGPT 上 10 题,仅一次;其余全部定制报价 | 企业版最多追踪九个回答引擎,带 SSO 和 SOC 2 | 无公开价格;一篇第三方对比文列为每月 399 美元起 |
| 自己在 Orkas 里跑 | 应用免费;模型用量计费,或自带 API key(定价) | 你自己的提问清单、买家真正在用的引擎,以及一份下个月能重跑的文件。我们的参考运行:24 题、两个引擎,一个下午,含逐条读完回答 | 花的是你的时间;结果是抽样不是普查,见文末的局限 |
我们把这个问题本身拿去问了一遍
2026 年 9 月,我们把帖子里的问题几乎逐字地问了 ChatGPT 和 Google 的 AI Mode,记下各自引用了什么。
ChatGPT 检索并引用了四个 Shopify 官方页面,别的没有:没有工具名,没有代理商。AI Mode 的回答是「自己做」,给了三步框架——免费扫描、手动逐题检查、然后建站外信任信号——引用了 Yotpo 的一篇审计指南、一家外联代理商的七步清单、Reddit 那条帖子本身,以及三个工具页面:CiteScore 的审计页、AppearAI 的应用商店页,和一篇点了 Otterly 名字的第三方价格对比。
由此有两点。被点名的工具,都是有公开价格、且有一个对比文能链过去的页面的。而且回答引擎自己就在向两人小店推荐「自己做」这条路,也就是下面要讲的这条。
自己做:五步
这和我们那篇五步产品推荐核查是同一套检查,只是这次标了价。某一步如果是 Orkas 内置的 SeoGeoAgent 在做,会写明;这里没有一步非用它不可。
1. 写问题,不带品牌
二十到四十个问题,按购物者下单前的敲法来写:适合〈用途〉的最好的〈品类〉、〈品类〉要〈某个约束〉、〈那个显眼品牌〉的替代品。也留几个带品牌名的问题,但只当对照:被问「〈你的品牌〉是什么」,模型按定义就会点你的名,所以带品牌的行测不出可见性。上面每个付费选项跑的都是这份清单的某个版本;一份 299 美元的审计,如果它的提问和你的买家实际问法对不上,那就是花 299 美元回答了一个错的问题。
在 Orkas 里,agent 的 geo-probe 技能会从你站点的抓取结果生成候选清单,并剔除带你品牌的、少于三个词或多于十二个词的、或者用了引擎会答到别的行业去的歧义缩写的候选。每一条剔除都写明理由。
2. 在买家真正用的引擎上跑
至少 ChatGPT 和 Google AI Mode;如果你的品类在 Perplexity 和 Claude 上有出现,也加上。每条回答记四件事:有没有被提到、有没有带链接被引用、出现了哪些竞品、顺序如何,以及被引用的每一个 URL。ChatGPT 用临时对话,免得前面的问题渗进后面的回答;AI Mode 用「不带个性化」。每十题左右停一停——不停的话 Google 会给你一个验证页。
在 Orkas 里,你可以让 agent 在你面前操作共享的浏览器标签,也可以把回答粘进去;哪种方式,回答都会回流给探针打分。计费的部分是读大约五十条回答花掉的模型 token。
3. 打分,并标明这是什么性质的数字
声量份额只算不带品牌的行。引用率——真正指向你域名的链接——单独算,因为这是可靠的信号。竞品份额。再加一个「歧义提及」的桶:品牌词出现了,但没有任何上下文能证明那是你而不是同名词。geo-probe 的打分操作返回的正是这些,并且只有在每条回答都来自带检索的运行时才标为「实测」;来自模型记忆的提及不是引用,也不会被报成引用。
4. 修来源,不修分数
两类修改。在你自己的页面上,是老活:过期事实、缺失的对比内容、结构化数据、页面能不能在三句话内被引用。SeoGeoAgent 的诊断模式在技术 SEO 之外给页面打一个 GEO 可引用性分并返回行动计划;应用模式在你逐条确认后修改你本地仓库里的源码,然后重新抓取改过的源文件。
在你页面之外,是更大的杠杆。在我们自己的运行里,非品牌回答引用 Reddit 帖、厂商博客、应用商店页和对比文章的次数远多于店铺首页。那边的行动清单是:过期事实在哪就去哪改,补上你品类里没人写过的那篇对比页,去回答你的买家真正在读的那些帖子。为什么某一段被引、另一段不被引,见我们关于如何被 ChatGPT 引用的那篇。
5. 现在留基线,四周后重跑
把第一次运行存下来。监测模式会连同健康分和 GEO 分保存一份基线,第二次运行就能比对,而不是重新争论。改完一周内别复测,模型看到的元数据会滞后几周。并且把每次运行都当抽样:一个问题在三天里重复问过,再相信变化。
完整的循环——追踪你出现在哪些问题里、把缺口变成页面——在搜索与 AI 回答可见性这个用例里。
什么时候该付钱
- 缺的那些页你们自己写不出来。六周的执行包,或者 450 英镑的代理商,买的是写作和外联,不是看板。这可能值。
- 你需要每天在四个引擎上追踪一百个提问。每月 69 到 189 美元的订阅,比那些工时便宜。
- 你在 Shopify 上,想十分钟看一份二十题的结果。19.90 美元作为第一眼是合理的,前提是之后你要写自己的清单。
- 什么都还没改,别买按月监测。数字没有东西可以动。也别买一个提问不是你写的看板。
所有选项都给不了你的
- 流量。Google Search Console 的生成式 AI 报告没有 API,而且从结构上只报展示量;表里没有一个选项能算出 AI 点击率。
- 竞品的真实份额。每个选项都是在抽样回答,不是在测量总体。
- 修改一定生效的保证。被引用的来源里有好几个是你不拥有的页面。