先填 site_context,而且要写成一句关于买家的话,不是一段关于公司的描述。每一个「下线」判定,本质是在论证「那句话里描述的读者没有一个需要这个页面」,所以「我们卖现场服务软件」会换来处处留有余地的措辞,而「有 3 到 20 名技师、还在白板上排班的老板」会换来决定。然后把清单按导出文件原样粘进去。这条提示词不需要固定的列顺序,只有标题也能跑,但会以明说的置信度损失为代价。
要盯的失败是被悄悄截断的导出。Search Console 的界面导出上限是 1,000 行,所以一个大博客交给你的文件里,站点的尾部干脆就不存在。如果你把那个文件粘进去还什么都不说,每个缺失的页面看起来都像是零曝光的页面,于是这次盘点会基于根本不存在的证据下线你站点的一大块。把那些行标成「not in export」,并在 metrics_source 里写上真实周期;提示词随后会把它们标为暂定,并要求在执行判定前先检查收录情况。
按列读产出,不要按行读。 先扫「依据」列并数一数暂定的行数:如果表里多数是暂定,这份盘点是在告诉你「去把数据取来」,不是「开始删」。然后扫「URL 去向」列,否掉任何写着「重定向到首页」「删除」「移除」的行——那些是模型回避了决定的行,把这几个 URL 连同下线政策重新说一遍再跑一次,通常就好了。最后确认每一个重合分组,要么以一次合并收尾,要么写明了两个页面为何都保留;一个没有结论的分组,正是这条提示词要防的那件事。
清单超过约 150 个页面时,按主题分批,不要按字母序。重合只在同一批次内被检测,而按字母序切分,恰好会把你最需要并排比较的那些页面分开。