这一点要先把流行说法纠正过来:Google 官方明确写了,分页序列里的页面不要求标题唯一,序列内使用相同的标题和描述是可以的,搜索侧会尝试识别同一序列中的页面并据此处理。所以“分页标题重复会被判为重复内容”是没有官方依据的说法。真正需要你动手的是另外几件事,而且都不在标题里。
官方对分页标题的原文口径
Google 关于分页与增量加载的说明先说了一个例外:一般情况下官方建议给不同页面不同的标题,但分页序列不必遵守这条建议,序列内可以用相同的标题与描述,搜索侧会尝试识别并索引这些页面。同一份文档还说明了它实际依赖的机制:抓取主要通过 <a href> 标签发现后续页面;可以把序列里每一页都链回第一页,让搜索侧更容易判断序列的起点。换句话说,分页靠的是链接结构,不是标题差异。
分页真正要处理的三件事
| 事项 | 官方要求 | 做错后的现象 |
|---|---|---|
| 每页唯一 URL | 分页序列里的 URL 会被当作不同页面,所以每页必须有各自地址 | 不同页共用一个地址,后续页实际抓不到 |
| 规范 URL | 不要把序列第一页当作整段的规范 URL,每页各有自己的 | 后续页被判为第一页的重复,序列被折叠成一页 |
| 片段标识 | 不要用 # 之后的部分表示页码,官方会忽略它 | 只差片段的链接不被跟随,看起来像死链 |
还有一条是历史包袱:过去用来标记前后页关系的 rel="next" 与 rel="prev" 标签,官方已说明不再使用,虽然其他搜索引擎可能还在读。规范 URL 这件事在 Google 关于如何指定规范 URL 的说明里有完整方法,官方按影响强度排了序:重定向最强,其次是 rel="canonical",再次是站点地图收录;文档还提醒站内链接应指向规范 URL,而不是某个重复地址。
按顺序检查文章分页
- 在后台把文章的分页选项打开并保存,然后查看源码,确认第二页有独立地址,而不是靠
#拼接。 - 逐页抄下
<title>与规范链接标签,检查规范链接是否指向本页自己。 - 确认序列末页的“下一页”不再存在,避免产生抓不到的入口。
- 清缓存后再复核一遍,排除缓存层返回旧页面的情况。
如果你在站点里改过 canonical 的默认行为,这一篇和站内canonical 和外链指向的 URL 有什么关系要一起看,因为外链落到哪一版 URL 上,决定了信号是否集中。上面第四步的清缓存复核尤其重要,它经常能解释“改了没反应”的假象。
这套做法用不上的三种情况
三种情况不适用:一是序列里每一页承载的是完全不同的内容,标题也各不相同,此时唯一标题反而更清晰,官方那条“不要求唯一”的许可你用不上;二是站点没有真正启用分页,只有一个长页面,那这套检查没有对象;三是主题输出的是无限滚动或点击加载,不是翻页链接——官方对这两种模式的抓取建议与分页不同,处理方式也不一样,需要另行判断。

还有一个容易混淆的边界:文章分页(/page/2/ 这类,同一篇文章的第二页)与列表页分页(分类的第二页)性质不同。前者是同一篇内容的续页,官方对分页序列的口径直接适用;后者是同类条目的续页,标题唯一性同样不是重点,但地址规范和入口链接的检查一样要做。混在一起改规则,容易把续页当成独立页面处理。
分页被发现的路径怎么确认
先自查源码,方法同上。然后确认发现路径:抓取主要靠 <a href> 标签,所以要确保“下一页”这些是真实链接,而不是需要点击才生成的按钮;站内链接怎么被发现和传递,Google 关于链接如何可被抓取的说明里有细节,包括内链锚文本应当有描述性、每个你在意的页面至少要从站内另一个页面获得链接。最后用 Search Console 入门里推荐的报告分工做确认:整站看索引覆盖报告,单页用 URL 检查工具查第二页是否已被发现。改完之后提交的抓取时间预期,见WordPress 站内搜索页被收录那篇讲的输出层排查里同样的原则:先确定标签真的输出了,再去讨论搜索侧。