检查www二级域名在移动端与桌面端的差异,核心是确认两件事:同一路径是否面向不同设备返回了不同内容,以及这种差异是否被搜索引擎正确识别。实际操作中,先用带桌面User-Agent和移动User-Agent的请求分别抓取同一URL,对比状态码、HTML主体、canonical、robots meta和跳转目标,再决定是修正配置还是保留差异。
从交付结果倒推,检查前要确定预期。常见有两种模式:响应式设计下,两端返回相同HTML,仅CSS和视口不同;独立移动站下,移动端URL返回移动版HTML,并通过rel="alternate"与rel="canonical"互相指向。如果www二级域名对移动端做了跳转,需要确认跳转目标是否可被索引、是否形成跳转链。
浏览器开发者工具的设备模拟只改变视口和部分特性,不能完全代表搜索引擎爬虫的移动User-Agent。更可靠的做法是用命令行或抓取工具发送不同User-Agent。下面示例中的域名和路径是假设,仅用于说明方法。
curl -A "Mozilla/5.0 (Windows NT 10.0; Win64; x64)" -I https://www.example.com/page
curl -A "Mozilla/5.0 (iPhone; CPU iPhone OS 17_0 like Mac OS X)" -I https://www.example.com/page
把-I换成直接输出正文,可以对比HTML。重点看:状态码是否同为200,最终URL是否一致,canonical是否指向自身或桌面版,robots meta是否有noindex,以及移动端是否被重定向到另一个二级域名或路径。
发现两端返回不同内容时,不要直接判定为问题。需要区分以下几种情况:
判断依据是“内容是否等价、是否可索引、指向关系是否自洽”,而不是两端HTML是否逐字相同。
把检查任务拆成可验收的条目,便于开发、运维和SEO协作。
需要提醒的是,robots.txt的抓取限制不等于可靠的索引移除;站点地图不保证收录;HTTPS不保证安全无漏洞或排名。不同搜索引擎对移动信号的识别方式须分别核查,不能以一端结果推断另一端。
选首页、栏目页、详情页各若干条,保存两端响应快照,修改跳转或canonical规则后重新抓取同一组URL,对比字段是否回到预期。若差异属于设计,记录原因和适用范围;若属于故障,按状态码、跳转链、canonical顺序逐项修复并复测。