面向 AI 搜索优化的 SEO、无障碍检查与回答验证
从 AI 搜索查找文档和生成回答的原理出发,说明 SEO 与网页无障碍的作用。以虚构的资费说明页面为例,确认抓取路径和信息准确性,并探讨如何将检查清单与 LLM 审查应用于 CMS 运营。
标签
24篇文章
从 AI 搜索查找文档和生成回答的原理出发,说明 SEO 与网页无障碍的作用。以虚构的资费说明页面为例,确认抓取路径和信息准确性,并探讨如何将检查清单与 LLM 审查应用于 CMS 运营。
AI features 文档全文 177,842 字节里,opt out、opt-out、exclude 各出现 0 次。为什么不存在只把 AI Overviews 与 AI Mode 排除在外的开关,以及不靠 robots.txt 的话团队该动哪里,用 18 轮实测给出答案。
Google 7 月 29 日宣布平台资源全球开放。今天 8 月 18 日帮助中心两页仍写逐步推出,API 参考停在 2024-07-23,只有 URL-prefix 和 sc-domain。七份文档核对后的判断:手动看报表的今天就接 Instagram、TikTok、X、YouTube,自动管道先别放。
我在两行 robots.txt 里调换顺序,urllib 的结果当场反转。把 34 KiB 的 AGENTS.md 喂给 Codex,文件后半截的测试标记变成 0 命中,终端没有报错。声明式规则解析失败时不会停下,只会假装规则不存在。219 次运行全部以退出码 0 结束,先确认是哪个解析器给的判定。
我从自己站点的构建产物里取出 69 句话,做成文本片段链接,在 Chromium 里逐条点开记录落点。48 句散文全部到达,15 段代码里有 14 段断在半路。本文用实测把块边界和词边界的规则讲清楚。
给去年写的文章发了个 curl,Last-Modified 显示的却是昨天的部署时间。拆开 ETag 一看,就是文件修改时间和大小拼成的十六进制。同一份源码重新构建出的 1,346 个 HTML 完全字节一致,可一次部署就让整站的条件请求全部落空,本该拿到的 304 再也换不回来。文中给出实测过程与几种可行的缓解方案。
一篇文章的标题会在 title、h1、og:title、headline、RSS 等六处被声明,1,296 篇全部一致。真正出问题的是第七处:指向文章的 18,296 条内部链接里,锚文本与目标标题完全一致的只有 0.7%,根源是包住整张卡片的那一个 a 标签。本文给出七个渠道的实测数据与可照做的修复路径。
本来是为测量链接文本的无障碍指标写的脚本,结果挖出一个URL缺陷。对构建产物中1,334个HTML页面的内部链接做全量扫描,超过一半的24,948条指向不带尾部斜杠的地址,也就是要走一次301跳转。本文记录成因、四个阶段的修复,以及把它清到零的过程。
每篇文章都挂着中位数8条内链,我以为内链已经够了。对1,330个构建产物页做广度优先遍历后,1,288篇文章中有1,276篇位于深度2。可是一旦把四个语言的列表页从链接图里拿掉,296篇从首页再也走不到。相关文章模块再多,也替代不了四个语言列表页这个入口。从首页出发时,四个列表页才是通往深度2的门。
Google在2026年5月7日彻底停用了FAQ富媒体结果。把FAQPage JSON-LD丢进离线校验器,schema能通过,可富媒体结果返回的是DEPRECATED。就在"通过"与"可见"分岔的这个点上,本文依据Google官方文档,梳理Web开发者现在该如何改代码和内容。
给自己运营的餐厅推荐PWA补上Restaurant结构化数据:把按天存储的营业时间字符串转换成openingHoursSpecification,再把同样三个缺陷依次喂给类型检查、schema.org校验器和运行时门禁,逐层测量谁能抓住什么。并引用官方文档,诚实划清它对本地排名的作用边界。
一行 nosnippet 已经不只是关掉搜索摘要。Google 官方文档明确写道:这条指令还会阻止内容被用作 AI Overview、AI Mode 的输入。我做了一个坏页面和一个好页面,再写解析器逐一审计,测出 max-snippet 与 data-nosnippet 的真实效果,以及"最严格者胜"这条规则如何咬人。
JSON-LD 解析器放行的标记,搜索引擎未必读得懂。因为 schema.org 设了 @vocab,拼写错误和大小写错误都会展开成合法的 JSON-LD。这里用一个 60 行的、懂 schema 的校验器,在 CI 里把它们拦下,附真实运行日志。
把同一个 Product 实体用三种语法各写一遍,喂进解析器,实测字节数和易碎程度。Google 三者同等对待。那么推荐 JSON-LD 的真正理由不是排名,而是能在改版中活下来的耦合度。用官方文档和可复现日志梳理出的选型标准。
GPTBot、ClaudeBot 都不渲染 JS。用 curl 复现 CSR 页面为何在 AI 搜索里隐形,并给出改为服务端渲染的具体做法。
给首页加上 priority 1.0 和 changefreq always,Google 全部丢弃。官方文档只用一个字段——lastmod,而且只在它可验证地准确时才用。我用官方 XSD 实际跑了三种 sitemap,看清什么通过校验、什么被悄悄忽略。
把自己页面的 JSON-LD 丢进校验工具,结果散成了三座孤岛。本文用 @id 节点引用把 Organization、WebSite、Article 拧进一个 @graph,并用 jsonld 实测连通性:三个分量如何合并成一个,以及 Google 不保证的地方。
我把一个30行的检查器直接跑在自己网站的构建产物上。248篇博客文章的hreflang集群全部通过,唯独首页没过。本文梳理Google官方的相互链接规则、实测日志、三种实现方式的对比,以及开发者可以直接套用的修复代码。
很多站点用一行屏蔽 GPTBot 就以为"AI 已挡住"。我实际写了一份把训练、搜索、用户请求爬虫分开控制的 robots.txt,并用标准解析器验证。还包括 Google-Extended 挡不住 AI Overviews 的陷阱,以及 llms.txt 的真实现状。
用JS注入店铺页的LocalBusiness JSON-LD,原始HTML里ld+json块为0。本文与服务端输出直接对比,并梳理Google官方立场与排名的边界。
在基于Astro的多语言博客中,技术性分析AdSense反复拒绝的根因,并解决ads.txt冲突、996个幽灵页面、站点地图全404等核心问题的实战指南。
分享针对ChatGPT、Perplexity等AI搜索引擎优化内容的AEO策略实施经验。涵盖Schema标记、FAQ页面优化、结构化数据设计等核心技术,以及Agent Effi Flow实际应用结果。
被Google AdSense以"低价值内容"拒绝后,我利用ChatGPT、Claude、Gemini三个AI分析原因,将批准可能性从5.5分提升到8.5分。分享我的实际经验。
从SEO基础到AEO战略:Agent Effi Flow项目的真实实施案例与可量化成果