一、为什么必须用 SSG,不用普通建站工具
AI 爬虫不执行 JavaScript。纯客户端渲染(CSR)的页面,爬虫抓到的是空 HTML 骨架,正文根本读不到——对 AI 完全隐身。SSG(静态站点生成)在构建时就把完整 HTML 预渲染好,CDN 直接返回,爬虫读到的是带全部正文的真实页面,抓取成功率与速度都最优。
二、JSON-LD 三重结构化数据
每篇文章页同时输出三种 Schema,这是 AI 最常抽取的信号:
- BlogPosting:文章身份(标题、作者、发布/更新时间、关键词)
- BreadcrumbList:面包屑路径,帮 AI 理解页面层级
- FAQPage:问答对,AI 最常直接作为"零位答案"引用
首页与关于页输出 Organization,服务页输出 Service,案例页输出 Article——核心页都有"身份证"。关键纪律:Schema 必须与可见正文一致,只存在于 JSON-LD 而无对应文本的信息,AI 几乎全部漏读且损害可信度。
三、llms.txt 喂料文件
llms.txt 放在站点根目录,是"给 AI 的说明书":站点索引 + 一句话定位 + 文章清单。大模型读取它能快速理解站点结构与核心内容,避免逐页试探。建议同时部署 llms-full.txt(核心全文),发布新内容自动同步更新。
四、推荐技术栈
| 层 | 选型 | 理由 |
|---|---|---|
| 框架 | Astro SSG + MDX | 构建时预渲染,零 CSR |
| 样式 | Tailwind CSS | 轻量、可控 |
| 托管 | 腾讯云 CloudBase 静态托管 | CDN + EdgeOne,发布秒生效 |
| 证书 | OV 证书 | 比 DV 多企业验证信号 |
| 喂料 | llms.txt / llms-full.txt / sitemap / RSS | 自动同步 |
五、性能门槛
AI 爬虫有时间预算,加载慢直接放弃。目标:TTFB < 800ms、LCP < 2.5s、页面 < 500KB。SSG + CDN 边缘分发天然满足。
常见问题
为什么 GEO 官网必须用 SSG 而不是普通建站工具?
AI 爬虫不执行 JavaScript,纯客户端渲染(CSR)的页面会被抓成空骨架。SSG(静态站点生成)在构建时预渲染完整 HTML,CDN 直接返回,爬虫读到的是带全部正文的真实页面,抓取成功率与速度都最优。
JSON-LD 三重结构化数据指什么?
指每篇文章页同时输出 BlogPosting(文章身份)、BreadcrumbList(面包屑路径)、FAQPage(问答,AI 最常直接引用的零位答案来源)。首页与关于页输出 Organization,服务页输出 Service,案例页输出 Article。Schema 必须与可见正文一致,否则 AI 漏读且损害可信度。
llms.txt 是干什么的?必须做吗?
llms.txt 是放在站点根目录、供 AI 直接读取的"站点索引 + 一句话说明 + 文章清单"文本文件(类似 robots.txt 给 AI 的说明书)。它能让大模型快速理解站点结构与核心内容,是 GEO 的标配喂料文件,强烈建议部署。
部署到腾讯云有什么优势?
腾讯云 CloudBase 静态托管 + CDN + EdgeOne 边缘加速,TTFB < 800ms、全站不缓存使发布秒生效;域名与元宝同生态,利于国内平台(尤其元宝/搜狗)抓取与信任。OV 证书传递更强企业可信信号。