2026.07.15

新站第一周 SEO 清单:上线七天别踩的坑

域名刚解析完的七天,决定爬虫第一次怎么看待你。这份免费清单覆盖索引、Sitemap、结构化数据与 AI 爬虫开关,并指向更深的冷启动手册与 Programmatic SEO。

新站最容易犯的错不是「内容不够多」,而是地基没齐就狂更。爬虫第一次来访时,若 sitemap、canonical、HTTPS、结构化数据或缺一,你会用后面几周的内容去补第一周的技术债。

下面是一份可勾选的七天清单。做完再谈长文矩阵与批量落地页。

Day 0–1:上线前必须就位

  • HTTPS 全站强制,无混合内容
  • 唯一规范域(www / 裸域二选一,301 互指)
  • robots.txt 不误挡 CSS/JS 与重要路径
  • sitemap.xml 可访问,并在 Search Console 提交
  • 每页唯一 <title> / meta description;文章页有 canonical
  • 核心模板有 JSON-LD(Article / WebSite / Organization 按需)

拾星集在构建后用 postbuild-seo.mjs 生成 sitemap、RSS 与 llms.txt —— 静态站也要把「构建产物」当成 SEO 交付物,而不是手改 HTML。

Day 2–3:Search Console 与抓取

  • 域名资源验证(优先于网址前缀),覆盖所有子域策略
  • 抽查「网页索引」→ 看是否有「已发现但未编入索引」堆积
  • 用 URL 检查工具抽测首页 + 1 篇正文 + 1 个标签/列表页
  • 确认移动端可用、CLS/LCP 没有明显红灯(不必迷信满分)

Day 4–5:内容与内链骨架

  • 首页说清主题,不要空壳「欢迎来到我的博客」
  • 至少 3–5 篇支柱文,互相内链,形成主题簇
  • 404 有用、无软 404;重要旧链不要裸挂死链
  • 图片有合理文件名与 alt(不必堆砌关键词)

Day 6–7:AI 搜索与可引用性

  • 检查 robots.txt 对 GPTBot / ClaudeBot / PerplexityBot 的策略(挡或不挡是产品决策,别默认复制别人)
  • 提供 llms.txt 或等价的机器可读摘要入口
  • 正文里放可被引用的定义句与步骤列表,少用只有氛围没有事实的空话

做完之后读什么

常见误判

「提交了 sitemap 却没收录」
正常。新站常有延迟;先保证可抓取与内链,再盯索引率。

「第一周就要上 Programmatic」
不建议。先有人工支柱文证明主题,再批量扩展,否则容易被当成薄内容站。

「只要文章够长就会排」
长度不是信号;主题一致性、E-E-A-T 线索与技术可抓取更重要。

上线同一周建议把 hello@你的域 也接上(Cloudflare Email Routing),避免页脚仍挂私人 Gmail:《域名 + Cloudflare 邮箱实战》。