搜索引擎友好型 URL 重构方案
把 Clara BBS 的 URL 捋顺、伪静态配好、GEO 开关打开之后,你能让百度、豆包、DeepSeek 这些引擎顺顺当当地抓完并收录整站内容。下面按顺序走一遍。
第一步:先把站点地址统一
后台「系统设置 → 基本设置」,站点地址一项要填完整,带 `https://` 和主域名。
注意:带 www 和裸域只能选一个,全程保持一致。混用会导致会话丢失,用户发帖时容易撞上「页面已过期,请刷新后重试」的提示(CSRF 校验失败),爬虫看到的规范地址也会左右摇摆,等于自己给自己制造重复页面。
第二步:配置伪静态
Clara BBS 的 URL 是 `.html` 后缀,由系统自动识别,不需要堆一大串 rewrite 规则。服务器只要做一件事:把「非静态文件的请求」转发给 index.php。
Nginx 在站点配置里写:
location / {
try_files $uri $uri/ /index.php?$query_string;
}
Apache 则确认 `.htaccess` 生效(目录配置里 `AllowOverride All`),把不存在的文件请求交给 index.php。
注意:转发规则要放在「静态文件直出」之后,uploads 等真实存在的目录别被吞进 index.php,否则图片全走 PHP 处理,白白吃掉性能。
第三步:规划版块层级
URL 的层级其实来自版块结构。系统支持两层:顶级分类(只做分组,不能发帖)→ 版块(可发帖),版块内还能再开子分类(发帖时选择,版块页可按分类筛选)。
主题分区要在建站初期就想清楚,别过几个月再改名改结构——URL 一变,已经收录的页面权重就散了。全部在后台「版块管理」可视化配置,没有数量限制。
第四步:打开 GEO 优化
进后台「系统设置 → GEO 优化」,各开关默认全开,检查一遍即可。它会自动完成:
- robots.txt 放行 16+ 中国系 AI 爬虫(豆包 DoubaoBot、DeepSeekBot、元宝、百度、Kimi、智谱、360、神马、夸克、华为小艺、通义等),以及 GPTBot、ClaudeBot、PerplexityBot 等国际系,后台可单独开关或追加 UA
- 生成 `/llms.txt`(站点与页面结构说明)和 `/llms-full.txt`(全量内容索引,含已解决问答的完整文本)
- 生成 `/answers.html` 问答聚合页,把悬赏帖的「问题 + 最佳答案」成对展示
注意:所有 GEO 输出只包含游客可见版块的内容,隐藏版块和权限版块不会外泄,这点不用自己再兜一层。
第五步:加速新内容的发现
收录本身由各 AI 平台的爬虫自主完成,通常 1–4 周到访,急不来。但可以提速:去百度站长平台拿主动推送 Token 填进后台,IndexNow 默认已开,新帖发布后会自动推送。
第六步:结构化数据不用自己写
系统已经内置:已解决的悬赏帖页输出 QAPage + acceptedAnswer,`/answers.html` 输出 FAQPage,帖子页带 citation 引用元标签,全站有 Organization + sameAs 的实体一致性标记。你不需要手工加代码。
第七步:看数据、定期体检
后台「系统设置 → GEO 优化」页有一张「AI 爬虫访问监控」表,能看到哪个爬虫来过、访问频率多少、最近抓的是哪个页面。再到「系统工具 → 计划任务」里跑每日 GEO 健康体检,有异常能早发现。
小结
- 站点地址先统一(带 `https://`、主域名唯一),URL 问题的根子多半在这
- 伪静态只需把非静态请求转发给 index.php,系统自动识别 `.html`,无需额外规则
- URL 层级跟着版块结构走,建站前想好,别事后大改
- GEO 开关默认全开,robots.txt、llms.txt、answers.html 自动生成
- 百度推送 Token + IndexNow 加速收录,监控表看爬虫、计划任务做体检
- 结构化数据全内置,不必手工添加
转载请注明出处,版权归原作者所有。
星耀SVIP
管理员
黑卡会员





