llms.txt 验证器会分析任意域名的 llms.txt 文件,并报告它的格式是否符合 AI 爬虫的要求。把您的网址或域名粘贴到上方的工具中,即可获得即时诊断。
什么是 llms.txt,它为什么重要?
llms.txt 是一种纯文本约定,类似于 robots.txt,用来告诉大语言模型和 AI 搜索如何浏览一个网站。它放在域名的根目录(例如 example.com/llms.txt),列出 AI 爬虫应当优先处理的关键页面、章节和文件。没有它,AI 系统就只能猜测哪些内容才是权威的,而且往往会猜错。
随着 AI 概览、ChatGPT 和 Perplexity 越来越多地驱动发现,拥有一份格式良好的 llms.txt,是生成式引擎优化(GEO)中见效最快的技术手段之一。
上方的工具会检查什么
- 文件是否存在:llms.txt 能否在预期路径上访问到?
- 语法是否有效:Markdown 标题结构是否正确,是否存在格式错误的链接。
- 必需章节:一份有效的文件通常包含站点标题、一段简短描述,以及至少一个网址章节。
- 链接可达性:验证器会抽样检查列出的网址,并标出任何返回 4xx 或 5xx 错误的链接。
- 编码:文件必须以 UTF-8 纯文本形式提供,MIME 类型不正确会导致 AI 解析器无法处理。
- 文件大小:过大的 llms.txt 可能被爬虫截断,文件超出建议上限时工具会给出警告。
如何解读结果并采取行动
- 绿色状态表示文件可访问且格式良好。请确认列出的网址确实是您最重要的页面。
- 文件本身返回 404 错误,说明还没有 llms.txt。请依照 llmstxt.org 上的官方规范创建一份,并部署到根目录。
- 文件内部的失效链接会削弱可信度:请立即修复重定向或移除过时的网址。
- MIME 类型不正确(例如用 text/html 而非 text/plain):请更新您的服务器或 CDN 响应头。
- 任何修复完成后,请重新运行上方的工具,确认问题已经解决,再去申请重新收录。
基准:AI 曝光度始于抓取权限
研究显示,AI 概览出现在大约 31% 的 Google 查询中(2025 年)。一个屏蔽或干扰 AI 爬虫的网站,在这块不断扩大的搜索份额中是不可见的。一份正确的 llms.txt,能移除 GEO 曝光度面前最常见的技术障碍之一。
若需要在 ChatGPT、Perplexity 和 Gemini 上持续监测您的 AI 搜索存在感,Sorank 会自动跟踪引用和曝光度。

























