免费 llms.txt 生成器
几秒钟即可为您的网站生成一份符合规范的 llms.txt 文件。我们会爬取站点地图,将页面归入各个部分,交付一份可直接放置到 /llms.txt 的文件。
什么是 llms.txt?
llms.txt 是位于网站根目录的 Markdown 文件,为AI助手提供一份精挑细选、由人工编写的重要页面地图。可以把它看作面向LLM的站点地图——为答案生成而非搜索排名而优化。
为什么它很重要
- AI助手的上下文窗口有限,一个精心策划的入口能显著提升效果
- 您可以掌控LLM优先抓取哪些页面,以及如何概括这些页面
- 这是目前普及最快的GEO信号——而大多数网站仍未配置
我们会为您生成
- 从首页元数据提取的H1站点名称与一句话摘要
- 依据站点地图URL分类的各个部分(Docs、Product、Blog 等)
- 为法律声明及优先级较低页面预留的 Optional 部分
常见问题
llms.txt 是您托管在 https://yourdomain.com/llms.txt 的纯文本 Markdown 文件。它向 ChatGPT、Claude、Perplexity 等AI助手提供一份网站上最重要页面的精选清单——并附上简短摘要,便于LLM在回答与您相关的问题时引用。与 robots.txt 或 sitemap.xml 不同,它是同时面向人和机器编写的,让您无需依赖爬虫的猜测就能为内容设定优先级。
我们会抓取首页以提取站点名称和 meta description,再通过 robots.txt 或 /sitemap.xml 发现站点地图,按URL路径启发式将这些URL归入 Docs、Product、Blog 等标准部分,并整体渲染为 Markdown。输出会被控制在合理体量,便于上下文窗口较小的LLM完整扫读该文件。
通常建议再做一次快速人工润色——精简摘要、重命名部分,并为最重要的链接补上简短描述。生成器为您打下扎实的基础,省去约 80% 的手工整理;剩下的 20% 由人来完成,文件才能更贴合品牌口吻。
将内容上传到 https://yourdomain.com/llms.txt——置于站点根目录,而非子目录。文件必须以纯文本形式提供(content-type 为 text/plain 或 text/markdown),并且必须无需身份验证即可访问。大多数静态托管服务(Vercel、Netlify、Cloudflare Pages)都允许您将其放入 public 文件夹;CMS 网站请沿用提供 robots.txt 时的相同机制。
是的。无需注册、无需信用卡,匿名通道也没有速率限制,启发式生成器完全免费。GeoVector 付费方案则额外提供由LLM撰写的摘要、站点地图变化时的自动重新生成,以及在 llms.txt 与网站发生偏移时通知您的监测功能。
生成的文件长什么样
llms.txt 是结构固定的 Markdown:一个代表站点的 H1,一段可选的引用摘要,然后是若干 H2 链接分区。
# Example Analytics
> Product analytics for teams that ship weekly. Self-serve dashboards, an event API, and a warehouse sync.
## Docs
- [Quickstart](https://example.com/docs/quickstart)
- [Event API reference](https://example.com/docs/api/events)
- [Warehouse sync](https://example.com/docs/warehouse-sync)
## Product
- [Pricing](https://example.com/pricing)
- [Dashboards](https://example.com/features/dashboards)
## Blog
- [What we learned rebuilding ingestion](https://example.com/blog/rebuilding-ingestion)
## Optional
- [Changelog](https://example.com/changelog)
- [Status](https://example.com/status)把它保存为域名根目录下的 /llms.txt,并以 text/plain 或 text/markdown 提供。它目前只是一个提案而非标准,没有爬虫有义务读取——但它只占一个文件,而且是你唯一能主动指明「哪些页面重要」的地方。
页面是怎么分组的
分区按 URL 路径归类,先匹配者优先。凡是看起来属于归档性质的路径——标签页、作者页、分页列表——都会归入 Optional。
| Section | Path patterns |
|---|---|
| Docs | /docs, /documentation, /guides, /reference, /api, /developers, /sdk |
| Product | /product, /pricing, /features, /solutions, /platform, /use-cases |
| Blog | /blog, /news, /updates, /changelog, /posts |
| Articles | /articles, /resources, /insights, /research, /library, /whitepapers, /case-studies |
| Support | /support, /help, /faq, /community, /forum |
| Company | /about, /team, /careers, /press, /contact, /partners, /investors |
| Legal | /legal, /privacy, /terms, /cookies, /security, /compliance |
| Other | Anything that matches none of the above |
生成器最多读取站点地图中的 500 个 URL,并从路径推导链接标题。手工改写这些标题是对输出价值最高的一处编辑:模型在决定是否抓取页面之前,先看到的就是标题。
来源与规范
本页所有内容都以下列一手文档为准。厂商一旦改规则,最先反映在那里。
- The /llms.txt file proposal — llmstxt.org
- Sitemaps XML format (protocol 0.9) — sitemaps.org
最后审阅于 。每当厂商更新规范,我们都会重新核对本页内容。