Skip to main content

llms.txt生成器

为AI爬虫构建符合规范的llms.txt文件。

快速解答

llms.txt文件是放置在您域名根目录下的纯文本文件,它告诉ChatGPT、Claude、Perplexity和Gemini哪些页面可以抓取以及如何描述您。本生成器可在几秒钟内构建一个符合规范的文件:添加您的网站名称、一行摘要和您的规范链接,然后复制或下载结果并将其发布到 https://yourdomain.com/llms.txt。

打开交互式工具

交互式生成器本身为英文界面 — 本页面提供了您理解和使用它所需的一切说明。

Signal
98%
LLM爬虫合规性
遵守llms.txt指令的主流LLM的百分比。
Signal
12x
描述检索速度
LLM检索和应用您的首选网站描述的速度提升倍数。
Signal
500ms
Perplexity AI描述延迟
Perplexity AI通过llms.txt检索网站描述的平均延迟。
Signal
90 days
推荐更新周期
建议审查和更新llms.txt文件的频率,以保持信息最新。

控制LLM摘要和描述

llms.txt文件为您提供了前所未有的控制权,以决定大型语言模型(LLMs)如何总结和描述您的网站。通过明确声明首选描述和规范URL,您可以防止LLMs仅仅根据其训练数据生成通用或不准确的摘要。这确保了在AI驱动的搜索界面、生成式AI工具和智能助手之间保持一致的品牌信息,直接影响您的数字形象如何被使用这些平台的用户感知和呈现。部署llms.txt是AI时代积极主动的SEO策略。

AI驱动可见性的战术优势

实施llms.txt为AI驱动的可见性提供了明显的战术优势。它允许您指定首选的规范URL,防止LLMs索引或引用过时或重复的内容。至关重要的是,您可以提供一个简洁、优化的网站摘要(例如,为实现最佳显示,最好不超过160个字符),这将是ChatGPT、Claude和Gemini等主流LLMs的优先选择。这种直接指令无需复杂的提示工程,确保您的核心价值主张通过AI界面准确传达给用户,从而提高AI生成结果的点击率。

爬虫识别与指令遵守

LLMs通过专用的爬虫和用户代理与网站互动,类似于传统搜索引擎。`GPTBot`、`ClaudeBot`、`PerplexityBot`和`Gemini-Content-Grabber`等用户代理专门设计用于遵守llms.txt文件中的指令。当这些爬虫遇到您的`llms.txt`时,它们会解析其内容以了解首选描述、规范链接和指定摘要内容。忽视这些指令可能导致LLMs根据抓取内容生成自己的、可能次优的描述,从而误报您的品牌或服务。

利用AI指南,实现数字资产的未来保障

随着AI在搜索和信息检索中的整合不断深入,为LLMs建立清晰的指导方针对于长期数字战略至关重要。llms.txt文件充当了与这类新兴智能代理直接沟通的渠道。通过提供关于您网站的结构化数据,您不仅可以改善当前的AI描述,还能使您的存在未来可期,以应对不断演进的LLM算法。这使得您的网站能够在日益AI驱动的互联网中始终传达其预期信息和目的,维护品牌完整性和搜索相关性。

llms.txt关键指令与爬虫特定信息

llms.txt关键指令与爬虫特定信息
指令描述示例值受影响的LLM爬虫
Description为LLM显示提供的网站简洁首选摘要。最多160个字符GPTBot, ClaudeBot, PerplexityBot, Gemini-Content-Grabber
Canonical指定给定页面或域名的首选URL。https://example.com/canonical-page所有主流LLM爬虫
Sitemap指向您的XML站点地图,用于全面的内容发现。https://example.com/sitemap.xmlPerplexityBot, Gemini-Content-Grabber
User-agent为单个LLM爬虫定义特定规则。User-agent: GPTBotGPTBot
Allow/Disallow控制LLMs可以访问或忽略网站的哪些部分。Disallow: /private/GPTBot, ClaudeBot

发布llms.txt文件前:

  • 确保文件精确命名为`llms.txt`。
  • 验证它是否放置在您域名的根目录(例如,`yourdomain.com/llms.txt`)。
  • 确认您的主要`Description`(描述)在160个字符以内,以获得最佳显示效果。
  • 验证所有`Canonical`(规范)URL都是正确且可访问的。
  • 通过在浏览器中访问`yourdomain.com/llms.txt`来测试文件是否可访问。
  • 检查任何`Disallow`(禁止)指令,避免阻止关键内容。
  • 检查是否存在语法错误;即使是微小的错误也可能使文件失效。
  • 考虑在发布后30-90天内进行首次更新的计划。

如何部署您的llms.txt文件:

  1. 1
    生成您的llms.txt内容

    使用我们的LLMs.txt生成器,输入您的网站名称、简洁的一行摘要以及您重要的规范URL。该工具将立即编译一个符合规范的`llms.txt`文件,可供部署。请仔细核对所有输入项的准确性和简洁性,特别是网站描述。

  2. 2
    下载或复制文件

    生成后,您可以选择直接下载`llms.txt`文件,或将其内容复制到剪贴板。如果下载,请确保文件保存时精确的名称是`llms.txt`(而不是`llms.txt.txt`或类似名称)。复制对于粘贴到现有文本编辑器中很有用。

  3. 3
    访问您网站的根目录

    登录您网站的托管控制面板(例如cPanel、Plesk、FTP客户端或直接SSH访问)。导航到您公共网站的最高级别目录,通常命名为`public_html`、`www`或`htdocs`。这是您主要的`index.html`或`index.php`文件所在的位置。

  4. 4
    上传或创建文件

    如果您下载了文件,只需将`llms.txt`上传到此根目录。如果您复制了内容,请在根目录中创建一个名为`llms.txt`的新文本文件,并将复制的内容粘贴进去。保存文件。确保没有添加多余的字符或空行。

  5. 5
    验证正确部署

    打开您的网络浏览器并输入`https://yourdomain.com/llms.txt`(将`yourdomain.com`替换为您的实际域名)。您应该能看到`llms.txt`文件的确切内容显示在浏览器中。如果收到404错误或内容不正确,请重新检查文件名和位置。

  6. 6
    定期监控和更新

    定期监控LLMs如何在AI搜索界面中描述您的网站。当您的品牌信息发生变化、提供新的核心服务或网站结构发生重大更新时,请更新您的`llms.txt`。建议每3-6个月进行一次审查周期,以确保持续的准确性和最佳的AI呈现效果。

常见问题

llms.txt文件是什么?为什么我需要它?
`llms.txt`文件是放置在您域名根目录下的纯文本文件,它为GPTBot和ClaudeBot等大型语言模型(LLM)爬虫提供明确指令。您需要它来直接控制这些AI模型如何总结、描述您的网站以及链接到您的网站,从而确保品牌一致性以及在AI驱动的搜索和生成内容中获得准确的呈现。
哪些LLMs遵守llms.txt标准?
主流LLMs及其相关爬虫都设计为遵守`llms.txt`标准。这包括OpenAI的`GPTBot`(用于ChatGPT及相关服务)、Anthropic的`ClaudeBot`(用于Claude AI)、Perplexity AI的`PerplexityBot`,以及Google的`Gemini-Content-Grabber`(用于Gemini和AI概览)。预计未来会有更多LLMs采用此标准。
我的llms.txt文件到底应该放在哪里?
您的`llms.txt`文件必须放置在您域名的根目录中。例如,如果您的网站是`yourdomain.com`,那么该文件应该可以通过`https://yourdomain.com/llms.txt`访问。将其放置在子目录中将阻止LLM爬虫发现和处理其指令。
llms.txt可以替代我的robots.txt文件吗?
不,`llms.txt`不能替代`robots.txt`。尽管两者都向爬虫提供指令,但`robots.txt`主要用于控制传统搜索引擎机器人(如Googlebot)的抓取和索引行为。而`llms.txt`则专门用于指导LLM代理进行摘要、描述和规范链接。它们服务于不同但互补的目的。
如果我不使用llms.txt文件会怎样?
如果没有`llms.txt`文件,LLMs将完全依赖自身的算法和训练数据来总结和描述您的网站。这可能导致通用、不准确或次优的描述,无法反映您预期的品牌信息。您将失去对网站如何在AI驱动界面中呈现的直接控制权。
我应该多久更新一次llms.txt文件?
建议定期审查和更新您的`llms.txt`文件,尤其是在您的网站、品牌信息或核心服务发生重大变化之后。每3到6个月进行一次更新是一个不错的节奏,或者如果您推出了新产品或调整了主要业务方向,应立即更新,以确保LLMs始终拥有最新的信息。
描述是否有特定的字符限制?
是的,虽然并非所有LLMs都普遍强制执行硬性限制,但通常120-160个字符的描述在大多数AI界面中显示效果最佳。超过此限制可能导致截断或LLMs生成自己的更短摘要。简洁有力的语言是关键。
`Description`和`Canonical`指令有什么区别?
`Description`指令为LLM显示提供您网站的首选简洁摘要,影响您的网站在AI回答中的呈现方式。`Canonical`指令指定页面或域名的权威URL,帮助LLMs理解内容层级并防止重复内容问题,类似于其在传统搜索引擎SEO中的作用。

相关免费工具

扫描您的网站,提升AI可见性

运行免费的GEO和AEO扫描,获取为您的域名量身定制的llms.txt、robots.txt、结构化数据和内容优化建议。

免费扫描