发现同域页面
从输入页面提取站内链接,并优先读取产品、服务、文档、文章和关于页面。
GenieWiki读取公开网站的重要页面,生成一份可编辑、可下载的 AI 友好网站导航文件。
输入网站信息
抓取多个页面可能需要十几秒,请不要重复提交
生成完成
起始页面:
llms.txt 是面向 AI 代理的网站导航提案,不是排名保证。Google Search 已明确表示其搜索和生成式 AI 功能不把 llms.txt 作为特殊优化信号。发布前请核对所有描述和链接。
工作原理
从输入页面提取站内链接,并优先读取产品、服务、文档、文章和关于页面。
读取 Title、Meta Description、H1–H3 和正文摘要,不执行网页中的脚本或指令。
按 Markdown 格式组织网站摘要和重要链接,支持复制、编辑和下载。
写给 AI 的网站入口
它是一份放在网站根目录的 Markdown 文本,用简短摘要和链接列表帮助兼容的 AI 代理快速找到重要内容。
把导航、脚本和视觉组件之外的核心页面集中列出,节省代理发现内容的成本。
站长可以解释网站定位、目标用户与页面用途,但必须确保内容真实准确。
产品文档、知识库、工具集合和内容站拥有明确页面体系,更容易从这种导航中获益。
它不能替代可抓取 HTML、站点地图、结构化数据、内部链接和高质量正文。
上线方法
删除低价值页面,修正不准确描述,不要把测试、登录或隐私页面列为主要资源。
文件公开地址通常应为 https://你的域名/llms.txt,并返回 text/plain 或可读文本。
新产品、新文档或链接失效时应同步更新,避免向代理提供过期入口。
常见问题
不能这样承诺。Google Search 已明确说明,其搜索与生成式 AI 功能不使用 llms.txt 作为特殊优化信号。它更适合作为兼容代理的网站导航补充。
不能。robots.txt 管理抓取权限,sitemap.xml 帮助搜索引擎发现 URL;llms.txt 提供的是面向代理的人工整理语境与重要链接。
工具只读取同域 HTML 页面,并受页面上限、超时、访问限制、链接结构和服务器响应影响。JavaScript 渲染后才出现的链接可能无法发现。
规则版直接使用页面标题和描述,速度快且数据不发送给模型;AI 版会调整摘要和分组,但仍需人工核对。
当前版本只在本次请求中读取并处理,不建立公开报告页,也不持久化保存抓取内容。
工具会代表用户向目标网站发起多个请求,因此只应分析自己拥有或已明确获授权的网站。
不建议不经检查直接上线。自动摘要可能遗漏语境,页面标题也可能不适合作为代理导航说明。
先生成覆盖关键入口的精简文件。大型文档站可以按目录提供更具体的 llms.txt,并为重要页面提供干净的 Markdown 版本。