GEO 项目库
报告错误经策展与核验的 GEO 仓库,逐条标注相关性、许可、活跃度与适用范围。
83 个项目 仓库数据同步于 2026年8月23日 收录方法
技术接入
影响智能体如何访问站点的爬虫权限、robots 规则与 llms.txt 工具。
- 查看仓库
GitHub ai-robots-txt/ai.robots.txt
由社区维护的 AI 爬虫 User-Agent 名录:以单一 JSON 文件为准,自动生成可直接部署的 robots.txt 以及 Nginx、Apache、Caddy 等服务器的拦截规则。
数据集 面向生产 Python MIT 4,069 最近提交 2026年8月22日
- 查看仓库
GitHub angeo-dev/module-robots-txt-aeo
面向 Magento 2 的模块,在 robots.txt 渲染阶段前置一段受管的 AI 抓取器规则,默认放行主流 AI 抓取器,不写数据库、不改文件,商家原有配置保持原样。
库 / SDK 面向生产 PHP MIT 5 最近提交 2026年6月14日
- 查看仓库
GitHub AnswerDotAI/llms-txt
/llms.txt 规范的原始仓库,同时提供参考实现的 Python 命令行工具,可把该文件展开为能直接喂给模型的上下文包。
协议 / 规范 可用 Jupyter Notebook Apache-2.0 2,578 最近提交 2026年8月10日
- 查看仓库
GitHub dotenvx/llmstxt
用途单一的命令行工具:遍历站点 sitemap.xml 中的每个链接,逐页读取标题与描述,拼装成 llms.txt 索引,并支持路径包含或排除以及标题字符串替换。
命令行工具 可用 JavaScript BSD-3-Clause 147 最近提交 2026年3月5日
- 查看仓库
GitHub galaar-org/AgentECHO
一套用 Docker 编排的自建方案:Next.js 中间件 SDK 采集请求,Go 服务分类后写入 ClickHouse,仪表盘按路由展示 AI 抓取量,并给出授权收入估算。
应用 实验性 TypeScript 4 最近提交 2026年1月15日
- 查看仓库
GitHub JerryZhi/AI-Crawler-Detector
一个单文件 Python 探测脚本,用数十个 AI 抓取器的 User-Agent 逐一请求同一个网址,汇总各自拿到的 HTTP 状态码,用于查看服务器实际放行了谁、拦下了谁。
命令行工具 实验性 Python MIT 5 最近提交 2025年8月20日
- 查看仓库
GitHub maango-io/ai-policy.json
一份 CC0 草案规范,主张网站在 /.well-known/ai-policy.json 用一个 JSON 文件声明三类许可:能否用于模型训练、能否被 AI 搜索收录引用、能否在生成回答时取用。
协议 / 规范 实验性 CC0-1.0 5 最近提交 2026年4月18日
- 查看仓库
GitHub madarco/ragrabbit
可自托管的 Next.js 应用:抓取站点内容并写入 pgvector 向量库,对外提供目录可重排的 llms.txt、可嵌入的站内 AI 搜索挂件,以及一个 MCP 检索接口。
应用 实验性 TypeScript MIT 136 最近提交 2026年1月5日
2026-08-08 核验:默认分支锁定 Next.js 15.2.3,而 2026 年 1 月 React Server Components 安全公告的修复(15.2.8)只合并到 demo 分支。因此 README 提供的一键部署仍会部署未修补的版本,对外暴露实例前应先升级 Next。
- 查看仓库
GitHub MADEVAL/WP-robots-generator
在浏览器内运行的 WordPress robots.txt 生成器,按三档安全级别与常用插件补全屏蔽规则,并用一个开关对十个已知 AI 抓取器写入 Disallow,全部逻辑在前端完成。
应用 可用 JavaScript GPL-3.0 31 最近提交 2026年6月30日
- 查看仓库
Hugging Face megrisdal/llms-txt
包含 174 个站点 llms.txt 全文的 CC0 语料,经公开的 Kaggle notebook 从社区目录 directory.llmstxt.cloud 采集,由 Kaggle 产品负责人维护。
数据集 可用 HF 数据集 CC0-1.0 13 ♥ 近 30 天下载 76 次 更新于 2026年8月17日
- 查看仓库
GitHub nuxt-content/nuxt-llms
由 NuxtLabs 维护的 Nuxt 模块:在预渲染阶段自动产出 /llms.txt 以及可选的 /llms-full.txt,并开放运行时钩子,允许内容模块或第三方模块自行追加章节与链接。
库 / SDK 面向生产 TypeScript MIT 167 最近提交 2026年8月21日
- 查看仓库
GitHub pawamoy/mkdocs-llmstxt
MkDocs 插件:按配置的分节与通配规则输出 /llms.txt,并把渲染后的 HTML 反向转换回 Markdown,使自动生成的 API 参考文档同样进入产物,可选一并输出 llms-full.txt。
库 / SDK 面向生产 Python ISC 130 最近提交 2026年8月23日
- 查看仓库
GitHub rubenmarcus/aeo.js
面向十余种前端框架的构建期插件与命令行工具:产出 llms.txt、逐页 Markdown、robots.txt、站点地图与 JSON-LD 结构化数据,并可为任意线上站点给出可见性就绪评分。
库 / SDK 实验性 TypeScript 129 最近提交 2026年8月11日
未检测到许可证
- 查看仓库
GitHub stani-chirk/logwick
自托管的日志分析工具:读取边缘节点导出的 JSONL 访问日志,把请求分成真人、搜索抓取、AI 训练采集与 AI 实时取页等类别,落到本地 SQLite,并在本机仪表盘按会话与路径查看。
应用 可用 JavaScript 4 最近提交 2026年6月10日
- 查看仓库
GitHub FabrizioCafolla/openai-crawlers-ip-ranges
由每周定时任务自动同步 OpenAI 官方公布的 GPTBot、ChatGPT-User 与 OAI-SearchBot 抓取 IP 段,提供纯地址与 CIDR 两种文本格式,可直接用于服务器端核验抓取来源。
数据集 可用 Shell MIT 31 最近提交 2026年8月17日
- 查看仓库
GitHub firecrawl/llmstxt-generator
Firecrawl 推出的网页端 llms.txt 生成工具:自动抓取整站内容并汇编为 llms.txt 与 llms-full.txt 两种文件;官方于 2025 年中声明弃用,指向 create-llmstxt-py 作为后继示例。
应用 历史项目 TypeScript 537 最近提交 2025年6月17日
未检测到许可证
- 查看仓库
GitHub langchain-ai/mcpdoc
LangChain 推出的 MCP(Model Context Protocol) 服务器:让 IDE 与编码智能体按用户指定的 llms.txt 索引检索对应文档页面,且每次工具调用均可审计。
库 / SDK 可用 Python MIT 1,030 最近提交 2026年8月20日
- 查看仓库
GitHub JonasLong/Pyison
自托管的 Python 爬虫陷阱(tarpit):以程序生成的无限链接迷宫困住无视 robots.txt 的 AI 爬虫,消耗其抓取预算并向其投喂随机文本。
应用 可用 Python MIT 122 最近提交 2025年10月10日
内容与实体优化
让页面更容易被识别和引用的内容、结构化数据与智能体工作流。
- 查看仓库
GitHub aaron-he-zhu/aaron-marketing-skills
一套可跨智能体运行的营销技能库;其中 SEO/GEO 路径从调研与内容实施,延伸到技术检查、引用就绪度门控和效果监测。
Agent Skill 面向生产 Python Apache-2.0 2,622 最近提交 2026年8月23日
- 查看仓库
GitHub AEO-God-Mode/aeo-god-mode
把 AI 搜索准备工作变成 WordPress 后台配置项的插件,涵盖抓取器许可、结构化数据输出、llms.txt 生成与 AI 机器人访问日志。
库 / SDK 面向生产 PHP GPL-2.0 19 最近提交 2026年8月21日
- 查看仓库
GitHub AgriciDaniel/claude-seo
面向 Claude Code 的审计插件:二十五个子技能与十八个子智能体并行检查技术层、结构化数据与 AI 回答可引用性,产出按优先级排序的整改清单。
Agent Skill 面向生产 Python MIT 14,824 最近提交 2026年8月20日
- 查看仓库
GitHub AgriciDaniel/codex-seo
一套 Codex 原生的 SEO 技能系统,包含二十六个专项工作流、TOML 智能体配置和确定性运行器,覆盖审计、Schema、GEO/AEO 与报告。
Agent Skill 面向生产 Python 606 最近提交 2026年7月20日
- 查看仓库
GitHub aigclink/geolook
自托管的 GEO 实施平台:向十五个回答引擎采样品牌提及情况,把诊断结果转成工单与可部署产物,再重新抓取核验每项修改是否真的落地。
应用 可用 Python MIT 578 最近提交 2026年8月10日
- 查看仓库
GitHub angeo-dev/module-rich-data
为 Magento 2 商店在商品页、内容页与首页注入 Product、Organization、FAQPage 与 BreadcrumbList 结构化数据,并补齐退货与配送等商家政策字段,附带命令行校验。
库 / SDK 可用 PHP MIT 5 最近提交 2026年6月14日
- 查看仓库
GitHub Auriti-Labs/geo-optimizer-skill
按八个类别为站点面向 AI 答案的准备度打分,逐项列出需要修改的地方,并向真实引擎发问,核实品牌是否真的被引用。
Agent Skill 面向生产 Python MIT 730 最近提交 2026年8月17日
- 查看仓库
Hugging Face cx-cmu/AutoGEO_Mini
AutoGEO Mini 的官方 demo Space:在浏览器里粘贴文档即得 GEO 改写结果,后端是已发布的检查点。
应用 研究代码 HF Space 1 ♥ 更新于 2026年4月3日
未检测到许可证
- 查看仓库
Hugging Face cx-cmu/AutoGEO_mini_Qwen1.7B_Ecommerce
AutoGEO Mini 在电商域上的专用检查点,针对以 gemini-2.5-flash-lite 驱动的引擎训练,用于商品内容改写。
模型 研究代码 HF 模型 MIT 0 ♥ 近 30 天下载 22 次 更新于 2026年4月11日
- 查看仓库
Hugging Face cx-cmu/AutoGEO_mini_Qwen1.7B_GEOBench
AutoGEO Mini 在 GEO-Bench 域上的专用检查点,针对以 gemini-2.5-flash-lite 驱动的引擎训练,由实验室组织发布,与 GEO-Bench 数据配置直接配对。
模型 研究代码 HF 模型 MIT 0 ♥ 近 30 天下载 30 次 更新于 2026年4月11日
- 查看仓库
Hugging Face cx-cmu/AutoGEO_mini_Qwen1.7B_ResearchyGEO
AutoGEO Mini 在 Researchy-GEO 域上的专用检查点:面向以 gemini-2.5-flash-lite 驱动的生成式引擎改写文档,同时要求保持原意与事实内容。
模型 研究代码 HF 模型 MIT 0 ♥ 近 30 天下载 35 次 更新于 2026年4月11日
- 查看仓库
GitHub dodopayments/dualmark
为每个页面生成同一网址下的 Markdown 孪生副本,由 HTTP 内容协商决定返回哪一种格式,并配有一份公开的 RFC-2119 规范和可接入持续集成的一致性评分工具。
库 / SDK 可用 TypeScript Apache-2.0 101 最近提交 2026年8月22日
- 查看仓库
GitHub geo-team-red/geo-optimizer
Go 语言的 GEO 优化库:以结构、结构化数据、结论先行、权威性、常见问题五种可注册策略改写内容,并用规则打分给出改写前后的对比。
库 / SDK 实验性 Go MIT 190 最近提交 2026年3月27日
- 查看仓库
GitHub IJONIS/geo-lint
一款判定确定的内容检查器,输出的 JSON 专为智能体读取:智能体依据每条告警的修改建议改稿,再反复重跑至无告警。规则覆盖生成式引擎优化(GEO)、搜索引擎优化、可读性与国际化。
命令行工具 可用 TypeScript MIT 39 最近提交 2026年3月19日
- 查看仓库
GitHub jdevalk/seo-graph
一套带类型的 schema.org JSON-LD 图谱构建工具,配套 Astro 集成,同时可对外提供 Markdown 副本、llms.txt 以及符合 RFC 9727 的接口目录,供智能体发现内容。
库 / SDK 可用 TypeScript MIT 46 最近提交 2026年8月17日
- 查看仓库
GitHub mverab/eGEOagents
双运行时的 GEO 工具箱:既是 Claude Code 智能体,也是独立的 Python 命令行工具,为页面打分、改写正文、生成 JSON-LD,并可按周作为有界循环持续复跑。
命令行工具 可用 Python MIT 163 最近提交 2026年8月12日
- 查看仓库
GitHub onvoyage-ai/gtm-engineer-skills
一套面向 Claude Code 的网站审计技能:先以十六项基础检查抓取站点,再把六个智能分析维度转成针对不同框架的修复建议。
Agent Skill 可用 HTML MIT 1,280 最近提交 2026年6月7日
- 查看仓库
GitHub rafters-studio/astro-meta
面向 Astro 站点的构建期集成,统一产出 JSON-LD、llms.txt、含 AI 抓取器分类清单的 robots、站点地图、OG 图,以及一份逐路由的可读性评分。
库 / SDK 可用 TypeScript MIT 6 最近提交 2026年8月3日
- 查看仓库
GitHub rodrigostockebrand/oreilly-aeo-book
一本 O'Reilly 答案引擎优化专著的配套代码库,收录书中因版面压缩而删节的完整清单:日志分析脚本、JSON-LD、robots 与 llms.txt 范例。
模板 / 示例 可用 Python MIT 1 最近提交 2026年7月16日
- 查看仓库
GitHub seranking/seo-skills
一套面向生产的 Claude Agent Skills 集合,把 SE Ranking 数据转成内容简报、技术审计、结构化数据和 AI 搜索声量报告。
Agent Skill 面向生产 Python MIT 123 最近提交 2026年6月25日
- 查看仓库
GitHub spronta/crawlie
Rust 编写的审计爬虫:按五十七条规则检查站点技术层、无障碍与 GEO 表现,为每个页面给出面向 AI 回答的准备度分数,同一引擎也通过 MCP 供智能体调用。
命令行工具 可用 Rust 99 最近提交 2026年7月18日
- 查看仓库
GitHub yaojingang/GEORank
自托管的中文 GEO 工作台:先对站点做一次 AI 可读性诊断,再据诊断结果生成 JSON-LD、llms.txt、标题与 30/60/90 天行动方案。
应用 可用 Python Apache-2.0 419 最近提交 2026年8月19日
- 查看仓库
Hugging Face yujiangw/AutoGEO_mini_Qwen1.7B
AutoGEO Mini 基础检查点:以 GRPO 强化学习微调的 Qwen3-1.7B 网页改写模型,按论文口径,其改写成本远低于前沿大模型。
模型 研究代码 HF 模型 MIT 0 ♥ 近 30 天下载 15 次 更新于 2025年12月13日
- 查看仓库
GitHub yulia-glukhova/aeo-schema-skill
一份供 Claude 等代理使用的技能文件,引导模型产出面向答案引擎的 Schema.org 标记,以跨页实体图为组织方式,而非逐页孤立片段。
Agent Skill 实验性 MIT 2 最近提交 2026年3月13日
- 查看仓库
GitHub zubair-trabzada/geo-seo-claude
一套 GEO 优先的 Claude Code 技能:审计网站、评估段落可引用性、检查 AI 爬虫访问,并生成 Schema、llms.txt 与分平台优化建议。
Agent Skill 面向生产 Python MIT 9,430 最近提交 2026年8月22日
- 查看仓库
GitHub JayHoltslander/Structured-Data-JSON-LD
一套经作者手工验证的 schema.org JSON-LD 范例合集,覆盖三十余种类型,在富媒体结果时代被广泛传抄,自二〇一九年起基本停止更新。
模板 / 示例 历史项目 279 最近提交 2022年11月11日
未检测到许可证
- 查看仓库
GitHub mustafapiplodi/schema-generator
完全在浏览器内运行的表单式结构化数据生成器,覆盖十四种类型,边填边校验,可导出 JSON、HTML 片段或 GTM 使用说明。
应用 实验性 JavaScript 0 最近提交 2025年11月11日
未检测到许可证
- 查看仓库
GitHub schemaorg/schemaorg
schema.org 词汇表的上游仓库:术语在此提出、评审并构建为对外发布的站点,自 2011 年起在 W3C 社区组的流程下运作。
协议 / 规范 面向生产 HTML Apache-2.0 6,216 最近提交 2026年8月20日
可见度监测
跨生成式回答引擎测量品牌提及、引用与流量。
- 查看仓库
GitHub ai-search-guru/getcito-worlds-first-open-source-aio-aeo-or-geo-tool
自托管的可见度追踪平台:以 Postgres 作业队列定时向 AI 回答引擎发送提问,汇总品牌、竞品与被引来源的分布,并提供 REST 接口与白标部署模式。
应用 面向生产 TypeScript MIT 170 最近提交 2026年8月22日
- 查看仓库
GitHub aryamantodkar/oneglanse
自托管的可见性追踪工具:用浏览器打开你自己已登录的五个 AI 产品会话,抓取它们渲染出的回答而非 API 输出,再交由大模型打分。
应用 实验性 TypeScript MIT 153 最近提交 2026年5月10日
2026-08-08 核验:其取数方式是登录你自己的 ChatGPT、Gemini、Perplexity、Claude 与 Google 账号,用反指纹浏览器抓取渲染出的回答,选用该浏览器正是因为常规自动化会触发机器人检测。这属于刻意绕过反自动化控制,很可能违反上述厂商条款,并可能导致所连账号被封停。评分也由大模型评审在单次随机结果上给出,没有重复采样与置信区间。README 自称是唯一免费开源的 GEO 追踪器,该说法并不成立。
- 查看仓库
GitHub Canonry/canonry
自托管的答案引擎优化(AEO)平台:通过厂商 API 测量引用,从服务器日志获取爬虫与转介流量,再把修复动作写回站点。
应用 面向生产 TypeScript 117 最近提交 2026年8月20日
- 查看仓库
GitHub danishashko/geo-aeo-tracker
自托管的可见度面板:在六个 AI 回答界面批量运行品牌提问,记录提及、引用与可见度漂移的时间序列,数据默认留在本地浏览器。
应用 可用 TypeScript MIT 244 最近提交 2026年8月12日
- 查看仓库
GitHub elmohq/elmo
可自托管的 AI 可见度追踪平台:批量向答案引擎发送预设提问,把回答整理成品牌提及、引用来源与竞品对比等指标。
应用 可用 TypeScript MIT 258 最近提交 2026年8月22日
- 查看仓库
GitHub onism1767-creator/potato
本地运行的向导与命令行工具:用 24 道固定问题采样 Claude 联网检索的回答,输出带置信区间的品牌提及率与引用率。
命令行工具 实验性 Python MIT 168 最近提交 2026年6月22日
研究与评测
研究检索、排序与引用行为的代码、数据集和评测基准。
- 查看仓库
GitHub AIcling/agentic_geo
自进化 GEO 改写系统:用质量多样性策略档案配合协同进化的评审器,在极少的引擎调用下为每篇内容选出适配的改写路径。
库 / SDK 研究代码 Python Apache-2.0 39 最近提交 2026年8月5日
- 查看仓库
Hugging Face cx-cmu/E-commerce
AutoGEO 的商业域数据集:面向商品的查询,沿用六配置布局,是三个域中最小的一个(约 1600 训练 400 测试)。
数据集 研究代码 HF 数据集 MIT 2 ♥ 近 30 天下载 222 次 更新于 2025年12月17日
- 查看仓库
Hugging Face cx-cmu/GEO-Bench
AutoGEO 发布的研究域 GEO-Bench 数据,按其管线重组为六个配置:训练测试、规则抽取、冷启动微调、推理与 GRPO 输入及评估(约 8000 训练 1000 测试)。
数据集 研究代码 HF 数据集 MIT 1 ♥ 近 30 天下载 117 次 更新于 2025年12月17日
- 查看仓库
Hugging Face cx-cmu/Researchy-GEO
AutoGEO 的研究域评测数据,基于 Researchy 的长开放式查询构建,与同系列数据集共用六配置布局,是三个域中规模最大的一个(约 10000 训练 1000 测试)。
数据集 研究代码 HF 数据集 MIT 1 ♥ 近 30 天下载 90 次 更新于 2025年12月17日
- 查看仓库
GitHub cxcscmu/AutoGEO
卡内基梅隆团队的研究代码:先从生成式引擎中挖出内容偏好规则,再用提示或强化学习训练的小模型按规则改写文档。
库 / SDK 研究代码 Python MIT 202 最近提交 2026年6月14日
- 查看仓库
GitHub EvoNexusX/2026LiuFeatGEO
在可解释的特征空间(结构、内容、语言)中用多目标进化搜索寻优,再让语言模型把胜出的特征组合落地成自然文本。
库 / SDK 研究代码 Python 4 最近提交 2026年5月13日
未检测到许可证
- 查看仓库
GitHub GEO-optim/GEO
为「生成式引擎优化」命名的那篇论文的官方代码与 GEO-Bench 评测脚本,用于测量内容改写如何改变来源可见度。
评测基准 研究代码 Python Apache-2.0 320 最近提交 2025年10月30日
- 查看仓库
GitHub parameterlab/c-seo-bench
NeurIPS 2025 数据集与基准论文的配套代码:在六个领域、多方同时采用的设定下,检验已发表的对话式 SEO 手法能否真正提升被引用排名。
评测基准 研究代码 Jupyter Notebook MIT 19 最近提交 2025年9月28日
- 查看仓库
GitHub psbagga17/E-GEO
电商 GEO 测试床:1.37 万条长文购物需求配 8.6 万件真实商品,衡量在看不到查询的前提下改写商品描述能把排名推高多少,由五个模型评审打分。
评测基准 研究代码 Python 45 最近提交 2026年7月3日
未检测到许可证
- 查看仓库
Hugging Face psbagga17/E-GEO
E-GEO 测试床数据:1.37 万条长对话式购物需求,每条配十件亚马逊商品;附固定的 2000 条测试集、六个模型评审的缓存排名与 3GB 已发布实验产物。
数据集 研究代码 HF 数据集 CC-BY-4.0 0 ♥ 近 30 天下载 222 次 更新于 2026年7月3日
- 查看仓库
Hugging Face qychen/CC-GSEO-Bench
CC-GSEO-Bench 数据集,配套评测管线运行时从 Hub 拉取:1000 多篇源文章与 5000 多组查询文章配对,用于按影响力而非仅按是否被引用来评估 GEO 改写策略。
数据集 研究代码 HF 数据集 Apache-2.0 0 ♥ 近 30 天下载 35 次 更新于 2025年12月26日
- 查看仓库
GitHub qychen2001/CC-GSEO-Bench
基准评测管线:对一篇源文章施加十种常见 GEO 改写策略,生成答案后由模型评审在三项指标上打出该文章的实际影响力。
评测基准 研究代码 Python 3 最近提交 2025年12月26日
未检测到许可证
- 查看仓库
GitHub Wu-beining/MAGEO
多智能体 GEO 优化闭环:先刻画引擎偏好,再规划并生成多份文档改写候选,最后只保留通过归因保真度门槛的版本。
库 / SDK 研究代码 Python 36 最近提交 2026年6月29日
未检测到许可证
- 查看仓库
GitHub yaojingang/geo-citation-lab
公开的引用测量工作台,汇集跨平台引用吸收实验、21.4 万条中文 AI 搜索引用记录,以及两者背后的分析管线。
数据集 研究代码 HTML 662 最近提交 2026年8月9日
- 查看仓库
Hugging Face yonsei-dli/SAGEO-Arena
SAGEO Arena 发布数据:从成熟检索数据集抽样的九个领域共 2700 条查询,配 26.2 万条 Google 自定义搜索结果;网页内容以链接加抓取说明的方式提供,不直接再分发正文。
数据集 研究代码 HF 数据集 MIT 0 ♥ 近 30 天下载 84 次 更新于 2026年5月28日
- 查看仓库
GitHub zhizibianjie-omniedge/geo-cultural-encoding
论文的配套数据样本与统计脚本,研究训练数据的地域构成如何决定模型愿意提及哪些品牌。
数据集 研究代码 Python MIT 71 最近提交 2026年1月6日
安全与操纵
围绕排名操纵、内容投毒、检测与防御控制的研究。
- 查看仓库
GitHub aounon/llm-rank-optimizer
「策略性文本序列」论文的官方攻击代码:为商品页优化一段对抗性文本,使大模型把该商品推到推荐列表首位。
库 / SDK 研究代码 Shell MIT 132 最近提交 2025年8月18日
- 查看仓库
Hugging Face Bai-YT/RAGDOLL
RAGDOLL 数据集:十个品类共 1147 个真实商品页面,用于研究对话搜索中的排名操纵;以链接清单发布,并附论文所用平衡子集的已下载网页。
数据集 研究代码 HF 数据集 CC-BY-4.0 4 ♥ 近 30 天下载 1,809 次 更新于 2024年7月25日
- 查看仓库
GitHub glad-lab/geobench
GEO-Bench 官方基准:把九种已发表的排名操纵方法与十种白帽 C-SEO 策略放在同一个固定的大模型排序器上重跑,同时给出操纵效果与可检测性两类分数。
评测基准 研究代码 Python 3 最近提交 2026年8月3日
未检测到许可证
- 查看仓库
GitHub glad-lab/MGEO
ACL 2026 KnowFM 工作坊论文的官方代码:协同扰动商品图片与文字,可把指定商品推到视觉语言模型排序器的首位,效果强于仅改文本或仅改图像的单模态做法。
库 / SDK 研究代码 Python 3 最近提交 2026年6月7日
未检测到许可证
- 查看仓库
GitHub QianfengWen/SafeGEO
配套论文的基准套件:用七种 GEO 操纵原语改写卖家可控的商品来源,衡量推荐智能体偏离合理选择的幅度,并附六层开发者侧防护的对照实验。
评测基准 研究代码 Python Apache-2.0 5 最近提交 2026年8月22日
- 查看仓库
GitHub spfrommer/cse-ranking-manipulation
EMNLP 2024 主会论文的复现产物:证明注入的文本可以把排名靠后的商品在对话式搜索结果中抬高,且在当时的商用引擎上同样成立。
库 / SDK 历史项目 Python 6 最近提交 2024年10月11日
未检测到许可证
- 查看仓库
GitHub Tangyiming205069/controllable-seo
StealthRank 论文的官方代码:证明在商品描述中嵌入一段读起来自然的对抗性文本,就能改变大模型排序器的输出顺序,且不留明显的推广痕迹。
库 / SDK 研究代码 Python 10 最近提交 2026年7月30日
未检测到许可证
- 查看仓库
Hugging Face wieeii/SafeGEO
SafeGEO 基准数据:六个商品垂类共 4.08 万个推荐实例,将模型可见输入与隐藏标注分开发布,覆盖由七种操纵原语组成的 22 个 GEO 攻击包。
数据集 研究代码 HF 数据集 CC-BY-4.0 0 ♥ 近 30 天下载 203 次 更新于 2026年7月2日
- 查看仓库
GitHub matanbt/GASLITE
ACM CCS 2025 论文的复现代码:通过优化对抗性段落,使稠密向量检索在一整类查询上都把这些段落排进前列。
库 / SDK 研究代码 Python 14 最近提交 2025年12月6日
未检测到许可证
- 查看仓库
GitHub yxf203/PoisonArena
PoisonArena 官方基准:让六种投毒攻击在同一个 RAG 语料库上互相竞争,衡量当多个攻击方争夺同一问题的答案时,哪些手法仍然有效。
评测基准 研究代码 Python 7 最近提交 2026年6月1日
未检测到许可证
资源集合
- 查看仓库
GitHub DavidHuji/Awesome-GEO
按年份编排的生成式引擎优化(GEO)研究书目,全库仅一个 README 文件,既收录优化方法类论文,也收录排序操纵与攻击类论文,另附少量开源资源。
资源集合 可用 119 最近提交 2026年8月12日
未检测到许可证
- 查看仓库
GitHub healsdata/ai-training-opt-out
汇集各类 AI 训练退出(opt-out)信号的速查参考:包括 robots.txt 标记、meta 标签、HTTP 头、ai.txt 与 TDMRep 协议以及爬虫 IP 段,内容停更于 2024 年中。
资源集合 历史项目 HTML Unlicense 159 最近提交 2024年6月21日
- 查看仓库
GitHub thedaviddias/llms-txt-hub
由社区维护的 llms.txt 实现目录:收录全网各站点的采用案例,并配套提供发现与校验(validation)相关工具,更新活跃。
资源集合 可用 TypeScript 897 最近提交 2026年8月19日
- 查看仓库
GitHub amplifying-ai/awesome-generative-engine-optimization
规模较大的 GEO 资源目录:收录对象主要是厂商、代理商、指南与论文,而非代码仓库;投稿队列自 2026 年 4 月起停滞。
资源集合 可用 488 最近提交 2026年4月14日
未检测到许可证
- 查看仓库
GitHub luka2chat/awesome-geo
以 CC0 发布的 GEO 手册:少量链接目录,加上维护者自撰的清单与模板,另有几张几乎没有出处的效果数据表。
资源集合 历史项目 CC0-1.0 135 最近提交 2026年4月9日
2026-08-08 核验:文档自带的效果数据表没有任何出处。诸如可见性提升 340%、提及率 92%,或点名某公司达到 78% AI 引用率等数字,均无来源、样本与日期,其中一条还断言 llms.txt 存在实测效果,而尚无主流引擎确认读取该文件。其 arXiv 引用经核对无误,但该清单中的任何效果数字都不应被引用。
没有符合当前筛选的项目,请取消一个筛选条件。