# GEO 文章收集与研究项目 ## 项目简介 本项目用于系统收集、阅读和整理生成式引擎优化(Generative Engine Optimization,GEO)相关资料,沉淀可检索、可复用的知识库,为 GEO 实践、客户分析、内容策略和操作培训提供参考。 本阶段计划至少整理 **100 篇公开文章**,对每篇文章进行人工筛选,并借助 AI 完成摘要、分类、要点提炼和交叉比较。首个阶段性目标是在上午完成前 **50 篇**资料的收集与初步归类。 ## 项目目标 - 收集不少于 100 篇高质量 GEO 相关文章; - 上午完成首批 50 篇的收集、去重和初步分类; - 为每篇文章保留来源、作者、发布日期和原文链接; - 提炼核心观点、方法步骤、案例数据及可执行建议; - 区分事实、作者观点和 AI 辅助总结,避免混淆; - 按主题建立索引,方便后续检索、比较和持续更新; - 结合海外 GEO 平台和现有客户报表,验证文章中的方法与结论。 ## 建议分类 | 分类 | 关注内容 | |---|---| | GEO 基础 | 定义、发展背景、与 SEO/AEO 的区别 | | 平台与模型 | ChatGPT、Claude、Gemini、Perplexity 等平台的内容发现机制 | | 内容策略 | 选题、结构、实体信息、权威性、引用和可读性 | | 技术实现 | 结构化数据、抓取、索引、站点性能和内容分发 | | 品牌与声誉 | 品牌提及、第三方信号、知识图谱和可信度建设 | | 数据监测 | 可见度、引用率、排名、流量及转化指标 | | 工具教程 | GEO 平台操作、测试方法和工作流 | | 案例研究 | 企业实践、行业案例、实验结果和复盘 | | 海外市场 | 海外平台、语言、本地化和区域差异 | | 风险与规范 | 内容质量、事实核验、版权、隐私及合规 | ## 工作流程 1. **收集**:通过搜索引擎、行业媒体、研究机构、产品博客和专业社区发现文章。 2. **筛选**:剔除重复、低质量、无来源或与 GEO 关系较弱的内容。 3. **存档**:记录文章标题、链接、作者、发布日期、访问日期和来源类型。 4. **阅读**:人工阅读原文,标记重要论点、证据、案例和操作方法。 5. **AI 辅助整理**:生成结构化摘要、关键词和候选分类,但不替代人工核验。 6. **归类**:按主题、内容类型、适用平台和实践阶段建立标签。 7. **提炼**:总结可执行结论、适用条件、局限性及与其他文章的异同。 8. **复核**:检查事实、链接、引用、版权边界和敏感信息后再提交仓库。 ## 单篇文章记录模板 建议每篇文章使用以下结构: ```markdown # 文章标题 - 原文链接: - 作者/机构: - 发布日期: - 访问日期: - 语言: - 分类: - 标签: ## 一句话结论 ## 核心观点 ## 方法与步骤 ## 数据、案例与证据 ## 可执行建议 ## 局限与待核实内容 ## 人工阅读备注 ``` ## 阶段计划 | 阶段 | 数量目标 | 主要产出 | 状态 | |---|---:|---|---| | 第一阶段 | 50 篇 | 收集、去重、初步分类和简要摘要 | 已完成 AI 初步整理,待人工复核 | | 第二阶段 | 50 篇 | 补齐主题、深度提炼和交叉比较 | 待完成 | | 汇总阶段 | 100+ 篇 | 分类索引、研究结论和实践清单 | 待完成 | 首批成果入口:[首批 50 篇 GEO 文章索引](indexes/first-50.md)。 ## 参考入口 ### 海外 GEO 平台 - [海外 GEO 用户操作教程(飞书)](https://my.feishu.cn/wiki/TnsSwHIDMidqL2kbQMVctkjznuf?from=from_copylink) - [海外 GEO 登录入口](http://47.250.132.147/user/) 平台测试账号的用户名、密码和授权码属于敏感凭据,请通过密码管理器或其他安全渠道保存,不要写入本仓库、提交记录、截图或公开文档。 ### 客户报表参考 - 客户:上海玉湖集医学科技有限公司 - [GEO 测试报表](https://geo.doujia5799.top/index/report_v2/index/cid/69c352ad09a26) 使用客户报表时应遵守授权范围和隐私要求。仓库只记录经过脱敏的观察、结论和方法,不保存个人信息、登录凭据或未经授权的客户数据。 ## 质量标准 - 优先使用官方文档、研究论文、权威媒体和有明确作者的行业文章; - 摘要必须能够追溯到原文,不虚构数据或结论; - 引用原文时控制篇幅并注明来源,避免大段复制受版权保护的内容; - 时效性内容需要记录发布日期和访问日期; - AI 生成的摘要必须经过人工复核; - 同一观点尽量寻找多个独立来源进行交叉验证; - 发现链接失效、内容更新或结论变化时及时修订记录。 ## 建议目录结构 ```text GEO/ ├─ README.md # 项目说明与总入口 ├─ articles/ # 单篇文章笔记 │ ├─ fundamentals/ # GEO 基础 │ ├─ content-strategy/ # 内容策略 │ ├─ technical/ # 技术实现 │ ├─ measurement/ # 数据监测 │ ├─ case-studies/ # 案例研究 │ └─ overseas/ # 海外市场 ├─ indexes/ # 分类索引与文章总表 ├─ reports/ # 阶段总结和研究报告 └─ templates/ # 文章记录模板 ``` ## 安全与合规 - 禁止提交密码、授权码、访问令牌、Cookie、SSH 私钥和其他认证信息; - 不公开转载完整文章,优先保存链接、摘要和必要的合规引用; - 涉及客户或测试平台的数据必须先脱敏,并确认具有使用权限; - 提交前使用 `git diff --cached` 检查是否误加入敏感信息。 ## 完成标准 当文章总数达到 100 篇以上、每篇记录包含基础元数据与人工复核摘要、所有文章均已归类且形成阶段性结论时,本轮资料收集任务视为完成。