AGI 路线调研终稿 · 2026-09-21 快照
当前环境不支持 WebGL,可用键盘滚动或右侧目录跳转。

2026-09-21 快照 · 面向中国大陆个人用户

六阶段 · 从零逼近 AGI

命令级实施路线 · 11 份文档 · 全站搜索 · 3D 能力雷达与文档星系

拖动可旋转六阶段路径 · 点击节点直达对应阶段 · 滚轮缩放

00-README.md — 从这里开始(3 分钟)

这套文档是什么:一份面向中国大陆普通个人用户(非企业、无大规模算力、预算有限)的完整调研 + 傻瓜式实施路线, 回答一个问题:用现有(截至 2026-09-21)的大模型和工具,个人能在哪些方面逼近、哪些方面无法逼近 AGI 能力。

在线浏览版:https://agi.d-o-b.cc.cd —— 全站搜索 + 3D 总览(能力雷达/文档星系)+ 移动端适配 + 原始 Markdown 下载;由 /root/agi-research/site/build_site.py 自动生成(改完源文件重跑即更新)。


一、先读这三条(决定你要不要往下走)

  1. 验证等级:本套文档约 95% 属于「案头推理档」(检索 + 交叉验证 + GitHub/arXiv 直查,但没有人实跑过完整方案)。 唯一的「单机实证档」= round2/novice_test.md 的 6 条真机实测(产出 11 个卡点,已全部内联进 ROUTE.md)。 「独立复现」= 0。→ 所以核心建议是:先做 ROUTE.md §0.0 的第 0 周自证实验(一晚、零成本), 用你自己的 10 个真实任务验证这条路对你有用,再投入时间与钱。
  2. 时效:本套文档所有价格/版本/政策 = 2026-09-21 快照。半衰期:硬件行情 2 周、API 价格 1 个月、政策随时。 使用当天先按 APPENDIX_facts.md 的监控清单重查(首月第一件事)。
  3. 诚实边界:支持侧结论("照做就能逼近")目前零第一手用户级证据,已降级为"待自证假设"; 反对侧有 9 条被实证击穿的硬边界(见 MASTER.md §4.2)。两侧都写在纸面上,请一起读。

二、文档地图(按阅读顺序)

# 文件 内容 什么时候读
0 本文件 入口与地图 现在
1 MASTER.md 判定与能力边界:TL;DR、8 维能力区间(含三档判定)、三条架构原则、做得到/做不到清单、X1-X16 证据降权账本、冲突裁决落点、承重数字三元组表 开工前通读(约 30 分钟)
2 ROUTE.md ★核心交付物:6 阶段傻瓜式路线(阶段 0→5),每步含 前置/命令(三平台)/预期输出/验收/耗时/成本/卡住怎么办/跳过条件;附录 A 修正吸收对照表 执行主战场,边做边查
3 CHECKLIST.md 打卡清单:第 0 周 → 首周 → 首月 → 90 天;月度必做仅 2 项,其余全部可选进阶 每周/每月对照
4 APPENDIX_scenarios.md 五大生活场景(理财/教育/健康/创作/社交)+ 4 个补充场景(家庭记忆库/个人知识管理/旅行/老人家人)的可执行 playbook 与红线 想做具体应用时读
5 APPENDIX_cost.md 预算选型决策树(30 秒结论→7 问决策树)、修正版月账单表、盈亏平衡点、国内购买渠道、"不要买"清单、保鲜日历 花钱前必读
6 APPENDIX_security.md 安全护栏:六类攻击面、最小权限五件套、渐进三级(L0 只读→L1 受控→L2 自动)、事故响应手册(打印贴墙版)、红线 20 条 阶段 1 前通读
7 APPENDIX_facts.md 事实账本:40 条承重结论的三元组(来源/口径/验证日期)+ 半衰期 + 重查方法 + 监控清单(月/季/半年/事件驱动) 每月维护 + 重查时用
8 APPENDIX_platform.md Windows / macOS / Linux 命令等价速查(12 组)+ 国内镜像替代源 非 Linux 用户对照

原始材料(想深挖再看): - BRIEF.md — 项目总纲(五原则/搜索规程) - round1/ — 10 份领域深度报告(记忆/编排/自改进/本地模型/动手/持续学习/基建/反对论/评测/风险成本) - round2/ — 方法学审计、10 组矛盾裁决、缺口填补(含国内生态)、乐观主义红队、安全红队、成本精算、路线骨架、新手实测 - round3/ — 收敛素材:补证核实(B1-B12)、场景深化、路线攻击(12 修正)、跨平台速查、安全护栏、成本修正、魔鬼代言人、时效监控、最终验收审计


三、最短路径(只想做一件事的读者)

第 0 周(今晚就能做,¥0,1-2 小时)
  └─ ROUTE §0.0 自证实验:你的 10 个真实任务 ×(手工 vs AI 辅助)计时对照
     └─ 判读(与 CHECKLIST §1 同一套阈值,2026-09-21 走查修复统一):省时 ≥30% 且满意 ≥6/10 → 继续 ↓
        省时 <10% 或满意 ≤3/10 → 止损;中间 = 灰区,换任务类型或优化提示词后重跑一轮再定

阶段 0(第 1-2 周,¥0,约 3-4 个晚上)
  └─ 装 promptfoo + Ollama + 建 30 题金标准集 + vault 起步 + 第一次 eval 基线

之后
  └─ 按 ROUTE.md 阶段 1 → 2 → 4 → 5 走(阶段 3 多数人跳过)
  └─ 每周对 CHECKLIST 打一次卡;每月只做 2 件事(重跑 30 题 + 账单异常抽查)

三条红线(全程只有这三条必须背): 1. 支付、删数据、对外发布——永远不自动; 2. 任何写操作先出 diff 再人审; 3. 不可逆操作必须有回滚路径(git / 备份 / 断路器)。


四、本套文档的维护

  • 月度必做(≤2 项,约 15 分钟):①重跑 30 题金标准集(判读阈值:较上期 ≥2 题且连续 2 期同向才算进步);②账单异常率抽查(环比 >50% 才去查官方价格页)。
  • 首月第一件事:对照 APPENDIX_facts.md 把本文档全部价格/模型/政策类结论重查一遍(成本 <5 分钟)——不要信任快照。
  • 下次全文半衰期复核日:2026-10-21(价格类)/ 2026-10-05(硬件类)。
  • 修订记录final/CHANGELOG.md —— 交付后的勘误与修复逐行记账(2026-09-21 起生效);任何承重数字勘误都必须在那里追加一行。

本套文档由 Round 1→3 多轮子代理调研 + 红队 + 收敛产出,完成于 2026-09-21(CST)。 文档纪律:支持与反对双侧并列;承重数字附来源与验证日期;查不到的一律写"未核实",不编造。