Karpathy 的 LLM Wiki gist

後設資料

一句話濃縮

用 LLM 持續維護一份互相連結的 markdown 知識庫,避免每次 RAG 重新從原文推導;wiki 是持續累積、跨對話保留的人造物。

提取要點

  • 核心洞察:「the wiki is a persistent, compounding artifact」——傳統 RAG 每次查詢都要從原文重新推導,這個模式讓 LLM 把資訊一次性整合進 wiki,之後查詢直接用 wiki。
  • 三層架構:原始來源(不可變)/ wiki(LLM 維護)/ schema(如 CLAUDE.md,告訴 LLM 怎麼維護)。
  • 三個操作
    • Ingest — 讀新來源、更新 10–15 個 wiki 頁、保持一致
    • Query — 搜 wiki、合成答案、把有價值的結果回灌
    • Lint — 檢查矛盾、孤兒頁、缺失交叉引用
  • 支援檔案index.md(內容導覽)/ log.md(append-only 紀錄)。
  • 為什麼有效:人類維護 wiki 的痛點(交叉引用、一致性檢查、更新)對 LLM 而言「near zero cost」;人類負責 curation 與方向,系統處理維護。
  • 歷史脈絡:靈感來自 Vannevar-Bush 1945 年論文「As We May Think」中的 Memex 概念——「私有的、主動策展的」知識,重視文件之間的連結。Bush 無法解決維護成本問題,LLM 正好填補。

提取概念

連結到此來源衍生 / 更新的 wiki 頁:

原文(可選)

Ingest 時透過 WebFetch 工具讀取,工具回傳的是被小型模型摘要過的內容、非 verbatim 原文。長期保存如有需要,可再次以瀏覽器抓取原始 gist 並貼回此區段。原始 URL 見上方。