用Claude Code管理100篇研究筆記!OpenAI共同創辦人公開LLM知識庫系統,貼一段指令就能建起來
用Claude Code管理100篇研究筆記!OpenAI共同創辦人公開LLM知識庫系統,貼一段指令就能建起來

你存了幾百篇文章,打了幾十份筆記,但要用的時候怎麼也找不到。

這不是你的問題。知識管理最耗人的部分,從來不是「讀」和「想」,而是整理:把資訊分類、建立連結、讓舊筆記和新資料串起來。

OpenAI 共同創辦人安德烈·卡帕西 (Andrej Karpathy) 最近公開了他的解法:讓 AI 代替你做這些整理工作。

你只需要把資料丟進去,剩下的摘要、分類、交叉連結、維護——全部交給 AI。他自己用這個方法,在某個研究主題上累積了將近 100 篇筆記、40 萬字,而且查得動。

這篇文章說明這套系統怎麼運作,以及怎麼用最快的方式把它建起來。

你需要準備什麼?

1. Obsidian(免費)
存放筆記的桌面應用程式。所有筆記存在你自己的電腦上,不上傳雲端。到 obsidian.md 下載,安裝後建立一個新的「保險庫」(Vault),這就是你的知識庫所在地。

如果你是第一次使用 Obsidian,可以先參考這篇入門教學。

2. Obsidian Web Clipper(免費)
瀏覽器擴充功能,讓你在看網頁文章時,一鍵把整篇文章存進 Obsidian,格式乾淨不跑版。

在瀏覽器的擴充功能商店搜尋「Obsidian Web Clipper」安裝即可。

3. Claude Code(需要 Anthropic 帳號)
這是整套系統的核心,也是和一般 AI 工具最不一樣的地方。

一般的 ChatGPT 或 Claude 網頁版只能在對話框裡交換文字。Claude Code 則可以直接進入你的資料夾,讀取筆記、寫入新內容、更新目錄,就像一個能操作你電腦的 AI 助理,不需要人工複製貼上。

前往 claude.ai/code 下載 Mac 或 Windows 的桌面應用程式。

關鍵是需要Anthropic 帳號,Claude Pro 訂閱方案(每月約 20 美元)包含 Claude Code 的使用權限。如果你對 Claude Code 還不熟悉,可先參考這篇入門教學。

最快的起步方式?

準備好之後,打開 Claude Code,把它指向你的 Obsidian 保險庫資料夾。有兩種方式可以讓它幫你把系統建起來:

方法一:餵入卡帕西的原始文件(英文)

把以下指令貼給 Claude Code:

請根據以下卡帕西的 GitHub Gist,在這個資料夾裡幫我建立 LLM 知識庫系統,並說明我接下來要怎麼使用:
> [https://gist.github.com/karpathy/442a6bf555914893e9891c11519de94f)

方法二:使用完整架構說明文件

AI 研究者 Elvis Saravia 根據卡帕西的系統整理了一份完整的架構說明文件,並發布在 dair.ai。

把這份文件直接貼給 Claude Code,它就能根據完整的架構說明建立系統,細節比方法一更豐富一些,整體架構如下:

現在把以下指令全部複製,貼給 Claude Code,並在最後加上一句:「請根據以上架構,在這個資料夾裡建立系統,所有筆記使用繁體中文,完成後告訴我怎麼開始使用。」

# LLM Knowledge Bases - Architecture (Karpathy)

## Overview
A personal knowledge base system where an LLM acts as a compiler that reads raw source documents and produces a structured, interlinked markdown wiki. No vector databases or embeddings needed at personal scale.

## Phase 1: Ingest
- Obsidian Web Clipper: Browser extension converts web articles into clean .md files with locally downloaded images
- Papers & Repos: arXiv papers, GitHub repos, datasets collected into raw/ staging directory
- raw/ directory: All source documents land here first - the LLM reads from this staging area

## Phase 2: Compile (LLM Compiler)
The LLM incrementally reads raw/ and builds a structured wiki:
- Index & Summaries: Auto-maintained index files with brief summaries of all documents - entry point for queries
- Concept Articles: ~100 articles, ~400K words, organized by topic with backlinks and cross-references
- Derived Outputs: Marp slide decks, matplotlib charts, filed-back query answers
- Backlinks & Cross-links: Auto-generated link graph between concepts, finding connections for new article candidates

## Phase 3: Query & Enhance
- Obsidian IDE: Frontend for browsing the wiki and visualizations
- Q&A Agent: Complex research questions across articles - answers rendered as markdown, slides, or charts
- Search Engine: Vibe-coded naive search over the wiki, usable via web UI or as a CLI tool for the LLM
- Key insight: Outputs from queries get filed back into the wiki - every exploration adds up

## Phase 4: Lint & Maintain
- Scan for inconsistent data
- Impute missing information via web search
- Find connections between concepts for new articles
- Suggest further questions to explore
- After linting, cycle returns to Phase 2 - wiki keeps growing

## Feedback Loops
- Q&A Agent outputs -> filed back into wiki (Derived Outputs)
- Linting results -> enhance the wiki
- Phase 4 cycles back to Phase 2 continuously

## Future Direction
Synthetic data generation from the wiki to fine-tune an LLM so it "knows" the data in its weights rather than just through context windows.

## Tools Used
- Obsidian (IDE + file viewer)
- Obsidian Web Clipper (article ingestion)
- LLM with large context window (compilation)
- Markdown directory structure (wiki storage)

兩個方法的效果一樣:Claude Code 會照著說明把整個系統建好,並告訴你後續怎麼操作。不需要手動設定任何東西。

這套系統怎麼運作?

整套系統由三個區域和四個動作組成:

三個區域:

  • raw/ 原始資料夾:你蒐集的所有原始素材,只進不改
  • wiki/ 知識庫:AI 整理好的筆記,每個概念一篇,互相連結
  • index.md + log.md:目錄與整理記錄,由 AI 自動維護

四個動作:

  1. 蒐集:用 Obsidian Web Clipper 把網頁文章存進 raw/
  2. 整理:讓 Claude Code 把原始資料編譯成知識庫筆記
  3. 提問:對知識庫問問題,把回答也存回去累積
  4. 清理:定期讓 AI 掃描知識庫,找矛盾、補缺漏

蒐集資料

看到一篇好文章,點一下瀏覽器上的 Obsidian Web Clipper,文章就自動存進原始資料夾(raw/)。PDF、截圖、逐字稿,直接拖進去就好。這個資料夾只進不改,是你所有知識的原始存檔。

讓 AI 整理

每次累積了幾篇新資料,在 Claude Code 下一個指令,它會自動讀取原始資料、為每個概念建立或更新筆記、在相關筆記之間加上連結,並更新整座知識庫的目錄。整個過程你不需要複製貼上任何東西——Claude Code 直接在你的 Obsidian 資料夾裡寫入修改。

問問題,把答案存回去

知識庫累積到一定規模,就可以開始對它提問。問題可以很廣:「幫我整理 XX 主題的重點」、「我在這個領域還有哪些盲點」、「把這些筆記的矛盾找出來」。

卡帕西的做法是讓 AI 把回答也整理成新筆記,直接存回知識庫——讓每一次提問都成為知識的一部分,而不是問完就消失。目前他在某個研究主題上的知識庫已達約 100 篇筆記、40 萬字,在這個規模下可以提出相當複雜的問題。

定期清理

每隔一段時間,讓 Claude Code 掃描整座知識庫,找出頁面之間的矛盾、過時的資訊、以及值得深入的新方向。AI 在這個環節也很擅長主動建議下一步值得追問的問題。

為什麼這樣做有意義?

傳統知識管理工具,無論是 Notion、Roam 還是 Obsidian,都把整理的苦工甩給人做。連結要人建、標籤要人貼、矛盾要人找。大多數人最終放棄,不是因為沒有毅力,而是維護成本超過了回報。

LLM 知識庫把這個成本轉移給 AI:人負責找素材、定方向、問好問題;AI 負責摘要、交叉連結、一致性維護。

卡帕西在公開這套方法時留下一句話:

「我認為這裡有空間誕生一個了不起的產品,而不只是一堆雜七雜八的腳本。」

目前這套系統還需要自己動手搭建,但它的邏輯已經完整。選一個方法,把文件餵給 Claude Code,就是開始的第一步。

延伸閱讀:Claude送免費額度!這三種方案都能領,怎麼領?要注意什麼?教學一次看

資料來源:Andrej Karpathy GitHub Gist、Karpathy X 貼文、Elvis Saravia / dair.ai

本文初稿為AI編撰,整理.編輯/ 李先泰

關鍵字: #AI工具 #Claude
往下滑看下一篇文章
OpenAI 重磅講者親臨高雄|掌握前瞻 AI 與產業轉型關鍵趨勢
OpenAI 重磅講者親臨高雄|掌握前瞻 AI 與產業轉型關鍵趨勢

隨著 AI 工具逐漸普及,真正拉開差距的,已不只是技術或算力的強弱,是企業能否整理資料、重新設計流程,並把 AI 融合既有工作方式,持續轉化為營運價值。

Amazon Web Services(AWS)將於10月23日於高雄舉辦「2026 亞馬遜港都 AI 創新日」邀請 OpenAI 與製造、金融、交通、零售及運動育樂等領域的實務代表,從技術趨勢、資料治理、流程設計與組織轉型等面向,拆解 AI 落地前必須處理的現實問題,協助企業重新檢視自身的導入條件與下一步布局。

企業下一步,不只是再導入一套 AI 工具,而是讓 AI 進入日常營運

模型可以採購,系統可以建置,但資料是否整理到位、流程能否重新設計、組織是否清楚由誰負責,才是決定技術能否持續發揮價值的關鍵。

高雄近年推動數位轉型,同樣面對這項核心課題。亞灣周邊聚集扣件、石化、鋼鐵等傳統產業,場域複雜、既有系統眾多,正因如此,更能檢驗一套 AI 導入方法是否具備複製與擴大的條件。城市發展也從建置算力基礎,進一步走向讓技術真正進入產業與治理現場。

AWS 連續六年深耕高雄,今年以「雲騰智慧大南方 齊創 AI 好未來」為主軸,將討論重心從雲端與算力基礎,推進到應用全面升級,協助城市從「有 AI」走向「AI 有感」。

政府治理是否更即時、產業流程是否真正改變、市民與使用者能否感受到服務提升,才是「AI 有感」的具體檢驗。延續「高雄試點、全臺普及、雲端出海國際」的發展路徑,10月 23 日登場的亞馬遜港都 AI 創新日要談的不只是企業「有沒有 AI」,而是導入之後企業的真實改變。

2025 亞馬遜港都 AI 創新日現場,資料照
圖/ AWS

OpenAI 重磅講者親臨高雄,從技術前沿看見企業的關鍵課題

今年活動特別邀請 OpenAI 東南亞暨台灣合作夥伴總監 Mark Jeffrey,以「前瞻 AI 如何助力產業領袖開創新局」為題,分享在 AI 技術快速演進之下,企業應如何重新思考未來布局。

面對 AI 能力邊界持續擴張,哪些應用已具備規模化條件?哪些仍需要更完整的資料、治理與組織準備?這是正在規畫下一階段 AI 投資的企業必須先回答的關鍵課題。

上午議程將從資料、組織與金融三個面向,拆解 AI 落地前必須處理的現實問題。「數據為本,AI 啟航」先回到資料基礎:外部模型跑得再快,若企業自身的欄位定義、存取權限與資料品質尚未整理到位,技術仍難以轉化為可靠判斷。

「打造 AI-Ready 組織的關鍵布局」論壇則聚焦組織當責。AI 專案通常橫跨資訊、營運與管理部門,真正困難的不只是把系統建起來,而是由誰推動流程改造、由誰認列成果,以及當 AI 產出的判斷出現問題時,責任最後應由誰承擔。公部門、製造業與雲端服務業者如何從不同角色處理這些問題,對其他組織同樣具有參考價值。

金融創新論壇將討論 AI、虛擬資產與企業轉型。金融場域對資料安全、合規、風控與可追溯性的高度要求,也提醒企業:效率不能取代治理,AI 更不能成為責任模糊的理由。能否在高監管、高風險環境中建立清楚邊界,將直接影響 AI 應用能不能被長期採用。

2025 年活動論壇現場,資料照
圖/ AWS

從六種產業場景,看 AI 如何走進真實流程

真正具備參考價值的 AI 案例,不只要說明「做了什麼」,還要回答幾個更實際的問題:解決哪一段流程、使用哪些資料、在哪個節點交給 AI、誰負責最後判斷,又如何確認投入確實產生價值。

下午議程規劃橫跨智慧支付、製造、媒體科技、智慧交通、零售製造與運動育樂六種產業場景。每個場景面對的資料條件、即時要求與風險門檻都不相同。

產業場景 議程規劃與關鍵課題
智慧支付 藍新金流運用 AWS AI 自建智能 KYC 與交易監控;處理身份辨識、交易監控與風險判斷
製造 以語意層串接資料孤島,讓 AI Agent 正確理解分散在不同系統的資料
媒體科技 會說台語的 AI Agent:從醫院櫃台到第一線的落地實戰
零售製造 零售製造轉型;把技術接進實際營運與使用者體驗

這些差異進一步說明,AI 沒有一套可以直接複製到所有產業的標準答案。企業真正需要的,不只是更多案例,而是看見不同產業如何依資料條件、即時要求與風險門檻,把 AI 融入實際營運與使用者體驗。

現場同步打造「產業賦能走廊」,邀集超過 15 組雲端生態系夥伴設置展示攤位,聚焦智慧製造、金融科技與城市治理的真實痛點與解法。無論企業目前卡在技術、資料、治理,還是組織協作,不同問題點,都能找到對應的解方。

10 月 23 日,從智慧製造的產線優化、金融科技的風控升級,到運動產業的會員體驗創新,看 AI 如何從概念走進產業現場,成為百工百業轉型升級的實際動能。

10/23高雄展覽館盛大舉行
圖/ AWS

「2026 亞馬遜港都 AI 創新日」,掌握 AI 賦能百工百業、領航產業升級的實務趨勢
立即報名

登入數位時代會員

開啟專屬自己的主題內容,

每日推播重點文章

閱讀會員專屬文章

請先登入數位時代會員

看更多獨享內容

請先登入數位時代會員

開啟收藏文章功能,

請先登入數位時代會員

開啟訂閱文章分類功能,

請先登入數位時代會員

我還不是會員, 註冊去!
追蹤我們
一次搞懂工業AI
© 2026 Business Next Media Corp. All Rights Reserved. 本網站內容未經允許,不得轉載。
106 台北市大安區光復南路102號9樓