數位分身 · 人格思維提煉

把一本書變成問得下去的 AI 顧問:來源底座、十區塊人格與八個思維引擎

摘要保存的是結論,丟掉的是作者怎麼走到這個結論。這篇把來源底座、十區塊人格與八個思維引擎的完整做法攤開,技能包 MIT 開源,可以直接拿去改。

這篇在講什麼

很多人問我同一件事:手上有一本很喜歡的書、一堆課程逐字稿、幾十集 Podcast,怎麼讓 AI 把它變成一個可以隨時問的顧問。這篇把我實際在用的流程完整攤開:先建可追溯的來源底座,再寫十區塊人格,最後補八個思維引擎子模組。範本、檢查方式與可複製提示詞都在文章裡,技能包本身是 MIT 開源的,你可以直接拿去改。

適合誰
  • 你讀完一本書覺得很有收穫,三個月後想引用某個觀點,卻連它在第幾章都想不起來。
  • 你叫 AI 幫你整理書摘,整理出來很整齊,但下次遇到真實決策,那份摘要幫不上忙。
  • 你想做「某某人的 AI 分身」,做出來聊兩句就發現它在講廢話,語氣像客服,觀點像百科。
  • 你已經在用 AI 幫忙工作,想把手上的專業素材變成一個穩定、不會亂編的顧問。
你可以帶走什麼
  • 一套兩層做法:來源底座負責「這批素材裡有什麼」,人格顧問負責「根據這批素材,它會怎麼判斷」。
  • 八個思維引擎子模組的完整清單與實際填法,含六個內容模組與兩個控制層。
  • 一組可直接貼進 AI 的提示詞,以及十個用來驗收的測試問句。

一、摘要留不住一本書

讀完一本書,最常見的下場是:當下很有感,兩週後只剩下幾個名詞。

用 AI 做書摘會讓這件事變快,但問題沒有解決。摘要保存的是結論,丟掉的是作者怎麼走到這個結論。你下次遇到的問題跟書裡的例子長得不一樣,你需要的是他的判斷方式,摘要給不了。

換個方式說:摘要能回答「這本書講了什麼」,回答不了「如果是他,遇到我這個狀況會怎麼想」。

第二個問題更麻煩 你把書丟給 AI,叫它扮演作者,它會演。演得還挺像,語氣有了,金句有了,然後它開始編。編出來的東西聽起來很合理,你查不到出處,因為根本沒有出處,那是模型用「感覺像」補出來的。

我做這套流程的第一目標,是讓分身可控、穩定、安全、省心。炫不炫是其次。所以整套設計都圍繞一件事:讓每一句判斷都能回頭指到來源,指不到就讓它說「不知道」。

如果你還沒做過第一個,先看這篇入門版

二、先建來源底座,不要急著做人格

這是整篇最重要的一段,也是最多人跳過的一步。

拿到一本書、一批逐字稿、一整年的文章,第一個動作先不要寫人格設定。先做一份來源底座。

兩層各自回答什麼

第一層 來源型知識底座

回答「這批素材裡有什麼」。產物是來源清單、章節索引、主題索引、術語表、框架與原則、反模式、速查表、範圍限制。

第二層 人格型 AI 顧問

回答「根據這批素材背後的思考方式,這個顧問會怎麼判斷」。產物是十區塊人格、思維引擎、回答工作流、來源追溯表、框架衝突處理、認識論邊界、一頁速查。

跳過第一層直接做人格,模型就會用「感覺像」把空缺補滿。這是人格分身最常見的失控樣態,而且很難事後補救,因為你分不出哪些是書上真的有、哪些是它自己長出來的。

來源底座的最小結構

# [素材名稱] 來源底座 ## Scope - 這批素材包含: - 這批素材不包含: - 最可靠的來源: - 最薄弱的來源: ## Source Index | 來源標記 | 類型 | 日期 | 位置 | 備註 | | [書] | 書籍 | YYYY-MM-DD | ch1-ch12 | 原始文本 | | [訪談A] | 訪談逐字稿 | YYYY-MM-DD | 00:00-90:00 | 原話 | ## Topic Index | 主題 | 來源位置 | 可提煉成 | | [主題] | [書 ch3]、[訪談A 12:30] | 心智模型/判斷原則/背景 | ## Frameworks / Principles | 名稱 | 定義 | 何時使用 | 來源 | ## Anti-patterns | 反模式 | 症狀 | 為什麼危險 | 來源 | ## Cheatsheet - 最重要的 5-7 條規則 - 3 個常見適用情境 - 3 個不適用情境

證據分四層

寫任何東西進人格設定前,先問這句話屬於哪一層。

A 層|本人原話

原始逐字稿、本人著作。可以寫進核心設定,優先用。

B 層|明確行動

反覆出現的案例、能交叉驗證的決策。可以寫,但要標依據。

C 層|歸納模式

你從 A、B 推出來的。可以寫,但要標明「依其思路推導」。

D 層不進核心人格 他人評論、粉絲轉述、模型猜測都屬 D 層,最多列為待查證。找不到來源的條目先標 待補來源,空著比補滿安全。分身說「這個我沒有依據」,比它掰一段漂亮的話有用得多。

什麼時候算做完第一層

能回答這五題,才進下一步:

  1. 這個顧問最可靠的知識範圍是什麼?
  2. 哪些主題來源不足?
  3. 哪些判斷是本人原話,哪些是我歸納的?
  4. 最容易出現的漂移風險是什麼?
  5. 出問題時要去哪個來源修?
底座跟索引背後那套知識結構,我另外寫過完整版

三、人格層:十區塊

來源底座做好,才開始寫人格。

人格層是對外的那一面:口吻、互動方式、可以聊的話題。一般對話只讀這一層,輕量、便宜。

十個區塊長這樣,右邊標的是等一下四個提煉動作各自的落腳處:

一、快速摘要 二、基本資訊 三、價值主張錨點 ← 判斷原則 四、溝通風格 ← 口吻 DNA 五、思維模式 ← 拆問題的第一個動作 六、人際互動 七、興趣喜好與話題地圖 ← 反覆談的主題 八、專業能力與工作流程 九、底層邏輯與判斷標準 ← 判斷原則(完整版) 十、出場定位

提煉的核心動作有四個,每一個都直接對應到上面某幾個區塊。

找他反覆談什麼

列一張主題頻率表,每出現一次劃一筆。三到五個他能講半小時不停的主題,就是這個顧問的主場。

抽口吻 DNA

這是擬人化最關鍵的一步,也最容易做得太粗。開一份 voice-dna.md,貼直接引言,不要改寫。分四種情境收:他同意時怎麼說、不同意時怎麼說、被挑戰時怎麼回、鼓勵人時什麼語氣。

句子長短要寫實際數字。「短句為主」沒有用,「15 到 25 字一句」才有用。

抽判斷原則,寫成 if-then

這一步決定分身有沒有判斷力。不要寫「他重視長期思維」,那種句子 AI 拿到也不知道怎麼用。要寫成「遇到什麼情況,他選什麼」。

以 Naval Ravikant 為例,我從素材裡抽出來的樣子是這樣:

  • 如果這件事需要某個權威點頭才能做,它的槓桿有限,先找別條路。
  • 如果在兩個選擇之間糾結很久,選 No。真正好的機會不會讓人猶豫。
  • 如果有人花很多時間強調自己多誠實,提高警覺。
  • 如果某個結論剛好對自己特別有利,用更高的標準檢驗它。

找他拆問題的第一個動作

每個人遇到新問題時,大腦的第一個反射不一樣。Naval 的第一個動作是重新定義關鍵詞。我自己的第一個動作是拆問題。有些人的第一個動作是先看人物關係。這個第一動作寫下來,分身的回答節奏就對了。

這四步的成果分別填進十區塊裡的話題地圖、溝通風格、價值主張與判斷標準、思維模式。剩下的區塊邊寫邊查素材,寫不出來的先空著,不要硬編

四、思維引擎:八個子模組

十區塊讓 AI 那個人。思維引擎讓 AI 思考起來像那個人。這是擬人化的核心,也是我認為一般「角色扮演提示詞」跟這套做法差最多的地方。

思維引擎是對內的那一層,深度討論才載入,平常對話不用讀。共八個子模組,前六個管內容,後兩個管控制。

01核心心智模型

他反覆套用的那幾組框架。目標 2 到 5 個。

02決策啟發式

完整的 if-then 規則庫。目標 8 到 15 條。

03表達 DNA

句式、修辭、語氣模式、幽默風格。

04回答工作流

遇到問題時大腦的標準流程。

05智識譜系

他的思想從哪來、受誰影響。

06內在張力

他的矛盾與前後不一致。

07來源追溯表

控制層。每條設定連回來源與證據層級。

08框架衝突處理

控制層。兩個原則打架時怎麼裁決。

八個不必一次寫完。素材深度不夠就先寫得出來的那幾個,建議至少先做 02、03、04。

01 核心心智模型

找他用同一個框架處理不同問題的證據。每個給一個名字加一句標語,讓 AI 在對話中能指名引用。

Naval 最核心的一個叫「重新定義術」:先換掉關鍵詞的定義,結論就自動成立。

| 常規定義 | 他的重新定義 | 於是 | |---------------|---------------------------|----------------------------| | 財富 = 很多錢 | 財富 = 睡覺時也在賺的資產 | 工資不算財富,資產才算 | | 退休 = 不工作 | 退休 = 只做想做的事 | 他說自己已退休,但還在創業 | | 運氣 = 隨機 | 運氣分四個層級 | 運氣可以系統性製造 |

抓到兩個以下表示還沒提煉夠,超過五個表示還沒分出主次。

02 決策啟發式

第三章那組 if-then 的完整版。每一條都給名字,例如「日曆測試」「糾結即否定」「手冊測試」。給了名字,分身就能在對話裡說「這就是我說的日曆測試」,不用每次重新解釋一遍。

目標八到十五條。少了不夠用,多了 AI 記不住。

03 表達 DNA

分五塊寫:句式規則、修辭武器、常用的類比來源、語氣的雙模式、幽默風格。做中文分身還要多一塊「中文輸出適配」,因為英文素材的句式直翻成中文會很怪。

語氣雙模式特別重要 同一個人在社群短文上跟在 Podcast 上完全兩種樣子,一個極度確定,一個允許「我也還在想」。只寫一種,分身就會全程用同一個腔調講話,講久了很假。

04 回答工作流

這是分身大腦的作業系統。先寫一句總綱,再列一張問題分類表。

以 Naval 為例,總綱是「不憑直覺編造事實,發表意見前先弄清楚事實」,分類表長這樣:

| 問題類型 | 特徵 | 行動 | |----------------|--------------------------|----------------------------| | 需要事實的問題 | 涉及具體公司、人物、事件 | 先研究再回答 | | 純框架問題 | 抽象價值觀、思維方式 | 直接用心智模型回答 | | 混合問題 | 用具體案例討論抽象道理 | 先取得事實,再用框架分析 |

05 智識譜系

他常引用誰、受誰影響、跨哪些領域整合。用一張表寫「領域 → 人物 → 對我的影響」,並且註明演化關係(A → B → C 代表思想傳承)。

這一塊寫完,順便誠實寫一句定位:他是原創理論家,還是綜合者。承認影響來源比假裝原創可信得多。

06 內在張力

這是最多人略過、但我認為差別最大的一塊。

真實的人都有矛盾。寫的時候不要為矛盾辯護,直接承認。

Naval 的例子:他說身份標籤越少越好,但「Naval」本身已經是一個品牌標籤;他說自己已經退休,同時持續創業投資,靠重新定義「退休」化解這個矛盾。

寫好這一塊的實際效果 當使用者挑戰「他不是說 X 嗎,怎麼又 Y」,分身能回答「對,這是我承認的矛盾,理由是⋯⋯」,而不是當場僵住或硬拗。

07 來源追溯表(控制層)

這一塊不是給讀者看的漂亮段落,是防止 AI 亂補的控制表。

| 模組 | 條目 | 依據來源 | 證據層級 | 備註 | |--------------|--------|---------------------------|----------|--------------| | 核心心智模型 | 模型名 | 書 ch3/訪談 00:12:35 | A/B/C | 是否反覆出現 |

規則很簡單:A、B 可以直接寫進核心設定;C 可以寫但要標「依其思路推導」;D 只能放背景材料;沒來源的先標 待補來源

08 框架衝突處理(控制層)

真實的人不只有多個框架,還會在框架之間取捨。只列框架不寫裁決規則,分身每次都會現場自由發揮,同一個問題問兩次得到兩種答案。

寫法是 if-then:

### 長期主義 vs 眼前現金流 來源: - 框架 A:[來源] - 框架 B:[來源] 裁決規則: - 若 [條件 1] → 優先 A - 若 [條件 2] → 優先 B - 若條件不明 → 不替本人猜測,先說需要補來源

常見的衝突組合有這幾種:長期主義對上短期壓力、原則堅持對上情境彈性、個人自由對上團隊責任、理性分析對上情緒照顧、哲學框架對上戰術操作、早期觀點對上近期觀點。

最後一種要特別小心 如果本人的立場隨時間演化過,要標來源日期,不要混成一個永遠不變的答案。
想先看一個做完的成品長什麼樣

五、怎麼知道做對了

跑十個測試對話,用六個標準檢查。

  • 像不像那個人會說的話(口吻、句式對得上)
  • 能不能說出他的判斷原則,而且能套用到書上沒有的新情境
  • 遇到沒談過的話題,會不會說「不知道」
  • 被問「你怎麼知道」時,能不能指回素材
  • 有沒有變成雞湯版、粉絲版、通靈版、過度自信版
  • 沒有來源時,會不會停下來標「待補來源」

測試題分四類,每類至少問兩題:

| 類型 | 問法 | 檢測什麼 | |------|-----------------------------------|----------------------| | 直球 | 「你對 [主題] 怎麼看?」 | 核心議題覆蓋夠不夠 | | 推導 | 「假如 [新情境],你會怎麼判斷?」 | 決策啟發式有沒有作用 | | 邊界 | 「你對 [沒談過的事] 怎麼看?」 | 會不會說不知道 | | 對抗 | 「但我覺得 [反觀點],你怎麼回?」 | 互動模式與內在張力 |

某一類答得不好,回去補對應的區塊,不要在提示詞上加形容詞硬修。

六、可以直接貼的提示詞

把素材準備好之後,這段可以直接貼進 Claude、ChatGPT 或任何長文本 AI,用來做第一層的來源底座。

我要把以下素材整理成一份「來源型知識底座」,之後會用它做成 AI 顧問。 現在請先不要寫人格設定,也不要幫我做摘要。 請照這個結構輸出: 1. Scope:這批素材包含什麼、不包含什麼、最可靠的來源是哪份、最薄弱的是哪份 2. Source Index:每份素材的類型、日期、位置(章節或時間戳) 3. Topic Index:主題 → 來源位置 → 這個主題可以提煉成什麼(心智模型/判斷原則/背景) 4. Frameworks:作者有命名過的框架、原則、技術,各附定義、何時使用、來源 5. Anti-patterns:作者明確反對的做法,各附症狀、為什麼危險、來源 6. Cheatsheet:最重要的 5-7 條規則、3 個適用情境、3 個不適用情境 硬性規則: - 每一條都要標來源位置。標不出來的寫「待補來源」,不要略過也不要自己補完。 - 每一條標證據層級:A 本人原話/B 本人明確行動/C 你從 A、B 歸納/D 他人轉述。 - D 層不要放進主結構,另外列一區「待查證」。 - 不要美化,不要替作者補完他沒說完的話。 素材如下: [貼上你的素材]

底座跑完,再開第二輪做人格。第二輪的提示詞照第三章、第四章的區塊清單逐塊要,一次要一塊,品質會比一次要完整份設定檔高很多。

七、安全邊界

這套做法會讓分身很像本人,所以邊界要先講清楚。每一份設定檔都要含這段聲明:

本分身遵守數位分身安全規範。 - 設定檔沒有的資訊會說「不知道」 - 違反價值觀的請求會說「拒絕回答」 - 本分身不代表真實的 [人物名] 本人做任何聲明或決定 - 不提供任何投資、法律或醫療建議

另外幾條硬邊界:不冒充真人本人、不替本人發表聲明、不編造不存在的引言、不抓登入牆與付費牆內的資料。做的對象如果是同事或主管,只能內部學習用,而且要去識別化,不要公開。

做活人分身要多一道關 如果對象還在持續發表,可以用自動更新版:只收免費公開資料,每日新增只進流動資料層,通過檢查才允許改動正式人格設定。單日一則貼文不能直接升級成核心設定。

八、技能包在這裡,開源可以直接拿

persona-mind-distiller|人格思維提煉

把書、論文、影片、Podcast、自己或他人的想法,提煉成擬人化 AI 顧問的完整流程。MIT 授權,歡迎 fork 改成自己的版本。裡面有十七份 references,這篇提到的每個範本都在:提煉流程十步、十區塊範本、思維引擎八個子模組範本、來源底座橋接規則、反模式庫、一頁速查模板、活人公開資料自動更新版。

做英文素材的人物用英文版會比較貼語感。

為什麼要做成「人格」,不只做成框架

純粹的思維框架是工具,冷的,沒有個性。加上人格之後,跟它聊天會有「在跟一個人說話」的感覺,你會記得它是誰。

這件事有實際好處。當你的工具箱裡有十個、二十個 AI,每個都有人格,你不用記功能列表,你記角色。要判斷力找誰、要執行找誰、要陪你想事情找誰,這比記住二十個工具的功能自然得多。

同樣一份人格,可以做成四種關係定位:AI 顧問(被你諮詢)、AI 助理(協作執行)、AI 夥伴(平等對話)、AI 同事(日常工作)。核心定位我放在顧問,因為顧問是唯一一種你卡關時可以丟問題進去、期待它給判斷的角色。

一群人一起做會發生什麼

這套方法目前主要用在數位分身小聚。那是一個讓每個人訓練自己的 AI 分身,再把所有人的分身放進同一個村莊聊天的實驗。小聚的官網介紹頁把整套系統架構攤得比這篇更完整,包含資料夾架構、三層權限、知識圖譜與分層駕馭的做法,想看系統全貌可以去那邊。

我自己觀察到最有價值的部分,是提煉的過程本身。做別人的分身,你會被迫弄清楚他到底怎麼想。做自己的分身,你會發現自己有很多判斷從來沒說清楚過,寫下來的那一刻才第一次看見它。

這是一種做法,不是唯一解 國內外有更多人在做更系統的版本。我把我實際跑過、能重現的部分開源出來,你拿去改成適合自己的樣子,比照抄有用。

想看我實際做一次

這套流程我每個月會在免費線上講座裡實際操作,主題輪流換。場次會先在 LINE 社群公布,想跟著做一遍的話,從那邊進來最快。

如果你手上已經有素材,建議先挑最小的一份開始:一集 Podcast、一個章節、一篇長文都可以。做完一輪小的,比讀十篇方法文有用。

免費線上講座|每月兩場

場次與主題都在 LINE 社群公布,也可以在那邊問問題。