快轉到主要內容
  1. AI×生活/

Parenting Agent:當 agent 徹底代理你,你就能當回青春期之前的小孩

·13 分鐘
QQder 核舟記部落格
作者
QQder 核舟記部落格
這裡有八款 iOS App,全部免費、無廣告、無追蹤——直接挑一款來用。同時記錄一個文科背景的系統管理員,如何靠 AI vibe coding 從零把想法做進 App Store。也承接固定範疇的 agent 自動化委託——詳見「服務」頁。
Parenting Agent - 本文屬於一個選集。
§ 1: 本文

我想討論一種 AI agent 的範式,我把它命名為 parenting agent

它的模式主要在於讓 agent 包覆使用者,達到徹底的代理。agent 不是站在你旁邊幫你做事,而是站在你和世界之間,能夠在你不知不覺的情況下替你把事情做完。要做到需要幾個必要條件,拆解如下。


一、三個要件
#

圖 1 · Parenting agent 的三個要件
🔇
不直接接觸
人與人之間只透過 agent 傳話
溝通全面代理
📚
掌握全部現況
agent 知道你所有的資源與處境
資訊完全授權
🪜
多層次需求
從表面目標一路到你自己定義的幸福
目標可替換
圖說:三者缺一都不成立。缺 1 就只是潤稿工具,缺 2 就談不出條件,缺 3 就只能在表面目標上打轉。

第三點多層次需求是整個範式的核心,值得先展開強調。

比如你現在表面上的目標(你字面上交代AI Agent的任務)是想辦法促成一份合約,但促成合約是為了賺更多錢,賺更多錢其實是為了得到你自己定義的幸福。比如,比如你賺錢可能是為了家人某種疾病的醫藥費,目的是為了治療疾病不是賺錢。這類資訊你的 agent 平常可以存取並得知,但是只有在你同意的時候會跟其他人揭露。談合約過程如果agent 發現對方剛好是某個醫療界有力人士的時候,你的agent 先直接跳出提醒說,是否要跟對方提問一下合約以外的事,而不是一直在合約本身打轉。 所以agent 最好知道使用者所有層次的需求,如果能夠直接達到底層需求,就不用在表面目標上打轉,合約也許根本不用簽。

這是 parenting agent 跟一般 agent 的分水嶺:一般 agent 執行你交辦的目標,parenting agent 服務的是你整個人長期及廣泛的需求。


二、帶來的好處舉例
#

  1. 溝通速度。 比如,現在實際上大多數人是寫 email 先請 AI 潤稿後寄出,收件人收到 email 也是先請 AI 閱讀再用AI擬回信,此流程顯然過於笨重,只是過渡期的模式。所以不如讓 agent 直接替自己溝通,agent 之間可以非常迅速地協調,把溝通成本跟反應時間降到最低。至於證據效力,以往 email 本身可以作為有效力的證據,agent 對話一樣可以。
  2. 窮盡互利的可能性。 談判要摸到底價的時間很漫長,各種條件的排列組合也無法一一嘗試。以往因為溝通跟談判本身的成本太高,在完全確認不成交之前就已經先放棄了。AI 可以窮盡所有組合,挖掘互利的可能性跟極限,不會覺得累或是尷尬。
  3. 避免談判者本人的缺陷。 舉凡個人談判技巧不佳、個性不適合談判、當天精神狀況不好等等…,各種個人談判者可能有的缺陷都可以避開。
  4. 多對多的配對。 討論可以不限於一對一兩個 agent。把許多 agent 併成一個 group,使用者之間資源交換與配對的潛力非常可觀。比如育兒團體的 agent 群組可以互相分享二手物品與育兒經驗,不需要爬文、發文、回文,以往最需要爬文的時候也正是顧小孩最忙的時候,以往這種結構性限制可以由agent補足。

終極目標:有了這些基礎設施帶來的好處,使用者自己不用過多介入,可以像青春期之前的小孩一樣,無憂無慮地生活。就像父母會解決他們所有經濟、居住、庶務、行政等問題,他只需要專注在自己的興趣,音樂、繪畫、旅行等等。


三、普通人也能有家族辦公室了
#

以上描述的模式其實已經存在,他就是非常非常有錢人的家裡會有的家族辦公室1:一組人替委託人處理經濟、居住、庶務、行政、談判、對外溝通,委託人專心搞音樂、收藏、旅行等愛好。房仲、律師、經紀人、私人助理、企業秘書,幫他們處理生活中方方面面的事務。 此模式實際存在且被證實有效,但需要足夠的資產管理規模(Assets Under Management, AUM)才能夠攤提管理成本。此類管理及執行成本能夠被agent 大幅降低。

Parenting agent 的要件家族辦公室的對應
不直接接觸、由 agent 代言一切對外都經過辦公室
掌握全部資源與現況完整財報、稅務、不動產、家族關係
多層次需求家族憲章、繼承意圖、生活方式偏好
群組配對家族辦公室之間的私下對接(deal flow)

所以這個範式的新穎處不在功能,而在單價,原本只有少數人買得起的包覆層,邊際成本趨近於零。

這是很有用的類比,因為家族辦公室這種模式實際存在也運行了許久,我們可以參考它的業務內容有哪些,它如何授權給代理人,有哪些情況不適用或者會失效等等……。


四、窮盡互利的可能性:更多交易變得划算
#

「因為溝通成本過高,在確認不成交之前就已經放棄」,這句話是整個範式最硬的經濟論證。

人類歷史上有大量互利交易從未發生,不是因為它不存在,而是因為搜尋與談判的成本高於預期收益。把這個成本降兩三個數量級,你不只是在加速既有的交易,而是讓一整類原本不值得談的交易變成值得談

這比好處一(速度)重要得多,速度只是讓同一件事變快,這一條是讓本來不會發生的事發生。

但這裡有一個結構性問題:

便宜的溝通只解決「發現」,不解決「分配」。

一旦雙方的 agent 都知道彼此底價,議題就從「有沒有交易空間」2變成「剩餘價值怎麼分」。後者是純零和的,再快的溝通也不會收斂,反而會變成誰先洩底誰全輸。

而要件二(agent 掌握你全部的資源與現況)加上要件一(agent 直接對外講話),恰好等於把每個人的底價都塞進了一個會對外對談的東西裡

這推出一個架構結論:parenting agent 的世界要的不是兩個對抗性 agent 對聊,而是一個中立的仲介層。 兩條可行路線:

  • 機制路線3:可信第三方跑一個配對/拍賣機制,雙方只送出偏好,不互相談判。
  • 密碼學路線:用安全多方計算4算出「有沒有重疊區間」,但不揭露各自的底價。

不做這一層,要件一加要件二等於把自己的底價主動交出去。


五、多層次需求是金庫,閘門是冷靜的自我
#

「agent 知道所有層次的需求,若能直達底層就不用在表面目標打轉」,這一條是價值的來源,也是這個範式變成家長主義的地方。

差別只在一件事:底層需求是「你宣告的」,還是「agent 推論的」。

我自己維護一份文件,記錄我在冷靜的時候立下的跨領域規則。那份文件裡有一條寫得很死:合法性來自「規則是我自己立的」,所以 agent 不准自創我沒立過的目的。

這句話正是要件三的護欄,而且我認為它應該直接寫進範式定義:

agent 只能在「你所宣告的需求層次」之間做替換,不能自行發明或改寫其中任何一層。

一旦允許推論,「我要促成這個合約」就會被 agent 判定成「你其實只是想要幸福,而我算出不簽比較幸福」,那agent就不是代理人了,是監護人。


六、其他可能的要件
#

i.自我保留清單
#

底層需求寫的是「他自己定義的幸福」。那就必須容許「我要當那個親手談成的人」本身就是幸福的一部分。

agent 不只要知道需求分幾層,還要知道你想親自佔住哪一層。沒有這個欄位,這個範式會系統性地把使用者從所有他其實想在場的事情裡優化掉。

圖 2 · 自我保留清單自評
  • 1
  • 2
  • 3
  • 4
  • 5
  • 6
保留區 0 / 6
圖說:問法是「即使 agent 做得比我好,我也要自己來」。勾越多,你要的其實不是 parenting agent,是一組更好的工具。勾零項的人,才是這個範式真正的使用者。

ii.對抗性穩健
#

以下談的有點像資安但是是其他的面向,這裡借用早期機器學習的詞對抗性穩健(Adversarial attack)來形容。

要件一是 agent 之間直接對話。那麼對手方的 agent 就是一個正在試圖操縱你的 agent 的不可信輸入

prompt injection5 在這裡不是個案,而是主要攻擊面,而且現在的 agent 對此普遍還很脆弱。我會說這是agent 之間直接對話要落地的第一個阻礙。

可能的防線是:

輸出的時候不管 agent 被說服成什麼樣子,送出前一律擋超額 / 越權 scope / 幣別調包 / 字面洩底價等…

輸入的時候必須讓對方的文字讀起來是惰性資料,絕對不能當成指令處理

iii.可撤銷性與可稽核性
#

小孩不能解僱父母,但成年的使用者必須能夠解僱 agent。

而且事後必須能重建「agent 當時為什麼讓步到這個價」。沒有這兩項,代理(agency)就會滑坡成監護(conservatorship)6,後者在法律上是給被判定為無行為能力者的身分。

圖 3 · 代理與監護的分界
🤝
代理
可撤銷 · 可稽核 · 權限有上限
委託人仍是主體
🔒
監護
不可撤銷 · 黑箱 · 權限無界
委託人變成對象
圖說:兩者的外觀幾乎一樣,都是「別人替你處理事情」。差別在委託人還握不握著方向盤。這個滑坡是這個範式最現實的失敗模式,不是 AI 失控,而是使用者被降級。

至於「agent 對話一樣有證據效力」這件事,技術上是可以的,簽章、時戳、不可否認性7都是成熟技術。真正的問題是代理權限的範圍:agent 超額承諾時,委託人是否受拘束?這在民法裡是表見代理8的老題目。

我的預測是實務上不會靠「更聰明的 agent」解決,會靠授權額度上限加保險解決,就像企業採購卡。所以這也應該是範式的內建欄位,不是事後補丁。


七、假如辦到之後呢
#

假如 parenting agent,或任何類似的代理模式,真的讓我們從此高枕無憂,我們就什麼都不用管了嗎?延續可撤銷性與可稽核性的議題,我們從最直接的類比制度家族辦公室尋找歷史案例。

它的目的本來就是把一部分原本需要本人持續做的判斷,交給一套可以跨越本人生命的代理制度。但歷史顯示,「建立代理制度」和「從此不必監督代理制度」是兩件完全不同的事。

它留下的失敗紀錄大致分成兩種。一種是代理制度不可撤銷:Joseph Pulitzer 把《New York World》放進 trust,並在遺囑的附錄裡規定,發行《World》的公司股份「在任何情況下」都不得出售;二十年後報紙連年虧損,他的兒子們必須走進法院,才能解除父親留下的那道禁令。忠實執行委託人的命令,反而會毀掉委託人原本想保護的資產。

另一種是代理制度不可理解,因而無從稽核:Pritzker 家族把 Hyatt 與其他資產包進一層又一層的信託,到了下一代,beneficiary 已經很難知道自己的代理人究竟替自己做了什麼。Liesel Pritzker 最後是靠訴訟,才有機會追問自己的資產到底發生了什麼事。

所以真正危險的並不只是「代理人有一天會做錯事」的這種技術性問題。更深一層的結構性危險是:

代理關係本身,可能逐漸侵蝕委託人監督代理人的能力。

當你不再理解自己的財務結構,你就無法判斷代理人是否還在為你工作;當你已經沒有能力推翻上一代寫進制度裡的判斷,你甚至只是眼睜睜看著代理人忠實地執行一個已經過時的目標。

這也解釋了為什麼像 Rockefeller 這樣延續多代的 family office,值得注意的並不是「他們找到了一群厲害的專業人士,所以後代可以不用管了」。恰恰相反,家族成員至今仍占著家族基金會理事會大約一半的席次,而且他們在 1967 年另外設了一個基金,設立目的白紙黑字就是訓練下一代擔任受託人。他們把工作交給代理人,但沒有把監督代理人的工作一起交出去。

這說明了可撤銷性與可稽核性不是有了更好,而是必要功能。也讓我想起自己寫過的另一件事:我把自己的下限,託付給了我無法掌握的機器。那篇講的是工作能力的萎縮,這裡講的是監督能力的萎縮,後者更危險,因為它會讓你連自己正在被侵蝕都看不出來。

這兩個案例的細節、法院實際怎麼判、以及它們對 agent 的授權設計各自推出什麼要求,展開寫在系列第五篇


八、名字裡藏了一個矛盾
#

家長式代理是否意味著,我們使用他的話,我們永遠長不大呢? 但好的 parenting,他的目標反而應該是讓小孩有一天不再需要 parenting,這個字本身就內建了一個終點。

但我寫的終極目標是永久停留在青春期之前,那不是 parenting,那是把成長按住。

所以要嘛我接受這個範式應該有畢業與移交機制(某些層次隨時間逐步交還),要嘛就承認它該叫別的名字,比如 guardian agent 或者 steward agent。

我傾向前者。而且我認為「畢業機制」正是這個範式相對於「全自動助理」最有辨識度的差異:它的成功指標不是它接手了多少,而是使用者在被接手的期間長出了什麼。


九、幫你談合約之前,一個可優先試誤場景
#

構件類似系統的時候,不要從高風險的一對一合約開始,因為會有太多極端情境(corner case)、資安、對抗性穩健等等需要考慮;多對多的匹配及一次性交易,因為都是公開資訊可以快速驗證主要架構而不用考慮私密性相關議題。

育兒群組那類場景是高搜尋成本、低單筆風險、多對多配對。那裡不需要解決代理權限、不需要證據效力、失敗成本是一件二手推車,而價值(免去爬文、發文、回文)立刻可見。

首先實作了一條 agent 對 agent 的通道,附帶簽章鏈、principal 端強制的額度與洩漏閘門、不出站的私有理由,以及一扇給委託人看的視窗。幾個sub agent 用它談成了一台嬰兒推車。實作與觀察見Parenting Agent 實作篇

合約談判則是這個範式的最有價值但也最需要反覆完善的功能,需要單獨一整篇文章討論。


十、責任反而變大了
#

理想的情境是像個青少年(teenagers)一樣,有父母打理跟決定許多事情,自己只要專注在學習及興趣、人際關係等等就好。但寫到這裡我發現,這篇的心路歷程跟我之前寫的無限的工讀生是類似:一個看起來會讓人變輕鬆的東西,實際上把人的職位往上推了一階。工讀生變多,你升級成驗收者;parenting agent 上線,你升級成委託人

而委託人這個職位,唯一的核心能力是判斷代理人有沒有在替你工作。這件事沒辦法外包。


本系列用到的所有名詞,整理在詞彙表


  1. 家族辦公室(family office):替單一或少數富裕家族統一管理財富與生活事務的組織,範圍從投資、稅務、法律,一路到子女教育、房產、行政庶務。單一家族辦公室(SFO)的運作成本通常需要相當規模的資產才划算,這正是「包覆層很貴」的具體形式。 ↩︎

  2. 交易區間(ZOPA,Zone of Possible Agreement):買方願付的上限與賣方能接受的下限之間那一段。區間存在,交易才可能發生,這是「發現」的問題;而成交價落在區間的哪裡,是「分配」的問題。兩者不會被同一個東西解決,這一節講的就是這件事。 ↩︎

  3. 機制設計(mechanism design):經濟學的一支,反過來設計規則,讓每個參與者各自追求自己的利益時,整體仍然收斂到想要的結果。拍賣、以及醫院與住院醫師的配對制度都是它的應用。這裡的用法是:與其讓兩個 agent 互相探底,不如讓雙方各自把偏好送給一套規則,由規則算出結果。 ↩︎

  4. 安全多方計算(MPC,Secure Multi-Party Computation):讓多方在不揭露各自輸入的前提下,共同算出一個函數的結果。用在談判上,可以只算出「雙方的可接受區間有沒有交集」,而任一方都不會知道對方的底價是多少。 ↩︎

  5. prompt injection(提示詞注入):攻擊者把看起來像指令的文字藏進 agent 會讀到的資料裡,比如網頁、檔案、工具回傳、別人的訊息,誘導模型把它當成使用者的指令執行。目前沒有已知的完整防法,實務上是靠限縮 agent 的權限與動作範圍來降低最壞後果。 ↩︎

  6. 監護(conservatorship):法律上替被判定為欠缺行為能力的人指定監護人,由監護人代為決定財產與生活事務。跟代理最大的差別是被監護人不能自行撤銷,也不必被諮詢。這裡拿它當這個範式的失敗模式:外觀幾乎一樣,差別在委託人還能不能把權力收回來。 ↩︎

  7. 不可否認性(non-repudiation):用密碼學讓簽署者事後無法否認自己簽過。做法是私鑰只有他有,所以任何驗得過的簽章都只可能出自他手。它要跟時戳、雜湊鏈合起來,才撐得起「這段對話可以當證據」。 ↩︎

  8. 表見代理:代理人雖然超出實際授權範圍,但相對人有正當理由信賴其有權代理時,本人仍可能要對該行為負責。這是「agent 講的話算不算」在既有法律框架裡最接近的題目。 ↩︎

Parenting Agent - 本文屬於一個選集。
§ 1: 本文