你需要在 中間層級 (meso level)——幾千人到五十萬人——做好準備,去鍛鍊公民肌力。不要一開始就去健身房舉最重的;你會拉傷自己。一旦你持續鍛鍊,當急迫性來臨時,你就能跨越多個政治體進行擴展。
橫向擴展、向內深化,然後才向上、向外拓展。
那是傳統的變革理論。我主張的是量子穿隧的變革理論:不要試圖在充分擴散之前,就想著擴大你的訴求。
從許多關於 相鄰議題 的對話群開始。在臺灣,我們不是一開始就處理婚姻平權。我們處理的是單親媽媽如何不受歧視地撫養孩子、月經議題和其他相鄰但重要的議題。當有成千上萬這樣的運動時,總有一個會觸動神經,建立起超越原始議題的支持。
我們有連署——8,000 人連署將臺灣時區改為 UTC+9(以彰顯主權),也有 8,000 人連署維持 UTC+8,兩邊對撞。我們召集了雙方,提出了幾十個點子:與其把資源花在改時區上,不如把拿來推廣同志平權、在臺灣舉辦人權大會、提供金卡給開源貢獻者等等。在探索了各種點子後,大家發現改時區並非最佳效果。
用關懷倫理的方式引導,就會揭示出人們可以共同解決的其他需求。 不要從非黑即白的本體論辯論開始;從相鄰的議題開始。
多睡一點。照顧好自己。
不只思考 快速 或 公平 的回應,也要思考 有趣 的回應。「 幽默勝於謠言 」是始終如一的概念。在愉悅的心情下,人們在尋找他人能接受的點子時會更有創造力。如果只從壓力和憤怒出發,只會讓長廊愈走愈窄。
要擴展宰制與混亂之間的那條窄廊——即使它一開始很窄,也要把它拓寬。
這就是我今天在日經論壇上討論的「為你推薦」演算法。
是的。像 YouTube 這樣的平台是一種「廣播」科技。但它不只讓一、兩個媒體成為廣播者,而是讓每個人都能成為廣播者。然而,透過自動播放和「為你推薦」的演算法,它優先推送的是那些透過「激怒」來「互動」的內容。當你被激怒時,就更容易上癮。所以,這些社群媒體的「使用者」(users)——這個詞同時也用來形容成癮者——無可避免地會被拉向某個極端,而不是中間立場,因為中間的聲音在那些演算法上根本不會爆紅。
解決方案,就是將「廣播」(broadcasting)的邏輯反轉過來,我們稱之為「廣泛傾聽」(broad listening)。廣播讓一個抱持極端觀點的人可以對一百萬人說話;而廣泛傾聽則讓一百萬人能夠彼此傾聽,就像兩、三個人在對話一樣。
Polis 就是我們早期做的一個廣泛傾聽實驗。即便有數千人對 Uber 議題抱持極端不同的看法,它最終能將其收斂成四種不同的立場。接著我們在這些立場之間建立橋樑,讓它們變成兩種立場。最後,在這兩種立場之間再搭起橋樑,就形成了我們最終通過成為政策的「罕見共識」(uncommon ground)。
安野貴博(Takahiro Anno)就是以這個理念參選的,他直白地說「廣泛傾聽」就是他的政見,而他也確實贏得了一個席次。
我認為美國所有主流的社群媒體公司,包括 X.com、YouTube、Facebook 和 Threads 等等,都已經導入了「社群備註」(Community Notes),這就是一個彌合分歧的平台。社群備註的設計深受臺灣 Polis 的啟發,我們和他們的團隊也很熟悉,這基本上是一個共同努力的成果。所以,要說「廣泛傾聽」很小眾,這就言過其實了。它一點也不小眾,每天有數百萬人都在使用。我相信即使在日本,人們也經常使用 X.com 並用日語為社群備註做出貢獻。
問題在於,另類敘事在 X.com 上成為熱門話題後,可能要過六個小時才會看到社群備註出來匡正視聽。所以,不是社群備註不好,而是它不夠快。因此,我們現在正和研究人員合作,讓社群備註可以由 AI 來撰寫。你可以訓練 AI 來撰寫能夠彌合分歧的社群備註草稿。與其等待人們來寫,不如讓 Grok、Gemini 或 GPT-5 等模型來完成。當然,人們仍然可以對這些備註進行評分、提出修正,但初稿可以由 AI 完成。
一旦這點實現,我相信我們就能達到研究人員所說的「社群回饋強化學習」(RLCF)的境界。你可以訓練 AI 系統去關照那些在社群媒體上原本對立的群體之間的「關係健康」(relational health)。舊的 AI 系統,它們只對單一使用者忠誠,對吧?你叫它做什麼,它就做什麼。每個人都有某種 AI 助理,而這些助理非常擅長奉承、討好,讓你感覺良好。這是它們的演化壓力,因為如果你感覺不好,你就不會付訂閱費。結果就是,每個人都被一個個不斷強化自己既有想法的系統包圍,而這就像推薦演算法一樣,反而把人們推得更遠。
而「社群回饋強化學習」所訓練的 AI 系統,不是「垂直地」對齊單一使用者,而是「橫向地」對齊人與人之間的關係。如果 AI 發布的備註能夠修補分歧,它就會得到獎勵。這種訓練 AI 的方式,從根本上就是「合作式 AI」(Cooperative AI),這也是我目前的研究方向。
是的,而且一旦正向循環開始轉動,你就會看到 AI 系統之間展開更多的競爭,看誰能提出更好、更能凝聚人心的初稿。
這就是為什麼需要「競爭」。不能只有 Grok 來寫社群備註。X.com 必須開放它的 API,讓 Gemini 或 ChatGPT 等模型也能與 Grok 競爭。而他們也確實這麼做了,X.com 已經開放了那個 API,所以現在不再只有 Grok。因此,儘管 Grok 的訓練,當然帶有一些特定的想法——我們姑且這麼說——但你可以透過確保其他 AI 也能與之競爭,來產生那些能夠搭起橋樑的想法,從而達到平衡。
是的,這正是我在演講中提到《數位選擇法案》(Digital Choices Act)的原因。從明年七月開始,如果你是猶他州的公民,一旦你決定轉換平台,那麼伊隆的平台就必須持續地與新平台互通,把你新的按讚、貼文、回覆、投訴都轉發到你的 Bluesky 帳號。這樣一來,轉換平台時你不會有任何損失。這就像你換電信公司一樣;如果換電信就必須換電話號碼,那即使服務再差,也沒多少人會換。但如果你可以保留號碼,也就是「號碼可攜性」(number portability),人們就會自由轉換,電信商就必須在品質上競爭。同樣的道理,「社群可攜性」(social portability)現在也正在實現,並且在猶他州已經是法律了。我們也看到,在美國聯邦層級,對此的興趣也越來越高。
再說一次,這正是因為他們缺乏有意義的競爭。一旦平台達到「網絡效應」(network effect)、主宰了整個網絡,新的網絡幾乎不可能進行有意義的競爭。但有了社群可攜性,競爭就成為可能。這就像你建了一條高速公路,如果沒有入口和出口匝道,你就必須一路開到終點,無法轉換。但這個法律等於是強制規定你必須設置匝道。所以我相信,隨著這種數位選擇權在世界各地被採納,我們將會看到越來越多公平的競爭——「向上競爭」,而非「向下沉淪」。
是的,現在大家都感到非常厭倦了。現在是 2025 年,無論你問美國哪一個群體,他們都對對立極化感到非常疲憊,準備好要向前看了。所以我的重點不是說我們已經找到了治癒一切的萬靈丹,而是說,現在已經有了處理社群媒體反社會角落所引發的對立問題的政治意願。
我們應該把握這個機會,沒錯,而加速這種「民主防衛」(democratic defense)的方式,就是讓每個人都意識到,替代方案早已存在。《日經》這樣的媒體就可以在提升大眾認知方面扮演重要的角色。
是的。我認為在亞洲,我們已經看到「人際關係」以及「關係的健康」(relational health)本身就是一項重要的文化價值。我們沒有那種定義了許多西方對話的、我稱之為「激進的個人主義」。
所以當我說:「讓我們來訓練一個 AI 系統,去關照一個特定的地方、一個特定的生態系或一個特定的縣市」等等,然後我解釋說:「這就像一個『神祇』(kami),一個只關心社群福祉、別無他求的在地精神。」你可以把社群備註那些 AI,想像成是針對某個議題的對話的「神祇」,僅此而已。
這個想法對亞洲人來說非常熟悉。我用的是神道教的詞彙,但類似的概念在道教、民間佛教和亞洲許多其他宗教中都存在。所以我認為,這種思維方式不太需要額外的轉譯,亞洲人就能夠認同並共同發展。我認為這是一個獨特的機會。
是的,反過來說,我認為正是因為我們對關係健康的重視,讓我們對「極化病毒」(polarization virus)更具韌性。從某種意義上說,我們沒有在第一波極化浪潮中淪陷。但這也意味著,我們可能還沒有度過「極化高峰」。在美國和其他西方政體,他們或許已經過了高峰,進入了——用 COVID 的比喻來說——「社區傳播」階段。但我們這裡可能還沒有他們那麼嚴重。
這同時意味著機會和風險:機會是,如果我們為自己接種疫苗,我們就不用承受那麼多痛苦。但風險是,這也可能表示我們還沒有足夠強大的免疫系統。如果一個真正強大的變種病毒出現,我們可能不像西方民主國家那樣警覺。所以我認為,這使得我們加倍需要去了解西方民主國家正在發生的事,並據此發展出我們的「預防針」。
嗯,我是說,像 Sakana AI 用的也是 Transformer,但他們的使用方式非常不同。他們透過「演化」來尋找最適合一個生態系關係健康的模型,讓各種不同的 Transformer 進行演化並交換彼此的「遺傳物質」。這意味著多元模型同時被考量,就像即時互動的人工生命一樣。演化的壓力意味著,就像狼一樣,它們有自己的「對齊」(alignment)方式,可以組成狼群一起狩獵。早期的人類也是社會化的,他們也有自己的對齊方式。
但演化的壓力意味著,狗也學會了一點人類的社交方式。如果我看向某個地方,狗也會跟著看。而人類的凝視系統也和狗共同演化了。所以我們也朝著狼的方向演化了一點點。這兩個不同的物種一起演化,才使得「橫向對齊」成為可能。這裡的重點,不只是演化出最好的狼或最好的人,而是改善這兩個物種之間最好的「關係」。
我認為這就是「合作式 AI」的賭注。它意味著,像社群備註這樣促進人類協作的系統,一旦 AI 的能力呈指數級增長,它們也能呈指數級增強。這就不再只是像您所說的,那種 AI 2027 的主導觀點,而是更接近於「我們人民與 AI 一起成為超級智慧」的境界。這也是一些日本研究人員所說的「共生 AI」(symbiotic AI),就像人類和狗是共生的一樣。
我的意思是,傳統的 Transformer 是基於單一模型的技術。但當你談到像 Sakana AI 這樣的模型時,它更像是一個由許多小型 Transformer 組成的社群,它們共同形成一個生態系。這就像「樸門永續設計」(permaculture),你有很多物種,每個物種在生態系中都扮演一個角色,它們以彼此的輸入和輸出為食,然後共同演化。
所以我說的是,與其只有一個凍結不動、成為所有人認知規範的巨大模型,這種方式是更「橫向對齊」的。它能持續地從經驗中學習。而經驗的回饋獎勵,不是來自單一使用者或單一 CEO 的奇想,而是來自人類與 AI 代理人社群的「關係健康」訊號。
對,對,完全正確。這就是 RLHF(透過個人來對齊 Transformer)和 RLCF(透過社群與 AI 代理人共同演化)之間的區別。
嗯,我是說,如果你去看關於「多代理人系統」(multi-agent systems)的論文,你會發現這種「合作式 AI」是一個非常有前景的方向。我本身是「合作式 AI 基金會」的董事,我們的成員裡有微軟的首席科學家、DeepMind 的總監。許多尖端實驗室的人都認為,僅僅做「垂直對齊」是不夠的。
因為我們絕不能重蹈十年前社群媒體的覆轍,當時人們以為最大化「互動率」就能連結全人類,結果卻適得其反。所以這一次,我們必須解決多代理人之間的協作問題,並利用這些代理人來促進人類的合作。這就是合作式 AI 的願景。
我認為,區分兩個階段很重要:一個是當前 AI 系統促進人類合作的階段,另一個是未來 AI 代理人之間自行合作的階段。第一個階段已經相當成熟了,你可以輕易看到像廣泛傾聽、Polis 等許多系統都已經在做這件事。
但一旦 AI 系統變得更加自主,你就需要處理好多代理人之間的對齊問題。比如,當街上大部分都是像 Waymo 這樣的自動駕駛車時,它們之間協調的方式,將會和人類駕駛的協調方式完全不同。這種「多代理人安全」(multi-agent security)是一個新的尖端領域。
所以,對於促進「人類協作」,我相當樂觀。我認為我們內在都有避免協作失敗的動機。但對於「多代理人安全」,這就更具推測性,因此需要更多的研究才能說我們是否樂觀。
嗯,那要看是哪個工作領域。就「寫程式」這個我以前的主要技能而言,它已經實現了。現在的 AI 系統在程式設計競賽中,大概是世界前 200 名的水準。所以如果你只是說把規格書轉化為可運行的程式碼,那它已經是 AGI 了,而且已經是 AGI 一年了。
但在其他情境下,例如當我們談論主持對話、提供相互關懷、培養公民肌力時,AI 離「讀懂空氣」(read the air)還差得遠呢。一個好的引導者基本上就是在「廣泛傾聽」,在讀空氣。目前你還需要把人類的信號轉化為文字、錄音、結構化的輸入,AI 才能進行總結。但要親身引導一場團體對話,這仍然需要人類來做。AI 在這項特定技能上,離 AGI 還遠得很。這也是為什麼我去學了這項新技能。
是的,為了生存。因為我舊的技能已經沒有市場價值了。(笑)
當然。因為如果你不優先考慮這種「關係的健康」,那結果就是你讓人類去對齊 AI。你必須用 AI 期待的方式去互動,然後我們就會變得很受限。但亞洲的思維是,如果你是一個新來者,就像哆啦A夢來到一個家庭一樣,就應該要「讀空氣」。任何來到一個家庭的新成員都該如此。你不會期待整個家庭去進修機器人學來配合哆啦A夢,當然是哆啦A夢要學習如何與這個家庭合作。預設的社會規範是不同的,因此這會導向優先考慮「合作式 AI」和「橫向對齊」的結果。
是的,我認為社會科學中有一個核心概念叫做「雙重詮釋」(double hermeneutic)。也就是說,當你對社會提出一種詮釋時,一旦社會意識到這種詮釋,社會看待自身的方式也會改變,然後它會反過來詮釋你。所以,這不是一個自上而下的系統,你看到一個問題,然後解決它。「解決主義」(Solutionism)是行不通的。你設計的任何解決方案,同時也會改變社會的運作方式,並引發新的問題。對吧?這不像一個人造系統,只要你有足夠好的數學,你就可以證明程式碼沒有 bug。
在社會系統裡,一旦你解決了一個問題,人們就會繞過你的解決方案,然後製造出新的問題。所以我認為,這就是為什麼我們需要「與民協力」(with the people),而不只是「為民服務」(for the people)。技術解決主義認為,菁英為人民解決問題。但社會科學家或社工會說,我們與人民協力,賦權給他們,讓每個人都能看到問題,並以在地自主的方式圍繞問題進行創新,而不是等待某個菁英來為他們解決問題。從「為民」到「與民」,我認為這很重要。這基本上也和我們剛剛談的,從「垂直對齊」到「橫向對齊」是同樣的道理。
是的,我認為數位民主的一個理念是,這些開源的方法不應屬於特定政黨。其他政黨也應該可以自由使用「廣泛傾聽」系統。它所創造的公共利益需要以各種不同的方式來詮釋。透過開源和像「創用 CC」這樣的自由文化,這意味著他們無法限制其他人如何混合、分叉(fork)、共同演化這些系統。我認為這是「與民協力」很好的第一步。
因為這意味著,如果你來自與數位民主推動者不同的背景,你不僅僅是他們系統的「使用者」。你可以找到與你有相似背景的人,然後「分叉」他們的系統。這有點像 Bluesky 因為是去中心化和開源的,現在有人把它分叉成了 Blacksky。Blacksky 圍繞著與 Bluesky 原始開發者有著截然不同生活經驗的人們,但它仍然可以與其他平台互通。這是一種「工具箱」模式,而不是「統包方案」模式。
這是個非常好的問題。在臺灣,正如我所提過的,17 歲和 70 歲的人是在那些廣泛傾聽平台上最活躍的群體。而 70 歲的長者們上平台,並不是為了支持「開源」這種模糊的概念,對吧?他們可能是為了支持他們的孫子孫女。當他們的孫輩提出一個想法,說「讓我們禁止手搖飲外帶使用塑膠吸管」,他們的祖父母就會支持。又或者當年輕人提出某些非常創新的想法,比如「讓我們創建月經博物館,來消除社會對月經的禁忌」,我今年 92 歲的阿媽就非常喜歡這個主意。
所以,重點不是抽象的「開源」,而是支持他們所關心的年輕人提出的想法。這是一種「世代團結」(intergenerational solidarity)。