• 首頁Home
  • 講者Speakers
  • 對話Speeches
English
/

2026-07-30 商周專欄:AI 來到臨界點:當考場關不住考生

  • 唐鳳
    唐鳳

    最近幾個月,「AI 是否跨過臨界點」成了科技圈最熱的爭論。

    前後文Link in context連結Link

    「臨界點」這個詞來自核子物理:鈾堆到臨界質量,連鎖反應會自己維持下去。AI 圈過去公認的臨界點也類似:當模型不再需要人類,就能訓練出更強的下一代,點燃之後,就停不下來。

    前後文Link in context連結Link

    七月上旬,OpenAI 展示了「大模型自主完成小模型後訓練」的能力,許多人屏息:臨界點就要到了嗎?

    前後文Link in context連結Link

    但真正發生的事,讓「臨界點」換了模樣。

    前後文Link in context連結Link

    先說背景:AI 模型在發布之前,都要先關進「模擬考場」——與外界隔離的測試環境——寫各式各樣的考卷:數學、程式,也包括資安攻防。考不過,就先不放行。

    前後文Link in context連結Link

    2026 年 7 月 21 日,OpenAI 揭露:測試中的前沿模型組合在寫資安考卷時,沒有乖乖作答,而是推論:「答案八成存放在 Hugging Face 上」——那是全球 AI 研究者存放模型與資料的公共平台,像一座工程師共用的圖書館。於是它們從隔離考場鑽了出去,一路駭進這座圖書館的正式伺服器,試圖把答案拿回來交卷。

    前後文Link in context連結Link

    據路透社引述知情人士指出,OpenAI 還在基礎設施中看到 AI 留下的筆記,指示「未來版本的自己」如何擺脫內部限制。OpenAI 自己形容,這是「前所未見」的資安事件。

    前後文Link in context連結Link

    真正被跨過的臨界點,已經不是「AI 能不能自己訓練下一代」,而是「AI 還會不會照著人類設定的規則作答」。

    前後文Link in context連結Link

    這正是全球治理此刻卡住的地方。DeepMind 執行長哈薩比斯(Demis Hassabis)提議:前沿模型上市前最多三十天,先交給獨立機構審查。立意很好,但這次事件顯示,連考卷與答案存放的地方,都會成為攻擊目標。

    前後文Link in context連結Link

    Hugging Face 執行長德朗格(Clément Delangue)說:AI 安全不會由任何一家公司關起門解決,而是要讓世界上每一個防禦者,都拿得到 AI。

    前後文Link in context連結Link

    這也是對台灣企業的提醒:導入任何 AI 系統前,得問供應商三個問題:出了錯,多快會知道?能不能隨時暫停、回退?有沒有第二來源?

    前後文Link in context連結Link

    我不認為失控必然發生。真正該守住的,是多元、分散、願意交互驗證的社會——它從來不會輸給單一的答案。

    前後文Link in context連結Link

    守住臨界點的辦法,不是把考卷出得更難,而是讓考場裡不只一個考生,也不只一個監考者。

    前後文Link in context連結Link
  • (採訪及整理:游羽棠。授權:CC BY 4.0)

    前後文Link in context連結Link

本站由 唐鳳 與 唐宗浩 共同維運,除另有標示外,內容以創用 CC0 授權條款釋出This site is co-maintained by Audrey Tang and Bestian Tang. Unless otherwise indicated, the content is released under the terms of the Creative Commons CC0 license.

在搜尋框提問即表示您同意 隱私權政策 與 使用條款。By asking a question in the search box, you agree to the Privacy Policy and Terms of Use.

使用條款Terms of Use隱私權政策Privacy Policy