Daniel Kokotajlo

Daniel Kokotajlo

AI Futures Project 執行主任

關於

Daniel Kokotajlo 是 AI 安全研究員,也是位於柏克萊的非營利組織 AI Futures Project 的執行主任,該組織專門研究人工智慧的未來影響。他曾修讀哲學博士,並在加入 OpenAI 擔任治理研究員之前,先後任職於 AI Impacts 與長期風險研究中心(Center on Long-Term Risk)。2024 年,他以拒絕簽署保密協議為由從 OpenAI 離職,並因此放棄約 200 萬美元的股權,表示他對公司能否在 AGI 開發上負責任地行事已失去信心。

主要貢獻

  • 共同創辦 AI Futures Project,將 AGI 預測轉化為具體公共情境,而不只是抽象時程
  • 發表《AI 2027》月度情境預測,讓 intelligence explosion 論點更容易被理解與辯論
  • 從 OpenAI 辭職並放棄據報導相當可觀的股權,原因是拒絕簽署他認為會限制公開示警的條款
  • 共同發起 Right to Warn,推動前沿 AI 實驗室員工的吹哨者保護
  • 他的預測罕見地具體、適合辯論;但也被批評信心過高、假設太強,且以情境敘事進行說服

影片與訪談

思想連結

Leopold Aschenbrenner

Leopold Aschenbrenner

思想對照

Situational Awareness LP 創辦人兼投資長

2024 年春天,兩人在前後幾週內離開 OpenAI——一個因據稱洩密而被解僱(他本人否認),一個為了不簽不貶損條款而辭職,並放棄約兩百萬美元——接著各自發表長文,把變革性 AI 放在 2027 年前後。從那裡開始,他們徹底分岔:Aschenbrenner 的《Situational Awareness》把這條時程讀成美國必須贏得競賽的理由,並據此開了一檔對沖基金;Kokotajlo 的《AI 2027》把同一條時程讀成該慢下來的理由,後來還公開替自己的預測打分數、把日期往後挪。同一棟樓、同一年、日曆上同一個數字,指令卻完全相反。

situational-awareness.ai

Sam Altman

Sam Altman

觀點交鋒

執行長・OpenAI

Kokotajlo 於 2024 年離開 OpenAI,寧可放棄約兩百萬美元的既得股權,也不簽署終身不貶損協議,並把這件事公開說了出來;不到一天,Altman 便發文表示公司「從未收回任何人的既得股權,未來也不會」,並稱這項條款是他事前並不知情的難堪之事。幾週後,OpenAI 把它從離職文件中刪去。這場分歧從來與能力無關——它關乎的是:離這項技術最近的人,能不能自由地描述它。而那是本站其他所有爭論的前提。

cybernews.com · righttowarn.ai

Ajeya Cotra

Ajeya Cotra

觀點交鋒

技術研究員・METR

Cotra 的生物錨點報告,為 AI 預測給出了第一個像樣的模型:算力、以大腦為基準的參照類別,以及一個明確的中位數。Kokotajlo 的〈Fun with +12 OOMs of Compute〉(2021)從「更短」的那一側施壓,主張這個模型自身的機制其實蘊含比它所報出的更早的日期;她 2022 年的更新在致謝中提到他的討論,在留言區回答他的提問,並把中位數從 2050 年移到 2040 年。這是一個罕見的公開案例:一份預測是被論證、而不是被氛圍,給往回挪動的。

lesswrong.com · alignmentforum.org

Theme
Language
Support
© funclosure 2025