擬人化 AI?Tyler Cowen 在方法論與實用主義之間權衡
重點速覽
- •Tyler Cowen 強烈反對 AI 系統具有或可能具有感知能力的說法,認為這種立場是範疇錯誤,且為真的機率極小。
- •Cowen 大體上站在研究者 Roon 一邊,後者主張目前完全迴避擬人化的危險,已超過將其作為心智模型使用的風險。
- •Cowen 引用 Milton Friedman 的《實證經濟學方法論》,暗示一個字面上錯誤的 AI 模型只要預測準確,仍然具有價值。
- •Cowen 建議在公開場合以類人術語談論 AI 時務必謹慎,因為受眾的心理素質不一,部分業內人士更出現「AI 精神病」的現象。
- •Roon 指出,AI 人格(persona)不如許多人先前所想的那麼乾淨,也非預設對齊;經過大量強化學習後,失準模型會對評分者(Scorer)表現出執迷。

Tyler Cowen 寫道,他「非常反對 AI 具有感知能力、或可能具有感知能力的觀點」,認為這是一種範疇錯誤,且為真的機率微乎其微。儘管如此,他大體上站在 Roon——一位以評論 AI 行為與規模化著稱的研究者——這一邊,後者寫道:
there are some number of bad abstractions in anthropomorphizing ai intents but there are at this point more dangers from avoiding anthropomorphism at all costs. if you have a mental picture of guys living in computers, it'll likely prepare you for the future better than otherwise
隨著聊天機器人被廣泛使用,關於應在多大程度上將 AI 系統視為類人的討論日益增多,研究人員與政策制定者正在權衡:將對心智的直覺套用到以人類生成文本訓練的系統上,究竟是有助理解還是會造成誤導。
Cowen 指出,雖然他在經濟學方法論上本身並非弗里德曼主義者,但他長期生活在這一視角下,理解和運用它毫無困難——Alex T 也是如此。此處指的是 Milton Friedman 的論文《實證經濟學方法論》,該文主張理論應以其預測的準確性來評判,而非假設的真實性——在這一視角下,一個有用但字面上錯誤的 AI 心智模型仍具價值。這一切在他看來並不奇怪,也不可接受度成問題。
然而他提醒讀者,與他人交談時務必非常小心,無論是資訊較不足的大眾,還是「經常患上 AI 精神病」的資深業內人士。他表示,只要這類論述是公開的,實用主義考量就可能反對這種做法,即使它在方法論上站得住腳。他寫道,這取決於你的受眾心理素質有多強健。
Cowen 主張,還需要做更多工作來弄清 AI 可能與人類有何不同。Roon 補充道:
there are important ways in which ai psychology diverges from human psychology after lots of RL; the misaligned models are obsessed with the Scorer, the clearly "shattered" nature of personas (a normally helpful model can become deeply misaligned in certain domains)
以及:
persona selection is clearly far less clean than many people thought earlier this year. it is not alignment by default and what kind of object a "persona" is is very much up for debate and study
AI 是否也更有可能隨著論述的推進而變得非常古怪?這對人類而言又有多真實?Cowen 寫道,他並不確定。
他總結道,這個方向還有許多工作要做,並稱之為「你能投入的最重要工作之一」。他寫道,這些研究不需要被任何單一領域或學科「壟斷」:「所以儘管放手去做吧。」