Anthropic 的創始人之一達里奧·阿莫代伊(Dario Amodei)表示,他希望他的公司能成為「AI 領域的迪士尼」。

他指的是,他希望 Anthropic 能夠像迪士尼一樣,為其 AI 模型注入道德價值觀,使其行為符合人類的期望。

這項任務極具挑戰性,因為道德本身就複雜且充滿爭議。Anthropic 正在開發一種名為「憲法 AI」(Constitutional AI)的方法,試圖在 AI 的訓練過程中建立一套道德準則,引導其發展方向。

該方法的核心思想是,AI 模型應該能夠根據一套預先定義的原則來評估和修正自己的行為,而不是僅僅依賴人類的監督。這些原則可以包括「不要傷害他人」、「尊重隱私」等基本道德規範。

然而,如何將這些抽象的道德原則轉化為 AI 可以理解和執行的具體指令,仍然是一個巨大的難題。此外,不同的文化和社會對道德的定義也可能存在差異,這使得建立一套普適的道德準則更加困難。

儘管如此,Anthropic 仍然堅信,為 AI 注入道德價值觀是確保其安全和負責任發展的關鍵。他們希望通過不斷的探索和實驗,最終能夠創造出既強大又符合人類利益的 AI。