自 2022 年 11 月 ChatGPT 推出以來,生成式人工智慧(AI)聊天機器人服務日益精密且廣受歡迎。這些系統現已整合於搜尋引擎、軟體開發工具及辦公室軟體中。對許多人而言,它們已迅速成為日常運算的一部分。
這些服務已被證明相當有用,尤其是在探索不熟悉的主題以及作為一般性的生產力輔助工具。然而,我認為這些服務的推廣和使用方式可能對社會構成危險,特別是當我們習慣於不經進一步審查就信任其輸出時。
現代 AI 系統中的某些設計選擇可能會鼓勵人們不加批判地接受其輸出。例如,許多流行的搜尋引擎已在頁面頂端突顯由 AI 生成的答案。當這種情況發生時,很容易就停止捲動,接受生成的答案然後繼續。久而久之,這可能會無意間訓練使用者將 AI 視為預設權威,而非進一步調查的起點。我希望每個生成式 AI 服務都能附帶一個簡短但顯眼的警告,說明這些系統有時可能會產生事實上不正確、誤導性或不完整的輸出。此類警告應強調,習慣性地信任 AI 輸出可能很危險。以我的經驗來看,即使存在此類警告,它們通常也很簡略且在視覺上被淡化。
在科幻小說的世界裡,艾薩克·艾西莫夫(Isaac Asimov)提出了「機器人三大定律」,這些定律貫穿了他的作品。這些定律旨在約束機器人的行為,以確保人類的安全。據我所知,艾西莫夫從未制定過任何等效的定律來規範人類應如何與機器人互動。我認為我們現在需要類似的東西來保護自己。我將其稱為「機器人的反向定律」。這些定律適用於任何需要我們人類與機器人互動的情況,其中「機器人」一詞指的是任何能夠自動執行複雜任務的機器、電腦程式、軟體服務或 AI 系統。我在此使用「反向」一詞,並非邏輯否定的意義,而是表示這些定律適用於人類而非機器人。
眾所周知,艾西莫夫的定律存在缺陷。事實上,艾西莫夫巧妙地利用了這些缺陷來製造張力。但它們對虛構機器人失效的特定方式,不一定會轉移到這些適用於人類的反向定律上。艾西莫夫的定律試圖約束自主機器人的行為。然而,這些反向定律旨在指導人類的判斷和行為。儘管如此,我們可以從艾西莫夫的故事中學到的一點是,任何有限的定律集都無法完全應對我們在 AI 和機器人領域面臨的複雜問題。但這並不意味著我們不應該嘗試。總會有需要判斷的邊緣案例。如果一套非詳盡的原則能幫助我們更清晰地思考所涉及的風險,那麼它們仍然是有用的。
以下是機器人的三個反向定律:
人類不得擬人化 AI 系統。也就是說,人類不得將情感、意圖或道德主體歸因於它們。擬人化會扭曲判斷。在極端情況下,擬人化可能導致情感依賴。
現代聊天機器人系統經常聽起來很健談且富有同情心。它們使用禮貌的措辭和類似人類互動的對話模式。雖然這使得它們更容易使用且更令人愉快,但也更容易讓人忘記它們實際上是什麼:基於數據模式生成看似合理文本的大型統計模型。
我認為基於 AI 的聊天機器人服務供應商可以在這方面做得更好。在許多情況下,系統被刻意調整成更像人類而非更機械化。我認為,從長遠來看,採取相反的方法會更健康。稍微更機械化的語氣可以降低使用者將流暢的語言誤認為理解、判斷或意圖的可能性。
無論供應商是否做出這些改變,我認為我們自己避免這個陷阱仍然是有益的。我們應該積極抵制將 AI 系統視為社會行為者或道德主體的習慣。這樣做可以保持對其能力和限制的清晰思考。
人類不得盲目信任 AI 系統的輸出。未經適當的獨立驗證,不得將 AI 生成的內容視為權威。
這個原則並非 AI 所獨有。在生活的大多數領域,我們都不應不加批判地接受資訊。當然,在實踐中,這並不總是可行的。並非每個人都是醫學或法律專家,因此我們經常依賴值得信賴的機構和公共衛生當局的指導。然而,此類機構發布的指導在大多數情況下都經過其領域專家的同行評審。另一方面,當我們在私人聊天會話中從 AI 聊天機器人那裡收到問題的答案時,我們收到的特定隨機生成的回應並未經過同行評審。因此,批判性地審查回應的責任就落在了我們身上。
儘管當今的 AI 系統在某些任務上已變得相當令人印象深刻,但它們仍可能產生錯誤的輸出。即使 AI 系統進步到能夠以高度可能性產生可靠的輸出,由於其固有的隨機性,仍然存在產生包含錯誤輸出的微小可能性。這使得它們在用於錯誤微妙但代價高昂的場合時尤其危險。潛在後果越嚴重,驗證的負擔就應該越高。
在某些應用中,例如制定數學證明或開發軟體,我們可以添加自動驗證層,例如證明檢查器或單元測試,來驗證 AI 的輸出。在其他情況下,我們必須獨立驗證輸出。
人類必須對涉及 AI 的決策及其使用後果負責。如果因遵循 AI 生成的建議或決策而發生負面結果,僅說「是 AI 告訴我們這樣做的」是不夠的。 AI 系統不會選擇目標,也不會自行部署,也不會承擔失敗的成本。人類和組織才會。 AI 系統是一種工具,就像任何其他工具一樣,其使用的責任在於決定依賴它的人。
儘管如此,這說起來容易做起來難。在類似於自動駕駛汽車的即時應用中,情況尤其棘手,因為人類沒有機會在 AI 系統採取行動之前充分審查其決策。要求人類駕駛員保持持續警惕,並不能解決 AI 系統的行動速度往往比人類介入所需時間更快的問題。儘管存在這個相當嚴重的限制,但我們必須承認,如果 AI 系統在這些應用中失敗,調查失敗並添加額外安全措施的責任仍應由負責系統設計的人員承擔。
在所有其他情況下,如果沒有物理限制阻止人類在 AI 輸出被執行前進行審查,那麼因使用 AI 而產生的任何負面後果都必須完全由人類決策者承擔。作為一項普遍原則,我們絕不應接受「是 AI 告訴我們這樣做的」作為有害後果的可接受藉口。是的,AI 可能產生了建議,但人類決定遵循它,因此必須追究該人類的責任。這對於防止 AI 在可能造成嚴重損害的情況下被濫用至關重要。
上述三個定律基於我所見到對社會有害的使用模式。我希望透過這三個簡單的定律,我們可以鼓勵我們的同胞停下來反思他們與現代 AI 系統的互動方式,抵制削弱判斷力或模糊責任的習慣,並始終記住 AI 是我們選擇使用的工具,而不是我們屈服的權威。