你可能已經知道,為 ChatGPT、Gemini、Claude 等聊天機器人提供動力的 AI 模型,都是在看似無限的出版作品資料庫上訓練的,其中包含數億本書籍、線上文章、學術論文,基本上是網路上能找到的一切。大多數出版作家,在不知情或未經同意的情況下,為開發這些威脅其生計的 AI 工具做出了貢獻。這聽起來不合法,對吧?
「就像任何渴望成為作家一樣,Anthropic 的大型語言模型是透過作品進行訓練,不是為了超越並複製或取代它們——而是為了轉向一個新的方向,創造出不同的東西,」法官寫道,他將大型語言模型攝取數兆字詞的方式,比喻為作家對文學的研究。
Gellis 認為這項裁決對 AI 公司更有利。對於預計到 2028 年年收入約 2000 億美元的公司來說,15 億美元的罰款算什麼?
「大家現在都非常擔心,因為法律處於混亂狀態,而這就是因為這個問題,」JW International 的知識產權與媒體業務資深律師兼創辦人 Jason Henderson 告訴 TechCrunch。「他們知道 AI 模型已經訓練了這麼多東西,而法律還沒有真正跟上這個問題。」
Henderson 提到一個案例,媒體科技公司湯森路透(Thomson Reuters)起訴研究公司 Ross Intelligence 複製其內容,以建立一個競爭性的、基於 AI 的法律平台。
「Ross 的使用不是轉化性的,因為它沒有比湯森路透的內容『進一步的目的或不同的特徵』,」法官 Stephanos Bibas 去年寫道。
在那起案件中,Bibas 法官裁定,為了建立一個直接與路透社競爭的新平台而訓練其內容,不構成合理使用。雖然作家們可能會爭辯說,聊天機器人透過使用他們的作品來生成新的、合成的書籍,從而與他們競爭,但這個論點尚未在法庭上取得勝利。
「如果你用 [Microsoft] Word 寫小說,然後運行拼寫檢查,我們覺得說 Word 並不擁有你的小說,」Gellis 說。「[AI] 迫使我們審視許多我們一直以來都忽略的決定。」
大多數 AI 公司仍然深陷於這些問題的訴訟中,這意味著我們短期內不會有這些問題的明確解決方案。
「你看到的是,最初的開局幾槍已經產生了影響,而這種影響本身可能會被其他法院做出不同決定的情況所抵銷,這需要後續的訴訟階段才能弄清楚哪一個會獲勝,」Gellis 說。「但在此期間,所有這些決定都在塑造著正在發生的一切。AI 公司如果無視它們,那將是愚蠢的。」