即便如此,如果你發布了由 AI 生成的程式碼(無論你投入多少額外的心力),你仍然面臨風險,即該程式碼可能與其他現有作品實質相似,達到原作者可以合理認為其權益受損並提起訴訟的程度。(顯然,同樣的情況也可能發生在你個人從零開始編寫的程式碼上。)對於純粹由人類編寫的程式碼,常見的辯護是聲稱你(作者)從未實際見過該作品,因此任何相似之處都必須是巧合(你可能根據某人看過該作品的抽象規格進行開發,即「淨室工程」,但這通常被認為是可以接受的)。在你的特定情況下,這種辯護是否有效,誰也無法預料,但如果你的部分作品是由一個可能在網路上所有可見原始碼上訓練出來的 LLM 生成,而沒有人確切知道其中包含了什麼,那麼這種論點就難以成立。

不,並非如此。沒有人考慮過這一點。你應該更清楚,自由軟體的原則在其網站上寫得清清楚楚。其核心是保護使用者免受開發者集中權力並鎖定系統的侵害。

在我看來,這毫無被接受的機會。我想知道提交者的意圖是什麼(我無法閱讀該部落格文章,主機已關閉),他是否真的認為 OpenBSD 社群會接受這樣的核心補丁?如何在不理解的情況下提交核心驅動程式?

我不認為有人在乎 Claude 的說法。我當然不在乎。法律已經確立;僱傭勞動。

實際上,這極有可能。OpenAI 自己就大聲疾呼,告訴我們 Deepseek 在其模型上訓練時「竊取了他們的知識產權」,但它如何保護自己不被數百萬網路公開作品的作者剽竊,同時又聲稱 Deepseek 不能做它所做的事情?

如果將大量數據轉換為 LLM 不需要許可,因為 LLM 的輸出不是「衍生作品」,那麼 OpenAI 如何聲稱 Deepseek 侵犯了任何權利……而如果這種轉換留下了足夠的原始作品痕跡,可以在法庭上被視為侵犯知識產權,那麼你如何確定你的 ext4 實施不會以同樣的方式侵犯他人的權利?

我們完全不知道這一切會走向何方……我們只知道這將會非常、非常、非常醜陋。

你可以持有這種信念,但這絕非「顯而易見」,所以請不要這樣聲稱。至少有一種可信的替代立場(順帶一提,在歐盟法律中已明確規定)是,將作品作為訓練數據集的一部分使用,與讓人從中學習大致相同——也就是說,它不一定會產生衍生作品。Linux 原始碼檔案確實被閱讀了。

Linux 原始碼檔案確實被閱讀了。

Linux 原始碼檔案確實被閱讀了。

Linux 原始碼檔案確實被閱讀了。

所以動機是授權,圍繞它的討論也是授權,但它不是授權。明白了。> 該說法是錯誤的,因為該驅動程式是使用 AI 模型建構的,而這些模型部分是基於 Linux 原始碼檔案建構的。這是對這些事物運作方式的嚴重且疏忽的歪曲。也就是說:這是錯誤的。Linux 原始碼檔案確實被閱讀了。

我說動機「可能」是授權,以留下這種可能性。我沒有說動機是授權,也不會這麼說,因為我沒有看到提交者說過他的動機是什麼。你又在讀不存在的東西了。

沒有圍繞它的討論。之後有討論,由於時間的運作方式,稍後發生的事情不能是先前事件的原因。

我能否建議你不要試圖使用諸如嚴重疏忽之類的術語,如果你不知道如何使用它們或它們的含義?因為這是一個指控,如果屬實,應該在其他地方提出,而我會在其他地方為自己辯護。