SynapseWire

AI 版權風暴:Anthropic 賠 15 億美元,Reddit 對 Perplexity 勝訴在望

一週之內兩起里程碑案件,正在重新定義誰擁有訓練 AI 模型的那些文字。

作者: SynapseWire 編輯部 發布於:
一把法槌放在一疊書本上,背景有數位二進位碼流動

AI 產業上週學到了一個教訓:訓練資料是有代價的。兩起獨立的法律進展——Anthropic 同意以 15 億美元和解版權侵權訴訟,以及曼哈頓聯邦法官允許 Reddit 對 Perplexity 的 DMCA 主張繼續進行——迫使整個產業面對一個它從第一個大型語言模型在網路上抓取資料以來就一直在迴避的問題:教會機器說話的那些文字,究竟歸誰所有?

Anthropic 的和解:15 億美元,但沒有人滿意

7 月 27 日,Anthropic 同意以 15 億美元和解一起由數十萬名作家提起的版權侵權訴訟。訴訟指控 Anthropic 未經授權使用受版權保護的書籍來訓練 Claude,並且在輸出中複製了足夠多的原始文字構成侵權。

這筆和解金是 AI 版權領域有史以來最大的賠償之一。但作家們的反應兩極。有人認為這是歷史性的勝利——證明 AI 公司可以為未經授權使用版權 material 承擔財務責任。但也有人指出,15 億美元分給數十萬名原告,每位作家大約只能拿到 3,000 美元左右。對於一位花 years 寫出一本书、結果被灌進訓練資料集並用來生成競爭內容的作家來說,這個數字與其說是正義,不如說是事後補繳的授權費。

真正有意義的不是金額,而是先例。Anthropic 沒有承認 wrongdoing,但它選擇付錢了事。這向每一家 AI 公司發出了一個信號:未經授權使用版權 material 訓練模型,真的有 financial 風險。現在的問題是,這個和解案會改變行為,還是只會變成經營成本的一部分。

Reddit 對 Perplexity:DMCA 主張存活下來

和解案四天後,曼哈頓聯邦法官允許 Reddit 對 Perplexity 和 SerpApi 的 DMCA 主張在駁回動議中存活。這意味著 Reddit 可以繼續主張 Perplexity 的網路抓取行為違反了《數位千禧年版權法》(DMCA),因為它未經授權複製了受版權保護的 Reddit 內容。

Reddit 的案子和 Anthropic 案有一個關鍵差異:它涉及的是用戶在平台上發佈的內容,不是專業作家寫的書。這引出了一個更棘手的問題:用戶生成的內容歸誰所有?AI 公司是否可以隨意抓取?

法官決定讓 DMCA 主張繼續進行,這一點值得注意,因為法院一直不太願意將版權法應用到網路抓取行為上。之前的案例,包括 LinkedIn 對 hiQ Labs 案,確立了抓取公開資料可能不違反《電腦詐騙和濫用法》。但 DMCA 是不同的法條,而 Reddit 的主張——Perplexity 在搜尋輸出中複製了受版權保護的內容——比一般的抓取主張更具體。

Reddit 的股價在消息傳出後下跌。公司報告 Q2 2026 美國日活用戶環比下降約 0.6%,高層將此歸因於搜尋引擎流量波動。但 Perplexity 訴訟的時間點暗示,Reddit 對資料授權的強硬立場可能正在與驅動其流量的平台產生摩擦。

這兩起案件對 AI 發展意味著什麼

綜合來看,這兩起案件建立了一個 AI 產業必須正視的模式。未經授權使用版權 material 訓練模型不再是零風險的賭注。Anthropic 的和解證明法院會判賠——即使 individual 作家覺得賠償不夠。Reddit 案的裁定證明 DMCA 主張可以在 early dismissal 階段存活,即使底層活動是網路抓取。

對 AI 公司來說,implications 很清楚:未經許可在網路抓取訓練資料的時代正在結束。公司需要要么明確取得訓練資料授權,要么依賴合成資料,要么投資減少對版權 material 依賴的技術。有些公司已經在行動——Anthropic 的和解包含未來授權協議的 provisions,多家 AI 公司已開始與出版商合作取得授權 training access。

對內容創作者來說,picture 更複雜。Anthropic 的和解確認了他們的作品在用於訓練 AI 模型時有價值。但 per-author 的賠償暗示 individual 創作者不太可能看到有意義的 compensation,除非 class-action settlements 大幅增加,或立法機關建立 statutory licensing 制度。

對用戶來說,downstream 效應不確定。如果 AI 公司面臨更高的 training 成本,這些成本最終會透過更高的訂閱價格或更弱的模型能力轉嫁給消費者。如果公司轉向合成資料,AI 輸出的 quality 可能會以不可預測的方式改變。

立法空白

兩起案件都沒有 address 一個根本問題:國會一直在回避的那個問題——AI 使用版權 material 訓練應該被視為合理使用(fair use),還是需要明確的授權?目前的 legal landscape 是 individual settlements 和 court rulings 的拼湊,每個都 address 特定的事實但沒有 establish broad rules。

歐盟的 AI Act 包含訓練資料透明度的 provisions,但沒有 require licensing。美國沒有 equivalent legislation。沒有 clear statutory framework,AI 產業將繼續 operating 在灰色地帶,每次 training run 都 carries litigation risk,每次 settlement 都 creates precedent 但不 creates clarity。

Anthropic 的和解和 Reddit 的裁定不是這個故事的結尾。它們是人類創造的內容在機器學習時代的價值的更長 legal 和 economic negotiation 的 beginning。這個 negotiation 的 terms 將 determine 不只是 AI 公司如何 operate,還有誰從訓練它們的知識中受益。

分享文章

留言評論

0 則評論

暫無評論,搶先發表你的看法吧!

相關文章