📰 重點摘要
台灣人工智慧領域近日再度聚焦於AI公司訓練大型語言模型時使用受著作權保護書籍所引發的法律爭議。文章指出,ChatGPT、Gemini、Claude等主流聊天機器人背後的AI模型,訓練資料庫涵蓋數億本已出版書籍、網路文章、學術論文等內容,絕大多數作者在未被告知也未同意的情況下,其作品便已被用來訓練這些可能威脅其生計的AI工具。去年法官William Alsup做出指標性判決,命令Anthropic支付高達15億美元的著作權和解金,但值得注意的是,法官實際認定Anthropic的AI訓練行為本身合法,真正遭到懲罰的是Anthropic從非法線上「影子圖書館」盜版取得書籍的行為。法官將LLM學習數兆字詞的過程比喻為作家研讀文學作品,強調AI並非為了複製或取代原作,而是要「轉個急彎、創造出不同的東西」。智財律師Cathy Gellis則認為,這項判決對AI公司而言其實較為有利,因為法官將AI訓練類比為「閱讀」而非「複製」,而著作權法的核心在於複製行為,並不涵蓋單純使用或閱讀作品本身;相對於Anthropic預估到2028年可達約2000億美元的年營收,15億美元罰款影響有限。文章也指出,現行著作權法自1976年後未曾更新,法官必須以半世紀前的舊法規來裁決攸關AI產業未來走向的新型態法律問題,而爭議核心多圍繞在「合理使用」原則,即判斷使用受著作權保護的內容是否具備足夠的「轉化性」。詳細內容請見原文連結。
💬 JudyAI Lab 觀點
臺灣AI業界近日再度熱議LLM訓練資料的著作權爭議,這場官司值得所有AI builder留意。
法官William Alsup的判決透露出微妙訊號:AI訓練行為本身被認定合法,真正遭罰的是Anthropic透過非法「影子圖書館」取得盜版書籍這件事。法官將LLM學習文字的過程類比為作家研讀文學作品,重點在於AI是否「轉個急彎、創造出不同的東西」而非單純複製。智財律師Cathy Gellis的觀點也點出關鍵:著作權法規範的是「複製」而非「閱讀」,這對AI公司其實相對有利。不過現行著作權法自1976年後未再更新,用半世紀前的舊法規處理AI新型態爭議,勢必還會有更多判例陸續出現。
對AI builder來說,這提醒我們:訓練資料的取得管道合法性,可能比訓練行為本身更容易成為法律風險點。
📅 原文資訊
- 發布時間:2026-08-23T15:00
- 來源原文:https://techcrunch.com/2026/08/23/is-it-legal-to-train-ai-models-on-copyrighted-books-its-complicated/