用版權書籍訓練AI模型合法嗎?法律尚無定論

你或許已經知道,驅動ChatGPT、Gemini、Claude等聊天機器人的AI模型,是在海量資料庫上訓練而成的——這些資料庫收錄了數億本書籍、網路文章、學術論文,以及幾乎所有能在網際網路上找到的內容法律。絕大多數已出版的作者,在毫不知情、未經同意的情況下,為那些可能威脅到他們生計的AI工具貢獻了素材。這看起來違法,對嗎?

現實並沒有那麼簡單法律

"我認為,這一法律領域和技術領域面臨的問題之一,就是涉及的因素太多了,"專注於智慧財產權、版權和技術領域的律師凱西·蓋利斯在接受TechCrunch採訪時表示,"整件事極為複雜,各方對於正在發生的事情都有強烈的情緒反應,無論是支援還是反對法律。"

去年,在同類案件中的首批裁決之一中,法官威廉·阿爾薩普裁定Anthropic向一批作家支付高達15億美元的版權和解金,這些作家的作品曾被用於訓練該公司的AI模型法律。表面上看,這似乎是有利於作者的道義勝利,但阿爾薩普法官實際上裁定Anthropic的AI訓練行為本身是合法的。他對Anthropic的處罰,是因為該公司從非法的網路影子圖書館盜取了這些書籍。

"就像任何有志成為作家的讀者一樣,Anthropic的大語言模型訓練這些作品,並非為了搶先複製或取代它們——而是為了轉個彎,創造出不同的東西,"法官寫道,將大語言模型攝取數萬億詞彙的方式,比作作家研讀文學作品的過程法律

蓋利斯認為,這一裁決對AI公司更為有利法律。對於一家預計到2028年年收入將達約2000億美元的公司而言,15億美元的罰款算得了什麼?

"我認為,就AI訓練而言,這總體上是個好訊息——法官審視了整件事,並將其類比為閱讀受版權保護的作品,而非複製受版權保護的作品,"蓋利斯說,"版權法的核心在於複製,而不在於使用、體驗、消費或閱讀作品法律。"

版權法自1976年以來從未更新,這意味著法官在面對可能塑造AI產業未來的法律問題時,必須設法解讀50年前制定的準則法律

"現在所有人都非常擔憂,因為法律層面亂成一鍋粥,而這正是問題所在,"JWL International智慧財產權與媒體業務高階律師兼創始人傑森·亨德森在接受TechCrunch採訪時表示,"大家都知道AI模型是在海量內容上訓練出來的,但法律在這個問題上還遠未跟上法律。"

展開全文

這些問題往往取決於合理使用原則——即對受版權保護作品的使用是否具有足夠的"轉化性",從而在法律上被允許法律

合理使用是版權法中的一項例外條款,允許在未經明確授權的情況下使用受版權保護的材料,保護透過批評、戲仿、教育等方式對版權作品進行評論和演繹的權利法律。法官在判斷某一行為是否構成合理使用時,會考量特定因素,包括作品的目的與性質、使用的數量,以及對市場的影響。

"版權始終關乎保護和拓展市場,"亨德森指出,"法院在AI案件的推理上可謂各行其是法律。目前佔上風的邏輯是:如果你訓練他人的作品,是為了直接與其競爭,法院就會對此持否定態度……如果你的行為不會構成競爭,法院則傾向於認定其合法。"

亨德森所指的,是媒體與科技公司湯森路透起訴研究公司Ross Intelligence的案件——後者複製了前者的內容,用於構建一個與之競爭的AI法律平臺法律

"Ross的使用不具有轉化性,因為它與湯森路透的使用不存在'進一步的目的或不同的特徵',"法官斯蒂法諾斯·比巴斯去年寫道法律

在該案中,比巴斯法官認定,以訓練資料來構建一個直接與路透競爭的新平臺,不構成合理使用法律。儘管作者們或許可以主張,聊天機器人利用他們的作品生成新的合成書籍,實際上是在與他們競爭,但這一論點在法庭上尚未獲得支援。

在AI與版權的關係問題上,蓋利斯認為,釐清我們究竟在討論什麼至關重要——我們在AI訓練語境下對版權的理解,與我們對AI生成內容版權的理解,是截然不同的兩件事法律

在Thaler訴Perlmutter一案中,法院裁定,如果一部作品100%由AI生成,則不受版權保護法律。這又開啟了一個新的潘多拉魔盒——我們如何確切證明一部作品是否由AI生成?如果是,我們又如何判斷其中有多少比例是由AI創作或輔助完成的?

"如果你用微軟Word寫小說,並使用了拼寫檢查,我們大概都能接受這樣一個觀點:Word並不擁有你的小說,"蓋利斯說,"AI正在迫使我們重新審視一大堆我們擱置已久的問題法律。"

目前,大多數AI公司仍深陷這些問題的未決訴訟之中,這意味著我們在短期內不會看到明確的解決方案法律

"你所看到的是,最初的幾輪裁決正在產生影響,而這種影響本身也可能被推翻——如果其他法院作出不同的裁定,就需要等到後續訴訟階段才能分出勝負,"蓋利斯說,"但與此同時,所有這些裁決都在塑造著當下發生的一切法律。AI公司若對此視而不見,未免太過短視。"

Q&A

Q1:Anthropic的15億美元版權和解案法律,法院最終認定AI訓練行為合法嗎?

A:是的法律。法官威廉·阿爾薩普裁定Anthropic的AI訓練行為本身合法,將大語言模型學習文字的過程類比為作家研讀文學作品。該公司被罰款的原因,是從非法的網路影子圖書館盜取書籍,而非訓練行為本身違法。

Q2:版權法中的"合理使用"原則在AI訓練案件裡是怎麼判斷的法律

A:法院主要看AI訓練是否具有"轉化性",以及是否會直接與原作者競爭法律。在湯森路透訴Ross Intelligence案中,法院認定用路透內容訓練一個直接競爭的法律平臺不構成合理使用;但如果訓練目的不是直接競爭,法院則傾向於認定合法。目前各法院的裁量標準尚不統一。

Q3:100%由AI生成的內容可以申請版權保護嗎法律

A:目前不可以法律。在Thaler訴Perlmutter案中,法院裁定完全由AI生成的作品不受版權保護。但這也引發了新的難題:如何界定一部作品中AI參與的比例,以及如何證明某內容是否由AI生成,目前法律上都還沒有明確答案。

本站內容來自使用者投稿,如果侵犯了您的權利,請與我們聯絡刪除。聯絡郵箱:835971066@qq.com

本文連結://jnhjhw.com/post/72082.html

🌐 /