一项新法案希望揭示AI训练数据的真实内容

一项新法案希望揭示AI训练数据的真实内容

💡 原文英文,约400词,阅读约需2分钟。
📝

内容提要

美国国会议员Adam Schiff提出《生成AI版权披露法案》,要求科技公司披露用于训练AI模型的受版权保护的材料。法案要求提交数据集内容摘要和URL,并适用于数据集的任何更改。公司需在发布AI模型前提交报告,得到行业团体支持。

🔎

延伸解读

法案的追溯力与行业影响

该法案不追溯适用于现有AI平台,除非其训练数据集在法案生效后发生更改。这意味着已发布的AI模型可能无需立即披露训练数据,但未来任何数据集更新都将触发披露义务。这种设计可能促使公司在更新数据集时更加谨慎,同时也为现有平台提供了缓冲期。

披露要求的具体内容

法案要求提交数据集的详细版权材料摘要和公开数据集的URL,并适用于数据集的任何更改。公司需在发布AI模型前30天提交报告。这些要求旨在提高透明度,但具体执行细节如摘要的详细程度、URL的有效性等可能成为争议点。

支持与反对的声音

法案获得了WGA、RIAA、DGA、SAG-AFTRA和Authors Guild等行业团体的支持,但缺少电影协会(MPA)的支持。MPA通常支持保护版权的举措,其缺席可能暗示对法案具体条款的保留。这反映了行业内部对AI版权问题的不同立场和利益考量。

❓

Q&A

《生成AI版权披露法案》的主要内容是什么?

该法案要求科技公司披露用于训练AI模型的受版权保护材料,包括数据集内容摘要和URL。

公司在发布AI模型前需要做什么?

公司需在发布AI模型前30天提交报告,详细说明数据集中的版权材料。

该法案是否适用于现有的AI平台?

该法案不适用于现有AI平台,除非其训练数据集在法案生效后发生更改。

为什么会提出《生成AI版权披露法案》?

法案回应了艺术家和创作者对AI模型未经许可使用版权材料的担忧。

哪些行业团体支持该法案?

该法案获得了作家协会、录音工业协会等多个行业团体的支持,但缺少电影协会的支持。

AI模型开发者如何看待版权材料的使用?

开发者声称其模型训练于公开数据,但难以具体识别哪些数据受版权保护。

🏷️

标签

➡️

继续阅读