微软称几乎无人通过其聊天机器人获取《纽约时报》文章

微软称几乎无人通过其聊天机器人获取《纽约时报》文章

💡 原文英文,约900词,阅读约需3分钟。
📝

内容提要

微软在版权诉讼中辩称,其AI助手Copilot极少复制新闻或书籍内容。在820万条聊天记录中,仅不到1%包含至少16个匹配词,与《纽约时报》等出版商作品有实质重叠的案例极少。微软以此主张AI训练使用版权内容属合理使用,因系统用途具变革性。案件已合并审理,微软正寻求简易判决。

🔎

延伸解读

数据解读:低比例不等于零风险

微软公布的数据显示,在820万条聊天记录中,仅不到1%包含至少16个匹配词,且实质性重叠案例极少。但这一比例虽低,绝对数量仍达数万条,可能构成侵权。法院在判断合理使用时,不仅看比例,还会考虑使用目的、性质、数量及对原作品市场的影响。因此,低比例并不能完全消除法律风险。

合理使用之争:变革性用途是关键

微软主张,AI训练属于变革性使用,即使复制了部分内容,也不影响其合理使用性质。但法院需权衡复制行为是否替代原作品。若AI输出与原文高度相似,可能损害出版商利益。此案结果将影响AI公司使用版权材料的边界,对内容创作者和科技行业均有深远影响。

案件合并与简易判决:策略与风险

微软寻求简易判决,意在早期终结诉讼,避免高昂的诉讼成本。案件合并审理虽提高效率,但可能使不同原告的诉求相互影响。若法院驳回微软动议,案件将进入全面审理,届时证据和专家证词将更充分,结果更难预料。微软此举是高风险高回报的策略。

Q&A

微软在版权诉讼中如何证明其AI助手Copilot没有大量复制新闻内容?

微软在诉讼中提供了820万条Copilot聊天记录,这些记录被特别筛选为最可能包含新闻出版商作品的关键词。分析显示,其中只有59,545条(不到1%)包含至少16个与新闻内容相同的词,而实质性重叠的案例极少。例如,调查报道中心的专家仅发现51例与CIR作品的实质性重叠,作者诉讼中的专家发现只有24条回复包含至少30个匹配词。

微软主张AI训练使用版权内容属于合理使用的理由是什么?

微软认为,虽然像Copilot这样的系统依赖版权材料进行训练,但最终系统的用途与原始作品有显著不同,具有变革性。因此,即使偶尔复制文本片段,也不足以削弱LLM训练的变革性目的,这符合合理使用的原则。

《纽约时报》等出版商起诉微软和OpenAI的核心指控是什么?

出版商和作者指控微软和OpenAI在未经授权的情况下使用其作品构建AI产品,这些产品现在通过复制受版权保护的内容与他们直接竞争。

微软和OpenAI的版权诉讼案件目前处于什么阶段?

新闻出版商和书籍作者的诉讼已合并由一位法官审理,微软已提交文件寻求简易判决,希望尽早结束案件。如果法官不支持微软,案件将继续在法庭审理。

在820万条聊天记录中,有多少条包含至少16个与新闻内容相同的词?

根据微软提供的分析,820万条聊天记录中有59,545条包含至少16个与新闻内容相同的词,占比不到1%。

特朗普政府在此案中采取了什么立场?

特朗普政府在本周向《纽约时报》案件提交了利益声明,支持OpenAI。

🏷️

标签

➡️

继续阅读