大脑充血 Vol.98

大脑充血 Vol.98

💡 原文中文,约5600字,阅读约需14分钟。
📝

内容提要

《大脑充血》小报讨论了三件事:Remove Your Media公司利用关键词匹配滥发版权警告,误伤BleachBit及动漫反应视频频道,甚至导致频道被删;Weird Gloop发现新维基域名难以被谷歌收录,疑似遭到“谷歌监狱”隐形打压;Hugo项目自1.151.0版本起包含大模型生成代码,引发版权争议,有人Fork出无LLM版本Hugo Unslopped。作者批评大公司道德缺失,呼吁以商业方式抵制。

🔎

延伸解读

关键词匹配滥发警告的连锁伤害

Remove Your Media 利用粗糙的关键词匹配系统,将 BleachBit 等无关名称和大量动漫反应视频频道误判为侵权。这种自动化流程不仅导致视频被删,还可能让频道在七天内被整体移除。对依赖平台收入的创作者而言,申诉渠道有限,恢复过程漫长,凸显出版权执法工具缺乏人工复核时对普通用户的巨大风险。

独立维基的搜索可见性困境

Weird Gloop 发现新维基域名难以被谷歌收录,因此放弃独立 .wiki 顶级域名,转用子域。文章将这种现象称为“谷歌监狱”,指出垄断搜索引擎可以在不透明的情况下让一类网站隐形。对依赖自然流量的独立项目来说,这意味着即使内容优质,也可能因平台规则而失去被发现的机会。

Hugo 引入 LLM 代码的版权争议

Hugo 自 v1.151.0 起包含大模型生成代码,引发版权状态不明的担忧。文章认为,LLM 输出揉合了未经授权爬取的训练数据,贡献者可能无权以 BSD-3-Clause 等开源协议授权这部分代码。因此有人 Fork 出无 LLM 版本的 Hugo Unslopped,为在意版权问题的用户提供替代选择。

商业抵制与个人选择

面对大公司的道德缺失,作者不主张道德呼吁,而建议用商业方式抵制:注销谷歌账号、改用 Kagi 或 Brave Search 等竞品、减少依赖谷歌服务。同时,对于必须使用 AI 工具谋生的程序员,文章承认现实压力,但强调开源项目应要求披露 AI 辅助并确保贡献者理解代码,以降低版权风险。

Q&A

Remove Your Media 公司是如何误伤 BleachBit 和动漫反应视频频道的?

Remove Your Media LLC 使用关键词匹配系统滥发版权警告,将磁盘清理工具 BleachBit 误判为侵犯动漫《BLEACH》版权,并导致大量动漫反应视频频道收到上百条警告,甚至频道被 YouTube 自动版权系统计划删除。

Weird Gloop 为什么放弃使用独立的 .wiki 域名?

Weird Gloop 发现新注册的 .wiki 顶级域名很难甚至几乎不会被 Google 收录,他们怀疑 Google 对独立维基实施了“Google Jail”(谷歌监狱),因此改为使用 weirdgloop.org 的子域名。

Hugo 项目从哪个版本开始包含大模型生成的代码?引发了什么争议?

Hugo 从 v1.151.0 版本开始包含 Claude 等大模型生成的代码,主要维护者 bep 也在使用。这引发了版权争议,因为 LLM 训练数据可能侵犯版权,且生成的代码版权状态不明,无法以开源协议授权。

Hugo Unslopped 是什么?它和原版 Hugo 有什么区别?

Hugo Unslopped 是 ch0ccyra1n 基于 Hugo 最后一个没有 LLM 代码的版本(v1.151.0 之前)Fork 出的项目,移除了所有大模型生成的代码,适合不依赖新特性且不想使用 LLM 代码的用户。

作者认为应该如何对抗大公司的道德缺失?

作者认为用道德和情理要求大公司没用,必须用商业方式对抗:注销谷歌账号、不再使用谷歌搜索、给竞争对手(如 Kagi、Brave Search)付钱、停止依赖各种谷歌服务,即使反抗激不起波澜,也能让自己远离低质量闭源软件。

开源项目对 LLM 生成代码应该采取什么政策?

开源项目应要求贡献者披露 AI 协助,并声明已审查理解代码、做出足够修改或创意决策、不复制受版权保护的材料。纯 AI 生成的 PR 因版权状态不确定不能被接受,也不应发送 LLM 写的“slop” issue。

🏷️

标签

➡️

继续阅读