









这是一篇小报,不遵循一般的格式,一般不谈严肃内容,甚至可能全是技术内容。不过这篇…… 实际上还挺严肃的。写着写着就变成了对谷歌和各种大公司的嘲讽,不过并不是批评和要求,因为我对他们的道德水准实际上毫无期待。
这篇小报从版权聊到垄断,再谈到版权,希望能让读者对曾经忽视过的问题有些思考,如果你有相关的见解,也欢迎 发邮件 讨论。
一家叫作 Remove Your Media LLC ,CEO 名叫 Eric Green 的公司开始在 YouTube 和各种网站上给人发律师函,准确来说是停终信(cease and desist)。他们似乎代理了很多日本动漫厂商,因为他们发停终的对象往往是关于火影忍者、BLEACH 和一拳超人的内容。
然后磁盘清理工具 BleachBit 收到了停终信。
?
需要解释的是,Bleach 的意思是清洁、漂白,是个非常常见的英语单词,而动漫 BLEACH 只是用了这个单词而已。BleachBit 作为磁盘清理工具的意思可以理解为「清洁比特」。
这家公司用的不知道是什么诡异的关键词匹配系统,YouTube 上反应视频(Reaction Video)这个生态的平台基本都遭殃了。反应视频就是 YouTuber 打开摄像头和麦克风录制自己看某个内容的反应的一类视频。我在之前 一篇文章 提到弹幕的时候,有读者指出 YouTube 的反应视频内容也覆盖了人们「看到其他人的情绪反应」的需求,反应视频和中文视频平台上的弹幕是类似的。这些看日漫和讨论日漫的频道有的收到了上百条版权警告,不仅视频被删了,甚至频道都被 YouTube 的自动版权系统计划删除。也就是说,他们某天早上醒来发现自己的平台多了好多条版权警告,然后被告知七天后他们赖以生存的频道就要没了。
离谱的是,被警告的内容并不一定包含动漫画面,有的只是图片、同人作品,甚至都没有画面,只是 YouTuber 拿着麦克风对着镜头讲自己对某部动漫的看法,或者发了个投票问观众接下来想看什么动漫的视频。他们被警告仅仅是因为标题里包含某个关键词,就像 BleachBit 被告抄袭 BLEACH 动漫一样离谱。
还有好笑的,这家公司的地址,一是家沃玛特超市的停车场。
一个叫 Nicholas Light TV 的频道收到警告后做了个视频指出他们的版权警告不合理,一段时间后就又收到了 Remove Your Media 的邮件。邮件的内容是指责 Nicholas 骚扰他们公司,因为他给他们打电话、在 YouTube 上反驳版权警告(counter-notification)还发骚扰邮件。这家公司在邮件中的用词非常强硬,甚至让人怀疑根本不是个律师写的。更好笑的是,Nicholas 本人并没有发这封邮件,非常有可能是一个看了视频的粉丝写的,他们就这么认定了是 Nicholas 在骚扰他们。
另外,对公司可没有骚扰这种说法:
Harassment covers a wide range of behaviors of an offensive nature. It is commonly understood as behavior that demeans, humiliates, and intimidates a person. In the legal sense, these are behaviors that are disturbing, upsetting, or threatening to a person.
详情可以看 Nicholas 的 视频 ,他最近已经无心干正事,好不容易救回了频道,还一直发 Remove Your Media 相关的视频。
或许是我有些太疾世愤俗了,看到 Nicholas 要求 YouTube 回信,指责 YouTube 竟然容许有人滥用版权系统的时候,我的想法是我完全不意外谷歌会干这种事情,我也觉得用道德和情理要求大公司有点可笑。可对普通人而言,他们有什么别的选择吗?他们又没有别的地方去做视频赚钱。
说完 YouTube 来看 Google 本身。给包括 Minecraft、Balatro 和 GTA 在内的游戏维基提供服务器等基础设施,帮助他们脱离 Fandom 等不自由的商业平台的
Weird Gloop
没有给新增的守望先锋和堡垒之夜维基用独立的 .wiki 顶级域名,而是用了 weirdgloop.org 的子域,因为他们发现这些新域名很难(甚至说几乎不会)被 Google 收录。他们怀疑 Google 给独立维基做了
Google Jail
,谷歌监狱。
目前没有人知道 Google 到底干了什么,这个垄断搜索引擎生态的怪物完全可以在用户不知情的情况下用没人知道具体是什么的手段让一类网站隐形。
我还是坚持我的观点,用道德和清理要求大公司是没用的,必须用商业的方式对抗:注销谷歌账号,不再使用谷歌搜索,给他们的竞争对手付钱(比如 Kagi、Brave Search),停止依赖各种谷歌服务。就算这种反抗激不起太多波澜,至少也能让自己远离低质量的闭源软件。
说到低质量的闭源软件,有什么闭源软件比一般的闭源软件更像黑盒、更容易出错、更具不确定性、更耗能、更烧钱但又有更多的人吹捧和追逐?
答案是大语言模型。
我对人们在企业中里大量使用 LLM 毫不意外,并且也不觉得可以要求他们继续手写代码,因为企业里上班的大部分程序员都只是把开发当成工作,大部分都不是对技术抱有热情、好奇心和反思的黑客。去年的我还有些 不成熟的想法 ,把「程序员」当作密不可分的整体。现在我不这么想了。
听同事某段时间还坚持“古法编程”然后被骂傻逼了
感觉程序员可以粗略地分为几个物种:
- 只把编程当作工作的程序员
- 开源软件派
- 自由软件派
- 对技术抱有极大热情和反思的黑客
- 热爱写代码本身的程序员
- 热爱创造软件的程序员(不在乎是自己写还是别的什么东西写的)
物种之间可能有重叠,但第一类基本不会和其他类重叠,于是就会有人把“古法编程”当傻逼。
这么看的话这个行业其实挺难待下去的,对我而言,除非把工作和生活分得特别开。
—— 发自我的联邦宇宙账号
就像我在《 第一个人 》书评中反思了自己的傲慢一样,我憎恶加缪那个老是打他骂他的外婆,可我有资格批评她吗?我没过过她那样贫困无助的生活。同样地,我能用我对技术的思考(哪怕合乎逻辑)去要求那些对技术并无热爱,写一辈子烂代码但也只是为了谋生而已的人吗?他们似乎只是在适应行业变化而已,他们哪有时间和精力思考 LLM 这项技术本身是否道德?可他们不关心建起的一座又一座数据中心让天然气燃烧量飙升、用水量飙升、让某些地区的电费暴涨、让 GPU 和算力变成快速消耗的稀缺资源,让人们的思维变得模糊,让人们不再在意训练数据背后被剽窃、授权协议被洗掉的创作者们。这难道又不是恶了吗?就像打压儿童,险些让他上不了学、接受不了教育的那个外婆,就不可恶了吗?
扯远了,其实我只是想推荐
Hugo Unslopped
这个项目。我在
Open Slopware
这个名录上看到了 Hugo(顺带一提,这个名录确实有些激进,图像识别模型也被他们当作 LLM 一样的 “AI” 技术来反对,又一个滥用 “AI” 一词的后果出现了),深究起来才发现,在 v1.151.0 之后的版本,Hugo 就包含了 Claude 等大模型生成的代码,主要维护者 bep 本人也在用。尽管他对 LLM 的质量也不看好,觉得除了解决一些微妙的小 Bug 之外 LLM 依旧很烂,但它忽视了或者说根本没有意识到 LLM 带来的版权问题。LLM 生成的任何内容都是从科技公司用不尊重 robots.txt、不顾网站死活的爬虫那里爬到的训练数据里揉碎后组合而成的,更别提代码本身还有开源协议,现在人人都可以不计后果地违反开源协议使用所有开源项目的代码,人们好像完全不关心这个问题。
即便要“接纳 AI”,我也认为开源项目至少要有这种政策才行:
Contributions must disclose AI assistance, e.g. “Created with help by Claude Opus 4.5”.
By submitting such a contribution, you represent that:
- You have reviewed and understood the code you are submitting.
- You have made sufficient modifications or creative decisions such that you can offer the contribution under the BSD-3-Clause license.
- To your knowledge, the contribution does not reproduce copyrighted material from other projects.
Here are a few examples for illustration:
- A purely AI-generated pull request (“vibe-coded”) cannot be accepted, because the copyright status of such output is uncertain and you may not be able to license it under BSD-3-Clause.
- It is considered impolite to send an LLM’s writing (posting “slop” issues). We want to hear your own voice and see that you have spent enough thoughts and time to write us a message.
- It can be very effective to ask a coding assistant to confirm and explain a bug, but then verify correctness of the generated explanation by implementing and testing your own solution. This process saves you time for the mechanical steps, but ensures you understood the problem and solution.
—— gokrazy
简单来说,就是要做出足够的修改之后才能提交,纯 LLM 生成的东西不被接受,因为版权状态未知,贡献者无权以 BSD-3-Clause 协议(以及基本上所有开源协议)授权这部分代码。LLM 生成的代码最大的问题并非幻觉和质量问题(这些都好解决),成本也有下降的趋势,唯一几乎不能解决的就是版权问题。或许也是这个问题基本无法解决,所以基本上所有的 LLM 公司都在一边派出能把小网站都打趴下的爬虫贪婪地获取训练数据,一边当鸵鸟假装这不是个问题。
至于企业,我对他们的道德水准毫无期待,所以没有任何要求,我最多鄙视那些为了给自己简历添光加彩就用 LLM 生成的垃圾 Issues 和 PR 淹没开源项目仓库的人。很遗憾的是,对于大部分要在这个行业生存的程序员,学会使用 Agent 等工具几乎是必备技能。除非想换口饭吃,否则几乎不得不用了。我不知道还能期待什么,我对不仅对 “AI” 热潮感到厌恶,对软件行业也感到厌倦了,即便我还仅仅是半只脚刚踏进去而已。
写着写着又跑题了,总之
ch0ccyra1n
Fork 了 Hugo 最后一个没有 LLM 代码的版本,开发了
Hugo Unslopped
。由于人不多,所以她之前几乎三个月没有更新了,我去某个欢迎贡献的 Issue 下问了问,提了个
PR
,她也在这周补上了一些工作发布了
新版本
。如果你不依赖 Hugo 1.51.0 之后的新特性,也不用 hugo deploy 这个刚被我移除的命令(谁要帮忙一键部署到 AWS 和 Google Cloud 上啊!),完全可以换成 Hugo Unslopped。
如果你也是 Go 程序员,我也建议你去找找 Issues 里标记为 contribution welcome 的条目。维护者貌似挺忙的,再小的帮忙都能推动这个项目。另外我也挺想改个名字的,维护者也在考虑,可以去这个 Issue 下面提一提对新名字的想法和建议。
此内容由惯性聚合(RSS阅读器)自动聚合整理,仅供阅读参考。 原文来自 — 版权归原作者所有。