这是什么
GitHub 用户 jbiaojerry 的一个仓库,把帆书、微信读书、京东读书、喜马拉雅等付费平台的电子书下载链接,用自动化脚本抓取整理后开源共享。仓库宣称收录超过 24,000 本书、1,000 个分类,提供 EPUB、MOBI、AZW3 三种格式,并配了在线搜索页面。
关键不是"开源"这件事本身,而是规模——人工整理两万四千本书要近七年,自动化把它压缩到了可管理的时间。这是典型的"程序采集 + 人工校对 + 在线展示"模式。
行业怎么看
支持者会说这是开源精神的纯粹体现:好知识不应被锁在高墙后面,一个人、一个想法、足够耐心,做成了所有人都能用的数字图书馆。这种"分享即价值"的姿态,和早期 Linux 社区对抗专有软件是同一种气质。
但反对意见必须说:
- 所谓"来源可靠、不是盗版"是误导——书来自主流平台,不代表重新分发是合法的。帆书、微信读书靠会员和版权授权变现,免费下载直接冲击它们的收入模型。
- 这类仓库随时可能因 DMCA 或下架通知消失。原文作者承认"慷慨可能不会永远持续",却仍鼓励读者"趁早保存"——这是很轻巧的风险转嫁。
- 对 AI 从业者来说:这件事和训练数据版权是同一类问题。如果你不认同未经授权抓取语料训练模型,那对未经授权抓取电子书分发也应保持同样的标准。自动化不改变事情性质。
对普通人的影响
对企业 IT:如果内部文档、培训资料能被脚本批量抓取并整理开源,访问控制和数据防泄漏就需要重新评估——这不只是 C 端用户的事。
对个人职场:对想多读书的人是诱惑,但要清醒。支持作者和平台的内容策展能力是一种长期投资,免费午餐吃多了,优质内容可能越来越少。
对消费市场:此类仓库若规模化扩散,会逼迫知识付费平台证明自己的价值,否则面临用户流失;但版权方主动出击也能让它快速消亡。这是一个仍在拉扯的中间态。