《当"数字化"变成"吞噬",我们是不是走偏了?》
临商珑胜 

Lv.2 潜力创作者
一本书被切脊、扫描、打浆,最后只喂出 AI 一封带货邮件——当数字化变成"吞噬",创作者的心血该谁来尊重?聊聊 AI 时代的知识与版权。
前两天看到一幅四格漫画,讲一本纸质书的"最后旅程",看完心里很不是滋味——
一、神秘买家扫货,张口就是"来一万本,品相无所谓"。书店老板举着书,怯生生问了一句:您……不翻翻看吗? 买家头也不回。
二、一万本书上了流水线:切掉书脊、高速扫描、打浆回收。一本本新旧不一、也许经历过战火和火灾的书,就这样被干脆利落地送进了机器。
三、书页化成数据,喂给 AI 大模型。它在疯狂地"读",一页不落。只有作者站在一旁,抱着自己作品的残骸(书脊)问:“书不见了,版税……呢?”无人应答。
四、最后它"学"完了买到的所有图书,产出的成果是一封——"亲,秒杀最后3件!"的带货邮件。
书被读死了。读它的不是人,是算法。
据说中文书因为便宜,批量采购的成本低,符合 大规模囤积训练的成本控制要求,且 2022 年前出版的内容"干净"(不含 AI 生成文本),作为训练数据质量更纯、更可验证,是天然的优质语料,正成为国外AI 公司被扫购的对象。
说实话,作为天天和文档、表格打交道的人,我比谁都清楚数字化的好处:检索快、不占地方、想带多少带多少。把文字搬进云端,原本就是为了让知识流动得更自由、更高效,让每一份思考都被更好地保存和共享。
可当"数字化"变成"吞噬",当"学习"变成"榨取",我忍不住想问:那些默默耕耘的作者——写小说的、编教材的、做翻译的、分享技术经验的——他们心血之作被某些国外IT公司大规模抓取、批量喂给算法模型,当成训练新一代 AI 的"饲料",自己赚得盆满钵满时,作者们知情吗?同意了吗?得到回报了吗?
我不是反对技术进步,也不反对在尊重版权的前提下用公开数据做研究。只是希望这一切能建立在知情、同意、尊重与合理回报的基础上,而不是以"优化体验""推动产业"的名义,默不作声地进行。
技术能印出书,也该记得书里住着人。愿数字化成为知识的翅膀,而不是绞索——让字里行间流淌的,不只是被汲取的养分,还有创作者的尊严与温度。
互动话题
WPS社区的朋友们,你家里的纸质书,还会一本本翻着读吗?还是已经全部"进了平板"?评论区聊聊,你那本舍不得扔的书是哪一本?
临商珑胜WPS知识库
Lv.2 潜力创作者
Lv.3 优质创作者
Lv.2 潜力创作者
Lv.1 新人创作者
Lv.2 潜力创作者
Lv.2 潜力创作者
Lv.2 潜力创作者