这两天不少网友,都在转发一则“AI公司正在全球疯狂收购旧书、绝版书、冷门书,然后对纸质原件永久销毁”的消息。“AI公司开始焚书”,成了最近网上热议的话题。有人叹息于那些老书躲过了时间、躲过了战火,但是没有躲过AI。最终在被扫描之后,成为了碎纸机器内的一堆残片。
也有人感叹于纸质书才是最好保存资料的形式,数字化资料看起来便捷,但是技术更新与黑客的小小任性,都会导致资料的永久丧失。互联网高速发展的这几十年,实则也是数据高速丢失的几十年。已经有海量的数据随着诸多网站的关闭与更新,遗失在了时间的洪流之中了。
![]()
所以群友说:看到这些内容,就想起了你很早的一期视频了。难道说当初说的那些东西,如今就是落地的时候了吗?那么这些AI公司收购旧书、绝版书、冷门书扫描后就销毁,是否就是为了信息垄断去的?
![]()
其实这个话题,确实是炒冷饭。
从AI公司的角度说,AI的数据量越大越复杂,能够提供的精确性与智能化的水平就越强。现今互联网上的数据,或公开或不公开的,各大公司早就给自己的大模型都喂完了。网络上有AI公司就表达过:截至2024年,用于训练主流大模型的公开人类知识数据,如互联网的文本、书籍、视频、语音等,都已经为AI所收录。
甚至基于此还出现了《讲过的GEO业务,很多公司开始以在网上投放错误信息的方式,去污染AI大模型。因此影响AI对用户的推荐,从中获取竞争优势。“给AI投毒”的生意,是这两年的热门灰产。
因此,一方面是网络上沉淀多年的数据已经消耗完毕,AI嗷嗷待哺需要新数据的投喂。一方面是“AI投毒”的生意越发火热,网络上的新数据真真假假筛选成本太高。甚至于就算是线下的实体书,在这几年AI的发展下,“AI生成书籍”这类的垃圾,也是越来越多。
所以新数据从哪来呢?
以前的老书、旧书、冷门书自然也就成了为数不多可以放心用的来源。所以也就出现了这次404MEDIAX报道指出的:AI公司正在批量购买2022年前出版的珍稀书籍,利用液压气割机切除书脊后加以扫描,从而获取未被AI污染的干净数据。
那么除了培养大模型之外,还有什么目的吗?
焚书这件事,对每一位有过小学教育的中国人来说都不陌生。小学课本中,将这四个字,与排除不同的思想与见解牢牢的绑定在一起。所以AI公司做这件事,必然也少不了对思想与见解的垄断。
当初在视频中,我就说过。书这个东西,其实有点像大家爱说的区块链,特别的去中心化。只要书在线下开卖了,卖给了谁,连卖家自己都不知道,也就谈不上追回。所以后续不管怎么重印,怎么删减涂改,只要第一版的书还有人保有,在做对比的时候,首印版通常都作为“原本”来认定。
但是数字化的资料这东西,在如今的AI面前,删减涂改起来就不要太简单了。大家可以看看自己的网盘,不知不觉中被删除与无法打开的资料有多少。而能删除自然就能修改,甚至于修改的悄无声息,删改的不知不觉对AI来说也就需要一根网线而已。
因此线下的资料越少,记忆就越容易修改。记忆被修改了,那么人的决策自然也就可以随意塑造。决策塑造完成,那么行为几何也就任人拿捏。所以对于AI公司来说,。
而且这个时间段,也正好是最合适做这件事的时候。太多老人在这些年集中离开,遗物都是由孩子代为处理。这生于互联网,长在短视频下的一代,对于看书这件事,大多是没什么兴趣的。因此处理其遗物来,书籍笔记是最先被丢弃的东西。如之砒霜,彼之蜜糖,一买一卖,也算是皆大欢喜,时代共同做出的决策。
![]()
至于说很多人看到这个消息,
又开始想:现在屯书,还来不来得及吗?
我想说,且不论这问题,在3年前的《就写过文章了,当时就已经晚了。在今年4月的时候,在济南我还特意去了趟旧书市场。那市场比2021年小了很多,也正规了很多。但是书的质量也下滑了很多,也新了很多。老书基本上是没有的了,翻翻捡捡,也只找到了几本以前的漫画,以及80年代的一套十万个为什么。
所以屯书这事就不要难为自己了,能保障自己现在看得下去3000字的文章,你就已经很厉害了。毕竟如今很多AI用多的人,已经不是什么“AI幻觉”了。而是在看很多文字的时候,脑子已经先于文字做出判断了。文字还没看完,脑子已经给出了答案。唯我主义的“人脑幻觉”,就在不远处等着大家。很快,人群的划分就要完成了。
祝大家顺利
关联文章:
![]()
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.