文章摘要
大学期间在图书馆整理书籍的经历,让我通过随机翻阅每本书的一页,偶然接触到许多有趣内容,如希腊神秘宗教等。这让我意识到,高质量的非虚构书籍能带来深度思考,与当下泛滥的AI生成内容形成鲜明对比。
文章总结
大学第一年,我在图书馆勤工俭学,负责整理A到F类书架,主要涉及宗教、哲学、社会学和历史类书籍。这份看似枯燥的工作却成了我最重要的知识体验之一。为了打发无聊,我每整理一本书就随机翻看一页,读一个句子。有时会因遇到匈牙利古典音乐评论家或玻利维亚农业统计学家等冷门内容而停下,但有时也会被《亨利·亚当斯的教育》或《衣服现代吗?》这类书深深吸引,一口气读上好几页才依依不舍地放回原处。我还会接着翻阅旁边书架上的书。
回想起来,我从这份工作中学到的东西比任何正式课程都多,因为它是一种经过筛选的自学方式。国会图书馆分类系统和专业馆员已经对这些文本进行了筛选和整理,加上这些书曾被借阅过,意味着它们拥有持久的读者群。因此,我看到的并非完全随机的书籍样本,而是经过精心组织、有趣且高质量的书籍。
如今,大学生找资料时总是用谷歌搜索,结果远不如过去在图书馆书架上随意浏览来得有效。但说实话,研究图书馆也已今非昔比。我41岁,感觉自己见证了图书馆的鼎盛与衰落。过去可供浏览的开放式书架正被学习实验室、数字创新中心和社交餐饮区取代,那些奇妙的老书也正被电子版替代。
不过,有一件事始终如一地好——那就是非虚构类书籍本身。尽管在AI聊天机器人和播客的冲击下,非虚构类书籍的读者数量在下降,但我认为我们正经历着这一形式的黄金时代,却鲜有人认识到这一点。
因此,今年夏天我花时间创建了一个免费平台,用于搜索高质量非虚构类书籍的“长尾”。质量难以定义,但根据我的经验,获得主要非虚构类奖项或入围名单的书籍通常都非常出色,所以我以此为标准。我统计了英语世界所有主要的非虚构类奖项,然后利用AI工具收集了历届入围者和获奖者名单,整理成一个可搜索、可排序的列表。你可以访问这个网站,它完全免费,我自掏腰包支付托管和API费用,只希望人们能找到并阅读更多优秀的非虚构类书籍。
这个平台除了收集数据和编码的工具外,与AI无关。关键在于语义搜索,这是目前所有AI工具中最吸引我的,因为它直接改进了研究人员已有的工作流程和习惯,让文本搜索更有效。例如,你可以搜索“现代法国”或“社会史”这样的简单短语,也可以搜索“出奇古怪的经典传记”,嵌入模型会从约6500个标题中筛选出相关结果。有时搜索结果令人困惑,但这正是我喜欢它的原因——它旨在重现我在图书馆整理书籍时那种在精心打理的花园中漫步的随机感。
我发现它最适合寻找“类似书籍”。比如,我读了斯蒂芬·茨威格关于战前维也纳的回忆录《昨日的世界》后,用语义搜索寻找类似书籍,立即得到了一些看起来很有希望但我从未听说过的书名。收集完所有书籍数据后,我还制作了一些数据可视化图表,包括按颜色排列的约5000本书的展示,以及按出版社在非虚构类奖项中的表现排名的图表。
这让我思考非虚构类书籍作为文化力量的过去和未来。例如,我惊讶地发现,即使是著名的普利策非虚构类奖也是1962年才设立的。在70年代、80年代和90年代,奖项数量不断增加,直到2014年达到顶峰,然后在2020年可能开始缓慢下降。但也许并非如此。最让我印象深刻的是,过去几十年非虚构类书籍的“长尾”质量始终如一地好。你可以从这个列表中随机挑选一本书,结果往往是一本非凡而原创的作品——不是因为它是被遗忘的宝藏,而是因为这些书因受到赞誉而上榜。但一本在90年代初获得报纸和文学界广泛赞誉的书,比如大卫·莱弗里恩·刘易斯关于W.E.B.杜波依斯的传记,如今在亚马逊上可能排名百万开外,却仍在榜单前十,因为它出版时赢得了至少四个主要奖项。你可以花大约4美元买到二手书,而且它确实很棒。
在写这篇文章时,我对非虚构类书籍的黄金时代何时开始以及为何开始产生了兴趣。我怀疑这与老式开放式研究图书馆的兴起有很大关系。战后时期,图书馆和档案馆产生新知识的方式发生了根本性转变,原因包括:喷气式飞机让作家和研究人员能前往多个大陆进行研究;阶级、种族和性别限制的消除使稀有图书馆等精英空间更易进入,也开启了新的研究线索;国会图书馆分类系统和MARC标准等早期数字技术使书籍分类和事实核查更加容易;广播新闻、电视访谈节目和书籍改编电影为作者创造了新的激励和平台;文字处理器和早期计算机可能也改变了非虚构类写作的质量。我个人主观认为,非虚构类写作质量在整个20世纪显著提高,可能在80年代到21世纪初达到顶峰。至于现在是否在下降,这是另一个话题,但我很想知道读者的看法。
评论总结
以下是对评论内容的总结,涵盖主要观点、论据及不同立场,并保留关键引用:
1. 对图书奖项作为质量信号的质疑
- 观点:图书奖项并非可靠的质量指标,存在出版商批量提交、评审不严谨等问题。
- 论据:NCR图书奖曾爆出评委未读书的丑闻;PROSE奖项规模过大,获奖含金量被高估。
- 关键引用:
- "which books get an award can either be completely arbitrary, or comically easy." (northhex)
- "The PROSE award is so comically large that an ordinary category finalist or win is usually overstated in prestige and value." (northhex)
2. 对项目使用AI的批评与辩护
- 批评:项目声称反对AI“垃圾内容”,却用AI构建网站,存在矛盾;AI生成内容缺乏真诚与高标准。
- 辩护:AI作为工具可降低编程门槛,帮助非程序员创建实用软件;AI用于语义搜索等合理用途不应被全盘否定。
- 关键引用:
- "Decries AI for producing slop. Uses AI to produce website." (wackget)
- "It’s okay to simultaneously preach the superiority of award winning books over AI-generated garbage while also acknowledging the same AI as a valuable tool." (paxys)
3. 图书馆与阅读体验的变迁
- 观点:图书馆从知识发现场所变为数字设备使用空间;实体书获取困难,传统阅读体验流失。
- 论据:学生坐在书架间却用ChatGPT;图书馆缩减实体书空间以增加电脑;经典书籍难以借阅。
- 关键引用:
- "The library has become just a place to sit and open an LLM." (adamddev1)
- "Primary knowledge is being lost, churned crude will forever lubricate the delusions..." (zahirbmirza)
4. 对项目实用性的肯定与改进建议
- 观点:项目能帮助发现好书,尤其对非虚构读者有价值;但存在搜索bug和评分机制不透明问题。
- 论据:通过奖项筛选可找到高质量书籍;建议增加更多奖项来源;过滤功能需修复。
- 关键引用:
- "This motivates me to start setting aside 'reading time' again every day." (titanomachy)
- "I am curious what the 'score' for each book means. Is it calculated by giving each award a certain weight?" (why_at)
5. 人类写作与AI写作的对比
- 观点:人类书籍也存在“垃圾内容”(如注水、观点重复);AI写作在散文质量上明显不足。
- 论据:许多书籍将核心观点拉伸成书;AI写作带有“AI腔”,难以写出高质量散文。
- 关键引用:
- "human slop in literature is a real thing... almost every book try to stretch core idea into book size format." (maxdo)
- "I find LLMs are astoundingly bad at writing good prose... the work of a good copywriter has never been more noticeable." (adamtaylor_13)
6. 对项目标题与内容的讽刺
- 观点:标题“Quality over Slop”是同义反复;部分书籍标题有“标题党”倾向。
- 关键引用:
- "The title is tautological. Quality is the opposite of slop, AI or not." (diego_sandoval)
- "the titles of top books from History, Nature, and Politics sound very click-baiting." (anvuong)
总结
评论呈现两极分化:一方面肯定项目在发现好书方面的实用价值,另一方面质疑其依赖AI的立场矛盾、奖项可靠性及书籍质量。用户对图书馆衰落、人类写作与AI写作的优劣也有深入讨论。