ISBN是在1970年发明的。你的书不在乎
在一个星期二的晚上11点左右——总是一个星期二——你将尝试对一本1642年在里昂印刷的书进行分类,软件将要求输入ISBN。不是礼貌地,而是不断地要求。一个红色边框。一个验证错误。一个小小的、像素完美的不尊重。你的书有书名页,有印刷商的标识。还有王权特许。一场法兰西的内战,两次世界大战,以及至少一个用铅笔作过注释的前任主人,这本书都熬过来了。它没有的是一个以978开头的十三位数字。这将被视为一个缺陷。 条形码的专制 戈登·福斯特,来自都柏林的三一学院的统计学家,于1965年为英国书商W.H. Smith设计了ISBN,他们当时正被文书工作淹没。这个系统——最初九位数字,从1970年开始为十位数字,2007年与EAN条形码标准合并时成为十三位数字——确实优雅。校验位使用模11算法(ISBN-10)或更简单的交替加权方案(ISBN-13)。它唯一地识别一本书籍的版本、格式和出版商。它在某个特定时刻解决了真实行业中的一个真实问题。问题在于,那个时刻是1970年,而行业是大众市场出版。ISBN是为通过国家分销商流通到市中心书店的胶印平装书设计的。它从未意图成为人类出版界的通用钥匙。尽管如此,它仍然以某种方式成为了这样的钥匙,就像临时解决方案总是变成永久基础设施一样——不是通过设计,而是通过默认。 打开任何在2005年后构建的书籍分类应用程序。ISBN字段不仅存在;它是主要字段。整个架构往往像从天花板钩子上悬挂的移动装置一样依赖于它。扫描条形码,获取元数据,填充字段。它快速、智能,并且对于大约五个世纪的西方印刷,这种工具是完全无声且失败的。 真正重要的标识符(而大多数软件忽视的) 如果你的收藏超越了ISBN时代——或者进入ISBN系统无法触及的出版任何角落——你已经在导航一个平行宇宙的参考号码,每个号码都有其自身的历史、范围和忠实用户。 ESTC(英文短题目目录)涵盖了约480,000种在1801年之前以英语或英语国家印刷的版本。如果你处理早期的英文书籍,ESTC号码不是可选的元数据——它是你的保险公司所讲的语言。“Wing S4482”或“STC 22273”将比任何ISBN更精准地定位一本书,并且所有从博德利图书馆到福尔杰图书馆的稀有书籍图书管理员都会理解它。 德国的同类目录有三个:VD16, VD17和VD18——即在德语地区出版的印刷品目录——涵盖了16世纪、17世纪和18世纪的德语书籍。仅VD16就超过了100,000条条目。VD17预计将以超过300,000条条目接近完成。这些都不是学术的好奇心;它们是德国古籍交易的基础设施。给慕尼黑的商贩报价一个VD17号码,你会被认真对待。报价ISBN,你会被温和地引导到当代小说桌子上。 USTC(通用短标题目录)旨在对1601年之前印刷的每一本欧洲书籍进行分类——目前记录超过400,000条,并持续增长。GW(早期印刷综合目录)专门覆盖早期印刷品,以德国书目学者似乎能够跨越多代所维持的那种执着精度。 还有伟大的回顾性书目:布鲁内特的《书商手册》、格拉埃斯的《珍稀和珍贵书籍的宝库》、萨宾的《与美洲有关的书籍词典》——每一部都是19世纪学术的丰碑,每一部仍然在拍卖目录中每天被引用。“Brunet III, 1247”是一个完全有效的标识符。它恰好引用一本于1864年出版的书中的一页,这对习惯使用REST API的开发人员来说,提出了一定的用户体验挑战。 OCLC号码和国会图书馆控制号码早于ISBN并仍然是,安静地,是存在的最全面的标识符。如果世界上任何研究图书馆拥有一本复本,那么这本书就会有OCLC号码。这是我们所拥有的最接近于通用书籍标识符的东西——而它,特有地,是大多数消费软件完全忽视的。 看不见的假设 问题不在于ISBN的存在。它们对其覆盖的书籍确实有用。问题在于,深深融入大多数软件中的假设,导致它变得看不见,即ISBN是标识符——主键,必不可少,没有它一本书就会以某种方式不完整。这一假设会产生后果。尝试将500本1970年前的书目导入基于ISBN查找构建的软件。看看它是如何将你的1742年小八开本与2019年的重印本自动匹配,因为它们共享一个标题字符串,而算法发现没有ISBN可以作为锚点,因此抓住了它能找到的第一个东西。看看它是如何对待你的El
本站免费、广告极少。如果觉得有帮助,可以请我们喝杯咖啡 —— 任何金额都对持续运营有实际帮助。
☕请我喝杯咖啡