三亩地 三亩地SAN MU DI · CODE DIARY
ARTICLE DETAIL

日记详情

真实记录编程学习的某一天,欢迎挑你感兴趣的翻一翻。

一人的图书馆怎么录?拍PDF版权页批量出Excel,图书信息再也不用手抄

一人的图书馆怎么录?拍PDF版权页批量出Excel,图书信息再也不用手抄

全校的图书,只有你一个人管

校长说这批新书三天内录完上架,可全校图书馆就你一个管理员。借还登记、书架整理、破损修补、应付上级检查——桩桩件件都是你一个人。翻开版权页,书名、作者、出版社、ISBN、中图分类号,逐行手抄到登记本上。字号小得跟蚂蚁似的,凑近了瞪着眼看,一本书录完脖子僵了、手腕酸了。一天拼尽全力录了不到三十本,桌上还剩一百七十多本压着没动。

更让你崩溃的是社区书屋收到的那批捐赠书——版权页泛黄破损,字迹模糊得像是被水泡过,认一条 ISBN 全靠连蒙带猜做填空题。你不是没努力,是手抄这件事的天花板就摆在那里。两百本书,一双手,三天时限。这个不等式从一开始就不成立。

不需要技术,不需要助手,拖进去就行

文档工作台做的事,就是把"翻版权页、手抄登记"这一步,从几天压到一个下午。

不需要学任何技术,不需要有帮手。手机对着版权页拍一张,保存成 PDF,回到电脑前全部框选拖进去。

然后告诉它你要提取什么:书名、作者、出版社、出版年月、ISBN、中图分类号、页数——需要什么字段就填什么字段。点开始,工具在后台用本地 OCR 引擎逐张识别——所有数据在你的电脑上跑,没有一本书的信息离开过你的电脑。

在这个过程中,文档工作台一共做了三件事:

第一,逐张 OCR 识别版权页全部文字。书名、作者、出版社、ISBN、中图分类号——从每张 PDF 中自动精准提取。即使版权页字迹模糊、排版拥挤、字号极小,也能高精度识别。泛黄破损的旧书版权页,不再需要凑着眼睛猜字。

第二,按你指定的字段自动整理为规范表格。书名一列、作者一列、ISBN 一列——你设什么字段就出什么列,不需要手动对齐、调格式、分表。

第三,一键导出为 Excel 登记表。

所有图书信息整整齐齐排列在一张 Excel 表上。书名、作者、ISBN 清清楚楚。你不再需要翻开任何一本版权页。

原本三天录不完的两百本新书,现在一个下午全部搞定。登记表直接打印交给校长,数据整整齐齐、一个字不错。

调一调字段,不同场景都能用

第一次跑完后,根据实际需要做个微调。比如学校图书馆要按中图分类法排序上架——在字段配置里加上"中图分类号",重新跑一次,导出的 Excel 按分类号排好序,上架路径一目了然。

社区书屋没有分类需求,只想做一张简单的书名目录给居民翻阅——删掉多余字段,只留书名、作者两列,导出一张干净清爽的查阅表,贴在书屋门口,居民想找什么书扫一眼就知道。

同一个工具,通过增减字段就能适配不同图书馆的管理习惯。不用为每种场景单独找方案。

写在最后

不只是中小学图书管理员,任何"一个人管一个馆"的岗位——社区书屋、职工书屋、乡村图书室——都面临同一个困境:书不多不少,偏偏只有你一个人打理。

两百本书逾期没录完,被上级查到就是管理失职。更严重的是,长期录不完的图书堆在角落吃灰,学生想借借不到、读者来了找不到——图书馆的存在价值,被录入效率这一个环节卡住了脖子。每次有读者问"那本新书到了吗",你只能说"还在录",读者眼里的失望比领导的催促更让你难受。

这里有一个关键区别:管理图书馆的"做数据"和"做服务"是两回事。

做数据是翻版权页、手抄字段、对登记表、查错改错——这些交给文档工作台,一个下午跑完,格式规范、零差错。

做服务是给读者推荐好书、帮学生找参考资料、办阅读活动——这才是一个图书管理员最该花时间的地方。

把做数据交给工具,把做服务留给自己。你是一个人管图书馆,不是一个人扛所有录入的活。

文档工作台下载链接https://pan.quark.cn/s/82ef5cfcf992

← 返回列表