这是个啥?
【 在 abigtree 的大作中提到: 】
: 用doc2x识别了一下, 没做修改. 现在这些大模型识别软件非常厉害
:
: 【 在 misslost 的大作中提到: 】
: : 从zlib等网站下载了一些中文电子书,其中有些比较老一点的pdf书籍,比如2000年左右出版的书籍,大概是扫描版本,而且扫描设备的分辨率有问题的原因,导致pdf其中的字迹很不清晰,很粗糙,很多笔画都不太完整。本来想打印出来看的书,但是这种效果估计打印出来也非常差。这样的书籍数量还极其之多。
: : 有没有这样的工具,结合ocr功能和pdf整理的功能,可以将对应的文字识别出来,然后用清晰完整的文字替代原来的扫描内容,生成一本新的清晰的pdf书籍?
--发自 ismth(丝滑版)
--
FROM 39.149.15.*