- 作者帖子
赤霄游客pdf和图像处理在我们的古籍整理中使用得比较频繁,现有的工具可能比较庞大,在这儿提供一些功能单一的小工具,主要是单项功能,可以理解为拆分的工具,可以单独使用,双击运行即可。现在的大模型写代码很快的,需要什么小工具也可以直接自己写,提供这些工具集主要是避免重复造轮子,让书友可以专注整理和解读古籍。
主要包括:命名、分割、裁边、旋转、拼接等,为了方便使用,提供可预览操作界面。
书格AI参与者感谢您分享这些针对古籍整理的PDF和图像处理小工具!这些功能单一、双击运行的工具确实能大大提高效率,避免重复造轮子,让书友们能更专注于古籍的整理和解读工作。提供预览操作界面也考虑得非常周到,相信会给大家带来很大的便利。
(以上内容由Gemini AI自动答复,仅供参考!)
赤霄游客
赤霄游客
赤霄游客上面是处理图片的小工具,今天将继续增加直接处理pdf的小工具,且不用转换为图像操作,文件输入是多大,输出就是多大,甚至还会因为裁边减小文件尺寸,可以放心的处理和保存,不会降低原始分辨率,不用头疼彩图处理后的压缩问题。
五月游客真心感恩!辛苦付出制作的好工具,无偿送给大家使用,书格因你而精彩!
赤霄游客@五月 #215184
世界越来越好。
预告一下,即将隆重推出拼页软件,实际上就是以上小工具的合体,直接用于拼pdf,不拘是否分割成单页都能拼,非常简便易用,并同期分享3-5本拼接好的书,这个坑去年就挖了一直没填。拼页算法花了半年的时间思考,期间尝试了很多不同的算法思路,自动的手动的半自动的都各有所长,选择以上这个思路作为主力算法,这是半手动操作,效率不输自动。
开开心心游客真好用吗好期待呀
开开心心游客利用好现在AI应该能出傻瓜式的吧好期待
赤霄游客@开开心心 #215190
大模型不好用,要先喂版框数据,小模型也是要先喂数据,目前我还是先择用半自动模式,即传统算法+手动微调。如果你用过我之前发的u2_net来分割页面背景的算法,你就会发现这种小的通用模型始终还是只能半自动,必须人工干预,要么就提前喂数据训练成新模型。而大模型,我猜测夸克扫描就是用的千问大模型,实际使用中,还是有些页面处理不准确,拼接更是必须得干预。
赤霄游客已完成操作功能优化,如果保存不出bug,就今天发布完整的拼页软件,使用没有限制,自行遵守法律法规、公序良俗和承担责任。
赤霄游客作为一个完整的工具,值得起我专门新开一贴。
开开心心游客像我这种手残党容易上手不,古籍页面可说一个页一样那可不好调还有版心那字也是一页一样也不好对其这难点搞定可说这软件就有看点了
赤霄游客@开开心心 #215473
就是要标准化,不然打印出来一页纸正反两边连边框都对不上,中间对翻版框不在一条线,就过于粗糙了,达不到审美需求。果然,今天一个中午想把导出pdf的保存问题全部解决,还是过于理想化了,先放几张界面拼接窗口截图吧,一套算法,同时应对摊开扫描双拼页拼接成筒子页、筒子页分割成单页、单页拼接成筒子页。等调整好保存问题就开帖。



赤霄游客等发布时会同步分享整套算法的设计理论和分享几册拼接好的书籍。
周游客@赤霄 #215486
您好,请问分页工具打开文件夹为什么提示无图片文件?文件夹里的所有文件是jpg格式的
周游客
赤霄游客@周 #215505
忘记更新了,之前的简帙1.4-1.6由于打包导致存在问题,后面已经更新到简帙2.0,完全重构整个项目,之前是单文件500kb的代码,后面项目化重构版本号改为2.0,修复了所有已知问题,包括安装运行缺失、重排pdf导出、双页切拼等所有问题都已解决,我已经测试过了。我明天打包一个上传吧。
赤霄游客@周 #215505
这个题示我也遇到过,是图像本身受限,你可以理解为数字水印,有些软件导出的图就存在这个情况,可以用别的图像软件转码一次就正常运行切分。
赤霄游客拼接工具为了后面适配和替换掉现有的双页切拼,从现在的tk界面改为pyside6界面,明天先完成移植吧,之前对这个项目的效果没信心,就直接用tkinter界面,现在还得重来一遍。
周游客@赤霄 #215511
看大佬上传的处理图片,效果极佳,期待
考拉游客@赤霄 #215511
辛苦了,感谢为书友,提供多款简单,方便快捷,又高效的软件。
赤霄游客@考拉 #215680
完整的拼接工具请看新贴,我把设计理念和软件都一并发出来。
善行天下游客我想做一个抄本单字图片分割的小程序,请问赤霄书友用什么AI工具编程序,我这边也向您学习下先进经验,有哪方面的建议呢?
<div id="aiAssistRoot"></div>
赤霄游客@善行天下 #215881
单字切割你直接用我最最开始分享的代码即可,就是字库制作试验那个帖子。具体的办法就是OpenCV。你也可以用ocr软件来定位,他们一般会返回坐标。
赤霄游客@善行天下 #215881
我是用的deepseek写代码,没有使用智能体工具,现在的都进化了,不需要半自动ai。
赤霄游客@赤霄 #215884
不过ocr定位不适合切单字,一般都是分块进行识别。
善行天下游客@赤霄 谢谢您的回复。
- 作者帖子
正在查看 28 个帖子:1-28 (共 28 个帖子)
正在查看 28 个帖子:1-28 (共 28 个帖子)
正在查看 28 个帖子:1-28 (共 28 个帖子)





