路线图/愿望清单:合并的功能请求和当前立场
作者: jbarlow83创建于 2026年6月9日更新于 2026年6月11日
标签enhancement
这个问题收集了目前还没有走上积极发展道路的长期特色请求,因此他们生活在一个地方,可以推动有关路线图的讨论.
** 请先读一下:** 我在下面引用了一个立场(往往"不会做,因为"),这就是我的当前 立场和推理——** 不是永久的**. 其中有几项是分组请求,许多人都要求同样的东西,这正是可以改变优先事项的信号。 欢迎评论、使用案例,特别是拉动请求。 如果你从你自己的 封闭/重新定向的问题来到这里, 这是做这个案子的地方。
这些决定中有许多是反复出现的原则:** OCRmyPDF偏向于大型、无人照管的档案批量工作。 ** 一个“右98-99%时间”的特征在该卷中常常是无法接受的,因为每页1-2%的误差率无声地腐蚀了没有人审查的文件。 这一条是以下几个本来合理的特征被搁置的原因。
-- -- . . .
□ 1. 更改页数的特性(页去除、分拆、裁剪)
一个强大的,多要求的集群——一个我目前不追求,因为任何增加/重排/重排页面,对于没有被关注的批次来说都是高风险的(误放删除了真实内容).
- 1032 — 删除没有可识别的 OCR 字符的页面** (第12 号的文字 -- -- 恒温变体) ----------- 作物空边/适合页**--*-"----"------------------------------------------- -- --- -- -- -- -- - -- - - - - - - - - - - - - - - - - - - - - - - - - - - - - - - - - - - - - - - - - - - - - - - - - - - - - - - - - - 单干并不难,但......我并不知道如何将它与其余的功能结合。”
- 330 — 将一页的双页(2-上)布局分割成一页** — — “Ocrmypdf偏向于[档案]使用案例... 我无法证明这一努力的合理性。” 工作:`工具海报'。 -510 — 在分隔符/条码页上分割文档** — * 这让我印象深刻,是您工作流程特有的定制要求,而不是普遍感兴趣的特征。”
^ 2. 文本层处理不全页光栅化 ^ 最大服务不足的集群
多个独立请求者将相同的空白圈入:** 干净地去掉/替换一个原有的文本层,而不给整页** ("-force-ocr" bloats文件大小;"-redo-ocr"可以将旧文本和新文本相混合). 这可能是唯一最需要的能力 还没有一个干净的答案。
- 1608 — 在将矢量图形保存为正时删除一个错误的文本层**
- 1600 — 带数字头/脚印的文件的性能** (正文- 字条- OCR- 重排正文) -?????????????????????????????????????????????537;只文本/重建的可搜索的PDF**。 (见`-侧车'. )
{\fn华文仿宋\fs16\1cHD1D1D1} . . . . . . .
内容来源: ocrmypdf/OCRmyPDF