将单个源图像导出为多个独立的图像文件,而不是一个文件
作者: mfh7创建于 2026年8月28日更新于 2026年8月28日
在一个 36 页的测试文档(混合文本/代码/截图 SAP 训练 PDF)中,一个图表(源编号中的“图 102”)是源 PDF 中的一个单个图像,由 Marker 导出为多个独立的图像文件,每个文件覆盖原始图表的一部分。然后,Markdown 输出会依次引用多个片段图像,而读者期望有一个统一的图表 - 在渲染时被视觉上分割(边缘不一致,没有任何指示这些片段属于一起)。**尝试了,尚未重现:**尝试了 3 个合成构造来隔离触发器 - (1) 一个图表分成两个图像页面对象,堆叠边缘贴合; (2) 一个单个图像对象,两个内容集之间有大量空白视觉间隙; (3) 变体 (1),其中一个流浪的文本对象位于两个图块之间的缝隙中。这三者都被 Marker 正确合并为一个导出的“Figure”/“Picture” + “FigureGroup”/“PictureGroup” - 其中没有一个重现了真实文档中看到的碎片(通过“marker-pdf==1.10.2”的自己的“_meta.json”块计数来确认每次尝试)。真实文档的触发器仍未确定;将此作为观察报告而不是阻止找到重现。候选未尝试的角度:重叠但不接触的图块,不同像素大小/分辨率的图块,或多列页面布局与图表的边界框相互作用。**请求:**当多个图像类型的页面对象在空间上相邻且显然是一个视觉单元的一部分(接触或接近接触的边界框)时,考虑将它们合并为一个导出的图像,或者至少在输出中将它们组合起来,以便下游渲染器/读者可以知道它们是一个图表。如果有已知的代码路径,我很乐意进一步帮助缩小触发器。**环境:**`marker-pdf==1.10.2`。
内容来源: datalab-to/marker