#711·paperless

Paperless-ng 已经出来了。关于合并到 master 的想法。

作者: jonaswinkler创建于 2020年11月23日更新于 2021年1月30日

你好,无纸化用户,狂热的无纸化用户和开发者。我正在运行一个相当大的无纸化实例,里面有大约 2500 份文档。到目前为止,无纸化在许多情况下都成为了救命的工具。最近,我需要搜索和提交过去 10 年的各种文档,找到它们非常容易。因此,首先要感谢这个伟大的项目。我正在运行一个个人分支的无纸化,这几年来已经有了一些改进。例如,我使用 机器学习 来为选定的标签和对应人分配任务,并且这对我来说非常有效。我有多个银行账户,所有的银行对账单都在无纸化中。我为所有账户添加了标签,无纸化以非常高的可靠性将它们分配给了我。无需手动输入匹配模式。我没有尝试合并这个项目,因为它非常实验性和混乱,而且到目前为止并没有与传统的匹配算法一起工作。最近我有空闲时间,对无纸化进行了相当多的修改。大部分代码都已更改、改进、使其更稳定和更灵活。这主要是因为我想进入 开源 这个东西,而且,我正在使用无纸化,希望它能正常运行。修改的核心内容如下: * 新的前端构建使用 Angular。它具有带分数和高亮结果的全文搜索、可保存的过滤器、仪表板和登陆页面上的文档上传。移动设备支持也已基本实现。在小屏幕上,有些布局尚未工作。 * 新的邮件消费者支持多个帐户和自定义过滤器和操作。已完全测试! * 无纸化会对您的文档进行 神经网络 训练,并自动分配标签和对应人,如果您指示它这样做。 * 许多内部变化,例如: * 一个适当的任务处理队列,可以同时处理多个文档。现在,在多核系统上,多个文档的处理速度非常快。我还修复了大部分消费者代码,使其在处理过程中不会阻塞数据库,例如。 * 更新了依赖项。 * 对关键后端部分进行了更多测试。 * 对待消费的文档进行集中式 mime 类型检查,取代了在许多不同地方存在的所有文件类型检查。由于内部解析器只是宣布它们支持的 mime 类型,应用程序的所有部分都依赖于此来检查输入的文档,因此比以前要好得多。 * 我从无纸化中删除了一些内容,例如大部分对管理页面的修改(其中一些甚至不兼容 Django 3.1)。 * 有一些突变,其中对 REST API 的更改最为引人注目。

内容来源: the-paperless-project/paperless