询问项目相关信息
作者: TentenMarchhhh创建于 2026年6月13日更新于 2026年6月13日
问题 1: OmniParse 支持各种各样的数据类型,包括文档、图像、音频和视频。从架构的角度来看,系统如何协调和分发这些不同的文件类型到各自的 ML 模型(例如,用于音频的 Whisper、用于 PDF 的 Nougat/Marker、用于图像的 OCR 引擎)?是否存在一个集中式编排器,并且它如何防止在处理大型多媒体文件和文本文档时出现资源耗尽的情况?
内容来源: adithya-s-k/omniparse