Janus 的图像生成模式是否支持多模态输入?
作者: Dswn888创建于 2025年7月6日更新于 2025年7月28日
Hi @learningpro @gnobitab @TheOneTrueGuy @mowentian @soloice, 感谢你们的出色工作! 最近, 我尝试使用 Janus 进行 **图像生成**。 除了提供文本提示外, 我还提供了 **其他图像作为提示的一部分**。 然而, 在 transformers 官方实现的 Janus 中, 我在 **JanusProcessor** 的定义中发现了以下代码, 这似乎意味着在生成图像时, 处理器不会处理输入中的图像元素? 因此, 在图像生成模式下, 模型似乎只会处理非模态的文本提示?
内容来源: deepseek-ai/Janus