虽然 num_classes 不是 1000,但 sample.py 中存在一些错误!
作者: Y1ZzLu创建于 2025年3月2日更新于 2025年3月20日
Q1: 使用单个 GPU 训练模型时,`model.module` 无法使用。 Q2: sample.py 中的 `y_null = torch.tensor([1000] * n, device=device)` 应该是 `y_null = torch.tensor([args.num_classes] * n, device=device)`。 Q3: 训练后,我使用训练好的模型生成数据,结果的 sample.png 看起来像高斯噪声,我的训练损失低于 0.05! 但我无法使用这个模型!
内容来源: facebookresearch/DiT