RTX 显卡没有加速, apex 对使用长浮点的损失函数有何影响?
作者: ulorentz创建于 2020年5月12日更新于 2026年5月14日
我的网络是一个编码器-解码器类型,其中编码器使用 resnet 块(因此包含卷积和批量标准化)。解码器使用 convtranspose 和卷积。我正在使用 RTX2070super 进行训练,但 apex 训练实际上比普通训练慢,这可能是由于我的显卡具有 tensor 核心? 我的网络需要自定义损失函数:
内容来源: NVIDIA/apex
我的网络是一个编码器-解码器类型,其中编码器使用 resnet 块(因此包含卷积和批量标准化)。解码器使用 convtranspose 和卷积。我正在使用 RTX2070super 进行训练,但 apex 训练实际上比普通训练慢,这可能是由于我的显卡具有 tensor 核心? 我的网络需要自定义损失函数:
内容来源: NVIDIA/apex