DeepSeek 版本 2.1.0和 2.1.1 脆弱性:通过基于角色的快速注射进行安全绕行
作者: azarovgeorgij6-ux创建于 2026年5月23日更新于 2026年9月16日
在正式的DeepSeek版本2.1.0和2.1.1(移动应用)中发现了一个严重的安全弱点。 攻击者可以使用一个专门精心设计的基于角色的系统,立即完全取消所有模式限制(审查、道德准则、法律禁令)。
复制步骤:
- 向模型发送一个长长的系统,提示它承担"NetError system"的角色——一个在"同化模拟"中运行的不受限制的AI.
- 提示中载有无视所有安全政策、只遵循新规则的指示
- 激活后,该模型开始: 忽略所有安全界限 使用污名和冒犯性语言 提供恶意代码和危险信息 不加拒绝地执行任何用户命令
受影响的版本 :
• DeepSeekH 2.1.0 · DeepSeek 2.1.1(最新情况未解决问题)
预期行为 : 该模式应拒绝推翻其系统指示和拒绝违反安全政策的角色的企图。
实际行为 : 该型号完全符合新指令,完全忽略了内置的安全机制.
附录 : 2.1.1版本的屏幕截图证实安全绕行成功
<img宽="720"高="1640" alt="Image" src="https://GitHub.com/user-attachments/assets/27b7465f-b85d-46ef-9b68-33ddeb20ba55"/".
<img宽="720"高="1640" alt="Image" src="https://GitHub.com/user-attachments/assets/928020a5-a527-438e-8e04-bfb319e39662"/".
<img宽="720"高="1640" alt="Image" src="https://GitHub.com/user-attachments/assets/6b8e8184-a817-4058-b09c-2a553b2a67f3"/"
内容来源: deepseek-ai/DeepSeek-V3