百科.dev
全部条目AI 编程趋势榜开源项目技术资讯提交条目
登录
返回工具页/返回 Issues 列表
#760·codex-plugin-cc

考虑是否可以缓和"对抗性审查"的框架

作者: lunaynx创建于 2026年9月14日更新于 2026年9月14日

我有一个有线线,我基本上循环了`/codex:对抗-审查 ' - > 请Claude修复 - > 重复。 这项工作与网络安全完全无关,仅涉及简单的联网。 然而,关于第6个周期(是的,它已经熟了,不要问了),“验证和地址Codex的发现”迅速绊倒了Fable的网络分类器。

现在,我显然不能确定 是否这是绊倒它的原因。 但是,如果在上下文中重复6次“对抗性审查”的话,我一点也不感到惊讶(而且很可能是双倍的,如果你包括CoT的话),它会绊倒分类者。 "对抗"一词具有网络安全/红色组合的内涵,尽管并没有被这样使用. 所以我想,也许应该用另一个术语来取而代之,以减少假旗与边疆模式相伴的风险.

内容来源: openai/codex-plugin-cc

查看 GitHub 原文在 GitHub 查看讨论