1个终端,2个信任级别——运行克洛德代码对抗真实订阅和廉价代理

2026年8月17日1 次浏览来源:Dev.to阅读原文

用于代理编码工具的模型路由和信任分级系列正在进行中的一部分.

这个是无聊的,半工半做——没有打虫,只是一个一直在两台机器上运行的装置.

Claude Code的问题有一件事很好: 仔细的,范围化的编辑, 背后有一个真正的计划 - 执行的循环, 由你已经付费的订阅支持。

并不是每个任务都需要这样 探索读取"概括这个目录",草稿-和-丢弃的抓取工作——其中大部分不需要最有能力的模型来观察每一个符号.

修复是这一类工作的第二个更便宜的后端.

捕捉:克洛德代码只说Anthropic的Messages API.

它没有内在的概念"相同的工具,不同的模型".

所以问题是如何在不放弃接口的情况下将其指向别的地方.

堆叠 代理商本身并非新人.

同一个LiteLLM实例 已经为我运行的 单独内容管道提供了路由 这里的实际工作是给它接通克洛德代码:一个 shell函数和一些环境变量.

核心技巧和我花了几个星期才得知,这是指向LiteLLM的终点,而不是OpenAI相容的路径LiteLLM也暴露出.

Claude Code只理解Anthropic的形状,所以OpenAI-的形状端点会以看起来像客户端错误的方式出故障,而不是.

一旦LiteLLM坐在正确的端点上 并在下面翻译 Claude Code 不知道它是不是在和Anthropic说话 一个值得标注克洛德代码计划模式的bug在其请求中附加了一个参数.

Anthropic的API处理它.

其他大多数后端都不认得它,用400个——这看起来像是"计划模式"本身被打破了,当它是一个参数时,下游模型从未被建造来接受.

LiteLLM 配置中的一行修正 : 这告诉了LiteLLM悄悄地剥离不支持的参数,而不是转发,让后端拒绝调用.

Plan Mode之后无论哪个模型实际答案如何,都同样工作.

两个命令,故意不对称 这是比任何代理配置更值得复制的部分:信任而便宜的代理商看起来并不一样,是故意的. ——真实的事物,完全订阅,没有包装.

默认终端, 默认快捷 。

错误成本最高,所以我要我和它之间的视觉噪音为零。 ——一个 shell 函数,会掉入一个被孤立的子 shell , 重新命名标签, 并带有一个不同的标签和图标, 退出时重排 。

不是美学:在晚上11点在6个分页之间切换时, 我希望在结构上不可能误用便宜、更宽容的会话, 昂贵的工具得不到任何仪式;廉价的工具得到一种服装,因为错误地识别出这个方向是值得防守的失败模式.

子壳是使得出口被抛出的原因——一旦函数返回,它们不会漏入母壳.

因为LiteLLM不检查所以被设定为假值;它只是需要现成的东西,这样Claude Code就不会拒绝开始.

Cut召回Anthropic自己的遥测端点,因为本会话背后没有真正的Anthropic帐户.

为什么要费心 因为目标从来不是"让克洛德代码更便宜" 这是一个主管/执行者分裂:订阅会确实计划,审查,任何我为看到被打破而难过的东西.

代理会话处理出量大,量少的工作,其产出在同样方式被信任之前会得到审查.

与选择一个云模型比一个本地模型更适合监测剂的形状相同[在本系列更早期]——不是"哪个模型更聪明",而是"什么样的失败模式我能容忍,什么是最便宜的东西来清理酒吧".

这里的轴是订阅费用,而不是在线设备对云。

基本的问题是一样的: 我愿意做错什么, 以及当它发生时,我正在看着什么。

还开着呢 还有一个仅本地化的变体: 相同的两级模式,但便宜的一级完全运行在设备上而不是通过一个

分享