#3935·chatbox

Chatbox 缺少「极高/最大/自定义」思考档位,大模型依然跑不满血

Author: ijhgfdrCreated Sep 17, 2026Updated Sep 17, 2026

标签建议

enhancement feature-request reasoning models ui/ux

问题描述

当前 Chatbox 已经提供思考档位设置,例如低 / 中 / 高,这是一个很好的基础。

但问题是:档位不完整,缺少极高、最大、自定义推理预算等更高档位。

对于支持更高推理强度的模型,用户目前无法选择最高档,也无法按任务手动设置 thinking budget / reasoning budget。结果就是:同一个模型,在官方 API 或其他支持最高档的客户端里可以拉满,但在 Chatbox 里只能到“高”,复杂推理、代码、数学、长链条分析等任务可能无法发挥完整能力。

这不是“没有思考档位”的问题,而是“最高档位缺失”的问题。对于需要极限推理的用户来说,这依然是一个明显的能力上限。

复现步骤

  1. 使用最新版 Chatbox。
  2. 添加一个支持思考档位 / 推理预算的模型。
  3. 打开模型设置、会话设置或高级参数页面。
  4. 查看“思考档位 / 推理强度”相关选项。
  5. 当前可以看到低 / 中 / 高,或者自动 / 关闭等选项。
  6. 但找不到“极高”“最大”“自定义预算”等更高档位。
  7. 发送一个复杂推理问题,与官方 API 或支持最高档的客户端对比。
  8. 可以观察到:Chatbox 无法选择更高档位,也无法自定义 thinking budget,输出深度、耗时和 reasoning token 消耗可能不同。

当前行为

  • 已经有低 / 中 / 高思考档位。
  • 但缺少极高、最大、自定义推理预算等更高档位。
  • 用户无法选择模型允许的最高推理强度。
  • 用户无法手动设置 thinking budget / reasoning budget。
  • 用户无法为不同模型保存不同的默认最高档位。
  • 用户无法在单次会话中临时覆盖到更高档位。
  • 最终请求可能只使用较低档位,导致大模型无法发挥完整推理能力。
  • 用户无法确认请求里到底有没有带上正确的思考参数。

期望行为

希望 Chatbox 在现有低 / 中 / 高基础上,补充更高档位和自定义能力。

建议至少支持:

  • 关闭 / 自动
  • 极高
  • 最大
  • 自定义预算
  • 模型级默认值
  • 会话级临时覆盖
  • 全局默认值
  • 保存为预设
  • 请求体预览或调试日志
  • 显示实际 reasoning token 消耗(如果 API 返回)

改进建议

1. UI 增加更高思考档位

建议位置:

设置 -> 模型 -> 编辑模型 -> 高级参数 -> 思考档位 / 推理强度

也可以在会话顶部快捷菜单里提供临时切换。

建议控件:

  • 关闭
  • 自动
  • 极高
  • 最大
  • 自定义预算
  • 自定义 JSON(高级用户)

其中“极高 / 最大”如果某些提供商没有完全对应的值,可以映射到该提供商允许的最高档,或引导用户使用自定义预算。

2. 支持三层配置优先级

建议优先级:

会话级设置 > 模型级设置 > 全局默认设置

这样用户既可以给某个模型固定“极高 / 最大”,也可以在单次对话里临时切到低档节省 token。

3. 按提供商正确映射参数

不同厂商参数不同,建议做成 provider adapter,不要让用户手写 JSON。

提供商类型 能力 建议参数
OpenAI 兼容 reasoning effort reasoning_effortreasoning.effort
Anthropic 兼容 extended thinking thinking: { type: "enabled", budget_tokens: N }
Google Gemini 兼容 thinking budget generationConfig.thinkingConfig.thinkingBudget: N
其他 自定义 预留自定义参数映射,避免硬编码

具体字段请以各家最新 API 文档为准。重点是:Chatbox 应该帮用户把 UI 选项转换成正确请求体。

4. 增加校验和错误提示

  • 自定义 budget 不能超过模型上下文限制。
  • 部分提供商的 thinking budget 必须小于 max_tokens。
  • 不支持更高档位的模型,应隐藏或置灰对应选项。
  • 参数不合法时,发送前提示,而不是等 API 报错。
  • 如果 API 返回错误,应显示可理解的错误信息。

5. 显示请求参数和 token 消耗

建议在高级设置或日志中显示:

  • 当前思考档位
  • 最终发送的请求参数
  • 是否成功注入 reasoning / thinking 参数
  • reasoning token / thinking token 消耗
  • 本次响应实际使用的模型和档位

6. 保持向后兼容

默认可以保留现有低 / 中 / 高行为,也可以使用“自动 / 不发送”。只有用户手动选择更高档位或自定义预算时,才注入额外参数。这样不会影响普通用户,也能让高级用户真正用上满血模型。

操作 / 交互设计建议

  1. 用户进入 设置 -> 模型 -> 编辑模型 -> 高级参数
  2. 看到“思考档位”下拉框:自动 / 关闭 / 低 / 中 / 高 / 极高 / 最大 / 自定义。
  3. 选择“自定义”后,出现 thinking budget 输入框。
  4. 保存后,该模型默认使用该档位。
  5. 在聊天输入框上方提供快捷切换,支持本次会话临时覆盖。
  6. 发送请求时,Chatbox 根据模型提供商自动注入正确参数。
  7. 请求日志中显示最终参数,方便排查。
  8. 如果模型不支持更高档位,显示“该模型不支持该档位”或置灰。

临时绕过方案(不保证适用)

如果当前版本支持自定义请求体或额外参数,可以临时尝试手动添加。但不同版本、不同 API 类型字段可能不同,普通用户很难安全配置。

OpenAI 兼容示例:

json
{
  "reasoning_effort": "high"
}

Anthropic 兼容示例:

json
{
  "thinking": {
    "type": "enabled",
    "budget_tokens": 16000
  },
  "max_tokens": 20000
}

Google Gemini 兼容示例:

json
{
  "generationConfig": {
    "thinkingConfig": {
      "thinkingBudget": 24576
    }
  }
}

注意:以上仅为示例,实际字段和限制请以官方 API 文档为准。临时绕过不能替代产品级 UI。

验收标准

  • 保留现有低 / 中 / 高思考档位。
  • 新增极高 / 最大 / 自定义预算选项。
  • 用户可以在 UI 中设置并保存更高思考档位。
  • 会话级设置可以覆盖模型级默认值。
  • 请求体中包含正确的 provider 参数。
  • 重启 Chatbox 后设置仍然保留。
  • 不支持该能力的模型会隐藏、置灰或提示。
  • 参数冲突时发送前有校验。
  • 日志或界面能显示当前思考档位和实际 token 消耗。
  • 文档中说明各提供商支持情况和限制。

环境信息

  • Chatbox 版本:
  • 操作系统:
  • 模型提供商:
  • 模型名称:
  • API 类型:Chat Completions / Responses / Anthropic / Gemini / 其他
  • 问题截图或日志:

结语

如果担心兼容性,可以默认保持现有低 / 中 / 高行为,仅在用户手动选择“极高 / 最大 / 自定义”时注入额外参数。希望 Chatbox 不要成为限制模型推理上限的瓶颈。这个问题对复杂推理用户非常关键,愿意协助测试和提供日志。