生成控制

调整温度、输出长度与推理深度,并了解 Cordy 如何把历史放入模型上下文窗口。

Cordy 以服务商无关的方式提供生成控制。温度最大输出 token 位于设置 → 生成;当所选模型声明支持思考时,推理深度会出现在模型选择器中。设置从下一次发送起生效,并会跨重启保留。

这些说明对应当前源码提交 0870b1e;已发布的 v0.5.0 使用的是较早的数字思考预算控件。

快速参考

控制可选值默认值可用范围
温度小数留空时使用服务商默认值所有模型
最大输出 token整数留空时使用服务商默认值所有模型
推理等级关闭、均衡、深入关闭仅支持思考的模型

重置为默认值会清除温度与最大输出覆盖,并把推理等级恢复为关闭。数值字段留空时,请求不会发送对应参数,由服务商选择默认值。

温度

温度控制采样。较低值通常更集中,较高值通常变化更多。有效范围由服务商校验;留空即可省略该参数。

最大输出 token

该值限制单次回复的输出长度,不会改变模型的总上下文窗口;后者同时包含输入与输出。留空时使用服务商默认值。

推理等级

选择支持思考的模型后打开模型选择器,可看到三个等级:

  • 关闭——不启用扩展推理,也是默认值。
  • 均衡——用于普通的多步推理。
  • 深入——提供更多推理深度,通常也会增加延迟和 token 用量。

Cordy 保存的是用户意图,而不是某一家服务商的协议字段。对兼容 OpenAI 的请求,均衡映射为 medium,深入映射为 high,关闭时省略 reasoning_effort。对 Anthropic,均衡映射为 4,096 token 的思考预算,深入映射为 16,384;必要时 Cordy 还会提高 max_tokens,保证思考之后仍有空间输出正文。

不支持 Thinking 能力的模型不会显示该控件。即使设置中残留了另一个模型保存的等级,发送路径也会强制使用关闭。

设置如何生效

  • Cordy 在每次发送时读取当前设置。
  • 温度、输出上限与推理等级是全局偏好,不是每个会话的快照。
  • 会话保留创建时的服务商与模型,而当前生成偏好会用于它的下一次请求。
  • 协议允许时,默认值不会被写入请求。

上下文处理

每次请求前,Cordy 会把历史放入所选模型的上下文窗口:

  • 预留输出空间与安全余量。
  • 优先丢弃最旧历史,并按完整的用户主导回合裁剪,不从中间切断一个回合。
  • 回放时保留非空的中断助手回复,但省略空白或只有推理内容的中断回复。
  • 对图片采用保守预算,并在设备端估算 token。
  • 调用前会结合系统提示与预留输出检查最新输入是否可容纳。

若最新输入无法放入上下文,Cordy 会显示**“此会话过长。请新建对话或缩短历史。”** 请新建会话或缩短输入;原样重试无法解决。