生成控制
调整温度、输出长度与推理深度,并了解 Cordy 如何把历史放入模型上下文窗口。
Cordy 以服务商无关的方式提供生成控制。温度与最大输出 token 位于设置 → 生成;当所选模型声明支持思考时,推理深度会出现在模型选择器中。设置从下一次发送起生效,并会跨重启保留。
这些说明对应当前源码提交 0870b1e;已发布的 v0.5.0 使用的是较早的数字思考预算控件。
快速参考
| 控制 | 可选值 | 默认值 | 可用范围 |
|---|---|---|---|
| 温度 | 小数 | 留空时使用服务商默认值 | 所有模型 |
| 最大输出 token | 整数 | 留空时使用服务商默认值 | 所有模型 |
| 推理等级 | 关闭、均衡、深入 | 关闭 | 仅支持思考的模型 |
重置为默认值会清除温度与最大输出覆盖,并把推理等级恢复为关闭。数值字段留空时,请求不会发送对应参数,由服务商选择默认值。
温度
温度控制采样。较低值通常更集中,较高值通常变化更多。有效范围由服务商校验;留空即可省略该参数。
最大输出 token
该值限制单次回复的输出长度,不会改变模型的总上下文窗口;后者同时包含输入与输出。留空时使用服务商默认值。
推理等级
选择支持思考的模型后打开模型选择器,可看到三个等级:
- 关闭——不启用扩展推理,也是默认值。
- 均衡——用于普通的多步推理。
- 深入——提供更多推理深度,通常也会增加延迟和 token 用量。
Cordy 保存的是用户意图,而不是某一家服务商的协议字段。对兼容 OpenAI 的请求,均衡映射为 medium,深入映射为 high,关闭时省略 reasoning_effort。对 Anthropic,均衡映射为 4,096 token 的思考预算,深入映射为 16,384;必要时 Cordy 还会提高 max_tokens,保证思考之后仍有空间输出正文。
不支持 Thinking 能力的模型不会显示该控件。即使设置中残留了另一个模型保存的等级,发送路径也会强制使用关闭。
设置如何生效
- Cordy 在每次发送时读取当前设置。
- 温度、输出上限与推理等级是全局偏好,不是每个会话的快照。
- 会话保留创建时的服务商与模型,而当前生成偏好会用于它的下一次请求。
- 协议允许时,默认值不会被写入请求。
上下文处理
每次请求前,Cordy 会把历史放入所选模型的上下文窗口:
- 预留输出空间与安全余量。
- 优先丢弃最旧历史,并按完整的用户主导回合裁剪,不从中间切断一个回合。
- 回放时保留非空的中断助手回复,但省略空白或只有推理内容的中断回复。
- 对图片采用保守预算,并在设备端估算 token。
- 调用前会结合系统提示与预留输出检查最新输入是否可容纳。
若最新输入无法放入上下文,Cordy 会显示**“此会话过长。请新建对话或缩短历史。”** 请新建会话或缩短输入;原样重试无法解决。