模型怎么选:三档模式与自定义模型接入
模型决定效果和消耗。WorkBuddy 的模型体系分两层:对话时选档位,设置里配具体模型。
三档模型模式
| 模式 | 适用场景 | 特点 |
|---|---|---|
| 快速模式 | 简单明确的任务:日常问答、格式转换、小段代码修改、文案润色 | 响应最快,消耗最低 |
| 均衡模式 | 绝大多数任务:写文档、分析数据、多文件代码改动 | 效果和速度兼顾,不确定选哪档时用它 |
| 极致模式 | 复杂任务:跨模块重构、多步骤推理、需要反复验证的分析 | 响应稍慢、消耗更高,但复杂任务下结果更稳定 |
思考强度
对应模型给出答案前的推理投入:强度越高,模型做更多分析和自我检查,适合逻辑链条长、容易出错的任务;强度越低响应更快。默认档位已适合绝大多数任务,一般无需单独调整。
上下文窗口
默认 200K,适用于绝大多数任务。官方特别提醒:窗口并非越大越好——每一轮对话都会把当前上下文完整发送给模型,开到 1M 不会让模型变聪明,只会让每轮消耗成倍增加。只有处理超长文档、或需要完整记住大量历史内容时才需要调大。
Max 模式
- 关闭(默认):系统在合适时机自动触发上下文压缩,减少长对话中重复传输的上下文,降低积分消耗;
- 开启:全程完整保留上下文、不做压缩,细节一点不丢,代价是长对话积分消耗明显更快。建议保持关闭,仅在需要超长上下文时开启。
内置模型
内置模型列表包含混元(Hy)、GLM、MiniMax、Kimi、DeepSeek 等系列模型,各有能力标注(图片输入、思考模式、推理模型等),例如支持 1M 上下文窗口的 GLM 新一代模型、擅长长程自主任务的 Kimi 系列等。具体型号与能力标注以客户端模型选择器为准;企业版中管理员禁用的模型会在选择器中同步隐藏或置灰。
自定义模型
设置页模型中可以通过图形界面管理自定义模型,配置参数(含 API Key)仅保存在本地 models.json,不上传云端。
接入方式
| 方式 | 说明 |
|---|---|
| 提供商接入 | 从提供商列表选择,URL、模型列表、能力标记自动填充,只需补全 API Key。支持腾讯云 Token Plan(兼容混元、MiniMax、Kimi、GLM 等)、Coding Plan(腾讯云 / 智谱 / Kimi)与自定义 API 预设入口 |
| 本地部署 | 通过 Ollama 接入本地开源模型(默认监听 11434 端口)。适合数据隐私 / 内网合规、零成本试用、离线可用三类场景 |
| 自定义 | 模型服务不在列表中时,手动填写 URL、API Key 与模型名接入 |
自定义协议
模型服务使用非标准 URL 路径(如经过网关或代理层封装)时,可在高级配置开启自定义协议开关:开启后直接按填写的 URL 发起请求,跳过路径校验与自动补全;关闭(默认)则使用标准路径并自动校验补全。
安全与消耗提醒
- 请勿将 API Key 分享给他人:泄露可能导致配额被盗用、产生额外费用;
- 自定义模型产生的全部费用(Token、订阅等)由你向第三方支付,使用中可能持续触发模型调用,建议密切关注第三方账户费用;
- WorkBuddy 仅作通信链路,输入内容直达第三方模型,处理规则按你与该第三方的协议执行;
- 不再使用时建议在配置中清理 API Key。
模型列表与接入入口可能随版本调整,以客户端实际显示为准。积分消耗与模型单价的关系见积分规则。