Kilo Code 模型选择指南:四个模型槽位、优先级规则与本地部署配置实战

发布时间:2026/9/12 15:43:52
Kilo Code 模型选择指南:四个模型槽位、优先级规则与本地部署配置实战 Kilo Code 模型选择指南四个模型槽位、优先级规则与本地部署配置实战【免费下载链接】kilocodeKilo is the all-in-one agentic engineering platform. Build, ship, and iterate faster with the most popular open source coding agent.项目地址: https://gitcode.com/GitHub_Trending/ki/kilocode导读Kilo Code 将模型配置拆分为主模型、小模型、子代理模型与自动补全模型四个独立槽位并在 IDE 扩展与 CLI 中提供了各自完整的选择与覆盖机制。本文以官方模型选择指南为骨架结合仓库源码配置覆盖层、task 工具、VS Code 深链处理器与实际配置样例讲清每个槽位的用途、解析顺序、优先级链条以及如何用kilo.jsonc、vscode://深链和 Auto 模型档位在完全本地、完全免费与最强能力之间精准切换。为什么静态推荐列表注定过时AI 模型领域的变化速度极快每隔几周就有新模型发布既有模型持续更新价格反复调整昨天的旗舰今天可能已经沦为性价比选项。任何一份手工维护的推荐模型清单在落笔的那一刻就已经开始过时。因此 Kilo Code 没有维护静态榜单而是提供实时模型榜单——展示 Kilo Code 用户当前实际使用并取得成效的模型数据。它来自真实开发者使用数据并持续更新能直观看到不同任务下用户的选择、实际效果以及模型格局的实时变化。相关源码证据可参见 overlay.ts其中将model、small_model等配置字段纳入了设置覆盖层的解析范围。四个独立配置的模型槽位Kilo Code 的 IDE 扩展与 CLI 配置中包含四个彼此独立的模型槽位各自负责不同任务可单独配置槽位用途配置方式未配置时的解析逻辑主模型Main model编码任务、对话、推理的主模型同时用于上下文压缩/摘要与todo 列表生成模型选择器、/models、kilo.jsonc中的model键按 优先级链条 逐级解析小模型Small model会话标题生成、提交信息生成、提示词增强等轻量后台任务kilo.jsonc的small_model键或Settings → Models标签页的Small Model字段见下方小模型解析逻辑子代理模型Subagent modeltask工具启动的子代理的默认模型kilo.jsonc的subagent_model键或Settings → Models标签页的Subagent Model字段未设置时继承父代理会话当前使用的模型自动补全模型Autocomplete model输入过程中的行内代码补全FIMSettings → Models → Autocomplete model默认 Codestral经 Kilo Gateway 路由小模型的解析逻辑当small_model未显式设置时Kilo 按以下顺序解析在当前 provider 上寻找小型/廉价变体如 Anthropic 的 Haiku、Gemini 的 Flash若会话中已认证 Kilo Gateway则回退到kilo-auto/small若未认证 Kilo Gateway则复用主模型。源码层面provider.ts 中的kiloSmallModelPriority对kilo开头的 provider 返回[kilo-auto/small]provider.ts 则在找不到合适小模型时回退到 Kilo provider 目录中的kilo-auto/small条目。而kilo-auto/small的最终解析由 Gateway 侧按账户状态决定有付费余额时路由到google/gemma-4-31b-it无余额/免费账户则路由到google/gemma-4-26b-a4b-it:free见 models-and-providers.md。配置本地/私有推理若希望使用私有或本地推理源Ollama、LM Studio或直连 BYOK provider按以下四步配置将主模型设置为非kilo-auto的 provider——本地模型Ollama、LM Studio或直连的 BYOK provider key显式设置small_model为同一 provider 上的模型。若在登录 Kilo Gateway 的状态下留空它会回退到kilo-auto/small而不会复用主模型subagent_model留空——无论是否登录 Gateway它都始终继承主模型而不是默认走 Kilo Gateway自动补全将 provider 切换到直连的 Mistral 或 Inception BYOK key或直接禁用自动补全。提示在 IDE 扩展或 TUI 中登出 Kilo Gateway即可确保没有任何推理流量经过 Kilo Gateway。从配置层面看small_model与agent、provider等字段一样被纳入设置覆盖层统一管理见 overlay.tsagent.name.model是集合类配置项可逐代理覆盖。模型优先级完整链条VS Code 中的优先级使用聊天输入区的模型选择器为当前会话选择模型也可输入/models打开模型选择器当所选模型支持变体时输入/variant打开推理强度reasoning effort选择器在输入区按ShiftTab可循环切换到下一个推理强度变体到末尾后循环回第一个。该快捷键在侧边栏聊天、Agent Manager 输入框和新 Worktree 对话框中都生效将鼠标悬停在变体选择器上会显示快捷键提示。若希望ShiftTab保留用于键盘焦点导航可关闭kilo-code.new.chat.shiftTabCyclesVariant设置也可在Settings → Display中调整在Settings面板Models 标签页设置每个代理的默认值与全局默认值或直接在kilo.jsonc中配置。VS Code 模型优先级会话级覆盖 → 每个代理最近一次的选择 → 代理级配置 → 全局配置 → Auto Free。模型选择器会记住每个代理你最后一次选择的模型切换代理时会恢复此前的选择手动选择始终优先于配置设置。CLI 中的优先级在 TUI 中使用模型选择器CtrlX m或/models切换模型非交互场景使用--model标志例如kilo run --model claude-sonnet-4-20250514用kilo.jsonc的model键设置全局默认或在agent段中按代理配置模型。CLI 模型优先级--model标志 → 代理级配置 → 会话中最近使用 → 全局配置 → 最近使用过的模型列表 → 首个可用模型。这与 custom-models.md 中记载的加载顺序一致--model/-m命令行标志 → 配置文件中model键 → 上次会话最后使用的模型 → 内部优先级下的首个可用模型格式统一为provider_id/model_id。任务类型与模型档位的一般建议复杂编码任务高端模型Claude Sonnet/Opus、GPT-5 级别、Gemini Pro通常更擅长处理精细需求、大规模重构与架构决策日常编码中端模型通常在速度、成本与质量间取得最佳平衡——足够快到不打断心流又足以胜任多数任务预算敏感新一代高效模型DeepSeek、Qwen 等的性价比常常超出预期可参考下文免费与预算选择本地/私有场景Ollama 与 LM Studio 支持本地运行模型代价通常是速度与能力换来的是隐私与零 API 成本。使用未收录模型自定义模型注册Kilo Code 为每个 provider 内置了精选模型列表但你可以使用 provider 支持的任何模型——包括尚未收录的新发布模型、微调模型、本地模型或自托管端点。在配置文件provider.provider_id.models下注册即可模型键即为你在其他位置引用的模型 ID{ $schema: https://app.kilo.ai/config.json, model: lmstudio/my-custom-model, provider: { lmstudio: { models: { my-custom-model: { name: My Custom Model, }, }, }, }, }model键使用provider_id/model_id格式provider_id是provider下的键如lmstudio、ollama、openai、anthropic、openai-compatiblemodel_id是provider.provider_id.models下的键。可配置字段包括name、idAPI 侧模型 ID、tool_call、reasoning、temperature、attachment、modalities、limitcontext/output/input 令牌上限、cost、options、headers等完整字段说明见 custom-models.md。免费与预算模型选择不需要付费 API key 也能高效使用 Kilo CodeAuto Efficientkilo-auto/efficient按任务难度实时分类路由到经基准验证对该任务足够准确的最便宜模型将每个请求的成本压到最低Auto Freekilo-auto/free自动路由到当前可用的最佳免费模型是免费起步最快的方式偏好手动选择时可在模型选择器中输入free过滤出免费模型。完整零成本配置见 using-kilo-for-free.md。注意免费模型的可用性会随 provider 调整促销周期而变化请以产品内实时榜单为准。关于 Auto Free 的数据处理Auto Free 可能将请求路由到会记录提示词与输出并用于改进服务的 provider尤其可能路由到 NVIDIA 的免费端点因此使用 Auto Free 时请勿提交个人或机密数据。NVIDIA 免费端点Super/Ultra 等仅限试用用途使用会被记录用于安全目的及改进 NVIDIA 产品与服务。详见 auto-model.md。Auto 各档位一览详见 auto-model.md 与 models-and-providers.md档位适用场景定价路由策略kilo-auto/frontier需要最强能力付费推理重任务plan/architect/debug 等路由到anthropic/claude-opus-4.7实现类任务code/build/explore路由到anthropic/claude-sonnet-4.6kilo-auto/efficient追求单任务最低成本付费会话感知的难度分类按 API 接口回退到基线模型Completions→qwen/qwen3.6-plus、Responses→openai/gpt-5.5、Messages→anthropic/claude-sonnet-4.6kilo-auto/free免费起步免费从当前可用免费模型集合中按会话动态选择映射由服务端更新kilo-auto/small轻量后台任务视账户而定有余额→google/gemma-4-31b-it无余额→google/gemma-4-26b-a4b-it:free各档位底层模型由服务端持续更新——档位 ID 保持稳定路由到的具体模型可能随时间变化。上下文窗口与 Max Tokens 取舍上下文窗口大小直接影响工作流这一点不会随时间改变小型项目脚本、组件32–64K tokens 即可胜任标准应用128K tokens 足以处理大部分多文件上下文大型代码库256K tokens 有助于跨系统理解超大规模系统存在 1M token 模型但在极端规模下有效性会衰减。各模型的具体上下文限制可查阅 ai-providers 文档如 Anthropic 的 200K、Groq 的 128K、Moonshot 的 200K 等。技巧思考型模型的 Max Tokens 要克制。分配给输出的每个 token 都会挤占存储对话历史的空间。建议仅在 Architect、Debug 等模式下使用较高的Max Tokens/Max Thinking TokensCode 模式保持在 16k 以下。恢复技巧遇到上下文上限错误时。若触发input length and max tokens exceed context limit错误可通过删除一条消息、回滚到之前的检查点或临时切换到长上下文模型如 Gemini处理一条消息来恢复。从实现角度看limit.context决定何时触发对话压缩limit.output以max_tokens形式发送给 provider 并默认封顶 32,000 tokens可通过KILO_EXPERIMENTAL_OUTPUT_TOKEN_MAX环境变量调整。若自定义模型未设置limit且不在内置目录中context与output会解析为0导致压缩被禁用、对话无界增长直到 provider 拒绝请求——因此自定义/本地模型务必显式设置limit.context与limit.output见 custom-models.md。委派Delegation时的模型行为当代理通过task工具把工作委派给子代理时子代理默认继承父代理的模型。可在配置中按子代理覆盖{ agent: { explore: { model: anthropic/claude-haiku-4-20250514 } } }上面的配置让explore子代理无论父代理用什么模型始终使用 Haiku任何没有model覆盖的子代理都使用发起方代理当前运行的模型。VS Code 端的等价操作通过 Settings打开Settings → Models → Model per Mode找到子代理并选择其模型通过配置文件编辑kilo.jsonc写入同样的agent.name.model条目。Settings 界面写入的正是agent.name.model两种方式效果一致。子代理的完整配置提示词、模式、工具、权限见 custom-subagents.md其中model字段注释明确未设置时子代理继承发起主代理的模型。源码层面的解析顺序可在 task.ts 的KiloTask.defaultModel中看到依次检查 workflow 直接指定 → 已保存的子代理状态 →agent.model直接指定→subagent_model配置且支持subagent_variant_overrides对特定模型做变体覆盖。通过链接选择模型或代理VS Code 深链VS Code 扩展注册了vscode://协议处理器可打开 VS Code 并自动选择模型、代理或两者无需手动操作选择器——适合分享模型推荐、从网页启动指定模型档位或快速切换到偏好的代理。URL 格式model与agent参数至少提供一个vscode://kilocode.kilo-code/kilocode/switch?modelmodelID vscode://kilocode.kilo-code/kilocode/switch?agentagentName vscode://kilocode.kilo-code/kilocode/switch?modelmodelIDagentagentNamemodelID使用 Kilo Gateway 模型 ID如kilo-auto/freeagentName使用可见的主代理 ID如code、plan而不是显示名称。示例Auto Free打开 Kilo Code 并切换到 Auto Free 档位kilo-auto/freevscode://kilocode.kilo-code/kilocode/switch?modelkilo-auto%2Ffree仅切换到 Plan 代理并使用其常规模型选择vscode://kilocode.kilo-code/kilocode/switch?agentplan同时选择两者vscode://kilocode.kilo-code/kilocode/switch?modelkilo-auto%2Ffreeagentplan技巧在 HTML 链接等裸斜杠可能被误解析的场景中嵌入该 URL 时请将模型 ID 中的/编码为%2F。工作原理VS Code 已打开聚焦 Kilo 侧边栏并立即将链接中的选择应用到当前会话VS Code 未打开先启动 VS Code待扩展就绪后再应用选择提供model时它必须是当前 Kilo Gateway 目录中的模型无效或不可用的模型会导致深链被忽略提供agent时它必须是可见的主代理无效或不可用的代理会导致深链被忽略仅含agent的链接使用该代理正常情况下会选用的模型两个参数同时出现时先选择代理再让链接中的模型应用到该代理选择遵循与使用选择器相同的优先级更新当前会话无活动会话时更新下一个会话不会更改设置中的配置默认值。实现层面extension.ts 中的 URI 处理器匹配/kilocode/switch与/kilocode/model路径解析model与agent查询参数后调用provider.selectKiloModel(modelID, agent)两个参数都缺失时直接忽略。分享与嵌入可将链接嵌入网页a hrefvscode://kilocode.kilo-code/kilocode/switch?modelkilo-auto%2Ffreeamp;agentplan Open Kilo Code with Auto Free in Plan /a或作为纯 URL 分享用户粘贴到浏览器地址栏即可。保持对模型格局的跟踪AI 模型领域变化极快。评估新选项时以产品内实时模型榜单为准并时常回看今天的最佳选择下个月可能就不再是了——这本身就是这个领域有趣的地方。从仓库侧看模型的可用性与能力清单也在持续演进内置目录会定期刷新custom-models.md 中提到 Kilo 内置 models.dev 快照并每小时刷新因此以实时数据为准永远比依赖静态记忆更可靠。【免费下载链接】kilocodeKilo is the all-in-one agentic engineering platform. Build, ship, and iterate faster with the most popular open source coding agent.项目地址: https://gitcode.com/GitHub_Trending/ki/kilocode创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

关于本文作者

来自尧图内容编辑团队

尧图内容编辑团队 内容团队

尧图内容编辑团队

本文由尧图网络内容编辑团队执笔。团队由资深项目经理、前端工程师与设计师组成,所有内容均来自亲手交付的真实项目,先讲清问题、再给出可落地的解法。尧图深耕北京网站建设十年,服务过京华建材集团、智造科技等各行业客户,把一线经验沉淀为可复用的行业观察。

  • 十年建站经验,覆盖建材、制造、服务、文创等
  • 项目经理把关选题与事实准确性
  • 工程师与设计师联合撰写专业细节
  • 统一编辑规范,保证文风与排版一致
  • 每月复盘转化数据,迭代选题方向

延伸阅读

相关资讯与近期热门内容

深度阅读推荐

建站决策前值得细读的三篇

网站改版的5个关键决策
2024-08-12

网站改版的5个关键决策

什么时候该改版、改到什么程度、如何避免流量掉光,京华建材集团改版复盘给出答案。

获取专属建站方案

看完文章,把您的行业与预算告诉我们,免费获取一份量身定制的官网建设方案与报价。

立即免费咨询