Kilo AI Gateway 模型与 Provider 完全指南:统一 API、免费模型与 Auto 自动路由实战
Kilo AI Gateway 模型与 Provider 完全指南统一 API、免费模型与 Auto 自动路由实战【免费下载链接】kilocodeKilo is the all-in-one agentic engineering platform. Build, ship, and iterate faster with the most popular open source coding agent.项目地址: https://gitcode.com/GitHub_Trending/ki/kilocodeKilo AI Gateway 是 Kilo 项目提供的一套统一 AI 网关服务通过单一 API 接口聚合了数百个来自 Anthropic、OpenAI、Google、DeepSeek、MiniMax 等厂商的大模型并内置了按任务难度自动路由的kilo-auto/*虚拟模型。本文以仓库文档 models-and-providers.md 为主体结合 kilo-gateway 包的源码与测试完整讲解模型 ID 规范、可用模型清单、免费模型限流规则以及 Auto 虚拟模型的各层路由策略帮助你无需修改任何业务代码即可在不同模型之间自由切换。模型标识规范provider/model-name格式Kilo AI Gateway 中的每个模型都通过provider/model-name这种厂商前缀 模型名称的二元格式唯一标识例如anthropic/claude-sonnet-4.6、openai/gpt-5.4。切换模型时只需改变这个模型 ID 字符串无需修改任何业务代码——这正是统一网关的核心价值所在。从源码角度看这种provider/...的 ID 结构贯穿整个网关实现。在 packages/kilo-gateway/src/api/models.ts 的extractFamily函数中网关会按/拆分模型 ID并从claude、gpt、gemini、llama、mistral等关键词推断模型家族family而模型目录的元数据中还会携带ai_sdk_provider字段取值限定为anthropic、openai、openai-compatible、openrouter四种见 packages/kilo-gateway/src/api/constants.ts这决定了网关在底层使用哪个 AI SDK 适配器来对接上游。如何指定模型SDK 与原生 API 两种方式方式一通过 Kilo AI SDKTypeScript在基于 Vercel AI SDKstreamText的代码中通过kilo.chat(...)传入模型 IDconst result streamText({ model: kilo.chat(anthropic/claude-sonnet-4.6), prompt: Hello!, })这里的kilo实例由网关包导出的createKilo()工厂函数创建。在 packages/kilo-gateway/src/provider.ts 中可以看到createKilo(options)会读取KILOCODE_API_KEY等环境变量或显式传入的kilocodeToken并把 OpenRouter 兼容端点resolveKiloOpenRouterBaseUrl(...)作为baseURL最终通过createOpenRouter、createAnthropic、createOpenAI等多个 SDK 适配器统一封装对外暴露languageModel(modelId)等方法。完整的接入方式可参考 packages/kilo-gateway/README.mdimport { createKilo } from kilocode/kilo-gateway const provider createKilo({ kilocodeToken: process.env.KILOCODE_API_KEY, kilocodeOrganizationId: org-123, }) const model provider.languageModel(anthropic/claude-sonnet-4)方式二原生 HTTP API 请求如果你不使用 SDK直接向 Chat Completions 兼容端点发送 JSON 即可{ model: anthropic/claude-sonnet-4.6, messages: [{ role: user, content: Hello! }] }网关包内部对这类请求的路由处理可以在 packages/kilo-gateway/src/api/url.ts 中找到依据resolveKiloGatewayBaseUrl与resolveKiloOpenRouterBaseUrl会把请求路径规范化为/api/gateway/与/api/openrouter/两个前缀前者面向 Kilo 专属能力画像、组织、FIM、编辑、图片生成、语音转写等见 packages/kilo-gateway/src/server/routes.ts后者面向 OpenRouter 兼容的模型调用与目录。浏览可用模型Models 端点完整的模型清单通过以下端点获取无需任何认证GET https://api.kilo.ai/api/gateway/models响应包含每个模型的定价pricing、上下文窗口context window和受支持的特性supported features。从源码来看网关层使用 zod schema 对响应做严格校验packages/kilo-gateway/src/api/models.ts 中的openRouterModelSchema并把 OpenRouter 返回的原始字段转换为内部统一的模型格式context_length / max_completion_tokens上下文窗口与最大输出 token 数输出上限还会参考top_provider.max_completion_tokens缺省时按context_length * 0.2估算pricingAPI 返回的单价为每 token 美元网关通过parseApiPrice统一换算为每百万 token 美元并拆分为input、output、cache_read、cache_write四个成本字段当价格为负值如动态/自动路由定价时该模型的 cost 会被省略——这一点在 packages/kilo-gateway/test/api/models.test.ts 的 omits cost when pricing contains negative values 测试中得到了验证supported_parameters模型支持的能力集合网关据此判断是否支持tools工具调用、reasoning推理、temperature等参数。特别值得注意的是不显式声明支持tools的模型会被直接过滤掉因为 Kilo 的 Agent 工作流强制要求工具调用能力terminalBench模型的终端智能体基准评测分数overallScore与单次任务平均成本avgAttemptCostUsd数据格式不完整时会安全地跳过该字段而不影响整个目录autoRoutingkilo-auto/*虚拟模型的路由元数据列出候选底层模型列表后文详述isFree / mayTrainOnYourPrompts / hasUserByokAvailable是否免费、上游是否可能使用你的提示词训练、是否支持 BYOK。热门模型一览下表列出当前比较常用的模型模型清单与厂商会随上游提供方的定价与可用性变化请以 Models 端点返回的实时数据为准Model IDProviderDescriptionanthropic/claude-opus-4.7AnthropicMost capable Claude model for complex reasoninganthropic/claude-sonnet-4.6AnthropicBalanced performance and costanthropic/claude-haiku-4.5AnthropicFast and cost-effectiveopenai/gpt-5.4OpenAILatest GPT modelopenai/gpt-5.4-miniOpenAIFast and efficientgoogle/gemini-3.1-pro-previewGoogleAdvanced reasoninggoogle/gemini-2.5-flashGoogleFast and efficientx-ai/grok-4SpaceXAIMost capable Grok modelx-ai/grok-code-fast-1SpaceXAIOptimized for code tasksdeepseek/deepseek-v3.2DeepSeekStrong coding and reasoning modelmoonshotai/kimi-k2.5MoonshotStrong coding and multilingual modelminimax/minimax-m2.7MiniMaxHigh-performance MoE model免费模型与匿名限流Kilo Gateway 提供若干零成本模型仅受速率限制约束Model IDDescriptionstepfun/step-3.7-flash:freeStepFun Step 3.7 Flashpoolside/laguna-s-2.1:freePoolside Laguna S 2.1poolside/laguna-xs-2.1:freePoolside Laguna XS 2.1nvidia/nemotron-3-ultra-550b-a55b:freeNVIDIA Nemotron 3 Ultratencent/hy3:freeTencent Hy3openrouter/freeBest available free model免费模型对已认证用户和匿名用户同样开放其中匿名用户按 IP 维度限流为每小时 200 次请求。需要特别留意 NVIDIA 免费端点Super/Ultra 等的使用条款此类端点仅供试用禁止提交个人或敏感数据你的使用记录会被记录用于安全目的及 NVIDIA 产品服务的改进用于改进用途的会话数据不会关联到你的身份或任何持久化标识与该端点交互即视为同意相关的数据收集、记录与使用以及 NVIDIA API 试用服务条款详见其隐私政策与试用条款原文。Auto 虚拟模型按层级自动路由除了直接指定具体模型Kilo Gateway 还提供kilo-auto/*系列虚拟模型。它们的 ID 保持稳定但底层映射的模型会由服务端动态调整——当上游出现更优选项或提供方调整定价与可用性时映射会自动更新你无需改动任何代码。kilo-auto/frontier面向任何任务的最高性能与能力。Frontier 请求会以中等推理强度medium reasoning effort和中等详细度medium verbosity发送并通过x-kilocode-mode请求头选择底层模型ModeResolved Modelplan,general,architect,orchestrator,ask,debuganthropic/claude-opus-4.7build,explore,codeanthropic/claude-sonnet-4.6Default (no / unknown mode)anthropic/claude-sonnet-4.6kilo-auto/efficient会话感知路由根据任务难度为每次请求分类路由到已被证明足以胜任该任务的最便宜模型。当无法做出有信心的路由决策时请求会回退到由客户端所用 API 接口决定的基线模型API interfaceResolved ModelReasoning effortCompletions (default)qwen/qwen3.6-plusenabledResponses APIopenai/gpt-5.5lowMessages APIanthropic/claude-sonnet-4.6low从源码看kilo-auto/efficient的路由元数据会以autoRouting.models字段随模型目录下发。在 packages/kilo-gateway/test/api/models.test.ts 的 preserves Auto Efficient routing metadata 测试中kilo-auto/efficient的autoRouting被解析为[google/gemini-2.5-flash, anthropic/claude-sonnet-4.6]这样的候选列表服务端会据此在候选池内做难度分级与择优路由。kilo-auto/free免费、能力有限无需消耗任何额度。解析出的模型会在每次会话中从一个精选的免费模型集合里动态选择映射随免费模型的可用性变化而由服务端更新。⚠️Auto Free 的数据处理提醒Auto Free 可能把请求路由到会记录提示词与输出、并将其用于改进自身服务的提供方。使用 Auto Free 时请勿提交个人或敏感数据尤其是它可能路由到 NVIDIA 的免费端点相关条款见上文 NVIDIA 试用条款说明。kilo-auto/small自动路由到一个体积小、速度快的小模型专为轻量后台任务设计如会话标题生成、commit message 生成、摘要等ConditionResolved ModelAccount has paid balancegoogle/gemma-4-31b-itNo balance / free accountgoogle/gemma-4-26b-a4b-it:free这一层级的定位在 packages/kilo-gateway/src/api/constants.ts 中也得到印证网关的默认模型常量DEFAULT_MODEL与匿名/免费用户的默认模型DEFAULT_FREE_MODEL均被设置为kilo-auto/free意味着未显式指定模型时网关会以 Auto 免费路由作为兜底。完整示例请求 Auto 模型直接在请求体中指定 Auto 模型{ model: kilo-auto/frontier, messages: [{ role: user, content: Help me design a database schema }] }配合 mode 请求头让路由感知当前任务模式curl -X POST https://api.kilo.ai/api/gateway/chat/completions \ -H Authorization: Bearer $KILO_API_KEY \ -H x-kilocode-mode: plan \ -H Content-Type: application/json \ -d {model: kilo-auto/efficient, messages: [{role: user, content: Design a database schema}]}网关层的可靠性保障机制从源码层面Kilo Gateway 对模型目录的获取做了一系列健壮性处理这些机制同样作用于你在客户端看到的模型列表401 自动回退携带过期 token 请求目录时若第一个请求返回 401网关会自动改走公共端点重试一次packages/kilo-gateway/test/api/models.test.ts 的 falls back to public endpoint on 401 测试验证了恰好两次调用但组织organization作用域的 401 永不回退到个人模型目录避免组织数据悄悄泄露到个人空间never retries an organization-scoped 401 测试覆盖了六种带组织参数的组合错误分类网络异常network、HTTP 错误http含状态码、schema 校验失败schema、未授权unauthorized被严格区分便于上层精确处理超时控制模型请求使用 10 秒超时MODELS_FETCH_TIMEOUT_MS避免上游挂起拖垮客户端组织模式缓存组织自定义模式mode通过 packages/kilo-gateway/src/api/modes.ts 以 5 分钟 TTL 的内存缓存读取切换组织时通过clearModesCache()主动失效。总结Kilo AI Gateway 通过provider/model-name的模型 ID 规范把数百个上游模型收敛到一套统一 API 之下配合免认证的 Models 目录端点、面向匿名用户的免费模型与kilo-auto/*分层自动路由让开发者能够以最小的心智负担完成模型的接入与切换。实操时记住三条要点直接指定模型用provider/model-name格式动态择优用kilo-auto/*层级frontier / efficient / free / small敏感数据务必避开 Auto Free 与 NVIDIA 免费端点。更完整的接入流程可继续阅读 quickstart.md、authentication.md 与 api-reference.md或直接查看网关实现 packages/kilo-gateway/src/api/models.ts 与配套测试 packages/kilo-gateway/test/api/models.test.ts。【免费下载链接】kilocodeKilo is the all-in-one agentic engineering platform. Build, ship, and iterate faster with the most popular open source coding agent.项目地址: https://gitcode.com/GitHub_Trending/ki/kilocode创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考