Kimi-Code配置自定义模型

作者:Administrator 发布时间: 2026-07-23 阅读量:0 评论数:0

自定义模型配置说明

背景

vLLM 服务运行在 http://xxxx:8060,暴露 OpenAI 兼容接口。通过 GET http://xxxx:8060/v1/models 查询到可用模型为 qwen3.5-27bmax_model_len = 262144

配置过程

  1. 确认 kimi CLI 已安装且 ~/.kimi-code/ 目录存在。
  2. 创建 ~/.kimi-code/config.toml,内容如下。
  3. 运行 kimi doctor 验证配置语法正确。
  4. 启动 kimi 即可使用。

配置文件

路径:~/.kimi-code/config.toml

default_model = "vllm/qwen3.5-27b"

[providers.vllm]
type = "openai"
base_url = "http://xxxx:8060/v1"
api_key = "not-needed"

[models."vllm/qwen3.5-27b"]
provider = "vllm"
model = "qwen3.5-27b"
max_context_size = 262144

字段说明

  • [providers.vllm] — 定义一个名为 vllm 的 provider,类型为 openai(vLLM 兼容 OpenAI Chat Completions 协议),base_url 为 vLLM 服务地址,api_key 设为 "not-needed"(vLLM 通常不校验)。
  • [models."vllm/qwen3.5-27b"] — 定义一个模型别名 vllm/qwen3.5-27b,绑定到 vllm provider,模型名与原 vLLM 中的 id 一致,max_context_size 取自 max_model_len
  • default_model — 设为全局默认,启动 kimi 时自动使用此模型。

验证

kimi doctor
# 输出: OK config.toml  /home/debian/.kimi-code/config.toml

使用方式

直接启动使用默认模型:

kimi

如需临时切换其他已配置的模型,可用 -m 指定:

kimi -m vllm/qwen3.5-27b

评论