自定义模型配置说明
背景
vLLM 服务运行在 http://xxxx:8060,暴露 OpenAI 兼容接口。通过 GET http://xxxx:8060/v1/models 查询到可用模型为 qwen3.5-27b,max_model_len = 262144。
配置过程
- 确认
kimiCLI 已安装且~/.kimi-code/目录存在。 - 创建
~/.kimi-code/config.toml,内容如下。 - 运行
kimi doctor验证配置语法正确。 - 启动
kimi即可使用。
配置文件
路径:~/.kimi-code/config.toml
default_model = "vllm/qwen3.5-27b"
[providers.vllm]
type = "openai"
base_url = "http://xxxx:8060/v1"
api_key = "not-needed"
[models."vllm/qwen3.5-27b"]
provider = "vllm"
model = "qwen3.5-27b"
max_context_size = 262144
字段说明
[providers.vllm]— 定义一个名为vllm的 provider,类型为openai(vLLM 兼容 OpenAI Chat Completions 协议),base_url为 vLLM 服务地址,api_key设为"not-needed"(vLLM 通常不校验)。[models."vllm/qwen3.5-27b"]— 定义一个模型别名vllm/qwen3.5-27b,绑定到vllmprovider,模型名与原 vLLM 中的id一致,max_context_size取自max_model_len。default_model— 设为全局默认,启动kimi时自动使用此模型。
验证
kimi doctor
# 输出: OK config.toml /home/debian/.kimi-code/config.toml
使用方式
直接启动使用默认模型:
kimi
如需临时切换其他已配置的模型,可用 -m 指定:
kimi -m vllm/qwen3.5-27b