模型与计费 / 支持的模型

支持的模型

灵犀指 IDE 原生支持 Kimi K3、GLM-5.2、DeepSeek-V4、Qwen3.6、豆包、MiniMax 等 15+ 主流模型,覆盖官方直连火山引擎等渠道。模型清单由内核从云端实时拉取,新上线的模型无需升级 IDE 即可使用。

可用模型以 IDE 为准:打开「设置 → AI 模型」,下拉框中的清单就是当前账号可用的全部模型。下表列出默认开启的代表性模型及其关键参数。

模型清单

模型厂商定位上下文视觉特点
kimi-k3Kimi(月之暗面)旗舰1M2.8 万亿参数,思考常驻,支持 reasoning_effort(low / high / max)调节思考深度,自动前缀缓存
kimi-k2.7-codeKimi(月之暗面)标准256K编程专用模型,始终开启思考,支持图片 / 视频输入,面向 Agent 任务
glm-5.2智谱 GLM旗舰1MIndexShare 索引复用架构,五档思考强度(Low / Medium / High / Extra / Max),原生 MCP 工具调用
deepseek-v4-proDeepSeek旗舰1M1.6T 参数 MoE,默认思考模式,Agentic Coding 开源 SOTA
qwen3.8-max-preview通义千问旗舰1M仅思考模式(无法关闭),最强推理能力,支持结构化输出
qwen3.7-max通义千问旗舰1M混合思考模式(默认开启),支持内置工具
qwen3.7-plus通义千问标准1M混合思考模式,高性价比,支持结构化输出
minimax-m3MiniMax旗舰1MMSA 稀疏注意力,原生多模态(图片 / 视频),最大输出 512K
minimax-m2.7MiniMax标准200K229B 参数 MoE(激活 10B),思考模式强制开启

思考模式因模型而异:Kimi K3 思考常驻,通过 reasoning_effort 控制思考深度;GLM-5.2 的深度思考需要开启 thinking 并设置 clear_thinking: false。这些参数由内核按模型能力自动适配,切换模型后无需手工处理。

接入渠道

同一模型可由多个渠道提供,IDE 会按配置选择可用渠道:

渠道类型说明
官方直连api智谱 GLM、DeepSeek、阿里通义千问、月之暗面 Kimi、MiniMax 官方 API
火山引擎api字节跳动火山引擎聚合渠道,上表主流模型均可经此接入
Coding Plan / Agentplan / agent智谱 Plan、火山引擎 Plan 等套餐化渠道,需对应厂商的订阅

此外还接入硅基流动等聚合渠道。渠道与模型的上下架由服务端统一管理,实际可用组合以 IDE 模型选择器为准

切换模型

  1. 打开「设置 → AI 模型」。
  2. 在「默认模型」下拉框中选择模型——选择后同时应用到 AI 对话、内联编辑与 RUSH 任务
  3. 如果下拉框为空,通常是网络或内核未就绪,稍等片刻或重启 IDE 即可。
!

上下文不是越大越好:超长上下文会增加单次请求的耗时与(BYOK 时的)厂商费用。日常对话建议选择标准档模型,RUSH 深度任务再切换旗舰模型。

下一步