模型与计费 / 支持的模型
支持的模型
灵犀指 IDE 原生支持 Kimi K3、GLM-5.2、DeepSeek-V4、Qwen3.6、豆包、MiniMax 等 15+ 主流模型,覆盖官方直连与火山引擎等渠道。模型清单由内核从云端实时拉取,新上线的模型无需升级 IDE 即可使用。
✦
可用模型以 IDE 为准:打开「设置 → AI 模型」,下拉框中的清单就是当前账号可用的全部模型。下表列出默认开启的代表性模型及其关键参数。
模型清单
| 模型 | 厂商 | 定位 | 上下文 | 视觉 | 特点 |
|---|---|---|---|---|---|
kimi-k3 | Kimi(月之暗面) | 旗舰 | 1M | ✓ | 2.8 万亿参数,思考常驻,支持 reasoning_effort(low / high / max)调节思考深度,自动前缀缓存 |
kimi-k2.7-code | Kimi(月之暗面) | 标准 | 256K | ✓ | 编程专用模型,始终开启思考,支持图片 / 视频输入,面向 Agent 任务 |
glm-5.2 | 智谱 GLM | 旗舰 | 1M | — | IndexShare 索引复用架构,五档思考强度(Low / Medium / High / Extra / Max),原生 MCP 工具调用 |
deepseek-v4-pro | DeepSeek | 旗舰 | 1M | — | 1.6T 参数 MoE,默认思考模式,Agentic Coding 开源 SOTA |
qwen3.8-max-preview | 通义千问 | 旗舰 | 1M | — | 仅思考模式(无法关闭),最强推理能力,支持结构化输出 |
qwen3.7-max | 通义千问 | 旗舰 | 1M | — | 混合思考模式(默认开启),支持内置工具 |
qwen3.7-plus | 通义千问 | 标准 | 1M | ✓ | 混合思考模式,高性价比,支持结构化输出 |
minimax-m3 | MiniMax | 旗舰 | 1M | ✓ | MSA 稀疏注意力,原生多模态(图片 / 视频),最大输出 512K |
minimax-m2.7 | MiniMax | 标准 | 200K | — | 229B 参数 MoE(激活 10B),思考模式强制开启 |
✦
思考模式因模型而异:Kimi K3 思考常驻,通过 reasoning_effort 控制思考深度;GLM-5.2 的深度思考需要开启 thinking 并设置 clear_thinking: false。这些参数由内核按模型能力自动适配,切换模型后无需手工处理。
接入渠道
同一模型可由多个渠道提供,IDE 会按配置选择可用渠道:
| 渠道 | 类型 | 说明 |
|---|---|---|
| 官方直连 | api | 智谱 GLM、DeepSeek、阿里通义千问、月之暗面 Kimi、MiniMax 官方 API |
| 火山引擎 | api | 字节跳动火山引擎聚合渠道,上表主流模型均可经此接入 |
| Coding Plan / Agent | plan / agent | 智谱 Plan、火山引擎 Plan 等套餐化渠道,需对应厂商的订阅 |
此外还接入硅基流动等聚合渠道。渠道与模型的上下架由服务端统一管理,实际可用组合以 IDE 模型选择器为准。
切换模型
- 打开「设置 → AI 模型」。
- 在「默认模型」下拉框中选择模型——选择后同时应用到 AI 对话、内联编辑与 RUSH 任务。
- 如果下拉框为空,通常是网络或内核未就绪,稍等片刻或重启 IDE 即可。
!
上下文不是越大越好:超长上下文会增加单次请求的耗时与(BYOK 时的)厂商费用。日常对话建议选择标准档模型,RUSH 深度任务再切换旗舰模型。
下一步
- 了解套餐内置额度与每日重置规则:套餐与配额。
- 已有厂商 Key?绑定后按厂商计费、平台零加价:自带 API Key。
- 在对话中使用思考模式与多模态能力:AI 对话指南。
本文对你有帮助吗?