第3课 · 选择合适的大模型
本节要点
- 了解为什么需要配置大模型,以及它对 AI Agent 能力的影响
- 掌握国内外主流模型的定价和特点
- 学会在 OpenCode 中接入 DeepSeek API
- 根据自己的用量选择最划算的方案
1. 为什么要配置大模型?
大模型就是 AI Agent 的大脑。大脑强不强,直接决定了它干活的品质。
OpenCode 的好处是:可以同时接入多家大模型厂商,随时切换。免费模型不够用的时候,你可以自己配国内的模型,灵活选择。
而且不同模型的价格差异非常大——从「几乎免费」到「每月几百元」都有。选对了,既省钱又好用。
2. 国内模型总览
DeepSeek — 推荐起步 ⭐
| 项目 | 详情 |
|---|---|
| 官网 | https://platform.deepseek.com |
| 模型 | DeepSeek V4-Flash、V4-Pro |
| 价格 | V4-Flash:输入 ¥1/百万token,输出 ¥2/百万token |
| V4-Pro:输入 ¥3/百万token(限时2.5折),输出 ¥6/百万token(限时2.5折) | |
| 缓存命中 | Flash ¥0.02/百万token(极便宜) |
| 上下文 | 1M(百万级 token) |
| 特点 | 价格屠夫,无需订阅,用多少付多少,国内直接访问 |
💡 强烈推荐先用 DeepSeek V4-Flash。 它的缓存命中率高达 90%+,实际花费极低——用 1 亿 token 大约只需 10 块钱。基本可以敞开了用。
DeepSeek 不需要包月订阅,充值余额即可按量付费。充值 20 块钱,够用很久。
⚠️ 群友反馈:V4-Flash 偶尔会"降智"
有群友发现,DeepSeek V4-Flash 便宜归便宜,但处理复杂任务时偶尔会"偷懒"——比如省略分析步骤、直接给结论、甚至忽略你明确要求的分点说明。这通常发生在任务复杂或上下文较长的时候。
解决办法:
- 简单任务、日常问答继续用 V4-Flash,最便宜
- 重要任务(写代码、审合同、复杂分析)切换到 V4-Pro,能力更稳定
- 也可以临时换到 GLM-5.1、Kimi K2.6 等编码能力强的模型试试
不要因为它便宜就所有任务都硬上 Flash,该换模型时就换。
⚠️ 群友反馈:DeepSeek API 高峰期会卡顿
有群友在下午/晚上高峰期遇到 OpenCode 一直显示"思考中"、响应极慢,切换付费模型也一样。这通常不是 OpenCode 或本地配置的问题,而是 DeepSeek API 高峰期算力不足。
解决办法:
- 先打开设置,勾选"显示推理摘要"(/thinking),看 AI 是否真的在思考
- 如果摘要空白或长时间无输出,大概率是 DeepSeek 服务端拥堵
- 等待非高峰期,或临时切换到 GLM、Kimi、MiniMax 等其他模型
- 重要工作避开晚上 17:00-21:00 的高峰期
智谱 GLM — 编码能力强
| 项目 | 详情 |
|---|---|
| 官网 | https://bigmodel.cn |
| Coding Plan | https://www.bigmodel.cn/glm-coding?ic=30ZSVNXKXY |
| 模型 | GLM-5.1、GLM-5-Turbo、GLM-4.7 |
| 价格 | Lite ¥49/月、Pro ¥149/月、Max ¥469/月 |
GLM-5.1 是目前国内编码能力最强的模型之一,仅次于最新的 Qwen3.7。
套餐有 5 小时滚动限额 + 周限额:
- Lite:~80 prompts/5h,~400/周(GLM-5 不可用,仅 GLM-4.7/4.6)
- Pro:~400 prompts/5h,~2000/周(全部模型可用)
- Max:~1600 prompts/5h,~8000/周(全部模型可用)
⚠️ 调用 GLM-5.1 会按「高峰期 3 倍、非高峰期 2 倍」系数消耗额度。建议复杂任务用 GLM-5.1,普通任务用 GLM-4.7。
包季享 9 折,包年享 7 折。
Kimi K2.6 — 多模态强
| 项目 | 详情 |
|---|---|
| Coding Plan | https://kimi.com/code |
| API 平台 | https://platform.kimi.ai |
| 模型 | Kimi K2.6 |
| API 价格 | 输入 $0.16~0.95/百万token,输出 $4.00/百万token |
| 上下文 | 256K |
Kimi K2.6 编码能力仅次于智谱 GLM,支持文本+图片+视频的多模态输入,256K 长上下文。有会员制(Moderato $15/月 ~ Vivace $159/月),包含 Kimi Code、Agent Swarm 等能力。
MiniMax M2.7 — 额度大、全模态
| 项目 | 详情 |
|---|---|
| 官网 | https://www.minimaxi.com |
| Token Plan | https://platform.minimaxi.com/docs/guides/pricing-token-plan |
| 模型 | MiniMax M2.7(标准版)、M2.7-highspeed(极速版) |
| 标准版价格 | Starter ¥29/月、Plus ¥49/月、Max ¥119/月 |
| 极速版价格 | Plus ¥98/月、Max ¥199/月、Ultra ¥899/月 |
MiniMax 的特点是额度非常充裕,适合用量大但对单次能力要求没那么极致的场景。Plus ¥49/月有 1500 次/5h 的额度,性价比不错。
支持文本+语音+图像+视频+音乐的全模态,一个订阅全覆盖。支持支付宝/微信支付。
阿里云百炼 — 多模型聚合
| 项目 | 详情 |
|---|---|
| 官网 | https://bailian.console.aliyun.com |
| 购买页 | https://www.aliyun.com/benefit/scene/codingplan |
| 模型 | Qwen3.6-Plus、Qwen3.7-Max、Kimi K2.5、GLM-5、MiniMax M2.5 等 7+ 模型 |
| 价格 | Pro ¥200/月(Lite 已停售) |
| 额度 | ~90,000 次请求/月 |
阿里百炼的最大优势是一个订阅能用 7+ 个模型,包括 Qwen、Kimi、GLM、MiniMax 等,随意切换。支持 Cursor、Claude Code、OpenCode 等主流工具。
⚠️ 每日限量抢购(9:30 开售),不一定买得到。
腾讯 TokenHub
| 项目 | 详情 |
|---|---|
| 官网 | https://cloud.tencent.com/document/product/1823 |
| 价格 | Lite ¥40/月、Pro ¥200/月 |
| 模型 | 自研 Hy3 + 第三方 GLM-5、Kimi K2.5、MiniMax M2.5 |
腾讯 TokenHub 是较新的入局者,Lite ¥40/月入门门槛低。
其他国内厂商
- 小米 MiMo:MiMo-V2.5 / V2.5-Pro,已接入 OpenCode Go,可尝试
- 京东:也有 Coding Plan,但生态较小
3. OpenCode Go — 一站式订阅 🚀
| 项目 | 详情 |
|---|---|
| 官网 | https://opencode.ai/zh/go |
| 价格 | 首月 $5,之后 $10/月 |
| 额度 | 每 5 小时 $12、每周 $30、每月 $60 |
| 模型 | 12 款:GLM-5/5.1、Kimi K2.5/K2.6、DeepSeek V4 Pro/Flash、MiniMax M2.5/M2.7、Qwen3.6 Plus、Qwen3.7 Max、MiMo-V2.5/V2.5-Pro |
OpenCode Go 是 OpenCode 官方推出的订阅服务,相当于一个聚合套餐——花 $10/月就能用 12 款模型随意切换。
按美元计价,首月 $5(约 35 元人民币),可以用国内模型也可以用国外模型。额度用完后可以继续用免费模型,或者从 Zen 余额扣费。
⚠️ 需要 GitHub 或 Google 账号登录订阅。
💡 通过我的推荐链接 https://opencode.ai/go?ref=CRGDXX1P4N 注册,双方均可获得 $5 使用额度。首月 $5,之后的月份 $10/月。支持支付宝支付。
4. 国外模型
| 厂商 | 模型 | 价格 | 特点 |
|---|---|---|---|
| Anthropic | Claude Sonnet 4.6 | $20/月 | 编程最强,~45次/5小时 |
| Anthropic | Claude Opus 4.7/4.8 | 含 Max $100-200 | SWE-Bench 80.8%,最强但最贵 |
| OpenAI | GPT-5.4 | $20/月 | Codex CLI,1M上下文,生图能力强 |
| Gemini 3.1 Pro | 免费 | 最佳免费选项,1M上下文 |
⚠️ Claude 会员在国内不可用,有梯子也容易封号,不建议购买。想用国外模型,可以考虑 OpenAI(有梯子+能充值即可用)或 Google Gemini(有免费额度)。
5. 价格对比一览
| 方案 | 月费 | 适合人群 |
|---|---|---|
| DeepSeek V4-Flash 按量 | ≈¥10(日常用量) | 入门尝鲜,几乎免费 |
| MiniMax Starter | ¥29 | 轻度使用 |
| 智谱 GLM Lite | ¥49 | 日常编程,稳定 |
| OpenCode Go | $10(≈¥70) | 想换多个模型试试 |
| 阿里百炼 Pro | ¥200 | 重度使用,多模型需求 |
| Claude Pro | $20 | 最强,但需梯子+风险 |
6. 实操:在 OpenCode 中接入 DeepSeek
第一步:注册 DeepSeek 开发平台
- 浏览器搜索「DeepSeek API」或直接访问 https://platform.deepseek.com
- 注册账号,完成实名认证
- 充值 ¥20(够用很久)
第二步:创建 API Key
- 进入控制台,找到「API Keys」
- 点击「创建」,随便起个名字(比如"测试")
- 复制并保存好这个 Key(只显示一次,不过也不用留存它,下一次需要用再创建一个就可以)



第三步:在 OpenCode 中配置
- 打开 OpenCode,点击左侧「设置」⚙️
- 点击「提供商」
- 搜索「DeepSeek」,点击添加
- 粘贴刚才复制的 API Key
- 点击提交
第四步:开始使用
配置完成后,在模型列表中选择 DeepSeek V4-Flash,输入"你好"测试一下——如果 AI 正常回复,说明连接成功了。
V4-Flash 基本够用。觉得效果不够好,可以切换到 V4-Pro(贵一点点,能力更强)。
7. 省钱配置技巧(装插件后必看)
如果你安装了 oh-my-opencode-slim 等多智能体插件,不同 Agent 会消耗不同模型。有群友反馈一天 API 费用高达 15 元,nigo 建议按角色分配模型,可以降到 5 元以内:
| Agent 角色 | 推荐模型 | 原因 |
|---|---|---|
| Orchestrator(编排者/项目经理) | DeepSeek V4-Flash | 调用最频繁,用便宜的 |
| Oracle(专家顾问/复杂推理) | DeepSeek V4-Pro | 需要深度思考,用强的 |
| Fixer/Explorer 等执行角色 | DeepSeek V4-Flash | 量大但简单,用便宜的 |
核心原则:
- 只有真正需要深度推理的环节才用 Pro
- 日常编排、执行、搜索等大量调用都用 Flash
- 如果某天突然费用飙升,先检查是不是 orchestrator 被设成了 Pro
💡 配置时可以让 AI 说:"帮我把 orchestrator 改成 flash,oracle 保持 pro,其他全部改成 flash。"
8. 我的推荐
🎯 别纠结,照着选就行。
按量付费(推荐起步)
DeepSeek API — 不用想,就用它。充值 20 块够用一两个月,几乎零门槛。
国内 Coding Plan
需要订阅的话,推荐顺序:
| 排名 | 方案 | 月费 | 推荐理由 |
|---|---|---|---|
| 🥇 | 智谱 GLM | ¥49 起 | 编码能力国内最强之一,套餐稳定 |
| 🥈 | Kimi K2.6 | $19 起 | 多模态强,Agent 能力好 |
| 🥉 | MiniMax M2.7 | ¥29 起 | 额度充裕,全模态,性价比高 |
⚠️ 阿里百炼、腾讯 TokenHub、OpenCode Go 等方案目前不推荐——要么抢购难买,要么性价比不如上面三个。
国外模型
OpenAI GPT($20/月)— 有梯子、能充值就用这个,综合能力强。
⚠️ Claude 会员在国内有封号风险,不推荐购买。
延伸阅读 📚
想深入了解国内各家 Coding Plan 套餐怎么选、怎么把额度用出最大价值,推荐阅读这篇文章:
国内 AI Coding Plan 指南:高性价比套餐对比 × 榨干 GLM × 套餐选择
作者对比了智谱、OpenCode Go、Kimi Code 等主流方案的实际额度、计费规则和省钱技巧,还分享了多模型路由配置、错峰使用、任务分级等进阶玩法,非常适合准备长期付费订阅的学员参考。
不懂就问 💬
遇到以下情况,直接在 OpenCode 里问 AI:
- 不确定该选哪个模型 → "帮我比较一下 DeepSeek 和 GLM 的区别"
- 不懂什么是 API Key → "什么是 API Key?怎么创建?"
- 不知道自己用量多大 → "帮我估算一下,每天写 2 小时代码大概消耗多少 token"