第3课 · 选择合适的大模型
本节要点
- 了解为什么需要配置大模型,以及它对 AI Agent 能力的影响
- 掌握国内外主流模型的定价和特点(2026 年 8 月后有大量价格变动,本节均为最新数据)
- 知道哪些模型已经自带"眼睛"(多模态),可以直接看图
- 学会在 OpenCode 中接入 DeepSeek API
- 根据自己的用量选择最划算的方案
1. 为什么要配置大模型?
大模型就是 AI Agent 的大脑。大脑强不强,直接决定了它干活的品质。
OpenCode 的好处是:可以同时接入多家大模型厂商,随时切换。免费模型不够用的时候,你可以自己配国内的模型,灵活选择。
而且不同模型的价格差异非常大——从「几乎免费」到「每月几百元」都有。选对了,既省钱又好用。
2. 国内模型总览
DeepSeek — 推荐起步 ⭐
| 项目 | 详情 |
|---|---|
| 官网 | https://platform.deepseek.com |
| 模型 | DeepSeek V4-Flash、V4-Pro、V4-Flash-Vision-Exp(新,会看图) |
| 价格(2026-08-17 涨价后) | 峰谷两档,空闲时段是高峰时段的一半 |
| V4-Flash / Vision-Exp:输入 ¥1.5~3 / 百万token,输出 ¥4.5~9 / 百万token | |
| V4-Pro:输入 ¥4.5~9 / 百万token,输出 ¥13.5~27 / 百万token | |
| 缓存命中 | Flash ¥0.05~0.1、Pro ¥0.15~0.3 / 百万token(依然极便宜) |
| 上下文 | 1M(百万级 token) |
| 特点 | 无需订阅,用多少付多少,国内直接访问;高峰期 = 周一至周五 9:00-12:00、14:00-18:00 |
💡 仍然推荐 DeepSeek 起步——而且现在可以直接选"带眼睛"的版本。
2026 年 8 月下旬,DeepSeek 上线了视觉实验模型
deepseek-v4-flash-vision-exp:价格与 V4-Flash 完全一致(同样分峰谷),但它看得懂截图、报表照片、报错界面。新手直接把它当主力:平时就是普通文本模型,遇到图片随手发,不用再像第 22/23 课那样额外配识图工具。在 OpenCode 模型列表里认准名字带 vision 的这个型号即可。
DeepSeek 不需要包月订阅,充值余额即可按量付费。
⚠️ 2026-08-17 大涨价,别再"敞开了用"
DeepSeek 官方于 2026-08-17 零点起全面涨价,并启用峰谷定价:高峰时段(周一至周五 9:00-12:00、14:00-18:00)最贵,其余时间(含全部周末)为空闲时段,价格减半。波峰恰好覆盖工作时间。opencode go 套餐里的 flash 调用量也缩水到以前的 1/10 左右。
涨前 vs 涨后价格对比(元 / 百万 token):
项目 涨价前(统一价) 涨价后·空闲时段 涨价后·高峰时段 峰时涨幅 V4-Flash 输入(缓存命中) ¥0.02 ¥0.05 ¥0.10 5 倍 V4-Flash 输入(缓存未命中) ¥1 ¥1.5 ¥3 3 倍 V4-Flash 输出 ¥2 ¥4.5 ¥9 4.5 倍 V4-Pro 输入(缓存命中) ¥0.025 ¥0.15 ¥0.30 12 倍 V4-Pro 输入(缓存未命中) ¥3 ¥4.5 ¥9 3 倍 V4-Pro 输出 ¥6 ¥13.5 ¥27 4.5 倍 注意两点:
- 缓存命中价涨得最狠(Pro 峰时涨了 12 倍),但绝对值依然只要几毛钱,重上下文任务还是划算
- 就算只挑空闲时段用,输出价也是原来的 2 倍多——旧价格的便宜日子彻底结束了
当天群里的真实感受:"以前一个月 50 块,今天一天 50 块"。
涨价后的省钱姿势:
- 用量一般的:V4-Flash 仍是综合性价比之选,但别无脑烧,重要任务外别全上 Pro
- 用量大的:认真考虑 Codex(充值和梯子麻烦点,但单位成本更低)
- 错峰跑任务:白天干轻活,大批量任务挪到深夜/清晨(波谷价)
- 白天可以搭配 Kimi 会员自带的 coding plan 顶一阵(额度每周更新)
opencode go 的 5 美元套餐(35 元)仍然比直充官方便宜❌ 首月 $5 新人价已于 2026 年 8 月下旬取消(详见下方第 3 节),现在入手直接 $10/月,不再划算
⚠️ 群友反馈:V4-Flash 偶尔会"降智"
有群友发现,DeepSeek V4-Flash 便宜归便宜,但处理复杂任务时偶尔会"偷懒"——比如省略分析步骤、直接给结论、甚至忽略你明确要求的分点说明。这通常发生在任务复杂或上下文较长的时候。
解决办法:
- 简单任务、日常问答继续用 V4-Flash,最便宜
- 重要任务(写代码、审合同、复杂分析)切换到 V4-Pro,能力更稳定
- 也可以临时换到 GLM-5.3-Flash、Kimi K3 等模型试试,都支持直接接入
不要因为它便宜就所有任务都硬上 Flash,该换模型时就换。
⚠️ 群友反馈:DeepSeek API 高峰期会卡顿
有群友在下午/晚上高峰期遇到 OpenCode 一直显示"思考中"、响应极慢,切换付费模型也一样。这通常不是 OpenCode 或本地配置的问题,而是 DeepSeek API 高峰期算力不足。
解决办法:
- 先打开设置,勾选"显示推理摘要"(/thinking),看 AI 是否真的在思考
- 如果摘要空白或长时间无输出,大概率是 DeepSeek 服务端拥堵
- 等待非高峰期,或临时切换到 GLM、Kimi、MiniMax 等其他模型
- 重要工作避开晚上 17:00-21:00 的高峰期
⚠️ 免费模型下架后一直报错?九成是没切换模型(群友晓平实测)
2026 年 8 月下旬,OpenCode 内置的部分免费模型陆续下架。有群友(事务所总审)的 OpenCode 突然用不了,反复重装也没用——点开报错一看,模型还停留在已下架的
deepseek v4 flash free上,自己花钱买的 DeepSeek API 根本没被选中。判断方法:报错(如 endpoint is unavailable、network_error)时先看当前用的是哪个模型。如果名字带 free / flash free,就是这个问题。
解决办法:
- 点击底部的模型名称,在列表里往下拉,找到你自己的付费 provider(比如 DeepSeek 官方),选中它名下的模型
- 如果下拉列表里除了内置免费模型啥都没有 → 说明配置文件坏了,按第 5 课的方法删除配置文件后重启 OpenCode
- 实在搞不定:直接改用 WorkBuddy,开箱即用不用选模型
记住一句话:配好了付费 API ≠ 用上了,必须手动把模型切过去。
智谱 GLM — 编码能力强
| 项目 | 详情 |
|---|---|
| 官网 | https://bigmodel.cn |
| Coding Plan | https://www.bigmodel.cn/glm-coding?ic=30ZSVNXKXY |
| 模型 | GLM-5.3-Flash(原生多模态)、GLM-5.3、GLM-5.1 |
| 新版套餐 (V3) | Lite ¥118/月、Pro ¥538/月、Max ¥1078/月(连续包月价) |
| 老版套餐 (V2) | Lite ¥49/月、Pro ¥149/月、Max ¥469/月(已停售,仅老用户可续订) |
| Flash API 价格 | 输入 ¥0.4/百万token、输出 ¥1.4/百万token(限时5折,原价 ¥0.8/¥2.8) |
💡 2026 年 8 月新增:GLM-5.3-Flash 已全量上线 Coding Plan
这是智谱的新一代轻量旗舰模型,三个亮点:
- 原生多模态——本身就能看图片、视频、文件,再也不用外挂识图工具(见第 22/23 课的更新提醒)
- Coding Plan 额度翻 3 倍——同样套餐,用 Flash 的可用额度是 GLM-5.3 的 3 倍,相当耐用
- API 极便宜——按量付费时输出只要 ¥1.4/百万 token,比 DeepSeek V4-Flash 还便宜(截至 2026-08)
所有 Coding Plan 套餐都支持 GLM-5.3 和 GLM-5.3-Flash。旧模型名(GLM-5-Turbo、GLM-4.7)调用时会自动切换到 Flash。
GLM-5.3 是智谱的旗舰编程模型,2026-08-14 发布,与 Kimi K3 并列国产第一梯队(多家第三方横评里两者明显领先 DeepSeek V4-Pro,编程专项被评「追平国际顶尖水平」)。不过旗舰是给复杂任务准备的——日常干活用上面的 GLM-5.3-Flash 就够了:便宜数倍、套餐额度还是 5.3 的 3 倍。
⚠️ 套餐改版:V2 老版 vs V3 新版,别买错
2026 年 7 月 30 日智谱对 Coding Plan 做了大改版,市面上同时存在两套套餐,价格差得很远,买之前务必分清:
| 对比项 | V2 老版(本课之前介绍的) | V3 新版 |
|---|---|---|
| 包月价 | Lite ¥49 / Pro ¥149 / Max ¥469 | Lite ¥118 / Pro ¥538 / Max ¥1078(连续包月) |
| 额度算法 | 按 prompts 次数:Pro 约 400 次/5h、2000 次/周 | 按积分计:Lite 1万分/周、Pro 6万分/周、Max 14万分/周 |
| 折扣 | 包季 9 折、包年 8 折 | 包季 8 折、包年 7 折 |
| 支持模型 | GLM-5.3、GLM-5.3-Flash 均可 | 相同 |
| 高峰期消耗 | 按次数×系数:GLM-5.3 峰时 3 倍;GLM-5.3-Flash 峰时仅 1.2 倍(非高峰 Flash 只要 0.4 倍) | 高峰按积分原价扣,非高峰(含周末全天)半价扣,无额外倍数 |
| 谁能买 | 仅老用户续订/升档,新入口已关闭 | 所有人 |
几个要点:
- 老用户完全不受影响:V1/V2 账号按原价格继续用、继续续订,智谱官方承诺权益不变
- 新用户只能买 V3——Lite 相当于从 ¥49 涨到 ¥118,Pro 从 ¥149 涨到 ¥538(涨幅超 150%),本质是低价获客期结束
- V2 用户用 GLM-5.3-Flash 很划算:高峰期才多扣 20%(1.2 倍),非高峰反而打 4 折(0.4 倍)——比 V2 用 GLM-5.3(峰时 3 倍)温和太多。想要"高峰不怕扣额度",选 Flash 就对了
⚡️ ZCode 1.5 倍额度活动,2026-08-31 截止
智谱在 ZCode(自家 AI 编程客户端)里用 Coding Plan 有 150% 额度加成活动——同样的套餐在 ZCode 里能用出 1.5 倍的量。该活动从上半年一路延期,最新一轮为 8 月 11 日宣布:即日起至 2026 年 8 月 31 日有效。叠加缓存优化后整体可用量接近常规的 1.8 倍。
还没试过 ZCode 的 V2/V3 老用户,建议月底前薅一波。活动到期是否续期,以智谱公告为准。
💡 群友在传的省钱野路子:闲鱼收 V2 老账号
因为 V2 老用户能一直按原价续费,有学员在闲鱼上加价约 ¥2000 收别人出手的 V2 Pro/Max 账号——算下来还是比新开同档 V3 年付便宜好几千。想走这条路的话:
- 只走平台担保交易,确认对方配合官方换绑手机号再付款
- 警惕"到手找回"骗局:换绑完成前不要确认收货
- 此类转让智谱官方不背书,有纠纷自己兜底;预算有限的话,老老实实用 DeepSeek 按量付费反而更省心
实操:用 API 接入 GLM-5.3-Flash
不想订阅套餐、只想按量用这个最便宜的多模态模型?三步搞定:
- 打开 https://bigmodel.cn ,注册并完成实名认证
- 点左侧菜单「API Key」→ 创建并复制 Key(也可以在首页 GLM-5.3-Flash 卡片上点「API 接入」进入,见下图箭头位置)

- 打开 OpenCode → 设置 ⚙️ → 提供商 → 搜索「智谱 / Zhipu / BigModel」→ 粘贴 API Key → 提交,然后在模型列表里选
glm-5.3-flash
手动配置时的接入参数(OpenAI 协议):
| 参数 | 值 |
|---|---|
| Base URL | https://open.bigmodel.cn/api/paas/v4 |
| 完整端点 | https://open.bigmodel.cn/api/paas/v4/chat/completions |
| 模型名 | glm-5.3-flash |
| API Key | 上一步创建的 Key |
💡 大多数工具的 Base URL 填
https://open.bigmodel.cn/api/paas/v4即可(/chat/completions会被自动拼接);如果工具要求填完整端点,就用表格里第二行的地址。
Kimi K3 — 旗舰多模态,按量偏贵
| 项目 | 详情 |
|---|---|
| Coding Plan | https://kimi.com/code |
| API 平台 | https://platform.kimi.ai |
| 模型 | Kimi K3(2026-07 发布,取代 K2.6 成为旗舰) |
| API 价格 | 输入 ¥20/百万token、输出 ¥100/百万token、缓存命中 ¥2/百万token |
| 上下文 | 1M |
K3 是月之暗面的旗舰:原生看图看视频,长周期 Agent 任务(连续几十步不跑偏)是国产最强之一,第三方横评与 GLM-5.3 并列第一梯队。
但注意它的定位:输出 ¥100/百万 token 是 DeepSeek V4-Flash 的 10 倍以上,属于"重型武器"。日常任务别直接烧 K3 API——想要 Kimi 的能力,走会员/Coding Plan 订阅($15~19 起)更划算。
MiniMax M2.7 — 额度大、全模态
| 项目 | 详情 |
|---|---|
| 官网 | https://www.minimaxi.com |
| Token Plan | https://platform.minimaxi.com/docs/guides/pricing-token-plan |
| 模型 | MiniMax M2.7(标准版)、M2.7-highspeed(极速版) |
| 标准版价格 | Starter ¥29/月、Plus ¥49/月、Max ¥119/月 |
| 极速版价格 | Plus ¥98/月、Max ¥199/月、Ultra ¥899/月 |
MiniMax 的特点是额度非常充裕,适合用量大但对单次能力要求没那么极致的场景。Plus ¥49/月有 1500 次/5h 的额度,性价比不错。
支持文本+语音+图像+视频+音乐的全模态,一个订阅全覆盖。支持支付宝/微信支付。
其他国内选项(了解即可)
| 方案 | 月费 | 一句话点评 |
|---|---|---|
| 阿里云百炼 | ¥200 | 一个订阅用 7+ 家模型,但每日限量抢购,基本买不到 |
| 腾讯 TokenHub | ¥40 起 | 入门门槛低,生态较新 |
| 小米 MiMo | — | MiMo-V2.5 系列,已接入 OpenCode Go |
| 京东 | — | 有 Coding Plan 但生态小 |
这些方案目前都不作为主推——上面 DeepSeek / GLM / Kimi / MiniMax 四家已经覆盖所有需求。
3. OpenCode Go — 已不推荐 ⛔
⚠️ 2026 年 8 月更新:首月 $5 新人价已取消,本课不再推荐 OpenCode Go。
OpenCode Go 是 OpenCode 官方的聚合订阅($10/月用一个额度池切换多家模型)。但 2026 年 8 月发生了两件事,让它性价比大打折扣:
- 首月 $5 半价优惠取消——因为大量滥用(取消后换支付渠道重开反复吃新人价、号商批量注册倒卖额度),官方在 8 月下旬直接下架了新人价,新用户 $10/月起
- 模型额度缩水、分化——DeepSeek 涨价后,Go 里的 V4 Flash 每 5 小时调用量一度暴跌 94%(后部分回调),各模型月度子额度也分成三六九等:GLM-5.3、Kimi K3 等热门旗舰只有 $15/月,二线模型才有 $60/月
同样的预算,直接按量充值 GLM-5.3-Flash(输出 ¥1.4/百万token)或 DeepSeek(谷时更省)反而更透明可控。以下保留原介绍供参考,但不建议新用户现在入手。
原介绍:$10/月聚合 10+ 款模型(GLM、Kimi、DeepSeek、MiniMax、Qwen、Grok 等),总额度每 5 小时 $12、每周 $30、每月 $60,支持支付宝。需要 GitHub 或 Google 账号订阅。
4. 国外模型
| 厂商 | 模型 | 价格 | 特点 |
|---|---|---|---|
| Anthropic | Claude Sonnet 4.6 | $20/月 | 编程最强,~45次/5小时 |
| Anthropic | Claude Opus 4.7/4.8 | 含 Max $100-200 | SWE-Bench 80.8%,最强但最贵 |
| OpenAI | GPT-5.4 | $20/月 | Codex CLI,1M上下文,生图能力强 |
| Gemini 3.1 Pro | 免费 | 最佳免费选项,1M上下文 |
⚠️ Claude 会员在国内不可用,有梯子也容易封号,不建议购买。想用国外模型,可以考虑 OpenAI(有梯子+能充值即可用)或 Google Gemini(有免费额度)。
5. 价格对比一览
API 按 token 单价对比(谁是"卷王")
以 2026 年 8 月官方价为准,按"输出价"粗算成本(输出通常是账单大头):
| 模型 | 输入/百万token | 输出/百万token | 看图? | 备注 |
|---|---|---|---|---|
| GLM-5.3-Flash | ¥0.4(原价 ¥0.8) | ¥1.4(原价 ¥2.8) | ✅ 图/视频/文件 | 5折至 9月9日;1M 上下文 |
| DeepSeek V4-Flash / Vision-Exp | ¥1.5~3 | ¥4.5~9 | Vision 版✅ 图片 | 谷时=峰时一半 |
| MiniMax M2.7 | ≈¥2 | ≈¥8.4 | 全模态 | Token Plan 更划算 |
| Kimi K3 | ¥20(缓存命中 ¥2) | ¥100 | ✅ 原生视觉旗舰 | 重型武器,别日常烧 |
🏆 结论:GLM-5.3-Flash 是当前"能力÷价格"的卷王。 输出价只有 DeepSeek 的一半不到,还自带多模态;就算 9 月恢复原价(¥2.8),依然是最便宜档。DeepSeek 的强项在缓存命中(¥0.05 起)+ 谷时段——文字为主的批量任务挑晚上跑,账单能压得很低。
订阅套餐对比
| 方案 | 月费 | 适合人群 |
|---|---|---|
| MiniMax Starter | ¥29 | 轻度使用 |
| 智谱 GLM Lite(V3 新版) | ¥118(老 V2 账号续费仍 ¥49) | 日常编程,稳定 |
| ❌ 已不推荐:首月 $5 取消+额度缩水,见第 3 节 | ||
| 阿里百炼 Pro | ¥200 | 抢得到再说 |
| Claude Pro | $20 | 最强,但需梯子+风险 |
💡 DeepSeek 没有订阅制,按量付费日常约 ¥30~50/月(2026-08 涨价后),配合错峰更省。
6. 实操:在 OpenCode 中接入 DeepSeek
第一步:注册 DeepSeek 开发平台
- 浏览器搜索「DeepSeek API」或直接访问 https://platform.deepseek.com
- 注册账号,完成实名认证
- 充值 ¥20(涨价后轻度使用也够一到两个月)
第二步:创建 API Key
- 进入控制台,找到「API Keys」
- 点击「创建」,随便起个名字(比如"测试")
- 复制并保存好这个 Key(只显示一次,不过也不用留存它,下一次需要用再创建一个就可以)



第三步:在 OpenCode 中配置
- 打开 OpenCode,点击左侧「设置」⚙️
- 点击「提供商」
- 搜索「DeepSeek」,点击添加
- 粘贴刚才复制的 API Key
- 点击提交
第四步:开始使用
配置完成后,点击底部模型名称,往下拉找到 DeepSeek 官方提供商下的模型:
- 推荐选
deepseek-v4-flash-vision-exp(名字带 vision)——价格和 Flash 一样,但能看图 - 列表里暂时没有的话,选
DeepSeek V4-Flash也完全够用
输入"你好"测试一下——AI 正常回复说明连接成功。再拖一张截图进去让它"描述这张图":能答上来,说明你的 DeepSeek 已经自带眼睛了(第 22/23 课的能力,现在开箱即有)。
觉得效果不够好,可以切换到 V4-Pro(贵几倍,能力更强)。
7. 省钱配置技巧(装插件后必看)
如果你安装了 oh-my-opencode-slim 等多智能体插件,不同 Agent 会消耗不同模型。有群友反馈一天 API 费用高达 15 元,nigo 建议按角色分配模型,可以降到 5 元以内:
| Agent 角色 | 推荐模型 | 原因 |
|---|---|---|
| Orchestrator(编排者/项目经理) | DeepSeek V4-Flash | 调用最频繁,用便宜的 |
| Oracle(专家顾问/复杂推理) | DeepSeek V4-Pro | 需要深度思考,用强的 |
| Fixer/Explorer 等执行角色 | DeepSeek V4-Flash | 量大但简单,用便宜的 |
核心原则:
- 只有真正需要深度推理的环节才用 Pro
- 日常编排、执行、搜索等大量调用都用 Flash
- 如果某天突然费用飙升,先检查是不是 orchestrator 被设成了 Pro
💡 配置时可以让 AI 说:"帮我把 orchestrator 改成 flash,oracle 保持 pro,其他全部改成 flash。"
8. 我的推荐
🎯 别纠结,照着选就行。
按量付费(推荐起步)
首选:DeepSeek deepseek-v4-flash-vision-exp
- 和 V4-Flash 同价,还自带"眼睛"——截图、扫描件、报错界面直接发
- 充 ¥20 就能开工;周末全天和每天 18 点后是空闲时段,价格减半
- 注册流程最简单,全课默认演示都用它
最便宜:智谱 GLM-5.3-Flash
- 当前按量单价的卷王(见上文对比表):5 折期间输出仅 ¥1.4/百万 token,恢复原价也只 ¥2.8
- 原生多模态 + 1M 上下文,轻量模型里能力数一数二
两家怎么选?图省事 → DeepSeek;追求极限性价比 → GLM-5.3-Flash。 都支持多模态,选谁都不会错。
国内 Coding Plan
需要订阅的话,推荐顺序:
| 排名 | 方案 | 月费 | 推荐理由 |
|---|---|---|---|
| 🥇 | 智谱 GLM | ¥118 起(V3 新版) | 编码能力国内最强之一;老 V2 账号续费仍 ¥49 起,闲鱼可收二手 V2(见上文) |
| 🥈 | Kimi K3 | $19 起 | 旗舰多模态强,长任务 Agent 能力好 |
| 🥉 | MiniMax M2.7 | ¥29 起 | 额度充裕,全模态,性价比高 |
⚠️ 智谱 2026-07-30 改版涨价后(详见上文 V2/V3 对比),Pro 档从 ¥149 涨到 ¥538,性价比下降。预算紧张的新手:先用 DeepSeek 按量付费;确实需要 GLM 的,考虑闲鱼收二手 V2 账号或只买 V3 Lite。
⚠️ 阿里百炼、腾讯 TokenHub、OpenCode Go 等方案目前不推荐——要么抢购难买,要么性价比不如上面三个。
国外模型
OpenAI GPT($20/月)— 有梯子、能充值就用这个,综合能力强。
⚠️ Claude 会员在国内有封号风险,不推荐购买。
延伸阅读 📚
想深入了解国内各家 Coding Plan 套餐怎么选、怎么把额度用出最大价值,推荐阅读这篇文章:
国内 AI Coding Plan 指南:高性价比套餐对比 × 榨干 GLM × 套餐选择
作者对比了智谱、OpenCode Go、Kimi Code 等主流方案的实际额度、计费规则和省钱技巧,还分享了多模型路由配置、错峰使用、任务分级等进阶玩法,非常适合准备长期付费订阅的学员参考。
不懂就问 💬
遇到以下情况,直接在 OpenCode 里问 AI:
- 不确定该选哪个模型 → "帮我比较一下 DeepSeek 和 GLM 的区别"
- 不懂什么是 API Key → "什么是 API Key?怎么创建?"
- 不知道自己用量多大 → "帮我估算一下,每天写 2 小时代码大概消耗多少 token"