Skip to content

第3课 · 选择合适的大模型

本节要点

  • 了解为什么需要配置大模型,以及它对 AI Agent 能力的影响
  • 掌握国内外主流模型的定价和特点(2026 年 8 月后有大量价格变动,本节均为最新数据)
  • 知道哪些模型已经自带"眼睛"(多模态),可以直接看图
  • 学会在 OpenCode 中接入 DeepSeek API
  • 根据自己的用量选择最划算的方案

1. 为什么要配置大模型?

大模型就是 AI Agent 的大脑。大脑强不强,直接决定了它干活的品质。

OpenCode 的好处是:可以同时接入多家大模型厂商,随时切换。免费模型不够用的时候,你可以自己配国内的模型,灵活选择。

而且不同模型的价格差异非常大——从「几乎免费」到「每月几百元」都有。选对了,既省钱又好用。


2. 国内模型总览

DeepSeek — 推荐起步 ⭐

项目详情
官网https://platform.deepseek.com
模型DeepSeek V4-Flash、V4-Pro、V4-Flash-Vision-Exp(新,会看图)
价格(2026-08-17 涨价后)峰谷两档,空闲时段是高峰时段的一半
V4-Flash / Vision-Exp:输入 ¥1.5~3 / 百万token,输出 ¥4.5~9 / 百万token
V4-Pro:输入 ¥4.5~9 / 百万token,输出 ¥13.5~27 / 百万token
缓存命中Flash ¥0.05~0.1、Pro ¥0.15~0.3 / 百万token(依然极便宜)
上下文1M(百万级 token)
特点无需订阅,用多少付多少,国内直接访问;高峰期 = 周一至周五 9:00-12:00、14:00-18:00

💡 仍然推荐 DeepSeek 起步——而且现在可以直接选"带眼睛"的版本。

2026 年 8 月下旬,DeepSeek 上线了视觉实验模型 deepseek-v4-flash-vision-exp:价格与 V4-Flash 完全一致(同样分峰谷),但它看得懂截图、报表照片、报错界面。

新手直接把它当主力:平时就是普通文本模型,遇到图片随手发,不用再像第 22/23 课那样额外配识图工具。在 OpenCode 模型列表里认准名字带 vision 的这个型号即可。

DeepSeek 不需要包月订阅,充值余额即可按量付费。

⚠️ 2026-08-17 大涨价,别再"敞开了用"

DeepSeek 官方于 2026-08-17 零点起全面涨价,并启用峰谷定价:高峰时段(周一至周五 9:00-12:00、14:00-18:00)最贵,其余时间(含全部周末)为空闲时段,价格减半。波峰恰好覆盖工作时间。opencode go 套餐里的 flash 调用量也缩水到以前的 1/10 左右。

涨前 vs 涨后价格对比(元 / 百万 token):

项目涨价前(统一价)涨价后·空闲时段涨价后·高峰时段峰时涨幅
V4-Flash 输入(缓存命中)¥0.02¥0.05¥0.105 倍
V4-Flash 输入(缓存未命中)¥1¥1.5¥33 倍
V4-Flash 输出¥2¥4.5¥94.5 倍
V4-Pro 输入(缓存命中)¥0.025¥0.15¥0.3012 倍
V4-Pro 输入(缓存未命中)¥3¥4.5¥93 倍
V4-Pro 输出¥6¥13.5¥274.5 倍

注意两点:

  • 缓存命中价涨得最狠(Pro 峰时涨了 12 倍),但绝对值依然只要几毛钱,重上下文任务还是划算
  • 就算只挑空闲时段用,输出价也是原来的 2 倍多——旧价格的便宜日子彻底结束了

当天群里的真实感受:"以前一个月 50 块,今天一天 50 块"。

涨价后的省钱姿势

  • 用量一般的:V4-Flash 仍是综合性价比之选,但别无脑烧,重要任务外别全上 Pro
  • 用量大的:认真考虑 Codex(充值和梯子麻烦点,但单位成本更低)
  • 错峰跑任务:白天干轻活,大批量任务挪到深夜/清晨(波谷价)
  • 白天可以搭配 Kimi 会员自带的 coding plan 顶一阵(额度每周更新)
  • opencode go 的 5 美元套餐(35 元)仍然比直充官方便宜 ❌ 首月 $5 新人价已于 2026 年 8 月下旬取消(详见下方第 3 节),现在入手直接 $10/月,不再划算

⚠️ 群友反馈:V4-Flash 偶尔会"降智"

有群友发现,DeepSeek V4-Flash 便宜归便宜,但处理复杂任务时偶尔会"偷懒"——比如省略分析步骤、直接给结论、甚至忽略你明确要求的分点说明。这通常发生在任务复杂或上下文较长的时候。

解决办法

  • 简单任务、日常问答继续用 V4-Flash,最便宜
  • 重要任务(写代码、审合同、复杂分析)切换到 V4-Pro,能力更稳定
  • 也可以临时换到 GLM-5.3-Flash、Kimi K3 等模型试试,都支持直接接入

不要因为它便宜就所有任务都硬上 Flash,该换模型时就换。

⚠️ 群友反馈:DeepSeek API 高峰期会卡顿

有群友在下午/晚上高峰期遇到 OpenCode 一直显示"思考中"、响应极慢,切换付费模型也一样。这通常不是 OpenCode 或本地配置的问题,而是 DeepSeek API 高峰期算力不足

解决办法

  • 先打开设置,勾选"显示推理摘要"(/thinking),看 AI 是否真的在思考
  • 如果摘要空白或长时间无输出,大概率是 DeepSeek 服务端拥堵
  • 等待非高峰期,或临时切换到 GLM、Kimi、MiniMax 等其他模型
  • 重要工作避开晚上 17:00-21:00 的高峰期

⚠️ 免费模型下架后一直报错?九成是没切换模型(群友晓平实测)

2026 年 8 月下旬,OpenCode 内置的部分免费模型陆续下架。有群友(事务所总审)的 OpenCode 突然用不了,反复重装也没用——点开报错一看,模型还停留在已下架的 deepseek v4 flash free,自己花钱买的 DeepSeek API 根本没被选中。

判断方法:报错(如 endpoint is unavailable、network_error)时先看当前用的是哪个模型。如果名字带 free / flash free,就是这个问题。

解决办法

  • 点击底部的模型名称,在列表里往下拉,找到你自己的付费 provider(比如 DeepSeek 官方),选中它名下的模型
  • 如果下拉列表里除了内置免费模型啥都没有 → 说明配置文件坏了,按第 5 课的方法删除配置文件后重启 OpenCode
  • 实在搞不定:直接改用 WorkBuddy,开箱即用不用选模型

记住一句话:配好了付费 API ≠ 用上了,必须手动把模型切过去。

智谱 GLM — 编码能力强

项目详情
官网https://bigmodel.cn
Coding Planhttps://www.bigmodel.cn/glm-coding?ic=30ZSVNXKXY
模型GLM-5.3-Flash(原生多模态)、GLM-5.3、GLM-5.1
新版套餐 (V3)Lite ¥118/月、Pro ¥538/月、Max ¥1078/月(连续包月价)
老版套餐 (V2)Lite ¥49/月、Pro ¥149/月、Max ¥469/月(已停售,仅老用户可续订)
Flash API 价格输入 ¥0.4/百万token、输出 ¥1.4/百万token(限时5折,原价 ¥0.8/¥2.8)

💡 2026 年 8 月新增:GLM-5.3-Flash 已全量上线 Coding Plan

这是智谱的新一代轻量旗舰模型,三个亮点:

  1. 原生多模态——本身就能看图片、视频、文件,再也不用外挂识图工具(见第 22/23 课的更新提醒)
  2. Coding Plan 额度翻 3 倍——同样套餐,用 Flash 的可用额度是 GLM-5.3 的 3 倍,相当耐用
  3. API 极便宜——按量付费时输出只要 ¥1.4/百万 token,比 DeepSeek V4-Flash 还便宜(截至 2026-08)

所有 Coding Plan 套餐都支持 GLM-5.3 和 GLM-5.3-Flash。旧模型名(GLM-5-Turbo、GLM-4.7)调用时会自动切换到 Flash。

GLM-5.3 是智谱的旗舰编程模型,2026-08-14 发布,与 Kimi K3 并列国产第一梯队(多家第三方横评里两者明显领先 DeepSeek V4-Pro,编程专项被评「追平国际顶尖水平」)。不过旗舰是给复杂任务准备的——日常干活用上面的 GLM-5.3-Flash 就够了:便宜数倍、套餐额度还是 5.3 的 3 倍

⚠️ 套餐改版:V2 老版 vs V3 新版,别买错

2026 年 7 月 30 日智谱对 Coding Plan 做了大改版,市面上同时存在两套套餐,价格差得很远,买之前务必分清:

对比项V2 老版(本课之前介绍的)V3 新版
包月价Lite ¥49 / Pro ¥149 / Max ¥469Lite ¥118 / Pro ¥538 / Max ¥1078(连续包月)
额度算法按 prompts 次数:Pro 约 400 次/5h、2000 次/周按积分计:Lite 1万分/周、Pro 6万分/周、Max 14万分/周
折扣包季 9 折、包年 8 折包季 8 折、包年 7 折
支持模型GLM-5.3、GLM-5.3-Flash 均可相同
高峰期消耗按次数×系数:GLM-5.3 峰时 3 倍;GLM-5.3-Flash 峰时仅 1.2 倍(非高峰 Flash 只要 0.4 倍)高峰按积分原价扣,非高峰(含周末全天)半价扣,无额外倍数
谁能买仅老用户续订/升档,新入口已关闭所有人

几个要点:

  • 老用户完全不受影响:V1/V2 账号按原价格继续用、继续续订,智谱官方承诺权益不变
  • 新用户只能买 V3——Lite 相当于从 ¥49 涨到 ¥118,Pro 从 ¥149 涨到 ¥538(涨幅超 150%),本质是低价获客期结束
  • V2 用户用 GLM-5.3-Flash 很划算:高峰期才多扣 20%(1.2 倍),非高峰反而打 4 折(0.4 倍)——比 V2 用 GLM-5.3(峰时 3 倍)温和太多。想要"高峰不怕扣额度",选 Flash 就对了

⚡️ ZCode 1.5 倍额度活动,2026-08-31 截止

智谱在 ZCode(自家 AI 编程客户端)里用 Coding Plan 有 150% 额度加成活动——同样的套餐在 ZCode 里能用出 1.5 倍的量。该活动从上半年一路延期,最新一轮为 8 月 11 日宣布:即日起至 2026 年 8 月 31 日有效。叠加缓存优化后整体可用量接近常规的 1.8 倍。

还没试过 ZCode 的 V2/V3 老用户,建议月底前薅一波。活动到期是否续期,以智谱公告为准。

💡 群友在传的省钱野路子:闲鱼收 V2 老账号

因为 V2 老用户能一直按原价续费,有学员在闲鱼上加价约 ¥2000 收别人出手的 V2 Pro/Max 账号——算下来还是比新开同档 V3 年付便宜好几千。想走这条路的话:

  • 只走平台担保交易,确认对方配合官方换绑手机号再付款
  • 警惕"到手找回"骗局:换绑完成前不要确认收货
  • 此类转让智谱官方不背书,有纠纷自己兜底;预算有限的话,老老实实用 DeepSeek 按量付费反而更省心

实操:用 API 接入 GLM-5.3-Flash

不想订阅套餐、只想按量用这个最便宜的多模态模型?三步搞定:

  1. 打开 https://bigmodel.cn ,注册并完成实名认证
  2. 点左侧菜单「API Key」→ 创建并复制 Key(也可以在首页 GLM-5.3-Flash 卡片上点「API 接入」进入,见下图箭头位置)

在智谱 BigModel 平台获取 API Key

  1. 打开 OpenCode → 设置 ⚙️ → 提供商 → 搜索「智谱 / Zhipu / BigModel」→ 粘贴 API Key → 提交,然后在模型列表里选 glm-5.3-flash

手动配置时的接入参数(OpenAI 协议):

参数
Base URLhttps://open.bigmodel.cn/api/paas/v4
完整端点https://open.bigmodel.cn/api/paas/v4/chat/completions
模型名glm-5.3-flash
API Key上一步创建的 Key

💡 大多数工具的 Base URL 填 https://open.bigmodel.cn/api/paas/v4 即可(/chat/completions 会被自动拼接);如果工具要求填完整端点,就用表格里第二行的地址。

Kimi K3 — 旗舰多模态,按量偏贵

项目详情
Coding Planhttps://kimi.com/code
API 平台https://platform.kimi.ai
模型Kimi K3(2026-07 发布,取代 K2.6 成为旗舰)
API 价格输入 ¥20/百万token、输出 ¥100/百万token、缓存命中 ¥2/百万token
上下文1M

K3 是月之暗面的旗舰:原生看图看视频,长周期 Agent 任务(连续几十步不跑偏)是国产最强之一,第三方横评与 GLM-5.3 并列第一梯队。

但注意它的定位:输出 ¥100/百万 token 是 DeepSeek V4-Flash 的 10 倍以上,属于"重型武器"。日常任务别直接烧 K3 API——想要 Kimi 的能力,走会员/Coding Plan 订阅($15~19 起)更划算。

MiniMax M2.7 — 额度大、全模态

项目详情
官网https://www.minimaxi.com
Token Planhttps://platform.minimaxi.com/docs/guides/pricing-token-plan
模型MiniMax M2.7(标准版)、M2.7-highspeed(极速版)
标准版价格Starter ¥29/月、Plus ¥49/月、Max ¥119/月
极速版价格Plus ¥98/月、Max ¥199/月、Ultra ¥899/月

MiniMax 的特点是额度非常充裕,适合用量大但对单次能力要求没那么极致的场景。Plus ¥49/月有 1500 次/5h 的额度,性价比不错。

支持文本+语音+图像+视频+音乐的全模态,一个订阅全覆盖。支持支付宝/微信支付。

其他国内选项(了解即可)

方案月费一句话点评
阿里云百炼¥200一个订阅用 7+ 家模型,但每日限量抢购,基本买不到
腾讯 TokenHub¥40 起入门门槛低,生态较新
小米 MiMoMiMo-V2.5 系列,已接入 OpenCode Go
京东有 Coding Plan 但生态小

这些方案目前都不作为主推——上面 DeepSeek / GLM / Kimi / MiniMax 四家已经覆盖所有需求。


3. OpenCode Go — 已不推荐 ⛔

⚠️ 2026 年 8 月更新:首月 $5 新人价已取消,本课不再推荐 OpenCode Go。

OpenCode Go 是 OpenCode 官方的聚合订阅($10/月用一个额度池切换多家模型)。但 2026 年 8 月发生了两件事,让它性价比大打折扣:

  1. 首月 $5 半价优惠取消——因为大量滥用(取消后换支付渠道重开反复吃新人价、号商批量注册倒卖额度),官方在 8 月下旬直接下架了新人价,新用户 $10/月起
  2. 模型额度缩水、分化——DeepSeek 涨价后,Go 里的 V4 Flash 每 5 小时调用量一度暴跌 94%(后部分回调),各模型月度子额度也分成三六九等:GLM-5.3、Kimi K3 等热门旗舰只有 $15/月,二线模型才有 $60/月

同样的预算,直接按量充值 GLM-5.3-Flash(输出 ¥1.4/百万token)或 DeepSeek(谷时更省)反而更透明可控。以下保留原介绍供参考,但不建议新用户现在入手。

原介绍:$10/月聚合 10+ 款模型(GLM、Kimi、DeepSeek、MiniMax、Qwen、Grok 等),总额度每 5 小时 $12、每周 $30、每月 $60,支持支付宝。需要 GitHub 或 Google 账号订阅。


4. 国外模型

厂商模型价格特点
AnthropicClaude Sonnet 4.6$20/月编程最强,~45次/5小时
AnthropicClaude Opus 4.7/4.8含 Max $100-200SWE-Bench 80.8%,最强但最贵
OpenAIGPT-5.4$20/月Codex CLI,1M上下文,生图能力强
GoogleGemini 3.1 Pro免费最佳免费选项,1M上下文

⚠️ Claude 会员在国内不可用,有梯子也容易封号,不建议购买。想用国外模型,可以考虑 OpenAI(有梯子+能充值即可用)或 Google Gemini(有免费额度)。


5. 价格对比一览

API 按 token 单价对比(谁是"卷王")

以 2026 年 8 月官方价为准,按"输出价"粗算成本(输出通常是账单大头):

模型输入/百万token输出/百万token看图?备注
GLM-5.3-Flash¥0.4(原价 ¥0.8)¥1.4(原价 ¥2.8)✅ 图/视频/文件5折至 9月9日;1M 上下文
DeepSeek V4-Flash / Vision-Exp¥1.5~3¥4.5~9Vision 版✅ 图片谷时=峰时一半
MiniMax M2.7≈¥2≈¥8.4全模态Token Plan 更划算
Kimi K3¥20(缓存命中 ¥2)¥100✅ 原生视觉旗舰重型武器,别日常烧

🏆 结论:GLM-5.3-Flash 是当前"能力÷价格"的卷王。 输出价只有 DeepSeek 的一半不到,还自带多模态;就算 9 月恢复原价(¥2.8),依然是最便宜档。DeepSeek 的强项在缓存命中(¥0.05 起)+ 谷时段——文字为主的批量任务挑晚上跑,账单能压得很低。

订阅套餐对比

方案月费适合人群
MiniMax Starter¥29轻度使用
智谱 GLM Lite(V3 新版)¥118(老 V2 账号续费仍 ¥49)日常编程,稳定
OpenCode Go$10(≈¥70)❌ 已不推荐:首月 $5 取消+额度缩水,见第 3 节
阿里百炼 Pro¥200抢得到再说
Claude Pro$20最强,但需梯子+风险

💡 DeepSeek 没有订阅制,按量付费日常约 ¥30~50/月(2026-08 涨价后),配合错峰更省。


6. 实操:在 OpenCode 中接入 DeepSeek

第一步:注册 DeepSeek 开发平台

  1. 浏览器搜索「DeepSeek API」或直接访问 https://platform.deepseek.com
  2. 注册账号,完成实名认证
  3. 充值 ¥20(涨价后轻度使用也够一到两个月)

第二步:创建 API Key

  1. 进入控制台,找到「API Keys」
  2. 点击「创建」,随便起个名字(比如"测试")
  3. 复制并保存好这个 Key(只显示一次,不过也不用留存它,下一次需要用再创建一个就可以)

第三步:在 OpenCode 中配置

  1. 打开 OpenCode,点击左侧「设置」⚙️
  2. 点击「提供商」
  3. 搜索「DeepSeek」,点击添加
  4. 粘贴刚才复制的 API Key
  5. 点击提交

第四步:开始使用

配置完成后,点击底部模型名称,往下拉找到 DeepSeek 官方提供商下的模型:

  • 推荐选 deepseek-v4-flash-vision-exp(名字带 vision)——价格和 Flash 一样,但能看图
  • 列表里暂时没有的话,选 DeepSeek V4-Flash 也完全够用

输入"你好"测试一下——AI 正常回复说明连接成功。再拖一张截图进去让它"描述这张图":能答上来,说明你的 DeepSeek 已经自带眼睛了(第 22/23 课的能力,现在开箱即有)。

觉得效果不够好,可以切换到 V4-Pro(贵几倍,能力更强)。


7. 省钱配置技巧(装插件后必看)

如果你安装了 oh-my-opencode-slim 等多智能体插件,不同 Agent 会消耗不同模型。有群友反馈一天 API 费用高达 15 元,nigo 建议按角色分配模型,可以降到 5 元以内:

Agent 角色推荐模型原因
Orchestrator(编排者/项目经理)DeepSeek V4-Flash调用最频繁,用便宜的
Oracle(专家顾问/复杂推理)DeepSeek V4-Pro需要深度思考,用强的
Fixer/Explorer 等执行角色DeepSeek V4-Flash量大但简单,用便宜的

核心原则

  • 只有真正需要深度推理的环节才用 Pro
  • 日常编排、执行、搜索等大量调用都用 Flash
  • 如果某天突然费用飙升,先检查是不是 orchestrator 被设成了 Pro

💡 配置时可以让 AI 说:"帮我把 orchestrator 改成 flash,oracle 保持 pro,其他全部改成 flash。"


8. 我的推荐

🎯 别纠结,照着选就行。

按量付费(推荐起步)

首选:DeepSeek deepseek-v4-flash-vision-exp

  • 和 V4-Flash 同价,还自带"眼睛"——截图、扫描件、报错界面直接发
  • 充 ¥20 就能开工;周末全天和每天 18 点后是空闲时段,价格减半
  • 注册流程最简单,全课默认演示都用它

最便宜:智谱 GLM-5.3-Flash

  • 当前按量单价的卷王(见上文对比表):5 折期间输出仅 ¥1.4/百万 token,恢复原价也只 ¥2.8
  • 原生多模态 + 1M 上下文,轻量模型里能力数一数二

两家怎么选?图省事 → DeepSeek;追求极限性价比 → GLM-5.3-Flash。 都支持多模态,选谁都不会错。

国内 Coding Plan

需要订阅的话,推荐顺序:

排名方案月费推荐理由
🥇智谱 GLM¥118 起(V3 新版)编码能力国内最强之一;老 V2 账号续费仍 ¥49 起,闲鱼可收二手 V2(见上文)
🥈Kimi K3$19 起旗舰多模态强,长任务 Agent 能力好
🥉MiniMax M2.7¥29 起额度充裕,全模态,性价比高

⚠️ 智谱 2026-07-30 改版涨价后(详见上文 V2/V3 对比),Pro 档从 ¥149 涨到 ¥538,性价比下降。预算紧张的新手:先用 DeepSeek 按量付费;确实需要 GLM 的,考虑闲鱼收二手 V2 账号或只买 V3 Lite。

⚠️ 阿里百炼、腾讯 TokenHub、OpenCode Go 等方案目前不推荐——要么抢购难买,要么性价比不如上面三个。

国外模型

OpenAI GPT($20/月)— 有梯子、能充值就用这个,综合能力强。

⚠️ Claude 会员在国内有封号风险,不推荐购买。


延伸阅读 📚

想深入了解国内各家 Coding Plan 套餐怎么选、怎么把额度用出最大价值,推荐阅读这篇文章:

国内 AI Coding Plan 指南:高性价比套餐对比 × 榨干 GLM × 套餐选择

作者对比了智谱、OpenCode Go、Kimi Code 等主流方案的实际额度、计费规则和省钱技巧,还分享了多模型路由配置、错峰使用、任务分级等进阶玩法,非常适合准备长期付费订阅的学员参考。


不懂就问 💬

遇到以下情况,直接在 OpenCode 里问 AI:

  • 不确定该选哪个模型 → "帮我比较一下 DeepSeek 和 GLM 的区别"
  • 不懂什么是 API Key → "什么是 API Key?怎么创建?"
  • 不知道自己用量多大 → "帮我估算一下,每天写 2 小时代码大概消耗多少 token"

© 2025 逆行的狗