DeepSeek 涨价后,用 WorkBuddy + CNB 搭建“零消耗“AI 编码流水线
用 WorkBuddy + CNB 搭建"零消耗"AI 编码流水线:让WB当指挥官,DeepSeek V4 Flash 在云端干重活
💡 本文不是教你怎么调 DeepSeek API,而是分享一个把 token 消耗的物理位置搬走的工程架构:WorkBuddy 用免费/低成本的混元模型做轻量编排,CNB 在云端用限时免费的 DeepSeek V4 Flash 跑复杂编码。年底前这套组合,复杂任务的模型调用成本接近于零。
一、为什么不能直接在 WorkBuddy 里硬跑重任务
DeepSeek 官方近期宣布 API 整体涨价,预计涨幅较大。即便 WorkBuddy 内置了 Credits 计量,复杂编码任务的长上下文反复出现在主对话里,积分消耗依然可观。
核心矛盾是:
- 复杂任务(代码生成、仓库重构、批量处理)需要在长上下文里反复推理
- 长上下文 = 大量 Input Token 反复计费
- WorkBuddy 主对话窗口如果承载这些上下文,Credits 会肉眼可见地往下掉
那有没有一种方式,让 WorkBuddy 只做"指挥官",把重活物理搬运到另一个免费执行端?
有。答案是 CNB(云原生构建)+ CodeBuddy NPC。
二、核心洞察:token 消耗发生在哪里,比"哪个模型便宜"更重要
CNB 平台(cnb.cool)内置了 CodeBuddy 智能体,当前默认模型 deepseek-v4-flash 限时免费,可用到 2026 年 12 月 31 日——不限量、不绑卡、不开会员。
同时,CNB 官方提供了 workbuddy-cnb-skill,让 WorkBuddy 可以通过 cnb-api 远程触发 CNB 仓库里的 CodeBuddy NPC,NPC 跨仓库处理任务、提 PR,结果回写到源 issue。
这两个事实叠加,催生了一个巧妙的架构:
WorkBuddy 主对话(Hy3 免费/低成本)
↓ 只发一句轻量指令
CNB 仓库 Issue 里 @CodeBuddy
↓ 云端执行(DeepSeek V4 Flash 免费)
结果回写到 WorkBuddy
↓
WorkBuddy 只接收短文本结果
关键点:复杂的代码上下文、NPC 多轮推理、工具调用——全部发生在 CNB 云端,不占用 WorkBuddy 主对话的上下文窗口。WorkBuddy 主对话只传输"指令"和"最终结果"两段极短文本。
这就是为什么能做到"零消耗":
- WorkBuddy 侧:用 Hy3(当前免费期倍率 0×)发指令,消耗可忽略
- CNB 侧:DeepSeek V4 Flash 免费到 2026-12-31,重活执行成本 = 0
- 总账:年底前跑复杂编码任务,模型调用成本 ≈ 0
三、架构原理:轻量编排层 + 重型执行层分离
这是 Agent 系统工程里的标准范式。我们把两层分开看:
🎯 编排层:WorkBuddy + Hy3
WorkBuddy 是腾讯推出的 AI 编程智能体,支持混元、DeepSeek、GLM、Kimi、MiniMax 等模型自由切换。其中腾讯混元 Hy3 在当前免费期内,文本对话、代码生成、复杂推理等任务消耗倍率为 0。
编排层只干三件事:
- 接收用户的自然语言指令
- 通过 workbuddy-cnb-skill 把指令转发到 CNB
- 接收 CNB 回写的结果摘要
⚙️ 执行层:CNB + CodeBuddy NPC + DeepSeek V4 Flash
CNB 是腾讯旗下的云原生研发平台,把代码托管、CI、远程开发、AI 助手融为一体。在其仓库的 Issue/PR 里 @CodeBuddy 或 npc/CodeBuddy,就能召唤 AI 智能体:
- 读整个代码库上下文
- 多轮推理 + 工具调用
- 写文件 / 跑命令 / 提 PR
- 当前默认模型 deepseek-v4-flash 免费到 2026-12-31
🔗 桥梁:workbuddy-cnb-skill
这是 CNB 官方提供的 Skill,安装在 WorkBuddy 里,核心机制是:
npc-run --mirror在镜像 issue 上召唤 NPC 跨仓库处理源仓库并提交源仓库 PR;处理完成后才把结果回写到源 issue(不带 @ 触发词,防止二次召唤)。pr-watch检测关联 PR 合并后自动关闭镜像 issue,形成「整合 → 处理 → PR → 闭环」全流程。
简单说:你在 WorkBuddy 里说一句话,skill 自动在 CNB 镜像 issue 召唤 NPC,NPC 在源仓库干完重活,PR 自动提回来,镜像 issue 自动关闭。
四、实战配置:30 分钟跑通整套流水线
Step 1:WorkBuddy 侧配置
- 下载安装 WorkBuddy(官方地址:codebuddy.cn/work/)
- 微信扫码登录
- 模型切换到 Hy3(确认带"限时免费"标签,倍率 0×)
- 安装 workbuddy-cnb-skill:
- 下载 zip 解压到用户级 skill 目录
- Windows:`%USERPROFILE%.workbuddy\skills`
- macOS/Linux:
~/.workbuddy/skills/
Step 2:CNB 侧配置
- 打开 cnb.cool,微信扫码登录
- 创建一个组织(微信认证,免费)
- 在组织下创建你的仓库
- 仓库设置 → AI 能力 → 开启 CodeBuddy NPC
- 确认 defaultModel 是
deepseek-v4-flash(CNB 当前默认)
⚠️ 权限提醒:CodeBuddy NPC 要真正写代码、推分支、建 PR,必须在你自己有 Developer 权限的仓库里操作。官方公开仓库里你的角色通常是 Reporter,NPC 无法推代码。所以用自己的仓库,别在别人仓库里裸跑。
Step 3:打通 WorkBuddy ↔ CNB
- 在 WorkBuddy 连接器管理页启用
cnb-api - 终端执行
cnb login(OAuth2 设备授权) - 回到 WorkBuddy 对话,首次运行 workbuddy-cnb-skill 会强制进行 4 项设定引导:
- 默认 NPC
- 默认模型(选
deepseek-v4-flash) - 镜像整合仓库
- 任务集
- 设定值保存在
~/.config/workbuddy-cnb/config.json
Step 4:跑第一个任务
在 WorkBuddy 对话里直接下指令:
去我的仓库 my-org/my-repo 的 issue #5,
让 CodeBuddy 实现一个 React 登录页组件,
包含表单校验和提交逻辑,完成后提 PR
Skill 会自动:
- 在镜像仓库创建 issue 并 @NPC
- NPC 在源仓库
my-org/my-repo执行复杂编码 - 完成后提 PR 回源仓库
- 结果回写到 WorkBuddy 对话
整个过程中:
- WorkBuddy 主对话消耗:下指令 + 收结果 ≈ 100-200 tokens(Hy3 免费额度内)
- CNB 侧消耗:NPC 读代码库 + 多轮推理 + 工具调用 ≈ 几十万 tokens(DSV4-Flash 免费)
五、成本对比:传统用法 vs 本架构
以"分析 1000 篇竞品文案并生成报告"为例:
|
维度 |
传统用法(WB 主对话直接跑 DeepSeek V4 Pro) |
本架构(WB+Hy3 编排 + CNB+Flash 执行) |
|---|---|---|
|
上下文处理 |
主对话反复加载,几百万 tokens |
全部在 CNB 云端,WB 主对话只传指令和结果 |
|
模型单价 |
V4 Pro 高峰输出 27 元/百万 tokens |
DSV4-Flash 免费 |
|
WB 侧消耗 |
Credits 持续消耗 |
Hy3 免费期 0 消耗 |
|
预估成本 |
几十到上百元 |
≈ 0 元(年底前) |
|
主对话体验 |
长上下文占满窗口,卡顿 |
清爽,只看到指令和结果 |
节省比例:年底前接近 100%;2027 年起,WB 编排层可能微调用 deepseek-v4-flash,但 CNB 执行层若继续免费则仍是 0,整体成本依然是传统用法的 1/10 甚至更低。
六、典型应用场景
这套架构特别适合以下任务:
📦 场景 1:代码库级重构
让 CodeBuddy 把 src/ 目录下所有
ES5 写法改成 ES6+,保持功能不变,
完成后提 PR
上下文可能涉及数百个文件——直接喂给 WorkBuddy 主对话会爆窗口,但丢给 CNB NPC 完全没问题。
📦 场景 2:批量文件处理
分析仓库 docs/ 下所有 markdown 文件,
提取标题层级,生成 SUMMARY.md
NPC 在云端逐个读取、处理、生成,WorkBuddy 只收最终结果。
📦 场景 3:复杂功能开发
实现用户鉴权模块:
- JWT 生成与验证
- 中间件拦截
- 单元测试
完成后提 PR 到 auth-feature 分支
NPC 会自己读项目结构、写代码、跑测试、提 PR。
📦 场景 4:跨仓库协同
同步 my-org/lib-core 的最新改动
到 my-org/app-web 的依赖中,
解决冲突后提 PR
workbuddy-cnb-skill 的 npc-run --mirror 天生支持跨仓库操作。
七、⚠️ 三个必须正视的边界
1. Hy3 免费是有时效的
根据社区消息,Hy3 的免费期到 2026 年 8 月 31 日结束。免费期结束后:
- 切换 deepseek-v4-flash(倍率 0.06x,依然很便宜)
- 或使用 WorkBuddy 每日签到的免费 Credits 额度
- 编排层的单轮消耗本身很低(只是发指令),所以即便计费也微不足道
真正关键的免费窗口是 CNB 的 DeepSeek V4 Flash——免费到 2026-12-31。这个窗口期内,重活执行端完全免费,这才是架构省钱的大头。
2. CNB 的 AI Credits 有月度上限
CNB 每月赠送 500 AI Credits,月底清零不叠加。"临时免费"指这 500 credits 目前不花钱,但重度使用要注意。
💡 实操建议:把大型任务拆成合理的 issue 序列,分批让 NPC 执行,避免单日集中爆量。
3. "替我上班"模式需 Developer 权限
NPC 要读写文件、执行命令、提 PR,必须在你自己有 Developer 权限的仓库里。官方公开仓库里 NPC 无法推代码。
⚠️ 千万别在核心生产库裸跑 NPC。第一次用拿测试仓库/Fork 仓库试水,检查 NPC 提交的 Git diff,确认只改了目标文件。
八、12 月 31 日之后怎么办
CNB 官方对 DSV4-Flash 免费政策的原话是"临时免费,年底再说"——后续收不收费、怎么收都没定论。建议提前准备三条后路:
- WorkBuddy Credits:deepseek-v4-flash 倍率 0.06x,依然便宜
- 腾讯云 Token Plan:固定订阅费模式,额度内单价显著低于按量计费
- 火山 against 套餐/其他云厂商套餐:DeepSeek 涨价后,部分云厂商套餐并未跟涨
但不管哪条后路,架构本身不用变——WB 编排 + CNB 执行的分离模式依然成立,只是执行层的模型计费方式可能调整。这也是分层架构的优势:换模型不影响编排层。
九、写在最后:把"关系确认机"MVP 跑出来的真实案例
我用这套架构,把"关系确认机"(一个面向银发家庭的产品)的 MVP 拆成了 CNB Issue 序列:
issue #1: 搭建微信小程序子女端框架
issue #2: 实现时序信件后端 API
issue #3: 实现微信公众号服务号推送模块
issue #4: 实现关系日记生成 cron job
issue #5: 实现反向给予(跑腿对接)模块
每个 issue 在 WorkBuddy 里一句话下发,CNB NPC 用免费的 DeepSeek V4 Flash 在云端逐个实现、提 PR。我作为"指挥官",WorkBuddy 主对话里只看到:
- "PR #2 已提交:时序信件 API 完成"
- "PR #3 已提交:公众号推送模块完成"
- ...
整个 MVP 从 0 到可演示,模型调用成本 ≈ 0 元。
🎬 结语
当 DeepSeek API 涨价、各路教程都在教你怎么"优化 prompt 省 token"时,真正的省钱思路是:让 token 消耗发生在免费的地方。
WorkBuddy 的 Hy3 是当前免费的轻量编排层,CNB 的 DeepSeek V4 Flash 是年底前免费的重型执行层。两者通过 workbuddy-cnb-skill 打通,构成了 2026 年下半年最划算的 AI 编码流水线。
时间窗口很明确:现在 ~ 2026-12-31。这 4 个月里,复杂编码任务的模型调用成本 ≈ 0。
12 月 31 日之后政策如何,无人知晓。但有一点可以确定:养成"轻编排 + 重执行分离"的习惯,比纠结某个模型是否免费更重要——因为架构对了,换哪个模型你都不会被绑定。
参考资料:
- CNB 平台 CodeBuddy 调用 DeepSeek V4 Flash 免费到 2026-12-31
- workbuddy-cnb-skill 官方仓库:npc-run 跨仓库处理、PR 闭环机制
- WorkBuddy 官方文档:Hy3 免费期、Credits 计量、模型切换
- DeepSeek V4 Flash 0731 版本:284B 总参数 MoE、1M 上下文、增强 Agent 与编程能力
欢迎在评论区交流你的使用心得,或者分享你用这套架构跑通的有趣任务。
更多推荐
所有评论(0)