用 WorkBuddy + CNB 搭建"零消耗"AI 编码流水线:让WB当指挥官,DeepSeek V4 Flash 在云端干重活

💡 本文不是教你怎么调 DeepSeek API,而是分享一个把 token 消耗的物理位置搬走的工程架构:WorkBuddy 用免费/低成本的混元模型做轻量编排,CNB 在云端用限时免费的 DeepSeek V4 Flash 跑复杂编码。年底前这套组合,复杂任务的模型调用成本接近于零


一、为什么不能直接在 WorkBuddy 里硬跑重任务

DeepSeek 官方近期宣布 API 整体涨价,预计涨幅较大。即便 WorkBuddy 内置了 Credits 计量,复杂编码任务的长上下文反复出现在主对话里,积分消耗依然可观

核心矛盾是:

  • 复杂任务(代码生成、仓库重构、批量处理)需要在长上下文里反复推理
  • 长上下文 = 大量 Input Token 反复计费
  • WorkBuddy 主对话窗口如果承载这些上下文,Credits 会肉眼可见地往下掉

那有没有一种方式,让 WorkBuddy 只做"指挥官",把重活物理搬运到另一个免费执行端?

有。答案是 CNB(云原生构建)+ CodeBuddy NPC


二、核心洞察:token 消耗发生在哪里,比"哪个模型便宜"更重要

CNB 平台(cnb.cool)内置了 CodeBuddy 智能体,当前默认模型 deepseek-v4-flash 限时免费,可用到 2026 年 12 月 31 日——不限量、不绑卡、不开会员。

同时,CNB 官方提供了 workbuddy-cnb-skill,让 WorkBuddy 可以通过 cnb-api 远程触发 CNB 仓库里的 CodeBuddy NPC,NPC 跨仓库处理任务、提 PR,结果回写到源 issue。

这两个事实叠加,催生了一个巧妙的架构:

WorkBuddy 主对话(Hy3 免费/低成本)
    ↓ 只发一句轻量指令
CNB 仓库 Issue 里 @CodeBuddy
    ↓ 云端执行(DeepSeek V4 Flash 免费)
结果回写到 WorkBuddy
    ↓
WorkBuddy 只接收短文本结果

关键点:复杂的代码上下文、NPC 多轮推理、工具调用——全部发生在 CNB 云端,不占用 WorkBuddy 主对话的上下文窗口。WorkBuddy 主对话只传输"指令"和"最终结果"两段极短文本。

这就是为什么能做到"零消耗":

  • WorkBuddy 侧:用 Hy3(当前免费期倍率 0×)发指令,消耗可忽略
  • CNB 侧:DeepSeek V4 Flash 免费到 2026-12-31,重活执行成本 = 0
  • 总账:年底前跑复杂编码任务,模型调用成本 ≈ 0

三、架构原理:轻量编排层 + 重型执行层分离

这是 Agent 系统工程里的标准范式。我们把两层分开看:

🎯 编排层:WorkBuddy + Hy3

WorkBuddy 是腾讯推出的 AI 编程智能体,支持混元、DeepSeek、GLM、Kimi、MiniMax 等模型自由切换。其中腾讯混元 Hy3 在当前免费期内,文本对话、代码生成、复杂推理等任务消耗倍率为 0

编排层只干三件事:

  1. 接收用户的自然语言指令
  2. 通过 workbuddy-cnb-skill 把指令转发到 CNB
  3. 接收 CNB 回写的结果摘要

⚙️ 执行层:CNB + CodeBuddy NPC + DeepSeek V4 Flash

CNB 是腾讯旗下的云原生研发平台,把代码托管、CI、远程开发、AI 助手融为一体。在其仓库的 Issue/PR 里 @CodeBuddynpc/CodeBuddy,就能召唤 AI 智能体:

  • 读整个代码库上下文
  • 多轮推理 + 工具调用
  • 写文件 / 跑命令 / 提 PR
  • 当前默认模型 deepseek-v4-flash 免费到 2026-12-31

🔗 桥梁:workbuddy-cnb-skill

这是 CNB 官方提供的 Skill,安装在 WorkBuddy 里,核心机制是:

npc-run --mirror 在镜像 issue 上召唤 NPC 跨仓库处理源仓库并提交源仓库 PR;处理完成后才把结果回写到源 issue(不带 @ 触发词,防止二次召唤)。pr-watch 检测关联 PR 合并后自动关闭镜像 issue,形成「整合 → 处理 → PR → 闭环」全流程。

简单说:你在 WorkBuddy 里说一句话,skill 自动在 CNB 镜像 issue 召唤 NPC,NPC 在源仓库干完重活,PR 自动提回来,镜像 issue 自动关闭


四、实战配置:30 分钟跑通整套流水线

Step 1:WorkBuddy 侧配置

  1. 下载安装 WorkBuddy(官方地址:codebuddy.cn/work/)
  2. 微信扫码登录
  3. 模型切换到 Hy3(确认带"限时免费"标签,倍率 0×)
  4. 安装 workbuddy-cnb-skill:
    • 下载 zip 解压到用户级 skill 目录
    • Windows:`%USERPROFILE%.workbuddy\skills`
    • macOS/Linux:~/.workbuddy/skills/

Step 2:CNB 侧配置

  1. 打开 cnb.cool,微信扫码登录
  2. 创建一个组织(微信认证,免费)
  3. 在组织下创建你的仓库
  4. 仓库设置 → AI 能力 → 开启 CodeBuddy NPC
  5. 确认 defaultModel 是 deepseek-v4-flash(CNB 当前默认)

⚠️ 权限提醒:CodeBuddy NPC 要真正写代码、推分支、建 PR,必须在你自己有 Developer 权限的仓库里操作。官方公开仓库里你的角色通常是 Reporter,NPC 无法推代码。所以用自己的仓库,别在别人仓库里裸跑。

Step 3:打通 WorkBuddy ↔ CNB

  1. 在 WorkBuddy 连接器管理页启用 cnb-api
  2. 终端执行 cnb login(OAuth2 设备授权)
  3. 回到 WorkBuddy 对话,首次运行 workbuddy-cnb-skill 会强制进行 4 项设定引导
    • 默认 NPC
    • 默认模型(选 deepseek-v4-flash
    • 镜像整合仓库
    • 任务集
  4. 设定值保存在 ~/.config/workbuddy-cnb/config.json

Step 4:跑第一个任务

在 WorkBuddy 对话里直接下指令:

去我的仓库 my-org/my-repo 的 issue #5,
让 CodeBuddy 实现一个 React 登录页组件,
包含表单校验和提交逻辑,完成后提 PR

Skill 会自动:

  1. 在镜像仓库创建 issue 并 @NPC
  2. NPC 在源仓库 my-org/my-repo 执行复杂编码
  3. 完成后提 PR 回源仓库
  4. 结果回写到 WorkBuddy 对话

整个过程中

  • WorkBuddy 主对话消耗:下指令 + 收结果 ≈ 100-200 tokens(Hy3 免费额度内)
  • CNB 侧消耗:NPC 读代码库 + 多轮推理 + 工具调用 ≈ 几十万 tokens(DSV4-Flash 免费)

五、成本对比:传统用法 vs 本架构

以"分析 1000 篇竞品文案并生成报告"为例:

维度

传统用法(WB 主对话直接跑 DeepSeek V4 Pro)

本架构(WB+Hy3 编排 + CNB+Flash 执行)

上下文处理

主对话反复加载,几百万 tokens

全部在 CNB 云端,WB 主对话只传指令和结果

模型单价

V4 Pro 高峰输出 27 元/百万 tokens

DSV4-Flash 免费

WB 侧消耗

Credits 持续消耗

Hy3 免费期 0 消耗

预估成本

几十到上百元

≈ 0 元(年底前)

主对话体验

长上下文占满窗口,卡顿

清爽,只看到指令和结果

节省比例:年底前接近 100%;2027 年起,WB 编排层可能微调用 deepseek-v4-flash,但 CNB 执行层若继续免费则仍是 0,整体成本依然是传统用法的 1/10 甚至更低。


六、典型应用场景

这套架构特别适合以下任务:

📦 场景 1:代码库级重构

让 CodeBuddy 把 src/ 目录下所有
ES5 写法改成 ES6+,保持功能不变,
完成后提 PR

上下文可能涉及数百个文件——直接喂给 WorkBuddy 主对话会爆窗口,但丢给 CNB NPC 完全没问题。

📦 场景 2:批量文件处理

分析仓库 docs/ 下所有 markdown 文件,
提取标题层级,生成 SUMMARY.md

NPC 在云端逐个读取、处理、生成,WorkBuddy 只收最终结果。

📦 场景 3:复杂功能开发

实现用户鉴权模块:
- JWT 生成与验证
- 中间件拦截
- 单元测试
完成后提 PR 到 auth-feature 分支

NPC 会自己读项目结构、写代码、跑测试、提 PR。

📦 场景 4:跨仓库协同

同步 my-org/lib-core 的最新改动
到 my-org/app-web 的依赖中,
解决冲突后提 PR

workbuddy-cnb-skill 的 npc-run --mirror 天生支持跨仓库操作。


七、⚠️ 三个必须正视的边界

1. Hy3 免费是有时效的

根据社区消息,Hy3 的免费期到 2026 年 8 月 31 日结束。免费期结束后:

  • 切换 deepseek-v4-flash(倍率 0.06x,依然很便宜)
  • 或使用 WorkBuddy 每日签到的免费 Credits 额度
  • 编排层的单轮消耗本身很低(只是发指令),所以即便计费也微不足道

真正关键的免费窗口是 CNB 的 DeepSeek V4 Flash——免费到 2026-12-31。这个窗口期内,重活执行端完全免费,这才是架构省钱的大头。

2. CNB 的 AI Credits 有月度上限

CNB 每月赠送 500 AI Credits,月底清零不叠加。"临时免费"指这 500 credits 目前不花钱,但重度使用要注意

💡 实操建议:把大型任务拆成合理的 issue 序列,分批让 NPC 执行,避免单日集中爆量。

3. "替我上班"模式需 Developer 权限

NPC 要读写文件、执行命令、提 PR,必须在你自己有 Developer 权限的仓库里。官方公开仓库里 NPC 无法推代码。

⚠️ 千万别在核心生产库裸跑 NPC。第一次用拿测试仓库/Fork 仓库试水,检查 NPC 提交的 Git diff,确认只改了目标文件。


八、12 月 31 日之后怎么办

CNB 官方对 DSV4-Flash 免费政策的原话是"临时免费,年底再说"——后续收不收费、怎么收都没定论。建议提前准备三条后路:

  1. WorkBuddy Credits:deepseek-v4-flash 倍率 0.06x,依然便宜
  2. 腾讯云 Token Plan:固定订阅费模式,额度内单价显著低于按量计费
  3. 火山 against 套餐/其他云厂商套餐:DeepSeek 涨价后,部分云厂商套餐并未跟涨

但不管哪条后路,架构本身不用变——WB 编排 + CNB 执行的分离模式依然成立,只是执行层的模型计费方式可能调整。这也是分层架构的优势:换模型不影响编排层


九、写在最后:把"关系确认机"MVP 跑出来的真实案例

我用这套架构,把"关系确认机"(一个面向银发家庭的产品)的 MVP 拆成了 CNB Issue 序列:

issue #1: 搭建微信小程序子女端框架
issue #2: 实现时序信件后端 API
issue #3: 实现微信公众号服务号推送模块
issue #4: 实现关系日记生成 cron job
issue #5: 实现反向给予(跑腿对接)模块

每个 issue 在 WorkBuddy 里一句话下发,CNB NPC 用免费的 DeepSeek V4 Flash 在云端逐个实现、提 PR。我作为"指挥官",WorkBuddy 主对话里只看到:

  • "PR #2 已提交:时序信件 API 完成"
  • "PR #3 已提交:公众号推送模块完成"
  • ...

整个 MVP 从 0 到可演示,模型调用成本 ≈ 0 元。


🎬 结语

当 DeepSeek API 涨价、各路教程都在教你怎么"优化 prompt 省 token"时,真正的省钱思路是:让 token 消耗发生在免费的地方

WorkBuddy 的 Hy3 是当前免费的轻量编排层,CNB 的 DeepSeek V4 Flash 是年底前免费的重型执行层。两者通过 workbuddy-cnb-skill 打通,构成了 2026 年下半年最划算的 AI 编码流水线。

时间窗口很明确:现在 ~ 2026-12-31。这 4 个月里,复杂编码任务的模型调用成本 ≈ 0。

12 月 31 日之后政策如何,无人知晓。但有一点可以确定:养成"轻编排 + 重执行分离"的习惯,比纠结某个模型是否免费更重要——因为架构对了,换哪个模型你都不会被绑定。


参考资料

  1. CNB 平台 CodeBuddy 调用 DeepSeek V4 Flash 免费到 2026-12-31
  2. workbuddy-cnb-skill 官方仓库:npc-run 跨仓库处理、PR 闭环机制
  3. WorkBuddy 官方文档:Hy3 免费期、Credits 计量、模型切换
  4. DeepSeek V4 Flash 0731 版本:284B 总参数 MoE、1M 上下文、增强 Agent 与编程能力

欢迎在评论区交流你的使用心得,或者分享你用这套架构跑通的有趣任务。

Logo

有“AI”的1024 = 2048,欢迎大家加入2048 AI社区

更多推荐