WorkBuddy 模型与思考模式详解:Hy3 快慢思考融合 + 多模型切换 + 积分透明
摘要:本文拆解 WorkBuddy 的模型与思考体系。以腾讯 2026 年 7 月发布的旗舰模型 Hy3(MoE 架构、256K 上下文、快慢思考融合)为核心,讲清思考模式、多模型切换与积分透明三大机制,并给出 models.json 配置示例与按任务选型的实战建议,帮你把 AI 的「脑回路」和「花销」都握在手里。
目录
- 一、背景:模型选择是 AI 办公的第一道开关
- 二、核心概念:Hy3 / 思考模式 / 多模型 / 积分透明
- 三、实战:切换模型与配置自定义模型
- 四、进阶:按任务选型与省钱技巧
- 五、总结
一、背景:模型选择是 AI 办公的第一道开关
用 WorkBuddy 干活,第一个要做的决定往往是:用哪个模型?这件事之所以重要,是因为模型倍率直接决定积分消耗速度。同一份工作,交给高倍率旗舰模型和轻量模型处理,成本可能相差数倍;而不同任务对推理深度的要求又天差地别——写一句周报不需要深度推理,调一个多步 Agent 工作流却非深度思考不可。
WorkBuddy 把这件事做成了「可调度、可透视」的能力:既能一键切换模型,也能控制思考强度,还能把每一次消耗的积分摊开给你看。理解这套体系,是用好 WorkBuddy 的基础。
二、核心概念:Hy3 / 思考模式 / 多模型 / 积分透明
2.1 Hy3:快慢思考融合的旗舰模型
Hy3 是腾讯于 2026 年 7 月 6 日正式发布的旗舰大模型,在 WorkBuddy 首发上线。它的几个关键指标值得记住:
- MoE 混合专家架构:总参数 295B,激活参数仅 21B,用「小身板」跑出比肩参数规模 2~5 倍旗舰模型的水平。
- 256K 超长上下文:长文档、大代码库可以一口气吃下去,做数据分析、代码开发很顺手。
- 快慢思考融合:简单问题秒回,复杂任务进入深度推理,兼顾速度与质量。
- 办公场景实测:相较 preview 版本,端到端任务成功率由 72% 提升至 90%,单任务平均耗时缩减 34%;文档处理较 GLM-5.2 节省约 47.4% 的 token,PPT 制作节省约 49.0%。
- 定价:输入 1 元/百万 tokens、输出 4 元/百万 tokens(端内常有免费体验活动,以当前标识为准)。
2.2 思考模式:极速与深度两条通道
WorkBuddy 把「思考」做成了可切换的模式,对应 Hy3 的快慢思考融合:
- 极速模式:适合简单问答、格式转换、轻量改写,追求秒回。
- 深度思考模式:适合复杂推理、多步规划、代码与数据分析,模型会展开推理链。
工程实现上,深度思考支持并行子任务,WorkBuddy 在 5.3.6 版本专门修复了「深度思考并行子任务时思考文本相互覆盖」的问题,并在 5.3.3 修复了思考强度档位外显异常,让强度选择更稳定可见。
2.3 多模型:从 Auto 路由到自定义接入
WorkBuddy 不绑定单一模型,提供多层选择:
- Auto 模式:智能路由,按任务复杂度自动调度最优模型,适合不确定用哪个模型的场景。
- 混元家族:以 Hy3 为代表的腾讯自研模型,性价比突出。
- 自定义模型:支持接入 DeepSeek V4、Kimi K2.6 等,通过
models.json配置,且支持热更新(修改后无需重启)。 - 切换轨迹清晰:对话中切换模型会自动插入分隔线提示,模型轨迹一目了然;Token Plan 可切换不同计费策略。
2.4 积分透明:花多少、怎么花都看得见
为了避免「不知不觉烧光积分」,WorkBuddy 在费用侧做了多轮透明化:
- 模型倍率公示:不同模型设置不同积分消耗系数,能力越强系数越高。
- 夜间折扣展示:5.3.3 与 5.2.3 新增「模型夜间折扣展示」,费用信息更透明。
- 生图/生视频提示:ImageGen / VideoGen 工具描述里直接标注积分消耗,提醒你避开「积分刺客」(视频生成最贵,使用前务必确认)。
- 用量平铺展示:5.2.6 把模型积分用量从 hover 隐藏改为名称与图标平铺显示,随时可见。
整体架构可以用下面这张图概括:
图:模型层(Auto 路由 / Hy3 / 自定义)与思考模式(极速 / 深度)双轴,叠加积分透明与多模型切换。
三、实战:切换模型与配置自定义模型
日常使用里,切换模型通常在对话输入框上方的模型列表里完成:点开列表 → 选择「混元 Hy3」或「Auto」→ 选中即生效,对话中切换会自动插入分隔线。
如果要接入自己的模型,编辑 WorkBuddy 的models.json即可,修改后无需重启(热更新)。一个最小配置示例:
{"models":[{"id":"hunyuan-hy3","name":"混元 Hy3","provider":"tencent","context_length":256000,"thinking":true,"pricing":{"input":1,"output":4,"unit":"per_million_tokens"}},{"id":"deepseek-v4","name":"DeepSeek V4","provider":"deepseek","context_length":128000,"thinking":true},{"id":"kimi-k2_6","name":"Kimi K2.6","provider":"moonshot","context_length":200000,"thinking":false}]}写入后,在模型列表里就能看到新接入的模型;对积分敏感的任务,优先选倍率更低的模型,并在闲时利用夜间折扣。
四、进阶:按任务选型与省钱技巧
把模型、思考模式和积分三件事组合起来,可以按任务类型建立一张选型表:
| 任务类型 | 推荐模型 | 思考模式 | 说明 |
|---|---|---|---|
| 周报 / 格式转换 / 轻量改写 | Auto 或 Hy3 | 极速 | 追求速度,省积分 |
| 复杂推理 / 多步规划 | Hy3 | 深度思考 | 成功率与质量优先 |
| 代码开发 / 大代码库 | Hy3(256K 上下文) | 深度思考 | 长上下文吃得下 |
| 数据分析 / 图表生成 | Hy3 | 深度思考 | 数据类任务省 token |
| 生图 / 生视频 | 专用 ImageGen / VideoGen | — | 留意积分提示,控制频次 |
省钱与避坑的几个建议:
- 不确定就用 Auto:让路由帮你选,避免手动选高倍率模型做简单活。
- 闲时用夜间折扣:对时效性不强的批量任务,放到夜间跑更划算。
- 避开积分刺客:视频生成最贵且提示最弱,使用前确认积分余额。
- 长文档交给 Hy3:256K 上下文一次吞下,省去分段拼接的麻烦。
五、总结
- WorkBuddy 的模型体系以Hy3(MoE 295B/21B 激活、256K 上下文、快慢思考融合)为核心,办公场景实测成功率 72%→90%。
- 思考模式提供极速与深度两条通道,深度思考支持并行子任务,相关稳定性在 5.3.6 得到修复。
- 多模型覆盖 Auto 路由、混元家族与自定义接入(DeepSeek V4 / Kimi K2.6),
models.json热更新免重启。 - 积分透明通过模型倍率、夜间折扣、生图/生视频提示与用量平铺展示,让花销看得见。
- 按任务选型 + 闲时折扣 + 避开积分刺客,是把成本压到最低的三件套。
模型不是越贵越好,而是「选得对、想得清、花得明」。把这三件事理顺,WorkBuddy 才算真正为你所用。
参考资料
- 腾讯云开发者社区《WorkBuddy 大模型怎么选?场景化选型指南》(2026-07-10)
- 科技日报《参数"做减法" 智能"做加法" 腾讯混元 Hy3 以高性价比推动普惠》(2026-07-06)
- 腾讯网《腾讯混元 Hy3 正式发布!日均 Token 消耗量增长 20 倍》(2026-07-06)
- 搜狐科技《记者实测 Hy3,再次看到腾讯做"好用"模型的决心》(2026-07)
- WorkBuddy 官方更新日志(workbuddy.cn 文档中心,含 5.3.3 / 5.3.6 模型与思考相关条目)