WorkBuddy 模型与思考模式详解:Hy3 快慢思考融合 + 多模型切换 + 积分透明
2026/8/2 11:48:57 网站建设 项目流程

WorkBuddy 模型与思考模式详解:Hy3 快慢思考融合 + 多模型切换 + 积分透明

摘要:本文拆解 WorkBuddy 的模型与思考体系。以腾讯 2026 年 7 月发布的旗舰模型 Hy3(MoE 架构、256K 上下文、快慢思考融合)为核心,讲清思考模式、多模型切换与积分透明三大机制,并给出 models.json 配置示例与按任务选型的实战建议,帮你把 AI 的「脑回路」和「花销」都握在手里。

目录

  • 一、背景:模型选择是 AI 办公的第一道开关
  • 二、核心概念:Hy3 / 思考模式 / 多模型 / 积分透明
  • 三、实战:切换模型与配置自定义模型
  • 四、进阶:按任务选型与省钱技巧
  • 五、总结

一、背景:模型选择是 AI 办公的第一道开关

用 WorkBuddy 干活,第一个要做的决定往往是:用哪个模型?这件事之所以重要,是因为模型倍率直接决定积分消耗速度。同一份工作,交给高倍率旗舰模型和轻量模型处理,成本可能相差数倍;而不同任务对推理深度的要求又天差地别——写一句周报不需要深度推理,调一个多步 Agent 工作流却非深度思考不可。

WorkBuddy 把这件事做成了「可调度、可透视」的能力:既能一键切换模型,也能控制思考强度,还能把每一次消耗的积分摊开给你看。理解这套体系,是用好 WorkBuddy 的基础。

二、核心概念:Hy3 / 思考模式 / 多模型 / 积分透明

2.1 Hy3:快慢思考融合的旗舰模型

Hy3 是腾讯于 2026 年 7 月 6 日正式发布的旗舰大模型,在 WorkBuddy 首发上线。它的几个关键指标值得记住:

  • MoE 混合专家架构:总参数 295B,激活参数仅 21B,用「小身板」跑出比肩参数规模 2~5 倍旗舰模型的水平。
  • 256K 超长上下文:长文档、大代码库可以一口气吃下去,做数据分析、代码开发很顺手。
  • 快慢思考融合:简单问题秒回,复杂任务进入深度推理,兼顾速度与质量。
  • 办公场景实测:相较 preview 版本,端到端任务成功率由 72% 提升至 90%,单任务平均耗时缩减 34%;文档处理较 GLM-5.2 节省约 47.4% 的 token,PPT 制作节省约 49.0%。
  • 定价:输入 1 元/百万 tokens、输出 4 元/百万 tokens(端内常有免费体验活动,以当前标识为准)。

2.2 思考模式:极速与深度两条通道

WorkBuddy 把「思考」做成了可切换的模式,对应 Hy3 的快慢思考融合:

  • 极速模式:适合简单问答、格式转换、轻量改写,追求秒回。
  • 深度思考模式:适合复杂推理、多步规划、代码与数据分析,模型会展开推理链。

工程实现上,深度思考支持并行子任务,WorkBuddy 在 5.3.6 版本专门修复了「深度思考并行子任务时思考文本相互覆盖」的问题,并在 5.3.3 修复了思考强度档位外显异常,让强度选择更稳定可见。

2.3 多模型:从 Auto 路由到自定义接入

WorkBuddy 不绑定单一模型,提供多层选择:

  • Auto 模式:智能路由,按任务复杂度自动调度最优模型,适合不确定用哪个模型的场景。
  • 混元家族:以 Hy3 为代表的腾讯自研模型,性价比突出。
  • 自定义模型:支持接入 DeepSeek V4、Kimi K2.6 等,通过models.json配置,且支持热更新(修改后无需重启)。
  • 切换轨迹清晰:对话中切换模型会自动插入分隔线提示,模型轨迹一目了然;Token Plan 可切换不同计费策略。

2.4 积分透明:花多少、怎么花都看得见

为了避免「不知不觉烧光积分」,WorkBuddy 在费用侧做了多轮透明化:

  • 模型倍率公示:不同模型设置不同积分消耗系数,能力越强系数越高。
  • 夜间折扣展示:5.3.3 与 5.2.3 新增「模型夜间折扣展示」,费用信息更透明。
  • 生图/生视频提示:ImageGen / VideoGen 工具描述里直接标注积分消耗,提醒你避开「积分刺客」(视频生成最贵,使用前务必确认)。
  • 用量平铺展示:5.2.6 把模型积分用量从 hover 隐藏改为名称与图标平铺显示,随时可见。

整体架构可以用下面这张图概括:

图:模型层(Auto 路由 / Hy3 / 自定义)与思考模式(极速 / 深度)双轴,叠加积分透明与多模型切换。

三、实战:切换模型与配置自定义模型

日常使用里,切换模型通常在对话输入框上方的模型列表里完成:点开列表 → 选择「混元 Hy3」或「Auto」→ 选中即生效,对话中切换会自动插入分隔线。

如果要接入自己的模型,编辑 WorkBuddy 的models.json即可,修改后无需重启(热更新)。一个最小配置示例:

{"models":[{"id":"hunyuan-hy3","name":"混元 Hy3","provider":"tencent","context_length":256000,"thinking":true,"pricing":{"input":1,"output":4,"unit":"per_million_tokens"}},{"id":"deepseek-v4","name":"DeepSeek V4","provider":"deepseek","context_length":128000,"thinking":true},{"id":"kimi-k2_6","name":"Kimi K2.6","provider":"moonshot","context_length":200000,"thinking":false}]}

写入后,在模型列表里就能看到新接入的模型;对积分敏感的任务,优先选倍率更低的模型,并在闲时利用夜间折扣。

四、进阶:按任务选型与省钱技巧

把模型、思考模式和积分三件事组合起来,可以按任务类型建立一张选型表:

任务类型推荐模型思考模式说明
周报 / 格式转换 / 轻量改写Auto 或 Hy3极速追求速度,省积分
复杂推理 / 多步规划Hy3深度思考成功率与质量优先
代码开发 / 大代码库Hy3(256K 上下文)深度思考长上下文吃得下
数据分析 / 图表生成Hy3深度思考数据类任务省 token
生图 / 生视频专用 ImageGen / VideoGen留意积分提示,控制频次

省钱与避坑的几个建议:

  • 不确定就用 Auto:让路由帮你选,避免手动选高倍率模型做简单活。
  • 闲时用夜间折扣:对时效性不强的批量任务,放到夜间跑更划算。
  • 避开积分刺客:视频生成最贵且提示最弱,使用前确认积分余额。
  • 长文档交给 Hy3:256K 上下文一次吞下,省去分段拼接的麻烦。

五、总结

  • WorkBuddy 的模型体系以Hy3(MoE 295B/21B 激活、256K 上下文、快慢思考融合)为核心,办公场景实测成功率 72%→90%。
  • 思考模式提供极速与深度两条通道,深度思考支持并行子任务,相关稳定性在 5.3.6 得到修复。
  • 多模型覆盖 Auto 路由、混元家族与自定义接入(DeepSeek V4 / Kimi K2.6),models.json热更新免重启。
  • 积分透明通过模型倍率、夜间折扣、生图/生视频提示与用量平铺展示,让花销看得见。
  • 按任务选型 + 闲时折扣 + 避开积分刺客,是把成本压到最低的三件套。

模型不是越贵越好,而是「选得对、想得清、花得明」。把这三件事理顺,WorkBuddy 才算真正为你所用。

参考资料

  • 腾讯云开发者社区《WorkBuddy 大模型怎么选?场景化选型指南》(2026-07-10)
  • 科技日报《参数"做减法" 智能"做加法" 腾讯混元 Hy3 以高性价比推动普惠》(2026-07-06)
  • 腾讯网《腾讯混元 Hy3 正式发布!日均 Token 消耗量增长 20 倍》(2026-07-06)
  • 搜狐科技《记者实测 Hy3,再次看到腾讯做"好用"模型的决心》(2026-07)
  • WorkBuddy 官方更新日志(workbuddy.cn 文档中心,含 5.3.3 / 5.3.6 模型与思考相关条目)

需要专业的网站建设服务?

联系我们获取免费的网站建设咨询和方案报价,让我们帮助您实现业务目标

立即咨询