混元 770B 旗舰开源:Hy4 preview 在 WorkBuddy 夜间免费,23 点后随便薅

一句话结论:腾讯把新一代旗舰混元 Hy4 preview 直接开源了——770B 总参数、每 token 只激活 49B、100 万 token 上下文、Apache 2.0 商用友好;不想折腾部署,WorkBuddy 里现在就能用,还有「夜间免费」,每晚 23 点到早 8 点不扣积分。
打开 WorkBuddy 选模型,列表里有个名字旁边挂着蓝色小标:Hy4 preview,夜间免费。
截图里能看到,它上面的快速、均衡、极致是三档速度,倍率 0.21x 到 1.20x;它下面的 Hy3 挂着「限时免费」,DeepSeek-V4.1-Flash 挂着「独家优惠」。一个模型列表,半页活动。

这期把 Hy4 preview 是个什么东西、夜间免费怎么薅、想自部署要去哪拿权重,一次讲清。
📊 速览表
| 项目 | 信息 |
|---|---|
| 模型 | 混元 Hy4 preview(纯语言模型) |
| 发布 / 开源 | 2026 年 8 月 28 日,协议 Apache 2.0 |
| 架构 | MoE,总参数 770B,每 token 激活 49B |
| 上下文 | 1M token |
| WorkBuddy 权益 | 夜间免费 23:00–次日 8:00 |
| Hy3 备胎 | 限时免费至 9 月 30 日 |
| 自部署 | Hugging Face / GitHub 权重,vLLM 官方 recipes 已收录 |
先看时间线

8 月 28 日,腾讯混元发布并开源 Hy4 preview。上线即爆火,调用量激增,WorkBuddy 国内版首发接入,给了两周限免,到 9 月 10 日晚结束。
按常理,故事到这就该结束了。但官方接着做了个调整:已经体验过 Hy4 preview 的用户,闲时夜间(23:00–次日 8:00)继续免费,其余时间正常扣积分。Hy3 的限时免费则延长到 9 月 30 日。
所以 9 月 21 日的今天,你在 WorkBuddy 模型列表里还能看到那个「夜间免费」的小蓝标。白嫖窗口还开着,只是改到了夜里。
770B 旗舰,参数上看什么
几个硬数,都来自官方发布:
- 总参数 770B,每 token 激活 49B。MoE 架构的标准打法——模型装了很多货,但每次只开一小部分仓门,推理成本远低于同体量稠密模型;
- 主干 78 层,第一层是标准 FFN,其余 77 层全是 MoE 层;
- 上下文 1M token。整库代码、几百页文档,一把塞进去;
- Apache 2.0。商用无额外条款,这是开源协议里最省心的一档。
定位是「生产力旗舰」,官方说法是在代码、办公、科学等真实生产力任务上表现突出,还登上了 OpenRouter 使用量第一。至于「追平 Claude」这类官网评论区的话,听听就好,自己上手跑两个真实任务再下结论。
有一点必须提前知道:Hy4 preview 是纯语言模型,不能生图、不能生视频,相关任务会被自动切到其他模型。别拿它去排画图的活。
夜间免费怎么薅
操作本身没有门槛:
- 打开 WorkBuddy,模型列表选 Hy4 preview;
- 每天 23:00 到次日 8:00,不扣积分;
- 其余时段按 0.29x 积分倍率正常消耗;
- 遇到限频,按提示等重置,或者切 Hy3——限时免费 0.00x,能顶到 9 月 30 日。
官方给过说明:每日免费额度有限,触发限频会提示重置时间;非紧急需求建议错峰晚间用,排队时切 Hy3。CodeBuddy 国内、国际版也同步接了这套限免。
WorkBuddy 当前几个主力模型的倍率,放一起看更直观:
| 模型 | 标签 | 积分倍率 |
|---|---|---|
| Hy4 preview | 夜间免费 | 0.29x |
| Hy3 | 限时免费(至 9/30) | 0.00x |
| DeepSeek-V4.1-Flash | 独家优惠 | 0.03x |
| GLM-5.3 | — | 0.79x |
白天限频就夜里跑,反正 AI 不睡觉。
三个要注意的地方:
- 官方口径里,夜间免费针对「已体验过 Hy4 preview 的用户」——新用户是否直接适用,官方没细说,以产品内实际生效为准;
- 夜间免费没有公开的截止时间。限免活动说停就停,别把它当长期依赖;
- 它毕竟是 preview 版,官方说过在紧急扩容、新版可能近期上线。追生产稳定性的人可以等正式版。
想自己部署的,权重在这
运维和做私有化的人,关心的不是 WorkBuddy,是权重在哪、能不能进自己的推理栈:
- Hugging Face:
tencent/Hy4-preview; - GitHub:官方仓库带中文 README,模型卡、评测、使用说明都在;
- vLLM:官方 recipes 已收录 Hy4 preview 的支持文档,推理框架这条路是通的。
别被「只激活 49B」迷惑——激活的是计算量,770B 的全量权重该占的显存一点不少,多卡起步。动手前先看 README 里的部署要求和量化方案,再决定是买卡还是租卡。
买卡的钱也不一定非要花:9 月 15 日起,硅基流动的模型中心也上线了 Hy4 preview,API 直接调,作为自部署之前的过渡方案挺合适。
开源的意义从来不是人人都能跑 770B,而是没人能拿它卡你的脖子。
🎯 老张建议
- 长任务挪到 23 点后:跑批处理、啃长文档这类不急的活,放到夜间免费时段,1M 上下文随便喂,一分积分不花;
- Hy3 当备胎用到 9 月 30 日:限频、排队的兜底方案,免费额度不用白不用,但记着月底到期;
- 私有化评估可以直接立项:Apache 2.0 + vLLM 支持,链路是完整的,先小规模验证,别急着上生产关键链路——preview 就是 preview。
💬 互动话题
- 夜间免费时段你打算拿 Hy4 跑什么活?
- 770B 的模型开源,你觉得国内私有化部署的需求会被点燃吗?
- 「已体验用户才能夜间免费」这个口径,你觉得是福利还是门槛?
🔗 关注老张
公众号:老张聊运维 小程序:观简国学 个人博客:https://www.shanwaiyun.top/