2026 年 8 月 28 日深夜,腾讯混元没有开发布会,只发了一篇文章加一个开源仓库,Hy4 preview 就这么上线了。紧接着的周末,WorkBuddy 首发接入后任务队列就开始排队,官方紧急扩容,公关总监张军公开回应”调用量出奇猛增”——这是 8 月中国模型界密集发布潮的收官一枪,也是腾讯第一次把旗舰模型做到开源第一梯队。
本文不讲发布会,直接讲三件事:Hy4 preview 到底强在哪、跟 GLM-5.3/Kimi K3 比什么水平、以及普通用户和开发者各怎么用上它。
太长不看
| 维度 | 一句话结论 |
|---|---|
| 定位 | 开源旗舰大模型,主打软件工程、办公分析、游戏开发、科学研究四大生产力场景 |
| 发布时间 | 2026-08-28 发布并开源(Apache 2.0) |
| 参数规模 | 总参数 770B(7700 亿),激活参数 49B |
| 上下文 | 100 万 Token,支持超长文档与大型代码库 |
| 性能 | 腾讯内部 163 专家 203 任务盲测 2.99/4,略胜 GLM-5.3(2.92)与 Kimi K3(2.94) |
| API 价格 | 输入 6 元/百万 Token,输出 18 元/百万 Token,缓存命中 0.3 元/百万 Token |
| 怎么用 | 元宝/ima 免费体验;WorkBuddy/CodeBuddy 深度集成;腾讯云 TokenHub 与 OpenRouter 调 API |
背景:为什么 Hy4 preview 值得关注
过去一个月中国开源模型密集出新:DeepSeek 端出 V4-Flash 和 V4 Pro 正式版,千问发了 Qwen3.8-Max,智谱推了 GLM-5.3,临近月末智谱和千问还各自深夜放出 Flash 版本。腾讯混元在这个节骨眼上推出 Hy4 preview,是它这两年 AI 投入的一次集中兑现。
跟自家上一代 Hy3 相比,这次升级幅度相当大:
| 指标 | Hy3 正式版 | Hy4 preview | 变化 |
|---|---|---|---|
| 总参数 | 295B | 770B | 2.6 倍 |
| 激活参数 | 21B | 49B | 2.3 倍 |
| 上下文长度 | 256K | 1M | 4 倍 |
| 开源协议 | 部分开放 | Apache 2.0 全开放 | 权重、推理代码全放 |
参数翻倍不代表一切,但配合”为生产力而生”的数据共建策略——腾讯直接拉软件工程、游戏、金融、安全各条线的顶尖专家参与高质量数据建设,模型在真实任务上的表现比纯堆参数更扎实。
性能:内部盲测的含金量
腾讯公布的数据是内部组织的 163 名专家、203 个工程任务盲测:Hy4 preview 均分 2.99/4,略优于 GLM-5.3(2.92/4.00)和 Kimi K3(2.94/4.00)。注意这是工程任务盲测,不是基准测试刷分——专家直接上手干活打分,比 benchmark 更接近日常使用感受。
四个重点提升场景:
- 软件工程:长程开发任务的理解、规划、调试与验证能力增强,前端开发的视觉审美也有提升——配合 CodeBuddy 使用效果更明显
- 办公分析:长文档理解 + 表格数据处理,1M 上下文意味着可以直接丢一整本手册或者几十页报表进去
- 游戏开发:有媒体实测 Hy4 preview 生成游戏能自行纠错,说明代码生成 + 执行验证的闭环做得不错
- 科学研究:长程推理与多步实验设计能力,适合论文阅读与实验方案生成
价格:继续走高性价比路线
| 计费项 | 价格(元/百万 Token) |
|---|---|
| 输入(缓存命中) | 0.3 |
| 输入(普通) | 6 |
| 输出 | 18 |
横向对比:GLM-5.3 输入 8 元/输出 28 元,DeepSeek V4-Pro 过渡价输入约 3 元/输出约 6 元(高峰后上调)。Hy4 preview 的输入价只有 GLM-5.3 的 75%,输出价便宜 36%,长上下文场景(缓存命中率高的对话、文档处理)成本优势更明显。
怎么用:四条路径
1. 免费体验:元宝、ima
腾讯元宝和 ima 已接入 Hy4 preview,普通用户直接在 App 或网页端选模型即可,不花钱、不用配 API。适合先感受 1M 上下文的实际体验——比如把一份长合同或整本电子书丢进去问问题。
2. 深度集成:WorkBuddy、CodeBuddy
WorkBuddy 是首发接入的产品(也是 8/31 排队事件的主角),CodeBuddy 面向编程场景。开发者想体验”模型 + 工具链”的完整效果,直接用这两个产品最省事。排队高峰出现在发布后首个工作日,目前官方已扩容,高峰期偶尔仍需等待。
3. API 接入:腾讯云 TokenHub
开发者走腾讯云 TokenHub 开通,模型名称为 hunyuan-hy4-preview(以官方控制台为准)。TokenHub 是腾讯云统一的模型网关,开通后拿到 API Key 就能调,计费走上面那张价格表。
4. 国际调用:OpenRouter
不想开腾讯云账号的话,OpenRouter 上也已上架 Hy4 preview,对海外开发者和习惯统一 API 格式的团队更友好。OpenRouter 统一 OpenAI 兼容格式,切换成本很低。
FAQ
Q1:Hy4 preview 是免费的吗? 模型开源(Apache 2.0),权重可以自己部署;官方 API 按量计费,元宝/ima 里可以免费体验。
Q2:1M 上下文能干什么? 一次处理约 70-80 万英文单词或一整本长篇小说。实际用途:整仓代码分析、长合同/法规全文问答、几十页报表一次性处理。
Q3:和 GLM-5.3、Kimi K3 怎么选? 三者同属开源第一梯队,盲测互有胜负(Hy4 2.99 vs GLM-5.3 2.92 vs Kimi K3 2.94)。选型看生态:腾讯系产品(元宝/ima/WorkBuddy)用 Hy4 最顺;已用智谱或月之暗面 API 的团队没必要迁移。
Q4:排队问题解决了吗? 8/31 高峰排队是首发接入 WorkBuddy 后的短期现象,官方周末连续扩容。现在 API 调用基本稳定,但高峰时段仍有偶发等待,不影响使用。
Q5:本地能跑吗? 开源权重已发布,但 770B 总参数、49B 激活的体量对硬件要求高,个人设备不现实,建议直接走 API 或等社区量化版本。
总结
Hy4 preview 是 8 月开源模型大战的收官之作:1M 上下文 + 770B 总参数 + 白菜价 API,配合腾讯自家的产品生态,代码、办公、游戏、科研四个场景都有真东西。想体验 1M 上下文的同学,元宝里直接开用;开发者按自己的云服务习惯在 TokenHub 或 OpenRouter 二选一即可。
顺手把 8 月这波新模型的上手教程都整理出来了,按需取用:GLM-5.3 上手教程、Kimi K3 上手教程、DeepSeek V4 Pro 上手教程、Qwen3.8-Max 上手教程。
最后提醒一句:用这些海外模型 API 和工具,稳定的国际网络是刚需——下面几家跨境网络加速服务我自己在用的,按需选:
| 服务商 | 特点 | 直达 |
|---|---|---|
| 光速云 | IEPL 专线 + IEPL专线 多路复用,晚高峰稳,主力推荐 | 👉 访问光速云官网 |
| 飞猫云 | IEPL + 住宅 IP,多区解锁表现好 | 👉 访问飞猫云官网 |
| 飞猫云 | 自有机房 IEPL,老牌稳定,年付划算 | 👉 访问飞猫云官网 |
| 微风网络 | 低价入门,¥6.99/月起,全球 80+ 地区 | 访问微风网络官网 |