8 月 28 日周五,腾讯在 "腾讯混元" 公众号上发布了新一代语言模型 Hy4 preview,并且直接开源 —— 连模型权重都开放了。所谓权重,就是帮助 AI 做判断的那组核心数值,相当于把训练好的 "大脑" 整个交出来,任何人都能下载、自己部署、按需改造,而不是只能通过腾讯的接口租用。
先看硬指标。Hy4 preview 有 7700 亿参数,参数可以理解成模型大脑里可调节的 "旋钮",数量越大,能拟合的知识和模式越复杂;上下文窗口支持 100 万 Token,粗略说就是一次对话能塞进几十万字的材料,整本报告、整套代码丢进去,模型读到后面也不会忘了前面。腾讯称,和上一代相比,模型规模和数据处理能力都上了一个台阶。

再看腾讯最想强调的部分:测试成绩。腾讯组织了 163 名内部专家,做了 203 个工程任务的盲测 —— 盲测的意思是,专家答题时不知道自己用的是哪家模型,避免品牌光环干扰打分。结果 Hy4 preview 平均得分 2.99 分(满分 4 分),智谱 GLM 5.3 是 2.92 分,月之暗面 K3 是 2.94 分。腾讯确实赢了,但只赢了 0.05 到 0.07 分,差距非常小。
而且彭博社指出,在第三方基准测试里,把阿里巴巴 Qwen 3.8 Max 这些对手也放进来,各家得分互有高低,没有谁能通吃。
模型已经上线。用户可以在腾讯云 TokenHub 和 OpenRouter 上调用,也能在腾讯 WorkBuddy/CodeBuddy、元宝、ima 这些产品里直接体验。定价继续走低:每处理 100 万 Token,输入收费 6 元,输出 18 元,如果命中缓存只要 0.3 元。Token 可以理解成模型处理文字的 "计量单位",这个价格是什么概念 —— 一本十几万字的书稿喂进去,成本也就几块钱,而且缓存复用部分几乎白送。
迭代节奏是另一个看点。据《科创板日报》,自今年 2 月重建基础设施以来,混元平均每两个月就更新一个大版本,按这个节奏,Hy4 的下一版近期就会上线。背景是 "AI 天才少年" 姚顺雨去年底加盟,腾讯今年 4 月发布并开源 Hy3 preview,7 月 6 日又完成一次版本更新,明显是在把落后的进度往回追。

说说我的看法。
第一,这不是 "腾讯碾压同行" 的故事,而是国产大模型进入贴身肉搏阶段的又一个证据。2.99 对 2.94、2.92,分差小到在误差边缘,而且这场盲测是腾讯自己组织、用自己出的 203 道工程任务考的,自证领先的含金量本来就要打折;反倒是彭博引述的第三方测试 "各有高低" 更接近真相 —— 头部几家模型已经没有代差,用户日常用起来差距更小,谁宣布 "超越" 谁,更多是发布节奏里的宣传动作。
第二,开源加超低价,腾讯图的不是卖模型的钱。权重直接开放、输入 6 元、缓存 0.3 元,模型层本身基本是微利甚至赔本赚吆喝。腾讯真正要的是两样:一是调用量带动腾讯云,模型是钩子,云算力才是生意;二是把模型塞进 WorkBuddy、元宝、ima 这些自家入口,用生态锁定用户。这也是整个中国大模型行业的共同打法 —— 模型当基础设施免费送,利润往应用层和云服务迁移。
第三,价格战对开发者和普通用户是实打实的红利。一年前调用模型还在心疼 Token,现在缓存命中几乎不要钱,长文档、长代码的使用门槛被一再打平,创业团队AI 应用的成本持续下降。但反过来,对所有还在烧钱训模型的厂商,这是一场消耗战:模型能力趋同、价格趋零,最后拼的是资金厚度、算力成本和谁手里有现成的流量入口。腾讯的底牌恰恰是后者 —— 模型分数可以被追平,但把模型接进微信生态这种事,别人做不了。
第四,两个月一个大版本的节奏说明,大厂在这场竞赛里没有 "缺席权"。混元曾经被认为起个大早、赶个晚集,2 月重建基础设施、引入姚顺雨之后,硬是用迭代频率把自己重新塞回第一梯队。这也意味着这个行业的技术领先保质期极短,今天的 0.05 分优势,两个月后就要重新考一次。
所以结论是:Hy4 preview 值得关注,但关注点不是 "腾讯又拿了第一",而是它确认了两个趋势 —— 国产头部模型正式进入 "没有王者、只有更快" 的消耗战,以及模型能力平权、价格趋零之后,胜负手正在从 "谁的模型分高" 转向 "谁的场景更深、成本更低"。对用户,这是最好用的阶段;对厂商,这是最烧钱的阶段;对腾讯,模型本身只是入场券,真正的考场在它那十几亿用户的产品矩阵里。



