上证指数 3930.12 -0.30%
|
深证成指 13516.97 -0.79%
|
恒生指数 25650.87 1.74%
|
纳斯达克 26506.99 -0.29%
|
日经225指数 65020.94 1.26%
|
以太坊信徒 以太坊信徒 站内编辑
2986 文章
6460788 阅读
首页  >  要闻 >  商业 >  正文
申请成为签约作者 >

腾讯新大模型亮相:赢了,但只赢了一点点

2026年08月30日 13:42    
收藏  
举报
AI摘要: 8月28日,腾讯发布新一代开源大模型Hy4 preview,开放7700亿参数模型权重,上下文窗口达100万Token。盲测中其得分2.99分,仅以0.05至0.07分小幅领先智谱GLM 5.3、月之暗面K3,第三方测试显示头部大模型无代差。该模型已上线多平台,定价低廉,缓存调用仅0.3元/百万Token。腾讯以开源低价带动腾讯云业务,依托自有生态锁定用户。当前国产大模型进入贴身肉搏的AI消耗战,胜负转向场景与成本,腾讯凭借用户矩阵握有先手。

8 月 28 日周五,腾讯在 "腾讯混元" 公众号上发布了新一代语言模型 Hy4 preview,并且直接开源 —— 连模型权重都开放了。所谓权重,就是帮助 AI 做判断的那组核心数值,相当于把训练好的 "大脑" 整个交出来,任何人都能下载、自己部署、按需改造,而不是只能通过腾讯的接口租用。

先看硬指标。Hy4 preview 有 7700 亿参数,参数可以理解成模型大脑里可调节的 "旋钮",数量越大,能拟合的知识和模式越复杂;上下文窗口支持 100 万 Token,粗略说就是一次对话能塞进几十万字的材料,整本报告、整套代码丢进去,模型读到后面也不会忘了前面。腾讯称,和上一代相比,模型规模和数据处理能力都上了一个台阶。

腾讯新大模型亮相:赢了,但只赢了一点点

再看腾讯最想强调的部分:测试成绩。腾讯组织了 163 名内部专家,做了 203 个工程任务的盲测 —— 盲测的意思是,专家答题时不知道自己用的是哪家模型,避免品牌光环干扰打分。结果 Hy4 preview 平均得分 2.99 分(满分 4 分),智谱 GLM 5.3 是 2.92 分,月之暗面 K3 是 2.94 分。腾讯确实赢了,但只赢了 0.05 到 0.07 分,差距非常小。

而且彭博社指出,在第三方基准测试里,把阿里巴巴 Qwen 3.8 Max 这些对手也放进来,各家得分互有高低,没有谁能通吃。

模型已经上线。用户可以在腾讯云 TokenHub 和 OpenRouter 上调用,也能在腾讯 WorkBuddy/CodeBuddy、元宝、ima 这些产品里直接体验。定价继续走低:每处理 100 万 Token,输入收费 6 元,输出 18 元,如果命中缓存只要 0.3 元。Token 可以理解成模型处理文字的 "计量单位",这个价格是什么概念 —— 一本十几万字的书稿喂进去,成本也就几块钱,而且缓存复用部分几乎白送。

迭代节奏是另一个看点。据《科创板日报》,自今年 2 月重建基础设施以来,混元平均每两个月就更新一个大版本,按这个节奏,Hy4 的下一版近期就会上线。背景是 "AI 天才少年" 姚顺雨去年底加盟,腾讯今年 4 月发布并开源 Hy3 preview,7 月 6 日又完成一次版本更新,明显是在把落后的进度往回追。

腾讯新大模型亮相:赢了,但只赢了一点点

说说我的看法。

第一,这不是 "腾讯碾压同行" 的故事,而是国产大模型进入贴身肉搏阶段的又一个证据。2.99 对 2.94、2.92,分差小到在误差边缘,而且这场盲测是腾讯自己组织、用自己出的 203 道工程任务考的,自证领先的含金量本来就要打折;反倒是彭博引述的第三方测试 "各有高低" 更接近真相 —— 头部几家模型已经没有代差,用户日常用起来差距更小,谁宣布 "超越" 谁,更多是发布节奏里的宣传动作。

第二,开源加超低价,腾讯图的不是卖模型的钱。权重直接开放、输入 6 元、缓存 0.3 元,模型层本身基本是微利甚至赔本赚吆喝。腾讯真正要的是两样:一是调用量带动腾讯云,模型是钩子,云算力才是生意;二是把模型塞进 WorkBuddy、元宝、ima 这些自家入口,用生态锁定用户。这也是整个中国大模型行业的共同打法 —— 模型当基础设施免费送,利润往应用层和云服务迁移。

第三,价格战对开发者和普通用户是实打实的红利。一年前调用模型还在心疼 Token,现在缓存命中几乎不要钱,长文档、长代码的使用门槛被一再打平,创业团队AI 应用的成本持续下降。但反过来,对所有还在烧钱训模型的厂商,这是一场消耗战:模型能力趋同、价格趋零,最后拼的是资金厚度、算力成本和谁手里有现成的流量入口。腾讯的底牌恰恰是后者 —— 模型分数可以被追平,但把模型接进微信生态这种事,别人做不了。

第四,两个月一个大版本的节奏说明,大厂在这场竞赛里没有 "缺席权"。混元曾经被认为起个大早、赶个晚集,2 月重建基础设施、引入姚顺雨之后,硬是用迭代频率把自己重新塞回第一梯队。这也意味着这个行业的技术领先保质期极短,今天的 0.05 分优势,两个月后就要重新考一次。

所以结论是:Hy4 preview 值得关注,但关注点不是 "腾讯又拿了第一",而是它确认了两个趋势 —— 国产头部模型正式进入 "没有王者、只有更快" 的消耗战,以及模型能力平权、价格趋零之后,胜负手正在从 "谁的模型分高" 转向 "谁的场景更深、成本更低"。对用户,这是最好用的阶段;对厂商,这是最烧钱的阶段;对腾讯,模型本身只是入场券,真正的考场在它那十几亿用户的产品矩阵里。

声明: 本文由入驻币海编者上传,观点仅代表编者本人,不代表币海财经赞同其观点或证实其描述,请自行判断。
延伸阅读
第四次“中国冲击”来袭?当开源AI成为撬动全球的“隐形杠杆”
第四次“中国冲击”来袭?当开源AI成为撬动全球的“隐形杠杆”
币海独步者    币海独步者        2026/08/17 13:38
马斯克关注DeepSeek:中美 AI 竞争进入路线分化新阶段
马斯克关注DeepSeek:中美 AI 竞争进入路线分化新阶段
鲁克    鲁克        2026/08/04 11:19