8月28日,腾讯混元发布并开源新一代大模型Hy4 preview。挑这个日子发布,本身就有意思——整个8月,DeepSeek推出V4-Flash和V4 Pro正式版,千问拿出Qwen3.8-Max,智谱端出GLM-5.3,各家在月末接连亮牌。腾讯这手牌,等于在”交作业季”的压轴出场。
先看位置。Hy4 preview总参数770B、激活参数49B、上下文1024K,规模上超过了智谱GLM-5.2,但离DeepSeek V4 Pro和Kimi K3的万亿级参数还有距离。有意思的是腾讯自己很清醒——内部163名专家、203个工程任务盲测,Hy4拿2.99分(满分4),比GLM 5.3的2.92和Kimi K3的2.94略高。”稳居开源第一梯队”是真的,但领先优势只有2%左右,第一梯队内部挤得很。
再谈战略。腾讯在AI上的转身,这两年肉眼可见:2025年底挖来姚顺雨、成立基础模型部,二季度一个季度采购算力花了超500亿元。混元的迭代节奏也上来了——7月初刚发Hy3正式版,8月底就推Hy4 preview。这套打法跟DeepSeek如出一辙:开源+高性价比抢心智,再靠规模效应反哺迭代。
那实际体验到底如何?办公场景进步最明显。有实测拿五家头部企业的财报让Hy4做PPT总结——排版成熟度高得多,重点标蓝、数据配柱状图、不同企业用背景色区分。同一个任务,Hy3做出来的像刚学电脑的学生作品,而Hy4和DeepSeek V4 Pro已经”能坐一张桌子吃饭”。
长程任务是真的能扛。有评测让模型做声音驱动的动效画布、在线鼓机、吉他调音器,复刻红白机沙罗曼蛇——它自己拆分任务、调用多个工具和Skill、自己跑测试修Bug,甚至自己把游戏测试打通关。一个复杂项目从零到部署上线,13分钟搞定。细节上也有惊喜:生成教学动画时画面有桌面纹理和倒影,操作面板比DeepSeek V4 Pro还丰富;生成企业官网连Logo都贴合主题;遇到不确定的地方会主动停下来问,还自带几个方案。
当然,不足也实实在在。教学动画里试剂瓶的瓶塞没取下来,生成马里奥时关卡难度单一——都是小瑕疵,能靠多轮修改补救,但也说明它还做不到一次到位。而且别忘了,对比对象里DeepSeek V4 Pro是正式版,Hy4还只是个preview。
定价倒是很有诚意:每百万Token输入6元、缓存命中0.3元、输出18元,WorkBuddy、CodeBuddy、元宝、ima上还免费体验两周。比参数更重要的是,腾讯把它第一时间塞进了自己所有能触达的产品入口——WorkBuddy在桌面办公Agent市场已经一骑绝尘,这一步是把模型能力直接兑换成产品体验。
所以怎么评价?一句话:欠的作业,腾讯补得挺认真。Hy4 preview证明了混元在模型层不掉队,产品层甚至有点超预期;但2%的领先、还没验证的500亿算力投入、正式版还没出——这些都说明,别急着封神。真正决定腾讯AI含金量的,是Hy5能不能迈过万亿参数这道坎,以及这500亿买来的算力,最终能不能变成财报里的收入。