腾讯开源Hy4:模型自己改自己,到底有多硬核

腾讯最近开源了新模型Hy4 preview,官方的说法是”初步形成递归自我改进闭环”。这词听着玄乎,说白了就是模型不再只被动回答问题,而是能自己审视自己、修改自己、再跑一遍——像一个人写完文章后自动检查错别字并改稿,然后再检查一遍。

先看硬指标:总参数770B、激活参数49B、上下文长度突破1M。在腾讯内部163名专家、203个工程任务的盲测里,Hy4 preview拿到2.99分(满分4分),略高于GLM 5.3的2.92和Kimi K3的2.94。稳居开源第一梯队——但也要看清,这个领先优势只有2%左右,第一梯队内部挤得很。

真正值得一说的是”递归自我改进”到底硬在哪。答案不在参数表里,而在研发过程里:Hy4 preview参与了自身研发的全链路,首次参与训练方法、数据策略、评估体系和底层算子的自动优化。模型提出方案、运行实验、再根据结果继续迭代,实验产生的代码、日志和反馈进入下一轮探索。最硬的证据是——它通过自主分析推理系统的瓶颈,围绕算子融合、通信优化做了多轮优化,端到端吞吐相比基线提升了31.8%。

这个31.8%才是重点。它不是实验室里的跑分,而是模型自己在真实工程问题上给出的改进结果。传统模型是”训练完就定型”,部署后用得再多也不会自动升级;而递归自我改进意味着模型可以在使用过程中不断迭代。理论上,今天的模型比昨天的自己更好用,而且差距会越拉越大。这才是这条技术路线真正的想象空间——不是又多了几百亿参数,而是模型具备了自我迭代的能力。

但技术叙事和商业兑现之间,隔着十万八千里。腾讯这次直接开源,铺到WorkBuddy、CodeBuddy、元宝、ima全线产品,开发者和企业还能通过腾讯云TokenHub和OpenRouter调用API,甚至搞了为期两周的限时免费。这套打法的意图很清楚:赌生态卡位——先把模型铺到所有能触及的入口,让开发者和用户先用起来再说。这和DeepSeek的路径如出一辙:用开源和性价比抢用户心智,再通过规模效应反哺技术迭代。今年2月重建基础设施以来,混元平均每两个月迭代一个大版本,”preview先行、正式版跟进”的节奏,本身就是把真实反馈灌回研发流程的做法。

对普通投资者来说,这种前沿技术新闻看看就好。模型层的竞争格局变化太快——同一个8月,DeepSeek推出了V4-Flash和V4 Pro,千问推出Qwen3.8-Max,智谱推出GLM-5.3,谁手上都不是稳赢的牌。今天领先明天被颠覆,这不是普通投资者能押对的方向。真正值得关注的是这类技术突破会不会带动腾讯云、企业服务、办公协同这些ToB业务的实际收入。如果Hy4真能让腾讯的产品更好用、让企业客户愿意买单,那才是从技术叙事变成真金白银的关键拐点。

模型能不能自己改自己,是技术圈的兴奋点;这事儿能不能让企业掏钱,才是投资圈的分水岭。

, ,

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注