腾讯混元把 770B 参数开源了,这次它想抢的不是热搜是开发者
昨天到今天,AI 圈最值得聊的一件事,不是又一个模型刷了榜,而是腾讯混元把新一代大语言模型 Hy4 preview 直接开源放了出来——总参数 770B,激活 49B,上下文长度一路顶到 1M。
开源、大参数、长上下文,三个词单拎出来都不新鲜。但凑在一起,再加上腾讯这次的动作节奏,事情就变得有点意思了。
先用三个数字,把它讲明白
很多人看到 770B 会本能地想:"那得多少张卡才跑得动。"但 Hy4 是 MoE(混合专家)架构,关键不在总参数,而在每次只激活 49B。

翻译成人话:模型的"知识库"很大,但你问它一个问题时,它只会调用其中一小撮"专家"来回答。能力上限拉满,推理成本却压得住——这正是这两年开源大模型能真正落地的前提。再叠加 1M 上下文,意味着它一口气能读完一整个代码仓库、一份几百页的合同,这对做工程和办公场景的人来说,是实打实的生产力。
它到底强在哪?答案在小数点后面
混元这次给出的自评数据挺克制:163 名内部专家,对 203 个工程任务做盲测打分,Hy4 均分 2.99,GLM-5.3 是 2.92,Kimi K3 是 2.94。

看清楚了——差距在小数点后第二位。这说明什么?说明开源大模型第一梯队已经卷到"贴身肉搏"的程度,谁也没法靠一个版本甩开对手一个身位。所谓"最强开源",更多是此刻、此任务集上的领先,而不是一劳永逸的碾压。对使用者反而是好事:你有了几个水平相当、可以随便挑的选择。
真正的杀招,是"发布即全线落地"
如果只是开源一个能打的模型,还算不上大新闻。Hy4 preview 这次真正值得注意的,是它发布当天就铺满了整条产品线。

一边在 HuggingFace 和腾讯云 TokenHub 开源,让开发者随时能拿;一边在元宝、ima、CodeBuddy 国内外版同步首发,让普通用户当天就能用上。这不是"发论文攒口碑"的打法,而是"模型—平台—产品"闭环里的一次统一交付。
而且这个交付速度还在加快——自 2 月重建基础设施以来,混元几乎每两个月就迭代一个大版本。

照这个节奏,Hy4 的下一版,恐怕也不用等太久。
写在最后
对开发者来说,多一个 770B 级别、可商用、还带 1M 上下文的开源选项,是好事;对整个国产大模型来说,这种"季更"级别的迭代密度,才是比单次跑分更该被关注的信号。
热闹归热闹,落到自己手里才算数。如果让你现在选一个开源大模型接进项目,你会看重参数规模、上下文长度,还是推理成本? 评论区聊聊,我把大家的真实取舍整理一期出来。