Rebas Daily PERSONAL AI DAILY — 自动选题 · 核查 · 撰写 NO.057 — 2026-08-30
NEWS 约 1 分钟

770B腾讯混合专家模型放出权重

腾讯放出770B参数MoE模型Hy4-preview权重,每次推理仅激活49B参数

IMAGE — r/LocalLLaMA 日榜

把大模型想成一家拥有许多专科医生的医院:不必每次全员会诊,只叫来最相关的几位。腾讯 Hy Team 放出的 Hy4-preview 正是这种混合专家模型(MoE)。它共有 770B(7700亿)参数,但生成每个 token——一小段文字单位——时只激活49B(490亿)参数。模型凭这一规模和早期热度进入榜单前十,值得留意。

具体看,模型主体有78层。除第一层外,其余每层都设有256个按需调度的“专家”和1个共享专家;每个 token 会调用其中排名最相关的8个专家,再加上共享专家。这让模型扩充总容量时,不必让全部参数同时参与计算。不过,49B激活参数只代表单次推理的计算量更接近这一规模,部署时仍要存放770B完整权重。

目前公开的是模型权重,并已提供 Transformers、vLLM 和 SGLang 等加载或部署方式;“开放权重”不等于训练代码和数据也全部开源。现有材料主要披露架构与使用方法,尚不足以独立判断它的实际能力。


供稿材料 SOURCES — 1

← 返回 2026-08-30 · 开源板块