8月28日,腾讯混元发布并开源新一代大模型 Hy4 preview。这不是一次常规刷榜,而是一次把参数、上下文和工程链全打开的发布。总参数770B,激活参数49B,上下文窗口突破1M token,Apache 2.0协议直接放权重。和半年前发布的Hy3相比,总参数涨了近三倍,上下文从256K拉到1M。
架构上走的是MoE路线:78层里,第一层是稠密FFN,其余77层每层256个路由专家加1个共享专家,每token激活top-8路由加1个共享。词表120832,官方定位是“为生产力而生”。也就是说,它不是为了答题好看,是为了写代码、做PPT、分析表格、整站代码生成这类真活儿。
真正让我注意的是它参与了自己研发。官方说 Hy4 preview 首次介入训练方法、数据策略、评估框架和底层算子的自动优化:模型自己提方案、跑实验、根据结果迭代,实验产生的代码和日志再喂进下一轮。端到端推理吞吐因此提升了31.8%。这听起来像递归自我改进的雏形,虽然只是早期版本,但方向比数字更关键。
成绩方面也很有意思。腾讯内部组织了163名专家、203个工程任务盲测,Hy4均分2.99,略高于GLM-5.3的2.92和Kimi K3的2.94。分数咬得很紧,参考价值在于任务类型而非名次。Terminal-Bench从70.8跳到85.4,DeepSWE从28.0涨到64.3,软件工程能力的提升比通用指标更显著。
使用门槛在快速降低。WorkBuddy、CodeBuddy、元宝、ima同步首发,腾讯云TokenHub和OpenRouter也能调API,输入每百万token 0.834美元,输出2.501美元。开源模型想活下去,最后拼的不是参数量,而是能不能嵌入真实工作流。Hy4 preview现在起码把门敞开了。
A5创业网 版权所有