标签: 腾讯混元

  • 腾讯混元Hy4 preview开源:770B参数、1M上下文,它还参与了”造自己”






    腾讯混元Hy4 preview开源:770B参数、1M上下文,它还参与了”造自己”






    🚀
    腾讯混元 Hy4 preview 开源
    770B 参数 · 1M 上下文 · 递归自我改进闭环
    2026年8月28日正式发布并开源
    AI
    AI工具导航
    cn.xcoolevdb.site · 每期扣一扣国产AI新品

    腾讯混元Hy4 preview开源:770B参数、1M上下文,它还参与了”造自己”

    8月的国产大模型圈卷得像早高峰的地铁:智谱刚开源GLM-5.3-Flash,阿里同日甩出Qwen3.8-Flash,8月28日腾讯混元直接把压箱底的Hy4 preview放上了开源平台——770B总参数、1M上下文,外加一个更值得琢磨的细节:这个模型参与了”造自己”。

    📑 本文目录
    1. 30秒速览:Hy4 preview 是什么
    2. 从Hy3到Hy4:四个月的跨代升级
    3. 1M上下文不是数字游戏
    4. 盲测2.99分:怎么看这份成绩单
    5. 四大生产力场景:为干活而生
    6. 真正的大新闻:它参与了造自己
    7. 价格与上手路径
    8. 八月混战:Hy4的卡位
    9. 适合谁用 & FAQ

    一、30秒速览:Hy4 preview 是什么

    先把结论放前面。2026年8月28日,腾讯混元发布并开源新一代大语言模型 Hy4 preview,核心参数三句话:总参数770B、激活参数49B(MoE架构)、上下文长度突破1M。官方定位很直白——“为生产力而生”,在代码、办公、游戏、科学这几类真实干活场景上重点发力。

    发布与开源时间
    2026-08-28
    架构
    MoE · 770B总参 / 49B激活
    上下文长度
    1M(1,048,576 tokens)
    推理模式
    high(默认)/ no_think
    开源协议
    Apache 2.0 · 免费商用
    API定价
    输入6元 / 输出18元 / 百万tokens

    模型已在 WorkBuddy / CodeBuddy 国内版及国际版、元宝、ima 等腾讯产品同步首发,普通用户打开产品就能体验;开发者可以通过腾讯云TokenHub和OpenRouter接入API;想自己折腾的,HuggingFace、GitHub、ModelScope、GitCode 四个平台都能直接拉权重,协议是Apache 2.0,允许免费商用。

    💡 一个背景

    自今年2月重建基础设施以来,混元大模型平均每两个月迭代一次大版本,采用”preview先行、正式版跟进”的节奏,把真实用户反馈持续引入研发。Hy4正式版大概率已在路上。

    二、从Hy3到Hy4:四个月的跨代升级

    光看770B没感觉?拉出上一代Hy3对比一下,升级幅度一目了然:

    维度 Hy3 Hy4 preview 变化
    总参数 295B 770B 约2.6倍
    激活参数 21B 49B 约2.3倍
    上下文长度 256K 1M 4倍
    迭代周期 四个月完成跨代

    这里得夸一下MoE(混合专家)架构的妙处:770B总参数意味着知识储备拉满,但每次推理只激活49B参数,相当于”大模型的脑子、小模型的电费”。这也是为什么各家旗舰都扎堆MoE——能力要堆上去,推理成本不能跟着翻几倍。

    三、1M上下文不是数字游戏

    100万token是什么概念?换算成汉字大约70多万字。给你两个直观参照:

    • 整本《红楼梦》丢进去,它能精准定位到任意一回的细节,不用你分段摘要、来回补充背景;
    • 一个中型项目的全量代码库一次性喂进去,跨文件排查bug、梳理整体架构,不用拆成碎片反复投喂。

    长上下文真正改变的是工作方式:很多过去依赖RAG”检索拼接”的场景,现在可以整本直接读。信息不再被切碎,上下文里的逻辑关系得以保留,这对代码理解、长文档分析、跨文件协作这类任务价值巨大。

    四、盲测2.99分:怎么看这份成绩单

    官方公布的评测方式有点意思:腾讯组织了163名内部专家,对203个工程任务做盲测,Hy4 preview拿到2.99/4.00的均分,略优于GLM 5.3(2.92)和Kimi K3(2.94)。另外在 Code Arena WebDev 榜单上排第5,开源模型里排第3。

    ⚠️ 冷静看数据

    这批盲测是腾讯内部组织的,专家和任务集由腾讯定义,”略优”的差距也在毫厘之间。参考即可,别当唯一标准。不过”稳居开源第一梯队”这个判断,目前多家媒体口径一致,没有太大争议。

    值得一提的是模型的训练方式:Hy4通过与软件工程、游戏、金融、安全等领域的腾讯专家数据共建,加上与WorkBuddy等产品的深度协同(Co-Design),练的是”真实生产力任务”而不是跑分技巧。这一点从下面四大场景的侧重就能看出来。

    五、四大生产力场景:为干活而生

    🛠 软件工程

    长程开发任务的理解、规划、调试与验证能力增强,能接住”从需求到上线”的完整链路;前端开发的视觉审美和交互质量也有针对性提升。和CodeBuddy协同后,走的是”模型+工具”的组合拳。

    📊 办公分析

    复杂办公环境理解和金融分析能力显著提升,重点优化数据分析与跨文件协作——从信息处理到文档、表格、演示文稿交付的完整流程,这是冲着WorkBuddy的办公场景去的。

    🎮 游戏开发

    “一句话生成可玩原型”能力增强,能熟练调用游戏引擎,开发者可以通过多轮交互持续完善复杂游戏项目。对独立开发者和小团队来说,这是个省掉大量重复劳动的方向。

    🔬 科学研究

    复杂科研问题的理解、推理与求解能力提升,在AI研发、分子动力学模拟、凝聚态物理、基础数学等场景均有长足进步。

    🔎 给HSE同行提个醒

    官方披露的训练数据共建名单里,“安全”与软件工程、游戏、金融并列出现。对做安全生产管理的人来说,这是个值得盯的信号——用Hy4做隐患数据图谱、应急预案初稿生成、安全培训问答这类场景,后续值得实际测一测。

    六、真正的大新闻:它参与了造自己

    如果只盯着参数和榜单,你会错过这次发布最本质的东西。

    Hy4 preview 第一次全程参与了自身的研发:训练方法、数据策略、评估体系、底层算子的自动优化,全都有它的份。模型自己提方案、跑实验、看结果、继续迭代,实验产生的代码、日志和反馈进入下一轮探索——官方称之为“初步的递归自我改进闭环”。翻译成人话:AI开始自己优化自己了。

    不止于”说漂亮话”,它还有可量化的产出:Hy4自主分析推理系统瓶颈,围绕算子融合、通信优化等方向开展多轮优化,端到端吞吐量相较基线提升31.8%,在不同上下文长度和并发度下均取得稳定收益。

    💡 为什么这事重要

    以前是人调模型,现在是模型也下场调自己——包括调自己跑起来的基础设施。这一步迈得不算大,但方向的味道很足:模型的迭代速度可能开始摆脱纯人力节奏。2026年这个时间点,”递归自我改进”从论文概念走进旗舰模型的发布说明,本身就是个里程碑式信号。

    七、价格与上手路径

    定价延续混元的普惠路线,在770B这个体量级里算相当克制的:

    计费项 价格(元/百万tokens)
    推理输入 6
    推理输出 18
    缓存命中输入 0.3

    另外,WorkBuddy和CodeBuddy开了为期两周的限时免费,想尝鲜的现在就能白嫖,建议抓紧。

    五条上手路径,按需选择:

    1. 纯体验:打开元宝或ima,直接聊,零门槛;
    2. 写代码:CodeBuddy国内版/国际版,两周限免期内值得重度试;
    3. 办公流:WorkBuddy,测测文档、表格、PPT的交付完整度;
    4. 开发者接API:腾讯云TokenHub或OpenRouter,model名 hy4-preview;
    5. 本地部署:四个开源平台拉权重,Apache 2.0免费商用。
    ⚠️ 部署前先掂量

    BF16原始权重约1.42TiB(131个safetensors分片),另有FP8量化版约减半。个人玩家基本无望,企业私有化也需要多卡集群。普通用户老老实实走API或产品端。

    📌 迁移提醒

    腾讯云TokenHub价格表显示,Hy3 preview 将于2026-08-31下线。还在调老版本API的项目注意迁移,别等报错了才想起来。

    八、八月混战:Hy4的卡位

    把镜头拉远,8月的国产大模型市场已经卷成什么样了:

    • 智谱:8月14日发布GLM-5.3,8月26日开源GLM-5.3-Flash(就是此前以”Ox Alpha”马甲匿名登顶OpenRouter的那位),320B总参/18B激活、原生多模态、MIT协议;
    • 阿里:8月26日开源Qwen3.8-Flash,125B总参仅激活6B,推理成本每百万tokens输入1元、输出3元;8月12日Qwen3.8-Max权重开源;
    • 月之暗面:Kimi K3 7月中旬发布、7月底全量权重开源,KDA注意力架构+1M无损上下文;
    • DeepSeek:V4系列8月17日起峰谷计费,周末全天闲时价。

    各家打法其实已经分化:有的卷价格(Flash系把token打到”白菜价”),有的卷开源声量(权重、许可证、Day0适配)。而Hy4 preview的差异点在于两头都不放弃——价格守在普惠线,同时把筹码押在”递归自我改进”+”自家产品矩阵协同”上:CodeBuddy、WorkBuddy、元宝、ima首发即落地,模型能力直接灌进亿级用户的生产力入口,这是纯模型厂商短期学不来的。

    九、适合谁用 & FAQ

    • 开发者:长程工程任务、大代码库重构与排查,CodeBuddy限免期内值得重度体验;
    • 办公族:数据分析、跨文件协作、文档表格PPT一条龙,WorkBuddy是主战场;
    • 游戏/创意团队:一句话出可玩原型,快速验证玩法;
    • 科研人员:模拟计算与复杂推理辅助;
    • 企业用户:Apache 2.0免费商用,私有化部署有FP8量化版可选。
    Q1:Hy4 preview免费吗?
    分两层:模型权重Apache 2.0协议开源,免费商用;API按量收费(输入6元/输出18元/缓存命中0.3元每百万tokens)。另外WorkBuddy和CodeBuddy有两周限时免费,产品端体验零成本。
    Q2:本地部署需要什么配置?
    BF16原始权重约1.42TiB,FP8量化版约减半,都需要多卡集群起步,个人玩家建议直接走API、元宝或ima。
    Q3:和GLM-5.3、Kimi K3比,选哪个?
    盲测分上Hy4略优(2.99 vs 2.92/2.94),但那是腾讯自家的测试口径。选型建议:重前端和长文档解析,Kimi K3口碑扎实;重极致性价比,GLM-5.3-Flash和Qwen3.8-Flash更狠;重长程生产力任务和产品协同,Hy4有独到优势。最好的办法是拿自己的真实任务各跑一遍。
    Q4:1M上下文实际能喂多少内容?
    中文场景大约70多万汉字,相当于一整本长篇小说,或一个中型项目的全量代码库。注意上下文越长,成本和延迟也越高,按需使用。

    写在最后

    参数和榜单很快会过时,但“递归自我改进闭环”这个方向值得单独记一笔:当模型开始参与优化自己的训练方法、评估体系甚至推理基础设施,迭代速度的天花板就从”有多少工程师”变成了”闭环转多快”。混元把”preview先行、正式版跟进”当成常规节奏,真实世界的反馈持续灌回研发——9月的Hy4正式版,到时候咱们再扣一扣细节。

    🔗 参考来源
    • 人民网《腾讯混元开源新一代大语言模型Hy4 preview》2026-08-29
    • 科技日报《腾讯混元Hy4 preview发布并开源》2026-08-28
    • 腾讯云TokenHub官方文档《模型价格》2026-08-28更新
    • 新浪科技《腾讯混元Hy4来了!7700亿参数直接开源》2026-08-29
    • 搜狐科技《腾讯770B模型开源:真正吓人的是它参与了造自己》2026-08-29
    • DataLearner《Hy4 preview:770B参数、1M上下文、价格与评测》2026-08-28
    腾讯混元Hy4 preview开源大模型MoECodeBuddyWorkBuddyAI编程
    AI工具导航 · cn.xcoolevdb.site | 本文由AI辅助整理,数据以官方发布为准