腾讯混元Hy4-Preview知乎评价深度扫描:770B开源旗舰的真实体验与争议

腾讯混元Hy4-Preview知乎评价深度扫描:770B开源旗舰的真实体验与争议

2026年8月28日,腾讯正式发布并开源了新一代大语言模型 Hy4 preview。凭借 770B 的总参数、49B 的激活参数以及突破至 1M 的上下文长度,这款模型一经亮相便在知乎及各大社区引发了热烈讨论如何评价腾讯混元 8 月 28 日发布并开源新一代大语言模型 Hy4 preview?实际体验如何? - 知乎

作为腾讯大模型重建基础设施后的又一重量级迭代,知乎用户对 Hy4 preview 的实际表现给出了怎样的评价?我们整理了多位一线开发者的深度实测,带你一探究竟。


一、 核心亮点:代码与前端审美的“断层式”惊喜

在知乎用户的多项真实场景盲测中,Hy4 preview 展现出了远超预期的生产力潜力,尤其在前端网页生成、复杂 3D 互动游戏以及多步骤 Agent 任务上表现亮眼。

  1. 惊艳的前端与 3D 渲染审美
    多位知乎答主使用同款高难度前端提示词进行测试,发现 Hy4 preview 生成的网页不仅排版精美、配色高级,还能直接直出诸如“皮卡丘全息卡片”、3D 像素艺术馆、流体特效艺术网站甚至完整复刻 macOS 桌面系统等复杂应用如何评价腾讯刚刚发布的Hy4 preview? - 知乎

  2. 长程任务与任务拆解能力增强
    得益于 1M 上下文与 MoE 架构的升级,模型在处理长代码仓库和跨文件协作时展现出了极强的自主调试与校验能力。例如在生成 3D 弹球或跑酷游戏时,模型能够自己暴露物理碰撞中的严重问题(如球体逃逸、挡板失效),并自主定位原因并完成修正。

  3. 高性价比的 API 策略
    在定价方面,Hy4 preview 延续了普惠路线:输入 6 元/百万 tokens,输出 18 元/百万 tokens,缓存命中仅 0.3 元,直接看齐并对标主流开源第一梯队,且在 WorkBuddy 等产品中限时免费两周腾讯混元 Hy4 preview 发布并开源模型尺寸、上下文长度等实现扩展


二、 槽点与争议:“雷霆大思考”带来的排队与慢节奏

尽管上限极高,但知乎用户在实际体验中也遇到了不少让人“抓狂”的痛点:

  1. 排队严重,推理资源吃紧
    由于 770B 的大体量和刚上线带来的巨大热度,不少用户反馈在 WorkBuddy 或 CodeBuddy 中使用时遇到了排队潮,甚至出现“前方数千人排队”的现象排队超5000!姚顺雨“新作业”混元Hy4 preview上线即爆火_腾讯新闻
  2. “雷霆大思考”导致响应变慢
    知乎答主 @Kitt在进化 指出:“它的雷霆大思考太严重了,思维链比 DS、GLM 这些国模还要长,加上推理资源紧张,导致一个小任务跑一个多小时,用起来真的很捉急如何评价腾讯混元 8 月 28 日发布并开源新一代大语言模型 Hy4 preview?实际体验如何? - 知乎。”
  3. 递归自我改进的闭环初现
    不过,从技术演进角度来看,腾讯官方及社区观察到一个有趣的现象:Hy4 preview 首次参与了训练方法、数据策略和底层算子的自动优化,初步形成了递归自我改进的闭环,端到端吞吐相比基线提升了 31.8%排队超5000!姚顺雨“新作业”混元Hy4 preview上线即爆火_腾讯新闻

三、 总结:蓄势待发的开源“重炮”

综合知乎用户的多方实测,Hy4 preview 证明了腾讯在 AI 赛道上正在加速追赶并缩小与顶尖第一梯队的差距。它不再仅仅是靠刷榜过拟合的“跑分模型”,而是实打实地聚焦于真实生产力。

正如知乎讨论所折射出的共识:Hy4 preview 拥有极高的能力上限和惊艳的工程交付能力,但预览版在推理速度、排队体验以及长任务稳定性上仍需进一步打磨。 趁着限时免费阶段亲自上手跑几个高难度任务,或许是对它最好的检验。


  1. 如何评价腾讯刚刚发布的Hy4 preview? - 知乎
  2. 如何评价腾讯混元 8 月 28 日发布并开源新一代大语言模型 Hy4 preview?实际体验如何? - 知乎
  3. 腾讯混元 Hy4 preview 发布并开源模型尺寸、上下文长度等实现扩展
  4. 排队超5000!姚顺雨“新作业”混元Hy4 preview上线即爆火_腾讯新闻