文章详情

专注互联网科技,赋能企业数字化发展

说实话,腾讯刚发的Hy3正式版远超出我预期

作者:说实话,腾讯刚发的Hy3正式版远超出我预期

没想到腾讯这么快就发布了混元 Hy3 正式版。 不说场面话,从我实际测试来看,相比之前的 Preview 版本,进步还是非常明显。 以防有的同学不了解,我解释一句。混元 Hy3 是一个 MoE 架构的中型模型,总参数 295B,激活参数 21B。 从我跑的 Case 来看,它的能力已经和 GLM5.1 以及DeepSeek V4 Pro 相当了。 这确实超出预期,毕竟 V4 Pro 的参数量比 Hy3 大了一个量级。 从这个结果来看,这段时间姚顺雨的一些策略应该是奏效了。中小模型可以做到这个水准,数据和基础设施一定不弱。 我跑了不少 Case,说两个典型的。一个是办公场景,一个是 Coding 场景。 我给了它一本 100 多页的 PDF,就是我前两天在小红书发过的那本成长类的书,大家可以去翻一下。 我让它按照我们公司 Logo 的风格和氛围,把核心内容做成 PPT。 为了做对比,同一个 Case 我用 Hy3 Preview 跑了一遍,也用正式版跑了一遍,进步还是非常明显。 一是模型对每一页 Slide 要呈现的信息理解更充分,放进 PPT 里的基本都是我自己认为重要的金句和新知。 二是 PPT 的审美,一次直出的效果也很好。 第二个 Case 是我最近在做的一个 Vibe Writing 的 App。 我要给这个 App 加一个补全功能,就是光标停留大概一秒以上的时候,AI 基于之前的内容自动补全。 之前用 Preview 版本跑,模型会过度思考,最后做出来的功能完成度大概只有 60%。这一次用正式版就好很多了,该有的功能都做出来了。 跟 GPT 5.5 相比,它的交互效果还弱一些,但比之前确实已经有明显的进步。 这确实挺给我惊喜的。毕竟 Hy3 的参数不到 300B,这个规模能做到这个水平,突破了我的认知。 以前会觉得这个参数量级的模型天花板太低了。但目前看,Hy3 效果还是挺好的。 总结来说,我的感受是,Hy3 正式版至少在我测试的这些 Case 里,跟 DeepSeek V4 Pro 是一个水准了。 这也能理解为什么 WorkBuddy 最近逐步把默认模型切到了 Hy3。 这半年我有一个明显的感受,就是随着 Agent 的破圈,使用场景正在发生分化。

返回新闻列表
077 【系列二】Gemini 还有你不知道的用法?? SOLIDWORKS设置全攻略:自动保存、模板配置与跨设备迁移技巧 Word文档智能排序与分类汇总超全指南 姓韦叫什么名字更好听呢