腾讯混元Hy3正式版开源:我第一时间跑完,视频生成超预期、WorkBuddy免费薅两周
今天下午腾讯混元Hy3正式版开源了。
我之前测过preview版,所以第一时间跑了一遍正式版,说说体感。
先说参数规格
MoE结构,总参数295B,激活参数21B,80层,专家数192,每次激活8个,上下文256K,注意力用的是GQA(64 heads / 8 KV heads)。
整体量级和DeepSeek-V4 Flash差不多,但实测下来效果要比Flash强不少,多数场景基本能压住Flash,部分任务能跟GLM5.1和DeepSeek-V4-Pro掰一掰。

300B出头的参数量,打到这个水平,说明后训练确实下了功夫。
和preview版相比有什么变化
**Coding能力更顺,**Agent任务执行更稳,前端审美明显提升,输出速度也快了。
快思考模式下效果不稳定,建议用深度思考模式,差距很明显,后面实测里能看出来。现在Hy3在WorkBuddy上免费用两周,随便跑。

综合功能完整度和可玩性,Hy3明显更好,瑕疵有但比另外两个稳。
实测:视频生成
提示词:根据下面内容生成30s左右横屏视频。 物理AI不是数字AI升级,是全新AI物种。数字AI靠TOKEN被动问答;物理AI毫秒决策、秒级推理,全天候主动感知。Om AI VLX双维度运行:Go每秒刷新10-20次,Seek秒级空间推理。端侧原生流式架构,是范式跃迁,非模型压缩。VLX-Go 0.6B模型精度85.42%碾压7B的78.6%,VLX-Seek 3B精度45.3超越Gemini 41.4,端侧0.1秒 vs 云端5秒,提速50倍。不是更快,是本质不同。数字AI落幕,物理AI元年开启!

生成视频剪辑素材,还是非常不错的。

根据素材我剪辑了一下,视频后面片段运用了素材,最终视频如下:
放在300B左右这个参数段,Hy3正式版的表现超出了我对这个尺寸的预期,混元这次追上来了不少。
当然256K上下文在现在这个时间点已经不算突出了,毕竟大家都在往1M冲,这块算是相对弱项。
但WorkBuddy上免费两周这个机会,对日常办公场景的用户来说很实际,直接去用就行。
以上,既然看到这里了,相信是有所共鸣。随手点个赞、在看、转发三连,想第一时间看到新内容,给我个星标⭐即可。感谢陪伴,文字因你而完整,下次见。
更多推荐


所有评论(0)