位置:首页 > 产业资讯 > 腾讯Hy3评测:参数仅对手五分之一,代码能力持平DeepSeek-V4-Pro

腾讯Hy3评测:参数仅对手五分之一,代码能力持平DeepSeek-V4-Pro

时间:2026-07-21  |  作者:318050  |  阅读:0

腾讯 Hy3 编程测评:性价比与性能兼备

SuperCLUE 最近放出了一组腾讯 Hy3 语言模型的编程专项测评数据。它直接和 DeepSeek-V4-Pro 等热门模型放在同一赛道上比代码能力。

Hy3 采用 MoE 架构,总参数 295B,激活参数仅 21B,支持 256K 上下文。官方称它是混元家族最强模型。从结果来看,这个模型参数体量远小于对手。但在编程场景里,它交出了一份让人意外的答卷

四大维度全面对比,Hy3 兼顾性能与花销

这次测评专门针对国内程序员日常写代码的真实场景设计。每道编程任务都需要来回沟通几十轮,逐步完成代码分析、修改和校验,更贴近实际开发调试流程。

测评从四个维度进行对比,帮助开发者根据预算和效率需求选择模型:

  • 使用成本
  • 运行速度
  • 沟通轮次
  • Token 消耗

在代码能力得分上,Hy3 的高分版本拿到了 47.37 分,和 DeepSeek-V4-Pro 完全持平。不少对标模型的参数规模比 Hy3 大四五倍,却没能拉开差距。这足以说明它的模型架构和训练方式做了大量优化。

成本方面,Hy3 优势更加明显。完成一道编程题目平均只需 0.43 元。长期高频调用也不会带来太高开销,商用落地的财务压力大幅降低。

单题不到 400 秒,40 轮对话搞定全套任务

运行速度方面,Hy3 单题平均耗时 不到 400 秒,排在评测前列。它适合需要快速响应的实时编码和线上调试场景。

沟通效率同样亮眼。平均 40 多轮对话就能完成整套任务,不需要反复调整指令修正代码,收敛速度更快。同时,每次任务消耗的 Token 仅约 116 万,占用云端算力更少,平台运行压力更低。

对于经常用 AI 辅助开发的程序员来说,Hy3 在性能和花销之间找到了一个难得的平衡点。当参数规模不再是能力的唯一标尺,“小身材大能量”的模型正在用实际数据证明:优化架构和训练策略,同样可以在编程这条赛道上与旗舰级对手掰手腕。随着 Hy3 以 Apache 2.0 协议全面开源,这场性价比之战或许才刚刚开始。

来源:整理自互联网
免责声明:文中图文均来自网络,如有侵权请联系删除,心愿游戏发布此文仅为传递信息,不代表心愿游戏认同其观点或证实其描述。

相关文章

更多

精选合集

更多

大家都在玩

热门话题

大家都在看

更多