腾讯Hy4盲测压过GLM-5.3、Kimi K3,输出价最低便宜82%

腾讯Hy4盲测压过GLM-5.3、Kimi K3,输出价最低便宜82%

2026-08-28 14:50

ChainThink 消息,8 月 28 日,据腾讯官方公告,其 Hy4 preview 模型在内部工程盲测中得分超过 GLM-5.3 和 Kimi K3。

163 名腾讯内部专家使用 203 个真实工程任务进行测试,Hy4 平均得分 2.99/4,高于 GLM-5.3 的 2.92/4 和 Kimi K3 的 2.94/4。

具体对决中,Hy4 对 GLM-5.3 胜率 46.8%,平局 12.8%,负率 40.4%;对 Kimi K3 胜率 51.2%,平局 7.9%,负率 40.9%。

不过,Hy4 在公开跑分中并未全面领先,在 DeepSWE、CyberGym 等代码和网络安全测试上仍落后于 GLM-5.3。

价格是 Hy4 的主要优势:每百万 Tokens 输入 6 元、输出 18 元,分别比 GLM-5.3 便宜 25% 和约 36%,比 Kimi K3 便宜 70% 和 82%。

缓存命中仅 0.3 元,比 GLM-5.3 和 Kimi K3 的 2 元便宜 85%。

腾讯Hy4盲测压过GLM-5.3、Kimi K3,输出价最低便宜82%
#AI巨头动态

免责声明:含第三方意见,不构成财务建议

推荐阅读

迈威尔科技跌8%,华尔街认为谷歌大单收入确认进度缓慢

12 小时前
迈威尔科技跌8%,华尔街认为谷歌大单收入确认进度缓慢

美股盘前要闻一览:沃什杰克逊霍尔首秀在即,Anthropic计划公开IPO招股书

13 小时前
美股盘前要闻一览:沃什杰克逊霍尔首秀在即,Anthropic计划公开IPO招股书

谷歌Omni 1.1 Flash:一次生成10秒,连续续写最长40秒

16 小时前
谷歌Omni 1.1 Flash:一次生成10秒,连续续写最长40秒

OpenAI测试Codex持续运行模式:任务做完还能继续跟进

20 小时前
OpenAI测试Codex持续运行模式:任务做完还能继续跟进

OpenAI开始自己当VC:4亿美元押注下一代AI公司

22 小时前
OpenAI开始自己当VC:4亿美元押注下一代AI公司

OpenAI联合Anthropic等100多家公司警告:AI网络攻击未来几个月会明显升级

23 小时前
OpenAI联合Anthropic等100多家公司警告:AI网络攻击未来几个月会明显升级

Anthropic计划在9月7日后公开披露招股说明书

1 天前
Anthropic计划在9月7日后公开披露招股说明书