ChainThink 消息,8 月 28 日,据腾讯官方公告,其 Hy4 preview 模型在内部工程盲测中得分超过 GLM-5.3 和 Kimi K3。
163 名腾讯内部专家使用 203 个真实工程任务进行测试,Hy4 平均得分 2.99/4,高于 GLM-5.3 的 2.92/4 和 Kimi K3 的 2.94/4。
具体对决中,Hy4 对 GLM-5.3 胜率 46.8%,平局 12.8%,负率 40.4%;对 Kimi K3 胜率 51.2%,平局 7.9%,负率 40.9%。
不过,Hy4 在公开跑分中并未全面领先,在 DeepSWE、CyberGym 等代码和网络安全测试上仍落后于 GLM-5.3。
价格是 Hy4 的主要优势:每百万 Tokens 输入 6 元、输出 18 元,分别比 GLM-5.3 便宜 25% 和约 36%,比 Kimi K3 便宜 70% 和 82%。
缓存命中仅 0.3 元,比 GLM-5.3 和 Kimi K3 的 2 元便宜 85%。

免责声明:含第三方意见,不构成财务建议
迈威尔科技跌8%,华尔街认为谷歌大单收入确认进度缓慢
12 小时前
美股盘前要闻一览:沃什杰克逊霍尔首秀在即,Anthropic计划公开IPO招股书
13 小时前
谷歌Omni 1.1 Flash:一次生成10秒,连续续写最长40秒
16 小时前
OpenAI测试Codex持续运行模式:任务做完还能继续跟进
20 小时前
OpenAI开始自己当VC:4亿美元押注下一代AI公司
22 小时前
OpenAI联合Anthropic等100多家公司警告:AI网络攻击未来几个月会明显升级
23 小时前
Anthropic计划在9月7日后公开披露招股说明书
1 天前






