DeepSeek V4.1 Flash第三方实测:没夺回国模第一,但成本只有Kimi、GLM七分之一

DeepSeek V4.1 Flash第三方实测:没夺回国模第一,但成本只有Kimi、GLM七分之一

2026-09-11 13:13

ChainThink 消息,9 月 11 日,据 Artificial Analysis 测试,DeepSeek V4.1 Flash 综合智能指数 40 分,超过自家 V4 Pro 0813 的 36 分,但仍低于 Kimi K3 的 44 分和 GLM-5.3 的 45 分。

按该第三方榜单,DeepSeek 尚未夺回国产模型第一。成本与速度差距明显。

V4.1 Flash 完成一个 Intelligence Index 任务平均成本 0.27 美元,Kimi K3 与 GLM-5.3 均在 2 美元左右,相差约 7 倍;

输出速度为 197 Token/s,远高于两者的约 36 Token/s 和约 58 Token/s。Agent 表现仍是强项。

AutomationBench-AA 上 V4.1 Flash 拿到 69%,追平 GPT-6 Astra,并超过 GLM-5.3 的 62%;长上下文测试 AA-LCR 得分为 84%。

不过其输出长度偏高,AA 测试单任务平均输出约 8.9 万 Token,比 V4 Pro 多 62%,部分抵消了价格优势。

DeepSeek V4.1 Flash第三方实测:没夺回国模第一,但成本只有Kimi、GLM七分之一
#AI巨头动态

免责声明:含第三方意见,不构成财务建议

推荐阅读

Kimi K2.8 Preview全量上线:性能逼近K3,支持1M上下文

16 小时前
Kimi K2.8 Preview全量上线:性能逼近K3,支持1M上下文

Long.xyz或将支持OpenAI和Anthropic代币化1倍多单底池

18 小时前
Long.xyz或将支持OpenAI和Anthropic代币化1倍多单底池

奥特曼内部表态:OpenAI考虑联合同行放慢AI开发

21 小时前
奥特曼内部表态:OpenAI考虑联合同行放慢AI开发

腾讯旗下拳头游戏近期与Kalshi和Polymarket讨论电竞赞助合作事宜

22 小时前
腾讯旗下拳头游戏近期与Kalshi和Polymarket讨论电竞赞助合作事宜

OpenAI向开发者开放Codex代理底层能力,Agents API进入公测

1 天前
OpenAI向开发者开放Codex代理底层能力,Agents API进入公测

港股应用软件、AI模型股持续大幅下挫,MiniMax跌超9%

1 天前
港股应用软件、AI模型股持续大幅下挫,MiniMax跌超9%

DeepSeek V4.1 Flash正式发布:552B新架构,输入只激活8B

1 天前
DeepSeek V4.1 Flash正式发布:552B新架构,输入只激活8B