ChainThink 消息,7 月 30 日,AI Agent 基础设施公司 Composio 将同一款 Kimi K3 分别接入 Kimi Code、Hermes 和 Claude Code,执行 28 项相同任务。
三套运行框架完成数分别为 22 项、21 项和 20 项,差距较小,但 Token 用量和成本差异明显。
测试显示,Kimi Code、Hermes、Claude Code 的单项任务 Token 中位数分别为 6.1 万、6.7 万和 34 万;
Composio 估算,平均每项任务成本约为 0.22 美元、0.28 美元和 2 美元。个别任务的 Token 用量最多相差 30 倍。
速度方面,Hermes 单项任务中位耗时为 179 秒,Kimi Code 为 297 秒,Claude Code 为 348 秒。
Writer 的另一项研究也显示,在 22 项企业任务和 6 款模型上仅替换运行框架后,Token 用量下降 38%,单项成本下降 41%,耗时下降 44%,完成质量基本持平。
免责声明:含第三方意见,不构成财务建议
谷歌因内存短缺而提高新手机价格
59 分钟前
腾讯AI开始同时吃掉现金流和利润:Q2自由现金流转负138亿
5 小时前
英伟达联手谷歌、微软推动800V直流供电架构采用,逐步引入现有AI工厂
6 小时前
三星电子引入Claude Code提升开发效率,部分芯片设计验证从一个月缩短至2天
7 小时前
Manus 2.0已经开发完成,等和Meta彻底分手就上线
8 小时前
Grok 4.6发布进入倒计时:官网开关已经埋好,Cursor也提前泄露
9 小时前
字节刚把AI数据升为一级部门,前负责人傅越被曝离职创业做Agent/FDE
11 小时前






