利好

Composio测试显示Claude Code成本是Hermes近4倍

2026-08-01 14:48:36

基于Kimi K3模型的框架对比中,Claude Code成本最高且速度最慢,仅为Hermes的3.8倍成本与2倍耗时。

Woofun AI 监测数据显示,AI 智能体基础设施公司 Composio 将 Kimi K3 模型接入 6 组不同 Agent 框架进行性能测试,共完成 26 项相同任务。在底层模型均为 Kimi K3 的情况下,Kimi Code 以完成 21 项任务位居首位,Hermes 完成 20 项,Pi Agent 与 Claude Code 均完成 19 项,OpenCode 完成 18 项,Codex 完成 17 项。

成本与效率方面,Hermes 和 Pi Agent 的每项任务平均成本最低,分别为 0.39 美元和 0.40 美元;Claude Code 的每项任务平均成本为 1.47 美元,约为 Hermes 的 3.8 倍。运行速度上,Pi Agent 最快,任务完成时间中位值为 161.7 秒;Claude Code 最慢,耗时 347.6 秒。

尽管使用相同模型,不同框架间成功完成任务数差异仅 4 项,但平均成本相差近 4 倍,耗时相差超过 2 倍。

WOOFUN AI

影响力评估 · 一键速读

该测试揭示了在相同底层模型下,Agent 框架对最终落地成本与效率的巨大影响。Claude Code 虽任务完成度尚可,但其高昂成本与缓慢速度在商业化场景中可能缺乏竞争力。相比之下,Hermes 和 Pi Agent 在保持高完成率的同时显著降低了边际成本,或成为开发者更优选择。这提示市场关注模型之上的框架优化价值,而非仅聚焦于基础模型能力。
WOOFUN AI 生成 · 仅供参考,非投资建议

评论

回复 @用户
0/800

暂无评论

消息提醒

登录后查看消息
查看全部消息管理订阅