OpenHands比对手省电9.4倍
同一个小模型,同一批任务,换个 agent 框架,耗电能差出 9.4 倍。
arXiv:2512.09543 这篇论文拿 SWE-Agent、OpenHands、Mini SWE Agent、AutoCodeRover 四个代码 agent 框架,故意只配 Gemma-3 4B 和 Qwen-3 1.7B 两个小模型,在 SWE-bench Verified Mini 上跑修 bug 任务,每个组合跑 150 次,记录电量、耗时、token 和内存。结论是框架结构才是电费的大头:同样用 Gemma,AutoCodeRover 平均耗电是 OpenHands 的 9.4 倍。想在资源有限的环境里跑 agent 的公司,选框架比选模型更影响账单。
你们本地跑 agent 用的哪套框架,算过电费吗? OpenHands AIAgent SWEbench 小模型
