vercel/eve

The Open Framework for Building Agents

Run by mupt-ai · Released 2026-10-02 · 30 tasks · 5 settings

Which coding agent works best on vercel/eve? Most accurate: GPT-6.1 Sol, 76.7% at $0.74 per task. Best for less: DeepSeek V4.1 Flash, 66.7% at $0.35. 5 model settings scored on 30 tasks from its merged pull requests.

All Settings

ModelHarnessReasoningAccessAccuracyCost / TaskFrontier
GPT-6.1 SolCodexHighAPI Key76.7%$0.74Yes
Kimi K3PiHighVercel AI Gateway73.3%$1.89No
DeepSeek V4.1 FlashPiHighVercel AI Gateway66.7%$0.35Yes
GPT-6 LunaCodexHighAPI Key60%$0.031Yes
GLM 5.3 FlashPiHighVercel AI Gateway56.7%$0.20No

All Repositories on SelfBench