Self-bench

mupt-ai · since 2026

Benchmark coding agents against real-world software engineering tasks.

PricingFree
LevelAdvanced
CategoryAI Coding & Development
Best forAI researchers and engineers evaluating coding agents

Tags: benchmarking, coding agents, evaluation, open source, llm

Visit Self-bench

Alternatives to Self-bench

Build your personal AI stack on Toolnaut