linny006/agent-eval-harness

Live, open-source benchmark for comparing AI coding agents on real GitHub issues

Qu'est-ce que agent-eval-harness ?

agent-eval-harness is a Claude Code agent skill that live, open-source benchmark for comparing AI coding agents on real GitHub issues.

Compatible avec~Claude Code~Codex CLI~Cursor
npx skills add linny006/agent-eval-harness

Installed? Explore more Recherche et analyse de données skills: obra/superpowers, affaan-m/quarkus-verification, affaan-m/uspto-database · View all 6 →

Demander à votre IA préférée

Ouvre une nouvelle conversation avec cette compétence d'agent déjà préchargée.

Documentation

Que fait agent-eval-harness ?

Live, open-source benchmark for comparing AI coding agents on real GitHub issues

Skills associés