axxafo/awesome-agent-benchmarks

๐Ÿง  Discover and evaluate advanced benchmark datasets for Large Language Model agents to enhance performance assessment in real-world tasks.

awesome-agent-benchmarks๋ž€ ๋ฌด์—‡์ธ๊ฐ€์š”?

awesome-agent-benchmarks is a Claude Code agent skill that ๐Ÿง  Discover and evaluate advanced benchmark datasets for Large Language Model agents to enhance performance assessment in real-world tasks.

์ง€์› ๋Œ€์ƒ~Claude Code~Codex CLI~Cursor
npx skills add axxafo/awesome-agent-benchmarks

Installed? Explore more ์—ฐ๊ตฌ & ๋ฐ์ดํ„ฐ ๋ถ„์„ skills: obra/superpowers, affaan-m/quarkus-verification, affaan-m/uspto-database ยท View all 6 โ†’

์ฆ๊ฒจ ์‚ฌ์šฉํ•˜๋Š” AI์—๊ฒŒ ๋ฌผ์–ด๋ณด๊ธฐ

์ด ์—์ด์ „ํŠธ ์Šคํ‚ฌ์ด ๋ฏธ๋ฆฌ ๋กœ๋“œ๋œ ์ƒˆ ์ฑ„ํŒ…์„ ์—ฝ๋‹ˆ๋‹ค.

๋ฌธ์„œ

awesome-agent-benchmarks์€(๋Š”) ๋ฌด์—‡์„ ํ•˜๋‚˜์š”?

๐Ÿง  Discover and evaluate advanced benchmark datasets for Large Language Model agents to enhance performance assessment in real-world tasks.

Source: https://github.com/axxafo/awesome-agent-benchmarks

Pushed: 2026-05-12T06:29:00Z Stars: 3

๊ด€๋ จ ์Šคํ‚ฌ