3
14 commits
1 linked in READMEs
updated Jan 2, 2026
MatrixStudio/Codeforces-Python-Submissions
Dataset Card for "Codeforces-Python-Submissions"
45
CodeEval-Pro/mbpp-pro
Evaluation dataset for umanEval Pro and MBPP Pro: Evaluating Large Language Models on Self-invoking…
2
KodCode/KodCode-V1
🐱 KodCode: A Diverse, Challenging, and Verifiable Synthetic Dataset for Coding
116
CodeEval-Pro/humaneval-pro
livecodebench/execution
Dataset Card for "livecodebench-execute"
6
bigcode/bigcodebench-hard
fredzzp/fine_code
Fine Code
5
RUC-AIBOX/ICPC-Eval
tongye98/Awesome-Code-Benchmark
A comprehensive code domain benchmark review of LLM researches.
245