CodeEval-Pro/mbpp-pro

Dataset

Evaluation dataset for umanEval Pro and MBPP Pro: Evaluating Large Language Models on Self-invoking Code Generation Task (arxiv.org/abs/2412.21199).

2

3 commits

1 linked in READMEs

updated Dec 31, 2024

See the code

README

Evaluation dataset for umanEval Pro and MBPP Pro: Evaluating Large Language Models on Self-invoking Code Generation Task (arxiv.org/abs/2412.21199).

Contributors

zjy2001

3 commits

CodeEval-Pro/mbpp-pro

Dataset

Evaluation dataset for umanEval Pro and MBPP Pro: Evaluating Large Language Models on Self-invoking Code Generation Task (arxiv.org/abs/2412.21199).

2

3 commits

1 linked in READMEs

updated Dec 31, 2024

See the code

README

Evaluation dataset for umanEval Pro and MBPP Pro: Evaluating Large Language Models on Self-invoking Code Generation Task (arxiv.org/abs/2412.21199).

Contributors

zjy2001

3 commits