Functionmain(
model: str,
dataset: str,
root: str,
bs: int = 1,
n_samples: int = 1,
temperat
evaluation/evalplus/codegen/generate.py:115
Functionsynthesize_test_code(task_id, entry_point, inputs, results, ref_func, atol)
evaluation/evalplus/tools/humaneval/to_original_fmt.py:59
Functionsynthesize_test_code(task_id, entry_point, inputs, results, ref_func, atol)
evaluation/evalplus/tools/mbpp/to_original_fmt.py:64
Functionunsafe_execute(
dataset: str,
entry_point: str,
code: str,
inputs,
expected: List,
time_limits,
evaluation/evaluate/utils.py:154
Functionunsafe_execute(
dataset: str,
entry_point: str,
code: str,
inputs,
expected: List,
time_limits
evaluation/evalplus/evalplus/eval/__init__.py:106
Functionworker_on_one_task(
task_id: str,
task_ref: Dict,
samples: list,
task: Dict,
expected_output: Dict,
prof
evaluation/evalplus/evalplus/evalperf.py:73