MCPcopy Create free account

hub / github.com/LeapLabTHU/Absolute-Zero-Reasoner / functions

Functions861 in github.com/LeapLabTHU/Absolute-Zero-Reasoner

↓ 1 callersFunctioncheck_composite_function
(code: str, composite_functions: List[str])
absolute_zero_reasoner/utils/code_utils/checks.py:72
↓ 1 callersFunctioncheck_correctness
Evaluates the functional correctness of a completion by running the test suite provided in the problem. :param completion_id: an optiona
evaluation/code_eval/coding/LiveCodeBench/lcb_runner/evaluation/utils_execute.py:64
↓ 1 callersFunctioncheck_id
(data, task_id)
evaluation/code_eval/coding/evalplus/tools/humaneval/fix_v013.py:1
↓ 1 callersFunctioncheck_id
(data, task_id)
evaluation/code_eval/coding/evalplus/tools/humaneval/fix_v016.py:4
↓ 1 callersFunctioncheck_id
(data, task_id)
evaluation/code_eval/coding/evalplus/tools/humaneval/fix_v014.py:4
↓ 1 callersFunctioncheck_no_definitions
(code: str, composite_functions: List[str])
absolute_zero_reasoner/utils/code_utils/checks.py:60
↓ 1 callersFunctioncheck_testcase_output
(testcase_str, expected_output)
evaluation/code_eval/coding/LiveCodeBench/lcb_runner/evaluation/compute_test_output_prediction_metrics.py:39
↓ 1 callersFunctioncheck_valid
(s: str)
evaluation/code_eval/coding/evalplus/tools/humaneval/fix_v015.py:8
↓ 1 callersFunctioncheck_valid
(op, num)
evaluation/code_eval/coding/evalplus/tools/humaneval/fix_v016.py:8
↓ 1 callersFunctioncheck_valid
(xs)
evaluation/code_eval/coding/evalplus/tools/humaneval/fix_v014.py:12
↓ 1 callersFunctionchoice_answer_clean
https://github.com/hkust-nlp/simpleRL-reason/blob/main/eval/grader.py
evaluation/math_eval/eval/custom_evaluate.py:27
↓ 1 callersFunctionchoice_answer_clean
https://github.com/hkust-nlp/simpleRL-reason/blob/main/eval/grader.py
absolute_zero_reasoner/rewards/custom_evaluate.py:25
↓ 1 callersFunctionclean_if_name
(code: str)
evaluation/code_eval/coding/LiveCodeBench/lcb_runner/evaluation/testing_util.py:73
↓ 1 callersMethodcleanup
(self)
absolute_zero_reasoner/utils/code_utils/sandboxfusion_executor.py:168
↓ 1 callersMethodcleanup
Clean up the executor and other resources
absolute_zero_reasoner/trainer/ppo/azr_ray_trainer.py:612
↓ 1 callersFunctioncode_execution_metrics
( samples, generations, )
evaluation/code_eval/coding/LiveCodeBench/lcb_runner/evaluation/compute_code_execution_metrics.py:25
↓ 1 callersFunctioncodegen
( target_path: str, model: DecoderBase, dataset: Dict, greedy=False, n_samples=1,
evaluation/code_eval/coding/evalplus/evalplus/codegen.py:11
↓ 1 callersMethodcodegen
( self, prompt: str, do_sample: bool = True, num_samples: int = 200 )
evaluation/code_eval/coding/evalplus/evalplus/provider/base.py:32
↓ 1 callersFunctioncollect_eval_results_by_prefix
(root)
evaluation/math_eval/collect_all_math_results.py:146
↓ 1 callersMethodcollect_names
(self, node)
absolute_zero_reasoner/utils/code_utils/checks.py:112
↓ 1 callersMethodcollect_names
(self, node, scope_dict)
absolute_zero_reasoner/utils/code_utils/checks.py:172
↓ 1 callersFunctioncollect_results
(base_dir, model_name, num_threads=8, temperature=None)
evaluation/math_eval/eval/sh/collect_results.py:253
↓ 1 callersFunctioncombine_results
( scenario: Scenario, results: list[list[str]], model: LanguageModel, cot_code_execution: bool
evaluation/code_eval/coding/LiveCodeBench/lcb_runner/runner/scenario_router.py:83
↓ 1 callersFunctioncompare_ans
(ans_p_str, ans_l_str, is_strict=False)
evaluation/math_eval/eval/math_utils.py:210
↓ 1 callersFunctioncompare_numerical_ans
(ans_p, ans_l)
evaluation/math_eval/eval/math_utils.py:29
↓ 1 callersFunctioncompatible_eval_result
(results: Dict)
evaluation/code_eval/coding/evalplus/evalplus/eval/__init__.py:49
↓ 1 callersFunctioncompute_avg_test
(set_cover_info: Dict[str, List[str]])
evaluation/code_eval/coding/evalplus/tools/tsr/minimization.py:132
↓ 1 callersFunctioncompute_score_matrix
(group: dict)
evaluation/code_eval/coding/evalplus/tools/evalperf/intra_model_viz.py:87
↓ 1 callersFunctioncompute_score_matrix
(group: dict)
evaluation/code_eval/coding/evalplus/tools/evalperf/viz_by_params.py:100
↓ 1 callersFunctioncompute_scores
(args)
evaluation/code_eval/coding/LiveCodeBench/lcb_runner/evaluation/compute_scores.py:72
↓ 1 callersFunctionconstruct_inputs_sig
(inputs: list)
evaluation/code_eval/coding/evalplus/tools/_experimental/evaluate_coverage.py:17
↓ 1 callersFunctionconstruct_prompt
(example, data_name, args)
evaluation/math_eval/eval/utils.py:221
↓ 1 callersMethodconverse
(self, *arg, **kwargs)
evaluation/code_eval/coding/evalplus/evalplus/provider/bedrock.py:50
↓ 1 callersFunctionconvert_pi_to_number
(code_string)
evaluation/math_eval/eval/parser.py:436
↓ 1 callersFunctionconvert_word_number
(text: str)
evaluation/math_eval/eval/parser.py:64
↓ 1 callersFunctioncorrectness_check
( solution: str, dataset: str, task: Dict, expected_output: List )
evaluation/code_eval/coding/evalplus/evalplus/evalperf.py:76
↓ 1 callersFunctioncount_unknown_letters_in_expr
(expr: str)
absolute_zero_reasoner/rewards/math_utils.py:329
↓ 1 callersFunctioncreate_summary
(results)
evaluation/math_eval/eval/sh/collect_results.py:284
↓ 1 callersFunctioncreate_tempdir
()
evaluation/code_eval/coding/LiveCodeBench/lcb_runner/evaluation/utils_execute.py:143
↓ 1 callersFunctiondebug
(idx)
evaluation/code_eval/coding/LiveCodeBench/lcb_runner/evaluation/old_results_check.py:19
↓ 1 callersFunctiondebug_output
(version: str, tasks: List[int])
evaluation/code_eval/coding/evalplus/tools/humaneval/fix_utils.py:39
↓ 1 callersFunctiondeduplicate
(inputs, results)
evaluation/code_eval/coding/evalplus/tools/humaneval/to_original_fmt.py:96
↓ 1 callersFunctiondeduplicate
(inputs, results)
evaluation/code_eval/coding/evalplus/tools/mbpp/to_original_fmt.py:148
↓ 1 callersFunctiondefault_parallelism
(divisor=4)
evaluation/code_eval/coding/evalplus/evalplus/perf/profile.py:27
↓ 1 callersFunctionderivative
(x)
evaluation/code_eval/coding/evalplus/tools/humaneval/fix_v014.py:22
↓ 1 callersFunctiondfs_get_deps
(node: Node, deps: Set[str])
evaluation/code_eval/coding/evalplus/evalplus/sanitize.py:48
↓ 1 callersFunctiondump_humaneval_plus_mini
(set_cover_info: Dict[str, List[str]], mini_path: str)
evaluation/code_eval/coding/evalplus/tools/tsr/minimization.py:164
↓ 1 callersFunctionestimate_pass_at_k
Estimates pass@k of each problem and returns them in an array.
evaluation/math_eval/eval/evaluate.py:27
↓ 1 callersFunctionestimator
Calculates 1 - comb(n - c, k) / comb(n, k).
evaluation/math_eval/eval/evaluate.py:36
↓ 1 callersFunctionestimator
Calculates 1 - comb(n - c, k) / comb(n, k).
evaluation/code_eval/coding/LiveCodeBench/lcb_runner/evaluation/pass_k_utils.py:7
↓ 1 callersFunctionestimator
Calculates 1 - comb(n - c, k) / comb(n, k).
evaluation/code_eval/coding/evalplus/evalplus/eval/__init__.py:68
↓ 1 callersMethodeval_k_input_prediction
(self, code: str, gold_output: str, k_agent_inputs: List[str], imports: List[str] = [])
absolute_zero_reasoner/utils/code_utils/python_executor.py:219
↓ 1 callersMethodeval_k_output_prediction
(self, code: str, gold_output: str, k_agent_outputs: List[str], imports: List[str] = [])
absolute_zero_reasoner/utils/code_utils/python_executor.py:238
↓ 1 callersFunctionevaluate
( dataset: str, samples: Optional[str] = None, base_only: bool = False, parallel: Optional[int
evaluation/code_eval/coding/evalplus/evalplus/evaluate.py:127
↓ 1 callersFunctionevaluate_generations
We take the list of code generations and try to compile them and the run their corresponding unit tests which are retrieved from the APPS dataset
evaluation/code_eval/coding/LiveCodeBench/lcb_runner/evaluation/compute_code_generation_metrics.py:108
↓ 1 callersFunctionevolve
(src_file, tgt_file)
evaluation/code_eval/coding/evalplus/tools/mbpp/fix_v020.py:52
↓ 1 callersFunctionevolve
(src_file, tgt_file)
evaluation/code_eval/coding/evalplus/tools/mbpp/fix_v010.py:203
↓ 1 callersMethodexec_code
(self, code_piece: str)
evaluation/math_eval/eval/python_executor.py:31
↓ 1 callersMethodexec_code
(self, code_piece: str)
absolute_zero_reasoner/utils/code_utils/python_executor.py:50
↓ 1 callersFunctionexecute
(code, input_list)
evaluation/code_eval/coding/evalplus/tools/filter_inputs.py:8
↓ 1 callersFunctionextract_answer
(solution_str: str, extraction_type: str)
evaluation/math_eval/eval/custom_evaluate.py:181
↓ 1 callersFunctionextract_answer_number
(sentence: str)
evaluation/math_eval/eval/math_utils.py:201
↓ 1 callersFunctionextract_azr_answer
(solution_str: str, extraction_type: str, data_name)
evaluation/math_eval/eval/parser.py:717
↓ 1 callersFunctionextract_boxed_answer
Extract the answer from inside a LaTeX \\boxed{} command
absolute_zero_reasoner/rewards/math_utils.py:422
↓ 1 callersFunctionextract_code_content
(solution_str)
evaluation/math_eval/eval/custom_evaluate.py:343
↓ 1 callersFunctionextract_execution_code
(model_output: str, lmstyle: LMStyle, cot: bool = False)
evaluation/code_eval/coding/LiveCodeBench/lcb_runner/utils/extraction_utils.py:59
↓ 1 callersFunctionextract_last_boxed
Extract content inside the last \boxed in LaTeX text
evaluation/math_eval/eval/sh/collect_results.py:19
↓ 1 callersFunctionextract_program_output
extract output between ```output\n...\n```, use regex, there might be multiple outputs, each output may have multiple lines
evaluation/math_eval/eval/trajectory.py:109
↓ 1 callersFunctionextract_solution
(solution_str)
absolute_zero_reasoner/data_construction/process_data.py:27
↓ 1 callersFunctionextract_target_code_or_empty
(code: str, entrypoint: Optional[str] = None)
evaluation/code_eval/coding/evalplus/evalplus/sanitize.py:110
↓ 1 callersFunctionextract_test_output_code
(model_output: str, lmstyle: LMStyle = None)
evaluation/code_eval/coding/LiveCodeBench/lcb_runner/utils/extraction_utils.py:30
↓ 1 callersFunctionextract_thought
(solution_str: str)
absolute_zero_reasoner/rewards/custom_evaluate.py:106
↓ 1 callersFunctionfewshot_cot
( task_id, client: openai.OpenAI, entry_point: str, code: str, model: str, n: int = 1,
evaluation/code_eval/coding/evalplus/evalplus/perf/sas.py:15
↓ 1 callersFunctionfilter_by_clustering
(task2profile: dict, base_threshold=0.2, min_clusters=3)
evaluation/code_eval/coding/evalplus/evalplus/perf/select_pe_tasks.py:102
↓ 1 callersFunctionfilter_by_compute_cost
Filter out tasks that can be solved using less than threshold #instruction.
evaluation/code_eval/coding/evalplus/evalplus/perf/select_pe_tasks.py:43
↓ 1 callersFunctionfilter_by_cv
(task2profile: dict, thresh: float, percentile: int = 95)
evaluation/code_eval/coding/evalplus/evalplus/perf/select_pe_tasks.py:64
↓ 1 callersFunctionfilter_by_profile_size
(task2profile: dict, threshold: int = 10)
evaluation/code_eval/coding/evalplus/evalplus/perf/select_pe_tasks.py:28
↓ 1 callersFunctionfind_calls
(source, functors, skip_main_fn=True)
evaluation/code_eval/coding/evalplus/tools/collect_valid_solutions.py:24
↓ 1 callersMethodfit
The training loop of PPO. The driver process only need to call the compute functions of the worker group through RPC to construct the
absolute_zero_reasoner/trainer/ppo/azr_ray_trainer.py:1446
↓ 1 callersFunctionfix
(data)
evaluation/code_eval/coding/evalplus/tools/humaneval/fix_v017.py:8
↓ 1 callersFunctionfix
(data)
evaluation/code_eval/coding/evalplus/tools/humaneval/fix_v018.py:8
↓ 1 callersFunctionfix
(data)
evaluation/code_eval/coding/evalplus/tools/mbpp/fix_v020.py:5
↓ 1 callersFunctionfix
(data)
evaluation/code_eval/coding/evalplus/tools/mbpp/fix_v010.py:5
↓ 1 callersFunctionfix_a_slash_b
(string: str)
evaluation/math_eval/eval/custom_evaluate.py:516
↓ 1 callersFunctionfix_a_slash_b
(string: str)
absolute_zero_reasoner/rewards/custom_evaluate.py:285
↓ 1 callersFunctionfix_fracs
(string: str)
evaluation/math_eval/eval/custom_evaluate.py:484
↓ 1 callersFunctionfix_fracs
(string: str)
absolute_zero_reasoner/rewards/custom_evaluate.py:253
↓ 1 callersFunctionfix_sqrt
(string: str)
evaluation/math_eval/eval/custom_evaluate.py:541
↓ 1 callersFunctionfix_sqrt
(string: str)
absolute_zero_reasoner/rewards/custom_evaluate.py:310
↓ 1 callersFunctionformat_prompt_self_repair
( question: str, LanguageModelStyle: LMStyle, code, result, metadata )
evaluation/code_eval/coding/LiveCodeBench/lcb_runner/prompts/self_repair.py:175
↓ 1 callersFunctionformat_testcase_func_name_input
use the form of "assert func_name(input) == "
evaluation/code_eval/coding/LiveCodeBench/lcb_runner/prompts/test_output_prediction.py:44
↓ 1 callersFunctiongather_solutions
Gather all solutions from the folders
evaluation/code_eval/coding/evalplus/tools/collect_valid_solutions.py:92
↓ 1 callersMethodget_all_datasets
Returns all datasets without step information
absolute_zero_reasoner/trainer/ppo/azr_ray_trainer.py:321
↓ 1 callersFunctionget_atol
(task_id: int)
evaluation/code_eval/coding/evalplus/tools/humaneval/init_plus.py:84
↓ 1 callersFunctionget_atol
(task_id: int)
evaluation/code_eval/coding/evalplus/tools/mbpp/init_plus.py:104
↓ 1 callersFunctionget_azr_question_template_answer
(question: CodeGenerationProblem)
evaluation/code_eval/coding/LiveCodeBench/lcb_runner/prompts/code_generation.py:156
↓ 1 callersFunctionget_base_model_question_template_answer
(question: CodeGenerationProblem)
evaluation/code_eval/coding/LiveCodeBench/lcb_runner/prompts/code_generation.py:188
↓ 1 callersFunctionget_benchmark_name
Extract benchmark name from path
evaluation/math_eval/eval/sh/collect_results.py:56
↓ 1 callersFunctionget_cache_path
(model_repr:str, args)
evaluation/code_eval/coding/LiveCodeBench/lcb_runner/utils/path_utils.py:15
↓ 1 callersFunctionget_cllama_question_template_answer
( question: TestOutputPredictionProblem, testcase_input: str )
evaluation/code_eval/coding/LiveCodeBench/lcb_runner/prompts/test_output_prediction.py:84
← previousnext →301–400 of 861, ranked by callers