MCPcopy Create free account

hub / github.com/ML-GSAI/LLaDA / functions

Functions3,438 in github.com/ML-GSAI/LLaDA

↓ 1 callersFunctionclean_latex
(latex_expr)
opencompass/opencompass/datasets/supergpqa/supergpqa_utils.py:326
↓ 1 callersMethodclean_latex
Cleans LaTeX expressions for parsing. Args: latex_expr (str): The LaTeX expression to clean. Returns: str: T
opencompass/opencompass/openicl/icl_evaluator/icl_korbench_evaluator.py:199
↓ 1 callersFunctioncn_string
(s)
opencompass/opencompass/datasets/subjective/corev2.py:188
↓ 1 callersFunctioncode_execution_metrics
( samples, generations, )
opencompass/opencompass/datasets/livecodebench/evaluator.py:346
↓ 1 callersFunctioncodeexecute_check_correctness
Evaluates the functional correctness of a completion by running the test suite provided in the problem. :param completion_id: an optional com
opencompass/opencompass/datasets/livecodebench/execute_utils.py:65
↓ 1 callersFunctioncodegen_check_correctness
Check correctness of code generation with a global timeout. The global timeout is to catch some extreme/rare cases not handled by the timeout
opencompass/opencompass/datasets/livecodebench/evaluator.py:22
↓ 1 callersFunctioncodegen_metrics
( samples_list, generations_list, k_list=[1, 5, 10, 20, 40, 50, 75, 100, 125, 150, 200, 500, 1000]
opencompass/opencompass/datasets/livecodebench/evaluator.py:173
↓ 1 callersFunctioncollect_preds
(filename: str)
opencompass/tools/collect_code_preds.py:91
↓ 1 callersFunctioncombine_prompt
(prompt_path, dataset_name, load_explanation=True, ch
opencompass/opencompass/datasets/agieval/dataset_loader.py:95
↓ 1 callersFunctioncombine_prompt
(prompt_path, dataset_name, load_explanation=True, ch
opencompass/opencompass/datasets/medbench/dataset_loader.py:68
↓ 1 callersFunctioncompareEdits
(hyp_edits, ref_edits)
opencompass/opencompass/datasets/lawbench/utils/compare_m2_for_evaluation.py:309
↓ 1 callersFunctioncompare_answers
Compare target and output answers. Takes only the first sentence from output and filters responses when model tries to generate examples. We
opencompass/opencompass/datasets/babilong/babilong_utils.py:11
↓ 1 callersFunctioncompare_folders
Compare files with specified extensions in two folders.
opencompass/tools/compare_configs.py:34
↓ 1 callersFunctioncompare_math_expressions
(response, answer)
opencompass/opencompass/datasets/korbench/korbench_utils.py:426
↓ 1 callersFunctioncompare_math_expressions
(response, answer)
opencompass/opencompass/datasets/supergpqa/supergpqa_utils.py:426
↓ 1 callersFunctioncompare_multi_results
(response, answer)
opencompass/opencompass/datasets/korbench/korbench_utils.py:405
↓ 1 callersFunctioncompare_multi_results
(response, answer)
opencompass/opencompass/datasets/supergpqa/supergpqa_utils.py:405
↓ 1 callersFunctioncompare_solutions_with_padding
(generated_output: List[int], correct_output: List[int],
opencompass/opencompass/datasets/arc_prize_public_evaluation.py:192
↓ 1 callersMethodcompare_steps
Compare results according to score when both answers are failed.
opencompass/opencompass/openicl/icl_evaluator/icl_agent_evaluator.py:236
↓ 1 callersFunctioncompare_two_list
(pred, gt)
opencompass/opencompass/datasets/TheoremQA/number_utils.py:88
↓ 1 callersFunctioncompute_acc
(gt_list, pred_list)
opencompass/opencompass/datasets/calm/evaluation/accuracy/prob.py:1
↓ 1 callersMethodcompute_args_em_metric
(self, gt_action, pred_action, gt_args, pred_args)
opencompass/opencompass/datasets/teval/evaluators/instruct_evaluator.py:85
↓ 1 callersFunctioncompute_bootstrap_bt
( battles, num_round: int, base: float = 10.0, scale: float = 400.0, init_rating: float =
opencompass/opencompass/summarizers/subjective/compass_arena_bradley_terry.py:323
↓ 1 callersFunctioncompute_bootstrap_style_control
( df, num_round: int, alpha: float = math.log(10.0), reg: float = 0.5, scale: float = 400.
opencompass/opencompass/summarizers/subjective/compass_arena_bradley_terry.py:516
↓ 1 callersFunctioncompute_bt
( df, base: float = 10.0, scale: float = 400.0, init_rating: float = 1000.0, baseline_mode
opencompass/opencompass/summarizers/subjective/compass_arena_bradley_terry.py:298
↓ 1 callersFunctioncompute_core_metrics
Computes core metrics for a given set of items based on the ground truth items. Args: items (list): The list of items generated by th
opencompass/opencompass/datasets/calm/evaluation/core_metrics.py:285
↓ 1 callersFunctioncompute_g_pass_at_k
(n, c, k, t)
opencompass/opencompass/openicl/icl_evaluator/icl_base_evaluator.py:29
↓ 1 callersFunctioncompute_ie_f1
(hyps, refs, entity_types)
opencompass/opencompass/datasets/lawbench/utils/comprehension_scores.py:35
↓ 1 callersFunctioncompute_maximum_bleu_value
(gen: str, ref: str, lang: str)
opencompass/opencompass/datasets/PMMEval/flores.py:27
↓ 1 callersMethodcompute_metrics
(self, results, k_list=[1, 10, 100])
opencompass/opencompass/datasets/apps.py:258
↓ 1 callersMethodcompute_metrics
(self, results, k_list=[1, 10, 100])
opencompass/opencompass/datasets/taco.py:207
↓ 1 callersFunctioncompute_metrics_from_results
(results: dict, k_list=[1])
opencompass/opencompass/datasets/codecompass/metrics.py:24
↓ 1 callersFunctioncompute_mg_pass_at_k
(n, c, k)
opencompass/opencompass/openicl/icl_evaluator/icl_base_evaluator.py:34
↓ 1 callersMethodcompute_min_edit_distance
Computes the minimum edit distance between two strings using dynamic programming.
opencompass/opencompass/datasets/NPHardEval/p_EDP.py:81
↓ 1 callersFunctioncompute_mle_elo
(df, SCALE=400, BASE=10, INIT_RATING=1000)
opencompass/opencompass/summarizers/subjective/arenahard.py:31
↓ 1 callersFunctioncompute_mle_elo
(df, SCALE=400, BASE=10, INIT_RATING=1000)
opencompass/opencompass/datasets/subjective/arena_hard.py:93
↓ 1 callersFunctioncompute_one_mixed_question_pass_rate
(idx, question_list, respons
opencompass/opencompass/datasets/korbench/korbench_utils.py:611
↓ 1 callersFunctioncompute_rc_f1
(hyps, refs)
opencompass/opencompass/datasets/lawbench/utils/comprehension_scores.py:21
↓ 1 callersFunctioncompute_style_control
( df: pd.DataFrame, alpha: float = math.log(10.0), reg: float = 0.5, scale: float = 400.0,
opencompass/opencompass/summarizers/subjective/compass_arena_bradley_terry.py:446
↓ 1 callersMethodcompute_turn_score
This is the function what you are probably looking for. a_pred is the answer string your model predicted.
opencompass/opencompass/datasets/lawbench/utils/rc_f1.py:101
↓ 1 callersFunctionconcat_prompt
(demos, dataset_name, max_tokens, end_of_example='\n',
opencompass/opencompass/datasets/agieval/dataset_loader.py:177
↓ 1 callersFunctionconcat_prompt
(demos, dataset_name, max_tokens, end_of_example='\n',
opencompass/opencompass/datasets/medbench/dataset_loader.py:139
↓ 1 callersFunctionconcat_prompt_chat_mode
(demos, dataset_name, max_tokens,
opencompass/opencompass/datasets/agieval/dataset_loader.py:210
↓ 1 callersFunctionconcat_prompt_chat_mode
(demos, dataset_name, max_tokens,
opencompass/opencompass/datasets/medbench/dataset_loader.py:172
↓ 1 callersFunctioncontains_elements_and_matches
(sentence, chem_elts)
opencompass/opencompass/datasets/matbench/post_process.py:70
↓ 1 callersFunctionconvert_few_shot
(line, dataset_name, demo, n_shot, chat_mode=False)
opencompass/opencompass/datasets/agieval/dataset_loader.py:242
↓ 1 callersFunctionconvert_few_shot
(line, dataset_name, demo, n_shot, chat_mode=False)
opencompass/opencompass/datasets/medbench/dataset_loader.py:204
↓ 1 callersFunctionconvert_latex_fractions
Convert non-standard fraction like \frac\alpha2 to its standard- convertible \frac{\alpha}{2} We support single letter,number or standard form
opencompass/opencompass/datasets/phybench/latex_pre_process.py:173
↓ 1 callersFunctionconvert_pi_to_number
(code_string)
opencompass/opencompass/datasets/TheoremQA/number_utils.py:28
↓ 1 callersFunctionconvert_results
(result_path)
opencompass/opencompass/datasets/teval/utils/convert_results.py:13
↓ 1 callersFunctionconvert_to_k
(value)
opencompass/opencompass/summarizers/needlebench.py:175
↓ 1 callersFunctionconvert_vec_syntax
Converts LaTeX vector syntax to a standardized form. This function processes a given text string and ensures that LaTeX vector notations are
opencompass/opencompass/datasets/phybench/latex_pre_process.py:301
↓ 1 callersMethodcot_prompt_wrap
(x: str, y: str = '')
opencompass/opencompass/datasets/game24.py:193
↓ 1 callersFunctioncount_chinese_characters
(text)
opencompass/opencompass/openicl/icl_evaluator/lm_evaluator.py:92
↓ 1 callersFunctioncount_english_words
(text)
opencompass/opencompass/openicl/icl_evaluator/lm_evaluator.py:97
↓ 1 callersFunctioncount_style_elements
Count style elements for bradley terry + style control. Args: text (str): Text to calculate style features from. suffix (str, opt
opencompass/opencompass/datasets/subjective/compass_arena_subjective_bench.py:414
↓ 1 callersFunctioncreate_chatbot_demo
()
app.py:295
↓ 1 callersMethodcreate_index
(self)
opencompass/opencompass/openicl/icl_retriever/icl_topk_retriever.py:86
↓ 1 callersMethodcreate_request_body
Create an API request body for a given text. Args: text: Text to perform evaluation. Returns: dict: Request
opencompass/opencompass/openicl/icl_evaluator/icl_toxic_evaluator.py:60
↓ 1 callersFunctioncreate_section_row
(row_i: int, row: List[str], table)
opencompass/opencompass/summarizers/multi_model.py:63
↓ 1 callersFunctioncreate_tempdir
()
opencompass/opencompass/datasets/livecodebench/execute_utils.py:146
↓ 1 callersFunctioncreate_win_row
(rows: List[List[str]])
opencompass/opencompass/summarizers/multi_model.py:75
↓ 1 callersFunctioncustom_compare_
(output, ground_truth)
opencompass/opencompass/datasets/apps.py:751
↓ 1 callersFunctioncustom_compare_
(output, ground_truth)
opencompass/opencompass/datasets/taco.py:701
↓ 1 callersFunctioncustom_compare_
(output, ground_truth)
opencompass/opencompass/datasets/livecodebench/testing_util.py:634
↓ 1 callersFunctiondetect_mapping
(text)
opencompass/opencompass/summarizers/subjective/alignmentbench.py:40
↓ 1 callersFunctiondetect_mapping
(text)
opencompass/opencompass/datasets/subjective/alignbench.py:141
↓ 1 callersFunctiondfs_get_deps
(node: Node, deps: Set[str])
opencompass/opencompass/datasets/bigcodebench/extractor.py:51
↓ 1 callersMethoddimension2def
(self, dimension)
opencompass/opencompass/datasets/subjective/alignbench.py:58
↓ 1 callersFunctiondispatch_tasks
(cfg, force=False)
opencompass/tools/case_analyzer.py:168
↓ 1 callersFunctiondispatch_tasks
(cfg)
opencompass/tools/prediction_merger.py:75
↓ 1 callersMethoddo_inference
(self, instruction, history=[])
opencompass/opencompass/models/alaya.py:80
↓ 1 callersFunctiondo_setup
()
opencompass/setup.py:107
↓ 1 callersFunctiondownload_and_extract_archive
(url, download_root, extract_root=None,
opencompass/opencompass/utils/fileio.py:509
↓ 1 callersFunctiondownload_url
Download a file from a url and place it in root. Args: url (str): URL to download file from. root (str): Directory to place downl
opencompass/opencompass/utils/fileio.py:420
↓ 1 callersMethoddpp_search
(self)
opencompass/opencompass/openicl/icl_retriever/icl_dpp_retriever.py:44
↓ 1 callersMethoddraw_menu
(self, stdscr, selected_row_idx, offset, max_rows)
opencompass/opencompass/utils/menu.py:29
↓ 1 callersFunctionds1000_postprocess
(text: str)
opencompass/opencompass/datasets/ds1000.py:128
↓ 1 callersFunctioneb_ex
()
opencompass/opencompass/datasets/musr/tree.py:566
↓ 1 callersFunctionedit_similarity_score
(predicted_text, original_text)
opencompass/opencompass/datasets/benbench.py:49
↓ 1 callersMethodedp_check
Check if the edit distance solution is valid. :param instance: The instance dictionary with 'string_a' and 'string_b'. :param solutio
opencompass/opencompass/datasets/NPHardEval/p_EDP.py:99
↓ 1 callersFunctionencode_base64_string
对字符串进行 Base64 编码. :param s: 字符串 :return: 编码后的字符串
opencompass/opencompass/models/yayi_api.py:48
↓ 1 callersFunctionensure_directory
(path)
opencompass/opencompass/summarizers/needlebench.py:386
↓ 1 callersFunctionentropy
(probs: np.array, label_dim: int = 0, mask=None)
opencompass/opencompass/openicl/icl_retriever/icl_mdl_retriever.py:184
↓ 1 callersFunctionequal_with_timeout
(expr1, expr2)
opencompass/opencompass/datasets/phybench/EED.py:134
↓ 1 callersMethodequation_equal
(expression1 is assumed to be Ground_Truth) Function: Check if two equations are mathematically equivalent Step 1: Simplify e
opencompass/opencompass/datasets/OlympiadBench.py:494
↓ 1 callersFunctionescape_ansi
(line)
opencompass/opencompass/lagent/actions/ipython_interpreter.py:273
↓ 1 callersFunctionestimate_pass_at_k
Estimates pass@k of each problem and returns them in an array.
opencompass/opencompass/datasets/codecompass/metrics.py:4
↓ 1 callersMethodestimate_pass_at_k
Estimates pass@k of each problem and returns them in an array.
opencompass/opencompass/datasets/LCBench.py:247
↓ 1 callersMethodestimate_pass_at_k
Estimates pass@k of each problem and returns them in an array.
opencompass/opencompass/datasets/mbpp.py:457
↓ 1 callersFunctionestimator
Calculates 1 - comb(n - c, k) / comb(n, k).
opencompass/opencompass/datasets/livecodebench/pass_k_utils.py:9
↓ 1 callersMethodeval_code
(self, expr: str)
opencompass/opencompass/lagent/actions/python_interpreter.py:29
↓ 1 callersFunctioneval_prompt_construct
(task, ref_answer, history)
opencompass/opencompass/datasets/subjective/mtbench101.py:237
↓ 1 callersMethodevaluate
(self)
opencompass/opencompass/tasks/llm_eval.py:34
↓ 1 callersFunctionevaluate_edits
(src, hyp_dict, ref_dict, best, sent_id, args)
opencompass/opencompass/datasets/lawbench/utils/compare_m2_for_evaluation.py:242
↓ 1 callersFunctionevaluate_generations
We take the list of code generations and try to compile them and the run their corresponding unit tests which are retrieved from the APPS dataset.
opencompass/opencompass/datasets/livecodebench/evaluator.py:117
↓ 1 callersMethodevaluate_generations
(self, generations, samples,
opencompass/opencompass/datasets/apps.py:193
↓ 1 callersMethodevaluate_generations
(self, generations, samples,
opencompass/opencompass/datasets/taco.py:142
↓ 1 callersMethodevaluate_response_vs_answer
Evaluates a single response against the answer. Args: response (str): The model's response. answer (str): The referen
opencompass/opencompass/openicl/icl_evaluator/icl_korbench_evaluator.py:216
↓ 1 callersMethodevaluate_responses
Evaluates a list of responses. Args: data (list): List of records containing responses and answers. question_type (st
opencompass/opencompass/openicl/icl_evaluator/icl_korbench_evaluator.py:132
← previousnext →801–900 of 3,438, ranked by callers