MCPcopy Create free account

hub / github.com/bigai-nlco/TongSearch-QR / functions

Functions47 in github.com/bigai-nlco/TongSearch-QR

↓ 9 callersFunctionget_scores
(query_ids,doc_ids,scores,excluded_ids)
scripts/evaluation/retrievers.py:112
↓ 4 callersFunctioncut_text
(text,tokenizer,threshold)
scripts/evaluation/retrievers.py:24
↓ 3 callersFunctionadd_instruct_concatenate
(texts,task,instruction)
scripts/evaluation/retrievers.py:97
↓ 3 callersFunctioncut_text_openai
(text,tokenizer,threshold=6000)
scripts/evaluation/retrievers.py:30
↓ 2 callersFunctionget_embedding_google
(texts,task,model,dimensionality=768)
scripts/evaluation/retrievers.py:36
↓ 2 callersFunctionget_embedding_openai
(texts, openai_client,tokenizer,model="text-embedding-3-large")
scripts/evaluation/retrievers.py:56
↓ 2 callersFunctionlast_token_pool
(last_hidden_states,attention_mask)
scripts/evaluation/retrievers.py:103
↓ 1 callersMethod_parse_think_output
Extract text inside <answer> tags if think_flag is True. Args: text: Raw model output. Returns: Ext
scripts/evaluation/vllm_model.py:71
↓ 1 callersFunctionbuild_samples
Randomly sample questions for each domain and format them as output items. Each item contains an empty 'instruction' and an 'input' with th
scripts/data_process/sample_stackexchange.py:68
↓ 1 callersFunctionbuild_system_prompt
Return system prompt depending on whether <think>/<answer> tags are enabled.
scripts/data_process/build_dataset.py:37
↓ 1 callersFunctioncalculate_retrieval_metrics
(results, qrels, k_values=[1, 5, 10, 25, 50, 100])
scripts/evaluation/retrievers.py:611
↓ 1 callersFunctioncollect_questions
Collect questions grouped by domain. Returns: dict: {domain_name: [list of questions]}
scripts/data_process/sample_stackexchange.py:50
↓ 1 callersFunctioncompute_score_bge
Compute the BGE-based reward score. Args: solution_str (str): The generated solution string. ground_truth (str): JSON string
scripts/train/reward.py:37
↓ 1 callersFunctioncreate_training_args
Create GRPO training configuration from argparse args.
scripts/train/train_grpo.py:65
↓ 1 callersFunctionextract_query_text
Extract the actual query text from a solution string. - If `<|im_start|>assistant` exists, strip everything before it. - If `think_f
scripts/train/reward.py:12
↓ 1 callersFunctionload_existing_queries
Load previously reasoned queries if the file exists.
scripts/evaluation/question_rewriting.py:15
↓ 1 callersFunctionload_training_dataset
Load and shuffle dataset from parquet file.
scripts/train/train_grpo.py:56
↓ 1 callersFunctionload_training_model_and_tokenizer
Load causal LM model and tokenizer from a given path.
scripts/train/train_grpo.py:48
↓ 1 callersFunctionmain
()
scripts/data_process/sample_stackexchange.py:85
↓ 1 callersFunctionmain
()
scripts/data_process/build_dataset.py:96
↓ 1 callersFunctionmain
()
scripts/evaluation/question_rewriting.py:56
↓ 1 callersFunctionmain
()
scripts/evaluation/print_eval_results.py:15
↓ 1 callersFunctionmain
()
scripts/train/train_grpo.py:99
↓ 1 callersFunctionparse_args
Parse command-line arguments.
scripts/data_process/sample_stackexchange.py:38
↓ 1 callersFunctionparse_args
Parse command-line arguments.
scripts/data_process/build_dataset.py:21
↓ 1 callersFunctionparse_args
Parse command-line arguments.
scripts/evaluation/question_rewriting.py:45
↓ 1 callersFunctionparse_args
Parse command-line arguments.
scripts/evaluation/print_eval_results.py:6
↓ 1 callersFunctionparse_args
()
scripts/train/train_grpo.py:11
↓ 1 callersMethodpredict
Generate model output given a prompt and optional instruction. Args: prompt: User query or input text. instr
scripts/evaluation/vllm_model.py:42
↓ 1 callersFunctionprocess_data
Process sampled questions into dataset items. Returns: (list of items, max question length)
scripts/data_process/build_dataset.py:49
↓ 1 callersFunctionreason_queries
Iterate over examples and generate reasoned queries.
scripts/evaluation/question_rewriting.py:27
↓ 1 callersFunctionsave_queries
Save the current query map to a JSON file.
scripts/evaluation/question_rewriting.py:22
↓ 1 callersFunctionsetup_logging
Setup logging to file and console.
scripts/train/train_grpo.py:36
Method__init__
(self, pretrain_path: str, system_prompt: str = "")
scripts/evaluation/vllm_model.py:22
Functionadd_instruct_list
(texts,task,instruction)
scripts/evaluation/retrievers.py:100
Functionbge_reward_func
Reward function that computes BGE-based scores for multiple completions. Args: completions (list): List of completions, each a list
scripts/train/reward.py:83
Functionretrieval_bm25
(queries,query_ids,documents,doc_ids,excluded_ids,long_context,**kwargs)
scripts/evaluation/retrievers.py:197
Functionretrieval_bm25_with_reasoner
(queries,query_ids,documents,doc_ids,excluded_ids,long_context,**kwargs)
scripts/evaluation/retrievers.py:227
Functionretrieval_cohere
(queries,query_ids,documents,doc_ids,task,model_id,cache_dir,excluded_ids,long_context,**kwargs)
scripts/evaluation/retrievers.py:415
Functionretrieval_google
(queries,query_ids,documents,doc_ids,task,model_id,cache_dir,excluded_ids,long_context,**kwargs)
scripts/evaluation/retrievers.py:559
Functionretrieval_grit
(queries,query_ids,documents,doc_ids,task,instructions,model_id,cache_dir,excluded_ids,long_context,**kwargs)
scripts/evaluation/retrievers.py:346
Functionretrieval_instructor
(queries,query_ids,documents,doc_ids,task,instructions,model_id,cache_dir,excluded_ids,long_context,**kwargs)
scripts/evaluation/retrievers.py:317
Functionretrieval_openai
(queries,query_ids,documents,doc_ids,task,model_id,cache_dir,excluded_ids,long_context,**kwargs)
scripts/evaluation/retrievers.py:379
Functionretrieval_sbert_bge
(queries,query_ids,documents,doc_ids,task,instructions,model_id,cache_dir,excluded_ids,long_context,**kwargs)
scripts/evaluation/retrievers.py:266
Functionretrieval_sbert_bge_with_reasoner
(queries,query_ids,documents,doc_ids,task,instructions,model_id,cache_dir,excluded_ids,long_context,**kwargs)
scripts/evaluation/retrievers.py:288
Functionretrieval_sf_qwen_e5
(queries,query_ids,documents,doc_ids,task,model_id,instructions,cache_dir,excluded_ids,long_context,**kwargs)
scripts/evaluation/retrievers.py:132
Functionretrieval_voyage
(queries,query_ids,documents,doc_ids,task,model_id,cache_dir,excluded_ids,long_context,**kwargs)
scripts/evaluation/retrievers.py:469