Code
Hub
Workspaces
Following
Trending
Connect
MCP
copy
Create free account
hub
/
github.com/alibaba/vstyle
/ functions
Functions
23 in github.com/alibaba/vstyle
⨍
Functions
23
◇
Types & classes
0
↓ 5 callers
Function
safe_float
(x: Any)
lalm_eval/gemini_eval.py:119
↓ 4 callers
Function
ensure_dir
(p: Path)
lalm_eval/gemini_eval.py:125
↓ 2 callers
Function
compute_individual_correlations
Compute correlations between individual annotators and model
human_align/compute_model_human_spearman_r.py:73
↓ 2 callers
Function
compute_overall_correlation
Compute overall correlation between human average and model
human_align/compute_model_human_spearman_r.py:117
↓ 2 callers
Function
compute_pairwise_human_correlations
Compute pairwise correlations between human annotators
human_align/compute_model_human_spearman_r.py:93
↓ 2 callers
Function
filter_by_category
Filter data dictionary by category
human_align/compute_model_human_spearman_r.py:143
↓ 2 callers
Function
get_major_category
Extract major category from ability string
human_align/compute_model_human_spearman_r.py:137
↓ 2 callers
Function
parse_score
Extract score from model reply: 1. Find all segments like [[...]] 2. Search backwards for the first value that can be converted to float
lalm_eval/gemini_eval.py:128
↓ 1 callers
Function
analyze_language
Analyze correlations for a single language
human_align/compute_model_human_spearman_r.py:302
↓ 1 callers
Function
analyze_scores
(scored_jsonl: Path, out_dir: Path)
lalm_eval/gemini_eval.py:412
↓ 1 callers
Function
call_gemini_api
Call model using official Gemini API
lalm_eval/gemini_eval.py:65
↓ 1 callers
Function
compute_category_correlations
Compute correlations for each major category
human_align/compute_model_human_spearman_r.py:153
↓ 1 callers
Function
construct_prompt
(template: str, instruction: str, ability: str)
lalm_eval/gemini_eval.py:59
↓ 1 callers
Function
eval_all_samples
( root_dir: Path, metadata_path: Path, prompts_dir: Path, out_dir: Path, max_per_ability:
lalm_eval/gemini_eval.py:312
↓ 1 callers
Function
get_ordered_abilities
Get abilities in the order defined by SUB_CATS
lalm_eval/gemini_eval.py:403
↓ 1 callers
Function
load_human_scores
Load human annotation jsonl files, return: - human_scores: {annotator: {key: mos}} - ability_map: {key: ability} where key = f"{did}_{iid
human_align/compute_model_human_spearman_r.py:8
↓ 1 callers
Function
load_model_scores
Load model evaluation jsonl file, return: - model_scores: {key: score} - ability_map: updated {key: ability}
human_align/compute_model_human_spearman_r.py:43
↓ 1 callers
Function
load_processed_ids_and_clean_failures
Read existing metadata_with_score.jsonl, return set of successfully processed IDs, and clean failed records in-place Returns:
lalm_eval/gemini_eval.py:223
↓ 1 callers
Function
load_prompts
(prompts_dir: Path)
lalm_eval/gemini_eval.py:51
↓ 1 callers
Function
main
()
lalm_eval/gemini_eval.py:609
↓ 1 callers
Function
print_summary_table
Print a summary table comparing results across languages
human_align/compute_model_human_spearman_r.py:201
↓ 1 callers
Function
remove_duplicates_from_tasks
Remove duplicate samples based on ID, keeping the first occurrence Args: tasks: List of sample dictionaries Returns
lalm_eval/gemini_eval.py:278
Function
evaluate_one
Evaluate single sample and write complete output to txt file
lalm_eval/gemini_eval.py:146