↓ 1 callersMethod_outcome_verification(
self,
rubric: dict,
evidence_by_criterion: Dict[int, List[Dict]],
task: str,
webeval/src/webeval/rubric_agent/mm_rubric_agent.py:2757
↓ 1 callersMethod_rescore_criterion_with_screenshots(
self,
rubric: dict,
evidence_by_criterion: Dict[int, List[Dict]],
task: str,
webeval/src/webeval/rubric_agent/mm_rubric_agent.py:2317
↓ 1 callersMethod_rescore_rubric_with_screenshots(
self,
rubric: dict,
evidence_by_criterion: Dict[int, List[Dict]],
task: str,
webeval/src/webeval/rubric_agent/mm_rubric_agent.py:2422
↓ 1 callersMethod_rubric_reality_check(
self,
rubric: dict,
evidence_by_criterion: Dict[int, List[Dict]],
task: str,
webeval/src/webeval/rubric_agent/mm_rubric_agent.py:2213
↓ 1 callersFunction_run_eval_multiple_examples_with_progress_multi_proc(examples, processes, output_folder, redo_eval, system, benchmark, callback = None, eval_only=False, max_error
webeval/src/webeval/core.py:721
↓ 1 callersFunction_run_eval_multiple_examples_with_progress_single_proc(examples, output_folder, redo_eval, system, benchmark, callback = None, eval_only=False, max_error_task_retri
webeval/src/webeval/core.py:708
↓ 1 callersMethodconvert_resized_coords_to_original(
self, coords: List[float], rsz_w: int, rsz_h: int, og_w: int, og_h: int
)
src/fara/fara_agent.py:324
↓ 1 callersMethodfill_coords(
self,
page: Page,
x: float,
y: float,
value: str,
press_ente
src/fara/browser/playwright_controller.py:487
↓ 1 callersMethodgenerate(self, messages, max_new_tokens=512, temperature=0, model=None, **kwargs)
webeval/src/webeval/benchmarks/om2w/impl/src/utils.py:115