(
setting: str,
model: Literal["Qwen2.5", "gpt-4o"],
general_eval: bool = False,
feature_eval: bool = False,
ppt_eval: bool = False,
)
| 233 | |
| 234 | |
| 235 | def eval_baseline( |
| 236 | setting: str, |
| 237 | model: Literal["Qwen2.5", "gpt-4o"], |
| 238 | general_eval: bool = False, |
| 239 | feature_eval: bool = False, |
| 240 | ppt_eval: bool = False, |
| 241 | ): |
| 242 | evals = defaultdict(dict) |
| 243 | prs_files = glob(f"data/*/pdf/*/{setting}/{model}/final.pptx") |
| 244 | slide_folders = [os.path.dirname(i) for i in prs_files] |
| 245 | |
| 246 | if general_eval or feature_eval: |
| 247 | config = Config("/tmp") |
| 248 | presentations = [Presentation.from_file(i, config) for i in prs_files] |
| 249 | |
| 250 | if general_eval: |
| 251 | eval_general(presentations, evals) |
| 252 | if feature_eval: |
| 253 | eval_feature(presentations, evals, setting, fid_eval=False) |
| 254 | if ppt_eval: |
| 255 | for slide_folder in slide_folders: |
| 256 | slide_score(slide_folder) |
| 257 | for presentation in prs_files: |
| 258 | pres_score(presentation) |
| 259 | |
| 260 | merge_evals(slide_folders, evals) |
| 261 | json.dump(evals, open(f"data/evals/{setting}_{model}.json", "w"), indent=4) |
| 262 | |
| 263 | |
| 264 | if __name__ == "__main__": |
nothing calls this directly
no test coverage detected