Simple utility methods to collect eval results from an eval service. The method is intentionally kept private to prevent general usage.
(
inference_results: list[InferenceResult],
eval_service: BaseEvalService,
eval_metrics: list[EvalMetric],
)
| 151 | |
| 152 | |
| 153 | async def _collect_eval_results( |
| 154 | inference_results: list[InferenceResult], |
| 155 | eval_service: BaseEvalService, |
| 156 | eval_metrics: list[EvalMetric], |
| 157 | ) -> list[EvalCaseResult]: |
| 158 | """Simple utility methods to collect eval results from an eval service. |
| 159 | |
| 160 | The method is intentionally kept private to prevent general usage. |
| 161 | """ |
| 162 | eval_results = [] |
| 163 | evaluate_request = EvaluateRequest( |
| 164 | inference_results=inference_results, |
| 165 | evaluate_config=EvaluateConfig(eval_metrics=eval_metrics), |
| 166 | ) |
| 167 | async with Aclosing( |
| 168 | eval_service.evaluate(evaluate_request=evaluate_request) |
| 169 | ) as agen: |
| 170 | async for eval_result in agen: |
| 171 | eval_results.append(eval_result) |
| 172 | |
| 173 | return eval_results |
| 174 | |
| 175 | |
| 176 | def _convert_content_to_text( |
no test coverage detected