Code
Hub
Workspaces
Following
Trending
Connect
MCP
copy
Create free account
hub
/
github.com/huggingface/evaluate
/ types & classes
Types & classes
150 in github.com/huggingface/evaluate
⨍
Functions
785
◇
Types & classes
150
↳
Endpoints
6
↓ 44 callers
Class
DummyMetric
tests/test_metric.py:16
↓ 6 callers
Class
HubEvaluationModuleFactory
Get the module of a metric from a metric repository on the Hub.
src/evaluate/loading.py:443
↓ 5 callers
Class
DatasetColumn
Helper class to avoid loading a dataset column into memory when accessing it.
src/evaluate/evaluator/utils.py:4
↓ 4 callers
Class
DummyTextClassificationPipeline
tests/test_evaluator.py:71
↓ 4 callers
Class
EvaluationModuleInfo
Base class to store information about an evaluation used for `MetricInfo`, `ComparisonInfo`, and `MeasurementInfo`. `EvaluationModuleInfo` do
src/evaluate/info.py:35
↓ 4 callers
Class
LocalEvaluationModuleFactory
Get the module of a local metric. The metric script is loaded from a local script.
src/evaluate/loading.py:400
↓ 3 callers
Class
AccuracyWithNonStandardFeatureNames
tests/test_metric.py:619
↓ 3 callers
Class
CachedEvaluationModuleFactory
Get the module of a metric that has been loaded once already and cached. The script that is loaded from the cache is the most recent one with
src/evaluate/loading.py:511
↓ 3 callers
Class
DummyText2TextGenerationPipeline
tests/test_evaluator.py:62
↓ 3 callers
Class
ImportableModule
src/evaluate/loading.py:390
↓ 2 callers
Class
DummyQuestionAnsweringPipeline
tests/test_evaluator.py:90
↓ 2 callers
Class
FileFreeLock
Thread lock until a file **cannot** be locked
src/evaluate/module.py:44
↓ 2 callers
Class
QuestionAnsweringEvaluator
Question answering evaluator. This evaluator handles [**extractive** question answering](https://huggingface.co/docs/transformers/task_summar
src/evaluate/evaluator/question_answering.py:78
↓ 1 callers
Class
AnotherDummyMetric
tests/test_metric.py:73
↓ 1 callers
Class
AudioClassificationEvaluator
Audio classification evaluator. This audio classification evaluator can currently be loaded from [`evaluator`] using the default task name
src/evaluate/evaluator/audio_classification.py:81
↓ 1 callers
Class
AutomaticSpeechRecognitionEvaluator
Automatic speech recognition evaluator. This automatic speech recognition evaluator can currently be loaded from [`evaluator`] using the defa
src/evaluate/evaluator/automatic_speech_recognition.py:47
↓ 1 callers
Class
CER
metrics/cer/cer.py:121
↓ 1 callers
Class
CombinedEvaluations
src/evaluate/module.py:872
↓ 1 callers
Class
ComplexRadar
Create a complex radar chart with different scales for each variable Args: fig (`matplotlib.figure`) : A matplotlib figure object to add the
src/evaluate/visualization.py:8
↓ 1 callers
Class
DatasetColumnPair
Helper class to avoid loading two dataset columns into memory when accessing it.
src/evaluate/evaluator/utils.py:41
↓ 1 callers
Class
DummyAudioClassificationPipeline
tests/test_evaluator.py:133
↓ 1 callers
Class
DummyAutomaticSpeechRecognitionPipeline
tests/test_evaluator.py:125
↓ 1 callers
Class
DummyImageClassificationPipeline
tests/test_evaluator.py:82
↓ 1 callers
Class
DummyTextGenerationPipeline
tests/test_evaluator.py:52
↓ 1 callers
Class
DummyTokenClassificationPipeline
tests/test_evaluator.py:107
↓ 1 callers
Class
EmptyTqdm
Dummy tqdm which doesn't do anything.
src/evaluate/utils/logging.py:172
↓ 1 callers
Class
ImageClassificationEvaluator
Image classification evaluator. This image classification evaluator can currently be loaded from [`evaluator`] using the default task name
src/evaluate/evaluator/image_classification.py:49
↓ 1 callers
Class
MetricWithMultiLabel
tests/test_metric.py:570
↓ 1 callers
Class
MockedPredictor
tests/test_metric_common.py:175
↓ 1 callers
Class
Model
tests/test_metric_common.py:205
↓ 1 callers
Class
OfflineModeIsEnabled
src/evaluate/utils/file_utils.py:236
↓ 1 callers
Class
RequestWouldHangIndefinitelyError
tests/utils.py:214
↓ 1 callers
Class
SentencesToListOfCharacters
metrics/xtreme_s/xtreme_s.py:103
↓ 1 callers
Class
SentencesToListOfCharacters
metrics/cer/cer.py:36
↓ 1 callers
Class
Text2TextGenerationEvaluator
Text2Text generation evaluator. This Text2Text generation evaluator can currently be loaded from [`evaluator`] using the default task name
src/evaluate/evaluator/text2text_generation.py:88
↓ 1 callers
Class
TextClassificationEvaluator
Text classification evaluator. This text classification evaluator can currently be loaded from [`evaluator`] using the default task name
src/evaluate/evaluator/text_classification.py:51
↓ 1 callers
Class
TextGenerationEvaluator
Text generation evaluator. This Text generation evaluator can currently be loaded from [`evaluator`] using the default task name `text-ge
src/evaluate/evaluator/text_generation.py:31
↓ 1 callers
Class
TimeoutException
metrics/code_eval/execute.py:118
↓ 1 callers
Class
TokenClassificationEvaluator
Token classification evaluator. This token classification evaluator can currently be loaded from [`evaluator`] using the default task name
src/evaluate/evaluator/token_classification.py:90
↓ 1 callers
Class
Tokenizer
Helper class to wrap a callable into a class with a `tokenize` method as used by rouge-score.
metrics/rouge/rouge.py:83
↓ 1 callers
Class
Tokenizer13a
metrics/google_bleu/tokenizer_13a.py:73
↓ 1 callers
Class
Tokenizer13a
metrics/bleu/tokenizer_13a.py:73
↓ 1 callers
Class
TokenizerRegexp
metrics/google_bleu/tokenizer_13a.py:39
↓ 1 callers
Class
TokenizerRegexp
metrics/bleu/tokenizer_13a.py:39
↓ 1 callers
Class
WriteOnlyStringIO
StringIO that throws an exception when it's read from
metrics/code_eval/execute.py:122
↓ 1 callers
Class
_tqdm_cls
src/evaluate/utils/logging.py:199
↓ 1 callers
Class
redirect_stdin
metrics/code_eval/execute.py:139
Class
Accuracy
metrics/accuracy/accuracy.py:81
Class
BERTScore
metrics/bertscore/bertscore.py:101
Class
BLEURT
metrics/bleurt/bleurt.py:80
Class
BaseTokenizer
A base dummy tokenizer to derive from.
metrics/google_bleu/tokenizer_13a.py:20
Class
BaseTokenizer
A base dummy tokenizer to derive from.
metrics/bleu/tokenizer_13a.py:20
Class
Bleu
metrics/bleu/bleu.py:88
Class
BrierScore
metrics/brier_score/brier_score.py:88
Class
COMET
metrics/comet/comet.py:128
Class
CUAD
metrics/cuad/cuad.py:72
Class
Character
CharacTer is a character-level metric inspired by the commonly applied translation edit rate (TER).
metrics/character/character.py:93
Class
Charcut
Character-based MT evaluation.
metrics/charcut_mt/charcut_mt.py:66
Class
ChrF
metrics/chrf/chrf.py:127
Class
CodeEval
metrics/code_eval/code_eval.py:135
Class
Comparison
A Comparison is the base class and common API for all comparisons. Args: config_name (`str`): This is used to define a hash s
src/evaluate/module.py:812
Class
ComparisonInfo
Information about a comparison. `EvaluationModuleInfo` documents a comparison, including its name, version, and features. See the constructor
src/evaluate/info.py:135
Class
CompetitionMathMetric
Accuracy metric for the MATH dataset.
metrics/competition_math/competition_math.py:67
Class
ConfusionMatrix
metrics/confusion_matrix/confusion_matrix.py:63
Class
Coval
metrics/coval/coval.py:273
Class
EvaluationModule
A `EvaluationModule` is the base class and common API for metrics, comparisons, and measurements. Args: config_name (`str`):
src/evaluate/module.py:149
Class
EvaluationModuleInfoMixin
This base class exposes some attributes of EvaluationModuleInfo at the base level of the EvaluationModule for easy access.
src/evaluate/module.py:83
Class
EvaluationSuite
This class instantiates an evaluation suite made up of multiple tasks, where each task consists of a dataset and an associated metric, and ru
src/evaluate/evaluation_suite/__init__.py:59
Class
Evaluator
The [`Evaluator`] class is the class from which all evaluators inherit. Refer to this class for methods shared across different evaluators.
src/evaluate/evaluator/base.py:102
Class
ExactMatch
metrics/exact_match/exact_match.py:87
Class
ExactMatch
comparisons/exact_match/exact_match.py:48
Class
F1
metrics/f1/f1.py:106
Class
FRUGALSCORE
metrics/frugalscore/frugalscore.py:58
Class
Glue
metrics/glue/glue.py:106
Class
GoogleBleu
metrics/google_bleu/google_bleu.py:128
Class
Honest
measurements/honest/honest.py:113
Class
IndicGlue
metrics/indic_glue/indic_glue.py:106
Class
LabelDistribution
measurements/label_distribution/label_distribution.py:72
Class
LocalModuleTest
tests/test_metric_common.py:97
Class
Mae
metrics/mae/mae.py:85
Class
Mahalanobis
metrics/mahalanobis/mahalanobis.py:61
Class
Mape
metrics/mape/mape.py:85
Class
Mase
metrics/mase/mase.py:95
Class
MatthewsCorrelation
metrics/matthews_correlation/matthews_correlation.py:102
Class
Mauve
metrics/mauve/mauve.py:95
Class
McNemar
comparisons/mcnemar/mcnemar.py:64
Class
MeanIoU
metrics/mean_iou/mean_iou.py:277
Class
Measurement
A Measurement is the base class and common API for all measurements. Args: config_name (`str`): This is used to define a hash
src/evaluate/module.py:842
Class
MeasurementInfo
Information about a measurement. `EvaluationModuleInfo` documents a measurement, including its name, version, and features. See the construct
src/evaluate/info.py:148
Class
Meteor
metrics/meteor/meteor.py:92
Class
Metric
A Metric is the base class and common API for all metrics. Args: config_name (`str`): This is used to define a hash specific
src/evaluate/module.py:782
Class
MetricInfo
Information about a metric. `EvaluationModuleInfo` documents a metric, including its name, version, and features. See the constructor argumen
src/evaluate/info.py:122
Class
ModuleFactoryTest
tests/test_load.py:50
Class
Mse
metrics/mse/mse.py:89
Class
NistMt
A wrapper around NLTK's NIST implementation.
metrics/nist_mt/nist_mt.py:86
Class
OfflineSimulationMode
tests/utils.py:218
Class
Pearsonr
metrics/pearsonr/pearsonr.py:87
Class
Perplexity
measurements/perplexity/perplexity.py:89
Class
Perplexity
metrics/perplexity/perplexity.py:88
Class
Poseval
metrics/poseval/poseval.py:84
next →
1–100 of 150, ranked by callers