Code
Hub
Workspaces
Following
Trending
Connect
MCP
copy
Create free account
hub
/
github.com/huggingface/smollm
/ types & classes
Types & classes
810 in github.com/huggingface/smollm
⨍
Functions
1,907
◇
Types & classes
810
↳
Endpoints
7
↓ 16 callers
Class
DOMTreeSimplificator
vision/m4/sourcing/data_collection/processors/dom_tree_simplificator.py:13
↓ 14 callers
Class
PreExtractionSimplificator
vision/m4/sourcing/data_collection/processors/pre_extraction_simplificator.py:80
↓ 11 callers
Class
RMSNorm
vision/m4/models/common.py:128
↓ 7 callers
Class
LlamaRMSNorm
vision/m4/models/idefics/modeling_idefics.py:89
↓ 5 callers
Class
DecoupledEmbedding
Implements a decoupling of parameters to allow freezing (or not) a subset of the embeddings. In practise, the regular `weight` can be trained
vision/m4/models/custom_modules.py:145
↓ 5 callers
Class
ImageCaptionPairedDatasetParams
vision/m4/training/config.py:275
↓ 5 callers
Class
ImageDecoder
vision/m4/training/dataset_utils.py:71
↓ 5 callers
Class
TextMediaPairsExtractor
vision/m4/sourcing/data_collection/processors/pair_extractor.py:14
↓ 4 callers
Class
Conversation
A class that keeps all conversation history.
vision/smolvlm2/smolvlm/conversation.py:26
↓ 4 callers
Class
PerceiverResampler
vision/m4/models/perceiver/perceiver.py:522
↓ 3 callers
Class
AssignTags
text/data/smoltalk/magpie_ultra_v1/pipeline.py:400
↓ 3 callers
Class
DecoupledLinear
Implements a decoupling of parameters to allow freezing (or not) a subset of the parameters. In practise, the regular `weight` can be trained
vision/m4/models/custom_modules.py:248
↓ 3 callers
Class
DeviceAgnosticTimer
vision/m4/utils/training/timer.py:48
↓ 3 callers
Class
GPT2Attention
vision/m4/models/vgpt2/modeling_vgpt2.py:123
↓ 3 callers
Class
HtmlExtractor
vision/m4/sourcing/data_collection/processors/html_extractor.py:13
↓ 3 callers
Class
LlamaRMSNorm
vision/m4/models/vllama3/modeling_vllama3.py:170
↓ 3 callers
Class
MLP
vision/m4/models/common.py:100
↓ 3 callers
Class
MofNCompleteColumn
vision/m4/utils/progress.py:27
↓ 3 callers
Class
Node
vision/m4/sourcing/data_collection/processors/pre_extraction_simplificator.py:11
↓ 3 callers
Class
TaskProgressColumn
vision/m4/utils/progress.py:35
↓ 3 callers
Class
TimeElapsedColumn
vision/m4/utils/progress.py:43
↓ 3 callers
Class
Timer
vision/m4/utils/training/timer.py:22
↓ 3 callers
Class
VLlama3PerceiverConfig
r""" This is the configuration class to store the configuration of a [`LlamaModel`]. It is used to instantiate an LLaMA model according to the
vision/m4/models/vllama3/configuration_vllama3.py:99
↓ 3 callers
Class
VLlama3VisionConfig
r""" This is the configuration class to store the configuration of a [`LlamaModel`]. It is used to instantiate an LLaMA model according to the
vision/m4/models/vllama3/configuration_vllama3.py:36
↓ 3 callers
Class
VMistralPerceiverConfig
r""" TThis is the configuration class to store the configuration of a [`MistralModel`]. It is used to instantiate an Mistral model according t
vision/m4/models/vmistral/configuration_vmistral.py:101
↓ 3 callers
Class
VMistralVisionConfig
r""" This is the configuration class to store the configuration of a [`MistralModel`]. It is used to instantiate an Mistral model according to
vision/m4/models/vmistral/configuration_vmistral.py:35
↓ 3 callers
Class
WebDocumentFilteringDocLevel
vision/m4/sourcing/data_collection/processors/web_document_filtering.py:881
↓ 3 callers
Class
WebDocumentFilteringNodeLevel
vision/m4/sourcing/data_collection/processors/web_document_filtering.py:457
↓ 2 callers
Class
ChatMessage
tools/smol_tools/smol_tools/chatter.py:9
↓ 2 callers
Class
CommonCrawlWebDocumentExtractor
vision/m4/sourcing/data_collection/processors/web_document_extractor.py:322
↓ 2 callers
Class
DataCollatorForSupervisedDataset
Collates examples containing text-only or text+image/video data. 1) Text sequences (input_ids, attention_mask, labels) are padded to the max
vision/smolvlm2/smolvlm/datasets/builder.py:234
↓ 2 callers
Class
GPT2MLP
vision/m4/models/vgpt2/modeling_vgpt2.py:344
↓ 2 callers
Class
GlobalBatchSizeRampUpRunningParams
The are running variables that are used to tell when to increment GBS and when to stop doing that, they are never set directly in the config file,
vision/m4/training/config.py:46
↓ 2 callers
Class
IdeficsPerceiverConfig
r""" This is the configuration class to store the configuration of a [`IdeficsModel`]. It is used to instantiate an Idefics model according to
vision/m4/models/idefics/configuration_idefics.py:90
↓ 2 callers
Class
IdeficsVisionConfig
r""" This is the configuration class to store the configuration of a [`IdeficsModel`]. It is used to instantiate an Idefics model according to
vision/m4/models/idefics/configuration_idefics.py:35
↓ 2 callers
Class
ImageDatasetNSFWFiltering
vision/data/datasets_processing_scripts/build_webdocs_dataset/python_scripts/07_01_nsfw_image_filtering.py:87
↓ 2 callers
Class
ImageDatasetURLFiltering
vision/data/datasets_processing_scripts/build_webdocs_dataset/python_scripts/07_01_nsfw_image_filtering.py:72
↓ 2 callers
Class
JudgeLLMMixEval
text/evaluation/smollm3/tasks.py:513
↓ 2 callers
Class
LaionPairFiltering
vision/m4/sourcing/data_collection/processors/laion_pair_filtering.py:6
↓ 2 callers
Class
LlamaAttention
Multi-headed attention from 'Attention Is All You Need' paper
vision/m4/models/idefics/modeling_idefics.py:175
↓ 2 callers
Class
LlamaMLP
vision/m4/models/idefics/modeling_idefics.py:158
↓ 2 callers
Class
LlamaRotaryEmbedding
vision/m4/models/vllama3/modeling_vllama3.py:190
↓ 2 callers
Class
LoggingTypes
Types of logging to use for the gradient and parameter statistics
vision/m4/training/utils.py:42
↓ 2 callers
Class
Trainer
Trainer object to monitor training and validation :- config -: json config file
vision/m4/training/trainer.py:108
↓ 2 callers
Class
VQANormalizationGtVisionLab
vision/m4/evaluation/custom_metrics/utils.py:182
↓ 2 callers
Class
WarcDownloader
vision/m4/sourcing/data_collection/processors/warc_downloader.py:6
↓ 2 callers
Class
WebDocumentsDatasetParams
vision/m4/training/config.py:295
↓ 1 callers
Class
ActivationTracker
This debug class helps detect and understand where the model starts getting very large or very small, and more importantly `nan` or `inf` act
vision/m4/utils/activation_tracker.py:33
↓ 1 callers
Class
BarColumn
vision/m4/utils/progress.py:23
↓ 1 callers
Class
BinaryClassifierFiltering
vision/data/datasets_processing_scripts/build_laion_coco_dataset/python_scripts/05_binary_classification.py:82
↓ 1 callers
Class
Bitmap
Apply a bitmap-style transformation to an image. This transformation replaces all pixel values below a certain threshold with a specified va
vision/m4/training/utils.py:164
↓ 1 callers
Class
COCOLoaderBuilder
vision/m4/sourcing/pmd/loader_builder.py:254
↓ 1 callers
Class
Conceptual12MLoaderBuilder
vision/m4/sourcing/pmd/loader_builder.py:380
↓ 1 callers
Class
ConditionalResize
vision/m4/training/utils.py:250
↓ 1 callers
Class
CustomChainDataset
r"""Dataset for chaining multiple :class:`IterableDataset` s. This class is useful to assemble different existing dataset streams. The chaini
vision/m4/training/dataset.py:1125
↓ 1 callers
Class
DOCVQADatasetParams
vision/m4/training/config.py:285
↓ 1 callers
Class
DataLoaderForIterableWrapperDataset
vision/m4/training/dataset.py:1313
↓ 1 callers
Class
DataLoaderForMappedWrapperDataset
vision/m4/training/dataset.py:1289
↓ 1 callers
Class
DataParams
Data Parameters
vision/m4/training/config.py:305
↓ 1 callers
Class
DatasetBuilderConfig
vision/m4/sourcing/pmd/scripts/pmd.py:52
↓ 1 callers
Class
Dilation
Apply dilation operation to an image. Dilation is a morphological operation that expands the white regions in a binary image. Args:
vision/m4/training/utils.py:130
↓ 1 callers
Class
EmailSummarization
text/data/smoltalk/summarization/pipelines/email_summaries.py:51
↓ 1 callers
Class
Erosion
Apply erosion operation to an image. Erosion is a morphological operation that shrinks the white regions in a binary image. Args:
vision/m4/training/utils.py:96
↓ 1 callers
Class
GPT2Block
vision/m4/models/vgpt2/modeling_vgpt2.py:361
↓ 1 callers
Class
GenerationHTMLCodes
vision/data/datasets_processing_scripts/build_websight_v02/python_scripts/02_01_generate_html_codes_prompt_1.py:47
↓ 1 callers
Class
GenerationHTMLCodes
vision/data/datasets_processing_scripts/build_websight_v02/python_scripts/02_02_generate_html_codes_prompt_2.py:44
↓ 1 callers
Class
GlobalBatchSizeRampUp
These are init variables that are used to set up the GBS ramp up protocol
vision/m4/training/config.py:31
↓ 1 callers
Class
HTMLFiltering
vision/data/datasets_processing_scripts/build_websight_v02/python_scripts/03_filtering_html_codes.py:56
↓ 1 callers
Class
HTMLWordCounter
vision/data/datasets_processing_scripts/build_websight_v02/python_scripts/03_filtering_html_codes.py:17
↓ 1 callers
Class
Hparams
General Hyperparameters
vision/m4/training/config.py:58
↓ 1 callers
Class
Hparams
General Hyperparameters
vision/m4/evaluation/config.py:27
↓ 1 callers
Class
Hparams
General Hyperparameters
vision/m4/evaluation/generation/config.py:15
↓ 1 callers
Class
IFEvalInstructionIdListAssignator
text/data/smoltalk/constraints/pipeline/ifeval_tasks.py:14
↓ 1 callers
Class
IFEvalKwargsAssignator
text/data/smoltalk/constraints/pipeline/ifeval_tasks.py:43
↓ 1 callers
Class
IdeficsConfig
r""" This is the configuration class to store the configuration of a [`IdeficsModel`]. It is used to instantiate an Idefics model according to
vision/m4/models/idefics/configuration_idefics.py:134
↓ 1 callers
Class
IdeficsGatedCrossAttentionLayer
vision/m4/models/idefics/modeling_idefics.py:401
↓ 1 callers
Class
IdeficsModel
Transformer decoder consisting of *config.num_hidden_layers* layers. Each layer is a [`LlamaDecoderLayer`] Args: config: IdeficsConf
vision/m4/models/idefics/modeling_idefics.py:677
↓ 1 callers
Class
ImageDeduplicator
vision/m4/sourcing/data_collection/processors/image_deduplicator.py:7
↓ 1 callers
Class
ImageURLDeduplication
vision/data/datasets_processing_scripts/build_webdocs_dataset/python_scripts/06_03_remove_image_duplicates.py:59
↓ 1 callers
Class
InContextParams
In context learning parameters
vision/m4/evaluation/config.py:56
↓ 1 callers
Class
LAIONCOCOFiltering
vision/data/datasets_processing_scripts/build_laion_coco_dataset/python_scripts/make_laion_coco_1_4_dataset.py:41
↓ 1 callers
Class
LAIONCOCOFiltering
vision/data/datasets_processing_scripts/build_laion_coco_dataset/python_scripts/make_laion_coco.py:40
↓ 1 callers
Class
LAIONCOCOReplacement
vision/data/datasets_processing_scripts/build_laion_coco_dataset/python_scripts/make_laion_coco_1_4_dataset.py:57
↓ 1 callers
Class
LAIONCOCOReplacement
vision/data/datasets_processing_scripts/build_laion_coco_dataset/python_scripts/make_laion_coco.py:56
↓ 1 callers
Class
LAIONDeduplication
vision/data/datasets_processing_scripts/build_laion_dataset/python_scripts/03_02_dedup_laion.py:42
↓ 1 callers
Class
LineDeduplication
vision/data/datasets_processing_scripts/build_webdocs_dataset/python_scripts/09_06_line_dedup.py:41
↓ 1 callers
Class
LlamaDecoderLayer
vision/m4/models/idefics/modeling_idefics.py:325
↓ 1 callers
Class
LlamaDecoderLayer
vision/m4/models/vllama3/modeling_vllama3.py:808
↓ 1 callers
Class
LlamaMLP
vision/m4/models/vllama3/modeling_vllama3.py:336
↓ 1 callers
Class
LlamaRotaryEmbedding
vision/m4/models/idefics/modeling_idefics.py:109
↓ 1 callers
Class
LocalizedNarrativesADE20kLoaderBuilder
vision/m4/sourcing/pmd/loader_builder.py:323
↓ 1 callers
Class
LocalizedNarrativesCOCOLoaderBuilder
vision/m4/sourcing/pmd/loader_builder.py:288
↓ 1 callers
Class
LocalizedNarrativesFlickr30kLoaderBuilder
vision/m4/sourcing/pmd/loader_builder.py:305
↓ 1 callers
Class
LocalizedNarrativesOpenImagesLoaderBuilder
vision/m4/sourcing/pmd/loader_builder.py:277
↓ 1 callers
Class
M4HTTPClient
vision/m4/sourcing/pmd/helpers.py:112
↓ 1 callers
Class
MapWrapperDataset
vision/m4/training/dataset.py:575
↓ 1 callers
Class
MergeOnSameImage
vision/data/datasets_processing_scripts/build_concatenation_datasets_sft/merge_on_image_individual_dataset.py:69
↓ 1 callers
Class
MistralAttention
Multi-headed attention from 'Attention Is All You Need' paper. Modified to use sliding window attention: Longformer and "Generating Long Sequ
vision/m4/models/vmistral/modeling_vmistral.py:337
↓ 1 callers
Class
MistralDecoderLayer
vision/m4/models/vmistral/modeling_vmistral.py:737
↓ 1 callers
Class
MistralFlashAttention2
Mistral flash attention module. This module inherits from `MistralAttention` as the weights of the module stays untouched. The only required
vision/m4/models/vmistral/modeling_vmistral.py:466
next →
1–100 of 810, ranked by callers