MCPcopy Create free account

hub / github.com/OpenSparseLLMs/MoM / types & classes

Types & classes129 in github.com/OpenSparseLLMs/MoM

↓ 19 callersClassInstance
lm-eval-harness/lm_eval/api/instance.py:6
↓ 4 callersClassCollator
A class for reordering and batching elements of an array. This class allows for sorting an array based on a provided sorting function, group
lm-eval-harness/lm_eval/models/utils.py:355
↓ 3 callersClassTaskConfig
lm-eval-harness/lm_eval/api/task.py:45
↓ 3 callersClassTaskManager
TaskManager indexes all tasks from the default `lm_eval/tasks/` and an optional directory if provided.
lm-eval-harness/lm_eval/tasks/__init__.py:14
↓ 2 callersClassCacheHook
lm-eval-harness/lm_eval/api/model.py:160
↓ 1 callersClassConfigurableTask
lm-eval-harness/lm_eval/api/task.py:671
↓ 1 callersClassDataCollatorForLanguageModeling
Data collator used for language modeling. Args: tokenizer ([`PreTrainedTokenizer`] or [`PreTrainedTokenizerFast`]): The
training/flame/data.py:158
↓ 1 callersClassFilterEnsemble
FilterEnsemble creates a pipeline applying multiple filters. Its intended usage is to stack multiple post-processing steps in order. `tas
lm-eval-harness/lm_eval/api/filter.py:34
↓ 1 callersClassJanitor
lm-eval-harness/lm_eval/decontamination/janitor.py:108
↓ 1 callersClassLogCallback
training/flame/logging.py:34
↓ 1 callersClassMomAttention
The layer implementaion for [MoM: Linear Sequence Modeling with Mixture-of-Memories](https://arxiv.org/abs/2502.13685).
mom/layers/mom.py:280
↓ 1 callersClassMomBlock
mom/models/mom/modeling_mom.py:115
↓ 1 callersClassMomCausalLMOutputWithPast
mom/models/mom/modeling_mom.py:354
↓ 1 callersClassMomGLABlock
mom_naive/models/mom_gla/modeling_mom_gla.py:63
↓ 1 callersClassMomGLACausalLMOutputWithPast
mom_naive/models/mom_gla/modeling_mom_gla.py:287
↓ 1 callersClassMomGLAMLP
mom_naive/models/mom_gla/modeling_mom_gla.py:31
↓ 1 callersClassMomGLAModel
mom_naive/models/mom_gla/modeling_mom_gla.py:183
↓ 1 callersClassMomGLAOutputWithPast
mom_naive/models/mom_gla/modeling_mom_gla.py:180
↓ 1 callersClassMomGSABlock
mom_naive/models/mom_gsa/modeling_mom_gsa.py:73
↓ 1 callersClassMomGSACausalLMOutputWithPast
mom_naive/models/mom_gsa/modeling_mom_gsa.py:308
↓ 1 callersClassMomGSAMLP
mom_naive/models/mom_gsa/modeling_mom_gsa.py:32
↓ 1 callersClassMomGSAModel
mom_naive/models/mom_gsa/modeling_mom_gsa.py:204
↓ 1 callersClassMomGSAOutputWithPast
mom_naive/models/mom_gsa/modeling_mom_gsa.py:201
↓ 1 callersClassMomGatedDeltaNet
The layer implementaion for [Gated Delta Networks: Improving Mamba2 with Delta Rule](https://arxiv.org/abs/2412.06464). # noqa Similar to M
mom_naive/layers/mom_gated_deltanet.py:192
↓ 1 callersClassMomGatedDeltaNetBlock
mom_naive/models/mom_gated_deltanet/modeling_mom_gated_deltanet.py:82
↓ 1 callersClassMomGatedDeltaNetCausalLMOutputWithPast
mom_naive/models/mom_gated_deltanet/modeling_mom_gated_deltanet.py:316
↓ 1 callersClassMomGatedDeltaNetMLP
mom_naive/models/mom_gated_deltanet/modeling_mom_gated_deltanet.py:37
↓ 1 callersClassMomGatedDeltaNetModel
mom_naive/models/mom_gated_deltanet/modeling_mom_gated_deltanet.py:209
↓ 1 callersClassMomGatedDeltaNetOutputWithPast
mom_naive/models/mom_gated_deltanet/modeling_mom_gated_deltanet.py:206
↓ 1 callersClassMomGatedLinearAttention
r""" The layer implementaion for [Gated Linear Attention Transformers with Hardware-Efficient Training](https://arxiv.org/abs/2312.06635). # noqa
mom_naive/layers/mom_gla.py:179
↓ 1 callersClassMomGatedSlotAttention
mom_naive/layers/mom_gsa.py:185
↓ 1 callersClassMomLACausalLMOutputWithPast
mom_naive/models/mom_linear_attn/modeling_mom_linear_attn.py:300
↓ 1 callersClassMomLAOutputWithPast
mom_naive/models/mom_linear_attn/modeling_mom_linear_attn.py:187
↓ 1 callersClassMomLinearAttention
mom_naive/layers/mom_linear_attn.py:175
↓ 1 callersClassMomLinearAttentionBlock
mom_naive/models/mom_linear_attn/modeling_mom_linear_attn.py:64
↓ 1 callersClassMomLinearAttentionMLP
mom_naive/models/mom_linear_attn/modeling_mom_linear_attn.py:32
↓ 1 callersClassMomLinearAttentionModel
mom_naive/models/mom_linear_attn/modeling_mom_linear_attn.py:190
↓ 1 callersClassMomModel
mom/models/mom/modeling_mom.py:243
↓ 1 callersClassMomOutputWithPast
mom/models/mom/modeling_mom.py:239
↓ 1 callersClassMultiTokenEOSCriteria
Criteria to stop on the specified multi-token sequence.
lm-eval-harness/lm_eval/models/utils.py:206
↓ 1 callersClassPerplexityEvaluator
evals/ppl.py:16
↓ 1 callersClassPromptString
lm-eval-harness/lm_eval/prompts/__init__.py:110
↓ 1 callersClassTextReader
lm-eval-harness/lm_eval/decontamination/archiver.py:104
↓ 1 callersClassZStdTextReader
lm-eval-harness/lm_eval/decontamination/archiver.py:161
↓ 1 callersClass_bootstrap_internal
lm-eval-harness/lm_eval/api/metrics.py:368
ClassAnthropicLM
lm-eval-harness/lm_eval/models/anthropic_llms.py:78
ClassArchive
lm-eval-harness/lm_eval/decontamination/archiver.py:23
ClassBalancedSampler
lm-eval-harness/lm_eval/api/samplers.py:86
ClassBasedDrop
lm-eval-harness/lm_eval/tasks/based_drop/task.py:8
ClassBasedDropTwice
lm-eval-harness/lm_eval/tasks/based_drop/task.py:119
ClassBasedLMWrapper
lm-eval-harness/lm_eval/models/based_lm.py:18
ClassBasedNQ1024
lm-eval-harness/lm_eval/tasks/based_nq/task.py:134
ClassBasedNQ2048
lm-eval-harness/lm_eval/tasks/based_nq/task.py:139
ClassBasedNQ512
lm-eval-harness/lm_eval/tasks/based_nq/task.py:8
ClassBasedNQTwice1024
lm-eval-harness/lm_eval/tasks/based_nq/task.py:144
ClassBasedNQTwice2048
lm-eval-harness/lm_eval/tasks/based_nq/task.py:149
ClassBasedNQTwice512
lm-eval-harness/lm_eval/tasks/based_nq/task.py:119
ClassBasedSQUADCompletion
lm-eval-harness/lm_eval/tasks/based_squadv2/task.py:20
ClassBasedSQUADCompletionTwice
lm-eval-harness/lm_eval/tasks/based_squadv2/task.py:155
ClassBasedTriviaQA
lm-eval-harness/lm_eval/tasks/based_triviaqa/task.py:21
ClassBasedTriviaQATwice
lm-eval-harness/lm_eval/tasks/based_triviaqa/task.py:172
ClassCachingLM
lm-eval-harness/lm_eval/api/model.py:175
ClassContextSampler
lm-eval-harness/lm_eval/api/samplers.py:1
ClassContractNLI
ContractNLI: A Dataset for Document-level Natural Language Inference for Contracts https://arxiv.org/abs/1712.07040
lm-eval-harness/lm_eval/tasks/scrolls/task.py:403
ClassCustomNeuronModelForCausalLM
NeuronModelForCausalLM with `stopping_criteria` in `generate`
lm-eval-harness/lm_eval/models/neuron_optimum.py:84
ClassDecontaminationFilter
A filter which evaluates
lm-eval-harness/lm_eval/filters/decontamination.py:4
ClassDummyLM
lm-eval-harness/lm_eval/models/dummy.py:8
ClassFDA
lm-eval-harness/lm_eval/tasks/based_fda/task.py:8
ClassFDATwice
lm-eval-harness/lm_eval/tasks/based_fda/task.py:108
ClassFilter
Filter classes operate on a per-task level. They take all model outputs (`instance.resps` for all `task.instances`) across all instances
lm-eval-harness/lm_eval/api/filter.py:8
ClassFirstNSampler
lm-eval-harness/lm_eval/api/samplers.py:74
ClassFlashLinearAttentionLMWrapper
evals/harness.py:15
ClassGGUFLM
lm-eval-harness/lm_eval/models/gguf.py:37
ClassGovReport
Efficient Attentions for Long Document Summarization https://arxiv.org/abs/2104.02112 Note: The average length of the reference summaries is
lm-eval-harness/lm_eval/tasks/scrolls/task.py:421
ClassGrouper
takes an array `arr` and function `fn` and returns a dictionary with keys fn(ob) for each ob in `arr` and with values `self.arr[key]` a list
lm-eval-harness/lm_eval/models/utils.py:82
ClassHFLM
An abstracted Huggingface model class. Enables usage with both models of `transformers.AutoModelForCausalLM` and `transformers.AutoModelForSe
lm-eval-harness/lm_eval/models/huggingface.py:70
ClassHuggingfaceDataset
training/flame/data.py:18
ClassJRTLMWrapper
lm-eval-harness/lm_eval/models/jrt_lm.py:17
ClassLM
lm-eval-harness/lm_eval/api/model.py:19
ClassLMWrapper
lm-eval-harness/lm_eval/models/local_lm.py:7
ClassLowercaseFilter
lm-eval-harness/lm_eval/filters/transformation.py:4
ClassMajorityVoteFilter
lm-eval-harness/lm_eval/filters/selection.py:35
ClassMambaLMWrapper
lm-eval-harness/lm_eval/models/mamba_lm.py:11
ClassManualSampler
lm-eval-harness/lm_eval/api/samplers.py:96
ClassMapFilter
lm-eval-harness/lm_eval/filters/transformation.py:26
ClassMomConfig
mom/models/mom/configuration_mom.py:8
ClassMomForCausalLM
mom/models/mom/modeling_mom.py:359
ClassMomGLAConfig
mom_naive/models/mom_gla/configuration_mom_gla.py:8
ClassMomGLAForCausalLM
mom_naive/models/mom_gla/modeling_mom_gla.py:291
ClassMomGLAPreTrainedModel
mom_naive/models/mom_gla/modeling_mom_gla.py:137
ClassMomGSAConfig
mom_naive/models/mom_gsa/configuration_mom_gsa.py:8
ClassMomGSAForCausalLM
mom_naive/models/mom_gsa/modeling_mom_gsa.py:312
ClassMomGSAPreTrainedModel
mom_naive/models/mom_gsa/modeling_mom_gsa.py:158
ClassMomGatedDeltaNetConfig
mom_naive/models/mom_gated_deltanet/configuration_mom_gated_deltanet.py:8
ClassMomGatedDeltaNetForCausalLM
mom_naive/models/mom_gated_deltanet/modeling_mom_gated_deltanet.py:320
ClassMomGatedDeltaNetPreTrainedModel
mom_naive/models/mom_gated_deltanet/modeling_mom_gated_deltanet.py:161
ClassMomLinearAttentionConfig
mom_naive/models/mom_linear_attn/configuration_mom_linear_attn.py:8
ClassMomLinearAttentionForCausalLM
mom_naive/models/mom_linear_attn/modeling_mom_linear_attn.py:304
ClassMomLinearAttentionPreTrainedModel
mom_naive/models/mom_linear_attn/modeling_mom_linear_attn.py:144
ClassMomPreTrainedModel
mom/models/mom/modeling_mom.py:193
next →1–100 of 129, ranked by callers