Code
Hub
Workspaces
Following
Trending
Connect
MCP
copy
Create free account
hub
/
github.com/OpenSparseLLMs/MoM
/ types & classes
Types & classes
129 in github.com/OpenSparseLLMs/MoM
⨍
Functions
861
◇
Types & classes
129
↳
Endpoints
19
↓ 19 callers
Class
Instance
lm-eval-harness/lm_eval/api/instance.py:6
↓ 4 callers
Class
Collator
A class for reordering and batching elements of an array. This class allows for sorting an array based on a provided sorting function, group
lm-eval-harness/lm_eval/models/utils.py:355
↓ 3 callers
Class
TaskConfig
lm-eval-harness/lm_eval/api/task.py:45
↓ 3 callers
Class
TaskManager
TaskManager indexes all tasks from the default `lm_eval/tasks/` and an optional directory if provided.
lm-eval-harness/lm_eval/tasks/__init__.py:14
↓ 2 callers
Class
CacheHook
lm-eval-harness/lm_eval/api/model.py:160
↓ 1 callers
Class
ConfigurableTask
lm-eval-harness/lm_eval/api/task.py:671
↓ 1 callers
Class
DataCollatorForLanguageModeling
Data collator used for language modeling. Args: tokenizer ([`PreTrainedTokenizer`] or [`PreTrainedTokenizerFast`]): The
training/flame/data.py:158
↓ 1 callers
Class
FilterEnsemble
FilterEnsemble creates a pipeline applying multiple filters. Its intended usage is to stack multiple post-processing steps in order. `tas
lm-eval-harness/lm_eval/api/filter.py:34
↓ 1 callers
Class
Janitor
lm-eval-harness/lm_eval/decontamination/janitor.py:108
↓ 1 callers
Class
LogCallback
training/flame/logging.py:34
↓ 1 callers
Class
MomAttention
The layer implementaion for [MoM: Linear Sequence Modeling with Mixture-of-Memories](https://arxiv.org/abs/2502.13685).
mom/layers/mom.py:280
↓ 1 callers
Class
MomBlock
mom/models/mom/modeling_mom.py:115
↓ 1 callers
Class
MomCausalLMOutputWithPast
mom/models/mom/modeling_mom.py:354
↓ 1 callers
Class
MomGLABlock
mom_naive/models/mom_gla/modeling_mom_gla.py:63
↓ 1 callers
Class
MomGLACausalLMOutputWithPast
mom_naive/models/mom_gla/modeling_mom_gla.py:287
↓ 1 callers
Class
MomGLAMLP
mom_naive/models/mom_gla/modeling_mom_gla.py:31
↓ 1 callers
Class
MomGLAModel
mom_naive/models/mom_gla/modeling_mom_gla.py:183
↓ 1 callers
Class
MomGLAOutputWithPast
mom_naive/models/mom_gla/modeling_mom_gla.py:180
↓ 1 callers
Class
MomGSABlock
mom_naive/models/mom_gsa/modeling_mom_gsa.py:73
↓ 1 callers
Class
MomGSACausalLMOutputWithPast
mom_naive/models/mom_gsa/modeling_mom_gsa.py:308
↓ 1 callers
Class
MomGSAMLP
mom_naive/models/mom_gsa/modeling_mom_gsa.py:32
↓ 1 callers
Class
MomGSAModel
mom_naive/models/mom_gsa/modeling_mom_gsa.py:204
↓ 1 callers
Class
MomGSAOutputWithPast
mom_naive/models/mom_gsa/modeling_mom_gsa.py:201
↓ 1 callers
Class
MomGatedDeltaNet
The layer implementaion for [Gated Delta Networks: Improving Mamba2 with Delta Rule](https://arxiv.org/abs/2412.06464). # noqa Similar to M
mom_naive/layers/mom_gated_deltanet.py:192
↓ 1 callers
Class
MomGatedDeltaNetBlock
mom_naive/models/mom_gated_deltanet/modeling_mom_gated_deltanet.py:82
↓ 1 callers
Class
MomGatedDeltaNetCausalLMOutputWithPast
mom_naive/models/mom_gated_deltanet/modeling_mom_gated_deltanet.py:316
↓ 1 callers
Class
MomGatedDeltaNetMLP
mom_naive/models/mom_gated_deltanet/modeling_mom_gated_deltanet.py:37
↓ 1 callers
Class
MomGatedDeltaNetModel
mom_naive/models/mom_gated_deltanet/modeling_mom_gated_deltanet.py:209
↓ 1 callers
Class
MomGatedDeltaNetOutputWithPast
mom_naive/models/mom_gated_deltanet/modeling_mom_gated_deltanet.py:206
↓ 1 callers
Class
MomGatedLinearAttention
r""" The layer implementaion for [Gated Linear Attention Transformers with Hardware-Efficient Training](https://arxiv.org/abs/2312.06635). # noqa
mom_naive/layers/mom_gla.py:179
↓ 1 callers
Class
MomGatedSlotAttention
mom_naive/layers/mom_gsa.py:185
↓ 1 callers
Class
MomLACausalLMOutputWithPast
mom_naive/models/mom_linear_attn/modeling_mom_linear_attn.py:300
↓ 1 callers
Class
MomLAOutputWithPast
mom_naive/models/mom_linear_attn/modeling_mom_linear_attn.py:187
↓ 1 callers
Class
MomLinearAttention
mom_naive/layers/mom_linear_attn.py:175
↓ 1 callers
Class
MomLinearAttentionBlock
mom_naive/models/mom_linear_attn/modeling_mom_linear_attn.py:64
↓ 1 callers
Class
MomLinearAttentionMLP
mom_naive/models/mom_linear_attn/modeling_mom_linear_attn.py:32
↓ 1 callers
Class
MomLinearAttentionModel
mom_naive/models/mom_linear_attn/modeling_mom_linear_attn.py:190
↓ 1 callers
Class
MomModel
mom/models/mom/modeling_mom.py:243
↓ 1 callers
Class
MomOutputWithPast
mom/models/mom/modeling_mom.py:239
↓ 1 callers
Class
MultiTokenEOSCriteria
Criteria to stop on the specified multi-token sequence.
lm-eval-harness/lm_eval/models/utils.py:206
↓ 1 callers
Class
PerplexityEvaluator
evals/ppl.py:16
↓ 1 callers
Class
PromptString
lm-eval-harness/lm_eval/prompts/__init__.py:110
↓ 1 callers
Class
TextReader
lm-eval-harness/lm_eval/decontamination/archiver.py:104
↓ 1 callers
Class
ZStdTextReader
lm-eval-harness/lm_eval/decontamination/archiver.py:161
↓ 1 callers
Class
_bootstrap_internal
lm-eval-harness/lm_eval/api/metrics.py:368
Class
AnthropicLM
lm-eval-harness/lm_eval/models/anthropic_llms.py:78
Class
Archive
lm-eval-harness/lm_eval/decontamination/archiver.py:23
Class
BalancedSampler
lm-eval-harness/lm_eval/api/samplers.py:86
Class
BasedDrop
lm-eval-harness/lm_eval/tasks/based_drop/task.py:8
Class
BasedDropTwice
lm-eval-harness/lm_eval/tasks/based_drop/task.py:119
Class
BasedLMWrapper
lm-eval-harness/lm_eval/models/based_lm.py:18
Class
BasedNQ1024
lm-eval-harness/lm_eval/tasks/based_nq/task.py:134
Class
BasedNQ2048
lm-eval-harness/lm_eval/tasks/based_nq/task.py:139
Class
BasedNQ512
lm-eval-harness/lm_eval/tasks/based_nq/task.py:8
Class
BasedNQTwice1024
lm-eval-harness/lm_eval/tasks/based_nq/task.py:144
Class
BasedNQTwice2048
lm-eval-harness/lm_eval/tasks/based_nq/task.py:149
Class
BasedNQTwice512
lm-eval-harness/lm_eval/tasks/based_nq/task.py:119
Class
BasedSQUADCompletion
lm-eval-harness/lm_eval/tasks/based_squadv2/task.py:20
Class
BasedSQUADCompletionTwice
lm-eval-harness/lm_eval/tasks/based_squadv2/task.py:155
Class
BasedTriviaQA
lm-eval-harness/lm_eval/tasks/based_triviaqa/task.py:21
Class
BasedTriviaQATwice
lm-eval-harness/lm_eval/tasks/based_triviaqa/task.py:172
Class
CachingLM
lm-eval-harness/lm_eval/api/model.py:175
Class
ContextSampler
lm-eval-harness/lm_eval/api/samplers.py:1
Class
ContractNLI
ContractNLI: A Dataset for Document-level Natural Language Inference for Contracts https://arxiv.org/abs/1712.07040
lm-eval-harness/lm_eval/tasks/scrolls/task.py:403
Class
CustomNeuronModelForCausalLM
NeuronModelForCausalLM with `stopping_criteria` in `generate`
lm-eval-harness/lm_eval/models/neuron_optimum.py:84
Class
DecontaminationFilter
A filter which evaluates
lm-eval-harness/lm_eval/filters/decontamination.py:4
Class
DummyLM
lm-eval-harness/lm_eval/models/dummy.py:8
Class
FDA
lm-eval-harness/lm_eval/tasks/based_fda/task.py:8
Class
FDATwice
lm-eval-harness/lm_eval/tasks/based_fda/task.py:108
Class
Filter
Filter classes operate on a per-task level. They take all model outputs (`instance.resps` for all `task.instances`) across all instances
lm-eval-harness/lm_eval/api/filter.py:8
Class
FirstNSampler
lm-eval-harness/lm_eval/api/samplers.py:74
Class
FlashLinearAttentionLMWrapper
evals/harness.py:15
Class
GGUFLM
lm-eval-harness/lm_eval/models/gguf.py:37
Class
GovReport
Efficient Attentions for Long Document Summarization https://arxiv.org/abs/2104.02112 Note: The average length of the reference summaries is
lm-eval-harness/lm_eval/tasks/scrolls/task.py:421
Class
Grouper
takes an array `arr` and function `fn` and returns a dictionary with keys fn(ob) for each ob in `arr` and with values `self.arr[key]` a list
lm-eval-harness/lm_eval/models/utils.py:82
Class
HFLM
An abstracted Huggingface model class. Enables usage with both models of `transformers.AutoModelForCausalLM` and `transformers.AutoModelForSe
lm-eval-harness/lm_eval/models/huggingface.py:70
Class
HuggingfaceDataset
training/flame/data.py:18
Class
JRTLMWrapper
lm-eval-harness/lm_eval/models/jrt_lm.py:17
Class
LM
lm-eval-harness/lm_eval/api/model.py:19
Class
LMWrapper
lm-eval-harness/lm_eval/models/local_lm.py:7
Class
LowercaseFilter
lm-eval-harness/lm_eval/filters/transformation.py:4
Class
MajorityVoteFilter
lm-eval-harness/lm_eval/filters/selection.py:35
Class
MambaLMWrapper
lm-eval-harness/lm_eval/models/mamba_lm.py:11
Class
ManualSampler
lm-eval-harness/lm_eval/api/samplers.py:96
Class
MapFilter
lm-eval-harness/lm_eval/filters/transformation.py:26
Class
MomConfig
mom/models/mom/configuration_mom.py:8
Class
MomForCausalLM
mom/models/mom/modeling_mom.py:359
Class
MomGLAConfig
mom_naive/models/mom_gla/configuration_mom_gla.py:8
Class
MomGLAForCausalLM
mom_naive/models/mom_gla/modeling_mom_gla.py:291
Class
MomGLAPreTrainedModel
mom_naive/models/mom_gla/modeling_mom_gla.py:137
Class
MomGSAConfig
mom_naive/models/mom_gsa/configuration_mom_gsa.py:8
Class
MomGSAForCausalLM
mom_naive/models/mom_gsa/modeling_mom_gsa.py:312
Class
MomGSAPreTrainedModel
mom_naive/models/mom_gsa/modeling_mom_gsa.py:158
Class
MomGatedDeltaNetConfig
mom_naive/models/mom_gated_deltanet/configuration_mom_gated_deltanet.py:8
Class
MomGatedDeltaNetForCausalLM
mom_naive/models/mom_gated_deltanet/modeling_mom_gated_deltanet.py:320
Class
MomGatedDeltaNetPreTrainedModel
mom_naive/models/mom_gated_deltanet/modeling_mom_gated_deltanet.py:161
Class
MomLinearAttentionConfig
mom_naive/models/mom_linear_attn/configuration_mom_linear_attn.py:8
Class
MomLinearAttentionForCausalLM
mom_naive/models/mom_linear_attn/modeling_mom_linear_attn.py:304
Class
MomLinearAttentionPreTrainedModel
mom_naive/models/mom_linear_attn/modeling_mom_linear_attn.py:144
Class
MomPreTrainedModel
mom/models/mom/modeling_mom.py:193
next →
1–100 of 129, ranked by callers