MCPcopy Create free account

hub / github.com/OpenSparseLLMs/MoM / functions

Functions861 in github.com/OpenSparseLLMs/MoM

↓ 1 callersFunctionget_nc_count
Returns the number of neuron cores on the current instance.
lm-eval-harness/lm_eval/models/neuron_optimum.py:36
↓ 1 callersFunctionget_prompt
(prompt_id: str, dataset_name: str = None, subset_name: str = None)
lm-eval-harness/lm_eval/prompts/__init__.py:20
↓ 1 callersFunctionget_result
(logprobs, context_length)
lm-eval-harness/lm_eval/models/gguf.py:15
↓ 1 callersFunctionget_result
Process results from OpenAI API response. :param response: dict OpenAI API Response :param ctxlen: int Length of context (so
lm-eval-harness/lm_eval/models/openai_completions.py:17
↓ 1 callersFunctionget_rolling_token_windows
- context_len allows for a rolling window context, allowing each prediction window to potentially condition on some context :param tok
lm-eval-harness/lm_eval/utils.py:122
↓ 1 callersFunctionget_task_dict
Creates a dictionary of task objects from either a name of task, config, or prepared Task object. :param task_name_list: List[Union[str, Dict, Ta
lm-eval-harness/lm_eval/tasks/__init__.py:385
↓ 1 callersFunctionget_task_name_from_object
(task_object)
lm-eval-harness/lm_eval/tasks/__init__.py:373
↓ 1 callersFunctionget_train_args
()
training/flame/parser.py:79
↓ 1 callersFunctiongroup
(arr, fn)
lm-eval-harness/lm_eval/utils.py:90
↓ 1 callersMethodgroup_by_index
(self)
lm-eval-harness/lm_eval/models/utils.py:378
↓ 1 callersFunctionhandle_arg_string
(arg)
lm-eval-harness/lm_eval/utils.py:56
↓ 1 callersMethodhas_training_docs
(self)
lm-eval-harness/lm_eval/api/task.py:885
↓ 1 callersFunctionhash_args
(*args, **kwargs)
lm-eval-harness/lm_eval/models/local_utils/jrt_utils.py:129
↓ 1 callersFunctionimport_object
Import an object from a string. Parameters: - name (str): The name of the object to import. Returns: - object: The imported
lm-eval-harness/lm_eval/models/local_utils/jrt_utils.py:97
↓ 1 callersFunctioninclude_path
(task_dir)
lm-eval-harness/lm_eval/tasks/__init__.py:346
↓ 1 callersFunctioninitialize_tasks
(verbosity="INFO")
lm-eval-harness/lm_eval/tasks/__init__.py:355
↓ 1 callersMethodinitialize_tasks
Creates an dictionary of tasks index. :param include_path: str = None An additional path to be searched for tasks :retur
lm-eval-harness/lm_eval/tasks/__init__.py:37
↓ 1 callersFunctionload_balancing_loss_func
r""" Computes auxiliary load balancing loss as in Switch Transformer - implemented in Pytorch. See Switch Transformer (https://huggingface.co
mom/models/mom/modeling_mom.py:25
↓ 1 callersFunctionload_balancing_loss_func
r""" Computes auxiliary load balancing loss as in Switch Transformer - implemented in Pytorch. See Switch Transformer (https://arxiv.org/abs/
mom_naive/models/mom_linear_attn/modeling_mom_linear_attn.py:470
↓ 1 callersFunctionload_balancing_loss_func
r""" Computes auxiliary load balancing loss as in Switch Transformer - implemented in Pytorch. See Switch Transformer (https://arxiv.org/abs/
mom_naive/models/mom_gated_deltanet/modeling_mom_gated_deltanet.py:489
↓ 1 callersFunctionload_balancing_loss_func
r""" Computes auxiliary load balancing loss as in Switch Transformer - implemented in Pytorch. See Switch Transformer (https://arxiv.org/abs/
mom_naive/models/mom_gsa/modeling_mom_gsa.py:502
↓ 1 callersFunctionload_balancing_loss_func
r""" Computes auxiliary load balancing loss as in Switch Transformer - implemented in Pytorch. See Switch Transformer (https://arxiv.org/abs/
mom_naive/models/mom_gla/modeling_mom_gla.py:457
↓ 1 callersFunctionload_config
Load a config from a wandb run ID. Parameters: run_id (str): A full wandb run id like "hazy-research/attention/159o6asi"
lm-eval-harness/lm_eval/models/local_utils/jrt_utils.py:254
↓ 1 callersMethodload_config
(self, config: Dict)
lm-eval-harness/lm_eval/tasks/__init__.py:262
↓ 1 callersFunctionload_config_hf
(model_name)
lm-eval-harness/lm_eval/models/based_lm.py:13
↓ 1 callersFunctionload_hf_model
(model_name: str, device:str = 'cuda')
lm-eval-harness/lm_eval/models/local_utils/loading.py:73
↓ 1 callersFunctionload_model
Load a model from a wandb run ID. Parameters: run_id (str): A full wandb run id like "hazy-research/attention/159o6asi"
lm-eval-harness/lm_eval/models/local_utils/loading.py:12
↓ 1 callersMethodload_task_or_group
Loads a dictionary of task objects from a list :param task_list: Union[str, list] = None Single string or list of string of task
lm-eval-harness/lm_eval/tasks/__init__.py:240
↓ 1 callersFunctionload_tokenizer
(model_name: str, is_hf: bool=False)
lm-eval-harness/lm_eval/models/local_utils/loading.py:97
↓ 1 callersFunctionmain
( model: List[str], task: List[str], batch_size: int, limit: Optional[int], parallelize:
lm-eval-harness/launch_hf.py:72
↓ 1 callersFunctionmain
( model: List[str], task: List[str], batch_size: int, limit: Optional[int], parallelize:
lm-eval-harness/launch_local.py:82
↓ 1 callersFunctionmain
( model: List[str], task: List[str], batch_size: int, limit: Optional[int], parallelize:
lm-eval-harness/launch.py:83
↓ 1 callersFunctionmain
( model: List[str], task: List[str], batch_size: int, limit: Optional[int], parallelize:
lm-eval-harness/launch_jrt.py:81
↓ 1 callersFunctionmain
()
training/run.py:22
↓ 1 callersFunctionmain
()
evals/ppl.py:170
↓ 1 callersMethodmatch_tasks
(self, task_list)
lm-eval-harness/lm_eval/tasks/__init__.py:67
↓ 1 callersFunctionmean_stderr
(arr)
lm-eval-harness/lm_eval/api/metrics.py:212
↓ 1 callersMethodmodify_gen_kwargs
(kwargs: dict)
lm-eval-harness/lm_eval/models/vllm_causallms.py:436
↓ 1 callersFunctionmom_upad_input
Unpads query, key, and values tensors, using a single dimension for all tokens even though they belong to different batches. This function i
mom/layers/mom.py:24
↓ 1 callersMethodoverride_metric
Override the default metrics used for evaluation with custom metrics. Parameters: - metric_name (str): The name of the custo
lm-eval-harness/lm_eval/api/task.py:645
↓ 1 callersMethodpad_for_conv
(self, cu_seqlens, cu_q, cu_k, cu_v)
mom/layers/mom.py:714
↓ 1 callersFunctionparse_eval_args
()
lm-eval-harness/lm_eval/__main__.py:49
↓ 1 callersFunctionparse_value
(item)
lm-eval-harness/lm_eval/__main__.py:26
↓ 1 callersFunctionpreprocess
Load, tokenize, and save the processed dataset. Args: dataset: Path or name of the dataset. Default: 'HuggingFaceFW/fine
training/preprocess.py:64
↓ 1 callersFunctionprint_tasks
(task_hierarchy, results, tab=0)
lm-eval-harness/lm_eval/evaluator.py:610
↓ 1 callersMethodprocess_batch
Process a single batch of data
evals/ppl.py:79
↓ 1 callersFunctionprofile
( name: str, batch_size: int = 8, seq_len: int = 2048, varlen: bool = False, warmup_steps:
benchmarks/benchmark_training_throughput.py:52
↓ 1 callersMethodprune
Create a pruned version of a SCROLLS task dataset containing only inputs that are less than `max_tokens` when tokenized by each tokenizer
lm-eval-harness/lm_eval/tasks/scrolls/task.py:157
↓ 1 callersMethodread
( self, file, get_meta: bool = False, autojoin_paragraphs: bool = True,
lm-eval-harness/lm_eval/decontamination/archiver.py:54
↓ 1 callersMethodread_tqdm
(self, update_frequency: int = 10000)
lm-eval-harness/lm_eval/decontamination/archiver.py:110
↓ 1 callersMethodread_tqdm
(self)
lm-eval-harness/lm_eval/decontamination/archiver.py:165
↓ 1 callersFunctionreconstruct
Reconstruct and mix transformed outputs back into the original input sequence shape. Key operations: 1. Reshapes and transposes `transfo
mom/layers/mom.py:206
↓ 1 callersMethodregister_contaminant_cpp
(self, dirt_string)
lm-eval-harness/lm_eval/decontamination/janitor.py:195
↓ 1 callersMethodregister_contaminant_python
(self, dirt_string: str)
lm-eval-harness/lm_eval/decontamination/janitor.py:213
↓ 1 callersFunctionremove_articles
(s)
lm-eval-harness/lm_eval/tasks/super_glue/record/t5_utils.py:56
↓ 1 callersFunctionreplace_punctuation
(s)
lm-eval-harness/lm_eval/tasks/super_glue/record/t5_utils.py:59
↓ 1 callersFunctionrun_task_tests
Find the package root and run the tests for the given tasks
lm-eval-harness/lm_eval/utils.py:312
↓ 1 callersMethodsample
Draw `n` samples from our fewshot docs. This method should be overridden by subclasses.
lm-eval-harness/lm_eval/api/samplers.py:66
↓ 1 callersMethodsample
(self, indices)
training/flame/data.py:103
↓ 1 callersMethodset_cache_hook
(self, cache_hook)
lm-eval-harness/lm_eval/api/model.py:150
↓ 1 callersMethodshared_o
( self, hidden_states: torch.Tensor, attention_mask: Optional[torch.Tensor] = None,
mom/layers/mom.py:612
↓ 1 callersMethodshared_o
( self, hidden_states: torch.Tensor, attention_mask: Optional[torch.Tensor] = None,
mom_naive/layers/mom_gla.py:521
↓ 1 callersMethodshared_o
( self, hidden_states: torch.Tensor, attention_mask: Optional[torch.Tensor] = None,
mom_naive/layers/mom_gated_deltanet.py:529
↓ 1 callersFunctionsimple_parse_args_string
Parses something like args1=val1,arg2=val2 Into a dictionary
lm-eval-harness/lm_eval/utils.py:69
↓ 1 callersFunctionsplit_indices
Splits a string on whitespaces and records the indices of each in the original string. @:return generator((word, (start_idx, end_idx)), ...)
lm-eval-harness/lm_eval/decontamination/janitor.py:73
↓ 1 callersMethodstate
(self)
training/flame/logging.py:110
↓ 1 callersMethodstate_dict
(self)
training/flame/data.py:136
↓ 1 callersMethodtest_docs
(self)
lm-eval-harness/lm_eval/api/task.py:919
↓ 1 callersMethodto_dict
dumps the current config as a dictionary object, as a printable format. null fields will not be printed. Used for dumping results alon
lm-eval-harness/lm_eval/api/task.py:121
↓ 1 callersMethodtok_batch_encode
( self, strings: List[str], padding_side: str = "left", left_truncate_len: int
lm-eval-harness/lm_eval/models/neuron_optimum.py:356
↓ 1 callersMethodtok_batch_encode
( self, strings: List[str], padding_side: str = "left", left_truncate_len: int
lm-eval-harness/lm_eval/models/huggingface.py:694
↓ 1 callersFunctiontokenize
Tokenize the input text and split into chunks of specified context length. Args: examples: Dictionary containing the inp
training/preprocess.py:17
↓ 1 callersMethodtokenize
(self, data, batch_size: int = 64)
training/flame/data.py:88
↓ 1 callersFunctiontransform
Transform input sequences into memory-organized chunks with capacity constraints. Processes input sequences by routing tokens to designated
mom/layers/mom.py:105
↓ 1 callersFunctiontransform
Transform input sequences into memory-organized chunks with capacity constraints. Processes input sequences by routing tokens to designa
mom_naive/layers/mom_gla.py:21
↓ 1 callersFunctiontransform
Transform input sequences into memory-organized chunks with capacity constraints. Processes input sequences by routing tokens to designa
mom_naive/layers/mom_gsa.py:27
↓ 1 callersFunctiontransform
Transform input sequences into memory-organized chunks with capacity constraints. Processes input sequences by routing tokens to designa
mom_naive/layers/mom_linear_attn.py:17
↓ 1 callersFunctiontransform
Transform input sequences into memory-organized chunks with capacity constraints. Processes input sequences by routing tokens to designa
mom_naive/layers/mom_gated_deltanet.py:34
↓ 1 callersMethodtruncate_context
Custom Code for the Just Read Twice Project
lm-eval-harness/lm_eval/api/task.py:352
↓ 1 callersFunctionunflatten_dict
Takes a flat dictionary with '/' separated keys, and returns it as a nested dictionary. Parameters: d (dict): The flat dictionary t
lm-eval-harness/lm_eval/models/local_utils/jrt_utils.py:28
↓ 1 callersMethodunpad_after_conv
(self, conv_cu_seqlens, cu_seqlens, cu_q, cu_k, cu_v, pad_lengths)
mom/layers/mom.py:738
↓ 1 callersMethodvalidation_docs
(self)
lm-eval-harness/lm_eval/api/task.py:911
↓ 1 callersFunctionwhite_space_fix
(s)
lm-eval-harness/lm_eval/tasks/super_glue/record/t5_utils.py:63
↓ 1 callersFunctionword_ngrams_indices
Splits a string into pairs of (ngram words, their start/end indices)
lm-eval-harness/lm_eval/decontamination/janitor.py:80
Method__call__
(self, v)
lm-eval-harness/lm_eval/api/metrics.py:373
Method__call__
(self, input_ids, scores, **kwargs)
lm-eval-harness/lm_eval/models/utils.py:232
Method__call__
( self, examples: List[Union[List[int], Dict[str, Any]]] )
training/flame/data.py:179
Method__contains__
(self, values)
lm-eval-harness/lm_eval/models/utils.py:68
Method__getattr__
(self, attr)
lm-eval-harness/lm_eval/api/model.py:193
Method__getitem__
(self, item)
lm-eval-harness/lm_eval/api/task.py:115
Method__init__
( self, hidden_size: int = 2048, head_dim: int = 256, num_heads: int = 4,
mom/layers/mom.py:285
Method__init__
(self, *inputs, **kwargs)
mom/models/mom/modeling_mom.py:199
Method__init__
(self, config: MomConfig)
mom/models/mom/modeling_mom.py:245
Method__init__
(self, config)
mom/models/mom/modeling_mom.py:363
Method__init__
( self, attn_mode: str = "chunk", hidden_size: int = 2048, conv_size: int = 4,
mom/models/mom/configuration_mom.py:12
Method__init__
( self, mode: str = 'chunk', hidden_size: int = 1024, expand_k: float = 0.5,
mom_naive/layers/mom_gla.py:226
Method__init__
( self, mode: str = 'chunk', hidden_size: int = 1024, expand_k: float = 1.,
mom_naive/layers/mom_gsa.py:187
Method__init__
( self, mode: str = 'chunk', hidden_size: str = 1024, expand_k: int = 1.0,
mom_naive/layers/mom_linear_attn.py:176
Method__init__
( self, hidden_size: int = 2048, expand_v: float = 2, head_dim: int = 256,
mom_naive/layers/mom_gated_deltanet.py:239
Method__init__
(self, config: MomLinearAttentionConfig, layer_idx: int)
mom_naive/models/mom_linear_attn/modeling_mom_linear_attn.py:65
← previousnext →201–300 of 861, ranked by callers