Code
Hub
Workspaces
Following
Trending
Connect
MCP
copy
Create free account
hub
/
github.com/CStanKonrad/long_llama
/ functions
Functions
296 in github.com/CStanKonrad/long_llama
⨍
Functions
296
◇
Types & classes
52
↳
Endpoints
1
Function
create_logger
(log_dir, enable)
fot_continued_pretraining/EasyLM/logging_utils.py:10
Method
create_token_type_ids_from_sequences
Create a mask from the two sequences passed to be used in a sequence-pair classification task. T5 does not make use of token type ids
fot_continued_pretraining/EasyLM/models/llama/llama_model.py:1396
Function
create_trainstate_from_params
(params)
fot_continued_pretraining/EasyLM/models/llama/llama_train.py:129
Method
custom_forward
(*inputs)
src/modeling_longllama.py:869
Method
dataset
(self)
fot_continued_pretraining/EasyLM/data.py:224
Function
decay
(name, _)
fot_continued_pretraining/EasyLM/jax_utils.py:387
Method
eos_token_id
(self)
fot_continued_pretraining/EasyLM/models/llama/llama_model.py:1289
Function
eval_step
(train_state, rng, batch)
fot_continued_pretraining/EasyLM/models/llama/llama_train.py:171
Method
extract_batch
()
fot_continued_pretraining/FoT/data_pipeline.py:135
Function
filtering
(x: Dict[str, Any])
instruction_fine_tuning/data_processing.py:444
Function
flatten_tree
(xs, is_leaf=None, sep=None)
fot_continued_pretraining/EasyLM/jax_utils.py:349
Method
forward
(self, hidden_states)
src/modeling_longllama.py:112
Method
forward
(self, x, seq_len=None)
src/modeling_longllama.py:146
Method
forward
(self, x)
src/modeling_longllama.py:198
Method
forward
( self, hidden_states: torch.Tensor, attention_mask: Optional[torch.Tensor] = None,
src/modeling_longllama.py:239
Method
forward
Args: hidden_states (`torch.FloatTensor`): input to the layer of shape `(batch, seq_len, embed_dim)` attention_mask (
src/modeling_longllama.py:496
Method
forward
( self, input_ids: torch.LongTensor = None, attention_mask: Optional[torch.Tensor] = N
src/modeling_longllama.py:782
Method
forward
r""" Args: labels (`torch.LongTensor` of shape `(batch_size, sequence_length)`, *optional*): Labels for computing
src/modeling_longllama.py:1197
Method
forward
r""" labels (`torch.LongTensor` of shape `(batch_size,)`, *optional*): Labels for computing the sequence classification/regression
src/modeling_longllama.py:1372
Function
gather_fn
(tensor)
fot_continued_pretraining/EasyLM/jax_utils.py:124
Function
get_data_pipeline_constructor
(data_pipeline: str)
fot_continued_pretraining/FoT/data_pipeline.py:324
Function
get_dataset_packing
DOC_AWARE_PIPELINE_K assigns k batch indices to one doc
fot_continued_pretraining/FoT/data_pipeline.py:313
Method
get_decoder
(self)
src/modeling_longllama.py:1185
Method
get_default_config
(updates=None)
fot_continued_pretraining/EasyLM/data.py:24
Method
get_default_config
(updates=None)
fot_continued_pretraining/EasyLM/optimizers.py:69
Method
get_default_config
(updates=None)
fot_continued_pretraining/EasyLM/optimizers.py:125
Method
get_input_embeddings
(self)
src/modeling_longllama.py:751
Method
get_input_embeddings
(self)
src/modeling_longllama.py:1170
Method
get_input_embeddings
(self)
src/modeling_longllama.py:1365
Function
get_metrics
(metrics, unreplicate=False, stack=False)
fot_continued_pretraining/EasyLM/jax_utils.py:229
Method
get_optimizer
(cls, config, weight_decay_mask=None)
fot_continued_pretraining/EasyLM/optimizers.py:84
Method
get_optimizer
(cls, config, weight_decay_mask=None)
fot_continued_pretraining/EasyLM/optimizers.py:144
Method
get_output_embeddings
(self)
src/modeling_longllama.py:1176
Function
get_partition_spec
(name, leaf)
fot_continued_pretraining/EasyLM/jax_utils.py:372
Method
get_special_tokens_mask
Retrieve sequence ids from a token list that has no special tokens added. This method is called when adding special tokens using the
fot_continued_pretraining/EasyLM/models/llama/llama_model.py:1371
Method
get_state_dict
(self)
fot_continued_pretraining/EasyLM/data.py:204
Method
get_vocab
Returns vocab as a dict
fot_continued_pretraining/EasyLM/models/llama/llama_model.py:1292
Function
init_eval_fn
(rng)
fot_continued_pretraining/EasyLM/models/llama/llama_train.py:145
Function
init_fn
(params)
fot_continued_pretraining/EasyLM/optimizers.py:199
Function
init_train_fn
(rng)
fot_continued_pretraining/EasyLM/models/llama/llama_train.py:142
Method
init_weights
(self, rng: jax.random.PRNGKey, input_shape: Tuple, params: FrozenDict = None)
fot_continued_pretraining/EasyLM/models/llama/llama_model.py:849
Function
inst_tuning_data_processor
( data_args: DataArgs, data, tokenizer: PreTrainedTokenizer, tokenization_args: TokenizationArgs )
instruction_fine_tuning/data_processing.py:90
Method
learning_rate_schedule
(step)
fot_continued_pretraining/EasyLM/optimizers.py:87
Method
load_state_dict
(self, state_dict)
fot_continued_pretraining/EasyLM/data.py:207
Function
loss_and_accuracy
(params)
fot_continued_pretraining/EasyLM/models/llama/llama_train.py:151
Function
main
(argv)
fot_continued_pretraining/EasyLM/scripts/convert_checkpoint.py:25
Function
main
(argv)
fot_continued_pretraining/EasyLM/scripts/diff_checkpoint.py:28
Function
main
(argv)
fot_continued_pretraining/EasyLM/models/llama/convert_torch_to_easylm.py:24
Function
main
(argv)
fot_continued_pretraining/EasyLM/models/llama/convert_easylm_to_hf.py:283
Function
main
(argv)
fot_continued_pretraining/EasyLM/models/llama/llama_train.py:62
Function
make_gather_fn
(partition_spec, dtype_spec=None)
fot_continued_pretraining/EasyLM/jax_utils.py:118
Function
make_shard_fn
(partition_spec, dtype_spec=None)
fot_continued_pretraining/EasyLM/jax_utils.py:108
Function
mse_loss
(val, target, valid=None)
fot_continued_pretraining/EasyLM/jax_utils.py:239
Function
non_numeric_to_str
(metrics_dict: Dict[str, Any])
instruction_fine_tuning/utils.py:15
Function
none_str_to_none
(x)
instruction_fine_tuning/data_processing.py:312
Method
parallel_example_iterator
(self)
fot_continued_pretraining/EasyLM/data.py:308
Method
populate_docs
()
fot_continued_pretraining/FoT/data_pipeline.py:113
Method
prepare_inputs_for_generation
( self, input_ids, past_key_values=None, attention_mask=None, inputs_e
src/modeling_longllama.py:1288
Method
prepare_inputs_for_generation
(self, input_ids, max_length, attention_mask: Optional[jax.Array] = None)
fot_continued_pretraining/EasyLM/models/llama/llama_model.py:1194
Function
read_json
(path)
fot_continued_pretraining/EasyLM/models/llama/convert_easylm_to_hf.py:116
Function
run_fot
(_)
fot_continued_pretraining/running_utils/runner.py:17
Method
save_vocabulary
Save the vocabulary and special tokens file to a directory. Args: save_directory (`str`): The directory i
fot_continued_pretraining/EasyLM/models/llama/llama_model.py:1330
Function
scan_ffn
(remat_ffn, carry, hidden_states)
fot_continued_pretraining/EasyLM/bpt.py:25
Function
scan_kv_block
(carry, args)
fot_continued_pretraining/EasyLM/bpt.py:104
Method
seq_length
(self)
fot_continued_pretraining/EasyLM/data.py:212
Method
seq_length
(self)
fot_continued_pretraining/EasyLM/data.py:374
Method
set_decoder
(self, decoder)
src/modeling_longllama.py:1182
Method
set_input_embeddings
(self, value)
src/modeling_longllama.py:754
Method
set_input_embeddings
(self, value)
src/modeling_longllama.py:1173
Method
set_input_embeddings
(self, value)
src/modeling_longllama.py:1368
Method
set_output_embeddings
(self, new_embeddings)
src/modeling_longllama.py:1179
Method
setup
(self)
fot_continued_pretraining/EasyLM/models/llama/llama_model.py:384
Method
setup
(self)
fot_continued_pretraining/EasyLM/models/llama/llama_model.py:460
Method
setup
(self)
fot_continued_pretraining/EasyLM/models/llama/llama_model.py:698
Method
setup
(self)
fot_continued_pretraining/EasyLM/models/llama/llama_model.py:740
Method
setup
(self)
fot_continued_pretraining/EasyLM/models/llama/llama_model.py:980
Method
setup
(self)
fot_continued_pretraining/EasyLM/models/llama/llama_model.py:1059
Method
setup
(self)
fot_continued_pretraining/EasyLM/models/llama/llama_model.py:1135
Function
shard_fn
(tensor)
fot_continued_pretraining/EasyLM/jax_utils.py:114
Function
skip_upper_half
(carry, args)
fot_continued_pretraining/EasyLM/bpt.py:124
Function
split_field
(field: Optional[str], dataset_type: str, separator: str, process_field_name_fn)
instruction_fine_tuning/data_processing.py:291
Method
text_processor
(self)
fot_continued_pretraining/EasyLM/data.py:220
Function
to_dtype
(tensor)
fot_continued_pretraining/EasyLM/jax_utils.py:99
Method
tokenizer
(self)
fot_continued_pretraining/EasyLM/data.py:216
Method
tokenizer
(self)
fot_continued_pretraining/EasyLM/data.py:378
Function
train_step
(train_state, rng, batch)
fot_continued_pretraining/EasyLM/models/llama/llama_train.py:148
Function
update_fn
(updates, state, params)
fot_continued_pretraining/EasyLM/optimizers.py:203
Method
update_inputs_for_generation
(self, model_outputs, model_kwargs)
fot_continued_pretraining/EasyLM/models/llama/llama_model.py:1215
Method
vocab_size
(self)
fot_continued_pretraining/EasyLM/data.py:228
Method
vocab_size
(self)
fot_continued_pretraining/EasyLM/data.py:386
Method
vocab_size
Returns vocab size
fot_continued_pretraining/EasyLM/models/llama/llama_model.py:1280
Function
weight_decay_mask
(params)
fot_continued_pretraining/EasyLM/jax_utils.py:393
Method
weight_decay_schedule
(step)
fot_continued_pretraining/EasyLM/optimizers.py:91
Function
wrap_function
(function)
fot_continued_pretraining/EasyLM/jax_utils.py:210
Function
wrap_function_with_rng
To be used as decorator, automatically bookkeep a RNG for the wrapped function.
fot_continued_pretraining/EasyLM/jax_utils.py:208
Function
wrapped
(*args, **kwargs)
fot_continued_pretraining/EasyLM/jax_utils.py:211
← previous
201–296 of 296, ranked by callers