↓ 1 callersMethodcache_swap(
self,
blocks_to_swap_in: Dict[int, int],
blocks_to_swap_out: Dict[int, int],
autoregressive/serve/worker.py:196
↓ 1 callersFunctioncreat_optimizer_by_name(model, weight_decay, learning_rate, betas, global_rank, logger)
autoregressive/train/train_c2i_fsdp.py:67
↓ 1 callersFunctiondecode_n_tokens(
model, cur_token: torch.Tensor, input_pos: torch.Tensor, num_new_tokens: int,
cfg_scale: float, cfg
autoregressive/models/generate.py:105
↓ 1 callersFunctiondecode_one_token(model, x: torch.Tensor, input_pos: torch.Tensor, cfg_scale: float, cfg_flag: bool, **sampling_kwargs)
autoregressive/models/generate.py:89