Method__init__(self, params, lr=required, warmup=-1, t_total=-1, schedule='warmup_linear', b1=0.9, b2=0.999, e=1e-6,
networks/adapter_mask/my_optimization.py:65
Methodforward(self, x, t, s, smax=400, add_residual=True, residual=None)
networks/adapter_mask/roberta_adapter.py:40
Methodforward(self, hidden_states: torch.Tensor, input_tensor: torch.Tensor, t, s, **kwargs)
networks/adapter_mask/roberta_adapter.py:84
Methodforward(
self, input_ids=None, token_type_ids=None, position_ids=None, inputs_embeds=None, past_key_value
networks/adapter_mask/roberta_model.py:110
Functionforward_cls(self, t, input_ids, segment_ids, input_mask, start_mixup=None, s=None, l=None, idx=None, mix_type=None)
networks/adapter_mask/roberta_adapter.py:311