MCPcopy Create free account

hub / github.com/UIC-Liu-Lab/CPT / types & classes

Types & classes33 in github.com/UIC-Liu-Lab/CPT

↓ 7 callersClassRobertaModel
The model can behave as an encoder (with only self-attention) as well as a decoder, in which case a layer of cross-attention is added betwee
networks/adapter_mask/roberta_model.py:716
↓ 2 callersClassRobertaAdapterMask
networks/adapter_mask/roberta_adapter.py:31
↓ 2 callersClassRobertaAttention
networks/adapter_mask/roberta_model.py:314
↓ 2 callersClassRobertaLMHead
Roberta Head for masked language modeling.
networks/adapter_mask/roberta_model.py:1246
↓ 1 callersClassAdapterMaskConfig
networks/adapter_mask/common.py:8
↓ 1 callersClassAppr
approaches/finetune.py:21
↓ 1 callersClassAppr
approaches/posttrain.py:27
↓ 1 callersClassRobertaAdaptedSelfAttention
For parallel adapter.
networks/adapter_mask/roberta_adapter.py:98
↓ 1 callersClassRobertaAdaptedSelfOutput
networks/adapter_mask/roberta_adapter.py:75
↓ 1 callersClassRobertaClassificationHead
Head for sentence-level classification tasks.
networks/adapter_mask/roberta_model.py:1567
↓ 1 callersClassRobertaEmbeddings
Same as BertEmbeddings with a tiny tweak for positional embeddings indexing.
networks/adapter_mask/roberta_model.py:78
↓ 1 callersClassRobertaEncoder
networks/adapter_mask/roberta_model.py:486
↓ 1 callersClassRobertaIntermediate
networks/adapter_mask/roberta_model.py:366
↓ 1 callersClassRobertaLayer
networks/adapter_mask/roberta_model.py:400
↓ 1 callersClassRobertaOutput
networks/adapter_mask/roberta_model.py:382
↓ 1 callersClassRobertaPooler
networks/adapter_mask/roberta_model.py:588
↓ 1 callersClassRobertaSelfAttention
networks/adapter_mask/roberta_model.py:169
↓ 1 callersClassRobertaSelfOutput
networks/adapter_mask/roberta_model.py:296
↓ 1 callersClassmyAccelerator
networks/adapter_mask/MyAccelerator.py:16
↓ 1 callersClassmyAccleratedOptimizer
networks/adapter_mask/MyAccelerator.py:7
ClassBertAdam
Implements BERT version of Adam algorithm with weight decay fix. Params: lr: learning rate warmup: portion of t_total for the warm
networks/adapter_mask/my_optimization.py:50
ClassRobertaAdapter
networks/adapter_mask/roberta_adapter.py:17
ClassRobertaForCausalLM
networks/adapter_mask/roberta_model.py:991
ClassRobertaForMaskedLM
networks/adapter_mask/roberta_model.py:1146
ClassRobertaForMultipleChoice
networks/adapter_mask/roberta_model.py:1384
ClassRobertaForQuestionAnswering
networks/adapter_mask/roberta_model.py:1596
ClassRobertaForSequenceClassification
networks/adapter_mask/roberta_model.py:1283
ClassRobertaForTokenClassification
networks/adapter_mask/roberta_model.py:1478
ClassRobertaMaskBasedModel
networks/adapter_mask/roberta_base.py:13
ClassRobertaMaskForMaskedLM
networks/adapter_mask/roberta_base.py:46
ClassRobertaMaskForSequenceClassification
networks/adapter_mask/roberta_base.py:51
ClassRobertaModelWithHeads
networks/adapter_mask/roberta_model.py:910
ClassRobertaPreTrainedModel
An abstract class to handle weights initialization and a simple interface for downloading and loading pretrained models.
networks/adapter_mask/roberta_model.py:603