Method__init__(self, params, lr=1e-3, betas=(0.9, 0.999), eps=1e-6, weight_decay=0.01)
apex/tests/L0/run_optimizers/test_lamb.py:29
Method__init__(self, num_features, fuse_relu=False, bn_group=1, max_cta_per_sm=2, cta_launch_margin=12, multi_stream=False)
apex/apex/contrib/groupbn/batch_norm.py:103
Method__init__(self, params,
lr=1e-3, bias_correction = True,
betas=(0.9, 0.999), eps=1e-8
apex/apex/contrib/optimizers/distributed_fused_adam_v3.py:43
Method__init__(self, params, lr=1e-3, bias_correction=True,
betas=(0.9, 0.999), eps=1e-6, weight_decay=0.01
apex/apex/contrib/optimizers/fused_lamb.py:63
Method__init__(self, params, lr=required, momentum=0, dampening=0,
weight_decay=0, nesterov=False,
apex/apex/contrib/optimizers/fused_sgd.py:66
Method__init__(self, params,
lr=1e-3, bias_correction=True, betas=(0.9, 0.999),
eps=1e-8,
apex/apex/contrib/optimizers/distributed_fused_adam.py:55
Method__init__(self, params,
lr=1e-3, bias_correction = True,
betas=(0.9, 0.999), eps=1e-8
apex/apex/contrib/optimizers/distributed_fused_adam_v2.py:43
Method__init__(self, params,
lr=1e-3, bias_correction = True, grad_averaging=True,
betas=(
apex/apex/contrib/optimizers/distributed_fused_lamb.py:68
Method__init__(self, params,
lr=1e-3, bias_correction = True,
betas=(0.9, 0.999), eps=1e-8
apex/apex/contrib/optimizers/fused_adam.py:38
Method__init__(self, embed_dim, num_heads, dropout=0., bias=False, include_norm_add=False, impl='fast')
apex/apex/contrib/multihead_attn/encdec_multihead_attn.py:31
Method__init__(self, embed_dim, num_heads, dropout=0., bias=False, include_norm_add=False, impl='fast', separate_qkv_params=
apex/apex/contrib/multihead_attn/self_multihead_attn.py:31