| 39 | #os.environ["WANDB_MODE"] = "offline" |
| 40 | |
| 41 | def get_args_parser(): |
| 42 | config_parser = parser = argparse.ArgumentParser( |
| 43 | description="Training Config", add_help=False |
| 44 | ) |
| 45 | parser.add_argument("-c", "--config",default="imagenet.yml", type=str, metavar="FILE", help="YAML config file specifying default arguments",) |
| 46 | |
| 47 | # important params |
| 48 | parser = argparse.ArgumentParser('MAE fine-tuning for image classification', add_help=False) |
| 49 | parser.add_argument('--batch_size', default=64, type=int, |
| 50 | help='Batch size per GPU (effective batch size is batch_size * accum_iter * # gpus') |
| 51 | parser.add_argument('--epochs', default=200, type=int) |
| 52 | parser.add_argument('--accum_iter', default=1, type=int, |
| 53 | help='Accumulate gradient iterations (for increasing the effective batch size under memory constraints)') |
| 54 | parser.add_argument('--data_path', default='', type=str, |
| 55 | help='dataset path') |
| 56 | parser.add_argument('--exp', default='', type=str, |
| 57 | help='expreiment name') |
| 58 | # Model parameters |
| 59 | parser.add_argument('--model', default='maxformer_10_384', type=str, metavar='MODEL', |
| 60 | help='Name of model to train') |
| 61 | parser.add_argument('--time_step', default=4, type=int, |
| 62 | help='images input size') |
| 63 | parser.add_argument('--input_size', default=224, type=int, |
| 64 | help='images input size') |
| 65 | |
| 66 | parser.add_argument('--drop_path', type=float, default=0.1, metavar='PCT', |
| 67 | help='Drop path rate (default: 0.1)') |
| 68 | |
| 69 | # Optimizer parameters |
| 70 | parser.add_argument('--clip_grad', type=float, default=None, metavar='NORM', |
| 71 | help='Clip gradient norm (default: None, no clipping)') |
| 72 | parser.add_argument('--weight_decay', type=float, default=0.05, |
| 73 | help='weight decay (default: 0.05)') |
| 74 | |
| 75 | parser.add_argument('--lr', type=float, default=None, metavar='LR', |
| 76 | help='learning rate (absolute lr)') |
| 77 | parser.add_argument('--blr', type=float, default=12e-4, metavar='LR', #10 |
| 78 | help='base learning rate: absolute_lr = base_lr * total_batch_size / 256') |
| 79 | parser.add_argument('--layer_decay', type=float, default=1.0, |
| 80 | help='layer-wise lr decay from ELECTRA/BEiT') |
| 81 | |
| 82 | parser.add_argument('--min_lr', type=float, default=5.0e-6, metavar='LR', |
| 83 | help='lower lr bound for cyclic schedulers that hit 0') |
| 84 | |
| 85 | parser.add_argument('--warmup_epochs', type=int, default=5, metavar='N', |
| 86 | help='epochs to warmup LR') |
| 87 | |
| 88 | # Augmentation parameters |
| 89 | parser.add_argument('--color_jitter', type=float, default=0.4, metavar='PCT', |
| 90 | help='Color jitter factor (enabled only when not using Auto/RandAug)')#None |
| 91 | parser.add_argument('--aa', type=str, default='rand-m9-mstd0.5-inc1', metavar='NAME', |
| 92 | help='Use AutoAugment policy. "v0" or "original". " + "(default: rand-m9-mstd0.5-inc1)'), #rand-m9-mstd0.5-inc1 |
| 93 | parser.add_argument('--smoothing', type=float, default=0.1, |
| 94 | help='Label smoothing (default: 0.1)') |
| 95 | |
| 96 | # * Random Erase params |
| 97 | parser.add_argument('--reprob', type=float, default=0.25, metavar='PCT', |
| 98 | help='Random erase prob (default: 0.25)') |