| 19 | from eval_utils.humaneval_evaluation import evaluate_functional_correctness |
| 20 | |
| 21 | def get_args_parser(): |
| 22 | parser = argparse.ArgumentParser('light-eval', add_help=False) |
| 23 | # Dataset parameters |
| 24 | parser.add_argument("--overwrite", action="store_true", default=False, |
| 25 | help="Overwrite existed results") |
| 26 | # Model parameters |
| 27 | parser.add_argument('--llama_type', default='llama', type=str, metavar='MODEL', |
| 28 | help='type of llama') |
| 29 | parser.add_argument('--llama_config', default='/path/to/params.json', type=str, nargs="+", |
| 30 | help='Path to llama model config') |
| 31 | parser.add_argument('--tokenizer_path', type=str, default="../tokenizer.model", |
| 32 | help='path to tokenizer.model') |
| 33 | parser.add_argument('--pretrained_path', default='/path/to/pretrained', type=str, |
| 34 | help='directory containing pretrained checkpoints') |
| 35 | parser.add_argument('--pretrained_type', type=str, default="consolidated", choices=['consolidated', 'meta_ori'], |
| 36 | help='pretrained checkpoint save format') |
| 37 | # Parrallel parameters |
| 38 | parser.add_argument('--device', default='cuda', |
| 39 | help='device for inference') |
| 40 | parser.add_argument('--model_parallel_size', default=1, type=int) |
| 41 | parser.add_argument('--world_size', default=1, type=int, |
| 42 | help='number of distributed processes') |
| 43 | parser.add_argument('--local_rank', default=-1, type=int) |
| 44 | parser.add_argument('--dist_on_itp', action='store_true') |
| 45 | parser.add_argument('--dist_url', default='env://', |
| 46 | help='url used to set up distributed training') |
| 47 | return parser |
| 48 | |
| 49 | # load model and tokenizer |
| 50 | def load(args): |