| 21 | |
| 22 | |
| 23 | def parse_args(args): |
| 24 | parser = argparse.ArgumentParser(description="LISA chat") |
| 25 | parser.add_argument("--version", default="xinlai/LISA-13B-llama2-v1") |
| 26 | parser.add_argument("--vis_save_path", default="./vis_output", type=str) |
| 27 | parser.add_argument( |
| 28 | "--precision", |
| 29 | default="fp16", |
| 30 | type=str, |
| 31 | choices=["fp32", "bf16", "fp16"], |
| 32 | help="precision for inference", |
| 33 | ) |
| 34 | parser.add_argument("--image_size", default=1024, type=int, help="image size") |
| 35 | parser.add_argument("--model_max_length", default=512, type=int) |
| 36 | parser.add_argument("--lora_r", default=8, type=int) |
| 37 | parser.add_argument( |
| 38 | "--vision-tower", default="openai/clip-vit-large-patch14", type=str |
| 39 | ) |
| 40 | parser.add_argument("--local-rank", default=0, type=int, help="node rank") |
| 41 | parser.add_argument("--load_in_8bit", action="store_true", default=False) |
| 42 | parser.add_argument("--load_in_4bit", action="store_true", default=False) |
| 43 | parser.add_argument("--use_mm_start_end", action="store_true", default=True) |
| 44 | parser.add_argument( |
| 45 | "--conv_type", |
| 46 | default="llava_v1", |
| 47 | type=str, |
| 48 | choices=["llava_v1", "llava_llama_2"], |
| 49 | ) |
| 50 | return parser.parse_args(args) |
| 51 | |
| 52 | |
| 53 | def preprocess( |