(pixel=224)
| 111 | return model, tokenizer, new_token_ids , vit_image_transform, dino_transform |
| 112 | |
| 113 | def build_transform(pixel=224): |
| 114 | image_transform = QwenVL2ImageTransform(pixel, pixel, 14) |
| 115 | |
| 116 | return image_transform |
| 117 | |
| 118 | |
| 119 | def process_conversation(images, conversation): |
no test coverage detected