(
self,
image_size_h,
image_size_w,
image_stride=14,
max_pixels=14*14*9*1024,
image_mean=OPENAI_CLIP_MEAN,
image_std=OPENAI_CLIP_STD,
)
| 150 | |
| 151 | class QwenVL2ImageTransform: |
| 152 | def __init__( |
| 153 | self, |
| 154 | image_size_h, |
| 155 | image_size_w, |
| 156 | image_stride=14, |
| 157 | max_pixels=14*14*9*1024, |
| 158 | image_mean=OPENAI_CLIP_MEAN, |
| 159 | image_std=OPENAI_CLIP_STD, |
| 160 | ): |
| 161 | self.processor = Qwen2VLImageProcessor.from_pretrained('InternRobotics/G2VLM-2B-MoT') |
| 162 | self.img_h = image_size_h |
| 163 | self.img_w = image_size_w |
| 164 | self.stride = image_stride |
| 165 | |
| 166 | # self.to_tensor_transform = transforms.ToTensor() |
| 167 | # self.normalize_transform = transforms.Normalize(mean=image_mean, std=image_std, inplace=True) |
| 168 | |
| 169 | def __call__(self, img, img_num=1): |
| 170 | # if self.img_h is not None: |
nothing calls this directly
no test coverage detected