(
input_video_path,
sample_size,
max_video_length=49,
temporal_window_size=49,
)
| 448 | |
| 449 | |
| 450 | def get_video( |
| 451 | input_video_path, |
| 452 | sample_size, |
| 453 | max_video_length=49, |
| 454 | temporal_window_size=49, |
| 455 | ): |
| 456 | input_video = media.read_video(input_video_path) |
| 457 | input_video = torch.from_numpy(np.array(input_video))[:max_video_length] |
| 458 | input_video = input_video.permute([3, 0, 1, 2]).float() / 255 # (c, t, h, w) |
| 459 | input_video = F.interpolate(input_video, sample_size, mode='area').unsqueeze(0) # (1, c, t, h, w) |
| 460 | |
| 461 | input_video = temporal_padding(input_video, min_length=temporal_window_size, max_length=max_video_length) |
| 462 | return input_video |
| 463 | |
| 464 | |
| 465 | def dilate_video_mask(video_mask, width=11): |
nothing calls this directly
no test coverage detected