(input_tensor)
| 237 | |
| 238 | |
| 239 | def quant_fp8_vllm(input_tensor): |
| 240 | input_tensor_fp8, input_tensor_scale = ops.scaled_fp8_quant(input_tensor, scale=None, scale_ub=None, use_per_token_if_dynamic=True) |
| 241 | return input_tensor_fp8, input_tensor_scale |
| 242 | |
| 243 | |
| 244 | def dequant_fp8_vllm(input_tensor_fp8, input_tensor_scale, dtype): |
no outgoing calls
no test coverage detected