↓ 47 callersFunctionvmlaq_symm_hi_u8_s16(
store: (int16x8_t, int16x8_t),
input0: uint8x16_t,
input1: uint8x16_t,
weight: int16x8_t,
)
src/filter1d/neon/utils.rs:84
↓ 27 callersFunctionvfmlaq_symm_u8_f32(
store: (float32x4_t, float32x4_t, float32x4_t, float32x4_t),
input0: uint8x16_t,
input1: uint8x1
src/filter1d/neon/utils.rs:241
↓ 26 callersFunctionvfmlaq_symm_u16_u16(
store: (uint32x4_t, uint32x4_t),
input0: uint16x8_t,
input1: uint16x8_t,
weight: uint32x4_t,
src/filter1d/neon/utils.rs:367
↓ 24 callersFunction_mm_mul_add_epi8_by_ps_x4(
accumulator: (__m128, __m128, __m128, __m128),
input: __m128i,
weight: __m128,
)
src/filter1d/sse/utils.rs:175
↓ 24 callersFunctionvfmlaq_symm_u8_s16(
store: (int32x4_t, int32x4_t, int32x4_t, int32x4_t),
input0: uint8x16_t,
input1: uint8x16_t,
src/filter1d/neon/utils.rs:344
↓ 24 callersFunctionvfmlaq_u8_f32(
store: (float32x4_t, float32x4_t, float32x4_t, float32x4_t),
input: uint8x16_t,
weight: float32x
src/filter1d/neon/utils.rs:212
↓ 24 callersFunctionvfmlaq_u8_s16(
store: (int32x4_t, int32x4_t, int32x4_t, int32x4_t),
input: uint8x16_t,
weight: int16x8_t,
)
src/filter1d/neon/utils.rs:325
↓ 20 callersFunction_mm256_mul_add_symm_epu16_by_epu16_x4(
accumulator: (__m256i, __m256i),
input0: __m256i,
input1: __m256i,
weight: __m256i,
)
src/filter1d/avx/utils.rs:144
↓ 20 callersFunctionmq_complex_mla(
acc: (__m128i, __m128i),
r0i0: __m128i,
r: __m128i,
r_swop: __m128i,
)
src/filter1d/sse/filter_column_complex_u8_i32.rs:49
↓ 17 callersFunction_mm256_mul_add_symm_epi8_by_epi16_x4(
accumulator: (__m256i, __m256i),
input0: __m256i,
input1: __m256i,
weight: __m256i,
)
src/filter1d/avx/utils.rs:118
↓ 17 callersFunction_mm_mul_add_symm_epi8_by_epi16_x4(
accumulator: (__m128i, __m128i),
input0: __m128i,
input1: __m128i,
weight: __m128i,
)
src/filter1d/sse/utils.rs:499
↓ 17 callersFunction_mm_mul_add_symm_epi8_by_ps_x4(
accumulator: (__m128, __m128, __m128, __m128),
input0: __m128i,
input1: __m128i,
weight: __m
src/filter1d/sse/utils.rs:326