x86 Compiler Intrinsics
3623 intrinsics from the Intel® SDM, each mapped to the instruction it compiles to - page 6 of 37, alphabetical. The global search in the top nav also matches intrinsic names directly.
| Intrinsic | Instruction | Signature |
|---|---|---|
| _mm256_mask_set1_epi16 | vpbroadcastw | VPBROADCASTW __m256i _mm256_mask_set1_epi16(__m256i s, __mmask16 k, int a); |
| _mm256_mask_set1_epi32 | vpbroadcastd | VPBROADCASTD __m256i _mm256_mask_set1_epi32(__m256i s, __mmask8 k, int a); |
| _mm256_mask_set1_epi64 | vpbroadcastq | VPBROADCASTQ __m256i _mm256_mask_set1_epi64(__m256i s, __mmask8 k, __int64 a); |
| _mm256_mask_set1_epi8 | vpbroadcastb | VPBROADCASTB __m256i _mm256_mask_set1_epi8(__m256i s, __mmask32 k, int a); |
| _mm256_mask_shldi_epi16 | vpshldw | VPSHLDW __m256i _mm256_mask_shldi_epi16(__m256i, __mmask16, __m256i, __m256i, int); |
| _mm256_mask_shldi_epi32 | vpshldd | VPSHLDD __m256i _mm256_mask_shldi_epi32(__m256i, __mmask8, __m256i, __m256i, int); |
| _mm256_mask_shldi_epi64 | vpshldq | VPSHLDQ __m256i _mm256_mask_shldi_epi64(__m256i, __mmask8, __m256i, __m256i, int); |
| _mm256_mask_shrdi_epi16 | vpshrdw | VPSHRDW __m256i _mm256_mask_shrdi_epi16(__m256i, __mmask16, __m256i, __m256i, int); |
| _mm256_mask_shrdi_epi32 | vpshrdd | VPSHRDD __m256i _mm256_mask_shrdi_epi32(__m256i, __mmask8, __m256i, __m256i, int); |
| _mm256_mask_shrdi_epi64 | vpshrdq | VPSHRDQ __m256i _mm256_mask_shrdi_epi64(__m256i, __mmask8, __m256i, __m256i, int); |
| _mm256_mask_shuffle_epi32 | pshufd | VPSHUFD __m256i _mm256_mask_shuffle_epi32(__m256i s, __mmask8 k, __m256i a, int n ); |
| _mm256_mask_shuffle_epi8 | vpshufb | VPSHUFB __m256i _mm256_mask_shuffle_epi8(__m256i s, __mmask32 k, __m256i a, __m256i b); |
| _mm256_mask_shuffle_i32x4 | vshuff32x4 | VSHUFI32x4 __m256i _mm256_mask_shuffle_i32x4(__m256i s, __mmask8 k, __m256i a, __m256i b, int imm); |
| _mm256_mask_shuffle_pd | shufpd | VSHUFPD __m256d _mm256_mask_shuffle_pd(__m256d s, __mmask8 k, __m256d a, __m256d b, int imm); |
| _mm256_mask_shuffle_ps | shufps | VSHUFPS __m256 _mm256_mask_shuffle_ps(__m256 s, __mmask8 k, __m256 a, __m256 b, int imm); |
| _mm256_mask_shufflehi_epi16 | pshufhw | VPSHUFHW __m256i _mm256_mask_shufflehi_epi16(__m256i s, __mmask8 k, __m256i a, int n ); |
| _mm256_mask_shufflelo_epi16 | pshuflw | VPSHUFLW __m256i _mm256_mask_shufflelo_epi16(__m256i s, __mmask8 k, __m256i a, int n ); |
| _mm256_mask_sll_epi16 | psllw | VPSLLW __m256i _mm256_mask_sll_epi16(__m256i s, __mmask16 k, __m256i a, __m128i cnt); |
| _mm256_mask_sll_epi32 | psllw | VPSLLD __m256i _mm256_mask_sll_epi32(__m256i s, __mmask8 k, __m256i a, __m128i cnt); |
| _mm256_mask_sll_epi64 | psllw | VPSLLQ __m256i _mm256_mask_sll_epi64(__m256i s, __mmask8 k, __m256i a, __m128i cnt); |
| _mm256_mask_slli_epi16 | psllw | VPSLLW __m256i _mm256_mask_slli_epi16(__m256i s, __mmask16 k, __m256i a, unsigned int imm); |
| _mm256_mask_slli_epi32 | psllw | VPSLLD __m256i _mm256_mask_slli_epi32(__m256i s, __mmask8 k, __m256i a, unsigned int imm); |
| _mm256_mask_slli_epi64 | psllw | VPSLLQ __m256i _mm256_mask_slli_epi64(__m256i s, __mmask8 k, __m256i a, unsigned int imm); |
| _mm256_mask_sllv_epi16 | vpsllvd | VPSLLVW __m256i _mm256_mask_sllv_epi16(__m256i s, __mmask16 k, __m256i a, __m256i cnt); |
| _mm256_mask_sllv_epi32 | vpsllvd | VPSLLVD __m256i _mm256_mask_sllv_epi32(__m256i s, __mmask8 k, __m256i a, __m256i cnt); |
| _mm256_mask_sllv_epi64 | vpsllvd | VPSLLVD __m256i _mm256_mask_sllv_epi64(__m256i s, __mmask8 k, __m256i a, __m256i cnt); |
| _mm256_mask_sqrt_pd | sqrtpd | VSQRTPD __m256d _mm256_mask_sqrt_pd(__m256d s, __mmask8 k, __m256d a, int r); |
| _mm256_mask_sqrt_ph | vsqrtph | VSQRTPH __m256h _mm256_mask_sqrt_ph (__m256h src, __mmask16 k, __m256h a); |
| _mm256_mask_sqrt_ps | sqrtps | VSQRTPS __m256 _mm256_mask_sqrt_ps(__m256 s, __mmask8 k, __m256 a, int r); |
| _mm256_mask_sra_epi16 | psraw | VPSRAW __m256i _mm256_mask_sra_epi16(__m256i s, __mmask8 k, __m256i a, __m128i cnt); |
| _mm256_mask_sra_epi32 | psraw | VPSRAD __m256i _mm256_mask_sra_epi32(__m256i s, __mmask8 k, __m256i a, __m128i cnt); |
| _mm256_mask_sra_epi64 | psraw | VPSRAQ __m256i _mm256_mask_sra_epi64(__m256i s, __mmask8 k, __m256i a, __m128i cnt); |
| _mm256_mask_srai_epi16 | psraw | VPSRAW __m256i _mm256_mask_srai_epi16(__m256i s, __mmask16 k, __m256i a, unsigned int imm); |
| _mm256_mask_srai_epi32 | psraw | VPSRAD __m256i _mm256_mask_srai_epi32(__m256i s, __mmask8 k, __m256i a, unsigned int imm); |
| _mm256_mask_srai_epi64 | psraw | VPSRAQ __m256i _mm256_mask_srai_epi64(__m256i s, __mmask8 k, __m256i a, unsigned int imm); |
| _mm256_mask_srav_epi16 | vpsravd | VPSRAVW __m256i _mm256_mask_srav_epi16(__m256i s, __mmask16 m, __m256i a, __m256i cnt); |
| _mm256_mask_srav_epi32 | vpsravd | VPSRAVD __m256i _mm256_mask_srav_epi32(__m256i s, __mmask8 m, __m256i a, __m256i cnt); |
| _mm256_mask_srav_epi64 | vpsravq | VPSRAVQ __m256i _mm256_mask_srav_epi64(__m256i s, __mmask8 m, __m256i a, __m256i cnt); |
| _mm256_mask_srl_epi16 | psrlw | VPSRLW __m256i _mm256_mask_srl_epi16(__m256i s, __mmask16 k, __m256i a, __m128i cnt); |
| _mm256_mask_srl_epi32 | psrlw | VPSRLD __m256i _mm256_mask_srl_epi32(__m256i s, __mmask8 k, __m256i a, __m128i cnt); |
| _mm256_mask_srl_epi64 | psrlw | VPSRLQ __m256i _mm256_mask_srl_epi64(__m256i s, __mmask8 k, __m256i a, __m128i cnt); |
| _mm256_mask_srli_epi16 | psrlw | VPSRLW __m256i _mm256_mask_srli_epi16(__m256i s, __mmask16 k, __m256i a, unsigned int imm); |
| _mm256_mask_srli_epi32 | psrlw | VPSRLD __m256i _mm256_mask_srli_epi32(__m256i s, __mmask8 k, __m256i a, unsigned int imm); |
| _mm256_mask_srli_epi64 | psrlw | VPSRLQ __m256i _mm256_mask_srli_epi64(__m256i s, __mmask8 k, __m256i a, unsigned int imm); |
| _mm256_mask_srlv_epi16 | vpsrlvd | VPSRLVW __m256i _mm256_mask_srlv_epi16(__m256i s, __mmask16 k, __m256i a, __m256i cnt); |
| _mm256_mask_srlv_epi32 | vpsrlvd | VPSRLVD __m256i _mm256_mask_srlv_epi32(__m256i s, __mmask8 k, __m256i a, __m256i cnt); |
| _mm256_mask_srlv_epi64 | vpsrlvq | VPSRLVQ __m256i _mm256_mask_srlv_epi64(__m256i s, __mmask8 k, __m256i a, __m256i cnt); |
| _mm256_mask_store_epi32 | movdqa | VMOVDQA32 void _mm256_mask_store_epi32(void * d, __mmask8 k, __m256i a); |
| _mm256_mask_store_epi64 | movdqa | VMOVDQA64 void _mm256_mask_store_epi64(void * d, __mmask8 k, __m256i a); |
| _mm256_mask_store_pd | movapd | VMOVAPD void _mm256_mask_store_pd( void * d, __mmask8 k, __m256d a); |
| _mm256_mask_store_ps | movaps | VMOVAPS void _mm256_mask_store_ps( void * d, __mmask8 k, __m256 a); |
| _mm256_mask_storeu_epi16 | movdqu | VMOVDQU16 void _mm256_mask_storeu_epi16(void * d, __mmask16 k, __m256i a); |
| _mm256_mask_storeu_epi32 | movdqu | VMOVDQU32 void _mm256_mask_storeu_epi32(void * d, __mmask8 k, __m256i a); |
| _mm256_mask_storeu_epi64 | movdqu | VMOVDQU64 void _mm256_mask_storeu_epi64(void * d, __mmask8 k, __m256i a); |
| _mm256_mask_storeu_epi8 | movdqu | VMOVDQU8 void _mm256_mask_storeu_epi8(void * d, __mmask32 k, __m256i a); |
| _mm256_mask_storeu_pd | movupd | VMOVUPD void _mm256_mask_storeu_pd( void * d, __mmask8 k, __m256d a); |
| _mm256_mask_storeu_ps | movups | VMOVUPS void _mm256_mask_storeu_ps( void * d, __mmask8 k, __m256 a); |
| _mm256_mask_sub_epi16 | psubb | VPSUBW __m256i _mm256_mask_sub_epi16(__m256i s, __mmask16 k, __m256i a, __m256i b); |
| _mm256_mask_sub_epi32 | vpsubd | VPSUBD __m256i _mm256_mask_sub_epi32(__m256i s, __mmask8 k, __m256i a, __m256i b); |
| _mm256_mask_sub_epi64 | psubq | VPSUBQ __m256i _mm256_mask_sub_epi64(__m256i s, __mmask8 k, __m256i a, __m256i b); |
| _mm256_mask_sub_epi8 | psubb | VPSUBB __m256i _mm256_mask_sub_epi8(__m256i s, __mmask32 k, __m256i a, __m256i b); |
| _mm256_mask_sub_pd | subpd | VSUBPD __m256d _mm256_mask_sub_pd (__m256d s, __mmask8 k, __m256d a, __m256d b); |
| _mm256_mask_sub_ph | vsubph | VSUBPH __m256h _mm256_mask_sub_ph (__m256h src, __mmask16 k, __m256h a, __m256h b); |
| _mm256_mask_sub_ps | subps | VSUBPS __m256 _mm256_mask_sub_ps (__m256 s, __mmask8 k, __m256 a, __m256 b); |
| _mm256_mask_subs_epi16 | psubsb | VPSUBSW __m256i _mm256_mask_subs_epi16(__m256i s, __mmask16 k, __m256i a, __m256i b); |
| _mm256_mask_subs_epi8 | psubsb | VPSUBSB __m256i _mm256_mask_subs_epi8(__m256i s, __mmask32 k, __m256i a, __m256i b); |
| _mm256_mask_subs_epu16 | psubusb | VPSUBUSW __m256i _mm256_mask_subs_epu16(__m256i s, __mmask16 k, __m256i a, __m256i b); |
| _mm256_mask_subs_epu8 | psubusb | VPSUBUSB __m256i _mm256_mask_subs_epu8(__m256i s, __mmask32 k, __m256i a, __m256i b); |
| _mm256_mask_ternarylogic_epi32 | vpternlogd | VPTERNLOGD __m256i _mm256_mask_ternarylogic_epi32(__m256i s, __mmask8 m, __m256i a, __m256i b, int imm); |
| _mm256_mask_ternarylogic_epi64 | vpternlogq | VPTERNLOGQ __m256i _mm256_mask_ternarylogic_epi64(__m256i s, __mmask8 m, __m256i a, __m256i b, int imm); |
| _mm256_mask_unpackhi_epi16 | punpckhbw | VPUNPCKHWD __m256i _mm256_mask_unpackhi_epi16(__m256i s, __mmask16 k, __m256i a, __m256i b); |
| _mm256_mask_unpackhi_epi32 | punpckhbw | VPUNPCKHDQ __m256i _mm256_mask_unpackhi_epi32(__m512i s, __mmask8 k, __m512i a, __m512i b); |
| _mm256_mask_unpackhi_epi64 | punpckhbw | VPUNPCKHQDQ __m256i _mm256_mask_unpackhi_epi64(__m512i s, __mmask8 k, __m512i a, __m512i b); |
| _mm256_mask_unpackhi_epi8 | punpckhbw | VPUNPCKHBW __m256i _mm256_mask_unpackhi_epi8(__m256i s, __mmask32 k, __m256i a, __m256i b); |
| _mm256_mask_unpackhi_pd | unpckhpd | VUNPCKHPD __m256d _mm256_mask_unpackhi_pd(__m256d s, __mmask8 k, __m256d a, __m256d b); |
| _mm256_mask_unpackhi_ps | unpckhps | VUNPCKHPS __m256 _mm256_mask_unpackhi_ps(__m256 s, __mmask8 k, __m256 a, __m256 b); |
| _mm256_mask_unpacklo_epi16 | punpcklbw | VPUNPCKLWD __m256i _mm256_mask_unpacklo_epi16(__m256i s, __mmask16 k, __m256i a, __m256i b); |
| _mm256_mask_unpacklo_epi32 | punpcklbw | VPUNPCKLDQ __m256i _mm256_mask_unpacklo_epi32(__m256i s, __mmask8 k, __m256i a, __m256i b); |
| _mm256_mask_unpacklo_epi64 | punpcklbw | VPUNPCKLQDQ __m256i _mm256_mask_unpacklo_epi64(__m256i s, __mmask8 k, __m256i a, __m256i b); |
| _mm256_mask_unpacklo_epi8 | punpcklbw | VPUNPCKLBW __m256i _mm256_mask_unpacklo_epi8(__m256i s, __mmask32 k, __m256i a, __m256i b); |
| _mm256_mask_unpacklo_pd | unpcklpd | VUNPCKLPD __m256d _mm256_mask_unpacklo_pd(__m256d s, __mmask8 k, __m256d a, __m256d b); |
| _mm256_mask_unpacklo_ps | unpcklps | VUNPCKLPS __m256 _mm256_mask_unpacklo_ps(__m256 s, __mmask8 k, __m256 a, __m256 b); |
| _mm256_mask_xor_epi32 | pxor | VPXORD __m256i _mm256_mask_xor_epi32(__m256i s, __mmask8 m, __m256i a, __m256i b) |
| _mm256_mask_xor_epi64 | pxor | VPXORQ __m256i _mm256_mask_xor_epi64(__m256i s, __mmask8 m, __m256i a, __m256i b); |
| _mm256_mask_xor_ps | xorps | VXORPS __m256 _mm256_mask_xor_ps (__m256 a, __mmask8 m, __m256 b); |
| _mm256_maskload_pd | vmaskmovpd | __m256d _mm256_maskload_pd(double *a, __m256i mask); |
| _mm256_maskload_ps | vmaskmovps | __m256 _mm256_maskload_ps(float const *a, __m256i mask) |
| _mm256_maskstore_pd | vmaskmovpd | void _mm256_maskstore_pd(double *a, __m256i mask, __m256d b); |
| _mm256_maskstore_ps | vmaskmovps | void _mm256_maskstore_ps(float *a, __m256i mask, __m256 b) |
| _mm256_maskz_abs_epi16 | pabsb | VPABSW__m256i _mm256_maskz_abs_epi16 (__mmask16 m, __m256i a) |
| _mm256_maskz_abs_epi32 | vpabsd | VPABSD __m256i _mm256_maskz_abs_epi32( __mmask8 k, __m256i a); |
| _mm256_maskz_abs_epi64 | vpabsq | VPABSQ __m256i _mm256_maskz_abs_epi64( __mmask8 k, __m256i a); |
| _mm256_maskz_abs_epi8 | pabsb | VPABSB__m256i _mm256_maskz_abs_epi8 (__mmask32 m, __m256i a) |
| _mm256_maskz_add_epi16 | paddb | VPADDW__m256i _mm256_maskz_add_epi16 (__mmask16 m, __m256i a, __m256i b) |
| _mm256_maskz_add_epi32 | vpaddd | VPADDD __m256i _mm256_maskz_add_epi32( __mmask8 k, __m256i a, __m256i b); |
| _mm256_maskz_add_epi64 | paddb | VPADDQ __m256i _mm256_maskz_add_epi64( __mmask8 k, __m256i a, __m256i b); |
| _mm256_maskz_add_epi8 | paddb | VPADDB__m256i _mm256_maskz_add_epi8 (__mmask32 m, __m256i a, __m256i b) |
| _mm256_maskz_add_pd | addpd | VADDPD __m256d _mm256_maskz_add_pd (__mmask8 k, __m256d a, __m256d b); |
| _mm256_maskz_add_ph | vaddph | VADDPH __m256h _mm256_maskz_add_ph (__mmask16 k, __m256h a, __m256h b); |
| _mm256_maskz_add_ps | vaddps | VADDPS __m256 _mm256_maskz_add_ps (__mmask8 k, __m256 a, __m256 b); |