x86 Compiler Intrinsics
3623 intrinsics from the Intel® SDM, each mapped to the instruction it compiles to - page 5 of 37, alphabetical. The global search in the top nav also matches intrinsic names directly.
| Intrinsic | Instruction | Signature |
|---|---|---|
| _mm256_mask_gf2p8mul_epi8 | gf2p8mulb | VGF2P8MULB __m256i _mm256_mask_gf2p8mul_epi8(__m256i, __mmask32, __m256i, __m256i); |
| _mm256_mask_i32scatter_pd | vscatterdpd | VSCATTERDPD void _mm256_mask_i32scatter_pd(void * base, __mmask8 k, __m256i vdx, __m256d a, int scale); |
| _mm256_mask_i32scatter_ps | vscatterdps | VSCATTERDPS void _mm256_mask_i32scatter_ps(void * base, __mmask8 k, __m256i vdx, __m256 a, int scale); |
| _mm256_mask_i64gather_epi32lo | vpgatherqd | VPGATHERQD __m128i _mm256_mask_i64gather_epi32lo(__m128i s, __mmask8 k, __m256i vdx, void * base, int scale); |
| _mm256_mask_i64gather_epi64 | vpgatherqq | VPGATHERQQ __m256i _mm256_mask_i64gather_epi64(__m256i s, __mmask8 k, __m256i vdx, void * base, int scale); |
| _mm256_mask_i64scatter_pd | vscatterqpd | VSCATTERQPD void _mm256_mask_i64scatter_pd(void * base, __mmask8 k, __m256i vdx, __m256d a, int scale); |
| _mm256_mask_i64scatter_ps | vscatterqps | VSCATTERQPS void _mm256_mask_i64scatter_ps(void * base, __mmask8 k, __m256i vdx, __m256 a, int scale); |
| _mm256_mask_insertf32x4 | vinsertf128 | VINSERTF32x4 __m256 _mm256_mask_insertf32x4(__m256 s, __mmask8 k, __m256 a, __m128 b, int imm); |
| _mm256_mask_insertf64x2 | vinsertf128 | VINSERTF64x2 __m256d _mm256_mask_insertf64x2(__m256d s, __mmask8 k, __m256d a, __m128d b, int imm); |
| _mm256_mask_inserti32x4 | vinserti128 | VINSERTI32x4 __m256i _mm256_mask_inserti32x4(__m256i s, __mmask8 k, __m256i a, __m128i b, int imm); |
| _mm256_mask_inserti64x2 | vinserti128 | VINSERTI64x2 __m256i _mm256_mask_inserti64x2(__m256i s, __mmask8 k, __m256i a, __m128i b, int imm); |
| _mm256_mask_load_epi32 | movdqa | VMOVDQA32 __m256i _mm256_mask_load_epi32(__m256i s, __mmask8 k, void * sa); |
| _mm256_mask_load_epi64 | movdqa | VMOVDQA64 __m256i _mm256_mask_load_epi64(__m256i s, __mmask8 k, void * sa); |
| _mm256_mask_load_pd | movapd | VMOVAPD __m256d _mm256_mask_load_pd(__m256d s, __mmask8 k, void * m); |
| _mm256_mask_load_ps | movaps | VMOVAPS __m256 _mm256_mask_load_ps(__m256 a, __mmask8 k, void * s); |
| _mm256_mask_loadu_epi16 | movdqu | VMOVDQU16 __m256i _mm256_mask_loadu_epi16(__m256i s, __mmask16 k, void * sa); |
| _mm256_mask_loadu_epi32 | movdqu | VMOVDQU32 __m256i _mm256_mask_loadu_epi32(__m256i s, __mmask8 k, void * sa); |
| _mm256_mask_loadu_epi64 | movdqu | VMOVDQU64 __m256i _mm256_mask_loadu_epi64(__m256i s, __mmask8 k, void * sa); |
| _mm256_mask_loadu_epi8 | movdqu | VMOVDQU8 __m256i _mm256_mask_loadu_epi8(__m256i s, __mmask32 k, void * sa); |
| _mm256_mask_loadu_pd | movupd | VMOVUPD __m256d _mm256_mask_loadu_pd(__m256d s, __mmask8 k, void * m); |
| _mm256_mask_loadu_ps | movups | VMOVUPS __m256 _mm256_mask_loadu_ps(__m256 a, __mmask8 k, void * s); |
| _mm256_mask_lzcnt_epi32 | vplzcntd | VPLZCNTD __m256i _mm256_mask_lzcnt_epi32(__m256i s, __mmask8 m, __m256i a); |
| _mm256_mask_lzcnt_epi64 | vplzcntq | VPLZCNTQ __m256i _mm256_mask_lzcnt_epi64(__m256i s, __mmask8 m, __m256i a); |
| _mm256_mask_madd52hi_epu64 | vpmadd52huq | VPMADD52HUQ __m256i _mm256_mask_madd52hi_epu64(__m256i s, __mmask8 k, __m256i a, __m256i b, __m256i c); |
| _mm256_mask_madd52lo_epu64 | vpmadd52luq | VPMADD52LUQ __m256i _mm256_mask_madd52lo_epu64(__m256i s, __mmask8 k, __m256i a, __m256i b, __m256i c); |
| _mm256_mask_madd_epi16 | pmaddwd | VPMADDWD __m256i _mm256_mask_madd_epi16(__m256i s, __mmask16 k, __m256i a, __m256i b); |
| _mm256_mask_maddubs_epi16 | pmaddubsw | VPMADDUBSW __m256i _mm256_mask_maddubs_epi16(__m256i s, __mmask16 k, __m256i a, __m256i b); |
| _mm256_mask_max_epi16 | pmaxsb | VPMAXSW __m256i _mm256_mask_max_epi16(__m256i s, __mmask16 k, __m256i a, __m256i b); |
| _mm256_mask_max_epi32 | pmaxsb | VPMAXSD __m256i _mm256_mask_max_epi32(__m256i s, __mmask16 k, __m256i a, __m256i b); |
| _mm256_mask_max_epi64 | vpmaxsq | VPMAXSQ __m256i _mm256_mask_max_epi64(__m256i s, __mmask8 k, __m256i a, __m256i b); |
| _mm256_mask_max_epi8 | pmaxsb | VPMAXSB __m256i _mm256_mask_max_epi8(__m256i s, __mmask32 k, __m256i a, __m256i b); |
| _mm256_mask_max_epu16 | pmaxuw | VPMAXUW __m256i _mm256_mask_max_epu16(__m256i s, __mmask16 k, __m256i a, __m256i b); |
| _mm256_mask_max_epu32 | pmaxud | VPMAXUD __m256i _mm256_mask_max_epu32(__m256i s, __mmask16 k, __m256i a, __m256i b); |
| _mm256_mask_max_epu64 | vpmaxuq | VPMAXUQ __m256i _mm256_mask_max_epu64(__m256i s, __mmask8 k, __m256i a, __m256i b); |
| _mm256_mask_max_epu8 | pmaxuw | VPMAXUB __m256i _mm256_mask_max_epu8(__m256i s, __mmask32 k, __m256i a, __m256i b); |
| _mm256_mask_max_ph | vmaxph | VMAXPH __m256h _mm256_mask_max_ph (__m256h src, __mmask16 k, __m256h a, __m256h b); |
| _mm256_mask_max_ps | maxps | VMAXPS __m256 _mm256_mask_max_ps(__m256 s, __mmask8 k, __m256 a, __m256 b); |
| _mm256_mask_min_epi16 | pminsb | VPMINSW __m256i _mm256_mask_min_epi16(__m256i s, __mmask16 k, __m256i a, __m256i b); |
| _mm256_mask_min_epi32 | pminsd | VPMINSD __m256i _mm256_mask_min_epi32(__m256i s, __mmask16 k, __m256i a, __m256i b); |
| _mm256_mask_min_epi64 | vpminsq | VPMINSQ __m256i _mm256_mask_min_epi64(__m256i s, __mmask8 k, __m256i a, __m256i b); |
| _mm256_mask_min_epi8 | pminsb | VPMINSB __m256i _mm256_mask_min_epi8(__m256i s, __mmask32 k, __m256i a, __m256i b); |
| _mm256_mask_min_epu16 | pminuw | VPMINUW __m256i _mm256_mask_min_epu16(__m256i s, __mmask16 k, __m256i a, __m256i b); |
| _mm256_mask_min_epu32 | pminud | VPMINUD __m256i _mm256_mask_min_epu32(__m256i s, __mmask16 k, __m256i a, __m256i b); |
| _mm256_mask_min_epu64 | vpminuq | VPMINUQ __m256i _mm256_mask_min_epu64(__m256i s, __mmask8 k, __m256i a, __m256i b); |
| _mm256_mask_min_epu8 | pminuw | VPMINUB __m256i _mm256_mask_min_epu8(__m256i s, __mmask32 k, __m256i a, __m256i b); |
| _mm256_mask_min_ph | vminph | VMINPH __m256h _mm256_mask_min_ph (__m256h src, __mmask16 k, __m256h a, __m256h b); |
| _mm256_mask_min_ps | minps | VMINPS __m256 _mm256_mask_min_ps(__m256 s, __mmask8 k, __m256 a, __m256 b); |
| _mm256_mask_movedup_pd | movddup | VMOVDDUP __m256d _mm256_mask_movedup_pd(__m256d s, __mmask8 k, __m256d a); |
| _mm256_mask_movehdup_ps | movshdup | VMOVSHDUP __m256 _mm256_mask_movehdup_ps(__m256 s, __mmask8 k, __m256 a); |
| _mm256_mask_moveldup_ps | movsldup | VMOVSLDUP __m256 _mm256_mask_moveldup_ps(__m256 s, __mmask8 k, __m256 a); |
| _mm256_mask_mul_epu32 | pmuludq | VPMULUDQ __m256i _mm256_mask_mul_epu32(__m256i s, __mmask8 k, __m256i a, __m256i b); |
| _mm256_mask_mul_ph | vmulph | VMULPH __m256h _mm256_mask_mul_ph (__m256h src, __mmask16 k, __m256h a, __m256h b); |
| _mm256_mask_mul_ps | vmulps | VMULPS __m256 _mm256_mask_mul_ps(__m256 s, __mmask8 k, __m256 a, __m256 b); |
| _mm256_mask_mulhi_epi16 | pmulhw | VPMULHW __m256i _mm256_mask_mulhi_epi16(__m256i s, __mmask16 k, __m256i a, __m256i b); |
| _mm256_mask_mulhi_epu16 | pmulhuw | VPMULHUW __m256i _mm256_mask_mulhi_epu16(__m256i s, __mmask16 k, __m256i a, __m256i b); |
| _mm256_mask_mulhrs_epi16 | pmulhrsw | VPMULHRSW __m256i _mm256_mask_mulhrs_epi16(__m256i s, __mmask16 k, __m256i a, __m256i b); |
| _mm256_mask_mullo_epi16 | pmullw | VPMULLW __m256i _mm256_mask_mullo_epi16(__m256i s, __mmask16 k, __m256i a, __m256i b); |
| _mm256_mask_mullo_epi32 | vpmulld | VPMULLD __m256i _mm256_mask_mullo_epi32(__m256i s, __mmask8 k, __m256i a, __m256i b); |
| _mm256_mask_mullo_epi64 | vpmullq | VPMULLQ __m256i _mm256_mask_mullo_epi64(__m256i s, __mmask8 k, __m256i a, __m256i b); |
| _mm256_mask_multishift_epi64_epi8 | vpmultishiftqb | VPMULTISHIFTQB __m256i _mm256_mask_multishift_epi64_epi8(__m256i s, __mmask32 k, __m256i a, __m256i b); |
| _mm256_mask_or_epi32 | por | VPORD __m256i _mm256_mask_or_epi32(__m256i s, __mmask8 k, __m256i a, __m256i b,); |
| _mm256_mask_or_epi64 | por | VPORQ __m256i _mm256_mask_or_epi64(__m256i s, __mmask8 k, __m256i a, __m256i b); |
| _mm256_mask_or_ps | orps | VORPS __m256 _mm256_mask_or_ps (__m256 s, ___mmask8 k, __m256 a, __m256 b); |
| _mm256_mask_packs_epi16 | packsswb | VPACKSSWB__m256i _mm256_mask_packs_epi16( __m256i s, __mmask16 k, __m256i m1, __m256i m2); |
| _mm256_mask_packs_epi32 | packsswb | VPACKSSDW__m256i _mm256_mask_packs_epi32( __m256i s, __mmask16 k, __m256i m1, __m256i m2); |
| _mm256_mask_packus_epi16 | packuswb | VPACKUSWB __m256i _mm256_mask_packus_epi16(__m256i s, __mmask32 k, __m256i m1, __m256i m2); |
| _mm256_mask_packus_epi32 | packusdw | VPACKUSDW__m256i _mm256_mask_packus_epi32( __m256i s, __mmask16 k, __m256i m1, __m256i m2); |
| _mm256_mask_permute_pd | vpermilpd | VPERMILPD __m256d _mm256_mask_permute_pd(__m256d s, __mmask8 k, __m256d a, int imm); |
| _mm256_mask_permute_ps | vpermilps | VPERMILPS __m256 _mm256_mask_permute_ps(__m256 s, __mmask8 k, __m256 a, int imm); |
| _mm256_mask_permutevar_pd | vpermilpd | VPERMILPD __m256d _mm256_mask_permutevar_pd(__m256d s, __mmask8 k, __m256d i, __m256d a); |
| _mm256_mask_permutevar_ps | vpermilps | VPERMILPS __m256 _mm256_mask_permutevar_ps(__m256 s, __mmask8 k, __m256 i, __m256 a); |
| _mm256_mask_permutex2var_epi16 | vpermi2q | VPERMI2W __m256i _mm256_mask_permutex2var_epi16(__m256i a, __mmask16 k, __m256i idx, __m256i b); |
| _mm256_mask_permutex2var_epi32 | vpermi2d | VPERMI2D __m256i _mm256_mask_permutex2var_epi32(__m256i a, __mmask8 k, __m256i idx, __m256i b); |
| _mm256_mask_permutex2var_epi64 | vpermi2q | VPERMI2Q __m256i _mm256_mask_permutex2var_epi64(__m256i a, __mmask8 k, __m256i idx, __m256i b); |
| _mm256_mask_permutex2var_epi8 | vpermt2b | VPERMT2B __m256i _mm256_mask_permutex2var_epi8(__m256i a, __mmask32 k, __m256i idx, __m256i b); |
| _mm256_mask_permutex2var_pd | vpermi2q | VPERMI2PD __m256d _mm256_mask_permutex2var_pd(__m256d a, __mmask8 k, __m256i idx, __m256d b); |
| _mm256_mask_permutex2var_ps | vpermi2q | VPERMI2PS __m256 _mm256_mask_permutex2var_ps(__m256 a, __mmask8 k, __m256i idx, __m256 b); |
| _mm256_mask_permutex_epi64 | vpermq | VPERMQ __m256i _mm256_mask_permutex_epi64(__m256i s, __mmask8 k, __m256i a, int imm); |
| _mm256_mask_permutexvar_epi16 | vpermw | VPERMW __m256i _mm256_mask_permutexvar_epi16(__m256i s, __mmask16 k, __m256i idx, __m256i a); |
| _mm256_mask_permutexvar_epi32 | vpermd | VPERMD __m256i _mm256_mask_permutexvar_epi32(__m256i s, __mmask8 k, __m256i idx, __m256i a); |
| _mm256_mask_permutexvar_epi64 | vpermq | VPERMQ __m256i _mm256_mask_permutexvar_epi64(__m256i s, __mmask8 k, __m256i a, __m256i b); |
| _mm256_mask_permutexvar_epi8 | vpermb | VPERMB __m256i _mm256_mask_permutexvar_epi8(__m256i s, __mmask32 k, __m256i idx, __m256i a); |
| _mm256_mask_permutexvar_ps | vpermps | VPERMPS __m256 _mm256_mask_permutexvar_ps(__m256 s, __mmask8 k, __m256 i, __m256 a); |
| _mm256_mask_popcnt_epi16 | vpopcntw | VPOPCNTW __m256i _mm256_mask_popcnt_epi16(__m256i, __mmask16, __m256i); |
| _mm256_mask_popcnt_epi32 | vpopcntd | VPOPCNTD __m256i _mm256_mask_popcnt_epi32(__m256i, __mmask8, __m256i); |
| _mm256_mask_popcnt_epi64 | vpopcntq | VPOPCNTQ __m256i _mm256_mask_popcnt_epi64(__m256i, __mmask8, __m256i); |
| _mm256_mask_popcnt_epi8 | vpopcntb | VPOPCNTB __m256i _mm256_mask_popcnt_epi8(__m256i, __mmask32, __m256i); |
| _mm256_mask_range_ps | vrangeps | VRANGEPS __m256 _mm256_mask_range_ps (__m256 s, __mmask8 k, __m256 a, __m256 b, int imm); |
| _mm256_mask_reduce_ps | vreduceps | VREDUCEPS __m256 _mm256_mask_reduce_ps( __m256 a, int imm) |
| _mm256_mask_rol_epi32 | vprolvq | VPROLD __m256i _mm256_mask_rol_epi32(__m256i a, __mmask8 k, __m256i b, int imm); |
| _mm256_mask_rol_epi64 | vprolq | VPROLQ __m256i _mm256_mask_rol_epi64(__m256i a, __mmask8 k, __m256i b, int imm); |
| _mm256_mask_rolv_epi32 | vprolvd | VPROLVD __m256i _mm256_mask_rolv_epi32(__m256i a, __mmask8 k, __m256i b, __m256i cnt); |
| _mm256_mask_rolv_epi64 | vprolvq | VPROLVQ __m256i _mm256_mask_rolv_epi64(__m256i a, __mmask8 k, __m256i b, __m256i cnt); |
| _mm256_mask_ror_epi32 | vprorvd | VPRORD __m256i _mm256_mask_ror_epi32(__m256i a, __mmask8 k, __m256i b, int imm); |
| _mm256_mask_ror_epi64 | vprorq | VPRORQ __m256i _mm256_mask_ror_epi64(__m256i a, __mmask8 k, __m256i b, int imm); |
| _mm256_mask_rorv_epi32 | vprorvd | VPRORVD __m256i _mm256_mask_rorv_epi32(__m256i a, __mmask8 k, __m256i b, __m256i cnt); |
| _mm256_mask_rorv_epi64 | vprorvq | VPRORVQ __m256i _mm256_mask_rorv_epi64(__m256i a, __mmask8 k, __m256i b, __m256i cnt); |
| _mm256_mask_roundscale_pd | vrndscalepd | VRNDSCALEPD __m256d _mm256_mask_roundscale_pd(__m256d s, __mmask8 k, __m256d a, int imm); |
| _mm256_mask_rsqrt14_ps | vrsqrt14ps | VRSQRT14PS __m256 _mm256_mask_rsqrt14_ps(__m256 s, __mmask8 k, __m256 a); |
| _mm256_mask_scalef_pd | vscalefpd | VSCALEFPD __m256d _mm256_mask_scalef_pd(__m256d s, __mmask8 k, __m256d a, __m256d b); |