Instruction
VMOVAPS
Moves packed singles between registers and memory that must be aligned to the vector size.
- Extensions
- Forms
- 17 (8 VEX, 9 EVEX)
- Data
- Intel XED v2026.08.23
Forms
| Instruction | Encoding | Requires |
|---|---|---|
VMOVAPS xmm, m128
VMOVAPS_XMMdq_MEMdq | VEX.128.NP.0F.WIG 28 /r | AVX |
VMOVAPS xmm, xmm
VMOVAPS_XMMdq_XMMdq_28 | VEX.128.NP.0F.WIG 28 /r | AVX |
VMOVAPS m128, xmm
VMOVAPS_MEMdq_XMMdq | VEX.128.NP.0F.WIG 29 /r | AVX |
VMOVAPS xmm, xmm
VMOVAPS_XMMdq_XMMdq_29 | VEX.128.NP.0F.WIG 29 /r | AVX |
VMOVAPS ymm, m256
VMOVAPS_YMMqq_MEMqq | VEX.256.NP.0F.WIG 28 /r | AVX |
VMOVAPS ymm, ymm
VMOVAPS_YMMqq_YMMqq_28 | VEX.256.NP.0F.WIG 28 /r | AVX |
VMOVAPS m256, ymm
VMOVAPS_MEMqq_YMMqq | VEX.256.NP.0F.WIG 29 /r | AVX |
VMOVAPS ymm, ymm
VMOVAPS_YMMqq_YMMqq_29 | VEX.256.NP.0F.WIG 29 /r | AVX |
VMOVAPS zmm {k}{z}, zmm
VMOVAPS_ZMMf32_MASKmskw_ZMMf32_AVX512 | EVEX.512.NP.0F.W0 28 /rEVEX.512.NP.0F.W0 29 /r | AVX10.1 or AVX512F |
VMOVAPS zmm {k}{z}, m512
VMOVAPS_ZMMf32_MASKmskw_MEMf32_AVX512 | EVEX.512.NP.0F.W0 28 /r | AVX10.1 or AVX512F |
VMOVAPS m512 {k}, zmm
VMOVAPS_MEMf32_MASKmskw_ZMMf32_AVX512 | EVEX.512.NP.0F.W0 29 /r | AVX10.1 or AVX512F |
VMOVAPS xmm {k}{z}, xmm
VMOVAPS_XMMf32_MASKmskw_XMMf32_AVX512 | EVEX.128.NP.0F.W0 28 /rEVEX.128.NP.0F.W0 29 /r | AVX10.1 or AVX512F + AVX512VL |
VMOVAPS xmm {k}{z}, m128
VMOVAPS_XMMf32_MASKmskw_MEMf32_AVX512 | EVEX.128.NP.0F.W0 28 /r | AVX10.1 or AVX512F + AVX512VL |
VMOVAPS m128 {k}, xmm
VMOVAPS_MEMf32_MASKmskw_XMMf32_AVX512 | EVEX.128.NP.0F.W0 29 /r | AVX10.1 or AVX512F + AVX512VL |
VMOVAPS ymm {k}{z}, ymm
VMOVAPS_YMMf32_MASKmskw_YMMf32_AVX512 | EVEX.256.NP.0F.W0 28 /rEVEX.256.NP.0F.W0 29 /r | AVX10.1 or AVX512F + AVX512VL |
VMOVAPS ymm {k}{z}, m256
VMOVAPS_YMMf32_MASKmskw_MEMf32_AVX512 | EVEX.256.NP.0F.W0 28 /r | AVX10.1 or AVX512F + AVX512VL |
VMOVAPS m256 {k}, ymm
VMOVAPS_MEMf32_MASKmskw_YMMf32_AVX512 | EVEX.256.NP.0F.W0 29 /r | AVX10.1 or AVX512F + AVX512VL |
Intrinsics
The C intrinsics of Clang 23.1.2 that compile to VMOVAPS, each with the form it compiles to and the Clang options it needs. The forms come from compiling every intrinsic and decoding the result with Intel XED; all intrinsics A–Z explains the method.
| Intrinsic | Compiles to |
|---|---|
_mm_load_pbh
__m128bh _mm_load_pbh(const void *__p) |
|
_mm_load_ph
__m128h _mm_load_ph(const void *__p) |
|
_mm_load_ps
__m128 _mm_load_ps(const float *__p) |
|
_mm_store_pbh
void _mm_store_pbh(void *__P, __m128bh __A) |
|
_mm_store_ph
void _mm_store_ph(void *__P, __m128h __A) |
|
_mm_store_ps
void _mm_store_ps(float *__p, __m128 __a) |
|
_mm_store_si128
void _mm_store_si128(__m128i *__p, __m128i __b) |
|
_mm_mask_blend_ps
__m128 _mm_mask_blend_ps(__mmask8 __U, __m128 __A, __m128 __W) |
|
_mm_mask_load_ps
__m128 _mm_mask_load_ps(__m128 __W, __mmask8 __U, const void *__P) |
|
_mm_mask_mov_ps
__m128 _mm_mask_mov_ps(__m128 __W, __mmask8 __U, __m128 __A) |
|
_mm_mask_store_ps
void _mm_mask_store_ps(void *__P, __mmask8 __U, __m128 __A) |
|
_mm_maskz_load_ps
__m128 _mm_maskz_load_ps(__mmask8 __U, const void *__P) |
|
_mm_maskz_mov_ps
__m128 _mm_maskz_mov_ps(__mmask8 __U, __m128 __A) |
|
_mm256_load_pbh
__m256bh _mm256_load_pbh(const void *__p) |
|
_mm256_load_ph
__m256h _mm256_load_ph(const void *__p) |
|
_mm256_load_ps
__m256 _mm256_load_ps(const float *__p) |
|
_mm256_store_pbh
void _mm256_store_pbh(void *__P, __m256bh __A) |
|
_mm256_store_ph
void _mm256_store_ph(void *__P, __m256h __A) |
|
_mm256_store_ps
void _mm256_store_ps(float *__p, __m256 __a) |
|
_mm256_mask_blend_ps
__m256 _mm256_mask_blend_ps(__mmask8 __U, __m256 __A, __m256 __W) |
|
_mm256_mask_load_ps
__m256 _mm256_mask_load_ps(__m256 __W, __mmask8 __U, const void *__P) |
|
_mm256_mask_mov_ps
__m256 _mm256_mask_mov_ps(__m256 __W, __mmask8 __U, __m256 __A) |
|
_mm256_mask_store_ps
void _mm256_mask_store_ps(void *__P, __mmask8 __U, __m256 __A) |
|
_mm256_maskz_load_ps
__m256 _mm256_maskz_load_ps(__mmask8 __U, const void *__P) |
|
_mm256_maskz_mov_ps
__m256 _mm256_maskz_mov_ps(__mmask8 __U, __m256 __A) |
|
_mm512_load_pbh
__m512bh _mm512_load_pbh(const void *__p) |
|
_mm512_load_ph
__m512h _mm512_load_ph(const void *__p) |
|
_mm512_load_ps
__m512 _mm512_load_ps(const void *__p) |
|
_mm512_store_pbh
void _mm512_store_pbh(void *__P, __m512bh __A) |
|
_mm512_store_ph
void _mm512_store_ph(void *__P, __m512h __A) |
|
_mm512_store_ps
void _mm512_store_ps(void *__P, __m512 __A) |
|
_mm512_mask_blend_ps
__m512 _mm512_mask_blend_ps(__mmask16 __U, __m512 __A, __m512 __W) |
|
_mm512_mask_load_ps
__m512 _mm512_mask_load_ps(__m512 __W, __mmask16 __U, const void *__P) |
|
_mm512_mask_mov_ps
__m512 _mm512_mask_mov_ps(__m512 __W, __mmask16 __U, __m512 __A) |
|
_mm512_mask_store_ps
void _mm512_mask_store_ps(void *__P, __mmask16 __U, __m512 __A) |
|
_mm512_maskz_load_ps
__m512 _mm512_maskz_load_ps(__mmask16 __U, const void *__P) |
|
_mm512_maskz_mov_ps
__m512 _mm512_maskz_mov_ps(__mmask16 __U, __m512 __A) |
|
CPUID and processors
Each form belongs to an XED ISA set. A form can be used when the processor reports every CPUID bit of one of its ISA set's alternatives.
More AVX10.1 instructions
- VINSERTF64X2
- VINSERTF64X4
- VINSERTI32X4
- VINSERTI32X8
- VINSERTI64X2
- VINSERTI64X4
- VINSERTPS
- VMAXPD
- VMAXPH
- VMAXPS
- VMAXSD
- VMAXSH
- VMAXSS
- VMINPD
- VMINPH
- VMINPS
- VMINSD
- VMINSH
- VMINSS
- VMOVAPD
- VMOVD
- VMOVDDUP
- VMOVDQA32
- VMOVDQA64
- VMOVDQU16
- VMOVDQU32
- VMOVDQU64
- VMOVDQU8
- VMOVHLPS
- VMOVHPD
- VMOVHPS
- VMOVLHPS
- VMOVLPD
- VMOVLPS
- VMOVNTDQ
- VMOVNTDQA
- VMOVNTPD
- VMOVNTPS
- VMOVQ
- VMOVSD
Sources
- Intel XED v2026.08.23 (commit
0bcb6237345c): forms, encodings, ISA sets, CPUID bits and chip model. - Clang's x86 intrinsic headers, LLVM 23.1.2 (commit
85ac56026243): the intrinsics, their signatures and doc comments, and the Clang of that release, which compiled each of them. - Intel Advanced Vector Extensions 10.2 Architecture Specification, revision 6.0 (361050-006, January 2026)
The tables are derived from Intel XED, Copyright Intel Corporation, licensed under the Apache License 2.0; x86-64.net converted and reformatted them. The intrinsics and their signatures come from Clang, part of the LLVM Project, licensed under the Apache License 2.0 with LLVM Exceptions. The text is our own.