Instruction
VMOVAPD
Moves packed doubles between registers and memory that must be aligned to the vector size.
- Extensions
- Forms
- 17 (8 VEX, 9 EVEX)
- Data
- Intel XED v2026.08.23
Forms
| Instruction | Encoding | Requires |
|---|---|---|
VMOVAPD xmm, m128
VMOVAPD_XMMdq_MEMdq | VEX.128.66.0F.WIG 28 /r | AVX |
VMOVAPD xmm, xmm
VMOVAPD_XMMdq_XMMdq_28 | VEX.128.66.0F.WIG 28 /r | AVX |
VMOVAPD m128, xmm
VMOVAPD_MEMdq_XMMdq | VEX.128.66.0F.WIG 29 /r | AVX |
VMOVAPD xmm, xmm
VMOVAPD_XMMdq_XMMdq_29 | VEX.128.66.0F.WIG 29 /r | AVX |
VMOVAPD ymm, m256
VMOVAPD_YMMqq_MEMqq | VEX.256.66.0F.WIG 28 /r | AVX |
VMOVAPD ymm, ymm
VMOVAPD_YMMqq_YMMqq_28 | VEX.256.66.0F.WIG 28 /r | AVX |
VMOVAPD m256, ymm
VMOVAPD_MEMqq_YMMqq | VEX.256.66.0F.WIG 29 /r | AVX |
VMOVAPD ymm, ymm
VMOVAPD_YMMqq_YMMqq_29 | VEX.256.66.0F.WIG 29 /r | AVX |
VMOVAPD zmm {k}{z}, zmm
VMOVAPD_ZMMf64_MASKmskw_ZMMf64_AVX512 | EVEX.512.66.0F.W1 28 /rEVEX.512.66.0F.W1 29 /r | AVX10.1 or AVX512F |
VMOVAPD zmm {k}{z}, m512
VMOVAPD_ZMMf64_MASKmskw_MEMf64_AVX512 | EVEX.512.66.0F.W1 28 /r | AVX10.1 or AVX512F |
VMOVAPD m512 {k}, zmm
VMOVAPD_MEMf64_MASKmskw_ZMMf64_AVX512 | EVEX.512.66.0F.W1 29 /r | AVX10.1 or AVX512F |
VMOVAPD xmm {k}{z}, xmm
VMOVAPD_XMMf64_MASKmskw_XMMf64_AVX512 | EVEX.128.66.0F.W1 28 /rEVEX.128.66.0F.W1 29 /r | AVX10.1 or AVX512F + AVX512VL |
VMOVAPD xmm {k}{z}, m128
VMOVAPD_XMMf64_MASKmskw_MEMf64_AVX512 | EVEX.128.66.0F.W1 28 /r | AVX10.1 or AVX512F + AVX512VL |
VMOVAPD m128 {k}, xmm
VMOVAPD_MEMf64_MASKmskw_XMMf64_AVX512 | EVEX.128.66.0F.W1 29 /r | AVX10.1 or AVX512F + AVX512VL |
VMOVAPD ymm {k}{z}, ymm
VMOVAPD_YMMf64_MASKmskw_YMMf64_AVX512 | EVEX.256.66.0F.W1 28 /rEVEX.256.66.0F.W1 29 /r | AVX10.1 or AVX512F + AVX512VL |
VMOVAPD ymm {k}{z}, m256
VMOVAPD_YMMf64_MASKmskw_MEMf64_AVX512 | EVEX.256.66.0F.W1 28 /r | AVX10.1 or AVX512F + AVX512VL |
VMOVAPD m256 {k}, ymm
VMOVAPD_MEMf64_MASKmskw_YMMf64_AVX512 | EVEX.256.66.0F.W1 29 /r | AVX10.1 or AVX512F + AVX512VL |
Intrinsics
The C intrinsics of Clang 23.1.2 that compile to VMOVAPD, each with the form it compiles to and the Clang options it needs. The forms come from compiling every intrinsic and decoding the result with Intel XED; all intrinsics A–Z explains the method.
| Intrinsic | Compiles to |
|---|---|
_mm_load_pd
__m128d _mm_load_pd(const double *__dp) |
|
_mm_store_pd
void _mm_store_pd(double *__dp, __m128d __a) |
|
_mm_mask_blend_pd
__m128d _mm_mask_blend_pd(__mmask8 __U, __m128d __A, __m128d __W) |
|
_mm_mask_load_pd
__m128d _mm_mask_load_pd(__m128d __W, __mmask8 __U, const void *__P) |
|
_mm_mask_mov_pd
__m128d _mm_mask_mov_pd(__m128d __W, __mmask8 __U, __m128d __A) |
|
_mm_mask_permute_pd
__m128d _mm_mask_permute_pd(__m128d W, __mmask8 U, __m128d X, const int C) |
|
_mm_mask_store_pd
void _mm_mask_store_pd(void *__P, __mmask8 __U, __m128d __A) |
|
_mm_maskz_load_pd
__m128d _mm_maskz_load_pd(__mmask8 __U, const void *__P) |
|
_mm_maskz_mov_pd
__m128d _mm_maskz_mov_pd(__mmask8 __U, __m128d __A) |
|
_mm_maskz_permute_pd
__m128d _mm_maskz_permute_pd(__mmask8 U, __m128d X, const int C) |
|
_mm256_load_pd
__m256d _mm256_load_pd(const double *__p) |
|
_mm256_store_pd
void _mm256_store_pd(double *__p, __m256d __a) |
|
_mm256_mask_blend_pd
__m256d _mm256_mask_blend_pd(__mmask8 __U, __m256d __A, __m256d __W) |
|
_mm256_mask_load_pd
__m256d _mm256_mask_load_pd(__m256d __W, __mmask8 __U, const void *__P) |
|
_mm256_mask_mov_pd
__m256d _mm256_mask_mov_pd(__m256d __W, __mmask8 __U, __m256d __A) |
|
_mm256_mask_store_pd
void _mm256_mask_store_pd(void *__P, __mmask8 __U, __m256d __A) |
|
_mm256_maskz_load_pd
__m256d _mm256_maskz_load_pd(__mmask8 __U, const void *__P) |
|
_mm256_maskz_mov_pd
__m256d _mm256_maskz_mov_pd(__mmask8 __U, __m256d __A) |
|
_mm512_load_pd
__m512d _mm512_load_pd(const void *__p) |
|
_mm512_store_pd
void _mm512_store_pd(void *__P, __m512d __A) |
|
_mm512_mask_blend_pd
__m512d _mm512_mask_blend_pd(__mmask8 __U, __m512d __A, __m512d __W) |
|
_mm512_mask_load_pd
__m512d _mm512_mask_load_pd(__m512d __W, __mmask8 __U, const void *__P) |
|
_mm512_mask_mov_pd
__m512d _mm512_mask_mov_pd(__m512d __W, __mmask8 __U, __m512d __A) |
|
_mm512_mask_store_pd
void _mm512_mask_store_pd(void *__P, __mmask8 __U, __m512d __A) |
|
_mm512_maskz_load_pd
__m512d _mm512_maskz_load_pd(__mmask8 __U, const void *__P) |
|
_mm512_maskz_mov_pd
__m512d _mm512_maskz_mov_pd(__mmask8 __U, __m512d __A) |
|
CPUID and processors
Each form belongs to an XED ISA set. A form can be used when the processor reports every CPUID bit of one of its ISA set's alternatives.
More AVX10.1 instructions
- VINSERTF32X8
- VINSERTF64X2
- VINSERTF64X4
- VINSERTI32X4
- VINSERTI32X8
- VINSERTI64X2
- VINSERTI64X4
- VINSERTPS
- VMAXPD
- VMAXPH
- VMAXPS
- VMAXSD
- VMAXSH
- VMAXSS
- VMINPD
- VMINPH
- VMINPS
- VMINSD
- VMINSH
- VMINSS
- VMOVAPS
- VMOVD
- VMOVDDUP
- VMOVDQA32
- VMOVDQA64
- VMOVDQU16
- VMOVDQU32
- VMOVDQU64
- VMOVDQU8
- VMOVHLPS
- VMOVHPD
- VMOVHPS
- VMOVLHPS
- VMOVLPD
- VMOVLPS
- VMOVNTDQ
- VMOVNTDQA
- VMOVNTPD
- VMOVNTPS
- VMOVQ
Sources
- Intel XED v2026.08.23 (commit
0bcb6237345c): forms, encodings, ISA sets, CPUID bits and chip model. - Clang's x86 intrinsic headers, LLVM 23.1.2 (commit
85ac56026243): the intrinsics, their signatures and doc comments, and the Clang of that release, which compiled each of them. - Intel Advanced Vector Extensions 10.2 Architecture Specification, revision 6.0 (361050-006, January 2026)
The tables are derived from Intel XED, Copyright Intel Corporation, licensed under the Apache License 2.0; x86-64.net converted and reformatted them. The intrinsics and their signatures come from Clang, part of the LLVM Project, licensed under the Apache License 2.0 with LLVM Exceptions. The text is our own.