PUNPCKLBW
/ VPUNPCKLBWInterleave low bytes
Interleave the lower eight bytes of each 128-bit lane from two inputs.
Similar operations on Arm64:ZIP1vzip1q_u8
| Form | Bits | Requires | Encoding |
|---|---|---|---|
PUNPCKLBW xmm1, xmm2 | 128 | SSE2 | 66 0F 60 /r |
VPUNPCKLBW xmm1, xmm2, xmm3 | 128 | AVX | VEX.L0.66.0F.WIG 60 /r |
VPUNPCKLBW ymm1, ymm2, ymm3 | 256 | AVX2 | VEX.L1.66.0F.WIG 60 /r |
Explore the operation
The interactive explorer is loading. The operation and reference details are available below.
Operation#
for each 128-bit lane:
dst[2*i] = a[i]
dst[2*i+1] = b[i] // i = 0…7Exact upstream semantics
Standard variant
let elements := 64 / element_size;
var result := Zero(64);
for i := 0 to elements-1 do
let j := i / 2;
if Is_Even(i) then
result[i *: element_size] := src1[j *: element_size];
else
result[i *: element_size] := src2[j *: element_size];
endif;
endfor;Standard variant
let elements := 64 / element_size;
var result := Zero(64);
for i := 0 to elements-1 do
let j := i / 2;
if Is_Even(i) then
result[i *: element_size] := src1[j *: element_size];
else
result[i *: element_size] := src2[j *: element_size];
endif;
endfor;Lane variant
let lanes := register_size / 128;
let elements := 128 / element_size;
var result := Zero(register_size);
for lane := 0 to lanes-1 do
let s1 := src1[lane *: 128];
let s2 := src2[lane *: 128];
var lane_result := Zero(128);
for i := 0 to elements-1 do
let j := i / 2;
let r := if Is_Even(i) then s1[j *: element_size] else s2[j *: element_size];
lane_result[i *: element_size] := r;
endfor;
result[lane *: 128] := lane_result;
endfor;What to watch for
- The upper half of each input lane is unused.
- The 256-bit form interleaves within each 128-bit lane.
Corresponding intrinsics#
__m128i _mm_unpacklo_epi8(__m128i a, __m128i b)Documented mapping
PUNPCKLBW xmm, xmm
Architectural details#
- Flags
- Arithmetic flags unchanged.
- Destination
- Writes the low 128 bits; upper vector-register bits are preserved.
- Encoding
66 0F 60 /r- Operands
xmm1read / writexmm2read
- Coverage
- Selected register-only 128/256-bit forms. Memory operands, MMX, and EVEX/AVX-512 forms are outside this sample.
Exception information & execution requirements
#NM#UD
Feature availability alone does not guarantee execution: OS state and execution-level controls also apply. Use the linked architecture documentation for the full exception conditions.
Sources & provenance#
Technical fields are imported from pinned upstream files. Explanations and explorer behavior are maintained separately.
Intel · PUNPCKLBW-PUNPCKLWD-PUNPCKLDQ-PUNPCKLQDQ-Unpack-Low-Data.xml
- Revision
4ebe7f0ac1bd00f46244c49bb72c503ce368def7- SHA-256
2ff28acc17f0735fc26077d2d713c94fb7f6f909761d2b41a1f294239b228f67- Terms
- Intel SDM terms; see License.md
Intel · intrinsics.xml
- Revision
4ebe7f0ac1bd00f46244c49bb72c503ce368def7- SHA-256
6762a50652a35ef663fd532ed83b789d19bbc2ac7e94b1771f19d666d96c2c30- Terms
- Intel SDM terms; see License.md