Skip to content

Connection missing static methods - #8

Merged
ManickaP merged 1 commit into
managed-quicfrom
mapichov/managed-quic-api
Sep 12, 2023
Merged

Connection missing static methods#8
ManickaP merged 1 commit into
managed-quicfrom
mapichov/managed-quic-api

Conversation

@ManickaP

Copy link
Copy Markdown
Owner

No description provided.

@ManickaP
ManickaP merged commit b8e0991 into managed-quicSep 12, 2023
@ManickaP
ManickaP deleted the mapichov/managed-quic-api branch September 12, 2023 14:29
ManickaP pushed a commit that referenced this pull request Jul 23, 2024
This transforms sequences like
```asm
ldr x0, [x1]
add x1, x1, #8
```
into the equivalent
```asm
ldr x0, [x1], #8
```
ManickaP pushed a commit that referenced this pull request Feb 10, 2026
…otnet#124193)
## Summary
Adds Azure CLI guidance to the ci-analysis skill for investigating AzDO
pipelines directly, reducing reliance on manual REST API construction.
## Changes
- **New section: "Deep Investigation with Azure CLI"**
- Auth checking: how to verify `az` is installed/authenticated, refresh
PATH on Windows, check `azure-devops` extension
- Pipeline querying: `az pipelines list`, `az pipelines show`, `az
pipelines runs list/show`
- Artifact listing: `az pipelines runs artifact list`
- REST API fallback: only for build timelines and artifact downloads (no
CLI equivalent)
- Pipeline YAML: all arcade-based dotnet repos use `eng/pipelines/`; use
`az pipelines show` to find the YAML path
- **Key principle: prefer `az` CLI over manual REST API construction**
- CLI handles auth, pagination, and output formatting automatically
- `--query` (JMESPath) and `-o table` reduce scripting overhead
- **Concurrency safety: never use `az devops configure --defaults`**
- Global config causes conflicts when multiple agents run concurrently
- Always pass `--org` and `-p` explicitly
- **Terminology fix: AAD access token, not PAT**
- **New tip #8**: verify `az account show` before making REST calls
ManickaP pushed a commit that referenced this pull request Apr 15, 2026
ManickaP pushed a commit that referenced this pull request Jun 19, 2026
This PR adds lane construction and composition APIs approved in dotnet#122557,
and the corresponding JIT intrinsics.
The JIT now recognizes the new vector APIs and expands them using
existing SIMD nodes. The managed implementation allows decomposition
through smaller vector widths when wider hardware support is
unavailable.
The xarch lowering uses fixed shuffle forms where profitable:
- `vpbroadcast*` for sequence and alternating construction
- vshufps and vpunpck* for 128-bit concat/zip/unzip patterns
- full-width unpack plus `vperm2i128` for 256-bit zip/unzip
- EVEX shuffle/permute forms for 512-bit operations when AVX512 is
available
- fixed immediate shuffles for reverse
The ARM64 lowering avoids table-lookup forms for small fixed
concat/reverse operations and uses direct element moves where
applicable, such as `ins` and `rev64`.
`CreateCauchySequence` has been removed as it doesn't make sense at all.
And `SignSequence` has been moved to an extension property as we only
want to expose it for signed numbers.
Codegen:
<details>
<summary>Vector128</summary>
```asm
; Vector128.CreateGeometricSequence<int>(initial, 3)
; Emitting BLENDED_CODE for x64 + VEX + EVEX on Windows
G_M55419_IG01: ;; offset=0x0000
G_M55419_IG02: ;; offset=0x0000
vpbroadcastd xmm0, edx
vpmulld xmm0, xmm0, xmmword ptr [reloc @rwd00]
vmovups xmmword ptr [rcx], xmm0
mov rax, rcx
G_M55419_IG03: ;; offset=0x0016
ret RWD00 dq	0000000300000001h, 0000001B00000009h
; Total bytes of code 23
; Vector128.CreateAlternatingSequence<int>(even, odd)
; Emitting BLENDED_CODE for x64 + VEX + EVEX on Windows
G_M23632_IG01: ;; offset=0x0000
G_M23632_IG02: ;; offset=0x0000
vpbroadcastd xmm0, edx
vpbroadcastd xmm1, r8d
vpunpckldq xmm0, xmm0, xmm1
vmovups xmmword ptr [rcx], xmm0
mov rax, rcx
G_M23632_IG03: ;; offset=0x0017
ret ; Total bytes of code 24
; Vector128<int>.SignSequence
; Emitting BLENDED_CODE for x64 + VEX + EVEX on Windows
G_M37526_IG01: ;; offset=0x0000
G_M37526_IG02: ;; offset=0x0000
vmovddup xmm0, qword ptr [reloc @rwd00]
vmovups xmmword ptr [rcx], xmm0
mov rax, rcx
G_M37526_IG03: ;; offset=0x000F
ret RWD00 dq	FFFFFFFF00000001h
; Total bytes of code 16
; Vector128.CreateHarmonicSequence<float>(start, step)
; Emitting BLENDED_CODE for x64 + VEX + EVEX on Windows
G_M24925_IG01: ;; offset=0x0000
G_M24925_IG02: ;; offset=0x0000
vbroadcastss xmm0, xmm2
vmulps xmm0, xmm0, xmmword ptr [reloc @rwd00]
vbroadcastss xmm1, xmm1
vaddps xmm0, xmm1, xmm0
vbroadcastss xmm1, dword ptr [reloc @RWD16]
vdivps xmm0, xmm1, xmm0
vmovups xmmword ptr [rcx], xmm0
mov rax, rcx
G_M24925_IG03: ;; offset=0x002A
ret RWD00 dq	3F80000000000000h, 4040000040000000h
RWD16 dd	3F800000h ; 1
; Total bytes of code 43
; Vector128.CreateGeometricSequence<float>(initial, 3.0f)
; Emitting BLENDED_CODE for x64 + VEX + EVEX on Windows
G_M52564_IG01: ;; offset=0x0000
G_M52564_IG02: ;; offset=0x0000
vbroadcastss xmm0, xmm1
vmulps xmm0, xmm0, xmmword ptr [reloc @rwd00]
vmovups xmmword ptr [rcx], xmm0
mov rax, rcx
G_M52564_IG03: ;; offset=0x0014
ret RWD00 dq	404000003F800000h, 41D8000041100000h
; Total bytes of code 21
; Vector128.ConcatLowerLower<int>(left, right)
; Emitting BLENDED_CODE for x64 + VEX + EVEX on Windows
G_M47101_IG01: ;; offset=0x0000
G_M47101_IG02: ;; offset=0x0000
vmovups xmm0, xmmword ptr [rdx]
vshufps xmm0, xmm0, xmmword ptr [r8], 68
vmovups xmmword ptr [rcx], xmm0
mov rax, rcx
G_M47101_IG03: ;; offset=0x0011
ret ; Total bytes of code 18
; Vector128.ConcatLowerUpper<int>(left, right)
; Emitting BLENDED_CODE for x64 + VEX + EVEX on Windows
G_M48932_IG01: ;; offset=0x0000
G_M48932_IG02: ;; offset=0x0000
vmovups xmm0, xmmword ptr [rdx]
vshufps xmm0, xmm0, xmmword ptr [r8], -28
vmovups xmmword ptr [rcx], xmm0
mov rax, rcx
G_M48932_IG03: ;; offset=0x0011
ret ; Total bytes of code 18
; Vector128.ConcatUpperLower<int>(left, right)
; Emitting BLENDED_CODE for x64 + VEX + EVEX on Windows
G_M24196_IG01: ;; offset=0x0000
G_M24196_IG02: ;; offset=0x0000
vmovups xmm0, xmmword ptr [rdx]
vshufps xmm0, xmm0, xmmword ptr [r8], 78
vmovups xmmword ptr [rcx], xmm0
mov rax, rcx
G_M24196_IG03: ;; offset=0x0011
ret ; Total bytes of code 18
; Vector128.ConcatUpperUpper<int>(left, right)
; Emitting BLENDED_CODE for x64 + VEX + EVEX on Windows
G_M45405_IG01: ;; offset=0x0000
G_M45405_IG02: ;; offset=0x0000
vmovups xmm0, xmmword ptr [rdx]
vshufps xmm0, xmm0, xmmword ptr [r8], -18
vmovups xmmword ptr [rcx], xmm0
mov rax, rcx
G_M45405_IG03: ;; offset=0x0011
ret ; Total bytes of code 18
; Vector128.ZipLower<int>(left, right)
; Emitting BLENDED_CODE for x64 + VEX + EVEX on Windows
G_M10057_IG01: ;; offset=0x0000
G_M10057_IG02: ;; offset=0x0000
vmovups xmm0, xmmword ptr [rdx]
vpunpckldq xmm0, xmm0, xmmword ptr [r8]
vmovups xmmword ptr [rcx], xmm0
mov rax, rcx
G_M10057_IG03: ;; offset=0x0010
ret ; Total bytes of code 17
; Vector128.ZipUpper<int>(left, right)
; Emitting BLENDED_CODE for x64 + VEX + EVEX on Windows
G_M48936_IG01: ;; offset=0x0000
G_M48936_IG02: ;; offset=0x0000
vmovups xmm0, xmmword ptr [rdx]
vpunpckhdq xmm0, xmm0, xmmword ptr [r8]
vmovups xmmword ptr [rcx], xmm0
mov rax, rcx
G_M48936_IG03: ;; offset=0x0010
ret ; Total bytes of code 17
; Vector128.Zip<int>(left, right)
; Emitting BLENDED_CODE for x64 + VEX + EVEX on Windows
G_M32727_IG01: ;; offset=0x0000
G_M32727_IG02: ;; offset=0x0000
vmovups xmm0, xmmword ptr [rdx]
vmovups xmm1, xmmword ptr [r8]
vpunpckldq xmm2, xmm0, xmm1
vpunpckhdq xmm0, xmm0, xmm1
vmovups xmmword ptr [rcx], xmm2
vmovups xmmword ptr [rcx+0x10], xmm0
mov rax, rcx
G_M32727_IG03: ;; offset=0x001D
ret ; Total bytes of code 30
; Vector128.UnzipEven<int>(left, right)
; Emitting BLENDED_CODE for x64 + VEX + EVEX on Windows
G_M32745_IG01: ;; offset=0x0000
G_M32745_IG02: ;; offset=0x0000
vmovups xmm0, xmmword ptr [rdx]
vshufps xmm0, xmm0, xmmword ptr [r8], -120
vmovups xmmword ptr [rcx], xmm0
mov rax, rcx
G_M32745_IG03: ;; offset=0x0011
ret ; Total bytes of code 18
; Vector128.UnzipOdd<int>(left, right)
; Emitting BLENDED_CODE for x64 + VEX + EVEX on Windows
G_M32638_IG01: ;; offset=0x0000
G_M32638_IG02: ;; offset=0x0000
vmovups xmm0, xmmword ptr [rdx]
vshufps xmm0, xmm0, xmmword ptr [r8], -35
vmovups xmmword ptr [rcx], xmm0
mov rax, rcx
G_M32638_IG03: ;; offset=0x0011
ret ; Total bytes of code 18
; Vector128.Unzip<int>(left, right)
; Emitting BLENDED_CODE for x64 + VEX + EVEX on Windows
G_M7116_IG01: ;; offset=0x0000
G_M7116_IG02: ;; offset=0x0000
vmovups xmm0, xmmword ptr [rdx]
vmovups xmm1, xmmword ptr [r8]
vshufps xmm2, xmm0, xmm1, -120
vshufps xmm0, xmm0, xmm1, -35
vmovups xmmword ptr [rcx], xmm2
vmovups xmmword ptr [rcx+0x10], xmm0
mov rax, rcx
G_M7116_IG03: ;; offset=0x001F
ret ; Total bytes of code 32
; Vector128.Reverse<int>(vector)
; Emitting BLENDED_CODE for x64 + VEX + EVEX on Windows
G_M36184_IG01: ;; offset=0x0000
G_M36184_IG02: ;; offset=0x0000
vpshufd xmm0, xmmword ptr [rdx], 27
vmovups xmmword ptr [rcx], xmm0
mov rax, rcx
G_M36184_IG03: ;; offset=0x000C
ret ; Total bytes of code 13
```
</details>
<details>
<summary>Vector256</summary>
```asm
; Vector256.CreateGeometricSequence<int>(initial, 3)
; Emitting BLENDED_CODE for x64 + VEX + EVEX on Windows
G_M59643_IG01: ;; offset=0x0000
G_M59643_IG02: ;; offset=0x0000
vpbroadcastd ymm0, edx
vpmulld ymm0, ymm0, ymmword ptr [reloc @rwd00]
vmovups ymmword ptr [rcx], ymm0
mov rax, rcx
G_M59643_IG03: ;; offset=0x0016
vzeroupper ret RWD00 dq	0000000300000001h, 0000001B00000009h, 000000F300000051h, 0000088B000002D9h
; Total bytes of code 26
; Vector256.CreateAlternatingSequence<int>(even, odd)
; Emitting BLENDED_CODE for x64 + VEX + EVEX on Windows
G_M40720_IG01: ;; offset=0x0000
G_M40720_IG02: ;; offset=0x0000
vpbroadcastd ymm0, edx
vmovups ymm1, ymmword ptr [reloc @rwd00]
vpbroadcastd ymm2, r8d
vpermt2d ymm2, ymm1, ymm0
vmovups ymmword ptr [rcx], ymm2
mov rax, rcx
G_M40720_IG03: ;; offset=0x0021
vzeroupper ret RWD00 dq	0000000000000008h, 0000000100000009h, 000000020000000Ah, 000000030000000Bh
; Total bytes of code 37
; Vector256<int>.SignSequence
; Emitting BLENDED_CODE for x64 + VEX + EVEX on Windows
G_M7766_IG01: ;; offset=0x0000
G_M7766_IG02: ;; offset=0x0000
vbroadcastsd ymm0, qword ptr [reloc @rwd00]
vmovups ymmword ptr [rcx], ymm0
mov rax, rcx
G_M7766_IG03: ;; offset=0x0010
vzeroupper ret RWD00 dq	FFFFFFFF00000001h
; Total bytes of code 20
; Vector256.CreateHarmonicSequence<float>(start, step)
; Emitting BLENDED_CODE for x64 + VEX + EVEX on Windows
G_M59741_IG01: ;; offset=0x0000
G_M59741_IG02: ;; offset=0x0000
vbroadcastss ymm0, ymm2
vmulps ymm0, ymm0, ymmword ptr [reloc @rwd00]
vbroadcastss ymm1, ymm1
vaddps ymm0, ymm1, ymm0
vbroadcastss ymm1, dword ptr [reloc @RWD32]
vdivps ymm0, ymm1, ymm0
vmovups ymmword ptr [rcx], ymm0
mov rax, rcx
G_M59741_IG03: ;; offset=0x002A
vzeroupper ret RWD00 dq	3F80000000000000h, 4040000040000000h, 40A0000040800000h, 40E0000040C00000h
RWD32 dd	3F800000h ; 1
; Total bytes of code 46
; Vector256.CreateGeometricSequence<float>(initial, 3.0f)
; Emitting BLENDED_CODE for x64 + VEX + EVEX on Windows
G_M42068_IG01: ;; offset=0x0000
G_M42068_IG02: ;; offset=0x0000
vbroadcastss ymm0, ymm1
vmulps ymm0, ymm0, ymmword ptr [reloc @rwd00]
vmovups ymmword ptr [rcx], ymm0
mov rax, rcx
G_M42068_IG03: ;; offset=0x0014
vzeroupper ret RWD00 dq	404000003F800000h, 41D8000041100000h, 4373000042A20000h, 4508B00044364000h
; Total bytes of code 24
; Vector256.ConcatLowerLower<int>(left, right)
; Emitting BLENDED_CODE for x64 + VEX + EVEX on Windows
G_M46973_IG01: ;; offset=0x0000
G_M46973_IG02: ;; offset=0x0000
vmovups ymm0, ymmword ptr [rdx]
vmovdqu xmm1, xmmword ptr [r8]
vinserti128 ymm0, ymm0, xmm1
vmovups ymmword ptr [rcx], ymm0
mov rax, rcx
G_M46973_IG03: ;; offset=0x0016
vzeroupper ret ; Total bytes of code 26
; Vector256.ConcatLowerUpper<int>(left, right)
; Emitting BLENDED_CODE for x64 + VEX + EVEX on Windows
G_M9060_IG01: ;; offset=0x0000
G_M9060_IG02: ;; offset=0x0000
vmovups ymm0, ymmword ptr [rdx]
vmovups ymm1, ymmword ptr [r8]
vextracti128 xmm1, ymm1
vinserti128 ymm0, ymm0, xmm1
vmovups ymmword ptr [rcx], ymm0
mov rax, rcx
G_M9060_IG03: ;; offset=0x001C
vzeroupper ret ; Total bytes of code 32
; Vector256.ConcatUpperLower<int>(left, right)
; Emitting BLENDED_CODE for x64 + VEX + EVEX on Windows
G_M57796_IG01: ;; offset=0x0000
G_M57796_IG02: ;; offset=0x0000
vmovups ymm0, ymmword ptr [rdx]
vextracti128 xmm0, ymm0
vmovdqu xmm1, xmmword ptr [r8]
vinserti128 ymm0, ymm0, xmm1
vmovups ymmword ptr [rcx], ymm0
mov rax, rcx
G_M57796_IG03: ;; offset=0x001C
vzeroupper ret ; Total bytes of code 32
; Vector256.ConcatUpperUpper<int>(left, right)
; Emitting BLENDED_CODE for x64 + VEX + EVEX on Windows
G_M7901_IG01: ;; offset=0x0000
G_M7901_IG02: ;; offset=0x0000
vmovups ymm0, ymmword ptr [rdx]
vextracti128 xmm0, ymm0
vmovups ymm1, ymmword ptr [r8]
vinserti128 ymm0, ymm1, xmm0
vmovups ymmword ptr [rcx], ymm0
mov rax, rcx
G_M7901_IG03: ;; offset=0x001C
vzeroupper ret ; Total bytes of code 32
; Vector256.ZipLower<int>(left, right)
; Emitting BLENDED_CODE for x64 + VEX + EVEX on Windows
G_M61705_IG01: ;; offset=0x0000
G_M61705_IG02: ;; offset=0x0000
vmovups ymm0, ymmword ptr [rdx]
vmovups ymm1, ymmword ptr [reloc @rwd00]
vpermt2d ymm0, ymm1, ymmword ptr [r8]
vmovups ymmword ptr [rcx], ymm0
mov rax, rcx
G_M61705_IG03: ;; offset=0x0019
vzeroupper ret RWD00 dq	0000000800000000h, 0000000900000001h, 0000000A00000002h, 0000000B00000003h
; Total bytes of code 29
; Vector256.ZipUpper<int>(left, right)
; Emitting BLENDED_CODE for x64 + VEX + EVEX on Windows
G_M38056_IG01: ;; offset=0x0000
G_M38056_IG02: ;; offset=0x0000
vmovups ymm0, ymmword ptr [rdx]
vmovups ymm1, ymmword ptr [reloc @rwd00]
vpermt2d ymm0, ymm1, ymmword ptr [r8]
vmovups ymmword ptr [rcx], ymm0
mov rax, rcx
G_M38056_IG03: ;; offset=0x0019
vzeroupper ret RWD00 dq	0000000C00000004h, 0000000D00000005h, 0000000E00000006h, 0000000F00000007h
; Total bytes of code 29
; Vector256.Zip<int>(left, right)
; Emitting BLENDED_CODE for x64 + VEX + EVEX on Windows
G_M24445_IG01: ;; offset=0x0000
G_M24445_IG02: ;; offset=0x0000
vmovups ymm0, ymmword ptr [rdx]
vmovups ymm1, ymmword ptr [r8]
vpunpckldq ymm2, ymm0, ymm1
vpunpckhdq ymm0, ymm0, ymm1
vperm2i128 ymm1, ymm2, ymm0, 32
vperm2i128 ymm0, ymm2, ymm0, 49
vmovups ymmword ptr [rcx], ymm1
vmovups ymmword ptr [rcx+0x20], ymm0
mov rax, rcx
G_M24445_IG03: ;; offset=0x0029
vzeroupper ret ; Total bytes of code 45
; Vector256.UnzipEven<int>(left, right)
; Emitting BLENDED_CODE for x64 + VEX + EVEX on Windows
G_M4905_IG01: ;; offset=0x0000
G_M4905_IG02: ;; offset=0x0000
vmovups ymm0, ymmword ptr [rdx]
vmovups ymm1, ymmword ptr [reloc @rwd00]
vpermt2d ymm0, ymm1, ymmword ptr [r8]
vmovups ymmword ptr [rcx], ymm0
mov rax, rcx
G_M4905_IG03: ;; offset=0x0019
vzeroupper ret RWD00 dq	0000000200000000h, 0000000600000004h, 0000000A00000008h, 0000000E0000000Ch
; Total bytes of code 29
; Vector256.UnzipOdd<int>(left, right)
; Emitting BLENDED_CODE for x64 + VEX + EVEX on Windows
G_M54526_IG01: ;; offset=0x0000
G_M54526_IG02: ;; offset=0x0000
vmovups ymm0, ymmword ptr [rdx]
vmovups ymm1, ymmword ptr [reloc @rwd00]
vpermt2d ymm0, ymm1, ymmword ptr [r8]
vmovups ymmword ptr [rcx], ymm0
mov rax, rcx
G_M54526_IG03: ;; offset=0x0019
vzeroupper ret RWD00 dq	0000000300000001h, 0000000700000005h, 0000000B00000009h, 0000000F0000000Dh
; Total bytes of code 29
; Vector256.Unzip<int>(left, right)
; Emitting BLENDED_CODE for x64 + VEX + EVEX on Windows
G_M52326_IG01: ;; offset=0x0000
G_M52326_IG02: ;; offset=0x0000
vpshufd ymm0, ymmword ptr [rdx], -40
vpermq ymm0, ymm0, -40
vpshufd ymm1, ymmword ptr [r8], -40
vpermq ymm1, ymm1, -40
vperm2i128 ymm2, ymm0, ymm1, 32
vperm2i128 ymm0, ymm0, ymm1, 49
vmovups ymmword ptr [rcx], ymm2
vmovups ymmword ptr [rcx+0x20], ymm0
mov rax, rcx
G_M52326_IG03: ;; offset=0x002F
vzeroupper ret ; Total bytes of code 51
; Vector256.Reverse<int>(vector)
; Emitting BLENDED_CODE for x64 + VEX + EVEX on Windows
G_M23794_IG01: ;; offset=0x0000
G_M23794_IG02: ;; offset=0x0000
vmovups ymm0, ymmword ptr [reloc @rwd00]
vpermd ymm0, ymm0, ymmword ptr [rdx]
vmovups ymmword ptr [rcx], ymm0
mov rax, rcx
G_M23794_IG03: ;; offset=0x0014
vzeroupper ret RWD00 dq	0000000600000007h, 0000000400000005h, 0000000200000003h, 0000000000000001h
; Total bytes of code 24
```
</details>
<details>
<summary>Vector512</summary>
```asm
; Vector512.CreateGeometricSequence<int>(initial, 3)
; Emitting BLENDED_CODE for x64 + VEX + EVEX on Windows
G_M55451_IG01: ;; offset=0x0000
G_M55451_IG02: ;; offset=0x0000
vpbroadcastd zmm0, edx
vpmulld zmm0, zmm0, zmmword ptr [reloc @rwd00]
vmovups zmmword ptr [rcx], zmm0
mov rax, rcx
G_M55451_IG03: ;; offset=0x0019
vzeroupper ret RWD00 dq	0000000300000001h, 0000001B00000009h, 000000F300000051h, 0000088B000002D9h, 00004CE3000019A1h, 0002B3FB0000E6A9h, 001853D300081BF1h, 00DAF26B0048FB79h
; Total bytes of code 29
; Vector512.CreateAlternatingSequence<int>(even, odd)
; Emitting BLENDED_CODE for x64 + VEX + EVEX on Windows
G_M560_IG01: ;; offset=0x0000
G_M560_IG02: ;; offset=0x0000
vpbroadcastd zmm0, edx
vmovups zmm1, zmmword ptr [reloc @rwd00]
vpbroadcastd zmm2, r8d
vpermt2d zmm2, zmm1, zmm0
vmovups zmmword ptr [rcx], zmm2
mov rax, rcx
G_M560_IG03: ;; offset=0x0025
vzeroupper ret RWD00 dq	0000000000000010h, 0000000100000011h, 0000000200000012h, 0000000300000013h, 0000000400000014h, 0000000500000015h, 0000000600000016h, 0000000700000017h
; Total bytes of code 41
; Vector512<int>.SignSequence
; Emitting BLENDED_CODE for x64 + VEX + EVEX on Windows
G_M63542_IG01: ;; offset=0x0000
G_M63542_IG02: ;; offset=0x0000
vbroadcastsd zmm0, qword ptr [reloc @rwd00]
vmovups zmmword ptr [rcx], zmm0
mov rax, rcx
G_M63542_IG03: ;; offset=0x0013
vzeroupper ret RWD00 dq	FFFFFFFF00000001h
; Total bytes of code 23
; Vector512.CreateHarmonicSequence<float>(start, step)
; Emitting BLENDED_CODE for x64 + VEX + EVEX on Windows
G_M41245_IG01: ;; offset=0x0000
G_M41245_IG02: ;; offset=0x0000
vbroadcastss zmm0, zmm2
vmulps zmm0, zmm0, zmmword ptr [reloc @rwd00]
vbroadcastss zmm1, zmm1
vaddps zmm0, zmm1, zmm0
vbroadcastss zmm1, dword ptr [reloc @RWD64]
vdivps zmm0, zmm1, zmm0
vmovups zmmword ptr [rcx], zmm0
mov rax, rcx
G_M41245_IG03: ;; offset=0x0035
vzeroupper ret RWD00 dq	3F80000000000000h, 4040000040000000h, 40A0000040800000h, 40E0000040C00000h, 4110000041000000h, 4130000041200000h, 4150000041400000h, 4170000041600000h
RWD64 dd	3F800000h ; 1
; Total bytes of code 57
; Vector512.CreateGeometricSequence<float>(initial, 3.0f)
; Emitting BLENDED_CODE for x64 + VEX + EVEX on Windows
G_M35892_IG01: ;; offset=0x0000
G_M35892_IG02: ;; offset=0x0000
vbroadcastss zmm0, zmm1
vmulps zmm0, zmm0, zmmword ptr [reloc @rwd00]
vmovups zmmword ptr [rcx], zmm0
mov rax, rcx
G_M35892_IG03: ;; offset=0x0019
vzeroupper ret RWD00 dq	404000003F800000h, 41D8000041100000h, 4373000042A20000h, 4508B00044364000h, 4699C60045CD0800h, 482CFEC04766A900h, 49C29E984901BF10h, 4B5AF26B4A91F6F2h
; Total bytes of code 29
; Vector512.ConcatLowerLower<int>(left, right)
; Emitting BLENDED_CODE for x64 + VEX + EVEX on Windows
G_M13789_IG01: ;; offset=0x0000
G_M13789_IG02: ;; offset=0x0000
vmovups zmm0, zmmword ptr [rdx]
vmovdqu ymm1, ymmword ptr [r8]
vinserti32x8 zmm0, zmm0, ymm1, 1
vmovups zmmword ptr [rcx], zmm0
mov rax, rcx
G_M13789_IG03: ;; offset=0x001B
vzeroupper ret ; Total bytes of code 31
; Vector512.ConcatLowerUpper<int>(left, right)
; Emitting BLENDED_CODE for x64 + VEX + EVEX on Windows
G_M36420_IG01: ;; offset=0x0000
G_M36420_IG02: ;; offset=0x0000
vmovups zmm0, zmmword ptr [rdx]
vmovups zmm1, zmmword ptr [r8]
vextracti32x8 ymm1, zmm1, 1
vinserti32x8 zmm0, zmm0, ymm1, 1
vmovups zmmword ptr [rcx], zmm0
mov rax, rcx
G_M36420_IG03: ;; offset=0x0023
vzeroupper ret ; Total bytes of code 39
; Vector512.ConcatUpperLower<int>(left, right)
; Emitting BLENDED_CODE for x64 + VEX + EVEX on Windows
G_M56164_IG01: ;; offset=0x0000
G_M56164_IG02: ;; offset=0x0000
vmovups zmm0, zmmword ptr [rdx]
vextracti32x8 ymm0, zmm0, 1
vmovdqu ymm1, ymmword ptr [r8]
vinserti32x8 zmm0, zmm0, ymm1, 1
vmovups zmmword ptr [rcx], zmm0
mov rax, rcx
G_M56164_IG03: ;; offset=0x0022
vzeroupper ret ; Total bytes of code 38
; Vector512.ConcatUpperUpper<int>(left, right)
; Emitting BLENDED_CODE for x64 + VEX + EVEX on Windows
G_M13821_IG01: ;; offset=0x0000
G_M13821_IG02: ;; offset=0x0000
vmovups zmm0, zmmword ptr [rdx]
vextracti32x8 ymm0, zmm0, 1
vmovups zmm1, zmmword ptr [r8]
vinserti32x8 zmm0, zmm1, ymm0, 0
vmovups zmmword ptr [rcx], zmm0
mov rax, rcx
G_M13821_IG03: ;; offset=0x0023
vzeroupper ret ; Total bytes of code 39
; Vector512.ZipLower<int>(left, right)
; Emitting BLENDED_CODE for x64 + VEX + EVEX on Windows
G_M59881_IG01: ;; offset=0x0000
G_M59881_IG02: ;; offset=0x0000
vmovups zmm0, zmmword ptr [rdx]
vmovups zmm1, zmmword ptr [reloc @rwd00]
vpermt2d zmm0, zmm1, zmmword ptr [r8]
vmovups zmmword ptr [rcx], zmm0
mov rax, rcx
G_M59881_IG03: ;; offset=0x001F
vzeroupper ret RWD00 dq	0000001000000000h, 0000001100000001h, 0000001200000002h, 0000001300000003h, 0000001400000004h, 0000001500000005h, 0000001600000006h, 0000001700000007h
; Total bytes of code 35
; Vector512.ZipUpper<int>(left, right)
; Emitting BLENDED_CODE for x64 + VEX + EVEX on Windows
G_M10568_IG01: ;; offset=0x0000
G_M10568_IG02: ;; offset=0x0000
vmovups zmm0, zmmword ptr [rdx]
vmovups zmm1, zmmword ptr [reloc @rwd00]
vpermt2d zmm0, zmm1, zmmword ptr [r8]
vmovups zmmword ptr [rcx], zmm0
mov rax, rcx
G_M10568_IG03: ;; offset=0x001F
vzeroupper ret RWD00 dq	0000001800000008h, 0000001900000009h, 0000001A0000000Ah, 0000001B0000000Bh, 0000001C0000000Ch, 0000001D0000000Dh, 0000001E0000000Eh, 0000001F0000000Fh
; Total bytes of code 35
; Vector512.Zip<int>(left, right)
; Emitting BLENDED_CODE for x64 + VEX + EVEX on Windows
G_M59130_IG01: ;; offset=0x0000
G_M59130_IG02: ;; offset=0x0000
vmovups zmm0, zmmword ptr [rdx]
vmovups zmm1, zmmword ptr [r8]
vpunpckhdq zmm2, zmm0, zmm1
vpunpckldq zmm0, zmm0, zmm1
vshufi32x4 zmm1, zmm0, zmm2, 68
vshufi32x4 zmm1, zmm1, zmm1, -40
vshufi32x4 zmm0, zmm0, zmm2, -18
vshufi32x4 zmm0, zmm0, zmm0, -40
vmovups zmmword ptr [rcx], zmm1
vmovups zmmword ptr [rcx+0x40], zmm0
mov rax, rcx
G_M59130_IG03: ;; offset=0x0044
vzeroupper ret ; Total bytes of code 72
; Vector512.UnzipEven<int>(left, right)
; Emitting BLENDED_CODE for x64 + VEX + EVEX on Windows
G_M30057_IG01: ;; offset=0x0000
G_M30057_IG02: ;; offset=0x0000
vmovups zmm0, zmmword ptr [rdx]
vmovups zmm1, zmmword ptr [reloc @rwd00]
vpermt2d zmm0, zmm1, zmmword ptr [r8]
vmovups zmmword ptr [rcx], zmm0
mov rax, rcx
G_M30057_IG03: ;; offset=0x001F
vzeroupper ret RWD00 dq	0000000200000000h, 0000000600000004h, 0000000A00000008h, 0000000E0000000Ch, 0000001200000010h, 0000001600000014h, 0000001A00000018h, 0000001E0000001Ch
; Total bytes of code 35
; Vector512.UnzipOdd<int>(left, right)
; Emitting BLENDED_CODE for x64 + VEX + EVEX on Windows
G_M65310_IG01: ;; offset=0x0000
G_M65310_IG02: ;; offset=0x0000
vmovups zmm0, zmmword ptr [rdx]
vmovups zmm1, zmmword ptr [reloc @rwd00]
vpermt2d zmm0, zmm1, zmmword ptr [r8]
vmovups zmmword ptr [rcx], zmm0
mov rax, rcx
G_M65310_IG03: ;; offset=0x001F
vzeroupper ret RWD00 dq	0000000300000001h, 0000000700000005h, 0000000B00000009h, 0000000F0000000Dh, 0000001300000011h, 0000001700000015h, 0000001B00000019h, 0000001F0000001Dh
; Total bytes of code 35
; Vector512.Unzip<int>(left, right)
; Emitting BLENDED_CODE for x64 + VEX + EVEX on Windows
G_M1377_IG01: ;; offset=0x0000
G_M1377_IG02: ;; offset=0x0000
vmovups zmm0, zmmword ptr [rdx]
vmovups zmm1, zmmword ptr [reloc @rwd00]
vmovups zmm2, zmmword ptr [r8]
vmovaps zmm3, zmm2
vpermt2d zmm3, zmm1, zmm0
vmovups zmm1, zmmword ptr [reloc @RWD64]
vpermt2d zmm2, zmm1, zmm0
vmovups zmmword ptr [rcx], zmm2
vmovups zmmword ptr [rcx+0x40], zmm3
mov rax, rcx
G_M1377_IG03: ;; offset=0x0042
vzeroupper ret RWD00 dq	0000001300000011h, 0000001700000015h, 0000001B00000019h, 0000001F0000001Dh, 0000000300000001h, 0000000700000005h, 0000000B00000009h, 0000000F0000000Dh
RWD64 dq	0000001200000010h, 0000001600000014h, 0000001A00000018h, 0000001E0000001Ch, 0000000200000000h, 0000000600000004h, 0000000A00000008h, 0000000E0000000Ch
; Total bytes of code 70
; Vector512.Reverse<int>(vector)
; Emitting BLENDED_CODE for x64 + VEX + EVEX on Windows
G_M34517_IG01: ;; offset=0x0000
G_M34517_IG02: ;; offset=0x0000
vmovups zmm0, zmmword ptr [reloc @rwd00]
vpermd zmm0, zmm0, zmmword ptr [rdx]
vmovups zmmword ptr [rcx], zmm0
mov rax, rcx
G_M34517_IG03: ;; offset=0x0019
vzeroupper ret RWD00 dq	0000000E0000000Fh, 0000000C0000000Dh, 0000000A0000000Bh, 0000000800000009h, 0000000600000007h, 0000000400000005h, 0000000200000003h, 0000000000000001h
; Total bytes of code 29
```
</details>
<details>
<summary>ARM64</summary>
```asm
; Vector64.CreateGeometricSequence<int>(initial, 3)
; Emitting BLENDED_CODE for arm64 on Windows
G_M6971_IG01: ;; offset=0x0000
stp fp, lr, [sp, #-0x10]!
mov fp, sp
G_M6971_IG02: ;; offset=0x0008
dup v0.2s, w0
ldr d16, [@rwd00]
mul v0.2s, v0.2s, v16.2s
G_M6971_IG03: ;; offset=0x0014
ldp fp, lr, [sp], #0x10
ret lr
RWD00 dq 0000000300000001h
; Total bytes of code 28
; Vector64.CreateAlternatingSequence<int>(even, odd)
; Emitting BLENDED_CODE for arm64 on Windows
G_M10160_IG01: ;; offset=0x0000
stp fp, lr, [sp, #-0x10]!
mov fp, sp
G_M10160_IG02: ;; offset=0x0008
dup v0.2s, w0
dup v16.2s, w1
zip1 v0.2s, v0.2s, v16.2s
G_M10160_IG03: ;; offset=0x0014
ldp fp, lr, [sp], #0x10
ret lr
; Total bytes of code 28
; Vector64<int>.SignSequence
; Emitting BLENDED_CODE for arm64 on Windows
G_M46198_IG01: ;; offset=0x0000
stp fp, lr, [sp, #-0x10]!
mov fp, sp
G_M46198_IG02: ;; offset=0x0008
ldr d0, [@rwd00]
G_M46198_IG03: ;; offset=0x000C
ldp fp, lr, [sp], #0x10
ret lr
RWD00 dq FFFFFFFF00000001h
; Total bytes of code 20
; Vector64.CreateHarmonicSequence<float>(start, step)
; Emitting BLENDED_CODE for arm64 on Windows
G_M43901_IG01: ;; offset=0x0000
stp fp, lr, [sp, #-0x10]!
mov fp, sp
G_M43901_IG02: ;; offset=0x0008
ldr d16, [@rwd00]
fmul v16.2s, v16.2s, v1.s[0]
dup v0.2s, v0.s[0]
fadd v0.2s, v16.2s, v0.2s
ldr d16, [@RWD08]
fdiv v0.2s, v16.2s, v0.2s
G_M43901_IG03: ;; offset=0x0020
ldp fp, lr, [sp], #0x10
ret lr
RWD00 dq	3F80000000000000h
RWD08 dq	3F8000003F800000h
; Total bytes of code 40
; Vector64.ConcatLowerLower<int>(left, right)
; Emitting BLENDED_CODE for arm64 on Windows
G_M48061_IG01: ;; offset=0x0000
stp fp, lr, [sp, #-0x10]!
mov fp, sp
G_M48061_IG02: ;; offset=0x0008
ins v0.s[1], v1.s[0]
G_M48061_IG03: ;; offset=0x000C
ldp fp, lr, [sp], #0x10
ret lr
; Total bytes of code 20
; Vector64.ConcatLowerUpper<int>(left, right)
; Emitting BLENDED_CODE for arm64 on Windows
G_M62724_IG01: ;; offset=0x0000
stp fp, lr, [sp, #-0x10]!
mov fp, sp
G_M62724_IG02: ;; offset=0x0008
ins v0.s[1], v1.s[1]
G_M62724_IG03: ;; offset=0x000C
ldp fp, lr, [sp], #0x10
ret lr
; Total bytes of code 20
; Vector64.ConcatUpperLower<int>(left, right)
; Emitting BLENDED_CODE for arm64 on Windows
G_M2660_IG01: ;; offset=0x0000
stp fp, lr, [sp, #-0x10]!
mov fp, sp
G_M2660_IG02: ;; offset=0x0008
ins v0.s[0], v0.s[1]
ins v0.s[1], v1.s[0]
G_M2660_IG03: ;; offset=0x0010
ldp fp, lr, [sp], #0x10
ret lr
; Total bytes of code 24
; Vector64.ConcatUpperUpper<int>(left, right)
; Emitting BLENDED_CODE for arm64 on Windows
G_M55837_IG01: ;; offset=0x0000
stp fp, lr, [sp, #-0x10]!
mov fp, sp
G_M55837_IG02: ;; offset=0x0008
ins v0.s[0], v0.s[1]
ins v0.s[1], v1.s[1]
G_M55837_IG03: ;; offset=0x0010
ldp fp, lr, [sp], #0x10
ret lr
; Total bytes of code 24
; Vector64.ZipLower<int>(left, right)
; Emitting BLENDED_CODE for arm64 on Windows
G_M32585_IG01: ;; offset=0x0000
stp fp, lr, [sp, #-0x10]!
mov fp, sp
G_M32585_IG02: ;; offset=0x0008
zip1 v0.2s, v0.2s, v1.2s
G_M32585_IG03: ;; offset=0x000C
ldp fp, lr, [sp], #0x10
ret lr
; Total bytes of code 20
; Vector64.ZipUpper<int>(left, right)
; Emitting BLENDED_CODE for arm64 on Windows
G_M43976_IG01: ;; offset=0x0000
stp fp, lr, [sp, #-0x10]!
mov fp, sp
G_M43976_IG02: ;; offset=0x0008
zip2 v0.2s, v0.2s, v1.2s
G_M43976_IG03: ;; offset=0x000C
ldp fp, lr, [sp], #0x10
ret lr
; Total bytes of code 20
; Vector64.Zip<int>(left, right)
; Emitting BLENDED_CODE for arm64 on Windows
G_M14030_IG01: ;; offset=0x0000
stp fp, lr, [sp, #-0x10]!
mov fp, sp
G_M14030_IG02: ;; offset=0x0008
zip1 v16.2s, v0.2s, v1.2s
zip2 v1.2s, v0.2s, v1.2s
mov v0.8b, v16.8b
G_M14030_IG03: ;; offset=0x0014
ldp fp, lr, [sp], #0x10
ret lr
; Total bytes of code 28
; Vector64.UnzipEven<int>(left, right)
; Emitting BLENDED_CODE for arm64 on Windows
G_M26249_IG01: ;; offset=0x0000
stp fp, lr, [sp, #-0x10]!
mov fp, sp
G_M26249_IG02: ;; offset=0x0008
uzp1 v0.2s, v0.2s, v1.2s
G_M26249_IG03: ;; offset=0x000C
ldp fp, lr, [sp], #0x10
ret lr
; Total bytes of code 20
; Vector64.UnzipOdd<int>(left, right)
; Emitting BLENDED_CODE for arm64 on Windows
G_M25438_IG01: ;; offset=0x0000
stp fp, lr, [sp, #-0x10]!
mov fp, sp
G_M25438_IG02: ;; offset=0x0008
uzp2 v0.2s, v0.2s, v1.2s
G_M25438_IG03: ;; offset=0x000C
ldp fp, lr, [sp], #0x10
ret lr
; Total bytes of code 20
; Vector64.Unzip<int>(left, right)
; Emitting BLENDED_CODE for arm64 on Windows
G_M41813_IG01: ;; offset=0x0000
stp fp, lr, [sp, #-0x10]!
mov fp, sp
G_M41813_IG02: ;; offset=0x0008
uzp1 v16.2s, v0.2s, v1.2s
uzp2 v1.2s, v0.2s, v1.2s
mov v0.8b, v16.8b
G_M41813_IG03: ;; offset=0x0014
ldp fp, lr, [sp], #0x10
ret lr
; Total bytes of code 28
; Vector64.Reverse<int>(vector)
; Emitting BLENDED_CODE for arm64 on Windows
G_M63937_IG01: ;; offset=0x0000
stp fp, lr, [sp, #-0x10]!
mov fp, sp
G_M63937_IG02: ;; offset=0x0008
rev64 v0.2s, v0.2s
G_M63937_IG03: ;; offset=0x000C
ldp fp, lr, [sp], #0x10
ret lr
; Total bytes of code 20
; Vector128.CreateGeometricSequence<int>(initial, 3)
; Emitting BLENDED_CODE for arm64 on Windows
G_M55419_IG01: ;; offset=0x0000
stp fp, lr, [sp, #-0x10]!
mov fp, sp
G_M55419_IG02: ;; offset=0x0008
dup v0.4s, w0
ldr q16, [@rwd00]
mul v0.4s, v0.4s, v16.4s
G_M55419_IG03: ;; offset=0x0014
ldp fp, lr, [sp], #0x10
ret lr
RWD00 dq 0000000300000001h, 0000001B00000009h
; Total bytes of code 28
; Vector128.CreateAlternatingSequence<int>(even, odd)
; Emitting BLENDED_CODE for arm64 on Windows
G_M23632_IG01: ;; offset=0x0000
stp fp, lr, [sp, #-0x10]!
mov fp, sp
G_M23632_IG02: ;; offset=0x0008
dup v0.4s, w0
dup v16.4s, w1
zip1 v0.4s, v0.4s, v16.4s
G_M23632_IG03: ;; offset=0x0014
ldp fp, lr, [sp], #0x10
ret lr
; Total bytes of code 28
; Vector128<int>.SignSequence
; Emitting BLENDED_CODE for arm64 on Windows
G_M37526_IG01: ;; offset=0x0000
stp fp, lr, [sp, #-0x10]!
mov fp, sp
G_M37526_IG02: ;; offset=0x0008
ldr q0, [@rwd00]
G_M37526_IG03: ;; offset=0x000C
ldp fp, lr, [sp], #0x10
ret lr
RWD00 dq FFFFFFFF00000001h, FFFFFFFF00000001h
; Total bytes of code 20
; Vector128.CreateHarmonicSequence<float>(start, step)
; Emitting BLENDED_CODE for arm64 on Windows
G_M24925_IG01: ;; offset=0x0000
stp fp, lr, [sp, #-0x10]!
mov fp, sp
G_M24925_IG02: ;; offset=0x0008
ldr q16, [@rwd00]
fmul v16.4s, v16.4s, v1.s[0]
dup v0.4s, v0.s[0]
fadd v0.4s, v16.4s, v0.4s
ldr q16, [@RWD16]
fdiv v0.4s, v16.4s, v0.4s
G_M24925_IG03: ;; offset=0x0020
ldp fp, lr, [sp], #0x10
ret lr
RWD00 dq	3F80000000000000h, 4040000040000000h
RWD16 dq	3F8000003F800000h, 3F8000003F800000h
; Total bytes of code 40
; Vector128.ConcatLowerLower<int>(left, right)
; Emitting BLENDED_CODE for arm64 on Windows
G_M47101_IG01: ;; offset=0x0000
stp fp, lr, [sp, #-0x10]!
mov fp, sp
G_M47101_IG02: ;; offset=0x0008
ins v0.d[1], v1.d[0]
G_M47101_IG03: ;; offset=0x000C
ldp fp, lr, [sp], #0x10
ret lr
; Total bytes of code 20
; Vector128.ConcatLowerUpper<int>(left, right)
; Emitting BLENDED_CODE for arm64 on Windows
G_M48932_IG01: ;; offset=0x0000
stp fp, lr, [sp, #-0x10]!
mov fp, sp
G_M48932_IG02: ;; offset=0x0008
ext v16.16b, v1.16b, v1.16b, #8
ins v0.d[1], v16.d[0]
G_M48932_IG03: ;; offset=0x0010
ldp fp, lr, [sp], #0x10
ret lr
; Total bytes of code 24
; Vector128.ConcatUpperLower<int>(left, right)
; Emitting BLENDED_CODE for arm64 on Windows
G_M24196_IG01: ;; offset=0x0000
stp fp, lr, [sp, #-0x10]!
mov fp, sp
G_M24196_IG02: ;; offset=0x0008
ext v0.16b, v0.16b, v0.16b, #8
ins v0.d[1], v1.d[0]
G_M24196_IG03: ;; offset=0x0010
ldp fp, lr, [sp], #0x10
ret lr
; Total bytes of code 24
; Vector128.ConcatUpperUpper<int>(left, right)
; Emitting BLENDED_CODE for arm64 on Windows
G_M45405_IG01: ;; offset=0x0000
stp fp, lr, [sp, #-0x10]!
mov fp, sp
G_M45405_IG02: ;; offset=0x0008
ext v0.16b, v0.16b, v0.16b, #8
ins v1.d[0], v0.d[0]
mov v0.16b, v1.16b
G_M45405_IG03: ;; offset=0x0014
ldp fp, lr, [sp], #0x10
ret lr
; Total bytes of code 28
; Vector128.ZipLower<int>(left, right)
; Emitting BLENDED_CODE for arm64 on Windows
G_M10057_IG01: ;; offset=0x0000
stp fp, lr, [sp, #-0x10]!
mov fp, sp
G_M10057_IG02: ;; offset=0x0008
zip1 v0.4s, v0.4s, v1.4s
G_M10057_IG03: ;; offset=0x000C
ldp fp, lr, [sp], #0x10
ret lr
; Total bytes of code 20
; Vector128.ZipUpper<int>(left, right)
; Emitting BLENDED_CODE for arm64 on Windows
G_M48936_IG01: ;; offset=0x0000
stp fp, lr, [sp, #-0x10]!
mov fp, sp
G_M48936_IG02: ;; offset=0x0008
zip2 v0.4s, v0.4s, v1.4s
G_M48936_IG03: ;; offset=0x000C
ldp fp, lr, [sp], #0x10
ret lr
; Total bytes of code 20
; Vector128.Zip<int>(left, right)
; Emitting BLENDED_CODE for arm64 on Windows
G_M32727_IG01: ;; offset=0x0000
stp fp, lr, [sp, #-0x10]!
mov fp, sp
G_M32727_IG02: ;; offset=0x0008
zip1 v16.4s, v0.4s, v1.4s
zip2 v1.4s, v0.4s, v1.4s
mov v0.16b, v16.16b
G_M32727_IG03: ;; offset=0x0014
ldp fp, lr, [sp], #0x10
ret lr
; Total bytes of code 28
; Vector128.UnzipEven<int>(left, right)
; Emitting BLENDED_CODE for arm64 on Windows
G_M32745_IG01: ;; offset=0x0000
stp fp, lr, [sp, #-0x10]!
mov fp, sp
G_M32745_IG02: ;; offset=0x0008
uzp1 v0.4s, v0.4s, v1.4s
G_M32745_IG03: ;; offset=0x000C
ldp fp, lr, [sp], #0x10
ret lr
; Total bytes of code 20
; Vector128.UnzipOdd<int>(left, right)
; Emitting BLENDED_CODE for arm64 on Windows
G_M32638_IG01: ;; offset=0x0000
stp fp, lr, [sp, #-0x10]!
mov fp, sp
G_M32638_IG02: ;; offset=0x0008
uzp2 v0.4s, v0.4s, v1.4s
G_M32638_IG03: ;; offset=0x000C
ldp fp, lr, [sp], #0x10
ret lr
; Total bytes of code 20
; Vector128.Unzip<int>(left, right)
; Emitting BLENDED_CODE for arm64 on Windows
G_M7116_IG01: ;; offset=0x0000
stp fp, lr, [sp, #-0x10]!
mov fp, sp
G_M7116_IG02: ;; offset=0x0008
uzp1 v16.4s, v0.4s, v1.4s
uzp2 v1.4s, v0.4s, v1.4s
mov v0.16b, v16.16b
G_M7116_IG03: ;; offset=0x0014
ldp fp, lr, [sp], #0x10
ret lr
; Total bytes of code 28
; Vector128.Reverse<int>(vector)
; Emitting BLENDED_CODE for arm64 on Windows
G_M36184_IG01: ;; offset=0x0000
stp fp, lr, [sp, #-0x10]!
mov fp, sp
G_M36184_IG02: ;; offset=0x0008
ldr q16, [@rwd00]
tbl v0.16b, {v0.16b}, v16.16b
G_M36184_IG03: ;; offset=0x0010
ldp fp, lr, [sp], #0x10
ret lr
RWD00 dq 0B0A09080F0E0D0Ch, 0302010007060504h
; Total bytes of code 24
```
</details>
Codegen for constant input:
<details>
<summary>Vector256</summary>
```asm
; Vector256.CreateGeometricSequence<int>(2, 3)
; Emitting BLENDED_CODE for x64 + VEX + EVEX on Windows
G_M53517_IG01: ;; offset=0x0000
G_M53517_IG02: ;; offset=0x0000
vmovups ymm0, ymmword ptr [reloc @rwd00]
vmovups ymmword ptr [rcx], ymm0
mov rax, rcx
G_M53517_IG03: ;; offset=0x000F
vzeroupper ret RWD00 dq	0000000600000002h, 0000003600000012h, 000001E6000000A2h, 00001116000005B2h
; Total bytes of code 19
; Vector256.CreateAlternatingSequence<int>(5, 7)
; Emitting BLENDED_CODE for x64 + VEX + EVEX on Windows
G_M39644_IG01: ;; offset=0x0000
G_M39644_IG02: ;; offset=0x0000
vbroadcastsd ymm0, qword ptr [reloc @rwd00]
vmovups ymmword ptr [rcx], ymm0
mov rax, rcx
G_M39644_IG03: ;; offset=0x0010
vzeroupper ret RWD00 dq	0000000700000005h
; Total bytes of code 20
; Vector256.CreateHarmonicSequence<float>(1.0f, 2.0f)
; Emitting BLENDED_CODE for x64 + VEX + EVEX on Windows
G_M64276_IG01: ;; offset=0x0000
G_M64276_IG02: ;; offset=0x0000
vmovups ymm0, ymmword ptr [reloc @rwd00]
vmovups ymmword ptr [rcx], ymm0
mov rax, rcx
G_M64276_IG03: ;; offset=0x000F
vzeroupper ret RWD00 dq	3EAAAAAB3F800000h, 3E1249253E4CCCCDh, 3DBA2E8C3DE38E39h, 3D8888893D9D89D9h
; Total bytes of code 19
```
</details>
<details>
<summary>Vector512</summary>
```asm
; Vector512.CreateGeometricSequence<int>(2, 3)
; Emitting BLENDED_CODE for x64 + VEX + EVEX on Windows
G_M22445_IG01: ;; offset=0x0000
G_M22445_IG02: ;; offset=0x0000
vmovups zmm0, zmmword ptr [reloc @rwd00]
vmovups zmmword ptr [rcx], zmm0
mov rax, rcx
G_M22445_IG03: ;; offset=0x0013
vzeroupper ret RWD00 dq	0000000600000002h, 0000003600000012h, 000001E6000000A2h, 00001116000005B2h, 000099C600003342h, 000567F60001CD52h, 0030A7A6001037E2h, 01B5E4D60091F6F2h
; Total bytes of code 23
; Vector512.CreateAlternatingSequence<int>(5, 7)
; Emitting BLENDED_CODE for x64 + VEX + EVEX on Windows
G_M9468_IG01: ;; offset=0x0000
G_M9468_IG02: ;; offset=0x0000
vbroadcastsd zmm0, qword ptr [reloc @rwd00]
vmovups zmmword ptr [rcx], zmm0
mov rax, rcx
G_M9468_IG03: ;; offset=0x0013
vzeroupper ret RWD00 dq	0000000700000005h
; Total bytes of code 23
; Vector512.CreateHarmonicSequence<float>(1.0f, 2.0f)
; Emitting BLENDED_CODE for x64 + VEX + EVEX on Windows
G_M13716_IG01: ;; offset=0x0000
G_M13716_IG02: ;; offset=0x0000
vmovups zmm0, zmmword ptr [reloc @rwd00]
vmovups zmmword ptr [rcx], zmm0
mov rax, rcx
G_M13716_IG03: ;; offset=0x0013
vzeroupper ret RWD00 dq	3EAAAAAB3F800000h, 3E1249253E4CCCCDh, 3DBA2E8C3DE38E39h, 3D8888893D9D89D9h, 3D5794363D70F0F1h, 3D3216433D430C31h, 3D17B4263D23D70Ah, 3D0421083D0D3DCBh
; Total bytes of code 23
```
</details>
<details>
<summary>Vector512 without AVX512 - Vector256 decomposition
path</summary>
```asm
; Vector512.CreateGeometricSequence<int>(2, 3)
; Emitting BLENDED_CODE for x64 + VEX on Windows
G_M22445_IG01: ;; offset=0x0000
G_M22445_IG02: ;; offset=0x0000
vmovups ymm0, ymmword ptr [reloc @rwd00]
vmovups ymm1, ymmword ptr [reloc @RWD32]
vmovups ymmword ptr [rcx], ymm1
vmovups ymmword ptr [rcx+0x20], ymm0
mov rax, rcx
G_M22445_IG03: ;; offset=0x001C
vzeroupper ret RWD00 dq	000099C600003342h, 000567F60001CD52h, 0030A7A6001037E2h, 01B5E4D60091F6F2h
RWD32 dq	0000000600000002h, 0000003600000012h, 000001E6000000A2h, 00001116000005B2h
; Total bytes of code 32
; Vector512.CreateAlternatingSequence<int>(5, 7)
; Emitting BLENDED_CODE for x64 + VEX on Windows
G_M9468_IG01: ;; offset=0x0000
G_M9468_IG02: ;; offset=0x0000
vbroadcastsd ymm0, qword ptr [reloc @rwd00]
vmovups ymmword ptr [rcx], ymm0
vmovups ymmword ptr [rcx+0x20], ymm0
mov rax, rcx
G_M9468_IG03: ;; offset=0x0015
vzeroupper ret RWD00 dq	0000000700000005h
; Total bytes of code 25
; Vector512.CreateHarmonicSequence<float>(1.0f, 2.0f)
; Emitting BLENDED_CODE for x64 + VEX on Windows
G_M13716_IG01: ;; offset=0x0000
G_M13716_IG02: ;; offset=0x0000
vmovups ymm0, ymmword ptr [reloc @rwd00]
vmovups ymmword ptr [rcx], ymm0
vmovups ymm0, ymmword ptr [reloc @RWD32]
vmovups ymmword ptr [rcx+0x20], ymm0
mov rax, rcx
G_M13716_IG03: ;; offset=0x001C
vzeroupper ret RWD00 dq	3EAAAAAB3F800000h, 3E1249253E4CCCCDh, 3DBA2E8C3DE38E39h, 3D8888893D9D89D9h
RWD32 dq	3D5794363D70F0F1h, 3D3216433D430C31h, 3D17B4263D23D70Ah, 3D0421083D0D3DCBh
; Total bytes of code 32
```
</details>
Closesdotnet#122557
cc: @tannergooding
ManickaP pushed a commit that referenced this pull request Jul 22, 2026
This PR adds lane construction and composition APIs approved in dotnet#122557,
and the corresponding JIT intrinsics.
The JIT now recognizes the new vector APIs and expands them using
existing SIMD nodes. The managed implementation allows decomposition
through smaller vector widths when wider hardware support is
unavailable.
The xarch lowering uses fixed shuffle forms where profitable:
- `vpbroadcast*` for sequence and alternating construction
- vshufps and vpunpck* for 128-bit concat/zip/unzip patterns
- full-width unpack plus `vperm2i128` for 256-bit zip/unzip
- EVEX shuffle/permute forms for 512-bit operations when AVX512 is
available
- fixed immediate shuffles for reverse
The ARM64 lowering avoids table-lookup forms for small fixed
concat/reverse operations and uses direct element moves where
applicable, such as `ins` and `rev64`.
`CreateCauchySequence` has been removed as it doesn't make sense at all.
And `SignSequence` has been moved to an extension property as we only
want to expose it for signed numbers.
Codegen:
<details>
<summary>Vector128</summary>
```asm
; Vector128.CreateGeometricSequence<int>(initial, 3)
; Emitting BLENDED_CODE for x64 + VEX + EVEX on Windows
G_M55419_IG01: ;; offset=0x0000
G_M55419_IG02: ;; offset=0x0000
vpbroadcastd xmm0, edx
vpmulld xmm0, xmm0, xmmword ptr [reloc @rwd00]
vmovups xmmword ptr [rcx], xmm0
mov rax, rcx
G_M55419_IG03: ;; offset=0x0016
ret RWD00 dq	0000000300000001h, 0000001B00000009h
; Total bytes of code 23
; Vector128.CreateAlternatingSequence<int>(even, odd)
; Emitting BLENDED_CODE for x64 + VEX + EVEX on Windows
G_M23632_IG01: ;; offset=0x0000
G_M23632_IG02: ;; offset=0x0000
vpbroadcastd xmm0, edx
vpbroadcastd xmm1, r8d
vpunpckldq xmm0, xmm0, xmm1
vmovups xmmword ptr [rcx], xmm0
mov rax, rcx
G_M23632_IG03: ;; offset=0x0017
ret ; Total bytes of code 24
; Vector128<int>.SignSequence
; Emitting BLENDED_CODE for x64 + VEX + EVEX on Windows
G_M37526_IG01: ;; offset=0x0000
G_M37526_IG02: ;; offset=0x0000
vmovddup xmm0, qword ptr [reloc @rwd00]
vmovups xmmword ptr [rcx], xmm0
mov rax, rcx
G_M37526_IG03: ;; offset=0x000F
ret RWD00 dq	FFFFFFFF00000001h
; Total bytes of code 16
; Vector128.CreateHarmonicSequence<float>(start, step)
; Emitting BLENDED_CODE for x64 + VEX + EVEX on Windows
G_M24925_IG01: ;; offset=0x0000
G_M24925_IG02: ;; offset=0x0000
vbroadcastss xmm0, xmm2
vmulps xmm0, xmm0, xmmword ptr [reloc @rwd00]
vbroadcastss xmm1, xmm1
vaddps xmm0, xmm1, xmm0
vbroadcastss xmm1, dword ptr [reloc @RWD16]
vdivps xmm0, xmm1, xmm0
vmovups xmmword ptr [rcx], xmm0
mov rax, rcx
G_M24925_IG03: ;; offset=0x002A
ret RWD00 dq	3F80000000000000h, 4040000040000000h
RWD16 dd	3F800000h ; 1
; Total bytes of code 43
; Vector128.CreateGeometricSequence<float>(initial, 3.0f)
; Emitting BLENDED_CODE for x64 + VEX + EVEX on Windows
G_M52564_IG01: ;; offset=0x0000
G_M52564_IG02: ;; offset=0x0000
vbroadcastss xmm0, xmm1
vmulps xmm0, xmm0, xmmword ptr [reloc @rwd00]
vmovups xmmword ptr [rcx], xmm0
mov rax, rcx
G_M52564_IG03: ;; offset=0x0014
ret RWD00 dq	404000003F800000h, 41D8000041100000h
; Total bytes of code 21
; Vector128.ConcatLowerLower<int>(left, right)
; Emitting BLENDED_CODE for x64 + VEX + EVEX on Windows
G_M47101_IG01: ;; offset=0x0000
G_M47101_IG02: ;; offset=0x0000
vmovups xmm0, xmmword ptr [rdx]
vshufps xmm0, xmm0, xmmword ptr [r8], 68
vmovups xmmword ptr [rcx], xmm0
mov rax, rcx
G_M47101_IG03: ;; offset=0x0011
ret ; Total bytes of code 18
; Vector128.ConcatLowerUpper<int>(left, right)
; Emitting BLENDED_CODE for x64 + VEX + EVEX on Windows
G_M48932_IG01: ;; offset=0x0000
G_M48932_IG02: ;; offset=0x0000
vmovups xmm0, xmmword ptr [rdx]
vshufps xmm0, xmm0, xmmword ptr [r8], -28
vmovups xmmword ptr [rcx], xmm0
mov rax, rcx
G_M48932_IG03: ;; offset=0x0011
ret ; Total bytes of code 18
; Vector128.ConcatUpperLower<int>(left, right)
; Emitting BLENDED_CODE for x64 + VEX + EVEX on Windows
G_M24196_IG01: ;; offset=0x0000
G_M24196_IG02: ;; offset=0x0000
vmovups xmm0, xmmword ptr [rdx]
vshufps xmm0, xmm0, xmmword ptr [r8], 78
vmovups xmmword ptr [rcx], xmm0
mov rax, rcx
G_M24196_IG03: ;; offset=0x0011
ret ; Total bytes of code 18
; Vector128.ConcatUpperUpper<int>(left, right)
; Emitting BLENDED_CODE for x64 + VEX + EVEX on Windows
G_M45405_IG01: ;; offset=0x0000
G_M45405_IG02: ;; offset=0x0000
vmovups xmm0, xmmword ptr [rdx]
vshufps xmm0, xmm0, xmmword ptr [r8], -18
vmovups xmmword ptr [rcx], xmm0
mov rax, rcx
G_M45405_IG03: ;; offset=0x0011
ret ; Total bytes of code 18
; Vector128.ZipLower<int>(left, right)
; Emitting BLENDED_CODE for x64 + VEX + EVEX on Windows
G_M10057_IG01: ;; offset=0x0000
G_M10057_IG02: ;; offset=0x0000
vmovups xmm0, xmmword ptr [rdx]
vpunpckldq xmm0, xmm0, xmmword ptr [r8]
vmovups xmmword ptr [rcx], xmm0
mov rax, rcx
G_M10057_IG03: ;; offset=0x0010
ret ; Total bytes of code 17
; Vector128.ZipUpper<int>(left, right)
; Emitting BLENDED_CODE for x64 + VEX + EVEX on Windows
G_M48936_IG01: ;; offset=0x0000
G_M48936_IG02: ;; offset=0x0000
vmovups xmm0, xmmword ptr [rdx]
vpunpckhdq xmm0, xmm0, xmmword ptr [r8]
vmovups xmmword ptr [rcx], xmm0
mov rax, rcx
G_M48936_IG03: ;; offset=0x0010
ret ; Total bytes of code 17
; Vector128.Zip<int>(left, right)
; Emitting BLENDED_CODE for x64 + VEX + EVEX on Windows
G_M32727_IG01: ;; offset=0x0000
G_M32727_IG02: ;; offset=0x0000
vmovups xmm0, xmmword ptr [rdx]
vmovups xmm1, xmmword ptr [r8]
vpunpckldq xmm2, xmm0, xmm1
vpunpckhdq xmm0, xmm0, xmm1
vmovups xmmword ptr [rcx], xmm2
vmovups xmmword ptr [rcx+0x10], xmm0
mov rax, rcx
G_M32727_IG03: ;; offset=0x001D
ret ; Total bytes of code 30
; Vector128.UnzipEven<int>(left, right)
; Emitting BLENDED_CODE for x64 + VEX + EVEX on Windows
G_M32745_IG01: ;; offset=0x0000
G_M32745_IG02: ;; offset=0x0000
vmovups xmm0, xmmword ptr [rdx]
vshufps xmm0, xmm0, xmmword ptr [r8], -120
vmovups xmmword ptr [rcx], xmm0
mov rax, rcx
G_M32745_IG03: ;; offset=0x0011
ret ; Total bytes of code 18
; Vector128.UnzipOdd<int>(left, right)
; Emitting BLENDED_CODE for x64 + VEX + EVEX on Windows
G_M32638_IG01: ;; offset=0x0000
G_M32638_IG02: ;; offset=0x0000
vmovups xmm0, xmmword ptr [rdx]
vshufps xmm0, xmm0, xmmword ptr [r8], -35
vmovups xmmword ptr [rcx], xmm0
mov rax, rcx
G_M32638_IG03: ;; offset=0x0011
ret ; Total bytes of code 18
; Vector128.Unzip<int>(left, right)
; Emitting BLENDED_CODE for x64 + VEX + EVEX on Windows
G_M7116_IG01: ;; offset=0x0000
G_M7116_IG02: ;; offset=0x0000
vmovups xmm0, xmmword ptr [rdx]
vmovups xmm1, xmmword ptr [r8]
vshufps xmm2, xmm0, xmm1, -120
vshufps xmm0, xmm0, xmm1, -35
vmovups xmmword ptr [rcx], xmm2
vmovups xmmword ptr [rcx+0x10], xmm0
mov rax, rcx
G_M7116_IG03: ;; offset=0x001F
ret ; Total bytes of code 32
; Vector128.Reverse<int>(vector)
; Emitting BLENDED_CODE for x64 + VEX + EVEX on Windows
G_M36184_IG01: ;; offset=0x0000
G_M36184_IG02: ;; offset=0x0000
vpshufd xmm0, xmmword ptr [rdx], 27
vmovups xmmword ptr [rcx], xmm0
mov rax, rcx
G_M36184_IG03: ;; offset=0x000C
ret ; Total bytes of code 13
```
</details>
<details>
<summary>Vector256</summary>
```asm
; Vector256.CreateGeometricSequence<int>(initial, 3)
; Emitting BLENDED_CODE for x64 + VEX + EVEX on Windows
G_M59643_IG01: ;; offset=0x0000
G_M59643_IG02: ;; offset=0x0000
vpbroadcastd ymm0, edx
vpmulld ymm0, ymm0, ymmword ptr [reloc @rwd00]
vmovups ymmword ptr [rcx], ymm0
mov rax, rcx
G_M59643_IG03: ;; offset=0x0016
vzeroupper ret RWD00 dq	0000000300000001h, 0000001B00000009h, 000000F300000051h, 0000088B000002D9h
; Total bytes of code 26
; Vector256.CreateAlternatingSequence<int>(even, odd)
; Emitting BLENDED_CODE for x64 + VEX + EVEX on Windows
G_M40720_IG01: ;; offset=0x0000
G_M40720_IG02: ;; offset=0x0000
vpbroadcastd ymm0, edx
vmovups ymm1, ymmword ptr [reloc @rwd00]
vpbroadcastd ymm2, r8d
vpermt2d ymm2, ymm1, ymm0
vmovups ymmword ptr [rcx], ymm2
mov rax, rcx
G_M40720_IG03: ;; offset=0x0021
vzeroupper ret RWD00 dq	0000000000000008h, 0000000100000009h, 000000020000000Ah, 000000030000000Bh
; Total bytes of code 37
; Vector256<int>.SignSequence
; Emitting BLENDED_CODE for x64 + VEX + EVEX on Windows
G_M7766_IG01: ;; offset=0x0000
G_M7766_IG02: ;; offset=0x0000
vbroadcastsd ymm0, qword ptr [reloc @rwd00]
vmovups ymmword ptr [rcx], ymm0
mov rax, rcx
G_M7766_IG03: ;; offset=0x0010
vzeroupper ret RWD00 dq	FFFFFFFF00000001h
; Total bytes of code 20
; Vector256.CreateHarmonicSequence<float>(start, step)
; Emitting BLENDED_CODE for x64 + VEX + EVEX on Windows
G_M59741_IG01: ;; offset=0x0000
G_M59741_IG02: ;; offset=0x0000
vbroadcastss ymm0, ymm2
vmulps ymm0, ymm0, ymmword ptr [reloc @rwd00]
vbroadcastss ymm1, ymm1
vaddps ymm0, ymm1, ymm0
vbroadcastss ymm1, dword ptr [reloc @RWD32]
vdivps ymm0, ymm1, ymm0
vmovups ymmword ptr [rcx], ymm0
mov rax, rcx
G_M59741_IG03: ;; offset=0x002A
vzeroupper ret RWD00 dq	3F80000000000000h, 4040000040000000h, 40A0000040800000h, 40E0000040C00000h
RWD32 dd	3F800000h ; 1
; Total bytes of code 46
; Vector256.CreateGeometricSequence<float>(initial, 3.0f)
; Emitting BLENDED_CODE for x64 + VEX + EVEX on Windows
G_M42068_IG01: ;; offset=0x0000
G_M42068_IG02: ;; offset=0x0000
vbroadcastss ymm0, ymm1
vmulps ymm0, ymm0, ymmword ptr [reloc @rwd00]
vmovups ymmword ptr [rcx], ymm0
mov rax, rcx
G_M42068_IG03: ;; offset=0x0014
vzeroupper ret RWD00 dq	404000003F800000h, 41D8000041100000h, 4373000042A20000h, 4508B00044364000h
; Total bytes of code 24
; Vector256.ConcatLowerLower<int>(left, right)
; Emitting BLENDED_CODE for x64 + VEX + EVEX on Windows
G_M46973_IG01: ;; offset=0x0000
G_M46973_IG02: ;; offset=0x0000
vmovups ymm0, ymmword ptr [rdx]
vmovdqu xmm1, xmmword ptr [r8]
vinserti128 ymm0, ymm0, xmm1
vmovups ymmword ptr [rcx], ymm0
mov rax, rcx
G_M46973_IG03: ;; offset=0x0016
vzeroupper ret ; Total bytes of code 26
; Vector256.ConcatLowerUpper<int>(left, right)
; Emitting BLENDED_CODE for x64 + VEX + EVEX on Windows
G_M9060_IG01: ;; offset=0x0000
G_M9060_IG02: ;; offset=0x0000
vmovups ymm0, ymmword ptr [rdx]
vmovups ymm1, ymmword ptr [r8]
vextracti128 xmm1, ymm1
vinserti128 ymm0, ymm0, xmm1
vmovups ymmword ptr [rcx], ymm0
mov rax, rcx
G_M9060_IG03: ;; offset=0x001C
vzeroupper ret ; Total bytes of code 32
; Vector256.ConcatUpperLower<int>(left, right)
; Emitting BLENDED_CODE for x64 + VEX + EVEX on Windows
G_M57796_IG01: ;; offset=0x0000
G_M57796_IG02: ;; offset=0x0000
vmovups ymm0, ymmword ptr [rdx]
vextracti128 xmm0, ymm0
vmovdqu xmm1, xmmword ptr [r8]
vinserti128 ymm0, ymm0, xmm1
vmovups ymmword ptr [rcx], ymm0
mov rax, rcx
G_M57796_IG03: ;; offset=0x001C
vzeroupper ret ; Total bytes of code 32
; Vector256.ConcatUpperUpper<int>(left, right)
; Emitting BLENDED_CODE for x64 + VEX + EVEX on Windows
G_M7901_IG01: ;; offset=0x0000
G_M7901_IG02: ;; offset=0x0000
vmovups ymm0, ymmword ptr [rdx]
vextracti128 xmm0, ymm0
vmovups ymm1, ymmword ptr [r8]
vinserti128 ymm0, ymm1, xmm0
vmovups ymmword ptr [rcx], ymm0
mov rax, rcx
G_M7901_IG03: ;; offset=0x001C
vzeroupper ret ; Total bytes of code 32
; Vector256.ZipLower<int>(left, right)
; Emitting BLENDED_CODE for x64 + VEX + EVEX on Windows
G_M61705_IG01: ;; offset=0x0000
G_M61705_IG02: ;; offset=0x0000
vmovups ymm0, ymmword ptr [rdx]
vmovups ymm1, ymmword ptr [reloc @rwd00]
vpermt2d ymm0, ymm1, ymmword ptr [r8]
vmovups ymmword ptr [rcx], ymm0
mov rax, rcx
G_M61705_IG03: ;; offset=0x0019
vzeroupper ret RWD00 dq	0000000800000000h, 0000000900000001h, 0000000A00000002h, 0000000B00000003h
; Total bytes of code 29
; Vector256.ZipUpper<int>(left, right)
; Emitting BLENDED_CODE for x64 + VEX + EVEX on Windows
G_M38056_IG01: ;; offset=0x0000
G_M38056_IG02: ;; offset=0x0000
vmovups ymm0, ymmword ptr [rdx]
vmovups ymm1, ymmword ptr [reloc @rwd00]
vpermt2d ymm0, ymm1, ymmword ptr [r8]
vmovups ymmword ptr [rcx], ymm0
mov rax, rcx
G_M38056_IG03: ;; offset=0x0019
vzeroupper ret RWD00 dq	0000000C00000004h, 0000000D00000005h, 0000000E00000006h, 0000000F00000007h
; Total bytes of code 29
; Vector256.Zip<int>(left, right)
; Emitting BLENDED_CODE for x64 + VEX + EVEX on Windows
G_M24445_IG01: ;; offset=0x0000
G_M24445_IG02: ;; offset=0x0000
vmovups ymm0, ymmword ptr [rdx]
vmovups ymm1, ymmword ptr [r8]
vpunpckldq ymm2, ymm0, ymm1
vpunpckhdq ymm0, ymm0, ymm1
vperm2i128 ymm1, ymm2, ymm0, 32
vperm2i128 ymm0, ymm2, ymm0, 49
vmovups ymmword ptr [rcx], ymm1
vmovups ymmword ptr [rcx+0x20], ymm0
mov rax, rcx
G_M24445_IG03: ;; offset=0x0029
vzeroupper ret ; Total bytes of code 45
; Vector256.UnzipEven<int>(left, right)
; Emitting BLENDED_CODE for x64 + VEX + EVEX on Windows
G_M4905_IG01: ;; offset=0x0000
G_M4905_IG02: ;; offset=0x0000
vmovups ymm0, ymmword ptr [rdx]
vmovups ymm1, ymmword ptr [reloc @rwd00]
vpermt2d ymm0, ymm1, ymmword ptr [r8]
vmovups ymmword ptr [rcx], ymm0
mov rax, rcx
G_M4905_IG03: ;; offset=0x0019
vzeroupper ret RWD00 dq	0000000200000000h, 0000000600000004h, 0000000A00000008h, 0000000E0000000Ch
; Total bytes of code 29
; Vector256.UnzipOdd<int>(left, right)
; Emitting BLENDED_CODE for x64 + VEX + EVEX on Windows
G_M54526_IG01: ;; offset=0x0000
G_M54526_IG02: ;; offset=0x0000
vmovups ymm0, ymmword ptr [rdx]
vmovups ymm1, ymmword ptr [reloc @rwd00]
vpermt2d ymm0, ymm1, ymmword ptr [r8]
vmovups ymmword ptr [rcx], ymm0
mov rax, rcx
G_M54526_IG03: ;; offset=0x0019
vzeroupper ret RWD00 dq	0000000300000001h, 0000000700000005h, 0000000B00000009h, 0000000F0000000Dh
; Total bytes of code 29
; Vector256.Unzip<int>(left, right)
; Emitting BLENDED_CODE for x64 + VEX + EVEX on Windows
G_M52326_IG01: ;; offset=0x0000
G_M52326_IG02: ;; offset=0x0000
vpshufd ymm0, ymmword ptr [rdx], -40
vpermq ymm0, ymm0, -40
vpshufd ymm1, ymmword ptr [r8], -40
vpermq ymm1, ymm1, -40
vperm2i128 ymm2, ymm0, ymm1, 32
vperm2i128 ymm0, ymm0, ymm1, 49
vmovups ymmword ptr [rcx], ymm2
vmovups ymmword ptr [rcx+0x20], ymm0
mov rax, rcx
G_M52326_IG03: ;; offset=0x002F
vzeroupper ret ; Total bytes of code 51
; Vector256.Reverse<int>(vector)
; Emitting BLENDED_CODE for x64 + VEX + EVEX on Windows
G_M23794_IG01: ;; offset=0x0000
G_M23794_IG02: ;; offset=0x0000
vmovups ymm0, ymmword ptr [reloc @rwd00]
vpermd ymm0, ymm0, ymmword ptr [rdx]
vmovups ymmword ptr [rcx], ymm0
mov rax, rcx
G_M23794_IG03: ;; offset=0x0014
vzeroupper ret RWD00 dq	0000000600000007h, 0000000400000005h, 0000000200000003h, 0000000000000001h
; Total bytes of code 24
```
</details>
<details>
<summary>Vector512</summary>
```asm
; Vector512.CreateGeometricSequence<int>(initial, 3)
; Emitting BLENDED_CODE for x64 + VEX + EVEX on Windows
G_M55451_IG01: ;; offset=0x0000
G_M55451_IG02: ;; offset=0x0000
vpbroadcastd zmm0, edx
vpmulld zmm0, zmm0, zmmword ptr [reloc @rwd00]
vmovups zmmword ptr [rcx], zmm0
mov rax, rcx
G_M55451_IG03: ;; offset=0x0019
vzeroupper ret RWD00 dq	0000000300000001h, 0000001B00000009h, 000000F300000051h, 0000088B000002D9h, 00004CE3000019A1h, 0002B3FB0000E6A9h, 001853D300081BF1h, 00DAF26B0048FB79h
; Total bytes of code 29
; Vector512.CreateAlternatingSequence<int>(even, odd)
; Emitting BLENDED_CODE for x64 + VEX + EVEX on Windows
G_M560_IG01: ;; offset=0x0000
G_M560_IG02: ;; offset=0x0000
vpbroadcastd zmm0, edx
vmovups zmm1, zmmword ptr [reloc @rwd00]
vpbroadcastd zmm2, r8d
vpermt2d zmm2, zmm1, zmm0
vmovups zmmword ptr [rcx], zmm2
mov rax, rcx
G_M560_IG03: ;; offset=0x0025
vzeroupper ret RWD00 dq	0000000000000010h, 0000000100000011h, 0000000200000012h, 0000000300000013h, 0000000400000014h, 0000000500000015h, 0000000600000016h, 0000000700000017h
; Total bytes of code 41
; Vector512<int>.SignSequence
; Emitting BLENDED_CODE for x64 + VEX + EVEX on Windows
G_M63542_IG01: ;; offset=0x0000
G_M63542_IG02: ;; offset=0x0000
vbroadcastsd zmm0, qword ptr [reloc @rwd00]
vmovups zmmword ptr [rcx], zmm0
mov rax, rcx
G_M63542_IG03: ;; offset=0x0013
vzeroupper ret RWD00 dq	FFFFFFFF00000001h
; Total bytes of code 23
; Vector512.CreateHarmonicSequence<float>(start, step)
; Emitting BLENDED_CODE for x64 + VEX + EVEX on Windows
G_M41245_IG01: ;; offset=0x0000
G_M41245_IG02: ;; offset=0x0000
vbroadcastss zmm0, zmm2
vmulps zmm0, zmm0, zmmword ptr [reloc @rwd00]
vbroadcastss zmm1, zmm1
vaddps zmm0, zmm1, zmm0
vbroadcastss zmm1, dword ptr [reloc @RWD64]
vdivps zmm0, zmm1, zmm0
vmovups zmmword ptr [rcx], zmm0
mov rax, rcx
G_M41245_IG03: ;; offset=0x0035
vzeroupper ret RWD00 dq	3F80000000000000h, 4040000040000000h, 40A0000040800000h, 40E0000040C00000h, 4110000041000000h, 4130000041200000h, 4150000041400000h, 4170000041600000h
RWD64 dd	3F800000h ; 1
; Total bytes of code 57
; Vector512.CreateGeometricSequence<float>(initial, 3.0f)
; Emitting BLENDED_CODE for x64 + VEX + EVEX on Windows
G_M35892_IG01: ;; offset=0x0000
G_M35892_IG02: ;; offset=0x0000
vbroadcastss zmm0, zmm1
vmulps zmm0, zmm0, zmmword ptr [reloc @rwd00]
vmovups zmmword ptr [rcx], zmm0
mov rax, rcx
G_M35892_IG03: ;; offset=0x0019
vzeroupper ret RWD00 dq	404000003F800000h, 41D8000041100000h, 4373000042A20000h, 4508B00044364000h, 4699C60045CD0800h, 482CFEC04766A900h, 49C29E984901BF10h, 4B5AF26B4A91F6F2h
; Total bytes of code 29
; Vector512.ConcatLowerLower<int>(left, right)
; Emitting BLENDED_CODE for x64 + VEX + EVEX on Windows
G_M13789_IG01: ;; offset=0x0000
G_M13789_IG02: ;; offset=0x0000
vmovups zmm0, zmmword ptr [rdx]
vmovdqu ymm1, ymmword ptr [r8]
vinserti32x8 zmm0, zmm0, ymm1, 1
vmovups zmmword ptr [rcx], zmm0
mov rax, rcx
G_M13789_IG03: ;; offset=0x001B
vzeroupper ret ; Total bytes of code 31
; Vector512.ConcatLowerUpper<int>(left, right)
; Emitting BLENDED_CODE for x64 + VEX + EVEX on Windows
G_M36420_IG01: ;; offset=0x0000
G_M36420_IG02: ;; offset=0x0000
vmovups zmm0, zmmword ptr [rdx]
vmovups zmm1, zmmword ptr [r8]
vextracti32x8 ymm1, zmm1, 1
vinserti32x8 zmm0, zmm0, ymm1, 1
vmovups zmmword ptr [rcx], zmm0
mov rax, rcx
G_M36420_IG03: ;; offset=0x0023
vzeroupper ret ; Total bytes of code 39
; Vector512.ConcatUpperLower<int>(left, right)
; Emitting BLENDED_CODE for x64 + VEX + EVEX on Windows
G_M56164_IG01: ;; offset=0x0000
G_M56164_IG02: ;; offset=0x0000
vmovups zmm0, zmmword ptr [rdx]
vextracti32x8 ymm0, zmm0, 1
vmovdqu ymm1, ymmword ptr [r8]
vinserti32x8 zmm0, zmm0, ymm1, 1
vmovups zmmword ptr [rcx], zmm0
mov rax, rcx
G_M56164_IG03: ;; offset=0x0022
vzeroupper ret ; Total bytes of code 38
; Vector512.ConcatUpperUpper<int>(left, right)
; Emitting BLENDED_CODE for x64 + VEX + EVEX on Windows
G_M13821_IG01: ;; offset=0x0000
G_M13821_IG02: ;; offset=0x0000
vmovups zmm0, zmmword ptr [rdx]
vextracti32x8 ymm0, zmm0, 1
vmovups zmm1, zmmword ptr [r8]
vinserti32x8 zmm0, zmm1, ymm0, 0
vmovups zmmword ptr [rcx], zmm0
mov rax, rcx
G_M13821_IG03: ;; offset=0x0023
vzeroupper ret ; Total bytes of code 39
; Vector512.ZipLower<int>(left, right)
; Emitting BLENDED_CODE for x64 + VEX + EVEX on Windows
G_M59881_IG01: ;; offset=0x0000
G_M59881_IG02: ;; offset=0x0000
vmovups zmm0, zmmword ptr [rdx]
vmovups zmm1, zmmword ptr [reloc @rwd00]
vpermt2d zmm0, zmm1, zmmword ptr [r8]
vmovups zmmword ptr [rcx], zmm0
mov rax, rcx
G_M59881_IG03: ;; offset=0x001F
vzeroupper ret RWD00 dq	0000001000000000h, 0000001100000001h, 0000001200000002h, 0000001300000003h, 0000001400000004h, 0000001500000005h, 0000001600000006h, 0000001700000007h
; Total bytes of code 35
; Vector512.ZipUpper<int>(left, right)
; Emitting BLENDED_CODE for x64 + VEX + EVEX on Windows
G_M10568_IG01: ;; offset=0x0000
G_M10568_IG02: ;; offset=0x0000
vmovups zmm0, zmmword ptr [rdx]
vmovups zmm1, zmmword ptr [reloc @rwd00]
vpermt2d zmm0, zmm1, zmmword ptr [r8]
vmovups zmmword ptr [rcx], zmm0
mov rax, rcx
G_M10568_IG03: ;; offset=0x001F
vzeroupper ret RWD00 dq	0000001800000008h, 0000001900000009h, 0000001A0000000Ah, 0000001B0000000Bh, 0000001C0000000Ch, 0000001D0000000Dh, 0000001E0000000Eh, 0000001F0000000Fh
; Total bytes of code 35
; Vector512.Zip<int>(left, right)
; Emitting BLENDED_CODE for x64 + VEX + EVEX on Windows
G_M59130_IG01: ;; offset=0x0000
G_M59130_IG02: ;; offset=0x0000
vmovups zmm0, zmmword ptr [rdx]
vmovups zmm1, zmmword ptr [r8]
vpunpckhdq zmm2, zmm0, zmm1
vpunpckldq zmm0, zmm0, zmm1
vshufi32x4 zmm1, zmm0, zmm2, 68
vshufi32x4 zmm1, zmm1, zmm1, -40
vshufi32x4 zmm0, zmm0, zmm2, -18
vshufi32x4 zmm0, zmm0, zmm0, -40
vmovups zmmword ptr [rcx], zmm1
vmovups zmmword ptr [rcx+0x40], zmm0
mov rax, rcx
G_M59130_IG03: ;; offset=0x0044
vzeroupper ret ; Total bytes of code 72
; Vector512.UnzipEven<int>(left, right)
; Emitting BLENDED_CODE for x64 + VEX + EVEX on Windows
G_M30057_IG01: ;; offset=0x0000
G_M30057_IG02: ;; offset=0x0000
vmovups zmm0, zmmword ptr [rdx]
vmovups zmm1, zmmword ptr [reloc @rwd00]
vpermt2d zmm0, zmm1, zmmword ptr [r8]
vmovups zmmword ptr [rcx], zmm0
mov rax, rcx
G_M30057_IG03: ;; offset=0x001F
vzeroupper ret RWD00 dq	0000000200000000h, 0000000600000004h, 0000000A00000008h, 0000000E0000000Ch, 0000001200000010h, 0000001600000014h, 0000001A00000018h, 0000001E0000001Ch
; Total bytes of code 35
; Vector512.UnzipOdd<int>(left, right)
; Emitting BLENDED_CODE for x64 + VEX + EVEX on Windows
G_M65310_IG01: ;; offset=0x0000
G_M65310_IG02: ;; offset=0x0000
vmovups zmm0, zmmword ptr [rdx]
vmovups zmm1, zmmword ptr [reloc @rwd00]
vpermt2d zmm0, zmm1, zmmword ptr [r8]
vmovups zmmword ptr [rcx], zmm0
mov rax, rcx
G_M65310_IG03: ;; offset=0x001F
vzeroupper ret RWD00 dq	0000000300000001h, 0000000700000005h, 0000000B00000009h, 0000000F0000000Dh, 0000001300000011h, 0000001700000015h, 0000001B00000019h, 0000001F0000001Dh
; Total bytes of code 35
; Vector512.Unzip<int>(left, right)
; Emitting BLENDED_CODE for x64 + VEX + EVEX on Windows
G_M1377_IG01: ;; offset=0x0000
G_M1377_IG02: ;; offset=0x0000
vmovups zmm0, zmmword ptr [rdx]
vmovups zmm1, zmmword ptr [reloc @rwd00]
vmovups zmm2, zmmword ptr [r8]
vmovaps zmm3, zmm2
vpermt2d zmm3, zmm1, zmm0
vmovups zmm1, zmmword ptr [reloc @RWD64]
vpermt2d zmm2, zmm1, zmm0
vmovups zmmword ptr [rcx], zmm2
vmovups zmmword ptr [rcx+0x40], zmm3
mov rax, rcx
G_M1377_IG03: ;; offset=0x0042
vzeroupper ret RWD00 dq	0000001300000011h, 0000001700000015h, 0000001B00000019h, 0000001F0000001Dh, 0000000300000001h, 0000000700000005h, 0000000B00000009h, 0000000F0000000Dh
RWD64 dq	0000001200000010h, 0000001600000014h, 0000001A00000018h, 0000001E0000001Ch, 0000000200000000h, 0000000600000004h, 0000000A00000008h, 0000000E0000000Ch
; Total bytes of code 70
; Vector512.Reverse<int>(vector)
; Emitting BLENDED_CODE for x64 + VEX + EVEX on Windows
G_M34517_IG01: ;; offset=0x0000
G_M34517_IG02: ;; offset=0x0000
vmovups zmm0, zmmword ptr [reloc @rwd00]
vpermd zmm0, zmm0, zmmword ptr [rdx]
vmovups zmmword ptr [rcx], zmm0
mov rax, rcx
G_M34517_IG03: ;; offset=0x0019
vzeroupper ret RWD00 dq	0000000E0000000Fh, 0000000C0000000Dh, 0000000A0000000Bh, 0000000800000009h, 0000000600000007h, 0000000400000005h, 0000000200000003h, 0000000000000001h
; Total bytes of code 29
```
</details>
<details>
<summary>ARM64</summary>
```asm
; Vector64.CreateGeometricSequence<int>(initial, 3)
; Emitting BLENDED_CODE for arm64 on Windows
G_M6971_IG01: ;; offset=0x0000
stp fp, lr, [sp, #-0x10]!
mov fp, sp
G_M6971_IG02: ;; offset=0x0008
dup v0.2s, w0
ldr d16, [@rwd00]
mul v0.2s, v0.2s, v16.2s
G_M6971_IG03: ;; offset=0x0014
ldp fp, lr, [sp], #0x10
ret lr
RWD00 dq 0000000300000001h
; Total bytes of code 28
; Vector64.CreateAlternatingSequence<int>(even, odd)
; Emitting BLENDED_CODE for arm64 on Windows
G_M10160_IG01: ;; offset=0x0000
stp fp, lr, [sp, #-0x10]!
mov fp, sp
G_M10160_IG02: ;; offset=0x0008
dup v0.2s, w0
dup v16.2s, w1
zip1 v0.2s, v0.2s, v16.2s
G_M10160_IG03: ;; offset=0x0014
ldp fp, lr, [sp], #0x10
ret lr
; Total bytes of code 28
; Vector64<int>.SignSequence
; Emitting BLENDED_CODE for arm64 on Windows
G_M46198_IG01: ;; offset=0x0000
stp fp, lr, [sp, #-0x10]!
mov fp, sp
G_M46198_IG02: ;; offset=0x0008
ldr d0, [@rwd00]
G_M46198_IG03: ;; offset=0x000C
ldp fp, lr, [sp], #0x10
ret lr
RWD00 dq FFFFFFFF00000001h
; Total bytes of code 20
; Vector64.CreateHarmonicSequence<float>(start, step)
; Emitting BLENDED_CODE for arm64 on Windows
G_M43901_IG01: ;; offset=0x0000
stp fp, lr, [sp, #-0x10]!
mov fp, sp
G_M43901_IG02: ;; offset=0x0008
ldr d16, [@rwd00]
fmul v16.2s, v16.2s, v1.s[0]
dup v0.2s, v0.s[0]
fadd v0.2s, v16.2s, v0.2s
ldr d16, [@RWD08]
fdiv v0.2s, v16.2s, v0.2s
G_M43901_IG03: ;; offset=0x0020
ldp fp, lr, [sp], #0x10
ret lr
RWD00 dq	3F80000000000000h
RWD08 dq	3F8000003F800000h
; Total bytes of code 40
; Vector64.ConcatLowerLower<int>(left, right)
; Emitting BLENDED_CODE for arm64 on Windows
G_M48061_IG01: ;; offset=0x0000
stp fp, lr, [sp, #-0x10]!
mov fp, sp
G_M48061_IG02: ;; offset=0x0008
ins v0.s[1], v1.s[0]
G_M48061_IG03: ;; offset=0x000C
ldp fp, lr, [sp], #0x10
ret lr
; Total bytes of code 20
; Vector64.ConcatLowerUpper<int>(left, right)
; Emitting BLENDED_CODE for arm64 on Windows
G_M62724_IG01: ;; offset=0x0000
stp fp, lr, [sp, #-0x10]!
mov fp, sp
G_M62724_IG02: ;; offset=0x0008
ins v0.s[1], v1.s[1]
G_M62724_IG03: ;; offset=0x000C
ldp fp, lr, [sp], #0x10
ret lr
; Total bytes of code 20
; Vector64.ConcatUpperLower<int>(left, right)
; Emitting BLENDED_CODE for arm64 on Windows
G_M2660_IG01: ;; offset=0x0000
stp fp, lr, [sp, #-0x10]!
mov fp, sp
G_M2660_IG02: ;; offset=0x0008
ins v0.s[0], v0.s[1]
ins v0.s[1], v1.s[0]
G_M2660_IG03: ;; offset=0x0010
ldp fp, lr, [sp], #0x10
ret lr
; Total bytes of code 24
; Vector64.ConcatUpperUpper<int>(left, right)
; Emitting BLENDED_CODE for arm64 on Windows
G_M55837_IG01: ;; offset=0x0000
stp fp, lr, [sp, #-0x10]!
mov fp, sp
G_M55837_IG02: ;; offset=0x0008
ins v0.s[0], v0.s[1]
ins v0.s[1], v1.s[1]
G_M55837_IG03: ;; offset=0x0010
ldp fp, lr, [sp], #0x10
ret lr
; Total bytes of code 24
; Vector64.ZipLower<int>(left, right)
; Emitting BLENDED_CODE for arm64 on Windows
G_M32585_IG01: ;; offset=0x0000
stp fp, lr, [sp, #-0x10]!
mov fp, sp
G_M32585_IG02: ;; offset=0x0008
zip1 v0.2s, v0.2s, v1.2s
G_M32585_IG03: ;; offset=0x000C
ldp fp, lr, [sp], #0x10
ret lr
; Total bytes of code 20
; Vector64.ZipUpper<int>(left, right)
; Emitting BLENDED_CODE for arm64 on Windows
G_M43976_IG01: ;; offset=0x0000
stp fp, lr, [sp, #-0x10]!
mov fp, sp
G_M43976_IG02: ;; offset=0x0008
zip2 v0.2s, v0.2s, v1.2s
G_M43976_IG03: ;; offset=0x000C
ldp fp, lr, [sp], #0x10
ret lr
; Total bytes of code 20
; Vector64.Zip<int>(left, right)
; Emitting BLENDED_CODE for arm64 on Windows
G_M14030_IG01: ;; offset=0x0000
stp fp, lr, [sp, #-0x10]!
mov fp, sp
G_M14030_IG02: ;; offset=0x0008
zip1 v16.2s, v0.2s, v1.2s
zip2 v1.2s, v0.2s, v1.2s
mov v0.8b, v16.8b
G_M14030_IG03: ;; offset=0x0014
ldp fp, lr, [sp], #0x10
ret lr
; Total bytes of code 28
; Vector64.UnzipEven<int>(left, right)
; Emitting BLENDED_CODE for arm64 on Windows
G_M26249_IG01: ;; offset=0x0000
stp fp, lr, [sp, #-0x10]!
mov fp, sp
G_M26249_IG02: ;; offset=0x0008
uzp1 v0.2s, v0.2s, v1.2s
G_M26249_IG03: ;; offset=0x000C
ldp fp, lr, [sp], #0x10
ret lr
; Total bytes of code 20
; Vector64.UnzipOdd<int>(left, right)
; Emitting BLENDED_CODE for arm64 on Windows
G_M25438_IG01: ;; offset=0x0000
stp fp, lr, [sp, #-0x10]!
mov fp, sp
G_M25438_IG02: ;; offset=0x0008
uzp2 v0.2s, v0.2s, v1.2s
G_M25438_IG03: ;; offset=0x000C
ldp fp, lr, [sp], #0x10
ret lr
; Total bytes of code 20
; Vector64.Unzip<int>(left, right)
; Emitting BLENDED_CODE for arm64 on Windows
G_M41813_IG01: ;; offset=0x0000
stp fp, lr, [sp, #-0x10]!
mov fp, sp
G_M41813_IG02: ;; offset=0x0008
uzp1 v16.2s, v0.2s, v1.2s
uzp2 v1.2s, v0.2s, v1.2s
mov v0.8b, v16.8b
G_M41813_IG03: ;; offset=0x0014
ldp fp, lr, [sp], #0x10
ret lr
; Total bytes of code 28
; Vector64.Reverse<int>(vector)
; Emitting BLENDED_CODE for arm64 on Windows
G_M63937_IG01: ;; offset=0x0000
stp fp, lr, [sp, #-0x10]!
mov fp, sp
G_M63937_IG02: ;; offset=0x0008
rev64 v0.2s, v0.2s
G_M63937_IG03: ;; offset=0x000C
ldp fp, lr, [sp], #0x10
ret lr
; Total bytes of code 20
; Vector128.CreateGeometricSequence<int>(initial, 3)
; Emitting BLENDED_CODE for arm64 on Windows
G_M55419_IG01: ;; offset=0x0000
stp fp, lr, [sp, #-0x10]!
mov fp, sp
G_M55419_IG02: ;; offset=0x0008
dup v0.4s, w0
ldr q16, [@rwd00]
mul v0.4s, v0.4s, v16.4s
G_M55419_IG03: ;; offset=0x0014
ldp fp, lr, [sp], #0x10
ret lr
RWD00 dq 0000000300000001h, 0000001B00000009h
; Total bytes of code 28
; Vector128.CreateAlternatingSequence<int>(even, odd)
; Emitting BLENDED_CODE for arm64 on Windows
G_M23632_IG01: ;; offset=0x0000
stp fp, lr, [sp, #-0x10]!
mov fp, sp
G_M23632_IG02: ;; offset=0x0008
dup v0.4s, w0
dup v16.4s, w1
zip1 v0.4s, v0.4s, v16.4s
G_M23632_IG03: ;; offset=0x0014
ldp fp, lr, [sp], #0x10
ret lr
; Total bytes of code 28
; Vector128<int>.SignSequence
; Emitting BLENDED_CODE for arm64 on Windows
G_M37526_IG01: ;; offset=0x0000
stp fp, lr, [sp, #-0x10]!
mov fp, sp
G_M37526_IG02: ;; offset=0x0008
ldr q0, [@rwd00]
G_M37526_IG03: ;; offset=0x000C
ldp fp, lr, [sp], #0x10
ret lr
RWD00 dq FFFFFFFF00000001h, FFFFFFFF00000001h
; Total bytes of code 20
; Vector128.CreateHarmonicSequence<float>(start, step)
; Emitting BLENDED_CODE for arm64 on Windows
G_M24925_IG01: ;; offset=0x0000
stp fp, lr, [sp, #-0x10]!
mov fp, sp
G_M24925_IG02: ;; offset=0x0008
ldr q16, [@rwd00]
fmul v16.4s, v16.4s, v1.s[0]
dup v0.4s, v0.s[0]
fadd v0.4s, v16.4s, v0.4s
ldr q16, [@RWD16]
fdiv v0.4s, v16.4s, v0.4s
G_M24925_IG03: ;; offset=0x0020
ldp fp, lr, [sp], #0x10
ret lr
RWD00 dq	3F80000000000000h, 4040000040000000h
RWD16 dq	3F8000003F800000h, 3F8000003F800000h
; Total bytes of code 40
; Vector128.ConcatLowerLower<int>(left, right)
; Emitting BLENDED_CODE for arm64 on Windows
G_M47101_IG01: ;; offset=0x0000
stp fp, lr, [sp, #-0x10]!
mov fp, sp
G_M47101_IG02: ;; offset=0x0008
ins v0.d[1], v1.d[0]
G_M47101_IG03: ;; offset=0x000C
ldp fp, lr, [sp], #0x10
ret lr
; Total bytes of code 20
; Vector128.ConcatLowerUpper<int>(left, right)
; Emitting BLENDED_CODE for arm64 on Windows
G_M48932_IG01: ;; offset=0x0000
stp fp, lr, [sp, #-0x10]!
mov fp, sp
G_M48932_IG02: ;; offset=0x0008
ext v16.16b, v1.16b, v1.16b, #8
ins v0.d[1], v16.d[0]
G_M48932_IG03: ;; offset=0x0010
ldp fp, lr, [sp], #0x10
ret lr
; Total bytes of code 24
; Vector128.ConcatUpperLower<int>(left, right)
; Emitting BLENDED_CODE for arm64 on Windows
G_M24196_IG01: ;; offset=0x0000
stp fp, lr, [sp, #-0x10]!
mov fp, sp
G_M24196_IG02: ;; offset=0x0008
ext v0.16b, v0.16b, v0.16b, #8
ins v0.d[1], v1.d[0]
G_M24196_IG03: ;; offset=0x0010
ldp fp, lr, [sp], #0x10
ret lr
; Total bytes of code 24
; Vector128.ConcatUpperUpper<int>(left, right)
; Emitting BLENDED_CODE for arm64 on Windows
G_M45405_IG01: ;; offset=0x0000
stp fp, lr, [sp, #-0x10]!
mov fp, sp
G_M45405_IG02: ;; offset=0x0008
ext v0.16b, v0.16b, v0.16b, #8
ins v1.d[0], v0.d[0]
mov v0.16b, v1.16b
G_M45405_IG03: ;; offset=0x0014
ldp fp, lr, [sp], #0x10
ret lr
; Total bytes of code 28
; Vector128.ZipLower<int>(left, right)
; Emitting BLENDED_CODE for arm64 on Windows
G_M10057_IG01: ;; offset=0x0000
stp fp, lr, [sp, #-0x10]!
mov fp, sp
G_M10057_IG02: ;; offset=0x0008
zip1 v0.4s, v0.4s, v1.4s
G_M10057_IG03: ;; offset=0x000C
ldp fp, lr, [sp], #0x10
ret lr
; Total bytes of code 20
; Vector128.ZipUpper<int>(left, right)
; Emitting BLENDED_CODE for arm64 on Windows
G_M48936_IG01: ;; offset=0x0000
stp fp, lr, [sp, #-0x10]!
mov fp, sp
G_M48936_IG02: ;; offset=0x0008
zip2 v0.4s, v0.4s, v1.4s
G_M48936_IG03: ;; offset=0x000C
ldp fp, lr, [sp], #0x10
ret lr
; Total bytes of code 20
; Vector128.Zip<int>(left, right)
; Emitting BLENDED_CODE for arm64 on Windows
G_M32727_IG01: ;; offset=0x0000
stp fp, lr, [sp, #-0x10]!
mov fp, sp
G_M32727_IG02: ;; offset=0x0008
zip1 v16.4s, v0.4s, v1.4s
zip2 v1.4s, v0.4s, v1.4s
mov v0.16b, v16.16b
G_M32727_IG03: ;; offset=0x0014
ldp fp, lr, [sp], #0x10
ret lr
; Total bytes of code 28
; Vector128.UnzipEven<int>(left, right)
; Emitting BLENDED_CODE for arm64 on Windows
G_M32745_IG01: ;; offset=0x0000
stp fp, lr, [sp, #-0x10]!
mov fp, sp
G_M32745_IG02: ;; offset=0x0008
uzp1 v0.4s, v0.4s, v1.4s
G_M32745_IG03: ;; offset=0x000C
ldp fp, lr, [sp], #0x10
ret lr
; Total bytes of code 20
; Vector128.UnzipOdd<int>(left, right)
; Emitting BLENDED_CODE for arm64 on Windows
G_M32638_IG01: ;; offset=0x0000
stp fp, lr, [sp, #-0x10]!
mov fp, sp
G_M32638_IG02: ;; offset=0x0008
uzp2 v0.4s, v0.4s, v1.4s
G_M32638_IG03: ;; offset=0x000C
ldp fp, lr, [sp], #0x10
ret lr
; Total bytes of code 20
; Vector128.Unzip<int>(left, right)
; Emitting BLENDED_CODE for arm64 on Windows
G_M7116_IG01: ;; offset=0x0000
stp fp, lr, [sp, #-0x10]!
mov fp, sp
G_M7116_IG02: ;; offset=0x0008
uzp1 v16.4s, v0.4s, v1.4s
uzp2 v1.4s, v0.4s, v1.4s
mov v0.16b, v16.16b
G_M7116_IG03: ;; offset=0x0014
ldp fp, lr, [sp], #0x10
ret lr
; Total bytes of code 28
; Vector128.Reverse<int>(vector)
; Emitting BLENDED_CODE for arm64 on Windows
G_M36184_IG01: ;; offset=0x0000
stp fp, lr, [sp, #-0x10]!
mov fp, sp
G_M36184_IG02: ;; offset=0x0008
ldr q16, [@rwd00]
tbl v0.16b, {v0.16b}, v16.16b
G_M36184_IG03: ;; offset=0x0010
ldp fp, lr, [sp], #0x10
ret lr
RWD00 dq 0B0A09080F0E0D0Ch, 0302010007060504h
; Total bytes of code 24
```
</details>
Codegen for constant input:
<details>
<summary>Vector256</summary>
```asm
; Vector256.CreateGeometricSequence<int>(2, 3)
; Emitting BLENDED_CODE for x64 + VEX + EVEX on Windows
G_M53517_IG01: ;; offset=0x0000
G_M53517_IG02: ;; offset=0x0000
vmovups ymm0, ymmword ptr [reloc @rwd00]
vmovups ymmword ptr [rcx], ymm0
mov rax, rcx
G_M53517_IG03: ;; offset=0x000F
vzeroupper ret RWD00 dq	0000000600000002h, 0000003600000012h, 000001E6000000A2h, 00001116000005B2h
; Total bytes of code 19
; Vector256.CreateAlternatingSequence<int>(5, 7)
; Emitting BLENDED_CODE for x64 + VEX + EVEX on Windows
G_M39644_IG01: ;; offset=0x0000
G_M39644_IG02: ;; offset=0x0000
vbroadcastsd ymm0, qword ptr [reloc @rwd00]
vmovups ymmword ptr [rcx], ymm0
mov rax, rcx
G_M39644_IG03: ;; offset=0x0010
vzeroupper ret RWD00 dq	0000000700000005h
; Total bytes of code 20
; Vector256.CreateHarmonicSequence<float>(1.0f, 2.0f)
; Emitting BLENDED_CODE for x64 + VEX + EVEX on Windows
G_M64276_IG01: ;; offset=0x0000
G_M64276_IG02: ;; offset=0x0000
vmovups ymm0, ymmword ptr [reloc @rwd00]
vmovups ymmword ptr [rcx], ymm0
mov rax, rcx
G_M64276_IG03: ;; offset=0x000F
vzeroupper ret RWD00 dq	3EAAAAAB3F800000h, 3E1249253E4CCCCDh, 3DBA2E8C3DE38E39h, 3D8888893D9D89D9h
; Total bytes of code 19
```
</details>
<details>
<summary>Vector512</summary>
```asm
; Vector512.CreateGeometricSequence<int>(2, 3)
; Emitting BLENDED_CODE for x64 + VEX + EVEX on Windows
G_M22445_IG01: ;; offset=0x0000
G_M22445_IG02: ;; offset=0x0000
vmovups zmm0, zmmword ptr [reloc @rwd00]
vmovups zmmword ptr [rcx], zmm0
mov rax, rcx
G_M22445_IG03: ;; offset=0x0013
vzeroupper ret RWD00 dq	0000000600000002h, 0000003600000012h, 000001E6000000A2h, 00001116000005B2h, 000099C600003342h, 000567F60001CD52h, 0030A7A6001037E2h, 01B5E4D60091F6F2h
; Total bytes of code 23
; Vector512.CreateAlternatingSequence<int>(5, 7)
; Emitting BLENDED_CODE for x64 + VEX + EVEX on Windows
G_M9468_IG01: ;; offset=0x0000
G_M9468_IG02: ;; offset=0x0000
vbroadcastsd zmm0, qword ptr [reloc @rwd00]
vmovups zmmword ptr [rcx], zmm0
mov rax, rcx
G_M9468_IG03: ;; offset=0x0013
vzeroupper ret RWD00 dq	0000000700000005h
; Total bytes of code 23
; Vector512.CreateHarmonicSequence<float>(1.0f, 2.0f)
; Emitting BLENDED_CODE for x64 + VEX + EVEX on Windows
G_M13716_IG01: ;; offset=0x0000
G_M13716_IG02: ;; offset=0x0000
vmovups zmm0, zmmword ptr [reloc @rwd00]
vmovups zmmword ptr [rcx], zmm0
mov rax, rcx
G_M13716_IG03: ;; offset=0x0013
vzeroupper ret RWD00 dq	3EAAAAAB3F800000h, 3E1249253E4CCCCDh, 3DBA2E8C3DE38E39h, 3D8888893D9D89D9h, 3D5794363D70F0F1h, 3D3216433D430C31h, 3D17B4263D23D70Ah, 3D0421083D0D3DCBh
; Total bytes of code 23
```
</details>
<details>
<summary>Vector512 without AVX512 - Vector256 decomposition
path</summary>
```asm
; Vector512.CreateGeometricSequence<int>(2, 3)
; Emitting BLENDED_CODE for x64 + VEX on Windows
G_M22445_IG01: ;; offset=0x0000
G_M22445_IG02: ;; offset=0x0000
vmovups ymm0, ymmword ptr [reloc @rwd00]
vmovups ymm1, ymmword ptr [reloc @RWD32]
vmovups ymmword ptr [rcx], ymm1
vmovups ymmword ptr [rcx+0x20], ymm0
mov rax, rcx
G_M22445_IG03: ;; offset=0x001C
vzeroupper ret RWD00 dq	000099C600003342h, 000567F60001CD52h, 0030A7A6001037E2h, 01B5E4D60091F6F2h
RWD32 dq	0000000600000002h, 0000003600000012h, 000001E6000000A2h, 00001116000005B2h
; Total bytes of code 32
; Vector512.CreateAlternatingSequence<int>(5, 7)
; Emitting BLENDED_CODE for x64 + VEX on Windows
G_M9468_IG01: ;; offset=0x0000
G_M9468_IG02: ;; offset=0x0000
vbroadcastsd ymm0, qword ptr [reloc @rwd00]
vmovups ymmword ptr [rcx], ymm0
vmovups ymmword ptr [rcx+0x20], ymm0
mov rax, rcx
G_M9468_IG03: ;; offset=0x0015
vzeroupper ret RWD00 dq	0000000700000005h
; Total bytes of code 25
; Vector512.CreateHarmonicSequence<float>(1.0f, 2.0f)
; Emitting BLENDED_CODE for x64 + VEX on Windows
G_M13716_IG01: ;; offset=0x0000
G_M13716_IG02: ;; offset=0x0000
vmovups ymm0, ymmword ptr [reloc @rwd00]
vmovups ymmword ptr [rcx], ymm0
vmovups ymm0, ymmword ptr [reloc @RWD32]
vmovups ymmword ptr [rcx+0x20], ymm0
mov rax, rcx
G_M13716_IG03: ;; offset=0x001C
vzeroupper ret RWD00 dq	3EAAAAAB3F800000h, 3E1249253E4CCCCDh, 3DBA2E8C3DE38E39h, 3D8888893D9D89D9h
RWD32 dq	3D5794363D70F0F1h, 3D3216433D430C31h, 3D17B4263D23D70Ah, 3D0421083D0D3DCBh
; Total bytes of code 32
```
</details>
Closesdotnet#122557
cc: @tannergooding
ManickaP pushed a commit that referenced this pull request Aug 5, 2026
…rs (dotnet#129688)
See discussion at
dotnet#121981 (comment)
# SuperPMI ASM diffs: ExtractMostSignificantBits
Base JIT: `artifacts/asmdiff/builds/59979e64/core_root/libclrjit.so` Diff JIT:
`artifacts/tests/coreclr/linux.arm64.Checked/Tests/Core_Root/libclrjit.so`
MCH: `/tmp/ExtractMostSignificantBits_final.mch` Base commit: `59979e6401a` (`origin/main`) Diff commit: `e37c3840564`
## Short summary
Diffs are based on <span style="color:#1460aa">39</span> contexts (<span
style="color:#1460aa">0</span> MinOpts, <span
style="color:#1460aa">39</span> FullOpts).
<details>
<summary>Overall (<span style="color:green">-480</span> bytes)</summary>
<div style="margin-left:1em">
|Collection|Base size (bytes)|Diff size (bytes)|PerfScore in Diffs
|---|--:|--:|--:|
|ExtractMostSignificantBits_final.mch|8,492|<span
style="color:green">-480</span>|<span
style="color:green">-28.40%</span>|
</div></details>
<details>
<summary>FullOpts (<span style="color:green">-480</span>
bytes)</summary>
<div style="margin-left:1em">
|Collection|Base size (bytes)|Diff size (bytes)|PerfScore in Diffs
|---|--:|--:|--:|
|ExtractMostSignificantBits_final.mch|8,492|<span
style="color:green">-480</span>|<span
style="color:green">-28.40%</span>|
</div></details>
## SuperPMI summary
Diffs are based on <span style="color:#1460aa">39</span> contexts (<span
style="color:#1460aa">0</span> MinOpts, <span
style="color:#1460aa">39</span> FullOpts).
<details>
<summary>Overall (<span style="color:green">-480</span> bytes)</summary>
<div style="margin-left:1em">
|Collection|Base size (bytes)|Diff size (bytes)|PerfScore in Diffs
|---|--:|--:|--:|
|ExtractMostSignificantBits_final.mch|8,492|<span
style="color:green">-480</span>|<span
style="color:green">-28.40%</span>|
</div></details>
<details>
<summary>FullOpts (<span style="color:green">-480</span>
bytes)</summary>
<div style="margin-left:1em">
|Collection|Base size (bytes)|Diff size (bytes)|PerfScore in Diffs
|---|--:|--:|--:|
|ExtractMostSignificantBits_final.mch|8,492|<span
style="color:green">-480</span>|<span
style="color:green">-28.40%</span>|
</div></details>
<details>
<summary>Example diffs</summary>
<div style="margin-left:1em">
<details>
<summary>ExtractMostSignificantBits_final.mch</summary>
<div style="margin-left:1em">
<details>
<summary><span style="color:green">-44</span> (<span
style="color:green">-52.38%</span>) : 17.dasm -
TestExtractMostSignificantBits.Program:CountGreaterThanOrEqualByte(System.Runtime.Intrinsics.Vector128`1[byte],byte):int
(FullOpts)</summary>
<div style="margin-left:1em">
```diff
@@ -7,10 +7,9 @@
; No matching PGO data
; Final local variable assignments
;
-; V00 arg0 [V00,T02] ( 3, 3 ) simd16 -> d0 single-def <System.Runtime.Intrinsics.Vector128`1[byte]>
+; V00 arg0 [V00,T01] ( 3, 3 ) simd16 -> d0 single-def <System.Runtime.Intrinsics.Vector128`1[byte]>
; V01 arg1 [V01,T00] ( 3, 3 ) ubyte -> x0 single-def
;# V02 OutArgs [V02 ] ( 1, 1 ) struct ( 0) [sp+0x00] do-not-enreg[XS] addr-exposed "OutgoingArgSpace" <Empty>
-; V03 rat0 [V03,T01] ( 3, 6 ) simd16 -> d16 "ReplaceWithLclVar is creating a new local variable"
;
; Lcl frame size = 0
@@ -18,33 +17,20 @@ G_M10966_IG01: ; bbWeight=1, gcrefRegs=0000 {}, byrefRegs=0000 {}, byref,
stp fp, lr, [sp, #-0x10]!
mov fp, sp
;; size=8 bbWeight=1 PerfScore 1.50
-G_M10966_IG02: ; bbWeight=1, gcrefRegs=0000 {}, byrefRegs=0000 {}, byref, isz
+G_M10966_IG02: ; bbWeight=1, gcrefRegs=0000 {}, byrefRegs=0000 {}, byref
uxtb w0, w0
dup v16.16b, w0
cmhs v16.16b, v0.16b, v16.16b
- movi v17.16b, #0x80
- and v16.16b, v16.16b, v17.16b
- ldr q17, [@rwd00]
- ushl v16.16b, v16.16b, v17.16b
- uxtl2 v17.8h, v16.16b
- shl v17.8h, v17.8h, #8
- uaddw v16.8h, v17.8h, v16.8b
- addv h16, v16.8h
- umov w0, v16.h[0]
- movi v16.8b, #0
- ins v16.s[0], w0
- cnt v16.8b, v16.8b
- addv b16, v16.8b
- umov w0, v16.s[0]
- ;; size=68 bbWeight=1 PerfScore 20.00
+ ushr v16.16b, v16.16b, #7
+ addv b16, v16.16b
+ umov w0, v16.b[0]
+ ;; size=24 bbWeight=1 PerfScore 7.50
G_M10966_IG03: ; bbWeight=1, epilog, nogc, extend
ldp fp, lr, [sp], #0x10
ret lr
;; size=8 bbWeight=1 PerfScore 2.00
-RWD00 dq	00FFFEFDFCFBFAF9h, 00FFFEFDFCFBFAF9h
-
-; Total bytes of code 84, prolog size 8, PerfScore 23.50, instruction count 21, allocated bytes for code 84 (MethodHash=3eafd529) for method TestExtractMostSignificantBits.Program:CountGreaterThanOrEqualByte(System.Runtime.Intrinsics.Vector128`1[byte],byte):int (FullOpts)
+; Total bytes of code 40, prolog size 8, PerfScore 11.00, instruction count 10, allocated bytes for code 40 (MethodHash=3eafd529) for method TestExtractMostSignificantBits.Program:CountGreaterThanOrEqualByte(System.Runtime.Intrinsics.Vector128`1[byte],byte):int (FullOpts)
; ============================================================
Unwind Info:
@@ -55,7 +41,7 @@ Unwind Info:
E bit : 0
X bit : 0
Vers : 0
- Function Length : 21 (0x00015) Actual length = 84 (0x000054)
+ Function Length : 10 (0x0000a) Actual length = 40 (0x000028)
---- Epilog scopes ----
---- Scope 0
Epilog Start Offset : 3523193630 (0xd1ffab1e) Actual offset = 3523193630 (0xd1ffab1e) Offset from main function begin = 3523193630 (0xd1ffab1e)
```
</div></details>
<details>
<summary><span style="color:green">-32</span> (<span
style="color:green">-47.06%</span>) : 12.dasm -
TestExtractMostSignificantBits.Program:CountLessThanInt32(System.Runtime.Intrinsics.Vector128`1[int],int):int
(FullOpts)</summary>
<div style="margin-left:1em">
```diff
@@ -17,29 +17,19 @@ G_M46948_IG01: ; bbWeight=1, gcrefRegs=0000 {}, byrefRegs=0000 {}, byref,
stp fp, lr, [sp, #-0x10]!
mov fp, sp
;; size=8 bbWeight=1 PerfScore 1.50
-G_M46948_IG02: ; bbWeight=1, gcrefRegs=0000 {}, byrefRegs=0000 {}, byref, isz
+G_M46948_IG02: ; bbWeight=1, gcrefRegs=0000 {}, byrefRegs=0000 {}, byref
dup v16.4s, w0
cmgt v16.4s, v16.4s, v0.4s
- movi v17.4s, #0x80, LSL dotnet#24
- and v16.4s, v16.4s, v17.4s
- ldr q17, [@rwd00]
- ushl v16.4s, v16.4s, v17.4s
+ ushr v16.4s, v16.4s, dotnet#31
addv s16, v16.4s
- smov x0, v16.s[0]
- movi v16.8b, #0
- ins v16.s[0], w0
- cnt v16.8b, v16.8b
- addv b16, v16.8b
umov w0, v16.s[0]
- ;; size=52 bbWeight=1 PerfScore 15.50
+ ;; size=20 bbWeight=1 PerfScore 7.00
G_M46948_IG03: ; bbWeight=1, epilog, nogc, extend
ldp fp, lr, [sp], #0x10
ret lr
;; size=8 bbWeight=1 PerfScore 2.00
-RWD00 dq	FFFFFFE2FFFFFFE1h, FFFFFFE4FFFFFFE3h
-
-; Total bytes of code 68, prolog size 8, PerfScore 19.00, instruction count 17, allocated bytes for code 68 (MethodHash=d8b1489b) for method TestExtractMostSignificantBits.Program:CountLessThanInt32(System.Runtime.Intrinsics.Vector128`1[int],int):int (FullOpts)
+; Total bytes of code 36, prolog size 8, PerfScore 10.50, instruction count 9, allocated bytes for code 36 (MethodHash=d8b1489b) for method TestExtractMostSignificantBits.Program:CountLessThanInt32(System.Runtime.Intrinsics.Vector128`1[int],int):int (FullOpts)
; ============================================================
Unwind Info:
@@ -50,7 +40,7 @@ Unwind Info:
E bit : 0
X bit : 0
Vers : 0
- Function Length : 17 (0x00011) Actual length = 68 (0x000044)
+ Function Length : 9 (0x00009) Actual length = 36 (0x000024)
---- Epilog scopes ----
---- Scope 0
Epilog Start Offset : 3523193630 (0xd1ffab1e) Actual offset = 3523193630 (0xd1ffab1e) Offset from main function begin = 3523193630 (0xd1ffab1e)
```
</div></details>
<details>
<summary><span style="color:green">-32</span> (<span
style="color:green">-47.06%</span>) : 27.dasm -
TestExtractMostSignificantBits.Program:CountLessThanInt3264(System.Runtime.Intrinsics.Vector64`1[int],int):int
(FullOpts)</summary>
<div style="margin-left:1em">
```diff
@@ -18,29 +18,19 @@ G_M44223_IG01: ; bbWeight=1, gcrefRegs=0000 {}, byrefRegs=0000 {}, byref,
stp fp, lr, [sp, #-0x10]!
mov fp, sp
;; size=8 bbWeight=1 PerfScore 1.50
-G_M44223_IG02: ; bbWeight=1, gcrefRegs=0000 {}, byrefRegs=0000 {}, byref, isz
+G_M44223_IG02: ; bbWeight=1, gcrefRegs=0000 {}, byrefRegs=0000 {}, byref
dup v16.2s, w0
cmgt v16.2s, v16.2s, v0.2s
- movi v17.2s, #0x80, LSL dotnet#24
- and v16.2s, v16.2s, v17.2s
- ldr d17, [@rwd00]
- ushl v16.2s, v16.2s, v17.2s
+ ushr v16.2s, v16.2s, dotnet#31
addp v16.2s, v16.2s, v16.2s
- smov x0, v16.s[0]
- movi v16.8b, #0
- ins v16.s[0], w0
- cnt v16.8b, v16.8b
- addv b16, v16.8b
umov w0, v16.s[0]
- ;; size=52 bbWeight=1 PerfScore 15.50
+ ;; size=20 bbWeight=1 PerfScore 7.00
G_M44223_IG03: ; bbWeight=1, epilog, nogc, extend
ldp fp, lr, [sp], #0x10
ret lr
;; size=8 bbWeight=1 PerfScore 2.00
-RWD00 dq	FFFFFFE2FFFFFFE1h
-
-; Total bytes of code 68, prolog size 8, PerfScore 19.00, instruction count 17, allocated bytes for code 68 (MethodHash=6ccd5340) for method TestExtractMostSignificantBits.Program:CountLessThanInt3264(System.Runtime.Intrinsics.Vector64`1[int],int):int (FullOpts)
+; Total bytes of code 36, prolog size 8, PerfScore 10.50, instruction count 9, allocated bytes for code 36 (MethodHash=6ccd5340) for method TestExtractMostSignificantBits.Program:CountLessThanInt3264(System.Runtime.Intrinsics.Vector64`1[int],int):int (FullOpts)
; ============================================================
Unwind Info:
@@ -51,7 +41,7 @@ Unwind Info:
E bit : 0
X bit : 0
Vers : 0
- Function Length : 17 (0x00011) Actual length = 68 (0x000044)
+ Function Length : 9 (0x00009) Actual length = 36 (0x000024)
---- Epilog scopes ----
---- Scope 0
Epilog Start Offset : 3523193630 (0xd1ffab1e) Actual offset = 3523193630 (0xd1ffab1e) Offset from main function begin = 3523193630 (0xd1ffab1e)
```
</div></details>
<details>
<summary><span style="color:green">-8</span> (<span
style="color:green">-13.33%</span>) : 33.dasm -
TestExtractMostSignificantBits.Program:IndexOfFirstGreaterThanOrEqualByte64(System.Runtime.Intrinsics.Vector64`1[byte],byte):int
(FullOpts)</summary>
<div style="margin-left:1em">
```diff
@@ -21,23 +21,21 @@ G_M59363_IG02: ; bbWeight=1, gcrefRegs=0000 {}, byrefRegs=0000 {}, byref,
uxtb w0, w0
dup v16.8b, w0
cmhs v16.8b, v0.8b, v16.8b
- movi v17.8b, #0x80
- and v16.8b, v16.8b, v17.8b
ldr d17, [@rwd00]
- ushl v16.8b, v16.8b, v17.8b
- addv b16, v16.8b
+ movi v18.8b, #0x21
+ bsl v16.8b, v17.8b, v18.8b
+ uminv b16, v16.8b
umov w0, v16.b[0]
- rbit w0, w0
- clz w0, w0
- ;; size=44 bbWeight=1 PerfScore 12.00
+ sub w0, w0, #1
+ ;; size=36 bbWeight=1 PerfScore 11.00
G_M59363_IG03: ; bbWeight=1, epilog, nogc, extend
ldp fp, lr, [sp], #0x10
ret lr
;; size=8 bbWeight=1 PerfScore 2.00
-RWD00 dq	00FFFEFDFCFBFAF9h
+RWD00 dq	0807060504030201h
-; Total bytes of code 60, prolog size 8, PerfScore 15.50, instruction count 15, allocated bytes for code 60 (MethodHash=312b181c) for method TestExtractMostSignificantBits.Program:IndexOfFirstGreaterThanOrEqualByte64(System.Runtime.Intrinsics.Vector64`1[byte],byte):int (FullOpts)
+; Total bytes of code 52, prolog size 8, PerfScore 14.50, instruction count 13, allocated bytes for code 52 (MethodHash=312b181c) for method TestExtractMostSignificantBits.Program:IndexOfFirstGreaterThanOrEqualByte64(System.Runtime.Intrinsics.Vector64`1[byte],byte):int (FullOpts)
; ============================================================
Unwind Info:
@@ -48,7 +46,7 @@ Unwind Info:
E bit : 0
X bit : 0
Vers : 0
- Function Length : 15 (0x0000f) Actual length = 60 (0x00003c)
+ Function Length : 13 (0x0000d) Actual length = 52 (0x000034)
---- Epilog scopes ----
---- Scope 0
Epilog Start Offset : 3523193630 (0xd1ffab1e) Actual offset = 3523193630 (0xd1ffab1e) Offset from main function begin = 3523193630 (0xd1ffab1e)
```
</div></details>
<details>
<summary><span style="color:green">-8</span> (<span
style="color:green">-13.33%</span>) : 23.dasm -
TestExtractMostSignificantBits.Program:IndexOfFirstGreaterThanOrEqualUInt1664(System.Runtime.Intrinsics.Vector64`1[ushort],ushort):int
(FullOpts)</summary>
<div style="margin-left:1em">
```diff
@@ -21,23 +21,21 @@ G_M61416_IG02: ; bbWeight=1, gcrefRegs=0000 {}, byrefRegs=0000 {}, byref,
uxth w0, w0
dup v16.4h, w0
cmhs v16.4h, v0.4h, v16.4h
- movi v17.4h, #0x80, LSL #8
- and v16.4h, v16.4h, v17.4h
ldr d17, [@rwd00]
- ushl v16.4h, v16.4h, v17.4h
- addv h16, v16.4h
+ movi v18.4h, #0x21
+ bsl v16.4h, v17.4h, v18.4h
+ uminv h16, v16.4h
umov w0, v16.h[0]
- rbit w0, w0
- clz w0, w0
- ;; size=44 bbWeight=1 PerfScore 12.00
+ sub w0, w0, #1
+ ;; size=36 bbWeight=1 PerfScore 11.00
G_M61416_IG03: ; bbWeight=1, epilog, nogc, extend
ldp fp, lr, [sp], #0x10
ret lr
;; size=8 bbWeight=1 PerfScore 2.00
-RWD00 dq	FFF4FFF3FFF2FFF1h
+RWD00 dq	0004000300020001h
-; Total bytes of code 60, prolog size 8, PerfScore 15.50, instruction count 15, allocated bytes for code 60 (MethodHash=ba031017) for method TestExtractMostSignificantBits.Program:IndexOfFirstGreaterThanOrEqualUInt1664(System.Runtime.Intrinsics.Vector64`1[ushort],ushort):int (FullOpts)
+; Total bytes of code 52, prolog size 8, PerfScore 14.50, instruction count 13, allocated bytes for code 52 (MethodHash=ba031017) for method TestExtractMostSignificantBits.Program:IndexOfFirstGreaterThanOrEqualUInt1664(System.Runtime.Intrinsics.Vector64`1[ushort],ushort):int (FullOpts)
; ============================================================
Unwind Info:
@@ -48,7 +46,7 @@ Unwind Info:
E bit : 0
X bit : 0
Vers : 0
- Function Length : 15 (0x0000f) Actual length = 60 (0x00003c)
+ Function Length : 13 (0x0000d) Actual length = 52 (0x000034)
---- Epilog scopes ----
---- Scope 0
Epilog Start Offset : 3523193630 (0xd1ffab1e) Actual offset = 3523193630 (0xd1ffab1e) Offset from main function begin = 3523193630 (0xd1ffab1e)
```
</div></details>
<details>
<summary><span style="color:green">-8</span> (<span
style="color:green">-13.33%</span>) : 8.dasm -
TestExtractMostSignificantBits.Program:IndexOfFirstGreaterThanOrEqualUInt16(System.Runtime.Intrinsics.Vector128`1[ushort],ushort):int
(FullOpts)</summary>
<div style="margin-left:1em">
```diff
@@ -21,23 +21,21 @@ G_M44819_IG02: ; bbWeight=1, gcrefRegs=0000 {}, byrefRegs=0000 {}, byref,
uxth w0, w0
dup v16.8h, w0
cmhs v16.8h, v0.8h, v16.8h
- movi v17.8h, #0x80, LSL #8
- and v16.8h, v16.8h, v17.8h
ldr q17, [@rwd00]
- ushl v16.8h, v16.8h, v17.8h
- addv h16, v16.8h
+ movi v18.8h, #0x21
+ bsl v16.8h, v17.8h, v18.8h
+ uminv h16, v16.8h
umov w0, v16.h[0]
- rbit w0, w0
- clz w0, w0
- ;; size=44 bbWeight=1 PerfScore 12.00
+ sub w0, w0, #1
+ ;; size=36 bbWeight=1 PerfScore 11.00
G_M44819_IG03: ; bbWeight=1, epilog, nogc, extend
ldp fp, lr, [sp], #0x10
ret lr
;; size=8 bbWeight=1 PerfScore 2.00
-RWD00 dq	FFF4FFF3FFF2FFF1h, FFF8FFF7FFF6FFF5h
+RWD00 dq	0004000300020001h, 0008000700060005h
-; Total bytes of code 60, prolog size 8, PerfScore 15.50, instruction count 15, allocated bytes for code 60 (MethodHash=016950ec) for method TestExtractMostSignificantBits.Program:IndexOfFirstGreaterThanOrEqualUInt16(System.Runtime.Intrinsics.Vector128`1[ushort],ushort):int (FullOpts)
+; Total bytes of code 52, prolog size 8, PerfScore 14.50, instruction count 13, allocated bytes for code 52 (MethodHash=016950ec) for method TestExtractMostSignificantBits.Program:IndexOfFirstGreaterThanOrEqualUInt16(System.Runtime.Intrinsics.Vector128`1[ushort],ushort):int (FullOpts)
; ============================================================
Unwind Info:
@@ -48,7 +46,7 @@ Unwind Info:
E bit : 0
X bit : 0
Vers : 0
- Function Length : 15 (0x0000f) Actual length = 60 (0x00003c)
+ Function Length : 13 (0x0000d) Actual length = 52 (0x000034)
---- Epilog scopes ----
---- Scope 0
Epilog Start Offset : 3523193630 (0xd1ffab1e) Actual offset = 3523193630 (0xd1ffab1e) Offset from main function begin = 3523193630 (0xd1ffab1e)
```
</div></details>
</div></details>
</div></details>
<details>
<summary>Details</summary>
<div style="margin-left:1em">
#### Size improvements/regressions per collection
|Collection|Contexts with diffs|Improvements|Regressions|Same
size|Improvements (bytes)|Regressions (bytes)|
|---|--:|--:|--:|--:|--:|--:|
|ExtractMostSignificantBits_final.mch|24|<span
style="color:green">24</span>|<span style="color:red">0</span>|<span
style="color:blue">0</span>|<span style="color:green">-480</span>|<span
style="color:red">+0</span>|
---
#### PerfScore improvements/regressions per collection
|Collection|Contexts with diffs|Improvements|Regressions|Same
PerfScore|Improvements (PerfScore)|Regressions (PerfScore)|PerfScore
Overall in FullOpts|
|---|--:|--:|--:|--:|--:|--:|--:|
|ExtractMostSignificantBits_final.mch|24|<span
style="color:green">24</span>|<span style="color:red">0</span>|<span
style="color:blue">0</span>|<span
style="color:green">-28.40%</span>|0.00%|<span
style="color:green">-18.5844%</span>|
---
#### Context information
|Collection|Diffed contexts|MinOpts|FullOpts|Missed, base|Missed, diff|
|---|--:|--:|--:|--:|--:|
|ExtractMostSignificantBits_final.mch|39|0|39|0 (0.00%)|0 (0.00%)|
---
#### jit-analyze output
<details>
<summary>ExtractMostSignificantBits_final.mch</summary>
<div style="margin-left:1em">
```
Summary of Code Size diffs:
(Lower is better)
Total bytes of base: 8492 (overridden on cmd)
Total bytes of diff: 8012 (overridden on cmd)
Total bytes of delta: -480 (-5.65 % of base)
diff is an improvement.
relative diff is an improvement.
```
<details>
<summary>Detail diffs</summary>
```
Top file improvements (bytes):
-44 : 17.dasm (-52.38 % of base)
-32 : 22.dasm (-44.44 % of base)
-32 : 7.dasm (-44.44 % of base)
-32 : 32.dasm (-44.44 % of base)
-32 : 27.dasm (-47.06 % of base)
-32 : 12.dasm (-47.06 % of base)
-28 : 16.dasm (-38.89 % of base)
-28 : 15.dasm (-38.89 % of base)
-20 : 18.dasm (-27.78 % of base)
-16 : 30.dasm (-26.67 % of base)
-16 : 6.dasm (-26.67 % of base)
-16 : 5.dasm (-26.67 % of base)
-16 : 10.dasm (-28.57 % of base)
-16 : 26.dasm (-28.57 % of base)
-16 : 25.dasm (-28.57 % of base)
-16 : 21.dasm (-26.67 % of base)
-16 : 11.dasm (-28.57 % of base)
-16 : 31.dasm (-26.67 % of base)
-16 : 20.dasm (-26.67 % of base)
-8 : 33.dasm (-13.33 % of base)
24 total files with Code Size differences (24 improved, 0 regressed), 0 unchanged.
Top method improvements (bytes):
-44 (-52.38 % of base) : 17.dasm - TestExtractMostSignificantBits.Program:CountGreaterThanOrEqualByte(System.Runtime.Intrinsics.Vector128`1[byte],byte):int (FullOpts)
-32 (-44.44 % of base) : 32.dasm - TestExtractMostSignificantBits.Program:CountGreaterThanOrEqualByte64(System.Runtime.Intrinsics.Vector64`1[byte],byte):int (FullOpts)
-32 (-44.44 % of base) : 7.dasm - TestExtractMostSignificantBits.Program:CountGreaterThanOrEqualUInt16(System.Runtime.Intrinsics.Vector128`1[ushort],ushort):int (FullOpts)
-32 (-44.44 % of base) : 22.dasm - TestExtractMostSignificantBits.Program:CountGreaterThanOrEqualUInt1664(System.Runtime.Intrinsics.Vector64`1[ushort],ushort):int (FullOpts)
-32 (-47.06 % of base) : 12.dasm - TestExtractMostSignificantBits.Program:CountLessThanInt32(System.Runtime.Intrinsics.Vector128`1[int],int):int (FullOpts)
-32 (-47.06 % of base) : 27.dasm - TestExtractMostSignificantBits.Program:CountLessThanInt3264(System.Runtime.Intrinsics.Vector64`1[int],int):int (FullOpts)
-28 (-38.89 % of base) : 15.dasm - TestExtractMostSignificantBits.Program:AnyGreaterThanOrEqualByte(System.Runtime.Intrinsics.Vector128`1[byte],byte):bool (FullOpts)
-28 (-38.89 % of base) : 16.dasm - TestExtractMostSignificantBits.Program:NoneGreaterThanOrEqualByte(System.Runtime.Intrinsics.Vector128`1[byte],byte):bool (FullOpts)
-20 (-27.78 % of base) : 18.dasm - TestExtractMostSignificantBits.Program:IndexOfFirstGreaterThanOrEqualByte(System.Runtime.Intrinsics.Vector128`1[byte],byte):int (FullOpts)
-16 (-26.67 % of base) : 30.dasm - TestExtractMostSignificantBits.Program:AnyGreaterThanOrEqualByte64(System.Runtime.Intrinsics.Vector64`1[byte],byte):bool (FullOpts)
-16 (-28.57 % of base) : 10.dasm - TestExtractMostSignificantBits.Program:AnyLessThanInt32(System.Runtime.Intrinsics.Vector128`1[int],int):bool (FullOpts)
-16 (-28.57 % of base) : 25.dasm - TestExtractMostSignificantBits.Program:AnyLessThanInt3264(System.Runtime.Intrinsics.Vector64`1[int],int):bool (FullOpts)
-16 (-26.67 % of base) : 5.dasm - TestExtractMostSignificantBits.Program:AnyLessThanUInt16(System.Runtime.Intrinsics.Vector128`1[ushort],ushort):bool (FullOpts)
-16 (-26.67 % of base) : 20.dasm - TestExtractMostSignificantBits.Program:AnyLessThanUInt1664(System.Runtime.Intrinsics.Vector64`1[ushort],ushort):bool (FullOpts)
-16 (-26.67 % of base) : 31.dasm - TestExtractMostSignificantBits.Program:NoneGreaterThanOrEqualByte64(System.Runtime.Intrinsics.Vector64`1[byte],byte):bool (FullOpts)
-16 (-28.57 % of base) : 11.dasm - TestExtractMostSignificantBits.Program:NoneLessThanInt32(System.Runtime.Intrinsics.Vector128`1[int],int):bool (FullOpts)
-16 (-28.57 % of base) : 26.dasm - TestExtractMostSignificantBits.Program:NoneLessThanInt3264(System.Runtime.Intrinsics.Vector64`1[int],int):bool (FullOpts)
-16 (-26.67 % of base) : 6.dasm - TestExtractMostSignificantBits.Program:NoneLessThanUInt16(System.Runtime.Intrinsics.Vector128`1[ushort],ushort):bool (FullOpts)
-16 (-26.67 % of base) : 21.dasm - TestExtractMostSignificantBits.Program:NoneLessThanUInt1664(System.Runtime.Intrinsics.Vector64`1[ushort],ushort):bool (FullOpts)
-8 (-13.33 % of base) : 33.dasm - TestExtractMostSignificantBits.Program:IndexOfFirstGreaterThanOrEqualByte64(System.Runtime.Intrinsics.Vector64`1[byte],byte):int (FullOpts)
Top method improvements (percentages):
-44 (-52.38 % of base) : 17.dasm - TestExtractMostSignificantBits.Program:CountGreaterThanOrEqualByte(System.Runtime.Intrinsics.Vector128`1[byte],byte):int (FullOpts)
-32 (-47.06 % of base) : 12.dasm - TestExtractMostSignificantBits.Program:CountLessThanInt32(System.Runtime.Intrinsics.Vector128`1[int],int):int (FullOpts)
-32 (-47.06 % of base) : 27.dasm - TestExtractMostSignificantBits.Program:CountLessThanInt3264(System.Runtime.Intrinsics.Vector64`1[int],int):int (FullOpts)
-32 (-44.44 % of base) : 32.dasm - TestExtractMostSignificantBits.Program:CountGreaterThanOrEqualByte64(System.Runtime.Intrinsics.Vector64`1[byte],byte):int (FullOpts)
-32 (-44.44 % of base) : 7.dasm - TestExtractMostSignificantBits.Program:CountGreaterThanOrEqualUInt16(System.Runtime.Intrinsics.Vector128`1[ushort],ushort):int (FullOpts)
-32 (-44.44 % of base) : 22.dasm - TestExtractMostSignificantBits.Program:CountGreaterThanOrEqualUInt1664(System.Runtime.Intrinsics.Vector64`1[ushort],ushort):int (FullOpts)
-28 (-38.89 % of base) : 15.dasm - TestExtractMostSignificantBits.Program:AnyGreaterThanOrEqualByte(System.Runtime.Intrinsics.Vector128`1[byte],byte):bool (FullOpts)
-28 (-38.89 % of base) : 16.dasm - TestExtractMostSignificantBits.Program:NoneGreaterThanOrEqualByte(System.Runtime.Intrinsics.Vector128`1[byte],byte):bool (FullOpts)
-16 (-28.57 % of base) : 10.dasm - TestExtractMostSignificantBits.Program:AnyLessThanInt32(System.Runtime.Intrinsics.Vector128`1[int],int):bool (FullOpts)
-16 (-28.57 % of base) : 25.dasm - TestExtractMostSignificantBits.Program:AnyLessThanInt3264(System.Runtime.Intrinsics.Vector64`1[int],int):bool (FullOpts)
-16 (-28.57 % of base) : 11.dasm - TestExtractMostSignificantBits.Program:NoneLessThanInt32(System.Runtime.Intrinsics.Vector128`1[int],int):bool (FullOpts)
-16 (-28.57 % of base) : 26.dasm - TestExtractMostSignificantBits.Program:NoneLessThanInt3264(System.Runtime.Intrinsics.Vector64`1[int],int):bool (FullOpts)
-20 (-27.78 % of base) : 18.dasm - TestExtractMostSignificantBits.Program:IndexOfFirstGreaterThanOrEqualByte(System.Runtime.Intrinsics.Vector128`1[byte],byte):int (FullOpts)
-16 (-26.67 % of base) : 30.dasm - TestExtractMostSignificantBits.Program:AnyGreaterThanOrEqualByte64(System.Runtime.Intrinsics.Vector64`1[byte],byte):bool (FullOpts)
-16 (-26.67 % of base) : 5.dasm - TestExtractMostSignificantBits.Program:AnyLessThanUInt16(System.Runtime.Intrinsics.Vector128`1[ushort],ushort):bool (FullOpts)
-16 (-26.67 % of base) : 20.dasm - TestExtractMostSignificantBits.Program:AnyLessThanUInt1664(System.Runtime.Intrinsics.Vector64`1[ushort],ushort):bool (FullOpts)
-16 (-26.67 % of base) : 31.dasm - TestExtractMostSignificantBits.Program:NoneGreaterThanOrEqualByte64(System.Runtime.Intrinsics.Vector64`1[byte],byte):bool (FullOpts)
-16 (-26.67 % of base) : 6.dasm - TestExtractMostSignificantBits.Program:NoneLessThanUInt16(System.Runtime.Intrinsics.Vector128`1[ushort],ushort):bool (FullOpts)
-16 (-26.67 % of base) : 21.dasm - TestExtractMostSignificantBits.Program:NoneLessThanUInt1664(System.Runtime.Intrinsics.Vector64`1[ushort],ushort):bool (FullOpts)
-8 (-14.29 % of base) : 13.dasm - TestExtractMostSignificantBits.Program:IndexOfFirstLessThanInt32(System.Runtime.Intrinsics.Vector128`1[int],int):int (FullOpts)
24 total methods with Code Size differences (24 improved, 0 regressed).
```
</details>
--------------------------------------------------------------------------------
</div></details>
</div></details>
## Jit-analyze summary
```
Summary of Code Size diffs:
(Lower is better)
Total bytes of base: 8492 (overridden on cmd)
Total bytes of diff: 8012 (overridden on cmd)
Total bytes of delta: -480 (-5.65 % of base)
diff is an improvement.
relative diff is an improvement.
```
<details>
<summary>Detail diffs</summary>
```
Top file improvements (bytes):
-44 : 17.dasm (-52.38 % of base)
-32 : 22.dasm (-44.44 % of base)
-32 : 7.dasm (-44.44 % of base)
-32 : 32.dasm (-44.44 % of base)
-32 : 27.dasm (-47.06 % of base)
-32 : 12.dasm (-47.06 % of base)
-28 : 16.dasm (-38.89 % of base)
-28 : 15.dasm (-38.89 % of base)
-20 : 18.dasm (-27.78 % of base)
-16 : 30.dasm (-26.67 % of base)
-16 : 6.dasm (-26.67 % of base)
-16 : 5.dasm (-26.67 % of base)
-16 : 10.dasm (-28.57 % of base)
-16 : 26.dasm (-28.57 % of base)
-16 : 25.dasm (-28.57 % of base)
-16 : 21.dasm (-26.67 % of base)
-16 : 11.dasm (-28.57 % of base)
-16 : 31.dasm (-26.67 % of base)
-16 : 20.dasm (-26.67 % of base)
-8 : 33.dasm (-13.33 % of base)
24 total files with Code Size differences (24 improved, 0 regressed), 0 unchanged.
Top method improvements (bytes):
-44 (-52.38 % of base) : 17.dasm - TestExtractMostSignificantBits.Program:CountGreaterThanOrEqualByte(System.Runtime.Intrinsics.Vector128`1[byte],byte):int (FullOpts)
-32 (-44.44 % of base) : 32.dasm - TestExtractMostSignificantBits.Program:CountGreaterThanOrEqualByte64(System.Runtime.Intrinsics.Vector64`1[byte],byte):int (FullOpts)
-32 (-44.44 % of base) : 7.dasm - TestExtractMostSignificantBits.Program:CountGreaterThanOrEqualUInt16(System.Runtime.Intrinsics.Vector128`1[ushort],ushort):int (FullOpts)
-32 (-44.44 % of base) : 22.dasm - TestExtractMostSignificantBits.Program:CountGreaterThanOrEqualUInt1664(System.Runtime.Intrinsics.Vector64`1[ushort],ushort):int (FullOpts)
-32 (-47.06 % of base) : 12.dasm - TestExtractMostSignificantBits.Program:CountLessThanInt32(System.Runtime.Intrinsics.Vector128`1[int],int):int (FullOpts)
-32 (-47.06 % of base) : 27.dasm - TestExtractMostSignificantBits.Program:CountLessThanInt3264(System.Runtime.Intrinsics.Vector64`1[int],int):int (FullOpts)
-28 (-38.89 % of base) : 15.dasm - TestExtractMostSignificantBits.Program:AnyGreaterThanOrEqualByte(System.Runtime.Intrinsics.Vector128`1[byte],byte):bool (FullOpts)
-28 (-38.89 % of base) : 16.dasm - TestExtractMostSignificantBits.Program:NoneGreaterThanOrEqualByte(System.Runtime.Intrinsics.Vector128`1[byte],byte):bool (FullOpts)
-20 (-27.78 % of base) : 18.dasm - TestExtractMostSignificantBits.Program:IndexOfFirstGreaterThanOrEqualByte(System.Runtime.Intrinsics.Vector128`1[byte],byte):int (FullOpts)
-16 (-26.67 % of base) : 30.dasm - TestExtractMostSignificantBits.Program:AnyGreaterThanOrEqualByte64(System.Runtime.Intrinsics.Vector64`1[byte],byte):bool (FullOpts)
-16 (-28.57 % of base) : 10.dasm - TestExtractMostSignificantBits.Program:AnyLessThanInt32(System.Runtime.Intrinsics.Vector128`1[int],int):bool (FullOpts)
-16 (-28.57 % of base) : 25.dasm - TestExtractMostSignificantBits.Program:AnyLessThanInt3264(System.Runtime.Intrinsics.Vector64`1[int],int):bool (FullOpts)
-16 (-26.67 % of base) : 5.dasm - TestExtractMostSignificantBits.Program:AnyLessThanUInt16(System.Runtime.Intrinsics.Vector128`1[ushort],ushort):bool (FullOpts)
-16 (-26.67 % of base) : 20.dasm - TestExtractMostSignificantBits.Program:AnyLessThanUInt1664(System.Runtime.Intrinsics.Vector64`1[ushort],ushort):bool (FullOpts)
-16 (-26.67 % of base) : 31.dasm - TestExtractMostSignificantBits.Program:NoneGreaterThanOrEqualByte64(System.Runtime.Intrinsics.Vector64`1[byte],byte):bool (FullOpts)
-16 (-28.57 % of base) : 11.dasm - TestExtractMostSignificantBits.Program:NoneLessThanInt32(System.Runtime.Intrinsics.Vector128`1[int],int):bool (FullOpts)
-16 (-28.57 % of base) : 26.dasm - TestExtractMostSignificantBits.Program:NoneLessThanInt3264(System.Runtime.Intrinsics.Vector64`1[int],int):bool (FullOpts)
-16 (-26.67 % of base) : 6.dasm - TestExtractMostSignificantBits.Program:NoneLessThanUInt16(System.Runtime.Intrinsics.Vector128`1[ushort],ushort):bool (FullOpts)
-16 (-26.67 % of base) : 21.dasm - TestExtractMostSignificantBits.Program:NoneLessThanUInt1664(System.Runtime.Intrinsics.Vector64`1[ushort],ushort):bool (FullOpts)
-8 (-13.33 % of base) : 33.dasm - TestExtractMostSignificantBits.Program:IndexOfFirstGreaterThanOrEqualByte64(System.Runtime.Intrinsics.Vector64`1[byte],byte):int (FullOpts)
Top method improvements (percentages):
-44 (-52.38 % of base) : 17.dasm - TestExtractMostSignificantBits.Program:CountGreaterThanOrEqualByte(System.Runtime.Intrinsics.Vector128`1[byte],byte):int (FullOpts)
-32 (-47.06 % of base) : 12.dasm - TestExtractMostSignificantBits.Program:CountLessThanInt32(System.Runtime.Intrinsics.Vector128`1[int],int):int (FullOpts)
-32 (-47.06 % of base) : 27.dasm - TestExtractMostSignificantBits.Program:CountLessThanInt3264(System.Runtime.Intrinsics.Vector64`1[int],int):int (FullOpts)
-32 (-44.44 % of base) : 32.dasm - TestExtractMostSignificantBits.Program:CountGreaterThanOrEqualByte64(System.Runtime.Intrinsics.Vector64`1[byte],byte):int (FullOpts)
-32 (-44.44 % of base) : 7.dasm - TestExtractMostSignificantBits.Program:CountGreaterThanOrEqualUInt16(System.Runtime.Intrinsics.Vector128`1[ushort],ushort):int (FullOpts)
-32 (-44.44 % of base) : 22.dasm - TestExtractMostSignificantBits.Program:CountGreaterThanOrEqualUInt1664(System.Runtime.Intrinsics.Vector64`1[ushort],ushort):int (FullOpts)
-28 (-38.89 % of base) : 15.dasm - TestExtractMostSignificantBits.Program:AnyGreaterThanOrEqualByte(System.Runtime.Intrinsics.Vector128`1[byte],byte):bool (FullOpts)
-28 (-38.89 % of base) : 16.dasm - TestExtractMostSignificantBits.Program:NoneGreaterThanOrEqualByte(System.Runtime.Intrinsics.Vector128`1[byte],byte):bool (FullOpts)
-16 (-28.57 % of base) : 10.dasm - TestExtractMostSignificantBits.Program:AnyLessThanInt32(System.Runtime.Intrinsics.Vector128`1[int],int):bool (FullOpts)
-16 (-28.57 % of base) : 25.dasm - TestExtractMostSignificantBits.Program:AnyLessThanInt3264(System.Runtime.Intrinsics.Vector64`1[int],int):bool (FullOpts)
-16 (-28.57 % of base) : 11.dasm - TestExtractMostSignificantBits.Program:NoneLessThanInt32(System.Runtime.Intrinsics.Vector128`1[int],int):bool (FullOpts)
-16 (-28.57 % of base) : 26.dasm - TestExtractMostSignificantBits.Program:NoneLessThanInt3264(System.Runtime.Intrinsics.Vector64`1[int],int):bool (FullOpts)
-20 (-27.78 % of base) : 18.dasm - TestExtractMostSignificantBits.Program:IndexOfFirstGreaterThanOrEqualByte(System.Runtime.Intrinsics.Vector128`1[byte],byte):int (FullOpts)
-16 (-26.67 % of base) : 30.dasm - TestExtractMostSignificantBits.Program:AnyGreaterThanOrEqualByte64(System.Runtime.Intrinsics.Vector64`1[byte],byte):bool (FullOpts)
-16 (-26.67 % of base) : 5.dasm - TestExtractMostSignificantBits.Program:AnyLessThanUInt16(System.Runtime.Intrinsics.Vector128`1[ushort],ushort):bool (FullOpts)
-16 (-26.67 % of base) : 20.dasm - TestExtractMostSignificantBits.Program:AnyLessThanUInt1664(System.Runtime.Intrinsics.Vector64`1[ushort],ushort):bool (FullOpts)
-16 (-26.67 % of base) : 31.dasm - TestExtractMostSignificantBits.Program:NoneGreaterThanOrEqualByte64(System.Runtime.Intrinsics.Vector64`1[byte],byte):bool (FullOpts)
-16 (-26.67 % of base) : 6.dasm - TestExtractMostSignificantBits.Program:NoneLessThanUInt16(System.Runtime.Intrinsics.Vector128`1[ushort],ushort):bool (FullOpts)
-16 (-26.67 % of base) : 21.dasm - TestExtractMostSignificantBits.Program:NoneLessThanUInt1664(System.Runtime.Intrinsics.Vector64`1[ushort],ushort):bool (FullOpts)
-8 (-14.29 % of base) : 13.dasm - TestExtractMostSignificantBits.Program:IndexOfFirstLessThanInt32(System.Runtime.Intrinsics.Vector128`1[int],int):int (FullOpts)
24 total methods with Code Size differences (24 improved, 0 regressed).
```
</details>
--------------------------------------------------------------------------------
## Generated artifacts
- SuperPMI log: `artifacts/spmi/superpmi.27.log`
- Short summary: `artifacts/spmi/diff_short_summary.11.md`
- Full summary: `artifacts/spmi/diff_summary.11.md`
- Jit-analyze summary:
`artifacts/spmi/asm.ExtractMostSignificantBits_final/summary.md`
- Base asm: `artifacts/spmi/asm.ExtractMostSignificantBits_final/base/`
- Diff asm: `artifacts/spmi/asm.ExtractMostSignificantBits_final/diff/`
---------
Co-authored-by: Egor Bogatov <egorbo@gmail.com>
Sign up for freeto join this conversation on GitHub. Already have an account? Sign in to comment

Labels

None yet

Projects

None yet

Development

Successfully merging this pull request may close these issues.

1 participant

@ManickaP