Skip to content

Test Blossom CI - #12

Closed
ptrendx wants to merge 1 commit into
NVIDIA:mainfrom
ptrendx:pr_blossom_ci_test
Closed

Test Blossom CI#12
ptrendx wants to merge 1 commit into
NVIDIA:mainfrom
ptrendx:pr_blossom_ci_test

Conversation

@ptrendx

@ptrendxptrendx commented Oct 11, 2022

Copy link
Copy Markdown
Member

Test CI. "" '';?&

'

@ptrendx

Copy link
Copy Markdown
MemberAuthor

/te-ci

@ptrendx

Copy link
Copy Markdown
MemberAuthor

/blossom-ci

@ptrendx

Copy link
Copy Markdown
MemberAuthor

/blossom-ci

5 similar comments
@ptrendx

Copy link
Copy Markdown
MemberAuthor

/blossom-ci

@ptrendx

Copy link
Copy Markdown
MemberAuthor

/blossom-ci

@ptrendx

Copy link
Copy Markdown
MemberAuthor

/blossom-ci

@ptrendx

Copy link
Copy Markdown
MemberAuthor

/blossom-ci

@ptrendx

Copy link
Copy Markdown
MemberAuthor

/blossom-ci

@ptrendx

Copy link
Copy Markdown
MemberAuthor

\blossom-ci

@ptrendx

Copy link
Copy Markdown
MemberAuthor

/blossom-ci

@ptrendx
ptrendxforce-pushed the pr_blossom_ci_test branch 6 times, most recently from 870690f to 3111cb5CompareOctober 19, 2022 18:45
@ptrendx

Copy link
Copy Markdown
MemberAuthor

/te-ci

@ptrendx
ptrendxforce-pushed the pr_blossom_ci_test branch 4 times, most recently from aa19faa to fb6feafCompareOctober 28, 2022 18:53
@ptrendx

Copy link
Copy Markdown
MemberAuthor

/te-ci

4 similar comments
@ptrendx

Copy link
Copy Markdown
MemberAuthor

/te-ci

@ptrendx

Copy link
Copy Markdown
MemberAuthor

/te-ci

@ptrendx

Copy link
Copy Markdown
MemberAuthor

/te-ci

@ptrendx

Copy link
Copy Markdown
MemberAuthor

/te-ci

@ptrendx

Copy link
Copy Markdown
MemberAuthor

/te-ci

1 similar comment
@ptrendx

Copy link
Copy Markdown
MemberAuthor

/te-ci

@ptrendx

Copy link
Copy Markdown
MemberAuthor

/te-ci

3 similar comments
@ptrendx

Copy link
Copy Markdown
MemberAuthor

/te-ci

@ptrendx

Copy link
Copy Markdown
MemberAuthor

/te-ci

@ptrendx

Copy link
Copy Markdown
MemberAuthor

/te-ci

@ptrendx

Copy link
Copy Markdown
MemberAuthor

/te-ci

@ptrendx

Copy link
Copy Markdown
MemberAuthor

/te-ci

2 similar comments
@ptrendx

Copy link
Copy Markdown
MemberAuthor

/te-ci

@ptrendx

Copy link
Copy Markdown
MemberAuthor

/te-ci

@ptrendxptrendx closed this Nov 7, 2022
timmoon10 added a commit to timmoon10/TransformerEngine that referenced this pull request Sep 26, 2025
* make nvte_cublas_gemm_v2 to take alpha/beta pointers
Signed-off-by: Phuong Nguyen <phuonguyen@nvidia.com>
* users are expected to pass a valid C_tensor
Signed-off-by: Phuong Nguyen <phuonguyen@nvidia.com>
* typos
Signed-off-by: Phuong Nguyen <phuonguyen@nvidia.com>
* API to have const float* alpha
Signed-off-by: Phuong Nguyen <phuonguyen@nvidia.com>
* Minor tweaks
Support arbitrary beta scales. Increase workspace to be aligned to 128 bytes.
Signed-off-by: Tim Moon <tmoon@nvidia.com>
* Debug IMA with alpha pointer
Signed-off-by: Tim Moon <tmoon@nvidia.com>
---------
Signed-off-by: Phuong Nguyen <phuonguyen@nvidia.com>
Signed-off-by: Tim Moon <tmoon@nvidia.com>
Co-authored-by: Tim Moon <tmoon@nvidia.com>
ksivaman added a commit that referenced this pull request Sep 29, 2025
* Add NVFP4 recipe
Signed-off-by: Kirthi Shankar Sivamani <ksivamani@nvidia.com>
Co-authored-by: Frank Sun <frsun@nvidia.com>
Co-authored-by: Oleg Goncharov <ogoncharov@nvidia.com>
Co-authored-by: Zhongbo Zhu <zhongboz@nvidia.com>
Co-authored-by: Evgeny Tsykunov <etsykunov@nvidia.com>
Co-authored-by: Tim Moon <tmoon@nvidia.com>
Co-authored-by: Teddy Do <tdophung@nvidia.com>
* [pre-commit.ci] auto fixes from pre-commit.com hooks
for more information, see https://pre-commit.ci
* Add MathDx dependency to GitHub builds
Signed-off-by: Tim Moon <tmoon@nvidia.com>
* Suggestions from GitHub Copilot
Signed-off-by: Tim Moon <tmoon@nvidia.com>
* Move 2x shape logic from core to PyTorch
Signed-off-by: Kirthi Shankar Sivamani <ksivamani@nvidia.com>
* Fix compilation errors with CUDA 12.1
Signed-off-by: Tim Moon <tmoon@nvidia.com>
* [pre-commit.ci] auto fixes from pre-commit.com hooks
for more information, see https://pre-commit.ci
* SM 70 is not supported in CUDA 13
Signed-off-by: Tim Moon <4406448+timmoon10@users.noreply.github.com>
* Typo
Signed-off-by: Tim Moon <4406448+timmoon10@users.noreply.github.com>
* Revert "Move 2x shape logic from core to PyTorch"
This reverts commit f8b2a2d.
Signed-off-by: Tim Moon <tmoon@nvidia.com>
* Added dequantize kernel for FP4
Signed-off-by: Przemek Tredak <ptredak@nvidia.com>
* [pre-commit.ci] auto fixes from pre-commit.com hooks
for more information, see https://pre-commit.ci
* Fix linter warning
Signed-off-by: Tim Moon <tmoon@nvidia.com>
* Add NVFP4 support with fusible ops
Use logical tensor dims for PyTorch NVFP4 tensors. Temporarily add unfused dequantize impl. Fix bug where NVFP4 recipe was not configurable.
Signed-off-by: Tim Moon <tmoon@nvidia.com>
* Fix logic for 2x shapes and move to PyTorch
Signed-off-by: Kirthi Shankar Sivamani <ksivamani@nvidia.com>
* Fix CG test model config
Signed-off-by: Kirthi Shankar Sivamani <ksivamani@nvidia.com>
* Debug NVFP4 tensor size function
Signed-off-by: Tim Moon <tmoon@nvidia.com>
* Proper handling of the RNG state
Signed-off-by: Przemek Tredak <ptredak@nvidia.com>
* Test SR properly
Signed-off-by: Przemek Tredak <ptredak@nvidia.com>
* [pre-commit.ci] auto fixes from pre-commit.com hooks
for more information, see https://pre-commit.ci
* Fix workspace size for GEMM heuristic.
Signed-off-by: Kirthi Shankar Sivamani <ksivamani@nvidia.com>
* Fix compile error in C++ NVFP4 test
Some some numeric errors when blocks are all zero.
Signed-off-by: Tim Moon <tmoon@nvidia.com>
* fix distrbuted test problem shape
Signed-off-by: zhongboz <zhongboz@nvidia.com>
* proper assert dim for low precision AG TP
Signed-off-by: zhongboz <zhongboz@nvidia.com>
* clean up duplicated code in nvfp4_utils.cuh
Signed-off-by: zhongboz <zhongboz@nvidia.com>
* lint
Signed-off-by: zhongboz <zhongboz@nvidia.com>
* pylint: disable=unused-argument
Signed-off-by: zhongboz <zhongboz@nvidia.com>
* `nvte_cublas_gemm_v2` to take alpha pointer (#12)
* make nvte_cublas_gemm_v2 to take alpha/beta pointers
Signed-off-by: Phuong Nguyen <phuonguyen@nvidia.com>
* users are expected to pass a valid C_tensor
Signed-off-by: Phuong Nguyen <phuonguyen@nvidia.com>
* typos
Signed-off-by: Phuong Nguyen <phuonguyen@nvidia.com>
* API to have const float* alpha
Signed-off-by: Phuong Nguyen <phuonguyen@nvidia.com>
* Minor tweaks
Support arbitrary beta scales. Increase workspace to be aligned to 128 bytes.
Signed-off-by: Tim Moon <tmoon@nvidia.com>
* Debug IMA with alpha pointer
Signed-off-by: Tim Moon <tmoon@nvidia.com>
---------
Signed-off-by: Phuong Nguyen <phuonguyen@nvidia.com>
Signed-off-by: Tim Moon <tmoon@nvidia.com>
Co-authored-by: Tim Moon <tmoon@nvidia.com>
* [pre-commit.ci] auto fixes from pre-commit.com hooks
for more information, see https://pre-commit.ci
* Support fused amax kernels with NVFP4 quantization
Signed-off-by: Tim Moon <tmoon@nvidia.com>
* Disable fused amax with cuDNN LayerNorm kernel
Signed-off-by: Tim Moon <tmoon@nvidia.com>
* Add NVFP4 cases to distributed tests for TE ops
Signed-off-by: Tim Moon <tmoon@nvidia.com>
* Change assert to NVTE_CHECK in the hadamard cast fusion
Signed-off-by: Przemek Tredak <ptredak@nvidia.com>
* Fix compile error
Signed-off-by: Tim Moon <tmoon@nvidia.com>
* Use global thread IDs for Philox subsequences
Signed-off-by: Tim Moon <tmoon@nvidia.com>
* [pre-commit.ci] auto fixes from pre-commit.com hooks
for more information, see https://pre-commit.ci
* Add shape checks for NVFP4 cast kernels
Signed-off-by: Tim Moon <tmoon@nvidia.com>
* [pre-commit.ci] auto fixes from pre-commit.com hooks
for more information, see https://pre-commit.ci
* Do not fuse amax if cuDNN normalization is forced by envvar
Signed-off-by: Przemek Tredak <ptredak@nvidia.com>
---------
Signed-off-by: Kirthi Shankar Sivamani <ksivamani@nvidia.com>
Signed-off-by: Tim Moon <tmoon@nvidia.com>
Signed-off-by: Tim Moon <4406448+timmoon10@users.noreply.github.com>
Signed-off-by: Przemek Tredak <ptredak@nvidia.com>
Signed-off-by: zhongboz <zhongboz@nvidia.com>
Signed-off-by: Phuong Nguyen <phuonguyen@nvidia.com>
Co-authored-by: Frank Sun <frsun@nvidia.com>
Co-authored-by: Oleg Goncharov <ogoncharov@nvidia.com>
Co-authored-by: Zhongbo Zhu <zhongboz@nvidia.com>
Co-authored-by: Evgeny Tsykunov <etsykunov@nvidia.com>
Co-authored-by: Tim Moon <tmoon@nvidia.com>
Co-authored-by: Teddy Do <tdophung@nvidia.com>
Co-authored-by: pre-commit-ci[bot] <66853113+pre-commit-ci[bot]@users.noreply.github.com>
Co-authored-by: Tim Moon <4406448+timmoon10@users.noreply.github.com>
Co-authored-by: Przemek Tredak <ptredak@nvidia.com>
Co-authored-by: Phuong Nguyen <phuonguyen@nvidia.com>
KshitijLakhani pushed a commit that referenced this pull request Sep 29, 2025
* Add NVFP4 recipe
Signed-off-by: Kirthi Shankar Sivamani <ksivamani@nvidia.com>
Co-authored-by: Frank Sun <frsun@nvidia.com>
Co-authored-by: Oleg Goncharov <ogoncharov@nvidia.com>
Co-authored-by: Zhongbo Zhu <zhongboz@nvidia.com>
Co-authored-by: Evgeny Tsykunov <etsykunov@nvidia.com>
Co-authored-by: Tim Moon <tmoon@nvidia.com>
Co-authored-by: Teddy Do <tdophung@nvidia.com>
* [pre-commit.ci] auto fixes from pre-commit.com hooks
for more information, see https://pre-commit.ci
* Add MathDx dependency to GitHub builds
Signed-off-by: Tim Moon <tmoon@nvidia.com>
* Suggestions from GitHub Copilot
Signed-off-by: Tim Moon <tmoon@nvidia.com>
* Move 2x shape logic from core to PyTorch
Signed-off-by: Kirthi Shankar Sivamani <ksivamani@nvidia.com>
* Fix compilation errors with CUDA 12.1
Signed-off-by: Tim Moon <tmoon@nvidia.com>
* [pre-commit.ci] auto fixes from pre-commit.com hooks
for more information, see https://pre-commit.ci
* SM 70 is not supported in CUDA 13
Signed-off-by: Tim Moon <4406448+timmoon10@users.noreply.github.com>
* Typo
Signed-off-by: Tim Moon <4406448+timmoon10@users.noreply.github.com>
* Revert "Move 2x shape logic from core to PyTorch"
This reverts commit f8b2a2d.
Signed-off-by: Tim Moon <tmoon@nvidia.com>
* Added dequantize kernel for FP4
Signed-off-by: Przemek Tredak <ptredak@nvidia.com>
* [pre-commit.ci] auto fixes from pre-commit.com hooks
for more information, see https://pre-commit.ci
* Fix linter warning
Signed-off-by: Tim Moon <tmoon@nvidia.com>
* Add NVFP4 support with fusible ops
Use logical tensor dims for PyTorch NVFP4 tensors. Temporarily add unfused dequantize impl. Fix bug where NVFP4 recipe was not configurable.
Signed-off-by: Tim Moon <tmoon@nvidia.com>
* Fix logic for 2x shapes and move to PyTorch
Signed-off-by: Kirthi Shankar Sivamani <ksivamani@nvidia.com>
* Fix CG test model config
Signed-off-by: Kirthi Shankar Sivamani <ksivamani@nvidia.com>
* Debug NVFP4 tensor size function
Signed-off-by: Tim Moon <tmoon@nvidia.com>
* Proper handling of the RNG state
Signed-off-by: Przemek Tredak <ptredak@nvidia.com>
* Test SR properly
Signed-off-by: Przemek Tredak <ptredak@nvidia.com>
* [pre-commit.ci] auto fixes from pre-commit.com hooks
for more information, see https://pre-commit.ci
* Fix workspace size for GEMM heuristic.
Signed-off-by: Kirthi Shankar Sivamani <ksivamani@nvidia.com>
* Fix compile error in C++ NVFP4 test
Some some numeric errors when blocks are all zero.
Signed-off-by: Tim Moon <tmoon@nvidia.com>
* fix distrbuted test problem shape
Signed-off-by: zhongboz <zhongboz@nvidia.com>
* proper assert dim for low precision AG TP
Signed-off-by: zhongboz <zhongboz@nvidia.com>
* clean up duplicated code in nvfp4_utils.cuh
Signed-off-by: zhongboz <zhongboz@nvidia.com>
* lint
Signed-off-by: zhongboz <zhongboz@nvidia.com>
* pylint: disable=unused-argument
Signed-off-by: zhongboz <zhongboz@nvidia.com>
* `nvte_cublas_gemm_v2` to take alpha pointer (#12)
* make nvte_cublas_gemm_v2 to take alpha/beta pointers
Signed-off-by: Phuong Nguyen <phuonguyen@nvidia.com>
* users are expected to pass a valid C_tensor
Signed-off-by: Phuong Nguyen <phuonguyen@nvidia.com>
* typos
Signed-off-by: Phuong Nguyen <phuonguyen@nvidia.com>
* API to have const float* alpha
Signed-off-by: Phuong Nguyen <phuonguyen@nvidia.com>
* Minor tweaks
Support arbitrary beta scales. Increase workspace to be aligned to 128 bytes.
Signed-off-by: Tim Moon <tmoon@nvidia.com>
* Debug IMA with alpha pointer
Signed-off-by: Tim Moon <tmoon@nvidia.com>
---------
Signed-off-by: Phuong Nguyen <phuonguyen@nvidia.com>
Signed-off-by: Tim Moon <tmoon@nvidia.com>
Co-authored-by: Tim Moon <tmoon@nvidia.com>
* [pre-commit.ci] auto fixes from pre-commit.com hooks
for more information, see https://pre-commit.ci
* Support fused amax kernels with NVFP4 quantization
Signed-off-by: Tim Moon <tmoon@nvidia.com>
* Disable fused amax with cuDNN LayerNorm kernel
Signed-off-by: Tim Moon <tmoon@nvidia.com>
* Add NVFP4 cases to distributed tests for TE ops
Signed-off-by: Tim Moon <tmoon@nvidia.com>
* Change assert to NVTE_CHECK in the hadamard cast fusion
Signed-off-by: Przemek Tredak <ptredak@nvidia.com>
* Fix compile error
Signed-off-by: Tim Moon <tmoon@nvidia.com>
* Use global thread IDs for Philox subsequences
Signed-off-by: Tim Moon <tmoon@nvidia.com>
* [pre-commit.ci] auto fixes from pre-commit.com hooks
for more information, see https://pre-commit.ci
* Add shape checks for NVFP4 cast kernels
Signed-off-by: Tim Moon <tmoon@nvidia.com>
* [pre-commit.ci] auto fixes from pre-commit.com hooks
for more information, see https://pre-commit.ci
* Do not fuse amax if cuDNN normalization is forced by envvar
Signed-off-by: Przemek Tredak <ptredak@nvidia.com>
---------
Signed-off-by: Kirthi Shankar Sivamani <ksivamani@nvidia.com>
Signed-off-by: Tim Moon <tmoon@nvidia.com>
Signed-off-by: Tim Moon <4406448+timmoon10@users.noreply.github.com>
Signed-off-by: Przemek Tredak <ptredak@nvidia.com>
Signed-off-by: zhongboz <zhongboz@nvidia.com>
Signed-off-by: Phuong Nguyen <phuonguyen@nvidia.com>
Co-authored-by: Frank Sun <frsun@nvidia.com>
Co-authored-by: Oleg Goncharov <ogoncharov@nvidia.com>
Co-authored-by: Zhongbo Zhu <zhongboz@nvidia.com>
Co-authored-by: Evgeny Tsykunov <etsykunov@nvidia.com>
Co-authored-by: Tim Moon <tmoon@nvidia.com>
Co-authored-by: Teddy Do <tdophung@nvidia.com>
Co-authored-by: pre-commit-ci[bot] <66853113+pre-commit-ci[bot]@users.noreply.github.com>
Co-authored-by: Tim Moon <4406448+timmoon10@users.noreply.github.com>
Co-authored-by: Przemek Tredak <ptredak@nvidia.com>
Co-authored-by: Phuong Nguyen <phuonguyen@nvidia.com>
Sign up for freeto join this conversation on GitHub. Already have an account? Sign in to comment

Labels

None yet

Projects

None yet

Development

Successfully merging this pull request may close these issues.

1 participant

@ptrendx