Skip to content

[PyTorch] Misc fixes for release_v1.6 - #784

Merged
ksivaman merged 5 commits into
NVIDIA:mainfrom
ksivaman:fp8_attention_fixes
Apr 17, 2024
Merged

[PyTorch] Misc fixes for release_v1.6#784
ksivaman merged 5 commits into
NVIDIA:mainfrom
ksivaman:fp8_attention_fixes

Conversation

@ksivaman

@ksivamanksivaman commented Apr 16, 2024

Copy link
Copy Markdown
Member
  1. Remove docs for 'is_first_module_in_mha' in Linear API's forward.
  2. Add check for FP8 before calling function to update amaxes.
  3. Only call is_first_fp8_module if any of the inputs or params require grad. We don't want the attribute to be set on a module for which bprop will not be executed.
  4. Fix the type check for grad_output in Linear backward since it is a Tensor (fwd returns 1 output).

Signed-off-by: Kirthi Shankar Sivamani <ksivamani@nvidia.com>
@ksivaman
ksivaman requested a review from cyanguwaApril 16, 2024 16:38
@ksivamanksivaman self-assigned this Apr 16, 2024
Signed-off-by: Kirthi Shankar Sivamani <ksivamani@nvidia.com>
@ksivaman
ksivamanforce-pushed the fp8_attention_fixes branch from f682260 to ac70e05CompareApril 16, 2024 23:56
Signed-off-by: Kirthi Shankar Sivamani <ksivamani@nvidia.com>
@ksivamanksivaman changed the title [PyTorch] Misc fixes from #768[PyTorch] Misc fixes for release_v1.6Apr 17, 2024
@ksivaman
ksivaman requested a review from ptrendxApril 17, 2024 02:20
@ksivaman

Copy link
Copy Markdown
MemberAuthor

/te-ci pytorch

Comment threadtransformer_engine/pytorch/module/layernorm_linear.py Outdated
Signed-off-by: Kirthi Shankar Sivamani <ksivamani@nvidia.com>
@ksivaman

Copy link
Copy Markdown
MemberAuthor

/te-ci pytorch

@timmoon10timmoon10 left a comment

Copy link
Copy Markdown
Member

Choose a reason for hiding this comment

The reason will be displayed to describe this comment to others. Learn more.

LGTM

@ksivaman
ksivaman merged commit cd54a8c into NVIDIA:mainApr 17, 2024
ksivaman added a commit that referenced this pull request Apr 17, 2024
* fixes; docs
Signed-off-by: Kirthi Shankar Sivamani <ksivamani@nvidia.com>
* Check for FP8
Signed-off-by: Kirthi Shankar Sivamani <ksivamani@nvidia.com>
* Fix LoRa-like use cases
Signed-off-by: Kirthi Shankar Sivamani <ksivamani@nvidia.com>
* Reviews
Signed-off-by: Kirthi Shankar Sivamani <ksivamani@nvidia.com>
---------
Signed-off-by: Kirthi Shankar Sivamani <ksivamani@nvidia.com>
ksivaman added a commit to ksivaman/TransformerEngine-1 that referenced this pull request Apr 19, 2024
* fixes; docs
Signed-off-by: Kirthi Shankar Sivamani <ksivamani@nvidia.com>
* Check for FP8
Signed-off-by: Kirthi Shankar Sivamani <ksivamani@nvidia.com>
* Fix LoRa-like use cases
Signed-off-by: Kirthi Shankar Sivamani <ksivamani@nvidia.com>
* Reviews
Signed-off-by: Kirthi Shankar Sivamani <ksivamani@nvidia.com>
---------
Signed-off-by: Kirthi Shankar Sivamani <ksivamani@nvidia.com>
ksivaman added a commit that referenced this pull request Apr 19, 2024
* fixes; docs
Signed-off-by: Kirthi Shankar Sivamani <ksivamani@nvidia.com>
* Check for FP8
Signed-off-by: Kirthi Shankar Sivamani <ksivamani@nvidia.com>
* Fix LoRa-like use cases
Signed-off-by: Kirthi Shankar Sivamani <ksivamani@nvidia.com>
* Reviews
Signed-off-by: Kirthi Shankar Sivamani <ksivamani@nvidia.com>
---------
Signed-off-by: Kirthi Shankar Sivamani <ksivamani@nvidia.com>
pggPL pushed a commit to pggPL/TransformerEngine that referenced this pull request May 23, 2024
* fixes; docs
Signed-off-by: Kirthi Shankar Sivamani <ksivamani@nvidia.com>
* Check for FP8
Signed-off-by: Kirthi Shankar Sivamani <ksivamani@nvidia.com>
* Fix LoRa-like use cases
Signed-off-by: Kirthi Shankar Sivamani <ksivamani@nvidia.com>
* Reviews
Signed-off-by: Kirthi Shankar Sivamani <ksivamani@nvidia.com>
---------
Signed-off-by: Kirthi Shankar Sivamani <ksivamani@nvidia.com>
Signed-off-by: Pawel Gadzinski <pgadzinski@nvidia.com>
Sign up for freeto join this conversation on GitHub. Already have an account? Sign in to comment

Labels

Projects

None yet

Development

Successfully merging this pull request may close these issues.

2 participants

@ksivaman@timmoon10