Skip to content

[PyTorch] Avoid using LRU cache for cu_seqlens - #798

Merged
ksivaman merged 4 commits into
NVIDIA:mainfrom
ksivaman:llm_ima_fix
Apr 24, 2024
Merged

[PyTorch] Avoid using LRU cache for cu_seqlens#798
ksivaman merged 4 commits into
NVIDIA:mainfrom
ksivaman:llm_ima_fix

Conversation

@ksivaman

Copy link
Copy Markdown
Member

LRU cache usage is leading to IMAs in certain LLM workloads
@vasunvidia

vasunvidiaand others added 2 commits April 22, 2024 20:49
Signed-off-by: Kirthi Shankar Sivamani <ksivamani@nvidia.com>
Signed-off-by: Kirthi Shankar Sivamani <ksivamani@nvidia.com>
Signed-off-by: Kirthi Shankar Sivamani <ksivamani@nvidia.com>

@timmoon10timmoon10 left a comment

Copy link
Copy Markdown
Member

Choose a reason for hiding this comment

The reason will be displayed to describe this comment to others. Learn more.

We speculate the bug is because torch.device("cuda") != torch.device("cuda", 0) != "cuda".

@ksivaman

Copy link
Copy Markdown
MemberAuthor

/te-ci pytorch

@ksivaman
ksivaman merged commit f0ed3d5 into NVIDIA:mainApr 24, 2024
ksivaman added a commit that referenced this pull request Apr 24, 2024
* Try using global buffer for cu_seqlens
Signed-off-by: Kirthi Shankar Sivamani <ksivamani@nvidia.com>
* Avoid using functools.lru_cache
Signed-off-by: Kirthi Shankar Sivamani <ksivamani@nvidia.com>
* fixes
Signed-off-by: Kirthi Shankar Sivamani <ksivamani@nvidia.com>
---------
Signed-off-by: Kirthi Shankar Sivamani <ksivamani@nvidia.com>
Co-authored-by: Vasudevan Rengasamy <vrengasamy@nvidia.com>
pggPL pushed a commit to pggPL/TransformerEngine that referenced this pull request May 23, 2024
* Try using global buffer for cu_seqlens
Signed-off-by: Kirthi Shankar Sivamani <ksivamani@nvidia.com>
* Avoid using functools.lru_cache
Signed-off-by: Kirthi Shankar Sivamani <ksivamani@nvidia.com>
* fixes
Signed-off-by: Kirthi Shankar Sivamani <ksivamani@nvidia.com>
---------
Signed-off-by: Kirthi Shankar Sivamani <ksivamani@nvidia.com>
Co-authored-by: Vasudevan Rengasamy <vrengasamy@nvidia.com>
Signed-off-by: Pawel Gadzinski <pgadzinski@nvidia.com>
Sign up for freeto join this conversation on GitHub. Already have an account? Sign in to comment

Labels

Projects

None yet

Development

Successfully merging this pull request may close these issues.

3 participants

@ksivaman@timmoon10@vasunvidia