OpenGVLab / OpenGVLab/InternVideo

ModuleNotFoundError: No module named 'dropout_layer_norm'

Open
#102 8 comments 0 reactions 0 assignees View on GitHub

Nobody has claimed this yet.

Dominant language
Python
Stars
2.4k
Forks
160
PR merge metrics
No merged PRs in 30d

Description

Error occurred while running demo.ipynb in InternVideo2's multi_modality demo.
I installed packages according to requirements.txt.

ModuleNotFoundError                       
Traceback (most recent call last)
Cell In[1], line 11
      6 import torch
      8 from config import (Config,
      9                     eval_dict_leaf)
---> 11 from utils import (retrieve_text,
     12                   _frame_from_video,
     13                   setup_internvideo2)

File [~/rl-gnrl/InternVideo/InternVideo2/multi_modality/demo/utils.py:17](http://127.0.0.1:8888/lab/workspaces/auto-m/tree/multi_modality/demo/~/rl-gnrl/InternVideo/InternVideo2/multi_modality/demo/utils.py#line=16)
     13 parent_dir = os.path.dirname(current_dir)
     14 sys.path.append(parent_dir)
---> 17 from models.backbones.internvideo2 import pretrain_internvideo2_1b_patch14_224
     18 from models.backbones.bert.builder import build_bert
     19 from models.criterions import get_sim

File [~/rl-gnrl/InternVideo/InternVideo2/multi_modality/models/__init__.py:1](http://127.0.0.1:8888/lab/workspaces/auto-m/tree/multi_modality/demo/~/rl-gnrl/InternVideo/InternVideo2/multi_modality/models/__init__.py#line=0)
----> 1 from .internvideo2_clip import InternVideo2_CLIP
      2 from .internvideo2_stage2 import InternVideo2_Stage2
      3 # from .internvideo2_stage2_audio import InternVideo2_Stage2_audio

File [~/rl-gnrl/InternVideo/InternVideo2/multi_modality/models/internvideo2_clip.py:10](http://127.0.0.1:8888/lab/workspaces/auto-m/tree/multi_modality/demo/~/rl-gnrl/InternVideo/InternVideo2/multi_modality/models/internvideo2_clip.py#line=9)
      7 import torchvision.transforms as transforms
      8 from torchvision.transforms import InterpolationMode
---> 10 from .backbones.internvideo2 import InternVideo2, LLaMA, Tokenizer
     11 from .criterions import VTC_VTM_Loss
     13 logger = logging.getLogger(__name__)

File [~/rl-gnrl/InternVideo/InternVideo2/multi_modality/models/backbones/internvideo2/__init__.py:1](http://127.0.0.1:8888/lab/workspaces/auto-m/tree/multi_modality/demo/~/rl-gnrl/InternVideo/InternVideo2/multi_modality/models/backbones/internvideo2/__init__.py#line=0)
----> 1 from .internvl_clip_vision import internvl_clip_6b
      2 from .internvideo2 import pretrain_internvideo2_1b_patch14_224, pretrain_internvideo2_6b_patch14_224
      3 from .internvideo2_clip_vision import InternVideo2

File [~/rl-gnrl/InternVideo/InternVideo2/multi_modality/models/backbones/internvideo2/internvl_clip_vision.py:16](http://127.0.0.1:8888/lab/workspaces/auto-m/tree/multi_modality/demo/~/rl-gnrl/InternVideo/InternVideo2/multi_modality/models/backbones/internvideo2/internvl_clip_vision.py#line=15)
     14     from flash_attention_class import FlashAttention
     15 from flash_attn.modules.mlp import FusedMLP
---> 16 from flash_attn.ops.rms_norm import DropoutAddRMSNorm
     19 MODEL_PATH = 'your_model_path[/internvl](http://127.0.0.1:8888/internvl)'
     20 _MODELS = {
     21     # see InternVL
     22     "internvl_c_13b_224px": os.path.join(MODEL_PATH, "internvl_c_13b_224px.pth"),
     23 }

File [~/miniconda3/envs/internvid/lib/python3.10/site-packages/flash_attn/ops/rms_norm.py:7](http://127.0.0.1:8888/lab/workspaces/auto-m/tree/multi_modality/demo/~/miniconda3/envs/internvid/lib/python3.10/site-packages/flash_attn/ops/rms_norm.py#line=6)
      4 import torch
      5 from torch.nn import init
----> 7 from flash_attn.ops.layer_norm import DropoutAddLayerNormFn, DropoutAddLayerNormSubsetFn
      8 from flash_attn.ops.layer_norm import DropoutAddLayerNormParallelResidualFn
     11 def rms_norm(x, weight, epsilon):

File [~/miniconda3/envs/internvid/lib/python3.10/site-packages/flash_attn/ops/layer_norm.py:7](http://127.0.0.1:8888/lab/workspaces/auto-m/tree/multi_modality/demo/~/miniconda3/envs/internvid/lib/python3.10/site-packages/flash_attn/ops/layer_norm.py#line=6)
      4 import torch
      5 from torch.nn import init
----> 7 import dropout_layer_norm
     10 def maybe_align(x, alignment_in_bytes=16):
     11     """Assume that x already has last dim divisible by alignment_in_bytes
     12     """

ModuleNotFoundError: No module named 'dropout_layer_norm'

Contributor guide

No contributing guide indexed for this repository

First steps

  1. Read the whole issue, then the project's contributing guide.
  2. Comment on the issue to say you are picking it up — it saves two people doing the same work.
  3. Fork the repository and make your change on a branch.
  4. Open a pull request that references the issue number.

Research direction

Start by reproducing the import failure from InternVideo2/multi_modality/demo/demo.ipynb using the versions in requirements.txt. Trace the import path through multi_modality/demo/utils.py and models/backbones/internvideo2/internvl_clip_vision.py, then verify the dependency setup against flash_attn.ops.layer_norm. Done means the demo imports successfully in a fresh environment.

Written by the indexing model from the issue text.

Assessment

Tech stack
python
Domain
machine-learning
Issue type
Bug
Difficulty
3/5
Estimated time
1-2 days
Activity status
Stale
Clarity
Needs clarification
Newbie friendliness
35/100

Get new issues in your inbox

A short digest of beginner-friendly GitHub issues.