OpenGVLab
/

InternVL-Chat-V1-5-AWQ

Image-Text-to-Text

feature-extraction

Model card Files Files and versions

czczup commited on Aug 23, 2024

Commit

11d92ff

·

verified ·

1 Parent(s): f879461

Upload folder using huggingface_hub

Files changed (1) hide show

modeling_internvl_chat.py +3 -3

modeling_internvl_chat.py CHANGED Viewed

@@ -10,15 +10,14 @@ import torch.utils.checkpoint
 import transformers
 from torch import nn
 from torch.nn import CrossEntropyLoss
-from transformers import (AutoModel, GenerationConfig, LlamaForCausalLM,
-                          LlamaTokenizer)
 from transformers.modeling_outputs import CausalLMOutputWithPast
 from transformers.modeling_utils import PreTrainedModel
 from transformers.utils import ModelOutput, logging
 from .configuration_internvl_chat import InternVLChatConfig
 from .conversation import get_conv_template
-from .modeling_intern_vit import InternVisionModel
 from .modeling_internlm2 import InternLM2ForCausalLM
 logger = logging.get_logger(__name__)
@@ -50,6 +49,7 @@ class InternVLChatModel(PreTrainedModel):
         self.num_image_token = int((image_size // patch_size) ** 2 * (config.downsample_ratio ** 2))
         self.downsample_ratio = config.downsample_ratio
         self.ps_version = config.ps_version
         config.vision_config.use_flash_attn = True if use_flash_attn else False
         config.llm_config.attn_implementation = 'flash_attention_2' if use_flash_attn else 'eager'

 import transformers
 from torch import nn
 from torch.nn import CrossEntropyLoss
+from transformers import AutoModel, GenerationConfig, LlamaForCausalLM
 from transformers.modeling_outputs import CausalLMOutputWithPast
 from transformers.modeling_utils import PreTrainedModel
 from transformers.utils import ModelOutput, logging
 from .configuration_internvl_chat import InternVLChatConfig
 from .conversation import get_conv_template
+from .modeling_intern_vit import InternVisionModel, has_flash_attn
 from .modeling_internlm2 import InternLM2ForCausalLM
 logger = logging.get_logger(__name__)
         self.num_image_token = int((image_size // patch_size) ** 2 * (config.downsample_ratio ** 2))
         self.downsample_ratio = config.downsample_ratio
         self.ps_version = config.ps_version
+        use_flash_attn = use_flash_attn if has_flash_attn else False
         config.vision_config.use_flash_attn = True if use_flash_attn else False
         config.llm_config.attn_implementation = 'flash_attention_2' if use_flash_attn else 'eager'