4 Commits
Author SHA1 Message Date
Anh71meandgubei 8eddf6ed3d Merge pull request #24 from longgui0318/main
* diffusers 0.26 support . from https://github.com/levihsu/OOTDiffusion/issues/44#issuecomment-1968365131

---------

Co-authored-by: gubei <>
2024-03-14 11:45:36 +08:00
gubei c17a198800 fix diffusers minimum version requirement 2024-03-14 09:34:12 +08:00
gubei feb9d28f1d Add diffusers minimum version requirement
PixArtAlphaTextProjection renamed in version 0.25.0 issues id 6212
GLIGENTextBoundingboxProjection added in version 0.25.1 issues id 6244
2024-03-13 18:09:17 +08:00
gubei c5abb6f538 fix diffusers verison . from https://github.com/levihsu/OOTDiffusion/issues/44#issuecomment-1968365131 2024-03-13 16:14:15 +08:00
5 changed files with 9 additions and 9 deletions
+2 -2
View File
@@ -26,7 +26,7 @@ from diffusers.configuration_utils import ConfigMixin, register_to_config
from diffusers.models.embeddings import ImagePositionalEmbeddings from diffusers.models.embeddings import ImagePositionalEmbeddings
from diffusers.utils import USE_PEFT_BACKEND, BaseOutput, deprecate from diffusers.utils import USE_PEFT_BACKEND, BaseOutput, deprecate
# from diffusers.models.attention import BasicTransformerBlock # from diffusers.models.attention import BasicTransformerBlock
from diffusers.models.embeddings import CaptionProjection, PatchEmbed from diffusers.models.embeddings import PixArtAlphaTextProjection, PatchEmbed
from diffusers.models.lora import LoRACompatibleConv, LoRACompatibleLinear from diffusers.models.lora import LoRACompatibleConv, LoRACompatibleLinear
from diffusers.models.modeling_utils import ModelMixin from diffusers.models.modeling_utils import ModelMixin
from diffusers.models.normalization import AdaLayerNormSingle from diffusers.models.normalization import AdaLayerNormSingle
@@ -237,7 +237,7 @@ class Transformer2DModel(ModelMixin, ConfigMixin):
self.caption_projection = None self.caption_projection = None
if caption_channels is not None: if caption_channels is not None:
self.caption_projection = CaptionProjection(in_features=caption_channels, hidden_size=inner_dim) self.caption_projection = PixArtAlphaTextProjection(in_features=caption_channels, hidden_size=inner_dim)
self.gradient_checkpointing = False self.gradient_checkpointing = False
+2 -2
View File
@@ -26,7 +26,7 @@ from diffusers.configuration_utils import ConfigMixin, register_to_config
from diffusers.models.embeddings import ImagePositionalEmbeddings from diffusers.models.embeddings import ImagePositionalEmbeddings
from diffusers.utils import USE_PEFT_BACKEND, BaseOutput, deprecate from diffusers.utils import USE_PEFT_BACKEND, BaseOutput, deprecate
# from diffusers.models.attention import BasicTransformerBlock # from diffusers.models.attention import BasicTransformerBlock
from diffusers.models.embeddings import CaptionProjection, PatchEmbed from diffusers.models.embeddings import PixArtAlphaTextProjection, PatchEmbed
from diffusers.models.lora import LoRACompatibleConv, LoRACompatibleLinear from diffusers.models.lora import LoRACompatibleConv, LoRACompatibleLinear
from diffusers.models.modeling_utils import ModelMixin from diffusers.models.modeling_utils import ModelMixin
from diffusers.models.normalization import AdaLayerNormSingle from diffusers.models.normalization import AdaLayerNormSingle
@@ -237,7 +237,7 @@ class Transformer2DModel(ModelMixin, ConfigMixin):
self.caption_projection = None self.caption_projection = None
if caption_channels is not None: if caption_channels is not None:
self.caption_projection = CaptionProjection(in_features=caption_channels, hidden_size=inner_dim) self.caption_projection = PixArtAlphaTextProjection(in_features=caption_channels, hidden_size=inner_dim)
self.gradient_checkpointing = False self.gradient_checkpointing = False
+2 -2
View File
@@ -44,7 +44,7 @@ from diffusers.models.embeddings import (
ImageHintTimeEmbedding, ImageHintTimeEmbedding,
ImageProjection, ImageProjection,
ImageTimeEmbedding, ImageTimeEmbedding,
PositionNet, GLIGENTextBoundingboxProjection,
TextImageProjection, TextImageProjection,
TextImageTimeEmbedding, TextImageTimeEmbedding,
TextTimeEmbedding, TextTimeEmbedding,
@@ -624,7 +624,7 @@ class UNetGarm2DConditionModel(ModelMixin, ConfigMixin, UNet2DConditionLoadersMi
positive_len = cross_attention_dim[0] positive_len = cross_attention_dim[0]
feature_type = "text-only" if attention_type == "gated" else "text-image" feature_type = "text-only" if attention_type == "gated" else "text-image"
self.position_net = PositionNet( self.position_net = GLIGENTextBoundingboxProjection(
positive_len=positive_len, out_dim=cross_attention_dim, feature_type=feature_type positive_len=positive_len, out_dim=cross_attention_dim, feature_type=feature_type
) )
+2 -2
View File
@@ -44,7 +44,7 @@ from diffusers.models.embeddings import (
ImageHintTimeEmbedding, ImageHintTimeEmbedding,
ImageProjection, ImageProjection,
ImageTimeEmbedding, ImageTimeEmbedding,
PositionNet, GLIGENTextBoundingboxProjection,
TextImageProjection, TextImageProjection,
TextImageTimeEmbedding, TextImageTimeEmbedding,
TextTimeEmbedding, TextTimeEmbedding,
@@ -624,7 +624,7 @@ class UNetVton2DConditionModel(ModelMixin, ConfigMixin, UNet2DConditionLoadersMi
positive_len = cross_attention_dim[0] positive_len = cross_attention_dim[0]
feature_type = "text-only" if attention_type == "gated" else "text-image" feature_type = "text-only" if attention_type == "gated" else "text-image"
self.position_net = PositionNet( self.position_net = GLIGENTextBoundingboxProjection(
positive_len=positive_len, out_dim=cross_attention_dim, feature_type=feature_type positive_len=positive_len, out_dim=cross_attention_dim, feature_type=feature_type
) )
+1 -1
View File
@@ -5,7 +5,7 @@ scipy
scikit-image scikit-image
opencv-python opencv-python
pillow pillow
diffusers==0.24.0 diffusers>=0.26.0
transformers transformers
accelerate accelerate
matplotlib matplotlib