diff --git a/finetrainers/conditioning/LTXVideoConditionedTransformer3DModel.py b/finetrainers/conditioning/LTXVideoConditionedTransformer3DModel.py index 98ca484..d4e5f97 100644 --- a/finetrainers/conditioning/LTXVideoConditionedTransformer3DModel.py +++ b/finetrainers/conditioning/LTXVideoConditionedTransformer3DModel.py @@ -93,7 +93,8 @@ class LTXVideoConditionedTransformer3DModel(LTXVideoTransformer3DModel): attention_kwargs: Optional[Dict[str, Any]] = None, return_dict: bool = True ) -> torch.Tensor: - + if residual_x == None: + print("Residual Not included in the calculation.") image_rotary_emb = self.rope(hidden_states, num_frames, height, width, rope_interpolation_scale) # convert encoder_attention_mask to a bias the same way we do for attention_mask