{ "_class_name": "LTX2VideoDiffusionDecoderModel", "_diffusers_version": "0.40.0.dev0", "decoder_head_dim": 8, "decoder_model_output_type": "x0", "decoder_num_inference_steps": 1, "decoder_stage5_kernel": [ 3, 3, 3 ], "decoder_stage_channels": [ 16, 16, 16, 16, 16 ], "decoder_stage_depths": [ 1, 1, 1, 1, 1 ], "decoder_stage_kernels": [ [ 3, 3, 3 ], [ 3, 3, 3 ], [ 3, 3, 3 ], [ 3, 3, 3 ] ], "decoder_t_emb_dim": 16, "decoder_timestep_scale_multiplier": 1000.0, "decoder_upsample_channel_reductions": [ 1, 1, 1, 1 ], "decoder_upsample_strides": [ [ 1, 1, 1 ], [ 1, 1, 1 ], [ 1, 1, 1 ], [ 2, 2, 2 ] ], "latent_channels": 4, "out_channels": 3, "patch_size": 1, "scaling_factor": 1.0, "spatial_compression_ratio": 2, "temporal_compression_ratio": 2 }