{ "metadata": { "total_size": 89241092, "total_parameters": 117332322 }, "weight_map": { "flow_lm.bos_emb": "model.safetensors", "flow_lm.conditioner.embed.biases": "model.safetensors", "flow_lm.conditioner.embed.scales": "model.safetensors", "flow_lm.conditioner.embed.weight": "model.safetensors", "flow_lm.emb_mean": "model.safetensors", "flow_lm.emb_std": "model.safetensors", "flow_lm.flow_net.cond_embed.bias": "model.safetensors", "flow_lm.flow_net.cond_embed.biases": "model.safetensors", "flow_lm.flow_net.cond_embed.scales": "model.safetensors", "flow_lm.flow_net.cond_embed.weight": "model.safetensors", "flow_lm.flow_net.final_layer.adaLN_modulation.1.bias": "model.safetensors", "flow_lm.flow_net.final_layer.adaLN_modulation.1.biases": "model.safetensors", "flow_lm.flow_net.final_layer.adaLN_modulation.1.scales": "model.safetensors", "flow_lm.flow_net.final_layer.adaLN_modulation.1.weight": "model.safetensors", "flow_lm.flow_net.final_layer.linear.bias": "model.safetensors", "flow_lm.flow_net.final_layer.linear.biases": "model.safetensors", "flow_lm.flow_net.final_layer.linear.scales": "model.safetensors", "flow_lm.flow_net.final_layer.linear.weight": "model.safetensors", "flow_lm.flow_net.input_proj.bias": "model.safetensors", "flow_lm.flow_net.input_proj.weight": "model.safetensors", "flow_lm.flow_net.res_blocks.0.adaLN_modulation.1.bias": "model.safetensors", "flow_lm.flow_net.res_blocks.0.adaLN_modulation.1.biases": "model.safetensors", "flow_lm.flow_net.res_blocks.0.adaLN_modulation.1.scales": "model.safetensors", "flow_lm.flow_net.res_blocks.0.adaLN_modulation.1.weight": "model.safetensors", "flow_lm.flow_net.res_blocks.0.in_ln.bias": "model.safetensors", "flow_lm.flow_net.res_blocks.0.in_ln.weight": "model.safetensors", "flow_lm.flow_net.res_blocks.0.mlp.0.bias": "model.safetensors", "flow_lm.flow_net.res_blocks.0.mlp.0.biases": "model.safetensors", "flow_lm.flow_net.res_blocks.0.mlp.0.scales": "model.safetensors", "flow_lm.flow_net.res_blocks.0.mlp.0.weight": "model.safetensors", "flow_lm.flow_net.res_blocks.0.mlp.2.bias": "model.safetensors", "flow_lm.flow_net.res_blocks.0.mlp.2.biases": "model.safetensors", "flow_lm.flow_net.res_blocks.0.mlp.2.scales": "model.safetensors", "flow_lm.flow_net.res_blocks.0.mlp.2.weight": "model.safetensors", "flow_lm.flow_net.res_blocks.1.adaLN_modulation.1.bias": "model.safetensors", "flow_lm.flow_net.res_blocks.1.adaLN_modulation.1.biases": "model.safetensors", "flow_lm.flow_net.res_blocks.1.adaLN_modulation.1.scales": "model.safetensors", "flow_lm.flow_net.res_blocks.1.adaLN_modulation.1.weight": "model.safetensors", "flow_lm.flow_net.res_blocks.1.in_ln.bias": "model.safetensors", "flow_lm.flow_net.res_blocks.1.in_ln.weight": "model.safetensors", "flow_lm.flow_net.res_blocks.1.mlp.0.bias": "model.safetensors", "flow_lm.flow_net.res_blocks.1.mlp.0.biases": "model.safetensors", "flow_lm.flow_net.res_blocks.1.mlp.0.scales": "model.safetensors", "flow_lm.flow_net.res_blocks.1.mlp.0.weight": "model.safetensors", "flow_lm.flow_net.res_blocks.1.mlp.2.bias": "model.safetensors", "flow_lm.flow_net.res_blocks.1.mlp.2.biases": "model.safetensors", "flow_lm.flow_net.res_blocks.1.mlp.2.scales": "model.safetensors", "flow_lm.flow_net.res_blocks.1.mlp.2.weight": "model.safetensors", "flow_lm.flow_net.res_blocks.2.adaLN_modulation.1.bias": "model.safetensors", "flow_lm.flow_net.res_blocks.2.adaLN_modulation.1.biases": "model.safetensors", "flow_lm.flow_net.res_blocks.2.adaLN_modulation.1.scales": "model.safetensors", "flow_lm.flow_net.res_blocks.2.adaLN_modulation.1.weight": "model.safetensors", "flow_lm.flow_net.res_blocks.2.in_ln.bias": "model.safetensors", "flow_lm.flow_net.res_blocks.2.in_ln.weight": "model.safetensors", "flow_lm.flow_net.res_blocks.2.mlp.0.bias": "model.safetensors", "flow_lm.flow_net.res_blocks.2.mlp.0.biases": "model.safetensors", "flow_lm.flow_net.res_blocks.2.mlp.0.scales": "model.safetensors", "flow_lm.flow_net.res_blocks.2.mlp.0.weight": "model.safetensors", "flow_lm.flow_net.res_blocks.2.mlp.2.bias": "model.safetensors", "flow_lm.flow_net.res_blocks.2.mlp.2.biases": "model.safetensors", "flow_lm.flow_net.res_blocks.2.mlp.2.scales": "model.safetensors", "flow_lm.flow_net.res_blocks.2.mlp.2.weight": "model.safetensors", "flow_lm.flow_net.res_blocks.3.adaLN_modulation.1.bias": "model.safetensors", "flow_lm.flow_net.res_blocks.3.adaLN_modulation.1.biases": "model.safetensors", "flow_lm.flow_net.res_blocks.3.adaLN_modulation.1.scales": "model.safetensors", "flow_lm.flow_net.res_blocks.3.adaLN_modulation.1.weight": "model.safetensors", "flow_lm.flow_net.res_blocks.3.in_ln.bias": "model.safetensors", "flow_lm.flow_net.res_blocks.3.in_ln.weight": "model.safetensors", "flow_lm.flow_net.res_blocks.3.mlp.0.bias": "model.safetensors", "flow_lm.flow_net.res_blocks.3.mlp.0.biases": "model.safetensors", "flow_lm.flow_net.res_blocks.3.mlp.0.scales": "model.safetensors", "flow_lm.flow_net.res_blocks.3.mlp.0.weight": "model.safetensors", "flow_lm.flow_net.res_blocks.3.mlp.2.bias": "model.safetensors", "flow_lm.flow_net.res_blocks.3.mlp.2.biases": "model.safetensors", "flow_lm.flow_net.res_blocks.3.mlp.2.scales": "model.safetensors", "flow_lm.flow_net.res_blocks.3.mlp.2.weight": "model.safetensors", "flow_lm.flow_net.res_blocks.4.adaLN_modulation.1.bias": "model.safetensors", "flow_lm.flow_net.res_blocks.4.adaLN_modulation.1.biases": "model.safetensors", "flow_lm.flow_net.res_blocks.4.adaLN_modulation.1.scales": "model.safetensors", "flow_lm.flow_net.res_blocks.4.adaLN_modulation.1.weight": "model.safetensors", "flow_lm.flow_net.res_blocks.4.in_ln.bias": "model.safetensors", "flow_lm.flow_net.res_blocks.4.in_ln.weight": "model.safetensors", "flow_lm.flow_net.res_blocks.4.mlp.0.bias": "model.safetensors", "flow_lm.flow_net.res_blocks.4.mlp.0.biases": "model.safetensors", "flow_lm.flow_net.res_blocks.4.mlp.0.scales": "model.safetensors", "flow_lm.flow_net.res_blocks.4.mlp.0.weight": "model.safetensors", "flow_lm.flow_net.res_blocks.4.mlp.2.bias": "model.safetensors", "flow_lm.flow_net.res_blocks.4.mlp.2.biases": "model.safetensors", "flow_lm.flow_net.res_blocks.4.mlp.2.scales": "model.safetensors", "flow_lm.flow_net.res_blocks.4.mlp.2.weight": "model.safetensors", "flow_lm.flow_net.res_blocks.5.adaLN_modulation.1.bias": "model.safetensors", "flow_lm.flow_net.res_blocks.5.adaLN_modulation.1.biases": "model.safetensors", "flow_lm.flow_net.res_blocks.5.adaLN_modulation.1.scales": "model.safetensors", "flow_lm.flow_net.res_blocks.5.adaLN_modulation.1.weight": "model.safetensors", "flow_lm.flow_net.res_blocks.5.in_ln.bias": "model.safetensors", "flow_lm.flow_net.res_blocks.5.in_ln.weight": "model.safetensors", "flow_lm.flow_net.res_blocks.5.mlp.0.bias": "model.safetensors", "flow_lm.flow_net.res_blocks.5.mlp.0.biases": "model.safetensors", "flow_lm.flow_net.res_blocks.5.mlp.0.scales": "model.safetensors", "flow_lm.flow_net.res_blocks.5.mlp.0.weight": "model.safetensors", "flow_lm.flow_net.res_blocks.5.mlp.2.bias": "model.safetensors", "flow_lm.flow_net.res_blocks.5.mlp.2.biases": "model.safetensors", "flow_lm.flow_net.res_blocks.5.mlp.2.scales": "model.safetensors", "flow_lm.flow_net.res_blocks.5.mlp.2.weight": "model.safetensors", "flow_lm.flow_net.time_embed.0.freqs": "model.safetensors", "flow_lm.flow_net.time_embed.0.mlp.0.bias": "model.safetensors", "flow_lm.flow_net.time_embed.0.mlp.0.biases": "model.safetensors", "flow_lm.flow_net.time_embed.0.mlp.0.scales": "model.safetensors", "flow_lm.flow_net.time_embed.0.mlp.0.weight": "model.safetensors", "flow_lm.flow_net.time_embed.0.mlp.2.bias": "model.safetensors", "flow_lm.flow_net.time_embed.0.mlp.2.biases": "model.safetensors", "flow_lm.flow_net.time_embed.0.mlp.2.scales": "model.safetensors", "flow_lm.flow_net.time_embed.0.mlp.2.weight": "model.safetensors", "flow_lm.flow_net.time_embed.0.mlp.3.alpha": "model.safetensors", "flow_lm.flow_net.time_embed.1.freqs": "model.safetensors", "flow_lm.flow_net.time_embed.1.mlp.0.bias": "model.safetensors", "flow_lm.flow_net.time_embed.1.mlp.0.biases": "model.safetensors", "flow_lm.flow_net.time_embed.1.mlp.0.scales": "model.safetensors", "flow_lm.flow_net.time_embed.1.mlp.0.weight": "model.safetensors", "flow_lm.flow_net.time_embed.1.mlp.2.bias": "model.safetensors", "flow_lm.flow_net.time_embed.1.mlp.2.biases": "model.safetensors", "flow_lm.flow_net.time_embed.1.mlp.2.scales": "model.safetensors", "flow_lm.flow_net.time_embed.1.mlp.2.weight": "model.safetensors", "flow_lm.flow_net.time_embed.1.mlp.3.alpha": "model.safetensors", "flow_lm.input_linear.weight": "model.safetensors", "flow_lm.out_eos.bias": "model.safetensors", "flow_lm.out_eos.biases": "model.safetensors", "flow_lm.out_eos.scales": "model.safetensors", "flow_lm.out_eos.weight": "model.safetensors", "flow_lm.out_norm.bias": "model.safetensors", "flow_lm.out_norm.weight": "model.safetensors", "flow_lm.transformer.layers.0.linear1.biases": "model.safetensors", "flow_lm.transformer.layers.0.linear1.scales": "model.safetensors", "flow_lm.transformer.layers.0.linear1.weight": "model.safetensors", "flow_lm.transformer.layers.0.linear2.biases": "model.safetensors", "flow_lm.transformer.layers.0.linear2.scales": "model.safetensors", "flow_lm.transformer.layers.0.linear2.weight": "model.safetensors", "flow_lm.transformer.layers.0.norm1.bias": "model.safetensors", "flow_lm.transformer.layers.0.norm1.weight": "model.safetensors", "flow_lm.transformer.layers.0.norm2.bias": "model.safetensors", "flow_lm.transformer.layers.0.norm2.weight": "model.safetensors", "flow_lm.transformer.layers.0.self_attn.in_proj.biases": "model.safetensors", "flow_lm.transformer.layers.0.self_attn.in_proj.scales": "model.safetensors", "flow_lm.transformer.layers.0.self_attn.in_proj.weight": "model.safetensors", "flow_lm.transformer.layers.0.self_attn.out_proj.biases": "model.safetensors", "flow_lm.transformer.layers.0.self_attn.out_proj.scales": "model.safetensors", "flow_lm.transformer.layers.0.self_attn.out_proj.weight": "model.safetensors", "flow_lm.transformer.layers.1.linear1.biases": "model.safetensors", "flow_lm.transformer.layers.1.linear1.scales": "model.safetensors", "flow_lm.transformer.layers.1.linear1.weight": "model.safetensors", "flow_lm.transformer.layers.1.linear2.biases": "model.safetensors", "flow_lm.transformer.layers.1.linear2.scales": "model.safetensors", "flow_lm.transformer.layers.1.linear2.weight": "model.safetensors", "flow_lm.transformer.layers.1.norm1.bias": "model.safetensors", "flow_lm.transformer.layers.1.norm1.weight": "model.safetensors", "flow_lm.transformer.layers.1.norm2.bias": "model.safetensors", "flow_lm.transformer.layers.1.norm2.weight": "model.safetensors", "flow_lm.transformer.layers.1.self_attn.in_proj.biases": "model.safetensors", "flow_lm.transformer.layers.1.self_attn.in_proj.scales": "model.safetensors", "flow_lm.transformer.layers.1.self_attn.in_proj.weight": "model.safetensors", "flow_lm.transformer.layers.1.self_attn.out_proj.biases": "model.safetensors", "flow_lm.transformer.layers.1.self_attn.out_proj.scales": "model.safetensors", "flow_lm.transformer.layers.1.self_attn.out_proj.weight": "model.safetensors", "flow_lm.transformer.layers.2.linear1.biases": "model.safetensors", "flow_lm.transformer.layers.2.linear1.scales": "model.safetensors", "flow_lm.transformer.layers.2.linear1.weight": "model.safetensors", "flow_lm.transformer.layers.2.linear2.biases": "model.safetensors", "flow_lm.transformer.layers.2.linear2.scales": "model.safetensors", "flow_lm.transformer.layers.2.linear2.weight": "model.safetensors", "flow_lm.transformer.layers.2.norm1.bias": "model.safetensors", "flow_lm.transformer.layers.2.norm1.weight": "model.safetensors", "flow_lm.transformer.layers.2.norm2.bias": "model.safetensors", "flow_lm.transformer.layers.2.norm2.weight": "model.safetensors", "flow_lm.transformer.layers.2.self_attn.in_proj.biases": "model.safetensors", "flow_lm.transformer.layers.2.self_attn.in_proj.scales": "model.safetensors", "flow_lm.transformer.layers.2.self_attn.in_proj.weight": "model.safetensors", "flow_lm.transformer.layers.2.self_attn.out_proj.biases": "model.safetensors", "flow_lm.transformer.layers.2.self_attn.out_proj.scales": "model.safetensors", "flow_lm.transformer.layers.2.self_attn.out_proj.weight": "model.safetensors", "flow_lm.transformer.layers.3.linear1.biases": "model.safetensors", "flow_lm.transformer.layers.3.linear1.scales": "model.safetensors", "flow_lm.transformer.layers.3.linear1.weight": "model.safetensors", "flow_lm.transformer.layers.3.linear2.biases": "model.safetensors", "flow_lm.transformer.layers.3.linear2.scales": "model.safetensors", "flow_lm.transformer.layers.3.linear2.weight": "model.safetensors", "flow_lm.transformer.layers.3.norm1.bias": "model.safetensors", "flow_lm.transformer.layers.3.norm1.weight": "model.safetensors", "flow_lm.transformer.layers.3.norm2.bias": "model.safetensors", "flow_lm.transformer.layers.3.norm2.weight": "model.safetensors", "flow_lm.transformer.layers.3.self_attn.in_proj.biases": "model.safetensors", "flow_lm.transformer.layers.3.self_attn.in_proj.scales": "model.safetensors", "flow_lm.transformer.layers.3.self_attn.in_proj.weight": "model.safetensors", "flow_lm.transformer.layers.3.self_attn.out_proj.biases": "model.safetensors", "flow_lm.transformer.layers.3.self_attn.out_proj.scales": "model.safetensors", "flow_lm.transformer.layers.3.self_attn.out_proj.weight": "model.safetensors", "flow_lm.transformer.layers.4.linear1.biases": "model.safetensors", "flow_lm.transformer.layers.4.linear1.scales": "model.safetensors", "flow_lm.transformer.layers.4.linear1.weight": "model.safetensors", "flow_lm.transformer.layers.4.linear2.biases": "model.safetensors", "flow_lm.transformer.layers.4.linear2.scales": "model.safetensors", "flow_lm.transformer.layers.4.linear2.weight": "model.safetensors", "flow_lm.transformer.layers.4.norm1.bias": "model.safetensors", "flow_lm.transformer.layers.4.norm1.weight": "model.safetensors", "flow_lm.transformer.layers.4.norm2.bias": "model.safetensors", "flow_lm.transformer.layers.4.norm2.weight": "model.safetensors", "flow_lm.transformer.layers.4.self_attn.in_proj.biases": "model.safetensors", "flow_lm.transformer.layers.4.self_attn.in_proj.scales": "model.safetensors", "flow_lm.transformer.layers.4.self_attn.in_proj.weight": "model.safetensors", "flow_lm.transformer.layers.4.self_attn.out_proj.biases": "model.safetensors", "flow_lm.transformer.layers.4.self_attn.out_proj.scales": "model.safetensors", "flow_lm.transformer.layers.4.self_attn.out_proj.weight": "model.safetensors", "flow_lm.transformer.layers.5.linear1.biases": "model.safetensors", "flow_lm.transformer.layers.5.linear1.scales": "model.safetensors", "flow_lm.transformer.layers.5.linear1.weight": "model.safetensors", "flow_lm.transformer.layers.5.linear2.biases": "model.safetensors", "flow_lm.transformer.layers.5.linear2.scales": "model.safetensors", "flow_lm.transformer.layers.5.linear2.weight": "model.safetensors", "flow_lm.transformer.layers.5.norm1.bias": "model.safetensors", "flow_lm.transformer.layers.5.norm1.weight": "model.safetensors", "flow_lm.transformer.layers.5.norm2.bias": "model.safetensors", "flow_lm.transformer.layers.5.norm2.weight": "model.safetensors", "flow_lm.transformer.layers.5.self_attn.in_proj.biases": "model.safetensors", "flow_lm.transformer.layers.5.self_attn.in_proj.scales": "model.safetensors", "flow_lm.transformer.layers.5.self_attn.in_proj.weight": "model.safetensors", "flow_lm.transformer.layers.5.self_attn.out_proj.biases": "model.safetensors", "flow_lm.transformer.layers.5.self_attn.out_proj.scales": "model.safetensors", "flow_lm.transformer.layers.5.self_attn.out_proj.weight": "model.safetensors", "mimi.decoder.final_conv1d.conv.conv.bias": "model.safetensors", "mimi.decoder.final_conv1d.conv.conv.weight": "model.safetensors", "mimi.decoder.init_conv1d.conv.conv.bias": "model.safetensors", "mimi.decoder.init_conv1d.conv.conv.weight": "model.safetensors", "mimi.decoder.layers.0.residuals.0.block.0.conv.conv.bias": "model.safetensors", "mimi.decoder.layers.0.residuals.0.block.0.conv.conv.weight": "model.safetensors", "mimi.decoder.layers.0.residuals.0.block.1.conv.conv.bias": "model.safetensors", "mimi.decoder.layers.0.residuals.0.block.1.conv.conv.weight": "model.safetensors", "mimi.decoder.layers.0.upsample.convtr.convtr.bias": "model.safetensors", "mimi.decoder.layers.0.upsample.convtr.convtr.weight": "model.safetensors", "mimi.decoder.layers.1.residuals.0.block.0.conv.conv.bias": "model.safetensors", "mimi.decoder.layers.1.residuals.0.block.0.conv.conv.weight": "model.safetensors", "mimi.decoder.layers.1.residuals.0.block.1.conv.conv.bias": "model.safetensors", "mimi.decoder.layers.1.residuals.0.block.1.conv.conv.weight": "model.safetensors", "mimi.decoder.layers.1.upsample.convtr.convtr.bias": "model.safetensors", "mimi.decoder.layers.1.upsample.convtr.convtr.weight": "model.safetensors", "mimi.decoder.layers.2.residuals.0.block.0.conv.conv.bias": "model.safetensors", "mimi.decoder.layers.2.residuals.0.block.0.conv.conv.weight": "model.safetensors", "mimi.decoder.layers.2.residuals.0.block.1.conv.conv.bias": "model.safetensors", "mimi.decoder.layers.2.residuals.0.block.1.conv.conv.weight": "model.safetensors", "mimi.decoder.layers.2.upsample.convtr.convtr.bias": "model.safetensors", "mimi.decoder.layers.2.upsample.convtr.convtr.weight": "model.safetensors", "mimi.decoder_transformer.transformer.layers.0.gating.linear1.biases": "model.safetensors", "mimi.decoder_transformer.transformer.layers.0.gating.linear1.scales": "model.safetensors", "mimi.decoder_transformer.transformer.layers.0.gating.linear1.weight": "model.safetensors", "mimi.decoder_transformer.transformer.layers.0.gating.linear2.biases": "model.safetensors", "mimi.decoder_transformer.transformer.layers.0.gating.linear2.scales": "model.safetensors", "mimi.decoder_transformer.transformer.layers.0.gating.linear2.weight": "model.safetensors", "mimi.decoder_transformer.transformer.layers.0.layer_scale_1.scale": "model.safetensors", "mimi.decoder_transformer.transformer.layers.0.layer_scale_2.scale": "model.safetensors", "mimi.decoder_transformer.transformer.layers.0.norm1.bias": "model.safetensors", "mimi.decoder_transformer.transformer.layers.0.norm1.weight": "model.safetensors", "mimi.decoder_transformer.transformer.layers.0.norm2.bias": "model.safetensors", "mimi.decoder_transformer.transformer.layers.0.norm2.weight": "model.safetensors", "mimi.decoder_transformer.transformer.layers.0.self_attn.in_proj.biases": "model.safetensors", "mimi.decoder_transformer.transformer.layers.0.self_attn.in_proj.scales": "model.safetensors", "mimi.decoder_transformer.transformer.layers.0.self_attn.in_proj.weight": "model.safetensors", "mimi.decoder_transformer.transformer.layers.0.self_attn.out_proj.biases": "model.safetensors", "mimi.decoder_transformer.transformer.layers.0.self_attn.out_proj.scales": "model.safetensors", "mimi.decoder_transformer.transformer.layers.0.self_attn.out_proj.weight": "model.safetensors", "mimi.decoder_transformer.transformer.layers.1.gating.linear1.biases": "model.safetensors", "mimi.decoder_transformer.transformer.layers.1.gating.linear1.scales": "model.safetensors", "mimi.decoder_transformer.transformer.layers.1.gating.linear1.weight": "model.safetensors", "mimi.decoder_transformer.transformer.layers.1.gating.linear2.biases": "model.safetensors", "mimi.decoder_transformer.transformer.layers.1.gating.linear2.scales": "model.safetensors", "mimi.decoder_transformer.transformer.layers.1.gating.linear2.weight": "model.safetensors", "mimi.decoder_transformer.transformer.layers.1.layer_scale_1.scale": "model.safetensors", "mimi.decoder_transformer.transformer.layers.1.layer_scale_2.scale": "model.safetensors", "mimi.decoder_transformer.transformer.layers.1.norm1.bias": "model.safetensors", "mimi.decoder_transformer.transformer.layers.1.norm1.weight": "model.safetensors", "mimi.decoder_transformer.transformer.layers.1.norm2.bias": "model.safetensors", "mimi.decoder_transformer.transformer.layers.1.norm2.weight": "model.safetensors", "mimi.decoder_transformer.transformer.layers.1.self_attn.in_proj.biases": "model.safetensors", "mimi.decoder_transformer.transformer.layers.1.self_attn.in_proj.scales": "model.safetensors", "mimi.decoder_transformer.transformer.layers.1.self_attn.in_proj.weight": "model.safetensors", "mimi.decoder_transformer.transformer.layers.1.self_attn.out_proj.biases": "model.safetensors", "mimi.decoder_transformer.transformer.layers.1.self_attn.out_proj.scales": "model.safetensors", "mimi.decoder_transformer.transformer.layers.1.self_attn.out_proj.weight": "model.safetensors", "mimi.downsample.conv.conv.conv.weight": "model.safetensors", "mimi.encoder.final_conv1d.conv.conv.bias": "model.safetensors", "mimi.encoder.final_conv1d.conv.conv.weight": "model.safetensors", "mimi.encoder.init_conv1d.conv.conv.bias": "model.safetensors", "mimi.encoder.init_conv1d.conv.conv.weight": "model.safetensors", "mimi.encoder.layers.0.downsample.conv.conv.bias": "model.safetensors", "mimi.encoder.layers.0.downsample.conv.conv.weight": "model.safetensors", "mimi.encoder.layers.0.residuals.0.block.0.conv.conv.bias": "model.safetensors", "mimi.encoder.layers.0.residuals.0.block.0.conv.conv.weight": "model.safetensors", "mimi.encoder.layers.0.residuals.0.block.1.conv.conv.bias": "model.safetensors", "mimi.encoder.layers.0.residuals.0.block.1.conv.conv.weight": "model.safetensors", "mimi.encoder.layers.1.downsample.conv.conv.bias": "model.safetensors", "mimi.encoder.layers.1.downsample.conv.conv.weight": "model.safetensors", "mimi.encoder.layers.1.residuals.0.block.0.conv.conv.bias": "model.safetensors", "mimi.encoder.layers.1.residuals.0.block.0.conv.conv.weight": "model.safetensors", "mimi.encoder.layers.1.residuals.0.block.1.conv.conv.bias": "model.safetensors", "mimi.encoder.layers.1.residuals.0.block.1.conv.conv.weight": "model.safetensors", "mimi.encoder.layers.2.downsample.conv.conv.bias": "model.safetensors", "mimi.encoder.layers.2.downsample.conv.conv.weight": "model.safetensors", "mimi.encoder.layers.2.residuals.0.block.0.conv.conv.bias": "model.safetensors", "mimi.encoder.layers.2.residuals.0.block.0.conv.conv.weight": "model.safetensors", "mimi.encoder.layers.2.residuals.0.block.1.conv.conv.bias": "model.safetensors", "mimi.encoder.layers.2.residuals.0.block.1.conv.conv.weight": "model.safetensors", "mimi.encoder_transformer.transformer.layers.0.gating.linear1.biases": "model.safetensors", "mimi.encoder_transformer.transformer.layers.0.gating.linear1.scales": "model.safetensors", "mimi.encoder_transformer.transformer.layers.0.gating.linear1.weight": "model.safetensors", "mimi.encoder_transformer.transformer.layers.0.gating.linear2.biases": "model.safetensors", "mimi.encoder_transformer.transformer.layers.0.gating.linear2.scales": "model.safetensors", "mimi.encoder_transformer.transformer.layers.0.gating.linear2.weight": "model.safetensors", "mimi.encoder_transformer.transformer.layers.0.layer_scale_1.scale": "model.safetensors", "mimi.encoder_transformer.transformer.layers.0.layer_scale_2.scale": "model.safetensors", "mimi.encoder_transformer.transformer.layers.0.norm1.bias": "model.safetensors", "mimi.encoder_transformer.transformer.layers.0.norm1.weight": "model.safetensors", "mimi.encoder_transformer.transformer.layers.0.norm2.bias": "model.safetensors", "mimi.encoder_transformer.transformer.layers.0.norm2.weight": "model.safetensors", "mimi.encoder_transformer.transformer.layers.0.self_attn.in_proj.biases": "model.safetensors", "mimi.encoder_transformer.transformer.layers.0.self_attn.in_proj.scales": "model.safetensors", "mimi.encoder_transformer.transformer.layers.0.self_attn.in_proj.weight": "model.safetensors", "mimi.encoder_transformer.transformer.layers.0.self_attn.out_proj.biases": "model.safetensors", "mimi.encoder_transformer.transformer.layers.0.self_attn.out_proj.scales": "model.safetensors", "mimi.encoder_transformer.transformer.layers.0.self_attn.out_proj.weight": "model.safetensors", "mimi.encoder_transformer.transformer.layers.1.gating.linear1.biases": "model.safetensors", "mimi.encoder_transformer.transformer.layers.1.gating.linear1.scales": "model.safetensors", "mimi.encoder_transformer.transformer.layers.1.gating.linear1.weight": "model.safetensors", "mimi.encoder_transformer.transformer.layers.1.gating.linear2.biases": "model.safetensors", "mimi.encoder_transformer.transformer.layers.1.gating.linear2.scales": "model.safetensors", "mimi.encoder_transformer.transformer.layers.1.gating.linear2.weight": "model.safetensors", "mimi.encoder_transformer.transformer.layers.1.layer_scale_1.scale": "model.safetensors", "mimi.encoder_transformer.transformer.layers.1.layer_scale_2.scale": "model.safetensors", "mimi.encoder_transformer.transformer.layers.1.norm1.bias": "model.safetensors", "mimi.encoder_transformer.transformer.layers.1.norm1.weight": "model.safetensors", "mimi.encoder_transformer.transformer.layers.1.norm2.bias": "model.safetensors", "mimi.encoder_transformer.transformer.layers.1.norm2.weight": "model.safetensors", "mimi.encoder_transformer.transformer.layers.1.self_attn.in_proj.biases": "model.safetensors", "mimi.encoder_transformer.transformer.layers.1.self_attn.in_proj.scales": "model.safetensors", "mimi.encoder_transformer.transformer.layers.1.self_attn.in_proj.weight": "model.safetensors", "mimi.encoder_transformer.transformer.layers.1.self_attn.out_proj.biases": "model.safetensors", "mimi.encoder_transformer.transformer.layers.1.self_attn.out_proj.scales": "model.safetensors", "mimi.encoder_transformer.transformer.layers.1.self_attn.out_proj.weight": "model.safetensors", "mimi.quantizer.output_proj.weight": "model.safetensors", "mimi.upsample.convtr.convtr.convtr.weight": "model.safetensors", "speaker_proj_weight": "model.safetensors" } }