{ "best_metric": 0.4422070384025574, "best_model_checkpoint": "ckpt/origin/vehicle_appearance/checkpoint-91", "epoch": 4.45771144278607, "eval_steps": 7, "global_step": 112, "is_hyper_param_search": false, "is_local_process_zero": true, "is_world_process_zero": true, "log_history": [ { "epoch": 0.04, "learning_rate": 0.0, "loss": 0.4508, "step": 1 }, { "epoch": 0.08, "learning_rate": 1e-05, "loss": 0.4507, "step": 2 }, { "epoch": 0.12, "learning_rate": 1e-05, "loss": 0.4625, "step": 3 }, { "epoch": 0.16, "learning_rate": 1e-05, "loss": 0.5117, "step": 4 }, { "epoch": 0.2, "learning_rate": 1e-05, "loss": 0.4944, "step": 5 }, { "epoch": 0.24, "learning_rate": 1e-05, "loss": 0.4584, "step": 6 }, { "epoch": 0.28, "learning_rate": 1e-05, "loss": 0.4287, "step": 7 }, { "epoch": 0.28, "eval_loss": 0.48472654819488525, "eval_runtime": 44.1485, "eval_samples_per_second": 1.133, "eval_steps_per_second": 0.566, "step": 7 }, { "epoch": 0.32, "learning_rate": 1e-05, "loss": 0.4324, "step": 8 }, { "epoch": 0.36, "learning_rate": 1e-05, "loss": 0.4542, "step": 9 }, { "epoch": 0.4, "learning_rate": 1e-05, "loss": 0.5006, "step": 10 }, { "epoch": 0.44, "learning_rate": 1e-05, "loss": 0.4067, "step": 11 }, { "epoch": 0.48, "learning_rate": 1e-05, "loss": 0.4518, "step": 12 }, { "epoch": 0.52, "learning_rate": 1e-05, "loss": 0.4061, "step": 13 }, { "epoch": 0.56, "learning_rate": 1e-05, "loss": 0.4353, "step": 14 }, { "epoch": 0.56, "eval_loss": 0.46628907322883606, "eval_runtime": 43.3293, "eval_samples_per_second": 1.154, "eval_steps_per_second": 0.577, "step": 14 }, { "epoch": 0.6, "learning_rate": 1e-05, "loss": 0.3778, "step": 15 }, { "epoch": 0.64, "learning_rate": 1e-05, "loss": 0.4015, "step": 16 }, { "epoch": 0.68, "learning_rate": 1e-05, "loss": 0.3813, "step": 17 }, { "epoch": 0.72, "learning_rate": 1e-05, "loss": 0.4341, "step": 18 }, { "epoch": 0.76, "learning_rate": 1e-05, "loss": 0.4109, "step": 19 }, { "epoch": 0.8, "learning_rate": 1e-05, "loss": 0.4043, "step": 20 }, { "epoch": 0.84, "learning_rate": 1e-05, "loss": 0.4197, "step": 21 }, { "epoch": 0.84, "eval_loss": 0.45521485805511475, "eval_runtime": 43.3276, "eval_samples_per_second": 1.154, "eval_steps_per_second": 0.577, "step": 21 }, { "epoch": 0.88, "learning_rate": 1e-05, "loss": 0.3848, "step": 22 }, { "epoch": 0.92, "learning_rate": 1e-05, "loss": 0.4519, "step": 23 }, { "epoch": 0.96, "learning_rate": 1e-05, "loss": 0.4042, "step": 24 }, { "epoch": 1.0, "learning_rate": 1e-05, "loss": 0.3767, "step": 25 }, { "epoch": 1.03, "learning_rate": 1e-05, "loss": 0.4017, "step": 26 }, { "epoch": 1.07, "learning_rate": 1e-05, "loss": 0.3815, "step": 27 }, { "epoch": 1.11, "learning_rate": 1e-05, "loss": 0.4495, "step": 28 }, { "epoch": 1.11, "eval_loss": 0.4485742151737213, "eval_runtime": 43.3469, "eval_samples_per_second": 1.153, "eval_steps_per_second": 0.577, "step": 28 }, { "epoch": 1.15, "learning_rate": 1e-05, "loss": 0.3649, "step": 29 }, { "epoch": 1.19, "learning_rate": 1e-05, "loss": 0.3705, "step": 30 }, { "epoch": 1.23, "learning_rate": 1e-05, "loss": 0.3521, "step": 31 }, { "epoch": 1.27, "learning_rate": 1e-05, "loss": 0.3636, "step": 32 }, { "epoch": 1.31, "learning_rate": 1e-05, "loss": 0.4246, "step": 33 }, { "epoch": 1.35, "learning_rate": 1e-05, "loss": 0.4214, "step": 34 }, { "epoch": 1.39, "learning_rate": 1e-05, "loss": 0.4064, "step": 35 }, { "epoch": 1.39, "eval_loss": 0.4434570372104645, "eval_runtime": 43.3331, "eval_samples_per_second": 1.154, "eval_steps_per_second": 0.577, "step": 35 }, { "epoch": 1.43, "learning_rate": 1e-05, "loss": 0.3966, "step": 36 }, { "epoch": 1.47, "learning_rate": 1e-05, "loss": 0.3961, "step": 37 }, { "epoch": 1.51, "learning_rate": 1e-05, "loss": 0.3561, "step": 38 }, { "epoch": 1.55, "learning_rate": 1e-05, "loss": 0.4413, "step": 39 }, { "epoch": 1.59, "learning_rate": 1e-05, "loss": 0.4661, "step": 40 }, { "epoch": 1.63, "learning_rate": 1e-05, "loss": 0.3613, "step": 41 }, { "epoch": 1.67, "learning_rate": 1e-05, "loss": 0.3479, "step": 42 }, { "epoch": 1.67, "eval_loss": 0.4422851502895355, "eval_runtime": 43.8605, "eval_samples_per_second": 1.14, "eval_steps_per_second": 0.57, "step": 42 }, { "epoch": 1.71, "learning_rate": 1e-05, "loss": 0.3753, "step": 43 }, { "epoch": 1.75, "learning_rate": 1e-05, "loss": 0.3354, "step": 44 }, { "epoch": 1.79, "learning_rate": 1e-05, "loss": 0.3885, "step": 45 }, { "epoch": 1.83, "learning_rate": 1e-05, "loss": 0.3724, "step": 46 }, { "epoch": 1.87, "learning_rate": 1e-05, "loss": 0.3169, "step": 47 }, { "epoch": 1.91, "learning_rate": 1e-05, "loss": 0.3801, "step": 48 }, { "epoch": 1.95, "learning_rate": 1e-05, "loss": 0.408, "step": 49 }, { "epoch": 1.95, "eval_loss": 0.44175779819488525, "eval_runtime": 43.3292, "eval_samples_per_second": 1.154, "eval_steps_per_second": 0.577, "step": 49 }, { "epoch": 1.99, "learning_rate": 1e-05, "loss": 0.3558, "step": 50 }, { "epoch": 2.03, "learning_rate": 1e-05, "loss": 0.3792, "step": 51 }, { "epoch": 2.07, "learning_rate": 1e-05, "loss": 0.3726, "step": 52 }, { "epoch": 2.11, "learning_rate": 1e-05, "loss": 0.3569, "step": 53 }, { "epoch": 2.15, "learning_rate": 1e-05, "loss": 0.3771, "step": 54 }, { "epoch": 2.19, "learning_rate": 1e-05, "loss": 0.374, "step": 55 }, { "epoch": 2.23, "learning_rate": 1e-05, "loss": 0.3322, "step": 56 }, { "epoch": 2.23, "eval_loss": 0.4400390684604645, "eval_runtime": 43.3391, "eval_samples_per_second": 1.154, "eval_steps_per_second": 0.577, "step": 56 }, { "epoch": 2.27, "learning_rate": 1e-05, "loss": 0.3827, "step": 57 }, { "epoch": 2.31, "learning_rate": 1e-05, "loss": 0.3671, "step": 58 }, { "epoch": 2.35, "learning_rate": 1e-05, "loss": 0.333, "step": 59 }, { "epoch": 2.39, "learning_rate": 1e-05, "loss": 0.3226, "step": 60 }, { "epoch": 2.43, "learning_rate": 1e-05, "loss": 0.4008, "step": 61 }, { "epoch": 2.47, "learning_rate": 1e-05, "loss": 0.37, "step": 62 }, { "epoch": 2.51, "learning_rate": 1e-05, "loss": 0.3586, "step": 63 }, { "epoch": 2.51, "eval_loss": 0.44056642055511475, "eval_runtime": 43.3358, "eval_samples_per_second": 1.154, "eval_steps_per_second": 0.577, "step": 63 }, { "epoch": 2.55, "learning_rate": 1e-05, "loss": 0.3931, "step": 64 }, { "epoch": 2.59, "learning_rate": 1e-05, "loss": 0.3748, "step": 65 }, { "epoch": 2.63, "learning_rate": 1e-05, "loss": 0.373, "step": 66 }, { "epoch": 2.67, "learning_rate": 1e-05, "loss": 0.3354, "step": 67 }, { "epoch": 2.71, "learning_rate": 1e-05, "loss": 0.3618, "step": 68 }, { "epoch": 2.75, "learning_rate": 1e-05, "loss": 0.3696, "step": 69 }, { "epoch": 2.79, "learning_rate": 1e-05, "loss": 0.3688, "step": 70 }, { "epoch": 2.79, "eval_loss": 0.44316405057907104, "eval_runtime": 43.3385, "eval_samples_per_second": 1.154, "eval_steps_per_second": 0.577, "step": 70 }, { "epoch": 2.83, "learning_rate": 1e-05, "loss": 0.3291, "step": 71 }, { "epoch": 2.87, "learning_rate": 1e-05, "loss": 0.3366, "step": 72 }, { "epoch": 2.91, "learning_rate": 1e-05, "loss": 0.366, "step": 73 }, { "epoch": 2.95, "learning_rate": 1e-05, "loss": 0.3573, "step": 74 }, { "epoch": 2.99, "learning_rate": 1e-05, "loss": 0.3402, "step": 75 }, { "epoch": 3.02, "learning_rate": 1e-05, "loss": 0.3664, "step": 76 }, { "epoch": 3.06, "learning_rate": 1e-05, "loss": 0.3148, "step": 77 }, { "epoch": 3.06, "eval_loss": 0.44486328959465027, "eval_runtime": 43.3237, "eval_samples_per_second": 1.154, "eval_steps_per_second": 0.577, "step": 77 }, { "epoch": 3.1, "learning_rate": 1e-05, "loss": 0.377, "step": 78 }, { "epoch": 3.14, "learning_rate": 1e-05, "loss": 0.3814, "step": 79 }, { "epoch": 3.18, "learning_rate": 1e-05, "loss": 0.3661, "step": 80 }, { "epoch": 3.22, "learning_rate": 1e-05, "loss": 0.3774, "step": 81 }, { "epoch": 3.26, "learning_rate": 1e-05, "loss": 0.3836, "step": 82 }, { "epoch": 3.3, "learning_rate": 1e-05, "loss": 0.3663, "step": 83 }, { "epoch": 3.34, "learning_rate": 1e-05, "loss": 0.3776, "step": 84 }, { "epoch": 3.34, "eval_loss": 0.44332030415534973, "eval_runtime": 43.3334, "eval_samples_per_second": 1.154, "eval_steps_per_second": 0.577, "step": 84 }, { "epoch": 3.38, "learning_rate": 1e-05, "loss": 0.3253, "step": 85 }, { "epoch": 3.42, "learning_rate": 1e-05, "loss": 0.2968, "step": 86 }, { "epoch": 3.46, "learning_rate": 1e-05, "loss": 0.3658, "step": 87 }, { "epoch": 3.5, "learning_rate": 1e-05, "loss": 0.3224, "step": 88 }, { "epoch": 3.54, "learning_rate": 1e-05, "loss": 0.3156, "step": 89 }, { "epoch": 3.58, "learning_rate": 1e-05, "loss": 0.3638, "step": 90 }, { "epoch": 3.62, "learning_rate": 1e-05, "loss": 0.3361, "step": 91 }, { "epoch": 3.62, "eval_loss": 0.4422070384025574, "eval_runtime": 43.3274, "eval_samples_per_second": 1.154, "eval_steps_per_second": 0.577, "step": 91 }, { "epoch": 3.66, "learning_rate": 1e-05, "loss": 0.3833, "step": 92 }, { "epoch": 3.7, "learning_rate": 1e-05, "loss": 0.3441, "step": 93 }, { "epoch": 3.74, "learning_rate": 1e-05, "loss": 0.3344, "step": 94 }, { "epoch": 3.78, "learning_rate": 1e-05, "loss": 0.3382, "step": 95 }, { "epoch": 3.82, "learning_rate": 1e-05, "loss": 0.309, "step": 96 }, { "epoch": 3.86, "learning_rate": 1e-05, "loss": 0.3347, "step": 97 }, { "epoch": 3.9, "learning_rate": 1e-05, "loss": 0.3539, "step": 98 }, { "epoch": 3.9, "eval_loss": 0.4428125023841858, "eval_runtime": 43.3264, "eval_samples_per_second": 1.154, "eval_steps_per_second": 0.577, "step": 98 }, { "epoch": 3.94, "learning_rate": 1e-05, "loss": 0.3624, "step": 99 }, { "epoch": 3.98, "learning_rate": 1e-05, "loss": 0.3182, "step": 100 }, { "epoch": 4.02, "learning_rate": 1e-05, "loss": 0.3321, "step": 101 }, { "epoch": 4.06, "learning_rate": 1e-05, "loss": 0.3202, "step": 102 }, { "epoch": 4.1, "learning_rate": 1e-05, "loss": 0.3456, "step": 103 }, { "epoch": 4.14, "learning_rate": 1e-05, "loss": 0.3232, "step": 104 }, { "epoch": 4.18, "learning_rate": 1e-05, "loss": 0.3367, "step": 105 }, { "epoch": 4.18, "eval_loss": 0.4445117115974426, "eval_runtime": 43.4068, "eval_samples_per_second": 1.152, "eval_steps_per_second": 0.576, "step": 105 }, { "epoch": 4.22, "learning_rate": 1e-05, "loss": 0.3253, "step": 106 }, { "epoch": 4.26, "learning_rate": 1e-05, "loss": 0.3254, "step": 107 }, { "epoch": 4.3, "learning_rate": 1e-05, "loss": 0.3183, "step": 108 }, { "epoch": 4.34, "learning_rate": 1e-05, "loss": 0.3864, "step": 109 }, { "epoch": 4.38, "learning_rate": 1e-05, "loss": 0.3214, "step": 110 }, { "epoch": 4.42, "learning_rate": 1e-05, "loss": 0.369, "step": 111 }, { "epoch": 4.46, "learning_rate": 1e-05, "loss": 0.3076, "step": 112 }, { "epoch": 4.46, "eval_loss": 0.4474218785762787, "eval_runtime": 43.3254, "eval_samples_per_second": 1.154, "eval_steps_per_second": 0.577, "step": 112 }, { "epoch": 4.46, "step": 112, "total_flos": 59909461770240.0, "train_loss": 0.3766386849539621, "train_runtime": 5052.2732, "train_samples_per_second": 1.19, "train_steps_per_second": 0.025 } ], "logging_steps": 1.0, "max_steps": 125, "num_train_epochs": 5, "save_steps": 13, "total_flos": 59909461770240.0, "trial_name": null, "trial_params": null }