{ "adapter_path": "/Users/vipul.m/Nova/Training/sft-finetuning/finetuning_multilingual_conversion/models/qwen-7b/mlx-qwen7b", "batch_size": 1, "config": null, "data": "/Users/vipul.m/Nova/Training/sft-finetuning/finetuning_multilingual_conversion/data", "fine_tune_type": "lora", "grad_accumulation_steps": 1, "grad_checkpoint": true, "iters": 1000, "learning_rate": 1e-05, "lora_parameters": { "rank": 64, "alpha": 128, "dropout": 0.1, "scale": 2.0 }, "lr_schedule": null, "mask_prompt": true, "max_seq_length": 512, "model": "Qwen/Qwen2.5-7B-Instruct", "num_layers": -1, "optimizer": "adam", "optimizer_config": { "adam": {}, "adamw": {}, "muon": {}, "sgd": {}, "adafactor": {} }, "project_name": "mewari-finetuning", "report_to": "wandb", "resume_adapter_file": null, "save_every": 100, "seed": 42, "steps_per_eval": 100, "steps_per_report": 10, "test": false, "test_batches": 500, "train": true, "val_batches": 25 }