{ "output_dir": "./output", "experiment_name": "gliner2", "num_epochs": 1, "max_steps": -1, "batch_size": 16, "eval_batch_size": 16, "gradient_accumulation_steps": 1, "encoder_lr": 1e-05, "task_lr": 0.0005, "weight_decay": 0.01, "adam_beta1": 0.9, "adam_beta2": 0.999, "adam_epsilon": 1e-08, "max_grad_norm": 1.0, "scheduler_type": "linear", "warmup_ratio": 0.1, "warmup_steps": 0, "num_cycles": 0.5, "fp16": true, "bf16": false, "eval_strategy": "steps", "eval_steps": 5000, "save_total_limit": 10, "save_best": true, "metric_for_best": "eval_loss", "greater_is_better": false, "logging_steps": 50, "logging_first_step": true, "report_to_wandb": false, "wandb_project": null, "wandb_entity": null, "wandb_run_name": null, "wandb_tags": [], "wandb_notes": null, "early_stopping": false, "early_stopping_patience": 3, "early_stopping_threshold": 0.0, "num_workers": 4, "pin_memory": true, "prefetch_factor": 2, "seed": 42, "deterministic": false, "local_rank": -1, "debug": false, "max_train_samples": -1, "max_eval_samples": -1, "validate_data": true, "max_len": null, "use_lora": false, "lora_r": 16, "lora_alpha": 32.0, "lora_dropout": 0.0, "lora_use_dora": false, "lora_target_modules": [ "encoder", "span_rep", "classifier", "count_embed", "count_pred" ], "save_adapter_only": true }