{ "acoustic_checkpoint_sha256": "e237160c1c2a8afc7a1f44ae323cd0a4d87fdba13826879139d546c4b7bfa472", "vocoder_checkpoint_sha256": "9c007b9b4f58fa65d29b947e8ce09f3564638c0aca1bc60e0d02e182c81892b0", "acoustic_step": 10413, "vocoder_step": 29000, "acoustic_training": { "train_rows": 9255, "dev_rows": 2337, "train_hours": 19.09963390625, "dev_hours": 5.477470677083333, "held_rows": 4502, "source_rows": 16094, "label_field": "label", "split": "parent recording SHA256 disjoint", "epochs": 100, "batch_size": 8, "device": "cuda", "initialization": "upstream warm weights; new Persian embedding and native 100-mel projection", "vocoder": "frozen charactr/vocos-mel-24khz" }, "grain_speech_commit": "8b38829809a6f86a9699371adc487c1efb875b05", "acoustic_dataset": "Reza2kn/nasle-mana-clean-chunked-30s-avasanj", "dataset_revision": "606ecdc1d93a77c6f3a452ab5721774248cdf587", "g2p_source": "Negara v7.1 with overlay", "waveform_training": "50,000 updates; generator selected on 96 dev excerpts; discriminators excluded", "frontend_evaluation": null }