{ "created_at": "2026-08-04T23:06:46.507787+00:00", "base_model": "fastino/gliner2-privacy-filter-PII-multi", "resolved_base_model": "/workspace/models/gliner2-pii-base", "config": { "model_name": "fastino/gliner2-privacy-filter-PII-multi", "train_file": "data/processed/train.jsonl", "validation_file": "data/processed/validation.jsonl", "require_negative_queries": true, "training": { "output_dir": "outputs/sota", "experiment_name": "gliner2-polish-pii-sota-v2", "num_epochs": 2, "batch_size": 32, "eval_batch_size": 64, "gradient_accumulation_steps": 1, "encoder_lr": 1e-06, "task_lr": 2e-05, "weight_decay": 0.01, "scheduler_type": "cosine", "warmup_ratio": 0.05, "max_grad_norm": 1.0, "max_len": 512, "fp16": false, "bf16": true, "eval_strategy": "epoch", "save_total_limit": 2, "save_best": true, "metric_for_best": "eval_loss", "greater_is_better": false, "logging_steps": 25, "early_stopping": true, "early_stopping_patience": 1, "num_workers": 8, "pin_memory": true, "seed": 42, "deterministic": false, "use_lora": false } }, "training_data": { "records": 79975, "positive_mentions": { "person": 62380, "sensitive_date": 41100, "pesel": 32980, "phone_number": 24741, "address": 24613, "organization": 16566, "email": 16420, "iban": 16401, "nip": 9144, "health_condition": 8300, "city": 5696, "country": 2841, "username": 2000, "account_id": 2000, "postal_code": 2000, "street_address": 2000, "date_of_birth": 2000, "state_or_region": 1485, "ip_address": 1000, "url": 1000, "bank_account": 1000, "payment_card": 1000, "id_card_number": 1000, "license_plate": 1000, "krs": 1000, "regon": 1000, "drivers_license_number": 1000, "passport_number": 1000 }, "negative_queries": { "state_or_region": 13175, "country": 13107, "city": 12789, "organization": 11856, "phone_number": 10462, "account_id": 8531, "payment_card": 8528, "date_of_birth": 8527, "passport_number": 8519, "regon": 8474, "ip_address": 8468, "bank_account": 8465, "license_plate": 8435, "id_card_number": 8357, "drivers_license_number": 8316, "username": 8310, "postal_code": 8305, "krs": 8203, "person": 7256, "url": 7213, "street_address": 7106, "health_condition": 6496, "nip": 6048, "email": 5433, "iban": 5426, "pesel": 4851, "address": 4460, "sensitive_date": 3892, "national_id_number": 1613 }, "pure_negative_records": 9180 }, "dataset_sources": { "synthetic_train": { "id": "klusai/ds-kp-general-pl-50k", "split": "train", "revision": "00a2b5abde18b65598ca1a5e7af5979e720580a4", "license": "CC-BY-4.0" }, "human_ner": { "id": "clarin-pl/kpwr-ner", "train_split": "train", "test_split": "test", "revision": "a20247f8787670ef987fa61e1c9139227c186105", "license": "CC-BY-3.0" }, "polish_realskeleton_eval": { "id": "klusai/europriv-bench", "config": "pl-realskeleton-v1", "split": "test", "revision": "58faa4fa572cd8064818a6e1f8ca6e361b959c00", "license": "CC-BY-4.0", "status": "dev; pending native-speaker review and IAA according to dataset card" }, "cee_eval": { "id": "flowxai/cee-pii-bench", "file": "ceepii_bench_v0.2.jsonl", "revision": "84ee883574624e6fde2f81932da187f59b3253e4", "license": "Apache-2.0" }, "project_structured_augmentation": { "id": "generated-by-src/pl_pii/augmentation.py", "version": "v2", "license": "Apache-2.0" }, "project_contextual_negatives": { "id": "generated-by-src/pl_pii/augmentation.py", "version": "v2", "license": "Apache-2.0", "note": "Independent templates; frozen hard_negatives_pl.jsonl is never used for training." } }, "taxonomy": { "person": "pełne imię i nazwisko albo nazwa konkretnej osoby", "organization": "firma, urząd, instytucja lub inna nazwana organizacja", "first_name": "imię osoby", "last_name": "nazwisko osoby", "date_of_birth": "data urodzenia osoby", "email": "adres poczty elektronicznej", "phone_number": "numer telefonu", "address": "pełny adres pocztowy osoby lub podmiotu", "street_address": "ulica wraz z numerem domu lub lokalu", "city": "miasto lub miejscowość", "state_or_region": "województwo, powiat, gmina lub region", "postal_code": "polski lub zagraniczny kod pocztowy", "country": "państwo", "pesel": "polski numer PESEL", "nip": "polski numer identyfikacji podatkowej NIP", "regon": "polski numer statystyczny REGON", "krs": "numer podmiotu w Krajowym Rejestrze Sądowym", "id_card_number": "seria i numer polskiego dowodu osobistego", "passport_number": "numer paszportu", "drivers_license_number": "numer prawa jazdy", "national_id_number": "inny państwowy numer identyfikacyjny", "iban": "numer rachunku w formacie IBAN", "bank_account": "numer rachunku bankowego bez jednoznacznego formatu IBAN", "payment_card": "numer karty płatniczej", "account_id": "identyfikator konta, klienta, polisy, umowy lub sprawy", "ip_address": "adres IPv4 lub IPv6", "username": "nazwa użytkownika lub uchwyt konta", "url": "adres strony lub profilu internetowego", "license_plate": "numer rejestracyjny pojazdu", "health_condition": "choroba, diagnoza lub inna informacja o zdrowiu", "sensitive_date": "data powiązana z osobą, transakcją lub dokumentem" }, "trainer_result": { "total_steps": 4998, "total_epochs": 2, "total_time_seconds": 1414.6116650104523, "samples_per_second": 113.06000364334496, "best_metric": 24.426227224642275, "train_metrics_history": [ { "loss": 99.04931030273437, "classification_loss": 0.0, "structure_loss": 93.63141632080078, "count_loss": 0.0, "learning_rate": 1.0040160642570281e-07, "epoch": 0.009603841536614645, "step": 25, "samples_seen": 800, "throughput": 74.62681568025457 }, { "loss": 64.97382843017579, "classification_loss": 0.0, "structure_loss": 66.02812194824219, "count_loss": 0.0, "learning_rate": 2.0080321285140563e-07, "epoch": 0.0196078431372549, "step": 50, "samples_seen": 1600, "throughput": 92.82374415965413 }, { "loss": 44.070018463134765, "classification_loss": 0.0, "structure_loss": 42.799644470214844, "count_loss": 0.0, "learning_rate": 3.0120481927710845e-07, "epoch": 0.029611844737895156, "step": 75, "samples_seen": 2400, "throughput": 98.30354784207975 }, { "loss": 30.930209045410155, "classification_loss": 0.0, "structure_loss": 31.350421905517578, "count_loss": 0.0, "learning_rate": 4.0160642570281125e-07, "epoch": 0.03961584633853541, "step": 100, "samples_seen": 3200, "throughput": 103.19330562269646 }, { "loss": 24.96437442779541, "classification_loss": 0.0, "structure_loss": 12.4683837890625, "count_loss": 0.0, "learning_rate": 5.020080321285141e-07, "epoch": 0.04961984793917567, "step": 125, "samples_seen": 4000, "throughput": 106.97213967947206 }, { "loss": 25.582296981811524, "classification_loss": 0.0, "structure_loss": 18.098430633544922, "count_loss": 0.0, "learning_rate": 6.024096385542169e-07, "epoch": 0.05962384953981593, "step": 150, "samples_seen": 4800, "throughput": 108.75234959531238 }, { "loss": 20.733098487854004, "classification_loss": 0.0, "structure_loss": 14.19676399230957, "count_loss": 0.0, "learning_rate": 7.028112449799196e-07, "epoch": 0.06962785114045618, "step": 175, "samples_seen": 5600, "throughput": 109.93767621551197 }, { "loss": 16.99376205444336, "classification_loss": 0.0, "structure_loss": 8.712682723999023, "count_loss": 0.0, "learning_rate": 8.032128514056225e-07, "epoch": 0.07963185274109644, "step": 200, "samples_seen": 6400, "throughput": 111.2305122244336 }, { "loss": 16.849667263031005, "classification_loss": 0.0, "structure_loss": 13.397004127502441, "count_loss": 0.0, "learning_rate": 9.036144578313253e-07, "epoch": 0.0896358543417367, "step": 225, "samples_seen": 7200, "throughput": 112.51036433983369 }, { "loss": 15.211669397354125, "classification_loss": 0.0, "structure_loss": 1.195124864578247, "count_loss": 0.0, "learning_rate": 9.999998905954461e-07, "epoch": 0.09963985594237695, "step": 250, "samples_seen": 8000, "throughput": 113.51176652173123 }, { "loss": 14.910255842208862, "classification_loss": 0.0, "structure_loss": 7.4534220695495605, "count_loss": 0.0, "learning_rate": 9.999260443421814e-07, "epoch": 0.10964385754301721, "step": 275, "samples_seen": 8800, "throughput": 114.29297505715992 }, { "loss": 10.635792865753174, "classification_loss": 0.0, "structure_loss": 13.590654373168945, "count_loss": 0.0, "learning_rate": 9.997154657359785e-07, "epoch": 0.11964785914365746, "step": 300, "samples_seen": 9600, "throughput": 114.88746279226388 }, { "loss": 12.733585557937623, "classification_loss": 0.0, "structure_loss": 16.169078826904297, "count_loss": 0.0, "learning_rate": 9.993682123711732e-07, "epoch": 0.12965186074429771, "step": 325, "samples_seen": 10400, "throughput": 115.03859047453639 }, { "loss": 10.061355848312378, "classification_loss": 0.0, "structure_loss": 1.5736509561538696, "count_loss": 0.0, "learning_rate": 9.988843792233525e-07, "epoch": 0.139655862344938, "step": 350, "samples_seen": 11200, "throughput": 115.57651420479505 }, { "loss": 14.043990325927734, "classification_loss": 0.0, "structure_loss": 6.840167045593262, "count_loss": 0.0, "learning_rate": 9.982640986233794e-07, "epoch": 0.14965986394557823, "step": 375, "samples_seen": 12000, "throughput": 116.10389225727042 }, { "loss": 11.137088117599488, "classification_loss": 0.0, "structure_loss": 25.211833953857422, "count_loss": 0.0, "learning_rate": 9.975075402211986e-07, "epoch": 0.15966386554621848, "step": 400, "samples_seen": 12800, "throughput": 116.4741085950832 }, { "loss": 11.900955266952515, "classification_loss": 0.0, "structure_loss": 18.351381301879883, "count_loss": 0.0, "learning_rate": 9.966149109394373e-07, "epoch": 0.16966786714685875, "step": 425, "samples_seen": 13600, "throughput": 116.8600413654694 }, { "loss": 10.38374192237854, "classification_loss": 0.0, "structure_loss": 13.540153503417969, "count_loss": 0.0, "learning_rate": 9.955864549168103e-07, "epoch": 0.179671868747499, "step": 450, "samples_seen": 14400, "throughput": 117.20167608044974 }, { "loss": 11.54733696937561, "classification_loss": 0.0, "structure_loss": 37.600955963134766, "count_loss": 0.0, "learning_rate": 9.944224534413471e-07, "epoch": 0.18967587034813926, "step": 475, "samples_seen": 15200, "throughput": 117.41363166304863 }, { "loss": 12.878256187438964, "classification_loss": 0.0, "structure_loss": 1.7767024040222168, "count_loss": 0.0, "learning_rate": 9.93123224873458e-07, "epoch": 0.1996798719487795, "step": 500, "samples_seen": 16000, "throughput": 117.57326941626161 }, { "loss": 12.404712638854981, "classification_loss": 0.0, "structure_loss": 0.9207334518432617, "count_loss": 0.0, "learning_rate": 9.91689124558861e-07, "epoch": 0.20968387354941978, "step": 525, "samples_seen": 16800, "throughput": 117.92641560979052 }, { "loss": 12.592862186431885, "classification_loss": 0.0, "structure_loss": 5.176852226257324, "count_loss": 0.0, "learning_rate": 9.901205447313922e-07, "epoch": 0.21968787515006002, "step": 550, "samples_seen": 17600, "throughput": 118.06389357078814 }, { "loss": 9.714210193157196, "classification_loss": 0.0, "structure_loss": 6.10215950012207, "count_loss": 0.0, "learning_rate": 9.884179144057291e-07, "epoch": 0.22969187675070027, "step": 575, "samples_seen": 18400, "throughput": 118.15989866914225 }, { "loss": 10.28147933959961, "classification_loss": 0.0, "structure_loss": 5.6401824951171875, "count_loss": 0.0, "learning_rate": 9.865816992600523e-07, "epoch": 0.23969587835134054, "step": 600, "samples_seen": 19200, "throughput": 117.89185746410641 }, { "loss": 14.013380606174469, "classification_loss": 0.0, "structure_loss": 0.7078776955604553, "count_loss": 0.0, "learning_rate": 9.84612401508679e-07, "epoch": 0.24969987995198079, "step": 625, "samples_seen": 20000, "throughput": 118.07617926736738 }, { "loss": 11.437678546905518, "classification_loss": 0.0, "structure_loss": 3.47279691696167, "count_loss": 0.0, "learning_rate": 9.825105597647073e-07, "epoch": 0.25970388155262103, "step": 650, "samples_seen": 20800, "throughput": 118.20890031356247 }, { "loss": 9.81547406077385, "classification_loss": 0.0, "structure_loss": 7.785722255706787, "count_loss": 0.0, "learning_rate": 9.802767488927e-07, "epoch": 0.26970788315326133, "step": 675, "samples_seen": 21600, "throughput": 118.46414178263225 }, { "loss": 8.334551153182984, "classification_loss": 0.0, "structure_loss": 12.68344497680664, "count_loss": 0.0, "learning_rate": 9.77911579851458e-07, "epoch": 0.2797118847539016, "step": 700, "samples_seen": 22400, "throughput": 118.6948052595724 }, { "loss": 9.948170335292817, "classification_loss": 0.0, "structure_loss": 10.81518268585205, "count_loss": 0.0, "learning_rate": 9.754156995269194e-07, "epoch": 0.2897158863545418, "step": 725, "samples_seen": 23200, "throughput": 118.83399571914867 }, { "loss": 10.262408761978149, "classification_loss": 0.0, "structure_loss": 12.122699737548828, "count_loss": 0.0, "learning_rate": 9.727897905552325e-07, "epoch": 0.29971988795518206, "step": 750, "samples_seen": 24000, "throughput": 118.94903636710484 }, { "loss": 9.16137779712677, "classification_loss": 0.0, "structure_loss": 1.201209545135498, "count_loss": 0.0, "learning_rate": 9.70034571136052e-07, "epoch": 0.3097238895558223, "step": 775, "samples_seen": 24800, "throughput": 119.02843384020855 }, { "loss": 7.7620487833023075, "classification_loss": 0.0, "structure_loss": 3.669886589050293, "count_loss": 0.0, "learning_rate": 9.67150794836107e-07, "epoch": 0.3197278911564626, "step": 800, "samples_seen": 25600, "throughput": 119.03098601307144 }, { "loss": 13.92262485742569, "classification_loss": 0.0, "structure_loss": 5.447021961212158, "count_loss": 0.0, "learning_rate": 9.641392503830966e-07, "epoch": 0.32973189275710285, "step": 825, "samples_seen": 26400, "throughput": 119.11175876420141 }, { "loss": 11.622924909591674, "classification_loss": 0.0, "structure_loss": 7.624882698059082, "count_loss": 0.0, "learning_rate": 9.610007614499696e-07, "epoch": 0.3397358943577431, "step": 850, "samples_seen": 27200, "throughput": 119.26467906950073 }, { "loss": 8.326000628471375, "classification_loss": 0.0, "structure_loss": 6.874894618988037, "count_loss": 0.0, "learning_rate": 9.57736186429645e-07, "epoch": 0.34973989595838334, "step": 875, "samples_seen": 28000, "throughput": 119.15416927016393 }, { "loss": 10.578895367980003, "classification_loss": 0.0, "structure_loss": 20.06766128540039, "count_loss": 0.0, "learning_rate": 9.543464182002375e-07, "epoch": 0.3597438975590236, "step": 900, "samples_seen": 28800, "throughput": 119.22260029597567 }, { "loss": 7.39383844614029, "classification_loss": 0.0, "structure_loss": 1.5392993688583374, "count_loss": 0.0, "learning_rate": 9.508323838808502e-07, "epoch": 0.3697478991596639, "step": 925, "samples_seen": 29600, "throughput": 119.29014246148633 }, { "loss": 8.50196311712265, "classification_loss": 0.0, "structure_loss": 8.139094352722168, "count_loss": 0.0, "learning_rate": 9.471950445780032e-07, "epoch": 0.37975190076030413, "step": 950, "samples_seen": 30400, "throughput": 119.36233091897887 }, { "loss": 8.74600182890892, "classification_loss": 0.0, "structure_loss": 0.6056110262870789, "count_loss": 0.0, "learning_rate": 9.43435395122766e-07, "epoch": 0.3897559023609444, "step": 975, "samples_seen": 31200, "throughput": 119.48125115703785 }, { "loss": 9.760897154808044, "classification_loss": 0.0, "structure_loss": 4.32525634765625, "count_loss": 0.0, "learning_rate": 9.395544637986656e-07, "epoch": 0.3997599039615846, "step": 1000, "samples_seen": 32000, "throughput": 119.59786855418572 }, { "loss": 8.712153223752976, "classification_loss": 0.0, "structure_loss": 9.245855331420898, "count_loss": 0.0, "learning_rate": 9.355533120604466e-07, "epoch": 0.4097639055622249, "step": 1025, "samples_seen": 32800, "throughput": 119.68300930515208 }, { "loss": 9.123019242286682, "classification_loss": 0.0, "structure_loss": 16.350570678710938, "count_loss": 0.0, "learning_rate": 9.314330342437567e-07, "epoch": 0.41976790716286516, "step": 1050, "samples_seen": 33600, "throughput": 119.77897743877926 }, { "loss": 8.316779203414917, "classification_loss": 0.0, "structure_loss": 7.702871799468994, "count_loss": 0.0, "learning_rate": 9.27194757265841e-07, "epoch": 0.4297719087635054, "step": 1075, "samples_seen": 34400, "throughput": 119.8856722347503 }, { "loss": 8.488542495369911, "classification_loss": 0.0, "structure_loss": 20.336898803710938, "count_loss": 0.0, "learning_rate": 9.228396403173239e-07, "epoch": 0.43977591036414565, "step": 1100, "samples_seen": 35200, "throughput": 119.96276672695959 }, { "loss": 8.100739126205445, "classification_loss": 0.0, "structure_loss": 2.2083840370178223, "count_loss": 0.0, "learning_rate": 9.183688745451653e-07, "epoch": 0.4497799119647859, "step": 1125, "samples_seen": 36000, "throughput": 119.94824706460943 }, { "loss": 8.55866054534912, "classification_loss": 0.0, "structure_loss": 8.241480827331543, "count_loss": 0.0, "learning_rate": 9.137836827268744e-07, "epoch": 0.4597839135654262, "step": 1150, "samples_seen": 36800, "throughput": 119.99537788448457 }, { "loss": 7.043005896806717, "classification_loss": 0.0, "structure_loss": 21.49624252319336, "count_loss": 0.0, "learning_rate": 9.090853189360749e-07, "epoch": 0.46978791516606644, "step": 1175, "samples_seen": 37600, "throughput": 120.07733644806338 }, { "loss": 6.9454214972257615, "classification_loss": 0.0, "structure_loss": 1.567102074623108, "count_loss": 0.0, "learning_rate": 9.04275068199509e-07, "epoch": 0.4797919167667067, "step": 1200, "samples_seen": 38400, "throughput": 120.12856041062281 }, { "loss": 6.946920309066773, "classification_loss": 0.0, "structure_loss": 14.833473205566406, "count_loss": 0.0, "learning_rate": 8.993542461455761e-07, "epoch": 0.4897959183673469, "step": 1225, "samples_seen": 39200, "throughput": 120.21366426285694 }, { "loss": 8.980769230425357, "classification_loss": 0.0, "structure_loss": 3.9791007041931152, "count_loss": 0.0, "learning_rate": 8.943241986445011e-07, "epoch": 0.49979991996798717, "step": 1250, "samples_seen": 40000, "throughput": 120.3021994506212 }, { "loss": 7.692282853722572, "classification_loss": 0.0, "structure_loss": 0.14559580385684967, "count_loss": 0.0, "learning_rate": 8.891863014402323e-07, "epoch": 0.5098039215686274, "step": 1275, "samples_seen": 40800, "throughput": 120.39915587196803 }, { "loss": 9.572303340435028, "classification_loss": 0.0, "structure_loss": 30.794593811035156, "count_loss": 0.0, "learning_rate": 8.839419597741689e-07, "epoch": 0.5198079231692677, "step": 1300, "samples_seen": 41600, "throughput": 120.46717844692563 }, { "loss": 8.310638714134694, "classification_loss": 0.0, "structure_loss": 4.628296852111816, "count_loss": 0.0, "learning_rate": 8.785926080008194e-07, "epoch": 0.529811924769908, "step": 1325, "samples_seen": 42400, "throughput": 120.46153492340153 }, { "loss": 7.940273861885071, "classification_loss": 0.0, "structure_loss": 3.256073236465454, "count_loss": 0.0, "learning_rate": 8.731397091954984e-07, "epoch": 0.5398159263705482, "step": 1350, "samples_seen": 43200, "throughput": 120.45452283985966 }, { "loss": 8.138656517267227, "classification_loss": 0.0, "structure_loss": 40.89887237548828, "count_loss": 0.0, "learning_rate": 8.675847547541681e-07, "epoch": 0.5498199279711885, "step": 1375, "samples_seen": 44000, "throughput": 120.50680673327369 }, { "loss": 9.699006514549255, "classification_loss": 0.0, "structure_loss": 17.299598693847656, "count_loss": 0.0, "learning_rate": 8.619292639855342e-07, "epoch": 0.5598239295718287, "step": 1400, "samples_seen": 44800, "throughput": 120.36857886574587 }, { "loss": 5.950802283287048, "classification_loss": 0.0, "structure_loss": 1.6475454568862915, "count_loss": 0.0, "learning_rate": 8.561747836955061e-07, "epoch": 0.569827931172469, "step": 1425, "samples_seen": 45600, "throughput": 120.39874195661841 }, { "loss": 7.0815291887521745, "classification_loss": 0.0, "structure_loss": 1.5799254179000854, "count_loss": 0.0, "learning_rate": 8.503228877641386e-07, "epoch": 0.5798319327731093, "step": 1450, "samples_seen": 46400, "throughput": 120.28760021535034 }, { "loss": 9.931254105567932, "classification_loss": 0.0, "structure_loss": 0.9176030158996582, "count_loss": 0.0, "learning_rate": 8.44375176715167e-07, "epoch": 0.5898359343737495, "step": 1475, "samples_seen": 47200, "throughput": 120.34635486021548 }, { "loss": 7.594077644348144, "classification_loss": 0.0, "structure_loss": 22.018707275390625, "count_loss": 0.0, "learning_rate": 8.383332772782557e-07, "epoch": 0.5998399359743898, "step": 1500, "samples_seen": 48000, "throughput": 120.38821430725184 }, { "loss": 8.296588959693908, "classification_loss": 0.0, "structure_loss": 12.32800579071045, "count_loss": 0.0, "learning_rate": 8.321988419440791e-07, "epoch": 0.60984393757503, "step": 1525, "samples_seen": 48800, "throughput": 120.43267820771133 }, { "loss": 8.543200163841247, "classification_loss": 0.0, "structure_loss": 6.612170219421387, "count_loss": 0.0, "learning_rate": 8.259735485123571e-07, "epoch": 0.6198479391756703, "step": 1550, "samples_seen": 49600, "throughput": 120.48209480358226 }, { "loss": 6.509791485071182, "classification_loss": 0.0, "structure_loss": 8.01965045928955, "count_loss": 0.0, "learning_rate": 8.196590996329684e-07, "epoch": 0.6298519407763106, "step": 1575, "samples_seen": 50400, "throughput": 120.51233650903778 }, { "loss": 6.7389576733112335, "classification_loss": 0.0, "structure_loss": 9.892376899719238, "count_loss": 0.0, "learning_rate": 8.132572223402663e-07, "epoch": 0.6398559423769508, "step": 1600, "samples_seen": 51200, "throughput": 120.53818784869574 }, { "loss": 6.470398366451263, "classification_loss": 0.0, "structure_loss": 5.099959850311279, "count_loss": 0.0, "learning_rate": 8.067696675807266e-07, "epoch": 0.6498599439775911, "step": 1625, "samples_seen": 52000, "throughput": 120.52853577849193 }, { "loss": 8.96691639482975, "classification_loss": 0.0, "structure_loss": 3.479485034942627, "count_loss": 0.0, "learning_rate": 8.00198209734054e-07, "epoch": 0.6598639455782312, "step": 1650, "samples_seen": 52800, "throughput": 120.3935382878811 }, { "loss": 7.475189960598946, "classification_loss": 0.0, "structure_loss": 0.8365634083747864, "count_loss": 0.0, "learning_rate": 7.935446461278814e-07, "epoch": 0.6698679471788715, "step": 1675, "samples_seen": 53600, "throughput": 120.43079408453742 }, { "loss": 10.039394336938859, "classification_loss": 0.0, "structure_loss": 0.20020633935928345, "count_loss": 0.0, "learning_rate": 7.868107965461896e-07, "epoch": 0.6798719487795118, "step": 1700, "samples_seen": 54400, "throughput": 120.43577906648213 }, { "loss": 4.354646364748478, "classification_loss": 0.0, "structure_loss": 10.524239540100098, "count_loss": 0.0, "learning_rate": 7.799985027315886e-07, "epoch": 0.689875950380152, "step": 1725, "samples_seen": 55200, "throughput": 120.46607352309205 }, { "loss": 4.140304425358773, "classification_loss": 0.0, "structure_loss": 2.8044941425323486, "count_loss": 0.0, "learning_rate": 7.731096278815908e-07, "epoch": 0.6998799519807923, "step": 1750, "samples_seen": 56000, "throughput": 120.46165427108416 }, { "loss": 6.777013623118401, "classification_loss": 0.0, "structure_loss": 0.5911509394645691, "count_loss": 0.0, "learning_rate": 7.661460561390165e-07, "epoch": 0.7098839535814325, "step": 1775, "samples_seen": 56800, "throughput": 120.48552654873895 }, { "loss": 5.894899523854256, "classification_loss": 0.0, "structure_loss": 5.2809624671936035, "count_loss": 0.0, "learning_rate": 7.591096920766725e-07, "epoch": 0.7198879551820728, "step": 1800, "samples_seen": 57600, "throughput": 120.47853840668272 }, { "loss": 8.673274445533753, "classification_loss": 0.0, "structure_loss": 5.897564888000488, "count_loss": 0.0, "learning_rate": 7.5200246017644e-07, "epoch": 0.7298919567827131, "step": 1825, "samples_seen": 58400, "throughput": 120.40908418397126 }, { "loss": 8.79144304394722, "classification_loss": 0.0, "structure_loss": 1.9147647619247437, "count_loss": 0.0, "learning_rate": 7.448263043029197e-07, "epoch": 0.7398959583833533, "step": 1850, "samples_seen": 59200, "throughput": 120.37939440217367 }, { "loss": 5.9299666213989255, "classification_loss": 0.0, "structure_loss": 5.970696926116943, "count_loss": 0.0, "learning_rate": 7.375831871717749e-07, "epoch": 0.7498999599839936, "step": 1875, "samples_seen": 60000, "throughput": 120.40037105428226 }, { "loss": 5.397893999814987, "classification_loss": 0.0, "structure_loss": 12.298643112182617, "count_loss": 0.0, "learning_rate": 7.302750898129179e-07, "epoch": 0.7599039615846338, "step": 1900, "samples_seen": 60800, "throughput": 120.44246257544697 }, { "loss": 7.616344484686851, "classification_loss": 0.0, "structure_loss": 20.101993560791016, "count_loss": 0.0, "learning_rate": 7.229040110286895e-07, "epoch": 0.7699079631852741, "step": 1925, "samples_seen": 61600, "throughput": 120.31548261411136 }, { "loss": 6.6778002096712585, "classification_loss": 0.0, "structure_loss": 3.6434950828552246, "count_loss": 0.0, "learning_rate": 7.154719668471742e-07, "epoch": 0.7799119647859144, "step": 1950, "samples_seen": 62400, "throughput": 120.25302321594188 }, { "loss": 6.992779169082642, "classification_loss": 0.0, "structure_loss": 13.020526885986328, "count_loss": 0.0, "learning_rate": 7.079809899708083e-07, "epoch": 0.7899159663865546, "step": 1975, "samples_seen": 63200, "throughput": 120.27472737372466 }, { "loss": 12.876803722381592, "classification_loss": 0.0, "structure_loss": 4.32088565826416, "count_loss": 0.0, "learning_rate": 7.004331292204235e-07, "epoch": 0.7999199679871949, "step": 2000, "samples_seen": 64000, "throughput": 120.24565449142993 }, { "loss": 6.17560591518879, "classification_loss": 0.0, "structure_loss": 2.8572444915771484, "count_loss": 0.0, "learning_rate": 6.928304489748848e-07, "epoch": 0.8099239695878351, "step": 2025, "samples_seen": 64800, "throughput": 120.24855811045548 }, { "loss": 7.217613797038793, "classification_loss": 0.0, "structure_loss": 14.731121063232422, "count_loss": 0.0, "learning_rate": 6.851750286064726e-07, "epoch": 0.8199279711884754, "step": 2050, "samples_seen": 65600, "throughput": 120.27284710261891 }, { "loss": 8.049188077747822, "classification_loss": 0.0, "structure_loss": 2.0474934577941895, "count_loss": 0.0, "learning_rate": 6.774689619121621e-07, "epoch": 0.8299319727891157, "step": 2075, "samples_seen": 66400, "throughput": 120.28055584119065 }, { "loss": 5.81945149064064, "classification_loss": 0.0, "structure_loss": 2.4519805908203125, "count_loss": 0.0, "learning_rate": 6.697143565409607e-07, "epoch": 0.8399359743897559, "step": 2100, "samples_seen": 67200, "throughput": 120.30772680011204 }, { "loss": 7.189643049240113, "classification_loss": 0.0, "structure_loss": 3.0753955841064453, "count_loss": 0.0, "learning_rate": 6.619133334174539e-07, "epoch": 0.8499399759903962, "step": 2125, "samples_seen": 68000, "throughput": 120.35381419632287 }, { "loss": 8.21572742164135, "classification_loss": 0.0, "structure_loss": 4.644731521606445, "count_loss": 0.0, "learning_rate": 6.540680261617226e-07, "epoch": 0.8599439775910365, "step": 2150, "samples_seen": 68800, "throughput": 120.3637341140648 }, { "loss": 5.6418577837944035, "classification_loss": 0.0, "structure_loss": 1.743297815322876, "count_loss": 0.0, "learning_rate": 6.461805805057858e-07, "epoch": 0.8699479791916767, "step": 2175, "samples_seen": 69600, "throughput": 120.3731856940065 }, { "loss": 6.979270329475403, "classification_loss": 0.0, "structure_loss": 3.0269265174865723, "count_loss": 0.0, "learning_rate": 6.382531537067328e-07, "epoch": 0.879951980792317, "step": 2200, "samples_seen": 70400, "throughput": 120.30494147988387 }, { "loss": 8.363030426502227, "classification_loss": 0.0, "structure_loss": 13.405003547668457, "count_loss": 0.0, "learning_rate": 6.302879139567017e-07, "epoch": 0.8899559823929571, "step": 2225, "samples_seen": 71200, "throughput": 120.3177456254781 }, { "loss": 8.395818560123443, "classification_loss": 0.0, "structure_loss": 4.904322624206543, "count_loss": 0.0, "learning_rate": 6.222870397898676e-07, "epoch": 0.8999599839935974, "step": 2250, "samples_seen": 72000, "throughput": 120.33617440788107 }, { "loss": 7.224377961158752, "classification_loss": 0.0, "structure_loss": 14.904130935668945, "count_loss": 0.0, "learning_rate": 6.14252719486603e-07, "epoch": 0.9099639855942377, "step": 2275, "samples_seen": 72800, "throughput": 120.35434342507156 }, { "loss": 5.239644635245204, "classification_loss": 0.0, "structure_loss": 0.5755757093429565, "count_loss": 0.0, "learning_rate": 6.061871504749709e-07, "epoch": 0.9199679871948779, "step": 2300, "samples_seen": 73600, "throughput": 120.36301587915379 }, { "loss": 7.521065675467253, "classification_loss": 0.0, "structure_loss": 6.594547748565674, "count_loss": 0.0, "learning_rate": 5.980925387297172e-07, "epoch": 0.9299719887955182, "step": 2325, "samples_seen": 74400, "throughput": 120.35752305806528 }, { "loss": 7.112370202541351, "classification_loss": 0.0, "structure_loss": 2.928374767303467, "count_loss": 0.0, "learning_rate": 5.89971098168926e-07, "epoch": 0.9399759903961584, "step": 2350, "samples_seen": 75200, "throughput": 120.34552035322737 }, { "loss": 5.465680583119393, "classification_loss": 0.0, "structure_loss": 0.10396753251552582, "count_loss": 0.0, "learning_rate": 5.818250500485002e-07, "epoch": 0.9499799919967987, "step": 2375, "samples_seen": 76000, "throughput": 120.35117416628567 }, { "loss": 7.971647808551788, "classification_loss": 0.0, "structure_loss": 12.424342155456543, "count_loss": 0.0, "learning_rate": 5.736566223546373e-07, "epoch": 0.959983993597439, "step": 2400, "samples_seen": 76800, "throughput": 120.38192534321227 }, { "loss": 6.279013748168945, "classification_loss": 0.0, "structure_loss": 5.462818622589111, "count_loss": 0.0, "learning_rate": 5.654680491944639e-07, "epoch": 0.9699879951980792, "step": 2425, "samples_seen": 77600, "throughput": 120.42267762453695 }, { "loss": 7.329232487678528, "classification_loss": 0.0, "structure_loss": 4.469842910766602, "count_loss": 0.0, "learning_rate": 5.572615701849957e-07, "epoch": 0.9799919967987195, "step": 2450, "samples_seen": 78400, "throughput": 120.36748565535477 }, { "loss": 5.409736155644059, "classification_loss": 0.0, "structure_loss": 2.7723350524902344, "count_loss": 0.0, "learning_rate": 5.490394298405901e-07, "epoch": 0.9899959983993597, "step": 2475, "samples_seen": 79200, "throughput": 120.4076148966211 }, { "loss": 7.381327478662133, "classification_loss": 0.0, "structure_loss": 5.2080793380737305, "count_loss": 0.0, "learning_rate": 5.408038769590609e-07, "epoch": 1.0, "step": 2500, "samples_seen": 80000, "throughput": 115.25303309333617 }, { "loss": 7.067755463123322, "classification_loss": 0.0, "structure_loss": 13.097148895263672, "count_loss": 0.0, "learning_rate": 5.325571640066198e-07, "epoch": 1.0100040016006402, "step": 2525, "samples_seen": 80800, "throughput": 115.30654127279881 }, { "loss": 7.197874571084976, "classification_loss": 0.0, "structure_loss": 1.9652886390686035, "count_loss": 0.0, "learning_rate": 5.243015465018151e-07, "epoch": 1.0200080032012806, "step": 2550, "samples_seen": 81600, "throughput": 115.35930169063184 }, { "loss": 5.450983689446002, "classification_loss": 0.0, "structure_loss": 2.6210343837738037, "count_loss": 0.0, "learning_rate": 5.160392823986371e-07, "epoch": 1.0300120048019208, "step": 2575, "samples_seen": 82400, "throughput": 115.390321024912 }, { "loss": 7.510146309137344, "classification_loss": 0.0, "structure_loss": 2.195521593093872, "count_loss": 0.0, "learning_rate": 5.077726314689542e-07, "epoch": 1.040016006402561, "step": 2600, "samples_seen": 83200, "throughput": 115.43799949905494 }, { "loss": 6.296725056171417, "classification_loss": 0.0, "structure_loss": 9.916637420654297, "count_loss": 0.0, "learning_rate": 4.995038546844547e-07, "epoch": 1.0500200080032012, "step": 2625, "samples_seen": 84000, "throughput": 115.41662662916004 }, { "loss": 5.482753418534994, "classification_loss": 0.0, "structure_loss": 6.13421106338501, "count_loss": 0.0, "learning_rate": 4.912352135982594e-07, "epoch": 1.0600240096038416, "step": 2650, "samples_seen": 84800, "throughput": 115.45919674014421 }, { "loss": 4.377273374348879, "classification_loss": 0.0, "structure_loss": 4.643762588500977, "count_loss": 0.0, "learning_rate": 4.829689697263744e-07, "epoch": 1.0700280112044818, "step": 2675, "samples_seen": 85600, "throughput": 115.50691708616958 }, { "loss": 7.479796994626522, "classification_loss": 0.0, "structure_loss": 3.52524733543396, "count_loss": 0.0, "learning_rate": 4.7470738392915616e-07, "epoch": 1.080032012805122, "step": 2700, "samples_seen": 86400, "throughput": 115.54758569368343 }, { "loss": 6.6115838821977375, "classification_loss": 0.0, "structure_loss": 20.561983108520508, "count_loss": 0.0, "learning_rate": 4.664527157929528e-07, "epoch": 1.0900360144057624, "step": 2725, "samples_seen": 87200, "throughput": 115.60255433313175 }, { "loss": 6.11866726398468, "classification_loss": 0.0, "structure_loss": 12.989026069641113, "count_loss": 0.0, "learning_rate": 4.582072230120969e-07, "epoch": 1.1000400160064026, "step": 2750, "samples_seen": 88000, "throughput": 115.64237913782846 }, { "loss": 7.562336605340242, "classification_loss": 0.0, "structure_loss": 22.30143928527832, "count_loss": 0.0, "learning_rate": 4.499731607714141e-07, "epoch": 1.1100440176070427, "step": 2775, "samples_seen": 88800, "throughput": 115.69075386364715 }, { "loss": 5.822371518611908, "classification_loss": 0.0, "structure_loss": 0.457958459854126, "count_loss": 0.0, "learning_rate": 4.417527811294178e-07, "epoch": 1.1200480192076832, "step": 2800, "samples_seen": 89600, "throughput": 115.73247648806759 }, { "loss": 5.847555767297745, "classification_loss": 0.0, "structure_loss": 8.550634384155273, "count_loss": 0.0, "learning_rate": 4.33548332402361e-07, "epoch": 1.1300520208083233, "step": 2825, "samples_seen": 90400, "throughput": 115.80262467156587 }, { "loss": 6.552901059389114, "classification_loss": 0.0, "structure_loss": 15.977275848388672, "count_loss": 0.0, "learning_rate": 4.253620585493079e-07, "epoch": 1.1400560224089635, "step": 2850, "samples_seen": 91200, "throughput": 115.85634514262236 }, { "loss": 5.121231662482023, "classification_loss": 0.0, "structure_loss": 1.497225046157837, "count_loss": 0.0, "learning_rate": 4.1719619855840216e-07, "epoch": 1.150060024009604, "step": 2875, "samples_seen": 92000, "throughput": 115.89503595398439 }, { "loss": 7.246889696121216, "classification_loss": 0.0, "structure_loss": 4.369898796081543, "count_loss": 0.0, "learning_rate": 4.0905298583449014e-07, "epoch": 1.1600640256102441, "step": 2900, "samples_seen": 92800, "throughput": 115.87130280626519 }, { "loss": 6.552699720859527, "classification_loss": 0.0, "structure_loss": 8.655736923217773, "count_loss": 0.0, "learning_rate": 4.0093464758827375e-07, "epoch": 1.1700680272108843, "step": 2925, "samples_seen": 93600, "throughput": 115.92944221474926 }, { "loss": 6.1213423877954485, "classification_loss": 0.0, "structure_loss": 1.7430897951126099, "count_loss": 0.0, "learning_rate": 3.9284340422715754e-07, "epoch": 1.1800720288115247, "step": 2950, "samples_seen": 94400, "throughput": 115.97410257137791 }, { "loss": 3.681735370978713, "classification_loss": 0.0, "structure_loss": 2.5154480934143066, "count_loss": 0.0, "learning_rate": 3.8478146874795414e-07, "epoch": 1.190076030412165, "step": 2975, "samples_seen": 95200, "throughput": 116.03337508965049 }, { "loss": 5.696872165873646, "classification_loss": 0.0, "structure_loss": 0.016803063452243805, "count_loss": 0.0, "learning_rate": 3.7675104613162004e-07, "epoch": 1.200080032012805, "step": 3000, "samples_seen": 96000, "throughput": 116.0815614884609 }, { "loss": 8.384422822594642, "classification_loss": 0.0, "structure_loss": 6.0098185539245605, "count_loss": 0.0, "learning_rate": 3.6875433274018107e-07, "epoch": 1.2100840336134453, "step": 3025, "samples_seen": 96800, "throughput": 116.1024450752887 }, { "loss": 6.483229663968086, "classification_loss": 0.0, "structure_loss": 4.955495357513428, "count_loss": 0.0, "learning_rate": 3.6079351571601557e-07, "epoch": 1.2200880352140857, "step": 3050, "samples_seen": 97600, "throughput": 116.15503577272099 }, { "loss": 8.588153747022153, "classification_loss": 0.0, "structure_loss": 0.9956717491149902, "count_loss": 0.0, "learning_rate": 3.528707723836608e-07, "epoch": 1.230092036814726, "step": 3075, "samples_seen": 98400, "throughput": 116.19706268907728 }, { "loss": 5.008555377572775, "classification_loss": 0.0, "structure_loss": 2.9865760803222656, "count_loss": 0.0, "learning_rate": 3.449882696543022e-07, "epoch": 1.240096038415366, "step": 3100, "samples_seen": 99200, "throughput": 116.23641487720386 }, { "loss": 6.274345535933971, "classification_loss": 0.0, "structure_loss": 4.76536750793457, "count_loss": 0.0, "learning_rate": 3.3714816343311323e-07, "epoch": 1.2501000400160063, "step": 3125, "samples_seen": 100000, "throughput": 116.28644038601405 }, { "loss": 5.185575053095818, "classification_loss": 0.0, "structure_loss": 1.704534649848938, "count_loss": 0.0, "learning_rate": 3.2935259802960356e-07, "epoch": 1.2601040416166467, "step": 3150, "samples_seen": 100800, "throughput": 116.35612584912343 }, { "loss": 4.523853889107704, "classification_loss": 0.0, "structure_loss": 5.04381799697876, "count_loss": 0.0, "learning_rate": 3.216037055711388e-07, "epoch": 1.2701080432172869, "step": 3175, "samples_seen": 101600, "throughput": 116.356517463462 }, { "loss": 6.119333234876394, "classification_loss": 0.0, "structure_loss": 6.375429630279541, "count_loss": 0.0, "learning_rate": 3.139036054197938e-07, "epoch": 1.280112044817927, "step": 3200, "samples_seen": 102400, "throughput": 116.40956174681315 }, { "loss": 4.301225325502455, "classification_loss": 0.0, "structure_loss": 14.213972091674805, "count_loss": 0.0, "learning_rate": 3.062544035926951e-07, "epoch": 1.2901160464185675, "step": 3225, "samples_seen": 103200, "throughput": 116.42267269143672 }, { "loss": 4.79283535450697, "classification_loss": 0.0, "structure_loss": 4.64979362487793, "count_loss": 0.0, "learning_rate": 2.9865819218601564e-07, "epoch": 1.3001200480192077, "step": 3250, "samples_seen": 104000, "throughput": 116.44528696539899 }, { "loss": 7.466769599914551, "classification_loss": 0.0, "structure_loss": 26.281068801879883, "count_loss": 0.0, "learning_rate": 2.9111704880277454e-07, "epoch": 1.3101240496198479, "step": 3275, "samples_seen": 104800, "throughput": 116.44675679972164 }, { "loss": 6.749424895197153, "classification_loss": 0.0, "structure_loss": 13.302038192749023, "count_loss": 0.0, "learning_rate": 2.8363303598460174e-07, "epoch": 1.3201280512204883, "step": 3300, "samples_seen": 105600, "throughput": 116.50137857576892 }, { "loss": 7.121686450839043, "classification_loss": 0.0, "structure_loss": 13.37693977355957, "count_loss": 0.0, "learning_rate": 2.7620820064762423e-07, "epoch": 1.3301320528211285, "step": 3325, "samples_seen": 106400, "throughput": 116.54459694109613 }, { "loss": 5.483743262588978, "classification_loss": 0.0, "structure_loss": 5.036625385284424, "count_loss": 0.0, "learning_rate": 2.68844573522621e-07, "epoch": 1.3401360544217686, "step": 3350, "samples_seen": 107200, "throughput": 116.5825020046446 }, { "loss": 4.922785555124283, "classification_loss": 0.0, "structure_loss": 6.03078031539917, "count_loss": 0.0, "learning_rate": 2.615441685996101e-07, "epoch": 1.350140056022409, "step": 3375, "samples_seen": 108000, "throughput": 116.61801540834864 }, { "loss": 10.308587160110473, "classification_loss": 0.0, "structure_loss": 4.938443183898926, "count_loss": 0.0, "learning_rate": 2.543089825770109e-07, "epoch": 1.3601440576230492, "step": 3400, "samples_seen": 108800, "throughput": 116.64828631622547 }, { "loss": 7.7507626557350155, "classification_loss": 0.0, "structure_loss": 17.238086700439453, "count_loss": 0.0, "learning_rate": 2.4714099431553685e-07, "epoch": 1.3701480592236894, "step": 3425, "samples_seen": 109600, "throughput": 116.63353248913963 }, { "loss": 7.0959153990447525, "classification_loss": 0.0, "structure_loss": 6.110723495483398, "count_loss": 0.0, "learning_rate": 2.4004216429696735e-07, "epoch": 1.3801520608243298, "step": 3450, "samples_seen": 110400, "throughput": 116.67574020583295 }, { "loss": 6.335880955159664, "classification_loss": 0.0, "structure_loss": 1.8073030710220337, "count_loss": 0.0, "learning_rate": 2.3301443408794448e-07, "epoch": 1.39015606242497, "step": 3475, "samples_seen": 111200, "throughput": 116.72191924787654 }, { "loss": 4.1429378002882, "classification_loss": 0.0, "structure_loss": 1.2728129625320435, "count_loss": 0.0, "learning_rate": 2.2605972580894678e-07, "epoch": 1.4001600640256102, "step": 3500, "samples_seen": 112000, "throughput": 116.77078434717936 }, { "loss": 5.386964270845056, "classification_loss": 0.0, "structure_loss": 0.19500409066677094, "count_loss": 0.0, "learning_rate": 2.1917994160857761e-07, "epoch": 1.4101640656262506, "step": 3525, "samples_seen": 112800, "throughput": 116.80366784343316 }, { "loss": 8.67481882572174, "classification_loss": 0.0, "structure_loss": 0.5958187580108643, "count_loss": 0.0, "learning_rate": 2.1237696314331744e-07, "epoch": 1.4201680672268908, "step": 3550, "samples_seen": 113600, "throughput": 116.84617680989646 }, { "loss": 5.6229641375690695, "classification_loss": 0.0, "structure_loss": 2.4720396995544434, "count_loss": 0.0, "learning_rate": 2.0565265106288328e-07, "epoch": 1.430172068827531, "step": 3575, "samples_seen": 114400, "throughput": 116.88574261905525 }, { "loss": 5.28811331525445, "classification_loss": 0.0, "structure_loss": 5.041225910186768, "count_loss": 0.0, "learning_rate": 1.990088445013286e-07, "epoch": 1.4401760704281712, "step": 3600, "samples_seen": 115200, "throughput": 116.9197487353635 }, { "loss": 5.191645332686603, "classification_loss": 0.0, "structure_loss": 0.1500621885061264, "count_loss": 0.0, "learning_rate": 1.9244736057403276e-07, "epoch": 1.4501800720288116, "step": 3625, "samples_seen": 116000, "throughput": 116.94082724453298 }, { "loss": 6.2020716343075035, "classification_loss": 0.0, "structure_loss": 9.816466331481934, "count_loss": 0.0, "learning_rate": 1.8596999388070967e-07, "epoch": 1.4601840736294518, "step": 3650, "samples_seen": 116800, "throughput": 116.97703782725526 }, { "loss": 4.153355816602707, "classification_loss": 0.0, "structure_loss": 1.6705769300460815, "count_loss": 0.0, "learning_rate": 1.7957851601457568e-07, "epoch": 1.470188075230092, "step": 3675, "samples_seen": 117600, "throughput": 117.0034553428547 }, { "loss": 6.748252404928207, "classification_loss": 0.0, "structure_loss": 9.044058799743652, "count_loss": 0.0, "learning_rate": 1.7327467507780975e-07, "epoch": 1.4801920768307322, "step": 3700, "samples_seen": 118400, "throughput": 116.98404728235575 }, { "loss": 6.548597960961051, "classification_loss": 0.0, "structure_loss": 6.34812593460083, "count_loss": 0.0, "learning_rate": 1.670601952034379e-07, "epoch": 1.4901960784313726, "step": 3725, "samples_seen": 119200, "throughput": 117.01652412759167 }, { "loss": 7.718031783439219, "classification_loss": 0.0, "structure_loss": 2.3841545581817627, "count_loss": 0.0, "learning_rate": 1.609367760837753e-07, "epoch": 1.5002000800320128, "step": 3750, "samples_seen": 120000, "throughput": 117.04461506989627 }, { "loss": 7.953970726430416, "classification_loss": 0.0, "structure_loss": 0.4784854054450989, "count_loss": 0.0, "learning_rate": 1.549060925055504e-07, "epoch": 1.510204081632653, "step": 3775, "samples_seen": 120800, "throughput": 117.06918110950768 }, { "loss": 4.091673249006272, "classification_loss": 0.0, "structure_loss": 0.5163557529449463, "count_loss": 0.0, "learning_rate": 1.4896979389184221e-07, "epoch": 1.5202080832332934, "step": 3800, "samples_seen": 121600, "throughput": 117.09624523338587 }, { "loss": 5.306579557545483, "classification_loss": 0.0, "structure_loss": 7.333562850952148, "count_loss": 0.0, "learning_rate": 1.431295038509553e-07, "epoch": 1.5302120848339336, "step": 3825, "samples_seen": 122400, "throughput": 117.14051401813188 }, { "loss": 4.3503397542983295, "classification_loss": 0.0, "structure_loss": 5.1910400390625, "count_loss": 0.0, "learning_rate": 1.3738681973235394e-07, "epoch": 1.5402160864345738, "step": 3850, "samples_seen": 123200, "throughput": 117.17173059546974 }, { "loss": 5.046948902457952, "classification_loss": 0.0, "structure_loss": 17.477210998535156, "count_loss": 0.0, "learning_rate": 1.31743312189779e-07, "epoch": 1.5502200880352142, "step": 3875, "samples_seen": 124000, "throughput": 117.19378902335008 }, { "loss": 7.012878070995211, "classification_loss": 0.0, "structure_loss": 20.76140594482422, "count_loss": 0.0, "learning_rate": 1.262005247516662e-07, "epoch": 1.5602240896358543, "step": 3900, "samples_seen": 124800, "throughput": 117.22731129012236 }, { "loss": 5.39517169162631, "classification_loss": 0.0, "structure_loss": 0.40023794770240784, "count_loss": 0.0, "learning_rate": 1.2075997339898265e-07, "epoch": 1.5702280912364945, "step": 3925, "samples_seen": 125600, "throughput": 117.253310621989 }, { "loss": 7.958102140426636, "classification_loss": 0.0, "structure_loss": 2.1934316158294678, "count_loss": 0.0, "learning_rate": 1.1542314615059878e-07, "epoch": 1.580232092837135, "step": 3950, "samples_seen": 126400, "throughput": 117.2416839430036 }, { "loss": 8.562177613377571, "classification_loss": 0.0, "structure_loss": 3.367286443710327, "count_loss": 0.0, "learning_rate": 1.1019150265630689e-07, "epoch": 1.5902360944377751, "step": 3975, "samples_seen": 127200, "throughput": 117.26040387670143 }, { "loss": 6.926742394361645, "classification_loss": 0.0, "structure_loss": 6.458062648773193, "count_loss": 0.0, "learning_rate": 1.0506647379759986e-07, "epoch": 1.6002400960384153, "step": 4000, "samples_seen": 128000, "throughput": 117.27407001751101 }, { "loss": 5.2798626905307176, "classification_loss": 0.0, "structure_loss": 1.867978572845459, "count_loss": 0.0, "learning_rate": 1.000494612963182e-07, "epoch": 1.6102440976390557, "step": 4025, "samples_seen": 128800, "throughput": 117.31826814986583 }, { "loss": 7.838844245672226, "classification_loss": 0.0, "structure_loss": 12.928021430969238, "count_loss": 0.0, "learning_rate": 9.514183733127018e-08, "epoch": 1.620248099239696, "step": 4050, "samples_seen": 129600, "throughput": 117.3432406212885 }, { "loss": 4.676729964539408, "classification_loss": 0.0, "structure_loss": 17.23797607421875, "count_loss": 0.0, "learning_rate": 9.034494416293575e-08, "epoch": 1.6302521008403361, "step": 4075, "samples_seen": 130400, "throughput": 117.36863785115695 }, { "loss": 7.528232505321503, "classification_loss": 0.0, "structure_loss": 8.93016242980957, "count_loss": 0.0, "learning_rate": 8.566009376635014e-08, "epoch": 1.6402561024409765, "step": 4100, "samples_seen": 131200, "throughput": 117.38570200318708 }, { "loss": 4.7078500360250475, "classification_loss": 0.0, "structure_loss": 0.9807890057563782, "count_loss": 0.0, "learning_rate": 8.108856747227244e-08, "epoch": 1.6502601040416165, "step": 4125, "samples_seen": 132000, "throughput": 117.42218322627016 }, { "loss": 5.8399445220083, "classification_loss": 0.0, "structure_loss": 2.796839714050293, "count_loss": 0.0, "learning_rate": 7.663161561673504e-08, "epoch": 1.660264105642257, "step": 4150, "samples_seen": 132800, "throughput": 117.45994646988528 }, { "loss": 7.813393564410507, "classification_loss": 0.0, "structure_loss": 1.4968748092651367, "count_loss": 0.0, "learning_rate": 7.229045719906984e-08, "epoch": 1.6702681072428973, "step": 4175, "samples_seen": 133600, "throughput": 117.49135216492088 }, { "loss": 5.346969854533672, "classification_loss": 0.0, "structure_loss": 0.0509672611951828, "count_loss": 0.0, "learning_rate": 6.806627954850635e-08, "epoch": 1.6802721088435373, "step": 4200, "samples_seen": 134400, "throughput": 117.45869989238484 }, { "loss": 7.971506252288818, "classification_loss": 0.0, "structure_loss": 2.545427083969116, "count_loss": 0.0, "learning_rate": 6.396023799943012e-08, "epoch": 1.6902761104441777, "step": 4225, "samples_seen": 135200, "throughput": 117.47469325003436 }, { "loss": 8.417529141902923, "classification_loss": 0.0, "structure_loss": 30.150789260864258, "count_loss": 0.0, "learning_rate": 5.997345557539362e-08, "epoch": 1.7002801120448179, "step": 4250, "samples_seen": 136000, "throughput": 117.49406033613882 }, { "loss": 10.217099289894104, "classification_loss": 0.0, "structure_loss": 9.088652610778809, "count_loss": 0.0, "learning_rate": 5.610702268196338e-08, "epoch": 1.710284113645458, "step": 4275, "samples_seen": 136800, "throughput": 117.50381480266236 }, { "loss": 9.27821324288845, "classification_loss": 0.0, "structure_loss": 4.306550025939941, "count_loss": 0.0, "learning_rate": 5.2361996808487794e-08, "epoch": 1.7202881152460985, "step": 4300, "samples_seen": 137600, "throughput": 117.54116406372536 }, { "loss": 8.638549534678459, "classification_loss": 0.0, "structure_loss": 4.444990158081055, "count_loss": 0.0, "learning_rate": 4.8739402238869074e-08, "epoch": 1.7302921168467387, "step": 4325, "samples_seen": 138400, "throughput": 117.55567881831733 }, { "loss": 7.800692800879478, "classification_loss": 0.0, "structure_loss": 26.31658935546875, "count_loss": 0.0, "learning_rate": 4.524022977141606e-08, "epoch": 1.7402961184473789, "step": 4350, "samples_seen": 139200, "throughput": 117.58294518837246 }, { "loss": 5.153361746892333, "classification_loss": 0.0, "structure_loss": 5.36966609954834, "count_loss": 0.0, "learning_rate": 4.186543644785556e-08, "epoch": 1.7503001200480193, "step": 4375, "samples_seen": 140000, "throughput": 117.61815048095872 }, { "loss": 7.200507343709469, "classification_loss": 0.0, "structure_loss": 2.032229423522949, "count_loss": 0.0, "learning_rate": 3.861594529157702e-08, "epoch": 1.7603041216486595, "step": 4400, "samples_seen": 140800, "throughput": 117.64620001386511 }, { "loss": 5.646530331969261, "classification_loss": 0.0, "structure_loss": 9.144591331481934, "count_loss": 0.0, "learning_rate": 3.5492645055180016e-08, "epoch": 1.7703081232492996, "step": 4425, "samples_seen": 141600, "throughput": 117.69274705936783 }, { "loss": 4.1788239325582985, "classification_loss": 0.0, "structure_loss": 0.9507667422294617, "count_loss": 0.0, "learning_rate": 3.24963899773969e-08, "epoch": 1.78031212484994, "step": 4450, "samples_seen": 142400, "throughput": 117.72346707592058 }, { "loss": 5.159318681973964, "classification_loss": 0.0, "structure_loss": 5.187628269195557, "count_loss": 0.0, "learning_rate": 2.9627999549453053e-08, "epoch": 1.7903161264505802, "step": 4475, "samples_seen": 143200, "throughput": 117.69569561885207 }, { "loss": 4.603484847992658, "classification_loss": 0.0, "structure_loss": 3.207559108734131, "count_loss": 0.0, "learning_rate": 2.6888258290932552e-08, "epoch": 1.8003201280512204, "step": 4500, "samples_seen": 144000, "throughput": 117.72202990513104 }, { "loss": 5.8734498000144955, "classification_loss": 0.0, "structure_loss": 1.2838051319122314, "count_loss": 0.0, "learning_rate": 2.4277915535207916e-08, "epoch": 1.8103241296518608, "step": 4525, "samples_seen": 144800, "throughput": 117.75410747209493 }, { "loss": 5.2884864377975465, "classification_loss": 0.0, "structure_loss": 6.6412482261657715, "count_loss": 0.0, "learning_rate": 2.179768522449299e-08, "epoch": 1.820328131252501, "step": 4550, "samples_seen": 145600, "throughput": 117.77262445937258 }, { "loss": 6.099887031614781, "classification_loss": 0.0, "structure_loss": 10.770424842834473, "count_loss": 0.0, "learning_rate": 1.9448245714576762e-08, "epoch": 1.8303321328531412, "step": 4575, "samples_seen": 146400, "throughput": 117.79258957992909 }, { "loss": 6.945089138746262, "classification_loss": 0.0, "structure_loss": 13.309601783752441, "count_loss": 0.0, "learning_rate": 1.723023958928921e-08, "epoch": 1.8403361344537816, "step": 4600, "samples_seen": 147200, "throughput": 117.81029931815735 }, { "loss": 3.933501681610942, "classification_loss": 0.0, "structure_loss": 3.947570562362671, "count_loss": 0.0, "learning_rate": 1.514427348475139e-08, "epoch": 1.8503401360544216, "step": 4625, "samples_seen": 148000, "throughput": 117.83317211633783 }, { "loss": 5.6902808170020585, "classification_loss": 0.0, "structure_loss": 0.037246838212013245, "count_loss": 0.0, "learning_rate": 1.3190917923457278e-08, "epoch": 1.860344137655062, "step": 4650, "samples_seen": 148800, "throughput": 117.87656862343535 }, { "loss": 5.842685925960541, "classification_loss": 0.0, "structure_loss": 0.37119942903518677, "count_loss": 0.0, "learning_rate": 1.137070715823285e-08, "epoch": 1.8703481392557024, "step": 4675, "samples_seen": 149600, "throughput": 117.90025239234211 }, { "loss": 5.141752853989601, "classification_loss": 0.0, "structure_loss": 4.884376525878906, "count_loss": 0.0, "learning_rate": 9.684139026115533e-09, "epoch": 1.8803521408563424, "step": 4700, "samples_seen": 150400, "throughput": 117.9021500071645 }, { "loss": 6.901966539621353, "classification_loss": 0.0, "structure_loss": 4.126835823059082, "count_loss": 0.0, "learning_rate": 8.131674812192679e-09, "epoch": 1.8903561424569828, "step": 4725, "samples_seen": 151200, "throughput": 117.87422348210596 }, { "loss": 4.705660388320684, "classification_loss": 0.0, "structure_loss": 5.178854942321777, "count_loss": 0.0, "learning_rate": 6.7137391234382e-09, "epoch": 1.9003601440576232, "step": 4750, "samples_seen": 152000, "throughput": 117.89534309054923 }, { "loss": 4.153859798610211, "classification_loss": 0.0, "structure_loss": 2.5284993648529053, "count_loss": 0.0, "learning_rate": 5.430719772580028e-09, "epoch": 1.9103641456582632, "step": 4775, "samples_seen": 152800, "throughput": 117.92168446930631 }, { "loss": 4.57541688144207, "classification_loss": 0.0, "structure_loss": 4.501616477966309, "count_loss": 0.0, "learning_rate": 4.282967672031457e-09, "epoch": 1.9203681472589036, "step": 4800, "samples_seen": 153600, "throughput": 117.95861113270777 }, { "loss": 7.260555210113526, "classification_loss": 0.0, "structure_loss": 0.06216999888420105, "count_loss": 0.0, "learning_rate": 3.2707967379148603e-09, "epoch": 1.9303721488595438, "step": 4825, "samples_seen": 154400, "throughput": 117.98563202919406 }, { "loss": 4.666583783775568, "classification_loss": 0.0, "structure_loss": 0.8759968280792236, "count_loss": 0.0, "learning_rate": 2.3944838042038727e-09, "epoch": 1.940376150460184, "step": 4850, "samples_seen": 155200, "throughput": 118.00630068744734 }, { "loss": 4.230024012178182, "classification_loss": 0.0, "structure_loss": 15.392610549926758, "count_loss": 0.0, "learning_rate": 1.6542685470080642e-09, "epoch": 1.9503801520608244, "step": 4875, "samples_seen": 156000, "throughput": 118.03566363281558 }, { "loss": 4.767931305095553, "classification_loss": 0.0, "structure_loss": 13.46725082397461, "count_loss": 0.0, "learning_rate": 1.0503534190200446e-09, "epoch": 1.9603841536614646, "step": 4900, "samples_seen": 156800, "throughput": 118.06665035499493 }, { "loss": 6.1552965437993405, "classification_loss": 0.0, "structure_loss": 1.2226543426513672, "count_loss": 0.0, "learning_rate": 5.829035941436466e-10, "epoch": 1.9703881552621048, "step": 4925, "samples_seen": 157600, "throughput": 118.08596706671885 }, { "loss": 5.883813387900591, "classification_loss": 0.0, "structure_loss": 0.7433130741119385, "count_loss": 0.0, "learning_rate": 2.520469223183386e-10, "epoch": 1.9803921568627452, "step": 4950, "samples_seen": 158400, "throughput": 118.11229713509262 }, { "loss": 5.890708170905709, "classification_loss": 0.0, "structure_loss": 4.371570587158203, "count_loss": 0.0, "learning_rate": 5.787389455114144e-11, "epoch": 1.9903961584633854, "step": 4975, "samples_seen": 159200, "throughput": 118.13531787299769 } ], "eval_metrics_history": [ { "eval_loss": 27.304477414777885, "eval_classification_loss": 0.0, "eval_structure_loss": 27.304477414777885, "eval_count_loss": 0.0, "step": 2499, "epoch": 0 }, { "eval_loss": 24.426227224642275, "eval_classification_loss": 0.0, "eval_structure_loss": 24.426227224642275, "eval_count_loss": 0.0, "step": 4998, "epoch": 1 } ] }, "torch_version": "2.7.1+cu126", "cuda_available": true, "cuda_device": "NVIDIA A100-SXM4-80GB" }