luca0621 commited on
Commit
5d4b90b
·
verified ·
1 Parent(s): 96a3ba5

Seal ability-SFT FAMILY_READY provenance

Browse files
Files changed (1) hide show
  1. appgen_sft_family_ready.json +341 -0
appgen_sft_family_ready.json ADDED
@@ -0,0 +1,341 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "base_model_revision": "0c351dd01ed87e9c1b53cbc748cba10e6187ff3b",
3
+ "dataset_manifest": "/data/appgen/sft_nav_ground_recovery_v2r7/audit_manifest.json",
4
+ "dataset_manifest_sha256": "efc7f7117575fbcc54d95d8a98756376ba2c7ea09346979225f1fd5ae37ce942",
5
+ "family": "qwen3",
6
+ "include_gr_aligner": true,
7
+ "markers": [
8
+ {
9
+ "freeze_mode": "frozen",
10
+ "path": "/data/appgen/training/sft_ability_sweep_v2r7_r2/qwen3/markers/g_f_g800_frozen_lr5e7_1ep_v2.json",
11
+ "repo_id": "luca0621/appgen-qwen3-sft-g800-frozen-lr5e7-1ep-v2",
12
+ "run_id": "g_f_g800_frozen_lr5e7_1ep_v2",
13
+ "sha256": "dcfa30e7a3abf36a061eecfc183387f89fa02c758157e1b4815c0d8902c5b024",
14
+ "value": {
15
+ "aligner_trainable": false,
16
+ "args_sha256": "b47c351dab366c3d78a195d0650f6deb17c28d5c302d0f70503dcfb5571006c1",
17
+ "base_model": "Qwen/Qwen3-VL-8B-Instruct",
18
+ "base_model_path": "/data/.cache/huggingface/hub/models--Qwen--Qwen3-VL-8B-Instruct/snapshots/0c351dd01ed87e9c1b53cbc748cba10e6187ff3b",
19
+ "base_model_revision": "0c351dd01ed87e9c1b53cbc748cba10e6187ff3b",
20
+ "checkpoint": "/data/appgen/training/sft_ability_sweep_v2r7_r2/qwen3/g_f_g800_frozen_lr5e7_1ep_v2/checkpoint-112",
21
+ "config_sha256": "4625ddc397d5e967aac26ddc9c446537b5ac8976d1b3348db92d3a06acaf221d",
22
+ "dataset_manifest_sha256": "efc7f7117575fbcc54d95d8a98756376ba2c7ea09346979225f1fd5ae37ce942",
23
+ "dataset_rows": 3568,
24
+ "dataset_sha256": "6bcbfb12a4d93395e46e1cb4c257bca0fdeac007506f940d40dc40d57483057b",
25
+ "epochs": 1,
26
+ "family": "qwen3",
27
+ "freeze_mode": "frozen",
28
+ "optimizer_steps": 112,
29
+ "parameter_audit": {
30
+ "family": "qwen3",
31
+ "freeze_mode": "frozen",
32
+ "schema_version": "appgen-sft-runtime-parameter-audit-v1",
33
+ "source": "pinned_base_state_dict_expected_trainable_set",
34
+ "state_dict_aligner_tensors": 24,
35
+ "state_dict_tensor_names_sha256": "82c3e0aa71e33af255ce4d5785345d1a0a46ce7372ca443e1a9ca64741cd10d3",
36
+ "state_dict_total_numel": 8767123696,
37
+ "state_dict_total_tensors": 750,
38
+ "state_dict_trainable_names_sha256": "dc15fcaf337a2224e93f04c4d4f7acd1c4e527110f7adda863b60470cc245752",
39
+ "state_dict_trainable_numel": 8190735360,
40
+ "state_dict_trainable_tensors": 399,
41
+ "state_dict_visual_tensors": 351,
42
+ "trainable_names_not_in_state_dict": []
43
+ },
44
+ "parameter_audit_path": "/data/appgen/training/sft_ability_sweep_v2r7_r2/qwen3/parameter_audits/g_f_g800_frozen_lr5e7_1ep_v2.json",
45
+ "parameter_audit_sha256": "55e7ddebf6dc881b532dde0a7bb0baf4946708db8a24c39927dee3606b69d665",
46
+ "schema_version": "appgen-sft-nav-ground-recovery-v2-checkpoint",
47
+ "system_prompt_sha256": "67ff8adb0e78a617f3d0edcf196d4e4cc3239967a8c30619fc5afc14484ee8c0",
48
+ "trainer_state_sha256": "c3febc1d6e1b039a4d81a1f5652b075fdc3181d39de880a68c83797bf71a580f",
49
+ "training_log_sha256": "ee90740f5af5a5511773871bb086e7018a56f225b2560a71a323d8783f2aaee2",
50
+ "validated": true,
51
+ "validated_at": "2026-07-20T15:29:45.446541+00:00",
52
+ "variant": "nav_ground_800",
53
+ "vit_trainable": false,
54
+ "weight_shards": [
55
+ "model-00001-of-00004.safetensors",
56
+ "model-00002-of-00004.safetensors",
57
+ "model-00003-of-00004.safetensors",
58
+ "model-00004-of-00004.safetensors"
59
+ ]
60
+ },
61
+ "variant": "nav_ground_800"
62
+ },
63
+ {
64
+ "freeze_mode": "aligner",
65
+ "path": "/data/appgen/training/sft_ability_sweep_v2r7_r2/qwen3/markers/g_a_g800_aligner_lr5e7_1ep_v2.json",
66
+ "repo_id": "luca0621/appgen-qwen3-sft-g800-aligner-lr5e7-1ep-v2",
67
+ "run_id": "g_a_g800_aligner_lr5e7_1ep_v2",
68
+ "sha256": "23fe7c9a9382b233ecd1a8a8099d65ed56421dd821bd6a4af36874341bf69c9a",
69
+ "value": {
70
+ "aligner_trainable": true,
71
+ "args_sha256": "9ea8c558e8f09a22c57f44b27c9b7880b90957a4e667d6e00a96e98a9634f57d",
72
+ "base_model": "Qwen/Qwen3-VL-8B-Instruct",
73
+ "base_model_path": "/data/.cache/huggingface/hub/models--Qwen--Qwen3-VL-8B-Instruct/snapshots/0c351dd01ed87e9c1b53cbc748cba10e6187ff3b",
74
+ "base_model_revision": "0c351dd01ed87e9c1b53cbc748cba10e6187ff3b",
75
+ "checkpoint": "/data/appgen/training/sft_ability_sweep_v2r7_r2/qwen3/g_a_g800_aligner_lr5e7_1ep_v2/checkpoint-112",
76
+ "config_sha256": "4625ddc397d5e967aac26ddc9c446537b5ac8976d1b3348db92d3a06acaf221d",
77
+ "dataset_manifest_sha256": "efc7f7117575fbcc54d95d8a98756376ba2c7ea09346979225f1fd5ae37ce942",
78
+ "dataset_rows": 3568,
79
+ "dataset_sha256": "6bcbfb12a4d93395e46e1cb4c257bca0fdeac007506f940d40dc40d57483057b",
80
+ "epochs": 1,
81
+ "family": "qwen3",
82
+ "freeze_mode": "aligner",
83
+ "optimizer_steps": 112,
84
+ "parameter_audit": {
85
+ "family": "qwen3",
86
+ "freeze_mode": "aligner",
87
+ "schema_version": "appgen-sft-runtime-parameter-audit-v1",
88
+ "source": "pinned_base_state_dict_expected_trainable_set",
89
+ "state_dict_aligner_tensors": 24,
90
+ "state_dict_tensor_names_sha256": "82c3e0aa71e33af255ce4d5785345d1a0a46ce7372ca443e1a9ca64741cd10d3",
91
+ "state_dict_total_numel": 8767123696,
92
+ "state_dict_total_tensors": 750,
93
+ "state_dict_trainable_names_sha256": "f9850f7bd19e6f14849961af28e2b4b46d4c52a2505d9829cb72dd655f60e6b5",
94
+ "state_dict_trainable_numel": 8351232256,
95
+ "state_dict_trainable_tensors": 423,
96
+ "state_dict_visual_tensors": 351,
97
+ "trainable_names_not_in_state_dict": []
98
+ },
99
+ "parameter_audit_path": "/data/appgen/training/sft_ability_sweep_v2r7_r2/qwen3/parameter_audits/g_a_g800_aligner_lr5e7_1ep_v2.json",
100
+ "parameter_audit_sha256": "a73997cfefb53a13b7f4990a5ea0e209b242566769daa24b083765bd1fbe98f0",
101
+ "schema_version": "appgen-sft-nav-ground-recovery-v2-checkpoint",
102
+ "system_prompt_sha256": "67ff8adb0e78a617f3d0edcf196d4e4cc3239967a8c30619fc5afc14484ee8c0",
103
+ "trainer_state_sha256": "30439e58c026f187857d4d4b6df9c7132e1537ae5f9d1f42dfc8ad36b069d5b9",
104
+ "training_log_sha256": "c19eb474bf92f3ac76a4d24f7676385ad1f420a83041b388ab0dc39bc7a07673",
105
+ "validated": true,
106
+ "validated_at": "2026-07-20T15:50:52.816021+00:00",
107
+ "variant": "nav_ground_800",
108
+ "vit_trainable": false,
109
+ "weight_shards": [
110
+ "model-00001-of-00004.safetensors",
111
+ "model-00002-of-00004.safetensors",
112
+ "model-00003-of-00004.safetensors",
113
+ "model-00004-of-00004.safetensors"
114
+ ]
115
+ },
116
+ "variant": "nav_ground_800"
117
+ },
118
+ {
119
+ "freeze_mode": "full_visual",
120
+ "path": "/data/appgen/training/sft_ability_sweep_v2r7_r2/qwen3/markers/g_v_g800_full_visual_lr5e7_1ep_v2.json",
121
+ "repo_id": "luca0621/appgen-qwen3-sft-g800-full-visual-lr5e7-1ep-v2",
122
+ "run_id": "g_v_g800_full_visual_lr5e7_1ep_v2",
123
+ "sha256": "739d6292f27a32df6d640ad5d217e83e93ed9b8c2d801943b48f5fe1a1dcf614",
124
+ "value": {
125
+ "aligner_trainable": true,
126
+ "args_sha256": "f6c62c10c0e329a346003e57ed51b8ec72b46a7756bbc830e3a1dde3185fb063",
127
+ "base_model": "Qwen/Qwen3-VL-8B-Instruct",
128
+ "base_model_path": "/data/.cache/huggingface/hub/models--Qwen--Qwen3-VL-8B-Instruct/snapshots/0c351dd01ed87e9c1b53cbc748cba10e6187ff3b",
129
+ "base_model_revision": "0c351dd01ed87e9c1b53cbc748cba10e6187ff3b",
130
+ "checkpoint": "/data/appgen/training/sft_ability_sweep_v2r7_r2/qwen3/g_v_g800_full_visual_lr5e7_1ep_v2/checkpoint-112",
131
+ "config_sha256": "4625ddc397d5e967aac26ddc9c446537b5ac8976d1b3348db92d3a06acaf221d",
132
+ "dataset_manifest_sha256": "efc7f7117575fbcc54d95d8a98756376ba2c7ea09346979225f1fd5ae37ce942",
133
+ "dataset_rows": 3568,
134
+ "dataset_sha256": "6bcbfb12a4d93395e46e1cb4c257bca0fdeac007506f940d40dc40d57483057b",
135
+ "epochs": 1,
136
+ "family": "qwen3",
137
+ "freeze_mode": "full_visual",
138
+ "optimizer_steps": 112,
139
+ "parameter_audit": {
140
+ "family": "qwen3",
141
+ "freeze_mode": "full_visual",
142
+ "schema_version": "appgen-sft-runtime-parameter-audit-v1",
143
+ "source": "pinned_base_state_dict_expected_trainable_set",
144
+ "state_dict_aligner_tensors": 24,
145
+ "state_dict_tensor_names_sha256": "82c3e0aa71e33af255ce4d5785345d1a0a46ce7372ca443e1a9ca64741cd10d3",
146
+ "state_dict_total_numel": 8767123696,
147
+ "state_dict_total_tensors": 750,
148
+ "state_dict_trainable_names_sha256": "82c3e0aa71e33af255ce4d5785345d1a0a46ce7372ca443e1a9ca64741cd10d3",
149
+ "state_dict_trainable_numel": 8767123696,
150
+ "state_dict_trainable_tensors": 750,
151
+ "state_dict_visual_tensors": 351,
152
+ "trainable_names_not_in_state_dict": []
153
+ },
154
+ "parameter_audit_path": "/data/appgen/training/sft_ability_sweep_v2r7_r2/qwen3/parameter_audits/g_v_g800_full_visual_lr5e7_1ep_v2.json",
155
+ "parameter_audit_sha256": "9e26d2eb00004129767b9ee7c63661aba66956fe264ec0270a80aa9d23912b2d",
156
+ "schema_version": "appgen-sft-nav-ground-recovery-v2-checkpoint",
157
+ "system_prompt_sha256": "67ff8adb0e78a617f3d0edcf196d4e4cc3239967a8c30619fc5afc14484ee8c0",
158
+ "trainer_state_sha256": "8ed54217bc98a5e78949f92ed34078f85377fefe5a53db80c2a7a6e8e505585a",
159
+ "training_log_sha256": "295b65f7eace07f87be422f3d2f75d31f7bdef3edfb1aef991d3141461fa982d",
160
+ "validated": true,
161
+ "validated_at": "2026-07-20T16:10:46.542585+00:00",
162
+ "variant": "nav_ground_800",
163
+ "vit_trainable": true,
164
+ "weight_shards": [
165
+ "model-00001-of-00004.safetensors",
166
+ "model-00002-of-00004.safetensors",
167
+ "model-00003-of-00004.safetensors",
168
+ "model-00004-of-00004.safetensors"
169
+ ]
170
+ },
171
+ "variant": "nav_ground_800"
172
+ },
173
+ {
174
+ "freeze_mode": "frozen",
175
+ "path": "/data/appgen/training/sft_ability_sweep_v2r7_r2/qwen3/markers/r_f_recovery_frozen_lr5e7_1ep_v2.json",
176
+ "repo_id": "luca0621/appgen-qwen3-sft-recovery-frozen-lr5e7-1ep-v2",
177
+ "run_id": "r_f_recovery_frozen_lr5e7_1ep_v2",
178
+ "sha256": "d7cb329ab79d23bb792c7bd5429d2452a55bd808ecce4d5118953e8193fb7e4a",
179
+ "value": {
180
+ "aligner_trainable": false,
181
+ "args_sha256": "19b94830e1ae55720b11762e9a3ec2eb20cbb22c5411926969481d6b46a4f1e5",
182
+ "base_model": "Qwen/Qwen3-VL-8B-Instruct",
183
+ "base_model_path": "/data/.cache/huggingface/hub/models--Qwen--Qwen3-VL-8B-Instruct/snapshots/0c351dd01ed87e9c1b53cbc748cba10e6187ff3b",
184
+ "base_model_revision": "0c351dd01ed87e9c1b53cbc748cba10e6187ff3b",
185
+ "checkpoint": "/data/appgen/training/sft_ability_sweep_v2r7_r2/qwen3/r_f_recovery_frozen_lr5e7_1ep_v2/checkpoint-90",
186
+ "config_sha256": "4625ddc397d5e967aac26ddc9c446537b5ac8976d1b3348db92d3a06acaf221d",
187
+ "dataset_manifest_sha256": "efc7f7117575fbcc54d95d8a98756376ba2c7ea09346979225f1fd5ae37ce942",
188
+ "dataset_rows": 2868,
189
+ "dataset_sha256": "f01c63f4fdb61d7cdb51695fa77326f71e7ccd5f14af3ce116d58f6ef6fd53b9",
190
+ "epochs": 1,
191
+ "family": "qwen3",
192
+ "freeze_mode": "frozen",
193
+ "optimizer_steps": 90,
194
+ "parameter_audit": {
195
+ "family": "qwen3",
196
+ "freeze_mode": "frozen",
197
+ "schema_version": "appgen-sft-runtime-parameter-audit-v1",
198
+ "source": "pinned_base_state_dict_expected_trainable_set",
199
+ "state_dict_aligner_tensors": 24,
200
+ "state_dict_tensor_names_sha256": "82c3e0aa71e33af255ce4d5785345d1a0a46ce7372ca443e1a9ca64741cd10d3",
201
+ "state_dict_total_numel": 8767123696,
202
+ "state_dict_total_tensors": 750,
203
+ "state_dict_trainable_names_sha256": "dc15fcaf337a2224e93f04c4d4f7acd1c4e527110f7adda863b60470cc245752",
204
+ "state_dict_trainable_numel": 8190735360,
205
+ "state_dict_trainable_tensors": 399,
206
+ "state_dict_visual_tensors": 351,
207
+ "trainable_names_not_in_state_dict": []
208
+ },
209
+ "parameter_audit_path": "/data/appgen/training/sft_ability_sweep_v2r7_r2/qwen3/parameter_audits/r_f_recovery_frozen_lr5e7_1ep_v2.json",
210
+ "parameter_audit_sha256": "55e7ddebf6dc881b532dde0a7bb0baf4946708db8a24c39927dee3606b69d665",
211
+ "schema_version": "appgen-sft-nav-ground-recovery-v2-checkpoint",
212
+ "system_prompt_sha256": "67ff8adb0e78a617f3d0edcf196d4e4cc3239967a8c30619fc5afc14484ee8c0",
213
+ "trainer_state_sha256": "a706c8ac0915b7e95609130f3ff932af506bf1183f38e1a273ac333bf0d3ef82",
214
+ "training_log_sha256": "033f87876e7e14cf37966ffe5f288ef932d3a87c74eef299479fd0f10567b2de",
215
+ "validated": true,
216
+ "validated_at": "2026-07-20T16:27:19.543720+00:00",
217
+ "variant": "nav_recovery",
218
+ "vit_trainable": false,
219
+ "weight_shards": [
220
+ "model-00001-of-00004.safetensors",
221
+ "model-00002-of-00004.safetensors",
222
+ "model-00003-of-00004.safetensors",
223
+ "model-00004-of-00004.safetensors"
224
+ ]
225
+ },
226
+ "variant": "nav_recovery"
227
+ },
228
+ {
229
+ "freeze_mode": "frozen",
230
+ "path": "/data/appgen/training/sft_ability_sweep_v2r7_r2/qwen3/markers/gr_f_g800_recovery_frozen_lr5e7_1ep_v2.json",
231
+ "repo_id": "luca0621/appgen-qwen3-sft-g800-recovery-frozen-lr5e7-1ep-v2",
232
+ "run_id": "gr_f_g800_recovery_frozen_lr5e7_1ep_v2",
233
+ "sha256": "6075d262e91127e1796c4587db1a2cb8c7d15bdc75250533163047e8aef102d4",
234
+ "value": {
235
+ "aligner_trainable": false,
236
+ "args_sha256": "1f54bed2a1a8e2ae07d55b0f58824455be014b765831375b14c121ae5f01bd91",
237
+ "base_model": "Qwen/Qwen3-VL-8B-Instruct",
238
+ "base_model_path": "/data/.cache/huggingface/hub/models--Qwen--Qwen3-VL-8B-Instruct/snapshots/0c351dd01ed87e9c1b53cbc748cba10e6187ff3b",
239
+ "base_model_revision": "0c351dd01ed87e9c1b53cbc748cba10e6187ff3b",
240
+ "checkpoint": "/data/appgen/training/sft_ability_sweep_v2r7_r2/qwen3/gr_f_g800_recovery_frozen_lr5e7_1ep_v2/checkpoint-115",
241
+ "config_sha256": "4625ddc397d5e967aac26ddc9c446537b5ac8976d1b3348db92d3a06acaf221d",
242
+ "dataset_manifest_sha256": "efc7f7117575fbcc54d95d8a98756376ba2c7ea09346979225f1fd5ae37ce942",
243
+ "dataset_rows": 3668,
244
+ "dataset_sha256": "64de056bf4a376238d1f9870af03b69c4a99d3f87217f9ef071e05704e3712d7",
245
+ "epochs": 1,
246
+ "family": "qwen3",
247
+ "freeze_mode": "frozen",
248
+ "optimizer_steps": 115,
249
+ "parameter_audit": {
250
+ "family": "qwen3",
251
+ "freeze_mode": "frozen",
252
+ "schema_version": "appgen-sft-runtime-parameter-audit-v1",
253
+ "source": "pinned_base_state_dict_expected_trainable_set",
254
+ "state_dict_aligner_tensors": 24,
255
+ "state_dict_tensor_names_sha256": "82c3e0aa71e33af255ce4d5785345d1a0a46ce7372ca443e1a9ca64741cd10d3",
256
+ "state_dict_total_numel": 8767123696,
257
+ "state_dict_total_tensors": 750,
258
+ "state_dict_trainable_names_sha256": "dc15fcaf337a2224e93f04c4d4f7acd1c4e527110f7adda863b60470cc245752",
259
+ "state_dict_trainable_numel": 8190735360,
260
+ "state_dict_trainable_tensors": 399,
261
+ "state_dict_visual_tensors": 351,
262
+ "trainable_names_not_in_state_dict": []
263
+ },
264
+ "parameter_audit_path": "/data/appgen/training/sft_ability_sweep_v2r7_r2/qwen3/parameter_audits/gr_f_g800_recovery_frozen_lr5e7_1ep_v2.json",
265
+ "parameter_audit_sha256": "55e7ddebf6dc881b532dde0a7bb0baf4946708db8a24c39927dee3606b69d665",
266
+ "schema_version": "appgen-sft-nav-ground-recovery-v2-checkpoint",
267
+ "system_prompt_sha256": "67ff8adb0e78a617f3d0edcf196d4e4cc3239967a8c30619fc5afc14484ee8c0",
268
+ "trainer_state_sha256": "b0672cd621d32c9911e6b1083870cb2bd27794c43c877f4389f031224976a767",
269
+ "training_log_sha256": "890653a8aa5a6f4807a3fed1b20f0b7e68736f2254718d1988606c683ee851fa",
270
+ "validated": true,
271
+ "validated_at": "2026-07-20T16:47:52.265407+00:00",
272
+ "variant": "nav_ground_recovery",
273
+ "vit_trainable": false,
274
+ "weight_shards": [
275
+ "model-00001-of-00004.safetensors",
276
+ "model-00002-of-00004.safetensors",
277
+ "model-00003-of-00004.safetensors",
278
+ "model-00004-of-00004.safetensors"
279
+ ]
280
+ },
281
+ "variant": "nav_ground_recovery"
282
+ },
283
+ {
284
+ "freeze_mode": "aligner",
285
+ "path": "/data/appgen/training/sft_ability_sweep_v2r7_r2/qwen3/markers/gr_a_g800_recovery_aligner_lr5e7_1ep_v2.json",
286
+ "repo_id": "luca0621/appgen-qwen3-sft-g800-recovery-aligner-lr5e7-1ep-v2",
287
+ "run_id": "gr_a_g800_recovery_aligner_lr5e7_1ep_v2",
288
+ "sha256": "a912392a621de7fab046d71644a85d4a87b6f01dda5f8b1a57632501ac8edc59",
289
+ "value": {
290
+ "aligner_trainable": true,
291
+ "args_sha256": "9a13391b5f7b9ce1d0512057812de8e92a6a13c287ad5cce4b426108206a268c",
292
+ "base_model": "Qwen/Qwen3-VL-8B-Instruct",
293
+ "base_model_path": "/data/.cache/huggingface/hub/models--Qwen--Qwen3-VL-8B-Instruct/snapshots/0c351dd01ed87e9c1b53cbc748cba10e6187ff3b",
294
+ "base_model_revision": "0c351dd01ed87e9c1b53cbc748cba10e6187ff3b",
295
+ "checkpoint": "/data/appgen/training/sft_ability_sweep_v2r7_r2/qwen3/gr_a_g800_recovery_aligner_lr5e7_1ep_v2/checkpoint-115",
296
+ "config_sha256": "4625ddc397d5e967aac26ddc9c446537b5ac8976d1b3348db92d3a06acaf221d",
297
+ "dataset_manifest_sha256": "efc7f7117575fbcc54d95d8a98756376ba2c7ea09346979225f1fd5ae37ce942",
298
+ "dataset_rows": 3668,
299
+ "dataset_sha256": "64de056bf4a376238d1f9870af03b69c4a99d3f87217f9ef071e05704e3712d7",
300
+ "epochs": 1,
301
+ "family": "qwen3",
302
+ "freeze_mode": "aligner",
303
+ "optimizer_steps": 115,
304
+ "parameter_audit": {
305
+ "family": "qwen3",
306
+ "freeze_mode": "aligner",
307
+ "schema_version": "appgen-sft-runtime-parameter-audit-v1",
308
+ "source": "pinned_base_state_dict_expected_trainable_set",
309
+ "state_dict_aligner_tensors": 24,
310
+ "state_dict_tensor_names_sha256": "82c3e0aa71e33af255ce4d5785345d1a0a46ce7372ca443e1a9ca64741cd10d3",
311
+ "state_dict_total_numel": 8767123696,
312
+ "state_dict_total_tensors": 750,
313
+ "state_dict_trainable_names_sha256": "f9850f7bd19e6f14849961af28e2b4b46d4c52a2505d9829cb72dd655f60e6b5",
314
+ "state_dict_trainable_numel": 8351232256,
315
+ "state_dict_trainable_tensors": 423,
316
+ "state_dict_visual_tensors": 351,
317
+ "trainable_names_not_in_state_dict": []
318
+ },
319
+ "parameter_audit_path": "/data/appgen/training/sft_ability_sweep_v2r7_r2/qwen3/parameter_audits/gr_a_g800_recovery_aligner_lr5e7_1ep_v2.json",
320
+ "parameter_audit_sha256": "a73997cfefb53a13b7f4990a5ea0e209b242566769daa24b083765bd1fbe98f0",
321
+ "schema_version": "appgen-sft-nav-ground-recovery-v2-checkpoint",
322
+ "system_prompt_sha256": "67ff8adb0e78a617f3d0edcf196d4e4cc3239967a8c30619fc5afc14484ee8c0",
323
+ "trainer_state_sha256": "475bc16192344c0dc40c7c424d5968db04be5cba52ad30e711fb3c73495106ec",
324
+ "training_log_sha256": "00421f395b6fba9c0853effd5990cfc879b89a17f3678494f0f2d3960e9771d9",
325
+ "validated": true,
326
+ "validated_at": "2026-07-20T17:09:17.657685+00:00",
327
+ "variant": "nav_ground_recovery",
328
+ "vit_trainable": false,
329
+ "weight_shards": [
330
+ "model-00001-of-00004.safetensors",
331
+ "model-00002-of-00004.safetensors",
332
+ "model-00003-of-00004.safetensors",
333
+ "model-00004-of-00004.safetensors"
334
+ ]
335
+ },
336
+ "variant": "nav_ground_recovery"
337
+ }
338
+ ],
339
+ "recovery_rows": 100,
340
+ "schema_version": "appgen-sft-ability-sweep-v2-family"
341
+ }