luca0621 commited on
Commit
96a3ba5
·
verified ·
1 Parent(s): 1e672c5

Add immutable marker-gated ability-SFT provenance

Browse files
README.md ADDED
@@ -0,0 +1,17 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ ---
2
+ library_name: transformers
3
+ pipeline_tag: image-text-to-text
4
+ ---
5
+
6
+ # luca0621/appgen-qwen3-sft-g800-frozen-lr5e7-1ep-v2
7
+
8
+ Validated AppGen ability-SFT v2 checkpoint.
9
+
10
+ - Family: `qwen3`
11
+ - Arm: `g_f_g800_frozen_lr5e7_1ep_v2`
12
+ - Variant: `nav_ground_800`
13
+ - Freeze mode: `frozen`
14
+ - Base revision: `0c351dd01ed87e9c1b53cbc748cba10e6187ff3b`
15
+ - Dataset SHA256: `6bcbfb12a4d93395e46e1cb4c257bca0fdeac007506f940d40dc40d57483057b`
16
+ - Epochs: 1
17
+ - Optimizer updates: 112
appgen_sft_data_manifest.json ADDED
The diff for this file is too large to render. See raw diff
 
appgen_sft_parameter_audit.json ADDED
@@ -0,0 +1,15 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "family": "qwen3",
3
+ "freeze_mode": "frozen",
4
+ "schema_version": "appgen-sft-runtime-parameter-audit-v1",
5
+ "source": "pinned_base_state_dict_expected_trainable_set",
6
+ "state_dict_aligner_tensors": 24,
7
+ "state_dict_tensor_names_sha256": "82c3e0aa71e33af255ce4d5785345d1a0a46ce7372ca443e1a9ca64741cd10d3",
8
+ "state_dict_total_numel": 8767123696,
9
+ "state_dict_total_tensors": 750,
10
+ "state_dict_trainable_names_sha256": "dc15fcaf337a2224e93f04c4d4f7acd1c4e527110f7adda863b60470cc245752",
11
+ "state_dict_trainable_numel": 8190735360,
12
+ "state_dict_trainable_tensors": 399,
13
+ "state_dict_visual_tensors": 351,
14
+ "trainable_names_not_in_state_dict": []
15
+ }
appgen_sft_validation.json ADDED
@@ -0,0 +1,47 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "aligner_trainable": false,
3
+ "args_sha256": "b47c351dab366c3d78a195d0650f6deb17c28d5c302d0f70503dcfb5571006c1",
4
+ "base_model": "Qwen/Qwen3-VL-8B-Instruct",
5
+ "base_model_path": "/data/.cache/huggingface/hub/models--Qwen--Qwen3-VL-8B-Instruct/snapshots/0c351dd01ed87e9c1b53cbc748cba10e6187ff3b",
6
+ "base_model_revision": "0c351dd01ed87e9c1b53cbc748cba10e6187ff3b",
7
+ "checkpoint": "/data/appgen/training/sft_ability_sweep_v2r7_r2/qwen3/g_f_g800_frozen_lr5e7_1ep_v2/checkpoint-112",
8
+ "config_sha256": "4625ddc397d5e967aac26ddc9c446537b5ac8976d1b3348db92d3a06acaf221d",
9
+ "dataset_manifest_sha256": "efc7f7117575fbcc54d95d8a98756376ba2c7ea09346979225f1fd5ae37ce942",
10
+ "dataset_rows": 3568,
11
+ "dataset_sha256": "6bcbfb12a4d93395e46e1cb4c257bca0fdeac007506f940d40dc40d57483057b",
12
+ "epochs": 1,
13
+ "family": "qwen3",
14
+ "freeze_mode": "frozen",
15
+ "optimizer_steps": 112,
16
+ "parameter_audit": {
17
+ "family": "qwen3",
18
+ "freeze_mode": "frozen",
19
+ "schema_version": "appgen-sft-runtime-parameter-audit-v1",
20
+ "source": "pinned_base_state_dict_expected_trainable_set",
21
+ "state_dict_aligner_tensors": 24,
22
+ "state_dict_tensor_names_sha256": "82c3e0aa71e33af255ce4d5785345d1a0a46ce7372ca443e1a9ca64741cd10d3",
23
+ "state_dict_total_numel": 8767123696,
24
+ "state_dict_total_tensors": 750,
25
+ "state_dict_trainable_names_sha256": "dc15fcaf337a2224e93f04c4d4f7acd1c4e527110f7adda863b60470cc245752",
26
+ "state_dict_trainable_numel": 8190735360,
27
+ "state_dict_trainable_tensors": 399,
28
+ "state_dict_visual_tensors": 351,
29
+ "trainable_names_not_in_state_dict": []
30
+ },
31
+ "parameter_audit_path": "/data/appgen/training/sft_ability_sweep_v2r7_r2/qwen3/parameter_audits/g_f_g800_frozen_lr5e7_1ep_v2.json",
32
+ "parameter_audit_sha256": "55e7ddebf6dc881b532dde0a7bb0baf4946708db8a24c39927dee3606b69d665",
33
+ "schema_version": "appgen-sft-nav-ground-recovery-v2-checkpoint",
34
+ "system_prompt_sha256": "67ff8adb0e78a617f3d0edcf196d4e4cc3239967a8c30619fc5afc14484ee8c0",
35
+ "trainer_state_sha256": "c3febc1d6e1b039a4d81a1f5652b075fdc3181d39de880a68c83797bf71a580f",
36
+ "training_log_sha256": "ee90740f5af5a5511773871bb086e7018a56f225b2560a71a323d8783f2aaee2",
37
+ "validated": true,
38
+ "validated_at": "2026-07-20T15:29:45.446541+00:00",
39
+ "variant": "nav_ground_800",
40
+ "vit_trainable": false,
41
+ "weight_shards": [
42
+ "model-00001-of-00004.safetensors",
43
+ "model-00002-of-00004.safetensors",
44
+ "model-00003-of-00004.safetensors",
45
+ "model-00004-of-00004.safetensors"
46
+ ]
47
+ }