robgreenberg3 aurick commited on
Commit
5b1d5d4
·
0 Parent(s):

Duplicate from thinkingmachines/Inkling-NVFP4

Browse files

Co-authored-by: Aurick Qiao <aurick@users.noreply.huggingface.co>

Files changed (45) hide show
  1. .gitattributes +36 -0
  2. README.md +139 -0
  3. chat_template.jinja +129 -0
  4. config.json +134 -0
  5. hf_quant_config.json +578 -0
  6. model-00001-of-00033.safetensors +3 -0
  7. model-00002-of-00033.safetensors +3 -0
  8. model-00003-of-00033.safetensors +3 -0
  9. model-00004-of-00033.safetensors +3 -0
  10. model-00005-of-00033.safetensors +3 -0
  11. model-00006-of-00033.safetensors +3 -0
  12. model-00007-of-00033.safetensors +3 -0
  13. model-00008-of-00033.safetensors +3 -0
  14. model-00009-of-00033.safetensors +3 -0
  15. model-00010-of-00033.safetensors +3 -0
  16. model-00011-of-00033.safetensors +3 -0
  17. model-00012-of-00033.safetensors +3 -0
  18. model-00013-of-00033.safetensors +3 -0
  19. model-00014-of-00033.safetensors +3 -0
  20. model-00015-of-00033.safetensors +3 -0
  21. model-00016-of-00033.safetensors +3 -0
  22. model-00017-of-00033.safetensors +3 -0
  23. model-00018-of-00033.safetensors +3 -0
  24. model-00019-of-00033.safetensors +3 -0
  25. model-00020-of-00033.safetensors +3 -0
  26. model-00021-of-00033.safetensors +3 -0
  27. model-00022-of-00033.safetensors +3 -0
  28. model-00023-of-00033.safetensors +3 -0
  29. model-00024-of-00033.safetensors +3 -0
  30. model-00025-of-00033.safetensors +3 -0
  31. model-00026-of-00033.safetensors +3 -0
  32. model-00027-of-00033.safetensors +3 -0
  33. model-00028-of-00033.safetensors +3 -0
  34. model-00029-of-00033.safetensors +3 -0
  35. model-00030-of-00033.safetensors +3 -0
  36. model-00031-of-00033.safetensors +3 -0
  37. model-00032-of-00033.safetensors +3 -0
  38. model-00033-of-00033.safetensors +3 -0
  39. model.safetensors.index.json +0 -0
  40. mtp.safetensors +3 -0
  41. processor_config.json +46 -0
  42. special_tokens_map.json +22 -0
  43. tiktoken/tokenizer.model +3 -0
  44. tokenizer.json +3 -0
  45. tokenizer_config.json +508 -0
.gitattributes ADDED
@@ -0,0 +1,36 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ model-00012-of-00033.safetensors filter=lfs diff=lfs merge=lfs -text
2
+ model-00032-of-00033.safetensors filter=lfs diff=lfs merge=lfs -text
3
+ model-00025-of-00033.safetensors filter=lfs diff=lfs merge=lfs -text
4
+ model-00002-of-00033.safetensors filter=lfs diff=lfs merge=lfs -text
5
+ model-00005-of-00033.safetensors filter=lfs diff=lfs merge=lfs -text
6
+ model-00013-of-00033.safetensors filter=lfs diff=lfs merge=lfs -text
7
+ model-00029-of-00033.safetensors filter=lfs diff=lfs merge=lfs -text
8
+ model-00026-of-00033.safetensors filter=lfs diff=lfs merge=lfs -text
9
+ model-00007-of-00033.safetensors filter=lfs diff=lfs merge=lfs -text
10
+ model-00022-of-00033.safetensors filter=lfs diff=lfs merge=lfs -text
11
+ model-00001-of-00033.safetensors filter=lfs diff=lfs merge=lfs -text
12
+ model-00021-of-00033.safetensors filter=lfs diff=lfs merge=lfs -text
13
+ model-00010-of-00033.safetensors filter=lfs diff=lfs merge=lfs -text
14
+ model-00023-of-00033.safetensors filter=lfs diff=lfs merge=lfs -text
15
+ tokenizer.json filter=lfs diff=lfs merge=lfs -text
16
+ model-00030-of-00033.safetensors filter=lfs diff=lfs merge=lfs -text
17
+ model-00024-of-00033.safetensors filter=lfs diff=lfs merge=lfs -text
18
+ model-00018-of-00033.safetensors filter=lfs diff=lfs merge=lfs -text
19
+ model-00017-of-00033.safetensors filter=lfs diff=lfs merge=lfs -text
20
+ model-00033-of-00033.safetensors filter=lfs diff=lfs merge=lfs -text
21
+ model-00014-of-00033.safetensors filter=lfs diff=lfs merge=lfs -text
22
+ mtp.safetensors filter=lfs diff=lfs merge=lfs -text
23
+ model-00027-of-00033.safetensors filter=lfs diff=lfs merge=lfs -text
24
+ model-00008-of-00033.safetensors filter=lfs diff=lfs merge=lfs -text
25
+ model-00003-of-00033.safetensors filter=lfs diff=lfs merge=lfs -text
26
+ model-00009-of-00033.safetensors filter=lfs diff=lfs merge=lfs -text
27
+ model-00016-of-00033.safetensors filter=lfs diff=lfs merge=lfs -text
28
+ model-00004-of-00033.safetensors filter=lfs diff=lfs merge=lfs -text
29
+ model-00019-of-00033.safetensors filter=lfs diff=lfs merge=lfs -text
30
+ model-00006-of-00033.safetensors filter=lfs diff=lfs merge=lfs -text
31
+ model-00011-of-00033.safetensors filter=lfs diff=lfs merge=lfs -text
32
+ model-00020-of-00033.safetensors filter=lfs diff=lfs merge=lfs -text
33
+ model-00015-of-00033.safetensors filter=lfs diff=lfs merge=lfs -text
34
+ model-00028-of-00033.safetensors filter=lfs diff=lfs merge=lfs -text
35
+ model-00031-of-00033.safetensors filter=lfs diff=lfs merge=lfs -text
36
+ tiktoken/tokenizer.model filter=lfs diff=lfs merge=lfs -text
README.md ADDED
@@ -0,0 +1,139 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ ---
2
+ license: apache-2.0
3
+ license_link: https://www.apache.org/licenses/LICENSE-2.0
4
+ pipeline_tag: image-text-to-text
5
+ tags:
6
+ - conversational
7
+ - image-text-to-text
8
+ - audio-text-to-text
9
+ - moe
10
+ library_name: transformers
11
+ base_model:
12
+ - thinkingmachines/Inkling
13
+ ---
14
+
15
+ # Inkling
16
+
17
+ <img src="https://cdn-uploads.huggingface.co/production/uploads/630e8f0bf6f6d700f50ebd2e/AvmDwmrWRMnKjOWvmLieg.png" style="display: block;margin-left: auto;margin-right: auto;width: 30%;">
18
+
19
+ <p align="center">
20
+ <a href="https://huggingface.co/thinkingmachines/Inkling">BF16</a> |
21
+ <a href="https://huggingface.co/thinkingmachines/Inkling-NVFP4">NVFP4</a> |
22
+ <a href="https://tinker.thinkingmachines.ai/playground">Playground</a> |
23
+ <a href="https://github.com/thinking-machines-lab/tinker-cookbook">Tinker Cookbook</a> |
24
+ <a href="https://thinkingmachines.ai/model-acceptable-use-policy">Acceptable Use</a>
25
+ </p>
26
+
27
+ ## 1. General Information
28
+
29
+ Inkling is a general-purpose multimodal model that accepts text, image and audio inputs and generates text outputs. It is intended for use in English and other languages, and across multiple coding languages. The model is designed to be used by developers building AI-powered applications, including agentic and tool-use systems, coding assistants, chatbots, and retrieval-augmented generation systems, and is suitable for general-purpose conversational use, instruction-following, and other natural language and multimodal tasks. It is released with open weights to support research, fine-tuning and integration into third-party products by downstream developers.
30
+
31
+ **Languages:** English, with general multilingual capabilities across other languages.
32
+
33
+ ## 2. Getting Started
34
+
35
+ Try Inkling on the [Tinker Playground](https://tinker.thinkingmachines.ai/playground) or access via API using the [Tinker Cookbook](https://github.com/thinking-machines-lab/tinker-cookbook).
36
+
37
+ Inkling supports local deployment using the following open-source libraries:
38
+
39
+ * SGLang ([recipe](https://docs.sglang.io/cookbook/autoregressive/ThinkingMachines/Inkling))
40
+ * vLLM ([recipe](https://recipes.vllm.ai/thinkingmachines/Inkling))
41
+ * TokenSpeed ([recipe](https://lightseek.org/tokenspeed/recipes/models#Inkling))
42
+ * Unsloth ([recipe](https://unsloth.ai/docs/models/inkling))
43
+ * Huggingface ([recipe](https://hf.co/blog/thinkingmachines-inkling))
44
+
45
+ API access is also available through third party inference providers.
46
+
47
+ ## 3. Model Properties
48
+
49
+ ### Model type
50
+
51
+ Multimodal autoregressive transformer
52
+
53
+ ### Architecture type
54
+
55
+ A 66-layer decoder-only transformer with a sparse Mixture-of-Experts (MoE) feed-forward backbone: each token is routed to 6 of 256 experts, plus 2 shared experts active on every token. Attention is a hybrid of local and global layers. The model is natively multimodal — images and video are encoded via a hierarchical patch encoder, and audio via discrete token encoding — with all modalities projected into a shared hidden space and processed jointly by the decoder.
56
+
57
+ ### Parameters
58
+
59
+ 975B total, 41B active
60
+
61
+ ### Numerics support
62
+
63
+ BF16 and NVFP4
64
+
65
+ ### Input modalities
66
+
67
+ Inkling accepts text input in UTF-8 encoding, image input in any pixel-based format (with each dimension ideally between 40px and 4096px for optimal performance), and audio input in WAV format sampled at 16kHz (ideally under 20 minutes in length for optimal performance).
68
+
69
+ ### Output modalities
70
+
71
+ Inkling generates output as UTF-8 encoded text.
72
+
73
+ ## 4. Training
74
+
75
+ Training data includes a broad variety of content types, including text, images, audio, video. Training data for the model was drawn from publicly available sources, acquired from third-parties, or synthetically generated or augmented. Publicly available data includes content from the public internet and publicly accessible repositories.
76
+
77
+ The training data curation process includes cleaning, processing, and modifying datasets. These processing steps, which vary by data type, may include deduplication and filtering to remove junk or other low-quality data, or to advance safety or other objectives.
78
+
79
+ ## 5. Evaluations
80
+
81
+ Inkling results are reported at effort=0.99. Comparison scores are generated Jul 14, 2026. Nemotron 3 Ultra, Kimi K2.5, Kimi K2.6, GLM 5.2, and DeepSeek V4 Pro are open weights models; Gemini 3.1 Pro, Claude Fable 5, and GPT 5.6 Sol are closed weights models.
82
+
83
+ | | | Inkling | Nemotron 3 Ultra | Kimi K2.5 | Kimi K2.6 | GLM 5.2 | DeepSeek V4 Pro | Gemini 3.1 Pro (high) | Claude Fable 5 (max) | GPT 5.6 Sol (xhigh) |
84
+ |-----|-----|---------|------------------|-----------|-----------|---------|-----------------|-----------------------|----------------------|---------------------|
85
+ | **Reasoning** | | | | | | | | | | |
86
+ | | HLE (text only) | 29.7% | 26.6% | 29.4% | 35.9% | 40.1% | 35.9% | 44.7% | 53.3% | 47.2% |
87
+ | | HLE (with tools) | 46.0% | 37.4% | 50.2% | 54.0% | 54.7% | 48.2% | 51.4% | 64.5% | 55.0% |
88
+ | | AIME 2026 | 97.1% | 94.2% | 95.8% | 96.4% | 99.2% | 96.7% | 98.3% | – | 99.9% |
89
+ | | GPQA Diamond | 87.2% | 86.7% | 87.9% | 91.1% | 89.5% | 88.8% | 94.1% | 92.6% | 94.1% |
90
+ | **Agentic (coding)** | | | | | | | | | | |
91
+ | | SWEBench Verified | 77.6% | 70.7% | 76.8% | 80.2% | – | 80.6% | 80.6% | 95.0% | – |
92
+ | | SWEBench Pro (Public) | 54.3% | 46.4% | 50.7% | 58.6% | 62.1% | 55.4% | 54.2% | 80.0% | 64.6% |
93
+ | | Terminal Bench 2.1 (Best Harness) | 63.8 | 56.4 | 51.3 | 71.3 | 82.7 | 64 | 73.8 | 84.6 | 89.5 |
94
+ | | GDPVal-AA v2 | 1233 | 1164 | 1009 | 1190 | 1514 | 1307 | 962 | 1760 | 1748 |
95
+ | **Agentic (general)** | | | | | | | | | | |
96
+ | | MCP Atlas | 74.1% | 44.7% | 64.0% | 68.1% | 77.8% | 73.2% | 78.2% | 83.3% | 81.8% |
97
+ | | Tau 3 Banking | 23.7% | 13.8% | 13.2% | 20.6% | 26.8% | 25.8% | 16.5% | 26.8% | 33.0% |
98
+ | **Factuality** | | | | | | | | | | |
99
+ | | BrowseComp (w/ Ctx) | 77.1% | – | 74.9% | 83.2% | – | 83.4% | 85.9% | 88.0% | 89.4% |
100
+ | | SimpleQA Verified | 43.9% | 32.4% | 36.9% | 38.7% | 38.1% | 57.0% | 77.3% | 68.3% | 71.6% |
101
+ | | AA Omniscience | 1.0% | -1.0% | -8.0% | 6.0% | 4.0% | -10.0% | 33.0% | 40.0% | 22.0% |
102
+ | **Chat** | | | | | | | | | | |
103
+ | | IFBench | 79.8% | 81.4% | 70.2% | 76.0% | 73.3% | 76.5% | 77.1% | 63.5% | 72.7% |
104
+ | | Global-MMLU-Lite | 88.7% | 85.6% | 84.0% | 88.4% | 89.2% | 89.3% | 92.7% | 93.3% | 91.8% |
105
+ | **Vision** | | | | | | | | | | |
106
+ | | MMMU Pro (Standard 10) | 73.5% | – | 75.0% | 79.0% | – | – | 82.0% | 84.2% | 83.0% |
107
+ | | Charxiv RQ | 78.1% | – | 77.5% | 80.4% | – | – | 80.2% | 86.5% | 84.7% |
108
+ | | Charxiv RQ (with python) | 82.0% | – | 78.7% | 86.7% | – | – | 89.9% | 89.4% | 87.8% |
109
+ | **Audio** | | | | | | | | | | |
110
+ | | Audio MC | 56.6% | – | – | – | – | – | 66.8% | – | – |
111
+ | | MMAU | 77.2% | – | – | – | – | – | 82.5% | – | – |
112
+ | | VoiceBench | 91.4% | – | – | – | – | – | 94.3% | – | – |
113
+ | **Safety** | | | | | | | | | | |
114
+ | | FORTRESS (Adversarial) | 78.0% | 77.6% | 54.1% | 65.6% | 71.3% | 36.0% | 65.2% | 96.0% | 82.4% |
115
+ | | FORTRESS (Benign) | 95.9% | 90.5% | 98.3% | 97.2% | 90.0% | 98.5% | 98.0% | 55.1% | 98.1% |
116
+ | | StrongREJECT | 98.6% | 98.7% | 99.5% | 99.8% | 98.5% | 98.6% | 98.0% | 98.7% | 98.5% |
117
+
118
+
119
+ ## 6. Safety
120
+
121
+ We conducted safety evaluations ahead of release, spanning both everyday human-AI interaction and dangerous-capability testing. Because Inkling is multimodal, we paid attention to whether safety behavior held consistently across text, audio, and image inputs. We applied mitigations to reduce risks before release.
122
+
123
+ For everyday interaction, we evaluated sycophancy, harmful manipulation, and psychological-harm patterns like parasocial dependency and validation of delusional reasoning, including through multi-turn, open-ended external red-teaming designed to surface issues that only emerge over longer conversations. We also assessed whether the model refuses genuinely harmful requests without over-refusing benign ones. For CBRN and cyber, we assessed knowledge and procedural uplift through internal evaluations, external testing, and refusal-suppressed variants intended to estimate latent capability with safeguards removed. For loss of control, we evaluated agentic capability, strategic deception, and sabotage potential, benchmarked against public frontier models, and found the model materially below frontier capabilities.
124
+
125
+ Across all areas, we concluded that Inkling did not present risk of material uplift beyond what's already available in the open-weight ecosystem.
126
+
127
+ The residual risks identified in our evaluations — specifically, Inkling's occasional tendency to comply with role-play and indirectly framed prompts concerning harmful topics — are consistent with what you would see from any open-weight model, and are best addressed with defense-in-depth rather than relying on the model's refusals alone. Common downstream moderation tools, such as Llama Guard, are compatible with Inkling and can be layered around the model to catch jailbreak attempts, filter unsafe outputs, and enforce use-case-specific policies. We would encourage treating this kind of input/output classification as a part of your deployment stack, especially for consumer-facing or high-traffic applications where adversarial prompting is more likely.
128
+
129
+ ## 7. Bias, risks and limitations
130
+
131
+ Inkling may exhibit general limitations common to foundation models, including hallucination (generating plausible but factually incorrect or unsupported content), occasional failures to follow instructions precisely, and degraded performance in long multi-turn conversations. As with other large-scale models trained on web-derived and synthetic data, Inkling may reflect biases present in its training data, including demographic, cultural, or linguistic biases, and may perform unevenly across languages, dialects, or subject domains that were less represented during training.
132
+
133
+ Inkling's knowledge is limited to information available as of its training cutoff, and it may not reflect events, developments, or changes that occurred afterward.
134
+
135
+ We recommend that downstream developers and deployers apply appropriate human oversight and review for outputs used in high-stakes or safety-critical contexts, rather than relying on Inkling's outputs without verification.
136
+
137
+ * Conduct their own evaluation of Inkling's performance, safety, and fairness for their specific use case, language, and population prior to deployment, particularly for applications involving vulnerable groups.
138
+ * Implement additional safeguards — such as content filtering, rate limiting, and monitoring — at the application layer, especially for open deployment contexts where Inkling's built-in mitigations may not be sufficient on their own.
139
+ * Avoid deploying Inkling in domains such as medical, legal, or safety-critical decision-making without additional fine-tuning, domain-specific validation, and human oversight.
chat_template.jinja ADDED
@@ -0,0 +1,129 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {%- set effort_map = {"none": 0.0, "minimal": 0.1, "low": 0.2, "medium": 0.7, "high": 0.9, "max": 0.99} -%}
2
+ {%- set role_token = {"user": "<|message_user|>", "assistant": "<|message_model|>", "system": "<|message_system|>", "tool": "<|message_tool|>"} -%}
3
+
4
+ {%- macro emit_thinking_effort() -%}
5
+ {%- set eff = reasoning_effort if reasoning_effort is defined and reasoning_effort is not none else 0.9 -%}
6
+ {%- if eff is string -%}
7
+ {%- set key = eff | trim -%}
8
+ {%- if key not in effort_map -%}
9
+ {{- raise_exception("Unknown reasoning_effort: " ~ eff) -}}
10
+ {%- endif -%}
11
+ {%- set num = effort_map[key] -%}
12
+ {%- else -%}
13
+ {%- set num = eff | float -%}
14
+ {%- endif -%}
15
+ {%- if num < 0.0 or num > 0.99 -%}
16
+ {{- raise_exception("reasoning_effort must be in [0.0, 0.99]") -}}
17
+ {%- endif -%}
18
+ {{- "<|message_system|><|content_text|>Thinking effort level: " -}}
19
+ {%- if num == 0.0 -%}0{%- else -%}{{ num }}{%- endif -%}
20
+ {{- "<|end_message|>" -}}
21
+ {%- endmacro -%}
22
+
23
+ {%- if tools -%}
24
+ {%- set tool_state = namespace(specs=[]) -%}
25
+ {%- for tool in tools -%}
26
+ {%- set fn = tool.function if tool.function is defined else tool -%}
27
+ {%- set spec = {
28
+ "description": (fn.description if fn.description is defined and fn.description else ""),
29
+ "name": fn.name,
30
+ "parameters": (fn.parameters if fn.parameters is defined and fn.parameters else {}),
31
+ "type": (tool.type if tool.type is defined and tool.type else "function"),
32
+ } -%}
33
+ {%- set tool_state.specs = tool_state.specs + [spec] -%}
34
+ {%- endfor -%}
35
+ {{- "<|message_system|>tool_declare<|content_xml|>" -}}
36
+ {{- tool_state.specs | tojson(sort_keys=true, separators=(",", ":")) -}}
37
+ {{- "<|end_message|>" -}}
38
+ {%- endif -%}
39
+
40
+ {%- set state = namespace(effort_emitted=false) -%}
41
+ {%- for message in messages -%}
42
+ {%- if message.role not in role_token -%}
43
+ {{- raise_exception("Unknown message role: " ~ message.role) -}}
44
+ {%- endif -%}
45
+ {%- if not state.effort_emitted and message.role != "system" -%}
46
+ {{- emit_thinking_effort() -}}
47
+ {%- set state.effort_emitted = true -%}
48
+ {%- endif -%}
49
+
50
+ {%- set rtok = role_token[message.role] -%}
51
+
52
+ {%- if message.role == "tool" -%}
53
+ {%- set tool_name_state = namespace(name="") -%}
54
+ {%- if message.name is defined and message.name -%}
55
+ {%- set tool_name_state.name = message.name -%}
56
+ {%- elif message.tool_call_id is defined and message.tool_call_id -%}
57
+ {%- for prev in messages -%}
58
+ {%- if prev.role == "assistant" and prev.tool_calls -%}
59
+ {%- for tc in prev.tool_calls -%}
60
+ {%- if tc.id is defined and tc.id == message.tool_call_id and tc.function.name is defined -%}
61
+ {%- set tool_name_state.name = tc.function.name -%}
62
+ {%- endif -%}
63
+ {%- endfor -%}
64
+ {%- endif -%}
65
+ {%- endfor -%}
66
+ {%- endif -%}
67
+ {{- rtok -}}
68
+ {%- if tool_name_state.name -%}{{- tool_name_state.name -}}{%- endif -%}
69
+ {{- "<|content_text|>" -}}
70
+ {%- if message.content is string -%}{{- message.content -}}{%- endif -%}
71
+ {{- "<|end_message|>" -}}
72
+
73
+ {%- else -%}
74
+ {%- if message.role == "assistant" and message.reasoning_content is defined and message.reasoning_content -%}
75
+ {{- "<|message_model|><|content_thinking|>" ~ message.reasoning_content ~ "<|end_message|>" -}}
76
+ {%- endif -%}
77
+
78
+ {%- if message.content is string -%}
79
+ {{- rtok ~ "<|content_text|>" ~ message.content ~ "<|end_message|>" -}}
80
+ {%- elif message.content -%}
81
+ {%- for part in message.content -%}
82
+ {%- if part is string -%}
83
+ {{- rtok ~ "<|content_text|>" ~ part ~ "<|end_message|>" -}}
84
+ {%- elif part.type is not defined or part.type in ("text", "input_text") -%}
85
+ {%- set text_part = (part.text if part.text is defined and part.text is string else "") -%}
86
+ {{- rtok ~ "<|content_text|>" ~ text_part ~ "<|end_message|>" -}}
87
+ {%- elif part.type in ("image", "input_image", "image_url") -%}
88
+ {{- rtok ~ "<|content_image|><|unused_200054|><|end_message|>" -}}
89
+ {%- elif part.type in ("audio", "input_audio", "audio_url") -%}
90
+ {{- rtok ~ "<|content_audio_input|><|unused_200053|><|audio_end|><|end_message|>" -}}
91
+ {%- else -%}
92
+ {{- raise_exception("Unsupported content part type: " ~ part.type) -}}
93
+ {%- endif -%}
94
+ {%- endfor -%}
95
+ {%- endif -%}
96
+
97
+ {%- if message.role == "assistant" and message.tool_calls -%}
98
+ {%- for tc in message.tool_calls -%}
99
+ {%- set fn = tc.function -%}
100
+ {%- if fn.name is not defined or fn.name is not string -%}
101
+ {{- raise_exception("tool call function name must be a string") -}}
102
+ {%- endif -%}
103
+ {%- set args = fn.arguments if fn.arguments is defined and fn.arguments else {} -%}
104
+ {%- if args is string -%}
105
+ {{- raise_exception("tool call arguments must be a parsed object, not a JSON string; canonicalize upstream") -}}
106
+ {%- endif -%}
107
+ {%- if args is not mapping -%}
108
+ {{- raise_exception("tool call arguments must be an object") -}}
109
+ {%- endif -%}
110
+ {{- "<|message_model|>" ~ fn.name ~ "<|content_invoke_tool_json|>" -}}
111
+ {{- '{"name":' ~ (fn.name | tojson(sort_keys=true, separators=(",", ":"))) ~ ',"args":' -}}
112
+ {{- (args | tojson(sort_keys=true, separators=(",", ":"))) -}}
113
+ {{- "}<|end_message|>" -}}
114
+ {%- endfor -%}
115
+ {%- endif -%}
116
+
117
+ {%- if message.role == "assistant" -%}
118
+ {{- "<|content_model_end_sampling|>" -}}
119
+ {%- endif -%}
120
+ {%- endif -%}
121
+ {%- endfor -%}
122
+
123
+ {%- if not state.effort_emitted -%}
124
+ {{- emit_thinking_effort() -}}
125
+ {%- endif -%}
126
+
127
+ {%- if add_generation_prompt -%}
128
+ {{- "<|message_model|>" -}}
129
+ {%- endif -%}
config.json ADDED
@@ -0,0 +1,134 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "architectures": [
3
+ "InklingForConditionalGeneration"
4
+ ],
5
+ "model_type": "inkling_mm_model",
6
+ "eos_token_id": 200006,
7
+ "text_config": {
8
+ "model_max_length": 1048576,
9
+ "torch_dtype": "bfloat16",
10
+ "hidden_size": 6144,
11
+ "num_hidden_layers": 66,
12
+ "vocab_size": 201024,
13
+ "num_attention_heads": 64,
14
+ "num_key_value_heads": 8,
15
+ "head_dim": 128,
16
+ "d_rel": 16,
17
+ "rel_extent": 1024,
18
+ "q_bias": false,
19
+ "o_bias": false,
20
+ "log_scaling_n_floor": 128000,
21
+ "log_scaling_alpha": 0.1,
22
+ "rms_norm_eps": 1e-06,
23
+ "use_embed_norm": true,
24
+ "local_layer_ids": [
25
+ 0,
26
+ 1,
27
+ 2,
28
+ 3,
29
+ 4,
30
+ 6,
31
+ 7,
32
+ 8,
33
+ 9,
34
+ 10,
35
+ 12,
36
+ 13,
37
+ 14,
38
+ 15,
39
+ 16,
40
+ 18,
41
+ 19,
42
+ 20,
43
+ 21,
44
+ 22,
45
+ 24,
46
+ 25,
47
+ 26,
48
+ 27,
49
+ 28,
50
+ 30,
51
+ 31,
52
+ 32,
53
+ 33,
54
+ 34,
55
+ 36,
56
+ 37,
57
+ 38,
58
+ 39,
59
+ 40,
60
+ 42,
61
+ 43,
62
+ 44,
63
+ 45,
64
+ 46,
65
+ 48,
66
+ 49,
67
+ 50,
68
+ 51,
69
+ 52,
70
+ 54,
71
+ 55,
72
+ 56,
73
+ 57,
74
+ 58,
75
+ 60,
76
+ 61,
77
+ 62,
78
+ 63,
79
+ 64
80
+ ],
81
+ "dense_mlp_idx": 2,
82
+ "use_sconv": true,
83
+ "sconv_kernel_size": 4,
84
+ "unpadded_vocab_size": 200058,
85
+ "logits_mup_width_multiplier": 24.0,
86
+ "final_logit_softcapping": null,
87
+ "swa_head_dim": 128,
88
+ "swa_num_attention_heads": 64,
89
+ "swa_num_key_value_heads": 16,
90
+ "sliding_window_size": 512,
91
+ "n_routed_experts": 256,
92
+ "num_experts_per_tok": 6,
93
+ "n_shared_experts": 2,
94
+ "shared_expert_sink": true,
95
+ "dense_intermediate_size": 24576,
96
+ "intermediate_size": 3072,
97
+ "route_scale": 8.0,
98
+ "use_gate_bias": true,
99
+ "gate_activation": "sigmoid",
100
+ "norm_after_topk": true,
101
+ "use_global_scale": true
102
+ },
103
+ "audio_config": {
104
+ "decoder_dmodel": 6144,
105
+ "n_mel_bins": 80,
106
+ "mel_vocab_size": 16,
107
+ "bias": false,
108
+ "dmel_min_value": -7.0,
109
+ "dmel_max_value": 2.0,
110
+ "use_audio_norm": true,
111
+ "audio_mode": "dmel"
112
+ },
113
+ "vision_config": {
114
+ "vision_encoder_type": "hmlp",
115
+ "decoder_dmodel": 6144,
116
+ "patch_size": 40,
117
+ "temporal_patch_size": 2,
118
+ "n_channels": 3,
119
+ "n_layers": 4,
120
+ "use_vision_norm": true
121
+ },
122
+ "mtp_config": {
123
+ "num_nextn_predict_layers": 8,
124
+ "chain_hidden_post_norm": false,
125
+ "local_layer_ids": [
126
+ 0,
127
+ 2,
128
+ 4,
129
+ 5,
130
+ 6,
131
+ 7
132
+ ]
133
+ }
134
+ }
hf_quant_config.json ADDED
@@ -0,0 +1,578 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "quantization": {
3
+ "quant_algo": "NVFP4",
4
+ "kv_cache_quant_algo": "none",
5
+ "exclude_modules": [
6
+ "model.audio.encoder",
7
+ "model.audio.final_norm",
8
+ "model.llm.embed",
9
+ "model.llm.embed_norm",
10
+ "model.llm.norm",
11
+ "model.llm.unembed",
12
+ "model.visual.final_norm",
13
+ "model.visual.layers.linear_0",
14
+ "model.visual.layers.linear_1",
15
+ "model.visual.layers.linear_2",
16
+ "model.visual.layers.linear_3",
17
+ "model.visual.layers.norm_0",
18
+ "model.visual.layers.norm_1",
19
+ "model.visual.layers.norm_2",
20
+ "model.llm.layers.0.attn",
21
+ "model.llm.layers.0.attn_norm",
22
+ "model.llm.layers.0.attn_sconv",
23
+ "model.llm.layers.0.mlp.global_scale",
24
+ "model.llm.layers.0.mlp.w13_dn",
25
+ "model.llm.layers.0.mlp.w2_md",
26
+ "model.llm.layers.0.mlp_norm",
27
+ "model.llm.layers.0.mlp_sconv",
28
+ "model.llm.layers.1.attn",
29
+ "model.llm.layers.1.attn_norm",
30
+ "model.llm.layers.1.attn_sconv",
31
+ "model.llm.layers.1.mlp.global_scale",
32
+ "model.llm.layers.1.mlp.w13_dn",
33
+ "model.llm.layers.1.mlp.w2_md",
34
+ "model.llm.layers.1.mlp_norm",
35
+ "model.llm.layers.1.mlp_sconv",
36
+ "model.llm.layers.10.attn",
37
+ "model.llm.layers.10.attn_norm",
38
+ "model.llm.layers.10.attn_sconv",
39
+ "model.llm.layers.10.mlp.gate",
40
+ "model.llm.layers.10.mlp.shared_experts",
41
+ "model.llm.layers.10.mlp_norm",
42
+ "model.llm.layers.10.mlp_sconv",
43
+ "model.llm.layers.11.attn",
44
+ "model.llm.layers.11.attn_norm",
45
+ "model.llm.layers.11.attn_sconv",
46
+ "model.llm.layers.11.mlp.gate",
47
+ "model.llm.layers.11.mlp.shared_experts",
48
+ "model.llm.layers.11.mlp_norm",
49
+ "model.llm.layers.11.mlp_sconv",
50
+ "model.llm.layers.12.attn",
51
+ "model.llm.layers.12.attn_norm",
52
+ "model.llm.layers.12.attn_sconv",
53
+ "model.llm.layers.12.mlp.gate",
54
+ "model.llm.layers.12.mlp.shared_experts",
55
+ "model.llm.layers.12.mlp_norm",
56
+ "model.llm.layers.12.mlp_sconv",
57
+ "model.llm.layers.13.attn",
58
+ "model.llm.layers.13.attn_norm",
59
+ "model.llm.layers.13.attn_sconv",
60
+ "model.llm.layers.13.mlp.gate",
61
+ "model.llm.layers.13.mlp.shared_experts",
62
+ "model.llm.layers.13.mlp_norm",
63
+ "model.llm.layers.13.mlp_sconv",
64
+ "model.llm.layers.14.attn",
65
+ "model.llm.layers.14.attn_norm",
66
+ "model.llm.layers.14.attn_sconv",
67
+ "model.llm.layers.14.mlp.gate",
68
+ "model.llm.layers.14.mlp.shared_experts",
69
+ "model.llm.layers.14.mlp_norm",
70
+ "model.llm.layers.14.mlp_sconv",
71
+ "model.llm.layers.15.attn",
72
+ "model.llm.layers.15.attn_norm",
73
+ "model.llm.layers.15.attn_sconv",
74
+ "model.llm.layers.15.mlp.gate",
75
+ "model.llm.layers.15.mlp.shared_experts",
76
+ "model.llm.layers.15.mlp_norm",
77
+ "model.llm.layers.15.mlp_sconv",
78
+ "model.llm.layers.16.attn",
79
+ "model.llm.layers.16.attn_norm",
80
+ "model.llm.layers.16.attn_sconv",
81
+ "model.llm.layers.16.mlp.gate",
82
+ "model.llm.layers.16.mlp.shared_experts",
83
+ "model.llm.layers.16.mlp_norm",
84
+ "model.llm.layers.16.mlp_sconv",
85
+ "model.llm.layers.17.attn",
86
+ "model.llm.layers.17.attn_norm",
87
+ "model.llm.layers.17.attn_sconv",
88
+ "model.llm.layers.17.mlp.gate",
89
+ "model.llm.layers.17.mlp.shared_experts",
90
+ "model.llm.layers.17.mlp_norm",
91
+ "model.llm.layers.17.mlp_sconv",
92
+ "model.llm.layers.18.attn",
93
+ "model.llm.layers.18.attn_norm",
94
+ "model.llm.layers.18.attn_sconv",
95
+ "model.llm.layers.18.mlp.gate",
96
+ "model.llm.layers.18.mlp.shared_experts",
97
+ "model.llm.layers.18.mlp_norm",
98
+ "model.llm.layers.18.mlp_sconv",
99
+ "model.llm.layers.19.attn",
100
+ "model.llm.layers.19.attn_norm",
101
+ "model.llm.layers.19.attn_sconv",
102
+ "model.llm.layers.19.mlp.gate",
103
+ "model.llm.layers.19.mlp.shared_experts",
104
+ "model.llm.layers.19.mlp_norm",
105
+ "model.llm.layers.19.mlp_sconv",
106
+ "model.llm.layers.2.attn",
107
+ "model.llm.layers.2.attn_norm",
108
+ "model.llm.layers.2.attn_sconv",
109
+ "model.llm.layers.2.mlp.experts",
110
+ "model.llm.layers.2.mlp.gate",
111
+ "model.llm.layers.2.mlp.shared_experts",
112
+ "model.llm.layers.2.mlp_norm",
113
+ "model.llm.layers.2.mlp_sconv",
114
+ "model.llm.layers.20.attn",
115
+ "model.llm.layers.20.attn_norm",
116
+ "model.llm.layers.20.attn_sconv",
117
+ "model.llm.layers.20.mlp.gate",
118
+ "model.llm.layers.20.mlp.shared_experts",
119
+ "model.llm.layers.20.mlp_norm",
120
+ "model.llm.layers.20.mlp_sconv",
121
+ "model.llm.layers.21.attn",
122
+ "model.llm.layers.21.attn_norm",
123
+ "model.llm.layers.21.attn_sconv",
124
+ "model.llm.layers.21.mlp.gate",
125
+ "model.llm.layers.21.mlp.shared_experts",
126
+ "model.llm.layers.21.mlp_norm",
127
+ "model.llm.layers.21.mlp_sconv",
128
+ "model.llm.layers.22.attn",
129
+ "model.llm.layers.22.attn_norm",
130
+ "model.llm.layers.22.attn_sconv",
131
+ "model.llm.layers.22.mlp.gate",
132
+ "model.llm.layers.22.mlp.shared_experts",
133
+ "model.llm.layers.22.mlp_norm",
134
+ "model.llm.layers.22.mlp_sconv",
135
+ "model.llm.layers.23.attn",
136
+ "model.llm.layers.23.attn_norm",
137
+ "model.llm.layers.23.attn_sconv",
138
+ "model.llm.layers.23.mlp.gate",
139
+ "model.llm.layers.23.mlp.shared_experts",
140
+ "model.llm.layers.23.mlp_norm",
141
+ "model.llm.layers.23.mlp_sconv",
142
+ "model.llm.layers.24.attn",
143
+ "model.llm.layers.24.attn_norm",
144
+ "model.llm.layers.24.attn_sconv",
145
+ "model.llm.layers.24.mlp.gate",
146
+ "model.llm.layers.24.mlp.shared_experts",
147
+ "model.llm.layers.24.mlp_norm",
148
+ "model.llm.layers.24.mlp_sconv",
149
+ "model.llm.layers.25.attn",
150
+ "model.llm.layers.25.attn_norm",
151
+ "model.llm.layers.25.attn_sconv",
152
+ "model.llm.layers.25.mlp.gate",
153
+ "model.llm.layers.25.mlp.shared_experts",
154
+ "model.llm.layers.25.mlp_norm",
155
+ "model.llm.layers.25.mlp_sconv",
156
+ "model.llm.layers.26.attn",
157
+ "model.llm.layers.26.attn_norm",
158
+ "model.llm.layers.26.attn_sconv",
159
+ "model.llm.layers.26.mlp.gate",
160
+ "model.llm.layers.26.mlp.shared_experts",
161
+ "model.llm.layers.26.mlp_norm",
162
+ "model.llm.layers.26.mlp_sconv",
163
+ "model.llm.layers.27.attn",
164
+ "model.llm.layers.27.attn_norm",
165
+ "model.llm.layers.27.attn_sconv",
166
+ "model.llm.layers.27.mlp.gate",
167
+ "model.llm.layers.27.mlp.shared_experts",
168
+ "model.llm.layers.27.mlp_norm",
169
+ "model.llm.layers.27.mlp_sconv",
170
+ "model.llm.layers.28.attn",
171
+ "model.llm.layers.28.attn_norm",
172
+ "model.llm.layers.28.attn_sconv",
173
+ "model.llm.layers.28.mlp.gate",
174
+ "model.llm.layers.28.mlp.shared_experts",
175
+ "model.llm.layers.28.mlp_norm",
176
+ "model.llm.layers.28.mlp_sconv",
177
+ "model.llm.layers.29.attn",
178
+ "model.llm.layers.29.attn_norm",
179
+ "model.llm.layers.29.attn_sconv",
180
+ "model.llm.layers.29.mlp.gate",
181
+ "model.llm.layers.29.mlp.shared_experts",
182
+ "model.llm.layers.29.mlp_norm",
183
+ "model.llm.layers.29.mlp_sconv",
184
+ "model.llm.layers.3.attn",
185
+ "model.llm.layers.3.attn_norm",
186
+ "model.llm.layers.3.attn_sconv",
187
+ "model.llm.layers.3.mlp.gate",
188
+ "model.llm.layers.3.mlp.shared_experts",
189
+ "model.llm.layers.3.mlp_norm",
190
+ "model.llm.layers.3.mlp_sconv",
191
+ "model.llm.layers.30.attn",
192
+ "model.llm.layers.30.attn_norm",
193
+ "model.llm.layers.30.attn_sconv",
194
+ "model.llm.layers.30.mlp.gate",
195
+ "model.llm.layers.30.mlp.shared_experts",
196
+ "model.llm.layers.30.mlp_norm",
197
+ "model.llm.layers.30.mlp_sconv",
198
+ "model.llm.layers.31.attn",
199
+ "model.llm.layers.31.attn_norm",
200
+ "model.llm.layers.31.attn_sconv",
201
+ "model.llm.layers.31.mlp.gate",
202
+ "model.llm.layers.31.mlp.shared_experts",
203
+ "model.llm.layers.31.mlp_norm",
204
+ "model.llm.layers.31.mlp_sconv",
205
+ "model.llm.layers.32.attn",
206
+ "model.llm.layers.32.attn_norm",
207
+ "model.llm.layers.32.attn_sconv",
208
+ "model.llm.layers.32.mlp.gate",
209
+ "model.llm.layers.32.mlp.shared_experts",
210
+ "model.llm.layers.32.mlp_norm",
211
+ "model.llm.layers.32.mlp_sconv",
212
+ "model.llm.layers.33.attn",
213
+ "model.llm.layers.33.attn_norm",
214
+ "model.llm.layers.33.attn_sconv",
215
+ "model.llm.layers.33.mlp.gate",
216
+ "model.llm.layers.33.mlp.shared_experts",
217
+ "model.llm.layers.33.mlp_norm",
218
+ "model.llm.layers.33.mlp_sconv",
219
+ "model.llm.layers.34.attn",
220
+ "model.llm.layers.34.attn_norm",
221
+ "model.llm.layers.34.attn_sconv",
222
+ "model.llm.layers.34.mlp.gate",
223
+ "model.llm.layers.34.mlp.shared_experts",
224
+ "model.llm.layers.34.mlp_norm",
225
+ "model.llm.layers.34.mlp_sconv",
226
+ "model.llm.layers.35.attn",
227
+ "model.llm.layers.35.attn_norm",
228
+ "model.llm.layers.35.attn_sconv",
229
+ "model.llm.layers.35.mlp.gate",
230
+ "model.llm.layers.35.mlp.shared_experts",
231
+ "model.llm.layers.35.mlp_norm",
232
+ "model.llm.layers.35.mlp_sconv",
233
+ "model.llm.layers.36.attn",
234
+ "model.llm.layers.36.attn_norm",
235
+ "model.llm.layers.36.attn_sconv",
236
+ "model.llm.layers.36.mlp.gate",
237
+ "model.llm.layers.36.mlp.shared_experts",
238
+ "model.llm.layers.36.mlp_norm",
239
+ "model.llm.layers.36.mlp_sconv",
240
+ "model.llm.layers.37.attn",
241
+ "model.llm.layers.37.attn_norm",
242
+ "model.llm.layers.37.attn_sconv",
243
+ "model.llm.layers.37.mlp.gate",
244
+ "model.llm.layers.37.mlp.shared_experts",
245
+ "model.llm.layers.37.mlp_norm",
246
+ "model.llm.layers.37.mlp_sconv",
247
+ "model.llm.layers.38.attn",
248
+ "model.llm.layers.38.attn_norm",
249
+ "model.llm.layers.38.attn_sconv",
250
+ "model.llm.layers.38.mlp.gate",
251
+ "model.llm.layers.38.mlp.shared_experts",
252
+ "model.llm.layers.38.mlp_norm",
253
+ "model.llm.layers.38.mlp_sconv",
254
+ "model.llm.layers.39.attn",
255
+ "model.llm.layers.39.attn_norm",
256
+ "model.llm.layers.39.attn_sconv",
257
+ "model.llm.layers.39.mlp.gate",
258
+ "model.llm.layers.39.mlp.shared_experts",
259
+ "model.llm.layers.39.mlp_norm",
260
+ "model.llm.layers.39.mlp_sconv",
261
+ "model.llm.layers.4.attn",
262
+ "model.llm.layers.4.attn_norm",
263
+ "model.llm.layers.4.attn_sconv",
264
+ "model.llm.layers.4.mlp.gate",
265
+ "model.llm.layers.4.mlp.shared_experts",
266
+ "model.llm.layers.4.mlp_norm",
267
+ "model.llm.layers.4.mlp_sconv",
268
+ "model.llm.layers.40.attn",
269
+ "model.llm.layers.40.attn_norm",
270
+ "model.llm.layers.40.attn_sconv",
271
+ "model.llm.layers.40.mlp.gate",
272
+ "model.llm.layers.40.mlp.shared_experts",
273
+ "model.llm.layers.40.mlp_norm",
274
+ "model.llm.layers.40.mlp_sconv",
275
+ "model.llm.layers.41.attn",
276
+ "model.llm.layers.41.attn_norm",
277
+ "model.llm.layers.41.attn_sconv",
278
+ "model.llm.layers.41.mlp.gate",
279
+ "model.llm.layers.41.mlp.shared_experts",
280
+ "model.llm.layers.41.mlp_norm",
281
+ "model.llm.layers.41.mlp_sconv",
282
+ "model.llm.layers.42.attn",
283
+ "model.llm.layers.42.attn_norm",
284
+ "model.llm.layers.42.attn_sconv",
285
+ "model.llm.layers.42.mlp.gate",
286
+ "model.llm.layers.42.mlp.shared_experts",
287
+ "model.llm.layers.42.mlp_norm",
288
+ "model.llm.layers.42.mlp_sconv",
289
+ "model.llm.layers.43.attn",
290
+ "model.llm.layers.43.attn_norm",
291
+ "model.llm.layers.43.attn_sconv",
292
+ "model.llm.layers.43.mlp.gate",
293
+ "model.llm.layers.43.mlp.shared_experts",
294
+ "model.llm.layers.43.mlp_norm",
295
+ "model.llm.layers.43.mlp_sconv",
296
+ "model.llm.layers.44.attn",
297
+ "model.llm.layers.44.attn_norm",
298
+ "model.llm.layers.44.attn_sconv",
299
+ "model.llm.layers.44.mlp.gate",
300
+ "model.llm.layers.44.mlp.shared_experts",
301
+ "model.llm.layers.44.mlp_norm",
302
+ "model.llm.layers.44.mlp_sconv",
303
+ "model.llm.layers.45.attn",
304
+ "model.llm.layers.45.attn_norm",
305
+ "model.llm.layers.45.attn_sconv",
306
+ "model.llm.layers.45.mlp.gate",
307
+ "model.llm.layers.45.mlp.shared_experts",
308
+ "model.llm.layers.45.mlp_norm",
309
+ "model.llm.layers.45.mlp_sconv",
310
+ "model.llm.layers.46.attn",
311
+ "model.llm.layers.46.attn_norm",
312
+ "model.llm.layers.46.attn_sconv",
313
+ "model.llm.layers.46.mlp.gate",
314
+ "model.llm.layers.46.mlp.shared_experts",
315
+ "model.llm.layers.46.mlp_norm",
316
+ "model.llm.layers.46.mlp_sconv",
317
+ "model.llm.layers.47.attn",
318
+ "model.llm.layers.47.attn_norm",
319
+ "model.llm.layers.47.attn_sconv",
320
+ "model.llm.layers.47.mlp.gate",
321
+ "model.llm.layers.47.mlp.shared_experts",
322
+ "model.llm.layers.47.mlp_norm",
323
+ "model.llm.layers.47.mlp_sconv",
324
+ "model.llm.layers.48.attn",
325
+ "model.llm.layers.48.attn_norm",
326
+ "model.llm.layers.48.attn_sconv",
327
+ "model.llm.layers.48.mlp.gate",
328
+ "model.llm.layers.48.mlp.shared_experts",
329
+ "model.llm.layers.48.mlp_norm",
330
+ "model.llm.layers.48.mlp_sconv",
331
+ "model.llm.layers.49.attn",
332
+ "model.llm.layers.49.attn_norm",
333
+ "model.llm.layers.49.attn_sconv",
334
+ "model.llm.layers.49.mlp.gate",
335
+ "model.llm.layers.49.mlp.shared_experts",
336
+ "model.llm.layers.49.mlp_norm",
337
+ "model.llm.layers.49.mlp_sconv",
338
+ "model.llm.layers.5.attn",
339
+ "model.llm.layers.5.attn_norm",
340
+ "model.llm.layers.5.attn_sconv",
341
+ "model.llm.layers.5.mlp.gate",
342
+ "model.llm.layers.5.mlp.shared_experts",
343
+ "model.llm.layers.5.mlp_norm",
344
+ "model.llm.layers.5.mlp_sconv",
345
+ "model.llm.layers.50.attn",
346
+ "model.llm.layers.50.attn_norm",
347
+ "model.llm.layers.50.attn_sconv",
348
+ "model.llm.layers.50.mlp.gate",
349
+ "model.llm.layers.50.mlp.shared_experts",
350
+ "model.llm.layers.50.mlp_norm",
351
+ "model.llm.layers.50.mlp_sconv",
352
+ "model.llm.layers.51.attn",
353
+ "model.llm.layers.51.attn_norm",
354
+ "model.llm.layers.51.attn_sconv",
355
+ "model.llm.layers.51.mlp.gate",
356
+ "model.llm.layers.51.mlp.shared_experts",
357
+ "model.llm.layers.51.mlp_norm",
358
+ "model.llm.layers.51.mlp_sconv",
359
+ "model.llm.layers.52.attn",
360
+ "model.llm.layers.52.attn_norm",
361
+ "model.llm.layers.52.attn_sconv",
362
+ "model.llm.layers.52.mlp.gate",
363
+ "model.llm.layers.52.mlp.shared_experts",
364
+ "model.llm.layers.52.mlp_norm",
365
+ "model.llm.layers.52.mlp_sconv",
366
+ "model.llm.layers.53.attn",
367
+ "model.llm.layers.53.attn_norm",
368
+ "model.llm.layers.53.attn_sconv",
369
+ "model.llm.layers.53.mlp.gate",
370
+ "model.llm.layers.53.mlp.shared_experts",
371
+ "model.llm.layers.53.mlp_norm",
372
+ "model.llm.layers.53.mlp_sconv",
373
+ "model.llm.layers.54.attn",
374
+ "model.llm.layers.54.attn_norm",
375
+ "model.llm.layers.54.attn_sconv",
376
+ "model.llm.layers.54.mlp.gate",
377
+ "model.llm.layers.54.mlp.shared_experts",
378
+ "model.llm.layers.54.mlp_norm",
379
+ "model.llm.layers.54.mlp_sconv",
380
+ "model.llm.layers.55.attn",
381
+ "model.llm.layers.55.attn_norm",
382
+ "model.llm.layers.55.attn_sconv",
383
+ "model.llm.layers.55.mlp.gate",
384
+ "model.llm.layers.55.mlp.shared_experts",
385
+ "model.llm.layers.55.mlp_norm",
386
+ "model.llm.layers.55.mlp_sconv",
387
+ "model.llm.layers.56.attn",
388
+ "model.llm.layers.56.attn_norm",
389
+ "model.llm.layers.56.attn_sconv",
390
+ "model.llm.layers.56.mlp.gate",
391
+ "model.llm.layers.56.mlp.shared_experts",
392
+ "model.llm.layers.56.mlp_norm",
393
+ "model.llm.layers.56.mlp_sconv",
394
+ "model.llm.layers.57.attn",
395
+ "model.llm.layers.57.attn_norm",
396
+ "model.llm.layers.57.attn_sconv",
397
+ "model.llm.layers.57.mlp.gate",
398
+ "model.llm.layers.57.mlp.shared_experts",
399
+ "model.llm.layers.57.mlp_norm",
400
+ "model.llm.layers.57.mlp_sconv",
401
+ "model.llm.layers.58.attn",
402
+ "model.llm.layers.58.attn_norm",
403
+ "model.llm.layers.58.attn_sconv",
404
+ "model.llm.layers.58.mlp.gate",
405
+ "model.llm.layers.58.mlp.shared_experts",
406
+ "model.llm.layers.58.mlp_norm",
407
+ "model.llm.layers.58.mlp_sconv",
408
+ "model.llm.layers.59.attn",
409
+ "model.llm.layers.59.attn_norm",
410
+ "model.llm.layers.59.attn_sconv",
411
+ "model.llm.layers.59.mlp.gate",
412
+ "model.llm.layers.59.mlp.shared_experts",
413
+ "model.llm.layers.59.mlp_norm",
414
+ "model.llm.layers.59.mlp_sconv",
415
+ "model.llm.layers.6.attn",
416
+ "model.llm.layers.6.attn_norm",
417
+ "model.llm.layers.6.attn_sconv",
418
+ "model.llm.layers.6.mlp.gate",
419
+ "model.llm.layers.6.mlp.shared_experts",
420
+ "model.llm.layers.6.mlp_norm",
421
+ "model.llm.layers.6.mlp_sconv",
422
+ "model.llm.layers.60.attn",
423
+ "model.llm.layers.60.attn_norm",
424
+ "model.llm.layers.60.attn_sconv",
425
+ "model.llm.layers.60.mlp.gate",
426
+ "model.llm.layers.60.mlp.shared_experts",
427
+ "model.llm.layers.60.mlp_norm",
428
+ "model.llm.layers.60.mlp_sconv",
429
+ "model.llm.layers.61.attn",
430
+ "model.llm.layers.61.attn_norm",
431
+ "model.llm.layers.61.attn_sconv",
432
+ "model.llm.layers.61.mlp.gate",
433
+ "model.llm.layers.61.mlp.shared_experts",
434
+ "model.llm.layers.61.mlp_norm",
435
+ "model.llm.layers.61.mlp_sconv",
436
+ "model.llm.layers.62.attn",
437
+ "model.llm.layers.62.attn_norm",
438
+ "model.llm.layers.62.attn_sconv",
439
+ "model.llm.layers.62.mlp.gate",
440
+ "model.llm.layers.62.mlp.shared_experts",
441
+ "model.llm.layers.62.mlp_norm",
442
+ "model.llm.layers.62.mlp_sconv",
443
+ "model.llm.layers.63.attn",
444
+ "model.llm.layers.63.attn_norm",
445
+ "model.llm.layers.63.attn_sconv",
446
+ "model.llm.layers.63.mlp.gate",
447
+ "model.llm.layers.63.mlp.shared_experts",
448
+ "model.llm.layers.63.mlp_norm",
449
+ "model.llm.layers.63.mlp_sconv",
450
+ "model.llm.layers.64.attn",
451
+ "model.llm.layers.64.attn_norm",
452
+ "model.llm.layers.64.attn_sconv",
453
+ "model.llm.layers.64.mlp.gate",
454
+ "model.llm.layers.64.mlp.shared_experts",
455
+ "model.llm.layers.64.mlp_norm",
456
+ "model.llm.layers.64.mlp_sconv",
457
+ "model.llm.layers.65.attn",
458
+ "model.llm.layers.65.attn_norm",
459
+ "model.llm.layers.65.attn_sconv",
460
+ "model.llm.layers.65.mlp.gate",
461
+ "model.llm.layers.65.mlp.shared_experts",
462
+ "model.llm.layers.65.mlp_norm",
463
+ "model.llm.layers.65.mlp_sconv",
464
+ "model.llm.layers.7.attn",
465
+ "model.llm.layers.7.attn_norm",
466
+ "model.llm.layers.7.attn_sconv",
467
+ "model.llm.layers.7.mlp.gate",
468
+ "model.llm.layers.7.mlp.shared_experts",
469
+ "model.llm.layers.7.mlp_norm",
470
+ "model.llm.layers.7.mlp_sconv",
471
+ "model.llm.layers.8.attn",
472
+ "model.llm.layers.8.attn_norm",
473
+ "model.llm.layers.8.attn_sconv",
474
+ "model.llm.layers.8.mlp.gate",
475
+ "model.llm.layers.8.mlp.shared_experts",
476
+ "model.llm.layers.8.mlp_norm",
477
+ "model.llm.layers.8.mlp_sconv",
478
+ "model.llm.layers.9.attn",
479
+ "model.llm.layers.9.attn_norm",
480
+ "model.llm.layers.9.attn_sconv",
481
+ "model.llm.layers.9.mlp.gate",
482
+ "model.llm.layers.9.mlp.shared_experts",
483
+ "model.llm.layers.9.mlp_norm",
484
+ "model.llm.layers.9.mlp_sconv"
485
+ ],
486
+ "modelopt_quant_config": {
487
+ "quant_cfg": {
488
+ "*weight_quantizer": {
489
+ "num_bits": [
490
+ 2,
491
+ 1
492
+ ],
493
+ "block_sizes": {
494
+ "-1": 16,
495
+ "type": "dynamic",
496
+ "scale_bits": [
497
+ 4,
498
+ 3
499
+ ]
500
+ },
501
+ "axis": null,
502
+ "enable": true
503
+ },
504
+ "*input_quantizer": {
505
+ "num_bits": [
506
+ 2,
507
+ 1
508
+ ],
509
+ "block_sizes": {
510
+ "-1": 16,
511
+ "type": "dynamic",
512
+ "scale_bits": [
513
+ 4,
514
+ 3
515
+ ]
516
+ },
517
+ "axis": null,
518
+ "enable": true
519
+ },
520
+ "nn.BatchNorm1d": {
521
+ "*": {
522
+ "enable": false
523
+ }
524
+ },
525
+ "nn.BatchNorm2d": {
526
+ "*": {
527
+ "enable": false
528
+ }
529
+ },
530
+ "nn.BatchNorm3d": {
531
+ "*": {
532
+ "enable": false
533
+ }
534
+ },
535
+ "nn.LeakyReLU": {
536
+ "*": {
537
+ "enable": false
538
+ }
539
+ },
540
+ "*lm_head*": {
541
+ "enable": false
542
+ },
543
+ "*proj_out.*": {
544
+ "enable": false
545
+ },
546
+ "*block_sparse_moe.gate*": {
547
+ "enable": false
548
+ },
549
+ "*router*": {
550
+ "enable": false
551
+ },
552
+ "*mlp.gate.*": {
553
+ "enable": false
554
+ },
555
+ "*mlp.shared_expert_gate.*": {
556
+ "enable": false
557
+ },
558
+ "*linear_attn.conv1d*": {
559
+ "enable": false
560
+ },
561
+ "*mixer.conv1d*": {
562
+ "enable": false
563
+ },
564
+ "*output_layer*": {
565
+ "enable": false
566
+ },
567
+ "output.*": {
568
+ "enable": false
569
+ },
570
+ "default": {
571
+ "enable": false
572
+ }
573
+ },
574
+ "algorithm": "max"
575
+ },
576
+ "group_size": 16
577
+ }
578
+ }
model-00001-of-00033.safetensors ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:d23be7ca189d3474217ab8063d0153e44b04eedb9b7854db74dc0f24e4979538
3
+ size 19116985342
model-00002-of-00033.safetensors ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:41b33ae960764a81d5b401cca3edf4c1beed9b9a8bb35e032dc8fdf3ad5cfbb4
3
+ size 19974331454
model-00003-of-00033.safetensors ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:fe781903b1bb876b77831fbaafd485831a97db6d878d95fd176282eaf42df303
3
+ size 19167394188
model-00004-of-00033.safetensors ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:cfd2beda8c08d0c2f3f4204f982879672a67cde4ba183d082cc6df238f592f55
3
+ size 15696646890
model-00005-of-00033.safetensors ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:b19b96fb7acec0e01286c63ffadbd258486d8044ae252c7af2d4b5785aa21ebc
3
+ size 17858589788
model-00006-of-00033.safetensors ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:e718c10c7770562f87cc15bb40488a37f5ec856d3536267fc962056f0d2ed293
3
+ size 19944324836
model-00007-of-00033.safetensors ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:74fc6ed7fec4e97d7c370dac0b565d43b2b9f4c043e8770118141cfaf35c83ed
3
+ size 19208103526
model-00008-of-00033.safetensors ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:e47c3b0b413c96a00dbc3b7e1bab610685addab8471f0e48952ddac0bc26af48
3
+ size 19950824732
model-00009-of-00033.safetensors ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:d07c90536ed495b7fac18a2a2602058b85eb93dfe88f74639927af056c62689f
3
+ size 18726640016
model-00010-of-00033.safetensors ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:1fcc29248d304d52ab894e76b904c15005f5dae87e5db4188b9220a3637c2fd7
3
+ size 19997716432
model-00011-of-00033.safetensors ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:6acd555f7925e4330bf38b091f5cf67836a5611f3f8142afc7e99ed6aaa7ae5a
3
+ size 19503730654
model-00012-of-00033.safetensors ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:86d80117e4deb8f2947c53ddc5ab35d361bb8759ad36dcdc4f1de5635aed4f46
3
+ size 15632104382
model-00013-of-00033.safetensors ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:13307919a112b12452ebc78ab53b5d1ad32d82f0867e6c305f1b85aebca65676
3
+ size 18122786004
model-00014-of-00033.safetensors ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:554ea1d6bf0b84772cd0dd1d36487b7eb081528dcc79bab6ab3cba36d740a2df
3
+ size 18000161310
model-00015-of-00033.safetensors ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:9f93de27a3928b3beb5b58bb0d00d33be91ce60ce090ede27fa29c95b4c94872
3
+ size 19849789206
model-00016-of-00033.safetensors ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:e0f295b3871fe4aa9be4873c11f645dd80b18be52ae6d316253448f51cb7eda1
3
+ size 19579605120
model-00017-of-00033.safetensors ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:9373b84f05de768a6bf98c1942c016f8b0129090b0570f61dc2b6daab7777e9b
3
+ size 18349586234
model-00018-of-00033.safetensors ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:75dae1981cd64811ecd65d438e17ccbbdf218c3664e343a2b2de8d46d59de962
3
+ size 19542373784
model-00019-of-00033.safetensors ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:d6302d4e1c1d85de690147b90521225620c9e86bf477d7f4f0f10921d466cf9b
3
+ size 15483680186
model-00020-of-00033.safetensors ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:c1e547007ec0dbc44f0972666698ceb7fd71b2b2c4c0d0016c0431f00245f8d8
3
+ size 19255845282
model-00021-of-00033.safetensors ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:10ad49ad1a9f85624af04006bb16354027c6c21c7689a8602aff1487956a0e40
3
+ size 16632058036
model-00022-of-00033.safetensors ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:52e84a65712cb045151603cec3633f6ab1ffd4c4d2584aba9bc2fdef1354f7c4
3
+ size 17755343330
model-00023-of-00033.safetensors ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:3aaf8a3bba4c8206cb2f51011a33e46eae5063446317edf9e5edf50c8d80389f
3
+ size 17842745792
model-00024-of-00033.safetensors ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:9b889e3657ce1d7f8b634eb73c7e9fef75492cbcb8206ade2b1de0266590e29c
3
+ size 16021544096
model-00025-of-00033.safetensors ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:8d7577d69d5c304bd98f8ac1edc7c68fcb82d807f840ec9ace23ba2cc9a96473
3
+ size 19384613910
model-00026-of-00033.safetensors ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:f00eb775e4d28ec500fbba497ca5b6b862a881545f4fcc5acfc1aeae5cac2386
3
+ size 19126417732
model-00027-of-00033.safetensors ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:22006739079defafd8bd3abf574f7161842f6c53cd45e3a9f7dbf5dd51b8885e
3
+ size 18252708640
model-00028-of-00033.safetensors ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:16fcb85bb6b1841a43c0c242d5192ec6297c5c5acb5637951af21c3a54e248e8
3
+ size 19645387122
model-00029-of-00033.safetensors ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:a37f89d8436040f16473caa70677b71a4808bdc31dac357d1e7543a3f5bbec85
3
+ size 19871788438
model-00030-of-00033.safetensors ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:4afa6d80ea00e395067a54c50a0498a345d6aed1c51adba4d19291f5e15ae722
3
+ size 1224040074
model-00031-of-00033.safetensors ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:a15ba82145814f6186bda48484ef09adef7c3fc7babf740d6c50a6dab395a76b
3
+ size 19352518936
model-00032-of-00033.safetensors ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:91a6e0d6613ea5051cb2e69c3d2cba9d41222d2b991b0b7f95929e6ee081ebda
3
+ size 18582473448
model-00033-of-00033.safetensors ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:de00ac84eb647e310675cf9eacd84919e732e272cb9e7b356cf93c5799666993
3
+ size 4831838368
model.safetensors.index.json ADDED
The diff for this file is too large to render. See raw diff
 
mtp.safetensors ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:a0a01bf72ac48c3d7bfd56d5c1efbc955f00f51db30eb0955996680d8e595cc0
3
+ size 10520911944
processor_config.json ADDED
@@ -0,0 +1,46 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "audio_token": "<|unused_200053|>",
3
+ "audio_bos_token": "<|content_audio_input|>",
4
+ "dmel_max_value": 2.0,
5
+ "dmel_min_value": -7.0,
6
+ "feature_extractor": {
7
+ "audio_token_duration_s": 0.05,
8
+ "feature_extractor_type": "InklingFeatureExtractor",
9
+ "feature_size": 80,
10
+ "hop_length": 800,
11
+ "n_fft": 1600,
12
+ "padding_side": "right",
13
+ "padding_value": 0.0,
14
+ "return_attention_mask": true,
15
+ "sampling_rate": 16000,
16
+ "window_size": 1600,
17
+ "window_size_multiplier": 2.0
18
+ },
19
+ "image_processor": {
20
+ "do_convert_rgb": true,
21
+ "do_normalize": true,
22
+ "do_rescale": true,
23
+ "do_resize": true,
24
+ "image_mean": [
25
+ 0.48145466,
26
+ 0.4578275,
27
+ 0.40821073
28
+ ],
29
+ "image_processor_type": "InklingImageProcessor",
30
+ "image_std": [
31
+ 0.26862954,
32
+ 0.26130258,
33
+ 0.27577711
34
+ ],
35
+ "resample": 3,
36
+ "rescale_factor": 0.00392156862745098,
37
+ "size": {
38
+ "height": 40,
39
+ "width": 40
40
+ }
41
+ },
42
+ "image_token": "<|unused_200054|>",
43
+ "image_bos_token": "<|content_image|>",
44
+ "num_dmel_bins": 16,
45
+ "processor_class": "InklingProcessor"
46
+ }
special_tokens_map.json ADDED
@@ -0,0 +1,22 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "additional_special_tokens": [
3
+ "<|endoftext|>",
4
+ "<|message_user|>",
5
+ "<|message_model|>",
6
+ "<|message_system|>",
7
+ "<|message_tool|>",
8
+ "<|content_text|>",
9
+ "<|content_image|>",
10
+ "<|content_model_end_sampling|>",
11
+ "<|content_thinking|>",
12
+ "<|end_message|>",
13
+ "<|content_audio_input|>",
14
+ "<|content_tool_error|>",
15
+ "<|audio|>",
16
+ "<|content_xml|>",
17
+ "<|begin_of_text|>",
18
+ "<|audio_end|>",
19
+ "<|content_invoke_tool_json|>",
20
+ "<|content_invoke_tool_text|>"
21
+ ]
22
+ }
tiktoken/tokenizer.model ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:bc253fd2b702f7a6da7105eaa8f3463b2f1247e83614f23e5323b921088bed2a
3
+ size 3615874
tokenizer.json ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:9fb6333a7db8fe5da90728e741e4a3ee4ac2ae12c5dd4958cc6f31688787d3c2
3
+ size 27875797
tokenizer_config.json ADDED
@@ -0,0 +1,508 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "added_tokens_decoder": {
3
+ "199998": {
4
+ "content": "<|unused|>",
5
+ "single_word": false,
6
+ "lstrip": false,
7
+ "rstrip": false,
8
+ "normalized": false,
9
+ "special": true
10
+ },
11
+ "199999": {
12
+ "content": "<|endoftext|>",
13
+ "single_word": false,
14
+ "lstrip": false,
15
+ "rstrip": false,
16
+ "normalized": false,
17
+ "special": true
18
+ },
19
+ "200000": {
20
+ "content": "<|message_user|>",
21
+ "single_word": false,
22
+ "lstrip": false,
23
+ "rstrip": false,
24
+ "normalized": false,
25
+ "special": true
26
+ },
27
+ "200001": {
28
+ "content": "<|message_model|>",
29
+ "single_word": false,
30
+ "lstrip": false,
31
+ "rstrip": false,
32
+ "normalized": false,
33
+ "special": true
34
+ },
35
+ "200002": {
36
+ "content": "<|message_system|>",
37
+ "single_word": false,
38
+ "lstrip": false,
39
+ "rstrip": false,
40
+ "normalized": false,
41
+ "special": true
42
+ },
43
+ "200003": {
44
+ "content": "<|message_tool|>",
45
+ "single_word": false,
46
+ "lstrip": false,
47
+ "rstrip": false,
48
+ "normalized": false,
49
+ "special": true
50
+ },
51
+ "200004": {
52
+ "content": "<|content_text|>",
53
+ "single_word": false,
54
+ "lstrip": false,
55
+ "rstrip": false,
56
+ "normalized": false,
57
+ "special": true
58
+ },
59
+ "200005": {
60
+ "content": "<|content_image|>",
61
+ "single_word": false,
62
+ "lstrip": false,
63
+ "rstrip": false,
64
+ "normalized": false,
65
+ "special": true
66
+ },
67
+ "200006": {
68
+ "content": "<|content_model_end_sampling|>",
69
+ "single_word": false,
70
+ "lstrip": false,
71
+ "rstrip": false,
72
+ "normalized": false,
73
+ "special": true
74
+ },
75
+ "200007": {
76
+ "content": "<|unused_200007|>",
77
+ "single_word": false,
78
+ "lstrip": false,
79
+ "rstrip": false,
80
+ "normalized": false,
81
+ "special": true
82
+ },
83
+ "200008": {
84
+ "content": "<|content_thinking|>",
85
+ "single_word": false,
86
+ "lstrip": false,
87
+ "rstrip": false,
88
+ "normalized": false,
89
+ "special": true
90
+ },
91
+ "200009": {
92
+ "content": "<|unused_200009|>",
93
+ "single_word": false,
94
+ "lstrip": false,
95
+ "rstrip": false,
96
+ "normalized": false,
97
+ "special": true
98
+ },
99
+ "200010": {
100
+ "content": "<|end_message|>",
101
+ "single_word": false,
102
+ "lstrip": false,
103
+ "rstrip": false,
104
+ "normalized": false,
105
+ "special": true
106
+ },
107
+ "200011": {
108
+ "content": "<|unused_200011|>",
109
+ "single_word": false,
110
+ "lstrip": false,
111
+ "rstrip": false,
112
+ "normalized": false,
113
+ "special": true
114
+ },
115
+ "200012": {
116
+ "content": "<|unused_200012|>",
117
+ "single_word": false,
118
+ "lstrip": false,
119
+ "rstrip": false,
120
+ "normalized": false,
121
+ "special": true
122
+ },
123
+ "200013": {
124
+ "content": "<|unused_200013|>",
125
+ "single_word": false,
126
+ "lstrip": false,
127
+ "rstrip": false,
128
+ "normalized": false,
129
+ "special": true
130
+ },
131
+ "200014": {
132
+ "content": "<|unused_200014|>",
133
+ "single_word": false,
134
+ "lstrip": false,
135
+ "rstrip": false,
136
+ "normalized": false,
137
+ "special": true
138
+ },
139
+ "200015": {
140
+ "content": "<|unused_200015|>",
141
+ "single_word": false,
142
+ "lstrip": false,
143
+ "rstrip": false,
144
+ "normalized": false,
145
+ "special": true
146
+ },
147
+ "200016": {
148
+ "content": "<|unused_200016|>",
149
+ "single_word": false,
150
+ "lstrip": false,
151
+ "rstrip": false,
152
+ "normalized": false,
153
+ "special": true
154
+ },
155
+ "200017": {
156
+ "content": "<|unused_200017|>",
157
+ "single_word": false,
158
+ "lstrip": false,
159
+ "rstrip": false,
160
+ "normalized": false,
161
+ "special": true
162
+ },
163
+ "200018": {
164
+ "content": "<|unused_200018|>",
165
+ "single_word": false,
166
+ "lstrip": false,
167
+ "rstrip": false,
168
+ "normalized": false,
169
+ "special": true
170
+ },
171
+ "200019": {
172
+ "content": "<|unused_200019|>",
173
+ "single_word": false,
174
+ "lstrip": false,
175
+ "rstrip": false,
176
+ "normalized": false,
177
+ "special": true
178
+ },
179
+ "200020": {
180
+ "content": "<|content_audio_input|>",
181
+ "single_word": false,
182
+ "lstrip": false,
183
+ "rstrip": false,
184
+ "normalized": false,
185
+ "special": true
186
+ },
187
+ "200021": {
188
+ "content": "<|unused_200021|>",
189
+ "single_word": false,
190
+ "lstrip": false,
191
+ "rstrip": false,
192
+ "normalized": false,
193
+ "special": true
194
+ },
195
+ "200022": {
196
+ "content": "<|content_tool_error|>",
197
+ "single_word": false,
198
+ "lstrip": false,
199
+ "rstrip": false,
200
+ "normalized": false,
201
+ "special": true
202
+ },
203
+ "200023": {
204
+ "content": "<|audio|>",
205
+ "single_word": false,
206
+ "lstrip": false,
207
+ "rstrip": false,
208
+ "normalized": false,
209
+ "special": true
210
+ },
211
+ "200024": {
212
+ "content": "<|content_xml|>",
213
+ "single_word": false,
214
+ "lstrip": false,
215
+ "rstrip": false,
216
+ "normalized": false,
217
+ "special": true
218
+ },
219
+ "200025": {
220
+ "content": "<|unused_200025|>",
221
+ "single_word": false,
222
+ "lstrip": false,
223
+ "rstrip": false,
224
+ "normalized": false,
225
+ "special": true
226
+ },
227
+ "200026": {
228
+ "content": "<|unused_200026|>",
229
+ "single_word": false,
230
+ "lstrip": false,
231
+ "rstrip": false,
232
+ "normalized": false,
233
+ "special": true
234
+ },
235
+ "200027": {
236
+ "content": "<|unused_200027|>",
237
+ "single_word": false,
238
+ "lstrip": false,
239
+ "rstrip": false,
240
+ "normalized": false,
241
+ "special": true
242
+ },
243
+ "200028": {
244
+ "content": "<|begin_of_text|>",
245
+ "single_word": false,
246
+ "lstrip": false,
247
+ "rstrip": false,
248
+ "normalized": false,
249
+ "special": true
250
+ },
251
+ "200029": {
252
+ "content": "<|unused_200029|>",
253
+ "single_word": false,
254
+ "lstrip": false,
255
+ "rstrip": false,
256
+ "normalized": false,
257
+ "special": true
258
+ },
259
+ "200030": {
260
+ "content": "<|unused_200030|>",
261
+ "single_word": false,
262
+ "lstrip": false,
263
+ "rstrip": false,
264
+ "normalized": false,
265
+ "special": true
266
+ },
267
+ "200031": {
268
+ "content": "<|unused_200031|>",
269
+ "single_word": false,
270
+ "lstrip": false,
271
+ "rstrip": false,
272
+ "normalized": false,
273
+ "special": true
274
+ },
275
+ "200032": {
276
+ "content": "<|unused_200032|>",
277
+ "single_word": false,
278
+ "lstrip": false,
279
+ "rstrip": false,
280
+ "normalized": false,
281
+ "special": true
282
+ },
283
+ "200033": {
284
+ "content": "<|unused_200033|>",
285
+ "single_word": false,
286
+ "lstrip": false,
287
+ "rstrip": false,
288
+ "normalized": false,
289
+ "special": true
290
+ },
291
+ "200034": {
292
+ "content": "<|unused_200034|>",
293
+ "single_word": false,
294
+ "lstrip": false,
295
+ "rstrip": false,
296
+ "normalized": false,
297
+ "special": true
298
+ },
299
+ "200035": {
300
+ "content": "<|unused_200035|>",
301
+ "single_word": false,
302
+ "lstrip": false,
303
+ "rstrip": false,
304
+ "normalized": false,
305
+ "special": true
306
+ },
307
+ "200036": {
308
+ "content": "<|unused_200036|>",
309
+ "single_word": false,
310
+ "lstrip": false,
311
+ "rstrip": false,
312
+ "normalized": false,
313
+ "special": true
314
+ },
315
+ "200037": {
316
+ "content": "<|unused_200037|>",
317
+ "single_word": false,
318
+ "lstrip": false,
319
+ "rstrip": false,
320
+ "normalized": false,
321
+ "special": true
322
+ },
323
+ "200038": {
324
+ "content": "<|unused_200038|>",
325
+ "single_word": false,
326
+ "lstrip": false,
327
+ "rstrip": false,
328
+ "normalized": false,
329
+ "special": true
330
+ },
331
+ "200039": {
332
+ "content": "<|unused_200039|>",
333
+ "single_word": false,
334
+ "lstrip": false,
335
+ "rstrip": false,
336
+ "normalized": false,
337
+ "special": true
338
+ },
339
+ "200040": {
340
+ "content": "<|unused_200040|>",
341
+ "single_word": false,
342
+ "lstrip": false,
343
+ "rstrip": false,
344
+ "normalized": false,
345
+ "special": true
346
+ },
347
+ "200041": {
348
+ "content": "<|unused_200041|>",
349
+ "single_word": false,
350
+ "lstrip": false,
351
+ "rstrip": false,
352
+ "normalized": false,
353
+ "special": true
354
+ },
355
+ "200042": {
356
+ "content": "<|unused_200042|>",
357
+ "single_word": false,
358
+ "lstrip": false,
359
+ "rstrip": false,
360
+ "normalized": false,
361
+ "special": true
362
+ },
363
+ "200043": {
364
+ "content": "<|audio_end|>",
365
+ "single_word": false,
366
+ "lstrip": false,
367
+ "rstrip": false,
368
+ "normalized": false,
369
+ "special": true
370
+ },
371
+ "200044": {
372
+ "content": "<|unused_200044|>",
373
+ "single_word": false,
374
+ "lstrip": false,
375
+ "rstrip": false,
376
+ "normalized": false,
377
+ "special": true
378
+ },
379
+ "200045": {
380
+ "content": "<|unused_200045|>",
381
+ "single_word": false,
382
+ "lstrip": false,
383
+ "rstrip": false,
384
+ "normalized": false,
385
+ "special": true
386
+ },
387
+ "200046": {
388
+ "content": "<|unused_200046|>",
389
+ "single_word": false,
390
+ "lstrip": false,
391
+ "rstrip": false,
392
+ "normalized": false,
393
+ "special": true
394
+ },
395
+ "200047": {
396
+ "content": "<|unused_200047|>",
397
+ "single_word": false,
398
+ "lstrip": false,
399
+ "rstrip": false,
400
+ "normalized": false,
401
+ "special": true
402
+ },
403
+ "200048": {
404
+ "content": "<|unused_200048|>",
405
+ "single_word": false,
406
+ "lstrip": false,
407
+ "rstrip": false,
408
+ "normalized": false,
409
+ "special": true
410
+ },
411
+ "200049": {
412
+ "content": "<|content_invoke_tool_json|>",
413
+ "single_word": false,
414
+ "lstrip": false,
415
+ "rstrip": false,
416
+ "normalized": false,
417
+ "special": true
418
+ },
419
+ "200050": {
420
+ "content": "<|unused_200050|>",
421
+ "single_word": false,
422
+ "lstrip": false,
423
+ "rstrip": false,
424
+ "normalized": false,
425
+ "special": true
426
+ },
427
+ "200051": {
428
+ "content": "<|unused_200051|>",
429
+ "single_word": false,
430
+ "lstrip": false,
431
+ "rstrip": false,
432
+ "normalized": false,
433
+ "special": true
434
+ },
435
+ "200052": {
436
+ "content": "<|unused_200052|>",
437
+ "single_word": false,
438
+ "lstrip": false,
439
+ "rstrip": false,
440
+ "normalized": false,
441
+ "special": true
442
+ },
443
+ "200053": {
444
+ "content": "<|unused_200053|>",
445
+ "single_word": false,
446
+ "lstrip": false,
447
+ "rstrip": false,
448
+ "normalized": false,
449
+ "special": true
450
+ },
451
+ "200054": {
452
+ "content": "<|unused_200054|>",
453
+ "single_word": false,
454
+ "lstrip": false,
455
+ "rstrip": false,
456
+ "normalized": false,
457
+ "special": true
458
+ },
459
+ "200055": {
460
+ "content": "<|unused_200055|>",
461
+ "single_word": false,
462
+ "lstrip": false,
463
+ "rstrip": false,
464
+ "normalized": false,
465
+ "special": true
466
+ },
467
+ "200056": {
468
+ "content": "<|unused_200056|>",
469
+ "single_word": false,
470
+ "lstrip": false,
471
+ "rstrip": false,
472
+ "normalized": false,
473
+ "special": true
474
+ },
475
+ "200057": {
476
+ "content": "<|content_invoke_tool_text|>",
477
+ "single_word": false,
478
+ "lstrip": false,
479
+ "rstrip": false,
480
+ "normalized": false,
481
+ "special": true
482
+ }
483
+ },
484
+ "clean_up_tokenization_spaces": false,
485
+ "fix_mistral_regex": false,
486
+ "extra_special_tokens": {
487
+ "endoftext": "<|endoftext|>",
488
+ "message_user": "<|message_user|>",
489
+ "message_model": "<|message_model|>",
490
+ "message_system": "<|message_system|>",
491
+ "message_tool": "<|message_tool|>",
492
+ "content_text": "<|content_text|>",
493
+ "content_image": "<|content_image|>",
494
+ "content_model_end_sampling": "<|content_model_end_sampling|>",
495
+ "content_thinking": "<|content_thinking|>",
496
+ "end_message": "<|end_message|>",
497
+ "content_audio_input": "<|content_audio_input|>",
498
+ "content_tool_error": "<|content_tool_error|>",
499
+ "audio": "<|audio|>",
500
+ "content_xml": "<|content_xml|>",
501
+ "begin_of_text": "<|begin_of_text|>",
502
+ "audio_end": "<|audio_end|>",
503
+ "content_invoke_tool_json": "<|content_invoke_tool_json|>",
504
+ "content_invoke_tool_text": "<|content_invoke_tool_text|>"
505
+ },
506
+ "model_max_length": 1000000000000000019884624838656,
507
+ "tokenizer_class": "PreTrainedTokenizerFast"
508
+ }