Image-Text-to-Text
MLX
Safetensors
English
qwen3_5
mlx-vlm
mxfp8
nvfp4
mixed-precision
multimodal
vision
video
text-generation
mtp
speculative-decoding
conversational
4-bit precision
Instructions to use airagrp/Qwen3.8-27B-mlx-nvfp4-L with libraries, inference providers, notebooks, and local apps. Follow these links to get started.
- Libraries
- MLX
How to use airagrp/Qwen3.8-27B-mlx-nvfp4-L with MLX:
# Make sure mlx-vlm is installed # pip install --upgrade mlx-vlm from mlx_vlm import load, generate from mlx_vlm.prompt_utils import apply_chat_template from mlx_vlm.utils import load_config # Load the model model, processor = load("airagrp/Qwen3.8-27B-mlx-nvfp4-L") config = load_config("airagrp/Qwen3.8-27B-mlx-nvfp4-L") # Prepare input image = ["http://images.cocodataset.org/val2017/000000039769.jpg"] prompt = "Describe this image." # Apply chat template formatted_prompt = apply_chat_template( processor, config, prompt, num_images=1 ) # Generate output output = generate(model, processor, formatted_prompt, image) print(output) - Notebooks
- Google Colab
- Kaggle
- Local Apps Settings
- LM Studio
- Pi
How to use airagrp/Qwen3.8-27B-mlx-nvfp4-L with Pi:
Start the MLX server
# Install MLX LM: uv tool install mlx-lm # Start a local OpenAI-compatible server: mlx_lm.server --model "airagrp/Qwen3.8-27B-mlx-nvfp4-L"
Configure the model in Pi
# Install Pi: npm install -g @earendil-works/pi-coding-agent # Add to ~/.pi/agent/models.json: { "providers": { "mlx-lm": { "baseUrl": "http://localhost:8080/v1", "api": "openai-completions", "apiKey": "none", "models": [ { "id": "airagrp/Qwen3.8-27B-mlx-nvfp4-L" } ] } } }Run Pi
# Start Pi in your project directory: pi
- Hermes Agent
How to use airagrp/Qwen3.8-27B-mlx-nvfp4-L with Hermes Agent:
Start the MLX server
# Install MLX LM: uv tool install mlx-lm # Start a local OpenAI-compatible server: mlx_lm.server --model "airagrp/Qwen3.8-27B-mlx-nvfp4-L"
Configure Hermes
# Install Hermes: curl -fsSL https://hermes-agent.nousresearch.com/install.sh | bash hermes setup # Point Hermes at the local server: hermes config set model.provider custom hermes config set model.base_url http://127.0.0.1:8080/v1 hermes config set model.default airagrp/Qwen3.8-27B-mlx-nvfp4-L
Run Hermes
hermes
- Atomic Chat
- OpenClaw
How to use airagrp/Qwen3.8-27B-mlx-nvfp4-L with OpenClaw:
Start the MLX server
# Install MLX LM: uv tool install mlx-lm # Start a local OpenAI-compatible server: mlx_lm.server --model "airagrp/Qwen3.8-27B-mlx-nvfp4-L"
Configure OpenClaw
# Install OpenClaw: npm install -g openclaw@latest # Register the local server and set it as the default model: openclaw onboard --non-interactive --mode local \ --auth-choice custom-api-key \ --custom-base-url http://127.0.0.1:8080/v1 \ --custom-model-id "airagrp/Qwen3.8-27B-mlx-nvfp4-L" \ --custom-provider-id mlx-lm \ --custom-compatibility openai \ --custom-text-input \ --accept-risk \ --skip-health
Run OpenClaw
openclaw agent --local --agent main --message "Hello from Hugging Face"
mixed mxfp8/nvfp4/bf16 MLX conversion of Qwen/Qwen3.8-27B (mlx-vlm 0.6.17)
Browse files- README.md +1 -1
- model-00001-of-00005.safetensors +2 -2
- model-00002-of-00005.safetensors +2 -2
- model-00003-of-00005.safetensors +2 -2
- model-00004-of-00005.safetensors +2 -2
- model.safetensors.index.json +103 -157
README.md
CHANGED
|
@@ -32,7 +32,7 @@ This repository contains [`Qwen/Qwen3.8-27B`](https://huggingface.co/Qwen/Qwen3.
|
|
| 32 |
| MTP head | bfloat16 |
|
| 33 |
| Vision tower | bfloat16 |
|
| 34 |
|
| 35 |
-
- Effective size: ~24 GB (7.
|
| 36 |
- Quantized modules: mxfp8 (group_size=32, bits=8) / nvfp4 (group_size=16, bits=4); bfloat16 modules are stored as-is. Per-module precision is detected from the presence of `.scales` tensors.
|
| 37 |
|
| 38 |
## MTP
|
|
|
|
| 32 |
| MTP head | bfloat16 |
|
| 33 |
| Vision tower | bfloat16 |
|
| 34 |
|
| 35 |
+
- Effective size: ~24 GB (7.9 bits per weight), base model is ~54 GB in bfloat16.
|
| 36 |
- Quantized modules: mxfp8 (group_size=32, bits=8) / nvfp4 (group_size=16, bits=4); bfloat16 modules are stored as-is. Per-module precision is detected from the presence of `.scales` tensors.
|
| 37 |
|
| 38 |
## MTP
|
model-00001-of-00005.safetensors
CHANGED
|
@@ -1,3 +1,3 @@
|
|
| 1 |
version https://git-lfs.github.com/spec/v1
|
| 2 |
-
oid sha256:
|
| 3 |
-
size
|
|
|
|
| 1 |
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:3ee3e79fa11d98687022b62cc0892a92a477325e219ea1e027c74d167815d4a5
|
| 3 |
+
size 5342651393
|
model-00002-of-00005.safetensors
CHANGED
|
@@ -1,3 +1,3 @@
|
|
| 1 |
version https://git-lfs.github.com/spec/v1
|
| 2 |
-
oid sha256:
|
| 3 |
-
size
|
|
|
|
| 1 |
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:08720813d66efcec558bff958cc5a35427aec64dd719571ce7df952dd02e0db4
|
| 3 |
+
size 5342300272
|
model-00003-of-00005.safetensors
CHANGED
|
@@ -1,3 +1,3 @@
|
|
| 1 |
version https://git-lfs.github.com/spec/v1
|
| 2 |
-
oid sha256:
|
| 3 |
-
size
|
|
|
|
| 1 |
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:95f201102f6c75c068c43d5f9fc733541da308105875c5c5c0d4cf38e73d40e5
|
| 3 |
+
size 5342300284
|
model-00004-of-00005.safetensors
CHANGED
|
@@ -1,3 +1,3 @@
|
|
| 1 |
version https://git-lfs.github.com/spec/v1
|
| 2 |
-
oid sha256:
|
| 3 |
-
size
|
|
|
|
| 1 |
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:3562fdbe5643e6af37d696b2b0b9c20fde830853c14e68075ad2daba3e24b445
|
| 3 |
+
size 4532413904
|
model.safetensors.index.json
CHANGED
|
@@ -1,6 +1,6 @@
|
|
| 1 |
{
|
| 2 |
"metadata": {
|
| 3 |
-
"total_size":
|
| 4 |
},
|
| 5 |
"weight_map": {
|
| 6 |
"language_model.lm_head.weight": "model-00005-of-00005.safetensors",
|
|
@@ -429,46 +429,46 @@
|
|
| 429 |
"language_model.model.layers.26.mlp.up_proj.scales": "model-00002-of-00005.safetensors",
|
| 430 |
"language_model.model.layers.26.mlp.up_proj.weight": "model-00002-of-00005.safetensors",
|
| 431 |
"language_model.model.layers.26.post_attention_layernorm.weight": "model-00002-of-00005.safetensors",
|
| 432 |
-
"language_model.model.layers.27.input_layernorm.weight": "model-
|
| 433 |
-
"language_model.model.layers.27.mlp.down_proj.scales": "model-
|
| 434 |
-
"language_model.model.layers.27.mlp.down_proj.weight": "model-
|
| 435 |
-
"language_model.model.layers.27.mlp.gate_proj.scales": "model-
|
| 436 |
-
"language_model.model.layers.27.mlp.gate_proj.weight": "model-
|
| 437 |
-
"language_model.model.layers.27.mlp.up_proj.scales": "model-
|
| 438 |
-
"language_model.model.layers.27.mlp.up_proj.weight": "model-
|
| 439 |
-
"language_model.model.layers.27.post_attention_layernorm.weight": "model-
|
| 440 |
-
"language_model.model.layers.27.self_attn.k_norm.weight": "model-
|
| 441 |
-
"language_model.model.layers.27.self_attn.k_proj.scales": "model-
|
| 442 |
-
"language_model.model.layers.27.self_attn.k_proj.weight": "model-
|
| 443 |
-
"language_model.model.layers.27.self_attn.o_proj.scales": "model-
|
| 444 |
-
"language_model.model.layers.27.self_attn.o_proj.weight": "model-
|
| 445 |
-
"language_model.model.layers.27.self_attn.q_norm.weight": "model-
|
| 446 |
-
"language_model.model.layers.27.self_attn.q_proj.scales": "model-
|
| 447 |
-
"language_model.model.layers.27.self_attn.q_proj.weight": "model-
|
| 448 |
-
"language_model.model.layers.27.self_attn.v_proj.scales": "model-
|
| 449 |
-
"language_model.model.layers.27.self_attn.v_proj.weight": "model-
|
| 450 |
-
"language_model.model.layers.28.input_layernorm.weight": "model-
|
| 451 |
-
"language_model.model.layers.28.linear_attn.A_log": "model-
|
| 452 |
-
"language_model.model.layers.28.linear_attn.conv1d.weight": "model-
|
| 453 |
-
"language_model.model.layers.28.linear_attn.dt_bias": "model-
|
| 454 |
-
"language_model.model.layers.28.linear_attn.in_proj_a.scales": "model-
|
| 455 |
-
"language_model.model.layers.28.linear_attn.in_proj_a.weight": "model-
|
| 456 |
-
"language_model.model.layers.28.linear_attn.in_proj_b.scales": "model-
|
| 457 |
-
"language_model.model.layers.28.linear_attn.in_proj_b.weight": "model-
|
| 458 |
-
"language_model.model.layers.28.linear_attn.in_proj_qkv.scales": "model-
|
| 459 |
-
"language_model.model.layers.28.linear_attn.in_proj_qkv.weight": "model-
|
| 460 |
-
"language_model.model.layers.28.linear_attn.in_proj_z.scales": "model-
|
| 461 |
-
"language_model.model.layers.28.linear_attn.in_proj_z.weight": "model-
|
| 462 |
-
"language_model.model.layers.28.linear_attn.norm.weight": "model-
|
| 463 |
-
"language_model.model.layers.28.linear_attn.out_proj.scales": "model-
|
| 464 |
-
"language_model.model.layers.28.linear_attn.out_proj.weight": "model-
|
| 465 |
"language_model.model.layers.28.mlp.down_proj.scales": "model-00003-of-00005.safetensors",
|
| 466 |
"language_model.model.layers.28.mlp.down_proj.weight": "model-00003-of-00005.safetensors",
|
| 467 |
"language_model.model.layers.28.mlp.gate_proj.scales": "model-00003-of-00005.safetensors",
|
| 468 |
"language_model.model.layers.28.mlp.gate_proj.weight": "model-00003-of-00005.safetensors",
|
| 469 |
"language_model.model.layers.28.mlp.up_proj.scales": "model-00003-of-00005.safetensors",
|
| 470 |
"language_model.model.layers.28.mlp.up_proj.weight": "model-00003-of-00005.safetensors",
|
| 471 |
-
"language_model.model.layers.28.post_attention_layernorm.weight": "model-
|
| 472 |
"language_model.model.layers.29.input_layernorm.weight": "model-00003-of-00005.safetensors",
|
| 473 |
"language_model.model.layers.29.linear_attn.A_log": "model-00003-of-00005.safetensors",
|
| 474 |
"language_model.model.layers.29.linear_attn.conv1d.weight": "model-00003-of-00005.safetensors",
|
|
@@ -889,46 +889,46 @@
|
|
| 889 |
"language_model.model.layers.46.mlp.up_proj.scales": "model-00003-of-00005.safetensors",
|
| 890 |
"language_model.model.layers.46.mlp.up_proj.weight": "model-00003-of-00005.safetensors",
|
| 891 |
"language_model.model.layers.46.post_attention_layernorm.weight": "model-00003-of-00005.safetensors",
|
| 892 |
-
"language_model.model.layers.47.input_layernorm.weight": "model-
|
| 893 |
-
"language_model.model.layers.47.mlp.down_proj.scales": "model-
|
| 894 |
-
"language_model.model.layers.47.mlp.down_proj.weight": "model-
|
| 895 |
-
"language_model.model.layers.47.mlp.gate_proj.scales": "model-
|
| 896 |
-
"language_model.model.layers.47.mlp.gate_proj.weight": "model-
|
| 897 |
-
"language_model.model.layers.47.mlp.up_proj.scales": "model-
|
| 898 |
-
"language_model.model.layers.47.mlp.up_proj.weight": "model-
|
| 899 |
-
"language_model.model.layers.47.post_attention_layernorm.weight": "model-
|
| 900 |
-
"language_model.model.layers.47.self_attn.k_norm.weight": "model-
|
| 901 |
-
"language_model.model.layers.47.self_attn.k_proj.scales": "model-
|
| 902 |
-
"language_model.model.layers.47.self_attn.k_proj.weight": "model-
|
| 903 |
-
"language_model.model.layers.47.self_attn.o_proj.scales": "model-
|
| 904 |
-
"language_model.model.layers.47.self_attn.o_proj.weight": "model-
|
| 905 |
-
"language_model.model.layers.47.self_attn.q_norm.weight": "model-
|
| 906 |
-
"language_model.model.layers.47.self_attn.q_proj.scales": "model-
|
| 907 |
-
"language_model.model.layers.47.self_attn.q_proj.weight": "model-
|
| 908 |
-
"language_model.model.layers.47.self_attn.v_proj.scales": "model-
|
| 909 |
-
"language_model.model.layers.47.self_attn.v_proj.weight": "model-
|
| 910 |
-
"language_model.model.layers.48.input_layernorm.weight": "model-
|
| 911 |
-
"language_model.model.layers.48.linear_attn.A_log": "model-
|
| 912 |
-
"language_model.model.layers.48.linear_attn.conv1d.weight": "model-
|
| 913 |
-
"language_model.model.layers.48.linear_attn.dt_bias": "model-
|
| 914 |
-
"language_model.model.layers.48.linear_attn.in_proj_a.scales": "model-
|
| 915 |
-
"language_model.model.layers.48.linear_attn.in_proj_a.weight": "model-
|
| 916 |
-
"language_model.model.layers.48.linear_attn.in_proj_b.scales": "model-
|
| 917 |
-
"language_model.model.layers.48.linear_attn.in_proj_b.weight": "model-
|
| 918 |
-
"language_model.model.layers.48.linear_attn.in_proj_qkv.scales": "model-
|
| 919 |
-
"language_model.model.layers.48.linear_attn.in_proj_qkv.weight": "model-
|
| 920 |
-
"language_model.model.layers.48.linear_attn.in_proj_z.scales": "model-
|
| 921 |
-
"language_model.model.layers.48.linear_attn.in_proj_z.weight": "model-
|
| 922 |
-
"language_model.model.layers.48.linear_attn.norm.weight": "model-
|
| 923 |
-
"language_model.model.layers.48.linear_attn.out_proj.scales": "model-
|
| 924 |
-
"language_model.model.layers.48.linear_attn.out_proj.weight": "model-
|
| 925 |
"language_model.model.layers.48.mlp.down_proj.scales": "model-00004-of-00005.safetensors",
|
| 926 |
"language_model.model.layers.48.mlp.down_proj.weight": "model-00004-of-00005.safetensors",
|
| 927 |
"language_model.model.layers.48.mlp.gate_proj.scales": "model-00004-of-00005.safetensors",
|
| 928 |
"language_model.model.layers.48.mlp.gate_proj.weight": "model-00004-of-00005.safetensors",
|
| 929 |
"language_model.model.layers.48.mlp.up_proj.scales": "model-00004-of-00005.safetensors",
|
| 930 |
"language_model.model.layers.48.mlp.up_proj.weight": "model-00004-of-00005.safetensors",
|
| 931 |
-
"language_model.model.layers.48.post_attention_layernorm.weight": "model-
|
| 932 |
"language_model.model.layers.49.input_layernorm.weight": "model-00004-of-00005.safetensors",
|
| 933 |
"language_model.model.layers.49.linear_attn.A_log": "model-00004-of-00005.safetensors",
|
| 934 |
"language_model.model.layers.49.linear_attn.conv1d.weight": "model-00004-of-00005.safetensors",
|
|
@@ -1287,46 +1287,46 @@
|
|
| 1287 |
"language_model.model.layers.63.self_attn.q_proj.weight": "model-00004-of-00005.safetensors",
|
| 1288 |
"language_model.model.layers.63.self_attn.v_proj.scales": "model-00004-of-00005.safetensors",
|
| 1289 |
"language_model.model.layers.63.self_attn.v_proj.weight": "model-00004-of-00005.safetensors",
|
| 1290 |
-
"language_model.model.layers.7.input_layernorm.weight": "model-
|
| 1291 |
-
"language_model.model.layers.7.mlp.down_proj.scales": "model-
|
| 1292 |
-
"language_model.model.layers.7.mlp.down_proj.weight": "model-
|
| 1293 |
-
"language_model.model.layers.7.mlp.gate_proj.scales": "model-
|
| 1294 |
-
"language_model.model.layers.7.mlp.gate_proj.weight": "model-
|
| 1295 |
-
"language_model.model.layers.7.mlp.up_proj.scales": "model-
|
| 1296 |
-
"language_model.model.layers.7.mlp.up_proj.weight": "model-
|
| 1297 |
-
"language_model.model.layers.7.post_attention_layernorm.weight": "model-
|
| 1298 |
-
"language_model.model.layers.7.self_attn.k_norm.weight": "model-
|
| 1299 |
-
"language_model.model.layers.7.self_attn.k_proj.scales": "model-
|
| 1300 |
-
"language_model.model.layers.7.self_attn.k_proj.weight": "model-
|
| 1301 |
-
"language_model.model.layers.7.self_attn.o_proj.scales": "model-
|
| 1302 |
-
"language_model.model.layers.7.self_attn.o_proj.weight": "model-
|
| 1303 |
-
"language_model.model.layers.7.self_attn.q_norm.weight": "model-
|
| 1304 |
-
"language_model.model.layers.7.self_attn.q_proj.scales": "model-
|
| 1305 |
-
"language_model.model.layers.7.self_attn.q_proj.weight": "model-
|
| 1306 |
-
"language_model.model.layers.7.self_attn.v_proj.scales": "model-
|
| 1307 |
-
"language_model.model.layers.7.self_attn.v_proj.weight": "model-
|
| 1308 |
-
"language_model.model.layers.8.input_layernorm.weight": "model-
|
| 1309 |
-
"language_model.model.layers.8.linear_attn.A_log": "model-
|
| 1310 |
-
"language_model.model.layers.8.linear_attn.conv1d.weight": "model-
|
| 1311 |
-
"language_model.model.layers.8.linear_attn.dt_bias": "model-
|
| 1312 |
-
"language_model.model.layers.8.linear_attn.in_proj_a.scales": "model-
|
| 1313 |
-
"language_model.model.layers.8.linear_attn.in_proj_a.weight": "model-
|
| 1314 |
-
"language_model.model.layers.8.linear_attn.in_proj_b.scales": "model-
|
| 1315 |
-
"language_model.model.layers.8.linear_attn.in_proj_b.weight": "model-
|
| 1316 |
-
"language_model.model.layers.8.linear_attn.in_proj_qkv.scales": "model-
|
| 1317 |
-
"language_model.model.layers.8.linear_attn.in_proj_qkv.weight": "model-
|
| 1318 |
-
"language_model.model.layers.8.linear_attn.in_proj_z.scales": "model-
|
| 1319 |
-
"language_model.model.layers.8.linear_attn.in_proj_z.weight": "model-
|
| 1320 |
-
"language_model.model.layers.8.linear_attn.norm.weight": "model-
|
| 1321 |
-
"language_model.model.layers.8.linear_attn.out_proj.scales": "model-
|
| 1322 |
-
"language_model.model.layers.8.linear_attn.out_proj.weight": "model-
|
| 1323 |
"language_model.model.layers.8.mlp.down_proj.scales": "model-00002-of-00005.safetensors",
|
| 1324 |
"language_model.model.layers.8.mlp.down_proj.weight": "model-00002-of-00005.safetensors",
|
| 1325 |
"language_model.model.layers.8.mlp.gate_proj.scales": "model-00002-of-00005.safetensors",
|
| 1326 |
"language_model.model.layers.8.mlp.gate_proj.weight": "model-00002-of-00005.safetensors",
|
| 1327 |
"language_model.model.layers.8.mlp.up_proj.scales": "model-00002-of-00005.safetensors",
|
| 1328 |
"language_model.model.layers.8.mlp.up_proj.weight": "model-00002-of-00005.safetensors",
|
| 1329 |
-
"language_model.model.layers.8.post_attention_layernorm.weight": "model-
|
| 1330 |
"language_model.model.layers.9.input_layernorm.weight": "model-00002-of-00005.safetensors",
|
| 1331 |
"language_model.model.layers.9.linear_attn.A_log": "model-00002-of-00005.safetensors",
|
| 1332 |
"language_model.model.layers.9.linear_attn.conv1d.weight": "model-00002-of-00005.safetensors",
|
|
@@ -1370,10 +1370,8 @@
|
|
| 1370 |
"vision_tower.blocks.0.attn.qkv.bias": "model-00001-of-00005.safetensors",
|
| 1371 |
"vision_tower.blocks.0.attn.qkv.weight": "model-00001-of-00005.safetensors",
|
| 1372 |
"vision_tower.blocks.0.mlp.linear_fc1.bias": "model-00001-of-00005.safetensors",
|
| 1373 |
-
"vision_tower.blocks.0.mlp.linear_fc1.scales": "model-00001-of-00005.safetensors",
|
| 1374 |
"vision_tower.blocks.0.mlp.linear_fc1.weight": "model-00001-of-00005.safetensors",
|
| 1375 |
"vision_tower.blocks.0.mlp.linear_fc2.bias": "model-00001-of-00005.safetensors",
|
| 1376 |
-
"vision_tower.blocks.0.mlp.linear_fc2.scales": "model-00001-of-00005.safetensors",
|
| 1377 |
"vision_tower.blocks.0.mlp.linear_fc2.weight": "model-00001-of-00005.safetensors",
|
| 1378 |
"vision_tower.blocks.0.norm1.bias": "model-00001-of-00005.safetensors",
|
| 1379 |
"vision_tower.blocks.0.norm1.weight": "model-00001-of-00005.safetensors",
|
|
@@ -1384,10 +1382,8 @@
|
|
| 1384 |
"vision_tower.blocks.1.attn.qkv.bias": "model-00001-of-00005.safetensors",
|
| 1385 |
"vision_tower.blocks.1.attn.qkv.weight": "model-00001-of-00005.safetensors",
|
| 1386 |
"vision_tower.blocks.1.mlp.linear_fc1.bias": "model-00001-of-00005.safetensors",
|
| 1387 |
-
"vision_tower.blocks.1.mlp.linear_fc1.scales": "model-00001-of-00005.safetensors",
|
| 1388 |
"vision_tower.blocks.1.mlp.linear_fc1.weight": "model-00001-of-00005.safetensors",
|
| 1389 |
"vision_tower.blocks.1.mlp.linear_fc2.bias": "model-00001-of-00005.safetensors",
|
| 1390 |
-
"vision_tower.blocks.1.mlp.linear_fc2.scales": "model-00001-of-00005.safetensors",
|
| 1391 |
"vision_tower.blocks.1.mlp.linear_fc2.weight": "model-00001-of-00005.safetensors",
|
| 1392 |
"vision_tower.blocks.1.norm1.bias": "model-00001-of-00005.safetensors",
|
| 1393 |
"vision_tower.blocks.1.norm1.weight": "model-00001-of-00005.safetensors",
|
|
@@ -1398,10 +1394,8 @@
|
|
| 1398 |
"vision_tower.blocks.10.attn.qkv.bias": "model-00001-of-00005.safetensors",
|
| 1399 |
"vision_tower.blocks.10.attn.qkv.weight": "model-00001-of-00005.safetensors",
|
| 1400 |
"vision_tower.blocks.10.mlp.linear_fc1.bias": "model-00001-of-00005.safetensors",
|
| 1401 |
-
"vision_tower.blocks.10.mlp.linear_fc1.scales": "model-00001-of-00005.safetensors",
|
| 1402 |
"vision_tower.blocks.10.mlp.linear_fc1.weight": "model-00001-of-00005.safetensors",
|
| 1403 |
"vision_tower.blocks.10.mlp.linear_fc2.bias": "model-00001-of-00005.safetensors",
|
| 1404 |
-
"vision_tower.blocks.10.mlp.linear_fc2.scales": "model-00001-of-00005.safetensors",
|
| 1405 |
"vision_tower.blocks.10.mlp.linear_fc2.weight": "model-00001-of-00005.safetensors",
|
| 1406 |
"vision_tower.blocks.10.norm1.bias": "model-00001-of-00005.safetensors",
|
| 1407 |
"vision_tower.blocks.10.norm1.weight": "model-00001-of-00005.safetensors",
|
|
@@ -1412,10 +1406,8 @@
|
|
| 1412 |
"vision_tower.blocks.11.attn.qkv.bias": "model-00001-of-00005.safetensors",
|
| 1413 |
"vision_tower.blocks.11.attn.qkv.weight": "model-00001-of-00005.safetensors",
|
| 1414 |
"vision_tower.blocks.11.mlp.linear_fc1.bias": "model-00001-of-00005.safetensors",
|
| 1415 |
-
"vision_tower.blocks.11.mlp.linear_fc1.scales": "model-00001-of-00005.safetensors",
|
| 1416 |
"vision_tower.blocks.11.mlp.linear_fc1.weight": "model-00001-of-00005.safetensors",
|
| 1417 |
"vision_tower.blocks.11.mlp.linear_fc2.bias": "model-00001-of-00005.safetensors",
|
| 1418 |
-
"vision_tower.blocks.11.mlp.linear_fc2.scales": "model-00001-of-00005.safetensors",
|
| 1419 |
"vision_tower.blocks.11.mlp.linear_fc2.weight": "model-00001-of-00005.safetensors",
|
| 1420 |
"vision_tower.blocks.11.norm1.bias": "model-00001-of-00005.safetensors",
|
| 1421 |
"vision_tower.blocks.11.norm1.weight": "model-00001-of-00005.safetensors",
|
|
@@ -1426,10 +1418,8 @@
|
|
| 1426 |
"vision_tower.blocks.12.attn.qkv.bias": "model-00001-of-00005.safetensors",
|
| 1427 |
"vision_tower.blocks.12.attn.qkv.weight": "model-00001-of-00005.safetensors",
|
| 1428 |
"vision_tower.blocks.12.mlp.linear_fc1.bias": "model-00001-of-00005.safetensors",
|
| 1429 |
-
"vision_tower.blocks.12.mlp.linear_fc1.scales": "model-00001-of-00005.safetensors",
|
| 1430 |
"vision_tower.blocks.12.mlp.linear_fc1.weight": "model-00001-of-00005.safetensors",
|
| 1431 |
"vision_tower.blocks.12.mlp.linear_fc2.bias": "model-00001-of-00005.safetensors",
|
| 1432 |
-
"vision_tower.blocks.12.mlp.linear_fc2.scales": "model-00001-of-00005.safetensors",
|
| 1433 |
"vision_tower.blocks.12.mlp.linear_fc2.weight": "model-00001-of-00005.safetensors",
|
| 1434 |
"vision_tower.blocks.12.norm1.bias": "model-00001-of-00005.safetensors",
|
| 1435 |
"vision_tower.blocks.12.norm1.weight": "model-00001-of-00005.safetensors",
|
|
@@ -1440,10 +1430,8 @@
|
|
| 1440 |
"vision_tower.blocks.13.attn.qkv.bias": "model-00001-of-00005.safetensors",
|
| 1441 |
"vision_tower.blocks.13.attn.qkv.weight": "model-00001-of-00005.safetensors",
|
| 1442 |
"vision_tower.blocks.13.mlp.linear_fc1.bias": "model-00001-of-00005.safetensors",
|
| 1443 |
-
"vision_tower.blocks.13.mlp.linear_fc1.scales": "model-00001-of-00005.safetensors",
|
| 1444 |
"vision_tower.blocks.13.mlp.linear_fc1.weight": "model-00001-of-00005.safetensors",
|
| 1445 |
"vision_tower.blocks.13.mlp.linear_fc2.bias": "model-00001-of-00005.safetensors",
|
| 1446 |
-
"vision_tower.blocks.13.mlp.linear_fc2.scales": "model-00001-of-00005.safetensors",
|
| 1447 |
"vision_tower.blocks.13.mlp.linear_fc2.weight": "model-00001-of-00005.safetensors",
|
| 1448 |
"vision_tower.blocks.13.norm1.bias": "model-00001-of-00005.safetensors",
|
| 1449 |
"vision_tower.blocks.13.norm1.weight": "model-00001-of-00005.safetensors",
|
|
@@ -1454,10 +1442,8 @@
|
|
| 1454 |
"vision_tower.blocks.14.attn.qkv.bias": "model-00001-of-00005.safetensors",
|
| 1455 |
"vision_tower.blocks.14.attn.qkv.weight": "model-00001-of-00005.safetensors",
|
| 1456 |
"vision_tower.blocks.14.mlp.linear_fc1.bias": "model-00001-of-00005.safetensors",
|
| 1457 |
-
"vision_tower.blocks.14.mlp.linear_fc1.scales": "model-00001-of-00005.safetensors",
|
| 1458 |
"vision_tower.blocks.14.mlp.linear_fc1.weight": "model-00001-of-00005.safetensors",
|
| 1459 |
"vision_tower.blocks.14.mlp.linear_fc2.bias": "model-00001-of-00005.safetensors",
|
| 1460 |
-
"vision_tower.blocks.14.mlp.linear_fc2.scales": "model-00001-of-00005.safetensors",
|
| 1461 |
"vision_tower.blocks.14.mlp.linear_fc2.weight": "model-00001-of-00005.safetensors",
|
| 1462 |
"vision_tower.blocks.14.norm1.bias": "model-00001-of-00005.safetensors",
|
| 1463 |
"vision_tower.blocks.14.norm1.weight": "model-00001-of-00005.safetensors",
|
|
@@ -1468,10 +1454,8 @@
|
|
| 1468 |
"vision_tower.blocks.15.attn.qkv.bias": "model-00001-of-00005.safetensors",
|
| 1469 |
"vision_tower.blocks.15.attn.qkv.weight": "model-00001-of-00005.safetensors",
|
| 1470 |
"vision_tower.blocks.15.mlp.linear_fc1.bias": "model-00001-of-00005.safetensors",
|
| 1471 |
-
"vision_tower.blocks.15.mlp.linear_fc1.scales": "model-00001-of-00005.safetensors",
|
| 1472 |
"vision_tower.blocks.15.mlp.linear_fc1.weight": "model-00001-of-00005.safetensors",
|
| 1473 |
"vision_tower.blocks.15.mlp.linear_fc2.bias": "model-00001-of-00005.safetensors",
|
| 1474 |
-
"vision_tower.blocks.15.mlp.linear_fc2.scales": "model-00001-of-00005.safetensors",
|
| 1475 |
"vision_tower.blocks.15.mlp.linear_fc2.weight": "model-00001-of-00005.safetensors",
|
| 1476 |
"vision_tower.blocks.15.norm1.bias": "model-00001-of-00005.safetensors",
|
| 1477 |
"vision_tower.blocks.15.norm1.weight": "model-00001-of-00005.safetensors",
|
|
@@ -1482,10 +1466,8 @@
|
|
| 1482 |
"vision_tower.blocks.16.attn.qkv.bias": "model-00001-of-00005.safetensors",
|
| 1483 |
"vision_tower.blocks.16.attn.qkv.weight": "model-00001-of-00005.safetensors",
|
| 1484 |
"vision_tower.blocks.16.mlp.linear_fc1.bias": "model-00001-of-00005.safetensors",
|
| 1485 |
-
"vision_tower.blocks.16.mlp.linear_fc1.scales": "model-00001-of-00005.safetensors",
|
| 1486 |
"vision_tower.blocks.16.mlp.linear_fc1.weight": "model-00001-of-00005.safetensors",
|
| 1487 |
"vision_tower.blocks.16.mlp.linear_fc2.bias": "model-00001-of-00005.safetensors",
|
| 1488 |
-
"vision_tower.blocks.16.mlp.linear_fc2.scales": "model-00001-of-00005.safetensors",
|
| 1489 |
"vision_tower.blocks.16.mlp.linear_fc2.weight": "model-00001-of-00005.safetensors",
|
| 1490 |
"vision_tower.blocks.16.norm1.bias": "model-00001-of-00005.safetensors",
|
| 1491 |
"vision_tower.blocks.16.norm1.weight": "model-00001-of-00005.safetensors",
|
|
@@ -1496,10 +1478,8 @@
|
|
| 1496 |
"vision_tower.blocks.17.attn.qkv.bias": "model-00001-of-00005.safetensors",
|
| 1497 |
"vision_tower.blocks.17.attn.qkv.weight": "model-00001-of-00005.safetensors",
|
| 1498 |
"vision_tower.blocks.17.mlp.linear_fc1.bias": "model-00001-of-00005.safetensors",
|
| 1499 |
-
"vision_tower.blocks.17.mlp.linear_fc1.scales": "model-00001-of-00005.safetensors",
|
| 1500 |
"vision_tower.blocks.17.mlp.linear_fc1.weight": "model-00001-of-00005.safetensors",
|
| 1501 |
"vision_tower.blocks.17.mlp.linear_fc2.bias": "model-00001-of-00005.safetensors",
|
| 1502 |
-
"vision_tower.blocks.17.mlp.linear_fc2.scales": "model-00001-of-00005.safetensors",
|
| 1503 |
"vision_tower.blocks.17.mlp.linear_fc2.weight": "model-00001-of-00005.safetensors",
|
| 1504 |
"vision_tower.blocks.17.norm1.bias": "model-00001-of-00005.safetensors",
|
| 1505 |
"vision_tower.blocks.17.norm1.weight": "model-00001-of-00005.safetensors",
|
|
@@ -1510,10 +1490,8 @@
|
|
| 1510 |
"vision_tower.blocks.18.attn.qkv.bias": "model-00001-of-00005.safetensors",
|
| 1511 |
"vision_tower.blocks.18.attn.qkv.weight": "model-00001-of-00005.safetensors",
|
| 1512 |
"vision_tower.blocks.18.mlp.linear_fc1.bias": "model-00001-of-00005.safetensors",
|
| 1513 |
-
"vision_tower.blocks.18.mlp.linear_fc1.scales": "model-00001-of-00005.safetensors",
|
| 1514 |
"vision_tower.blocks.18.mlp.linear_fc1.weight": "model-00001-of-00005.safetensors",
|
| 1515 |
"vision_tower.blocks.18.mlp.linear_fc2.bias": "model-00001-of-00005.safetensors",
|
| 1516 |
-
"vision_tower.blocks.18.mlp.linear_fc2.scales": "model-00001-of-00005.safetensors",
|
| 1517 |
"vision_tower.blocks.18.mlp.linear_fc2.weight": "model-00001-of-00005.safetensors",
|
| 1518 |
"vision_tower.blocks.18.norm1.bias": "model-00001-of-00005.safetensors",
|
| 1519 |
"vision_tower.blocks.18.norm1.weight": "model-00001-of-00005.safetensors",
|
|
@@ -1524,10 +1502,8 @@
|
|
| 1524 |
"vision_tower.blocks.19.attn.qkv.bias": "model-00001-of-00005.safetensors",
|
| 1525 |
"vision_tower.blocks.19.attn.qkv.weight": "model-00001-of-00005.safetensors",
|
| 1526 |
"vision_tower.blocks.19.mlp.linear_fc1.bias": "model-00001-of-00005.safetensors",
|
| 1527 |
-
"vision_tower.blocks.19.mlp.linear_fc1.scales": "model-00001-of-00005.safetensors",
|
| 1528 |
"vision_tower.blocks.19.mlp.linear_fc1.weight": "model-00001-of-00005.safetensors",
|
| 1529 |
"vision_tower.blocks.19.mlp.linear_fc2.bias": "model-00001-of-00005.safetensors",
|
| 1530 |
-
"vision_tower.blocks.19.mlp.linear_fc2.scales": "model-00001-of-00005.safetensors",
|
| 1531 |
"vision_tower.blocks.19.mlp.linear_fc2.weight": "model-00001-of-00005.safetensors",
|
| 1532 |
"vision_tower.blocks.19.norm1.bias": "model-00001-of-00005.safetensors",
|
| 1533 |
"vision_tower.blocks.19.norm1.weight": "model-00001-of-00005.safetensors",
|
|
@@ -1538,10 +1514,8 @@
|
|
| 1538 |
"vision_tower.blocks.2.attn.qkv.bias": "model-00001-of-00005.safetensors",
|
| 1539 |
"vision_tower.blocks.2.attn.qkv.weight": "model-00001-of-00005.safetensors",
|
| 1540 |
"vision_tower.blocks.2.mlp.linear_fc1.bias": "model-00001-of-00005.safetensors",
|
| 1541 |
-
"vision_tower.blocks.2.mlp.linear_fc1.scales": "model-00001-of-00005.safetensors",
|
| 1542 |
"vision_tower.blocks.2.mlp.linear_fc1.weight": "model-00001-of-00005.safetensors",
|
| 1543 |
"vision_tower.blocks.2.mlp.linear_fc2.bias": "model-00001-of-00005.safetensors",
|
| 1544 |
-
"vision_tower.blocks.2.mlp.linear_fc2.scales": "model-00001-of-00005.safetensors",
|
| 1545 |
"vision_tower.blocks.2.mlp.linear_fc2.weight": "model-00001-of-00005.safetensors",
|
| 1546 |
"vision_tower.blocks.2.norm1.bias": "model-00001-of-00005.safetensors",
|
| 1547 |
"vision_tower.blocks.2.norm1.weight": "model-00001-of-00005.safetensors",
|
|
@@ -1552,10 +1526,8 @@
|
|
| 1552 |
"vision_tower.blocks.20.attn.qkv.bias": "model-00001-of-00005.safetensors",
|
| 1553 |
"vision_tower.blocks.20.attn.qkv.weight": "model-00001-of-00005.safetensors",
|
| 1554 |
"vision_tower.blocks.20.mlp.linear_fc1.bias": "model-00001-of-00005.safetensors",
|
| 1555 |
-
"vision_tower.blocks.20.mlp.linear_fc1.scales": "model-00001-of-00005.safetensors",
|
| 1556 |
"vision_tower.blocks.20.mlp.linear_fc1.weight": "model-00001-of-00005.safetensors",
|
| 1557 |
"vision_tower.blocks.20.mlp.linear_fc2.bias": "model-00001-of-00005.safetensors",
|
| 1558 |
-
"vision_tower.blocks.20.mlp.linear_fc2.scales": "model-00001-of-00005.safetensors",
|
| 1559 |
"vision_tower.blocks.20.mlp.linear_fc2.weight": "model-00001-of-00005.safetensors",
|
| 1560 |
"vision_tower.blocks.20.norm1.bias": "model-00001-of-00005.safetensors",
|
| 1561 |
"vision_tower.blocks.20.norm1.weight": "model-00001-of-00005.safetensors",
|
|
@@ -1566,10 +1538,8 @@
|
|
| 1566 |
"vision_tower.blocks.21.attn.qkv.bias": "model-00001-of-00005.safetensors",
|
| 1567 |
"vision_tower.blocks.21.attn.qkv.weight": "model-00001-of-00005.safetensors",
|
| 1568 |
"vision_tower.blocks.21.mlp.linear_fc1.bias": "model-00001-of-00005.safetensors",
|
| 1569 |
-
"vision_tower.blocks.21.mlp.linear_fc1.scales": "model-00001-of-00005.safetensors",
|
| 1570 |
"vision_tower.blocks.21.mlp.linear_fc1.weight": "model-00001-of-00005.safetensors",
|
| 1571 |
"vision_tower.blocks.21.mlp.linear_fc2.bias": "model-00001-of-00005.safetensors",
|
| 1572 |
-
"vision_tower.blocks.21.mlp.linear_fc2.scales": "model-00001-of-00005.safetensors",
|
| 1573 |
"vision_tower.blocks.21.mlp.linear_fc2.weight": "model-00001-of-00005.safetensors",
|
| 1574 |
"vision_tower.blocks.21.norm1.bias": "model-00001-of-00005.safetensors",
|
| 1575 |
"vision_tower.blocks.21.norm1.weight": "model-00001-of-00005.safetensors",
|
|
@@ -1580,10 +1550,8 @@
|
|
| 1580 |
"vision_tower.blocks.22.attn.qkv.bias": "model-00001-of-00005.safetensors",
|
| 1581 |
"vision_tower.blocks.22.attn.qkv.weight": "model-00001-of-00005.safetensors",
|
| 1582 |
"vision_tower.blocks.22.mlp.linear_fc1.bias": "model-00001-of-00005.safetensors",
|
| 1583 |
-
"vision_tower.blocks.22.mlp.linear_fc1.scales": "model-00001-of-00005.safetensors",
|
| 1584 |
"vision_tower.blocks.22.mlp.linear_fc1.weight": "model-00001-of-00005.safetensors",
|
| 1585 |
"vision_tower.blocks.22.mlp.linear_fc2.bias": "model-00001-of-00005.safetensors",
|
| 1586 |
-
"vision_tower.blocks.22.mlp.linear_fc2.scales": "model-00001-of-00005.safetensors",
|
| 1587 |
"vision_tower.blocks.22.mlp.linear_fc2.weight": "model-00001-of-00005.safetensors",
|
| 1588 |
"vision_tower.blocks.22.norm1.bias": "model-00001-of-00005.safetensors",
|
| 1589 |
"vision_tower.blocks.22.norm1.weight": "model-00001-of-00005.safetensors",
|
|
@@ -1594,10 +1562,8 @@
|
|
| 1594 |
"vision_tower.blocks.23.attn.qkv.bias": "model-00001-of-00005.safetensors",
|
| 1595 |
"vision_tower.blocks.23.attn.qkv.weight": "model-00001-of-00005.safetensors",
|
| 1596 |
"vision_tower.blocks.23.mlp.linear_fc1.bias": "model-00001-of-00005.safetensors",
|
| 1597 |
-
"vision_tower.blocks.23.mlp.linear_fc1.scales": "model-00001-of-00005.safetensors",
|
| 1598 |
"vision_tower.blocks.23.mlp.linear_fc1.weight": "model-00001-of-00005.safetensors",
|
| 1599 |
"vision_tower.blocks.23.mlp.linear_fc2.bias": "model-00001-of-00005.safetensors",
|
| 1600 |
-
"vision_tower.blocks.23.mlp.linear_fc2.scales": "model-00001-of-00005.safetensors",
|
| 1601 |
"vision_tower.blocks.23.mlp.linear_fc2.weight": "model-00001-of-00005.safetensors",
|
| 1602 |
"vision_tower.blocks.23.norm1.bias": "model-00001-of-00005.safetensors",
|
| 1603 |
"vision_tower.blocks.23.norm1.weight": "model-00001-of-00005.safetensors",
|
|
@@ -1608,10 +1574,8 @@
|
|
| 1608 |
"vision_tower.blocks.24.attn.qkv.bias": "model-00001-of-00005.safetensors",
|
| 1609 |
"vision_tower.blocks.24.attn.qkv.weight": "model-00001-of-00005.safetensors",
|
| 1610 |
"vision_tower.blocks.24.mlp.linear_fc1.bias": "model-00001-of-00005.safetensors",
|
| 1611 |
-
"vision_tower.blocks.24.mlp.linear_fc1.scales": "model-00001-of-00005.safetensors",
|
| 1612 |
"vision_tower.blocks.24.mlp.linear_fc1.weight": "model-00001-of-00005.safetensors",
|
| 1613 |
"vision_tower.blocks.24.mlp.linear_fc2.bias": "model-00001-of-00005.safetensors",
|
| 1614 |
-
"vision_tower.blocks.24.mlp.linear_fc2.scales": "model-00001-of-00005.safetensors",
|
| 1615 |
"vision_tower.blocks.24.mlp.linear_fc2.weight": "model-00001-of-00005.safetensors",
|
| 1616 |
"vision_tower.blocks.24.norm1.bias": "model-00001-of-00005.safetensors",
|
| 1617 |
"vision_tower.blocks.24.norm1.weight": "model-00001-of-00005.safetensors",
|
|
@@ -1622,10 +1586,8 @@
|
|
| 1622 |
"vision_tower.blocks.25.attn.qkv.bias": "model-00001-of-00005.safetensors",
|
| 1623 |
"vision_tower.blocks.25.attn.qkv.weight": "model-00001-of-00005.safetensors",
|
| 1624 |
"vision_tower.blocks.25.mlp.linear_fc1.bias": "model-00001-of-00005.safetensors",
|
| 1625 |
-
"vision_tower.blocks.25.mlp.linear_fc1.scales": "model-00001-of-00005.safetensors",
|
| 1626 |
"vision_tower.blocks.25.mlp.linear_fc1.weight": "model-00001-of-00005.safetensors",
|
| 1627 |
"vision_tower.blocks.25.mlp.linear_fc2.bias": "model-00001-of-00005.safetensors",
|
| 1628 |
-
"vision_tower.blocks.25.mlp.linear_fc2.scales": "model-00001-of-00005.safetensors",
|
| 1629 |
"vision_tower.blocks.25.mlp.linear_fc2.weight": "model-00001-of-00005.safetensors",
|
| 1630 |
"vision_tower.blocks.25.norm1.bias": "model-00001-of-00005.safetensors",
|
| 1631 |
"vision_tower.blocks.25.norm1.weight": "model-00001-of-00005.safetensors",
|
|
@@ -1636,10 +1598,8 @@
|
|
| 1636 |
"vision_tower.blocks.26.attn.qkv.bias": "model-00001-of-00005.safetensors",
|
| 1637 |
"vision_tower.blocks.26.attn.qkv.weight": "model-00001-of-00005.safetensors",
|
| 1638 |
"vision_tower.blocks.26.mlp.linear_fc1.bias": "model-00001-of-00005.safetensors",
|
| 1639 |
-
"vision_tower.blocks.26.mlp.linear_fc1.scales": "model-00001-of-00005.safetensors",
|
| 1640 |
"vision_tower.blocks.26.mlp.linear_fc1.weight": "model-00001-of-00005.safetensors",
|
| 1641 |
"vision_tower.blocks.26.mlp.linear_fc2.bias": "model-00001-of-00005.safetensors",
|
| 1642 |
-
"vision_tower.blocks.26.mlp.linear_fc2.scales": "model-00001-of-00005.safetensors",
|
| 1643 |
"vision_tower.blocks.26.mlp.linear_fc2.weight": "model-00001-of-00005.safetensors",
|
| 1644 |
"vision_tower.blocks.26.norm1.bias": "model-00001-of-00005.safetensors",
|
| 1645 |
"vision_tower.blocks.26.norm1.weight": "model-00001-of-00005.safetensors",
|
|
@@ -1650,10 +1610,8 @@
|
|
| 1650 |
"vision_tower.blocks.3.attn.qkv.bias": "model-00001-of-00005.safetensors",
|
| 1651 |
"vision_tower.blocks.3.attn.qkv.weight": "model-00001-of-00005.safetensors",
|
| 1652 |
"vision_tower.blocks.3.mlp.linear_fc1.bias": "model-00001-of-00005.safetensors",
|
| 1653 |
-
"vision_tower.blocks.3.mlp.linear_fc1.scales": "model-00001-of-00005.safetensors",
|
| 1654 |
"vision_tower.blocks.3.mlp.linear_fc1.weight": "model-00001-of-00005.safetensors",
|
| 1655 |
"vision_tower.blocks.3.mlp.linear_fc2.bias": "model-00001-of-00005.safetensors",
|
| 1656 |
-
"vision_tower.blocks.3.mlp.linear_fc2.scales": "model-00001-of-00005.safetensors",
|
| 1657 |
"vision_tower.blocks.3.mlp.linear_fc2.weight": "model-00001-of-00005.safetensors",
|
| 1658 |
"vision_tower.blocks.3.norm1.bias": "model-00001-of-00005.safetensors",
|
| 1659 |
"vision_tower.blocks.3.norm1.weight": "model-00001-of-00005.safetensors",
|
|
@@ -1664,10 +1622,8 @@
|
|
| 1664 |
"vision_tower.blocks.4.attn.qkv.bias": "model-00001-of-00005.safetensors",
|
| 1665 |
"vision_tower.blocks.4.attn.qkv.weight": "model-00001-of-00005.safetensors",
|
| 1666 |
"vision_tower.blocks.4.mlp.linear_fc1.bias": "model-00001-of-00005.safetensors",
|
| 1667 |
-
"vision_tower.blocks.4.mlp.linear_fc1.scales": "model-00001-of-00005.safetensors",
|
| 1668 |
"vision_tower.blocks.4.mlp.linear_fc1.weight": "model-00001-of-00005.safetensors",
|
| 1669 |
"vision_tower.blocks.4.mlp.linear_fc2.bias": "model-00001-of-00005.safetensors",
|
| 1670 |
-
"vision_tower.blocks.4.mlp.linear_fc2.scales": "model-00001-of-00005.safetensors",
|
| 1671 |
"vision_tower.blocks.4.mlp.linear_fc2.weight": "model-00001-of-00005.safetensors",
|
| 1672 |
"vision_tower.blocks.4.norm1.bias": "model-00001-of-00005.safetensors",
|
| 1673 |
"vision_tower.blocks.4.norm1.weight": "model-00001-of-00005.safetensors",
|
|
@@ -1678,10 +1634,8 @@
|
|
| 1678 |
"vision_tower.blocks.5.attn.qkv.bias": "model-00001-of-00005.safetensors",
|
| 1679 |
"vision_tower.blocks.5.attn.qkv.weight": "model-00001-of-00005.safetensors",
|
| 1680 |
"vision_tower.blocks.5.mlp.linear_fc1.bias": "model-00001-of-00005.safetensors",
|
| 1681 |
-
"vision_tower.blocks.5.mlp.linear_fc1.scales": "model-00001-of-00005.safetensors",
|
| 1682 |
"vision_tower.blocks.5.mlp.linear_fc1.weight": "model-00001-of-00005.safetensors",
|
| 1683 |
"vision_tower.blocks.5.mlp.linear_fc2.bias": "model-00001-of-00005.safetensors",
|
| 1684 |
-
"vision_tower.blocks.5.mlp.linear_fc2.scales": "model-00001-of-00005.safetensors",
|
| 1685 |
"vision_tower.blocks.5.mlp.linear_fc2.weight": "model-00001-of-00005.safetensors",
|
| 1686 |
"vision_tower.blocks.5.norm1.bias": "model-00001-of-00005.safetensors",
|
| 1687 |
"vision_tower.blocks.5.norm1.weight": "model-00001-of-00005.safetensors",
|
|
@@ -1692,10 +1646,8 @@
|
|
| 1692 |
"vision_tower.blocks.6.attn.qkv.bias": "model-00001-of-00005.safetensors",
|
| 1693 |
"vision_tower.blocks.6.attn.qkv.weight": "model-00001-of-00005.safetensors",
|
| 1694 |
"vision_tower.blocks.6.mlp.linear_fc1.bias": "model-00001-of-00005.safetensors",
|
| 1695 |
-
"vision_tower.blocks.6.mlp.linear_fc1.scales": "model-00001-of-00005.safetensors",
|
| 1696 |
"vision_tower.blocks.6.mlp.linear_fc1.weight": "model-00001-of-00005.safetensors",
|
| 1697 |
"vision_tower.blocks.6.mlp.linear_fc2.bias": "model-00001-of-00005.safetensors",
|
| 1698 |
-
"vision_tower.blocks.6.mlp.linear_fc2.scales": "model-00001-of-00005.safetensors",
|
| 1699 |
"vision_tower.blocks.6.mlp.linear_fc2.weight": "model-00001-of-00005.safetensors",
|
| 1700 |
"vision_tower.blocks.6.norm1.bias": "model-00001-of-00005.safetensors",
|
| 1701 |
"vision_tower.blocks.6.norm1.weight": "model-00001-of-00005.safetensors",
|
|
@@ -1706,10 +1658,8 @@
|
|
| 1706 |
"vision_tower.blocks.7.attn.qkv.bias": "model-00001-of-00005.safetensors",
|
| 1707 |
"vision_tower.blocks.7.attn.qkv.weight": "model-00001-of-00005.safetensors",
|
| 1708 |
"vision_tower.blocks.7.mlp.linear_fc1.bias": "model-00001-of-00005.safetensors",
|
| 1709 |
-
"vision_tower.blocks.7.mlp.linear_fc1.scales": "model-00001-of-00005.safetensors",
|
| 1710 |
"vision_tower.blocks.7.mlp.linear_fc1.weight": "model-00001-of-00005.safetensors",
|
| 1711 |
"vision_tower.blocks.7.mlp.linear_fc2.bias": "model-00001-of-00005.safetensors",
|
| 1712 |
-
"vision_tower.blocks.7.mlp.linear_fc2.scales": "model-00001-of-00005.safetensors",
|
| 1713 |
"vision_tower.blocks.7.mlp.linear_fc2.weight": "model-00001-of-00005.safetensors",
|
| 1714 |
"vision_tower.blocks.7.norm1.bias": "model-00001-of-00005.safetensors",
|
| 1715 |
"vision_tower.blocks.7.norm1.weight": "model-00001-of-00005.safetensors",
|
|
@@ -1720,10 +1670,8 @@
|
|
| 1720 |
"vision_tower.blocks.8.attn.qkv.bias": "model-00001-of-00005.safetensors",
|
| 1721 |
"vision_tower.blocks.8.attn.qkv.weight": "model-00001-of-00005.safetensors",
|
| 1722 |
"vision_tower.blocks.8.mlp.linear_fc1.bias": "model-00001-of-00005.safetensors",
|
| 1723 |
-
"vision_tower.blocks.8.mlp.linear_fc1.scales": "model-00001-of-00005.safetensors",
|
| 1724 |
"vision_tower.blocks.8.mlp.linear_fc1.weight": "model-00001-of-00005.safetensors",
|
| 1725 |
"vision_tower.blocks.8.mlp.linear_fc2.bias": "model-00001-of-00005.safetensors",
|
| 1726 |
-
"vision_tower.blocks.8.mlp.linear_fc2.scales": "model-00001-of-00005.safetensors",
|
| 1727 |
"vision_tower.blocks.8.mlp.linear_fc2.weight": "model-00001-of-00005.safetensors",
|
| 1728 |
"vision_tower.blocks.8.norm1.bias": "model-00001-of-00005.safetensors",
|
| 1729 |
"vision_tower.blocks.8.norm1.weight": "model-00001-of-00005.safetensors",
|
|
@@ -1734,10 +1682,8 @@
|
|
| 1734 |
"vision_tower.blocks.9.attn.qkv.bias": "model-00001-of-00005.safetensors",
|
| 1735 |
"vision_tower.blocks.9.attn.qkv.weight": "model-00001-of-00005.safetensors",
|
| 1736 |
"vision_tower.blocks.9.mlp.linear_fc1.bias": "model-00001-of-00005.safetensors",
|
| 1737 |
-
"vision_tower.blocks.9.mlp.linear_fc1.scales": "model-00001-of-00005.safetensors",
|
| 1738 |
"vision_tower.blocks.9.mlp.linear_fc1.weight": "model-00001-of-00005.safetensors",
|
| 1739 |
"vision_tower.blocks.9.mlp.linear_fc2.bias": "model-00001-of-00005.safetensors",
|
| 1740 |
-
"vision_tower.blocks.9.mlp.linear_fc2.scales": "model-00001-of-00005.safetensors",
|
| 1741 |
"vision_tower.blocks.9.mlp.linear_fc2.weight": "model-00001-of-00005.safetensors",
|
| 1742 |
"vision_tower.blocks.9.norm1.bias": "model-00001-of-00005.safetensors",
|
| 1743 |
"vision_tower.blocks.9.norm1.weight": "model-00001-of-00005.safetensors",
|
|
|
|
| 1 |
{
|
| 2 |
"metadata": {
|
| 3 |
+
"total_size": 23951648224
|
| 4 |
},
|
| 5 |
"weight_map": {
|
| 6 |
"language_model.lm_head.weight": "model-00005-of-00005.safetensors",
|
|
|
|
| 429 |
"language_model.model.layers.26.mlp.up_proj.scales": "model-00002-of-00005.safetensors",
|
| 430 |
"language_model.model.layers.26.mlp.up_proj.weight": "model-00002-of-00005.safetensors",
|
| 431 |
"language_model.model.layers.26.post_attention_layernorm.weight": "model-00002-of-00005.safetensors",
|
| 432 |
+
"language_model.model.layers.27.input_layernorm.weight": "model-00003-of-00005.safetensors",
|
| 433 |
+
"language_model.model.layers.27.mlp.down_proj.scales": "model-00003-of-00005.safetensors",
|
| 434 |
+
"language_model.model.layers.27.mlp.down_proj.weight": "model-00003-of-00005.safetensors",
|
| 435 |
+
"language_model.model.layers.27.mlp.gate_proj.scales": "model-00003-of-00005.safetensors",
|
| 436 |
+
"language_model.model.layers.27.mlp.gate_proj.weight": "model-00003-of-00005.safetensors",
|
| 437 |
+
"language_model.model.layers.27.mlp.up_proj.scales": "model-00003-of-00005.safetensors",
|
| 438 |
+
"language_model.model.layers.27.mlp.up_proj.weight": "model-00003-of-00005.safetensors",
|
| 439 |
+
"language_model.model.layers.27.post_attention_layernorm.weight": "model-00003-of-00005.safetensors",
|
| 440 |
+
"language_model.model.layers.27.self_attn.k_norm.weight": "model-00003-of-00005.safetensors",
|
| 441 |
+
"language_model.model.layers.27.self_attn.k_proj.scales": "model-00003-of-00005.safetensors",
|
| 442 |
+
"language_model.model.layers.27.self_attn.k_proj.weight": "model-00003-of-00005.safetensors",
|
| 443 |
+
"language_model.model.layers.27.self_attn.o_proj.scales": "model-00003-of-00005.safetensors",
|
| 444 |
+
"language_model.model.layers.27.self_attn.o_proj.weight": "model-00003-of-00005.safetensors",
|
| 445 |
+
"language_model.model.layers.27.self_attn.q_norm.weight": "model-00003-of-00005.safetensors",
|
| 446 |
+
"language_model.model.layers.27.self_attn.q_proj.scales": "model-00003-of-00005.safetensors",
|
| 447 |
+
"language_model.model.layers.27.self_attn.q_proj.weight": "model-00003-of-00005.safetensors",
|
| 448 |
+
"language_model.model.layers.27.self_attn.v_proj.scales": "model-00003-of-00005.safetensors",
|
| 449 |
+
"language_model.model.layers.27.self_attn.v_proj.weight": "model-00003-of-00005.safetensors",
|
| 450 |
+
"language_model.model.layers.28.input_layernorm.weight": "model-00003-of-00005.safetensors",
|
| 451 |
+
"language_model.model.layers.28.linear_attn.A_log": "model-00003-of-00005.safetensors",
|
| 452 |
+
"language_model.model.layers.28.linear_attn.conv1d.weight": "model-00003-of-00005.safetensors",
|
| 453 |
+
"language_model.model.layers.28.linear_attn.dt_bias": "model-00003-of-00005.safetensors",
|
| 454 |
+
"language_model.model.layers.28.linear_attn.in_proj_a.scales": "model-00003-of-00005.safetensors",
|
| 455 |
+
"language_model.model.layers.28.linear_attn.in_proj_a.weight": "model-00003-of-00005.safetensors",
|
| 456 |
+
"language_model.model.layers.28.linear_attn.in_proj_b.scales": "model-00003-of-00005.safetensors",
|
| 457 |
+
"language_model.model.layers.28.linear_attn.in_proj_b.weight": "model-00003-of-00005.safetensors",
|
| 458 |
+
"language_model.model.layers.28.linear_attn.in_proj_qkv.scales": "model-00003-of-00005.safetensors",
|
| 459 |
+
"language_model.model.layers.28.linear_attn.in_proj_qkv.weight": "model-00003-of-00005.safetensors",
|
| 460 |
+
"language_model.model.layers.28.linear_attn.in_proj_z.scales": "model-00003-of-00005.safetensors",
|
| 461 |
+
"language_model.model.layers.28.linear_attn.in_proj_z.weight": "model-00003-of-00005.safetensors",
|
| 462 |
+
"language_model.model.layers.28.linear_attn.norm.weight": "model-00003-of-00005.safetensors",
|
| 463 |
+
"language_model.model.layers.28.linear_attn.out_proj.scales": "model-00003-of-00005.safetensors",
|
| 464 |
+
"language_model.model.layers.28.linear_attn.out_proj.weight": "model-00003-of-00005.safetensors",
|
| 465 |
"language_model.model.layers.28.mlp.down_proj.scales": "model-00003-of-00005.safetensors",
|
| 466 |
"language_model.model.layers.28.mlp.down_proj.weight": "model-00003-of-00005.safetensors",
|
| 467 |
"language_model.model.layers.28.mlp.gate_proj.scales": "model-00003-of-00005.safetensors",
|
| 468 |
"language_model.model.layers.28.mlp.gate_proj.weight": "model-00003-of-00005.safetensors",
|
| 469 |
"language_model.model.layers.28.mlp.up_proj.scales": "model-00003-of-00005.safetensors",
|
| 470 |
"language_model.model.layers.28.mlp.up_proj.weight": "model-00003-of-00005.safetensors",
|
| 471 |
+
"language_model.model.layers.28.post_attention_layernorm.weight": "model-00003-of-00005.safetensors",
|
| 472 |
"language_model.model.layers.29.input_layernorm.weight": "model-00003-of-00005.safetensors",
|
| 473 |
"language_model.model.layers.29.linear_attn.A_log": "model-00003-of-00005.safetensors",
|
| 474 |
"language_model.model.layers.29.linear_attn.conv1d.weight": "model-00003-of-00005.safetensors",
|
|
|
|
| 889 |
"language_model.model.layers.46.mlp.up_proj.scales": "model-00003-of-00005.safetensors",
|
| 890 |
"language_model.model.layers.46.mlp.up_proj.weight": "model-00003-of-00005.safetensors",
|
| 891 |
"language_model.model.layers.46.post_attention_layernorm.weight": "model-00003-of-00005.safetensors",
|
| 892 |
+
"language_model.model.layers.47.input_layernorm.weight": "model-00004-of-00005.safetensors",
|
| 893 |
+
"language_model.model.layers.47.mlp.down_proj.scales": "model-00004-of-00005.safetensors",
|
| 894 |
+
"language_model.model.layers.47.mlp.down_proj.weight": "model-00004-of-00005.safetensors",
|
| 895 |
+
"language_model.model.layers.47.mlp.gate_proj.scales": "model-00004-of-00005.safetensors",
|
| 896 |
+
"language_model.model.layers.47.mlp.gate_proj.weight": "model-00004-of-00005.safetensors",
|
| 897 |
+
"language_model.model.layers.47.mlp.up_proj.scales": "model-00004-of-00005.safetensors",
|
| 898 |
+
"language_model.model.layers.47.mlp.up_proj.weight": "model-00004-of-00005.safetensors",
|
| 899 |
+
"language_model.model.layers.47.post_attention_layernorm.weight": "model-00004-of-00005.safetensors",
|
| 900 |
+
"language_model.model.layers.47.self_attn.k_norm.weight": "model-00004-of-00005.safetensors",
|
| 901 |
+
"language_model.model.layers.47.self_attn.k_proj.scales": "model-00004-of-00005.safetensors",
|
| 902 |
+
"language_model.model.layers.47.self_attn.k_proj.weight": "model-00004-of-00005.safetensors",
|
| 903 |
+
"language_model.model.layers.47.self_attn.o_proj.scales": "model-00004-of-00005.safetensors",
|
| 904 |
+
"language_model.model.layers.47.self_attn.o_proj.weight": "model-00004-of-00005.safetensors",
|
| 905 |
+
"language_model.model.layers.47.self_attn.q_norm.weight": "model-00004-of-00005.safetensors",
|
| 906 |
+
"language_model.model.layers.47.self_attn.q_proj.scales": "model-00004-of-00005.safetensors",
|
| 907 |
+
"language_model.model.layers.47.self_attn.q_proj.weight": "model-00004-of-00005.safetensors",
|
| 908 |
+
"language_model.model.layers.47.self_attn.v_proj.scales": "model-00004-of-00005.safetensors",
|
| 909 |
+
"language_model.model.layers.47.self_attn.v_proj.weight": "model-00004-of-00005.safetensors",
|
| 910 |
+
"language_model.model.layers.48.input_layernorm.weight": "model-00004-of-00005.safetensors",
|
| 911 |
+
"language_model.model.layers.48.linear_attn.A_log": "model-00004-of-00005.safetensors",
|
| 912 |
+
"language_model.model.layers.48.linear_attn.conv1d.weight": "model-00004-of-00005.safetensors",
|
| 913 |
+
"language_model.model.layers.48.linear_attn.dt_bias": "model-00004-of-00005.safetensors",
|
| 914 |
+
"language_model.model.layers.48.linear_attn.in_proj_a.scales": "model-00004-of-00005.safetensors",
|
| 915 |
+
"language_model.model.layers.48.linear_attn.in_proj_a.weight": "model-00004-of-00005.safetensors",
|
| 916 |
+
"language_model.model.layers.48.linear_attn.in_proj_b.scales": "model-00004-of-00005.safetensors",
|
| 917 |
+
"language_model.model.layers.48.linear_attn.in_proj_b.weight": "model-00004-of-00005.safetensors",
|
| 918 |
+
"language_model.model.layers.48.linear_attn.in_proj_qkv.scales": "model-00004-of-00005.safetensors",
|
| 919 |
+
"language_model.model.layers.48.linear_attn.in_proj_qkv.weight": "model-00004-of-00005.safetensors",
|
| 920 |
+
"language_model.model.layers.48.linear_attn.in_proj_z.scales": "model-00004-of-00005.safetensors",
|
| 921 |
+
"language_model.model.layers.48.linear_attn.in_proj_z.weight": "model-00004-of-00005.safetensors",
|
| 922 |
+
"language_model.model.layers.48.linear_attn.norm.weight": "model-00004-of-00005.safetensors",
|
| 923 |
+
"language_model.model.layers.48.linear_attn.out_proj.scales": "model-00004-of-00005.safetensors",
|
| 924 |
+
"language_model.model.layers.48.linear_attn.out_proj.weight": "model-00004-of-00005.safetensors",
|
| 925 |
"language_model.model.layers.48.mlp.down_proj.scales": "model-00004-of-00005.safetensors",
|
| 926 |
"language_model.model.layers.48.mlp.down_proj.weight": "model-00004-of-00005.safetensors",
|
| 927 |
"language_model.model.layers.48.mlp.gate_proj.scales": "model-00004-of-00005.safetensors",
|
| 928 |
"language_model.model.layers.48.mlp.gate_proj.weight": "model-00004-of-00005.safetensors",
|
| 929 |
"language_model.model.layers.48.mlp.up_proj.scales": "model-00004-of-00005.safetensors",
|
| 930 |
"language_model.model.layers.48.mlp.up_proj.weight": "model-00004-of-00005.safetensors",
|
| 931 |
+
"language_model.model.layers.48.post_attention_layernorm.weight": "model-00004-of-00005.safetensors",
|
| 932 |
"language_model.model.layers.49.input_layernorm.weight": "model-00004-of-00005.safetensors",
|
| 933 |
"language_model.model.layers.49.linear_attn.A_log": "model-00004-of-00005.safetensors",
|
| 934 |
"language_model.model.layers.49.linear_attn.conv1d.weight": "model-00004-of-00005.safetensors",
|
|
|
|
| 1287 |
"language_model.model.layers.63.self_attn.q_proj.weight": "model-00004-of-00005.safetensors",
|
| 1288 |
"language_model.model.layers.63.self_attn.v_proj.scales": "model-00004-of-00005.safetensors",
|
| 1289 |
"language_model.model.layers.63.self_attn.v_proj.weight": "model-00004-of-00005.safetensors",
|
| 1290 |
+
"language_model.model.layers.7.input_layernorm.weight": "model-00002-of-00005.safetensors",
|
| 1291 |
+
"language_model.model.layers.7.mlp.down_proj.scales": "model-00002-of-00005.safetensors",
|
| 1292 |
+
"language_model.model.layers.7.mlp.down_proj.weight": "model-00002-of-00005.safetensors",
|
| 1293 |
+
"language_model.model.layers.7.mlp.gate_proj.scales": "model-00002-of-00005.safetensors",
|
| 1294 |
+
"language_model.model.layers.7.mlp.gate_proj.weight": "model-00002-of-00005.safetensors",
|
| 1295 |
+
"language_model.model.layers.7.mlp.up_proj.scales": "model-00002-of-00005.safetensors",
|
| 1296 |
+
"language_model.model.layers.7.mlp.up_proj.weight": "model-00002-of-00005.safetensors",
|
| 1297 |
+
"language_model.model.layers.7.post_attention_layernorm.weight": "model-00002-of-00005.safetensors",
|
| 1298 |
+
"language_model.model.layers.7.self_attn.k_norm.weight": "model-00002-of-00005.safetensors",
|
| 1299 |
+
"language_model.model.layers.7.self_attn.k_proj.scales": "model-00002-of-00005.safetensors",
|
| 1300 |
+
"language_model.model.layers.7.self_attn.k_proj.weight": "model-00002-of-00005.safetensors",
|
| 1301 |
+
"language_model.model.layers.7.self_attn.o_proj.scales": "model-00002-of-00005.safetensors",
|
| 1302 |
+
"language_model.model.layers.7.self_attn.o_proj.weight": "model-00002-of-00005.safetensors",
|
| 1303 |
+
"language_model.model.layers.7.self_attn.q_norm.weight": "model-00002-of-00005.safetensors",
|
| 1304 |
+
"language_model.model.layers.7.self_attn.q_proj.scales": "model-00002-of-00005.safetensors",
|
| 1305 |
+
"language_model.model.layers.7.self_attn.q_proj.weight": "model-00002-of-00005.safetensors",
|
| 1306 |
+
"language_model.model.layers.7.self_attn.v_proj.scales": "model-00002-of-00005.safetensors",
|
| 1307 |
+
"language_model.model.layers.7.self_attn.v_proj.weight": "model-00002-of-00005.safetensors",
|
| 1308 |
+
"language_model.model.layers.8.input_layernorm.weight": "model-00002-of-00005.safetensors",
|
| 1309 |
+
"language_model.model.layers.8.linear_attn.A_log": "model-00002-of-00005.safetensors",
|
| 1310 |
+
"language_model.model.layers.8.linear_attn.conv1d.weight": "model-00002-of-00005.safetensors",
|
| 1311 |
+
"language_model.model.layers.8.linear_attn.dt_bias": "model-00002-of-00005.safetensors",
|
| 1312 |
+
"language_model.model.layers.8.linear_attn.in_proj_a.scales": "model-00002-of-00005.safetensors",
|
| 1313 |
+
"language_model.model.layers.8.linear_attn.in_proj_a.weight": "model-00002-of-00005.safetensors",
|
| 1314 |
+
"language_model.model.layers.8.linear_attn.in_proj_b.scales": "model-00002-of-00005.safetensors",
|
| 1315 |
+
"language_model.model.layers.8.linear_attn.in_proj_b.weight": "model-00002-of-00005.safetensors",
|
| 1316 |
+
"language_model.model.layers.8.linear_attn.in_proj_qkv.scales": "model-00002-of-00005.safetensors",
|
| 1317 |
+
"language_model.model.layers.8.linear_attn.in_proj_qkv.weight": "model-00002-of-00005.safetensors",
|
| 1318 |
+
"language_model.model.layers.8.linear_attn.in_proj_z.scales": "model-00002-of-00005.safetensors",
|
| 1319 |
+
"language_model.model.layers.8.linear_attn.in_proj_z.weight": "model-00002-of-00005.safetensors",
|
| 1320 |
+
"language_model.model.layers.8.linear_attn.norm.weight": "model-00002-of-00005.safetensors",
|
| 1321 |
+
"language_model.model.layers.8.linear_attn.out_proj.scales": "model-00002-of-00005.safetensors",
|
| 1322 |
+
"language_model.model.layers.8.linear_attn.out_proj.weight": "model-00002-of-00005.safetensors",
|
| 1323 |
"language_model.model.layers.8.mlp.down_proj.scales": "model-00002-of-00005.safetensors",
|
| 1324 |
"language_model.model.layers.8.mlp.down_proj.weight": "model-00002-of-00005.safetensors",
|
| 1325 |
"language_model.model.layers.8.mlp.gate_proj.scales": "model-00002-of-00005.safetensors",
|
| 1326 |
"language_model.model.layers.8.mlp.gate_proj.weight": "model-00002-of-00005.safetensors",
|
| 1327 |
"language_model.model.layers.8.mlp.up_proj.scales": "model-00002-of-00005.safetensors",
|
| 1328 |
"language_model.model.layers.8.mlp.up_proj.weight": "model-00002-of-00005.safetensors",
|
| 1329 |
+
"language_model.model.layers.8.post_attention_layernorm.weight": "model-00002-of-00005.safetensors",
|
| 1330 |
"language_model.model.layers.9.input_layernorm.weight": "model-00002-of-00005.safetensors",
|
| 1331 |
"language_model.model.layers.9.linear_attn.A_log": "model-00002-of-00005.safetensors",
|
| 1332 |
"language_model.model.layers.9.linear_attn.conv1d.weight": "model-00002-of-00005.safetensors",
|
|
|
|
| 1370 |
"vision_tower.blocks.0.attn.qkv.bias": "model-00001-of-00005.safetensors",
|
| 1371 |
"vision_tower.blocks.0.attn.qkv.weight": "model-00001-of-00005.safetensors",
|
| 1372 |
"vision_tower.blocks.0.mlp.linear_fc1.bias": "model-00001-of-00005.safetensors",
|
|
|
|
| 1373 |
"vision_tower.blocks.0.mlp.linear_fc1.weight": "model-00001-of-00005.safetensors",
|
| 1374 |
"vision_tower.blocks.0.mlp.linear_fc2.bias": "model-00001-of-00005.safetensors",
|
|
|
|
| 1375 |
"vision_tower.blocks.0.mlp.linear_fc2.weight": "model-00001-of-00005.safetensors",
|
| 1376 |
"vision_tower.blocks.0.norm1.bias": "model-00001-of-00005.safetensors",
|
| 1377 |
"vision_tower.blocks.0.norm1.weight": "model-00001-of-00005.safetensors",
|
|
|
|
| 1382 |
"vision_tower.blocks.1.attn.qkv.bias": "model-00001-of-00005.safetensors",
|
| 1383 |
"vision_tower.blocks.1.attn.qkv.weight": "model-00001-of-00005.safetensors",
|
| 1384 |
"vision_tower.blocks.1.mlp.linear_fc1.bias": "model-00001-of-00005.safetensors",
|
|
|
|
| 1385 |
"vision_tower.blocks.1.mlp.linear_fc1.weight": "model-00001-of-00005.safetensors",
|
| 1386 |
"vision_tower.blocks.1.mlp.linear_fc2.bias": "model-00001-of-00005.safetensors",
|
|
|
|
| 1387 |
"vision_tower.blocks.1.mlp.linear_fc2.weight": "model-00001-of-00005.safetensors",
|
| 1388 |
"vision_tower.blocks.1.norm1.bias": "model-00001-of-00005.safetensors",
|
| 1389 |
"vision_tower.blocks.1.norm1.weight": "model-00001-of-00005.safetensors",
|
|
|
|
| 1394 |
"vision_tower.blocks.10.attn.qkv.bias": "model-00001-of-00005.safetensors",
|
| 1395 |
"vision_tower.blocks.10.attn.qkv.weight": "model-00001-of-00005.safetensors",
|
| 1396 |
"vision_tower.blocks.10.mlp.linear_fc1.bias": "model-00001-of-00005.safetensors",
|
|
|
|
| 1397 |
"vision_tower.blocks.10.mlp.linear_fc1.weight": "model-00001-of-00005.safetensors",
|
| 1398 |
"vision_tower.blocks.10.mlp.linear_fc2.bias": "model-00001-of-00005.safetensors",
|
|
|
|
| 1399 |
"vision_tower.blocks.10.mlp.linear_fc2.weight": "model-00001-of-00005.safetensors",
|
| 1400 |
"vision_tower.blocks.10.norm1.bias": "model-00001-of-00005.safetensors",
|
| 1401 |
"vision_tower.blocks.10.norm1.weight": "model-00001-of-00005.safetensors",
|
|
|
|
| 1406 |
"vision_tower.blocks.11.attn.qkv.bias": "model-00001-of-00005.safetensors",
|
| 1407 |
"vision_tower.blocks.11.attn.qkv.weight": "model-00001-of-00005.safetensors",
|
| 1408 |
"vision_tower.blocks.11.mlp.linear_fc1.bias": "model-00001-of-00005.safetensors",
|
|
|
|
| 1409 |
"vision_tower.blocks.11.mlp.linear_fc1.weight": "model-00001-of-00005.safetensors",
|
| 1410 |
"vision_tower.blocks.11.mlp.linear_fc2.bias": "model-00001-of-00005.safetensors",
|
|
|
|
| 1411 |
"vision_tower.blocks.11.mlp.linear_fc2.weight": "model-00001-of-00005.safetensors",
|
| 1412 |
"vision_tower.blocks.11.norm1.bias": "model-00001-of-00005.safetensors",
|
| 1413 |
"vision_tower.blocks.11.norm1.weight": "model-00001-of-00005.safetensors",
|
|
|
|
| 1418 |
"vision_tower.blocks.12.attn.qkv.bias": "model-00001-of-00005.safetensors",
|
| 1419 |
"vision_tower.blocks.12.attn.qkv.weight": "model-00001-of-00005.safetensors",
|
| 1420 |
"vision_tower.blocks.12.mlp.linear_fc1.bias": "model-00001-of-00005.safetensors",
|
|
|
|
| 1421 |
"vision_tower.blocks.12.mlp.linear_fc1.weight": "model-00001-of-00005.safetensors",
|
| 1422 |
"vision_tower.blocks.12.mlp.linear_fc2.bias": "model-00001-of-00005.safetensors",
|
|
|
|
| 1423 |
"vision_tower.blocks.12.mlp.linear_fc2.weight": "model-00001-of-00005.safetensors",
|
| 1424 |
"vision_tower.blocks.12.norm1.bias": "model-00001-of-00005.safetensors",
|
| 1425 |
"vision_tower.blocks.12.norm1.weight": "model-00001-of-00005.safetensors",
|
|
|
|
| 1430 |
"vision_tower.blocks.13.attn.qkv.bias": "model-00001-of-00005.safetensors",
|
| 1431 |
"vision_tower.blocks.13.attn.qkv.weight": "model-00001-of-00005.safetensors",
|
| 1432 |
"vision_tower.blocks.13.mlp.linear_fc1.bias": "model-00001-of-00005.safetensors",
|
|
|
|
| 1433 |
"vision_tower.blocks.13.mlp.linear_fc1.weight": "model-00001-of-00005.safetensors",
|
| 1434 |
"vision_tower.blocks.13.mlp.linear_fc2.bias": "model-00001-of-00005.safetensors",
|
|
|
|
| 1435 |
"vision_tower.blocks.13.mlp.linear_fc2.weight": "model-00001-of-00005.safetensors",
|
| 1436 |
"vision_tower.blocks.13.norm1.bias": "model-00001-of-00005.safetensors",
|
| 1437 |
"vision_tower.blocks.13.norm1.weight": "model-00001-of-00005.safetensors",
|
|
|
|
| 1442 |
"vision_tower.blocks.14.attn.qkv.bias": "model-00001-of-00005.safetensors",
|
| 1443 |
"vision_tower.blocks.14.attn.qkv.weight": "model-00001-of-00005.safetensors",
|
| 1444 |
"vision_tower.blocks.14.mlp.linear_fc1.bias": "model-00001-of-00005.safetensors",
|
|
|
|
| 1445 |
"vision_tower.blocks.14.mlp.linear_fc1.weight": "model-00001-of-00005.safetensors",
|
| 1446 |
"vision_tower.blocks.14.mlp.linear_fc2.bias": "model-00001-of-00005.safetensors",
|
|
|
|
| 1447 |
"vision_tower.blocks.14.mlp.linear_fc2.weight": "model-00001-of-00005.safetensors",
|
| 1448 |
"vision_tower.blocks.14.norm1.bias": "model-00001-of-00005.safetensors",
|
| 1449 |
"vision_tower.blocks.14.norm1.weight": "model-00001-of-00005.safetensors",
|
|
|
|
| 1454 |
"vision_tower.blocks.15.attn.qkv.bias": "model-00001-of-00005.safetensors",
|
| 1455 |
"vision_tower.blocks.15.attn.qkv.weight": "model-00001-of-00005.safetensors",
|
| 1456 |
"vision_tower.blocks.15.mlp.linear_fc1.bias": "model-00001-of-00005.safetensors",
|
|
|
|
| 1457 |
"vision_tower.blocks.15.mlp.linear_fc1.weight": "model-00001-of-00005.safetensors",
|
| 1458 |
"vision_tower.blocks.15.mlp.linear_fc2.bias": "model-00001-of-00005.safetensors",
|
|
|
|
| 1459 |
"vision_tower.blocks.15.mlp.linear_fc2.weight": "model-00001-of-00005.safetensors",
|
| 1460 |
"vision_tower.blocks.15.norm1.bias": "model-00001-of-00005.safetensors",
|
| 1461 |
"vision_tower.blocks.15.norm1.weight": "model-00001-of-00005.safetensors",
|
|
|
|
| 1466 |
"vision_tower.blocks.16.attn.qkv.bias": "model-00001-of-00005.safetensors",
|
| 1467 |
"vision_tower.blocks.16.attn.qkv.weight": "model-00001-of-00005.safetensors",
|
| 1468 |
"vision_tower.blocks.16.mlp.linear_fc1.bias": "model-00001-of-00005.safetensors",
|
|
|
|
| 1469 |
"vision_tower.blocks.16.mlp.linear_fc1.weight": "model-00001-of-00005.safetensors",
|
| 1470 |
"vision_tower.blocks.16.mlp.linear_fc2.bias": "model-00001-of-00005.safetensors",
|
|
|
|
| 1471 |
"vision_tower.blocks.16.mlp.linear_fc2.weight": "model-00001-of-00005.safetensors",
|
| 1472 |
"vision_tower.blocks.16.norm1.bias": "model-00001-of-00005.safetensors",
|
| 1473 |
"vision_tower.blocks.16.norm1.weight": "model-00001-of-00005.safetensors",
|
|
|
|
| 1478 |
"vision_tower.blocks.17.attn.qkv.bias": "model-00001-of-00005.safetensors",
|
| 1479 |
"vision_tower.blocks.17.attn.qkv.weight": "model-00001-of-00005.safetensors",
|
| 1480 |
"vision_tower.blocks.17.mlp.linear_fc1.bias": "model-00001-of-00005.safetensors",
|
|
|
|
| 1481 |
"vision_tower.blocks.17.mlp.linear_fc1.weight": "model-00001-of-00005.safetensors",
|
| 1482 |
"vision_tower.blocks.17.mlp.linear_fc2.bias": "model-00001-of-00005.safetensors",
|
|
|
|
| 1483 |
"vision_tower.blocks.17.mlp.linear_fc2.weight": "model-00001-of-00005.safetensors",
|
| 1484 |
"vision_tower.blocks.17.norm1.bias": "model-00001-of-00005.safetensors",
|
| 1485 |
"vision_tower.blocks.17.norm1.weight": "model-00001-of-00005.safetensors",
|
|
|
|
| 1490 |
"vision_tower.blocks.18.attn.qkv.bias": "model-00001-of-00005.safetensors",
|
| 1491 |
"vision_tower.blocks.18.attn.qkv.weight": "model-00001-of-00005.safetensors",
|
| 1492 |
"vision_tower.blocks.18.mlp.linear_fc1.bias": "model-00001-of-00005.safetensors",
|
|
|
|
| 1493 |
"vision_tower.blocks.18.mlp.linear_fc1.weight": "model-00001-of-00005.safetensors",
|
| 1494 |
"vision_tower.blocks.18.mlp.linear_fc2.bias": "model-00001-of-00005.safetensors",
|
|
|
|
| 1495 |
"vision_tower.blocks.18.mlp.linear_fc2.weight": "model-00001-of-00005.safetensors",
|
| 1496 |
"vision_tower.blocks.18.norm1.bias": "model-00001-of-00005.safetensors",
|
| 1497 |
"vision_tower.blocks.18.norm1.weight": "model-00001-of-00005.safetensors",
|
|
|
|
| 1502 |
"vision_tower.blocks.19.attn.qkv.bias": "model-00001-of-00005.safetensors",
|
| 1503 |
"vision_tower.blocks.19.attn.qkv.weight": "model-00001-of-00005.safetensors",
|
| 1504 |
"vision_tower.blocks.19.mlp.linear_fc1.bias": "model-00001-of-00005.safetensors",
|
|
|
|
| 1505 |
"vision_tower.blocks.19.mlp.linear_fc1.weight": "model-00001-of-00005.safetensors",
|
| 1506 |
"vision_tower.blocks.19.mlp.linear_fc2.bias": "model-00001-of-00005.safetensors",
|
|
|
|
| 1507 |
"vision_tower.blocks.19.mlp.linear_fc2.weight": "model-00001-of-00005.safetensors",
|
| 1508 |
"vision_tower.blocks.19.norm1.bias": "model-00001-of-00005.safetensors",
|
| 1509 |
"vision_tower.blocks.19.norm1.weight": "model-00001-of-00005.safetensors",
|
|
|
|
| 1514 |
"vision_tower.blocks.2.attn.qkv.bias": "model-00001-of-00005.safetensors",
|
| 1515 |
"vision_tower.blocks.2.attn.qkv.weight": "model-00001-of-00005.safetensors",
|
| 1516 |
"vision_tower.blocks.2.mlp.linear_fc1.bias": "model-00001-of-00005.safetensors",
|
|
|
|
| 1517 |
"vision_tower.blocks.2.mlp.linear_fc1.weight": "model-00001-of-00005.safetensors",
|
| 1518 |
"vision_tower.blocks.2.mlp.linear_fc2.bias": "model-00001-of-00005.safetensors",
|
|
|
|
| 1519 |
"vision_tower.blocks.2.mlp.linear_fc2.weight": "model-00001-of-00005.safetensors",
|
| 1520 |
"vision_tower.blocks.2.norm1.bias": "model-00001-of-00005.safetensors",
|
| 1521 |
"vision_tower.blocks.2.norm1.weight": "model-00001-of-00005.safetensors",
|
|
|
|
| 1526 |
"vision_tower.blocks.20.attn.qkv.bias": "model-00001-of-00005.safetensors",
|
| 1527 |
"vision_tower.blocks.20.attn.qkv.weight": "model-00001-of-00005.safetensors",
|
| 1528 |
"vision_tower.blocks.20.mlp.linear_fc1.bias": "model-00001-of-00005.safetensors",
|
|
|
|
| 1529 |
"vision_tower.blocks.20.mlp.linear_fc1.weight": "model-00001-of-00005.safetensors",
|
| 1530 |
"vision_tower.blocks.20.mlp.linear_fc2.bias": "model-00001-of-00005.safetensors",
|
|
|
|
| 1531 |
"vision_tower.blocks.20.mlp.linear_fc2.weight": "model-00001-of-00005.safetensors",
|
| 1532 |
"vision_tower.blocks.20.norm1.bias": "model-00001-of-00005.safetensors",
|
| 1533 |
"vision_tower.blocks.20.norm1.weight": "model-00001-of-00005.safetensors",
|
|
|
|
| 1538 |
"vision_tower.blocks.21.attn.qkv.bias": "model-00001-of-00005.safetensors",
|
| 1539 |
"vision_tower.blocks.21.attn.qkv.weight": "model-00001-of-00005.safetensors",
|
| 1540 |
"vision_tower.blocks.21.mlp.linear_fc1.bias": "model-00001-of-00005.safetensors",
|
|
|
|
| 1541 |
"vision_tower.blocks.21.mlp.linear_fc1.weight": "model-00001-of-00005.safetensors",
|
| 1542 |
"vision_tower.blocks.21.mlp.linear_fc2.bias": "model-00001-of-00005.safetensors",
|
|
|
|
| 1543 |
"vision_tower.blocks.21.mlp.linear_fc2.weight": "model-00001-of-00005.safetensors",
|
| 1544 |
"vision_tower.blocks.21.norm1.bias": "model-00001-of-00005.safetensors",
|
| 1545 |
"vision_tower.blocks.21.norm1.weight": "model-00001-of-00005.safetensors",
|
|
|
|
| 1550 |
"vision_tower.blocks.22.attn.qkv.bias": "model-00001-of-00005.safetensors",
|
| 1551 |
"vision_tower.blocks.22.attn.qkv.weight": "model-00001-of-00005.safetensors",
|
| 1552 |
"vision_tower.blocks.22.mlp.linear_fc1.bias": "model-00001-of-00005.safetensors",
|
|
|
|
| 1553 |
"vision_tower.blocks.22.mlp.linear_fc1.weight": "model-00001-of-00005.safetensors",
|
| 1554 |
"vision_tower.blocks.22.mlp.linear_fc2.bias": "model-00001-of-00005.safetensors",
|
|
|
|
| 1555 |
"vision_tower.blocks.22.mlp.linear_fc2.weight": "model-00001-of-00005.safetensors",
|
| 1556 |
"vision_tower.blocks.22.norm1.bias": "model-00001-of-00005.safetensors",
|
| 1557 |
"vision_tower.blocks.22.norm1.weight": "model-00001-of-00005.safetensors",
|
|
|
|
| 1562 |
"vision_tower.blocks.23.attn.qkv.bias": "model-00001-of-00005.safetensors",
|
| 1563 |
"vision_tower.blocks.23.attn.qkv.weight": "model-00001-of-00005.safetensors",
|
| 1564 |
"vision_tower.blocks.23.mlp.linear_fc1.bias": "model-00001-of-00005.safetensors",
|
|
|
|
| 1565 |
"vision_tower.blocks.23.mlp.linear_fc1.weight": "model-00001-of-00005.safetensors",
|
| 1566 |
"vision_tower.blocks.23.mlp.linear_fc2.bias": "model-00001-of-00005.safetensors",
|
|
|
|
| 1567 |
"vision_tower.blocks.23.mlp.linear_fc2.weight": "model-00001-of-00005.safetensors",
|
| 1568 |
"vision_tower.blocks.23.norm1.bias": "model-00001-of-00005.safetensors",
|
| 1569 |
"vision_tower.blocks.23.norm1.weight": "model-00001-of-00005.safetensors",
|
|
|
|
| 1574 |
"vision_tower.blocks.24.attn.qkv.bias": "model-00001-of-00005.safetensors",
|
| 1575 |
"vision_tower.blocks.24.attn.qkv.weight": "model-00001-of-00005.safetensors",
|
| 1576 |
"vision_tower.blocks.24.mlp.linear_fc1.bias": "model-00001-of-00005.safetensors",
|
|
|
|
| 1577 |
"vision_tower.blocks.24.mlp.linear_fc1.weight": "model-00001-of-00005.safetensors",
|
| 1578 |
"vision_tower.blocks.24.mlp.linear_fc2.bias": "model-00001-of-00005.safetensors",
|
|
|
|
| 1579 |
"vision_tower.blocks.24.mlp.linear_fc2.weight": "model-00001-of-00005.safetensors",
|
| 1580 |
"vision_tower.blocks.24.norm1.bias": "model-00001-of-00005.safetensors",
|
| 1581 |
"vision_tower.blocks.24.norm1.weight": "model-00001-of-00005.safetensors",
|
|
|
|
| 1586 |
"vision_tower.blocks.25.attn.qkv.bias": "model-00001-of-00005.safetensors",
|
| 1587 |
"vision_tower.blocks.25.attn.qkv.weight": "model-00001-of-00005.safetensors",
|
| 1588 |
"vision_tower.blocks.25.mlp.linear_fc1.bias": "model-00001-of-00005.safetensors",
|
|
|
|
| 1589 |
"vision_tower.blocks.25.mlp.linear_fc1.weight": "model-00001-of-00005.safetensors",
|
| 1590 |
"vision_tower.blocks.25.mlp.linear_fc2.bias": "model-00001-of-00005.safetensors",
|
|
|
|
| 1591 |
"vision_tower.blocks.25.mlp.linear_fc2.weight": "model-00001-of-00005.safetensors",
|
| 1592 |
"vision_tower.blocks.25.norm1.bias": "model-00001-of-00005.safetensors",
|
| 1593 |
"vision_tower.blocks.25.norm1.weight": "model-00001-of-00005.safetensors",
|
|
|
|
| 1598 |
"vision_tower.blocks.26.attn.qkv.bias": "model-00001-of-00005.safetensors",
|
| 1599 |
"vision_tower.blocks.26.attn.qkv.weight": "model-00001-of-00005.safetensors",
|
| 1600 |
"vision_tower.blocks.26.mlp.linear_fc1.bias": "model-00001-of-00005.safetensors",
|
|
|
|
| 1601 |
"vision_tower.blocks.26.mlp.linear_fc1.weight": "model-00001-of-00005.safetensors",
|
| 1602 |
"vision_tower.blocks.26.mlp.linear_fc2.bias": "model-00001-of-00005.safetensors",
|
|
|
|
| 1603 |
"vision_tower.blocks.26.mlp.linear_fc2.weight": "model-00001-of-00005.safetensors",
|
| 1604 |
"vision_tower.blocks.26.norm1.bias": "model-00001-of-00005.safetensors",
|
| 1605 |
"vision_tower.blocks.26.norm1.weight": "model-00001-of-00005.safetensors",
|
|
|
|
| 1610 |
"vision_tower.blocks.3.attn.qkv.bias": "model-00001-of-00005.safetensors",
|
| 1611 |
"vision_tower.blocks.3.attn.qkv.weight": "model-00001-of-00005.safetensors",
|
| 1612 |
"vision_tower.blocks.3.mlp.linear_fc1.bias": "model-00001-of-00005.safetensors",
|
|
|
|
| 1613 |
"vision_tower.blocks.3.mlp.linear_fc1.weight": "model-00001-of-00005.safetensors",
|
| 1614 |
"vision_tower.blocks.3.mlp.linear_fc2.bias": "model-00001-of-00005.safetensors",
|
|
|
|
| 1615 |
"vision_tower.blocks.3.mlp.linear_fc2.weight": "model-00001-of-00005.safetensors",
|
| 1616 |
"vision_tower.blocks.3.norm1.bias": "model-00001-of-00005.safetensors",
|
| 1617 |
"vision_tower.blocks.3.norm1.weight": "model-00001-of-00005.safetensors",
|
|
|
|
| 1622 |
"vision_tower.blocks.4.attn.qkv.bias": "model-00001-of-00005.safetensors",
|
| 1623 |
"vision_tower.blocks.4.attn.qkv.weight": "model-00001-of-00005.safetensors",
|
| 1624 |
"vision_tower.blocks.4.mlp.linear_fc1.bias": "model-00001-of-00005.safetensors",
|
|
|
|
| 1625 |
"vision_tower.blocks.4.mlp.linear_fc1.weight": "model-00001-of-00005.safetensors",
|
| 1626 |
"vision_tower.blocks.4.mlp.linear_fc2.bias": "model-00001-of-00005.safetensors",
|
|
|
|
| 1627 |
"vision_tower.blocks.4.mlp.linear_fc2.weight": "model-00001-of-00005.safetensors",
|
| 1628 |
"vision_tower.blocks.4.norm1.bias": "model-00001-of-00005.safetensors",
|
| 1629 |
"vision_tower.blocks.4.norm1.weight": "model-00001-of-00005.safetensors",
|
|
|
|
| 1634 |
"vision_tower.blocks.5.attn.qkv.bias": "model-00001-of-00005.safetensors",
|
| 1635 |
"vision_tower.blocks.5.attn.qkv.weight": "model-00001-of-00005.safetensors",
|
| 1636 |
"vision_tower.blocks.5.mlp.linear_fc1.bias": "model-00001-of-00005.safetensors",
|
|
|
|
| 1637 |
"vision_tower.blocks.5.mlp.linear_fc1.weight": "model-00001-of-00005.safetensors",
|
| 1638 |
"vision_tower.blocks.5.mlp.linear_fc2.bias": "model-00001-of-00005.safetensors",
|
|
|
|
| 1639 |
"vision_tower.blocks.5.mlp.linear_fc2.weight": "model-00001-of-00005.safetensors",
|
| 1640 |
"vision_tower.blocks.5.norm1.bias": "model-00001-of-00005.safetensors",
|
| 1641 |
"vision_tower.blocks.5.norm1.weight": "model-00001-of-00005.safetensors",
|
|
|
|
| 1646 |
"vision_tower.blocks.6.attn.qkv.bias": "model-00001-of-00005.safetensors",
|
| 1647 |
"vision_tower.blocks.6.attn.qkv.weight": "model-00001-of-00005.safetensors",
|
| 1648 |
"vision_tower.blocks.6.mlp.linear_fc1.bias": "model-00001-of-00005.safetensors",
|
|
|
|
| 1649 |
"vision_tower.blocks.6.mlp.linear_fc1.weight": "model-00001-of-00005.safetensors",
|
| 1650 |
"vision_tower.blocks.6.mlp.linear_fc2.bias": "model-00001-of-00005.safetensors",
|
|
|
|
| 1651 |
"vision_tower.blocks.6.mlp.linear_fc2.weight": "model-00001-of-00005.safetensors",
|
| 1652 |
"vision_tower.blocks.6.norm1.bias": "model-00001-of-00005.safetensors",
|
| 1653 |
"vision_tower.blocks.6.norm1.weight": "model-00001-of-00005.safetensors",
|
|
|
|
| 1658 |
"vision_tower.blocks.7.attn.qkv.bias": "model-00001-of-00005.safetensors",
|
| 1659 |
"vision_tower.blocks.7.attn.qkv.weight": "model-00001-of-00005.safetensors",
|
| 1660 |
"vision_tower.blocks.7.mlp.linear_fc1.bias": "model-00001-of-00005.safetensors",
|
|
|
|
| 1661 |
"vision_tower.blocks.7.mlp.linear_fc1.weight": "model-00001-of-00005.safetensors",
|
| 1662 |
"vision_tower.blocks.7.mlp.linear_fc2.bias": "model-00001-of-00005.safetensors",
|
|
|
|
| 1663 |
"vision_tower.blocks.7.mlp.linear_fc2.weight": "model-00001-of-00005.safetensors",
|
| 1664 |
"vision_tower.blocks.7.norm1.bias": "model-00001-of-00005.safetensors",
|
| 1665 |
"vision_tower.blocks.7.norm1.weight": "model-00001-of-00005.safetensors",
|
|
|
|
| 1670 |
"vision_tower.blocks.8.attn.qkv.bias": "model-00001-of-00005.safetensors",
|
| 1671 |
"vision_tower.blocks.8.attn.qkv.weight": "model-00001-of-00005.safetensors",
|
| 1672 |
"vision_tower.blocks.8.mlp.linear_fc1.bias": "model-00001-of-00005.safetensors",
|
|
|
|
| 1673 |
"vision_tower.blocks.8.mlp.linear_fc1.weight": "model-00001-of-00005.safetensors",
|
| 1674 |
"vision_tower.blocks.8.mlp.linear_fc2.bias": "model-00001-of-00005.safetensors",
|
|
|
|
| 1675 |
"vision_tower.blocks.8.mlp.linear_fc2.weight": "model-00001-of-00005.safetensors",
|
| 1676 |
"vision_tower.blocks.8.norm1.bias": "model-00001-of-00005.safetensors",
|
| 1677 |
"vision_tower.blocks.8.norm1.weight": "model-00001-of-00005.safetensors",
|
|
|
|
| 1682 |
"vision_tower.blocks.9.attn.qkv.bias": "model-00001-of-00005.safetensors",
|
| 1683 |
"vision_tower.blocks.9.attn.qkv.weight": "model-00001-of-00005.safetensors",
|
| 1684 |
"vision_tower.blocks.9.mlp.linear_fc1.bias": "model-00001-of-00005.safetensors",
|
|
|
|
| 1685 |
"vision_tower.blocks.9.mlp.linear_fc1.weight": "model-00001-of-00005.safetensors",
|
| 1686 |
"vision_tower.blocks.9.mlp.linear_fc2.bias": "model-00001-of-00005.safetensors",
|
|
|
|
| 1687 |
"vision_tower.blocks.9.mlp.linear_fc2.weight": "model-00001-of-00005.safetensors",
|
| 1688 |
"vision_tower.blocks.9.norm1.bias": "model-00001-of-00005.safetensors",
|
| 1689 |
"vision_tower.blocks.9.norm1.weight": "model-00001-of-00005.safetensors",
|