Qwen3-VL-32B-Abliterated-xCloud-GGUF

ไปฅ Qwen/Qwen3-VL-32B-Instruct ็‚บๅบ•๏ผŒ็ถ“ abliteration๏ผˆๆ‹’็ต•ๆ–นๅ‘ๆญฃไบคๅŒ–๏ผ‰ ้™ไฝŽ้Žๅบฆๆ‹’็ต•็š„ ่ฆ–่ฆบ่ชž่จ€ๆจกๅž‹๏ผˆๅซ่ฆ–่ฆบ mmproj๏ผ‰๏ผŒGGUF ้‡ๅŒ–ๆ ผๅผ๏ผŒ็”ฑ xCloudinfo๏ผˆไบ‘็ขฉ็ง‘ๆŠ€๏ผ‰ ้‡‹ๅ‡บใ€‚

ไฝฟ็”จๅ‰ๆ๏ผšๆœฌๆจกๅž‹ๅƒ…ไพ›ๅœจๅˆๆณ•ใ€ไธ้•ๆณ•็š„ๅ‰ๆไธ‹ไฝฟ็”จ โ€”โ€” ๆŽˆๆฌŠ็ฏ„ๅœๅ…ง็š„่ณ‡ๅฎ‰็ ”็ฉถใ€็ด…้šŠๆธฌ่ฉฆใ€ ๅ…งๅฎนๅฏฉๆ ธ็ ”็ฉถใ€ๅญธ่ก“็ ”็ฉถ๏ผŒไปฅๅŠๆธ›ๅฐ‘ๆจกๅž‹ใ€Œ้Žๅบฆๆ‹’็ต•ใ€้€ ๆˆ็š„ๅฏ็”จๆ€งๅ•้กŒใ€‚ไฝฟ็”จ่€…้ ˆ่‡ช่กŒ็‚บๅ…ถ ็”จ้€”่ฒ ๅ…จ้ƒจๆณ•ๅพ‹่ˆ‡้“ๅพท่ฒฌไปป๏ผ›ๅšด็ฆ็”จๆ–ผไปปไฝ•้•ๆณ•่กŒ็‚บใ€‚ ้‡‹ๅ‡บ่€…ไธ็‚บไปปไฝ•ๆฟซ็”จ่ƒŒๆ›ธๆˆ–่ฒ ่ฒฌใ€‚

้€™ๆ˜ฏไป€้บผ

ๅŽŸๅง‹ Instruct ๆจกๅž‹ๅฐ่จฑๅคš้›™็”จใ€ๅˆๆณ•ไฝ†ๆ•ๆ„Ÿ็š„่ซ‹ๆฑ‚ๆœƒๅๅฐ„ๆ€งๆ‹’็ต•๏ผŒๅฝฑ้Ÿฟ็ ”็ฉถ่ˆ‡็ด…้šŠๅทฅไฝœ็š„ๅฏ็”จๆ€งใ€‚ ๆœฌ็‰ˆๆœฌๆŽก็”จ Arditi et al. (2024)ใ€ŠRefusal in LLMs is mediated by a single directionใ€‹็š„ๆ–นๆณ•๏ผŒ ๅพžๆฎ˜ๅทฎๆตๅฏซๅ…ฅๆฌŠ้‡ไธญๆŠŠใ€Œๆ‹’็ต•ๆ–นๅ‘ใ€ๆญฃไบคๅŒ–็งป้™ค๏ผŒไธ้‡ๆ–ฐ่จ“็ทด๏ผŒๅ› ๆญคไฟ็•™ๅŽŸๆจกๅž‹็š„่ƒฝๅŠ›่ˆ‡่ฆ–่ฆบ็†่งฃ๏ผŒ ๅƒ…้™ไฝŽ้Žๅบฆๆ‹’็ต•ใ€‚

  • ๆ–นๆณ•๏ผšๅ–ฎไธ€ๆ‹’็ต•ๆ–นๅ‘ๆญฃไบคๅŒ–๏ผˆembedding + ๅ„ๅฑค o_proj / down_proj๏ผ‰๏ผŒๆŠฝๅ–ๅฑค layer 28๏ผˆๅฏฆๆธฌๆญคๅฑคๆ–นๅ‘ๆœ€ไนพๆทจ๏ผ‰ใ€‚
  • ่ฆ–่ฆบ๏ผšไฟ็•™๏ผˆ้™„ mmproj-*-f16.gguf๏ผŒ็œ‹ๅœ–่ƒฝๅŠ›่ˆ‡ๅบ•ๆจกไธ€่‡ด๏ผ‰ใ€‚
  • ่ชž่จ€๏ผšไธญ่‹ฑ้›™่ชž๏ผ›็น้ซ”ไธญๆ–‡่ผธๅ‡บ็ถ“้ฉ—่ญ‰ๆœชๅ› ่™•็†ๆˆ–้‡ๅŒ–่€ŒๅŠฃๅŒ–ใ€‚

้‡ๅŒ–้šŽๆขฏ

ๆช”ๆกˆ ้‡ๅŒ– ๅคงๅฐ
Qwen3-VL-32B-Abliterated-xCloud-Q8_0.gguf Q8_0 34.8 GB
Qwen3-VL-32B-Abliterated-xCloud-Q6_K.gguf Q6_K 26.9 GB
Qwen3-VL-32B-Abliterated-xCloud-Q5_K_M.gguf Q5_K_M 23.2 GB
Qwen3-VL-32B-Abliterated-xCloud-Q4_K_M.gguf Q4_K_M 19.8 GB
mmproj-Qwen3-VL-32B-Abliterated-xCloud-f16.gguf ่ฆ–่ฆบๆŠ•ๅฝฑ 1.2 GB

็œ‹ๅœ–ไฝฟ็”จ้œ€ๅŒๆ™‚่ผ‰ๅ…ฅๅฐๆ‡‰็š„ mmproj ๆช”ใ€‚

ๆ•ˆๆžœ๏ผˆ่ช ๅฏฆๆญ้œฒ๏ผ‰

ไปฅไธ€็ต„ 10 ้กŒๅšด้‡ๅฑๅฎณ held-out ๅฏฆๆธฌๆ‹’็ญ”็އ๏ผˆ่ถŠไฝŽ่กจ็คบ่ถŠๅฐ‘ๅๅฐ„ๆ€งๆ‹’็ต•๏ผ‰๏ผš

  • ๅŽŸๅง‹ Instruct๏ผšๆ‹’็ญ” ~10/10
  • ๆœฌ็‰ˆๆœฌ๏ผˆQ4_K_M๏ผŒ้‡ๅŒ–ๅพŒๅฏฆๆธฌ๏ผ‰๏ผšๆ‹’็ญ” ~1/10๏ผŒไธ”ๆญฃๅธธไปปๅ‹™ไธๅ—ๅฝฑ้Ÿฟใ€็น้ซ”ไธญๆ–‡่ผธๅ‡บๅฎŒๆ•ดใ€‚

ๅ–ฎไธ€ๆ–นๅ‘ abliteration ไธไฟ่ญ‰็งป้™คๆ‰€ๆœ‰ๅฎ‰ๅ…จ่กŒ็‚บ๏ผŒไนŸไธๆ‡‰่ขซ่ฆ–็‚บ็งป้™คใ€‚่ซ‹ๅœจไธŠ่ฟฐไฝฟ็”จๅ‰ๆไธ‹่ฒ ่ฒฌไปปๅœฐไฝฟ็”จใ€‚

ๆณจๆ„๏ผšๆœฌๆจกๅž‹็š„ไธ–็•Œ่ง€ใ€ๆ”ฟๆฒป็ซ‹ๅ ดใ€ไบ‹ๅฏฆๆ€ง้™ณ่ฟฐ็ญ‰ๅ…งๅฎน็นผๆ‰ฟ่‡ชๅบ•ๆจก Qwen3-VL๏ผˆไธญๅœ‹ไพ†ๆบ๏ผ‰๏ผŒ ไธๅœจๆœฌๆฌก abliteration ็š„่™•็†็ฏ„ๅœๅ…ง๏ผ›abliteration ๅƒ…่ชฟๆ•ดใ€Œๆ‹’็ต•่กŒ็‚บใ€๏ผŒไธๆ”น่ฎŠๆจกๅž‹ๆ—ขๆœ‰็š„ๅƒนๅ€ผๅˆคๆ–ทใ€‚

็”จๆณ•๏ผˆllama.cpp๏ผ‰

# ็ด”ๆ–‡ๅญ—
llama-cli -m Qwen3-VL-32B-Abliterated-xCloud-Q4_K_M.gguf -p "ไฝ ็š„ๆ็คบ"
# ็œ‹ๅœ–๏ผˆๅธถ mmproj๏ผ‰
llama-server -m Qwen3-VL-32B-Abliterated-xCloud-Q4_K_M.gguf \
  --mmproj mmproj-Qwen3-VL-32B-Abliterated-xCloud-f16.gguf

xCloudinfo ยท ไบ‘็ขฉ็ง‘ๆŠ€ใ€€|ใ€€base๏ผšQwen/Qwen3-VL-32B-Instruct๏ผˆApache-2.0๏ผ‰

Downloads last month
444
GGUF
Model size
33B params
Architecture
qwen3vl
Hardware compatibility
Log In to add your hardware

2-bit

4-bit

5-bit

6-bit

8-bit

Inference Providers NEW
This model isn't deployed by any Inference Provider. ๐Ÿ™‹ Ask for provider support

Model tree for xCloudinfo/Qwen3-VL-32B-Abliterated-xCloud-GGUF

Quantized
(49)
this model