GGUF
conversational

What is this?

Alibaba Cloudใฎๆ€่€ƒ๏ผ†้žๆ€่€ƒใƒใ‚คใƒ–ใƒชใƒƒใƒ‰ๅž‹MoEใƒขใƒ‡ใƒซQwen3.5-122B-A10Bใ‚’GGUFใƒ•ใ‚ฉใƒผใƒžใƒƒใƒˆใซๅค‰ๆ›ใ—ใŸใ‚‚ใฎใงใ™ใ€‚
้žๆ€่€ƒใƒขใƒผใƒ‰ใฎ้œ€่ฆใŒ้ซ˜ใ„ใ“ใจใ‚’้‘‘ใฟใ€ใƒ‡ใƒ•ใ‚ฉใƒซใƒˆใงใฏ้žๆ€่€ƒใƒขใƒ‡ใƒซใจใ—ใฆใตใ‚‹ใพใ†ใ‚ˆใ†ใซchat_templateใ‚’ๅค‰ๆ›ดใ—ใฆใ„ใพใ™ใ€‚

imatrix dataset

ๆ—ฅๆœฌ่ชž่ƒฝๅŠ›ใ‚’้‡่ฆ–ใ—ใ€ๆ—ฅๆœฌ่ชžใŒๅคš้‡ใซๅซใพใ‚Œใ‚‹TFMC/imatrix-dataset-for-japanese-llmใƒ‡ใƒผใ‚ฟใ‚ปใƒƒใƒˆใ‚’ไฝฟ็”จใ—ใพใ—ใŸใ€‚

Quants

ๅ„ใ‚ฏใ‚ชใƒณใƒ„ใฎใƒ™ใƒณใƒใƒžใƒผใ‚ฏๆธฌๅฎš็ตๆžœ๏ผˆAPI็‰ˆGemma3 27BๆŽก็‚นใซใ‚ˆใ‚‹Elyza_tasks 100๏ผ‰ใ‚’ใพใจใ‚ใฆใŠใใพใ™ใ€‚

  • ๆ€่€ƒใชใ—
ใ‚ฏใ‚ชใƒณใƒ„ ใ‚นใ‚ณใ‚ข ใ‚ณใƒกใƒณใƒˆ
Q8_0 4.59
Q6_K 4.6
Q5_K_M 4.58
Q4_K_M 4.535
IQ4_XS 4.71 ๆŽจๅฅจ
MXFP4_MOE 4.62
  • ๆ€่€ƒใ‚ใ‚Š

่ชฟๆŸปไธญ

Note

llama.cpp-b8226ไปฅๅ‰ใจๅˆใ‚ใ›ใฆใฎใ”ๅˆฉ็”จใ‚’ๆŽจๅฅจใ—ใพใ™ใ€‚
ใชใœใชใ‚‰ใ€llama.cpp-b8227ไปฅ้™ใฏใƒใƒฃใƒƒใƒˆใƒ†ใƒณใƒ—ใƒฌใƒผใƒˆใ‚’็„ก่ฆ–ใ—ใฆๆ€่€ƒใ‚’้–‹ๅง‹ใ•ใ›ใฆใ—ใพใ†ใ‹ใ‚‰ใงใ™ใ€‚

ใพใŸใ€-mm mmproj-Qwen3.5-122b-BF16.ggufใงใƒ“ใ‚ธใƒงใƒณใ‚จใƒณใ‚ณใƒผใƒ€ใƒผใ‚’ใƒญใƒผใƒ‰ใ—ใ€Visionๅฏพๅฟœใƒขใƒ‡ใƒซใจใ—ใฆไฝฟ็”จใ™ใ‚‹ใ“ใจใŒใงใใพใ™ใ€‚

Environment

Windows็‰ˆllama.cpp-b8226ใŠใ‚ˆใณllama.cpp-b8145ๅŒๆ™‚ใƒชใƒชใƒผใ‚นใฎconvert-hf-to-gguf.pyใ‚’ไฝฟ็”จใ—ใฆ้‡ๅญๅŒ–ไฝœๆฅญใ‚’ๅฎŸๆ–ฝใ—ใพใ—ใŸใ€‚

License

Apache 2.0

Developer

Alibaba Cloud

Downloads last month
139
GGUF
Model size
122B params
Architecture
qwen35moe
Hardware compatibility
Log In to add your hardware

4-bit

5-bit

6-bit

8-bit

16-bit

Inference Providers NEW
This model isn't deployed by any Inference Provider. ๐Ÿ™‹ Ask for provider support