llm-jp-4-vl-9b-GGUF-v0.1


  • 更新履歴
    • [2026-09-03] 複数ターンの会話で HTTP 500 になる問題を修正
    • [2026-09-03] 複数画像入力時のタイル数上限が元実装と異なる問題を修正
    • [2026-09-03] analysis 途中の <|end|> 出力で HTTP 500 になる問題を修正

  • llm-jp/llm-jp-4-vl-9b を GGUF 形式に変換したものです。
  • 現状、パッチ 適用済みの llama.cpp を用いて実行する必要があります。

当リポジトリに含まれる GGUF およびパッチは非公式のものです。
不具合を発見された場合は、LLM-jp ではなく、当リポジトリの Discussions にて報告をお願いいたします。

パッチ適用

git clone --branch v0.3.0 --depth 1 https://github.com/ggml-org/llama.cpp.git
cd llama.cpp
wget https://huggingface.co/tokinasin/llm-jp-4-vl-9b-GGUF-v0.1/resolve/main/llama.cpp-llmjpvl.patch
git apply --check llama.cpp-llmjpvl.patch && git apply llama.cpp-llmjpvl.patch

# パッチ適用後、お好みの方法でビルドしてください

使用例

llama-server \
  -m llm-jp-4-vl-9b-Q8_0.gguf \
  --mmproj mmproj-llm-jp-4-vl-9b-F16.gguf \
  --chat-template-kwargs '{"reasoning_effort":"low"}' \
  --jinja -c 8192
  • Q4_K_M では reasoning がスキップされることが多いため、Q6_K 以上のモデルの使用を推奨いたします。

License

Downloads last month
655
GGUF
Model size
9B params
Architecture
llama
Hardware compatibility
Log In to add your hardware

4-bit

6-bit

8-bit

16-bit

Inference Providers NEW
This model isn't deployed by any Inference Provider. 🙋 Ask for provider support

Model tree for tokinasin/llm-jp-4-vl-9b-GGUF-v0.1

Quantized
(2)
this model

Dataset used to train tokinasin/llm-jp-4-vl-9b-GGUF-v0.1