Ettin Reranker 1B β GGUF
GGUF quantizations of cross-encoder/ettin-reranker-1b-v1, a ModernBERT-based cross-encoder reranker (1.00B params, Apache-2.0).
Converted with CrispEmbed.
Files
| File | Quant | Size |
|---|---|---|
| F32 | 4126 MB | |
| Q8_0 | 1107 MB | |
| Q4_K | 638 MB |
Architecture
- Base: ModernBERT (28 layers, 1792 hidden)
- Classifier head: Dense(1792β1792, GELU) β LayerNorm β Dense(1792β1)
- Tokenizer: GPT-2 ByteLevel BPE (50368 tokens)
Usage
- Downloads last month
- 147
Hardware compatibility
Log In to add your hardware
6-bit
8-bit
32-bit
Inference Providers NEW
This model isn't deployed by any Inference Provider. π Ask for provider support
Model tree for cstr/ettin-reranker-1b-v1-GGUF
Base model
jhu-clsp/ettin-encoder-1b Finetuned
cross-encoder/ettin-reranker-1b-v1