--- language: - en license: apache-2.0 tags: - sentence-transformers - cross-encoder - reranker - generated_from_trainer - dataset_size:143393475 - loss:MSELoss - llama-cpp - gguf-my-repo base_model: cross-encoder/ettin-reranker-1b-v1 pipeline_tag: text-ranking library_name: sentence-transformers metrics: - map - mrr@10 - ndcg@10 model-index: - name: ettin-reranker-1b-v1 results: - task: type: cross-encoder-reranking name: Cross Encoder Reranking dataset: name: NanoMSMARCO R100 type: NanoMSMARCO_R100 metrics: - type: map value: 0.6111 name: Map - type: mrr@10 value: 0.6142 name: Mrr@10 - type: ndcg@10 value: 0.6978 name: Ndcg@10 - task: type: cross-encoder-reranking name: Cross Encoder Reranking dataset: name: NanoNFCorpus R100 type: NanoNFCorpus_R100 metrics: - type: map value: 0.3971 name: Map - type: mrr@10 value: 0.6391 name: Mrr@10 - type: ndcg@10 value: 0.4485 name: Ndcg@10 - task: type: cross-encoder-reranking name: Cross Encoder Reranking dataset: name: NanoNQ R100 type: NanoNQ_R100 metrics: - type: map value: 0.7361 name: Map - type: mrr@10 value: 0.7547 name: Mrr@10 - type: ndcg@10 value: 0.798 name: Ndcg@10 - task: type: cross-encoder-reranking name: Cross Encoder Reranking dataset: name: NanoFiQA2018 R100 type: NanoFiQA2018_R100 metrics: - type: map value: 0.5993 name: Map - type: mrr@10 value: 0.6997 name: Mrr@10 - type: ndcg@10 value: 0.6605 name: Ndcg@10 - task: type: cross-encoder-reranking name: Cross Encoder Reranking dataset: name: NanoTouche2020 R100 type: NanoTouche2020_R100 metrics: - type: map value: 0.4946 name: Map - type: mrr@10 value: 0.8275 name: Mrr@10 - type: ndcg@10 value: 0.584 name: Ndcg@10 - task: type: cross-encoder-reranking name: Cross Encoder Reranking dataset: name: NanoSciFact R100 type: NanoSciFact_R100 metrics: - type: map value: 0.7337 name: Map - type: mrr@10 value: 0.7406 name: Mrr@10 - type: ndcg@10 value: 0.7775 name: Ndcg@10 - task: type: cross-encoder-reranking name: Cross Encoder Reranking dataset: name: NanoHotpotQA R100 type: NanoHotpotQA_R100 metrics: - type: map value: 0.9295 name: Map - type: mrr@10 value: 0.98 name: Mrr@10 - type: ndcg@10 value: 0.9515 name: Ndcg@10 - task: type: cross-encoder-reranking name: Cross Encoder Reranking dataset: name: NanoArguAna R100 type: NanoArguAna_R100 metrics: - type: map value: 0.6853 name: Map - type: mrr@10 value: 0.6985 name: Mrr@10 - type: ndcg@10 value: 0.7637 name: Ndcg@10 - task: type: cross-encoder-reranking name: Cross Encoder Reranking dataset: name: NanoFEVER R100 type: NanoFEVER_R100 metrics: - type: map value: 0.9432 name: Map - type: mrr@10 value: 0.98 name: Mrr@10 - type: ndcg@10 value: 0.9607 name: Ndcg@10 - task: type: cross-encoder-reranking name: Cross Encoder Reranking dataset: name: NanoDBPedia R100 type: NanoDBPedia_R100 metrics: - type: map value: 0.6963 name: Map - type: mrr@10 value: 0.8822 name: Mrr@10 - type: ndcg@10 value: 0.7631 name: Ndcg@10 - task: type: cross-encoder-reranking name: Cross Encoder Reranking dataset: name: NanoClimateFEVER R100 type: NanoClimateFEVER_R100 metrics: - type: map value: 0.4873 name: Map - type: mrr@10 value: 0.7342 name: Mrr@10 - type: ndcg@10 value: 0.574 name: Ndcg@10 - task: type: cross-encoder-reranking name: Cross Encoder Reranking dataset: name: NanoSCIDOCS R100 type: NanoSCIDOCS_R100 metrics: - type: map value: 0.3412 name: Map - type: mrr@10 value: 0.5922 name: Mrr@10 - type: ndcg@10 value: 0.3991 name: Ndcg@10 - task: type: cross-encoder-reranking name: Cross Encoder Reranking dataset: name: NanoQuoraRetrieval R100 type: NanoQuoraRetrieval_R100 metrics: - type: map value: 0.9509 name: Map - type: mrr@10 value: 0.9733 name: Mrr@10 - type: ndcg@10 value: 0.9668 name: Ndcg@10 - task: type: cross-encoder-nano-beir name: Cross Encoder Nano BEIR dataset: name: NanoBEIR R100 mean type: NanoBEIR_R100_mean metrics: - type: map value: 0.662 name: Map - type: mrr@10 value: 0.7782 name: Mrr@10 - type: ndcg@10 value: 0.7189 name: Ndcg@10 --- # klnstpr/ettin-reranker-1b-v1-Q8_0-GGUF This model was converted to GGUF format from [`cross-encoder/ettin-reranker-1b-v1`](https://huggingface.co/cross-encoder/ettin-reranker-1b-v1) using llama.cpp via the ggml.ai's [GGUF-my-repo](https://huggingface.co/spaces/ggml-org/gguf-my-repo) space. Refer to the [original model card](https://huggingface.co/cross-encoder/ettin-reranker-1b-v1) for more details on the model. ## Use with llama.cpp Install llama.cpp through brew (works on Mac and Linux) ```bash brew install llama.cpp ``` Invoke the llama.cpp server or the CLI. ### CLI: ```bash llama-cli --hf-repo klnstpr/ettin-reranker-1b-v1-Q8_0-GGUF --hf-file ettin-reranker-1b-v1-q8_0.gguf -p "The meaning to life and the universe is" ``` ### Server: ```bash llama-server --hf-repo klnstpr/ettin-reranker-1b-v1-Q8_0-GGUF --hf-file ettin-reranker-1b-v1-q8_0.gguf -c 2048 ``` Note: You can also use this checkpoint directly through the [usage steps](https://github.com/ggerganov/llama.cpp?tab=readme-ov-file#usage) listed in the Llama.cpp repo as well. Step 1: Clone llama.cpp from GitHub. ``` git clone https://github.com/ggerganov/llama.cpp ``` Step 2: Move into the llama.cpp folder and build it with `LLAMA_CURL=1` flag along with other hardware-specific flags (for ex: LLAMA_CUDA=1 for Nvidia GPUs on Linux). ``` cd llama.cpp && LLAMA_CURL=1 make ``` Step 3: Run inference through the main binary. ``` ./llama-cli --hf-repo klnstpr/ettin-reranker-1b-v1-Q8_0-GGUF --hf-file ettin-reranker-1b-v1-q8_0.gguf -p "The meaning to life and the universe is" ``` or ``` ./llama-server --hf-repo klnstpr/ettin-reranker-1b-v1-Q8_0-GGUF --hf-file ettin-reranker-1b-v1-q8_0.gguf -c 2048 ```