Sentence Similarity
sentence-transformers
Safetensors
bert
feature-extraction
Generated from Trainer
dataset_size:7278
loss:MultipleNegativesRankingLoss
Eval Results (legacy)
text-embeddings-inference
Instructions to use midwestcyr/labse-ruskaromani with libraries, inference providers, notebooks, and local apps. Follow these links to get started.
- Libraries
- sentence-transformers
How to use midwestcyr/labse-ruskaromani with sentence-transformers:
from sentence_transformers import SentenceTransformer model = SentenceTransformer("midwestcyr/labse-ruskaromani") sentences = [ "- Н-да!", "Акана — хохавава.", "А о-отэнчя тихэс устя тэ и гыя дрэ фэлда ни прэ конэстэ на дыкхи.", "— Аи!" ] embeddings = model.encode(sentences) similarities = model.similarity(embeddings, embeddings) print(similarities.shape) # [4, 4] - Notebooks
- Google Colab
- Kaggle
Update README.md
Browse files
README.md
CHANGED
|
@@ -77,7 +77,9 @@ This is a [sentence-transformers](https://www.SBERT.net) model finetuned from [s
|
|
| 77 |
|
| 78 |
Model was fine-tuned Ruska Romani on Russian language pairs. Ruska Romani is the dialect of Romani language attributed to Ruska Roma, the largest subgroup of Romani people in Russia.
|
| 79 |
|
| 80 |
-
Model was trained and evaluated on data from [Russian National Corpus](https://ruscorpora.ru/en/search?search=CgkyBwgFEgNybWw%253D).
|
|
|
|
|
|
|
| 81 |
|
| 82 |
## Model Details
|
| 83 |
|
|
|
|
| 77 |
|
| 78 |
Model was fine-tuned Ruska Romani on Russian language pairs. Ruska Romani is the dialect of Romani language attributed to Ruska Roma, the largest subgroup of Romani people in Russia.
|
| 79 |
|
| 80 |
+
Model was trained and evaluated on parallel pairs data data from the [Russian National Corpus](https://ruscorpora.ru/en/search?search=CgkyBwgFEgNybWw%253D).
|
| 81 |
+
|
| 82 |
+
The data curation process is described in the article [The Parallel Corpus of Russian and Ruska Romani Languages](https://aclanthology.org/2024.fieldmatters-1.1/). Please refer to that paper in any publications where the model was used.
|
| 83 |
|
| 84 |
## Model Details
|
| 85 |
|