{ "source_model": "WWTCyberLab/gemma-4-E4B-it-abliterated", "output_repo": "loay/gemma-4-E4B-it-abliterated-en-ar-text-only", "original_vocab_size": 262144, "new_vocab_size": 175852, "dropped_vocab_size": 86292, "policy": "text-only; keep Arabic, English/Latin, neutral symbols/punctuation/numbers/marks, byte fallback, and special tokens; drop other language-script tokens; drop multimodal tensors", "sample_dropped_tokens": [ "▁क", "▁ह", "▁स", "▁म", "▁प", "▁है", "ें", "▁п", "या", "्र", "ার", "ार", "ст", "▁ক", "▁ब", "▁ज", "▁के", "▁в", "на", "ने", "▁স", "но", "▁आ", "▁с", "▁व", "▁ব", "ни", "▁द", "▁প", "ра", "▁अ", "ের", "▁ल", "্র", "▁में", "ро", "▁र", "ко", "то", "▁त", "্য", "▁и", "र्", "▁न", "▁о", "ों", "▁এ", "ता", "ান", "▁कर", "ре", "▁की", "▁д", "ка", "▁আ", "▁को", "▁इ", "்க", "য়", "্ত", "го", "ва", "▁का", "ना", "ен", "▁হ", "ли", "▁से", "▁ग", "▁ম", "▁ন", "्य", "ри", "те", "▁ए", "▁по", "▁कि", "▁м", "िक", "та", "▁ত", "▁भ", "▁на", "▁কর", "не", "▁उ", "्या", "ль", "்த", "स्", "▁দ", "ла", "▁औ", "ान", "▁और", "ம்", "ला", "क्", "▁অ", "ле", "ны", "▁б", "▁प्र", "▁च", "▁हो", "▁з", "▁पर", "েন", "▁हैं", "▁य", "▁श", "во", "ло", "ки", "ти", "ले", "ते", "да", "▁য", "ன்", "তে", "ல்", "▁জ", "▁इस", "िए", "কে", "্ব", "ть", "ер", "▁ப", "িন", "ет", "वा", "ही", "▁у", "▁आप", "ित", "हा", "▁फ", "▁जा", "▁প্র", "▁स्", "▁க", "▁सा", "िय", "के", "க்க", "িক", "▁ко", "▁а", "்ட", "লা", "▁ने", "ছে", "से", "▁শ", "ंग", "রা", "▁ம", "▁не", "че", "লে", "র্", "ती", "টি", "ди", "ся", "ும்", "▁थ", "▁за", "▁வ", "▁एक", "ма", "்ப", "ми", "বে", "த்த", "ля", "▁दे", "▁к", "য়ে", "ви", "িত", "▁গ", "ру", "री", "ली", "▁भी", "▁ट", "де", "▁वि", "िया", "का", "रा", "▁ভ", "▁ख", "▁அ", "ста", "ள்", "▁तो" ] }