metadata
license: cc-by-sa-4.0
datasets:
- Miwa-Keita/zenz-v2.5-dataset
language:
- ja
base_model:
- WariHima/hourai3-90m-base-ja-v1
hourai3 zenz 90m v1
zenz v3互換 かな漢字変換モデル
architecture:
- lfm2moe
tarined by:
- rtx3060 * 8m training code in ./training_codes
tokenizer from ku-nlp/gpt2-small-japanese-char
+(unused qwen3 special toknes from base model)
dataset:
- Miwa-Keita/zenz-v2.5-dataset use wikipedia part 40k rows 1 epoch