Maggio33 commited on
Commit
8749fd4
·
verified ·
1 Parent(s): c139564

rename -> GoLLeM-110M-PL

Browse files
Files changed (1) hide show
  1. README.md +2 -2
README.md CHANGED
@@ -12,7 +12,7 @@ tags:
12
  - amd-rocm
13
  ---
14
 
15
- # Slayer-110M-PL (base)
16
 
17
  Bazowy model językowy (**pretraining, model bazowy — NIE chatbot**) dla języka polskiego.
18
  **110M** parametrów, architektura GPT-2, wytrenowany **od zera** na **konsumenckiej karcie AMD Radeon RX 7900 XTX** (ROCm/WSL2, Windows) — bez NVIDII, bez chmury.
@@ -36,7 +36,7 @@ Bazowy model językowy (**pretraining, model bazowy — NIE chatbot**) dla języ
36
  ```python
37
  import torch
38
  from transformers import AutoModelForCausalLM, PreTrainedTokenizerFast
39
- m = AutoModelForCausalLM.from_pretrained("Maggio33/Slayer-110M-PL").eval()
40
  tok = PreTrainedTokenizerFast(tokenizer_file="tokenizer.json")
41
  ids = tok("Polska to kraj położony w", return_tensors="pt").input_ids
42
  ids = torch.cat([torch.tensor([[0]]), ids], 1) # BOS = <|endoftext|>=0
 
12
  - amd-rocm
13
  ---
14
 
15
+ # GoLLeM-110M-PL (base)
16
 
17
  Bazowy model językowy (**pretraining, model bazowy — NIE chatbot**) dla języka polskiego.
18
  **110M** parametrów, architektura GPT-2, wytrenowany **od zera** na **konsumenckiej karcie AMD Radeon RX 7900 XTX** (ROCm/WSL2, Windows) — bez NVIDII, bez chmury.
 
36
  ```python
37
  import torch
38
  from transformers import AutoModelForCausalLM, PreTrainedTokenizerFast
39
+ m = AutoModelForCausalLM.from_pretrained("Maggio33/GoLLeM-110M-PL").eval()
40
  tok = PreTrainedTokenizerFast(tokenizer_file="tokenizer.json")
41
  ids = tok("Polska to kraj położony w", return_tensors="pt").input_ids
42
  ids = torch.cat([torch.tensor([[0]]), ids], 1) # BOS = <|endoftext|>=0