Text Generation
PEFT
Safetensors
gin-rummy
grpo
reinforcement-learning
lora
game-playing
qwen3
conversational
Eval Results (legacy)
Instructions to use GoodStartLabs/ginrummy-qwen3-8b-grpo-lora with libraries, inference providers, notebooks, and local apps. Follow these links to get started.
- Libraries
- PEFT
How to use GoodStartLabs/ginrummy-qwen3-8b-grpo-lora with PEFT:
from peft import PeftModel from transformers import AutoModelForCausalLM base_model = AutoModelForCausalLM.from_pretrained("/workspace/models/Qwen3-8B") model = PeftModel.from_pretrained(base_model, "GoodStartLabs/ginrummy-qwen3-8b-grpo-lora") - Notebooks
- Google Colab
- Kaggle
- Xet hash:
- 37d52aae15121730df7a624625eb22b2ee56341ae3245e782cb75f26bc0611e3
- Size of remote file:
- 7.7 kB
- SHA256:
- b568ed52394492676d99037e7b4c55bb60c9a530f00da7e84bcd0be2036a6cb7
·
Xet efficiently stores Large Files inside Git, intelligently splitting files into unique chunks and accelerating uploads and downloads. More info.