Text Classification
Transformers
Safetensors
llama
Generated from Trainer
trl
reward-trainer
text-embeddings-inference
Instructions to use bikalnetomi/RLHF-PPO-RewardModel-LLama3-1B-v1.1 with libraries, inference providers, notebooks, and local apps. Follow these links to get started.
- Libraries
- Transformers
How to use bikalnetomi/RLHF-PPO-RewardModel-LLama3-1B-v1.1 with Transformers:
# Use a pipeline as a high-level helper from transformers import pipeline pipe = pipeline("text-classification", model="bikalnetomi/RLHF-PPO-RewardModel-LLama3-1B-v1.1")# Load model directly from transformers import AutoTokenizer, AutoModelForSequenceClassification tokenizer = AutoTokenizer.from_pretrained("bikalnetomi/RLHF-PPO-RewardModel-LLama3-1B-v1.1") model = AutoModelForSequenceClassification.from_pretrained("bikalnetomi/RLHF-PPO-RewardModel-LLama3-1B-v1.1", device_map="auto") - Notebooks
- Google Colab
- Kaggle
Ctrl+K