Hugging Face
Models
Datasets
Spaces
Buckets
new
Docs
Enterprise
Pricing
Website
Tasks
HuggingChat
Collections
Languages
Organizations
Community
Blog
Posts
Daily Papers
Hardware
Learn
Discord
Forum
GitHub
Solutions
Team & Enterprise
Hugging Face PRO
Enterprise Support
Inference Providers
Inference Endpoints
Storage Buckets
Log In
Sign Up
balarajr
/
triage-qwen2.5-7b-grpo
Like
0
Text Generation
Safetensors
openlifescienceai/medmcqa
bigbio/med_qa
English
qwen3_5_text
medical
triage
hospital
multi-agent
grpo
lora
qwen
clinical-ai
crisis-management
conversational
License:
apache-2.0
Model card
Files
Files and versions
xet
Community
Copy to bucket
new
main
triage-qwen2.5-7b-grpo
/
training
1.35 MB
Ctrl+K
Ctrl+K
1 contributor
History:
11 commits
balarajr
Add Kaggle training notebook (live run)
7dc7603
verified
5 months ago
01_reward_curve.png
127 kB
xet
Add graph 01_reward_curve.png
5 months ago
02_training_dashboard.png
206 kB
xet
Add graph 02_training_dashboard.png
5 months ago
03_scenario_performance.png
97.2 kB
Add graph 03_scenario_performance.png
5 months ago
04_radar_chart.png
259 kB
xet
Add graph 04_radar_chart.png
5 months ago
04_scenario_heatmap.png
85.1 kB
Add graph 04_scenario_heatmap.png
5 months ago
05_episode_rewards.png
77.5 kB
Add graph 05_episode_rewards.png
5 months ago
06_agent_accuracy.png
88 kB
Add graph 06_agent_accuracy.png
5 months ago
07_radar_chart.png
239 kB
xet
Add graph 07_radar_chart.png
5 months ago
08_loss_reward.png
133 kB
xet
Add graph 08_loss_reward.png
5 months ago
Kaggle_GRPO_Training_LIVE.ipynb
18.7 kB
Add Kaggle training notebook (live run)
5 months ago
TRIAGE_GRPO_Training.ipynb
17.4 kB
Add training notebook
5 months ago