Update README.md
Browse files
README.md
CHANGED
|
@@ -37,7 +37,7 @@ This model was trained on 32,000 stratified expert game states to learn optimal
|
|
| 37 |
|
| 38 |
- **Training samples:** 32,000 (stratified sampling, minimum 1,000 per action type)
|
| 39 |
- **Validation samples:** 1,000 (perfectly balanced, 200 per action type)
|
| 40 |
-
- **Source:**
|
| 41 |
|
| 42 |
**Action distribution (training set):**
|
| 43 |
- `discard` (discard a card): 44.6%
|
|
|
|
| 37 |
|
| 38 |
- **Training samples:** 32,000 (stratified sampling, minimum 1,000 per action type)
|
| 39 |
- **Validation samples:** 1,000 (perfectly balanced, 200 per action type)
|
| 40 |
+
- **Source:** Human gameplay
|
| 41 |
|
| 42 |
**Action distribution (training set):**
|
| 43 |
- `discard` (discard a card): 44.6%
|