Spaces:
Running on Zero
Running on Zero
Update app.py
Browse files
app.py
CHANGED
|
@@ -53,6 +53,9 @@ BASE_MODEL_IDS: List[str] = [
|
|
| 53 |
"OpenCerebral/Boris-1.3-125M",
|
| 54 |
"OpenCerebral/Boris-1.3-75M",
|
| 55 |
"CodeSoft/sorbet-v2-25m",
|
|
|
|
|
|
|
|
|
|
| 56 |
]
|
| 57 |
|
| 58 |
BASE_MODEL_DISPLAY: Dict[str, str] = {
|
|
@@ -63,6 +66,9 @@ BASE_MODEL_DISPLAY: Dict[str, str] = {
|
|
| 63 |
"OpenCerebral/Boris-1.3-125M": "Boris-1.3-125M",
|
| 64 |
"OpenCerebral/Boris-1.3-75M": "Boris-1.3-75M",
|
| 65 |
"CodeSoft/sorbet-v2-25m": "sorbet-v2-25m",
|
|
|
|
|
|
|
|
|
|
| 66 |
}
|
| 67 |
|
| 68 |
MODEL_PARAMS: Dict[str, float] = {
|
|
@@ -79,6 +85,9 @@ MODEL_PARAMS: Dict[str, float] = {
|
|
| 79 |
"OpenCerebral/Boris-1.3-125M": 125.0e6,
|
| 80 |
"OpenCerebral/Boris-1.3-75M": 75.0e6,
|
| 81 |
"CodeSoft/sorbet-v2-25m": 25.2e6,
|
|
|
|
|
|
|
|
|
|
| 82 |
}
|
| 83 |
|
| 84 |
FALLBACK_IDS: Dict[str, str] = {}
|
|
@@ -162,6 +171,9 @@ GEN_DEFAULTS: Dict[str, dict] = {
|
|
| 162 |
"OpenCerebral/Boris-1.3-125M": {"max_new_tokens": 64, "temperature": 0.8, "top_p": 0.95, "repetition_penalty": 1.1, "do_sample": True},
|
| 163 |
"OpenCerebral/Boris-1.3-75M": {"max_new_tokens": 64, "temperature": 0.8, "top_p": 0.95, "repetition_penalty": 1.1, "do_sample": True},
|
| 164 |
"CodeSoft/sorbet-v2-25m": {"max_new_tokens": 64, "temperature": 0.8, "top_p": 0.95, "repetition_penalty": 1.1, "do_sample": True},
|
|
|
|
|
|
|
|
|
|
| 165 |
}
|
| 166 |
|
| 167 |
MODEL_CONTEXT: Dict[str, int] = {
|
|
@@ -178,6 +190,9 @@ MODEL_CONTEXT: Dict[str, int] = {
|
|
| 178 |
"OpenCerebral/Boris-1.3-125M": 2048,
|
| 179 |
"OpenCerebral/Boris-1.3-75M": 2048,
|
| 180 |
"CodeSoft/sorbet-v2-25m": 4096,
|
|
|
|
|
|
|
|
|
|
| 181 |
}
|
| 182 |
|
| 183 |
|
|
|
|
| 53 |
"OpenCerebral/Boris-1.3-125M",
|
| 54 |
"OpenCerebral/Boris-1.3-75M",
|
| 55 |
"CodeSoft/sorbet-v2-25m",
|
| 56 |
+
"fromziro/Er-Large-31M",
|
| 57 |
+
"fromziro/Negative-v1.0",
|
| 58 |
+
"FromZero/Syn-2.6M",
|
| 59 |
]
|
| 60 |
|
| 61 |
BASE_MODEL_DISPLAY: Dict[str, str] = {
|
|
|
|
| 66 |
"OpenCerebral/Boris-1.3-125M": "Boris-1.3-125M",
|
| 67 |
"OpenCerebral/Boris-1.3-75M": "Boris-1.3-75M",
|
| 68 |
"CodeSoft/sorbet-v2-25m": "sorbet-v2-25m",
|
| 69 |
+
"fromziro/Er-Large-31M": "Er-Large-31M",
|
| 70 |
+
"fromziro/Negative-v1.0": "Negative-v1.0",
|
| 71 |
+
"FromZero/Syn-2.6M": "Syn-2.6M",
|
| 72 |
}
|
| 73 |
|
| 74 |
MODEL_PARAMS: Dict[str, float] = {
|
|
|
|
| 85 |
"OpenCerebral/Boris-1.3-125M": 125.0e6,
|
| 86 |
"OpenCerebral/Boris-1.3-75M": 75.0e6,
|
| 87 |
"CodeSoft/sorbet-v2-25m": 25.2e6,
|
| 88 |
+
"fromziro/Er-Large-31M": 31.9e6,
|
| 89 |
+
"fromziro/Negative-v1.0": 67.7e3,
|
| 90 |
+
"FromZero/Syn-2.6M": 2.6e6,
|
| 91 |
}
|
| 92 |
|
| 93 |
FALLBACK_IDS: Dict[str, str] = {}
|
|
|
|
| 171 |
"OpenCerebral/Boris-1.3-125M": {"max_new_tokens": 64, "temperature": 0.8, "top_p": 0.95, "repetition_penalty": 1.1, "do_sample": True},
|
| 172 |
"OpenCerebral/Boris-1.3-75M": {"max_new_tokens": 64, "temperature": 0.8, "top_p": 0.95, "repetition_penalty": 1.1, "do_sample": True},
|
| 173 |
"CodeSoft/sorbet-v2-25m": {"max_new_tokens": 64, "temperature": 0.8, "top_p": 0.95, "repetition_penalty": 1.1, "do_sample": True},
|
| 174 |
+
"fromziro/Er-Large-31M": {"max_new_tokens": 64, "temperature": 0.8, "top_p": 0.95, "repetition_penalty": 1.1, "do_sample": True},
|
| 175 |
+
"fromziro/Negative-v1.0": {"max_new_tokens": 48, "temperature": 0.9, "top_p": 0.95, "repetition_penalty": 1.1, "do_sample": True},
|
| 176 |
+
"FromZero/Syn-2.6M": {"max_new_tokens": 48, "temperature": 0.8, "top_p": 0.95, "repetition_penalty": 1.1, "do_sample": True},
|
| 177 |
}
|
| 178 |
|
| 179 |
MODEL_CONTEXT: Dict[str, int] = {
|
|
|
|
| 190 |
"OpenCerebral/Boris-1.3-125M": 2048,
|
| 191 |
"OpenCerebral/Boris-1.3-75M": 2048,
|
| 192 |
"CodeSoft/sorbet-v2-25m": 4096,
|
| 193 |
+
"fromziro/Er-Large-31M": 2048,
|
| 194 |
+
"fromziro/Negative-v1.0": 96,
|
| 195 |
+
"FromZero/Syn-2.6M": 384,
|
| 196 |
}
|
| 197 |
|
| 198 |
|