CodeSoft commited on
Commit
194153b
·
verified ·
1 Parent(s): 2d6cc43

Update app.py

Browse files
Files changed (1) hide show
  1. app.py +15 -0
app.py CHANGED
@@ -53,6 +53,9 @@ BASE_MODEL_IDS: List[str] = [
53
  "OpenCerebral/Boris-1.3-125M",
54
  "OpenCerebral/Boris-1.3-75M",
55
  "CodeSoft/sorbet-v2-25m",
 
 
 
56
  ]
57
 
58
  BASE_MODEL_DISPLAY: Dict[str, str] = {
@@ -63,6 +66,9 @@ BASE_MODEL_DISPLAY: Dict[str, str] = {
63
  "OpenCerebral/Boris-1.3-125M": "Boris-1.3-125M",
64
  "OpenCerebral/Boris-1.3-75M": "Boris-1.3-75M",
65
  "CodeSoft/sorbet-v2-25m": "sorbet-v2-25m",
 
 
 
66
  }
67
 
68
  MODEL_PARAMS: Dict[str, float] = {
@@ -79,6 +85,9 @@ MODEL_PARAMS: Dict[str, float] = {
79
  "OpenCerebral/Boris-1.3-125M": 125.0e6,
80
  "OpenCerebral/Boris-1.3-75M": 75.0e6,
81
  "CodeSoft/sorbet-v2-25m": 25.2e6,
 
 
 
82
  }
83
 
84
  FALLBACK_IDS: Dict[str, str] = {}
@@ -162,6 +171,9 @@ GEN_DEFAULTS: Dict[str, dict] = {
162
  "OpenCerebral/Boris-1.3-125M": {"max_new_tokens": 64, "temperature": 0.8, "top_p": 0.95, "repetition_penalty": 1.1, "do_sample": True},
163
  "OpenCerebral/Boris-1.3-75M": {"max_new_tokens": 64, "temperature": 0.8, "top_p": 0.95, "repetition_penalty": 1.1, "do_sample": True},
164
  "CodeSoft/sorbet-v2-25m": {"max_new_tokens": 64, "temperature": 0.8, "top_p": 0.95, "repetition_penalty": 1.1, "do_sample": True},
 
 
 
165
  }
166
 
167
  MODEL_CONTEXT: Dict[str, int] = {
@@ -178,6 +190,9 @@ MODEL_CONTEXT: Dict[str, int] = {
178
  "OpenCerebral/Boris-1.3-125M": 2048,
179
  "OpenCerebral/Boris-1.3-75M": 2048,
180
  "CodeSoft/sorbet-v2-25m": 4096,
 
 
 
181
  }
182
 
183
 
 
53
  "OpenCerebral/Boris-1.3-125M",
54
  "OpenCerebral/Boris-1.3-75M",
55
  "CodeSoft/sorbet-v2-25m",
56
+ "fromziro/Er-Large-31M",
57
+ "fromziro/Negative-v1.0",
58
+ "FromZero/Syn-2.6M",
59
  ]
60
 
61
  BASE_MODEL_DISPLAY: Dict[str, str] = {
 
66
  "OpenCerebral/Boris-1.3-125M": "Boris-1.3-125M",
67
  "OpenCerebral/Boris-1.3-75M": "Boris-1.3-75M",
68
  "CodeSoft/sorbet-v2-25m": "sorbet-v2-25m",
69
+ "fromziro/Er-Large-31M": "Er-Large-31M",
70
+ "fromziro/Negative-v1.0": "Negative-v1.0",
71
+ "FromZero/Syn-2.6M": "Syn-2.6M",
72
  }
73
 
74
  MODEL_PARAMS: Dict[str, float] = {
 
85
  "OpenCerebral/Boris-1.3-125M": 125.0e6,
86
  "OpenCerebral/Boris-1.3-75M": 75.0e6,
87
  "CodeSoft/sorbet-v2-25m": 25.2e6,
88
+ "fromziro/Er-Large-31M": 31.9e6,
89
+ "fromziro/Negative-v1.0": 67.7e3,
90
+ "FromZero/Syn-2.6M": 2.6e6,
91
  }
92
 
93
  FALLBACK_IDS: Dict[str, str] = {}
 
171
  "OpenCerebral/Boris-1.3-125M": {"max_new_tokens": 64, "temperature": 0.8, "top_p": 0.95, "repetition_penalty": 1.1, "do_sample": True},
172
  "OpenCerebral/Boris-1.3-75M": {"max_new_tokens": 64, "temperature": 0.8, "top_p": 0.95, "repetition_penalty": 1.1, "do_sample": True},
173
  "CodeSoft/sorbet-v2-25m": {"max_new_tokens": 64, "temperature": 0.8, "top_p": 0.95, "repetition_penalty": 1.1, "do_sample": True},
174
+ "fromziro/Er-Large-31M": {"max_new_tokens": 64, "temperature": 0.8, "top_p": 0.95, "repetition_penalty": 1.1, "do_sample": True},
175
+ "fromziro/Negative-v1.0": {"max_new_tokens": 48, "temperature": 0.9, "top_p": 0.95, "repetition_penalty": 1.1, "do_sample": True},
176
+ "FromZero/Syn-2.6M": {"max_new_tokens": 48, "temperature": 0.8, "top_p": 0.95, "repetition_penalty": 1.1, "do_sample": True},
177
  }
178
 
179
  MODEL_CONTEXT: Dict[str, int] = {
 
190
  "OpenCerebral/Boris-1.3-125M": 2048,
191
  "OpenCerebral/Boris-1.3-75M": 2048,
192
  "CodeSoft/sorbet-v2-25m": 4096,
193
+ "fromziro/Er-Large-31M": 2048,
194
+ "fromziro/Negative-v1.0": 96,
195
+ "FromZero/Syn-2.6M": 384,
196
  }
197
 
198