Architect8999 commited on
Commit
444e1a2
·
verified ·
1 Parent(s): 970b3b1

Update llm_config.json

Browse files
Files changed (1) hide show
  1. llm_config.json +23 -4
llm_config.json CHANGED
@@ -2,13 +2,32 @@
2
  "_comment": "Missminute OS — LLM Provider Config. Set API keys as HF Space Secrets, NOT here.",
3
 
4
  "routing": {
5
- "_comment": "Switch between 'deepseek' (current stable) and 'remote_ollama' (Space B trial). Change primary here, redeploy.",
6
- "primary": "remote_ollama"
7
  },
8
 
9
  "providers": {
10
-
11
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
12
  "remote_ollama": {
13
  "_comment": "Space B Ollama inference. base_url = your Space B HF URL + /v1. OLLAMA_PROXY_TOKEN must match Space B secret.",
14
  "model": "qwen2.5:1.5b",
@@ -16,7 +35,7 @@
16
  "env_secret_name": "OLLAMA_PROXY_TOKEN",
17
  "max_tokens": 40960,
18
  "temperature": 0.6,
19
- "timeout": 180
20
  },
21
 
22
  "openrouter_fallback": {
 
2
  "_comment": "Missminute OS — LLM Provider Config. Set API keys as HF Space Secrets, NOT here.",
3
 
4
  "routing": {
5
+ "_comment": "Switch 'primary' to 'github_models' or 'groq' for $0 bug hunting. 'remote_ollama' is your HF Space.",
6
+ "primary": "github_models"
7
  },
8
 
9
  "providers": {
 
10
 
11
+ "github_models": {
12
+ "_comment": "GitHub Models API (Free tier). Models: gpt-4o, claude-3.5-sonnet. Requires GITHUB_MODELS_TOKEN secret.",
13
+ "model": "gpt-4o",
14
+ "base_url": "https://models.github.ai/inference",
15
+ "env_secret_name": "GITHUB_MODELS_TOKEN",
16
+ "max_tokens": 8192,
17
+ "temperature": 0.2,
18
+ "timeout": 300
19
+ },
20
+
21
+ "groq": {
22
+ "_comment": "Groq LPU (Free tier, Blazing fast). Models: qwen-2.5-coder-32b, llama-3.3-70b-versatile. Requires GROQ_API_KEY secret.",
23
+ "model": "qwen-2.5-coder-32b",
24
+ "base_url": "https://api.groq.com/openai/v1",
25
+ "env_secret_name": "GROQ_API_KEY",
26
+ "max_tokens": 8192,
27
+ "temperature": 0.2,
28
+ "timeout": 120
29
+ },
30
+
31
  "remote_ollama": {
32
  "_comment": "Space B Ollama inference. base_url = your Space B HF URL + /v1. OLLAMA_PROXY_TOKEN must match Space B secret.",
33
  "model": "qwen2.5:1.5b",
 
35
  "env_secret_name": "OLLAMA_PROXY_TOKEN",
36
  "max_tokens": 40960,
37
  "temperature": 0.6,
38
+ "timeout": 900
39
  },
40
 
41
  "openrouter_fallback": {