general-eval-card / components /benchmark-evaluation-card.tsx

Commit History

WIP: v2 cleanup checkpoint before merging origin/main
d249d5b

j-chim commited on

Cross-source dedup, plotbox polish, pretty URLs, eval page fallbacks
0b45710

evijit HF Staff Claude Opus 4.7 (1M context) commited on

Consolidate hierarchy terminology + handle v2 hierarchy shape
350e866

evijit HF Staff commited on

Add plain-language captions and mode-aware framing for policy readers
3ad47c6

evijit HF Staff Claude Opus 4.7 (1M context) commited on

Add interpretive signals, corpus dashboard, and slice browser
bca888a

evijit HF Staff Claude Opus 4.7 (1M context) commited on

improve ux
8058fce

evijit HF Staff commited on

Improve eval/model UX, lite data paths, and leaderboard clarity
436ada0

evijit HF Staff commited on

Refresh eval cards UI and backend data flow
c1f2130

evijit HF Staff commited on

fix bugs
04b4cff

evijit HF Staff commited on

ux changes
5f59721

evijit HF Staff commited on

fix: align reporting cues and developer slugs
5ca5561

evijit HF Staff commited on

feat: refine model and benchmark exploration
03e2430

evijit HF Staff commited on

redesigned
3a12290

evijit HF Staff commited on

rename benchmark to eval
0eafde7

Avijit Ghosh commited on

Refactor: Update benchmarks with realistic data, fix UI stats, and improve About page
2554366

Avijit Ghosh commited on

new ux
6978d97

Avijit Ghosh commited on