Moderato-V1-Pro / .eval_results /terminal-bench-2.1.yaml
NitrAI's picture NitrAI-BOT's picture
Add community evaluation results for DEEP-SWE, GPQA, HLE, SWE-BENCH_PRO, TERMINAL-BENCH, WILDCLAWBENCH, EXTRACTBENCH (#3)
560ead4
Raw History Blame Contribute Delete
194 Bytes
- dataset:
id: harborframework/terminal-bench-2.1
task_id: terminalbench_2_1
value: 79.5
source:
url: https://huggingface.co/nitrai-research/Moderato-V1-Pro
name: Model Card