Add files using upload-large-folder tool
Browse filesThis view is limited to 50 files because it contains too many changes. See raw diff
- lm-quant-toolkit/.deps/lm-evaluation-harness/tests/testdata/lambada_openai_mt_it-v0-res.json +1 -0
- lm-quant-toolkit/.deps/lm-evaluation-harness/tests/testdata/lambada_standard-v0-loglikelihood +1 -0
- lm-quant-toolkit/.deps/lm-evaluation-harness/tests/testdata/lambada_standard-v0-res.json +1 -0
- lm-quant-toolkit/.deps/lm-evaluation-harness/tests/testdata/lambada_standard_cloze-v0-loglikelihood +1 -0
- lm-quant-toolkit/.deps/lm-evaluation-harness/tests/testdata/lambada_standard_cloze-v0-res.json +1 -0
- lm-quant-toolkit/.deps/lm-evaluation-harness/tests/testdata/logiqa-v0-loglikelihood +1 -0
- lm-quant-toolkit/.deps/lm-evaluation-harness/tests/testdata/logiqa-v0-res.json +1 -0
- lm-quant-toolkit/.deps/lm-evaluation-harness/tests/testdata/math_algebra-v0-greedy_until +1 -0
- lm-quant-toolkit/.deps/lm-evaluation-harness/tests/testdata/math_algebra-v0-res.json +1 -0
- lm-quant-toolkit/.deps/lm-evaluation-harness/tests/testdata/math_algebra-v1-greedy_until +1 -0
- lm-quant-toolkit/.deps/lm-evaluation-harness/tests/testdata/math_algebra-v1-res.json +1 -0
- lm-quant-toolkit/.deps/lm-evaluation-harness/tests/testdata/math_counting_and_prob-v0-greedy_until +1 -0
- lm-quant-toolkit/.deps/lm-evaluation-harness/tests/testdata/math_counting_and_prob-v0-res.json +1 -0
- lm-quant-toolkit/.deps/lm-evaluation-harness/tests/testdata/math_counting_and_prob-v1-greedy_until +1 -0
- lm-quant-toolkit/.deps/lm-evaluation-harness/tests/testdata/math_counting_and_prob-v1-res.json +1 -0
- lm-quant-toolkit/.deps/lm-evaluation-harness/tests/testdata/math_geometry-v0-greedy_until +1 -0
- lm-quant-toolkit/.deps/lm-evaluation-harness/tests/testdata/math_geometry-v0-res.json +1 -0
- lm-quant-toolkit/.deps/lm-evaluation-harness/tests/testdata/math_geometry-v1-greedy_until +1 -0
- lm-quant-toolkit/.deps/lm-evaluation-harness/tests/testdata/math_geometry-v1-res.json +1 -0
- lm-quant-toolkit/.deps/lm-evaluation-harness/tests/testdata/math_intermediate_algebra-v0-greedy_until +1 -0
- lm-quant-toolkit/.deps/lm-evaluation-harness/tests/testdata/math_intermediate_algebra-v0-res.json +1 -0
- lm-quant-toolkit/.deps/lm-evaluation-harness/tests/testdata/math_intermediate_algebra-v1-greedy_until +1 -0
- lm-quant-toolkit/.deps/lm-evaluation-harness/tests/testdata/math_intermediate_algebra-v1-res.json +1 -0
- lm-quant-toolkit/.deps/lm-evaluation-harness/tests/testdata/math_num_theory-v0-greedy_until +1 -0
- lm-quant-toolkit/.deps/lm-evaluation-harness/tests/testdata/math_num_theory-v0-res.json +1 -0
- lm-quant-toolkit/.deps/lm-evaluation-harness/tests/testdata/math_num_theory-v1-greedy_until +1 -0
- lm-quant-toolkit/.deps/lm-evaluation-harness/tests/testdata/math_num_theory-v1-res.json +1 -0
- lm-quant-toolkit/.deps/lm-evaluation-harness/tests/testdata/math_prealgebra-v0-greedy_until +1 -0
- lm-quant-toolkit/.deps/lm-evaluation-harness/tests/testdata/math_prealgebra-v0-res.json +1 -0
- lm-quant-toolkit/.deps/lm-evaluation-harness/tests/testdata/math_prealgebra-v1-greedy_until +1 -0
- lm-quant-toolkit/.deps/lm-evaluation-harness/tests/testdata/math_prealgebra-v1-res.json +1 -0
- lm-quant-toolkit/.deps/lm-evaluation-harness/tests/testdata/math_precalc-v0-greedy_until +1 -0
- lm-quant-toolkit/.deps/lm-evaluation-harness/tests/testdata/math_precalc-v0-res.json +1 -0
- lm-quant-toolkit/.deps/lm-evaluation-harness/tests/testdata/math_precalc-v1-greedy_until +1 -0
- lm-quant-toolkit/.deps/lm-evaluation-harness/tests/testdata/math_precalc-v1-res.json +1 -0
- lm-quant-toolkit/.deps/lm-evaluation-harness/tests/testdata/mathqa-v0-loglikelihood +1 -0
- lm-quant-toolkit/.deps/lm-evaluation-harness/tests/testdata/mathqa-v0-res.json +1 -0
- lm-quant-toolkit/.deps/lm-evaluation-harness/tests/testdata/mc_taco-v0-loglikelihood +1 -0
- lm-quant-toolkit/.deps/lm-evaluation-harness/tests/testdata/mc_taco-v0-res.json +1 -0
- lm-quant-toolkit/.deps/lm-evaluation-harness/tests/testdata/mmlu_stem_10_hf_pretrained-EleutherAI-pythia-14m-dtype-float32-device-cpu.txt +22 -0
- lm-quant-toolkit/.deps/lm-evaluation-harness/tests/testdata/mnli-v0-loglikelihood +1 -0
- lm-quant-toolkit/.deps/lm-evaluation-harness/tests/testdata/mnli-v0-res.json +1 -0
- lm-quant-toolkit/.deps/lm-evaluation-harness/tests/testdata/mnli_mismatched-v0-loglikelihood +1 -0
- lm-quant-toolkit/.deps/lm-evaluation-harness/tests/testdata/mnli_mismatched-v0-res.json +1 -0
- lm-quant-toolkit/.deps/lm-evaluation-harness/tests/testdata/mrpc-v0-loglikelihood +1 -0
- lm-quant-toolkit/.deps/lm-evaluation-harness/tests/testdata/mrpc-v0-res.json +1 -0
- lm-quant-toolkit/.deps/lm-evaluation-harness/tests/testdata/multirc-v0-loglikelihood +1 -0
- lm-quant-toolkit/.deps/lm-evaluation-harness/tests/testdata/multirc-v0-res.json +1 -0
- lm-quant-toolkit/.deps/lm-evaluation-harness/tests/testdata/multirc-v1-loglikelihood +1 -0
- lm-quant-toolkit/.deps/lm-evaluation-harness/tests/testdata/multirc-v1-res.json +1 -0
lm-quant-toolkit/.deps/lm-evaluation-harness/tests/testdata/lambada_openai_mt_it-v0-res.json
ADDED
|
@@ -0,0 +1 @@
|
|
|
|
|
|
|
| 1 |
+
{"results": {"lambada_openai_mt_it": {"acc": 0.0, "acc_stderr": 0.0, "ppl": 1.6479047769869253, "ppl_stderr": 0.006497321146240192}}, "versions": {"lambada_openai_mt_it": 0}}
|
lm-quant-toolkit/.deps/lm-evaluation-harness/tests/testdata/lambada_standard-v0-loglikelihood
ADDED
|
@@ -0,0 +1 @@
|
|
|
|
|
|
|
| 1 |
+
8958d9f8d8145046b692fadd8a9cc9c8bad5617c10774280cf7c24c21d2be160
|
lm-quant-toolkit/.deps/lm-evaluation-harness/tests/testdata/lambada_standard-v0-res.json
ADDED
|
@@ -0,0 +1 @@
|
|
|
|
|
|
|
| 1 |
+
{"results": {"lambada_standard": {"acc": 0.0, "acc_stderr": 0.0, "ppl": 1.6479047769869253, "ppl_stderr": 0.006497321146240192}}, "versions": {"lambada_standard": 0}}
|
lm-quant-toolkit/.deps/lm-evaluation-harness/tests/testdata/lambada_standard_cloze-v0-loglikelihood
ADDED
|
@@ -0,0 +1 @@
|
|
|
|
|
|
|
| 1 |
+
b604f00bc9f2a77ef41f8cfdb5a8509b3ae9266893b9e90abc665f5399ecba4e
|
lm-quant-toolkit/.deps/lm-evaluation-harness/tests/testdata/lambada_standard_cloze-v0-res.json
ADDED
|
@@ -0,0 +1 @@
|
|
|
|
|
|
|
| 1 |
+
{"results": {"lambada_standard_cloze": {"acc": 0.0, "acc_stderr": 0.0, "ppl": 1.6479047769869253, "ppl_stderr": 0.006497321146240192}}, "versions": {"lambada_standard_cloze": 0}}
|
lm-quant-toolkit/.deps/lm-evaluation-harness/tests/testdata/logiqa-v0-loglikelihood
ADDED
|
@@ -0,0 +1 @@
|
|
|
|
|
|
|
| 1 |
+
12495c50454ba5e1ce0753bd18c09aaca516bebd27648d815e37b15229dbf198
|
lm-quant-toolkit/.deps/lm-evaluation-harness/tests/testdata/logiqa-v0-res.json
ADDED
|
@@ -0,0 +1 @@
|
|
|
|
|
|
|
| 1 |
+
{"results": {"logiqa": {"acc": 0.25806451612903225, "acc_norm": 0.2764976958525346, "acc_norm_stderr": 0.017543209075825194, "acc_stderr": 0.017162894755127077}}, "versions": {"logiqa": 0}}
|
lm-quant-toolkit/.deps/lm-evaluation-harness/tests/testdata/math_algebra-v0-greedy_until
ADDED
|
@@ -0,0 +1 @@
|
|
|
|
|
|
|
| 1 |
+
f19182ce697a2c095d9e5b56ee6659dc38c93994b69ca75d7c3d3f5fd87572b4
|
lm-quant-toolkit/.deps/lm-evaluation-harness/tests/testdata/math_algebra-v0-res.json
ADDED
|
@@ -0,0 +1 @@
|
|
|
|
|
|
|
| 1 |
+
{"results": {"math_algebra": {"acc": 0.0, "acc_stderr": 0.0}}, "versions": {"math_algebra": 0}}
|
lm-quant-toolkit/.deps/lm-evaluation-harness/tests/testdata/math_algebra-v1-greedy_until
ADDED
|
@@ -0,0 +1 @@
|
|
|
|
|
|
|
| 1 |
+
f19182ce697a2c095d9e5b56ee6659dc38c93994b69ca75d7c3d3f5fd87572b4
|
lm-quant-toolkit/.deps/lm-evaluation-harness/tests/testdata/math_algebra-v1-res.json
ADDED
|
@@ -0,0 +1 @@
|
|
|
|
|
|
|
| 1 |
+
{"results": {"math_algebra": {"acc": 0.0, "acc_stderr": 0.0}}, "versions": {"math_algebra": 1}}
|
lm-quant-toolkit/.deps/lm-evaluation-harness/tests/testdata/math_counting_and_prob-v0-greedy_until
ADDED
|
@@ -0,0 +1 @@
|
|
|
|
|
|
|
| 1 |
+
2aa9ae43ee9dbb2457525247d7b65358632c5eaa9cbfc40cf95a4f17f5d942ad
|
lm-quant-toolkit/.deps/lm-evaluation-harness/tests/testdata/math_counting_and_prob-v0-res.json
ADDED
|
@@ -0,0 +1 @@
|
|
|
|
|
|
|
| 1 |
+
{"results": {"math_counting_and_prob": {"acc": 0.0, "acc_stderr": 0.0}}, "versions": {"math_counting_and_prob": 0}}
|
lm-quant-toolkit/.deps/lm-evaluation-harness/tests/testdata/math_counting_and_prob-v1-greedy_until
ADDED
|
@@ -0,0 +1 @@
|
|
|
|
|
|
|
| 1 |
+
2aa9ae43ee9dbb2457525247d7b65358632c5eaa9cbfc40cf95a4f17f5d942ad
|
lm-quant-toolkit/.deps/lm-evaluation-harness/tests/testdata/math_counting_and_prob-v1-res.json
ADDED
|
@@ -0,0 +1 @@
|
|
|
|
|
|
|
| 1 |
+
{"results": {"math_counting_and_prob": {"acc": 0.0, "acc_stderr": 0.0}}, "versions": {"math_counting_and_prob": 1}}
|
lm-quant-toolkit/.deps/lm-evaluation-harness/tests/testdata/math_geometry-v0-greedy_until
ADDED
|
@@ -0,0 +1 @@
|
|
|
|
|
|
|
| 1 |
+
46bc4cb219b6903397da782699a684bdbb982c0c954ff82e6beeed5c84878f42
|
lm-quant-toolkit/.deps/lm-evaluation-harness/tests/testdata/math_geometry-v0-res.json
ADDED
|
@@ -0,0 +1 @@
|
|
|
|
|
|
|
| 1 |
+
{"results": {"math_geometry": {"acc": 0.0, "acc_stderr": 0.0}}, "versions": {"math_geometry": 0}}
|
lm-quant-toolkit/.deps/lm-evaluation-harness/tests/testdata/math_geometry-v1-greedy_until
ADDED
|
@@ -0,0 +1 @@
|
|
|
|
|
|
|
| 1 |
+
46bc4cb219b6903397da782699a684bdbb982c0c954ff82e6beeed5c84878f42
|
lm-quant-toolkit/.deps/lm-evaluation-harness/tests/testdata/math_geometry-v1-res.json
ADDED
|
@@ -0,0 +1 @@
|
|
|
|
|
|
|
| 1 |
+
{"results": {"math_geometry": {"acc": 0.0, "acc_stderr": 0.0}}, "versions": {"math_geometry": 1}}
|
lm-quant-toolkit/.deps/lm-evaluation-harness/tests/testdata/math_intermediate_algebra-v0-greedy_until
ADDED
|
@@ -0,0 +1 @@
|
|
|
|
|
|
|
| 1 |
+
d53c699de272d517ed7ad783b4e692302be9f9f97a8d4ac7a6541e538a7cabe0
|
lm-quant-toolkit/.deps/lm-evaluation-harness/tests/testdata/math_intermediate_algebra-v0-res.json
ADDED
|
@@ -0,0 +1 @@
|
|
|
|
|
|
|
| 1 |
+
{"results": {"math_intermediate_algebra": {"acc": 0.0, "acc_stderr": 0.0}}, "versions": {"math_intermediate_algebra": 0}}
|
lm-quant-toolkit/.deps/lm-evaluation-harness/tests/testdata/math_intermediate_algebra-v1-greedy_until
ADDED
|
@@ -0,0 +1 @@
|
|
|
|
|
|
|
| 1 |
+
d53c699de272d517ed7ad783b4e692302be9f9f97a8d4ac7a6541e538a7cabe0
|
lm-quant-toolkit/.deps/lm-evaluation-harness/tests/testdata/math_intermediate_algebra-v1-res.json
ADDED
|
@@ -0,0 +1 @@
|
|
|
|
|
|
|
| 1 |
+
{"results": {"math_intermediate_algebra": {"acc": 0.0, "acc_stderr": 0.0}}, "versions": {"math_intermediate_algebra": 1}}
|
lm-quant-toolkit/.deps/lm-evaluation-harness/tests/testdata/math_num_theory-v0-greedy_until
ADDED
|
@@ -0,0 +1 @@
|
|
|
|
|
|
|
| 1 |
+
b920ccb507afdcf3ef6f4c04891913731e9f32ec914801791c6d9f8abf6e1897
|
lm-quant-toolkit/.deps/lm-evaluation-harness/tests/testdata/math_num_theory-v0-res.json
ADDED
|
@@ -0,0 +1 @@
|
|
|
|
|
|
|
| 1 |
+
{"results": {"math_num_theory": {"acc": 0.0, "acc_stderr": 0.0}}, "versions": {"math_num_theory": 0}}
|
lm-quant-toolkit/.deps/lm-evaluation-harness/tests/testdata/math_num_theory-v1-greedy_until
ADDED
|
@@ -0,0 +1 @@
|
|
|
|
|
|
|
| 1 |
+
b920ccb507afdcf3ef6f4c04891913731e9f32ec914801791c6d9f8abf6e1897
|
lm-quant-toolkit/.deps/lm-evaluation-harness/tests/testdata/math_num_theory-v1-res.json
ADDED
|
@@ -0,0 +1 @@
|
|
|
|
|
|
|
| 1 |
+
{"results": {"math_num_theory": {"acc": 0.0, "acc_stderr": 0.0}}, "versions": {"math_num_theory": 1}}
|
lm-quant-toolkit/.deps/lm-evaluation-harness/tests/testdata/math_prealgebra-v0-greedy_until
ADDED
|
@@ -0,0 +1 @@
|
|
|
|
|
|
|
| 1 |
+
752cdf343d7152e476b0273065024f6ea0e0f47ea385c6bdf9067736cb39724a
|
lm-quant-toolkit/.deps/lm-evaluation-harness/tests/testdata/math_prealgebra-v0-res.json
ADDED
|
@@ -0,0 +1 @@
|
|
|
|
|
|
|
| 1 |
+
{"results": {"math_prealgebra": {"acc": 0.0, "acc_stderr": 0.0}}, "versions": {"math_prealgebra": 0}}
|
lm-quant-toolkit/.deps/lm-evaluation-harness/tests/testdata/math_prealgebra-v1-greedy_until
ADDED
|
@@ -0,0 +1 @@
|
|
|
|
|
|
|
| 1 |
+
752cdf343d7152e476b0273065024f6ea0e0f47ea385c6bdf9067736cb39724a
|
lm-quant-toolkit/.deps/lm-evaluation-harness/tests/testdata/math_prealgebra-v1-res.json
ADDED
|
@@ -0,0 +1 @@
|
|
|
|
|
|
|
| 1 |
+
{"results": {"math_prealgebra": {"acc": 0.0, "acc_stderr": 0.0}}, "versions": {"math_prealgebra": 1}}
|
lm-quant-toolkit/.deps/lm-evaluation-harness/tests/testdata/math_precalc-v0-greedy_until
ADDED
|
@@ -0,0 +1 @@
|
|
|
|
|
|
|
| 1 |
+
bc834b06fd79473ca6fe38a51b714aad0bf0478c1b0eec787eca34dbdf69cb71
|
lm-quant-toolkit/.deps/lm-evaluation-harness/tests/testdata/math_precalc-v0-res.json
ADDED
|
@@ -0,0 +1 @@
|
|
|
|
|
|
|
| 1 |
+
{"results": {"math_precalc": {"acc": 0.0, "acc_stderr": 0.0}}, "versions": {"math_precalc": 0}}
|
lm-quant-toolkit/.deps/lm-evaluation-harness/tests/testdata/math_precalc-v1-greedy_until
ADDED
|
@@ -0,0 +1 @@
|
|
|
|
|
|
|
| 1 |
+
bc834b06fd79473ca6fe38a51b714aad0bf0478c1b0eec787eca34dbdf69cb71
|
lm-quant-toolkit/.deps/lm-evaluation-harness/tests/testdata/math_precalc-v1-res.json
ADDED
|
@@ -0,0 +1 @@
|
|
|
|
|
|
|
| 1 |
+
{"results": {"math_precalc": {"acc": 0.0, "acc_stderr": 0.0}}, "versions": {"math_precalc": 1}}
|
lm-quant-toolkit/.deps/lm-evaluation-harness/tests/testdata/mathqa-v0-loglikelihood
ADDED
|
@@ -0,0 +1 @@
|
|
|
|
|
|
|
| 1 |
+
a45260e49f02c7cb8886b3746db4d388890860b202dd8a9f0267e3c324e0af13
|
lm-quant-toolkit/.deps/lm-evaluation-harness/tests/testdata/mathqa-v0-res.json
ADDED
|
@@ -0,0 +1 @@
|
|
|
|
|
|
|
| 1 |
+
{"results": {"mathqa": {"acc": 0.20770519262981574, "acc_norm": 0.2050251256281407, "acc_norm_stderr": 0.007390619359738901, "acc_stderr": 0.007426217631188539}}, "versions": {"mathqa": 0}}
|
lm-quant-toolkit/.deps/lm-evaluation-harness/tests/testdata/mc_taco-v0-loglikelihood
ADDED
|
@@ -0,0 +1 @@
|
|
|
|
|
|
|
| 1 |
+
1811808ef05afd5f30ffc3471622a3dd7a1b681b17a2f7616695ad6b2a45943c
|
lm-quant-toolkit/.deps/lm-evaluation-harness/tests/testdata/mc_taco-v0-res.json
ADDED
|
@@ -0,0 +1 @@
|
|
|
|
|
|
|
| 1 |
+
{"results": {"mc_taco": {"em": 0.07732732732732733, "f1": 0.41600515965511614}}, "versions": {"mc_taco": 0}}
|
lm-quant-toolkit/.deps/lm-evaluation-harness/tests/testdata/mmlu_stem_10_hf_pretrained-EleutherAI-pythia-14m-dtype-float32-device-cpu.txt
ADDED
|
@@ -0,0 +1,22 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
| Tasks |Version|Filter|n-shot|Metric| |Value | |Stderr|
|
| 2 |
+
|-------------------------------|------:|------|-----:|------|---|-----:|---|------|
|
| 3 |
+
|stem | 2|none | |acc |↑ |0.2474|± | N/A|
|
| 4 |
+
| - abstract_algebra | 1|none | 0|acc |↑ |0.2000|± | N/A|
|
| 5 |
+
| - anatomy | 1|none | 0|acc |↑ |0.3000|± | N/A|
|
| 6 |
+
| - astronomy | 1|none | 0|acc |↑ |0.1000|± | N/A|
|
| 7 |
+
| - college_biology | 1|none | 0|acc |↑ |0.3000|± | N/A|
|
| 8 |
+
| - college_chemistry | 1|none | 0|acc |↑ |0.1000|± | N/A|
|
| 9 |
+
| - college_computer_science | 1|none | 0|acc |↑ |0.2000|± | N/A|
|
| 10 |
+
| - college_mathematics | 1|none | 0|acc |↑ |0.2000|± | N/A|
|
| 11 |
+
| - college_physics | 1|none | 0|acc |↑ |0.3000|± | N/A|
|
| 12 |
+
| - computer_security | 1|none | 0|acc |↑ |0.5000|± | N/A|
|
| 13 |
+
| - conceptual_physics | 1|none | 0|acc |↑ |0.3000|± | N/A|
|
| 14 |
+
| - electrical_engineering | 1|none | 0|acc |↑ |0.4000|± | N/A|
|
| 15 |
+
| - elementary_mathematics | 1|none | 0|acc |↑ |0.0000|± | N/A|
|
| 16 |
+
| - high_school_biology | 1|none | 0|acc |↑ |0.3000|± | N/A|
|
| 17 |
+
| - high_school_chemistry | 1|none | 0|acc |↑ |0.4000|± | N/A|
|
| 18 |
+
| - high_school_computer_science| 1|none | 0|acc |↑ |0.3000|± | N/A|
|
| 19 |
+
| - high_school_mathematics | 1|none | 0|acc |↑ |0.2000|± | N/A|
|
| 20 |
+
| - high_school_physics | 1|none | 0|acc |↑ |0.3000|± | N/A|
|
| 21 |
+
| - high_school_statistics | 1|none | 0|acc |↑ |0.0000|± | N/A|
|
| 22 |
+
| - machine_learning | 1|none | 0|acc |↑ |0.3000|± | N/A|
|
lm-quant-toolkit/.deps/lm-evaluation-harness/tests/testdata/mnli-v0-loglikelihood
ADDED
|
@@ -0,0 +1 @@
|
|
|
|
|
|
|
| 1 |
+
4fc7b56b8f1e37e38f4a052b227baec2df914c898c3405d3e994726ba4fba976
|
lm-quant-toolkit/.deps/lm-evaluation-harness/tests/testdata/mnli-v0-res.json
ADDED
|
@@ -0,0 +1 @@
|
|
|
|
|
|
|
| 1 |
+
{"results": {"mnli": {"acc": 0.32868059093224655, "acc_stderr": 0.004741640290753859}}, "versions": {"mnli": 0}}
|
lm-quant-toolkit/.deps/lm-evaluation-harness/tests/testdata/mnli_mismatched-v0-loglikelihood
ADDED
|
@@ -0,0 +1 @@
|
|
|
|
|
|
|
| 1 |
+
3784acf322e79f31702a7a0612030e4ba5c4fc466ad976a34ee3f3d7278c01f0
|
lm-quant-toolkit/.deps/lm-evaluation-harness/tests/testdata/mnli_mismatched-v0-res.json
ADDED
|
@@ -0,0 +1 @@
|
|
|
|
|
|
|
| 1 |
+
{"results": {"mnli_mismatched": {"acc": 0.3360455655004068, "acc_stderr": 0.004763973908606819}}, "versions": {"mnli_mismatched": 0}}
|
lm-quant-toolkit/.deps/lm-evaluation-harness/tests/testdata/mrpc-v0-loglikelihood
ADDED
|
@@ -0,0 +1 @@
|
|
|
|
|
|
|
| 1 |
+
9f54cbff8d6accba99cfa2c4c4b359563313941018173d7dcf9e32dc28c06583
|
lm-quant-toolkit/.deps/lm-evaluation-harness/tests/testdata/mrpc-v0-res.json
ADDED
|
@@ -0,0 +1 @@
|
|
|
|
|
|
|
| 1 |
+
{"results": {"mrpc": {"acc": 0.5392156862745098, "acc_stderr": 0.024707732873723128, "f1": 0.5982905982905982, "f1_stderr": 0.028928325246283727}}, "versions": {"mrpc": 0}}
|
lm-quant-toolkit/.deps/lm-evaluation-harness/tests/testdata/multirc-v0-loglikelihood
ADDED
|
@@ -0,0 +1 @@
|
|
|
|
|
|
|
| 1 |
+
cdb026c027437a8b4653212d0944d36fc16f49921dcb8e4bef899d15a55e9f80
|
lm-quant-toolkit/.deps/lm-evaluation-harness/tests/testdata/multirc-v0-res.json
ADDED
|
@@ -0,0 +1 @@
|
|
|
|
|
|
|
| 1 |
+
{"results": {"multirc": {"acc": 0.07450157397691501, "acc_stderr": 0.008510441526175931}}, "versions": {"multirc": 0}}
|
lm-quant-toolkit/.deps/lm-evaluation-harness/tests/testdata/multirc-v1-loglikelihood
ADDED
|
@@ -0,0 +1 @@
|
|
|
|
|
|
|
| 1 |
+
0e793bd6f637a70a04c6f2cda080188fc037961b2f909095fe63f7bdbc4a90c6
|
lm-quant-toolkit/.deps/lm-evaluation-harness/tests/testdata/multirc-v1-res.json
ADDED
|
@@ -0,0 +1 @@
|
|
|
|
|
|
|
| 1 |
+
{"results": {"multirc": {"acc": 0.046169989506820566, "acc_stderr": 0.006801377886208738}}, "versions": {"multirc": 1}}
|