radi-cho/Meta-Llama-3-70B-FLUTE

Model

| | Wiki | C4 | PIQA | ARC-E | ARC-C | HellaSwag | Wino | Avg. |

0

6 commits

2 linked in READMEs

updated Jul 20, 2024

See the code

README

WikiC4PIQAARC-EARC-CHellaSwagWinoAvg.
Unquantized2.96.982.486.960.366.480.675.3
W4G643.037.0382.1585.9857.8566.1779.7974.39
W3G644.158.1080.7483.7155.2964.0578.4572.45

Revisions available in this repository:

  • main (W4G64, scales learned);
  • nfl_w3g64 (W3G64, scales learned);

Evaluations are provided for models with learned scales.
Benchmark scores (zero-shot) are computed with lm-evaluation-harness.

endpoints_compatible
llama
safetensors
text-generation
text-generation-inference
transformers

radi-cho/Meta-Llama-3-70B-FLUTE

Model

| | Wiki | C4 | PIQA | ARC-E | ARC-C | HellaSwag | Wino | Avg. |

0

6 commits

2 linked in READMEs

updated Jul 20, 2024

See the code

README

WikiC4PIQAARC-EARC-CHellaSwagWinoAvg.
Unquantized2.96.982.486.960.366.480.675.3
W4G643.037.0382.1585.9857.8566.1779.7974.39
W3G644.158.1080.7483.7155.2964.0578.4572.45

Revisions available in this repository:

  • main (W4G64, scales learned);
  • nfl_w3g64 (W3G64, scales learned);

Evaluations are provided for models with learned scales.
Benchmark scores (zero-shot) are computed with lm-evaluation-harness.

endpoints_compatible
llama
safetensors
text-generation
text-generation-inference
transformers