in the loop

Llama 2-70B
#218 of 274 scored.

MetaJul 18, 2023Open weights

Capabilities Index

Range 105.7–117.4

113.8

Context

Tokens

—

Input

Per 1M tokens

—

Output

Per 1M tokens

—

Benchmarks

How it scores.

  • GPQA Diamond1.8%

    179th of 186

  • Mock AIME0.0%

    176th of 176

Everything else Epoch has for it

  • TriviaQA87.6%
  • HellaSwag80.4%
  • LAMBADA78.9%
  • ARC AI271.1%
  • GSM8K69.6%
  • PIQA65.6%
  • Winogrande60.4%
  • MMLU59.9%
  • BBH53.2%
  • OpenBookQA46.9%
  • MATH level 53.3%
  • DTBench2.8%

On the index

Around it.

  1. #215Gemma 3 4BGoogle · $0.05 in116.0
  2. #216GPT-3.5 Turbo (Jan 2024)OpenAI115.7
  3. #217PaLM 2-LGoogle115.0
  4. #218Llama 2-70BMeta113.8
  5. #219GPT-3.5 Turbo (Jun 2023)OpenAI113.4
  6. #220Qwen2.5-Coder (7B)Alibaba113.1
  7. #221Qwen-14BAlibaba113.0

Sources