{
  "title": {
    "pl": "Ten sam model 72B · szybkość generowania",
    "en": "The same 72B model · generation speed"
  },
  "unit": "tokens/s",
  "items": [
    {
      "label": {
        "pl": "Model na GPU",
        "en": "Model on GPU"
      },
      "value": 26.07091165761903
    },
    {
      "label": {
        "pl": "GPU + CPU: mniejsze zajęcie VRAM",
        "en": "GPU + CPU: lower VRAM use"
      },
      "value": 1.0752842293155311
    },
    {
      "label": {
        "pl": "GPU + CPU: jeszcze mniejsze zajęcie VRAM",
        "en": "GPU + CPU: further reduced VRAM use"
      },
      "value": 0.733935543108075
    }
  ],
  "note": {
    "pl": "Qwen2.5-72B Q4_K_M · wejście 2048 tokenów. Średnia szybkość generowania silnika z 3 rund, nie czas całej odpowiedzi.",
    "en": "Qwen2.5-72B Q4_K_M · 2048 input tokens. Mean server decoding speed across 3 rounds, not complete-response time."
  }
}
