VRAM別ベンチマーク
VRAM 8GB で動くモデル
VRAM 8GB のGPUで実測したローカルLLMを、生成速度や量子化方式から比較できます。
← 全ベンチマークへ戻る生成速度グラフ
比較表
列見出しで並べ替え、backend と GPU の選択欄で絞り込みができます。
| Gemma 2 2B | Q4_K_M | RTX 4060 | 8 | llama.cpp | 108.3 | 4,096 | 2026-05-22 | — |
| Llama 3.2 3B | Q4_K_M | RTX 4060 | 8 | ollama | 94.5 | 8,192 | 2026-05-06 | 標準設定での3回平均(暫定値) |