VRAM別ベンチマーク

VRAM 8GB で動くモデル

VRAM 8GB のGPUで実測したローカルLLMを、生成速度や量子化方式から比較できます。

← 全ベンチマークへ戻る

生成速度グラフ

VRAM 8GB の tokens/sec 比較
tokens/secGemma 2 2B (Q4_K_M) — RTX 4060 / llama.cpp108.3Llama 3.2 3B (Q4_K_M) — RTX 4060 / ollama94.5

比較表

列見出しで並べ替え、backend と GPU の選択欄で絞り込みができます。

ローカルLLMの実測ベンチマーク比較表
Gemma 2 2BQ4_K_MRTX 40608llama.cpp108.34,0962026-05-22
Llama 3.2 3BQ4_K_MRTX 40608ollama94.58,1922026-05-06標準設定での3回平均(暫定値)