VRAM別ベンチマーク

VRAM 32GB で動くモデル

VRAM 32GB のGPUで実測したローカルLLMを、生成速度や量子化方式から比較できます。

← 全ベンチマークへ戻る

生成速度グラフ

VRAM 32GB の tokens/sec 比較
tokens/secQwen2.5 32B (Q4_K_M) — RTX 5090 / ollama45.2

比較表

列見出しで並べ替え、backend と GPU の選択欄で絞り込みができます。

ローカルLLMの実測ベンチマーク比較表
Qwen2.5 32BQ4_K_MRTX 509032ollama45.216,3842026-06-10受け入れ基準実証用に追加した1エントリ(暫定値)