ベンチマーク

ベンチマーク

ローカルLLMのCPU推論とGPU推論を実測比較

「ローカルLLMを動かすにはやっぱりGPUがいるの?」「CPUだけだと実用にならないって本当?」——これからローカルLLMを触ろうとしている方が、最初に必ずぶつかる疑問だと思います。
ベンチマーク

GPU別ローカルLLM推論速度を実測比較【RTX4090/3090/A100】

「ローカルLLMを動かしたいけど、手元の GPU で本当に使えるの?」という疑問を持っている方は多いと思います。
ベンチマーク

ローカルLLMモデル別トークン生成速度を実測比較【Llama/Qwen/Gemma】

「ローカルでLLMを動かしたいけど、Llama・Qwen・Gemma のどれが速いの?」——結論から言うと、今回テストした0.5〜1.5Bクラスでは qwen3:0.6b が約259 tok/s で最速、同じ1Bクラスの gemma3:1b…