Tribute1998

設定

OllamaのGPUレイヤー数(num_gpu)を調整して速度を上げる方法

本記事は Ollama 0.30.8(macOS / Apple M1 Max・32GB ユニファイドメモリ)で実際に推論速度を計測し、パッケージ確認は Ubuntu 24.04 LTS(Docker 公式イメージ ubuntu:24.04…
設定

Ollamaのパラメータ完全解説【temperature/top_p/num_predict】

「Ollamaで生成した文章が毎回同じで面白くない」「逆にランダムすぎて使えない」——そんなときは生成パラメータを調整すれば、出力の品質と速度をコントロールできます。temperatureを下げれば一貫性が増し、num_predictを絞れ…
設定

Ubuntuのnginx.conf設定を完全解説【パフォーマンス最適化】

本記事のコマンドはすべて ubuntu:24.04 Docker公式イメージで実際に実行し、実出力を確認しています(2026-06-15)。比較用に ubuntu:22.04 でも nginx のバージョンを確認済みです。レスポンスヘッダー…
設定

Ubuntuのsshd_config設定項目を完全解説【セキュリティ強化】

UbuntuのSSHサーバーを設定する /etc/ssh/sshd_config には、セキュリティに直結する設定項目が数十個あります。正直、「どれをどう変えればいいのか分からない」という人は多いです。本記事では、Ubuntu 24.04…
ベンチマーク

Webサーバー別の性能を実測比較【Nginx/Apache/Caddy】

「NginxとApache、どっちが速いの?」——Linux でサーバーを立てようとすると、必ず迷うポイントです。さらに最近は Caddy という比較的新しいWebサーバーも注目されています。
ベンチマーク

圧縮形式別の速度と圧縮率を実測【gzip/bzip2/xz/zstd】

「ファイルを圧縮するときって gzip でいいんじゃないの?」と思っている方は多いと思います。実際、tar.gz 形式は長年Linuxで標準的に使われてきました。でも今は状況が変わりつつあります。
ベンチマーク

ファイルシステム別IO性能を実測比較【ext4/xfs/btrfs/zfs】

「ext4とXFSって何が違うの?」「Btrfsを使うとどのくらい遅くなるの?」――Linuxのファイルシステム選択は、VPSやサーバーを運用するうえで避けて通れない問いです。
ベンチマーク

量子化レベル別の速度と精度を実測【Q4/Q5/Q8/FP16】

「どの量子化レベルを選べばいいの?」は、Ollama でローカル LLM を動かし始めたときに誰もがぶつかる疑問です。Q4_K_M・Q5_K_M・Q8_0・FP16――名前はよく見かけるのに、実際に速度がどれだけ変わるのか、はっきりした一次…
用途別

Ubuntu+GPUでAI推論サーバーを自作する完全ガイド

自宅のPCやVPSにAI推論サーバーを自作すると、ChatGPT のような会話AIを完全ローカルで動かせるようになります。クラウドAPIの料金を気にせず、手元のデータをインターネットに送らずに済む点が最大の魅力です。
ローカルLLM

ローカルLLMはVPSと自宅PCどちらで動かすべき?コスト比較

ローカルLLMを動かしたいけど、VPSと自宅PCのどっちがいいんだろう?正直、これは多くの人が最初に詰まるポイントです。