ローカルLLM

ローカルLLM

ローカルLLMでAPI課金をゼロにする方法【ChatGPT代替のコスト試算】

ChatGPTのAPI料金、じわじわ増えていませんか?月に数百〜数千円が積み重なると、個人開発や学習用途では痛い出費です。この記事では、Ubuntu / Mac にローカルLLM(Ollama)を導入してAPI課金をゼロにする方法を、実際に…
ローカルLLM

ローカルLLMをAPIゲートウェイで束ねて使う方法【LiteLLM】

ローカルLLMを何種類も使い分けていると、「アプリごとにAPIの呼び方が違う」「モデルを切り替えるたびにコードを書き直す」という問題が出てきます。LiteLLMは、こうした複数のLLMを一つのOpenAI互換エンドポイントにまとめるAPIゲ…
ローカルLLM

ローカルLLMで社内文書を検索するRAGシステムの作り方

「社内の議事録やマニュアルをAIで検索したいけど、ChatGPTに機密情報を送るのは怖い」——そんな要望に応えるのが、ローカルLLMとRAG(Retrieval Augmented Generation)を組み合わせたオフラインAI検索シス…
ローカルLLM

UbuntuでLlamaIndexを使ってRAGを実装する方法

「ChatGPTに社内文書を読み込ませたい」「APIキーなしでローカルLLMに自分のドキュメントを質問したい」——そんなときに役立つのが RAG(Retrieval-Augmented Generation) です。
ローカルLLM

UbuntuでLangChainを使ってLLMアプリを開発する方法

「LangChainって聞いたことはあるけど、Ubuntuで実際にどうやって使い始めればいいの?」というのが、最初の疑問ですよね。本記事では、Ubuntu 24.04 LTS に LangChain をインストールして、ローカルLLMでチャ…
ローカルLLM

UbuntuにAnythingLLMを構築して社内文書AIを作る方法

「社内マニュアルや議事録をAIに読み込ませて、自然な日本語で質問したい」——そんな要望をクラウドAPIなし・無料・完全ローカルで実現できるのが AnythingLLM です。
ローカルLLM

Ollamaのモデル推論はGPUとCPUでどれだけ速度が違う?実測比較

「ローカルLLMって、GPUがないと使い物にならないの?」——Ollamaを触り始めると、誰もが一度はこの疑問にぶつかります。結論から言うと、GPUを使うと同じモデルでも2〜3倍速く回答が生成されます。ただし「CPUだと全く使えない」わけで…
ローカルLLM

ローカルLLMでAIエージェントを構築する方法【関数呼び出し】

「AIエージェントを作ってみたい、でも ChatGPT API は有料だし…」という方に朗報です。Ollama をローカルに立てるだけで、Function Calling(関数呼び出し)付きのAIエージェントを無料・無制限に動かせます。
ローカルLLM

Ollamaのモデルをファインチューニングする方法【LoRA基礎】

本記事のコマンドは Ollama 0.30.8 で検証しています(2026年6月15日実測)。学習ツールのバージョンは PyPI から実取得した最新版、Ubuntu 環境は ubuntu:24.04 公式Dockerイメージで確認しています…
ローカルLLM

UbuntuにvLLMを構築して高速推論する方法

ChatGPTのようなAIを自分のサーバーで動かしたい、しかもできるだけ速く推論したい——そう考えたとき、最も注目されているのが vLLM(Virtual Large Language Model)です。