AI/MLツール

AI/MLツール

Weights & Biases (wandb) on Ubuntu — ML実験トラッキングの導入

機械学習の実験を進めていると「あの時の学習率、何にしてたっけ?」「さっきのモデルより精度が下がった気がするけど、どのパラメータを変えたんだろう」という状況によく陥ります。結論から言うと、Weights & Biases(wandb)…
AI/MLツール

Ray on Ubuntu — 分散ML学習クラスターのセットアップと使い方

Ray(レイ)は、Pythonで書いた処理を複数のCPUコアや複数のマシンに自動で分散させるためのフレームワークです。機械学習のハイパーパラメータ探索・大規模データ処理・強化学習など、「1台では遅すぎる」という場面で真価を発揮します。本記事…
AI/MLツール

Axolotl on Ubuntu — LLMファインチューニングフレームワークの導入と実行

LLMのファインチューニング(追加学習)に挑戦しようとして、最初に「どのフレームワークを使えばいいのか分からない」と詰まる人は多いです。結論から言うと、Axolotl は LoRA・QLoRA・DeepSpeed・Flash Attenti…
AI/MLツール

ComfyUI API on Ubuntu — PythonからWebSocket APIで画像生成を自動化

ComfyUI を使い込んでいると、「ボタンを押すのではなく、プログラムから画像生成を呼び出したい」という場面が出てきます。バッチ処理、別サービスとの連携、スケジュール実行など、理由は様々です。
AI/MLツール

FLUX.1 Dev on Ubuntu — Black Forestの最新画像生成モデルをローカル実行

「Stable Diffusion よりも高品質な画像を生成できるモデルがある」と聞いて気になっている方も多いのではないでしょうか。FLUX.1 Dev は Black Forest Labs が公開した拡散モデルで、Ubuntu + GP…
AI/MLツール

Stable Diffusion 3.5 on Ubuntu — SD3最新モデルをローカルで動かす

Stable Diffusion 3.5(SD3.5)はStability AIが2024年後半にリリースした最新世代の画像生成モデルです。前世代のSDXLと比べてプロンプト追従性が大幅に向上しており、Ubuntu 24.04 LTS +…
AI/MLツール

Ubuntu ローカル音声AIパイプライン — Whisper+LLM+TTSで音声チャットボット構築

「マイクに話しかけたら、ローカルのAIがテキスト化して、考えて、音声で返してほしい」——そんな音声AIパイプラインを、クラウドAPIを一切使わずに Ubuntu 上で組めます。音声データが外に出ないのでプライバシーが守られ、APIコストもゼ…
AI/MLツール

RVC on Ubuntu — リアルタイムAI声質変換ツールの導入と使い方

RVC(Retrieval-based Voice Conversion)は、音声サンプルを学習させることで任意の声質に変換できるオープンソースの AI ボイスコンバーターです。「AI 歌声カバー」の制作や、配信中のリアルタイム声質変換など…
AI/MLツール

WhisperX on Ubuntu — 高精度タイムスタンプ付き音声文字起こしツール

音声ファイルを文字起こしすると、どうしてもタイムスタンプが「ざっくり数秒単位」になりがちです。WhisperX はそれを単語レベルの精度まで引き上げた、OpenAI Whisper の拡張ツールです。結論から言うと、pip install…
AI/MLツール

PEFT/QLoRA on Ubuntu — 低メモリでLLMをファインチューニングする実践

「LLMをファインチューニングしてみたい。でもモデルが大きすぎて自分のマシンには乗らない……」という悩み、よく聞きます。QLoRA(Quantized Low-Rank Adaptation)はその問題を解決する手法です。7Bクラスのモデル…