AI/MLツール

AI/MLツール

AlphaFold on Ubuntu — タンパク質構造予測AIのGPU環境構築

「AlphaFold を Ubuntu で動かしたい」と調べると、2.2TB ものデータベースが必要とか A100 でないと動かないといった情報に当たって、試す前に諦めた経験はないでしょうか。実際には、ColabFold を使えばローカルの…
AI/MLツール

Kokoro TTS on Ubuntu — 軽量高速ローカル日本語音声合成の導入

「Ubuntu で日本語の音声合成(TTS)をローカルで動かしたいけど、何を使えばいい?」という疑問をよく耳にします。結論から言うと、kokoro-onnx は pip install 1行でインストールできる軽量なオフラインTTSエンジン…
AI/MLツール

F5-TTS on Ubuntu — 少ないサンプルで自然な音声クローンを生成

F5-TTSは、Flow Matching(フローマッチング)という手法を使ったゼロショット音声合成モデルです。必要なサンプル音声は3〜15秒あれば十分で、その声の特徴を学習して任意のテキストを読み上げさせられます。
AI/MLツール

Zonos on Ubuntu — 感情制御付き高品質日本語TTSモデルの導入

Zonos は Zyphra 社が GitHub で公開している音声合成モデルです。2025年2月のリリース以来 GitHub スター数は 7.2k を超え、HuggingFace では月間 9,372 ダウンロードを記録しています。話題の…
AI/MLツール

AudioCraft/MusicGen on Ubuntu — MetaのAI音楽生成モデルをローカル実行

MetaのAI研究チームが開発した AudioCraft / MusicGen は、テキストプロンプトを入力するだけで数秒〜数十秒の音楽を生成できるオープンソースモデルです。 「upbeat electronic music with sy…
AI/MLツール

OpenVoice on Ubuntu — 声のクローンで多言語TTS音声を生成

「自分の声をAIにコピーさせたい」「日本語のTTS音声を無料で使いたい」――そう思ったことがあるなら、OpenVoiceはすぐに試せる選択肢です。MIT と MyShell が共同開発したこのツールは、短いサンプル音声から声の特徴を学習し、…
AI/MLツール

Tortoise TTS on Ubuntu — 超高品質多声テキスト音声合成のセットアップ

Ubuntu で Tortoise TTS を動かすと、市販のナレーションと見紛うほどの高品質な音声が手元で生成できます。結論を先に書くと、pip install tortoise-tts の1コマンドでインストールは完了しますが、モデルが…
AI/MLツール

so-vits-svc on Ubuntu — AIカバー曲・歌声変換モデルの構築

so-vits-svc(SoftVC VITS Singing Voice Conversion)は、 ある人物の声のサンプルを学習させて、任意の歌声を「その人の声」に変換するオープンソースモデルです。 AI カバー曲として SNS で流通…
AI/MLツール

OpenCompass on Ubuntu — LLMの日本語性能を体系的に評価する方法

チャット感覚で「このモデルは日本語が得意そう」と思っても、スコアで裏付けるのは難しいものです。OpenCompass を使えば、TyDi-QA(日本語QA)や Flores(英→日翻訳)などの標準ベンチマークでスコアを出せるので、印象ではな…
AI/MLツール

lm-evaluation-harness on Ubuntu — LLMの性能をベンチマーク評価する方法

LLM のスコアを比較した記事や論文で「Hellaswag 75.3%」「MMLU 68.1%」といった数字を見かけることがあります。これらは lm-evaluation-harness(lm-eval) と呼ばれる評価フレームワークで計測…