2026年8月16日日曜日

ComfyUI

以前、画像生成AIのStable Diffusion WebUIをインストールして遊んでみたのがおよそ2年前でした。

Stable Diffusion web UI
https://u1f.blogspot.com/2024/09/stable-diffusion-web-ui.html
Stable Diffusion web UI の続き
https://u1f.blogspot.com/2024/09/stable-diffusion-web-ui_01346362620.html
Stable Diffusion web UI のその後
https://u1f.blogspot.com/2024/09/stable-diffusion-web-ui_0784456881.html

この2年の間にもAIは目覚ましい進化を遂げ、画像生成AIもComfyUIという別のツールが主流になっているようです。今回はUbuntu 26.04にComfyUIを導入し遊んでみようと思います。

以前ならインストール手順はREADMEを見て導入したりするんだけど、今回はGeminiに聞いて導入をしました。やっぱりAIで世界は変わりつつあるのかもしれない。

必要なツール類のインストール
$ sudo apt update
$ sudo apt install -y git python3-pip python3-venv wget curl

GitリポジトリからComfyUIをクローン
$ cd ~
$ git clone https://github.com/comfyanonymous/ComfyUI.git

Pythonの仮想環境を作成して、動作に必要なモジュール類をインストールする
$ cd ComfyUI
$ python3 -m venv venv
$ source venv/bin/activate
$ pip install --upgrade pip
$ pip install torch torchvision torchaudio

正しくCUDAとGPUが認識されているかテスト
$ python -c "import torch; print('CUDA available:', torch.cuda.is_available()); print('Device:', torch.cuda.get_device_name(0) if torch.cuda.is_available() else 'None')"
CUDA available: True
Device: NVIDIA GeForce RTX 2080

更に必要なモジュール類をインストール
$ pip install -r requirements.txt

ComfyUIの実行
$ python main.py --fp32-vae

自分がテストした環境はRTX2080で--fp32-vaeという引数をつけないと壊れた画像しか生成されなかった。通常なら引数は必要ないはず、このあたりもGeminiが全部教えてくれた。起動すると、http://localhost:8188にアクセスしろみたいなメッセージが表示されるのでブラウザでアクセスするとComfyUIの画面が表示される。
えーっと…なにこれ… 続く