2026年8月26日水曜日

ローカルLLM モデル選び

先日、ComfyUIの記事で「プロンプト作成のためにローカルLLMをセットアップする」という内容を書きました。

▼ 前回の記事
ComfyUI その後
https://u1f.blogspot.com/2026/08/comfyui_045361163.html

Geminiに勧められ、よくわからないまま「Qwen2.5:7b」というモデルファイルをインストールしたのですが、モデルについて色々調べてみたのでまとめてみます。

モデル名「Qwen2.5:7b」の意味

まず「Qwen」は、中国のアリババ(Alibaba)が公開しているLLM(大規模言語モデル)のシリーズ名です。
  • 2.5:モデルの「世代(バージョン)」
  • 7b:モデルの「パラメータ数(70億=7 Billion)」
パラメータ数は、ざっくり言うと学習量を表す値のようなもので、数値が大きいほど賢くなるが、その分動作に必要なメモリ(VRAM)も大きくなってしまいます。

VRAM 8GBのグラフィックボードなら「7b」や「9b」あたりが実用的なターゲットになり、それ以上のモデルを動かす場合は、VRAM 16GBや24GBといった上位のビデオカードが必要になってしまいます。

世代が進むとより賢くなる

現在各AI企業はたえず進化しており、Qwenだったら同じパラメータサイズでも最新世代の「Qwen3.5:7b」のほうが「Qwen2.5:7b」よりずっと賢くなっているそうです。また、世代が進むと処理効率も上がるため、旧世代の「Qwen2.5:7b」と最新の「Qwen3.5:4b」が同等の賢さになることもあるそうです。パラメータが小さくなれば要求されるVRAM容量も減り、動作もサクサク軽くなります。

Googleの「Gemma4:e4b」に移行

……と、ここまでQwenの話をしてきましたが、今はGoogleの「Gemma4:e4b」を使っています。GoogleのLLMは「Gemma」がシリーズ名です。Qwenは3から思考モードが実装されたそうなのですが、延々と思考ループに入ってしまい、なかなか回答がでてこないことがあります。Gemma4も思考はすれど、ループにはならないのでこちらに乗り換えました。今のところ満足してます。

Google Gemma4:e4b
https://huggingface.co/HauhauCS/Gemma-4-E4B-Uncensored-HauhauCS-Aggressive

上記のURLからGemma-4-E4B-Uncensored-HauhauCS-Aggressive-Q4_K_M.gguf をダウンロードし、 Ollama に取り込むため、モデルファイルを作ります。
---
FROM ./Gemma-4-E4B-Uncensored-HauhauCS-Aggressive-Q4_K_M.gguf

# システムプロンプトの設定
SYSTEM """
あなたは親切なアシスタントです。回答は簡潔に、日本語で答えてください。
"""

# パラメータ設定
PARAMETER temperature 0.7
PARAMETER top_p 0.9
---
パラメーターはよくわからず設定している。この辺りも理解できるようになりたいね…
Ollama に取り込み、起動
$ ollama create gemma4:e4b-uncensored -f ./Modelfile
$ ollama run gemma4:e4b-uncensored

参考資料
生成AIの出力を操る「temperature / topP / topK」完全ガイド(直感→仕組み→実務設定まで)
https://qiita.com/softbase/items/20c372b1e07873bae2b7

グーグルのオフィシャルではGemma4は temperature=1.0, top_p=0.95, top_k=64 を推奨しているらしい。

2026年8月25日火曜日

FF14日記 ~ 今週の出来事

Belias シロガネ 24-30 のスタジオをお借りしました!

◆ 新生祭
新生祭は8/27から。紅蓮祭は8/26までなのでイベント見てない方はご注意を。
https://jp.finalfantasyxiv.com/lodestone/special/2026/The_Rising/cula62e5jx

◆ 南征編
500人蘇生のアチーブメント狙いで久しぶりに南征編のマップに行きました。驚いたのは、そこそこ人がいてCEでめちゃくちゃ床ペロしてる人が多いこと。500人まで130人くらい足りなかったので何回か通うことになると思ってたんだけど、なんと1回で終わった。今は北征編マップで蘇生して回ってます。まだ100人くらい。

◆ リテイナー
リテイナーのジョブをチェンジしました。Lv1からやり直しです。はたして白銀までに100に到達できるだろうか?

リテイナーは前のメインジョブだった召喚つながりで巴術士Lv100でした。召喚士の頃は装備のお下がりを渡すことができていましたが、今はメインが忍者なので、わざわざキャスターの装備を調達しないといけません。お下がりが渡せるようにジョブチェンジしました。白銀で戦闘が大きく変わるため、忍者から変わるかもしれないけど…。

最初は探索に行かせてLv10からは、ほりだしもの依頼に行ってもらっています。前はクラスのまま放置してたけど、今回はLv30になったらちゃんと忍者に変えてみようと思います。

2026年8月19日水曜日

ComfyUI その後

これまでComfyUIをインストールし、チェックポイント配置し、ノード設定を行って、画像が生成できるところまで進めました。今回はテキスト生成AIのOllamaをインストールしてみようと思います。

$ curl -fsSL https://ollama.com/install.sh | sh
$ ollama run qwen2.5:7b

プロンプトが表示されるので、下記のような指示を出します。

あなたへの指示:
あなたは画像生成AI(SDXL / FLUX.1)のための優秀なプロンプトエンジニアです。
私が日本語で「描きたいイメージ」を伝えたら、それを元に高画質な画像を生成するための英語プロンプトを作成してください。

出力フォーマット:
1. Positive Prompt (英語文体・またはカンマ区切り)
2. Negative Prompt (英語文体・またはカンマ区切り、簡潔に)
3. 日本語の訳・情景解説

その後、描きたい絵を日本語で入力します。

>>> 夏の昼下がりにひまわりを持って微笑んでいる女性

### 1. Positive Prompt
a female holding a sunflower with a smile in the middle of a summer afternoon

### 2. Negative Prompt
unnatural poses, distorted face, extra limbs, low resolution, bad anatomy, extra fingers, wrong number of fingers

### 3. 日本語の訳・情景解説
夏の昼下がり、明るい太陽の光の中で、ひまわりを持って微笑んでいる女性を描きたいです。背景は
太陽の光が差し込む明るいシーンで、ひまわりはその女性の手にしっかりと持たれており、微笑んだ
表情が特徴的です。全体的に優しく、明るい雰囲気を伝える絵になります。

出力されたプロンプトをComfyUIに入力すると、それっぽいイメージの絵が生成されます。
そこから更に自キャラの特徴を入れていくと
はい!かわいい!というわけで2年前と同じ感じで作ってみました。

次はUbuntu 28.04がでたあたりで、また画像生成AIを試して進化の度合いを確かめたいと思います。