ClockRoom

Since April 2000

勝手気ままに楽しくつくる ClockRoom のウェブサイト

Contents - 目次

Topics - 最新情報

自分の絵柄をt2iでどこまで再現できるかループエンジニアリングで検証してみた結果

まず先に結論から ────

まだ結果は出てない。

以前からAI補助を話題にしてたけど、絵を描くことが目的でないなら、補助ではなくt2iで自分の絵柄を再現できるのが手っ取り早いわけで。 ところが、いざ自分の絵柄を凝視したところで客観的に言語化できない。 ずっとバイブドローイングしてたんだから、そりゃそうだ。 そして、言語化できなければt2iは叶わない。 なお、LoRA等は使わない方針。 というわけで、実現不能なので本件は終了。

まあ、終了するわけないよね。 これで終了してたら記事にしない(笑) 自分で客観的に言語化できないなら、それすらAIに任せてしまおう。 都合の良いことに、AI界隈には「ループエンジニアリング」という手法がある。 本来はエンジニアリングに用いる手法だけど、これを応用する。

生成・批評ループ

色々と試して時間とトークンを消耗して、ようやく今のところ「生成・批評ループ」に落ち着いた。 「生成係」タスクと「批評係」タスクを交互に動かして、自動的に自分の絵柄のプロンプトを構築していく・・・予定の仕組み。 最初に言ったとおり、まだ結論は出てない。 いかんせん、このループは時間がかかるのだ。 試行錯誤の末に得たこのループはコスパは良いけど、それでも1日8〜12回の試行が限度。

少しだけループの設計に触れておくと ────

生成係
役割: 批評係が生成したプロンプトで唯唯諾諾と画像生成する
使用モデル: GPT-5.6 Luna Low
設計基準: コスパ重視
批評係
役割: 生成係が生成した画像と自分の過去絵を比較・評価してプロンプトを生成する
使用モデル: GPT-5.6 Terra High
設計基準: 厳しさ重視

当初、全工程をひとつのタスクに入れてSol Midで実行してたけどダメだった。 自己評価させると、妙なところで人間臭く自画自賛して評価が狂う。 「第三者の批評家」を後付けしたけど、トークンを浪費しながら順調に悪化して中止。 そうして再設計したのが「生成・批評ループ」。

生成係には一切考える余地を与えず画像生成させるのがポイント。 なので、モデルと思考量は最安で十分。 その分、批評係にリソースを振って難しい課題をしっかり考えさせる。 それでもTerra Highで問題ない。 SolやAstraは感覚的な課題には不向きなようで、お呼びでない。

ちなみに、このループでは私が「第三者」となる。 私が口を挟む仕組みはあるけど、今のところ介入する余地なく、お呼びでない(^^;

others - その他