Mac miniとクラウドで画像生成AIを10種類比べてみた|全部満点はGPTだけ

当ページのリンクには広告が含まれています。
  • URLをコピーしました!

同じ指示文を10種類の画像生成AIに渡して、どこまで言ったとおりに描けるかを比べてみました。お題は4つ。夜の部屋、抽象画、海辺のピクニック、人物です。点数をつけた3つのお題で全部満点だったのは、GPT-5.4 Image 2 だけでした。

画像生成AIは増えすぎて、正直どれを使えばいいのか分からないんですよね。そこで、作業を手伝ってくれている Claude(Anthropic の AI)に段取りを組んでもらい、10種類を同じ条件で一気に回しました。かかったお金は、4回ぶん全部で約200円です。

もくじ

比べた10種類

まずは今回の顔ぶれです。値段はドル建てを1ドル150円で計算しました。

名前どこで動くか1枚の値段1枚にかかった時間
Claude文章のAIが図形を数字で書く追加料金なし―
Gemini WebGoogle のチャット画面追加料金なし約15秒
Draw Things自宅の Mac mini のアプリ0円約1分40秒
Gemini 3 Pro Imageクラウド(Google)約21円約18秒
Gemini 3.1 Flash Imageクラウド(Google)約10円約16秒
GPT-5.4 Image 2クラウド(OpenAI)約20円約79秒
FLUX.2-klein自宅の Mac mini0円約55秒
FLUX.1-dev自宅の Mac mini0円約10〜13分
Z-Image-Turbo自宅の Mac mini0円約3分半
Image PlaygroundMac に最初から入っているアップルのアプリ0円約2分

クラウドの3つは OpenRouter という窓口からまとめて呼んでいます。時間は夜の部屋の回で測った値です。自宅の Mac mini で動かしたものは電気代だけで済みます。

なお、Claude は画像生成AIではありません。円や線の位置を数字で書いたファイル(SVG という形式)を作り、それを画像に変えています。いわば「定規で描く人」が1人だけ混ざっている状態です。

ルールは「1回目に出てきた絵をそのまま載せる」にしました。引き直しをすると、AIの素の力ではなく私の粘り強さの比べっこになってしまうからです。

お題1:夜の部屋でレコードを聴く女性

夜の部屋でレコードを聴く女性:10種類の画像生成AIの比較

最初のお題は、ローファイ系のイラストでよく見る「夜の部屋で、窓の外の大きな月とビルの灯りを眺めながらレコードを聴く女性」です。色は青い夜の中に、暖かい色はランプとレコードのラベルだけ、と指定しました。

この回だけは、慣れるまで描き直しを許しています。Claude は3回描き直し、Gemini Web は1回だけ直す指示を出し、Draw Things は2回目の4枚から選びました。追加した7つは全部1回目です。

並べてみると、どれもぱっと見はよく描けています。その中で私の好みに合い、しかも破綻が少なかったのは Gemini 3 Pro と GPT-5.4 Image 2 の2枚でした。

1枚ずつ見ると、細かいところで差が出ます。

  • Claude:10種類の中でいちばん絵に向いていないやり方ですが、このお題なら十分よいイラストになっています。
  • Gemini Web:雰囲気がよく、このまま挿絵に使えそうです。
  • Draw Things:サイバーなヘッドホンがかっこいいです。ただ、レコードが無造作に置かれています。
  • Gemini 3.1 Flash:この雰囲気も好きです。
  • GPT-5.4 Image 2:よく描けていますが、プレーヤー本体と蓋(ダストカバー)の大きさが合っていません。
  • FLUX.2-klein:絵柄がいいです。ただ、プレーヤーに蓋がありません。
  • FLUX.1-dev:落ち着いた雰囲気がいいです。蓋が光っているのは減点です。
  • Z-Image-Turbo:雰囲気も絵柄も好きです。蓋が1枚ガラスになっています。
  • Image Playground:雰囲気はいいのに、顔がアメリカンなんです。Apple 製品だからでしょうか。

こうして書き出してみると、レコードプレーヤーの蓋への指摘が4枚もありました。蓋が無い、光っている、大きさが合わない、ただのガラス板。雰囲気はどれもいいのに、つまずくのは小物の形のほうなんですね。

指示と見比べると、空気感がいちばん濃かったのは GPT-5.4 Image 2 でした。ただし女の子が目を閉じていて、「眺める」が「目を閉じて浸る」に変わっています。指示にいちばん忠実だったのは Z-Image-Turbo です。大きな満月と青い街、暖色はランプとラベルだけ、という所までほぼ守れていました。

面白かったのは、Gemini の仲間たちに共通の癖があったことです。Gemini 3 Pro も Gemini 3.1 Flash も、頼んでいない雨を降らせてきました。Flash は満月のはずが三日月です。Gemini Web の1枚目もまったく同じ「三日月と雨」だったので、Web 版の中身は Flash 系なんだろうと思っています。

FLUX.1-dev は1枚に13分かかって、ランプが消えていました(遅い…)。

お題2:抽象画(言ったとおりに描けるか)

抽象画のお題:10種類の画像生成AIの答え合わせ

夜の部屋は、比べても「こっちの方が好き」で終わってしまいました。そこで2回目は、誰が見ても○×がつけられる抽象画にしました。頼んだのはこれだけです。

  • 地は生成り色の和紙
  • 上のほう、少し右寄りに藍色の大きな円をひとつ。縁だけにじませる
  • 朱色の細い直線を1本、左下から右上へ。円には触れない
  • 下のほうに、抹茶色と栗色の筆の跡を横向きに3本。互いに重ならない
  • 使う色はこの5色だけ

赤い輪が、指示を破ったところです。6つの約束を全部守れたのは Claude と GPT-5.4 Image 2 でした。Claude は円の中心から線までの距離を計算してから書き出すので、配置の約束ではかなり有利なんです。その代わり筆の跡は右端が四角く切れていて、質感は10枚の中でいちばん機械的でした。

いちばん多かった失敗は、線が円を突き抜けることです。Gemini 3 Pro、FLUX.2-klein、Image Playground の3つがこれでした。「触れない」のような「〜しない」という約束は、どうも守りにくいようです。

いちばん派手に外したのは Draw Things です。筆の跡のつもりで渡した「brush stroke」という言葉を絵筆そのものだと受け取って、画面の真ん中に筆を1本描いてきました(汗)。4回描かせて4回とも同じだったので、たまたまではなさそうです。

お題3:海辺のピクニック(描かないものを守れるか)

海辺のピクニックのお題:10種類の画像生成AIの答え合わせ

抽象画で「〜しない」が苦手そうだと分かったので、3回目はそこを正面から試しました。砂浜にスイカ2切れ、おにぎり2個、麦わら帽子1つ。そして「人・鳥・船・雲は描かない」です。

結果は意外で、クラウドの4つ(Gemini Web、Gemini 3 Pro、Flash、GPT-5.4 Image 2)は全員満点でした。Claude も満点です。破ったのは FLUX.1-dev、Z-Image-Turbo、Image Playground の3つで、全部 Mac の中で動くものです。FLUX.1-dev にいたっては、鳥も船も雲も全部描いてきました。

ただしクラウド組には、頼んでいない小物を足す癖があります。いちばん多かったのは Gemini 3.1 Flash で、醤油皿にお箸、巻きすにリボンまで並んでいました。「描かない」は守るけれど、「描いていいとは言っていない物」は描く、という感じです。

Draw Things は、おにぎりの海苔を伝えるために入れた「nori」という言葉が、絵の左下に署名のような文字で出てきました。読める単語を渡すと、そのまま文字として描かれることがあるんですね。

お題4:甲板で団子を差し出す女性(顔と手)

甲板で団子を差し出す女性:10種類の画像生成AIの点数比較

最後は、画像生成AIが苦手と言われる顔と手です。船の甲板で、30代前半の女性が団子の串を差し出している絵を頼みました。切れ長の目で片方の口角だけ上げる、羽織と前掛け、首から羅針盤、朱色は前掛けの紐だけ、という細かい指定つきです。

唯一の満点は GPT-5.4 Image 2 でした。腕をこちらへ伸ばして、団子が手前に飛び出してくる遠近まで描けています。Gemini 3 Pro と Image Playground も、ちゃんと手前へ差し出していました。

一方で Gemini Web と Flash は、目を閉じた大笑いで団子を顔の横に掲げています。かわいいんですが、「差し出す」になっていないんです。FLUX.1-dev は若いアニメ顔になり、団子が串から外れて手のひらに乗っていました。

このお題では、点数だけでは測れない差も見えました。Claude は4点で Gemini Web と同点なんですが、絵としての出来は10枚で最下位です。ポニーテールがアンテナのように立ち、手は箱のような形でした。定規で描く人に、人物は荷が重かったようです。

点数を忘れて、好みで見てみると

指示を守ったかどうかとは別に、自分の好みで10枚を見直してみました。並びは点数の高い順です。

  • GPT-5.4 Image 2:好みのテイストで、絵に勢いがあります。点数でも好みでも1位でした。
  • Gemini 3 Pro:みたらし団子の解像度が少し低いものの、よく描けています。
  • Image Playground:ディズニーっぽい立体の絵で、いかにも Apple らしい仕上がりです。立体的な絵が得意なのかもしれません。
  • Claude:そもそも画像生成AIではないので、見た目は諦めました。
  • Gemini Web:日本人好みの、かわいい雰囲気のイラストです。
  • Gemini 3.1 Flash:このタッチも好きです。Gemini はマルチモーダルのAIとして優秀だなと感じました。
  • Z-Image-Turbo:アニメっぽくて良い感じです。ただ、ここから下の順位は、みたらし団子が怪しくなってきます。
  • FLUX.2-klein:無料にしては良い出来です。ただ、みたらし団子は誰かに食べられたあとのようでした。
  • Draw Things:これも無料にしてはよく描けています。ただ、団子がみたらしではなく三色団子で、しかも色がバラバラでした。
  • FLUX.1-dev:アニメキャラっぽくてかわいいのに、肝心の団子が団子になっていません。

好みで見ても、上位はほとんど点数の順番どおりでした。それでも、無料で動くローカル組が「無料にしては」かなり健闘していたのは、点数だけでは見えなかったところです。

3つのお題の合計点

点数をつけた3回(抽象画6点・海辺6点・人物5点、満点17点)を足すと、こうなりました。

  • 1位 GPT-5.4 Image 2:17点(3回とも満点)
  • 2位 Claude:16点
  • 3位 Gemini Web、Gemini 3 Pro Image:15.5点
  • 5位 Gemini 3.1 Flash Image:14点
  • 6位 Image Playground:13点
  • 7位 FLUX.2-klein:12点
  • 8位 Z-Image-Turbo:11.5点
  • 9位 Draw Things:6.5点
  • 10位 FLUX.1-dev:4点

上位はクラウドがほぼ独占しています。Claude の2位は、絵がうまいからではなく、数と配置を間違えないからです。

自宅の Mac mini で動く組は0円ですが、点数ははっきり下がりました。Z-Image-Turbo は夜の部屋でいちばん忠実だったのに、抽象画では円が風船のようになって崩れています。お題によって波が大きいタイプですね。

りょう

迷ったら1枚20円の GPT-5.4 Image 2。タダで済ませたいなら Gemini Web でも十分戦えるよ

おまけ:Image Playground が2〜4秒で落ちる問題

Mac 純正の Image Playground は、途中で「新しい画像」を開いた直後に、アプリが勝手に終了するようになりました。ボタンを変えても、Mac を再起動しても、計7回すべて2〜4秒で落ちます。

原因は Claude の Fable 5 に調べてもらって突き止めました。ウインドウを画面いっぱいに広げていたのが悪かったんです。ウインドウを小さくしてから「新しい画像」を押すと、嘘のように落ちなくなります。同じ症状で困っている方は、まずウインドウの大きさを変えてみてください。

まとめ:値段より「お題との相性」

4回やってみて分かったのは、値段の高さと指示の守りやすさは、あまり一致しないということです。約21円の Gemini 3 Pro は抽象画で線が円を突き抜け、追加料金なしの Gemini Web はほぼ満点でした。

それでも、3回とも満点を取った GPT-5.4 Image 2 は別格でした。1枚約20円で80秒ほど待つ価値はあると思います。

とはいえ、普段使いは無料の Gemini Web か、Mac 純正の Image Playground にするつもりです。Gemini Web は無料組では合計15.5点といちばん高く、15秒ほどで描けます。気になるところがあっても、同じ会話で「ここだけ直して」と頼めば直してくれます。Image Playground は Mac に最初から入っていて、人物の回では4.5点と健闘しました。ちなみに、この記事のアイキャッチも Gemini Web で作っています。

このシリーズは、お題を変えて続けていく予定です。「このお題で比べてほしい」というものがあれば、ぜひ教えてください!

よかったらシェアしてね!
  • URLをコピーしました!

コメント

コメントする

CAPTCHA


もくじ