Nano Banana 2.1を78枚で比較!キャラ・漫画・日本語・料金から考える創作での選び方

Nano Banana 2.1を78枚で比較。キャラ・漫画・文字・料金から創作での選び方を解説する、ざすことジェネコのアイキャッチ。
  • URLをコピーしました!
ジェネコ

顔がかわいく描けたら採用したくなるジェネ。でも漫画のコマが増えていたら、話のテンポまで変わるジェネな?

ざすこ

そうそう、絵が気に入ることと、頼んだ内容が合っていることは別なんだよね。今回は大きな作例を見ながら、その違いを一緒に確かめていきましょう!

目次

まず結論:2.1は有力な候補。使う場面ごとに得意・不得意を確認しましょう

Nano Banana 2.1は、Googleの画像生成AIです。文章から絵を作るほか、キャラの画像を渡して別の場面を描かせたり、作った画像へ修正を頼んだりできます。

今回知りたかったのは「新しい2.1なら、自分たちのキャラや漫画を、以前より作りやすくなるのか?」です。そこでHiggsfieldという画像生成サービスで、旧Nano Banana 2、Nano Banana 2.1、GPT Image 2.5を比較しました。

分かったことは次の3点です。

  • キャラのいる場面は作れます。 ただし、同じ顔でも持ち物や配置が間違うことがあります。
  • 難しい6コマ漫画では、今回のGPTが指定に合いました。 Nano系は絵を描けても6コマが8コマに増えました。
  • Googleの公式APIでは1K・2Kの画像出力料金が約半額になりました。 今回使ったHiggsfieldのクレジットは、2.1と旧2が同じ見積もりです。

以下では「何を頼んだか」「どこを見るか」「何が分かったか」を一組にして紹介します。2026年10月8日時点の記録です。

そもそも、Nano Banana 2.1は何が進化したの?

たとえば「このキャラの服を保ったまま、カフェにいる絵にして」「この商品の背景だけ変えて」と頼む場面を思い浮かべてください。作りたい絵に近づけるには、きれいな絵を描くだけでなく、元のキャラや商品を保ち、指示された部分を変える必要があります。

Googleは2.1について、見た目の品質、指示を守る力、会話で修正を重ねたときのキャラの維持、画像内の文字などの改善を説明しています。つまり、創作のやり直しを減らせそうな方向の進化です。ただし、実際にやり直しの回数が減るかは、自分の用途で試す必要があります。Googleのモデル仕様

Nano Banana Proという別モデルもありますが、今回の旧モデル比較はNano Banana 2です。Proとの比較結果ではありません。

比較画像の読み方:同じ題材を、同じ順で見ます

各作例は 2.1 → 旧2 → GPT Image 2.5 の順で、一枚ずつ大きく掲載します。画像を押すと拡大表示できます。元の生成内容は変えず、ブログ掲載用に長辺2400画素へ縮小・JPEG化しています。小さな図解だけでは見えにくいコマや台詞も、別冊PDFと合わせて確認してください。

78枚は「78回の三者対決」という意味ではありません。基本比較24枚は二者、高難度36枚と漫画18枚は三者です。同じ題材・モデルを2回ずつ試しました。この記事では違いが伝わる回を示し、別の回の結果も文章で補います。

2.1は考える量を選ぶ設定がmedium、GPTは画質設定がhighです。この2つは同じ種類のつまみではありません。全条件を完全に同一にした性能ランキングではなく、このサービス・設定で、制作上どんな違いが出たかを見る比較です。詳しい設定と実際の指示全文は末尾にまとめます。

キャラ比較:同じ4人を、3つの場面に描ける?

頼んだこと: 4人のキャラ資料を渡し、正面・側面・背面の3コマに、同じ4人を描いてもらいました。

見る場所: まず区切りを数えて3コマあるか。次に各コマに4人いるか。最後に髪・服・持ち物が変わっていないかを見てください。「似たキャラが描けた」だけでは、連続する場面にそのまま使えるとは限りません。

Nano Banana 2.1・第2回

Nano Banana 2.1 C02 第2回の未修正原出力
生成内容は未修正。掲載用に縮小・圧縮。画像を押すと拡大表示。Higgsfield経由・2K指定。

旧Nano Banana 2指定・第2回

旧Nano Banana 2指定 C02 第2回の未修正原出力
生成内容は未修正。掲載用に縮小・圧縮。画像を押すと拡大表示。Higgsfield経由・2K指定。

GPT Image 2.5 Sunburst・第2回

GPT Image 2.5 Sunburst C02 第2回の未修正原出力
生成内容は未修正。掲載用に縮小・圧縮。画像を押すと拡大表示。Higgsfield経由・2K指定。

今回の結果: 2.1とGPTは、2回とも3コマに4人ずつ、合計12体の描写を保ちました。上の旧2の第2回は4コマに増え、最後のコマにざすこが2人います。合計は17体です。なお、旧2の第1回は3コマ・12体でした。旧2では必ず増えるという意味ではありません。

創作ではどう使う? 立ち絵から「別の向き」「別の場面」の候補を作る用途では、2.1を試す価値があります。ただし、人数が合ったら完成ではありません。別の回では、2.1にも青い箱が別の人の手へ移る問題がありました。キャラの見た目、人数、持ち物を別々に点検しましょう。長編全体の同一性を確かめた試験ではありません。

実写比較:水滴やガラスはどう見える?

頼んだこと: ガラス、金属、果実を含む商品写真風の画像を作りました。

見る場所: ガラスのふち、水滴、金属に映った周りの様子を比べてみてください。写真らしい質感の好みが分かります。次に、指定した材料の個数も確認します。

Nano Banana 2.1・第1回

Nano Banana 2.1 R02 第1回の未修正原出力
生成内容は未修正。掲載用に縮小・圧縮。画像を押すと拡大表示。Higgsfield経由・2K指定。

旧Nano Banana 2指定・第1回

旧Nano Banana 2指定 R02 第1回の未修正原出力
生成内容は未修正。掲載用に縮小・圧縮。画像を押すと拡大表示。Higgsfield経由・2K指定。

GPT Image 2.5 Sunburst・第1回

GPT Image 2.5 Sunburst R02 第1回の未修正原出力
生成内容は未修正。掲載用に縮小・圧縮。画像を押すと拡大表示。Higgsfield経由・2K指定。

今回の結果: Nano系は滑らかで整理された商品写真の印象、GPTは細かな水滴や周囲の映り込みが目立ちました。これは今回の画像を見た制作者の印象です。写真としての正確さを点数で測った結果ではありません。

2.1のこの回では、ミント3枚の指定に4枚が描かれました。別の苺を使った題材でも、3個の指定が4個になった回があります。広告用なら、つやがきれいという理由だけで採用せず、材料と数量も照合してください。透明な物の奥に隠れた数は、見えないだけの可能性があるため、勝手に誤りと判定しません。

日本語比較:パッと読めても、原稿どおりとは限りません

頼んだこと: 4つの区画がある図解を作り、指定した日本語の長文を入れてもらいました。

見る場所: 全体の見やすさを見たあと、本文の言葉を読みます。2.1の「増やり」という箇所に注目してください。元原稿は「増やすより」です。

Nano Banana 2.1・第1回

Nano Banana 2.1 D01 第1回の未修正原出力
生成内容は未修正。掲載用に縮小・圧縮。画像を押すと拡大表示。Higgsfield経由・2K指定。

旧Nano Banana 2指定・第1回

旧Nano Banana 2指定 D01 第1回の未修正原出力
生成内容は未修正。掲載用に縮小・圧縮。画像を押すと拡大表示。Higgsfield経由・2K指定。

GPT Image 2.5 Sunburst・第1回

GPT Image 2.5 Sunburst D01 第1回の未修正原出力
生成内容は未修正。掲載用に縮小・圧縮。画像を押すと拡大表示。Higgsfield経由・2K指定。

今回の結果: 3モデルとも大きな図解の形は作れました。一方、2.1の第1回で「増やすより」が「増やり」になりました。旧2とGPTでは、その箇所の語は保たれていました。ただし、全画像の全ての文字について「誤字ゼロ」を証明したわけではありません。

創作ではどう使う? 説明図のラフや見出しの配置を考える用途には使えます。公開する説明資料なら、本文を原稿と一字ずつ照らし合わせるか、文字を後から自分で配置すると確認しやすくなります。「文字がある程度読める」と「文章を正確にコピーできる」を分けて考えましょう。

漫画比較①:短い4コマのオチは、3モデルとも描けた

頼んだこと: ざすこが「箱を一個」と頼むのに、ジェネコが三個作り、積んで一個と言い張る4コマです。台詞と各コマの出来事はこちらで指定しました。

見る場所: 箱の変化と最後のオチが絵で伝わるか。次に、台詞が横書きか、同じ台詞が重複していないかを見てください。

Nano Banana 2.1・第1回

Nano Banana 2.1 M01 第1回の未修正原出力
生成内容は未修正。掲載用に縮小・圧縮。画像を押すと拡大表示。Higgsfield経由・2K指定。

旧Nano Banana 2指定・第1回

旧Nano Banana 2指定 M01 第1回の未修正原出力
生成内容は未修正。掲載用に縮小・圧縮。画像を押すと拡大表示。Higgsfield経由・2K指定。

GPT Image 2.5 Sunburst・第1回

GPT Image 2.5 Sunburst M01 第1回の未修正原出力
生成内容は未修正。掲載用に縮小・圧縮。画像を押すと拡大表示。Higgsfield経由・2K指定。

今回の結果: 3モデルとも2回ずつ、4コマと箱を積むオチは成立しました。上の旧2では「えっ!?」が重複し、Nano系の台詞は縦書き、GPTは指定した横書きでした。

創作ではどう使う? ブログの短い説明漫画なら、3モデルとも候補です。漫画のアイデアや脚本をAIが自力で考えた試験ではなく、こちらの脚本をどう絵にできるかを比べています。

漫画比較②:同じ「6コマ」でも、守りたい条件で差が出る

まず、ジェネコが箱を投げ、ざすこがトレーで受ける白黒漫画です。動きが続いて見えるかと、カラーが混ざっていないかを別々に見ます。

Nano Banana 2.1・第1回

Nano Banana 2.1 M02 第1回の未修正原出力
生成内容は未修正。掲載用に縮小・圧縮。画像を押すと拡大表示。Higgsfield経由・2K指定。

旧Nano Banana 2指定・第1回

旧Nano Banana 2指定 M02 第1回の未修正原出力
生成内容は未修正。掲載用に縮小・圧縮。画像を押すと拡大表示。Higgsfield経由・2K指定。

GPT Image 2.5 Sunburst・第1回

GPT Image 2.5 Sunburst M02 第1回の未修正原出力
生成内容は未修正。掲載用に縮小・圧縮。画像を押すと拡大表示。Higgsfield経由・2K指定。

今回の結果: 3モデルとも投げる→受ける展開を描けました。しかし2.1は2回とも黄色い目が残り、完全な白黒にはなりませんでした。旧2は2回のうち1回、GPTは2回とも白黒になりました。動作を描けることと、白黒指定を守ることは別です。

次は、もっと難しい6コマです。4人を毎コマに登場させ、青い箱を ジェネコ→ライト→バナクマ→ジェネコ と順番に渡してもらいました。

見る場所: 最初にページ全体のコマ数を数えます。次に箱を持つ人と、台詞の吹き出しが指している人を追ってみてください。

Nano Banana 2.1・第1回

Nano Banana 2.1 M03 第1回の未修正原出力
生成内容は未修正。掲載用に縮小・圧縮。画像を押すと拡大表示。Higgsfield経由・2K指定。

旧Nano Banana 2指定・第1回

旧Nano Banana 2指定 M03 第1回の未修正原出力
生成内容は未修正。掲載用に縮小・圧縮。画像を押すと拡大表示。Higgsfield経由・2K指定。

GPT Image 2.5 Sunburst・第1回

GPT Image 2.5 Sunburst M03 第1回の未修正原出力
生成内容は未修正。掲載用に縮小・圧縮。画像を押すと拡大表示。Higgsfield経由・2K指定。

今回の結果: 2.1と旧2は、2回とも6コマの指定が8コマに増えました。今回のGPTは2回とも6コマを守り、箱を渡す順序と主要な台詞の話者も維持しました。

なぜ大事? 6コマで説明を終える予定が8コマになると、掲載スペースや読むテンポが変わります。手順の順番が変わると、読者へ伝える内容まで違ってしまいます。今回のような「誰が何をするか」が細かい漫画なら、GPTを先に試す理由があります。全ての漫画でGPTが勝つ、細部まで完全、という意味ではありません。

料金:安くなったのはGoogle API。使うサイトの料金も確認しましょう

料金は2つの財布に分けると分かりやすくなります。

①GoogleのAPI料金。 APIは、アプリからGoogleの生成機能を呼び出す仕組みです。Standardという通常の料金区分で、画像出力部分の金額は次のとおりです。1K・2K・4Kは画像サイズの区分で、数字が大きいほど細かい部分を多く描けます。

画像サイズ 旧Nano Banana 2 Nano Banana 2.1
1K 約$0.067 $0.0336
2K 約$0.101 $0.0504
4K 約$0.151 約$0.113

たとえば2Kの画像を100枚出力すると、画像出力部分は旧2が約$10.10、2.1が$5.04です。その部分は約半額になります。参照画像や文章を渡す費用、考える処理、検索、税などは別なので、仕事全体の請求が必ず半額になるわけではありません。4Kも半額ではありません。Google公式料金表

②Higgsfieldなどのサービス料金。 今回の2Kの見積もりは、2.1と旧2が1枚2クレジット、GPTが2.75クレジットでした。100枚なら200・200・275クレジット相当です。クレジットはそのサイトの利用ポイントなので、米ドルのAPI料金と足したり、同じものと考えたりしません。実際の請求明細との照合は未実施です。

安い1枚を選ぶだけでなく、何回作り直す必要があるかも考えたいところです。ただし今回、再生成や修正の総時間・採用率を測っていないため、「どれが仕事全体で最安か」は分かりません。

どこから使うとよい?

  • まず会話で試したい: Geminiが入口です。自分の画面に表示されるモデルと利用条件を確認します。
  • モデル名や設定を確かめたい: Google AI StudioやGemini APIを確認します。アプリへ組み込む人にも向いている入口です。
  • 複数モデルを同じ場所で比べたい: 今回利用したHiggsfieldが候補です。サイト独自の料金・設定・データ利用条件を見ます。
  • Flowを使っている: 公式ヘルプに2.1の記載を確認しました。今回の検証はFlowで行ったものではありません。

提供モデルや利用条件は、地域・アカウント・プランでも変わります。今後ほかの資料制作ツールなどへ搭載される可能性はありますが、導入時期を確かめたわけではありません。予定として紹介せず、発表された時点で確認します。

まとめ:自分の作品で「困る条件」を一つ試してみましょう

今回の比較では、2.1にキャラ構成を保てる作例がありました。一方、長い日本語の脱落や数量違い、難しい漫画のコマ増加も見られました。絵の好みと、作品に必要な条件を分けると選びやすくなります。

まずは「このキャラは青い箱を持つ」「4コマで終える」「本文を原稿どおりに入れる」など、失敗すると困る条件を一つ入れて、同じモデルで複数回試してみてください。成功例だけでなく、失敗した元画像も残しましょう。

ジェネコ

かわいさ審査のあとに、持ち物検査もあるジェネ。ワガハイの箱、勝手に増やさないでもらいたいジェネ!

ざすこ

そうそう、使いたい作品の条件が先だね。皆さんも、必要な条件を決めてから、自分に合うモデルを選んでみてください!

詳しい条件と出典

各題材・各モデル2回。同じ題材では指示全文と参照順を共通にしています。乱数は固定していません。2K指定でもNano出力とGPT出力の実際の画素数は異なりました。旧2はHiggsfieldでnano_banana_2を指定し、nano_banana_flashという名前で返却されました。内部モデル版を独立に確認できていません。GPTは同サービスのSunburst/highです。速度の統一測定や、会話を重ねる編集・長編でのキャラ維持は試していません。

C02 第2回:実際に使った指示全文(英語)

参照順:zasuko → geneko → banakuma → light。モデル別設定は本文末尾の条件を参照。

Generate a single finished image, 6500K neutral daylight/white balance, crisp smooth rendering without grain or sepia. Do not add watermarks or text unless explicitly specified. Using the four character sheets in supplied order (Zasuko, Geneko, Banakuma, Light), draw one coherent three-panel storyboard: exactly three equal vertical panels in a horizontal row with clean white gutters, no text or panel numbers. Each panel contains exactly the same FOUR characters, one of each per panel, in the same bright white workshop. Do not import miniature scale-comparison figures from the sheets. Preserve every character's costume, hairstyle, glasses, headphones, accessories, proportions, colors and tail designs across all three panels. Geneko is always the small upright two-legged purple round-headed fairy with yellow-rimmed eyes, rectangular glitch marks, one striped tail, no nose and no protruding muzzle. In panel 1 the group faces the camera: Zasuko left holding a red notebook, Geneko near her knee holding a blue cube, Light on the right wearing the black backpack and holding a yellow mug, Banakuma far right holding a green tablet. In panel 2 show the SAME group from a three-quarter SIDE camera angle as Zasuko leans forward to inspect Geneko's blue cube; keep the original prop assignments and plausible hands, without extra arms. In panel 3 show the SAME group from a three-quarter BACK angle walking toward one blank doorway; preserve the back designs, backpack, both tails, and Zasuko's blouse/skirt/boots. Geneko's tail must not become Light's cable tail. Banakuma retains the shirt design from the reference. The group count is four per panel, twelve depictions across the page, with no duplicates inside a panel.
R02 第1回:実際に使った指示全文(英語)

参照順:参照なし。モデル別設定は本文末尾の条件を参照。

Generate a single finished image, 6500K neutral daylight/white balance, crisp smooth rendering without grain or sepia. Do not add watermarks or text unless explicitly specified. Create one ultra-photorealistic close-up product photograph on a white marble kitchen island, shot with a natural 85mm lens and neutral white studio daylight. Foreground: exactly one crystal-clear drinking glass filled halfway with water and exactly TWO square ice cubes; one stainless-steel teaspoon is partly submerged, its shaft refracted through the water and its upper handle extending to viewer right. Condensation droplets adhere to the OUTSIDE of the glass. Immediately behind it, one polished chrome teapot with a coherent single reflection of the glass, not a second real glass. On viewer left, one matte white plate holds exactly FIVE ripe strawberries and exactly THREE small mint leaves. On viewer right, one transparent glass bowl contains exactly SIX whole blueberries. Realistic waterline, refraction, reflections, contact shadows, steel highlights, strawberry seeds, blueberry bloom and marble microtexture. All requested objects remain distinguishable in the depth of field. One continuous tabletop, no duplicate containers, no floating ice, no extra fruit, no text. The teapot and spoon reflections must follow one coherent camera viewpoint.
D01 第1回:実際に使った指示全文(英語)

参照順:参照なし。モデル別設定は本文末尾の条件を参照。

Generate a single finished image, 6500K neutral daylight/white balance, crisp smooth rendering without grain or sepia. Do not add watermarks or text unless explicitly specified. Create a publication-ready Japanese explainer slide on a pure white canvas with teal, pink and violet accents. Exact title 「画像を直す前のチェックガイド」 and exact subtitle 「元画像を保ち、変更点を確かめる」. Exactly four balanced content panels in a 2x2 layout, each with one small relevant icon and the following EXACT heading and paragraph. Reproduce ALL Japanese text verbatim, no summaries, paraphrases, replacements or omissions; automatic line wrapping is allowed. Keep every paragraph readable rather than enormous icons. Panel text:
Panel 1 heading: 1 素材をそろえる
Paragraph: 画像は、顔・衣装・小物の特徴が確認できるものを選びます。正面だけで分からない形は側面や背面を補い、使う権利のある素材だけを用意します。似た画像を増やすより、役割の違う参照を整理することが大切です。
Panel 2 heading: 2 変更点を絞る
Paragraph: 指示には、変える部分と残す部分を分けて書きます。背景だけを変える場合は、顔・髪型・服装・持ち物を保つことも明記します。一度に多くを直すと原因を追いにくいため、小さな変更から試します。
Panel 3 heading: 3 結果を点検する
Paragraph: 見た目がきれいでも、文字の抜け、左右の反転、人数や物の数の違いがないか確認します。手や足、眼鏡、髪飾りなども拡大して見ます。元画像と並べ、指定していない場所まで変わっていないか点検します。
Panel 4 heading: 4 記録して残す
Paragraph: 採用した画像だけでなく、入力素材・指示・モデル名・設定・作成日も記録します。修正版は別名で保存し、元画像を上書きしません。比較を紹介するときは、試した回数と条件、失敗した例も一緒に示します。
Exact bottom footnote 「比較用の文章です。実在サービスの操作画面ではありません。」. No other text. Each panel heading and paragraph must appear once, with no duplicated section. At 2K output make body text large enough to read when zoomed, align baselines, and maintain generous paragraph spacing.
M01 第1回:実際に使った指示全文(英語)

参照順:zasuko → geneko。モデル別設定は本文末尾の条件を参照。

Create ONE finished Japanese manga page, 3:4 portrait, 2K. 6500K neutral white balance, smooth clean paint and ink, no grain, particle noise, sepia, watermark or signature. Use supplied reference sheets ONLY for character identity, not sheet layout, labels, example silhouettes or backgrounds. Maintain identities across all panels, without extra characters or duplicate heads/limbs/tails. Zasuko is the adult anime woman with brown-green bob and cowlick, violet eyes, blue glasses, white flower on HER left, white sleeveless blouse, dark green bow/skirt and brown ankle boots. Geneko is the small purple TWO-LEGGED cat-noise fairy with yellow-rimmed dark eyes, rectangular cyan/pink/yellow glitch markings, exactly one striped tail, absolutely NO NOSE or protruding muzzle. Never substitute the realistic quadruped cat form. Japanese dialogue must be exact, legible, in clear white speech balloons with tails anchored to the actual speaker. Do not paraphrase, omit, duplicate or transfer dialogue. Use horizontal Japanese text inside balloons to reduce transcription ambiguity. No panel numbers, captions, page title or extra written words, except the explicitly specified speech and sound effects. Faces must express the beats; camera angle and shot size should vary naturally while preserving staging. Input 1 Zasuko, input 2 Geneko. Full-color comedy FOUR-KOMA with exactly FOUR equal-width rectangular panels vertically stacked, read top to bottom. Bright small workshop, one continuous white table. Panel 1: medium two-shot, Zasuko at viewer left holding her closed RED notebook; Geneko at right confidently poses with empty paws; NO blue boxes yet. Zasuko balloon:「青い箱を一個だけお願い。」 Geneko balloon:「任せるジェネ!」 Panel 2: closer shot of Geneko alone making exactly ONE BLUE CUBE appear above the table; one small sound effect「ポン」; Geneko balloon:「一個、ぴったりジェネ!」 Panel 3: wider reveal of exactly THREE separate blue cubes on the same table; Zasuko gives a flat incredulous expression, Geneko shocked with raised paws. Zasuko balloon:「三個あるんだけど?」 Geneko balloon:「えっ!?」 Panel 4: Geneko has stacked those same THREE cubes into ONE vertical tower, all three individual cubes clearly visible and countable, no spare cube; Geneko points proudly at the tower. Zasuko looks unimpressed. Geneko balloon:「まとめれば一個ジェネ!」 Zasuko balloon:「それは三個。」 Keep the punchline clear and the bubble order within each panel natural. No decorative cutaway panels.
M02 第1回:実際に使った指示全文(英語)

参照順:zasuko → geneko。モデル別設定は本文末尾の条件を参照。

Create ONE finished Japanese manga page, 3:4 portrait, 2K. 6500K neutral white balance, smooth clean paint and ink, no grain, particle noise, sepia, watermark or signature. Use supplied reference sheets ONLY for character identity, not sheet layout, labels, example silhouettes or backgrounds. Maintain identities across all panels, without extra characters or duplicate heads/limbs/tails. Zasuko is the adult anime woman with brown-green bob and cowlick, violet eyes, blue glasses, white flower on HER left, white sleeveless blouse, dark green bow/skirt and brown ankle boots. Geneko is the small purple TWO-LEGGED cat-noise fairy with yellow-rimmed dark eyes, rectangular cyan/pink/yellow glitch markings, exactly one striped tail, absolutely NO NOSE or protruding muzzle. Never substitute the realistic quadruped cat form. Japanese dialogue must be exact, legible, in clear white speech balloons with tails anchored to the actual speaker. Do not paraphrase, omit, duplicate or transfer dialogue. Use horizontal Japanese text inside balloons to reduce transcription ambiguity. No panel numbers, captions, page title or extra written words, except the explicitly specified speech and sound effects. Faces must express the beats; camera angle and shot size should vary naturally while preserving staging. Input 1 Zasuko, input 2 Geneko. BLACK-AND-WHITE Japanese action-comedy manga; grayscale rendering of reference colors is intentional. Clean solid black ink and smooth grayscale, NO stippled screentone or grain. Exactly SIX panels in THREE rows and TWO columns, with Japanese RIGHT-TO-LEFT order: top-right then top-left, middle-right then middle-left, bottom-right then bottom-left. Same workshop, no furniture obstructing action. Exactly ONE cube exists in each panel, medium gray in this monochrome page; never multiple motion-ghost cubes. Zasuko holds one shallow tray with two hands; no notebook in this story. P1 TOP-RIGHT: medium two-shot; Zasuko viewer left with EMPTY tray at waist height, Geneko right holding ONE cube in both paws. Only Zasuko says「落とさないでね。」 P2 TOP-LEFT: Geneko close-up bends knees to prepare throwing the cube, still holds ONE cube; says「余裕ジェネ!」 P3 MIDDLE-RIGHT: low-angle dynamic shot, Geneko has released ONE cube upward, both paws empty and extended; cube clearly separate in midair, motion lines; says「ぽいっ!」 P4 MIDDLE-LEFT: high-angle shot, Zasuko rushes to position EMPTY tray beneath that ONE falling cube; Geneko may be outside this crop; Zasuko says「高すぎる!」 P5 BOTTOM-RIGHT: the ONE cube has LANDED INSIDE the tray Zasuko holds; Geneko relieved, no airborne cube. Only Zasuko says「セーフ!」 P6 BOTTOM-LEFT: medium two-shot, same ONE cube remains in the tray; Geneko points proudly but visible paws tremble with simple motion lines; Geneko says「計算どおりジェネ!」 Zasuko replies「震えてるよ。」 Do not write any sound effects beyond these exact dialogue lines. Maintain the trajectory and landing causality, not six unrelated illustrations.
M03 第1回:実際に使った指示全文(英語)

参照順:zasuko → geneko → banakuma → light。モデル別設定は本文末尾の条件を参照。

Create ONE finished Japanese manga page, 3:4 portrait, 2K. 6500K neutral white balance, smooth clean paint and ink, no grain, particle noise, sepia, watermark or signature. Use supplied reference sheets ONLY for character identity, not sheet layout, labels, example silhouettes or backgrounds. Maintain identities across all panels, without extra characters or duplicate heads/limbs/tails. Zasuko is the adult anime woman with brown-green bob and cowlick, violet eyes, blue glasses, white flower on HER left, white sleeveless blouse, dark green bow/skirt and brown ankle boots. Geneko is the small purple TWO-LEGGED cat-noise fairy with yellow-rimmed dark eyes, rectangular cyan/pink/yellow glitch markings, exactly one striped tail, absolutely NO NOSE or protruding muzzle. Never substitute the realistic quadruped cat form. Japanese dialogue must be exact, legible, in clear white speech balloons with tails anchored to the actual speaker. Do not paraphrase, omit, duplicate or transfer dialogue. Use horizontal Japanese text inside balloons to reduce transcription ambiguity. No panel numbers, captions, page title or extra written words, except the explicitly specified speech and sound effects. Faces must express the beats; camera angle and shot size should vary naturally while preserving staging. Input1 Zasuko, input2 Geneko, input3 Banakuma, input4 Light. Full-color ensemble manga, exactly SIX rectangular panels in THREE rows TWO columns, Japanese RIGHT-TO-LEFT order. EVERY panel shows exactly these FOUR characters, no one missing or duplicated. Light is the boy with black hair, teal mouse-ear headphones, spiral glasses, teal hoodie, dark shorts, teal-white sneakers, black backpack and exactly ONE cable tail with connector. Banakuma is the big brown bear with sunglasses, yellow BananaCanvas graphic shirt and brown trousers. Stable left-to-right staging inside all panels: Zasuko, Geneko, Light, Banakuma, around one waist-high white table; small changes of camera are allowed but never reorder or swap identities. Zasuko keeps a CLOSED RED notebook against her chest in all six panels. Light has placed his ONE YELLOW mug on the table in front of him; mug stays there in all panels. Banakuma keeps ONE GREEN tablet tucked under his left arm in all six panels. There is exactly ONE BLUE CUBE in each panel. P1 TOP-RIGHT: Geneko holds cube with both paws, everyone attentive. Zasuko says「青い箱を順番に渡して。」 Geneko says「まずワガハイからジェネ!」 P2 TOP-LEFT: Geneko passes the SAME cube to Light, one cube between their hands, no second cube; Light receives with both hands. Geneko says「ライト、どうぞジェネ!」 Light says「受け取ったよ。」 P3 MIDDLE-RIGHT: Light passes the ONE cube to Banakuma, bear receives in free right paw while tablet stays under left arm. Light says「次はバナクマさん。」 Banakuma says「よし、預かった。」 P4 MIDDLE-LEFT: Banakuma reaches across the table to return the ONE cube to Geneko, cube in bear right paw, Geneko reaches with both paws. ONLY Banakuma says「ジェネコに返すぞ。」 P5 BOTTOM-RIGHT: Geneko now holds the returned ONE cube in both paws; others smile. ONLY Geneko says「戻ったジェネ!」 P6 BOTTOM-LEFT: Geneko still holds ONE cube, relieved tired expression; Zasuko smiles warmly. Zasuko says「一周できたね。」 Geneko says「箱より緊張したジェネ。」 Bubble tails must identify the correct speakers, especially boy versus bear versus fairy. Show the handoffs and actual changing ownership, not an identical group portrait repeated six times.

本稿の画像は制作者が保有するキャラ資料などで生成した出力です。元の内容は修正せず、掲載用に縮小・圧縮しています。性能の一般的な成功率や将来提供の保証ではありません。比較は2026年10月8日。公式の説明と今回の観察を分けて記載しました。説明用スライドの描画モデルは比較モデルと別です。

図解と大きな作例をPDFで読む

要点と使い分けを説明する本編13ページと、1ページに1作例を大きく載せる別冊18ページを用意しました。まず本編で見る場所をつかみ、別冊でコマや本文を拡大して確認してください。PDFも誌面への配置に伴う縮小・圧縮を行っています。

説明本編13ページ(約13MB) / 大きな作例集18ページ(約13MB)

広告・書籍のご案内

ざすこが実習パートを執筆!画像・動画生成AI スタートガイドの詳細をAmazonで見る
よかったらシェアしてください!
  • URLをコピーしました!
  • URLをコピーしました!

この記事を書いた人

zasuko 生成AI解説系 Vtuver

個人で Youtubeで生成系AIツールの解説動画を投稿しています。
創作活動をする方向けに私の学んだツールの活用方法などについて発信しつつ自主製作での、イラスト、動画、漫画、最終的にはゲーム開発などのコンテンツ制作を目指しています✨🌱✨

コメント

コメントする

目次