ログインする ユーザー登録する

026:Image Promptについて

今回はFramePackのお話はお休みして、FooocusのImage Promptについてです。

Fooocusのimage to imageの機能の中に、Image Promptというのがあります。これは画像をもとに、出力をコントロールするといったような機能です。ControlNetのFooocusでの実装、みたいなものだと思えばいいのだと思います。
今回は以下のテキストプロンプトをベースに、ImagePromptを試してみたいと思います。
=====
1girl, _, from _, blonde hair, medium hair, messy hair, twintails, big hair, black ribbon, blue eyes, tsurime, sanpaku, high neck no sleeve steampunk style leather jacket, Gear ornament, beret, short red skirt, pleated skirt, dancing head tilt, leg up, white background
=====

上記のテキストプロンプトで不通に出力した結果が2枚目の画像です。

さて、ではImage Promptを開いてみましょう。(3枚目)
いつものようにテキストプロンプトの入力欄の下の「Input image」をチェックして、出てくるタブのなかから「Image Prompt」を選択します。
そうすると4つのエリアが表示されます(画像ではその中の2つのエリアだけを表示)。
表示エリアの下に選択肢があって、「Image Prompt」、「PyraCanny」、「CPDS」、「FaceSwap」のどれかを指定できるようになっています。
今回は「Image Prompt」と「CPDS」を試してみます。

①CPDS

CPDSはいわゆるCannyと呼ばれている機能と同じようなポーズ適用効果のあるもののようです。FooocusにはPyraCannyというそのままの名前の機能もあるのですが、今回試した感じ、CPDSのほうがいい結果が得られたのでこちらを紹介しておきます。
指定したのは4枚目の画像で、キャラクターがダンスしている感じのポーズです。
これを5枚目のようにして、画像エリアにドラッグ&ドロップするとセットできます。
この状態で出力した結果が6枚目です。テキストプロンプトだけだと右脚が上がっている感じでしたが、CPDSを使った結果では指定した画像に近いポーズになって、左脚が上がっています。

②Image Prompt

Image Promptは指定した画像の内容を、出力画像に反映する機能です。テキストプロンプトで指定する内容を補強するような感じで機能します。
今回は7枚目の、スチームパンクっぽい衣装のMuaccaさん画像を指定してみました。
元画像は8枚目のように画像エリア内にドラッグ&ドロップしてください。
この状態で出力した結果が9枚目です。衣装がテキストプロンプトだけだった2枚目よりも、指定した元画像に近くなっているのがわかると思います。

③CPDS + Image Prompt

さて、Image Promptの効果は重ね掛けすることができます。
10枚目のように、今回試したCPDSとImage Promptを両方設定してみましょう。
この状態で出力した結果が1枚目です。衣装の感じと、ダンスのポーズ、どちらもテキストプロンプトだけのときよりも、指定した画像に近い感じになっていると思います。

今回は「Stop At」や「Weight」といったパラメータは調整していないですが、「Stop At」はどこまでImage Promptの効果をかけ続けるか、「Weight」はImage Promptの効果の度合いについてのパラメータです。
「Stop At」を長くするとImage Promptの効果を長くかけ続けてくれますし、「Weight」を重くするとImage Promptの効果を強くしてくれます。複数のImage Promptを重ね掛けする際には、このあたりのパラメータで効き具合を調整するといいのかも知れませんね。

Muaccaさんの他の投稿

Muaccaさんの他の投稿

すべてを見る
036:Qwen Image Edit の使い方
6

036:Qwen Image Edit の使い方

全体公開

今回は、元画像からテキスト指示で画像を編集できるQwen Image Editを試してみました。 例によって、差分の画像をStart-Endにフレーム指定して動画を作るのに便利、という動機からです。 まずは元画像としていつものようにAnim4gineで画像を用意します(2枚目)。 これを3枚目の画像のようにしてQwen Image Editのワークフローにセットします。 プロンプトとしては、「背景だけをフォトリアルな森の画像に差し替えてください」みたいな自然文をgoogle翻訳で英語にしたものを使ってみました(4枚目)。 今度は4枚目の画像を元にして、「キャラクターを削除して背景だけにしてください」とすると、5枚目のような森の風景だけの画像になりました。消しゴムマジックみたいなことができますね。 さらに「キャラクターを削除するけど、線画だけは残してくれ」としてみたのが6枚目で、そこから「背景を夜にして、線画を光らせてくれ」としたのが1枚目、といった感じです。 nano bananaほど指示がきれいに反映されるというわけではなく、融通が利かないところもあるんですが、これをローカルのPCで使い放題というのは結構楽しいです。 いろいろ試してみたくなりますね。

035:Anytestの使い方
6

035:Anytestの使い方

全体公開

Wan2.2で動画を作るときにはポーズ差分の画像があるとStart-Endでフレーム指定で安定した動画が生成できるので、最近はポーズ差分画像をどう作るかをいろいろ試しています。 nano bananaは強力なのですが、制約があったり絵柄がnano banana絵柄に寄ったりするので他の手段も試している、というか。 私がメインで使っている画像生成モデルはAnimagine4なので、Controlnetでポーズ指定するという手が使えます。 SDXL系のControlnetとしてはAnytestという強力なブツがあるので、それを試してみました。 まずは2枚目のような、大雑把な構図指定画像を手描きします。これはClip Studio Paintでマウスでちょいちょいと5分程度で描いた代物で、「まあなんとなく言いたいことは分かる」レベルのものかな、と思います。 この構図指定画像を参照画像として設定しているのが3枚目の画像で、Anytestを使うためのComfyUIワークフローです。このワークフローで画像を生成したのが1枚目です。なんとなくそれっぽくはなっている気がしますね。 ↓プロンプトはこんな感じにしています。 1girl, _, from _, blonde long hair, blue eyes tareme, forehead, pointy ears large breast, groin tendon slim bod, single-shoulder long magical black robe, bra strap, mini skirt under robe frill skirt, contrapposto, water wave background, smile, (glitter magic circle effect:1.2) from hand, blue water effect, pure clear realistic water, splash water around wind blowing さて、Anytestですが、結構いろいろなことができる「万能Controlnet」と言われていて、例えば4枚目の画像の真ん中の部分を黒塗りでつぶして(5枚目)これを参照画像として渡すと、1枚目の画像のポーズを変更することができたりもします(6枚目)。 1枚目の画像と6枚目の画像を動画のStart-Endフレームに指定すれば、なんとなく水魔法を使っているエルフ姉さんの動画ができるような気がしますね! とまあこんな感じに便利なControlnet「Anytest」ですが、月須和さんがHuggingFaceで公開してくれています。ありがたいですね。 https://huggingface.co/2vXpSwA7

034:InfiniteTalkで読み上げ動画を作る
3

034:InfiniteTalkで読み上げ動画を作る

全体公開

前回はWan2.2のS2Vモデルを使って、セリフ音声と画像から、読み上げ動画を作りましたが、今回はセリフ音声と動画から、読み上げ動画を作ってみます。 前回のはWan2.2 S2Vで1枚の画像から動画を生成したのですが、口元以外の箇所はあまり動かないというか、ほぼ口パク動画、みたいな感じでした。 今回は人物がなにか動いている動画をもとに、口元をセリフに合わせて口パクさせるというもので、動きのある読み上げ動画を作る場合はこちらの方が良いようです。 こういった手法はVideo to Video(V2V)と呼ばれているようですね。 読み上げのためのV2VにはInfiniteTalkを用いてみました。 InfiniteTalkはまだWan2.2には対応していないので、Wan2.1と組み合わせて使ってみています。 2枚目の画像がInfiniteTalkを使うためのComfyUIのワークフローで、画面下の方で元となる動画(1枚目)を指定しています。 セリフ音声は上の方(音声を読み込む、のところ)に指定してみています。 3枚目もワークフローの一部で、真ん中のあたりにプロンプトを指定しています。この手法の場合、キャラクターの見た目も動きも動画で指定しているので、プロンプトは簡単に「The woman turns to me, stretches her body, and speaks with a smile.」(その女性は私の方を向き、体を伸ばして、笑顔で話します)としました。 あとは実行すると、セリフ音声に合わせて口元の動きが調整されます。

033:Wan22 S2Vで読み上げ動画を作る
3

033:Wan22 S2Vで読み上げ動画を作る

全体公開

今回はWan2.2のS2Vモデルを使って、セリフ音声と画像から、読み上げ動画を作ってみました。 S2Vは、音声からそれに合った動画を生成するものですが、元画像を指定するとそれをもとにI2Vのように画像に沿った動画を生成してくれます。 前回使った魔法少女画像の顔アップ(2枚目)を元画像に指定し、音声として「魔法少女Muacca、いつもみんなと楽しく、ですです」という読み上げ音声を指定してできたのが1枚目の動画です。 残念ながらちちぷいには音声付の動画は投稿できないので、口パクだけになってしまいますが、元画像のキャラがなにかしゃべっている感じになっているのは分かるかと思います。 Wan2.2 S2Vですが、UIとしては公式から配布されているComfyUIワークフローを用いて実行しました(3枚目)。 基本的にはデフォルト値のままで使うのがいいようです。 ちなみに16fpsが指定されているのですが、これを30fpsとかにすると音声と口パクがズレるので、変えないほうが良いようです。fpsを変更したい場合は、生成した動画を別のツールでフレーム補間すればよいと思います。 あと、公式の情報では生成される動画は77フレーム分と書いてあって、これは変更しないほうが良いとのことでした。16fpsだと4秒くらいの動画になるはずなのですが、結果として生成されたのは14秒くらいのものだったので、それがなぜなのかはよくわかりません。投入した音声は4秒くらいだったので、ここに投稿しているものは後ろの無音声部分をカットしてあります。

他のクリエイターの投稿

Demon girl clad in lightning
13

Demon girl clad in lightning

580コイン/月以上支援すると見ることができます

【センチ~if】沢渡ほのか:小学生時代②~交換日記~
40

【センチ~if】沢渡ほのか:小学生時代②~交換日記~

100コイン/月以上支援すると見ることができます

8月の投稿企画をひと足先に公開!
4

8月の投稿企画をひと足先に公開!

100コイン/月以上支援すると見ることができます

【センチ~if】沢渡ほのか:小〇生時代①
40

【センチ~if】沢渡ほのか:小〇生時代①

100コイン/月以上支援すると見ることができます

艶華媛綺 肆
10

艶華媛綺 肆

500コイン/月以上支援すると見ることができます

草原少女155~161
7

草原少女155~161

100コイン/月以上支援すると見ることができます

新機能チラ見せ!#10
5

新機能チラ見せ!#10

100コイン/月以上支援すると見ることができます

バスガイド
6

バスガイド

100コイン/月以上支援すると見ることができます

7月リリース新機能情報

7月リリース新機能情報

全体公開

みなさん、こんにちは!🌟 今回は、7月に実施した機能改善・アップデート内容をご紹介します! 今月は新機能の追加よりも、みなさんにより快適にご利用いただけるよう、使い勝手や見やすさを中心とした改善を行いました✨ ▼生成機能関連 ①生成画面のモデル選択UIを改善 生成時のモデル選択画面を見直し、よりモデルを選びやすいUIに改善しました。 利用したいモデルを探しやすくなり、これまで以上にスムーズに生成を始められます! ②「解像度を上げる」の表示を最適化 「解像度を上げる」設定を、対応しているモデルを選択した場合のみ表示するように変更しました。 必要な設定だけが表示されるため、画面がよりシンプルで分かりやすくなっています。 ▼投稿機能関連 ●マンガテイスト選択時の案内を追加 作品投稿時に「マンガ」テイストを選択した際、投稿に関する注意事項を表示するようになりました。 セリフなどの文字が崩れて読めない作品については、「イラスト」カテゴリでの投稿をご検討いただくようお願いしています。 より多くの方に読みやすいマンガ作品を楽しんでいただけるよう、ご協力をお願いいたします。 ▼閲覧機能関連 ①呪文ありランキングを80位まで表示 「呪文ありランキング」の表示件数を80位まで拡大しました。 投稿作品が増えてきたことを受け、より多くの作品がランキングに掲載され、多くの方の目に触れる機会が増えています✨ ②マンガ作品ページにおすすめユーザーを表示 マンガ作品ページに、おすすめユーザーを表示するようになりました。 お気に入りのクリエイターを見つけたり、新しいマンガ作品との出会いにぜひご活用ください📖 ▼メンバーシップ関連 ●タグページにテイスト切り替えを追加 メンバーシップのタグページで、「イラスト」「フォト」「マンガ」の切り替えができるようになりました。 見たい作品だけを絞り込めるようになり、目的の作品を探しやすくなっています。 ▼その他の改善 ・コメント内の外部URLを開く際に、確認画面を表示するようになりました。  誤って外部サイトへ移動してしまうことを防ぎ、より安心してご利用いただけます。 上記以外にも、細かな改善や不具合修正を実施しています。 今後もみなさんにとって「使いやすく!」「楽しく!」利用できるサイトを目指して、継続的に改善を進めてまいります。✨

鬼神装甲・震天の金棒
7

鬼神装甲・震天の金棒

580コイン/月以上支援すると見ることができます

狐面の忍者ガール
14

狐面の忍者ガール

580コイン/月以上支援すると見ることができます

誓いのキス
6

誓いのキス

100コイン/月以上支援すると見ることができます

本当にアイスみたいに溶けている女の子
12

本当にアイスみたいに溶けている女の子

580コイン/月以上支援すると見ることができます

二人のJK362~368
7

二人のJK362~368

100コイン/月以上支援すると見ることができます

絢華幻姫 壱
8

絢華幻姫 壱

500コイン/月以上支援すると見ることができます

木の枝の伝説剣
12

木の枝の伝説剣

580コイン/月以上支援すると見ることができます