Whiskの最大の魅力は、特別な使い方を覚えなくても始められることです。
Googleアカウントでログインし、画像をドラッグ&ドロップするだけで使えます。まず猫の写真をアップロードし、Plushieスタイルを選んでみました。
数秒後、ぬいぐるみ風の画像が2枚生成されました。元の表情やポーズはある程度残っていますが、質感は完全にぬいぐるみへ変わっています。
こうした使い方は、まさにWhiskが得意とするところです。「毛並みの質感」「スタジオ照明」「商品写真」といったプロンプトの書き方を調べる必要はなく、画像を選ぶだけで始められます。
次に、もう少し複雑な組み合わせを試しました。
被写体は同じ猫のまま、シーンをサイバーパンク都市の夜景に変更し、Styleには『星月夜』のような雰囲気の参考画像を設定しました。
最終的に生成されたのは、青と紫を基調とした夜景の中にいる猫です。都市と空には、はっきりとした渦巻くような筆致が現れていました。
必ずしも事前に想像していた結果ではありませんが、思いがけないビジュアルの方向性を見つけやすいのは確かです。
もちろん、うまくいかないこともあります。
柴犬の写真を参考に「カウボーイハットをかぶった柴犬」を作ろうとしたところ、Whiskは被写体を茶髪の子どもとして解釈してしまいました。
そこでテキスト説明に「被写体は柴犬です」と追加すると、ようやく意図した結果に戻りました。
使っていて最も強く感じたのは、Whiskは「雰囲気」を理解するのは得意ですが、正確に再現するのは得意ではないということです。
元画像は参照しますが、人物、ポーズ、構図、細部が完全に維持される保証はありません。
ビジュアルの方向性を探るために使うなら、この自由度はとても面白いものです。一方、参考画像の正確な再現を求めると、期待外れに感じる可能性があります。
良いところ
- すぐに使い始められる。 プロンプトの知識がなくても、そのまま画像を生成できます。
- ビジュアルの方向性を探しやすい。 数枚の参考画像だけで、さまざまな組み合わせを素早く試せます。
- 画像とテキストを併用できる。 画像で雰囲気を伝え、テキストで具体的な要件を追加できます。
- 気軽に試行錯誤できる。 ムードボード、コンセプト案、アイデアスケッチを作るときに効率的です。
気になるところ
- 生成結果のランダム性が高い。 AIによる参考画像の解釈が、自分の意図と一致するとは限りません。
- 細部を維持する能力には限界がある。 髪型、服装、体型、そのほかの特徴が変わることがあります。
- 複雑な構図は崩れやすい。 複数の被写体の関係、正確な配置、複雑な遠近表現は得意ではありません。
- 編集ソフトというよりクリエイティブツールに近い。 既存画像を正確に修正したい場合は、専門的な画像編集ソフトが必要です。
向いている人 / あまり向いていない人
向いている人:
- デザイナーやクリエイティブ職。 ムードボード、コンセプト探索、スタイル検討に便利です。
- コンテンツクリエイターやSNS担当者。 アイコン、投稿用画像、ミーム、素材案を素早く生成できます。
- プロダクトマネージャーや起業家。 曖昧なビジュアルイメージを、議論できる形に素早く変えられます。
- AI画像生成の初心者。 プロンプトを先に学ばなくても、画像生成を体験できます。
あまり向いていない人:
- プロレベルの細かな修正が必要な人。 WhiskはPhotoshopのようなツールの代わりにはなりません。
- 参考画像を忠実に再現したい人。 元画像をそのまま複製するのではなく、独自に解釈して再生成します。
- 複雑で正確な構図が必要な人。 オブジェクトの位置、人物の細部、複数の被写体の関係が崩れることがあります。
コメント(0件)