モデルタイプ
Adobe Firefly で高性能なカスタムモデルを作成するために、トレーニング データセットを準備してレビューする方法を学習します。
カスタムモデルは現在、Adobe Firefly の個人版およびグループ版ユーザー向けのベータ版です。今すぐお試しいただき、フィードバックをお寄せください。
カスタムモデルは、トレーニング データセット内のすべての画像から学習します。一貫性があり高品質な画像を選択して、キャプションとタグを改良することで、生成される結果の品質と一貫性の向上に役立ちます。
モデルをトレーニングする前に、以下のベストプラクティスに従ってデータセットを準備してください。
スタイルを紹介する画像を選択
カスタムモデルに学習させたいスタイルや被写体を明確に表現する画像を選択します。
|
|
利用可能性 |
含める |
避ける |
|
イラストレーション |
個人版とエンタープライズ版 |
|
|
|
キャラクター |
個人版とエンタープライズ版 |
|
|
|
図像 |
個人版とエンタープライズ版 |
|
|
|
写真 |
個人版とエンタープライズ版 |
|
|
|
ライフスタイルフォト |
エンタープライズ版のみ |
|
|
|
人物写真 |
エンタープライズ版のみ |
|
|
|
アイソメトリックと 3D グラフィック |
エンタープライズ版のみ |
|
|
|
ブランド表現の探求 |
エンタープライズ版のみ |
|
|
|
商品撮影用の背景 |
エンタープライズ版のみ |
|
|
|
要件 |
ガイダンス |
|
形式 |
JPG または PNG |
|
ファイルサイズ |
個人版およびグループ版ユーザーは 20 MB 未満、エンタープライズ版ユーザーは 50 MB 未満。 |
|
解像度 |
1024 × 1024 ピクセル以上 |
|
縦横比 |
データセット全体で一貫した縦横比を保つ。横長の場合は最大 16:9、縦長の場合は最大 9:16。 |
|
量 |
10~30 枚の画像をアップロードします。 |
|
バリエーション |
一貫したビジュアルスタイルを維持しながら、様々な視点、背景、構成を含めてください。 |
|
被写体 |
メインのスタイルまたは被写体に焦点を当てる。可能な場合は、不要な要素をトリミングする。 |
|
背景 |
透明な背景や注意をそらす要素は避けてください。 |
|
一貫性 |
意図的にスタイルの一部にするのでない限り、意図しない繰り返しの小道具、アクセサリー、背景を避けてください。 |
エンタープライズ版ユーザーとして Firefly カスタムモデルを使用し、組織で使用するためのモデルをトレーニングしている場合は、データセットが承認されたブランド アセットを反映し、組織のガバナンス ポリシーに従っていることを確認してください。
キャプションをレビューして調整する
Firefly は、アップロードされたすべての画像に対してキャプションを自動生成します。トレーニング前に各キャプションを確認してください。
|
実行する操作 |
避ける操作 |
|
不正確なキャプションを修正する。 |
間違った自動生成キャプションをそのままにしておく。 |
|
スタイルや被写体を説明する視覚的な詳細を追加する。 |
曖昧な説明を使用する。 |
|
キャプション全体で多様な文章構造を使用する。 |
データセット全体で同じキャプションパターンを繰り返す。 |
|
認識可能な人物やランドマークを文脈も含めて説明してください。 |
Firefly がコンテキストなしで固有名詞を理解すると仮定する。 |
|
被写体モデルの場合、すべてのキャプションにコンセプト ID を含める。 |
被写体ベースのデータセットからコンセプト ID を省略する。 |
モデルタグをレビューする
モデルタグは、生成されるすべての画像で一貫性を保つべき特性を説明します。
|
含める |
避ける |
|
水彩画テクスチャ、フラットイラスト、茶色の髪、ソフトライティング、幾何学的スタイルなどの永続的な特性。 |
表情、服装、小道具、アクセサリー、手に持っている物などの一時的な属性。 |
トレーニングチェックリストを完了する
「トレーニング」を選択する前に、以下を確認してください。
|
トレーニング画像 |
キャプション |
モデルタグ |
|
10~30 枚の画像がアップロード済み |
キャプションの正確性を確認済み |
少なくとも 3 つのタグを追加済み |
|
JPG または PNG 形式 |
具体的で説明的な表現 |
タグが永続的な特性を説明している |
|
画像がサイズと解像度の要件を満たしている |
被写体モデルのコンセプト ID が含まれている |
一時的な属性は除外されている |
|
一貫したビジュアルスタイル |
多様な文章構成 |
|
|
構成と遠近法のバリエーション |
認識可能な被写体の明確な説明 |
|
|
気を散らす背景や繰り返し要素がない |