イメージモデル
AI-Public はテキスト対画像モデルの中央モデルカタログを使用します。表示されるモデルは環境のプロバイダー設定に依存します。
現在のカタログ
| 供給者 | コスト効果 | 高品質 |
|---|---|---|
| OpenAI | GPT Image 1 mini | GPT Image 2 |
| Nano Banana | Nano Banana 2 | |
| Black Forest Labs | FLUX.2 Flex | FLUX.2 Pro Preview |
Nano Banana は AI-Public が Gemini Flash Image モデルに用いている名前です。欧州のイメージモデルは Black Forest Labs 経由で提供されます。
どのモデルを選ぶべきか?
| モデル | 適した用途 |
|---|---|
| GPT Image 1 mini | 迅速なコンセプト画像、スケッチ、低コストでの試作と反復。 |
| GPT Image 2 | よりきれいな最終画像、画像内のテキストの明瞭さ、仕上げのより細かな制御。 |
| Nano Banana | 迅速で手頃な画像、多くのバリエーションと簡易な編集。 |
| Nano Banana 2 | Google との滑らかな画像生成とインタラクティブな画像編集。 |
| FLUX.2 Flex | 新規・汎用画像のための柔軟な欧州テキスト対画像生成。 |
| FLUX.2 Pro Preview | リアルな画像と一貫したスタイルの高品質な欧州画像生成。 |
中心フォーマットの選択
AI-Public はユーザーに対して四つの一般的なフォーマット選択を表示します。
| 選択 | 意味 |
|---|---|
| 自動 | AI-Public が選択されたモデルに最も適した設定を選択します。 |
| 正方形 | 正方形の画像。 |
| 横長 | スライドなどに適した横長の画像。 |
| 縦長 | ポスターなどに適した縦長の画像。 |
中央のモデルカタログには、これらの選択が各供給者ごとに正しい技術設定へどのように翻訳されるかが定義されています。したがって、ユーザーはプロバイダーが 16:9、1536x1024、横幅/高さ、その他の値で動作しているかを知っている必要はありません。
編集とインスピレーション画像
現代のイメージモデルは、入力として画像を使用することもできます。AI-Public は次の区別をします。
- インスピレーション画像:スタイル、色、構図、テーマの方向性を示す参照画像。
- 編集画像:モデルに修正を加えさせる元画像。
これらの機能は Black Forest Labs および Stability AI には適用されません。これらの供給者では、AI-Public はすべての元画像・インスピレーション・参照画像をブロックし、プライバシー制限付きのテキスト対画像生成のみが可能です。
編集モードでは、ユーザーはアスペクト比を選択しません。AI-Public は手動の寸法やフォーマット設定を送信しないため、元画像の寸法と比率をモデルが保持できます。
プロンプト改善
直接の画像生成時、AI-Public はプロンプトと自動設定を改善する追加の AI ステップを使用することがあります。このステップは現在のプロンプト、設定、および最近のチャット履歴を参照します。明示的に選択された設定は優先され、自動または空の設定は補完され得ます。
Black Forest Labs および Stability AI の場合、別個の技術データフローが適用されます。彼らは元のプロンプトを受け取らず、代わりに制御されたカタログからサーバーサイドで組み立てられたプロンプトのみを受け取ります。 個人情報が技術的に除外される方法を読む.