图像模型
AI-Public 使用中心模型目录进行文本到图像模型的管理。可见哪些模型,取决于环境的提供者设置。
目前目录
| 供应商 | 成本效益 | 高质量 |
|---|---|---|
| OpenAI | GPT Image 1 mini | GPT Image 2 |
| Nano Banana | Nano Banana 2 | |
| Black Forest Labs | FLUX.2 Flex | FLUX.2 Pro Preview |
Nano Banana 是 AI-Public 为 Gemini Flash 图像模型所使用的名称。欧洲图像模型通过 Black Forest Labs 提供。
你为何要选择哪个模型?
| 模型 | 适合的场景 |
|---|---|
| GPT Image 1 mini | 快速概念图、草图、测试与迭代,成本较低。 |
| GPT Image 2 | 较清晰的最终图像、图中文字更清晰、对完成度的掌控更多。 |
| Nano Banana | 迅速且经济的图像,变体丰富,易于编辑。 |
| Nano Banana 2 | 与 Google 进行流畅的图像生成与交互式编辑。 |
| FLUX.2 Flex | 面向欧洲的灵活文本到图像生成,适用于新颖、通用的图像。 |
| FLUX.2 Pro Preview | 面向欧洲的高质量图像生成,真实感强、风格一致。 |
中央格式选项
AI-Public 向用户展示四种通用的格式选项:
| 选项 | 含义 |
|---|---|
| 自动 | AI-Public 为所选模型选择最合适的设置。 |
| 方形 | 正方形图像。 |
| 横向 | 宽图像,例如用于幻灯片。 |
| 纵向 | 竖向图像,例如用于海报。 |
在中心模型目录中,已规定这些选项如何针对不同供应商翻译为正确的技术设置。因此用户无需了解某个提供商是否使用 16:9、1536x1024、宽高比或其他数值。
编辑和灵感图片
现代图像模型也可以将图片作为输入。AI-Public 将其区分为:
- 灵感图片:用于给风格、颜色、构图或主题提供方向的参考图像。
- 编辑图片:需要被模型调整的源图像。
这些功能对 Black Forest Labs 和 Stability AI 不适用。对于这些提供商,AI-Public 将阻止所有源图片、灵感图片和参考图片的加载,只允许在隐私受限的文本到图像生成。
在编辑模式下,用户不选择任何特定的长宽比。AI-Public 不会传送手动尺寸或格式设置,使模型能够保持源图像的尺寸与纵横比。
提示改进
在直接生成图像时,AI-Public 可以额外使用一个 AI 步骤来改进提示和自动设置。此步骤会审视当前提示、设置和最近的聊天历史。明确选择的设置仍然具有主导性;自动或空白设置可以被补充。
对于 Black Forest Labs 和 Stability AI,存在单独的技术数据流。它们不会接收原始提示,而是接收来自受控目录的服务器端拼接提示。 了解个人数据如何被技术性排除。