← 文章 / AI图像生成
Ollama 博客 1小时前 · 2026-08-31 21:10:19 · 2 阅读

图像生成(实验性)

An image of Ollama painting to depict Ollama now having image generation capabilities in experimental form on macOS and coming soon for Windows and Linux.

Ollama 现已在 macOS 上支持图像生成,Windows 和 Linux 版本也将很快推出。

ollama run x/z-image-turbo "your prompt"

生成的图片会保存到当前目录。支持图像渲染的终端(如 Ghostty、iTerm2 等)可以直接在终端内预览图片。

A cat holding a sign that says hello

模型

Z-Image Turbo

ollama run x/z-image-turbo

Z-Image Turbo 是由阿里巴巴通义实验室开发的 60 亿参数文生图模型。它能够生成逼真的图像,并支持在图片中准确呈现英文和中文文本。

  • 逼真效果:擅长生成写实照片、人像和场景
  • 中英文文本渲染:能够在图片中准确呈现英文和中文文本
  • Apache 2.0:采用开放权重,可用于商业用途

示例

写实人像:

年轻女性置身于舒适的咖啡馆中,柔和的自然窗光,身穿米白色针织毛衣,手持陶瓷杯,背景是带有温暖氛围灯光的柔和散景,捕捉自然瞬间,35mm 胶片质感

Young woman in a cozy coffee shop

中国书法:

传统中国书法水墨画风格,宣纸上以优雅的黑色墨迹写着“山高水长”,角落盖有朱红印章,极简构图

Chinese calligraphy on rice paper

创意构图:

超现实主义双重曝光人像,女性剪影中盛开着樱花树,粉色和白色花瓣在空中飘落,梦幻空灵的氛围

Surreal double exposure portrait with cherry blossoms

Z-image turbo 模型页面

FLUX.2 Klein

Black Forest Labs 迄今速度最快的图像生成模型,提供 4B 和 9B 两种参数规模。

FLUX.2 Klein 擅长在图像中生成清晰易读的文字,适合制作 UI 原型和包含排版文字的设计。

  • 4B 模型:采用 Apache 2.0 许可证,可完全用于商业用途
  • 9B 模型:采用 FLUX Non-Commercial License v2.1
ollama run x/flux2-klein

示例

文字渲染:

雨夜城市小巷中的霓虹灯牌,写着“OPEN 24 HOURS”,湿漉漉的路面映出灯光倒影

A neon sign reading “OPEN 24 HOURS” in a rainy city alley at night

产品摄影:

木质桌面上的哑光黑色咖啡随行杯,清晨阳光投下修长阴影,蒸汽缓缓升起,商业产品摄影风格

Matte black coffee tumbler on wooden desk

FLUX.2 Klein 模型页面

配置

使用以下参数自定义图像生成:

Screen capture of Ollama’s image generation settings from the terminal

图像保存位置

生成的图像会保存到当前目录。在终端中切换目录,即可将图像保存到其他位置。

图像尺寸

使用 /set width/set height 命令调整宽度和高度。图像尺寸越小,生成速度越快,占用的内存也越少。

生成步数

步数决定模型运行的迭代次数。步数越少,生成越快,但细节也会减少;步数过多则可能产生伪影。Ollama 会根据每个模型的推荐值,默认设置合适的步数。

随机种子

设置随机种子可以获得可复现的结果,便于反复调整同一主题或分享完全一致的输出。即使提示词相同,不同种子也会生成不同图像。

负面提示词

负面提示词用于告诉模型不希望图像中出现哪些内容。

后续计划

  • 支持 Windows 和 Linux
  • 增加更多图像生成模型,并支持图像编辑
原始来源: Ollama 博客

评论 (0)