prompt-optimizer 图像模式3步上手:文生图/图生图实操
【免费下载链接】prompt-optimizerAn AI prompt optimizer for writing better prompts and getting better AI results.项目地址: https://gitcode.com/GitHub_Trending/pro/prompt-optimizer
用 prompt-optimizer 跑文生图和图生图,配置好一个图像模型、写两句提示词就能出图,输出统一是 base64,直接拿去做后续集成。
它到底能帮你做什么
- 支持:文生图、图生图(单张本地图 + 提示词)、一次生成 1~4 张
- 输出:base64(默认 image/png),支持下载与复制
- 暂不支持:多图融合、mask 局部编辑、upscale、图像模板、历史记录
模型管理拆成了几个独立组件:ImageModelManager.vue 管增删改,ImageService.ts 按 provider 路由到 Gemini、Seedream 等适配器,互不干扰。
从零跑通:配置你的第一个图像模型
1. 填 API Key。把env.local.example复制为.env.local,填上密钥:
# Gemini 图像(内置 image-gemini) VITE_GEMINI_API_KEY=your-gemini-key # Seedream(内置 image-seedream / 5.0 Lite) VITE_SEEDREAM_API_KEY=your-ark-keyDocker 部署不用手动复制,generate-config.sh 会在容器启动时自动把VITE_*变量注入前端。
2. 等内置模型自动注入。配好密钥重启后,内置的 Gemini(gemini-2.5-flash-image-preview)和 Seedream(doubao-seedream-4-0-250828)会自动出现在模型列表里,按需启用即可。
3. 打开图像模型管理。模型管理器里有"文本模型|图像模型"标签页,点进去就能新增、编辑、启用/禁用、删除模型。想接 OpenAI、DashScope、SiliconFlow 等其他提供商,也在这里加自定义模型。
核心玩法:文生图与图生图怎么用
文生图操作步骤
- 顶部导航"高级模式"改为下拉菜单,选"图像模式"。
- 左侧输入提示词,设置生成张数(1~4 张)。
- 选一个已启用的图像模型,点"生成"。
- 右侧看 base64 预览,满意就点下载或复制。
提示词别只写"一只猫"。写清"主体 + 风格 + 光线 + 构图",再补一句"8K、细节丰富"这类质量词,出图稳定程度完全不一样。
图生图操作步骤
- 同上文生图切到图像模式。
- 上传一张本地参考图(png/jpeg,≤10MB)。
- 提示词写"要改什么"而不是"图里有什么",比如"转换成赛博朋克风格,保留主体轮廓"。
- 选模型生成,对比参考图和结果的改动幅度。
图生图的提示词重点在"约束保留什么、修改什么",写"保留构图,换背景为雪夜"比"重新画一遍"靠谱得多。
效果调优:让出图质量上一个台阶
- 出图平庸、和描述对不上→ 把风格、色调、镜头角度写进提示词,别指望模型脑补。
- 一张不满意→ 张数调到 4,挑最好的那张,比反复改词更快。
- 风格不符合预期→ 换一个模型试试:Gemini 偏创意色彩,Seedream 人物和场景更稳,同一提示词跑两个模型对比。
- 等得久→ 多张是串行执行的,先少生成几张快速验证提示词,再拉满张数。
容易踩的坑
- 参考图只收 png/jpeg,超过 10MB 会被直接拦下(前端后端都校验)。
- 生成张数上限 4,且串行执行,别指望并发提速。
- 浏览器环境直连某些 provider 可能撞跨域限制,换桌面版或配个反向代理就解决了。
功能边界和参数细节见 图像模式文档,想改适配器逻辑可以翻 adapters 目录。
【免费下载链接】prompt-optimizerAn AI prompt optimizer for writing better prompts and getting better AI results.项目地址: https://gitcode.com/GitHub_Trending/pro/prompt-optimizer
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考