提示词工程 — 多轮 AI 对话与生图交接
ForgeEcho AI 对话教程:多轮提示词工程、Gemini 风格结构化改写、带货脚本撰写,以及提示词转生图/配音的交接方法。
AI 对话能做什么
ForgeEcho AI 对话是面向创作的多轮助手。用于探索方向、在生图前打磨提示词或口播稿、分析失败出图,以及规划营销投放——准备好后再进入 AI 生图 或 AI 语音。
每条回复消耗 0.5 积分,并自动保存到控制台 提示词库(原始输入 + 助手回复),方便把优胜草稿变成可复用模板。
| 阶段 | 适合用 AI 对话… |
|---|---|
| 探索 | 角度、受众、钩子、文字版情绪板 |
| 起草 | 生图提示词、口播稿、广告结构 |
| 迭代 | 「太暗」「产品太小」「语气太硬」 |
| 交接 | 复制最终提示词/脚本到 AI 生图 / AI 语音 |
可用对话模型
| 模型 | 适用场景 |
|---|---|
gemini-3.1-pro | 默认——提示词与脚本撰写平衡较好 |
gemini-3-pro | 较长 campaign brief、多段落脚本 |
gemini-2.5-pro | 快速探索多个变体方向 |
nano-banana-fast | 轻量快速改写 |
nano-banana | 通用创意对话,延迟较低 |
在 AI 对话工作区顶部切换模型。做提示词优化时,gemini-3.1-pro 或 gemini-2.5-pro 通常输出结构最清晰。
模型路由建议
| 任务类型 | 优先模型 | 原因 |
|---|---|---|
| 结构化生图 prompt | gemini-3.1-pro | 约束与分层描述更完整 |
| 长 campaign brief / 多段脚本 | gemini-3-pro | 上下文窗口与段落连贯性更好 |
| 快速头脑风暴 3–5 个方向 | gemini-2.5-pro | 延迟低,适合探索期 |
| 单句改写、语气微调 | nano-banana-fast | 轻量,积分消耗低 |
同一 SKU 的 prompt 家族建议固定一个「主对话模型」,避免今天用 Pro、明天用 Fast 导致输出结构漂移,后续批量替换字段时更难维护。
智能体式提示词工程
多轮对话的价值在于逐步收窄搜索空间,而不是一次写出完美 prompt。可以把它理解成小型 agent 工作流:
- 规划 — 交付物、渠道、画幅、保真约束
- 起草 — 1–3 个结构化变体
- 评估 — 你或对话本身对照冲突词(如同时要求「写实」与「 flat 插画」)
- 改进 — 只改一个杠杆(光线 / 背景 / 语气)
- 交接 — 复制定稿到 AI 生图或 AI 语音
这种写法对 推理引导文生图 尤其重要:Nano Banana 2 等模型在 prompt 层次清晰时,更少在背景、光向、材质上「自由发挥」。
推荐流程
1. 打开 AI 对话
在应用中进入 AI 对话。同一会话内上下文会保留——后续消息可引用前面的草稿。
2. 说清交付物
- AI 生图 — 比例、背景、主体、品牌色
- AI 语音 — 时长、语气(温暖/紧迫/专业)、语言
- 投放 — 渠道(TikTok、邮件、详情页 PDP)
示例:
维生素软糖 9:16 广告,给我 3 个视觉方向写一段 15 秒护肤上新口播, calm、可信这个生图提示词几乎对了,但标签糊——改哪里?
3. 请求结构化优化
有粗略想法、需要可生产的 prompt 时,明确要求结构。可靠写法:
把下面内容优化成文生图提示词,包含:
- 主体(是什么、在画面什么位置)
- 风格与光线
- 背景与配色
- 约束(标签可读、外形不变)
- 画幅:1:1
粗略想法:护肤精华瓶,干净背景,高级感,适合 Instagram 广告可要求 3 个风格方向(极简影棚、生活场景、强 campaign 色)对比后再生图。
4. 多轮迭代
用追问代替一次写很长。对话擅长对比和小步修改(「电影感 vs UGC」「更短 vs 更情绪化」)。
5. 在对应工具生成
- 定稿 生图提示词 → AI 生图(在工作区选择模型与画幅)
- 定稿 口播稿 → AI 语音
完整闭环与验收清单见 先优化再生成。
示例请求
生图准备
把这段改成产品棚拍 prompt:白底、柔和阴影、标签清晰同一人物三种动漫风方向——保留 likeness,线稿强度不同改成 9:16 竖版——产品在下方三分之一,上方留标题区
配音准备
30 秒设计工具播客片头—— friendly,不要硬销无线耳机 20 秒内口播广告—— energetic压缩到 120 字,钩子保留在第一句
跨工具
已有 hero 图,建议匹配的配音语气与开头一句这条产品 prompt 有效——把同一 mood 改成 20 秒 UGC 口播稿
提示词结构速查
通过对话撰写生图 prompt 时,建议按此顺序(模型解析更稳定):
- 主体 — 产品/人物、姿势、在画面中的位置
- 场景与背景 — 影棚白底、生活厨房、抽象渐变
- 光线 — 窗光、轮廓光、高调棚拍
- 风格 — 写实、 editorial、UGC 手持
- 约束 — 保留五官、包装文字清晰、无多余道具
- 输出 — 画幅、用途(亚马逊主图、Reels 封面)
实用技巧
- 点名交付物 — 「亚马逊主图」与「Instagram Stories 封面」默认约束不同。
- 一张图一个主体,减少模型分散注意力。
- 口播稿边写边读 — 拗口的句子让对话改短。
- 从提示词库复用优胜模板 — 标注用过的模型与画幅。
实战案例:护肤 SKU Instagram 广告(约 45 分钟)
背景: 新品精华需要 4:5 Instagram feed 广告底图 + 15 秒口播钩子,团队只有一位运营。
| 步骤 | 操作 | 耗时 | 积分(约) |
|---|---|---|---|
| 1 | AI 对话:brief + 3 个 4:5 prompt 变体 | 8 min | 1.5 |
| 2 | AI 生图:nano-banana-fast 1K × 5 张筛选 | 12 min | 15 |
| 3 | 清单打分,只改「背景渐变 → 影棚白底」 | 5 min | — |
| 4 | nano-banana-2 2K 定稿 × 2 | 8 min | 8 |
| 5 | AI 对话:35 字口播钩子 × 2 版 | 5 min | 1 |
| 6 | AI 语音:试听 15 秒样本后定稿 | 7 min | 1 |
| 合计 | ~45 min | ~26.5 |
Winning prompt 片段(可入库):
单瓶护肤精华居中,纯白无缝背景,左上方柔和影棚主光,
玻璃材质真实反光,标签清晰,4:5 画幅,上方 30% 低纹理留白供标题教训: 第 2 步不要在 1K 阶段就追求 4K;先筛构图,再升分辨率——这与 先优化再生成 的单变量原则一致。
故障排查决策树
| 现象 | 优先检查 | 下一步 |
|---|---|---|
| 出图每次风格差很大 | prompt 是否含冲突词(写实 + 插画) | 回对话拆成「约束块 + 风格块」 |
| 产品标签糊 | 是否缺少「标签清晰可读」 | 加约束 + 上传参考图 |
| 对话输出结构乱 | 是否换了模型 mid-session | 固定一个主对话模型 |
| 脚本配音机械 | 句长是否 > 15 字 | 对话要求按口语断句 |
| 积分消耗超预期 | 是否在 1K 前反复 4K 重 roll | 先 fast + 1K 筛图 |
常见问题
AI 对话会替代 AI 生图或 AI 语音吗?
不会。对话负责规划与改写;生图与语音负责产出素材。
优化后的提示词存在哪?
每次对话会写入控制台 → 提示词库,含原始输入与助手回复。
可以用中文以外的语言吗?
可以。跨语言投放时保持 SKU 与品牌名拼写一致。