返回首页

提示词工程 — 多轮 AI 对话与生图交接

ForgeEcho AI 对话教程:多轮提示词工程、Gemini 风格结构化改写、带货脚本撰写,以及提示词转生图/配音的交接方法。

AI 对话能做什么

ForgeEcho AI 对话是面向创作的多轮助手。用于探索方向、在生图前打磨提示词或口播稿、分析失败出图,以及规划营销投放——准备好后再进入 AI 生图 或 AI 语音。

每条回复消耗 0.5 积分,并自动保存到控制台 提示词库(原始输入 + 助手回复),方便把优胜草稿变成可复用模板。

阶段适合用 AI 对话…
探索角度、受众、钩子、文字版情绪板
起草生图提示词、口播稿、广告结构
迭代「太暗」「产品太小」「语气太硬」
交接复制最终提示词/脚本到 AI 生图 / AI 语音

可用对话模型

模型适用场景
gemini-3.1-pro默认——提示词与脚本撰写平衡较好
gemini-3-pro较长 campaign brief、多段落脚本
gemini-2.5-pro快速探索多个变体方向
nano-banana-fast轻量快速改写
nano-banana通用创意对话,延迟较低

在 AI 对话工作区顶部切换模型。做提示词优化时,gemini-3.1-pro 或 gemini-2.5-pro 通常输出结构最清晰。

模型路由建议

任务类型优先模型原因
结构化生图 promptgemini-3.1-pro约束与分层描述更完整
长 campaign brief / 多段脚本gemini-3-pro上下文窗口与段落连贯性更好
快速头脑风暴 3–5 个方向gemini-2.5-pro延迟低,适合探索期
单句改写、语气微调nano-banana-fast轻量,积分消耗低

同一 SKU 的 prompt 家族建议固定一个「主对话模型」,避免今天用 Pro、明天用 Fast 导致输出结构漂移,后续批量替换字段时更难维护。

智能体式提示词工程

多轮对话的价值在于逐步收窄搜索空间,而不是一次写出完美 prompt。可以把它理解成小型 agent 工作流:

  1. 规划 — 交付物、渠道、画幅、保真约束
  2. 起草 — 1–3 个结构化变体
  3. 评估 — 你或对话本身对照冲突词(如同时要求「写实」与「 flat 插画」)
  4. 改进 — 只改一个杠杆(光线 / 背景 / 语气)
  5. 交接 — 复制定稿到 AI 生图或 AI 语音

这种写法对 推理引导文生图 尤其重要:Nano Banana 2 等模型在 prompt 层次清晰时,更少在背景、光向、材质上「自由发挥」。

推荐流程

1. 打开 AI 对话

在应用中进入 AI 对话。同一会话内上下文会保留——后续消息可引用前面的草稿。

2. 说清交付物

  • AI 生图 — 比例、背景、主体、品牌色
  • AI 语音 — 时长、语气(温暖/紧迫/专业)、语言
  • 投放 — 渠道(TikTok、邮件、详情页 PDP)

示例:

  • 维生素软糖 9:16 广告,给我 3 个视觉方向
  • 写一段 15 秒护肤上新口播, calm、可信
  • 这个生图提示词几乎对了,但标签糊——改哪里?

3. 请求结构化优化

有粗略想法、需要可生产的 prompt 时,明确要求结构。可靠写法:

把下面内容优化成文生图提示词,包含:
- 主体(是什么、在画面什么位置)
- 风格与光线
- 背景与配色
- 约束(标签可读、外形不变)
- 画幅:1:1

粗略想法:护肤精华瓶,干净背景,高级感,适合 Instagram 广告

可要求 3 个风格方向(极简影棚、生活场景、强 campaign 色)对比后再生图。

4. 多轮迭代

用追问代替一次写很长。对话擅长对比和小步修改(「电影感 vs UGC」「更短 vs 更情绪化」)。

5. 在对应工具生成

  • 定稿 生图提示词 → AI 生图(在工作区选择模型与画幅)
  • 定稿 口播稿 → AI 语音

完整闭环与验收清单见 先优化再生成。

示例请求

生图准备

  • 把这段改成产品棚拍 prompt:白底、柔和阴影、标签清晰
  • 同一人物三种动漫风方向——保留 likeness,线稿强度不同
  • 改成 9:16 竖版——产品在下方三分之一,上方留标题区

配音准备

  • 30 秒设计工具播客片头—— friendly,不要硬销
  • 无线耳机 20 秒内口播广告—— energetic
  • 压缩到 120 字,钩子保留在第一句

跨工具

  • 已有 hero 图,建议匹配的配音语气与开头一句
  • 这条产品 prompt 有效——把同一 mood 改成 20 秒 UGC 口播稿

提示词结构速查

通过对话撰写生图 prompt 时,建议按此顺序(模型解析更稳定):

  1. 主体 — 产品/人物、姿势、在画面中的位置
  2. 场景与背景 — 影棚白底、生活厨房、抽象渐变
  3. 光线 — 窗光、轮廓光、高调棚拍
  4. 风格 — 写实、 editorial、UGC 手持
  5. 约束 — 保留五官、包装文字清晰、无多余道具
  6. 输出 — 画幅、用途(亚马逊主图、Reels 封面)

实用技巧

  1. 点名交付物 — 「亚马逊主图」与「Instagram Stories 封面」默认约束不同。
  2. 一张图一个主体,减少模型分散注意力。
  3. 口播稿边写边读 — 拗口的句子让对话改短。
  4. 从提示词库复用优胜模板 — 标注用过的模型与画幅。

实战案例:护肤 SKU Instagram 广告(约 45 分钟)

背景: 新品精华需要 4:5 Instagram feed 广告底图 + 15 秒口播钩子,团队只有一位运营。

步骤操作耗时积分(约)
1AI 对话:brief + 3 个 4:5 prompt 变体8 min1.5
2AI 生图:nano-banana-fast 1K × 5 张筛选12 min15
3清单打分,只改「背景渐变 → 影棚白底」5 min—
4nano-banana-2 2K 定稿 × 28 min8
5AI 对话:35 字口播钩子 × 2 版5 min1
6AI 语音:试听 15 秒样本后定稿7 min1
合计~45 min~26.5

Winning prompt 片段(可入库):

单瓶护肤精华居中,纯白无缝背景,左上方柔和影棚主光,
玻璃材质真实反光,标签清晰,4:5 画幅,上方 30% 低纹理留白供标题

教训: 第 2 步不要在 1K 阶段就追求 4K;先筛构图,再升分辨率——这与 先优化再生成 的单变量原则一致。

故障排查决策树

现象优先检查下一步
出图每次风格差很大prompt 是否含冲突词(写实 + 插画)回对话拆成「约束块 + 风格块」
产品标签糊是否缺少「标签清晰可读」加约束 + 上传参考图
对话输出结构乱是否换了模型 mid-session固定一个主对话模型
脚本配音机械句长是否 > 15 字对话要求按口语断句
积分消耗超预期是否在 1K 前反复 4K 重 roll先 fast + 1K 筛图

常见问题

AI 对话会替代 AI 生图或 AI 语音吗?
不会。对话负责规划与改写;生图与语音负责产出素材。

优化后的提示词存在哪?
每次对话会写入控制台 → 提示词库,含原始输入与助手回复。

可以用中文以外的语言吗?
可以。跨语言投放时保持 SKU 与品牌名拼写一致。

相关指南

  • 先优化再生成
  • AI 语音功能
  • 电商主图优化
AI 对话能做什么可用对话模型模型路由建议智能体式提示词工程推荐流程1. 打开 AI 对话2. 说清交付物3. 请求结构化优化4. 多轮迭代5. 在对应工具生成示例请求提示词结构速查实用技巧实战案例:护肤 SKU Instagram 广告(约 45 分钟)故障排查决策树常见问题相关指南