提示词工程流程 · 可用

图片转提示词生成器

上传一张图片,得到能复现它的提示词——写给图像模型看的,不是写给人看的。

描述一张图片

附上 JPEG、PNG 或 WebP 并发送。Agent 会读取它,回复完整提示词、精简提示词、反向提示词和关键词标签。

一张图进,四种提示词出

图片转提示词生成器读取一张图片,返回你在别处重新生成它所需要的全部内容。

输入:一张图片,在输入框中附上

支持 JPEG、PNG、WebP。和在其它 Ideart 工具里一样附加,然后发送——图片进入你的工作区,Agent 从那里读取。

输出:60 到 120 词的完整提示词

按图像模型真正看重的顺序排列:主体、场景、构图、光线、色彩、媒介与渲染细节。写成描述性短语,而不是关于这张图的句子。

输出:精简提示词、反向提示词和标签

精简提示词适合字数受限的输入框或视频模型。反向提示词列出的是这张图重新生成时可能出问题的具体伪影。六到十二个关键词标签方便你在自己的素材库里检索。

如何使用图片转提示词生成器

三步,就在你平时生成的那个对话里。

1. 登录并附上图片

把文件拖进输入框、点击选择,或直接粘贴截图。附加媒体需要账号,和其它 Ideart 工具一致。

2. 发送

输入框里已经填好了要问的话。发送后 Agent 会读图,并回复完整提示词、精简提示词、反向提示词和逐项拆解。

3. 在同一个对话里继续

复制你要的部分,或者直接说要改什么——「光线不变,换成一只猫」——Agent 会直接生成,你不用离开对话。

提示词与它们生成的图片

下面每张图片都是由旁边这条提示词生成的。这就是图片转提示词生成器所追求的形态:先主体,再风格、光线与构图,不留任何靠猜的部分。

图片转提示词生成器会给你什么

一次上传,四种输出,每一种都对应一个你会去粘贴的地方。

按模型的读法写的完整提示词

六十到一百二十词,顺序是主体、场景、构图、光线、色彩、媒介。用短语而不是句子——因为「a weathered fisherman mending nets at dawn」能引导模型,而「这张图展示了一位渔夫」不能。

给窄输入框用的精简提示词

二十词以内,保留主体和那一个定义了整体观感的要素。这是你粘进视频模型或任何有硬字数上限的输入框的版本。

针对这张图生成的反向提示词

不是一段通用样板。列出的伪影是重新生成这张特定图片时真的可能出错的部分,没有可写的时候这一栏就是空的。

可以逐条修改的拆解

主体、风格、构图、光线、色彩、氛围分开返回。想换打光就只改光线那一行,不必重写整段再碰运气。

给自己素材库用的关键词标签

六到十二个小写标签,已去重。可以用来命名文件、筛选灵感板,或之后喂给搜索框。

无论你用什么语言,输出都是英文

这条提示词是给图像模型读的,不是给你读的。主流生成模型的训练数据以英文描述为主,翻译过的提示词就是更差的提示词——页面本身讲你的语言,提示词不讲。

读图不扣积分

读取本身是免费的:这是一次很小的模型调用,不是一次生成。只有当你接着用它的结果去生成图片或视频时才会消耗积分。

它就在你干活的地方

结果出现在一个正常的对话里,所以追问只需要一句话,而不是重新上传一次。附上的图片留在工作区,下一轮还能继续用。

裁到你真正想要的部分

提示词描述的是整个画面。如果截图有一半是浏览器工具栏,提示词就会有一半在讲浏览器工具栏。

给它你手上画质最好的那份

重度压缩的缩略图会丢掉让提示词变具体的纹理和光线细节。上传本来就会缩到 1536 像素,所以只要不低于这个尺寸就够了。

它会描述,但不会指认

模型被要求只描述可见内容,绝不猜测品牌、人物身份、地点或日期。这是刻意的准确性取舍:一个自信的错误名字比没有名字更糟。

把结果当初稿

用这条提示词重新生成会得到同一个想法,而不是同一张图——没有任何提示词是图片的无损编码。改掉偏得最远的那一行拆解,再跑一次。

人们拿它做什么

从图片里反推提示词的四个常见理由。

Editorial illustration of connected desks above a night city, used as a prompt reference
图片转提示词生成器

逆向拆解你喜欢的观感

你看到一张图,它的打光和色彩正是你想要的。图片转提示词生成器把它变成可以套到完全不同主体上的措辞。

Unbranded running shoe suspended over a red campaign track
图片转提示词生成器

找回没保存的提示词

一张你留下了、但提示词随会话消失的成品。上传图片就能拿回一条可用的提示词,不用再去回忆当初输入了什么。

Orange creature in a cinematic moonlit bakery
图片转提示词生成器

让一个系列保持视觉一致

从成功的那一帧反推提示词,保留它的风格、光线和构图行,只替换主体,用于系列里的下一张。

Green creature riding a subway with commuters
图片转提示词生成器

学习提示词是怎么搭起来的

拆解会显示哪些词负责主体,哪些负责光线、构图和氛围。读几条,比读关于提示词的建议更快学会它的结构。

依赖它之前该检查什么

提示词是对图片的有损描述。下面这些地方会暴露这一点。

  • 用这条提示词重新生成,得到的是同一个想法,不是同一张图。
  • 画面里的文字会被描述而不是被转录——它不会拼写正确地回来。
  • 人脸、品牌和地点会被刻意泛化描述;模型被要求不去猜测身份。
  • 画面过于繁杂时,提示词描述的是整个画面。想要单一主体请先裁剪。
  • 提示词是英文的,因为图像模型就是用英文训练的。

常见问题

图片转提示词生成器准确吗?

它能稳定还原主体、构图、光线、色彩和媒介,这些正是真正引导图像模型的部分。它不还原确切的文字、人脸或品牌,也不是无损编码——用这条提示词重新生成得到的是同一个想法,而不是同一张图。

需要账号吗?

需要。附加媒体要求登录,和其它 Ideart 工具一样,因为图片会先上传到你的工作区,Agent 再从那里读取。读取本身不扣积分。

我上传的图片会怎样?

它会作为对话附件上传到你的 Ideart 工作区,和你附加到任何其它工具的图片完全一样,Agent 从那里读取。它会留在那个对话里,方便你下一轮继续使用。

支持哪些格式和多大的文件?

JPEG、PNG 和 WebP,在输入框中附加。这与所有 Ideart 工具接受的参考媒体格式相同。

能用我自己的语言输出提示词吗?

提示词始终以英文返回。它是给图像模型读的而不是给你读的,而主流生成模型的训练数据以英文描述为主,所以英文提示词就是更好的提示词。页面其余部分是你的语言。

这和我自己写提示词有什么区别?

更快,也更完整。人描述的是自己注意到的东西;生成器描述的是画面里存在的东西,包括大多数人会略过不写的打光方向和构图选择。之后拆解还让你只改一个维度,不必重写整段。

把刚反推出来的提示词跑起来

在同一个对话里要一个变体,或者把提示词拿到别的工具去用。