上周末帮社群做活动海报,标题就「秋季读书会」五个字,我用惯用的绘画模型跑了七八版,字全糊成一团,有一版把「读」写成了「卖」。那次之后我换成了专门处理文字的工具。

多数图像模型画字不稳,原因是它把文字当图案去凑,笔画看着像就行。专门做文字渲染的模型按字符来排,正确率高出一截。

Ideogram 干的就是这个。你把要出现的文字直接写进提示词,用引号括起来,它会尽量排到你描述的位置。中英文都支持,中文短句比长段落稳得多。

能直接抄的写法大概是这样:

「一张暖色调的读书会海报,米色背景,中央是一摞书和一杯咖啡,柔和自然光,顶部居中用衬线字体写着『秋季读书会』,下方小字写着『10月18日 周六下午』」

我习惯把它拆成两段来想。前半段管画面氛围,后半段管文字内容和位置。混在一起写容易顾此失彼,要么画面跑偏,要么字根本没排上去。

位置要说人话。写「顶部居中」「左下角」「沿着杯身环绕」这类明确方位,比写「字要好看地放上去」有用得多。我还会顺手描述一下字号感觉,比如「主标题占画面上方三分之一」,排出来的留白就顺眼不少。

字数是最关键的变量。我的经验是主标题控制在八个字以内,副标题一行,再往下加就开始串行。你让它写「限时特惠全场五折起最后三天」这种长串,十有八九会多给你一个字或者少一个字。

有个反直觉的点:别在提示词里写「不要写错字」。这种否定说法对模型基本没用,有时反而把它引到错字上。想提高成功率,不如把字数砍短、多跑两版挑一版。

字体也能提。写「衬线体」「手写体」「粗黑体」这类描述它会试着靠,但指定具体字体名基本没用,它认不出来。真要精确到某款字体,出图后在排版软件里重排更靠谱。

中英混排时英文比中文稳。设计允许的话,主标题用中文短句,英文只放一行小字,成功率会高不少。

挑图的优先级我定死了:文字全对排第一,画面好不好看排第二。一次出四张,只要有一张字是对的,哪怕构图平庸也留它,因为字错一点整张就废了。

生成完一定要放大看。缩略图整体看着挺好,点开放大才发现某个字的笔画多了一撇,这种只有逐个字检查才看得见。发现错字我一般不硬修,换个种子重出一版更省事。

导出分辨率和放大选项以官网实际为准。如果放大后字的边缘发虚,别硬拉清晰度,回头换个种子重出一版更干净。那张读书会海报最后是第三版成的,五个字全对,只有日期那行我后期重排了一遍。

品牌 logo 别指望它画对。我的做法是让它在 logo 位置留出干净的空白,导出后自己把矢量标贴上去,比让它硬画一个歪商标体面得多。

有个坑得提前说:它对中文长句和竖排的支持偏弱,做对联、竖排标题这类需求,出图成功率明显低于横排短句。真要竖排,我倾向于让它出一张纯图,文字后期自己加。

还有一点,图里的文字只要涉及品牌名、价格、日期,出图后必须自己再核一遍。把「10月18日」写成「10月16日」这种事我遇到过两次,直接发出去就是事故。

它的短板也说清楚:画面审美和氛围不如那些主流的通用绘画模型,同一个提示词跑出来的构图常常偏平淡。所以我的做法是在通用模型里挑一张满意的画面,再拿去给 Ideogram 配文字,两头各取所长。

上面那条路我现在跑得很熟了。通用画面那一步我换成了 即梦AI,中文写提示词它就接得住,先在里面挑一张氛围到位的横向构图存下来,再作为参考图交给 Ideogram 加字。两个工具各管一段,比在一个模型里反复抽卡省事,通常两三版能出一张满意的。

传参考图有个坑:它可能连背景和物件位置一起改掉。我在提示词末尾补一句「保留参考图的构图和配色,只添加文字」,画面就稳得多。

整套物料要做得齐整,我把最后定稿的图丢进 创客贴 再排一次版,标题、日期、二维码对齐压好,社交平台和印刷版各存一份。

更多图像工具见 AI 图像工具。

你最近想做的那张带字海报,标题是几个字?把字数和大概风格发我,我可以先帮你拟一版提示词试试。