Ridvay 到底是怎么工作的(从一句话到可编辑设计)
在 Ridvay 里输入这么一句:“做一张每周开放麦之夜的海报,每周四晚上 8 点,免费入场,风格大胆现代。”
大约二十秒后,海报就出来了。OPEN MIC 几个大字压在顶上,日期在下面,一块照片区,场地名字放在角落。这一步并不稀奇——能把一句话变成一张图的工具满大街都是。
稀奇的是接下来这一步:点一下 OPEN 这个词,光标就出现了。不是框住一片像素的选区,而是一个真正的文字光标,落在一个文本图层里,右侧面板上还列着字体名、字重和颜色。换个字体,什么都不用重新生成。照片不会挪窝。海报的其余部分也不会趁你不注意,悄悄重画成你根本没要过的样子。
这个差别就是这个产品的全部,而头一回用 Ridvay 的人,几乎都没意识到它就在那儿。所以,下面就讲讲从你那句话到那张海报之间,到底发生了什么。
模型不是在画图,而是在写一份文档
你发出提示词的时候,AI 并不是在生成图像,而是在写一份描述这个设计的结构化文档。我们内部管它叫 IR。剥掉外壳,其中一个元素大致长这样:
{ "type": "text", "x": 240, "y": 570, "width": 620,
"lines": [{ "text": "OPEN", "fontFamily": "Poppins",
"fontSize": 130, "fontWeight": 800, "color": "#ffffff" }] }
一个页面有宽度、高度、背景,以及一串元素。每个元素要么是文本块,要么是形状,要么是图片,各自都清楚自己待在哪儿、长什么样。模型要做的,就是把这些数字定得漂亮——OPEN 该是 130px、白色、靠上;日期该只有它的五分之一大;两者之间该有一条分隔线。
所以 AI 干的其实是设计活儿——层级、留白、配色、字体搭配——然后把结论写下来。它不是在作画。
其余的一切,都由此而来。
所以你才改得动它
图像模型给你的是一片像素。想让标题大一点,唯一的办法就是再问一遍,然后祈祷。这种事你肯定都经历过:好不容易出了个八九不离十的结果,你只提了一处修改,下一版却换了照片、换了气氛,还多出一个拼写错误。你喜欢的那一版就这么没了。回不去,因为压根就没有可改的结构,只有一张可以重摇的图。
而 Ridvay 输出的是一份文档,所以“把标题放大”不过是一个数字从 130 变成 180。文件里别的东西一动不动。你喜欢的那张照片还是那张照片。你挑的那个颜色还是那个颜色。
落到实处,真正好用的流程是这样的:
- 生成一次,拿到一个起始版式。
- 点中不对劲的那个东西。
- 直接把它改掉。
第 3 步是大家最爱跳过的一步,也恰恰是它,把一份平庸的初稿变成真能摆进橱窗的东西。这篇文章如果你只带走一句话,那就是这句:第一次生成出来的是草稿,不是成品。 关于这一点,如何修改 AI 生成的设计而不必推倒重来里讲得更细。
图片是从哪儿来的
设计需要图片,而根据设计要什么,图片有三个不同的来源。
真实照片优先。 如果一个设计需要照片质感的背景——一盘菜、一群人、一条街——那生成图像基本就是选错了工具。生成出来的食物,一眼就看得出是生成的。所以 Ridvay 会先去找一张真实的图库照片(Pexels),再考虑别的路子。免费,而且它看起来像照片,因为它本来就是照片。
图标、标志和形状取自素材库。 当设计需要一只咖啡杯、一个 wifi 图形、一个国家的轮廓,或者一个品牌 logo,这些都不是现画的——模型写下一个规范键名,比如 icon:coffee 或 geo:us-texas,再由渲染器把它解析成真正的矢量图形。这一点很关键,因为 AI 现画的图标,正是设计露怯的地方。一个标着“杯子”的矩形,看上去就是个蓝方块。
生成图像是兜底方案,留给那些图库里根本不存在的东西——某种特定的插画风格、一个虚构的产品、一张超现实的背景。
一份文档怎么变成 PNG
总有你想要一个文件的时候。渲染器读这份文档,然后把它画出来——文字、形状、图片,按你要的倍率直接绘制到位图上。不走浏览器,也不是截图。同一套绘制代码,既能出 1080×1350 的社交贴图,也能出印刷尺寸的海报;变的只有数字。(少数早年的场景——图表,以及某些特殊动效——仍然走此前那套基于浏览器的渲染器。)
真正难的是字体,而原因跟你猜的正好相反。浏览器是宽容的:给它一个没有西里尔字母的字体,它会不声不响换一个,于是俄语标题顶多看着跟设计稿有点出入,而不是一个 bug。直接绘制则毫不宽容——缺一个字形,你的海报上就明晃晃杵着一个豆腐块。
所以在画下第一个字符之前,渲染器会拿字体真实的字形表,去比对你文本里真实的字符,然后换成一款画得出来的字体。Archivo Black 是一款极出色的海报字体,收了 423 个字形。它一直好看到有人开始打俄语——然后它就有意见了。
动效就是同一份文档加一条时间轴
视频不是一个自带编辑器的独立功能。给一个设计做动画,只是往你已有的那些元素上挂时间信息——这个标题往上滑,那个徽标晚 200ms 淡入,这几行依次错开出现。
渲染的方式,跟浏览器执行 CSS transform 动画是一个道理:每个元素只画一次,之后每一帧无非是把这个已经画好的图层做位移、淡入淡出或缩放。帧一边产出,一边直接流进视频编码器,中间不落盘。
这就意味着,一张海报和一段 25 秒的竖版视频,本质上是同一个文件,只是关于时间的指令不同。改一下标题文字,两边一起更新。我们自己社交账号上的视频就是这么做的;这篇文章的封面图也是。
那些没人发现的部分
有四样东西就在一步之遥,却几乎没人用:
- Brand Kit。 把你的配色、字体和 logo 存一次,之后任何设计都能套用。这就是“一张 AI 海报”和“你的海报”之间的差别。
- 改尺寸。 一个设计重排成竖屏故事、信息流和印刷版。是重排——版式会按新的画幅重新计算,而不是硬拉变形。参见怎么把一个设计适配到每一个社交平台。
- 实时图片链接。 分享一个设计,你会拿到一个网址,它把当前版本渲染成 PNG。把它嵌进网站或邮件里,设计一改它就跟着变。再把倒计时绑到某个日期上,图上的数字自己会往下走。
- MCP 服务器。 如果你用 Claude、Copilot 或别的 MCP 客户端,它可以直接生成并导出设计——全程不碰浏览器。上个月经由 Ridvay 做出的设计,差不多有一半是这么来的。
它不擅长什么
一份诚实的清单,反正你早晚也会撞上:
- 长文案。 超出一个标题、一个副标题和几行字之后,就开始挤了。海报不是宣传册,而模型会拼命把你给的东西全塞进去。
- 精确还原品牌。 它能一丝不差地用你的颜色和字体,但没法凭一段描述把你那个特定的 logo 重画出来——直接上传。
- 精细的排版控制。 字偶距、视觉对齐、标点悬挂。要是你在意到这个份上,那你是设计师,你会想导出去,在别处收尾。
- 读心术。 “做得抓眼球一点”换不来任何有用的东西。“把标题放大一倍,背景换成纯深藏青”就能精确得到那个结果。
现在就动手,大约一分钟
打开 Studio,把这段话粘进去:
给一家酒吧的每周开放麦之夜做一张海报,每周四晚上 8 点,免费入场,超大号粗体标题,深色背景配一种强调色,左下角放场地的小 logo。
回来的是一个可编辑的设计——文本图层、形状、一块照片区,全都能单独选中。然后按这个顺序做三处修改:
- 点中标题,把字号往上拖,一直拖到略微有点过火为止。几乎每一份 AI 初稿在尺度上都太拘谨,而尺度恰恰是让一张海报隔着半个屋子也看得清的东西。
- 把强调色换成你真正的品牌色。在色块上点一下就行;照片和文字纹丝不动。
- 删掉点什么。 总有那么一行是不干活的。三条信息的海报,胜过六条信息的海报。
这就是全部的流程,也正是这篇文章想说服你的事:生成一次,然后动手改——而不是重摇五次,指望这回运气好点。
一句话版本
你打一句话。模型写出一份设计文档。渲染器把它变成一张图、一个印刷文件,或者一段视频——而因为那份文档始终还在底下躺着,其中的每一个部件都仍然归你,随时可改。
拿你自己的海报试一次 → —— 免费开始,每一个图层都可编辑。