
说不清想要什么时,先让 AI 做三个小样
说不清想要什么时,先让 AI 做三个小样
Thariq Shihipar 用 Claude Code 剪 Fable 发布视频时,手里的工具很具体:Whisper 做转录,ffmpeg 根据时间点剪掉停顿,Remotion 把字幕和画面拼起来。

做到调色,他卡住了。视频看起来发灰,他知道问题大概在 color grading,却不知道”好”应该长什么样。最初的反应是让 Claude 多做几个版本供他挑。做着做着,他发现自己连比较标准都没有,于是停下来,先让 Claude 教他调色。
这个细节很有意思。小样能解决”说不出来但看得出来”,却不能替你补上完全缺失的知识。什么时候该先看三个版本,什么时候该先补课,边界就在这里。

三个版本用来找偏好
页面信息密度、文章开头的语气、图表先讲趋势还是先讲异常,这些要求很难凭空写准。方案摆在眼前,人通常马上有反应:这个太挤,那个重点不对,第三个虽然顺眼,但把最重要的数据藏到了下面。
这种反馈不是挑毛病。它在帮你把原本说不出的判断变成规则。
小样真正的用处是另一个方向:把说不清的偏好变成可以说出来的判断。它不是半个成品,用完就该直接扔掉。
所以小样要故意拉开差异。三个深色卡片,只换了圆角和阴影,没有比较价值。更好的做法是让一个版本偏紧凑,一个突出异常处理,另一个改变信息顺序。内容和假数据保持一致,只动你还没有拿定主意的部分。
数量也不用迷信。两个版本有时已经够用,四个也不算错。“三个”只是一个舒服的起点:能比较,又不至于看完十张图后只想把它们拼在一起。

先把正式项目放远一点
Thariq 在文中给过一个很实在的例子:想看编辑器工具栏怎么摆,先让 Claude 做一个使用假数据的单文件 HTML,不接后端,也不维护真实状态。方向确认后,再碰正式应用。
剪发布视频时,他也先用 Remotion 和一小段转录做 prototype,验证画面能不能跟说话时间对上。整条视频还没开始精修,最不确定的技术连接已经单独跑过。这个顺序比让 Agent 直接剪完,再看字幕是否跟得上,要便宜得多。
这是小样最容易被忽略的约束。Agent 写得太快,人会忍不住说”顺便把接口也接了”。等状态管理、测试和数据结构都补上,这个版本就很难扔。讨论会从”方向对不对”滑成”已经做了这么多,怎么改省一点”。
小样应当小到全部作废也不心疼。页面用假数据,文章只写三段,操作流程只串最关键的两步。如果三个都不对,删掉重来。
一句很短的任务就能约束它:“先别改正式项目,用同一份数据做三个差异明显的单文件版本。我选定方向后再实现。“至于差异放在哪,要根据当前拿不准的地方补一句,不需要附一张通用检查表。
如果 Agent 做出的三个版本只换颜色,可以直接退回。那说明任务里没有指出当前拿不准的是信息顺序、操作路径还是视觉气质。样品之间的差异必须对应一个真实选择,否则只是一次昂贵的配色抽奖。
选完以后,把原因留下
“用第二个”还不够。第二个到底对在哪里,下次增加页面时仍然会丢。
选择之后,可以要求 Agent 记录三五条原因。比如:先显示异常订单,再给总量;筛选项默认折叠;颜色只用于状态,不拿来装饰。它们才是这轮比较得到的东西。
如果三个方案都不满意,也要找共同问题。也许它们都默认用户先看全局,而你关心的是当天异常;也许三个开头都在解释背景,你其实想从一个具体错误切入。共同问题说清楚,下一轮才不会只是重新抽奖。
回到 Fable 视频那个例子。调色版本再多,也无法帮一个完全不懂调色的人判断肤色、对比度和饱和度。Thariq 后来先补了这块知识,再回去看方案。这个转向让”小样法”没那么万能,反而更可信。说不清但看得出好坏时,用三个版本把偏好逼出来。连好坏都分辨不了时,先补课,再回头看方案。
你不必在看见方案前,把每个要求都翻译成专业术语。先做几个便宜版本,通常能把偏好逼出来。逼不出来的那部分,才是该补的课。
