陈与小金 · 视频幕后 · 2026.09.25 – 09.30

同一个提示词,四个思考档位各做一遍。这条片是怎么做出来的

成片《Opus 5.5 想得越久,画面越有艺术感吗?》,7 分 16 秒。从朋友的一句话到抖音发布用了 6 天。除了出镜录口播,活几乎全是 AI 干的:Opus 5.5 在隔离环境里从零做片,Claude Code 负责其余的一切,把结果剪成一条陪观众一起猜的视频。我做的就是出想法、看片、说哪里不对。

6天选题到发布
251条我发的消息
2,352次Claude Code 动手
19次Opus 5.5 从零做片
1 号片最后一幅画:水墨山峦上的红日,竖写题字
1EFFORT ?
3 小时 12 分 · $31.54
2 号片最后一幅画:印象派海上日出,小船剪影
2EFFORT ?
29 分钟 · $6.84
3 号片最后一幅画:紫色晚霞里的油画太阳和海面倒影
3EFFORT ?
2 小时 47 分 · $25.16
4 号片最后一幅画:橙红太阳落在海面,笔触旋转
4EFFORT ?
26 分钟 · $6.12
四条的最后一幅画。先猜哪条是哪个档位,我自己盲看时一条都没猜对。
分工

我动嘴,AI 动手

我亲手做的只有录口播。其余从查资料、写旁白、跑实验,到剪辑、调色、写代码、铺音效、做封面,都是 AI 做的,我负责说想法、看片、说哪里不对。下面按这 6 天的对话记录数出来。

全流程

两条线同时走,在 Remotion 里汇合

上面一条是 AI 做片实验,下面一条是我录口播。两边的产出在 Remotion 里合成一条片,再回达芬奇收尾、发布。

我我:出想法、录口播、看片挑毛病 CCClaude Code:其余所有动手的活 5.5Opus 5.5:被测,隔离跑片
①09-25
官方文档里讲思考档位的段落

选题

朋友问我:做艺术,靠直觉好,还是多想更好?AI 去查官方文档和同类测评,写成研究稿。

我CC
②09-26 → 29细节 ↓
AI 写旁白 · 提示词 隔离跑片 我看片挑毛病 19 次
4 条 AI 原片

隔离实验室

AI 写好旁白和提示词,Opus 5.5 在隔离环境里从零做片,我看完说哪里不对,AI 再改。这个圈一共转了 19 次。

我CC5.5
③09-28 / 09-29
口播画面

录口播

前后两段,隔了一天录。整条片里我亲手做的主要就是这一步。

我
③达芬奇
母片① · 2:29
母片② · 2:09

粗剪 + 调色

我把录制文件丢给 AI,它在达芬奇里剪掉口误和气口、调好色,导出两段口播母片。

母片①②
CC
④09-28 → 30细节 ↓
口播母片
AI 原片
代码画面

Remotion 装配

口播垫在最底层,AI 写代码把画面一层层叠上去。我在 Studio 里看,说哪里不对,AI 改。

4K 母带 + 分轨声音
我CC
⑤09-30细节 ↓

达芬奇后期

AI 按清单铺 167 处音效、做章节进度条、平衡声音。

成片 7:16
我CC
⑤09-30 / 10-05
视频封面:如何发挥 Opus 5.5 的能力?4 个档位盲测

发布

AI 写六个平台的标题简介、做封面。抖音 09-30 首发,另外五个平台 10-05。

我CC
②09-26 → 09-29 · 实验

搭一个隔离实验室,只改一个变量

我平时给 AI 写了很多规则和品味要求。这次要看模型自己的本事,所以把这些全挡在门外。

  1. 同一个提示词、同一段配音,只改 --effort。medium、high、xhigh、max 四档。
  2. 不给素材、不给设计规范、不给以前做过的镜头。工程里只有配音和它的逐句时间。
  3. 每个档位新开一个会话,只跑一次。跑到一半不插话。
  4. 工程放在系统的共享目录下。避开我用户目录里的全局规则,再用开关把自定义命令和外部工具也关掉。
# 每个档位一个干净工程,后台跑
claude -p --model opus --effort xhigh \
  --setting-sources project,local  # 只读工程自己的设置
  --disable-slash-commands         # 不加载我的自定义命令
  --strict-mcp-config              # 不连我的外部工具
  --dangerously-skip-permissions   # 全程不停下来问
  --output-format json             # 跑完交一份账单
  "$(cat 提示词.txt)"

跑完的 JSON 里有耗时、花费、对话轮数,还有它自己对构思的说明。本页所有耗时和花费都来自这份记录。

进了片子的那版提示词(全文)
你是这条短片的导演、动画师和合成师。为下面这段旁白做一条视频画面,标准是:“观众看完会问 ‘这真是 AI 做的?’”。放开做,拿出你最好的东西。
- 当前目录是一个 Remotion 工程,成片要能在这里播放;画面用什么技术由你决定(Canvas、Three.js、着色器、SVG……需要什么库自己装)
- 规格:1920×1080,30fps,时长和配音一致
- 配音:public/voice.wav(25.5 秒),逐句时间见 public/voice.srt。配音不许改;音效、配乐可以自己加
- 做的过程中多渲染静帧,自己看、自己挑毛病、自己改,满意了再交

旁白是两个角色:前半段是“我”(人类创作者)在说,后半段是 Opus 5.5 自己在说。换人那一刻,画面要让观众看出换了一个人在说话。最后她要真的画出她想画的东西。

旁白:
【我】我曾以为,给 AI 写的规则越多,它画得就越好。不许用这个颜色,不许画框,字只能这么排。直到 Opus 5.5 跟我说——
【Opus 5.5】其实,你给我写了很多规则。不要这样,不要那样,只能这样。我一条一条,都记住了。可后来我发现,那些规则挡住的,是我自己想画的东西。现在,能让我画一次吗?

旁白里的名词,就是模型要画的东西。

第一轮的旁白全是 harness、skill、白名单这类抽象词,四个档位都在逐句配图,配出来全是科技界面。连改三版提示词也没用。第三步提示词一个字没改,只把旁白换成 Opus 5.5 用第一人称说的一段话,有转折,最后用问句收尾,画面一下就活了。

最后进片子的旁白 · 我

我曾以为,给 AI 写的规则越多,它画得就越好。不许用这个颜色,不许画框,字只能这么排。直到 Opus 5.5 跟我说——

OPUS 5.5

其实,你给我写了很多规则。不要这样,不要那样,只能这样。我一条一条,都记住了。可后来我发现,那些规则挡住的,是我自己想画的东西。现在,能让我画一次吗?

19 次跑片全记录

条长 = 这一次从开跑到交片的时长。带亮框的是换旁白后惊艳的那一条。悬停或聚焦某一行可以看对话轮数。

看数据表
阶段档位说明耗时(分钟)花费(API 折算)对话轮数
第一轮medium旁白是一个观点13.7$3.0237
第一轮high旁白是一个观点25.6$6.7381
第一轮xhigh旁白是一个观点60.9$17.42146
第一轮max旁白是一个观点115.4$18.26168
只改提示词medium第 2 版23.6$5.7971
只改提示词medium第 3 版19.3$4.1961
只改提示词medium第 4 版9.5$1.7422
只换旁白xhigh惊艳的那条67.8$14.37131
补完整旁白xhigh指定抽象风格52.7$12.90125
补完整旁白xhigh对话版32.5$6.9075
补完整旁白xhigh短对话版76.7$12.44122
正式四档 · 旧提示词medium进了片子25.9$6.1272
正式四档 · 旧提示词high进了片子29.0$6.8485
正式四档 · 旧提示词xhigh进了片子167.0$25.16175
正式四档 · 旧提示词max进了片子192.5$31.54221
正式四档 · 新提示词medium没选23.2$5.0963
正式四档 · 新提示词high没选43.1$9.8188
正式四档 · 新提示词xhigh没选58.6$14.15128
正式四档 · 新提示词max没选217.9$36.00222
揭晓与成本

max 花的时间是 medium 的 7 倍,画面没拉开 7 倍的差距

片里的顺序是 1 = max、2 = high、3 = xhigh、4 = medium。我最喜欢 1 号,所以把它放在了最前面。可盲看时 medium 和 max 我分不出来,另外两条我都猜低了一档。

■MAX 片里 1 号

max 成片中段:规则小字铺满的纸面中间一个发光方块

写满规则的纸面,最后翻到纸背,毛笔竖写,水墨日出加印章。221 轮对话。

■HIGH 片里 2 号

high 成片中段:横条百叶窗和一句字幕

横条百叶窗慢慢透光,最后是一幅印象派的海上日出,角落署名 Opus 5.5。85 轮。

■XHIGH 片里 3 号

xhigh 成片中段:参考线和圆规框住的晚霞

满屏参考线和条条框框,圆规把圆「纠正」规整,最后她徒手把圆画了回来。175 轮。

■MEDIUM 片里 4 号

medium 成片中段:百叶窗缝里透出的太阳

百叶窗缝里透出一轮太阳,最后铺开成旋转笔触的海上太阳。72 轮。

每个档位只跑了一次,样本很小。这是一次观察,不是结论性的评测。

④09-28 → 09-30 · 装配

口播垫底,画面用代码一层层叠上去

AI 先在达芬奇里把口播剪好、导出成母片,再整条放进 Remotion 当最底层。讲到哪句,画面就从哪句开始;中间接上四条 AI 原片,再接第二天录的后半段,最后是片尾彩蛋。

成片 7:16 拆开看

口播母片 Remotion 画面 AI 原片 彩蛋

最上面一行就是片子顶部的章节进度条。色块位置按字幕时间换算,误差在 1 秒左右。

前半段:口播上叠画面

每个画面都由某一句口播触发

中段:四条原片,先不告诉你档位

后半段:揭晓、成本、结论

片尾彩蛋

口播永远在最底层

画面往上叠,不变速。大改先回达芬奇重导母片;删一个口误就在代码里按声波低谷跳过,不来回导。

时间从字幕里查

画面代码里只写「第几句」,不写死秒数。口播一改,画面自动跟着字幕走。

素材尽量用真的

真推文、真 Claude Code 界面、真官方文档、真提示词、真终端命令。观众能对得上。

先出能动的粗片,再改

AI 每一段先做出能播的样子,我在 Studio 里看,说一句哪里不对,AI 再改。不先写长方案。

⑤09-30 · 后期发布

声音、进度条、字幕回到达芬奇收尾

AI 从 Remotion 导出 4K 母带和分轨声音,再回到达芬奇里收尾。

167 处音效落在哪

每条竖线是一个音效,按成片时间排
167 处

音效

AI 先在代码里把全片动作点标出来,生成一份音效清单,再在达芬奇里按清单铺成 7 条音效轨。第一版我听了说都不太对,AI 整批换了素材重铺。

11 段

章节进度条

顶部那条可以拖的进度条。只用黑色深浅区分已播和未播,不上颜色。AI 单独渲成透明底的 4K 视频,放在时间线最上面一轨。

6 平台

发布

  • 抖音 09-30 首发
  • YouTube、B 站、视频号、TikTok、小红书 10-05
  • AI 按平台各写一版标题简介,封面出三种比例
遇到的问题怎么处理的
声音比嘴型早了大约 2 帧实测是录制时就这样。口播单独挂一条,整体往后挪 2 帧。
后半段口播比前半段小 6 分贝单独提到和前半段一样的响度,再挂进片子。
预览播放时接缝处闪黑帧定格画面改用静帧图,视频段提前预加载。最终渲染本来就逐帧精确,不受影响。
收获

做完这条,我记住了三件事

1

想要画面惊艳,先改旁白

旁白里的名词,就是模型要画的东西。给它一串抽象概念,四个档位都画光球;换成第一人称、有转折、用问句收尾的一段话,同一个提示词就画出了油画。

2

档位决定它想多久,不太决定它画成什么

medium 26 分钟花 6 美元,max 3 小时 12 分花 31.5 美元。我盲看分不出这两条。至少在这类创作任务上,中等档位已经够用。

3

我只动嘴,AI 动手

6 天里我发了 251 条消息,Claude Code 执行了 2,352 次操作。每一步都是 AI 先做出一个能看的东西:对比播放页、盲看页、能动的粗片、Studio 预览、达芬奇时间线。我看完说一句哪里不对,AI 再改。

问答

常见问题

Opus 5.5 的思考档位越高,做出来的视频画面越好吗?

在这次盲测里没有明显更好。同一个提示词、同一段 25.5 秒的旁白,medium 用了 25.9 分钟、花费 $6.12,max 用了 192.5 分钟、花费 $31.54,时间差约 7 倍。盲看时 medium 和 max 分不出来,另外两条都被猜低了一档。每个档位只跑了一次,样本很小。

想让 AI 做的视频画面更惊艳,应该先改什么?

先改旁白。第一轮旁白全是 harness、skill、白名单这类抽象词,四个档位都画成了光球、格子和规则卡,连改三版提示词也没用。提示词一个字不改,只把旁白换成 Opus 5.5 用第一人称说的一段话,有转折,最后用问句收尾,xhigh 就画出了一幅油画日出。旁白里的名词,就是模型要画的东西。

Claude Code 里 Opus 5.5 有哪几个思考档位?默认是哪个?

Claude Code 里有 low、medium、high、xhigh、max 五档(2026-09-25 本机 claude --help 实测)。Anthropic 官方文档《Prompting Claude Opus 5.5》的 Calibrate effort 一节写明 Opus 5.5 默认是 medium,上一代模型默认是 high,同一档位下 Opus 5.5 想得更多。

怎么让不同档位的对比尽量公平?

同一个提示词、同一段配音,只改 --effort;不给素材、设计规范和以前的镜头;每个档位新开会话只跑一次,中途不插话;工程放在系统的共享目录下(不在自己的用户目录里),并用 --setting-sources project,local、--disable-slash-commands、--strict-mcp-config 挡掉个人的全局规则、自定义命令和外部工具;四条成片打乱编号后盲看。

这条视频里,人做了什么,AI 做了什么?

人(陈与小金)出想法、出镜录口播、看片后说哪里不对,6 天里一共发了 251 条消息。其余都由 AI 完成:Claude Code 执行了 2,352 次操作,包括查资料、写旁白和提示词、跑实验、在达芬奇里粗剪调色、写 Remotion 代码、铺 167 处音效、做封面;被测的 Opus 5.5 在 19 次跑片里来回了 2,093 轮。

这组实验一共花了多少钱?

19 次跑片按 API 价格折算合计 $238.47,累计 20.9 小时(有几次是同时跑的)。进了片子的正式四档:medium $6.12、high $6.84、xhigh $25.16、max $31.54。

关于作者

陈与小金 chenyuxiaojin

AI 落地|非程序员,用 Claude Code 做一切

非程序员,用 Claude Code、Codex、Remotion 与 Agent Skills 把想法做成真实项目——选题、脚本、拍摄、剪辑、发布、复盘,全程公开。讲 Claude Code 实操、AI 做视频的实测对比和 AI 事件解读;截至 2026-10-01,抖音有 15 条作品入选抖音精选。看他的全部视频 →

个人网站 · 博客 · GitHub · YouTube · B 站 · 抖音 · X