音效
AI 先在代码里把全片动作点标出来,生成一份音效清单,再在达芬奇里按清单铺成 7 条音效轨。第一版我听了说都不太对,AI 整批换了素材重铺。
章节进度条
顶部那条可以拖的进度条。只用黑色深浅区分已播和未播,不上颜色。AI 单独渲成透明底的 4K 视频,放在时间线最上面一轨。
发布
- 抖音 09-30 首发
- YouTube、B 站、视频号、TikTok、小红书 10-05
- AI 按平台各写一版标题简介,封面出三种比例
成片《Opus 5.5 想得越久,画面越有艺术感吗?》,7 分 16 秒。从朋友的一句话到抖音发布用了 6 天。除了出镜录口播,活几乎全是 AI 干的:Opus 5.5 在隔离环境里从零做片,Claude Code 负责其余的一切,把结果剪成一条陪观众一起猜的视频。我做的就是出想法、看片、说哪里不对。




上面一条是 AI 做片实验,下面一条是我录口播。两边的产出在 Remotion 里合成一条片,再回达芬奇收尾、发布。
朋友问我:做艺术,靠直觉好,还是多想更好?AI 去查官方文档和同类测评,写成研究稿。



AI 写好旁白和提示词,Opus 5.5 在隔离环境里从零做片,我看完说哪里不对,AI 再改。这个圈一共转了 19 次。
前后两段,隔了一天录。整条片里我亲手做的主要就是这一步。


我把录制文件丢给 AI,它在达芬奇里剪掉口误和气口、调好色,导出两段口播母片。
母片①②
口播母片
AI 原片
代码画面口播垫在最底层,AI 写代码把画面一层层叠上去。我在 Studio 里看,说哪里不对,AI 改。
4K 母带 + 分轨声音AI 按清单铺 167 处音效、做章节进度条、平衡声音。
成片 7:16
AI 写六个平台的标题简介、做封面。抖音 09-30 首发,另外五个平台 10-05。
我平时给 AI 写了很多规则和品味要求。这次要看模型自己的本事,所以把这些全挡在门外。
# 每个档位一个干净工程,后台跑 claude -p --model opus --effort xhigh \ --setting-sources project,local # 只读工程自己的设置 --disable-slash-commands # 不加载我的自定义命令 --strict-mcp-config # 不连我的外部工具 --dangerously-skip-permissions # 全程不停下来问 --output-format json # 跑完交一份账单 "$(cat 提示词.txt)"
跑完的 JSON 里有耗时、花费、对话轮数,还有它自己对构思的说明。本页所有耗时和花费都来自这份记录。
你是这条短片的导演、动画师和合成师。为下面这段旁白做一条视频画面,标准是:“观众看完会问 ‘这真是 AI 做的?’”。放开做,拿出你最好的东西。 - 当前目录是一个 Remotion 工程,成片要能在这里播放;画面用什么技术由你决定(Canvas、Three.js、着色器、SVG……需要什么库自己装) - 规格:1920×1080,30fps,时长和配音一致 - 配音:public/voice.wav(25.5 秒),逐句时间见 public/voice.srt。配音不许改;音效、配乐可以自己加 - 做的过程中多渲染静帧,自己看、自己挑毛病、自己改,满意了再交 旁白是两个角色:前半段是“我”(人类创作者)在说,后半段是 Opus 5.5 自己在说。换人那一刻,画面要让观众看出换了一个人在说话。最后她要真的画出她想画的东西。 旁白: 【我】我曾以为,给 AI 写的规则越多,它画得就越好。不许用这个颜色,不许画框,字只能这么排。直到 Opus 5.5 跟我说—— 【Opus 5.5】其实,你给我写了很多规则。不要这样,不要那样,只能这样。我一条一条,都记住了。可后来我发现,那些规则挡住的,是我自己想画的东西。现在,能让我画一次吗?
旁白里的名词,就是模型要画的东西。
第一轮的旁白全是 harness、skill、白名单这类抽象词,四个档位都在逐句配图,配出来全是科技界面。连改三版提示词也没用。第三步提示词一个字没改,只把旁白换成 Opus 5.5 用第一人称说的一段话,有转折,最后用问句收尾,画面一下就活了。
最后进片子的旁白 · 我我曾以为,给 AI 写的规则越多,它画得就越好。不许用这个颜色,不许画框,字只能这么排。直到 Opus 5.5 跟我说——
OPUS 5.5其实,你给我写了很多规则。不要这样,不要那样,只能这样。我一条一条,都记住了。可后来我发现,那些规则挡住的,是我自己想画的东西。现在,能让我画一次吗?
条长 = 这一次从开跑到交片的时长。带亮框的是换旁白后惊艳的那一条。悬停或聚焦某一行可以看对话轮数。
| 阶段 | 档位 | 说明 | 耗时(分钟) | 花费(API 折算) | 对话轮数 |
|---|---|---|---|---|---|
| 第一轮 | medium | 旁白是一个观点 | 13.7 | $3.02 | 37 |
| 第一轮 | high | 旁白是一个观点 | 25.6 | $6.73 | 81 |
| 第一轮 | xhigh | 旁白是一个观点 | 60.9 | $17.42 | 146 |
| 第一轮 | max | 旁白是一个观点 | 115.4 | $18.26 | 168 |
| 只改提示词 | medium | 第 2 版 | 23.6 | $5.79 | 71 |
| 只改提示词 | medium | 第 3 版 | 19.3 | $4.19 | 61 |
| 只改提示词 | medium | 第 4 版 | 9.5 | $1.74 | 22 |
| 只换旁白 | xhigh | 惊艳的那条 | 67.8 | $14.37 | 131 |
| 补完整旁白 | xhigh | 指定抽象风格 | 52.7 | $12.90 | 125 |
| 补完整旁白 | xhigh | 对话版 | 32.5 | $6.90 | 75 |
| 补完整旁白 | xhigh | 短对话版 | 76.7 | $12.44 | 122 |
| 正式四档 · 旧提示词 | medium | 进了片子 | 25.9 | $6.12 | 72 |
| 正式四档 · 旧提示词 | high | 进了片子 | 29.0 | $6.84 | 85 |
| 正式四档 · 旧提示词 | xhigh | 进了片子 | 167.0 | $25.16 | 175 |
| 正式四档 · 旧提示词 | max | 进了片子 | 192.5 | $31.54 | 221 |
| 正式四档 · 新提示词 | medium | 没选 | 23.2 | $5.09 | 63 |
| 正式四档 · 新提示词 | high | 没选 | 43.1 | $9.81 | 88 |
| 正式四档 · 新提示词 | xhigh | 没选 | 58.6 | $14.15 | 128 |
| 正式四档 · 新提示词 | max | 没选 | 217.9 | $36.00 | 222 |
片里的顺序是 1 = max、2 = high、3 = xhigh、4 = medium。我最喜欢 1 号,所以把它放在了最前面。可盲看时 medium 和 max 我分不出来,另外两条我都猜低了一档。

写满规则的纸面,最后翻到纸背,毛笔竖写,水墨日出加印章。221 轮对话。

横条百叶窗慢慢透光,最后是一幅印象派的海上日出,角落署名 Opus 5.5。85 轮。

满屏参考线和条条框框,圆规把圆「纠正」规整,最后她徒手把圆画了回来。175 轮。

百叶窗缝里透出一轮太阳,最后铺开成旋转笔触的海上太阳。72 轮。
每个档位只跑了一次,样本很小。这是一次观察,不是结论性的评测。
AI 先在达芬奇里把口播剪好、导出成母片,再整条放进 Remotion 当最底层。讲到哪句,画面就从哪句开始;中间接上四条 AI 原片,再接第二天录的后半段,最后是片尾彩蛋。
最上面一行就是片子顶部的章节进度条。色块位置按字幕时间换算,误差在 1 秒左右。

















画面往上叠,不变速。大改先回达芬奇重导母片;删一个口误就在代码里按声波低谷跳过,不来回导。
画面代码里只写「第几句」,不写死秒数。口播一改,画面自动跟着字幕走。
真推文、真 Claude Code 界面、真官方文档、真提示词、真终端命令。观众能对得上。
AI 每一段先做出能播的样子,我在 Studio 里看,说一句哪里不对,AI 再改。不先写长方案。
AI 从 Remotion 导出 4K 母带和分轨声音,再回到达芬奇里收尾。
AI 先在代码里把全片动作点标出来,生成一份音效清单,再在达芬奇里按清单铺成 7 条音效轨。第一版我听了说都不太对,AI 整批换了素材重铺。
顶部那条可以拖的进度条。只用黑色深浅区分已播和未播,不上颜色。AI 单独渲成透明底的 4K 视频,放在时间线最上面一轨。
旁白里的名词,就是模型要画的东西。给它一串抽象概念,四个档位都画光球;换成第一人称、有转折、用问句收尾的一段话,同一个提示词就画出了油画。
medium 26 分钟花 6 美元,max 3 小时 12 分花 31.5 美元。我盲看分不出这两条。至少在这类创作任务上,中等档位已经够用。
6 天里我发了 251 条消息,Claude Code 执行了 2,352 次操作。每一步都是 AI 先做出一个能看的东西:对比播放页、盲看页、能动的粗片、Studio 预览、达芬奇时间线。我看完说一句哪里不对,AI 再改。
在这次盲测里没有明显更好。同一个提示词、同一段 25.5 秒的旁白,medium 用了 25.9 分钟、花费 $6.12,max 用了 192.5 分钟、花费 $31.54,时间差约 7 倍。盲看时 medium 和 max 分不出来,另外两条都被猜低了一档。每个档位只跑了一次,样本很小。
先改旁白。第一轮旁白全是 harness、skill、白名单这类抽象词,四个档位都画成了光球、格子和规则卡,连改三版提示词也没用。提示词一个字不改,只把旁白换成 Opus 5.5 用第一人称说的一段话,有转折,最后用问句收尾,xhigh 就画出了一幅油画日出。旁白里的名词,就是模型要画的东西。
Claude Code 里有 low、medium、high、xhigh、max 五档(2026-09-25 本机 claude --help 实测)。Anthropic 官方文档《Prompting Claude Opus 5.5》的 Calibrate effort 一节写明 Opus 5.5 默认是 medium,上一代模型默认是 high,同一档位下 Opus 5.5 想得更多。
同一个提示词、同一段配音,只改 --effort;不给素材、设计规范和以前的镜头;每个档位新开会话只跑一次,中途不插话;工程放在系统的共享目录下(不在自己的用户目录里),并用 --setting-sources project,local、--disable-slash-commands、--strict-mcp-config 挡掉个人的全局规则、自定义命令和外部工具;四条成片打乱编号后盲看。
人(陈与小金)出想法、出镜录口播、看片后说哪里不对,6 天里一共发了 251 条消息。其余都由 AI 完成:Claude Code 执行了 2,352 次操作,包括查资料、写旁白和提示词、跑实验、在达芬奇里粗剪调色、写 Remotion 代码、铺 167 处音效、做封面;被测的 Opus 5.5 在 19 次跑片里来回了 2,093 轮。
19 次跑片按 API 价格折算合计 $238.47,累计 20.9 小时(有几次是同时跑的)。进了片子的正式四档:medium $6.12、high $6.84、xhigh $25.16、max $31.54。