陈与小金 · 视频幕后 · 2026.10.01 – 10.08

12 段特效,全是 Opus 5.5 从零写代码做的。这条片是怎么做出来的

成片《如何选择正确的模型档位?》,9 分 52 秒。从定题到抖音发布用了 8 天。我写稿、出镜录口播,看完说哪里不对;其余的活是 AI 干的:Opus 5.5 在空工程里一段一段做特效,Claude Code 管研究、剪辑、装配、后期和发布。

8天定题到发布
244条我发的消息
2,244次Claude Code 动手
51次Opus 5.5 从零做特效
评论区在问特效是开的 max 还是 high?特效、画面转场是 Opus 5.5 做的吗?这视频是怎么做的?
1EFFORT ?
跑了 9 版 · 耗时花费未记
2EFFORT ?
41 分钟 · $10.22
3EFFORT ?
21 分钟 · $4.03
4EFFORT ?
20 分钟 · $4.00
片里的 4 段特效。先猜各开的哪一档,再点开看。
分工

我动嘴,AI 动手

我亲手做的是写逐字稿和出镜录口播。其余从查资料、事实核查、剪辑,到做特效、装配、铺音效、上字幕、做封面,都是 AI 做的。我负责定题、看片、说哪里不对、拍板。下面按这 8 天的对话记录数出来。

全流程

一条主线,中间分出一个个空工程

上面一行是口播:我写稿、录制,AI 核查、粗剪。下面一行是特效:Claude Code 把口播一段段切出来,各开一个空工程派给 Opus 5.5。两边在主工程里汇合,再做后期、发布。

我我:定题、写稿、录口播、看片挑毛病 CCClaude Code:主工程里所有动手的活 5.5Opus 5.5:在空工程里做特效
①10-01
成片里的一帧:官方文档、论文、测试结果三份材料并排

选题和研究

我定题:模型档位开高,反而变差。AI 查官方发布页、论文、文档,抓 22 条同类视频的字幕,写成研究稿。

我CC
②10-02 → 03
口播画面

写稿和录口播

我写逐字稿、出镜录制。10-03 录到一半相机断了,后半段补录。

我
②10-03
口播母片 · 9:52

事实核查 + 粗剪

AI 对着逐字稿核事实,在达芬奇里剪掉口误和气口,出口播母片。

口播母片
CC
③10-04 → 07细节 ↓
切口播 · 开空工程 写代码 · 自己看 我挑一版 51 次跑片
12 段特效

做 12 段特效

一段画面一个空工程,Opus 5.5 写代码、渲静帧、自己看、自己改。16 批,最多 7 个同时跑。我看交片,几版里挑一版、说哪里不对。

我CC5.5
④10-05 → 08细节 ↓
口播母片
特效
章节卡

主工程装配

AI 把选中的特效搬回主工程,加章节卡、推近跳切、克隆音换句。我在预览里看,说哪里不对,AI 改。

成片 9:52
我CC
④10-07/08细节 ↓

音效和字幕

AI 铺 298 处音效、上 301 条字幕、做 6 段章节进度条。

CC
⑤10-07 → 08
视频封面

发布

AI 写六个平台的标题简介、做三种比例的封面。抖音 10-08 首发,另外五个平台计划 10-13。

我CC
③10-04 → 10-07 · 做特效

一段画面一个空工程,Opus 5.5 从零写

Claude Code 把口播按段切出来,每段开一个空的 Remotion 工程,派给 Opus 5.5。画面长什么样、用什么技术,都由它自己定。

  1. 一段画面,一个空工程。12 段各做各的,互不干扰,可以同时跑。
  2. 怎么做,它自己定。镜头怎么走、用什么技术、画面里放什么,都是 Opus 5.5 拿主意。
  3. 写代码 → 渲静帧 → 打开图片看 → 改。51 次跑片里,它一共打开了 1,129 次自己渲的图,平均每次 22 张。
  4. 交片时附一份出片说明。我看完在几版里挑一版、说哪里不对;Claude Code 再把选中的版本搬回主工程。

51 次跑片,分 16 批

一列是一批同时开跑的工程,一格是一次跑片。10-05 15:51 那批一次开了 7 个。带亮框的是进了片子的版本。

它自己查出来、主动做的事

摘自 Opus 5.5 每次交片时自己写的出片说明
③ 官方评分图改之前先确认没碰坏

只改后半段。动手前后把前半段几帧新旧版逐字节比对,确认前面一帧没动。

① 官方证据自己找到白方框的原因

快速滚动时,画面中间会冒出一个发白的方框。它查出是运动模糊的作用范围没设对,修好了。

⑨ 回看上期自己重测口播时间

用 whisper 重新对了一遍每个字的时间,再对着音量波形校停顿,发现原来的时间表有几处差了 10–15 帧,动画按校正后的时间卡。

⑪ 我怎么选换档对到具体帧号

念到 high 是第 72 帧,xhigh 第 103 帧,Fable 第 131 帧。按键、光标移动都卡在这几个字上。

⑩ 选哪一档和下一段逐像素对齐

最后一帧和下一段的第一帧逐像素对过,位置、字号、颜色、框和光晕都对上,两段接起来看不出缝。

⑪ 我怎么选照真实界面还原

终端的配色、排版、像素小 logo 都照真实界面的原文还原。正文缺一种字重,它从本机字体里自己补了一个。

⑤ 数水果主动加标签防误读

在 Claude Opus 4 那格加了一个小标签「多数仍答对」,免得观众把橙色问号看成「大多答错」。

④ FutureSearch主动提醒图会放大差距

分数轴截断了,只显示 48%–50%,它在交片时提醒这会把降幅放大;花费柱从 0 开始画,比例是真的。

51 次跑片全记录

按成片里的顺序分组。条长 = 这一次从开跑到交片的时长;斜纹小块 = 当时没记下时长(用了续跑,中间停过)。带亮框的是进了片子的那一版。悬停或聚焦某一行可以看开跑时间。

看数据表
档位与成本

12 段特效:9 段 high,没有一段开 max

有 6 处我让三档各跑一遍再挑,4 处挑了 high,1 处挑了 xhigh,1 处挑了 medium。xhigh 平均比 high 多花一半时间、贵约 77%,只有 93 秒一镜到底的「第三种情况」挑了它。

平均只算 5 处。第 6 处是开头的官方证据:三档跑的版数不一样(medium 7 版、high 4 版、xhigh 1 版),那几批也没存花费,所以不算进平均。另外 5 处每档各跑一次,样本很小。花费按 API 价格折算。

④10-05 → 10-08 · 装配

口播垫底,12 段特效一段段叠上去

Claude Code 把选中的特效从各自的工程搬回主工程,按口播时间一段段放上去,再补上章节卡、推近跳切和换句。我在预览里看,说哪里不对,它再改。

3张章节卡
22刀推近跳切
4句克隆音换句
38次渲视频(另渲静帧 50 次)

成片 9:52 拆开看

特效(含 3 张章节卡)盖住了 431 秒,占成片的 73%。最上面一行就是片子顶部的章节进度条。色块里的数字是第几段特效,悬停或聚焦可以看名字和时间。

开场:官方证据和一个比方

粗体是那一刻的口播

为什么:三种情况

怎么选:算账和回看上期

我的用法

口播永远在最底层

达芬奇里剪好的口播母片整条放进主工程当底。特效按口播的时间一段段叠上去,口播本身不变速。

一段一个工程,选中了再搬

每段特效在自己的工程里做完、挑好,再搬回主工程。一段重做,不影响别的段。

素材尽量用真的

真发布页、真论文图、真 FutureSearch 原文、真 /model 菜单。观众能对得上。

画面上的数字只用核过的

口播先过一遍事实核查。特效交片时,Opus 5.5 会在出片说明里列出画面上出现了哪些数字。

④ ⑤10-07 → 10-08 · 后期发布

声音、字幕、进度条,再发到六个平台

成片画面定下来以后,Claude Code 在达芬奇里铺音效、上字幕、叠进度条,再写发布物料、做封面。

298 处音效落在哪

每条竖线是一个音效,按成片时间排
298 处

音效

AI 先在代码里把每个动作点标出来,导出一份音效清单:起点、音量、放哪条轨。再按清单在达芬奇里铺成 3 条轨,一共 14 种声音。

301 条

字幕 + 进度条

字幕每条不超过 16 个字,文字取逐字稿,时间取达芬奇对成片重新转写的结果。顶部的章节进度条 6 段,单独渲成透明底的 4K 视频,叠在最上面。

6 平台

发布

  • 抖音 10-08 首发
  • YouTube、B 站、视频号、TikTok、小红书计划 10-13
  • AI 按平台各写一版标题简介,封面出三种比例
遇到的问题怎么处理的
10-03 录到后半段,相机断了,声音还在断点后念的内容按段整理成补录稿,后半段补录。
有几句口播要改用克隆音换了 4 句,不用重录。
口播里两处口误:0:20「第一档」、9:27「豆瓣」字幕按正确的写:「低一档」「豆包」。
第一版字幕的时间多处偏了 0.5 秒以上作废,改用达芬奇对成片重新转写的时间,再对齐每句开口的位置。
收获

做完这条,我记住了三件事

1

做特效,high 就够用

12 段里 9 段开的 high。6 处三档对比,4 处我挑了 high。xhigh 平均多花一半时间、贵约 77%,只在 93 秒一镜到底那段用上了。

2

它会自己检查,也会说哪里没把握

51 次跑片里打开了 1,129 次自己渲的图。逐字节比对、逐像素对齐、自己重测口播时间;交片时还会提醒我:这个轴截断了,这几秒偏静,这个标签你可能不想要。

3

我只动嘴,AI 动手

8 天里我发了 244 条消息,Claude Code 执行了 2,244 次操作,Opus 5.5 在特效工程里又操作了 3,114 次。每一步都是 AI 先做出一个能看的东西:研究稿、粗剪、几版特效、预览、达芬奇时间线、封面。我看完说一句哪里不对,AI 再改。

问答

常见问题

这个视频的特效是开 max 做的还是 high?

主要是 high。进片的 12 段特效里,9 段 high、2 段 medium、1 段 xhigh,没有一段开 max。只有「第三种情况」那段 93 秒的 A 点到 B 点用了 xhigh,跑了 41.1 分钟、花了 $10.22。

特效、画面转场是 Opus 5.5 做的吗?

12 段特效是。每段都是 Opus 5.5 在一个空的 Remotion 工程里从零写代码做的,画面长什么样、用什么技术由它自己定。章节卡、推近跳切这些转场是 Claude Code 在主工程里做的;这些对话记录里绝大多数回复来自 Opus 5.5,所以推断转场也是它做的,但没有逐条核对。

这视频是怎么做的?

画面是写代码做出来的。口播是我录的,AI 在达芬奇里剪好;12 段特效由 Opus 5.5 写 Remotion 代码,写完渲静帧、打开图片自己看、再改,51 次跑片一共打开了 1,129 次图片;Claude Code 再把选中的版本搬回主工程,加章节卡、音效、字幕和进度条。进片的画面代码约 12,700 行。

这条视频里,人做了什么,AI 做了什么?

人(陈与小金)定题、写逐字稿、出镜录口播、看片后说哪里不对,8 天里一共发了 244 条消息。其余都由 AI 完成:Claude Code 执行了 2,244 次操作,包括查资料、事实核查、达芬奇粗剪、给每段特效开工程派活、装配、铺 298 处音效、上 301 条字幕、做封面;Opus 5.5 在 51 次跑片里操作了 3,114 次,做出进片的 12 段特效。

一共花了多少钱?

51 次跑片里,记下花费的 30 次合计约 $131(按 API 价格折算),另外 21 次是 10-04 到 10-05 凌晨那几批,当时没存花费。进片的 12 版里,记下花费的 10 版合计 $45.33。记下时长的 45 次合计约 13.5 小时,有不少是同时跑的。

什么是模型的「智商倒挂」?

同一个模型,思考档位开得更高,分数反而更低。Sonnet 5.5 发布页脚注里写着:FrontierCode 测试上,max 档 46.2%,低一档的 xhigh 52.1%。Claude Code 文档介绍 max 档时也写了它「prone to overthinking」,容易想太多。

关于作者

陈与小金 chenyuxiaojin

AI 落地|非程序员,用 Claude Code 做一切

非程序员,用 Claude Code、Codex、Remotion 与 Agent Skills 把想法做成真实项目——选题、脚本、拍摄、剪辑、发布、复盘,全程公开。截至 2026-10-01,抖音有 15 条作品入选抖音精选。看他的全部视频 →

个人网站 · 博客 · GitHub · YouTube · B 站 · 抖音 · X