音效
AI 先在代码里把每个动作点标出来,导出一份音效清单:起点、音量、放哪条轨。再按清单在达芬奇里铺成 3 条轨,一共 14 种声音。
字幕 + 进度条
字幕每条不超过 16 个字,文字取逐字稿,时间取达芬奇对成片重新转写的结果。顶部的章节进度条 6 段,单独渲成透明底的 4K 视频,叠在最上面。
发布
- 抖音 10-08 首发
- YouTube、B 站、视频号、TikTok、小红书计划 10-13
- AI 按平台各写一版标题简介,封面出三种比例
成片《如何选择正确的模型档位?》,9 分 52 秒。从定题到抖音发布用了 8 天。我写稿、出镜录口播,看完说哪里不对;其余的活是 AI 干的:Opus 5.5 在空工程里一段一段做特效,Claude Code 管研究、剪辑、装配、后期和发布。
上面一行是口播:我写稿、录制,AI 核查、粗剪。下面一行是特效:Claude Code 把口播一段段切出来,各开一个空工程派给 Opus 5.5。两边在主工程里汇合,再做后期、发布。
我定题:模型档位开高,反而变差。AI 查官方发布页、论文、文档,抓 22 条同类视频的字幕,写成研究稿。
我写逐字稿、出镜录制。10-03 录到一半相机断了,后半段补录。

AI 对着逐字稿核事实,在达芬奇里剪掉口误和气口,出口播母片。
口播母片


一段画面一个空工程,Opus 5.5 写代码、渲静帧、自己看、自己改。16 批,最多 7 个同时跑。我看交片,几版里挑一版、说哪里不对。
口播母片
特效
章节卡AI 把选中的特效搬回主工程,加章节卡、推近跳切、克隆音换句。我在预览里看,说哪里不对,AI 改。
成片 9:52AI 铺 298 处音效、上 301 条字幕、做 6 段章节进度条。
AI 写六个平台的标题简介、做三种比例的封面。抖音 10-08 首发,另外五个平台计划 10-13。
Claude Code 把口播按段切出来,每段开一个空的 Remotion 工程,派给 Opus 5.5。画面长什么样、用什么技术,都由它自己定。
一列是一批同时开跑的工程,一格是一次跑片。10-05 15:51 那批一次开了 7 个。带亮框的是进了片子的版本。
只改后半段。动手前后把前半段几帧新旧版逐字节比对,确认前面一帧没动。
快速滚动时,画面中间会冒出一个发白的方框。它查出是运动模糊的作用范围没设对,修好了。
用 whisper 重新对了一遍每个字的时间,再对着音量波形校停顿,发现原来的时间表有几处差了 10–15 帧,动画按校正后的时间卡。
念到 high 是第 72 帧,xhigh 第 103 帧,Fable 第 131 帧。按键、光标移动都卡在这几个字上。
最后一帧和下一段的第一帧逐像素对过,位置、字号、颜色、框和光晕都对上,两段接起来看不出缝。
终端的配色、排版、像素小 logo 都照真实界面的原文还原。正文缺一种字重,它从本机字体里自己补了一个。
在 Claude Opus 4 那格加了一个小标签「多数仍答对」,免得观众把橙色问号看成「大多答错」。
分数轴截断了,只显示 48%–50%,它在交片时提醒这会把降幅放大;花费柱从 0 开始画,比例是真的。
按成片里的顺序分组。条长 = 这一次从开跑到交片的时长;斜纹小块 = 当时没记下时长(用了续跑,中间停过)。带亮框的是进了片子的那一版。悬停或聚焦某一行可以看开跑时间。
有 6 处我让三档各跑一遍再挑,4 处挑了 high,1 处挑了 xhigh,1 处挑了 medium。xhigh 平均比 high 多花一半时间、贵约 77%,只有 93 秒一镜到底的「第三种情况」挑了它。
平均只算 5 处。第 6 处是开头的官方证据:三档跑的版数不一样(medium 7 版、high 4 版、xhigh 1 版),那几批也没存花费,所以不算进平均。另外 5 处每档各跑一次,样本很小。花费按 API 价格折算。
Claude Code 把选中的特效从各自的工程搬回主工程,按口播时间一段段放上去,再补上章节卡、推近跳切和换句。我在预览里看,说哪里不对,它再改。
特效(含 3 张章节卡)盖住了 431 秒,占成片的 73%。最上面一行就是片子顶部的章节进度条。色块里的数字是第几段特效,悬停或聚焦可以看名字和时间。





















达芬奇里剪好的口播母片整条放进主工程当底。特效按口播的时间一段段叠上去,口播本身不变速。
每段特效在自己的工程里做完、挑好,再搬回主工程。一段重做,不影响别的段。
真发布页、真论文图、真 FutureSearch 原文、真 /model 菜单。观众能对得上。
口播先过一遍事实核查。特效交片时,Opus 5.5 会在出片说明里列出画面上出现了哪些数字。
成片画面定下来以后,Claude Code 在达芬奇里铺音效、上字幕、叠进度条,再写发布物料、做封面。
AI 先在代码里把每个动作点标出来,导出一份音效清单:起点、音量、放哪条轨。再按清单在达芬奇里铺成 3 条轨,一共 14 种声音。
字幕每条不超过 16 个字,文字取逐字稿,时间取达芬奇对成片重新转写的结果。顶部的章节进度条 6 段,单独渲成透明底的 4K 视频,叠在最上面。
12 段里 9 段开的 high。6 处三档对比,4 处我挑了 high。xhigh 平均多花一半时间、贵约 77%,只在 93 秒一镜到底那段用上了。
51 次跑片里打开了 1,129 次自己渲的图。逐字节比对、逐像素对齐、自己重测口播时间;交片时还会提醒我:这个轴截断了,这几秒偏静,这个标签你可能不想要。
8 天里我发了 244 条消息,Claude Code 执行了 2,244 次操作,Opus 5.5 在特效工程里又操作了 3,114 次。每一步都是 AI 先做出一个能看的东西:研究稿、粗剪、几版特效、预览、达芬奇时间线、封面。我看完说一句哪里不对,AI 再改。
主要是 high。进片的 12 段特效里,9 段 high、2 段 medium、1 段 xhigh,没有一段开 max。只有「第三种情况」那段 93 秒的 A 点到 B 点用了 xhigh,跑了 41.1 分钟、花了 $10.22。
12 段特效是。每段都是 Opus 5.5 在一个空的 Remotion 工程里从零写代码做的,画面长什么样、用什么技术由它自己定。章节卡、推近跳切这些转场是 Claude Code 在主工程里做的;这些对话记录里绝大多数回复来自 Opus 5.5,所以推断转场也是它做的,但没有逐条核对。
画面是写代码做出来的。口播是我录的,AI 在达芬奇里剪好;12 段特效由 Opus 5.5 写 Remotion 代码,写完渲静帧、打开图片自己看、再改,51 次跑片一共打开了 1,129 次图片;Claude Code 再把选中的版本搬回主工程,加章节卡、音效、字幕和进度条。进片的画面代码约 12,700 行。
人(陈与小金)定题、写逐字稿、出镜录口播、看片后说哪里不对,8 天里一共发了 244 条消息。其余都由 AI 完成:Claude Code 执行了 2,244 次操作,包括查资料、事实核查、达芬奇粗剪、给每段特效开工程派活、装配、铺 298 处音效、上 301 条字幕、做封面;Opus 5.5 在 51 次跑片里操作了 3,114 次,做出进片的 12 段特效。
51 次跑片里,记下花费的 30 次合计约 $131(按 API 价格折算),另外 21 次是 10-04 到 10-05 凌晨那几批,当时没存花费。进片的 12 版里,记下花费的 10 版合计 $45.33。记下时长的 45 次合计约 13.5 小时,有不少是同时跑的。
同一个模型,思考档位开得更高,分数反而更低。Sonnet 5.5 发布页脚注里写着:FrontierCode 测试上,max 档 46.2%,低一档的 xhigh 52.1%。Claude Code 文档介绍 max 档时也写了它「prone to overthinking」,容易想太多。