跳转到主要内容
GNIX GAZETTE

万象拾遗录

深海般的生活,是我心底的华北浪革
POST

自媒体创作心得:从瞎折腾到有章法

2026-09-21 17:50:56

自媒体创作心得:从瞎折腾到有章法

2026-09-21 17:50:56/ 预计阅读 2 分钟 --杂谈

前言

断断续续做视频和字幕翻译也两年多了,从一开始一个视频折腾一整天,到现在能比较轻车熟路地出片,中间踩过的坑比学会的技巧多得多。趁最近有空,把这些经验整理一下——算不上教程,更像是一份血泪教训清单

本文不涉及任何「流量密码」或「算法推荐」。如果你在找「三天起号十万粉」,那来错地方了。

工具观:够用就行,别武装到牙齿

刚入坑的时候,我的硬盘里装满了各种教程推荐的软件——字幕一个、压制一个、调色一个、特效一个。结果是什么?每次开工先花半小时在不同工具之间来回切,一个简单的任务被拆成七八个步骤,反而拖慢了节奏。

后来慢慢明白了一件事:减少工具切换本身就是效率提升

现在我日常的工具链非常精简:

  • 剪辑:剪映专业版(实际主力逐渐从剪映转到 PR 与 DaVinci)
  • 字幕:Arctime Pro/Aegisub + Whisper/Parakeet(自动识别后精校)
  • 压制:FFmpeg 命令行
  • 翻译:自己翻 + AI 辅助校对
  • 字体排版:全在剪辑软件内完成,不动用外部工具

FFmpeg 可能是对我效率提升最大的单个工具。以前压个视频要打开 HandBrake、调半天参数、盯着进度条——现在一条命令丢进终端,继续干别的。

工具精简的底线:你能在不看教程的情况下独立完成一个完整流程。如果每次开工都要先搜「XX 软件怎么导入素材」,那说明你的工具链太复杂了。

字幕:自动化与手动的分界线

关于字幕,我在另一篇文章里写得很详细,这里只讲最核心的心得。

Whisper 这类自动语音识别工具出现之后,做字幕的门槛低了很多。但我的体会是:自动识别解决的是 80% 的体力劳动,剩下的 20% 才是决定质量的关键

具体来说:

  1. 自动识别之后一定要人工过一遍。Whisper 对中文的准确率很高,但专有名词、中英混读、方言口音还是会翻车。有时候一个错字就能让整句话的意思完全反了。
  2. 时间轴比文字更难搞。自动生成的时间轴经常出现「说话还没开始字幕就出来了」或者「一句话结束了字幕还挂着」。调轴是最枯燥但最影响观看体验的环节——没人会注意到完美的轴,但烂轴会让观众反复暂停回看。
  3. 双语字幕不是简单翻译。中英字幕的字数差异很大,同样的意思中文可能 10 个字,英文 25 个单词。需要在翻译时主动控制长度,否则英文那行就溢出了。
§详情附录 · DETAILS我常用的字幕工作流
展开详情收起详情
— 附录文献全文 · FULL APPENDIX —
  1. PotPlayer 打开视频 → 运行 Whisper 自动识别
  2. 修正断句和初步调整时间轴
  3. 保存 .srt → 如果要做双语,用翻译工具生成中文初稿
  4. 双语精校:确保英文长度不溢出、术语统一
  5. 导回剪辑软件,调整字体、位置、样式,精调时间轴与译后校对
  6. 压制前最后检查一遍——这个时候发现错误是最折磨人的

全程做下来,一个十分钟的视频大约需要 1-2 小时,取决于原素材的语速和口音复杂度。

压制:少即是多

压制这块我在另一篇文章里也详细写了。核心原则就是一句话:参数不是越高越好,而是找到画质和体积的最佳平衡点

刚入门的时候我有个毛病——什么参数都拉满。CRF 拉到 16、预设用 veryslow、码率往死里加。结果一个十分钟的视频压了半小时,体积 2GB,传到 B 站又被二次压缩,画质反而比用合理参数压的 500MB 版本还差。

现在的原则:

  • 目标平台决定参数。传到 B 站就和传到抖音的要求不一样,B 站二压严重,源文件给太高码率没意义。
  • CRF 不是越小越好。H.264 一般 20-23 就够了,H.265 可以再高一点。CRF 16 和 20 的区别肉眼几乎不可见,体积却能差一倍。
  • 知道每个参数是干嘛的再调。FFmpeg 几百个参数,不需要全懂,但常用的 preset、crf、编码器、分辨率、音频码率这五个必须搞清楚。

翻译:人和机器的边界

做翻译这几年最大的感受:AI 翻译的进步很快,但离「可以直接发布」还差最后一公里

现在我的翻译流程通常是:先用 AI 过一遍拿到初稿,然后逐句精校。AI 擅长的是「不出错」——语法正确、术语翻译基本靠谱。但它不擅长的是「像人说话」——很多翻译读起来语法完全正确,但就是有一股翻译腔。

The quick brown fox jumps over the lazy dog.

那只敏捷的棕色狐狸跳过了懒惰的狗。

一只棕色的狐狸轻快地跃过那条懒狗。

两个版本都对,但第二个更像中文。

翻译腔是 AI 翻译最常见的毛病:过度直译、句子结构照搬英文、忽略中文的表达习惯。改掉这些问题不需要增加信息量,只需要把「英语思维」拧成「中文思维」。比如「jumps over」不是「跳过」而是「跃过」,因为中文里「跃」比「跳」多了轻快感——这种语感差异,至少目前 AI 还不能完全把握。

RULED NOTE译文复查
PAGE:NO. 01

如果你也做双语字幕翻译,一个很实用的小技巧:翻完英文后,关掉原文轨道,只看译文念一遍。如果念出来觉得不像正常人说话,那就需要改。

字体排版:藏在细节里的质感

字体是老本行,写过一篇文章专门聊,这里只说视频创作场景。

字幕选什么字体,大部分观众不会刻意注意。但他们能感觉到舒不舒服。几个很主观的原则:

  • 中文字幕不要用纯等宽字体(除非是代码教程)。等宽字体每个字的视觉宽度一样,但中文笔画差异太大,强制等宽会让笔画少的字「周围太空」、笔画多的字「挤在一起」。
  • 笔画粗细要适中。视频字幕有描边或背景阴影,字体太细会被吃掉,太粗又显得笨重。思源黑体 Medium 是个安全的选择。
  • 不要在一屏里用超过两种字体。中文一种,英文一种,最多再加一种注释字体。多了会像 PPT 艺术字。
  • 英文字幕尽量选用西文字体。中文系统自带的英文字形通常不够好,如果字幕里有英文,花十分钟配一套西文无衬线体,质感提升不止一个档次。

搬运、分流与平台策略

从 Halo 时代到现在,我一直保持「多处发布、一处沉淀」的策略。主站(也就是本博客)是我真正的内容仓库,所有文章都在那里沉淀;而 B 站、公众号、知乎等外部分发渠道则各取所需——视频分发到 B 站和抖音,长文创作则发知乎或 B 站专栏。(不过实际零产出)

这么做的好处是,任何一个平台翻车(限流、删稿、封号)都不会影响你的内容资产。平台是橱窗,自己的网站才是仓库

写了这么多,有没有捷径?

没有。

所有的经验本质上都是时间换来的。字幕不是一天校对的,压制参数不是一次搞懂的,翻译腔也不是一两篇就能洗掉的。如果说有什么值得分享的「捷径」——

不要追求一次做到完美,先做出来,然后在下一次做得更好。十个 80 分的作品,远好于一个迟迟做不出来的 100 分。

——我自己说的

这大概是我这几年唯一觉得有用的心法:把创作当成习惯,而不是任务。当你不需要靠「坚持」去维持创作频率的时候,进步自然会发生。

C

自媒体创作心得:从瞎折腾到有章法

作者
倪谅
发布于
2026-09-21 17:50:56
许可协议

Comments

分类筛选: