用 AI 翻译字幕再贴回去:行数一漂移,后面全错位
把字幕扒成纯文本喂给模型很容易,难的是拿回来的译文怎么原样贴回时间轴。这篇讲清模型为什么会合并和拆分行、编号锚定法怎么写和怎么校验、分块时上下文和术语表各放在哪、以及为什么最稳的一条路是干脆放弃行对齐、改用时间重叠配对。
🗨️ 双语字幕合并 2026-09-13
23.976 和 25 是怎么来的:字幕越走越偏背后的一段电视史
电影是 24 帧,而字幕文件里会出现 25 和 23.976 两族。这篇讲清 NTSC 彩色化时为什么把帧率下调 0.1%、24 帧怎么用 3:2 下拉塞进 30 帧的电视、PAL 地区为什么直接把片子提速 4% 播(连音调都高了大半个半音),以及这段历史如何变成你手上那条越走越偏的时间轴。
🕰️ 字幕时间轴校准 2026-09-13
网页录屏黑屏、按钮点不动、报错看不懂:按四层排查
录屏黑屏不是一个故障,而是四类原因长得一样——安全上下文、操作系统级权限、DRM 版权保护、硬件叠加层。这篇把它们分开,配上浏览器抛出的六种错误各自对应什么,以及 HDR 画面发灰、窗口最小化后画面定住这些相邻问题。
⏺️ 屏幕录制 2026-09-03
网页录屏录一小时怎么不崩:内存缓冲与边录边写盘的取舍
默认模式把视频攒在浏览器里,1080p 每分钟约 40MB,二十分钟以上就该换路子。这篇算清四档参数的体积账,讲清「边录边存到本地文件」为什么必须先选保存位置、为什么录完没有预览和剪辑,以及关标签页时那份文件到底还在不在。
⏺️ 屏幕录制 2026-09-03
网页录屏没声音的完整排查:系统声音和麦克风是两条独立的路
录屏出来是默片,八成不是工具坏了,而是「系统声音」和「麦克风」这两条路各自断在了不同地方。这篇按浏览器、共享范围、操作系统、授权四层逐个排掉,并解释为什么 Mac 上「整个屏幕」拿不到系统声音、录到的音乐为什么发闷、两路同开时的回声从哪来。
⏺️ 屏幕录制 2026-09-03
录屏出来进度条拖不动、快速剪辑总多几秒:WebM 时长元数据与关键帧对齐
浏览器直出的 WebM 没写总时长,播放器读到 0 或无穷大,进度条就废了。这篇讲清这个缺陷的成因和无损修法,以及为什么「只裁末尾」秒级完成而「裁掉开头」要重新编码整段——关键帧在屏幕录制里可能间隔好几秒。
⏺️ 屏幕录制 2026-09-03
字幕转文字稿为什么不能只删时间轴:滚动重复、断句合并与段落时间戳
把 SRT/VTT 的时间码删掉就叫文字稿?得到的往往是句子被拦腰截断、自动字幕整段整段重复的碎片堆。这篇讲清字幕和文章之间差的三步——去滚动重复、按标点和停顿合并断句、保留段落级时间戳——以及每一步背后的判断逻辑。
🗣️ 字幕转文字稿 2026-08-29
两小时的文字稿怎么喂给 AI:token 是什么、为什么要分块、怎么分才不丢信息
把长文字稿整个贴给 AI,要么被截断、要么中间部分被草草略过。这篇讲清楚三件事:token 和字数的换算关系、上下文窗口塞满之后模型会怎样偷懒、以及按段落边界分块 + 逐块提示词 + 最后合并的完整流程。
🗣️ 字幕转文字稿 2026-08-29
跨设备摄像头串流连不上的 7 类真实原因——iOS Safari 权限、WebRTC NAT 穿透、HTTPS 强制、微信浏览器限制全排查
扫码生成 PeerJS ID 后久转不出"已连接"?多半是 NAT 类型不兼容、对端在微信内置浏览器、iOS Safari 没给摄像头权限、或者两端走的不是 HTTPS。这篇按"扫码→建连→拿摄像头→画质调整→保持稳定"五段拆开每一步的失败点和定位方法,给出 7 类报错对照修复
📹 跨设备摄像头串流 2026-05-17
字幕乱码 / 时间不对 / 样式丢失三大痛点全修复——编码自动识别原理、整体偏移与重新打轴、ASS 标签清理实战
下了字幕一打开全是乱码、播放器里时间慢半秒、转完 SRT 后样式都没了——这三种是字幕处理的高频痛点。这篇拆开本工具的编码自动识别(BOM + UTF-8 严格校验 + GBK/Big5 启发式)、整体时间偏移与重新打轴的区别、ASS 样式标签清理的精确逻辑,给到真实修复路径
💬 字幕格式转换 2026-05-17
音频淡入淡出时长怎么选:50ms 防爆音、3s 自然过渡、10s 艺术化的分水岭
同样是淡入淡出,10ms 和 3s 是两种完全不同用途——前者是消除 click 爆音的工程手段,后者是营造情绪的艺术手法。这篇拆解 afade 的工作原理、为什么线性曲线听起来不自然、不同时长对应什么场景、什么时候根本不需要淡入淡出。
🌅 音频淡入淡出 2026-05-11
音频格式怎么选:MP3 / WAV / AAC / M4A / FLAC 各有什么用
同一段录音存成 MP3 1MB、WAV 10MB、FLAC 5MB——选错格式可能要么爆体积、要么破音质,要么播放器打不开;这篇讲清五种格式的设计目标、码率上限、容器与编码的差异、有损链式转码的累积失真
🔄 音频格式转换 2026-05-07
音频合并:拼接前必须统一采样率/声道,concat demuxer vs filter 怎么选
直接把多个 MP3 拼起来失败、拼起来后第二段开始变成噪声、段间衔接太突兀——这些都是因为采样率 / 声道 / 编码不一致;这篇讲清 ffmpeg 两种拼接方式、为什么本工具自动重采样、段间静音 / 交叉淡化的取舍
🔗 音频合并 2026-05-07
音频分割:按时长等分 vs 按时间点切,哪种适合你的场景
把一段长录音切成多段——是按"每 5 分钟一段"等分,还是按"0:30、1:45、3:20"切点切?两种方式适用场景完全不同;这篇讲清切点输入格式、有损切点的帧对齐、上传平台的时长上限和分段命名策略
🪓 音频分割 2026-05-07
音频变速不变调:atempo 的 0.5–2.0 区间和多级链式叠加
1.5x 听课、2x 听播客、0.75x 学外语——能保留原音调的"变速不变调"靠的是时间拉伸算法;为什么 ffmpeg 的 atempo 只接受 0.5–2.0、超出怎么办、过度变速会出现什么伪影
⏩ 音频变速 2026-05-07
音频剪辑:精确裁切的帧对齐、起点 click 和淡入淡出衔接
把一段录音的开头结尾杂音剪掉,看似简单——但 MP3 / AAC 是帧编码,切点不一定能精确到样本,起点没做淡入会有 click 声;这篇讲清流复制 vs 重编码的精度差异、为什么裁完开头会"啪"一声、什么时候配合淡入淡出工具、和"分割"工具的区别
✂️ 音频剪辑 2026-05-07
音量调整不是简单"放大":Peak / RMS / LUFS 和平台响度标准
同一段音频在不同平台听起来一边响一边闷,是因为现代流媒体都按 LUFS 自动归一化;这篇讲清峰值 / RMS / LUFS 三个度量、播客 −16 / Spotify −14 / 广播 −23 的来历、放大 6dB 是几倍能量、什么时候要开限幅器
🔊 音量调整 2026-05-07
从视频里抽音频:容器与编码的差异、流复制 vs 重编码
MP4 视频里"抽音频"看似简单,但选 MP3 还是 M4A、要不要无损、为什么有时候输出文件比预期大——这些都和"容器与编码的关系"有关;这篇讲清流复制(copy)和重编码(re-encode)的取舍、各容器的音轨格式、什么时候选哪个
🎙️ 视频提取音频 2026-05-07
字幕格式全解:SRT / ASS / VTT / LRC 怎么选,平台兼容踩坑指南
字幕转完播放器不显示、样式丢失、中文乱码——大部分问题来自格式不对或编码错了,这篇讲清四种格式的结构差异和平台矩阵
💬 字幕格式转换 2026-05-05
微信/抖音/B站/YouTube 视频上传规格完全对照 2026
各平台格式限制、大小上限、分辨率建议一览——上传前对照参数,避免反复转码
🎬 视频压缩 2026-05-05
视频转 ASCII:帧率、字符密度和灰度映射的取舍
为什么 ASCII art 动画看起来有时流畅有时卡顿?字符选哪些、密度多大、帧率设多少——三个参数的取舍逻辑
▶ 视频转ASCII 2026-05-05
视频压缩三杠杆:先看码率,再看分辨率,最后才动帧率
视频体积不是只靠“压一压”就能解决,真正该先动的是码率;分辨率第二,帧率最容易压过头
🎬 视频压缩 2026-05-01