采访收音补救
户外采访录到一半,后方突然传来施工钻墙声,人声被压得听不清。把原片导入工具,单独提取采访音轨,用降噪处理后的现场同期声替换掉爆破音段落,再与另一台机位录的干净环境音合并输出。成片里钻墙声被压到 -30dB 以下,人声清晰度恢复到可播出水平。
替换:去掉视频原声,只保留新音频。
诚实标注:本工具纯前端运行,采用「video 静音播放 → canvas 逐帧重绘 →
captureStream 取视频轨 + 新音频(AudioBufferSourceNode → GainNode → MediaStreamDestination;
混合时叠加原声 MediaElementSource → GainNode)→ MediaRecorder 重录」,
输出为 换音轨 webm 视频(画面重新编码,时长 = 原视频时长,保持原分辨率)。
如需 MP4 / 无损换音轨 请用 FFmpeg(ffmpeg -i in.mp4 -i bgm.mp3 -map 0:v -map 1:a -c:v copy -shortest out.mp4)。
导出需保持本页面前台播放至结束。
剪辑时发现视频原声有杂音,或想替换成外语配音、背景音乐,最麻烦的是手动对齐音轨时间轴。这个工具直接拆掉原音轨,上传新音频就能替换或合并多轨,FFmpeg 在服务器端处理,保证音画同步。上传的文件在处理后会被删除,不留副本。
户外采访录到一半,后方突然传来施工钻墙声,人声被压得听不清。把原片导入工具,单独提取采访音轨,用降噪处理后的现场同期声替换掉爆破音段落,再与另一台机位录的干净环境音合并输出。成片里钻墙声被压到 -30dB 以下,人声清晰度恢复到可播出水平。
一个 45 分钟的机械原理动画,需要配中、英、日三语讲解,且每段语速不同。用工具把原片静音,导入三条独立录制的音轨,按时间轴精确对齐到每个章节节点,输出成三个独立文件。每个文件只保留对应语种音轨,字幕组拿到后可直接压入对应语言字幕,省去重新剪辑对齐的 3 小时。
游戏主播的直播录屏里,平台自动添加的版权背景音乐贯穿全场,导致回放上传平台后被静音。把录屏拖入工具,提取纯净人声轨道(主播麦克风录的干音),替换掉原混合音轨,保留游戏音效和队友语音。处理后回放文件音轨里只有人声和游戏环境声,过审率从 60% 提到 95%。
婚礼现场交换戒指时,无线麦克风突然断连,拍下的画面里只有环境杂音。把仪式全程的备用机位音频(有微弱人声但混响严重)导入工具,与主画面同步后,用工具将备用音频中的人声段替换掉主音轨的空白段,再与现场乐队录制的纯音乐音轨合并。成片里誓言清晰可辨,背景音乐也完整保留。
讲师在开放式办公室录了 30 分钟教学视频,空调嗡鸣和同事电话声混入音轨。用工具提取原始音轨,导入录前单独录的 10 秒环境底噪样本,工具自动识别噪声频谱并生成干净人声音轨,替换原音轨。输出文件音轨底噪从 -45dB 降到 -60dB,人声信噪比提升 12dB,学生无需调大音量就能听清。
| 输入 | 输出 | 说明 |
|---|---|---|
| 视频A.mp4(原音轨为中文)+ 音频B.mp3(英文配音)→ 替换原音轨为英文 | 输出文件:视频A_音轨替换.mp4(仅保留英文音轨,原中文音轨被移除) | 常规:最常见的替换场景,验证单音轨替换功能是否正常工作 |
| 视频C.mkv(已有中、英、日三条音轨)+ 音频D.aac(法语旁白)→ 合并为第四条音轨 | 输出文件:视频C_多音轨合并.mkv(包含中、英、日、法四条音轨,法语为新增音轨) | 常规:多音轨合并典型场景,验证工具能正确处理已有多个音轨的视频并新增音轨 |
| 视频E.mp4(无音轨,纯视频)+ 音频F.wav(立体声)→ 添加音轨 | 输出文件:视频E_添加音轨.mp4(包含音频F.wav作为唯一音轨) | 边界:输入视频本身无音轨,工具需能识别并执行添加操作而非替换 |
| 视频G.mp4(音轨为48kHz 16bit立体声)+ 音频H.mp3(128kbps单声道)→ 替换音轨 | 输出文件:视频G_音轨替换.mp4(音轨格式自动转换为48kHz 16bit立体声,与视频原有参数一致) | 边界:输入音频与视频原有音轨参数(采样率、声道数)不一致,验证工具是否自动重采样/转格式 |
| 视频I.mov(音轨为AAC 256kbps)+ 音频J.m4a(AAC 128kbps)→ 替换音轨 | 输出文件:视频I_音轨替换.mp4(音轨编码保持AAC,码率继承视频原音轨的256kbps) | 边界:输入与输出编码相同但码率不同,验证工具是否按视频原参数编码而非直接复制音频流 |
| 视频K.avi(音轨为MP3 192kbps)+ 音频L.wav(44.1kHz 16bit立体声)→ 替换音轨 | 输出文件:视频K_音轨替换.avi(音轨编码转换为MP3,采样率调整为44.1kHz) | 易错:容器格式(AVI)对音轨编码有限制,验证工具是否根据容器自动选择兼容编码 |
| 视频M.mp4(音轨为5.1环绕声)+ 音频N.mp3(立体声)→ 替换音轨 | 输出文件:视频M_音轨替换.mp4(音轨降混为立体声,原5.1声道信息丢失) | 易错:用户可能误以为能保留环绕声,实际替换后声道数由输入音频决定,需提示 |
| 视频O.mp4(音轨语言标签为eng)+ 音频P.mp3(无语言标签)→ 替换音轨 | 输出文件:视频O_音轨替换.mp4(新音轨无语言标签,原eng标签丢失) | 易错:用户未注意语言元数据,替换后标签丢失,需提醒手动添加或工具保留原标签 |
1.输出格式选了 MKV 但原视频是 MP4,音轨合并后播放器不识别
原视频.mp4 + 新音轨.aac → 输出选 MKV原视频.mp4 + 新音轨.aac → 输出选 MP4,或先封装为 MP4 再操作MKV 和 MP4 的容器结构不同。MP4 容器对 AAC 音轨兼容好,直接混流为 MKV 可能让部分播放器(如旧版 QuickTime)无法识别音轨。
2.音轨时长比视频长,输出后视频末尾无声或音画不同步
视频 3 分钟,音轨 5 分钟,直接替换视频 3 分钟,音轨 5 分钟 → 先用剪辑工具裁切音轨到 3 分钟再上传FFmpeg 默认按最短流截断。音轨长于视频时,输出视频会保留完整音轨,但视频画面结束后音频继续播放,造成后半段只有声音无画面。
3.原视频已有两条音轨,选择替换时只替换了第一条
原视频:音轨1(中文)、音轨2(英文)→ 上传新音轨,勾选「替换」原视频:音轨1(中文)、音轨2(英文)→ 上传新音轨,勾选「替换」并指定「替换音轨索引:2」多音轨视频中,替换操作默认作用于索引为 0 的音轨(第一条)。不指定索引会覆盖第一条,第二条保留,导致输出仍包含旧英文音轨。
4.上传的音频采样率不匹配,输出后音质异常或文件变大
原视频音轨 44.1kHz,上传 96kHz 的 WAV原视频音轨 44.1kHz,上传前用 Audacity 将采样率转为 44.1kHzFFmpeg 混流时不会自动重采样。采样率不匹配时,要么强制重采样(增加处理时间),要么保留原采样率(造成容器内参数冲突,播放器可能降级输出)。
5.合并多音轨时选了「添加」但没勾选「保留原音轨」,结果只保留新音轨
原视频有 2 条音轨 → 上传 1 条新音轨 → 勾选「添加」但不勾「保留原音轨」原视频有 2 条音轨 → 上传 1 条新音轨 → 勾选「添加」并勾选「保留原音轨」工具默认「替换」模式会丢弃原视频所有音轨。切换到「添加」模式时,若不同时勾选保留原音轨,实际效果仍是替换——只保留新上传的音轨。
6.音频编码格式不兼容,输出后播放器无声
原视频 MP4(H.264 + AAC),上传 FLAC 无损音频直接替换原视频 MP4(H.264 + AAC),上传前将 FLAC 转为 AAC 或 MP3 再操作MP4 容器对音频编码有限制:标准支持 AAC、MP3、AC-3 等。FLAC 虽可封装进 MP4,但许多播放器(如 iOS 原生播放器)不识别,导致无声。
7.上传的音频文件本身有延迟/偏移,替换后音画不同步
从演唱会录像提取的音频,开头有 0.5 秒空白,直接替换原视频音轨上传前用 Audacity 查看波形,找到实际声音起点,剪切掉前导静音段音频延迟通常来自录制设备或剪辑软件。FFmpeg 不会自动对齐音轨,原样混流后,视频画面与音频起始点不匹配,造成持续偏移。
输出音轨 = 输入视频流 + 替换音轨(或合并多音轨)
输入视频流原始视频文件中的视频轨道替换音轨用户上传的新音频文件,替换原音轨合并多音轨将多个音频流同时封装到输出文件中用户上传一个 MP4 视频(含原音轨)和一个 MP3 音频文件(时长 3 分 20 秒)。工具使用 FFmpeg 执行:ffmpeg -i input.mp4 -i audio.mp3 -c:v copy -c:a aac -map 0:v:0 -map 1:a:0 output.mp4。输出视频保留原画质,音轨替换为 MP3 内容,时长与视频同步(若音频短于视频,末尾静音填充;若音频长于视频,截断至视频时长)。
本工具默认替换视频的第一条音轨(索引0)。如果视频有多条音轨,替换后其他音轨会被保留,第一条被新音频覆盖。如果想把新音频添加为第二条音轨而非替换,使用“合并多音轨”模式,新音频会追加到末尾。操作前建议先用其他工具查看视频的音频流索引,确认要替换的是第几条。
可以。工具后端用 FFmpeg 自动转码,新音频会被重采样为与原视频音频一致的采样率、声道数和编码格式,保证输出文件兼容播放器。常见组合(如 MP4 视频配 MP3 音频、MKV 配 AAC)都能正常处理。如果新音频采样率极低(如 8kHz)或通道数不匹配(如 6 声道转 2 声道),输出会有音质下降或声道合并,属正常现象。
最常见原因是新音频时长与原视频不匹配。替换模式下,工具按原视频总时长截断或循环新音频:新音频短于视频 → 后半段无声;新音频长于视频 → 尾部被裁掉。如果原视频本身音频就存在偏移(录屏时采集卡延迟),替换后偏移依然存在。建议先用播放器检查原视频音画同步情况,再上传时长一致的新音频。
输出文件是多音轨 MKV 或 MP4(取决于原容器),播放时需播放器支持音轨切换。电脑端:VLC 按“音频 → 音轨”菜单选;PotPlayer 右键“音频 → 选择音频流”;移动端:MX Player 长按屏幕选“音频流”。浏览器直接播放通常只放第一条音轨,如需测试所有音轨,建议下载后用播放器打开。
不能。本工具只做音轨替换/合并,不包含音频滤镜(降噪、均衡、音量归一化)。如果新音频有噪音,建议先用 Audacity 等软件降噪后再上传。FFmpeg 本身支持 anlmdn 降噪滤镜,但本工具未开启该功能,避免处理时间剧增和参数调节复杂。
卡住通常因为文件过大或网络中断。本工具无文件大小硬限制,但受浏览器上传超时和服务器处理时长影响。4K 长片建议:① 检查网络是否稳定;② 尝试分割视频(用剪映等切为 10 分钟片段)分别处理;③ 如果原地重试仍卡,清空浏览器缓存后重试。处理进度条超过 5 分钟无变化可刷新页面重新上传。
不能直接恢复。工具输出新文件后,原视频的音频流被覆盖(替换模式)或保留为另一轨道(合并模式)。如果需要保留原音频,建议操作前复制一份原视频备份。如果已操作且后悔,可重新上传原视频再替换一次(用原音频文件替换回去)。
字幕流和章节信息默认会被保留。FFmpeg 处理时只操作音频流,不会主动移除视频流、字幕流或元数据。但如果原视频的字幕是内嵌图形字幕(如 PGS),替换后依然可见;如果是外挂字幕文件(如 SRT),本工具不涉及外部字幕。章节信息(Chapters)也会保留,播放器可正常跳转。
隐私保证所有计算与处理均在你的浏览器本地完成,输入数据不会上传服务器,也不会保存或共享。