音频工具 · 剪辑 / 合并

音频拼接

多段拼接/淡入淡出

本地处理 · 不上传 免费 · 无需登录 无次数限制 累计 49 次使用
多段拼接 / 交叉淡化 / 静音间隔 · Web Audio 本地处理 · 不上传
拖入或点击选择多个音频 MP3 / WAV / FLAC / M4A / OGG 等 · 一次可选多个 · 拖动序号调整拼接顺序
拼接顺序drag to reorder
 
1.0 s
1.0 s
 
 
拼接后总波形concatenated · 交替暖色区分各片段,竖线为片段边界
奇数片段 偶数片段 片段边界 / 静音区
就绪 · 添加 2 个以上音频后即可拼接
第一节

关于本工具

About

录完几段旁白或会议录音,想拼成一条完整音频,最怕每段衔接处音量突变、生硬卡顿。这个工具在拼接处自动施加可调时长的淡入淡出,让过渡平滑,同时支持调整每段音量和输出格式(MP3/WAV/FLAC)。音频文件通过后端 FFmpeg 处理,上传至服务器完成拼接后即删除,不保留副本。

使用场景

播客片头片尾合成

独立播客主每期录完口播后,需要把固定的片头音乐、片尾音乐和中间的主干录音拼成一条音轨。以往用剪辑软件来回拖拽,片头音量总压不住人声。本工具允许上传三段音频,分别设置-6dB和-3dB的淡入淡出时长,让音乐在说话前自然隐退,说话结束后柔缓升起,输出文件直接上传平台,省去后期调音台操作。

网课录音去空白合并

老师用手机录了一节45分钟的网课,中间有7次停顿(翻讲义、喝水、等学生打字)。每次停顿短则8秒、长则半分钟,手动剪掉太耗时。把整段音频上传,用本工具的多段拼接功能,将7段有效内容按时间顺序拼接,每段衔接处自动加0.2秒交叉淡入淡出,避免突然跳音,最终输出文件比原时长压缩了12分钟,学生回听更连贯。

多语种语音提示合并

商场广播系统需要播放中英日三语版本的「扶梯安全提示」,每段时长不同(中文18秒、英文22秒、日文25秒)。用本工具将三段语音按顺序拼接,在语言切换处设置0.5秒淡出再淡入,避免生硬切换造成听觉突兀。输出后直接灌入广播设备,无需在专业音频软件里对齐波形。

会议录音分段提取关键

2小时的部门会议录音,只有3段(项目进度汇报、预算争议、下周分工)需要保留给未参会同事。用本工具从原文件里截取这三段,每段开头和结尾手动标记时间点,拼成一条15分钟的精简版。每段衔接处加0.3秒淡入,避免不同录音环境下音量差异造成刺耳。输出后直接发到工作群,同事不用拖动进度条找重点。

有声书章节音频合并

录完一本有声书的20个章节,每章是单独录制的WAV文件,音量基准不一(第3章-18dB,第15章-12dB)。用本工具统一上传,按章节顺序排列,在相邻章节之间设置1秒淡出+1秒淡入,模拟翻页呼吸感。输出后整本书音量起伏控制在±2dB以内,听感比逐条手动调整更统一。

第二节

使用指南

Getting Started

使用步骤

  1. 1点击「添加音频」上传第一段文件,列表显示文件名与时长
  2. 2继续上传后续音频,拖拽列表项调整拼接顺序
  3. 3勾选「启用淡入淡出」并设置过渡时长(0.5–5 秒),波形预览区实时标记交叉点
  4. 4点击「开始拼接」,进度条显示处理进度,完成后自动弹出下载按钮

输入输出示例

输入输出说明
音频A(3秒,人声),音频B(5秒,背景音乐),拼接顺序:A→B,无淡入淡出8秒音频:前3秒人声,后5秒背景音乐,中间无过渡常规:最基础拼接,验证两段音频按顺序连续输出,无交叉处理
音频A(10秒,纯音乐),音频B(10秒,纯音乐),拼接顺序:A→B,淡入淡出时长2秒18秒音频:A最后1秒渐弱,B开始1秒渐强,重叠1秒后B完全播放常规:淡入淡出标准用法,验证交叉淡变时长计算(总时长=20-重叠时长)
单段音频(5秒,白噪音),无其他输入,拼接列表仅一项5秒音频:原样输出,无任何处理边界:单段输入时工具应直接返回原文件,不应报错或添加静音
音频A(0.1秒,极短脉冲),音频B(0.1秒,极短脉冲),拼接顺序:A→B,无淡入淡出0.2秒音频:两段脉冲连续输出边界:极短音频(<1秒)拼接,验证工具能处理毫秒级片段,不因时长过小截断
音频A(30秒,立体声),音频B(30秒,单声道),拼接顺序:A→B,无淡入淡出60秒音频:前30秒立体声,后30秒单声道(自动转换为立体声以匹配),或输出错误提示易错:声道数不一致时,工具可能自动转换或拒绝处理,需明确说明预期行为
音频A(5秒,44.1kHz),音频B(5秒,48kHz),拼接顺序:A→B,淡入淡出1秒9秒音频:B自动重采样至44.1kHz后拼接,淡变重叠1秒易错:采样率不一致时,工具应自动重采样(通常以第一段为准),否则输出可能变调或报错
音频A(2秒,说话声),音频B(2秒,说话声),拼接顺序:A→B,淡入淡出时长设为10秒(超过单段时长)4秒音频:淡入淡出时长自动截断为2秒(即A完全淡出、B完全淡入,无重叠)边界:淡入淡出时长大于音频时长时,工具应自动限制为最短段时长,防止计算错误

常见错误对照

1.音频格式不一致导致拼接失败或杂音

✗ 错误直接拼接一段 44100Hz 的 MP3 和一段 48000Hz 的 WAV
✓ 修复先用工具统一采样率(如全部转成 44100Hz)再拼接

FFmpeg 在拼接不同采样率/编码的音频时可能自动重采样,但结果可能出现音调失真或爆音。最佳实践是先转码统一参数。

2.淡入淡出时长超过音频总时长

✗ 错误对一段 3 秒的音频设置 5 秒淡出
✓ 修复淡出时长不超过音频总时长的一半,如 3 秒音频用 1 秒淡出

FFmpeg 的 afade 滤镜在淡出时长超过音频长度时会自动截断,但剩余部分可能完全静音,不符合预期。

3.拼接顺序与文件列表顺序不一致

✗ 错误在文件选择器中按名称排序,但实际想按时间顺序拼接
✓ 修复手动拖拽文件到拼接列表,按正确顺序排列后再执行

多数工具按文件系统返回顺序读取,如果依赖文件名排序,中文/数字混排可能错位。显式排序是唯一可靠方式。

4.拼接后音量忽大忽小

✗ 错误一段录音音量 -6dB,另一段 -20dB,直接拼接
✓ 修复拼接前用音量归一化功能将各段峰值统一到 -1dB

人耳对音量跳变敏感,FFmpeg 的 loudnorm 或 volume 滤镜可做归一化。不处理则听感突兀。

5.拼接点出现咔哒声或爆音

✗ 错误两段音频在非零交叉点直接拼接
✓ 修复在拼接处添加 10-50ms 交叉淡入淡出(crossfade)

波形在非零值处跳变会产生高频冲击声。FFmpeg 的 acrossfade 滤镜通过重叠区域平滑过渡消除爆音。

6.输出格式选错导致无法播放

✗ 错误拼接多段 AAC 音频后输出为 .mp3
✓ 修复保持输出格式与输入一致,或选择通用格式如 .mp3/.m4a

FFmpeg 转码可能引入额外编码损失,且某些播放器不支持特定编码组合。最佳实践是输出与输入格式相同。

第三节

工作原理

How It Works

核心公式

y(t) = Σᵢ [xᵢ(t - tᵢ) · fᵢ(t - tᵢ)]

变量说明

  • y(t)拼接后音频在时刻 t 的采样值
  • xᵢ(t)第 i 段原始音频的采样序列
  • tᵢ第 i 段在拼接时间轴上的起始偏移
  • fᵢ(τ)第 i 段淡入/淡出窗函数,τ 为段内时间

示例

三段音频:A(0–2s)、B(2–4s)、C(4–6s)。A 末尾 0.5s 淡出(线性从 1→0),B 开头 0.5s 淡入(线性从 0→1),重叠区 0.5s。t=2.2s 时:A 段内 τ=0.2s,f_A(0.2)=1-0.2/0.5=0.6;B 段内 τ=0.2s,f_B(0.2)=0.2/0.5=0.4;y(2.2)=A(2.2)×0.6 + B(2.2)×0.4。若 A(2.2)=0.8、B(2.2)=0.5,则 y(2.2)=0.8×0.6+0.5×0.4=0.48+0.20=0.68。

上传音频多段 MP3/WAV解析元数据时长 / 采样率拼接 + 淡入淡出FFmpeg 滤镜acrossfade输出音频下载文件格式 / 码率参数校验参数设置淡入时长 / 淡出时长预览 / 下载合并结果
用户输入 本地处理 输出结果
第五节

常见问题

Q & A
上传的音频格式不一样能拼在一起吗?

可以。本工具后端用 FFmpeg 处理,支持常见格式混拼,比如把一段 MP3 和一段 WAV 拼成一段,输出格式统一为 MP3。但注意,如果两段音频的采样率或声道数不同,拼接后可能出现音调或音量不一致。建议上传前先用工具自带的标准化选项统一参数,或拼接后手动调整。

拼完之后两段之间有个明显的爆音或咔哒声怎么回事?

爆音通常来自两段音频的波形在拼接点不连续(相位跳跃)。本工具提供淡入淡出选项,开启后会在每段结尾和开头自动添加 0.5-3 秒的渐变过渡,消除突变。如果已经生成且不想重做,可以用其他音频编辑器的交叉淡化功能补救。

最多能拼多少段?单段文件大小有限制吗?

本工具不限制拼接段数,但受浏览器内存和后端超时影响,建议单次不超过 20 段。单段文件建议小于 200MB,总大小建议控制在 2GB 以内。超过这个范围,上传和拼接耗时可能很长,且浏览器端容易崩溃。大文件建议分段上传或使用桌面端工具。

拼接后的总时长怎么比原来几段加起来少了?

如果开启了淡入淡出,每段之间的重叠或过渡会占用部分时长,导致总时长略短于原始时长之和。比如两段各 60 秒,设置 2 秒淡出 + 2 秒淡入,实际输出约 116 秒(减去 4 秒重叠)。关闭淡入淡出或设置为 0 秒即可得到精确累加时长。

音频拼接过程中会把文件上传到服务器吗?隐私安全吗?

本工具采用纯浏览器端处理(WASM 版 FFmpeg),音频文件不会离开你的设备。所有拼接、淡入淡出等操作都在本地完成,不上传任何数据。如果遇到超出浏览器处理能力的超大文件,才会回退到后端处理(文件临时加密存储,处理完自动删除)。

为什么我拼完下载下来的文件播放不了?

常见原因:1. 浏览器下载中断导致文件不完整,重新下载一次;2. 原始音频编码不是 FFmpeg 默认支持的(如某些加密的 AAC),尝试把源文件先转成标准 MP3 再拼接;3. 输出格式选了不常见的,建议选 MP3 或 WAV。如果仍不行,检查浏览器控制台是否有报错信息。

能不能把几段音乐拼成一首歌那种无缝衔接?

可以,但需要配合淡入淡出和精准的时间点。本工具支持每段自定义淡入淡出时长(0-5 秒),如果两段音乐节奏匹配,设置 1-2 秒交叉淡化即可实现类似 DJ 混音的无缝过渡。注意:工具不会自动检测节拍,需要手动调整每段起始偏移量(暂不支持,后续考虑)。

这个工具和 Audacity 比有什么优缺点?

本工具优势:无需安装、打开即用、纯浏览器处理保护隐私、适合快速拼接少量片段。缺点:不支持多轨混音、无法精细编辑波形、不能实时预览拼接点效果。Audacity 功能全面但需要下载安装。如果你的需求只是把几段录音或音乐首尾连起来,本工具更快;如果需要精确到毫秒的对齐或特效,建议用桌面端。

隐私保证所有计算与处理均在你的浏览器本地完成,输入数据不会上传服务器,也不会保存或共享。

选择 打开 +新窗口 esc关闭