播客降噪后口型同步
播客剪辑师用 iZotope RX 降噪后,发现音频时长被算法缩短了 0.3 秒,导致采访视频里嘉宾的口型对不上声音。重新剪辑对齐太耗时,直接用本工具按 100.5% 的速率拉伸音频,补回丢失的时长,同时保持音调不变,三秒内输出修复文件,口型恢复自然。
只改语速 / 时长,音调保持不变(听课加速首选)
重采样改播放速率,快放升调(花栗鼠音)、慢放降调
录播课、播客或采访录音里,一段语速太快或太慢,直接拖动播放器速度条会变声成小黄人或者树懒。这个工具只改速度不改音高,用 FFmpeg 的 atempo 滤镜处理,输入原音频文件,设置 0.5 到 2.0 倍速,输出保持人声自然。处理在浏览器本地完成,不上传服务器。
播客剪辑师用 iZotope RX 降噪后,发现音频时长被算法缩短了 0.3 秒,导致采访视频里嘉宾的口型对不上声音。重新剪辑对齐太耗时,直接用本工具按 100.5% 的速率拉伸音频,补回丢失的时长,同时保持音调不变,三秒内输出修复文件,口型恢复自然。
B 站 UP 主录了一段 3 分 12 秒的游戏高光集锦,想用一首 2 分 58 秒的纯音乐做背景。用本工具把音乐拉伸到 3 分 12 秒(速率约 108%),同时锁定音调不变,避免高音区变尖刺耳。导出后直接拖入剪辑软件,高潮部分恰好落在击杀瞬间,无需手动裁剪音轨。
日语 N1 考生找到一段 1.5 倍速的 NHK 新闻原声,语速太快听不清促音和长音。用本工具将播放速率降到 0.75 倍,同时保持声调不变,避免像普通变速那样变成「唐老鸭」音。逐句跟读后,再逐步调回原速,两周内听力辨音准确率从 60% 提升到 85%。
广告公司接到一条 30 秒电台口播稿,配音员录完是 32.4 秒,超了 2.4 秒。重录要加钱且排期不够。用本工具把干音压缩到 30 秒(速率约 108%),保持男中音的音色厚度,没有出现「快进式」的机械感。输出后直接混音,客户验收一次通过。
ASMR 创作者录制了一段 20 分钟的雨声素材,想制作成 10 分钟的「加速雨声」版本用于短视频平台。普通变速会让雨滴声变成尖锐的「噼啪」声,破坏沉浸感。使用本工具按 200% 速率拉伸,同时锁住音调,输出后雨声仍保持低频蓬松质感,播放量比原版高出 3 倍。
| 输入 | 输出 | 说明 |
|---|---|---|
| 120 BPM → 60 BPM(速度减半) | 输出音频时长变为原时长的 2 倍,音高不变 | 常规:速度减半是典型应用场景,验证 atempo 参数 0.5 的效果,确认时长翻倍且不变调 |
| 120 BPM → 240 BPM(速度加倍) | 输出音频时长变为原时长的 0.5 倍,音高不变 | 常规:速度加倍是常见需求,验证 atempo 参数 2.0 的加速效果,确认时长减半且不变调 |
| 120 BPM → 120 BPM(速度不变) | 输出音频与原音频完全一致(时长、音高均不变) | 边界:速度不变时,工具应直接输出原始音频,验证 atempo 参数 1.0 的恒等映射,避免意外处理 |
| 120 BPM → 0.1 BPM(极慢速度) | 输出音频时长变为原时长的 10 倍,音高不变 | 边界:极慢速度(atempo 参数 0.1),验证工具对极端低值的处理能力,确认无失真或报错 |
| 120 BPM → 100 BPM(速度微调) | 输出音频时长变为原时长的 1.2 倍,音高不变 | 边界:速度微调(atempo 参数 0.8333),验证工具对非整数倍率(如 5/6)的精度,确认无音高偏移 |
| 120 BPM → 0 BPM(速度为零) | 工具报错或输出静音文件(取决于实现) | 易错:速度为零在物理上无意义,用户易误输入。工具应明确提示参数范围(atempo 不支持 0),避免静音输出误导 |
| 120 BPM → 1200 BPM(速度超快) | 输出音频时长变为原时长的 0.1 倍,音高不变 | 易错:超快速度(atempo 参数 10.0),用户可能期望仍能听清内容,实际高频信息可能丢失,需提醒听觉极限 |
1.atempo 参数写小数但没加小数点
atempo=2atempo=2.0FFmpeg atempo 滤波器要求参数为浮点数。写整数 2 会被解析为 2.0 但部分旧版 FFmpeg 会报错,显式写 2.0 更稳妥。
2.速度因子超出合法范围
atempo=3.5atempo=2.0FFmpeg atempo 合法范围是 0.5 到 2.0。超出此范围的数值会导致滤波器拒绝处理并报错。
3.想加速 2 倍以上时只用一个 atempo
atempo=2.5atempo=2.0,atempo=1.25atempo 单次上限 2.0。要加速 2.5 倍,需串联两个 atempo:2.0 × 1.25 = 2.5。
4.输入文件格式不支持 atempo 滤波器
输入一个 .wma 文件直接跑 atempo先用 -acodec pcm_s16le 转码为 WAV 再跑 atempoatempo 只处理 PCM 编码的音频流。压缩格式(如 WMA、MP3)需先解码为 PCM 才能应用 atempo。
5.输出文件名与输入相同导致覆盖
ffmpeg -i input.mp3 -af atempo=0.5 input.mp3ffmpeg -i input.mp3 -af atempo=0.5 output.mp3FFmpeg 默认覆盖输出文件。输入输出同名时,会先清空输入文件再开始处理,导致源文件丢失。
6.忘记指定输出编码器导致默认编码不符预期
ffmpeg -i input.wav -af atempo=1.5 output.mp3ffmpeg -i input.wav -af atempo=1.5 -acodec libmp3lame output.mp3FFmpeg 输出 MP3 时默认编码器可能不是 libmp3lame,导致质量或兼容性问题。显式指定编码器可避免。
7.多声道音频未先混音为双声道
对 5.1 声道 AC3 文件直接 atempo=2.0先加 -ac 2 混音:ffmpeg -i input.ac3 -ac 2 -af atempo=2.0 output.wavatempo 对多声道(如 5.1)处理可能产生爆音或相位问题。建议先混音为双声道再变速。
8.变速后音频与视频不同步
只对音频流变速,视频流保持原速同时用 setpts=PTS/1.5 调整视频速度:-vf setpts=PTS/1.5 -af atempo=1.5仅变速音频会导致音视频时长不一致。需用 setpts 同步调整视频速度,保持对齐。
new_rate = original_rate × speed_factor
new_rate变速后的采样率,单位 Hzoriginal_rate原始音频采样率,单位 Hzspeed_factor速度倍数,如 1.5 表示 1.5 倍速原始音频采样率 44100 Hz,需要 1.5 倍速播放(不变调):new_rate = 44100 × 1.5 = 66150 Hz。FFmpeg atempo 滤波器通过重采样至 66150 Hz 并保持基频不变,实现时长缩短 1/3 且音调不变。
可以。本工具核心算法就是 FFmpeg 的 atempo 滤波器,专门做「不变调变速」——改变播放速度的同时保持音高(pitch)不变。变慢一倍(0.5x)时人声听起来像慢速说话,不会变成「男低音」或「机器人声」。操作时直接在速度输入框填 0.5 即可。注意:极端变速(0.25x 以下或 4x 以上)可能出现轻微音频毛刺,这是算法物理极限,非工具问题。
卡顿通常来自两个原因:一是输入音频本身编码不规范(如 VBR 极端压缩的 MP3 或低码率 AAC),FFmpeg 处理时会产生短时丢帧;二是变速比例太极端(如 0.2x 或 5x),atempo 内部会做时间拉伸,超过推荐范围后算法会牺牲平滑度保音高。建议先用 0.5x-2x 试听,若无问题再逐步调大或调小。如果只是变慢后的轻微「空洞感」,可尝试在本地播放器开启交叉淡入淡出(crossfade)来掩盖。
本工具是纯浏览器端处理(WASM 方案),音频文件不会离开你的设备。点击「选择文件」后,整个变速运算都在本地内存中完成,不经过任何服务器。处理完成后生成的音频文件也是从浏览器直接下载。所以即使网络断开也能正常使用(需在页面加载完成后)。隐私方面可以放心,适合处理含敏感内容的录音或未发布的作品。
本工具基于浏览器的 File API 读取音频,所以支持浏览器原生能解码的格式:MP3、WAV、FLAC、OGG、M4A(AAC)、WebM 等。.wma 属于 Windows Media 私有格式,绝大多数浏览器不支持直接解码,建议先用格式转换工具(如 FFmpeg)转成 WAV 或 FLAC 后再上传。如果文件是 .aiff(苹果无损),Safari 和 Chrome 均支持,可直接使用。
变速后的时长会按比例变化:速度 0.7 倍 = 时长变为原来的 1/0.7 ≈ 1.4286 倍,所以 10 分钟录音会变成约 14 分 17 秒。如果下载的文件时长仍然是 10 分钟,说明变速没有实际生效——请检查速度输入框是否正确填了 0.7(而非 70 或 7.0),以及是否点击了「开始变速」按钮。部分浏览器在极速模式下可能缓存旧文件,建议清空缓存或使用无痕窗口重试。
正常。本工具输出格式固定为 WAV(无损 PCM),而输入可能是 MP3(有损压缩)。即使时长不变,从有损格式转成无损格式,文件大小也会膨胀到原来的 5-10 倍。例如 5MB 的 128kbps MP3 转成 44.1kHz 16bit WAV 约 50MB。如果文件过大不适合传输,建议下载后自行用 FFmpeg 或音频编辑软件转回 MP3/AAC。
当前版本一次只能处理一个文件。如果有多段音频需要同一比例变速,建议先用音频合并工具(如 Audacity 或 FFmpeg concat)拼成单个文件再上传,或者逐个处理。浏览器端的 WASM 处理受限于单线程内存,同时处理多个大文件可能导致标签页崩溃。如果需要批量处理大量文件,推荐使用 FFmpeg 命令行:`ffmpeg -i input.mp3 -af atempo=0.8 output.mp3`,写个批处理脚本即可。
浏览器对 .aac 容器的支持有限——虽然 AAC 编码本身被广泛支持,但 .aac 裸流文件(无容器)在 Chrome/Firefox 中可能无法直接解码。建议先确认文件后缀:如果是 .m4a(MPEG-4 容器内含 AAC)则完全支持;如果是纯 .aac,可以尝试用格式工厂或 FFmpeg 转成 .m4a 再上传。另外,如果文件扩展名被错误修改(如 .mp3 实际是 .aac),也会触发此错误,可右键文件属性查看真实编码。
隐私保证所有计算与处理均在你的浏览器本地完成,输入数据不会上传服务器,也不会保存或共享。