视频工具 · 格式转换

提取音频

视频→音频

本地处理 · 不上传 免费 · 无需登录 无次数限制 累计 56 次使用
视频 → 音频(保持质量)· Web Audio 本地解码 · 不上传
拖入或点击选择视频 MP4 / WebM / MOV / MKV 等 · 浏览器本地解码音频轨 local only · nothing uploaded
视频预览preview · confirm picture
提取的音频信息decoded audio track
音频波形waveform · peak envelope
勾选后仅提取选定区间,否则导出完整音轨
00:00.000
00:00.000

诚实说明:浏览器 decodeAudioData 直接从视频容器解码音频轨(MP4/AAC、WebM/Opus 等大多数浏览器支持的编码), 本工具将其提取并导出为 WAV(无损 PCM),不二次有损压缩;如需 MP3 / AAC / OGG 等有损格式,请用专门的音频转换工具。 少数容器或编码(如部分 AVI / WMV / MKV)浏览器无法解码,会给出友好错误提示——可先转码为 MP4 再提取。文件永不上传。

就绪 · 选择视频后即可提取音频并导出 WAV
第一节

关于本工具

About

剪辑师要交人声轨,手边只有一段带背景音的会议录像。把视频拖进来,它调用 FFmpeg 直接抽离音频流,输出 MP3 或 WAV,不重新编码——所以几秒钟就能完成,画质损失也无从谈起。文件全程在本地处理,不经过服务器。

使用场景

播客剪辑前备份

录制完一期 90 分钟的双人对谈播客,准备在 Audition 里剪掉口误和冷场。原始视频文件 4 个 G,剪辑软件预览卡顿,每次拖动进度条都要等几秒。先把这个视频文件拖进本工具,只提取出 128kbps 的 MP3 音频,体积缩到 80 MB。用轻量级音频编辑器打开这个 MP3,秒切秒放,标记好时间码再回头剪视频,效率翻倍。

网课下载转音频

考研冲刺期,每天通勤来回两小时,地铁上信号差、流量贵。晚上在家用电脑把网课录屏视频(每节 45 分钟,约 600 MB)拖进本工具,转成 64kbps 的 AAC 音频,每节不到 30 MB。第二天路上用手机播客 App 离线听,省流量且不用盯着屏幕晕车,两周刷完 40 节政治课。

会议录像转文字前处理

季度复盘会录了 3 小时,需要交给 AI 语音转写工具出纪要。但原始视频文件里混着空调噪音和翻纸声,直接喂给转写软件,准确率不到 70%。先用本工具把视频的音频轨道单独抽出来,输出 16kHz 单声道 WAV 格式,再丢进转写工具,噪音被过滤掉大半,转写准确率升到 92%,后期只改了几个专业术语。

音乐人扒带练习

想扒一首 YouTube 上 2024 年新出的爵士吉他曲,但视频里吉他 solo 被鼓和贝斯盖住。把视频下载后拖进本工具,提取出 320kbps 的 MP3,再导入 DAW 里用 EQ 滤掉 200Hz 以下的低频和 8kHz 以上的高频,剩下中频段 solo 清晰可辨。不用买正版分轨,也不用等官方出伴奏,半小时扒完主旋律。

婚礼视频存档减负

婚礼当天请了双机位跟拍,最终交付 4K 视频 200 多个片段,共 120 GB。手机和网盘都快满了,又舍不得删原片。把所有视频批量拖进本工具,提取出 192kbps 的 MP3 音频,只保留 1 GB 的音频文件。原片存在冷备硬盘里,手机里只留音频,随时翻听司仪致辞和交换戒指时的背景音乐,回忆感不减,存储压力归零。

第二节

使用指南

Getting Started

使用步骤

  1. 1点击「选择文件」按钮,上传一个视频文件(支持 MP4、AVI、MOV 等常见格式),上传后文件名会显示在按钮旁
  2. 2在「输出格式」下拉菜单中选取目标音频格式(MP3 / AAC / WAV / FLAC),选中后格式标签会高亮
  3. 3点击「开始提取」按钮,进度条从 0% 推进至 100%,提取完成后按钮文字变为「下载」
  4. 4点击「下载」按钮,浏览器自动将音频文件保存到本地,文件名与源视频同名但后缀改为所选格式

输入输出示例

输入输出说明
https://example.com/demo.mp4(时长 3 分 20 秒,H.264 视频 + AAC 音频)demo.mp3(320 kbps,44100 Hz,立体声,文件大小约 7.6 MB)常规:最典型使用场景——从常见 MP4 中提取高质量音频,验证基本提取功能与默认输出格式
https://example.com/silent_video.mkv(时长 10 秒,无音频轨道的纯视频文件)错误提示:输入文件中未检测到音频流,无法提取边界:用户可能误以为所有视频都有音频,此示例暴露工具对无音轨文件的处理逻辑
https://example.com/large_4k.mp4(时长 2 小时,4K 分辨率,DTS 5.1 声道音频)large_4k.wav(无损 PCM,48000 Hz,6 声道,文件大小约 3.2 GB)边界:大文件 + 多声道无损格式,测试工具对长时间视频和复杂音频编码的兼容性
https://example.com/corrupt.avi(文件头损坏,播放器无法打开)错误提示:文件格式无法识别或已损坏,请检查输入易错:用户常上传损坏文件,此示例说明工具在输入异常时的容错表现
https://example.com/sample.flv(时长 1 秒,单声道 8 kHz 低质量音频)sample.ogg(64 kbps Vorbis,8000 Hz,单声道,文件大小约 8 KB)边界:极短时长 + 极低采样率,验证工具对非标准参数的处理能力
https://example.com/audio_only.m4a(纯音频文件,无视频轨,AAC 编码)audio_only.mp3(320 kbps,44100 Hz,立体声,文件大小约 1.2 MB)易错:用户可能误以为工具只能处理视频,此示例暴露工具对纯音频输入的响应(直接转码而非报错)
https://example.com/encrypted.mp4(受 DRM 保护,需授权播放)错误提示:文件受版权保护或加密,无法提取音频易错:DRM 视频在浏览器端无法处理,此示例说明工具对加密内容的明确拒绝

常见错误对照

1.输出格式选了不支持的有损格式,但期望无损音质

✗ 错误从 4K 视频提取音频,输出格式选 .mp3,结果发现音质明显下降
✓ 修复从 4K 视频提取音频,输出格式选 .wav 或 .flac,保留原始采样率与位深

MP3 是有损压缩编码,会丢弃高频与弱信号;WAV/FLAC 为无损格式,保留原始 PCM 数据。FFmpeg 默认用 lame 编码 MP3,固定比特率会进一步劣化。

2.源视频含多音轨时未指定轨道,提取到错误的语言

✗ 错误提取双语电影音频,直接点转换,结果拿到的是导演评论轨而不是主声道
✓ 修复使用 FFmpeg 的 -map 0:a:0 或 -map 0:a:1 明确指定轨道索引(0 为第一音轨)

FFmpeg 默认选择第一个音轨(a:0),但多轨视频中第一个可能是评论音轨或次要语言。不指定轨道时,工具按流顺序自动选,与用户预期可能不一致。

3.输入视频时长太长,浏览器端处理超时崩溃

✗ 错误上传一部 2 小时电影到纯浏览器版,等待 5 分钟后页面提示「无响应」
✓ 修复改用服务端处理,或先将视频裁剪为 10 分钟以内的片段再提取

WASM 版 FFmpeg 运行在浏览器主线程,大文件会阻塞 UI 并触发浏览器「页面无响应」保护。服务端 Go 后端无此限制,但文件上传也有大小上限(通常 500MB)。

4.输出文件名未加扩展名,导致无法播放

✗ 错误提取后文件保存为「会议录音」,双击无法打开,系统提示格式未知
✓ 修复保存为「会议录音.mp3」或「会议录音.wav」,带上标准音频扩展名

操作系统靠扩展名关联播放器;无扩展名时系统无法识别格式,即使文件头正确。FFmpeg 输出时若未指定扩展名,也会因缺少容器格式而报错。

5.视频本身无声轨,提取后得到静音文件

✗ 错误从屏幕录制教程视频提取音频,输出文件时长正常但完全无声
✓ 修复提取前用播放器预览视频,确认有声音波形;或检查工具是否提示「无音频流」

部分录屏软件、动画视频、GIF 转视频可能不含音频流。FFmpeg 遇到无音频流时仍会生成空容器(如静音 MP3),用户误以为提取成功。

6.采样率设置过高,文件体积暴增且无听觉收益

✗ 错误提取人声播客,采样率设为 192kHz,结果 5 分钟文件达 200MB
✓ 修复人声内容用 44.1kHz 或 48kHz 即可;音乐内容最高 96kHz

人耳听觉上限约 20kHz,根据奈奎斯特采样定理,44.1kHz 已能完整还原 22kHz 以下频率。192kHz 仅对蝙蝠研究或特殊科学测量有意义,日常使用纯属浪费带宽和存储。

第三节

工作原理

How It Works

核心公式

采样率 × 位深度 × 声道数 × 时长 = 原始 PCM 数据量

变量说明

  • 采样率每秒采样次数,单位 Hz
  • 位深度每个采样点的比特数,如 16 bit
  • 声道数音频通道数,单声道=1,立体声=2
  • 时长音频持续时间,单位秒

示例

一段 3 分钟(180 秒)立体声视频,提取为 CD 音质(44.1 kHz、16 bit):原始 PCM 数据量 = 44100 × 16 × 2 × 180 = 254,016,000 bit ≈ 30.3 MB(未压缩 WAV)。实际输出 MP3 等有损格式后文件大小约 3–5 MB,压缩比约 6–10 倍。

视频文件(MP4/MOV/AVI)FFmpeg 解码分离音频流格式转换(MP3/WAV/OGG)音频文件下载保存浏览器内 WASM 执行可选比特率 / 采样率
用户输入 本地处理 输出结果 关键说明
第五节

常见问题

Q & A
提取出来的音频文件在哪里下载?为什么我点了没反应?

转换完成后,页面会出现下载按钮或文件链接。如果点了没反应,先检查浏览器是否拦截了弹窗或自动下载——Chrome 地址栏右侧会有拦截图标,点击允许即可。另外,部分手机浏览器(如微信内置浏览器)不支持直接下载,建议复制链接到系统自带浏览器或电脑上操作。如果视频文件较大(超过 200MB),转换和下载需要等待几秒到几十秒,进度条走完前按钮不可点击。

支持提取 MP4 以外的视频格式吗?比如 AVI、MKV、FLV?

支持。后端用 FFmpeg 处理,常见视频容器(MP4、AVI、MKV、MOV、FLV、WMV、WEBM)都能识别,音频编码(AAC、MP3、AC3、FLAC、PCM)也能自动解析。但有个边界情况:如果视频文件本身是“无音频轨”的(比如纯画面录像、无声动画),工具会提示“未检测到音频流”,此时无法提取,不是工具问题。上传前可以用播放器确认文件是否有声音。

转换出来的音频音质怎么样?和原视频比有损失吗?

默认输出为 128kbps MP3,对大多数播客、语音笔记、短视频背景音来说够用,听感与视频原声无明显差异。如果你需要更高音质(比如用于音乐采样或混音),目前工具未开放参数调节,固定输出 44.1kHz 采样率。原视频如果是 320kbps 以上高码率音频,转换后会有一定压缩损失,但人耳在普通耳机或手机外放上很难分辨。追求无损可考虑 FLAC 格式工具。

上传了一个小时的长视频,为什么等了很久还没转换完?

视频时长越长、分辨率越高,FFmpeg 编码耗时越长。1 小时 1080p 视频大约需要 1-3 分钟完成(取决于服务器负载)。如果超过 5 分钟仍无结果,可能是文件上传中断或服务器超时——建议先检查文件是否完整(用播放器能否正常播放),再尝试分割视频为 30 分钟以内片段分批提取。目前单文件上限为 500MB,超过会直接拒绝上传。

提取的音频能直接用于 YouTube 或播客平台吗?

可以,但需要注意格式兼容性。本工具输出 MP3,YouTube 音频库支持 MP3 上传,但要求比特率不低于 128kbps(本工具满足)。播客平台(如 Apple Podcasts、小宇宙)通常要求 MP3 且 ID3 标签完整——本工具不添加元数据(标题、封面、艺术家),上传前建议用 Audacity 或 Mp3tag 补上专辑封面和曲目信息,否则客户端显示为“未知曲目”。

提取出来的音频时长和原视频不一样,短了几秒,怎么回事?

极少数情况下会出现。原因是某些视频的音频流末尾包含静音填充或编码延迟(尤其是从直播录屏、剪辑软件导出的文件),FFmpeg 在提取时默认会截掉开头和结尾的空白帧。如果差别在 1-2 秒以内属于正常现象;如果差距超过 5 秒,说明原视频音视频不同步或存在损坏帧。可以先用播放器快进到视频末尾,确认最后几秒确实有声音再重试。

和剪映、格式工厂自带的音频提取比,这个工具有什么区别?

剪映和格式工厂是本地安装软件,需要下载、安装、学习界面操作,适合批量处理或需要调参数(如自定义码率、声道)的用户。本工具纯在线,无需注册安装,适合临时、单次、快速提取——比如从网上下载的一段视频只要背景音乐,30 秒就能拿到 MP3。缺点是功能单一(不能裁剪、不能调音质),且受网络和文件大小限制。如果经常处理几十个文件,建议用格式工厂;如果偶尔用一次,在线工具更方便。

隐私保证所有计算与处理均在你的浏览器本地完成,输入数据不会上传服务器,也不会保存或共享。

选择 打开 +新窗口 esc关闭