从视频中提取音频,直接拿回 MP3 和时长。
POST 一个视频 URL,返回 MP3,并附带时长。提取过程跑在 Fotovid 的托管基础设施上,你的技术栈里不用放二进制,也不用自建处理流水线。
curl -X POST https://api.fotovid.co/v1/video/extract-audio \
-H "Authorization: Bearer p6_YOUR_KEY_ID:YOUR_SECRET" \
-H "Content-Type: application/json" \
-d '{
"source_url": "https://cdn.yoursite.com/talk.mp4"
}'从视频里剥离音轨,不该逼你在服务器上装 ffmpeg
从视频里取出音轨,本来只是一行 ffmpeg 命令——直到你打算把它放进 serverless 函数里跑。静态编译的 ffmpeg 二进制有几十 MB,远远超出 Vercel、Netlify 和 Lambda 的部署体积上限。解码视频再重新编码成 MP3 极其吃 CPU 和内存,除了最高配的实例,其它都会撞上函数超时和冷启动限制。而且你还得自己下载源文件、起子进程调命令、接住输出文件,再把结果上传到一个能长期保存的地方。
- ffmpeg 静态构建体积太大,大多数 serverless 部署产物根本打包不进去
- 提取音频要把整条音轨重新编码,很容易顶到 CPU、内存和超时的上限
- 你还得找地方托管生成的 MP3,并给应用返回一个可用的 URL
- 当你只想要那份 MP3、不想自己维护任何媒体处理管道时,就用这个接口
请求参数
POST /v1/video/extract-audio
没有参数——POST 一个 source_url,就能拿回 MP3 和时长。
| Field | Type | Default | Description |
|---|---|---|---|
| source_url* | string (URL) | — | 源视频的 HTTPS URL(MP4、MOV、WebM、MKV 等) |
三步完成第一次调用
- 1领取免费 API 密钥
注册后在控制台创建密钥。请求通过 Authorization: Bearer p6_<key_id>:<secret> 请求头完成鉴权。新密钥自带免费 credits,计费完全按用量走——$1 可买 100 credits,本操作每次调用约消耗 1 credit,无需预先绑定任何套餐。
- 2把视频 POST 到 /v1/video/extract-audio
向 https://api.fotovid.co/v1/video/extract-audio 发送请求,请求体使用标准信封结构:source_url 指向你视频的 HTTPS URL,params 传一个空对象——提取音频不接受任何参数。Fotovid 会下载视频、剥离出音轨并同步编码为 MP3,文件一就绪就立刻返回。
- 3使用返回的 MP3 URL
响应是扁平的 JSON:包含 id、type、由 Fotovid 托管的 MP3 url、expires_at,以及以秒为单位的音频 duration。这个 url 可以直接接进播客 feed、转写或 AI 流水线,或者交给播放器。托管结果是临时的,记得在你的流程里下载并自行保存一份 MP3。
