操作 · 擷取音訊

從影片擷取音訊,直接拿回 MP3 與音訊長度。

POST 一個影片 URL,就拿回 MP3 以及音訊長度。Fotovid 在代管的基礎架構上完成擷取,你的技術堆疊裡不必放任何二進位檔,也不用自建處理流程。

curl -X POST https://api.fotovid.co/v1/video/extract-audio \
  -H "Authorization: Bearer p6_YOUR_KEY_ID:YOUR_SECRET" \
  -H "Content-Type: application/json" \
  -d '{
    "source_url": "https://cdn.yoursite.com/talk.mp4"
  }'

把音訊從影片裡抽出來,不該逼你在伺服器上裝 ffmpeg

從影片抽出音軌,用 ffmpeg 只要一行指令——前提是你不打算在 serverless 函式裡跑它。ffmpeg 靜態編譯的二進位檔動輒數十 MB,遠遠超出 Vercel、Netlify 與 Lambda 的部署大小上限。把影片解碼再重新編碼成 MP3 非常吃 CPU 與記憶體,除了規格最大的執行個體以外,都很容易撞上函式逾時與冷啟動限制。就算跑得動,你還是得自己下載來源檔、開子行程呼叫外部指令、接住輸出檔案,再把結果上傳到可長期保存的儲存空間。

  • ffmpeg 靜態編譯版體積太大,多數 serverless 部署產物根本打包不進去
  • 擷取音訊要把整段音軌重新編碼,很快就會撞上 CPU、記憶體與逾時上限
  • 你還得找地方存放產出的 MP3,並回傳一個應用程式能直接用的 URL
  • 當你只想要那個 MP3、不想自己養一整套媒體處理管線時,就用這個端點

請求參數

POST /v1/video/extract-audio

不需要任何參數——送出 source_url,就拿回 MP3 與音訊長度。

FieldTypeDefaultDescription
source_url*string (URL)來源影片的 HTTPS URL(MP4、MOV、WebM、MKV 等)
How it works

三個步驟完成第一次呼叫

  1. 1
    取得免費 API 金鑰

    註冊後在控制台建立金鑰。請求以 Authorization: Bearer p6_<key_id>:<secret> 標頭進行驗證。新金鑰一開始就附贈免費 credits,計費完全依用量計算——$1 可買 100 credits,而這個操作每次呼叫約 1 credit,不必事先承諾任何方案。

  2. 2
    把影片 POST 到 /v1/video/extract-audio

    以標準的請求封裝格式向 https://api.fotovid.co/v1/video/extract-audio 發出請求:source_url 指向你影片的 HTTPS URL,params 則傳一個空物件——擷取音訊不接受任何參數。Fotovid 會下載影片、抽出音軌,並同步編碼成 MP3,檔案一好就立刻回傳。

  3. 3
    使用回傳的 MP3 URL

    回應是扁平的 JSON:id、type、指向該 MP3 的 fotovid 代管 url、expires_at,以及以秒為單位的音訊 duration。你可以把 url 直接餵給 podcast feed、語音轉文字或 AI 處理流程,或是播放器。由於代管結果是暫時性的,請在自己的流程裡把 MP3 下載下來並保存一份。

常見問題

一次 API 呼叫就能上線

拿一把免費金鑰,五分鐘內完成你的第一次呼叫。