OpenRouter

OpenRouter 影片生成上線:一個 API 路由所有影片模型

OpenRouter 把影片生成納入統一路由層:Seedance、Veo 3.1、Wan、Sora 2 Pro 走同一個 schema 與計費,非同步 job 模型加上 /api/v1/videos/models 能力探索端點。本文整理四大正規化設計、參數差異的地雷,以及 LLM prompt 接影片的多模態工作流。

OpenRouter 影片生成上線:一個 API 路由所有影片模型 — 文章封面
本頁內容6 個段落
  1. 為什麼需要統一:影片 API 的碎片化
  2. 參數地雷:duration 都能讓請求掛掉
  3. 能力探索端點:給 coding agent 的完美介面
  4. 多模態工作流:LLM 寫 prompt、圖像模型造角色、影片模型拍場景
  5. 導入建議
  6. 參考來源

影片生成正式上線 OpenRouter:一個 API 取用頂尖影片模型,與文字、圖像、音訊、embeddings、rerankers 並列,共用同一套路由、治理與計費層。上路首日支援 text-to-video 與 image-to-video,模型涵蓋 Seedance 2.0/1.5、Veo 3.1、Wan 2.7/2.6 與 Sora 2 Pro,後續持續增加;新端點是 /api/v1/videos

為什麼需要統一:影片 API 的碎片化

各家的影片 API 各自為政——request 形狀、參數名稱、計費單位全都不同。OpenRouter 的解法繞著四個正規化設計展開:非同步生成(生成要跑數分鐘,一律以 job 追蹤:送 prompt、拿 job ID、就緒後取回影片);正規化參數(單一 schema 跨所有模型,涵蓋 resolution、duration、aspect ratio、音訊生成、frame images 與 reference images);能力探索(呼叫前先用程式查明每個模型支援什麼);透傳參數(需要模型專屬功能時直接下傳)。

參數地雷:duration 都能讓請求掛掉

影片模型之間的差異遠比表面看不出來的地方多。最典型的例子是 duration:Veo 3.1 支援 4、6、8 秒,Wan 2.6 支援 5 或 10 秒——帶錯值請求直接失敗。另一層碎片化是端點家族:同一模型常把 text-to-video、image-to-video、reference-to-video 拆成不同 endpoint;OpenRouter 依你的參數自動路由到正確端點,這層複雜度對呼叫者隱形。reference images(角色設定)與 frame images(首尾幀)的傳法也做了標準化。

能力探索端點:給 coding agent 的完美介面

/api/v1/videos/models 一個呼叫列回每個模型支援的 resolution、aspect ratio、定價、輸入圖片與時長——官方直接點名這是「給你的 coding agent 的完美端點」:agent 能據此適應每個模型,不用在錯誤訊息裡試出可接受的參數。模型專屬功能也有出口:Veo 3.1 獨有的 personGeneration 參數(控制輸出是否出現人物)就是透傳參數的例子。模型頁另新增 Playground 分頁,可以實際試看產出。

多模態工作流:LLM 寫 prompt、圖像模型造角色、影片模型拍場景

官方最興奮的應用是組合式工作流:LLM 把粗略想法展開成詳細 prompt、圖像模型生成主角、影片模型把角色變成場景——全部走同一個 API。實作心得很直白:這些模型獎勵具體——運鏡、光線、質地、節奏、動態風格全都影響結果,細節越多控制越多,這正好讓影片生成與 LLM 生成的 prompt 天作之合。OpenRouter 開源了示範應用 multimedia-explorer(程式碼在 GitHub),把這條多模態管線完整走一遍。

導入建議

三個實務起點:先把 /api/v1/videos/models 接進你的 agent 或程式碼生成流程,把參數驗證交給能力探索而不是 try-and-error;計費以各模型定價為準,跨模型比價在同一份清單裡就能做完;要做產品級的多模態管線,從 multimedia-explorer 的開源碼抄架構——LLM→圖像→影片的鏈條它已經跑通。回饋與下一批模型的需求,官方開了 Discord 的 #video-feedback 頻道收集。

參考來源

本文由 AI 協助自上述來源整理,經人工審核後發布。

分享X電郵