← 所有主題

Video Generation

此主題的繁體中文文章,最新優先。

20 篇文章
繁體中文

2026

18 篇文章

  1. Video Generation

    把 30 秒長鏡頭寫進 API:Seedance 2.5 的規格取捨與計費邏輯

    Seedance 2.5 支援 30 秒單次生成與影片參考輸入,但解析度上限只有 720p,計費依影片 token 而非秒數。

    閱讀文章 ↗

  2. Open Models

    MiniMax H3 開源:一次生成 2K 影片與立體聲的全模態模型

    MiniMax 於 7 月 31 日發表 Hailuo 後繼者 H3,數日後釋出權重:33B 全模態 Transformer 同時生成最長 15 秒、768p 起步 2K 的影片與原生立體聲,ComfyUI Day-0 支援,量化後 RTX 3060 也能本地運行。

    閱讀文章 ↗

  3. Video Generation

    Seedance 2.5 登場:30 秒一鏡到底,一次參考 30 張圖與 10 段音訊

    ByteDance Seed 團隊 7 月 31 日發表影片生成模型 Seedance 2.5:單次生成 30 秒、可多輪延伸成多分鐘成片,一次可引用 30 張圖、10 段影片與 10 段音訊,已上架即夢與豆包。

    閱讀文章 ↗

  4. Generative AI

    FLUX 3 登場:影片、圖像、聲音一個骨幹全包

    Black Forest Labs 發表多模態基礎模型 FLUX 3:最長 20 秒含原生音訊的影片生成、多語言文字渲染,並推出以 FLUX 3 為骨幹的機器人動作模型 FLUX-mimic。

    閱讀文章 ↗

  5. Google DeepMind

    DeepMind GenCeption:影片生成模型就是通用視覺學習器

    Google DeepMind 提出 GenCeption,把文字轉影片擴散模型改造成可用文字指令驅動的通用前饋感知模型,在深度、分割、相機姿態等任務達到 SOTA,所需訓練數據最多減少 500 倍。

    閱讀文章 ↗

  6. Generative AI

    Character.AI 進軍微短劇:c.ai Series 原創劇集登場

    Character.AI 推出 c.ai Series 自製微短劇格式,首波三齣劇集登場,18 歲以上觀眾能直接與劇中角色對話、改寫劇情,把核心聊天產品接進影集,成為微短劇市場最新的互動敘事玩家。

    閱讀文章 ↗

  7. Gemini

    Nano Banana 2 Lite 登場:4 秒生圖、單張 3.4 美分的高速影像路線

    2026 年 6 月 30 日,Google 發表 Nano Banana 2 Lite:約 4 秒完成文字生圖、每張 0.034 美元,同場推出 Gemini Omni Flash 影片模型,用「快出圖、再動圖」的串接工作流把低成本高速生成推向主流。

    閱讀文章 ↗

  8. Generative AI

    Adobe 收購 Topaz Labs:裝置端 AI 影像增強補強 Firefly

    Adobe 於 2026 年 6 月 25 日宣布收購影像增強公司 Topaz Labs,交易預計下半年完成。Topaz 的 Astra、Wonder 模型與 Neurostream 本地運算技術將整合進 Firefly 與創作套件,把大型視訊模型搬進消費級 GPU。

    閱讀文章 ↗

  9. Generative AI

    Decart Oasis 3 世界模型開放 API:即時生成三鏡頭駕駛世界

    2026 年 6 月 10 日,Decart 推出首個以 API 開放的互動世界模型 Oasis 3:22 FPS 三鏡頭駕駛場景、每秒 0.02 美元,背後是 3 億美元新輪募資;實測仍見主題漂移與物理失真。

    閱讀文章 ↗

  10. OpenRouter

    OpenRouter 影片生成上線:一個 API 路由所有影片模型

    OpenRouter 把影片生成納入統一路由層:Seedance、Veo 3.1、Wan、Sora 2 Pro 走同一個 schema 與計費,非同步 job 模型加上 /api/v1/videos/models 能力探索端點。本文整理四大正規化設計、參數差異的地雷,以及 LLM prompt 接影片的多模態工作流。

    閱讀文章 ↗

  11. OpenAI

    Sora 1 美國下架:OpenAI 把影片生成收進 ChatGPT

    2026 年 3 月 13 日,Sora 1 在美國正式下架,未匯出的舊內容一併刪除;同週 The Information 報導 OpenAI 計畫把 Sora 影片生成搬進 ChatGPT。本文解析這波產品整併的商業邏輯,以及創作者該記住的資料風險教訓。

    閱讀文章 ↗

  12. Video Generation

    PixVerse 籌得 3 億美元 C 輪,成為亞洲 AI 影片獨角獸

    2026 年 3 月 12 日,阿里巴巴支持的 AI 影片生成平台 PixVerse 完成 3 億美元 C 輪融資,估值突破 10 億美元,由 CDH Investments 領投,是亞洲 AI 影片類別最大一輪。本文解析其產品線、1.6 億月活背後的數據與新加坡全球佈局。

    閱讀文章 ↗

  13. Video Generation

    ByteDance Seedance 2.0 登場:音視訊統一生成,15 秒多鏡頭立體聲

    2026 年 2 月 12 日,ByteDance Seed 團隊發布 Seedance 2.0,以統一多模態架構一次生成 15 秒多鏡頭影片與同步立體聲音軌,支援文字、圖片、音訊、影片四種輸入混合,先在中國上線,再經第三方平台走向海外。

    閱讀文章 ↗

  14. Google DeepMind

    Google Project Genie 上線:世界模型即時生成可玩世界,遊戲股應聲重挫

    Google 於 1 月 29 日向 AI Ultra 訂閱者開放 Project Genie,首個基於 Genie 3 世界模型的公開產品,可從文字與圖片即時生成可互動 3D 世界。次日 Unity 一度暴跌近 24%,遊戲股全面下挫。

    閱讀文章 ↗

  15. xAI

    xAI 開放 Grok Imagine API:影片生成原生帶音訊

    xAI 於 2026 年 1 月 28 日推出 Grok Imagine API,提供原生音訊的影片生成,並宣稱在品質、成本與延遲上達到 state-of-the-art。本文解析影片生成 API 市場的競爭格局與開發者的評估重點。

    閱讀文章 ↗

  16. Video Generation

    Runway「The Turing Reel」實測:僅 9.5% 的人能穩定看穿 AI 影片

    Runway 用 Gen-4.5 生成影片與真實素材做對照測試,1,043 位受測者的整體正確率只有 57.1%,僅 9.5% 達統計顯著。本文解析測試方法、錯誤分佈,以及為何 Runway 呼籲放棄肉眼偵測、改走 C2PA 溯源路線。

    閱讀文章 ↗

  17. Content Creation

    YouTube 執行長年度信:打擊 AI slop 與深偽列為 2026 首要任務

    2026 年 1 月 21 日,YouTube 執行長 Neal Mohan 發表年度信,把打擊 AI slop 與深偽偵測列為年度優先,同時預告 AI 分身 Shorts 與文字生遊戲。一手緊縮、一手擴張的平台 AI 策略解析。

    閱讀文章 ↗

  18. Hugging Face

    Overworld 開源 Waypoint-1:鍵盤滑鼠即時操控的擴散世界模型

    2026 年 1 月 20 日,Overworld 在 Hugging Face 發布 Waypoint-1:以 10,000 小時遊戲影片訓練的即時互動世界模型,2.3B 開源,RTX 5090 上 30 FPS。文中解析 rectified flow 架構、WorldEngine 推理優化與世界模型離實用的距離。

    閱讀文章 ↗

2025

2 篇文章

  1. Video Generation

    Midjourney V1 影片模型問世:圖生影片最長約 21 秒

    2025 年 6 月 18 日,Midjourney 推出首款影片生成模型 V1,可將靜態圖片轉為 5 秒短片,最長延長至約 21 秒,定價約為圖片生成的 8 倍。本文整理功能、用量限制、定價,以及它在 Veo 3 與 Sora 之間的位置。

    閱讀文章 ↗

  2. Google

    Veo 3開放Gemini Pro訂閱戶試用,AI Ultra推進73國

    2025年5月30日Google擴大Veo 3供應範圍:Gemini應用程式的AI Pro訂閱戶可試用這款含音訊的影片生成模型,AI Ultra方案亦推進至73國;DeepMind執行長Hassabis稱上線數日已生成數百萬支影片。

    閱讀文章 ↗