ByteDance Seedance 2.5 上線:30 秒一鏡到底、音畫同步生成

Read this article in English →

ByteDance Seedance 2.5 上線:30 秒一鏡到底、音畫同步生成

ByteDance 旗下的影片生成模型「Seedance」,在 2026 年 7 月 31 日推出了最新的 2.5 版本,率先在「即夢 AI」與「豆包專業版」開放使用。這個版本最大的賣點很直接:單次生成最長 30 秒的影片,而且是「一鏡到底」——不需要像過去那樣把長片拆成好幾段 5 秒、8 秒的短片再手動拼接,同時還能讓畫面與聲音在同一次生成中一起產出,不用另外配音配樂。

從「畫面」進化到「畫面加聲音」

Seedance 2.5 最關鍵的技術躍進,是把「影片生成」與「音訊生成」合併成同一道工序。過去大多數 AI 影片工具,就算能生成不錯的畫面,聲音(對白、音效、背景音樂)通常還是得靠另一套工具事後補上,這也是「AI 影片看起來很假」的主要原因之一——畫面動作跟聲音對不上。ByteDance 這次直接讓模型「邊生成畫面、邊生成對應的聲音」,等於是把過去要跑兩套系統才能完成的事,收進同一次推論裡完成。

多模態參考輸入大幅擴充

除了時長與音訊,Seedance 2.5 另一個明顯升級,是可以塞進去的「參考素材」數量大幅增加:單次輸入最多可以放 30 張圖片、10 段影片與 10 段音訊,讓創作者可以用這些素材去描述角色身份、場景、構圖、運鏡、聲音甚至節奏與創作風格,遠比前代版本能接受的參考數量寬鬆許多。實務上,這代表創作者可以丟入更多「這是什麼角色」「這是什麼運鏡」的視覺與聽覺線索,讓模型有更多依據去產生連貫的畫面,而不是每次生成都得靠純文字描述硬猜。

Seedance 2.5 也內建了「局部編輯」與「片段延伸」的能力——可以只替換畫面裡的某個主體、增減物件,或換掉配樂,同時讓其餘部分維持不變;也可以從一段已生成影片的最後一幀「接著往後生」,或反過來生成「這一幕發生之前」的畫面,甚至把兩段風格不同的片段自然銜接起來。這些編輯與延伸功能,讓 Seedance 2.5 更像是一套「可以反覆修改的創作工具」,而不是一次性、生成完就定型的黑盒子。

解析度與定價:官方還沒說清楚

值得注意的是,Seedance 2.5 在正式開放時,並未公布明確的解析度規格與官方定價。網路上流傳的「原生 4K」或「原生 1080p」等說法,目前都還只是各平台或第三方轉售商各自的說法,尚未見到 ByteDance 官方文件正式確認;比較可以確定的是,2.5 版本相較於前一代,畫面在解析度上限、貼圖細節與光影表現上都有實際提升。定價方面同樣如此——目前市面上能看到的「每分鐘多少錢」報價,多半來自個別平台自訂的方案,並不等於 ByteDance 官方對這顆模型的定價,兩者不宜混為一談。

API 即將開放,但眼下還是網頁版優先

想直接用程式串接 Seedance 2.5 的開發者,目前得再等等:ByteDance 官方表示 API 存取將透過 Volcano Engine(火山引擎)/BytePlus 的 Ark 平台「即將推出」,現階段 2.5 版本主要還是透過即夢 AI 與豆包專業版這兩個消費端網頁應用開放使用,尚未全面開放給企業或開發者直接呼叫。

業界怎麼看

前代 Seedance 2.0,在具備音訊生成能力的影片模型中,一度是圖生影片排行榜上的領先者,在第三方評測平台 Artificial Analysis 的 Elo 排行上取得約 1,225 分,位居第三,僅次於 Gemini Omni Flash(1,246 分)與 MiniMax H3(1,242 分);2.5 版本目前尚未被主流評測平台正式收錄評分,實際表現仍待時間驗證。而業界內部對這類工具的態度,也頗值得玩味——有動畫製片人私下形容,目前業界對於是否使用 Seedance 這類工具,其實是一種「不問不說」的默契,反映出 AI 影片工具在專業製片圈裡,仍處於一個「用是在用、但沒人想公開承認」的尷尬階段。

這代表什麼

Seedance 2.5 這次更新,方向相當清楚:把「畫面生成」「聲音生成」「多素材參考」「局部編輯」全部整合進同一套系統,讓創作者不必再拼接好幾種工具才能完成一支像樣的短片。但解析度與定價的資訊真空,也提醒創作者在正式導入生產流程前,最好先實際測試、拿到官方明確規格,而不是照單全收各平台自行加工過的行銷說法。

關於作者

我是 Ryan,RyanOps 的站主。平日的工作是軟體開發與自動化,在這裡整理 AI 模型、開發工具與軟體工程的重要變化,也記錄自己實際除錯、實作過的技術筆記。

關於本站與編輯流程 →