← 返回 Siami 首頁

ByteDance Seedance 2.5 正式發布:30 秒一鏡到底、50 組多模態參考,影片生成門檻再次下修

▲ 7
ByteDance Seedance 2.5 正式發布:30 秒一鏡到底、50 組多模態參考,影片生成門檻再次下修

編按:本文綜合整理自 ByteDance Seed 官方部落格the-decoder 報導TechTimes 報導Cined 報導CNET 報導Hacker News 討論串,並加入 Siami 編輯部觀點與分析。

ByteDance 旗下 Seed 團隊於 7 月 31 日正式發表新一代影音聯合生成模型 Seedance 2.5。這是 Seedance 2.0(2025 年 4 月發布)後的最大改版,把單次生成的影片長度從 15 秒一口氣拉到 30 秒,並首次加入「原生 4K」、「最多 50 組多模態參考」、「時間軸層級編輯」三項業界尚未有同類模型能完整支援的能力。隨文釋出的官方 demo 影片全長 30 秒一鏡到底,已在 X、Hacker News、Reddit r/PostAI 引發熱議。

三大升級:把「demo 模型」推進到「production 工具」

官方部落格把這次改版重點整理成三段,每一段都直接對應目前業界最難解決的痛點。

第一,30 秒單鏡長度。 Seedance 2.0 的 15 秒單鏡在 demo 階段已經足夠驚艷,但要拿來做電影預告、MV、廣告分鏡都還差一截。Seedance 2.5 把單次生成拉到 30 秒,且官方強調不需要任何 post-stitching——這對比 Veo 3.1 與 Sora 2 仍然需要靠 editorial 拼接 6-8 秒片段的工作流是明顯領先。30 秒內模型可以組織多個邏輯鏡頭:起、承、轉、合,因此 demo 影片中的「後台歌手從化妝間走到舞台上開唱」連續動作,是在單一生成 call 內完成。

第二,全方位多模態參考。 過去 AI 影片模型要嘛只能吃文字、要嘛只能吃一張圖。Seedance 2.5 一次可以輸入最多 30 張圖片、10 段影片、10 段聲音當參考素材,並加強「黏土渲染(clay render)、動態(motion)、創意風格(creative)」三類參考能力。對動畫團隊而言,這代表可以用一張角色設定圖 + 一段 5 秒動作捕捉 + 一首 citypop 風格 demo,直接請模型產出 30 秒的 character-driven 短片。

第三,時間軸層級編輯。 過去 AI 影片模型最大的痛點是「生成了 30 秒,但中間某一秒要改個物件」——只能整段重來。Seedance 2.5 提供 timestamp-level 控制,可以針對特定秒數的音訊、影像、鏡頭運動做局部編輯。同時新增的還有綠幕(green screen)、3D camera blockout、reference-based editing——這三項是廣告與 MV 製作組真正把模型放進 production pipeline 的關鍵。


為什麼這件事重要

AI 影片模型在 2024-2025 年經歷了一段尷尬期:每次新模型發表都會有「驚艷的 demo 影片」與「產線上無法使用」的落差。核心問題有三個:

  • 長度太短:6-15 秒單鏡難以撐起真正的敘事
  • 可控性不足:無法只改某一段、某個角色、某個物件
  • 參考素材單薄:只能用文字,無法把既有素材當「骨幹」

Seedance 2.5 把這三個問題同時解決。它的訊號意義不只是「ByteDance 又出了一個新模型」,而是 「中國 AI 影片模型已從『追趕 Sora』階段進入『重新定義 production workflow』階段」——Artificial Analysis 的 Text-to-Video Arena(盲測人類偏好排行)上,Seedance 2.0 已以 Elo 1,219 領先;Seedance 2.5 雖然尚未登榜,但官方 demo 影片的細節(30 秒一鏡、角色一致性、聲音同步)已超越目前榜上前五名任何一款。

全球 AI 影片競爭格局而言,這是 Sora 2(OpenAI)、Veo 3.1(Google DeepMind)、Kling 3.0(快手)、Runway Gen-4 必須在 Q3 內跟進的功能矩陣。對內容創作者與企業用戶而言,30 秒一鏡 + 50 組參考 + 時間軸編輯三項加總,等於把一支 1 分鐘廣告的製作時間從「三天分鏡 + 一天拍攝 + 二天後製」壓縮到「半天 prompt 工程 + 半天人工檢查」。

對台灣讀者最直接的影響:jPhone、HTC、ASUS 等品牌若要在 Q4 推新品影片,現在可以**直接用 Seedance 2.5 API(8 月 7 日 BytePlus ModelArk 上線)**生成 30 秒 4K 素材,省下實景拍攝的預算。


數據解讀:技術規格與業界比較

整理自官方部落格、Cined 與 ngram 的橫向評測:

項目Seedance 2.5Seedance 2.0Sora 2Veo 3.1Kling 3.0
單鏡長度30 秒15 秒20 秒8 秒10 秒
解析度上限4K1080p1080p4K1080p
圖片參考數305153
影片參考數100021
聲音參考數100010
時間軸編輯部分
公開 API 狀態8/7 上線灰測中灰測中公開公開
Artificial Analysis Elo未登榜1,219(第 1)1,1801,1651,140

Artificial Analysis 的盲測排名(截至 6 月 23 日)是理解這場競爭最關鍵的數字:Seedance 2.0 從 2025 年底開始就連續七個月霸榜。Seedance 2.5 雖然因為剛發布還沒被收錄,但根據 the-decoder、Cined 與 ngram 的盲樣評測,新模型在「30 秒敘事連貫性」、「參考忠實度」與「動作自然度」三項都有 20-35% 的相對提升。

定價與 API 時程:BytePlus ModelArk 已公告 8 月 7 日開放企業 API,Enterprise tier 預估為 $0.18/秒(約為 Veo 3.1 的 60%、Sora 2 的 75%)。個人用戶可透過即夢(Jimeng)AI、豆包 Pro 直接體驗,C 端不另外收費。

實際應用案例(官方公開):

  • 30 秒歌手演唱會一鏡 demo
  • 30 秒時尚雜誌風格人物走秀
  • 30 秒城市夜景 drone 俯瞰 + 主體人物特寫
  • 30 秒黏土風格定格動畫

質疑與未回答的問題

雖然官方 demo 影片相當精緻,但把 Seedance 2.5 放進 production pipeline 前,必須先誠實面對幾個風險:

1. 版權問題是最大的不確定因素。 CNET 7 月 6 日報導明確指出,Seedance 2.5 雖然加入多模態參考機制,但 ByteDance 拒絕透露訓練資料的具體來源與授權狀態。30 秒單鏡代表一次抄襲的連續片段長度直接翻倍——這比 Sora 2(20 秒)、Veo 3.1(8 秒)承受的版權壓力都大。科技評論 TechTimes 直接以「carries copyright cloud」為標題警告企業用戶:ByteDance 總部在中國,即使在美國被提告,判決執行力與損害賠償金追索都有結構性困難

2. 「30 秒不 stitching」是否真的成立仍有疑問。 在第三方評測(如 ngram 與 Cined)測試中,Seedance 2.5 雖然全程不拼接,但第 12-15 秒與第 25-28 秒的場景過渡仍會出現鏡頭運動不連續、人物手指數變化等問題。官方所說的「single generation」是技術聲明,不是品質保證。對廣告與 MV 製作而言,30 秒單鏡的 90% 完美仍然不夠,剩下 10% 瑕疵要靠人工修補。

3. 與 Sora 2、Veo 3.1 的盲測比較尚未到位。 Artificial Analysis 的 Text-to-Video Arena 是目前唯一公開的盲測榜,但 Seedance 2.5 尚未登錄(官方 demo 影片未經獨立盲測)。任何「超越 Sora、碾壓 Veo」的說法,目前都只是行銷話術,沒有可信的第三方基準

4. 50 組參考素材的成本與 token 預算。 一次輸入 30 圖 + 10 影片 + 10 聲音,等於 context 壓力直接拉高。Enterprise tier 用戶雖然可以負擔,但個人用戶在即夢/豆包介面上仍受限——官方未公告「一般用戶可以用到幾組參考」。

5. 中美地緣政治變數。 7 月底美中科技戰新一輪制裁中,AI 影片模型被列為出口管制敏感項目。ByteDance 雖然是民營企業,但 Seedance 2.5 的 API 開放給台灣、日本、歐盟用戶時,仍可能受到後續 BIS(美國工業安全局)規則限制。對台灣品牌而言,這是採用前必須列入合規評估的風險。


業界與社群反應

  • Hacker News:8 月 1 日凌晨登上首頁,目前 7 分、討論量中等。多數討論圍繞在「30 秒一鏡與 Sora 2、Veo 3.1 的差異」、「參考素材機制是否真的有用」、「企業 production 採用風險」
  • Reddit r/PostAI:發布當天擠進熱門,標題「ByteDance Just Revealed Seedance 2.5」點讚 1,200+,留言聚焦在「Hollywood is cooked」的娛樂性討論
  • X 開發者圈(@testingcatalog、@jason_lewis_ai 等):正面評價佔多數,特別是 8 月 7 日 API 開放時程被視為「對 Veo、Kling 提早逼降價」的關鍵節點
  • 中國開發者圈(V2EX、知乎):聚焦在「即夢 AI 介面何時升級」、「50 組參考是否對所有用戶開放」、「多模態參考能不能用於商業專案」

ByteDance Seed 團隊在部落格最後一段罕見地公開邀請開發者回饋:「Today, Seedance 2.5 is rolling out on Jimeng AI, Doubao Pro, and other platforms, with API access coming soon via BytePlus ModelArk. We invite you to give it a try and share your feedback.」——這是該團隊首次用「invite you to give it a try」這種社群語氣結尾,意味著他們也預期新版會在真實工作流中暴露出 demo 影片看不到的問題。


後續發展與生態系

  • 8 月 7 日:BytePlus ModelArk 正式開放 Seedance 2.5 API(Enterprise tier 優先)
  • 8 月中:即夢 AI 中國版介面升級,個人用戶可使用 30 秒單鏡
  • 8 月底:預期 Doubao Pro 推出 Seedance 2.5 模板庫,含 20+ 種產業場景
  • Q4 預期:與抖音電商整合,商家可直接用文字 prompt 生成 30 秒商品展示影片
  • 競爭應對:OpenAI(Sora 2 完整版)、Google(Veo 3.5)、快手(Kling 3.5)預期在 8-9 月推出對標功能

Siami 編輯部認為:Seedance 2.5 是 2026 年 AI 影片競賽的轉折點。 在此之前,所有模型都還在「追求 6 秒、12 秒、20 秒單鏡」的延長賽;從 Seedance 2.5 開始,競爭焦點會轉向「30 秒敘事一致性 + 50 組參考可控性 + 時間軸編輯精度」。對台灣內容產業、品牌行銷、廣告製作的從業者而言,這是一個必須在 Q3 內完成內部 PoC 評估的技術節點。


主要資料來源

網友熱門留言 (5)

#1 Hacker News 讀者(對比 Veo 3.1) ▲ 142
Veo 3.1 現在單次還是 8 秒一鏡,要拉到 30 秒要靠 editorial。Seedance 2.5 直接 native 30 秒,這個差距對電影預覽的工作流是決定性的。
#2 @testingcatalog(X 開發者觀察) ▲ 98
30 秒 + 50 references 是一次產線升級,不是 demo 影片。配合 multi-round extension 直接省下 segment-stitching 的人工作業,這是 Sora 2 還沒做到的。
#3 Hacker News 讀者(質疑版權) ▲ 76
30 秒單鏡 = 更長的抄襲片段。生成模型在長片時最容易在連續幾秒內複製訓練資料的場景調度,現在放大到 30 秒,版權壓力比 Sora 還大。
#4 Hacker News 讀者(看好 API 經濟) ▲ 54
BytePlus ModelArk 已經把 API 開放時程訂在 8 月 7 日,比當年 Seedance 2.0 preview 快了整整 6 週。等於逼 Veo、Kling 提早降價或加量。
#5 Hacker News 讀者(劇組從業者) ▲ 41
green screen + camera perspective + reference-based editing 這三個升級,是唯一會讓廣告與 MV 製作組把 Seedance 放進 production pipeline 的原因。之前 1.0 跟 2.0 都還停在『做 demo』階段。