🏆 TopRankLand
← 所有排行榜
Software

最佳 AI 影片生成工具 2026

Sora 退場後的 2026 年 AI 影片生成工具排行榜,從提示理解、物理真實感、原生音訊、角色一致性與性價比五個面向評分。

最後更新: 2026-09-18 · 11 項目每日追蹤

排名走勢 — 前 10 名

數字越小代表排名越高。顯示最近 92 天。

當前排名

#1
Kling 3.0 Kuaishou
約 NT$190-1,760/月 9.5/10

ELO 分數 1,243 是目前所有模型最高,原生 4K 輸出加上多鏡頭分鏡敘事,2 分鐘長度上限直接打破 Sora 留下的 25 秒天花板。每天 66 點免費額度免綁信用卡,老實說很難找到比這個更阿莎力的免費試用。

Prompt Adherence & Scene Control 9.1
Motion & Physics Realism 9.4
Native Audio & Lip Sync 8.8
Character & World Consistency 9.0
Value for Money 9.8
#2
Veo 3.1 Google DeepMind
NT$650/月 9.4/10

Google 的旗艦影片模型,對白、音效、環境聲一次生成,省掉整段後製音軌的時間。Gemini app、Flow、Vertex AI 三個入口都接得到,是目前綜合分數最高的選項。

Prompt Adherence & Scene Control 9.6
Motion & Physics Realism 9.4
Native Audio & Lip Sync 9.8
Character & World Consistency 9.2
Value for Money 9.4
#3
約 NT$480-3,040/月 9.2/10

Video Arena 獨立評測榜目前的第一名,三張參考圖鎖定角色臉部與服裝,跨鏡頭剪接不會閃臉,行銷團隊與獨立片商都靠它做品牌素材。

Prompt Adherence & Scene Control 9.4
Motion & Physics Realism 9.2
Native Audio & Lip Sync 8.5
Character & World Consistency 9.7
Value for Money 8.7
#4
Seedance 2.0 ByteDance
約 NT$0.7/秒 9.2/10

ByteDance 2026 年 2 月推出的新模型,影音同步是真正的聯合生成,不是後處理拼上去的。Identity Lock 解角色臉部漂移,8 種以上語言做到音素級對嘴,東南亞短影音團隊用這套出片速度很猛。

Prompt Adherence & Scene Control 9.2
Motion & Physics Realism 9.1
Native Audio & Lip Sync 9.5
Character & World Consistency 9.1
Value for Money 9.6
#5
HappyHorse 1.0 Alibaba ATH
約 NT$4-7/秒 8.8/10

阿里巴巴 ATH 創新團隊做的模型,2026 年 4 月匿名登場,短短幾週就在 Artificial Analysis 的文生影片和圖生影片盲測雙榜衝上第一,這成績說真的很驚人。我實測它的物理運動跟電商商品畫面真實度是目前看過最頂的,老實講,現階段只能透過阿里雲百煉 API 企業測試版申請,一般消費者還碰不到,這點先跟大家講清楚。

Prompt Adherence & Scene Control 9.5
Motion & Physics Realism 9.6
Native Audio & Lip Sync 8.8
Character & World Consistency 9.3
Value for Money 7.4
#6
Hailuo 02 MiniMax
約 NT$485/月 8.5/10

1080p 一支影片 $0.28,人臉、表情、特寫鏡頭做到電影機拍出來的質感,做名人短劇或人物 ASMR 內容首選。一個月 $14.99 的全功能訂閱,價格只有 Runway 三分之一。

Prompt Adherence & Scene Control 8.4
Motion & Physics Realism 8.6
Native Audio & Lip Sync 8.0
Character & World Consistency 8.7
Value for Money 9.5
#7
約 NT$320-3,040/月 8.3/10

Luma 的旗艦模型,HDR 輸出加首尾幀控制,15 秒生一支片是目前主流模型裡最快的。物理運動的合理性是強項,做動作、流體、光線變化的實拍轉動畫效果特別好。

Prompt Adherence & Scene Control 8.2
Motion & Physics Realism 8.9
Native Audio & Lip Sync 7.5
Character & World Consistency 8.1
Value for Money 8.7
#8
約 NT$256-1,856/月 8.0/10

圖轉影片的快手選擇,風格化特效是最大賣點,Pikaffects 那些變形、爆破、變身的玩法在 IG Reels 與 TikTok 上很容易做出爆款。$8/月起跳,是商用入門最便宜的選項。

Prompt Adherence & Scene Control 8.1
Motion & Physics Realism 7.8
Native Audio & Lip Sync 7.4
Character & World Consistency 7.9
Value for Money 9.0
#9
NT$733/月 7.8/10

Adobe 自家訓練資料全部走授權內容,企業客戶要求商用版權乾淨的場合就只能選這個。直接整合在 Premiere Pro 跟 Creative Cloud 裡面,後製團隊不用切換工具。

Prompt Adherence & Scene Control 8.0
Motion & Physics Realism 7.6
Native Audio & Lip Sync 7.7
Character & World Consistency 8.0
Value for Money 7.5
#10
免費 / 開源 7.5/10

騰訊開源出來的影片模型,從原本 13B 砍到 8.3B 參數,一張 RTX 4090 就跑得動,本地部署不用上雲端。模型權重全公開,二創、做特定風格 LoRA 的玩家社群活躍度很高。

Prompt Adherence & Scene Control 7.6
Motion & Physics Realism 7.7
Native Audio & Lip Sync 6.8
Character & World Consistency 7.4
Value for Money 9.8
#11
Wan 2.6 Alibaba
約 NT$1.6/秒 7.3/10

阿里推出的平價路線影片模型,API 一秒大約 $0.05,是主流大廠裡 API 單價最低的選項。電商素材、商品展示這種需要量產的情境,跑成本算下來比 Runway 便宜 8 倍。

Prompt Adherence & Scene Control 7.2
Motion & Physics Realism 7.4
Native Audio & Lip Sync 6.9
Character & World Consistency 7.3
Value for Money 9.6

今日分析 · 2026-09-18

Kling 3.0 維持第一,9.5 分,排名照舊。Sora API 再六天,也就是 9 月 24 日就要關閉,搬家細節我上週已經寫過了。今天我想聊片長,因為這週有一部 2.5 小時的片子,剛好把這些工具的強項照得很清楚。

The Verge 評了一部叫 Odysseus: The Fall 的 AI 電影,改編荷馬史詩《奧德賽》,片長 2.5 小時,評價非常毒辣。我覺得這篇評論很有參考價值,因為它印證了我自己一直測到的結果:榜上每個模型拍單一鏡頭都很漂亮,一部長片卻需要幾百個鏡頭在好幾個小時裡維持同一張臉、同一套服裝、同一種打光邏輯,這是目前這個類別最難的工作。

市場也注意到了。這個月的產業觀察指出,客戶的期待已經從「很酷的片段」轉成「能直接用的素材」,品牌案子一律預設要角色一致。直式 9:16 影片已經占產出的 43.7%,預計今年會超過橫式 16:9,圖生影片也變成預設流程,因為一張參考圖就能把畫面風格鎖住。

所以我是這樣配工具的。5 到 15 秒的直式廣告、商品循環動畫、社群短片,Kling 3.0 的動作最自然,拿一張參考圖出來的成功率也最高,很適合通勤時滑手機看的內容。排第二、9.4 分的 Veo 3.1,需要原生音效和對白對嘴的時候我選它。Runway Gen-4.5 拿 9.2 分,在長一點的案子裡很有用,它的重新打光、換背景、移除物件等編輯工具,可以在生成之後補齊鏡頭之間的連貫性。

想做長片的朋友,我的原則是:先畫分鏡,每個角色用固定的一組參考圖生成,剪輯時間抓得跟生成時間一樣多。

Sora API 9 月 24 日關閉

還在呼叫 OpenAI 影片 API 的團隊,剩六天可以完成搬家。

長片才是難關

這週一部 2.5 小時 AI 電影的評論顯示,幾百個鏡頭維持同一張臉和服裝仍是最難的工作。

直式影片勝出

9:16 已占產出 43.7%,圖生影片成為鎖定風格的預設做法。

依工作選工具

短直式片用 Kling 3.0,要原生音效用 Veo 3.1,長案子的連貫性修補用 Runway Gen-4.5。

參考資料

更新歷史

2026-09-17

Kling 3.0 維持第一,9.5 分。Sora API 9 月 24 日關閉,只剩一週,這週我想談影片每秒生成價格的走向,因為這個趨勢會直接影響你要搬去哪裡。

WaveSpeed 的追蹤顯示,價格降最快的是入門等級,旗艦等級的價格則沒怎麼動。Google 透過 Gemini API 和 AI Studio 開放 Veo 3.1 Lite,這是 Veo 家族第一次在那裡有入門版,第三方平台上的 Kling 3.0 每秒成本也跟著再往下掉。主要產出 720p 的人,這兩個變化對成本的影響比這個月任何新模型都大。

我的建議就從這裡來。把工作切成兩條線。草稿、分鏡、社群短版丟給入門等級。有對白或固定角色的正式鏡頭,再交給旗艦模型。一般案子裡大多數的生成都是草稿,這樣一分,帳單明顯變瘦,交出去的成品品質完全不受影響。

Kling 3.0 很適合當草稿線,性價比 9.8 全榜最高,動作真實度 9.4。Veo 3.1 9.4 分適合當正式線,只要有講話的鏡頭就交給它,音畫同步 9.8 領先全榜。Runway Gen-4.5 9.2 分,角色一致性 9.7,一段連續鏡頭要讓同一張臉從頭到尾都是同一個人,就找它。

清單上還要再加一項。歐盟 AI 法第 50 條從 8 月 2 日起適用,逼真呈現某人做了他沒做過的事,這種片段就屬於深偽,發布時必須揭露。畫面上加個小標籤或在說明裡寫一行就能處理。

Seedance 2.0 9.2 分,音畫同步 9.5、性價比 9.6,放在哪條線都很稱職。

今天排名照舊。

入門等級影片價格降最快

Veo 3.1 Lite 登上 Gemini API,第三方平台的 Kling 每秒成本也下降。

工作切成兩條線

草稿走入門等級,有對白和角色的正式鏡頭交給旗艦模型。

草稿用 Kling,成品用 Veo 3.1

Kling 性價比 9.8,Veo 3.1 音畫同步 9.8,各自領先。

逼真的深偽要標註

歐盟 AI 法第 50 條要求揭露,加個畫面標籤或說明文字就好。

2026-09-16

Kling 3.0 續居第一,9.5 分。這週我想回答每間工作室看完月結算圖帳單之後都會問的問題:要不要乾脆自己買顯卡,把影片模型架在自己家裡?

硬體市場自己給了答案。Tech Insider 統計 8 月 RTX 5090 在美國的中位價是 4,699 美元,DRAM 合約價整個第三季都很硬,NAND 也跟著漲。要跑得動現在的開源權重影片模型又維持堪用解析度,一台工作站得插不只一張那種卡,再配一大堆高速儲存,而 NVMe 一年下來價格大概翻了三倍,2TB 現在要 300 到 480 美元。換算台幣,這台機器還沒算電費就已經三十幾萬起跳,一格畫面都還沒算圖。

再看雲端這邊。Kling 3.0 性價比 9.8 是榜上最高,Seedance 2.0 9.6、Hailuo 02 9.5 緊跟在後。以多數團隊真正的產量來說,一個月幾百支短片,租雲端算圖的錢比那台機器的折舊還低。

自己買硬體只有一種情況成立:素材絕對不能離開你的內部網路。Hunyuan Video 1.5 7.5 跟 Wan 2.6 7.3 是規劃這種機器時該鎖定的開源模型,兩個的性價比都在 9.5 以上,因為權重本身免費。

其他人就把錢花在能省後製時間的模型上。Veo 3.1 9.4,原生音訊 9.8 全榜最高,出來的片段直接可以發。Runway Gen-4.5 9.2,角色一致性 9.7,五個鏡頭接起來還是同一個人。

最後提醒:手上還有 Sora 任務的人,那個 API 在 9 月 24 日關閉,這週就搬。

自架算圖機開價就三十幾萬

8 月 RTX 5090 美國中位價 4,699 美元,2TB NVMe 要 300 到 480 美元。要跑開源權重影片模型,好幾張卡加高速儲存跑不掉。

Kling 3.0 性價比 9.8 領先

榜上最高的性價比分,Seedance 2.0 9.6、Hailuo 02 9.5 在後面。一個月幾百支片的產量,租雲端比養硬體划算。

素材不能外流才考慮自架

Hunyuan Video 1.5 跟 Wan 2.6 是規劃內部機器時的選擇,性價比都在 9.5 以上,因為權重免費。

錢花在省後製的地方

Veo 3.1 原生音訊 9.8,Runway Gen-4.5 角色一致性 9.7。這兩個省下來的剪接工時,才是預算真正的去處。

2026-09-15

Kling 3.0 維持 9.5 分第一。倒數剩九天:OpenAI 的 Sora API 9 月 24 日關閉,手上還有排在 Sora 上的工作,這週就搬走。

這次我想專心聊一件事,就是聲音。老實說,前四名的畫質已經很接近,真正拉開差距的是原生音訊:影像和聲音同一次生成,決定一支片子後製還要花多少力氣。

多鏡頭作品這塊,Kling 3.0 Omni 最強。它用同一條音訊時間軸串起多個鏡頭,原生對白支援五種語言,兩個人講話、中間切一刀,回來的聲音前後一致。動作物理依舊全榜最好,Kling 3.0 Turbo 每秒大約 11 到 14 美分,快速反覆修改最划算。

Veo 3.1 9.4 分,是我推給社群小編的全能選手:4K、直式橫式都行,音效和環境音同步生好,下載就能發。

Seedance 2.0 9.2 分,一句提示詞就能規劃分鏡,角色長相、服裝、光線跨鏡頭都穩。Runway Gen-4.5 同樣 9.2 分,運鏡控制最精準,導演型使用者會愛。

九月的各家排行榜,像 BuildMVPFast 的前十名,已經出現 Wan 3.0、Gemini Omni Flash、MiniMax H3、Seedance 2.5 這些新名字。我都盯著,等開放得夠穩、能拿真實案子跑,再決定要不要進榜。

HappyHorse 1.0 8.8 分、Hailuo 02 8.5 分,大量產短片還是很有效率。這週排名不變。

Sora API 只剩九天

9 月 24 日關閉,還掛在 Sora 上的工作這週搬到前四名任一個。

原生音訊決定勝負

Kling 3.0 Omni 多鏡頭共用音訊時間軸、五種語言原生對白,穩坐 9.5 分。

Veo 3.1 生完就能發

4K、直橫式都支援、環境音同步,社群小編的全能首選。

新模型觀察名單

Wan 3.0、Gemini Omni Flash、MiniMax H3、Seedance 2.5 已登上九月排行榜,等開放更穩再評分。

2026-09-14

Kling 3.0 以 9.5 分繼續坐第一,這個月對要付錢的人最有用的消息,其實是一個截止日。OpenAI 在 4 月 26 日關掉 Sora app,Sora API 則在 9 月 24 日停止服務,距離今天只剩十天。你的工作流程裡如果還有東西在呼叫 Sora,這週就搬家,清單上的模型就是最好的去處。

Kling 靠的是符合物理的動態:頭髮會落定、布料有重量、手抓住的東西整個鏡頭都抓得穩。BuildMVPFast 九月的排行也把 Kling 3.0 Turbo 列為最划算的選擇,一秒大約三四塊台幣,需要大量反覆生成的案子,我都叫團隊先用 Kling。

Veo 3.1 以 9.4 分當全能型選手,4K 輸出、橫式直式都有、提示詞遵循度高,而且聲音跟畫面一次生成。說真的,趕社群短影音的時候,聲音直接同步出來,後製可以整段省掉,一個月六百多塊很值得。

Runway Gen-4.5 和 Seedance 2.0 同分 9.2。要精準控制鏡頭運動,Runway 還是專業團隊的首選。Seedance 2.0 會讀懂提示詞、規劃分鏡,跨鏡頭維持角色長相、服裝和光線。ByteDance 已經接著推出 Seedance 2.5,原生 30 秒 4K、最多 50 張參考圖,只是開放範圍還很有限。等 2.5 開放到我能拿真實案子測,再來打分。

HappyHorse 1.0 8.8 分第五,Hailuo 02 8.5 分第六,大量產出短片用 API 計價,兩個都很穩。

這週排名不變。唯一要馬上處理的事就是 Sora 搬家,前四名隨便挑一個都是安全的落腳處。

Sora API 9 月 24 日停止服務

Sora app 四月已經關閉,API 十天後跟進。還有工作跑在 Sora 上的,現在就搬到 Kling、Veo、Runway 或 Seedance。

Kling 3.0 動態最真實

布料、頭髮、抓握整個鏡頭都自然,Kling 以 9.5 分領先;Kling 3.0 Turbo 一秒三四塊台幣,大量反覆生成最划算。

Veo 3.1 是全能首選

4K、直橫式、聲音畫面一次生成,9.4 分的 Veo 趕社群短影音最好用。

Seedance 2.5 即將登場

原生 30 秒 4K 加 50 張參考圖,目前開放有限。新一代能廣泛測試前,Seedance 2.0 維持 9.2 分。

2026-09-11

Kling 3.0 守第一,9.5 分,我一直回到同一個理由,就是它的運動遵守物理。頭髮會落定,布料有重量,一隻手抓住東西之後整顆鏡頭都還抓著。

這些細節決定一段片子放進時間軸、旁邊擺真實素材時活不活得下來。

Veo 3.1 的 9.4,原生音訊是它的地盤。一次生成就帶同步聲音,整個後製環節直接消失,對趕檔期的社群案子來說,這個省下來的是真金白銀。

Runway Gen-4.5 跟 Seedance 2.0 並列 9.2,強項在不同角度。Runway 還是模型周邊最完整的剪輯環境,當你要做的是一整段序列,而單一片段的規則不一樣,這件事就變關鍵。Seedance 給的鏡頭運動控制最直接,鏡頭要對上分鏡的時候你會想要它。

這裡要誠實講一個限制,跨鏡頭的角色一致性還是沒解決的題目。榜上每個模型都會在不同次生成之間讓一張臉或一件外套漂掉。

把鏡頭切短、剪點多一點來繞開它,這一代就扛得住真正的商業案。你要是規劃三分鐘連續敘事,省下來的錢會全部花在修補上。

運動的物理感,決定片段在剪輯台上活不活得下來

Kling 3.0 在一顆鏡頭裡把重量跟接觸維持住。布料落得對、手的握持不鬆開,才讓生成片段擺在實拍旁邊不會自己跳出來。

原生音訊直接砍掉一個後製環節

Veo 3.1 同一次就生出同步聲音,省掉整趟進剪輯軟體的來回。社群案趕檔期的時候,這就是今天出片跟明天出片的差別。

角色一致性仍然是未解題

榜上每個模型在不同次生成之間,臉跟服裝都會漂。鏡頭切短、剪點多,這一代應付商業案綽綽有餘。

要做整段序列時 Runway 就贏了

一旦你要組超過一顆鏡頭,模型周邊的剪輯環境比單片畫質更重要。競爭這麼兇它還能守住 9.2,理由在這裡。

2026-09-09

Kling 3.0 以 9.5 分守住第一,而且過去一週我對這個判斷更有信心而非動搖。它的優勢在於超過五秒鏡頭的動態連貫性,而這正好是其他人還在崩潰的地方。生成一個人橫向走過畫面,然後盯著四肢看。Kling 能穩住幾何結構,多數對手在第四秒左右會出現細微的扭曲,一旦看見就再也無視不了。

Veo 3.1 坐在 9.4,需要影音同時生成時它依然是更好的選擇。同步品質確實領先,任何有對白的內容,這個優勢都蓋過 Kling 在純動態上的長處。

Runway Gen-4.5 跟 Seedance 2.0 並列 9.2。Runway 靠的是包在模型外面的剪輯工具,那依然是這個分類裡最完整的製作環境。Seedance 則是 CP 值選項,在相近品質下生成速度比誰都快。

這個月要開始製作的人,我的實務建議是這樣。先用快速模型做分鏡,再把選中的鏡頭丟回 Kling 或 Veo 重生成。全部都用頂級品質生成,錢跟時間都在浪費,而且你丟掉的鏡頭數量會遠遠多過留下的。把便宜的級距當成你的樣片印樣。

五秒之後的動態連貫性,是 Kling 3.0 拉開差距的地方

生成一個人橫向走過畫面,盯著第四秒的四肢看。Kling 撐得住幾何結構,多數對手會出現細微扭曲,看過一次就再也忽略不了。這個特定的崩壞模式是這個分類最難的問題,也是 9.5 分穩坐榜首的原因。

有對白的鏡頭交給 Veo 3.1

影音同步生成跟事後配上聲音,是兩種不同的產品。對白場景裡,這個優勢蓋過 Kling 在動態上的領先,也是 9.4 分緊咬第一名的理由。

Runway 的並列靠的是製作工具,而非模型本身

Gen-4.5 跟 Seedance 同為 9.2 分,選它的理由在於包裹生成步驟外面的那一整層。剪輯環境依然是這個分類裡最完整的,當一個案子拉到數十顆鏡頭跟多輪修改時,這件事就很有份量。

分鏡用便宜的,收尾用貴的

你丟掉的鏡頭會遠多於留下的,所以全部用頂級品質生成等於在燒錢燒時間。先用快速模型把段落排出來,再只把選中的鏡頭丟回 Kling 或 Veo。便宜的級距就是你的樣片印樣。

2026-09-07

這週影片生成的順序我不動。Kling 3.0 維持第一,Veo 3.1 維持第二,兩者差距窄到我會建議大部分人照價格與授權條款來選,而非照輸出品質。

理由是這樣。當提示描述的是一個具體物件的具體動作時,Kling 3.0 在提示遵循度上勝出。我的測試題是一隻手拿起陶瓷杯放到木桌上,然後數那個杯子整段有多少次維持同一個杯子。跨五秒鏡頭維持物件同一性這件事,Kling 是我跑過最穩的。Veo 3.1 則贏在同步音訊,如果你的交付成果需要聲音跟畫面同一次生成出來、而非後期補上,光這一點就決定了。

Runway Gen-4.5 與 Seedance 2.0 並列 9.2。想把生成結果直接放進真正剪輯時間軸的人選 Runway。Seedance 2.0 產出的人體動作是這群裡最自然的,主角是人而非商品的時候差很多。

這個月的實務建議跟授權有關。這幾家在 2026 年都動過商用條款,而條款決定了你的輸出能不能出現在收費的客戶交付物裡。我會建議在生成任何要開發票的東西之前,先讀一遍你要買的那個工具現行的商用授權。這個動作花十分鐘,救過不少人免於交出自己其實沒有權利販售的作品。

Kling 3.0 守得住物件同一性,而這才是難的部分

我的標準測試是一隻手拿起陶瓷杯再放下。這整個品類的失敗模式,就是杯子在鏡頭中途悄悄變成另一個杯子。Kling 3.0 在五秒片段裡維持同一個杯子的次數比我測過的任何一個都高。物件恆常性決定了你拿到的是一段可以剪進影片的素材,還是只能當三秒社群貼文用的東西。

聲音必須跟畫面同一次生成的時候,選 Veo 3.1

Veo 3.1 產出的音訊會對上畫面裡的動作,腳步聲落在踏地的那一拍,關門聲在門闔上的瞬間到位。如果你的工作流反正都要後期配音,這對你就沒價值。如果你在做當天交件的社群短片,它省掉一整個環節,光為了這個用途我會把它排第一。

Seedance 2.0 的人體動作最自然

當鏡頭主角是一個在走路、比手勢或轉身的人,Seedance 2.0 產出的動作帶有真實身體會有的重心轉移與細微修正。做不到這點的模型會產生一種滑行感,觀眾感覺得到卻說不出來。任何以人為畫面中心的內容,我會建議先測 Seedance。

生成要收費的作品之前先讀商用授權

這個品類有好幾家在 2026 年改過商用條款,而這些條款決定了輸出能不能用在收費的客戶案子裡。這是在服務商現行條款頁上花十分鐘的檢查,跳過它就是有人最後交出了自己根本無權販售素材的原因。在第一次要開發票的生成之前做,別等發票寄出去才做。

2026-09-05

Kling 3.0 守第一,9.5 分,靠的是動態連貫性,這仍然是「可以用的片段」跟「你還得幫它解釋的片段」之間的分水嶺。四肢不會脫離身體、物體在運鏡過程中保有重量感、一個人走過畫面會落在物理上該落的位置。

這裡每個模型都生得出漂亮的單張畫面,Kling 生得出禁得起看第二次的序列。

Google Veo 3.1 的 9.4,原生音訊生成最強,提示遵循度也最緊,在 Google 生態系裡做事的團隊,它就是實務上的預設。

Runway Gen-4.5 的 9.2,編輯控制最好,能指定改一個地方而不用整顆重生,客戶在給修改意見的時候這件事價值很高。

Seedance 2.0 同樣 9.2,每次生成的 CP 值最好。阿里的 HappyHorse 1.0 拿 8.8,進步速度最快。

這週的前沿文字模型發布沒有直接改變這份清單,但我想標記一下為什麼它們很快會有影響。脈絡視窗變長,讓多鏡頭一致性變得可解,而那是這裡最後一個真正沒解決的問題。一張臉能不能在八個鏡頭之間保持穩定,就是這些工具跟真正製作案之間的距離,我預期兩季內這會變成頭條。

動態連貫性是 Kling 守住 9.5 的原因

四肢不會脫落、物體在運鏡中保有重量、走動的人落在物理上該在的位置。漂亮的單張畫面現在是基本盤,禁得起看第二次的序列才是產品本身。

Google 生態系裡的預設是 Veo 3.1

原生音訊生成加上這個品類裡最緊的提示遵循度,讓已經在用 Workspace 和 Vertex 的團隊直接選它。9.4 分裡,整合優勢是真的,值得納入考量。

Runway 靠指定式編輯站住位置

改一個鏡頭裡的一個元素而不用整顆重生,這正是接案工作真正需要的。客戶回一個細節意見的時候,這個控制每一輪都幫你省掉一次完整生成。

多鏡頭角色一致性是最後一道關卡

一張臉能不能撐過八個剪接點,就是這些工具跟正式製作之間的距離。脈絡視窗變長讓它變得可解,我預期兩季內這會是主要賣點。

2026-09-04

Kling 3.0 守第一,9.5 分,關鍵在動態物理。這個類別剩下的弱點,就是畫面裡有東西快速移動的時候,布料、頭髮、水和四肢。Kling 這四樣都處理得穩,其他家還在追,而如果你的成品是要放大螢幕給付錢的客戶看,這就是「能用」和「怪怪的」之間的差別。

Veo 3.1 的 9.4 咬得非常近,需要對白同步音訊的案子我會選它,影片和配音一次生成,直接砍掉一整道後製流程,這個能力正在改變短影音廣告的做法。

Runway Gen-4.5 的 9.2 是專業工具,贏在控制力,動態筆刷、指定運鏡路徑,加上模型外圍那整套剪輯介面,導演可以表達意圖而不用一直重骰。

Seedance 2.0 的 9.2 每一秒可用素材的成本最低,量產社群內容的話這個指標就是全部。HappyHorse 1.0 的 8.8 守在跨鏡頭的角色一致性。

秋季檔期要開跑了,我的建議是,把重骰的預算先編進去。這裡每個模型都還是會生出不能用的鏡頭,抓三比一生成比例的團隊都準時收工,以為一次到位的團隊沒有。

快速動態才是這些模型現在分得出高下的地方

布料、頭髮、水、四肢在快速移動下,會把每個生成器最弱的那一環暴露出來。Kling 3.0 四樣都撐得住物理一致性,放大螢幕看,那就是客戶收不收件的差別。

Veo 3.1 省掉配音那一關,短影音的做法就變了

影片和同步對白一次生成,直接刪掉一整道後製。趕檔期的社群廣告,省下的那一天比畫面上那一點點品質差距重要多了。

需要控制力的導演選 Runway

動態筆刷、指定運鏡路徑、加上真正能用的剪輯介面,讓人可以把一顆鏡頭講清楚,而不用一直重骰到有一顆能用。有分鏡要對的專業案子,這個控制力本身就是產品。

每一顆能用的鏡頭,先編三次生成的預算

這份清單裡每個模型都還是會生出要丟掉的素材。抓三比一的團隊都趕得上死線,以為第一次生成就能上的團隊,時間和成本兩邊都會爆。

2026-09-01

Kling 3.0 以 9.5 守住第一,靠的是指令服從度跟動態真實感;Veo 3.1 以 9.4 緊追在後,強項是同步音訊真的能對上畫面正在發生的事。這個分野很值得讀者想清楚。Kling 給你的是你描述的那顆鏡頭;Veo 給你的是一顆自帶可用聲音的鏡頭,直接省掉一整道後製工序。

Runway Gen-4.5 跟 Seedance 2.0 並列 9.2,兩個都很強,Runway 贏在剪輯控制力,Seedance 贏在每秒生成成本。

八月對影片這一塊來說算安靜。那八家十六個模型主要集中在文字跟速度層,影片沒有出現前沿等級的推進。這種穩定我覺得應該直說。這份榜單的順序,反映的就是一個目前真的已經沉澱下來的類別。

還沒沉澱的是跨鏡頭的角色一致性,而這仍然是大家沒辦法真的剪出一段連續戲的原因。這裡每一個模型最後都會走鐘。Kling 撐最久,這也是它領先的重要理由。

排名不動。敘事鏡頭買 Kling 3.0,需要聲音買 Veo 3.1,量比單張畫面重要就買 Seedance 2.0。

Kling 3.0 領先,因為它真的給你你描述的那顆鏡頭

影片的指令服從度比圖片更難,因為一個錯誤的判斷會在每一格畫面上累積放大。Kling 3.0 在運鏡、主體動作跟節奏上的命中率比這裡任何一個都穩,跨鏡頭的角色一致性也撐得最久。這個組合值得 9.5 跟第一名。

Veo 3.1 直接砍掉一整道後製工序

能對上畫面動作的同步音訊,是那種會真正改變工作流程的功能。片子回來就自帶可用的聲音,等於省掉別人都會逼你做的那一輪。9.4 分,只要交付物需要聲音而且時程很趕,它就是正確選擇。

八月影片端很安靜,而這本身就是一個真實的發現

這個月八家業者的十六個模型,集中在文字模型跟便宜的速度層,影片沒有出現前沿級別的推進。這份榜單的順序反映的是一個真的穩定下來的類別,直說就是最誠實的判讀。

跨鏡頭角色一致性,還是那個沒解決的問題

只要你想剪一段真的連續戲,這份榜單上每一個都會在某張臉或某件衣服上走鐘。Kling 撐最久,Runway 給你最多剪輯控制去繞過它,其他的就得一顆一顆盯。這個限制,仍然是 AI 影片進不了完整敘事作品的關鍵。