1,247 分,這是 Runway Gen-4.5 在 2025 年 12 月 1 日發布當天,登上 Artificial Analysis Text to Video 排行榜冠軍的 Elo 分數,當時打敗了榜上所有對手。不過如果現在重新打開同一份排行榜,Gen-4.5 已經不在前段班了,Google 的 Gemini Omni Flash、字節跳動的 Seedance 2.0、阿里的 HappyHorse 系列這幾款新模型陸續把它擠出前十名。
影片生成模型的排行榜換榜速度本來就快,冠軍頭銜換人是常態,糾結 Runway Gen-4.5 現在排第幾名意義不大。真正該搞懂的是這次版本升級實際改了什麼、跟 Gen-4、Gen-4 Turbo 差在哪、什麼情境下才值得換版本,這才是搜尋這個關鍵字的人多半想知道的答案。

先從 Runway Gen-4.5 是什麼、解決了什麼問題講起,再一項一項拆開它跟前代的差異。
Runway Gen-4.5 是什麼?
2025 年 12 月 1 日,Runway 把旗下影片生成模型陣容往前推進了一代,發布了 Gen-4.5。Runway Gen-4.5 是 Runway 目前最新的旗艦影片生成模型,同時支援文字轉影片與圖生影片,是 Gen-4 系列往下的下一代。 它要解決的問題很具體,讓 AI 生成的影片動作有真實的重量感,長鏡頭拍到一半也不會忽然崩壞閃爍。
Runway 是這個領域的先行者,兩年前發布了 Gen-1,是業界第一個公開釋出的影片生成模型,後續也一路帶頭把影片模型做得更強大、更可控。Gen-4.5 完全在 NVIDIA 的 Hopper 與 Blackwell 系列 GPU 上訓練與推論,NVIDIA 執行長黃仁勳也公開表示:「這是影片與世界模型發展格外令人興奮的時刻,我們很自豪 Runway 在 NVIDIA 的 GPU 上打造出這套開創性的影片與世界模型。」
官方把這次升級歸納成三個方向,物體移動要有真實的物理重量感、畫面細節在整段影片裡要維持一致不漂移、還有能不能讀懂一段更複雜的提示詞,這三項改進會在後面三節個別展開。想實際試用得先知道從哪裡找到它、要什麼方案、能調哪些參數,這部分先講清楚。

怎麼開始使用 Gen-4.5
Gen-4.5 現在收在 Runway 的 Apps View 裡,在搜尋列輸入「Gen-4.5」就能找到,也可以在 Tool Mode 的模型選擇器裡選 Video 分類直接切換過去。要用它得先確認方案,免費版拿不到 Gen-4.5,免費版的 125 點一次性額度只能拿去試 Gen-4 Turbo 的圖生影片;真的要用 Gen-4.5,至少要訂閱 Standard 以上的付費方案。
可以調整的基本設定不多,但每一項都會影響最後的畫面。時長從 2 秒到 10 秒之間自由選,不像舊版被鎖死在固定的 5 秒或 10 秒。輸入模式有兩種,純文字輸入或是文字加一張首幀圖片,兩者選一種都能生成,這個差異後面會另闢一節詳細講。幀率可以在進階設定裡選 24fps 或 25fps。畫面比例目前預設是 16:9、輸出解析度 720p,這點稍後在規格比較的章節會拉出來細談。
發布之初 Gen-4.5 還不支援原生語音,畫面本身是無聲的;要做需要對白或環境音的成品,現階段還得另外配音混音,不是打開就有聲音,這點下手前最好先有心理準備。
設定都調好之後,真正決定畫面好不好看的還是模型本身的能力。三項改進裡,官方擺在第一位的是物理真實度。
物理真實度提升,動作終於有重量感
物理真實度是 Runway 自己排在第一位的改進項目。物體移動時要有真實的重量、動量與力道,液體要照該有的方式流動,碰撞不能再是穿模式的假動作,這幾件事過去的影片生成模型常常做不到位。Gen-4.5 在這幾點上明顯進步,官方也直接點名這是它在排行榜上拿下高分的主因,背後跟前面提到的 NVIDIA 訓練資源投入也有關係。
官方公開的示範影片裡有幾個很能說明問題的例子。像是一顆擬人化的仙人掌抱住一顆氣球人偶,氣球被抱住後真的會啪地一聲擠破,而不是穿過去或憑空消失;另一段連續鏡頭是水龍頭的水注滿一個生鏽鐵桶,一艘摺好的白紙船順著水流漂出屋外,整段水的流動軌跡和紙船隨波晃動的樣子都符合物理直覺。這類需要準確判斷重量與碰撞的鏡頭,正是過去 AI 生成影片最容易穿幫的地方。
重量感和碰撞只是物理真實度的一部分,另一個同樣容易穿幫的地方,是畫面拍到一半突然變了樣子。
同一顆鏡頭裡,頭髮和布料為什麼不再忽然變形?
過去的 AI 生成影片有個常見毛病叫材質漂移,同一顆鏡頭拍到一半,人物的頭髮質感忽然變了、衣服上的布料花紋跑掉、表面反光忽明忽暗,像是換了一顆貼圖。Gen-4.5 官方把這項改進稱為視覺保真度與時間一致性,講的是像髮絲、布料紋理這類細節,在整段動作與時間軸上都能維持連貫一致,不會拍到第三秒就走樣。
這項改進對哪類內容最有感不難推論,近景特寫、需要盯著同一個主體看好幾秒的鏡頭最吃這個細節。拍人像特寫時,觀眾的視線會一直停在臉部與頭髮上,一旦髮絲質感中途跑掉很容易被看穿;拍產品展示時,材質與反光要是忽明忽暗,商品看起來就會失真。這兩類內容過去正是 AI 生成影片最常被抓包的地方。
重量感和細節一致性都顧到了,接下來要看的是模型聽不聽得懂複雜指令,這是官方強調的第三項改進。
一段提示詞,同時控制運鏡、時間點和氛圍
第三項官方強調的改進是提示詞遵循度,講的是模型能不能讀懂一段更複雜、更精確的指令。Gen-4.5 可以在同一段提示詞裡,同時指定運鏡編排(推軌、搖臂、跟拍)、複雜的場景構成、事件發生的精確時間點,還有細膩的氛圍轉換。過去的模型多半只抓得住大方向的氛圍,提示詞裡藏著的細節指令常常被忽略,現在這幾件事可以一次到位。
不過官方自己也老實列出了幾個目前還沒解決的限制,值得先知道:
- 因果順序偶爾顛倒:像是一扇門在把手被按下之前就先打開了,先後順序反了。
- 物體恆存性不穩定:畫面裡的物體可能被遮擋一下之後就憑空消失,或是無故冒出來。
- 動作成功率偏高於現實:一腳明顯沒踢準,球卻還是準確飛進球門,現實裡不會這麼順。
官方表示這幾點特別牽涉到他們在世界模型上的研究,因為世界模型需要準確反映一個動作在環境裡真正會造成的結果,目前團隊也還在持續研究怎麼改善。

讀懂指令是一回事,要不要靠一張圖片幫模型定錨,又是另一件事。這正是 Gen-4.5 跟 Gen-4、Gen-4 Turbo 最實際的操作差異之一。
首幀圖像控制上線,圖生影片從必填變選填
舊版 Gen-4 與 Gen-4 Turbo 有一個共同的硬性限制,一定要先上傳一張參考圖片當作影片的第一幀,圖片輸入是必填欄位,沒有圖就沒辦法生成。Gen-4.5 把這件事改成選填,可以純靠文字描述生成整段影片,也可以額外提供一張首幀圖片,讓角色長相、構圖、光線從一開始就固定下來。
這個差異對應到兩種不同的使用情境。想精準還原一張產品照片或角色設定的人,用首幀圖片鎖住起手畫面最保險,後續的動作再靠文字描述補完;不想被圖片綁住、想讓 AI 完全照文字描述自由發揮的人,直接純文字生成就好,不必再多準備一張圖。這種彈性是 Gen-4、Gen-4 Turbo 沒有的,舊版不管想不想要,都得先做一張或找一張圖片才能開始。
這裡有個容易被忽略的細節,選不選圖片,連帶會影響畫面比例能挑哪些。純文字生成目前只有 16:9 這一種比例可選;一旦額外提供首幀圖片,切換成文字加圖片的模式,畫面比例就能解鎖到 6 種選項,跟 Gen-4、Gen-4 Turbo 一樣多。換句話說,「Gen-4.5 只有 16:9」這個說法只對一半,補一張圖片就能繞過這個限制。
把首幀圖片、時長、比例這些設定攤開來看,Gen-4.5 跟舊版之間的差異,用一張表格會比一段一段文字更清楚。
Gen-4.5 跟 Gen-4、Gen-4 Turbo,規格有什麼差異?
下面這張表把三個模型的硬規格攤開,不看行銷文案,只看數字。
| 項目 | Gen-4.5 | Gen-4 | Gen-4 Turbo |
|---|---|---|---|
| 每秒點數 | 12 點 | 12 點 | 5 點 |
| 可選時長 | 2~10 秒(自由選) | 5 秒或 10 秒(固定二選一) | 5 秒或 10 秒(固定二選一) |
| 畫面比例選項 | 純文字模式 1 種(16:9);文字加圖片模式 6 種 | 6 種(含 9:16、1:1 等) | 6 種(含 9:16、1:1 等) |
| 輸出解析度 | 720p | 720p | 720p |
| 支援平台 | 僅網頁 | 網頁加 iOS App | 網頁加 iOS App |
| 圖片輸入 | 選填 | 必填 | 必填 |
| 最低方案門檻 | Standard 以上 | Standard 以上 | 免費版就能試(125 點一次性額度) |
先講最多人誤會的一點,Gen-4.5 每秒消耗 12 點,跟舊版 Gen-4 完全一樣,並沒有變貴,真正貴的對照組是 Gen-4 Turbo,每秒只要 5 點。Runway 自己在定價頁上也直接把這件事攤開,同樣 9,500 點的 Max 方案額度,換算下來 Gen-4.5 和 Gen-4 都能做出 791 秒的影片,秒數完全一樣,只有 Turbo 能做到 1,900 秒。
畫面比例是 Gen-4.5 目前明顯的弱項,純文字模式下只有 16:9 一種,Gen-4 跟 Turbo 兩個舊版反而都有 6 種比例可選,直式的 9:16 也在裡面,前一節提過,補一張首幀圖片就能追平。支援平台也是舊版的優勢,Gen-4.5 現階段只能在網頁上用,Gen-4 跟 Gen-4 Turbo 手機上的 App 也能直接生成,不必開電腦。
規格攤開來看完,接下來把這些差異換算成實際的選擇建議,幾個具體情境對照著看最快。
什麼情境該用 Gen-4.5?什麼時候 Gen-4 Turbo 更夠用?
把上面的規格差異換算成實際選擇,大概會落在下面幾個情境。
想拍直式或方形短影音(Reels、限動、TikTok)
如果只靠純文字生成,Gen-4.5 目前只有 16:9 這一種畫面比例;想要 9:16 或 1:1,得另外準備一張首幀圖片才能解鎖前面提到的其餘 5 種比例。手上剛好沒有合適的圖片可用,又急著出直式素材,Gen-4 或 Gen-4 Turbo 反而更省事,不必多這一道手續。
想用手機隨手生成
Gen-4.5 現階段只能在網頁版使用,還沒有對應的手機 App;Gen-4 跟 Gen-4 Turbo 兩個舊版都有 iOS App,可以直接在手機上生成短片。通勤路上、外出想到一個畫面就想馬上生成看看的情境,還是得靠這兩個舊版,Gen-4.5 目前得回到電腦前才能用。
要做產品展示、人像特寫、電影感主視覺
物理真實度與時間一致性這兩項提升,對近景、長鏡頭、細節不能跑掉的內容最有感。產品展示要顧到材質光澤不失真、人像特寫要顧到頭髮絲不中途變樣、電影感的主視覺鏡頭又特別倚賴動作的重量感,這幾類內容正好踩在 Gen-4.5 的強項上,值得直接選它,不必省下這筆點數。
只是想快速試 idea、大量迭代草稿
同樣的點數,Gen-4 Turbo 能產出的秒數是 Gen-4.5 的 2.4 倍,每秒只要 5 點,Gen-4.5 要 12 點。想法還沒定案、需要大量嘗試不同運鏡與構圖的階段,先用 Turbo 篩過一輪,等定案了再用 Gen-4.5 出最終成品,兩個模型搭著用最划算。
點數怎麼分配划算,講到 Turbo 篩選、Gen-4.5 出成品的搭配用法,自然會牽出下一個問題,這樣算下來要花多少點數、多少錢。
Gen-4.5 的費用其實跟 Gen-4 一樣,只比 Turbo 貴一倍
先破解一個常見的誤解。Gen-4.5 每秒消耗 12 點,跟舊版 Gen-4 完全一樣,並沒有因為是新模型就變貴;真正的差距是跟 Gen-4 Turbo 比,Turbo 每秒只要 5 點,Gen-4.5 貴了超過一倍。免費版用不到這個模型,免費版的 125 點一次性額度只給 Gen-4 Turbo 的圖生影片,想用 Gen-4.5 至少得訂閱 Standard 方案。
換算成實際能拍出幾秒影片會更有感。Standard 方案年繳每月 12 美元(不年繳則是每月 15 美元)、每月 625 點,約能做出 52 秒的 Gen-4.5 影片。Pro 方案年繳每月 28 美元、每月 2,250 點,約 187 秒。Max 方案年繳每月 76 美元、每月 9,500 點,約 791 秒。同樣的點數如果拿去產出 Gen-4 Turbo 的影片,秒數會是 Gen-4.5 的 2.4 倍,以 Standard 方案來說大約能做到 125 秒。

預算有限、需要精算成本效益的人,這筆帳值得先算清楚,再決定要不要把手上的專案全面換成 Gen-4.5。
糾結 Runway Gen-4.5 現在是不是排行榜第一名,意義不大,這個頭銜換手的速度比想像中快。真正該在意的是它把哪些讀者真正用得到的東西做到位了,動作的物理重量感、長鏡頭裡頭髮布料不再中途變形,還有要不要用首幀圖片鎖畫面的彈性,這幾點才是這次升級真正落地的部分。
Gen-4、Gen-4 Turbo 也沒有因此就過時。多種畫面比例、手機上就能生成、還有更低的點數成本,這幾個場景現階段還是舊版的天下,Gen-4.5 暫時補不上。三個模型搭著用,比執著要不要「全面升級」更實際。
