Wan 3.0 AI影片生成器

Alibaba的新一體化模型:可根據提示詞、圖片—或PDF、投影片或試算表原生生成30秒片段。這裡唯一能讀取文件的模型。在下方輸入提示詞並試用,無需等待名單。

模型
上傳圖片
點擊或將JPG、JPEG、PNG或WEBP圖片拖放到此處,最大 10 MB
提示詞
0/5000
輸出長寬比
Auto
解析度
Auto
時長(秒)
Auto
影片範例
 

開發者

阿里巴巴通義實驗室

類型

一體化: 生成 + 參考 + 編輯

時長

2–30秒單次處理

最大輸出

1080p

文件輸入

pdf / ppt / xls / URL

開啟權重

已承諾 (Apache 2.0)

此處為等級

付費點數

我們的一句話結論: 文件選擇。當來源素材是簡報、手冊或試算表時,其他任何東西甚至都無法讀取它。

Wan 3.0 於8月6日進入公開測試階段,而它最犀利的優勢並不是30秒單鏡頭——Seedance已經率先做到——而是它接受的輸入內容。給它一份PDF手冊、一份提案簡報或一份季度試算表,它就會根據內容生成影片,同時讓角色、道具和版面配置與來源保持一致。Alibaba也將過去4個獨立的Wan模型合併為1個,因此生成、參照和編輯不再意味著要在流程中途切換模型。

坦誠解讀

Wan 3.0勝出的地方 — 以及它沒有勝出的地方

公開測試版才發布數天,因此這些是基於我們的測試算圖以及Alibaba發布文件的第一印象——並已相應標註。我們會在獨立數據公布後進行修訂。

真正強大

  • • 文件轉影片。

    可讀取最大100 MB或50頁的doc、xls、ppt、pdf及類似格式,以及透過URL讀取網頁,並根據內容生成影片。可從手冊生成訓練影片,從投影片生成示範 — 我們代管的其他任何模型都完全做不到這一點。

  • • 30秒一鏡到底。

    一次原生生成可達2到30秒,是先前Wan上限的兩倍,並配備智慧時長功能,可為你的提示詞建議合適的長度。

  • • 一體化工作流程。

    Wan 2.7將text-to-video、image-to-video、參考和編輯拆分到四個模型中。Wan 3.0將它們合併 — 一個模型ID,無需切換流程,參考和編輯在同一處完成。

  • • 參考保真度。

    角色、道具、聲音、空間佈局和風格會與您的輸入保持一致——Alibaba的表述是「從生成一幀到講述完整故事」,我們的早期測試也支持其連續性主張。

已知限制

  • • 1080p上限。

    已記錄的輸出為480P、720P和1080P——沒有2K級別。如果解析度是核心要求,MiniMax H3手握這張牌。

  • • 存取上游摩擦。

    在Alibaba Cloud上,該模型標記為預覽版,定價僅限受邀使用者。你可以在這裡跳過候補名單,但在測試版擴展期間,預計上游容量會出現波動。

  • • 開放權重: 已承諾,未發布.

    承諾採用Apache 2.0;Wan系列在交付開放發布方面的紀錄並不穩定。相信上傳內容,而不是公告。

  • • 基準測試待處理。

    它在AI影片史上最擁擠的一個月推出——關於它、其競爭對手或我們提出的任何「最佳模型」主張,在獨立評分出爐之前都是暫定的。

提示詞配方

三個提示, 顯示它的用途

其中兩個使用了別人都沒有的文件技巧;第三個是長鏡頭。複製,交換括號,算繪。

從簡報到發布影片

上傳: 你的產品介紹文件 (ppt/pdf,≤50頁)

"將這份簡報製作成30秒發表影片:主持人依序介紹三個關鍵功能,產品渲染圖與投影片完全一致,採用明快的企業風格,最後以最後一張投影片中的標誌和標語收尾。"

為什麼它有效

為結構命名("依序介紹三個關鍵功能","在最後一張投影片結束")會告訴模型如何把30秒分配在你的12張投影片上。"與投影片完全匹配"會啟用參考保真系統 — 它是在讀取你的簡報,而不是在周圍加以裝飾。

手冊轉訓練短片

上傳: 設備手冊(pdf)

"本手冊第3節中的一段30秒安全訓練短片:操作員逐步示範啟動順序,特寫展示文本中提到的每個控制裝置,平靜的教學旁白,字幕與手冊術語一致。"

為什麼它有效

指向某個段落可讓50頁輸入保持聚焦,而"與手冊相符的術語"這項指示會讓輸出可用於實際訓練,而不是通用的b-roll。試算表版本:換入xls,並要求產生由圖表驅動的季度摘要。

不間斷的故事鏡頭

"一個連續30秒的鏡頭:[街頭小吃攤販]在黎明時分擺好她的攤位——展開推車,點燃爐頭,太陽越過屋頂時第一位顧客到來。鏡頭全程緩慢環繞攤位。清晨環境音逐漸增強,匯入滋滋聲和交談聲。"

為什麼它有效

將開端-中段-結尾寫成一句連續動作,就是長鏡頭模型會獎勵的形態。環繞移動的攝影機是連續性壓力測試 — 如果角色和佈局在360度範圍內持續30秒都能保持一致,模型就在完成它的工作。

正面對決

Wan 3.0 vs Seedance 2.5 vs MiniMax H3

三家中國實驗室,三款旗艦模型,六週。三者使用相同提示詞,並按我們會發布的成果來評判——鑑於它們都很新,這只是暫定結論。請自行比較 來自一個提示框。

JobWan 3.0Seedance 2.5MiniMax H3
文件輸入 (pdf/ppt/xls) 是 — 唯一
最大剪輯長度 30秒原生 30秒原生(180秒測試版) 15 s (延長至~30 s)
最高解析度 1080p 透過系列管線實現高解析度 2K原生
基於軌道音訊的節奏控制 語音參考
一體化 (生成 + 參考 + 編輯) 一個模型 區域編輯,獨立流程 指示編輯
每個剪輯的費用 中等 最高(算繪時間較長) 2K最低
開放權重路線圖 Apache 2.0已承諾 已認捐,未出貨
無需候補名單即可存取 僅限邀請的上游 開啟 開啟
版本歷史

Wan線路簡介

2026年8月 · 目前

Wan 3.0

8月6日以wan3.0-video在Alibaba Cloud公開測試版發布。原生30秒片段、文件轉影片、一體化架構、承諾Apache 2.0開放權重。本頁面上的版本。

較早

Wan 2.6 / 2.7

商業時代:透過將工作流程拆分到四個專用模型實現強大的15秒生成,以及一段忽冷忽熱的開源歷程。大多數現有Wan評論所描述的版本。

來源

Wan 2.1 / 2.2 — 開放時代

打造Wan社群的那些發布版本:催生了微調和本地工作流程的強大開放權重,以及為什麼"權重真的會發布嗎"是任何人關於Wan 3.0首先會問的問題。

常見問題

Wan 3.0相關問題,直接解答

1. Wan 3.0是什麼?

阿里巴巴通義實驗室Wan影片系列的新旗艦,於2026年8月6日以模型ID wan3.0-video開放公開測試。三大重點變化:原生30秒單次生成片段(是Wan 2.7上限的兩倍)、可接受文件——PDF、簡報、試算表,甚至網頁——作為創意輸入的全參考系統,以及將過去四個獨立Wan模型合併為一個的一體化架構。

其他模型

不是合適的工具? 試試相鄰的項目

Seedance 2.5

另一個長鏡頭模型。30秒鏡頭按你的配樂剪輯。

MiniMax H3

2K之選。最便宜的高解析度片段,角色和聲音已鎖定。

FLUX 3

造型師。帶音訊的20秒短片,從電影感到停格動畫。