Alibaba Cloud 於 2026 年 8 月 24 日正式推出 Wan3.0,新版本的重點不只是把文字轉成畫面,而是讓模型直接理解文件、試算表、簡報與網頁,將其中的資訊整理成可觀看的影片。官方表示,Wan3.0 最長可生成 30 秒影片,並已被用於短劇、電影製作、廣告行銷、旅遊推廣與音樂錄影帶等場景。
Wan3.0 這次改變了什麼?
過去的 AI 影片工具多半要求使用者輸入提示詞、參考圖片或分鏡描述;Wan3.0 把輸入範圍擴大到更接近工作文件。使用者可以把一份簡報、企劃資料或網頁交給模型,再要求它依照內容生成影片,減少先閱讀資料、整理腳本、準備視覺提示詞的往返。
30 秒上限也讓模型更適合做一段完整的短片,而不是只能產生幾秒鐘的片段。這不代表每次輸出都能直接交付,畫面連貫性、角色一致性、文字正確率與資料取捨仍需要人工檢查;但對需要快速做出提案、社群短片或商品概念影片的人來說,輸入方式已更接近實際工作流程。
從文件理解內容,而不是只讀一句提示詞
文件輸入的價值,在於影片可以建立在原本就存在的內容上。例如旅遊團隊能從行程與景點資料製作宣傳初稿,品牌團隊能從產品簡報整理視覺敘事,教育或企業團隊也能把一份說明文件轉成適合觀看的內容。Wan3.0 的定位因此不只是生成畫面,也包含把資訊轉成腳本、節奏與鏡頭選擇。
不過,模型能讀取文件不等於它能正確理解所有表格與限制。實際使用時,仍要確認影片中的數字、產品規格、日期、專有名詞與免責內容;涉及商業或公共資訊的影片,不能因為畫面看起來自然就跳過事實校對。
現在可以怎麼使用?
Wan3.0 在 8 月 6 日先開放公開測試,8 月 24 日再由 Alibaba Cloud 對外宣布正式推出。實際可用模型、申請方式、地區資格、價格與 API 限制,仍要以 Alibaba Cloud Model Studio 的最新頁面為準;不同入口不一定同時提供完全相同的功能。
對創作者而言,最合理的用法是把 Wan3.0 當成前期製作工具:先用文件建立腳本與視覺方向,再人工挑選鏡頭、修正文字與重新生成。它可以縮短從資料到第一版影片的時間,但不能取代拍攝規劃、剪輯、品牌審稿與權利確認。
對 AI 影片市場的意義
Wan3.0 顯示,生成式影片的競爭正從「誰能做出更漂亮的單一畫面」轉向「誰能把既有資料變成可用內容」。當模型能處理文件與簡報,企業導入的入口就不再只是影像創作者,也包括行銷、教育、旅遊與產品團隊。接下來真正重要的問題,會是輸出是否可靠、權利是否清楚,以及團隊能不能把生成結果接進既有審稿流程。
官方資訊可參考 Alibaba Cloud Model Studio 的 Wan3.0 模型頁面 與 Wan3.0 官方 GitHub。
