NVIDIA RTX加速LTX-2與ComfyUI解鎖PC端4K AI影片生成

NVIDIA 2026-01.jpg

2025年是PC端AI開發的突破之年。PC等級的小型語言模型(SLM)準確度相較2024年幾乎提升近2倍,大幅縮小與雲端前沿大型語言模型(LLM)之間的差距。同時,Ollama、ComfyUI、llama.cpp、Unsloth等AI PC開發者工具日趨成熟,年成長率翻倍;下載PC等級模型的使用者數量,也較2024年成長10倍。上述進展正推動生成式AI在2026年全面走向日常PC創作者、遊戲玩家與專業工作者。

在本週CES展會上,NVIDIA宣布為GeForce RTX、NVIDIA RTX PRO與NVIDIA DGX Spark推出一系列AI升級,為開發者在PC上部署生成式AI提供所需的效能與記憶體資源,包括:

  • 透過PyTorch-CUDA最佳化,以及ComfyUI原生支援NVFP4/FP8精度,影片與影像生成效能最高提升3倍,VRAM使用量降低60%
  • RTX影像超解析度整合至ComfyUI,加速4K影片生成
  • 針對Lightricks最尖端的LTX-2聲音與影像生成模型開源版,提供最佳化NVIDIA NVFP8
  • 一套全新影片生成流程,透過Blender 3D場景,精準控制輸出並生成4K AI影片
  • 透過Ollama與llama.cpp,將SLM推論效能提升最高35%
  • 為Nexa.ai的Hyperlink新一代影片搜尋功能提供RTX加速

這些升級讓使用者能在本地RTX AI PC上,順暢執行進階的影片、影像與語言AI工作流程,同時兼顧隱私、安全與低延遲。

在RTX PC上實現3倍加速的4K AI影片生成

生成式AI能製作出令人驚艷的影片內容,但僅靠文字提示的線上工具往往難以精準控制生成內容;嘗試生成4K影片更是幾乎不可能,因為多數模型過於龐大,難以放入PC的VRAM。

1/6,NVIDIA推出RTX加速的影片生成流程,讓創作者在使用極少VRAM的情況下,不僅能更精準掌控生成結果,還能以3倍速度生成影片並將提升至4K解析度。

此流程讓新銳創作者可先建立分鏡腳本,再生成擬真關鍵畫格,最終輸出高品質4K影片。整體分為三個可自由搭配、依需求調整的模組:

  • 3D物件生成器:用於建立場景所需的資產
  • 3D引導影像生成器:讓使用者在Blender中設定場景,並生成擬真關鍵畫格
  • 影片生成器:依據使用者設定的起始與結束關鍵畫格進行動畫生成,並透過NVIDIA RTX Video技術將影片升級至4K

這套流程得以實現,關鍵在於Lightricks全新LTX-2模型的正式釋出,該模型現已開放下載。

作為本地AI影片創作的重要里程碑,LTX-2的生成效果可與頂尖的雲端模型並駕齊驅,能生成長達20秒且具備出色視覺擬真度的4K影片。該模型內建音訊支援、多關鍵畫格能力,以及進階的條件控制功能,並透過可控式低秩適配(LoRA)強化,讓創作者在不依賴雲端的情況下,也能達到電影級的品質與控制力。

在底層技術上,這套流程由ComfyUI驅動。過去數月,NVIDIA與ComfyUI團隊密切合作,在NVIDIA顯示卡上將效能最佳化40%;最新版本新增支援NVFP4與NVFP8。在RTX 50系列顯示卡上採用NVFP4格式時,可讓效能提升3倍、VRAM使用量降低60%;採用NVFP8時,則可提升2倍效能、VRAM降低40%。

目前,NVFP4與NVFP8Checkpoint現已在ComfyUI中直接開放給多款頂尖模型,包括Lightricks的LTX-2、Black Forest Labs的FLUX.1與FLUX.2,以及阿里巴巴的Qwen-Image與Z-Image。使用者可直接在ComfyUI下載,後續也將陸續支援更多模型。

影片片段生成後,使用者可透過ComfyUI全新的RTX Video節點,在數秒內將影片升級至4K。此影像放大(Upscaler)功能可即時運作,銳化畫面邊緣並消除壓縮雜訊,輸出清晰的畫面。RTX Video將於下個月正式於ComfyUI中開放。

為協助使用者突破顯示卡的記憶體限制,NVIDIA也與ComfyUI合作強化其記憶體卸載功能(weight streaming)。啟用後,當VRAM不足時,ComfyUI可改用系統記憶體,讓中階RTX顯示卡也能執行更大型模型與更複雜的多階節點流程。完整的影片生成工作流程將於下個月開放下載;LTX-2影片模型的開源權重與ComfyUI RTX相關更新現已上線。

全新的PC檔案與影片搜尋方式

數十年來,PC上的檔案搜尋方式幾乎沒有改變,仍主要依賴檔名與零散、不完整的中繼資料,讓使用者要找出一年前的特定文件,往往困難許多。

由Nexa.ai推出的本地搜尋代理Hyperlink,能將RTX PC轉變為一個可搜尋的知識庫,使用者可透過自然語言提問,並即時取得附有引用來源的答案。Hyperlink可掃描並索引文件、簡報、PDF與圖像,讓搜尋依據內容與概念進行,而不再只是猜檔名。所有資料皆在本地處理並保留於使用者的PC中,兼顧隱私與資安需求。此外,Hyperlink也透過RTX加速大幅提升效能,在RTX 5090顯示卡上,索引文字與影像檔案僅需 每GB約30秒,回應時間約3秒;相較之下,僅使用CPU時,索引每GB檔案需 約1小時,回應時間約90秒。

在CES 2026展會上,Nexa.ai也首度公開支援影片內容的Hyperlink測試版本,讓使用者可在影片中搜尋物件、動作與語音內容。這項功能特別適合影片創作者快速尋找B-roll素材,也能讓玩家找出自己贏得比賽的精彩時刻,分享給朋友。有興趣體驗Hyperlink私有測試版本的使用者,測試資格將自本月起陸續開放。

小型語言模型(SLM)效能再提升35%

NVIDIA攜手開源社群,透過Llama.cpp與Ollama,在RTX顯示卡與NVIDIA DGX Spark桌上型超級電腦上為SLM帶來顯著的效能提升。此次更新對混合專家模型(MoE)特別有利,包含全新的NVIDIA Nemotron 3系列開放模型。

在過去四個月中,SLM的推論效能已有明顯進展,在llama.cpp上提升了35%,在Ollama上提升了30%。目前Ollama的更新已正式推出;llama.cpp也已加入改善使用體驗的更新,大幅加快大型語言模型(LLM)的載入速度,並預計於1月稍晚陸續推出更多更新。

這些效能提升將納入LM Studio的下一次更新,並陸續導入代理型應用程式,例如全新的MSI AI Robot應用。MSI AI Robot同樣受益於Llama.cpp的最佳化,讓使用者能以自然語言方式控制MSI裝置設定,並將在即將推出的版本中整合最新更新內容。

NVIDIA Broadcast 2.1:讓更多PC使用者體驗虛擬補光效果

NVIDIA Broadcast應用程式透過AI特效提升PC麥克風與網路攝影機的音訊與影像品質,非常適合用於直播與視訊會議。在2.1版更新中,NVIDIA進一步強化虛擬補光(Virtual Key Light)效果,不僅提升整體效能,也將支援範圍擴大至RTX 3060桌機顯示卡以上。新版可因應更多元的光源情境,提供更廣泛的色溫調整,並採用更新後的HDRi底圖,呈現專業直播中常見的雙主燈風格。

以DGX Spark將居家創作工作室升級為AI超級工作站

隨著功能日益強大的AI模型每月持續登上PC平台,開發者對於更高效、彈性更大的本地AI環境需求也不斷升溫。DGX Spark是一款可直接放置於桌面的精巧AI超級電腦,能與既有的桌機或筆電無縫搭配,讓使用者在原有PC旁,同步進行實驗、原型設計與進階AI工作負載。

DGX Spark非常適合想測試LLM、開發代理型工作流程的使用者,也適合創作者在背景平行生成素材,同時保留主力電腦持續進行剪輯與創作。

在CES 2026展會上,NVIDIA宣布為DGX Spark推出重大的AI效能升級,自產品推出不到三個月以來,整體效能提升最高2.6倍。此外,NVIDIA也同步釋出多款全新的DGX Spark教學範例,其中包含用於推測式解碼(Speculative Decoding)的範例,以及利用兩台DGX Spark模組進行模型微調 的實作指南。

玩家總結

NVIDIA於CES 2026展會期間,為GeForce RTX、NVIDIA RTX PRO與NVIDIA DGX Spark帶來一系列AI升級,大幅強化PC端AI影片、影像與文字生成效能。透過與Lightricks及ComfyUI等合作夥伴的技術整合,不僅可實現4K AI影片的3倍加速生成,更透過LTX-2模型提供電影級的創作控制力。同時,Nexa.ai的Hyperlink本地搜尋代理也獲得RTX加速,能以自然語言快速搜尋PC檔案與影片內容。

延伸閱讀:
徠卡再推全新M鏡頭!「Safari系列、亮面黑漆版」同步登場
Honda二輪新年神開局、指定車款享1萬購車金!Rebel500、CBR650R E-Clutch「60期零頭款零利率」
最紅年菜是它!王品嚴選「米其林鴨胸」成年夜飯寵兒、套組75折熱烈預購中
Kia全台首場「原廠精選中古車展」1/11限定登場!集結超過50台「公務、試乘車」最高享逾70萬禮遇