TechSpace 鐵客空間

每日科技新聞新知、硬體開箱評測、賣場優惠!

NVIDIA RTX AI PC 大更新:Nemotron 3.5 Lightning、LTX-2.5 齊發,DGX Spark 也能叢集運算

NVIDIA 為 RTX AI PC 帶來 Nemotron 3.5 Lightning、LTX-2.5 等新開源模型與 DGX Spark 叢集功能,效能與記憶體雙雙優化。
NVIDIA RTX AI PC 大更新:Nemotron 3.5 Lightning、LTX-2.5 齊發,DGX Spark 也能叢集運算

NVIDIA 加碼投入開源 AI 模型,RTX 與 DGX 平台再進化

NVIDIA 一口氣端出多項針對 RTX 與 DGX 平台的更新,主軸圍繞在「開源模型 + 本地端加速」,讓一般消費級 GPU 到桌上型 AI 超級電腦 DGX Spark,都能享有更快的推論速度與更省記憶體的運算表現。這波更新同時也呼應 NVIDIA 執行長黃仁勳近期在公開場合多次力挺開源 AI 的立場,他先前受訪時就直言,免費的 AI 對硬體、對晶片來說都是好事。

這次最受矚目的新模型,是 NVIDIA 同步發表的 Nemotron 3.5 Lightning。這款 300 億參數的混合專家(MoE)模型只會啟用其中約 30 億參數,設計目標鎖定在「常駐代理」(always-on agent)這類需要高頻率、低延遲執行的任務,例如工具呼叫、結果驗證與子任務分派。NVIDIA 表示,透過從旗下更大型的 Nemotron 3 Ultra 進行知識蒸餾,Nemotron 3.5 Lightning 在同量級模型中可帶來最高 4 倍的輸出速度,代理任務完成速度也提升約 30%。這顆模型可以直接跑在單張 GPU 上,支援的硬體範圍相當廣,從 GeForce RTX 5090、DGX Spark、DGX Station 到 Jetson 邊緣裝置都涵蓋在內,也能延伸到資料中心與雲端環境。目前 Hugging Face、ModelScope、OpenRouter 與 NVIDIA 官網都能下載,CrowdStrike、Harvey、CodeRabbit 等企業已經展開測試與客製化。

nvidia accelerates ai on dgx rtx with new models 1

搭配 Nemotron 3.5 Lightning 一起亮相的,還有開源模型路由工具 NeMo Switchyard,它能自動把每一步任務導向最合適、成本最划算的模型執行,開發者不需要為此重寫應用程式,內部測試顯示其準確度可維持在頂尖水準,同時把任務執行成本壓低到相當可觀的程度。

LTX-2.5 開源影片模型加入雙路徑解碼,RTX PRO 6000 效能提升 20%

在生成式影片領域,NVIDIA 也宣布加速支援全新開源影片模型 LTX-2.5。這款模型新增多鏡頭生成(multishot generation)與生成式編輯功能,並透過新的擴散式影片解碼器搭配原有的變分自編碼器解碼路徑,讓最終輸出畫質更進一步。在 RTX GPU、DGX Spark 與 DGX Station 上,LTX-2.5 可帶來 2 倍效能提升與 40% 記憶體節省;若換算到 RTX PRO 6000 96GB 這張旗艦卡上,效能提升幅度約為 20%,同樣可省下 40% 記憶體用量。開發者能透過 NVFP4、FastVideo 與 ComfyUI 進一步強化文字、圖片與影片轉影片的生成流程。值得一提的是,LTX-2.5 生成一段 10 秒影片僅需約 6.8 秒,相較部分雲端閉源方案動輒需要 52 到 398 秒,本地端運算的效率優勢相當明顯。

同一時間,Meta 也釋出了最新的 300 億參數開源模型 Muse Glimmer,具備 12 萬以上 token 的長上下文能力,主打程式撰寫與代理式 AI 應用,特別針對 NVIDIA RTX 與 DGX 系統最佳化,同時也相容 Jetson 平台,在單張 RTX 5090 上就能跑出超過每秒 200 個 token 的生成速度。Muse Glimmer 支援客製化代理、私有資料處理、金鑰與驗證憑證的本地端安全運用,也能拆解大型專案為多個步驟並在中斷後接續執行,相當適合需要長時間運作的自動化工作流程。

nvidia accelerates ai on dgx rtx with new models 2

DGX Spark 迎來叢集功能與原生 ARM64 版 Chrome

針對桌上型 AI 超級電腦 DGX Spark,NVIDIA 這次也帶來幾項重要更新。首先是全新的「NVIDIA Sync Cluster Assistant」,讓使用者能更輕鬆地把多台 DGX Spark 串接成高速叢集,藉此擴充記憶體、推論與運算能量以應付更大型的模型,這項功能同時支援 Windows 與 macOS。此外,DGX Spark 也將迎來原生 ARM64 版本的 Google Chrome,可直接透過 DGX Dashboard 在 DGX OS 上安裝;新推出的 NVIDIA Sync Resource Monitor 則能即時呈現單機或整個叢集的 CPU、GPU 使用狀況與歷史紀錄。

除了上述重點項目,NVIDIA 這波更新也一併加速了包括 Cosmos 3 Edge(40 億參數)、MiniMax-H3(330 億參數)、Poolside 的 Laguna S 2.1(1180 億參數)、DeepSeek-V4-Flash(2840 億參數)、Thinking Machines Lab 的 Inkling-Small(2760 億參數)以及 Wan-Animate-2(140 億參數)等多款開源模型,同時也開始支援開源桌面應用程式 Unsloth Desktop,一次整合本地模型推論、圖像/影片擴散生成、微調、代理整合、網路檢索與程式碼執行等功能。在 Wan-Animate-2 這款能把動作與表情從參考影片轉移到靜態角色圖片的模型上,RTX 5090 與 RTX PRO 5000 Blackwell 相較 Apple M3 Ultra 分別可帶來最高 26 倍與 16 倍的效能優勢。整體來看,NVIDIA 這次針對 RTX 與 DGX 平台的更新,等於是把「開源模型本地化」這條路線又往前推進了一大步,也讓 AI PC 這個新興品類的實用性更加明確。

快速 Q&A 整理

Nemotron 3.5 Lightning 是什麼?

它是 NVIDIA 發表的 300 億參數混合專家開源模型,主要啟用約 30 億參數,鎖定常駐代理與高頻任務執行,可運行於單張 GPU、RTX PC、DGX Spark 等裝置。

Nemotron 3.5 Lightning 的速度提升有多少?

NVIDIA 表示相較同量級模型,Nemotron 3.5 Lightning 輸出速度最高提升 4 倍,代理任務完成速度提升約 30%。

LTX-2.5 帶來哪些新功能?

LTX-2.5 是開源影片生成模型,新增多鏡頭生成與生成式編輯功能,並在 RTX GPU、DGX Spark 與 DGX Station 上帶來 2 倍效能提升與 40% 記憶體節省。

DGX Spark 的叢集功能是什麼?

NVIDIA Sync Cluster Assistant 讓使用者能把多台 DGX Spark 串接成高速叢集,擴充記憶體與運算能力以執行更大型模型,支援 Windows 與 macOS。

Meta Muse Glimmer 在 RTX 5090 上的表現如何?

這款 300 億參數的開源模型針對本地代理最佳化,在單張 RTX 5090 上可跑出超過每秒 200 個 token 的生成速度。

參考網頁來源

延伸閱讀

歡迎加入我們的 Facebook 粉絲團,隨時掌握最新消息!
喜歡看圖說故事的話,也可以追蹤 Instagram 專頁!
我們也有 Threads 可以隨時 follow!

發佈留言

發佈留言必須填寫的電子郵件地址不會公開。 必填欄位標示為 *