AI Infrastructure2026-10-01NVIDIA AI Blog

NVIDIA 攜手 CoreWeave,代理式 AI 正式走入生產線

NVIDIA 與 CoreWeave 正把代理式 AI 從實驗階段推向生產環境,透過新世代的 NVIDIA 基礎架構,把模型訓練與真實世界部署串成一個完整閉環。兩家公司已經合作將近十年,CoreWeave 把 NVIDIA 的運算、網路與軟體整合進一套專為 AI 工作負載設計的雲端平台。 這套組合的目標是支援代理式系統:也就是能自己規劃步驟、呼叫工具、檢索資訊,並在多個環節中採取行動的 AI 應用。這類工作負載的需求跟單一次聊天機器人查詢完全不同。它們需要低延遲、高吞吐量,還得在代理不斷產生新任務、查詢資料庫、跟外部服務互動時快速擴充。只要底層基礎設施一塞車,代理的使用體驗就會整組壞掉。 根據雙方說法,CoreWeave 正把 NVIDIA 最新的 Vera Rubin 架構導入生產環境。這個動作的目的是讓企業在訓練與推論上都能用到更新的效能與能源效率。對正在打造代理的企業來說,最吸引人的是更緊實的流程:訓練或微調模型、把模型部署到靠近資料與使用者的位置,然後持續跑推論,不必為每個階段重建整套技術堆疊。 這項合作也反映了 AI 經濟的更大轉向。雲端服務商不再只是出租 GPU,而是要比拼專門化的 AI 雲、網路、調度與軟體,讓複雜工作負載變得可管理。對 NVIDIA 來說,這能加深市場對它整套平台的需求;對 CoreWeave 而言,則是與一般通用雲端對手做出區隔。 不過,生產環境的代理式 AI 仍處於早期階段。企業必須處理可靠性、安全性、成本控管與治理等問題。能自主行動的代理會帶來新的風險,從非預期的工具呼叫到資料外洩都有可能。基礎架構能在隔離、可觀測性與效能上幫上忙,但沒辦法解決所有政策面的難題。NVIDIA 與 CoreWeave 的這一步,是在賭下一波 AI 價值會來自能在生產環境中持續運作的代理,而不只是展示起來很漂亮的模型。如果這個賭注押對了,兩家公司就等於把自己卡進了代理式技術堆疊的正中央。

相關資訊