NVIDIA 將 PAIR 開源,旨在將 Mac 與 RTX 電腦整合為單一 AI 叢集
NVIDIA 已推出「個人 AI 路由器」(PAIR)軟體的開源測試版,該軟體作為本地網路調度器,負責將 AI 請求導向至可用的電腦。

自動裝置偵測與請求指派:Ollama 與 LM Studio 的直接效益
在相容硬體(包括 M4+ Mac、NVIDIA RTX 個人電腦及 DGX Spark)上,PAIR 為 Ollama 和 LM Studio 等本地 AI 工具提供統一介面。這讓使用者能夠將多個獨立的 AI 任務分派至家庭或辦公室網路中的閒置裝置上。
PAIR 作為本地請求調度器,會自動偵測已連線的電腦,並將任務指派給可用資源。由於模型會透過 Ollama 或 LM Studio 持續在目標裝置上運行,使用者無需針對每台機器進行個別設定。 若某台裝置正處於繁忙狀態,PAIR 會將請求重新導向至其他已配對的節點。例如,正在處理多份文件的 AI 代理程式,可將獨立任務分配給不同的電腦。NVIDIA 澄清,此機制旨在分散並行工作負載,而非透過整合運算能力來加速個別 AI 回應。
效能測試:任務分割將處理時間從 18 分鐘縮短至 8 分 48 秒
NVIDIA 的示範顯示,在 Hermes 環境中使用 Ollama 搭配 Qwen 3.6 35B A3B 模型,並在 Hermes 中將任務分配給五個 AI 子代理後,在新增一台 DGX Spark 和一張 RTX 5090 後,單台 RTX Spark 筆記型電腦的平均完成時間從 18 分鐘縮短至 8 分 48 秒。
相關文章
英國人工智慧初創公司Emulate啟動融資,目標高達7億美元,估值37億美元
9月16日星期三,總部位於英國的AI初創公司Emulate宣佈完成新一輪融資,目標金額高達7億美元,投後估值約為37億美元。本輪融資由Index Ventures和Lightspeed Venture Partners領投。Emulate由前Google DeepMind研究人員Jack Parker-Holder和Matthew McGill於2026年8月創立,兩人均參與了DeepMind Genie世界模型的研發工作。Genie能夠根據簡短的文字提示生成逼真的影片和互動式3D環境。自今年
在 TechCrunch Disrupt 2026 上,AI 創始人權衡開放模型與封閉模型
對於人工智慧初創企業而言,選擇模型不再僅僅是一次性的架構決策。開源模型正在變得更好。前沿 API 持續改進。模型可以針對特定任務進行定製,一些公司正在構建使用多種模型而非單一模型的產品。這為創始人提供了更多的構建方式——以及在技術變化時,關於在哪裡投入、擁有哪些資產以及保留多少靈活性的更多決策。在 TechCrunch Disrupt 2026 上,四場對話從人工智慧棧的不同層面探討這些決策,涵蓋多模型應用、定製模型、基礎設施及其底層晶片。鎖定你的 Disrupt 通行證,聆聽人工智慧領導者如何
月之暗面(Moonshot AI)的Kimi K2.5——首個萬億引數多模態模型,將於本月底退役
Moonshot 透過 Kimi 官方微博宣佈,其首款萬億引數多模態模型 Kimi K2.5 將於本月底退役。K2.5 於今年一月釋出並開源,是 Kimi 迄今為止最通用的模型,採用原生多模態架構,能夠處理視覺和文字輸入,支援思考與非思考模式,並支援對話及 Agent 任務。K3 接棒,引數規模再度攀升K2.5 在 Agent、程式碼、影象、影片及通用智慧等任務中實現了開源模型的最優效能。它被定位為一款通用多模態模型,可在對話、複雜推理和自動化任務之間切換。其退役也標誌著 Moonshot 已將重
相關專題推薦
評論 (0)
0/500
NVIDIA 已推出「個人 AI 路由器」(PAIR)軟體的開源測試版,該軟體作為本地網路調度器,負責將 AI 請求導向至可用的電腦。

自動裝置偵測與請求指派:Ollama 與 LM Studio 的直接效益
在相容硬體(包括 M4+ Mac、NVIDIA RTX 個人電腦及 DGX Spark)上,PAIR 為 Ollama 和 LM Studio 等本地 AI 工具提供統一介面。這讓使用者能夠將多個獨立的 AI 任務分派至家庭或辦公室網路中的閒置裝置上。
PAIR 作為本地請求調度器,會自動偵測已連線的電腦,並將任務指派給可用資源。由於模型會透過 Ollama 或 LM Studio 持續在目標裝置上運行,使用者無需針對每台機器進行個別設定。 若某台裝置正處於繁忙狀態,PAIR 會將請求重新導向至其他已配對的節點。例如,正在處理多份文件的 AI 代理程式,可將獨立任務分配給不同的電腦。NVIDIA 澄清,此機制旨在分散並行工作負載,而非透過整合運算能力來加速個別 AI 回應。
效能測試:任務分割將處理時間從 18 分鐘縮短至 8 分 48 秒
NVIDIA 的示範顯示,在 Hermes 環境中使用 Ollama 搭配 Qwen 3.6 35B A3B 模型,並在 Hermes 中將任務分配給五個 AI 子代理後,在新增一台 DGX Spark 和一張 RTX 5090 後,單台 RTX Spark 筆記型電腦的平均完成時間從 18 分鐘縮短至 8 分 48 秒。
英國人工智慧初創公司Emulate啟動融資,目標高達7億美元,估值37億美元
9月16日星期三,總部位於英國的AI初創公司Emulate宣佈完成新一輪融資,目標金額高達7億美元,投後估值約為37億美元。本輪融資由Index Ventures和Lightspeed Venture Partners領投。Emulate由前Google DeepMind研究人員Jack Parker-Holder和Matthew McGill於2026年8月創立,兩人均參與了DeepMind Genie世界模型的研發工作。Genie能夠根據簡短的文字提示生成逼真的影片和互動式3D環境。自今年
在 TechCrunch Disrupt 2026 上,AI 創始人權衡開放模型與封閉模型
對於人工智慧初創企業而言,選擇模型不再僅僅是一次性的架構決策。開源模型正在變得更好。前沿 API 持續改進。模型可以針對特定任務進行定製,一些公司正在構建使用多種模型而非單一模型的產品。這為創始人提供了更多的構建方式——以及在技術變化時,關於在哪裡投入、擁有哪些資產以及保留多少靈活性的更多決策。在 TechCrunch Disrupt 2026 上,四場對話從人工智慧棧的不同層面探討這些決策,涵蓋多模型應用、定製模型、基礎設施及其底層晶片。鎖定你的 Disrupt 通行證,聆聽人工智慧領導者如何
月之暗面(Moonshot AI)的Kimi K2.5——首個萬億引數多模態模型,將於本月底退役
Moonshot 透過 Kimi 官方微博宣佈,其首款萬億引數多模態模型 Kimi K2.5 將於本月底退役。K2.5 於今年一月釋出並開源,是 Kimi 迄今為止最通用的模型,採用原生多模態架構,能夠處理視覺和文字輸入,支援思考與非思考模式,並支援對話及 Agent 任務。K3 接棒,引數規模再度攀升K2.5 在 Agent、程式碼、影象、影片及通用智慧等任務中實現了開源模型的最優效能。它被定位為一款通用多模態模型,可在對話、複雜推理和自動化任務之間切換。其退役也標誌著 Moonshot 已將重





首頁






