GetChain News
中简 中繁 EN
GetChain News
Toggle sidebar

上線/更新

同時關聯該項目與事件的快訊

英偉達推出NeMo Switchyard,利用AI模型路由技術降低智能體運行成本

英偉達(NVIDIA)推出 AI 模型路由系統 NeMo Switchyard,旨在幫助開發者在多個大模型之間動態分配 AI 智能體(AI Agent)任務,在保證性能的同時降低成本和延遲。英偉達表示,構建 AI 智能體並不意味着必須依賴單一大模型。不同模型在推理能力、響應速度和運行成本方面各有優勢,例如分類任務可能適合輕量模型,複雜推理則需要更強大的前沿模型。如果所有請求都發送至最大規模模型,將導致成本和延遲增加;而全部使用小模型則可能降低複雜任務完成質量。NeMo Switchyard 通過智能路由機制,根據任務需求、模型能力、成本、延遲以及系統狀態等因素,在多個專用模型和前沿模型之間自動選擇最合適的執行模型。該系統支持開發者在不改變應用架構的情況下切換不同模型供應商和模型版本。英偉達介紹,NeMo Switchyard 提供多種路由策略,包括無需訓練的 LLM 分類器路由、階段路由(Stage Router)、升級路由(Escalation Router),以及基於真實工作負載數據訓練的可調節路由模型。其中,升級路由會優先將任務分配給低成本模型,並在檢測到任務複雜度提升、持續錯誤或執行停滯時,將請求升級至更強模型,從而實現性能與成本之間的平衡。英偉達表示,在相關測試中,NeMo Switchyard 通過在不同模型之間分配任務,在保持較高任務完成率的同時顯著降低 AI Agent 運行成本。例如,與僅使用前沿模型相比,基於升級路由的方案在 LangChain 多輪智能體測試中降低約 74%的成本,僅有 7%的請求需要調用前沿模型。此外,英偉達已與 Cognition、Nous Research、Ramp、LangChain、LiteLLM、Kong 等企業合作,將 NeMo Switchyard 集成至 AI Agent 開發流程和企業應用基礎設施中。

Naver D2SF 完成對物理 AI 數據初創公司 NdotLight 第三輪跟投

據韓聯社報道,Naver D2SF 宣佈對物理 AI 數據初創公司 NdotLight(엔닷라이트)完成後續投資,本輪融資由韓國產業銀行主導,總規模達 150 億韓元。這也是 Naver D2SF 繼 2021 年 Pre-A 輪及 2022 年 A 輪之後對該公司的第三次投資。NdotLight 自主研發了 3D 數據生成解決方案 TRINIX,可自動化生成包含物理屬性(質量、摩擦力)、關節結構及碰撞範圍信息的高精度 3D 數據,並與英偉達仿真平臺 Omniverse 深度集成,實現大規模高質量 3D 仿真數據集的批量供應。

英偉達聯手六大華爾街機構組建 5000 億美元 AI 基礎設施融資平臺

據 CNBC 報道,英偉達與阿波羅全球管理、黑石、貝萊德、Brookfield 資產管理、高盛及 KKR 簽署諒解備忘錄,共同爲英偉達客戶建立融資平臺,目標動員逾 5000 億美元第三方資本,用於超大規模數據中心建設及英偉達硬件採購。 英偉達 CEO 黃仁勳將此定性爲 AI 芯片首次成爲"可投資資產類別",稱其具備創收能力、使用壽命長、可跨客戶流轉,並將算力基礎設施類比於電力和互聯網。貝萊德 CEO 拉里·芬克將該項目定義爲繼 1970 年代抵押貸款證券化之後"金融工程的下一個未來",並表示將盡快募集更多資金。高盛 CEO 大衛·所羅門透露,此次合作由黃仁勳主動發起。目前部分資金已完成募集,各方將通過機構信貸、保險資金及私人資本爲 GPU 和數據中心提供融資支持,幫助終端用戶在不動用自身資產負債表的前提下完成 AI 基礎設施建設。

英偉達擬投資 30 億美元於 Lancium,支撐「星際之門」數據中心項目

英偉達擬向電力基礎設施開發商 Lancium 投資至多 30 億美元,其中先期投入 20 億美元以獲取約 20% 股權,後續若達成電網併網等指標可追加 10 億美元。Lancium 由黑石集團支持,其位於得州阿比林的「清潔園區」是英偉達「星際之門」 AI 超算數據中心項目首期所在地。公司當前估值約 100 億美元,並評估 2027 年 IPO。

Cathie Wood旗下基金減持約1700萬美元Palantir股票

根據 Ark Invest 最新披露的交易數據,Cathie Wood 旗下基金於 8 月 4 日和 5 日合計賣出 109,492 股 Palantir(PLTR),按最新收盤價計算價值約 1700 萬美元。Palantir 此前公佈的第二季度營收同比增長 93% 至 19.4 億美元,並上調全年業績指引,推動股價在財報發佈後單日上漲近 30%。此外,Cathie Wood 近期還增持了 Circle(CRCL)、SpaceX(SPCX)及英偉達(NVDA)等股票,同時減持 Shopify(SHOP)和 Roblox(RBLX)。(The Street)

Firmus 以逾 105 億美元估值完成 20 億美元融資,英偉達、Coatue 等參投

據路透社報道,澳大利亞人工智能基礎設施公司 Firmus 完成 20 億美元股權融資,投後估值升至逾 105 億美元,較 4 月上一輪融資時的 55 億美元接近翻倍。本輪融資由英偉達、Coatue Management 繼續參與,Blackstone 旗下基金及 Jane Street 亦提供支持。

英偉達考慮調降 Rubin Ultra GPU 配置,應對 HBM 內存短缺

英偉達爲應對 HBM 內存供應短缺,考慮降低新一代 Rubin Ultra GPU 的配置。據 The Information 援引知情人士消息,英偉達內部在過去數週至少測試了 3 種低 HBM 配置的 Rubin Ultra GPU,所需 HBM 容量低於最初公佈規格。可能的降級路徑包括從 HBM4E 下調至 HBM4、從 12Hi HBM 下調至 8Hi HBM。此舉旨在在供應約束下推進產品發佈計劃。

深圳佳賢通信獨家回應:英偉達AI-RAN技術團隊曾到訪公司,雙方已成立技術工作組

佳賢通信相關人士就通宇通訊發佈的澄清公告回應,2026 年 3 月,英偉達 AI-RAN 技術團隊曾到訪佳賢通信,雙方圍繞 AI-RAN 技術路線進行交流。交流期間,英偉達方面向佳賢通信推薦使用 CUDAAerial 開源平臺開展 AI-RAN 基站系統研發。此後,佳賢通信啓動了基於 CUDAAerial 生態的 AI 原生 5G 及 6G 基站技術預研與驗證,相關工作已持續推進近半年。上述人士表示,目前雙方已組建常態化技術工作組,圍繞相關技術研發與驗證保持溝通。英偉達方面有十餘名來自中國內地、中國香港及新加坡等地區的技術人員參與該工作組。(界面)

AI研究公司Mirendil與谷歌雲達成超1億美元算力協議

AI 研究初創公司 Mirendil 已與 Google Cloud 達成多年期合作協議,將獲得大規模計算資源支持其“自我改進型 AI”(Self-Improving AI)研發。根據協議,Mirendil 將獲得谷歌雲提供的 TPU 和英偉達 GPU 算力資源,以及託管式 AI 訓練集羣,用於開發能夠持續優化自身能力的 AI 系統。據悉,Mirendil 致力於研發“遞歸自我改進”(Recursive Self-Improvement)AI,即 AI 系統能夠通過不斷迭代、自我學習和優化,提高自身性能。該方向也是當前部分頂級 AI 實驗室關注的研究領域。Mirendil 聯合創始人兼 CEO Benham Neyshabur 透露,該協議總價值超過 1 億美元,約相當於公司 6 月底完成的 10 億美元估值種子輪融資金額的一半。(TechCrunch)

馬斯克:SpaceX 憑藉火箭科學家的工程優勢,將在 AI 算力競賽中佔據壓倒性地位

據《財富》雜誌報道,馬斯克在 SpaceX 首次上市後的財報電話會議上表示,SpaceX 憑藉火箭科學家的工程優勢,將在 AI 算力競賽中佔據壓倒性地位,並將其比作"紐約洋基隊對陣小聯盟球隊"。SpaceX 二季度 AI 營收達 26 億美元,環比增長 213%,資本支出達 184 億美元。公司已簽署 141 億美元雲服務合同,客戶包括 Anthropic 和谷歌,並宣佈將全面採用英偉達 Vera Rubin 架構,目標於 2027 年底實現 20 吉瓦算力部署。

SpaceX將獨家採用英偉達AI計算架構,擬部署太空數據中心

SpaceX CEO 馬斯克在公司首次財報電話會上表示,未來 SpaceX 的 AI 服務將“獨家”基於英偉達系統運行。馬斯克稱,公司認爲英偉達 Vera Rubin 架構是“最佳 AI 計算架構”。SpaceX 預計今年年底計算能力將超過 2 吉瓦(GW),並計劃在明年底前提升至接近 10 吉瓦。此外,SpaceX 計劃在地面和太空端部署英偉達 Vera Rubin NVL72 機架級系統,並將其用於“Starmind”衛星項目,相關衛星預計將於明年開始發射。

黃仁勳宣佈英偉達推出Alpamayo 2 Super,加速自動駕駛AI發展

英偉達 CEO 黃仁勳在 X 平臺發文宣佈推出 Alpamayo 2 Super,一款面向自動駕駛領域的前沿開放推理模型(open reasoning model),並稱 AI 下一階段的發展重點將從軟件智能擴展到機器人領域,而自動駕駛車輛將成爲機器人時代的重要入口。黃仁勳表示,Alpamayo 2 Super 不僅能夠“看見”道路環境,還能理解並推理複雜場景,在執行動作前進行思考,可作爲自動駕駛出租車、無人卡車、接駁車、配送車輛、農業機器人以及未來大規模移動機器人系統的核心 AI 模型。據悉,英偉達將該模型以 OpenMDW-1.1 許可證開放用於商業應用,開發者和企業可對模型進行研究、微調和部署。黃仁勳稱,開放模型有助於推動自動駕駛系統的安全性和可靠性提升。

Bitdeer簽署16年AI數據中心租約總收入規模達47億美元

Bitdeer 宣佈,子公司 Tydal Data Center AS 已與 Volta Tydal AS 簽署一項爲期 16 年的數據中心託管及服務協議,將在挪威 Tydal AI/HPC 園區提供 121 MW IT 負載容量(約 133 MW 總功率),全部用於部署 NVIDIA GPU,並服務一家頭部 AI 實驗室。協議基礎期限內預計合同付款總額約爲 47 億美元,並附帶 8 年續約選項,續約後的潛在合同總價值約爲 80 億美元。(Stocktitan)

AI 雲基礎設施公司 Volta Infra Holdings 宣佈完成 3 億美元風險融資,估值達 24 億美元

據 Bloomberg 報道,AI 雲基礎設施公司 Volta Infra Holdings 宣佈完成 3 億美元風險融資,估值達 24 億美元,由 Andreessen Horowitz 與 Altimeter Capital 聯合領投,英偉達、戴爾科技創始人 Michael Dell 參與跟投。此外,Volta 還獲得 50 億美元客戶融資池支持,用於幫助中小 AI 企業降低購買英偉達高端芯片的門檻。 公司同步披露已簽署一份價值 100 億美元、爲期六年的雲計算服務合同,客戶爲一家未具名的頭部 AI 開發商,該合同將與比特礦業(Bitdeer)合作,依託其位於挪威的 133 兆瓦數據中心交付。Volta 由前 Brookfield 資產管理基礎設施業務高管 Ricard Boada 與 Sofia Gumuzio 於今年早些時候聯合創立,目前已鎖定 1 吉瓦數據中心電力資源,並計劃在德克薩斯州與懷俄明州開發新站點,目標於 2030 年前部署多吉瓦級算力容量。

英偉達發佈Vera存儲基準:CRC校驗性能提升3.67倍,多項存儲任務超越x86

英偉達發佈 Vera CPU 存儲基準測試結果,顯示其 NVIDIA BlueField-4 STX 存儲處理器可顯著提升 AI 原生存儲中的加密、壓縮、完整性校驗和數據恢復性能,幫助企業應對 Agentic AI 時代不斷增長的數據處理需求。英偉達表示,隨着 AI Agent 執行知識檢索、調用工具、管理長期記憶以及處理更大上下文窗口,存儲系統不再只是簡單的數據讀寫組件,而成爲 AI 推理流程中的關鍵環節。大量數據需要在存儲路徑中完成加密、壓縮、校驗和恢復,這些任務通常由 CPU 承擔,可能成爲 AI 基礎設施性能瓶頸。基準測試顯示,搭載 Vera CPU 的 BlueField-4 STX 存儲處理器相比對比 x86 CPU,在多項存儲任務中實現性能提升:AES-128 加密性能最高提升 1.43 倍AES-128 解密性能最高提升 1.29 倍Reed-Solomon 數據恢復性能最高提升 3.26 倍CRC32C 完整性校驗性能最高提升 3.67 倍壓縮性能最高提升 3.29 倍解壓縮性能最高提升 1.72 倍壓縮+加密多階段存儲流程性能最高提升 3.21 倍英偉達表示,傳統 CPU 擴展存儲處理能力通常需要增加核心數量、功耗和散熱成本,而 AI 原生存儲需要在更高併發、更大數據量環境下保持低延遲。Vera 通過提升單位 CPU 資源處理能力,幫助存儲系統在不顯著增加基礎設施成本的情況下支持更多 AI Agent 工作負載。

英偉達發佈Video Codec SDK 13.1:引入零拷貝轉碼及精準幀定位能力

英偉達官方發佈 Video Codec SDK 13.1,爲開發者提供多項視頻編解碼升級,包括 AV1 分層參考模式、零拷貝轉碼架構、精準幀級搜索、增強硬件解碼統計以及全新 Docker 開發環境,進一步提升 AI 視頻處理、流媒體和大規模內容分發場景的性能與效率。在解碼能力方面,SDK 13.1 新增 H.264/H.265 每宏塊級解碼統計信息,同時無需額外 CPU 解析開銷。英偉達表示,隨着高質量視頻流媒體、生成式 AI 視頻工具、遠程協作和大規模內容分發需求持續增長,Video Codec SDK 13.1 將幫助開發者構建更高效、更低延遲、更易擴展的視頻處理管線。

HIVE財年收入增長158%至2.98億美元,AI GPU每小時收入約爲挖礦設備24倍

HIVE Executive Chairman Frank Holmes 表示,公司位於 Bell Canada 曼尼託巴 AI fabric 的 504 枚英偉達 B200 GPU 集羣,每 GPU 每小時收入約 2.90 美元;相比之下,HIVE 比特幣挖礦設備每小時收入約 0.12 美元。 HIVE 2026 財年總收入達到 2.98 億美元,同比增長 158%;比特幣挖礦產生的數字貨幣收入增長 164%。同期平均算力爲 22.2 EH/s,同比增長 290%,約佔比特幣全網算力 3%,並挖出 2885 枚 BTC。 HIVE 旗下 BUZZ HPC 部門承載 AI 和高性能計算業務,收入爲 1950 萬美元,較上一財年的 1000 萬美元增長 94%。公司還與 Bell 及 AI 公司 Cohere 簽署約 2.2 億美元 GPU 雲協議,並通過票據發行籌集 7500 萬美元用於 AI 基礎設施擴建。 HIVE 正在大多倫多地區建設一座 320 兆瓦 AI 數據中心,計劃最終容納超過 10 萬枚 GPU。公司表示,該設施若於 2027 年下半年全面上線,年化經常性收入可達到約 3.6 億美元。

Four.Meme支持以bStocks美股代幣作爲發幣底池,首批開放NVDAb

Four.Meme 宣佈上線 Stock Meme 功能,項目方在 Four.Meme 發射代幣時可選擇 bStocks 美股代幣作爲交易底池,首批支持 NVDAb(英偉達),後續將陸續開放更多美股標的。該功能由 Four.Meme、bStocks 與 Binance Wallet 在 BNB Chain 生態支持下共同推出,爲 BNB Chain 首批官方支持的美股底池之一。Four.Meme 將與 bStocks 協作,爲平臺上每個 bStocks 底池提供流動性支持。此外,部分 Stock Meme 有機會被收錄至 Binance Wallet 美股 Meme 專區。

Bitget 美股代幣(rToken) 已上線 rJMKE

據官方公告,爲滿足用戶多元化投資需求,Bitget 美股代幣 rToken 已上線 rJMKE(Jersey Mike’s Subs)。截至目前,Bitget 平臺共支持 608 只美股代幣。 據悉,以字母 r + 股票代碼(如英偉達爲 rNVDA)爲標識的 rToken,由 Bitget 旗下持牌 RWA 協議 Reality 發行,通過與合規券商 Alpaca 合作直連納斯達克、紐交所等全球流動性池。其特點包括:底層資產 1:1 儲備並由持牌託管機構託管、股票股息以代幣形式 1:1 派發、支持公司行爲(拆合股等)同步映射,且持倉可作爲統一賬戶及 U 本位合約的聯合保證金,讓用戶在持有全球股票資產的同時,仍能靈活管理資金。

大摩:AI 基建 ROIC 最高可達 46%,超大規模廠商維持超配評級

據潮向研究,摩根士丹利 7月 27 日發佈研報,首次量化生成式 AI 投資的增量資本回報率(ROIC)。報告構建三套測算框架,超大規模雲服務商 GPU 租賃業務 ROIC 約31%,自有基礎設施模型 API 業務 ROIC 約46%,第三方算力 API 業務 ROIC 約25%。基準假設下,單個 1 吉瓦(GW)數據中心配置約 41 萬塊英偉達 GB300 GPU,利用率 75%,每小時租賃價格 8.5 美元。三大雲巨頭合計資本支出預計超 1.4 萬億美元。 大摩對微軟、亞馬遜、Meta、谷歌全部維持超配評級。報告指出,隨着 AI 從訓練階段進入推理階段,GPU 算力需求將持續增長。自建算力廠商憑藉算力緊缺生態下的定價權,將獲得可觀利潤。如果大摩的測算成立,這幾千億美元的 AI 資本開支將從“成本”認知切換爲“增長資產”認知。