GetChain News
中简 中繁 EN
GetChain News
Toggle sidebar

上线/更新

同时关联该项目与事件的快讯

英伟达推出NeMo Switchyard,利用AI模型路由技术降低智能体运行成本

英伟达(NVIDIA)推出 AI 模型路由系统 NeMo Switchyard,旨在帮助开发者在多个大模型之间动态分配 AI 智能体(AI Agent)任务,在保证性能的同时降低成本和延迟。英伟达表示,构建 AI 智能体并不意味着必须依赖单一大模型。不同模型在推理能力、响应速度和运行成本方面各有优势,例如分类任务可能适合轻量模型,复杂推理则需要更强大的前沿模型。如果所有请求都发送至最大规模模型,将导致成本和延迟增加;而全部使用小模型则可能降低复杂任务完成质量。NeMo Switchyard 通过智能路由机制,根据任务需求、模型能力、成本、延迟以及系统状态等因素,在多个专用模型和前沿模型之间自动选择最合适的执行模型。该系统支持开发者在不改变应用架构的情况下切换不同模型供应商和模型版本。英伟达介绍,NeMo Switchyard 提供多种路由策略,包括无需训练的 LLM 分类器路由、阶段路由(Stage Router)、升级路由(Escalation Router),以及基于真实工作负载数据训练的可调节路由模型。其中,升级路由会优先将任务分配给低成本模型,并在检测到任务复杂度提升、持续错误或执行停滞时,将请求升级至更强模型,从而实现性能与成本之间的平衡。英伟达表示,在相关测试中,NeMo Switchyard 通过在不同模型之间分配任务,在保持较高任务完成率的同时显著降低 AI Agent 运行成本。例如,与仅使用前沿模型相比,基于升级路由的方案在 LangChain 多轮智能体测试中降低约 74%的成本,仅有 7%的请求需要调用前沿模型。此外,英伟达已与 Cognition、Nous Research、Ramp、LangChain、LiteLLM、Kong 等企业合作,将 NeMo Switchyard 集成至 AI Agent 开发流程和企业应用基础设施中。

Naver D2SF 完成对物理 AI 数据初创公司 NdotLight 第三轮跟投

据韩联社报道,Naver D2SF 宣布对物理 AI 数据初创公司 NdotLight(엔닷라이트)完成后续投资,本轮融资由韩国产业银行主导,总规模达 150 亿韩元。这也是 Naver D2SF 继 2021 年 Pre-A 轮及 2022 年 A 轮之后对该公司的第三次投资。NdotLight 自主研发了 3D 数据生成解决方案 TRINIX,可自动化生成包含物理属性(质量、摩擦力)、关节结构及碰撞范围信息的高精度 3D 数据,并与英伟达仿真平台 Omniverse 深度集成,实现大规模高质量 3D 仿真数据集的批量供应。

英伟达联手六大华尔街机构组建 5000 亿美元 AI 基础设施融资平台

据 CNBC 报道,英伟达与阿波罗全球管理、黑石、贝莱德、Brookfield 资产管理、高盛及 KKR 签署谅解备忘录,共同为英伟达客户建立融资平台,目标动员逾 5000 亿美元第三方资本,用于超大规模数据中心建设及英伟达硬件采购。 英伟达 CEO 黄仁勋将此定性为 AI 芯片首次成为"可投资资产类别",称其具备创收能力、使用寿命长、可跨客户流转,并将算力基础设施类比于电力和互联网。贝莱德 CEO 拉里·芬克将该项目定义为继 1970 年代抵押贷款证券化之后"金融工程的下一个未来",并表示将尽快募集更多资金。高盛 CEO 大卫·所罗门透露,此次合作由黄仁勋主动发起。目前部分资金已完成募集,各方将通过机构信贷、保险资金及私人资本为 GPU 和数据中心提供融资支持,帮助终端用户在不动用自身资产负债表的前提下完成 AI 基础设施建设。

英伟达拟投资 30 亿美元于 Lancium,支撑「星际之门」数据中心项目

英伟达拟向电力基础设施开发商 Lancium 投资至多 30 亿美元,其中先期投入 20 亿美元以获取约 20% 股权,后续若达成电网并网等指标可追加 10 亿美元。Lancium 由黑石集团支持,其位于得州阿比林的「清洁园区」是英伟达「星际之门」 AI 超算数据中心项目首期所在地。公司当前估值约 100 亿美元,并评估 2027 年 IPO。

Cathie Wood旗下基金减持约1700万美元Palantir股票

根据 Ark Invest 最新披露的交易数据,Cathie Wood 旗下基金于 8 月 4 日和 5 日合计卖出 109,492 股 Palantir(PLTR),按最新收盘价计算价值约 1700 万美元。Palantir 此前公布的第二季度营收同比增长 93% 至 19.4 亿美元,并上调全年业绩指引,推动股价在财报发布后单日上涨近 30%。此外,Cathie Wood 近期还增持了 Circle(CRCL)、SpaceX(SPCX)及英伟达(NVDA)等股票,同时减持 Shopify(SHOP)和 Roblox(RBLX)。(The Street)

Firmus 以逾 105 亿美元估值完成 20 亿美元融资,英伟达、Coatue 等参投

据路透社报道,澳大利亚人工智能基础设施公司 Firmus 完成 20 亿美元股权融资,投后估值升至逾 105 亿美元,较 4 月上一轮融资时的 55 亿美元接近翻倍。本轮融资由英伟达、Coatue Management 继续参与,Blackstone 旗下基金及 Jane Street 亦提供支持。

英伟达考虑调降 Rubin Ultra GPU 配置,应对 HBM 内存短缺

英伟达为应对 HBM 内存供应短缺,考虑降低新一代 Rubin Ultra GPU 的配置。据 The Information 援引知情人士消息,英伟达内部在过去数周至少测试了 3 种低 HBM 配置的 Rubin Ultra GPU,所需 HBM 容量低于最初公布规格。可能的降级路径包括从 HBM4E 下调至 HBM4、从 12Hi HBM 下调至 8Hi HBM。此举旨在在供应约束下推进产品发布计划。

深圳佳贤通信独家回应:英伟达AI-RAN技术团队曾到访公司,双方已成立技术工作组

佳贤通信相关人士就通宇通讯发布的澄清公告回应,2026 年 3 月,英伟达 AI-RAN 技术团队曾到访佳贤通信,双方围绕 AI-RAN 技术路线进行交流。交流期间,英伟达方面向佳贤通信推荐使用 CUDAAerial 开源平台开展 AI-RAN 基站系统研发。此后,佳贤通信启动了基于 CUDAAerial 生态的 AI 原生 5G 及 6G 基站技术预研与验证,相关工作已持续推进近半年。上述人士表示,目前双方已组建常态化技术工作组,围绕相关技术研发与验证保持沟通。英伟达方面有十余名来自中国内地、中国香港及新加坡等地区的技术人员参与该工作组。(界面)

AI研究公司Mirendil与谷歌云达成超1亿美元算力协议

AI 研究初创公司 Mirendil 已与 Google Cloud 达成多年期合作协议,将获得大规模计算资源支持其“自我改进型 AI”(Self-Improving AI)研发。根据协议,Mirendil 将获得谷歌云提供的 TPU 和英伟达 GPU 算力资源,以及托管式 AI 训练集群,用于开发能够持续优化自身能力的 AI 系统。据悉,Mirendil 致力于研发“递归自我改进”(Recursive Self-Improvement)AI,即 AI 系统能够通过不断迭代、自我学习和优化,提高自身性能。该方向也是当前部分顶级 AI 实验室关注的研究领域。Mirendil 联合创始人兼 CEO Benham Neyshabur 透露,该协议总价值超过 1 亿美元,约相当于公司 6 月底完成的 10 亿美元估值种子轮融资金额的一半。(TechCrunch)

马斯克:SpaceX 凭借火箭科学家的工程优势,将在 AI 算力竞赛中占据压倒性地位

据《财富》杂志报道,马斯克在 SpaceX 首次上市后的财报电话会议上表示,SpaceX 凭借火箭科学家的工程优势,将在 AI 算力竞赛中占据压倒性地位,并将其比作"纽约洋基队对阵小联盟球队"。SpaceX 二季度 AI 营收达 26 亿美元,环比增长 213%,资本支出达 184 亿美元。公司已签署 141 亿美元云服务合同,客户包括 Anthropic 和谷歌,并宣布将全面采用英伟达 Vera Rubin 架构,目标于 2027 年底实现 20 吉瓦算力部署。

SpaceX将独家采用英伟达AI计算架构,拟部署太空数据中心

SpaceX CEO 马斯克在公司首次财报电话会上表示,未来 SpaceX 的 AI 服务将“独家”基于英伟达系统运行。马斯克称,公司认为英伟达 Vera Rubin 架构是“最佳 AI 计算架构”。SpaceX 预计今年年底计算能力将超过 2 吉瓦(GW),并计划在明年底前提升至接近 10 吉瓦。此外,SpaceX 计划在地面和太空端部署英伟达 Vera Rubin NVL72 机架级系统,并将其用于“Starmind”卫星项目,相关卫星预计将于明年开始发射。

黄仁勋宣布英伟达推出Alpamayo 2 Super,加速自动驾驶AI发展

英伟达 CEO 黄仁勋在 X 平台发文宣布推出 Alpamayo 2 Super,一款面向自动驾驶领域的前沿开放推理模型(open reasoning model),并称 AI 下一阶段的发展重点将从软件智能扩展到机器人领域,而自动驾驶车辆将成为机器人时代的重要入口。黄仁勋表示,Alpamayo 2 Super 不仅能够“看见”道路环境,还能理解并推理复杂场景,在执行动作前进行思考,可作为自动驾驶出租车、无人卡车、接驳车、配送车辆、农业机器人以及未来大规模移动机器人系统的核心 AI 模型。据悉,英伟达将该模型以 OpenMDW-1.1 许可证开放用于商业应用,开发者和企业可对模型进行研究、微调和部署。黄仁勋称,开放模型有助于推动自动驾驶系统的安全性和可靠性提升。

Bitdeer签署16年AI数据中心租约总收入规模达47亿美元

Bitdeer 宣布,子公司 Tydal Data Center AS 已与 Volta Tydal AS 签署一项为期 16 年的数据中心托管及服务协议,将在挪威 Tydal AI/HPC 园区提供 121 MW IT 负载容量(约 133 MW 总功率),全部用于部署 NVIDIA GPU,并服务一家头部 AI 实验室。协议基础期限内预计合同付款总额约为 47 亿美元,并附带 8 年续约选项,续约后的潜在合同总价值约为 80 亿美元。(Stocktitan)

AI 云基础设施公司 Volta Infra Holdings 宣布完成 3 亿美元风险融资,估值达 24 亿美元

据 Bloomberg 报道,AI 云基础设施公司 Volta Infra Holdings 宣布完成 3 亿美元风险融资,估值达 24 亿美元,由 Andreessen Horowitz 与 Altimeter Capital 联合领投,英伟达、戴尔科技创始人 Michael Dell 参与跟投。此外,Volta 还获得 50 亿美元客户融资池支持,用于帮助中小 AI 企业降低购买英伟达高端芯片的门槛。 公司同步披露已签署一份价值 100 亿美元、为期六年的云计算服务合同,客户为一家未具名的头部 AI 开发商,该合同将与比特矿业(Bitdeer)合作,依托其位于挪威的 133 兆瓦数据中心交付。Volta 由前 Brookfield 资产管理基础设施业务高管 Ricard Boada 与 Sofia Gumuzio 于今年早些时候联合创立,目前已锁定 1 吉瓦数据中心电力资源,并计划在德克萨斯州与怀俄明州开发新站点,目标于 2030 年前部署多吉瓦级算力容量。

英伟达发布Vera存储基准:CRC校验性能提升3.67倍,多项存储任务超越x86

英伟达发布 Vera CPU 存储基准测试结果,显示其 NVIDIA BlueField-4 STX 存储处理器可显著提升 AI 原生存储中的加密、压缩、完整性校验和数据恢复性能,帮助企业应对 Agentic AI 时代不断增长的数据处理需求。英伟达表示,随着 AI Agent 执行知识检索、调用工具、管理长期记忆以及处理更大上下文窗口,存储系统不再只是简单的数据读写组件,而成为 AI 推理流程中的关键环节。大量数据需要在存储路径中完成加密、压缩、校验和恢复,这些任务通常由 CPU 承担,可能成为 AI 基础设施性能瓶颈。基准测试显示,搭载 Vera CPU 的 BlueField-4 STX 存储处理器相比对比 x86 CPU,在多项存储任务中实现性能提升:AES-128 加密性能最高提升 1.43 倍AES-128 解密性能最高提升 1.29 倍Reed-Solomon 数据恢复性能最高提升 3.26 倍CRC32C 完整性校验性能最高提升 3.67 倍压缩性能最高提升 3.29 倍解压缩性能最高提升 1.72 倍压缩+加密多阶段存储流程性能最高提升 3.21 倍英伟达表示,传统 CPU 扩展存储处理能力通常需要增加核心数量、功耗和散热成本,而 AI 原生存储需要在更高并发、更大数据量环境下保持低延迟。Vera 通过提升单位 CPU 资源处理能力,帮助存储系统在不显著增加基础设施成本的情况下支持更多 AI Agent 工作负载。

英伟达发布Video Codec SDK 13.1:引入零拷贝转码及精准帧定位能力

英伟达官方发布 Video Codec SDK 13.1,为开发者提供多项视频编解码升级,包括 AV1 分层参考模式、零拷贝转码架构、精准帧级搜索、增强硬件解码统计以及全新 Docker 开发环境,进一步提升 AI 视频处理、流媒体和大规模内容分发场景的性能与效率。在解码能力方面,SDK 13.1 新增 H.264/H.265 每宏块级解码统计信息,同时无需额外 CPU 解析开销。英伟达表示,随着高质量视频流媒体、生成式 AI 视频工具、远程协作和大规模内容分发需求持续增长,Video Codec SDK 13.1 将帮助开发者构建更高效、更低延迟、更易扩展的视频处理管线。

HIVE财年收入增长158%至2.98亿美元,AI GPU每小时收入约为挖矿设备24倍

HIVE Executive Chairman Frank Holmes 表示,公司位于 Bell Canada 曼尼托巴 AI fabric 的 504 枚英伟达 B200 GPU 集群,每 GPU 每小时收入约 2.90 美元;相比之下,HIVE 比特币挖矿设备每小时收入约 0.12 美元。 HIVE 2026 财年总收入达到 2.98 亿美元,同比增长 158%;比特币挖矿产生的数字货币收入增长 164%。同期平均算力为 22.2 EH/s,同比增长 290%,约占比特币全网算力 3%,并挖出 2885 枚 BTC。 HIVE 旗下 BUZZ HPC 部门承载 AI 和高性能计算业务,收入为 1950 万美元,较上一财年的 1000 万美元增长 94%。公司还与 Bell 及 AI 公司 Cohere 签署约 2.2 亿美元 GPU 云协议,并通过票据发行筹集 7500 万美元用于 AI 基础设施扩建。 HIVE 正在大多伦多地区建设一座 320 兆瓦 AI 数据中心,计划最终容纳超过 10 万枚 GPU。公司表示,该设施若于 2027 年下半年全面上线,年化经常性收入可达到约 3.6 亿美元。

Four.Meme支持以bStocks美股代币作为发币底池,首批开放NVDAb

Four.Meme 宣布上线 Stock Meme 功能,项目方在 Four.Meme 发射代币时可选择 bStocks 美股代币作为交易底池,首批支持 NVDAb(英伟达),后续将陆续开放更多美股标的。该功能由 Four.Meme、bStocks 与 Binance Wallet 在 BNB Chain 生态支持下共同推出,为 BNB Chain 首批官方支持的美股底池之一。Four.Meme 将与 bStocks 协作,为平台上每个 bStocks 底池提供流动性支持。此外,部分 Stock Meme 有机会被收录至 Binance Wallet 美股 Meme 专区。

Bitget 美股代币(rToken) 已上线 rJMKE

据官方公告,为满足用户多元化投资需求,Bitget 美股代币 rToken 已上线 rJMKE(Jersey Mike’s Subs)。截至目前,Bitget 平台共支持 608 只美股代币。 据悉,以字母 r + 股票代码(如英伟达为 rNVDA)为标识的 rToken,由 Bitget 旗下持牌 RWA 协议 Reality 发行,通过与合规券商 Alpaca 合作直连纳斯达克、纽交所等全球流动性池。其特点包括:底层资产 1:1 储备并由持牌托管机构托管、股票股息以代币形式 1:1 派发、支持公司行为(拆合股等)同步映射,且持仓可作为统一账户及 U 本位合约的联合保证金,让用户在持有全球股票资产的同时,仍能灵活管理资金。

大摩:AI 基建 ROIC 最高可达 46%,超大规模厂商维持超配评级

据潮向研究,摩根士丹利 7月 27 日发布研报,首次量化生成式 AI 投资的增量资本回报率(ROIC)。报告构建三套测算框架,超大规模云服务商 GPU 租赁业务 ROIC 约31%,自有基础设施模型 API 业务 ROIC 约46%,第三方算力 API 业务 ROIC 约25%。基准假设下,单个 1 吉瓦(GW)数据中心配置约 41 万块英伟达 GB300 GPU,利用率 75%,每小时租赁价格 8.5 美元。三大云巨头合计资本支出预计超 1.4 万亿美元。 大摩对微软、亚马逊、Meta、谷歌全部维持超配评级。报告指出,随着 AI 从训练阶段进入推理阶段,GPU 算力需求将持续增长。自建算力厂商凭借算力紧缺生态下的定价权,将获得可观利润。如果大摩的测算成立,这几千亿美元的 AI 资本开支将从“成本”认知切换为“增长资产”认知。