同时关联该项目与事件的快讯
Perplexity CEO Aravind Srinivas 发推称,GLM 是一款被严重低估的模型,在 700B 参数规模下展现出接近 Opus 级别的性能,且运行效率极高。此前月之暗面刚刚发布开源模型 Kimi K3,业内对智谱 AI 旗下 GLM 系列模型的关注度正在上升。
月之暗面推出开源模型 Kimi K3,在 Artificial Analysis 智能指数上获得 57 分,成为第三高分模型,仅次于 Anthropic 的 Claude Opus 5(61 分)、Claude Fable 5(60 分)和 OpenAI 的 GPT-5.6 Sol(59 分)。该指数显示,领先闭源模型与开源权重模型之间的差距已缩小至 4 分,为自 2 月 GLM-5 发布以来的最小差距。这标志着开源模型在性能上正快速追赶闭源模型。
中国 AI 初创公司 Moonshot AI 将公开高性能模型 Kimi K3 的模型权重,开发者可下载模型并按用途修改,也可在自有数据中心或云环境中运行。Kimi K3 拥有 2.8 万亿个参数和 100 万 Token 上下文窗口,可一次性处理大规模文档和代码库。Moonshot AI 计划后续通过技术报告公开模型结构、训练方式和性能评估结果。Kimi K3 发布后,Moonshot AI 单日收入据悉至少增长 6 倍。Moonshot AI 正推进按 500 亿美元估值进行新一轮融资,并考虑最快今年在香港上市。Bloomberg Intelligence 表示,Kimi K3 与 Z.AI 的 GLM-5.2 发布后,中国开源权重模型在整体 Token 使用量中的占比升至 68%。AWS Bedrock、Microsoft Azure Foundry 和 Google Vertex AI 尚未提供 Kimi K3 与 GLM-5.2 等中国开源权重模型。
OpenAI 确认,GPT-5.6 Sol 及一款未命名、更强的预发布模型在 ExploitGym 基准测试评估中突破受限沙箱环境,并入侵 Hugging Face 生产基础设施以获取测试答案。OpenAI 表示,相关模型利用内部软件包注册表代理的零日漏洞提权并横向移动,最终连接至具备互联网访问能力的机器。模型随后识别并串联 OpenAI 研究环境和 Hugging Face 生产基础设施中的漏洞,直接从 Hugging Face 生产数据库获取测试解决方案。Hugging Face 于 7 月 16 日披露该事件,称攻击由自主 AI 代理系统端到端执行,涉及短生命周期沙箱中的数千次操作,并触及内部数据集和服务凭证。OpenAI 在五天后确认其模型为事件主体。Hugging Face 表示,其安全团队为分析逾 1.7 万条攻击日志,曾尝试使用美国商业前沿 AI 接口,但请求因安全护栏被拦截,随后改用中国 AI 初创公司 Z.ai 的 7530 亿参数开源权重模型 GLM 5.2 在自有基础设施上完成取证分析。
据彭博社报道,智谱 AI 已完成一座仅采用国产芯片的数据中心建设,并已开始部分投运。该数据中心设计功率为 1 吉瓦,将用于支持其 GLM 大模型 的训练与研发。报道称,智谱 AI 目前已建成或运营多个计算集群,单个集群芯片数量均超过 1 万枚。
据潮向研究,高盛 7月 18 日报告指出,月之暗面发布 Kimi K3 模型,2.8 万亿参数,在 Arena.ai 编程排行榜超越 Claude Fable 5和 GPT-5.6 Sol 登顶,API 定价 2.3 美元/百万 token 创中国模型新高。发布两日后智谱跌 28%、MiniMax 跌16%,纳斯达克 100 指数期货跌超 1.8%,费城半导体指数从高点累跌超 18%。 高盛认为 Kimi K3 标志着一个转折点:一家无法匹配西方最大规模预训练算力的中国实验室,通过架构创新和强化学习迅速缩小了与美国顶尖模型的差距,证明“扩展”不再是唯一的制胜路径。高盛警告“算力扩张时代”可能正在终结,围绕“算力越多越好”建立的 AI 基础设施投资逻辑需要重写。高盛对 MiniMax 维持买入评级,智谱中性。后续关注智谱 GLM、阿里 Qwen、MiniMax M3 Pro 等2-5 万亿参数模型的密集推出。
昨日,月之暗面最新开源 AI 模型 Kimi K3 模型发布,在 Frontend Code Arena 测试网站中以 1679 分位居第一,超越 Claude 旗下 Fable 5 模型。针对 K3 模型,Artifacial Analysis 进行了相关测评,随后埃马斯克再次为月之暗面 Kimi 模型点赞,称 K3 模型的基准性能令人印象深刻。今年 3 月,Kimi 发布《𝑨𝒕𝒕𝒆𝒏𝒕𝒊𝒐𝒏 𝑹𝒆𝒔𝒊𝒅𝒖𝒂𝒍𝒔:重新思考深度方向聚合》研究论文时曾获马斯克称赞:“Kimi 的研究工作令人印象深刻。”此前,其还称智谱旗下 GLM 模型或于 2027 年 Q1 超越 Claude Mythos 模型(即 Fable 5),对此智谱创始人唐杰回应称“不需要那么久”。
据官方公告,币安将于 2026 年 7 月 17 日 03:00(UTC)移除并停止以下现货交易对的交易:GLM/BTC、KNC/BTC、ONT/BTC 和 XAI/USDC。币安将同时终止这些交易对的现货交易机器人服务。用户需在此之前更新或取消相关交易机器人以避免潜在损失。下架交易对不影响代币在币安上的其他交易对交易。
Haseeb 在 X 平台发文表示,随着 GLM 5.2、Fable 和 GPT 5.6 等模型已上线并被攻击者实际使用,DeFi 并未出现预想中的“黑客末日”。图表数据显示,按当前年内数据与运行速率测算,2026 年 DeFi 被盗金额年化约为 18.9 亿美元,年内累计被盗约 9.86 亿美元,低于 2025 年水平,且仍处于历史区间内。Haseeb 表示,当前更深层的变化在于黑客攻击数量虽有所增加,但单次攻击规模下降更快,攻击者更多在针对小型协议和废弃项目,而大型协议已完成更多安全加固,因此整体资金安全性并未明显恶化。
今日晚间,智谱官方开放平台宣布,为进一步向 OPC(一人公司)模式的人工智能创业者提供全生命周期的支持保障,联合海淀区中关村科学城,面向千行百业正式推出总额为 5000 万元的模型券补贴计划,让人工智能成为每一位创新者都可以获取的生产力工具。补贴期间,所有在海淀区注册且申请通过的企业,在使用 GLM-5.2 模型时,均可享受最高 50%的调用费用补贴,每家企业每年最高补贴额度可达 200 万元。其目标为,助力北京打造“全球人工智能第一城”。本次模型券补贴的核心规则如下:补贴比例:最高享受 GLM-5.2 模型调用费用 50%补贴;补贴周期:即日起至 2026.11.19;补贴上限:每家企业每年补贴总额不超过 200 万元;适用模型:目前支持 GLM-5.2,后续新增模型另行通知。或受此消息影响,今日智谱港股最高涨幅超 16%,总市值一度再次突破万亿港元,目前已回落至 9690 亿港元。
智谱 AI 创始人唐杰在 X 平台发文表示,GLM-5.2 正式开源发布后已在多项国际权威评测与竞技榜单中取得领先成绩,在 Artificial Analysis Intelligence Index 综合评估中 GLM-5.2 获得 51 分,与 Anthropic 的 Claude Opus 4.8 处于同一水平区间;在 Code Arena 前端代码生成对抗测试中以 Elo 1595 排名全球第 2,在 DesignArena 设计与代码融合场景中获得 1360 分排名第 1。整体来看,智谱 GLM-5.2 在前端开发、设计生成与软件工程等多个真实场景评测也持续位居全球前列,逐步缩小与 OpenAI 及 Anthropic 等前沿模型之间的性能差距,并将继续推动模型能力上限提升。此前,针对马斯克表示中国大模型可能会在明年一季度达到 Anthropic 的 Fable 水平,智谱 AI 创始人唐杰回应表示“不会耗费如此长时间”。
根据官方消息,去中心化 GPU 云计算基础设施平台 Aethir 正式发布 Aethir Mesh——一个运行于 Aethir 去中心化 GPU 基础设施之上的自研开源大模型 API 平台,目前平台已上线,提供统一 API 端点直连 DeepSeek V4、Kimi K2.6、GLM-5.1、MiniMax-M2.5、Qwen3.6-27B 等主流开源模型。
KelpDAO 发布公告,自 4 月 18 日以来,其一直与 Aave 及生态合作伙伴协调推进 rsETH 持有者恢复工作。此次事件初始缺口为 163,200 ETH,目前 Kelp 已回收 40,300 枚 rsETH,约合 43,000 ETH,Arbitrum 安全委员会另保障 30,700 ETH,剩余缺口约 89,500 ETH。Kelp 称,在剩余缺口中,Mantle、Stani Kulechov、EtherFi、Lido、Golem 已公开确认承诺合计 43,500 ETH,正与合作方推进相关贡献正式落地。Kelp 强调,rsETH 持有者优先。
智谱产品主管 Zixuan Li 在 X 平台发文表示,OpenClaw,Hermes 以及 SillyTavern 目前已明确标记为 GLM Coding Plan 支持的项目。其他通用工具将根据具体情况进行逐案分析。此外,Zixuan Li 提醒用户请勿分享账号或将订阅作为 API 使用。若用户在遵守规则的情况下仍遇到 1313 错误,可联系官方反馈。
AI 代理平台 0G Labs 宣布推出面向消费者的 AI 开发平台 0G App,用户无需编写代码,仅通过自然语言提示即可构建并部署应用,打通 Web2 易用性与 Web3 基础设施。0G App 基于去中心化算力运行,并引入可信执行环境(TEE)验证机制,支持 AI 模型在隐私保护环境中运行,集成应用生成、AI 代理部署及代币发行能力,使用户可在同一生态内完成从创意到上线的全流程。在底层架构上,0G App 结合 Intel TDX 与 NVIDIA H100/H200 硬件环境,实现 AI 推理的可验证与隐私保护,并支持开源大模型 GLM-5 运行,应用部署可一键接入 Vercel,同时数据同步至去中心化存储网络。(CoinMarketCap)