同时关联该项目与事件的快讯
B.AI 宣布热门模型新一轮权益正式生效:高并发主力模型 DeepSeek-V4.1-Flash 与 GLM-5.3-Flash 专属 1 折调用权益全面上线,用户仅需支付原价的 10% 即可调用,以极致性价比承接高吞吐场景需求;同时,Qwen3.8-Flash、Hy3 及 MiMo-V2.5 继续开启全额免费调用,为开发者提供更丰富的零成本选择。此次权益调整以极致性价比承接高吞吐需求,用多模型矩阵降低开发者的探索门槛。B.AI 持续以多模型矩阵和普惠定价,助力开发者打造低成本 AI 基础设施,告别高昂算力成本,全速推进创新落地。
智谱官方 GLM-5.3-Flash 调价在即。为给全球开发者提供更充足的缓冲期,B.AI 宣布限时延长免费权益——即日起至 9 月 12 日 09:59(SGT),GLM-5.3-Flash 在 B.AI 平台仍保持全量免费调用。作为平台调用量领先的热门模型,GLM-5.3-Flash 拥有 320B 总参数与 18B 激活参数,支持 1M 超长上下文,兼顾极速响应与强大推理能力,是高频代码编写、海量数据处理与复杂 Agent 工作流的性价比之选。此外,Qwen3.8 Flash、Hy3、MiMo V2.5 等热门模型在 B.AI 平台依然 100% 免费开放。B.AI 将持续以普惠算力支持全球开发者,让前沿模型能力真正触手可及。
OpenAI CFO Sarah Friar 表示,公司正加速将 AI 拓展至芯片设计、生命科学和金融服务等专业领域,并尝试按照业务成果而非使用量进行定价。OpenAI 企业业务收入从今年 6 月至 7 月增长 32%,同期公司整体年化收入增长约 20%;截至年中,企业与消费者业务收入占比已大致各占一半。此外,OpenAI 近期将低成本 Luna 模型价格下调 80%,随后使用量增长约 10 倍。Friar 称,在云端部署场景下,Luna 的成本甚至低于 Z.ai 的 GLM 5.3。OpenAI 编程工具 Codex 用户数目前已达 2500 万。公司还利用自有 AI 模型辅助开发 Jalapeno 芯片,并在 9 个月内完成芯片设计流片。(路透社)
B.AI 宣布 GLM-5.3-Flash 将在智谱官方限时 5 折优惠于 9 月 9 日 24:00 截止后,继续为全球开发者提供 0 成本调用支持,无需因上游价格调整而改变使用习惯。
GLM-5.3-Flash 牛来模型已成为 B.AI 平台当前调用量最高、最受欢迎的模型,累计 Token 吞吐量突破 2.41 万亿。作为 GLM-5 系列首款原生全模态模型,GLM-5.3-Flash 拥有 320B 总参数与 18B 激活参数,采用稀疏与线性注意力相结合的混合架构,支持 1M 超长上下文,兼顾极速响应、强大推理与高性价比。即日起,开发者仍可通过 B.AI 平台免费调用该模型,覆盖高频 API、代码编写、复杂 Agent 及超长文档处理等多元场景。立即体验:chat.b.ai/chat
AI Agent 基础设施平台 B.AI 宣布,自免费活动上线以来,平台累计 Token 吞吐量已突破 10.9 万亿,累计 API 调用量达 8,956 万次,累计吸引超 23.9 万新注册用户(含 23.5 万+API 开发者)。平台底座在海量高并发与重度 Agent 工作流考验中持续验证了稳定性与承载力。模型阵容方面,GLM-5.3-Flash(Ox Alpha)、Qwen3.8-Flash、Tencent Hy3、Xiaomi MiMo-V2.5 继续全量免费开放,DeepSeek-V4-Flash及 Vision-Exp 版本则开启 5 折半价优惠,兼顾零门槛体验与极致性价比。未来,B.AI 将持续为开发者与企业团队提供更高效、更稳定、更实惠的 AI 算力服务,助力 AI 应用加速落地,欢迎登录 chat.b.ai/chat 即刻部署高效工作流。
8 月 31 日,B.AI 平台前沿大模型全量免费开放活动持续高热运行,全平台累计 Token 吞吐量已正式突破 5.74 万亿(5T+)历史大关,在海量高并发请求与重度 Agent 任务的严苛考验下,B.AI 工业级底座展现出极稳承载能力。目前平台已集结 GLM-5.3-Flash(Ox Alpha)、Qwen3.8-Flash、DeepSeek-V4-Flash、DeepSeek-V4-Flash-Vision-Exp、Tencent Hy3 及 Xiaomi MiMo-V2.5 等六大顶尖模型,全部面向用户零门槛无限量免费开放,覆盖代码生成、超长文本处理、多模态视觉理解、Agent 工作流部署等多元场景。即日起登录 B.AI 平台,即可零成本调用全系前沿模型,无限算力无缝接入,让每一位开发者与 AI 深度用户畅享真正的“算力自由”。
一站式 AGI 基础设施平台 B.AI 宣布智谱 GLM-5.3-Flash(320B-A18B)正式登陆平台,并在 API 官方组全量免费开放。作为 GLM-5 系列首款原生全模态模型,GLM-5.3-Flash 拥有 320B 总参数与 18B 激活参数,由纯国产 AI 芯片提供算力支持,首次引入稀疏与线性注意力混合架构,配合 1M 超长上下文,兼具强悍性能与极致性价比,是当前国产模型中的实力派选手。即日起,开发者可通过 B.AI API 官方组零成本调用这款硬核神器,轻松驾驭复杂推理、长文本处理与多模态任务。B.AI 持续以普惠算力降低 AI 应用门槛,让更多开发者用上顶尖国产模型。
智谱宣布上线并开源 GLM-5.3-Flash 模型。美国 7 月 PCE 物价指数年率达 3.7% 超预期,美联储加息预期升温;英伟达披露 2028 财年 70% 增速指引,提振盘后股价。
Z.ai 发布 GLM-5.3-Flash,称其为 GLM-5 系列首个原生多模态模型。该模型拥有 3200 亿总参数、180 亿激活参数,在多项编码、智能体和视觉基准测试中超过 GLM-5.2,并在部分编码任务上接近 Claude Opus 4.8。GLM-5.3-Flash 采用稀疏注意力与线性注意力结合的混合架构,并引入 mHC 与 IndexPool 等机制,以降低长上下文推理成本和 KV 缓存开销。
据彭博社报道,中国人工智能公司 Z.AI(智谱) 周三确认,近期在在线使用榜单中迅速升至前列的神秘人工智能模型 Ox Alpha,是其 GLM 系列 的新迭代版本。该公司在回应彭博新闻查询时表示,将于今晚发布 Ox Alpha 的模型权重。
Z.ai 发布 GLM-5.3,基于与 GLM-5.2 相同的基础模型,通过扩大后训练实现能力提升。官方称,GLM-5.3 在内部 Z.ai Code Bench 编码基准上较 GLM-5.2 提升 50%,并在 Terminal Bench 3.0、Agents’ Last Exam 等公开基准中达到开放模型领先水平。网络安全方面,GLM-5.3 在 CyberGym 漏洞发现测试中取得 84.5% 成绩,并在 ExploitBench、ExploitGym 等利用链相关测试中较前代显著提升。
Z.ai 发文预告 GLM-5.3 即将推出,该模型聚焦编程能力,并面向网络防御挑战。官方称,GLM-5.3 通过对 743B 基础模型进行后训练,实现了顶尖的编程和智能代理能力,并在网络安全领域取得重要进展,为开源模型树立新标准。
B.AI 平台现面向所有用户推出 GLM-5.2 模型限时 6 折优惠。活动期间,无论通过 API 进行工程化部署,还是在 Web 端进行日常交互,全量调用均可享受 6 折结算价。折扣后价格分别为:输入 0.84、缓存写入 0.84、缓存读取 0.168、输出 2.64(单位:Credits/Token)。GLM-5.2 作为新一代开源旗舰模型,拥有 1M 超长上下文窗口,专为大规模代码开发、复杂推理及智能体任务等高性能场景设计。用户可通过官方 API 标准通道或网页端直接使用,全场景工作流实现无缝衔接。此次活动旨在以更低成本释放顶级 AI 生产力,即日起用户可登录 B.AI 平台体验。
AI 个人助理初创公司 Pally 宣布完成 520 万美元融资,Cyber Fund 和 Y Combinator 领投,Pioneer Fund、Founders Inc、468 Capital 及天使投资人等参投。公司估值为 3000 万美元,主要业务为通过短信入口提供 AI 个人助理服务。 Pally 于 2025 年推出,最新版本于 6 月上线,可与 Gmail、Outlook、Slack、Granola、Notion 等平台同步。用户授权后,Pally 可预订航班、管理收件箱、回复消息及预订餐厅。 Pally 使用 Anthropic 的 Claude、OpenAI 的 ChatGPT 以及 Kimi K3、GLM 5.2 等开源模型。联合创始人 Haz Hubble 表示,公司不会出售用户数据,也不会使用相关数据训练模型。(BusinessInsider)
半导体巨头 AMD 宣布推出企业级 AI 编程平台 AMD Instinct Coder,该平台结合 AMD 芯片、Supermicro 服务器及 Spectro Cloud 软件,旨在帮助企业在本地部署 AI 编码助手,降低云端 AI 模型使用成本并保护代码及数据安全。AMD 表示,Instinct Coder 是一套“开箱即用”的端到端 AI 开发平台,整合了 AMD EPYC 处理器、AMD Instinct GPU、Supermicro AI 服务器、Spectro Cloud PaletteAI Inference Launchpad 软件,以及经过 AMD 优化的 GLM-5.2 模型,可用于代码生成、应用现代化、自动化测试、代码审查等软件开发场景。AMD 称,与依赖云端前沿 AI 模型相比,Instinct Coder 可帮助企业降低最高 70%的总拥有成本(TCO),投资回收期最快可缩短至 6 个月。AMD 表示,越来越多企业希望利用 AI 提升开发效率,但同时面临两大挑战:一方面,调用顶级云端模型成本不断增加;另一方面,将企业源代码、知识产权和敏感数据交由第三方服务存在安全和合规风险。通过本地部署模式,Instinct Coder 可让企业保持对数据和代码的控制,同时提供更可预测的基础设施成本。该平台支持 Claude Code、OpenAI Codex、Visual Studio Code 和 Cursor 等开发工具,每个节点最多支持 50 名用户(30 名并发用户)。此外,Spectro Cloud 提供的 PaletteAI Inference Launchpad 可实现 AI 工作负载管理、模型路由、请求审计和成本监控,并支持在需要时调用 Anthropic、OpenAI、Google 或 xAI 等外部模型。AMD 表示,Instinct Coder 旨在帮助企业摆脱高昂云端 AI 服务成本,在保障数据安全和自主控制的同时,加速 AI 驱动的软件开发流程。
据 Fortune 报道,随着 DeepSeek V4 Flash、GLM-5.2、Kimi K3 等中国开源 AI 模型持续突破,全球 AI 竞赛的核心矛盾正从"中美对抗"转向"开源 vs 封闭"之争。DeepSeek V4 Flash 性能仅落后 GPT-5.6 Luna 一个智能指数点,但每次任务成本较 OpenAI 降价 80%后仍低 60%。 美国对华出口管制原本意在限制中国 AI 发展,却反而倒逼中国企业在算法架构层面深度创新,加速了开源模式的崛起。目前,美国科技界风向已现转变,前"AI 沙皇"David Sacks 等人公开支持开源路线,Anthropic 也软化了对开源的反对立场。
Perplexity CEO Aravind Srinivas 发推称,GLM 是一款被严重低估的模型,在 700B 参数规模下展现出接近 Opus 级别的性能,且运行效率极高。此前月之暗面刚刚发布开源模型 Kimi K3,业内对智谱 AI 旗下 GLM 系列模型的关注度正在上升。
月之暗面推出开源模型 Kimi K3,在 Artificial Analysis 智能指数上获得 57 分,成为第三高分模型,仅次于 Anthropic 的 Claude Opus 5(61 分)、Claude Fable 5(60 分)和 OpenAI 的 GPT-5.6 Sol(59 分)。该指数显示,领先闭源模型与开源权重模型之间的差距已缩小至 4 分,为自 2 月 GLM-5 发布以来的最小差距。这标志着开源模型在性能上正快速追赶闭源模型。
中国 AI 初创公司 Moonshot AI 将公开高性能模型 Kimi K3 的模型权重,开发者可下载模型并按用途修改,也可在自有数据中心或云环境中运行。Kimi K3 拥有 2.8 万亿个参数和 100 万 Token 上下文窗口,可一次性处理大规模文档和代码库。Moonshot AI 计划后续通过技术报告公开模型结构、训练方式和性能评估结果。Kimi K3 发布后,Moonshot AI 单日收入据悉至少增长 6 倍。Moonshot AI 正推进按 500 亿美元估值进行新一轮融资,并考虑最快今年在香港上市。Bloomberg Intelligence 表示,Kimi K3 与 Z.AI 的 GLM-5.2 发布后,中国开源权重模型在整体 Token 使用量中的占比升至 68%。AWS Bedrock、Microsoft Azure Foundry 和 Google Vertex AI 尚未提供 Kimi K3 与 GLM-5.2 等中国开源权重模型。