GetChain News
中简 中繁 EN
GetChain News
Toggle sidebar

上線/更新

同時關聯該項目與事件的快訊

B.AI 模型權益更新,兩大主力模型 1 折調用全面生效

B.AI 宣佈熱門模型新一輪權益正式生效:高併發主力模型 DeepSeek-V4.1-Flash 與 GLM-5.3-Flash 專屬 1 折調用權益全面上線,用戶僅需支付原價的 10% 即可調用,以極致性價比承接高吞吐場景需求;同時,Qwen3.8-Flash、Hy3 及 MiMo-V2.5 繼續開啓全額免費調用,爲開發者提供更豐富的零成本選擇。此次權益調整以極致性價比承接高吞吐需求,用多模型矩陣降低開發者的探索門檻。B.AI 持續以多模型矩陣和普惠定價,助力開發者打造低成本 AI 基礎設施,告別高昂算力成本,全速推進創新落地。

GLM-5.3-Flash 官方調價即將生效,B.AI 免費權益限時延長至 9 月 12 日

智譜官方 GLM-5.3-Flash 調價在即。爲給全球開發者提供更充足的緩衝期,B.AI 宣佈限時延長免費權益——即日起至 9 月 12 日 09:59(SGT),GLM-5.3-Flash 在 B.AI 平臺仍保持全量免費調用。作爲平臺調用量領先的熱門模型,GLM-5.3-Flash 擁有 320B 總參數與 18B 激活參數,支持 1M 超長上下文,兼顧極速響應與強大推理能力,是高頻代碼編寫、海量數據處理與複雜 Agent 工作流的性價比之選。此外,Qwen3.8 Flash、Hy3、MiMo V2.5 等熱門模型在 B.AI 平臺依然 100% 免費開放。B.AI 將持續以普惠算力支持全球開發者,讓前沿模型能力真正觸手可及。

OpenAI CFO:企業收入單月增長32%,Luna降價80%後使用量增長約10倍

OpenAI CFO Sarah Friar 表示,公司正加速將 AI 拓展至芯片設計、生命科學和金融服務等專業領域,並嘗試按照業務成果而非使用量進行定價。OpenAI 企業業務收入從今年 6 月至 7 月增長 32%,同期公司整體年化收入增長約 20%;截至年中,企業與消費者業務收入佔比已大致各佔一半。此外,OpenAI 近期將低成本 Luna 模型價格下調 80%,隨後使用量增長約 10 倍。Friar 稱,在雲端部署場景下,Luna 的成本甚至低於 Z.ai 的 GLM 5.3。OpenAI 編程工具 Codex 用戶數目前已達 2500 萬。公司還利用自有 AI 模型輔助開發 Jalapeno 芯片,並在 9 個月內完成芯片設計流片。(路透社)

B.AI 持續提供 GLM-5.3-Flash 免費調用,保持 0 成本開發

B.AI 宣佈 GLM-5.3-Flash 將在智譜官方限時 5 折優惠於 9 月 9 日 24:00 截止後,繼續爲全球開發者提供 0 成本調用支持,無需因上游價格調整而改變使用習慣。

GLM-5.3-Flash 登頂 B.AI 模型調用量榜首,累計吞吐量突破 2.41 萬億 Tokens

GLM-5.3-Flash 牛來模型已成爲 B.AI 平臺當前調用量最高、最受歡迎的模型,累計 Token 吞吐量突破 2.41 萬億。作爲 GLM-5 系列首款原生全模態模型,GLM-5.3-Flash 擁有 320B 總參數與 18B 激活參數,採用稀疏與線性注意力相結合的混合架構,支持 1M 超長上下文,兼顧極速響應、強大推理與高性價比。即日起,開發者仍可通過 B.AI 平臺免費調用該模型,覆蓋高頻 API、代碼編寫、複雜 Agent 及超長文檔處理等多元場景。立即體驗:chat.b.ai/chat

B.AI 累計 Token 吞吐量突破 10.9 萬億,免費活動持續釋放算力紅利

AI Agent 基礎設施平臺 B.AI 宣佈,自免費活動上線以來,平臺累計 Token 吞吐量已突破 10.9 萬億,累計 API 調用量達 8,956 萬次,累計吸引超 23.9 萬新註冊用戶(含 23.5 萬+API 開發者)。平臺底座在海量高併發與重度 Agent 工作流考驗中持續驗證了穩定性與承載力。模型陣容方面,GLM-5.3-Flash(Ox Alpha)、Qwen3.8-Flash、Tencent Hy3、Xiaomi MiMo-V2.5 繼續全量免費開放,DeepSeek-V4-Flash及 Vision-Exp 版本則開啓 5 折半價優惠,兼顧零門檻體驗與極致性價比。未來,B.AI 將持續爲開發者與企業團隊提供更高效、更穩定、更實惠的 AI 算力服務,助力 AI 應用加速落地,歡迎登錄 chat.b.ai/chat 即刻部署高效工作流。

B.AI全量免費活動持續,累計吞吐突破5.74萬億再創里程碑

8 月 31 日,B.AI 平臺前沿大模型全量免費開放活動持續高熱運行,全平臺累計 Token 吞吐量已正式突破 5.74 萬億(5T+)歷史大關,在海量高併發請求與重度 Agent 任務的嚴苛考驗下,B.AI 工業級底座展現出極穩承載能力。目前平臺已集結 GLM-5.3-Flash(Ox Alpha)、Qwen3.8-Flash、DeepSeek-V4-Flash、DeepSeek-V4-Flash-Vision-Exp、Tencent Hy3 及 Xiaomi MiMo-V2.5 等六大頂尖模型,全部面向用戶零門檻無限量免費開放,覆蓋代碼生成、超長文本處理、多模態視覺理解、Agent 工作流部署等多元場景。即日起登錄 B.AI 平臺,即可零成本調用全系前沿模型,無限算力無縫接入,讓每一位開發者與 AI 深度用戶暢享真正的“算力自由”。

牛來模型 GLM-5.3-Flash 現已上線,B.AI 免費福利再加碼

一站式 AGI 基礎設施平臺 B.AI 宣佈智譜 GLM-5.3-Flash(320B-A18B)正式登陸平臺,並在 API 官方組全量免費開放。作爲 GLM-5 系列首款原生全模態模型,GLM-5.3-Flash 擁有 320B 總參數與 18B 激活參數,由純國產 AI 芯片提供算力支持,首次引入稀疏與線性注意力混合架構,配合 1M 超長上下文,兼具強悍性能與極致性價比,是當前國產模型中的實力派選手。即日起,開發者可通過 B.AI API 官方組零成本調用這款硬核神器,輕鬆駕馭複雜推理、長文本處理與多模態任務。B.AI 持續以普惠算力降低 AI 應用門檻,讓更多開發者用上頂尖國產模型。

智譜開源 GLM-5.3-Flash,美 PCE 超預期,英偉達盤後漲

智譜宣佈上線並開源 GLM-5.3-Flash 模型。美國 7 月 PCE 物價指數年率達 3.7% 超預期,美聯儲加息預期升溫;英偉達披露 2028 財年 70% 增速指引,提振盤後股價。

智譜上線並開源“牛來”模型 GLM-5.3-Flash,多模態能力與推理成本效率提升

Z.ai 發佈 GLM-5.3-Flash,稱其爲 GLM-5 系列首個原生多模態模型。該模型擁有 3200 億總參數、180 億激活參數,在多項編碼、智能體和視覺基準測試中超過 GLM-5.2,並在部分編碼任務上接近 Claude Opus 4.8。GLM-5.3-Flash 採用稀疏注意力與線性注意力結合的混合架構,並引入 mHC 與 IndexPool 等機制,以降低長上下文推理成本和 KV 緩存開銷。

中國智譜確認 Ox Alpha 爲 GLM 系列新迭代,今晚將發佈模型權重

據彭博社報道,中國人工智能公司 Z.AI(智譜) 週三確認,近期在在線使用榜單中迅速升至前列的神祕人工智能模型 Ox Alpha,是其 GLM 系列 的新迭代版本。該公司在回應彭博新聞查詢時表示,將於今晚發佈 Ox Alpha 的模型權重。

智譜 GLM-5.3 發佈:編碼與長程任務能力顯著提升,模型權重將於兩週後開放

Z.ai 發佈 GLM-5.3,基於與 GLM-5.2 相同的基礎模型,通過擴大後訓練實現能力提升。官方稱,GLM-5.3 在內部 Z.ai Code Bench 編碼基準上較 GLM-5.2 提升 50%,並在 Terminal Bench 3.0、Agents’ Last Exam 等公開基準中達到開放模型領先水平。網絡安全方面,GLM-5.3 在 CyberGym 漏洞發現測試中取得 84.5% 成績,並在 ExploitBench、ExploitGym 等利用鏈相關測試中較前代顯著提升。

GLM-5.3 即將發佈,聚焦編程與網絡安全能力

Z.ai 發文預告 GLM-5.3 即將推出,該模型聚焦編程能力,並面向網絡防禦挑戰。官方稱,GLM-5.3 通過對 743B 基礎模型進行後訓練,實現了頂尖的編程和智能代理能力,並在網絡安全領域取得重要進展,爲開源模型樹立新標準。

B.AI 平臺推出 GLM-5.2 旗艦模型限時 6 折優惠活動

B.AI 平臺現面向所有用戶推出 GLM-5.2 模型限時 6 折優惠。活動期間,無論通過 API 進行工程化部署,還是在 Web 端進行日常交互,全量調用均可享受 6 折結算價。折扣後價格分別爲:輸入 0.84、緩存寫入 0.84、緩存讀取 0.168、輸出 2.64(單位:Credits/Token)。GLM-5.2 作爲新一代開源旗艦模型,擁有 1M 超長上下文窗口,專爲大規模代碼開發、複雜推理及智能體任務等高性能場景設計。用戶可通過官方 API 標準通道或網頁端直接使用,全場景工作流實現無縫銜接。此次活動旨在以更低成本釋放頂級 AI 生產力,即日起用戶可登錄 B.AI 平臺體驗。

AI個人助理公司Pally完成520萬美元融資,Cyber Fund和Y Combinator領投

AI 個人助理初創公司 Pally 宣佈完成 520 萬美元融資,Cyber Fund 和 Y Combinator 領投,Pioneer Fund、Founders Inc、468 Capital 及天使投資人等參投。公司估值爲 3000 萬美元,主要業務爲通過短信入口提供 AI 個人助理服務。 Pally 於 2025 年推出,最新版本於 6 月上線,可與 Gmail、Outlook、Slack、Granola、Notion 等平臺同步。用戶授權後,Pally 可預訂航班、管理收件箱、回覆消息及預訂餐廳。 Pally 使用 Anthropic 的 Claude、OpenAI 的 ChatGPT 以及 Kimi K3、GLM 5.2 等開源模型。聯合創始人 Haz Hubble 表示,公司不會出售用戶數據,也不會使用相關數據訓練模型。(BusinessInsider)

AMD推出AI編程平臺Instinct Coder,可降低企業AI編碼成本70%

半導體巨頭 AMD 宣佈推出企業級 AI 編程平臺 AMD Instinct Coder,該平臺結合 AMD 芯片、Supermicro 服務器及 Spectro Cloud 軟件,旨在幫助企業在本地部署 AI 編碼助手,降低雲端 AI 模型使用成本並保護代碼及數據安全。AMD 表示,Instinct Coder 是一套“開箱即用”的端到端 AI 開發平臺,整合了 AMD EPYC 處理器、AMD Instinct GPU、Supermicro AI 服務器、Spectro Cloud PaletteAI Inference Launchpad 軟件,以及經過 AMD 優化的 GLM-5.2 模型,可用於代碼生成、應用現代化、自動化測試、代碼審查等軟件開發場景。AMD 稱,與依賴雲端前沿 AI 模型相比,Instinct Coder 可幫助企業降低最高 70%的總擁有成本(TCO),投資回收期最快可縮短至 6 個月。AMD 表示,越來越多企業希望利用 AI 提升開發效率,但同時面臨兩大挑戰:一方面,調用頂級雲端模型成本不斷增加;另一方面,將企業源代碼、知識產權和敏感數據交由第三方服務存在安全和合規風險。通過本地部署模式,Instinct Coder 可讓企業保持對數據和代碼的控制,同時提供更可預測的基礎設施成本。該平臺支持 Claude Code、OpenAI Codex、Visual Studio Code 和 Cursor 等開發工具,每個節點最多支持 50 名用戶(30 名併發用戶)。此外,Spectro Cloud 提供的 PaletteAI Inference Launchpad 可實現 AI 工作負載管理、模型路由、請求審計和成本監控,並支持在需要時調用 Anthropic、OpenAI、Google 或 xAI 等外部模型。AMD 表示,Instinct Coder 旨在幫助企業擺脫高昂雲端 AI 服務成本,在保障數據安全和自主控制的同時,加速 AI 驅動的軟件開發流程。

Fortune:AI 競賽核心矛盾或從中美對抗轉向開源 vs 封閉

據 Fortune 報道,隨着 DeepSeek V4 Flash、GLM-5.2、Kimi K3 等中國開源 AI 模型持續突破,全球 AI 競賽的核心矛盾正從"中美對抗"轉向"開源 vs 封閉"之爭。DeepSeek V4 Flash 性能僅落後 GPT-5.6 Luna 一個智能指數點,但每次任務成本較 OpenAI 降價 80%後仍低 60%。 美國對華出口管制原本意在限制中國 AI 發展,卻反而倒逼中國企業在算法架構層面深度創新,加速了開源模式的崛起。目前,美國科技界風向已現轉變,前"AI 沙皇"David Sacks 等人公開支持開源路線,Anthropic 也軟化了對開源的反對立場。

Perplexity CEO:GLM 700B 參數模型性能接近 Opus 級別

Perplexity CEO Aravind Srinivas 發推稱,GLM 是一款被嚴重低估的模型,在 700B 參數規模下展現出接近 Opus 級別的性能,且運行效率極高。此前月之暗面剛剛發佈開源模型 Kimi K3,業內對智譜 AI 旗下 GLM 系列模型的關注度正在上升。

Kimi K3 發佈,開源與閉源模型差距縮至 4 分

月之暗面推出開源模型 Kimi K3,在 Artificial Analysis 智能指數上獲得 57 分,成爲第三高分模型,僅次於 Anthropic 的 Claude Opus 5(61 分)、Claude Fable 5(60 分)和 OpenAI 的 GPT-5.6 Sol(59 分)。該指數顯示,領先閉源模型與開源權重模型之間的差距已縮小至 4 分,爲自 2 月 GLM-5 發佈以來的最小差距。這標誌着開源模型在性能上正快速追趕閉源模型。

Moonshot AI將公開2.8萬億參數Kimi K3權重,中國開源權重模型Token佔比升至68%

中國 AI 初創公司 Moonshot AI 將公開高性能模型 Kimi K3 的模型權重,開發者可下載模型並按用途修改,也可在自有數據中心或雲環境中運行。Kimi K3 擁有 2.8 萬億個參數和 100 萬 Token 上下文窗口,可一次性處理大規模文檔和代碼庫。Moonshot AI 計劃後續通過技術報告公開模型結構、訓練方式和性能評估結果。Kimi K3 發佈後,Moonshot AI 單日收入據悉至少增長 6 倍。Moonshot AI 正推進按 500 億美元估值進行新一輪融資,並考慮最快今年在香港上市。Bloomberg Intelligence 表示,Kimi K3 與 Z.AI 的 GLM-5.2 發佈後,中國開源權重模型在整體 Token 使用量中的佔比升至 68%。AWS Bedrock、Microsoft Azure Foundry 和 Google Vertex AI 尚未提供 Kimi K3 與 GLM-5.2 等中國開源權重模型。