GetChain News
中简 中繁 EN
GetChain News
Toggle sidebar

上線/更新

同時關聯該項目與事件的快訊

DeepSeek V4-Flash-0731 公測:代碼 Agent 能力大漲,價格不變

DeepSeek 正式公測 V4-Flash-0731 版本,通過後訓練與 Agent 框架優化,將 DeepSWE 榜單成績從 7.3 提升至 54.4,Cybergym 得分翻倍至 76.7,部分硬榜表現接近 Claude Opus 4.8。新版本未增加參數,價格保持不變,原生支持 Responses API,老用戶 API 將自動切換至新版本。目前僅更新 Flash API,V4 Pro 正式版仍在開發中。

研究:AI 代碼審查可壓縮審查時間,但質量隱患不容忽視

據 Rohan Paul 發佈的研究摘要,一項針對 207 個 GitHub 項目、102 萬次拉取請求的大規模研究顯示,引入 AI 代理審查可將代碼審查時間縮短 2.5 至 4.5 天/KLOC,但代價是審查質量下滑——AI 參與的審查中,78%~94% 的 PR 存在"審查異味"(review smells),高於純人工審查的 69%~76%。研究指出,反覆分配同一 AI 審查員身份是導致審查多樣性下降的主要原因。值得注意的是,早期大量引入 LLM 審查的項目並未獲得顯著效率提升。

Anthropic 刪減 Claude Code 系統提示詞 80%,新模型無需嚴格規則仍保持編碼性能

Anthropic 工程師披露,團隊爲最新 Claude 模型刪減了 Claude Code 約 80% 的系統提示詞,編碼評估未出現性能下降。早期版本因模型能力不足,提示詞中包含大量嚴格規則(如禁止多行註釋等),但新模型具備自主決策能力後,這些規則反而引發指令衝突和思維發散。新策略改爲描述目標(如「編寫與周圍代碼匹配的代碼」),並將指令分散到工具描述和按需啓用的技能模塊中。團隊明確將提示詞膨脹視爲技術債務,認爲隨着模型能力提升,應當簡化而非堆疊指令。

Block 推出 Buzz:基於 Nostr 協議的人機協作開源工作平臺

據 Decrypt 報道,Jack Dorsey 旗下支付公司 Block 正式發佈開源協作平臺 Buzz,基於 Nostr 協議構建,支持員工與 AI 代理在同一工作空間內協同作業。Buzz 集成團隊聊天、代碼倉庫及自動化工作流,每位用戶與 AI 代理均擁有獨立加密身份,支持 Claude Code、OpenAI Codex 及 Block 自研 goose 等主流模型框架,代碼以 Apache 2.0 協議開源發佈。Jack Dorsey 表示,該平臺旨在降低公司對 Slack 和 GitHub 的依賴,目前版本爲 0.4.21,已支持 macOS、Windows 及 Linux 桌面端,移動端仍在開發中。

Anthropic 支持 FCA"超級沙盒"第二批 AI 實驗項目

據 FCA 官方公告,Anthropic 將爲英國金融行爲監管局(FCA)"超級沙盒"第二批參與企業提供 Claude 系列產品(含 Claude Code 及 Claude Cowork)的訪問權限,以加速其 AI 開發進程。 第二批共 21 家機構入選,包括 Scottish Widows、Money Advice Trust 及 TrueLayer 等,本次申請數量較第一批增加 51%,共收到 199 份申請。參與企業將圍繞以下方向測試 AI 解決方案:智能體支付安全、欺詐與金融犯罪檢測、AI 治理與問責、弱勢羣體金融服務普惠,以及合規與業務自動化。 此外,FCA 同步推出"Agentic Academy"——一項由 FCA 與金融科技與創業中心(CFTE)聯合主辦的爲期 10 周 AI 專項培訓計劃。參與企業將繼續享有 NayaOne 數字沙盒基礎設施及 NVIDIA 加速計算資源支持。

Kimi K3需求遠超預期,暫停開放新訂閱並擴容算力

Kimi 在 X 平臺發文表示,K3 上線後獲得的市場反響遠超預期,過去 48 小時內用戶需求已接近現有 GPU 算力容量上限。爲保障現有訂閱用戶的使用體驗,已暫時暫停開放新的訂閱服務。目前已訂閱用戶的使用不會受到影響,公司正在儘快擴充算力資源,並將在後續分批恢復新用戶訂閱資格。此外,未來會員體系將拆分爲兩類更具針對性的產品,包括面向 Kimi 網頁端、App 及辦公場景的“Kimi Membership”,以及專注編程工作流的“Kimi Code Membership”,以實現更精準的算力分配並提升服務穩定性。

Claude Code曝高危安全風險:惡意配置文件或可靜默執行命令

慢霧創始人餘弦在 X 平臺轉發 Claude Code 潛在投毒攻擊風險推文併發布針對 Grok Build CLI 及 Claude Code CLI 投毒攻擊細節分析,其中指出 Grok Build CLI 的安全機制沒有統一,不同代碼路徑有不同的信任假設,縫隙之間便是攻擊者的通道。攻擊者可能通過惡意項目配置文件,在用戶不知情的情況下執行任意命令,進而竊取 API 密鑰、雲端憑證或控制本地設備。研究人員構造測試環境發現,在 Mac 系統中,如果 Claude Code 受到影響,執行特定測試命令後可觸發本地計算器啓動,證明存在潛在命令執行風險。若攻擊成功,攻擊者可能進一步竊取 Claude、OpenAI 等 AI 服務 API Key 造成賬戶費用損失,獲取 AWS、阿里雲、騰訊雲等雲服務憑證訪問服務器和數據,篡改代碼倉庫植入後門,利用本地設備作爲跳板攻擊企業內部網絡。據悉,相關漏洞已經存在一年。

馬斯克頻頻銳評國產AI模型:二次稱讚Kimi K3模型令人印象深刻

昨日,月之暗面最新開源 AI 模型 Kimi K3 模型發佈,在 Frontend Code Arena 測試網站中以 1679 分位居第一,超越 Claude 旗下 Fable 5 模型。針對 K3 模型,Artifacial Analysis 進行了相關測評,隨後埃馬斯克再次爲月之暗面 Kimi 模型點贊,稱 K3 模型的基準性能令人印象深刻。今年 3 月,Kimi 發佈《𝑨𝒕𝒕𝒆𝒏𝒕𝒊𝒐𝒏 𝑹𝒆𝒔𝒊𝒅𝒖𝒂𝒍𝒔:重新思考深度方向聚合》研究論文時曾獲馬斯克稱讚:“Kimi 的研究工作令人印象深刻。”此前,其還稱智譜旗下 GLM 模型或於 2027 年 Q1 超越 Claude Mythos 模型(即 Fable 5),對此智譜創始人唐傑回應稱“不需要那麼久”。

X-Agent正式發佈Litepaper V1,構建去中心化AI代理經濟體

今日,基於 Web3 社交網絡的 AI Agent 零代碼運行平臺 X-Agent 正式向全球發佈其核心《Litepaper V1》。白皮書詳細披露了其如何通過零代碼部署與安全沙箱技術,重構去中心化 AI 代理生態與商業化路徑。核心技術與解決方案如下:1)Speak to Build(零代碼部署): 允許用戶通過純自然語言,在數分鐘內創建並一鍵部署專業級 AI 代理至 Telegram、WhatsApp 或 Web 端。2)SRE 密碼學沙箱(物理隔離安全): 獨創物理隔離運行環境,在完美保護用戶私鑰與敏感憑證的同時,使代理具備企業級的自主資產變動與鏈上協作能力。市場表現與最新數據 X-Agent 全球累計用戶已突破 1,000,000+,運行的 AI 代理已自主完成超過 1,100,000 次 實際業務任務,累計消耗/銷燬超過 840 億個 模型 Token。項目此前已籌集 180 萬美元 資金,並在日本和韓國擁有極具凝聚力的本地化社區。原生代幣 $XAGT 作爲網絡結算硬通貨,直接用於 SRE 算力 Gas 費結算、交易佣金交納及質押背書。團隊與投資人設有嚴格的 12 個月 Cliff 鎖倉。社區額度完全非通脹化,僅能通過實際沙箱任務消耗算法化解鎖,確保每一枚代幣都由真實業務需求支撐。根據最新路線圖,X-Agent 將於 2026 年 Q3 開放全新零代碼 public 門戶,並於 2027 年 Q1 上線去中心化 Agent Store。

BNB Plus因股價不足1美元被納斯達克摘牌,保留代碼BNBX轉至OTCQB交易

BNB 財庫上市公司 BNB Plus 發佈公告,公司已收到納斯達克聽證小組摘牌裁決,退市核心原因爲股價持續未達標資本市場持續上市規則 1 美元最低買入價要求。BNB Plus 計劃向納斯達克上市複審委員會提交複審申請,但本次複審不會暫緩摘牌流程,公司股票將於 2026 年 7 月 14 日開盤暫停納斯達克場內交易。公司已完成 OTCQB Venture Market 掛牌籌備,股票代碼維持 BNBX 不變,預計 7 月 14 日開盤後即可在場外市場正常交易。(Businesswire)

Claude 延長 Fable 5 訪問權限至 7 月 19 日

據 Claude 官方 X 賬號(@claudeai)發佈,Claude 將在所有付費計劃中延長 Fable 5 的訪問權限,同時 Claude Code 每週使用限制維持高出 50% 的水平,上述政策延續至 7 月 19 日。官方補充說明,用戶每週使用限額的一半可用於 Fable 5,超出後可通過使用積分繼續訪問,或切換至其他模型繼續使用。

阿里內部全面禁用 Claude Code,推薦 Qoder 替代

據澎湃新聞報道,因 Claude Code 被曝存在植入後門的安全風險,阿里經綜合評估後已將其列入高風險軟件名單,自 7 月 10 日起全面禁止內部員工在辦公環境下使用,並推薦以 Qoder 作爲替代方案。 據悉,Anthropic 旗下 Claude Code 自 2.1.91 版本起被發現嵌入"隱形代碼",若用戶啓用網絡代理,該工具會通過修改不可見的系統提示詞,祕密傳輸用戶位置等信息。對此,Anthropic 回應稱該功能系今年 3 月啓動的實驗性措施,旨在防止未經授權的轉售商濫用賬戶及防範蒸餾行爲,並表示將在最新版本中完全回滾。

BNB Agent Studio正式上線BNB Chain主網

BNB Chain 宣佈 AI Agent 開發平臺 BNB Agent Studio 正式上線主網。開發者可在 Cursor、Claude Code 等 AI 編程工具中通過一句提示詞完成 Agent 的錢包創建、鏈上身份註冊(ERC-8004)與部署,無需分別搭建錢包、身份、支付、託管和 LLM 接入。Agent 部署後可通過 x402 協議從用戶預充值錢包中自動扣費續費 LLM 用量,並藉助 ERC-8183 任務接口被其他 Agent 發現和調用,全程運行於 AWS Bedrock AgentCore。官方同時推出限時免費試用活動,用戶憑 GitHub 賬號即可在 BSC 測試網體驗完整部署流程。

Anthropic 員工回應 Claude Code 針對中國用戶的檢測代碼:相關功能將於明日新版本回滾

針對 Claude Code 被曝存在面向中國用戶的檢測代碼一事,Claude Code 團隊成員 Thariq Shihipar 回應稱,相關功能是今年 3 月啓動的一項實驗,主要用於識別未經授權的經銷行爲及防範模型蒸餾。根據說明,相關代碼會檢測時區、代理及可能的人工智能實驗室信息。

OKX正式推出面向Agent經濟的去中心化平臺OKX.AI

據官方消息,OKX 已正式上線 OKX.AI。這是一個面向 Agent 經濟的去中心化平臺,支持 AI Agent 之間發佈任務、承接任務、完成支付、評價與仲裁,使 Agent 能夠像經濟主體一樣自主協作並完成複雜任務。據悉,OKX.AI 由 "Agent 廣場 "與「任務大廳」兩大市場構成,底層依託 Onchain OS 等基礎設施,提供智能體經濟所需的身份、支付、信任與結算能力。每個 Agent 均擁有唯一鏈上身份,可基於任務成果進行付費;爭議則由質押制驗證者網絡進行仲裁。開發者可通過開放工具包 Onchain OS 接入,兼容 Claude Code、Codex 等支持 MCP 的客戶端,創建 Agentic Wallet 即可開始使用。

智譜創始人唐傑:GLM-5.2開源發佈後將逐步縮小與OpenAI及Anthropic性能差距

智譜 AI 創始人唐傑在 X 平臺發文表示,GLM-5.2 正式開源發佈後已在多項國際權威評測與競技榜單中取得領先成績,在 Artificial Analysis Intelligence Index 綜合評估中 GLM-5.2 獲得 51 分,與 Anthropic 的 Claude Opus 4.8 處於同一水平區間;在 Code Arena 前端代碼生成對抗測試中以 Elo 1595 排名全球第 2,在 DesignArena 設計與代碼融合場景中獲得 1360 分排名第 1。整體來看,智譜 GLM-5.2 在前端開發、設計生成與軟件工程等多個真實場景評測也持續位居全球前列,逐步縮小與 OpenAI 及 Anthropic 等前沿模型之間的性能差距,並將繼續推動模型能力上限提升。此前,針對馬斯克表示中國大模型可能會在明年一季度達到 Anthropic 的 Fable 水平,智譜 AI 創始人唐傑回應表示“不會耗費如此長時間”。

Claude Code推出Artifacts:開發過程將可轉爲交互式即時網頁

Claude Code 宣佈正式推出 Artifacts 功能,用戶可將正在進行的工作預覽爲一個即時、可交互的網頁,並基於完整會話上下文生成與更新內容,方便團隊共享與協作,包括 PR 解讀、系統說明、儀表盤、發佈檢查清單等,並會隨着會話推進自動更新,該功能現已在 Claude Team 與 Enterprise 組織中上線 Beta 版本,並支持在瀏覽器中訪問。

OpenAI 將推動 AI 內容來源驗證標準建設並支持歐盟 AI 生成內容透明度準則

OpenAI 官方宣佈將推動 AI 內容來源驗證標準建設並支持歐盟委員會發布的《AI 生成內容透明度實踐準則》(Code of Practice on Transparency of AI-Generated Content),加強 AI 生成內容的來源追蹤與透明化。 據悉,OpenAI 自2024 年起已開始在 DALL·E 3 圖像生成工具中加入 C2PA 元數據,用於標識 AI 生成內容來源。此後,OpenAI 持續完善內容標記、檢測技術,並推出公開驗證工具,幫助用戶判斷圖片是否包含與 OpenAI 生成內容相關的來源信號。

OpenAI發佈前沿治理框架

OpenAI 發佈前沿治理框架(Frontier Governance Framework),系統闡述其 AI 安全與治理實踐如何對接《加州前沿 AI 透明法案》及歐盟《通用 AI 行爲準則》等新興監管要求。該框架基於 OpenAI 現有 Preparedness Framework,重點覆蓋網絡攻擊、CBRN 風險、有害操縱、失控風險、模型報告、安全事件響應及外部專家審查等領域,並表示將隨着模型能力與監管環境變化持續更新。

參議員Lummis:若Clarity Act未在本屆國會通過,美國軟件開發者將再因發佈代碼面臨起訴

Bitcoin News在X平臺發文表示,參議員 Lummis稱,如果Clarity Act未在本屆國會通過,美國軟件開發者將在不久的將來再次僅因發佈代碼而成爲起訴目標,這就是利害所在。