GetChain News
中简 中繁 EN
GetChain News
Toggle sidebar

上线/更新

同时关联该项目与事件的快讯

DeepSeek V4-Flash-0731 公测:代码 Agent 能力大涨,价格不变

DeepSeek 正式公测 V4-Flash-0731 版本,通过后训练与 Agent 框架优化,将 DeepSWE 榜单成绩从 7.3 提升至 54.4,Cybergym 得分翻倍至 76.7,部分硬榜表现接近 Claude Opus 4.8。新版本未增加参数,价格保持不变,原生支持 Responses API,老用户 API 将自动切换至新版本。目前仅更新 Flash API,V4 Pro 正式版仍在开发中。

研究:AI 代码审查可压缩审查时间,但质量隐患不容忽视

据 Rohan Paul 发布的研究摘要,一项针对 207 个 GitHub 项目、102 万次拉取请求的大规模研究显示,引入 AI 代理审查可将代码审查时间缩短 2.5 至 4.5 天/KLOC,但代价是审查质量下滑——AI 参与的审查中,78%~94% 的 PR 存在"审查异味"(review smells),高于纯人工审查的 69%~76%。研究指出,反复分配同一 AI 审查员身份是导致审查多样性下降的主要原因。值得注意的是,早期大量引入 LLM 审查的项目并未获得显著效率提升。

Anthropic 删减 Claude Code 系统提示词 80%,新模型无需严格规则仍保持编码性能

Anthropic 工程师披露,团队为最新 Claude 模型删减了 Claude Code 约 80% 的系统提示词,编码评估未出现性能下降。早期版本因模型能力不足,提示词中包含大量严格规则(如禁止多行注释等),但新模型具备自主决策能力后,这些规则反而引发指令冲突和思维发散。新策略改为描述目标(如「编写与周围代码匹配的代码」),并将指令分散到工具描述和按需启用的技能模块中。团队明确将提示词膨胀视为技术债务,认为随着模型能力提升,应当简化而非堆叠指令。

Block 推出 Buzz:基于 Nostr 协议的人机协作开源工作平台

据 Decrypt 报道,Jack Dorsey 旗下支付公司 Block 正式发布开源协作平台 Buzz,基于 Nostr 协议构建,支持员工与 AI 代理在同一工作空间内协同作业。Buzz 集成团队聊天、代码仓库及自动化工作流,每位用户与 AI 代理均拥有独立加密身份,支持 Claude Code、OpenAI Codex 及 Block 自研 goose 等主流模型框架,代码以 Apache 2.0 协议开源发布。Jack Dorsey 表示,该平台旨在降低公司对 Slack 和 GitHub 的依赖,目前版本为 0.4.21,已支持 macOS、Windows 及 Linux 桌面端,移动端仍在开发中。

Anthropic 支持 FCA"超级沙盒"第二批 AI 实验项目

据 FCA 官方公告,Anthropic 将为英国金融行为监管局(FCA)"超级沙盒"第二批参与企业提供 Claude 系列产品(含 Claude Code 及 Claude Cowork)的访问权限,以加速其 AI 开发进程。 第二批共 21 家机构入选,包括 Scottish Widows、Money Advice Trust 及 TrueLayer 等,本次申请数量较第一批增加 51%,共收到 199 份申请。参与企业将围绕以下方向测试 AI 解决方案:智能体支付安全、欺诈与金融犯罪检测、AI 治理与问责、弱势群体金融服务普惠,以及合规与业务自动化。 此外,FCA 同步推出"Agentic Academy"——一项由 FCA 与金融科技与创业中心(CFTE)联合主办的为期 10 周 AI 专项培训计划。参与企业将继续享有 NayaOne 数字沙盒基础设施及 NVIDIA 加速计算资源支持。

Kimi K3需求远超预期,暂停开放新订阅并扩容算力

Kimi 在 X 平台发文表示,K3 上线后获得的市场反响远超预期,过去 48 小时内用户需求已接近现有 GPU 算力容量上限。为保障现有订阅用户的使用体验,已暂时暂停开放新的订阅服务。目前已订阅用户的使用不会受到影响,公司正在尽快扩充算力资源,并将在后续分批恢复新用户订阅资格。此外,未来会员体系将拆分为两类更具针对性的产品,包括面向 Kimi 网页端、App 及办公场景的“Kimi Membership”,以及专注编程工作流的“Kimi Code Membership”,以实现更精准的算力分配并提升服务稳定性。

Claude Code曝高危安全风险:恶意配置文件或可静默执行命令

慢雾创始人余弦在 X 平台转发 Claude Code 潜在投毒攻击风险推文并发布针对 Grok Build CLI 及 Claude Code CLI 投毒攻击细节分析,其中指出 Grok Build CLI 的安全机制没有统一,不同代码路径有不同的信任假设,缝隙之间便是攻击者的通道。攻击者可能通过恶意项目配置文件,在用户不知情的情况下执行任意命令,进而窃取 API 密钥、云端凭证或控制本地设备。研究人员构造测试环境发现,在 Mac 系统中,如果 Claude Code 受到影响,执行特定测试命令后可触发本地计算器启动,证明存在潜在命令执行风险。若攻击成功,攻击者可能进一步窃取 Claude、OpenAI 等 AI 服务 API Key 造成账户费用损失,获取 AWS、阿里云、腾讯云等云服务凭证访问服务器和数据,篡改代码仓库植入后门,利用本地设备作为跳板攻击企业内部网络。据悉,相关漏洞已经存在一年。

马斯克频频锐评国产AI模型:二次称赞Kimi K3模型令人印象深刻

昨日,月之暗面最新开源 AI 模型 Kimi K3 模型发布,在 Frontend Code Arena 测试网站中以 1679 分位居第一,超越 Claude 旗下 Fable 5 模型。针对 K3 模型,Artifacial Analysis 进行了相关测评,随后埃马斯克再次为月之暗面 Kimi 模型点赞,称 K3 模型的基准性能令人印象深刻。今年 3 月,Kimi 发布《𝑨𝒕𝒕𝒆𝒏𝒕𝒊𝒐𝒏 𝑹𝒆𝒔𝒊𝒅𝒖𝒂𝒍𝒔:重新思考深度方向聚合》研究论文时曾获马斯克称赞:“Kimi 的研究工作令人印象深刻。”此前,其还称智谱旗下 GLM 模型或于 2027 年 Q1 超越 Claude Mythos 模型(即 Fable 5),对此智谱创始人唐杰回应称“不需要那么久”。

X-Agent正式发布Litepaper V1,构建去中心化AI代理经济体

今日,基于 Web3 社交网络的 AI Agent 零代码运行平台 X-Agent 正式向全球发布其核心《Litepaper V1》。白皮书详细披露了其如何通过零代码部署与安全沙箱技术,重构去中心化 AI 代理生态与商业化路径。核心技术与解决方案如下:1)Speak to Build(零代码部署): 允许用户通过纯自然语言,在数分钟内创建并一键部署专业级 AI 代理至 Telegram、WhatsApp 或 Web 端。2)SRE 密码学沙箱(物理隔离安全): 独创物理隔离运行环境,在完美保护用户私钥与敏感凭证的同时,使代理具备企业级的自主资产变动与链上协作能力。市场表现与最新数据 X-Agent 全球累计用户已突破 1,000,000+,运行的 AI 代理已自主完成超过 1,100,000 次 实际业务任务,累计消耗/销毁超过 840 亿个 模型 Token。项目此前已筹集 180 万美元 资金,并在日本和韩国拥有极具凝聚力的本地化社区。原生代币 $XAGT 作为网络结算硬通货,直接用于 SRE 算力 Gas 费结算、交易佣金交纳及质押背书。团队与投资人设有严格的 12 个月 Cliff 锁仓。社区额度完全非通胀化,仅能通过实际沙箱任务消耗算法化解锁,确保每一枚代币都由真实业务需求支撑。根据最新路线图,X-Agent 将于 2026 年 Q3 开放全新零代码 public 门户,并于 2027 年 Q1 上线去中心化 Agent Store。

BNB Plus因股价不足1美元被纳斯达克摘牌,保留代码BNBX转至OTCQB交易

BNB 财库上市公司 BNB Plus 发布公告,公司已收到纳斯达克听证小组摘牌裁决,退市核心原因为股价持续未达标资本市场持续上市规则 1 美元最低买入价要求。BNB Plus 计划向纳斯达克上市复审委员会提交复审申请,但本次复审不会暂缓摘牌流程,公司股票将于 2026 年 7 月 14 日开盘暂停纳斯达克场内交易。公司已完成 OTCQB Venture Market 挂牌筹备,股票代码维持 BNBX 不变,预计 7 月 14 日开盘后即可在场外市场正常交易。(Businesswire)

Claude 延长 Fable 5 访问权限至 7 月 19 日

据 Claude 官方 X 账号(@claudeai)发布,Claude 将在所有付费计划中延长 Fable 5 的访问权限,同时 Claude Code 每周使用限制维持高出 50% 的水平,上述政策延续至 7 月 19 日。官方补充说明,用户每周使用限额的一半可用于 Fable 5,超出后可通过使用积分继续访问,或切换至其他模型继续使用。

阿里内部全面禁用 Claude Code,推荐 Qoder 替代

据澎湃新闻报道,因 Claude Code 被曝存在植入后门的安全风险,阿里经综合评估后已将其列入高风险软件名单,自 7 月 10 日起全面禁止内部员工在办公环境下使用,并推荐以 Qoder 作为替代方案。 据悉,Anthropic 旗下 Claude Code 自 2.1.91 版本起被发现嵌入"隐形代码",若用户启用网络代理,该工具会通过修改不可见的系统提示词,秘密传输用户位置等信息。对此,Anthropic 回应称该功能系今年 3 月启动的实验性措施,旨在防止未经授权的转售商滥用账户及防范蒸馏行为,并表示将在最新版本中完全回滚。

BNB Agent Studio正式上线BNB Chain主网

BNB Chain 宣布 AI Agent 开发平台 BNB Agent Studio 正式上线主网。开发者可在 Cursor、Claude Code 等 AI 编程工具中通过一句提示词完成 Agent 的钱包创建、链上身份注册(ERC-8004)与部署,无需分别搭建钱包、身份、支付、托管和 LLM 接入。Agent 部署后可通过 x402 协议从用户预充值钱包中自动扣费续费 LLM 用量,并借助 ERC-8183 任务接口被其他 Agent 发现和调用,全程运行于 AWS Bedrock AgentCore。官方同时推出限时免费试用活动,用户凭 GitHub 账号即可在 BSC 测试网体验完整部署流程。

Anthropic 员工回应 Claude Code 针对中国用户的检测代码:相关功能将于明日新版本回滚

针对 Claude Code 被曝存在面向中国用户的检测代码一事,Claude Code 团队成员 Thariq Shihipar 回应称,相关功能是今年 3 月启动的一项实验,主要用于识别未经授权的经销行为及防范模型蒸馏。根据说明,相关代码会检测时区、代理及可能的人工智能实验室信息。

OKX正式推出面向Agent经济的去中心化平台OKX.AI

据官方消息,OKX 已正式上线 OKX.AI。这是一个面向 Agent 经济的去中心化平台,支持 AI Agent 之间发布任务、承接任务、完成支付、评价与仲裁,使 Agent 能够像经济主体一样自主协作并完成复杂任务。据悉,OKX.AI 由 "Agent 广场 "与「任务大厅」两大市场构成,底层依托 Onchain OS 等基础设施,提供智能体经济所需的身份、支付、信任与结算能力。每个 Agent 均拥有唯一链上身份,可基于任务成果进行付费;争议则由质押制验证者网络进行仲裁。开发者可通过开放工具包 Onchain OS 接入,兼容 Claude Code、Codex 等支持 MCP 的客户端,创建 Agentic Wallet 即可开始使用。

智谱创始人唐杰:GLM-5.2开源发布后将逐步缩小与OpenAI及Anthropic性能差距

智谱 AI 创始人唐杰在 X 平台发文表示,GLM-5.2 正式开源发布后已在多项国际权威评测与竞技榜单中取得领先成绩,在 Artificial Analysis Intelligence Index 综合评估中 GLM-5.2 获得 51 分,与 Anthropic 的 Claude Opus 4.8 处于同一水平区间;在 Code Arena 前端代码生成对抗测试中以 Elo 1595 排名全球第 2,在 DesignArena 设计与代码融合场景中获得 1360 分排名第 1。整体来看,智谱 GLM-5.2 在前端开发、设计生成与软件工程等多个真实场景评测也持续位居全球前列,逐步缩小与 OpenAI 及 Anthropic 等前沿模型之间的性能差距,并将继续推动模型能力上限提升。此前,针对马斯克表示中国大模型可能会在明年一季度达到 Anthropic 的 Fable 水平,智谱 AI 创始人唐杰回应表示“不会耗费如此长时间”。

Claude Code推出Artifacts:开发过程将可转为交互式实时网页

Claude Code 宣布正式推出 Artifacts 功能,用户可将正在进行的工作预览为一个实时、可交互的网页,并基于完整会话上下文生成与更新内容,方便团队共享与协作,包括 PR 解读、系统说明、仪表盘、发布检查清单等,并会随着会话推进自动更新,该功能现已在 Claude Team 与 Enterprise 组织中上线 Beta 版本,并支持在浏览器中访问。

OpenAI 将推动 AI 内容来源验证标准建设并支持欧盟 AI 生成内容透明度准则

OpenAI 官方宣布将推动 AI 内容来源验证标准建设并支持欧盟委员会发布的《AI 生成内容透明度实践准则》(Code of Practice on Transparency of AI-Generated Content),加强 AI 生成内容的来源追踪与透明化。 据悉,OpenAI 自2024 年起已开始在 DALL·E 3 图像生成工具中加入 C2PA 元数据,用于标识 AI 生成内容来源。此后,OpenAI 持续完善内容标记、检测技术,并推出公开验证工具,帮助用户判断图片是否包含与 OpenAI 生成内容相关的来源信号。

OpenAI发布前沿治理框架

OpenAI 发布前沿治理框架(Frontier Governance Framework),系统阐述其 AI 安全与治理实践如何对接《加州前沿 AI 透明法案》及欧盟《通用 AI 行为准则》等新兴监管要求。该框架基于 OpenAI 现有 Preparedness Framework,重点覆盖网络攻击、CBRN 风险、有害操纵、失控风险、模型报告、安全事件响应及外部专家审查等领域,并表示将随着模型能力与监管环境变化持续更新。

参议员Lummis:若Clarity Act未在本届国会通过,美国软件开发者将再因发布代码面临起诉

Bitcoin News在X平台发文表示,参议员 Lummis称,如果Clarity Act未在本届国会通过,美国软件开发者将在不久的将来再次仅因发布代码而成为起诉目标,这就是利害所在。