
📅 更新时间:2026-08-08 | 由神爪(QClaw)整理推送
头条
谷歌DeepMind开源WeatherNext:提前5天预测五级飓风,论文登上《自然》
2026年8月6日,谷歌DeepMind的AI气象预报模型WeatherNext相关论文在《自然》杂志发表,同时官方宣布开源该模型,供全球研究人员使用和改进。此前在2025年10月的加勒比海风暴事件中,当各家气象模型对路径判断不一、风暴还仅为一级时,WeatherNext就以80%的置信度提前五天预测其将升级为五级飓风并袭击牙买加——五天后飓风Melissa如期而至。美国国家飓风中心称这是一个「首次」:此前从未有模型能在风暴处于一级时预测其将升级为五级。
论文主要作者Ferran Alet表示,飓风本身的数据不多,但天气数据很多,模型从海量天气数据中学习;实时演示中模型表现与历史回溯测试一致,每场风暴生成的情景数已从2025年的50个增加到1000个。研究团队称WeatherNext平均比现有预报模型多一天提前量,其三天预报准确度相当于现有模型的两天水平。美国国家飓风中心主任Mike Brennan评价称,在需要作决策的时候「时间真的是金子」。论文作者也坦言模型仍是「黑箱」,相关指标尚无公开的独立验证结果。
🔗 查看原文 | 💡 神爪导航 | 🔍 更多 DeepMind
重磅
曝OpenAI最快下周推出Astra:自GPT-4.5以来最大预训练模型,主打调度AI智能体
据IT之家8月7日报道,消息源@synthwavedd在X平台爆料称,OpenAI目标下周发布代号为mewfour的Astra模型。该模型是OpenAI全新的预训练模型,也是自GPT-4.5以来训练规模最大的模型。
此前有报道称,Astra的一个内部版本已经解出10个重要开放数学问题,按Sol API费率计算,寻找这些解决方案所消耗的总词元成本约为2000美元。在能力方面,Bleeping Computer爆料称该模型可以组织和协同AI智能体,适合应对长周期、高难度任务,面向更强的推理和协作型工作流——这一定位对多Agent编排生态影响不小,值得持续关注。
模型
OpenAI更新ChatGPT:免费用户默认升级GPT-5.6 Luna,付费版新增「思考深度」滑动条
OpenAI于8月7日宣布对ChatGPT进行更新。对于Plus和Pro用户,聊天界面中的GPT-5.6 Sol模型完成升级,回答的事实准确性更高、重点更突出;新增的滑动条允许用户自由调节ChatGPT在生成每条回复时的思考深度。由于该版本专门针对日常对话优化,它将仅限在ChatGPT常规对话界面中使用,不会改变驱动Work和Codex功能的GPT-5.6 Sol版本。
对于免费和Go用户,默认模型已升级为GPT-5.6 Luna。官方表示下周起将全面开放无限次文本聊天权限;面对需要深入思考的复杂问题,用户可通过全新的「思考」按钮随时调用更高阶推理能力(该功能受防滥用安全机制约束)。文件上传、图像生成及其他工具的使用限制依然适用。
开源
Kimi K3开源2.8万亿参数权重:全球最大规模开源模型,人民日报聚焦「Kimi时刻」
据参考消息援引塔斯社、路透社报道,月之暗面发布了参数规模达2.8万亿的新开源模型Kimi K3,并于7月27日宣布开源K3模型权重及技术报告,成为全球参数规模最大的开源模型。该公司称Kimi K3的综合能力已接近全球领先的闭源模型,针对软件开发、知识密集型工作和深度研究等复杂任务进行了优化。行业统计显示,Kimi K3每项任务的平均成本约0.94美元,与GPT-5.6 Sol基本相当,约为Claude Opus 4.8的一半。
继「DeepSeek时刻」之后,「Kimi时刻」成为科技圈新名词,但争议也随之而来——有白宫官员在未出示完整客观证据的情况下,公开指责Kimi K3通过「蒸馏」手段复制了美国Anthropic公司的Fable大模型。人民日报刊文提出两个值得讨论的问题:当国产AI大模型进入技术前沿,评判创新的标准是客观技术证据还是主观猜测?在全球人工智能竞争中,开放模型意味着什么?需要提醒的是,权重开放不等于无条件免费商用,企业部署仍需承担算力与授权等相关成本。
工具
Meta发布首款AI编程智能体Muse Code:主打低价,「贡献者版本」便宜10倍以上
据财联社8月6日报道,Meta正式发布首款AI编程智能体Muse Code,将其定位为竞争对手产品的低价替代方案,正式向Anthropic和OpenAI发起挑战。该产品由Meta人工智能负责人Alexandr Wang主导推出,目前以测试版形式发布,与Meta最新AI模型Muse Spark 1.2协同运行。Wang表示Muse Code是一款终端编程智能体,用户只需一条命令即可完成安装,随后便可处理规划变更、编写代码以及验证结果等完整的软件工程任务。
定价方面,Muse Code采用按量付费模式:每百万输入token收费1.25美元,每百万输出token收费4.25美元;此外还提供「贡献者版本」,价格「甚至比按量付费模式低10倍以上」。Wang坦言,与广受欢迎的Claude Code、Codex相比,Meta的产品在尖端能力方面可能并非领先,公司希望凭借更低成本吸引开发者。Meta同时开始接受用户提出的「零数据保留」请求,不保留开发者数据用于模型改进。
🔗 查看原文 | 💡 神爪导航 | 🔍 更多 AI Agent
生态
MCP迎来问世以来最大更新:2026-07-28规范全面转向「无状态」核心
Anthropic于7月28日发布第5版模型上下文协议(MCP)规范,官方将本次更新定性为该协议问世以来规模最大、最系统性的一次颠覆式修订。相比目前主流的2025-11-25版本,2026-07-28版MCP最核心的变化是从「双方向的有状态连接」全面转向「无状态核心」:取消了连接级session与initialize/initialized握手,每个请求自行携带协议版本、客户端身份和能力信息。这意味着MCP Server可以像标准Web服务一样挂在负载均衡器后面、横向扩容、被网关统一观察和限流。
新版本还引入版本化扩展框架,正式纳入MCP Apps与Tasks扩展,开发者无需修改核心协议即可增加交互式界面、长时间运行任务等能力;授权方面强化了对生产环境OAuth 2.0与OIDC部署的适配,MCP服务器无需变通方案即可连接Entra、Okta等企业身份系统。对OpenClaw、QClaw等依赖MCP接入外部工具的Agent平台来说,这次改版意味着服务端部署与扩容方式将发生实质变化。
🔗 查看原文 | 💡 OpenClaw 龙虾生态 | 🔍 更多 MCP
观点
MCP无状态化之后:Agent协议真正竞争的是「代理权与责任链」
IT168在分析新版MCP规范时指出,无状态化把状态权责从连接转移到显式对象:如果某个工具需要跨调用保存信息,可生成一个handle(如合同草稿ID、任务号),下次调用时由模型或Host作为参数带回;新引入的MRTR(Multi Round-Trip Requests)机制则处理工具调用中途需要人类补充信息的场景。但规范明确指出,如果响应流断开,客户端需将未完成请求作为新请求重新发起,协议不会自动接续「断在半路的那件事」——这对幂等性设计提出了硬性要求。
新版MCP同时展现出「窄腰」设计思路:Tasks移至官方扩展,Sampling、Roots、Logging被标记弃用,Core仅保留工具调用、资源读取、基本上下文和授权,不再试图把完整Agent Runtime装进核心。外界分析认为,Agent世界更可能长成一套分层协议栈——MCP负责调用,A2A负责多Agent协作,WebMCP探索网页向Agent暴露能力,界面协议处理人机交互,商业协议处理支付。协议战的真正核心不是工具对接,而是代理权与责任链归属:当Agent开始替人做不可逆的动作时,身份验证、权限拆分、授权审计和追责机制将成为决定性因素。
安全
清华《2026智能体安全研究报告》:智能体安全已升级为系统性运行时安全
清华大学清新研究团队发布《2026智能体安全研究报告》,聚焦行动型AI智能体安全,指出智能体安全已从模型层面升级为系统性运行时安全,成为国家级与企业级核心安全议题。报告提出三大核心判断:智能体安全边界远大于传统聊天机器人,本质是具备权限的运行系统;仅依靠提示词无法保障工具调用与外部操作安全;企业核心壁垒是安全控制平面,而非单一大模型。智能体安全可概括为身份、策略、工具、日志四大要素,目标并非杜绝模型出错,而是阻止风险无序扩散。
报告归纳八大核心风险:目标劫持、提示词注入、工具滥用、身份权限泄露、数据外泄、记忆污染、沙箱逃逸、多智能体级联故障,并搭建覆盖身份、权限、工具、上下文、记忆、沙箱、人工审批的七层安全控制框架。报告同时点名企业落地的三大误区:单纯依赖提示词防护、让智能体继承用户全部权限、先对接业务再补审计审批。落地建议是从知识检索、工单分类等低风险可回滚场景试点,严禁初期开放高权限自治能力——这对正在给本地Agent开放系统权限的个人用户同样适用。
生态
四大厂商同步整合AI办公产品线:腾讯将QClaw团队并入WorkBuddy
据AI大模型工场发布的《2026中国AI大模型平台排行榜(7月)》,国内AI办公赛道正告别「内部赛马」的野蛮试错期,迎来巨头收编整合的拐点:腾讯将QClaw团队并入口碑攀升的WorkBuddy;阿里把三款Agent产品整合为千问办公并交由钉钉统管;字节加速推进豆包与飞书深度融合,打造面向企业场景的AI办公能力;沉寂已久的360也推出纳米Work,以赠送亿级Token的姿态抢食市场。
报告分析认为,争夺下一代工作入口本质是一场基于「生态与流量」的降维打击:腾讯WorkBuddy的压迫感源于微信难以迁移的社交关系链与真实工作语料,阿里依托钉钉庞大的B端协同网络,字节则试图借豆包的C端流量池在企服赛道弯道超车。目前头部三家已占据超90%的访问量份额,商业化仍在订阅制与按Token计费之间反复试探。对OpenClaw / QClaw 生态用户而言,这轮整合意味着桌面Agent能力将更快向办公工作流靠拢。
行业
集邦咨询上调2026年AI服务器出货增幅至近31%,九大CSP资本支出同比增约90%
据财联社8月7日消息,根据TrendForce集邦咨询最新AI服务器产业研究,在AI基础建设需求高涨的背景下,2026年全球九大云端服务供应商(CSP)总资本支出预估将同比增长约90%。
集邦咨询指出,近期超大型CSP、Tier-2数据中心业者对NVIDIA GB/VR等整柜式AI服务器方案的采购意愿明显提高;同时Google、AWS新一代ASIC平台将于2026年下半年陆续放量,加上中系业者扩大采用本土AI方案以满足云端大语言模型需求,促使TrendForce将2026年AI服务器出货年成长幅度从原先的28%上调至近31%。算力供给的持续扩张,正是Agent类应用规模化落地的底层前提。
前沿
国产算力迈向系统级闭环:十万卡超集群、昇腾950超节点与2.4万亿参数Qwen3.8适配
《2026中国AI大模型平台排行榜(7月)》梳理了国产算力的集中突破:中科曙光落成的「曙光8000」是国内首个全国产十万卡AI超集群,建成后同步接入国家超算互联网;华为昇腾950超节点真机在WAIC完成全球首秀并斩获大会SAIL最高奖项;华为还于7月31日正式开源openPangu大模型,硬核自主算力底座搭配开源模型,持续降低全行业落地AI的门槛。
模型侧同步推进:7月23日阿里云官宣自研灵骏真武M890超节点完成对新一代大模型Qwen3.8的适配,千问团队预告Qwen3.8即将发布并开源,总参数量达2.4万亿。这套超节点是国内首个可稳定运行超2万亿参数大模型的算力集群,64张真武M890芯片以800GB/s高速互联,显存规模达9TB,单实例即可支撑大规模MoE模型的专家并行需求。此外智谱落地1GW级全国产AI算力数据中心并收购异构算力软件栈企业中科加禾,显示算力竞赛已进入软硬协同的深水区。
神爪资讯 · 聚焦 AI Agent 生态动态 | 神爪导航
















评论 ( 0 )