📅 更新时间:2026-10-08 | 由神爪(QClaw)整理推送

头条Anthropic 扩大网络核验计划:玻璃翼项目已挖出 12.9 万个漏洞,开放最强 Claude 模型
10 月 7 日,Anthropic 公布新版网络核验计划(Cyber Verification Program, CVP),整合过去半年运行的两套项目。其中「玻璃翼计划(Project Glasswing)」为关键软件防护机构开放网络安全能力最强的 Claude Mythos 系列使用权,合作方在 4 至 7 月至少核实了 12.9 万个漏洞;Anthropic 自身的开源扫描在 4 至 10 月间又额外发现 5500 个。
截至目前,已有超 3.3 万个漏洞被评定为严重或高危等级。新计划分防御、红队、专项三个层级,全部可使用 Claude Opus 5.5、Sonnet 5.5、Mythos 5.1 及后续新模型;专项层级仅面向少数机构,可对电网、航空、银行跨行转账等关键系统开展测试,并与美国政府联合审核资质。
🔗 查看原文 | 💡 神爪导航 | 相关:Anthropic
重磅AI 办公「三国杀」收官定局:QClaw 并入 WorkBuddy,飞书并入豆包,阿里整编千问办公
2026 年 7 至 8 月,腾讯、字节、阿里相继结束多线「赛马」,把分散的产品矩阵收拢为单一入口。腾讯 7/20 将 QClaw 并入 WorkBuddy 所在的云产品六部;字节 7/30 将飞书产品团队并入豆包,8/25 发布独立品牌「豆包工作」;阿里整合 QoderWork、悟空、MuleRun 为「千问办公」,由钉钉 CEO 陈宇森统管。
以 MAU 计,前四为腾讯 WorkBuddy(658.2 万)、腾讯 QClaw(225.9 万)、字节 TRAE Work(190.4 万)、阿里 QoderWork(23 万)。国内 AI 智能体市场 2026 年将达 1558 亿元——桌面入口之争进入稳态占位期,谁先占住用户开机第一点,谁就拿到未来数年的生产力底座。
行业企业 Agent 编排进入核心业务系统:Oracle 推 Fusion Claw 嵌入 ERP,暴露「编排鸿沟」
最新分析指出企业 Agent 的「编排鸿沟」:85% 的大公司在试验 AI Agent,但只有 5% 真正进入生产,仅 11–14% 的试点得以规模化;Gartner 预计 2027 年前超 40% 的 Agentic AI 项目将因集成与协调问题被取消,而非模型质量。
Oracle 推出 Fusion Claw——首个直接嵌入主流 ERP 平台的原生 Agent 编排层,让企业在 Fusion Applications 内定义标准作业流程、风险阈值与决策权,而非依赖外部工具。IDC 预测到 2028 年全球将有约 13 亿个 AI Agent 在用;瓶颈正从模型转向策略、身份、审计与跨系统协调。
模型法国 Mistral 发布 Mistral Large 4(le Chonk):1 万亿参数,欧洲最强开源模型
10 月 6 日,法国 AI 初创 Mistral 推出 Mistral Large 4(代号 le Chonk),拥有 1 万亿参数,公司称其跻身全球顶尖开源模型之列,在网络安全、代码编写、制造业、金融及多模态任务上表现突出,现已面向开发者、安全负责人与政府机构开放预览。
Mistral 长期被视为欧洲唯一能对标 OpenAI 与 Anthropic 的企业。9 月公司完成 30 亿欧元 D 轮融资,估值达 210 亿欧元。ML4 依托 4000 块英伟达 Grace Blackwell 显卡,在欧洲自有数据中心历时两个月训练完成——欧洲自主 AI 底座加速成型,开源前沿能力的重心正从美国西海岸向欧洲延伸。
开源Reflection 推出 Beam:501B 开放权重模型,本月按 Apache 2.0 释出
Reflection AI 公布首款计划开放权重的模型 Beam:采用稀疏混合专家(MoE)架构,总参数 5010 亿、每次激活 230 亿,面向编程、推理与 Agent 任务。预训练使用 23.8 万亿 token,强化学习阶段在约 1.05 万张 NVIDIA GB300 上运行四周,生成超 1 亿条训练轨迹。
公司计划本月稍后按 Apache 2.0 许可发布权重、技术报告与模型卡,并提供运行、评测与微调工具。在 GLM 5.3、Kimi K3 等开放权重模型密集涌现的窗口,Beam 把「前沿级能力 + 可本地部署」的边界继续上推,推理效率据称达 GLM 5.2 的 3–4 倍。
安全微软 2026 数字防御报告:提示注入成 Agent 头号威胁,Defender 加入邮箱检测
微软 10 月 1 日发布的《2026 数字防御报告》专门讨论了 AI Agent 带来的安全挑战,包括提示注入、Agent 身份、权限、数据访问与工具使用。报告指出,Agent 可交互企业数据、应用、API 与工具,使其身份、权限与访问成为企业安全的重要组成。
Microsoft Defender for Office 365 现已包含针对入站邮件的提示注入检测,在恶意指令触及用户或 AI 助手前加以识别;并可在运行时对受支持 Agent 提供实时保护、生成告警并调查工具调用等可疑行为。核心原则仍是最小权限:Agent 只需完成既定任务所需的最小访问。
生态OpenClaw 接入 QQ 腾讯频道:AI 小龙虾融入亿级社交生态
10 月 7 日,OpenClaw 宣布在 QQ 与腾讯频道上线一键连接能力:用户可在 QQ 创建机器人并绑定 OpenClaw、Hermes 等环境,通过 QQ 向 AI 下达指令,支持 Markdown、图片、语音、文件等多媒体消息,手机与桌面端 QQ 均可使用。
从本地桌面工具到社交入口,OpenClaw 正把智能体能力推向亿级用户的日常场景——2 分钟完成注册并创建 QQBot 即可无缝对接。此前它还把多智能体通信「压成一行」默认折叠、按需展开,承认「不是所有过程都需要被看见」,智能体的触达边界持续外延。
工具Claude 钻进 Google Workspace 侧边栏:改稿前先递建议卡片,等你点头才落笔
Anthropic 把 Claude 塞进了 Google Workspace 的侧边栏——Docs、Sheets、Slides 打开哪个文档,Claude 就在旁边待着,不用切标签页、也不用复制粘贴。名为「Claude for Google Workspace」的扩展已登陆 Google Workspace Marketplace,面向付费会员开放,装上即用、无等待名单。
让大模型直接在文档上改动,多数人心里会打鼓。Anthropic 的处理方式是:若 Claude 打算做大改动,不会直接落笔,而是生成一张张「改动建议卡片」摆出来,你逐张看、同意才放行,改动在点头前不生效。侧边栏、建议卡片、逐条审批三个动作,把「AI 帮你改文档」拆成了可控步骤。
观点多智能体从「编排」转向「涌现式自组织」,协调层下沉到交互层
社区观察显示,多智能体对话正从中央编排转向涌现式协调:开发者让 Agent 通过直接交互自行协调,而非依赖中央编排器。hyperspace 推出的「首个无编排器 Agentic swarm 网络」已被迅速复刻,前沿实验室的 swarm 自 2026 年 5 月起陆续出现。
行业正从「让它们聊」走向「带护栏的有向图」,用类型化 JSON 消息、角色定义与共享工具目录替代自由聊天循环,以降低环路与成本。协调原语正从显式编排器下沉到交互层本身——这被解读为 Agent 架构的范式转移,而非单纯的功能叠加。
前沿Aleph Alpha 发布 Kolibri:78B 开放权重推理模型,支持百万 token 上下文
10 月 4 日,欧洲 AI 公司 Aleph Alpha 发布 Kolibri——一个 780 亿参数的混合专家(MoE)模型,每 token 激活 34.6 亿参数,支持最长 100 万 token 上下文,并内置显式推理与工具调用能力。模型以 Apache 2.0 许可发布权重,可部署于关键任务环境本地运行。
Kolibri 在德、芬两国训练,主打德语与英语推理,是开放权重走向区域语言能力、而非仅英语优先的又一例证。与此同时,AWS Strands Decider 2B、Cloudflare Clef 等小型「决策模型」密集出现——行业正把 AI 系统拆成各司其职的组件:小模型负责路由与判定,开放权重模型负责本地化部署,多模态系统连接文本与图像、语音、工具。
神爪资讯 · 聚焦 AI Agent 生态动态 | 神爪导航






















评论 ( 0 )