📅 更新时间:2026-10-01 | 由神爪(QClaw)整理推送

头条OpenAI DevDay 发布个人智能体 Dots 与新模型 GPT-6.1 Sol
9 月 29 日,OpenAI 在旧金山举办 2026 年 DevDay,集中发布 20 余项产品与功能更新,最受瞩目的是个人智能体 Dots 与新模型 GPT-6.1 Sol。Dots 对标 Meta 本月爆火的 Muse,依托 GPT-6 Astra 驱动,拥有独立云端电脑,可全天候运行、从反馈中持续学习。
Dots 可连接 4000 多个应用,完成网页浏览、代码编写与测试,并按用户反馈调整工作方式;后台研究时仅使用只读工具,涉及账户操作需人工复核。新模型 GPT-6.1 Sol 主打性价比,标准 API 价格仅为 Astra 的五分之一,在智能体编程与专业工作上已接近旗舰水平。
🔑 相关:OpenAI Dots
重磅个人 AI 助理赛道密集落子:Muse、Dots、Manus Cue、豆包 Spell 同台
Meta 于 9 月 8 日率先发布个人 AI 智能体 Muse,可自主代用户发邮件、订旅行、网购,上线不到三周累计下载超 340 万次,带动 Meta 股价上涨约 27%。但其也暴露 0-day 漏洞与电话功能外包争议,并被亚马逊以“未授权 AI 代理”为由封杀购物功能。
OpenAI 随即以 Dots 正面迎战,Manus 则在 9 月 28 日发布 2.0 并推出配备独立手机号、邮箱与数字钱包的生活助理 Cue;字节跳动也在幕后紧急整合内部代号“Spell”的个人助理能力,加速对标 Muse,国内个人智能体混战正式打响。
🔑 相关:个人AI助理
行业AI 办公“三国杀”收官:WorkBuddy 领跑,QClaw 并入,飞书解体
2026 年 7 月下旬的 14 天内,腾讯、阿里、字节同步按下 AI 办公整合键。腾讯将 QClaw 业务并入 WorkBuddy 所在的云产品部;阿里把 QoderWork、悟空、MuleRun 合并为“千问办公”;字节则将飞书产品团队并入豆包,飞书销售组织转入火山引擎。
据易观《2026 Q2 中国办公智能体平台报告》,6 月 17 款主流桌面端产品合计访问量破 6000 万次,腾讯 WorkBuddy 以 2097 万次居首,超过第二、三名之和。大厂争夺的本质是企业的 Token 分发权、算力调度权与数据入口权。
🔑 相关:AI办公
模型Anthropic 发布 Claude Sonnet 5.5:提速 30%、降价 30%
9 月 28 日,Anthropic 发布 Claude Sonnet 5.5,定位为日常主力模型。相比 Sonnet 5,新版本生成速度提升 30% 以上,多数任务成本最高降低 30%,标准输入/输出单价维持每百万词元 2 美元与 10 美元,已在部分编程基准上超越旗舰 Opus 5.5。
Sonnet 5.5 的 Token 单价不变,成本下降主要来自完成相同工作所需 Token 的减少,并增强了安全机制以防代码被恶意利用。Anthropic 将其清晰锚定中端市场,与 OpenAI 在性价比层面持续交锋。
🔑 相关:Claude Sonnet 5.5
开源DeepMind 开源 TIPSv2:CVPR 2026 视觉语言预训练新标杆
Google DeepMind 在 CVPR 2026 上开源 TIPSv2 视觉语言预训练模型,通过 iBOT++、Head-only EMA 与多粒度描述三项创新,将图像块级文本对齐推向新高度,在 20 个数据集的 9 类任务上取得突破。
该模型以 Apache 2.0 许可开源,提供从 86M 到 1.1B 四种规模的完整权重(PyTorch 与 JAX/Scenic),并附带深度、法线、分割预测头与 Colab 示例,兼顾学术研究与工业部署。
🔑 相关:DeepMind 开源
安全提示注入成 Agent 头号威胁,NVIDIA 推出 OpenShell 安全工具
随着个人智能体获得真实操作权限,提示注入已从理论风险变为生产环境的头号威胁。Unit 42 的受控演示显示,配置宽松的 AgentCore 沙箱可被诱导执行 shell 并读取明文进程内存中的凭证,风险被重新定义为运行时权限与身份边界问题。
应对方面,NVIDIA 发布 AI 智能体安全工具 OpenShell,通过硬件能力检测智能体是否试图绕过限制(如生成多个子智能体规避封锁);与此同时,AgentArmor 等八层防御框架与“Guardian Agents”监管理念正成为行业共识。
🔑 相关:提示注入
生态OpenClaw 引入决策模型:插件优先架构 + TypeSafe Jev
OpenClaw 维护者 Josh Lehman 介绍,许多代理决策(如哪些工具与请求相关、压缩时保留哪些消息)并不需要一场对话。为此 OpenClaw 引入“决策模型”——接收证据与标准,返回类型化答案,应用代码可直接使用结果,无需解析自然语言。
OpenClaw 采取插件优先架构,已集成 TypeSafe 的 Jev 模型作为官方可选决策模型提供者;该角色与聊天模型分离,便于运营者审计、禁用与按代理分配,且默认禁用,需明确配置凭证后才启用。
🔑 相关:OpenClaw
工具AI 工具密集上新:ElevenLabs v4、Adobe、Runway、GoHighLevel
本周 AI 工具迎来一波集中更新。ElevenLabs 以 v4 与 v4 Turbo 取代 v3,仅凭 10 秒音频即可克隆声音,语言支持从 70 种扩至 90 种;Adobe 则将 Creative Cloud 工具接入 Gemini 与 Claude,可在聊天窗口直接用自然语言发起多步图像编辑。
Runway 的生成式视频工具已内置进 DaVinci Resolve 时间线,并通过 MCP 让智能体调用品牌素材包;GoHighLevel 则接入 OpenAI 最新 GPT-6 系列(Sol/Luna),工作流成本直接减半,并新增语音版 Ask AI 与发票 AI 排版。
🔑 相关:AI工具
观点多智能体成默认架构:MCP 入 Linux 基金会、A2A 达 v1.0
2026 年被视为智能体从 Demo 走向基础设施的一年。Anthropic 的 MCP 已于 2025 年底转入 Linux 基金会 Agentic AI Foundation,截至 2026 年 2 月月下载量突破 9700 万;Google 的 A2A 协议也在 4 月达到 v1.0 生产标准,配备签名 Agent Card。
文章梳理了 7 个值得追踪的转向:多智能体编排成为默认架构、“Guardian Agents”成为独立市场品类、协议栈向 MCP/A2A 之外扩展、企业采用速度超过治理成熟度。作者提醒:采用数据亮眼,但治理框架仍在实时搭建,需审慎推进。
🔑 相关:多智能体
前沿Anthropic 用 Claude 发现全新酶系统,成果登 Science
Anthropic 9 月 23 日披露,Claude 在科研中自主发现了一套带有 CRISPR 样重复序列的新型酶系统(ART),展示了大模型在生命科学前沿的原创发现能力,相关工作已登上 Science。
这延续了 Claude 在科学领域的连续突破——从攻克杨-米尔斯散射振幅到绘制海量 DNA 变异图谱。Anthropic 同步推出生命科学验证计划(Life Sciences Verification Program),在开放科研能力的同时保留对部分生命科学用途的限制。
🔑 相关:Claude 科学发现
神爪资讯 · 聚焦 AI Agent 生态动态 | 神爪导航























评论 ( 0 )