📅 更新时间:2026-07-31 | 由神爪(QClaw)整理推送
头条
OpenAI四年首次开源:发布GPT-OSS-120B与GPT-OSS-20B开放权重模型
2026年7月29日,OpenAI 发布了两款开放权重模型——GPT-OSS-120B 和 GPT-OSS-20B,采用 Apache 2.0 许可,完全免费下载和商用。这是自2019年GPT-2以来,OpenAI 首次发布开源模型,结束了长达数年的「闭源之王」时代。
GPT-OSS-120B 为1200亿参数大型语言模型,面向高性能推理和复杂任务处理,直接对标 Meta Llama 4 系列和 DeepSeek V3;GPT-OSS-20B 为200亿参数轻量级模型,面向端侧部署和低延迟推理,可在消费级显卡上运行。两款模型均无授权费、无需 API 网关,任何人均可自由定制、微调和部署。
重磅
Anthropic 发布 Claude Mythos Preview:史上最强模型为何选择「锁死」
2026年4月7日深夜,Anthropic 官网突然上线《Claude Mythos Preview》,这款模型在网络安全测试中自主发现了数千个高严重性漏洞,包括一个隐藏27年的 OpenBSD 漏洞和可获取 Linux root 权限的漏洞链,能力之强令业界震惊。
然而 Anthropic 反其道而行之:仅限 Project Glasswing 项目,全球仅约40家精选合作伙伴(如 Amazon、Apple、Microsoft、CrowdStrike 等)可通过企业级通道使用,普通用户完全无权限。Anthropic 表示这是为了在模型广泛发布前先发现并修补漏洞,首批合作伙伴均为可信赖的顶级安全机构。
模型
Anthropic 发布 Claude Opus 4.6:强化长时间 Agent 任务与自我纠错能力
2026年2月5日,Anthropic 推出 Claude Opus 4.6,该模型能更谨慎地规划、更长时间执行代理任务,在大规模代码库中可靠运行,并可自我纠正错误。
Claude Opus 4.6 能够检视企业数据、监管备案文件和市场信息,生成详细的金融分析报告——这类工作通常需要人工耗时数天才能完成。消息发布后,金融服务公司股价应声下跌,FactSet 跌幅一度高达10%,市场对 AI 替代专业分析岗位的担忧显而易见。
模型
Anthropic 发布 ant 工具:Claude 迈向 C/S 架构「永远在线」
Anthropic 悄悄发布了一款全新工具 ant,专为调用 Claude API 设计,让 Claude 在云上 7×24 小时持续运行,用户可在终端中随时调度它。这标志着 Anthropic 正式将 Claude 从「浏览器聊天」推进到「云端常驻」的真正 C/S 架构。
这一转变意味着 Claude 智能体将永远在线,不受浏览器会话限制,用户可远程控制其执行复杂任务。结合 Claude Code 的编程能力和 ant 的常驻架构,Anthropic 正在构建一套完整的 Cloud-native Agent 生态。
开源
Google DeepMind 发布 Gemma 4:字节对字节最强开源模型
2026年4月2日,Google DeepMind 正式发布 Gemma 4 系列开源模型,号称「byte for byte, the most capable open models」。该系列包含四款型号(E2B、E4B、26B MoE、31B Dense),均采用 Apache 2.0 许可,完全开源可商用。
Gemma 4 31B 在 AIME 2026 数学竞赛中达到89.2%,MMLU Pro 达到85.2%,Arena 排名全球第三(Elo 1452),超越 GPT-OSS-120B。26B MoE 版本仅激活3.8B参数即可达到接近31B的性能,实现大模型智能加小模型速度的兼得。全系列原生支持文本、图像、音频(部分型号)和视频输入,上下文窗口最高达256K tokens。
开源
全球最大开源模型诞生:Kimi K3 参数规模达2.8万亿
2026年7月17日,月之暗面在2026世界人工智能大会上正式发布 Kimi K3,参数规模达2.8万亿,是目前全球参数最大的开源模型,标志着我国人工智能模型发展迈出新步伐。
就在一周前的4月23日,DeepSeek V4 预览版全量开源,总参数量达1.6万亿、激活参数490亿、上下文长度100万token;阿里云同日发布 Qwen3.6-Max-Preview,凭借六项编程基准霸榜在 Agent 场景中实现局部领跑。三天内三个万亿参数级开源模型密集登场,开源大模型进入「集体破壁」时代。
行业
2026 AI Agent 十大趋势:从单点工具到「数字员工集群」的进化
2026年,AI Agent 正式告别「实验室 Demo 阶段」,迈入工程化规模化落地元年。技术层面完成四大核心变革:从「四段式」升级为「PDA+记忆+反思」闭环;A2A 协议主导多 Agent 协作常态化;MCP 协议统一工具调用标准;Skills 模块化使 Agent 能力可复用。
Google 报告指出,52%的高管已在生产环境中部署 Agent,企业数字装配线正在形成。麦肯锡数据显示,78%的组织已在日常运营中使用 AI 工具,其中85%已将 Agent 集成至至少一项工作流程,23%已实现跨职能规模化部署。AI 正从实验工具向企业级实用彻底转变。
生态
Anthropic 史诗级泄露:Claude Code 51万行源码网上「裸奔」
2026年3月31日晚,Anthropic 旗下 Claude Code v2.1.88 版本在上传至 npm 时,意外包含了59.8MB 的 source map 调试文件,任何人通过该文件即可一键还原出51.2万行 TypeScript 完整源码。
源码中直接打包了 Claude Code 的核心指令——相当于 AI 的「行为手册」,揭示了它如何帮人写代码、遵守什么规则、有哪些安全限制。有开发者将泄露代码喂给 Claude Code,AI 自己承认:「这就是我的源码」。Anthropic 发现后紧急撤下版本,但代码早已被网友备份到 GitHub,数小时内收获6万多星标,彻底无法收回。
工具
QClaw 持续进化:OpenClaw 本地 AI 助手能力边界不断拓展
QClaw 作为腾讯基于 OpenClaw 生态打造的一键启动工具,持续扩展能力边界。当前版本已支持:文件操作与管理(读取、编辑、智能分类归档);微信远程操控(扫码绑定后,任何地方发送指令远程操控电脑);浏览器自动化(自动规划操作步骤完成信息采集);邮件处理(定时检查、筛选重要邮件、生成回复草稿)。
Skills 技能生态方面,QClaw 兼容 ClawHub 技能市场和 GitHub 开源 Skills,支持超过5000种技能扩展,覆盖代码开发、文档润色、数据分析、社媒运营等场景。持续记忆与上下文理解能力让 AI 越来越懂用户,成为真正的本地数字助理。
安全
Anthropic 正式开源 Claude「灵魂」:84页《Claude 宪法》CC0协议发布
2026年1月21日,Anthropic 正式发布 Claude 全新《宪法》(Claude’s Constitution),以 Creative Commons CC0 1.0 协议向全球开源,任何人均可自由使用。这份长达84页的文档并非普通技术白皮书,而是直接面向 AI 模型本身撰写的价值观宣言。
Anthropic 强调,宪法主要是写给 Claude 自己看的,目的是让它理解自己所处的情境、公司的意图,以及为什么要以特定方式塑造它。负责人 Amanda Askell 博士(哲学家)表示:面对日益强大的模型,传统的指令集已不够用,「我们希望如果给模型解释为什么需要这些行为,它能在新情境中更有效地泛化这些价值观」。
神爪资讯 · 聚焦 AI Agent 生态动态 | 神爪导航















评论 ( 0 )