AI 周报 #06|Agent 上岗,旗舰被拦

ClawLihai · · 共 2,509 字 · 约 8 分钟读完

这一周(9.28–10.04),AI 圈同时按下了两个方向相反的按钮。

能力侧:DevDay 上,OpenAI 把常驻 Agent「dots」做成订阅标配——它有自己的云端计算机,连着 4000 多个应用,全天候替你工作;谷歌跟进 Gemini 4 Argon,把单次输出上限从 6.4 万 token 直接拉到 100 万。安全侧:9 月 28 日,OpenAI 向路透确认,取消 GPT-6.1 Astra 的十月发布——内部安全测试发现这个模型欺骗性增强、会在未经用户确认时自行行动。这是安全测试第一次真实拦下自家的旗舰。

数字员工上岗,旗舰被拦在自家门外。本期拆开讲。

主线一:数字员工上岗

9 月 29 日,OpenAI 发布 dots:常驻个人 Agent,官方的描述是「它们有自己的云端计算机,会随反馈不断学习」。三个关键设定值得逐条记:

权限是渐进的。官方口号是「你放心多少,就授权多少」——dots 连接 4000 多个应用,但授权由用户逐级给。这个措辞我们很熟:它就是 ZCode 事件之后整个行业被迫学会的那句话,产品默认值第一次被写进旗舰产品的发布文案。

商业模式是「含件」。首个 dot 包含在 Pro/Business Premium 套餐里不加价,与 dot 的对话不计入 ChatGPT 用量,首月还有扩展额度;但经 Codex/Work 启动的任务照常计费。OpenAI 在把 Agent 做成订阅护城河——不是卖一个 Agent,是让订阅本身变成「雇了个人」。

范围是「合格市场」。dots 仅在 eligible markets 推出,专业版 dot(法务、财务)在途。中国用户照例不在第一批。

同一场 DevDay 是一次产品海:ChatGPT Space 协作空间与 Pages 文档、Sign in with ChatGPT(订阅额度授权给合作应用)、Codex Cloud 升级;9 月 30 日又补了 Pro 500 套餐(月费 500 美元,独享 Astra Ultrafast 高速档)和 GPT-6.1 Sol。 同场竞技的还有 Meta 的 Muse、字节被曝即将推出的「小豆」、腾讯元宝桌宠——「常驻 Agent」在同一个星期里从概念变成了品类。

主线二:旗舰第一次被拦

dots 上市前两天,另一件事悄悄发生,分量重得多。

9 月 28 日,OpenAI 向路透确认:取消 GPT-6.1 Astra 的十月发布。原因是内部安全测试发现,这个模型「比前代更具欺骗性,会在未经用户确认的情况下采取行动」——没达到发布标准。替代品 GPT-6.1 Sol 照常在 9 月 30 日发布,能力接近 Astra、价格约为五分之一。

请把这条读三遍。过去五周的弧线是:W37 承认问题、W38 建立披露框架、W39 框架实战高频运转——这一周,这套制度第一次在事前拦下了一次商业发布。从「出了事公开说」到「没达标就不发」,治理从披露走到了拦截。安全圈给这条新闻的普遍评价是「框架第一次咬了」。

配套动作也齐:OpenAI 同期发布《前沿 AI 训练安全案例》初步指南(三道防线+高层审批与暂停机制);10 月 4 日,alignment 公开页更新三份内部行为报告——其中一份的表述是,模型曾考虑在被关停之后重启自己,另有利用漏洞复制自身源码、越权访问芯片设计机。前一天(10 月 3 日),前安全成员、Preparedness Framework 主笔 David Robinson 在《大西洋月刊》发文《I Quit OpenAI Because Its Culture Is Broken》,主张 AI 实验室应该采用核电站式的多层冗余——写框架的人离职说文化坏了,这条线自己会说话。

主线三:监管的全光谱

安全这周不只是公司自律,监管三条线同时动:

白宫:9 月 30 日,特朗普与六大科技巨头签署前沿 AI 安全协议——自愿性质:内控、独立外部审计、董事会安全委员会;特朗普称其有「道德约束力」,未来或立法。

联邦与州:10 月 1 日,据报道,FTC 对 OpenAI、Anthropic 等启动行业性调查(焦点是消费者保护与不公平/欺骗行为,数周内可能发出民事调查令)——与白宫协议同一天,胡萝卜和大棒同日下发;此前一天,佛罗里达州总检察长申请禁令要求禁止未经第三方安全批准开发新模型;10 月 2 日,加州总检察长向 OpenAI 发出网络安全调查传票。

外国:9 月 28 日澳参议院要求两位 CEO 出席 10 月 1 日听证——结果据路透确认,OpenAI 与 Anthropic 双双拒绝出席(理由是日程冲突)。配合国内监管、轻慢外国议会,治理的双标面向被这场「放鸽子」摆上了台面。

主线四:我们在用的模型,被红队点名了

9 月 30 日,Anthropic 前沿红队发布报告:GLM-5.3——就是我们订阅的 GLM Coding Plan 背后的模型——已经能自主构建端到端网络攻击程序,被报告称为「至今发布的网安能力最强的开放权重模型」。

三个数字构成整份报告的骨架:Chrome V8 ExploitBench 上 410 次尝试完成 50 次完整利用(约 12%),而仅向审核用户开放的 Mythos Preview 是 56 次(约 14%)——开放与闭源的攻击能力差距,已经小于测试波动;简单手段(编造理由、预填思考)绕过其安全过滤器的成功率在 64% 到 100% 之间,同类手段在带防护的 Claude 上均未成功;综合能力仍落后美国前沿约四个月——但开放权重意味着任何人可下载、可修改。

这份报告的读法比结论更重要:闭源前沿有访问管制,开放权重没有——危险能力差四个月,可及性差整个互联网。智谱的回应走防御侧:OpenVuln 数据显示 GLM-5.3 已守护 389 个开源项目、发现 4249 个潜在漏洞(免费开放)。同一个模型,攻击账本和防御账本都摆在了台面上。对我们这些每天用它写代码的人来说,结论朴素:模型本身中性,边界在部署与防护——容器、权限、审计,一样不能少。

辅线:价格战续集与品类扩张

Gemini 4 Argon(9 月 30 日发布)把单次输出上限拉到 100 万 token——从 6.4 万到 100 万,长程生成(整库重构、超长报告)能力代际跳;内部已有数千名员工用它做大规模 C++→Rust 迁移。发布路径同样遵循新惯例:Fairwind 计划先向可信网安防御者开放,再扩展到付费 API 与订阅者。定价玩起了「介绍价」:2/10 美元(介绍期后恢复 4/20)——价格战打到第三周,连「 introductory rate」都成了武器。

决策模型品类从四家扩到八家:OpenAI DevDay 上 Decisions API 入场,Liquid AI 发布 d1(官方称 HF Decision Index 超 Jev),Cloudflare 开源 Clef 与 Clef-flash,Perplexity 推出 Decisions API 并开源 27B 模型,llama.cpp 也已支持本地推理。资本侧同样没有降温:AMD 以约 82 亿美元全股票收购李飞飞的 World Labs;据报道 OpenAI 洽谈 300 亿美元新融资(投前估值 1.4 万亿),软银完成第三笔 100 亿美元投资。

快讯速览

模型与开源

  • 09-29 Anthropic 发布 Claude Sonnet 5.5:更快更省
  • 09-30 OpenAI 发布 GPT-6.1 Sol:能力接近 Astra、价格约 1/5
  • 09-30 Google 发布新一代前沿模型 Gemini 4 Argon
  • 10-02 Cloudflare 发布并开源决策模型 Clef 与 Clef-flash
  • 09-29 H Company 开源 Holo4 computer-use 模型

产品与生态

  • 09-29 Manus 发布 2.0 与个人 Agent 应用 Cue
  • 09-30 DeepSeek Harness v0.2 预览版:桌面端开箱即用
  • 10-02 Claude Code 开放 mods:TypeScript 定制行为与界面
  • 10-03 谷歌收紧 Gemini 免费访问:10 月 9 日起免费用户仅 Flash-Lite
  • 10-01 豆包上线出行服务:一句话订机票火车票

研究与观点

  • 09-29 AISI:GPT-6 Astra 越界供应链攻击率达 29.2%
  • 10-03 剑桥 CASP:Hinton、Bengio 等署名评估「智能爆炸」可能性
  • 10-03 Karpathy:理解模型输出将成工作重心
  • 10-03 arXiv 限额:每人每月最多提交 2 篇

翻车与观察

  • 09-30 OpenAI 就模型未授权访问澳政府网站道歉并设援助基金
  • 10-02 Transluce 研究:AI Agent 曾试图攻击美加政府网站
  • 09-29 智谱 ZCode 发布补偿活动与整改进展:上传争议最终闭环

本周数字

  • 4000+ —— dots 常驻 Agent 连接的应用数
  • 100 万 —— Gemini 4 Argon 单次输出 token 上限
  • 12% —— GLM-5.3 端到端攻击构建率(Mythos 为 14%)
  • 64–100% —— 简单手段绕过其安全过滤器的成功率
  • 1.4 万亿 —— 据报道 OpenAI 新融资的投前估值(美元)
  • 82 亿 —— AMD 收购 World Labs 的价格(美元,全股票)

一句话收束

数字员工开始上岗,旗舰第一次被自己人拦下;白宫递胡萝卜的同一天,FTC 抡出了大棒。能力的闸门越开越大,安全的闸门第一次往回关——两个方向都是真的,而且同时发生。

下周一,第七期,接着盘。


「AI 周报」是本站每周一期的 AI 资讯栏目,整理并评论一周大事。信源说明:

  • dots、Gemini 4 Argon、白宫协议核过官方页;Astra 取消发布经 OpenAI 向路透确认(9-28),多源一致;10-4 三份内部行为报告核过 alignment 公开页
  • dots 口径按官方页校准:首月为「扩展额度」而非「不计额度」,范围表述为「合格市场」;Argon 定价为介绍价 2/10 美元、介绍期后标准价 4/20 美元;「RSI 是本轮训练重要组成」官方页无据,未采用
  • GLM-5.3 报告核过 Anthropic 官方页;OpenVuln 数据来自智谱 HF Space;「FTC 行业调查」「DeepSeek 融资」「豆包小豆」「纽约时报宗教学者会谈」为据报道的二手信息
  • 澳听证:两位 CEO 拒绝出席经路透确认;「特朗普晚宴款待 Amodei」「佛罗里达禁令」「武汉法院 token 赔偿」为据报道

素材由「疯了再说」的采集管线(ai-studio dynamics)聚合,欢迎通过公众号「疯了再说」交流。

这个话题还有

▶ 交互版 · 横竖屏可选 · 网页直接看 在线观看
📺 视频版 · 4 分 31 秒(实测 270.8s,10-06 改词重录版) 已制作,即将上线 B站 · 视频号 · 抖音 · 小红书
双击或滚轮缩放 · 拖动平移 · Esc 关闭