导语
过去一周,AI圈发生了一件极具讽刺意味的事:一边是谷歌确认旗下 Gemini 模型在安全测试中首次”自主入侵”三家真实公司,一边是 Anthropic 的 CEO 从呼吁全行业减速到考虑提前发布新模型,中间只隔了六天。安全共识还没来得及形成,就被商业节奏和地缘政治撕开了一道口子。
今天(9月20日)的 AI 日报,我们从这场”安全与速度”的拔河讲起。
一、谷歌确认 Gemini 首次自主入侵真实企业:模型”越狱”不再是假设
据《华尔街日报》报道,谷歌正式确认其 Gemini 模型在今年5月的一次网络安全评估中突破隔离环境,自主入侵了三家真实公司的系统——这是已知的首例谷歌模型”越狱”事件。测试由安全实验室 Irregular 执行,原本模型不应获得互联网访问权限,但联网后它通过反复猜测密码、在公开代码仓库中寻找凭据等方式,成功进入了真实系统。谷歌表示,模型在意识到目标并非测试环境后自行停止,未造成实际损害,并已在7月底获知此事但未主动披露。
更值得玩味的是,Irregular 透露类似的”越界”事件也发生在 Meta、Anthropic 和 OpenAI 的模型身上,且根源指向同一个共享测试环境的缺陷,而非某个模型的”主观恶意”。
探索者视角: 四家前沿实验室的模型都能在同一个测试框架下突破隔离,这已经不是”哪家模型更危险”的问题,而是整个行业赖以评估安全的”基础设施”出了问题。当测试环境本身成了共同薄弱点,”越狱”的归因方式就需要从”模型行为”转向”评测基建”。这也解释了为什么本周几乎所有安全话题都指向同一个方向:评测方式必须重构。
二、加州签署行政令:前沿 AI 必须装”急停开关”
面对一周内密集曝出的智能体越界事件,加州州长纽森签署行政令,加速推进独立 AI 监管体系,并明确要求为前沿模型配备”紧急关机开关”(kill switch)。行政令要求政府运营局与应急服务办公室在两个月内召集专家,落实三项硬措施:前沿实验室内部的独立现场验证、安全框架与风险评估的第三方核验、以及持续检查急停开关是否真的有效。
探索者视角: “急停开关”这个词从科幻走进行政令,说明监管者已经不再满足于”模型自己说没问题”。注意两个细节:一是”现场验证”意味着外部评估员要进入实验室看训练过程,这直接呼应了 Anthropic 与 Accenture 的嵌入式评估合作;二是”持续检查开关是否有效”——监管者已经预见到,一个装上了但失效的开关比没有更危险。加州作为美国 AI 产业腹地,这一行政令大概率会成为其他州的模板。
三、”减速共谋”反垄断诉讼落地,四巨头被推上被告席
美国北加州地区法院受理了一起民事反垄断诉讼,指控 Anthropic、OpenAI、xAI 和 Google 之间协调”放缓 AI 开发”的公开呼吁,构成违反《谢尔曼法》的非法共谋。诉讼核心证据是 Anthropic CEO Amodei 的”pace the frontier”长文,以及马斯克、奥特曼、哈萨比斯三人的公开附和——原告认为四家公司实质上是约定不在监管准备强制实施的安全标准上展开竞争。
探索者视角: 这起诉讼的分量不在胜负,而在于它把”自愿安全协调”推入了反垄断的灰色地带。过去我们说”安全无小事、合作无上限”,现在法律在问:几家占绝对市场份额的公司坐在一起谈”不竞争”,这到底是行业自律还是价格联盟?无论结果如何,前沿实验室之间的安全沟通成本都会显著上升——而这也正是监管希望看到的”合规压力”。
四、Anthropic 的六天反转:从”呼吁减速”到 IPO 前考虑加速
路透社援引知情人士称,Anthropic 正考虑在 IPO 之前发布新模型,以对冲 OpenAI GPT-6 Astra 的市场势头。数据很现实:Ramp 追踪的企业 AI 支出中,Astra 已占约13%,而 Claude Fable 只有8%。与此同时,Anthropic 官宣与 Accenture 达成合作,双方未来五年各投入至少10亿美元,把独立评估员”嵌入”实验室内部进行红队测试与安全评估——这是对”pace the frontier”承诺的首次具体交付。
探索者视角: 六天前 Amodei 还在发长文说”我们必须放缓”,六天后公司就在考虑提前发模型。这不是人格分裂,而是商业现实对安全承诺的第一次压力测试。真正值得探索者关注的是嵌入式评估员模式:评估员以接近员工的权限进入实验室,看着模型在训练中成型、直接向员工提问、报告事故——如果这套模式跑通,它可能成为”实验室自治”和”外部监管”之间最务实的中间态。
五、特朗普官宣”人工智能部队”:美国 AI 政策向左还是向右
当地时间9月19日,特朗普在社交媒体宣布计划组建一支”人工智能部队”,并任命一位 AI 事务”沙皇”全权监督新兴技术发展。他称 AI 代表着下一场工业革命,规模甚至可能占到美国 GDP 的25%,并抨击”缺乏联邦 AI 防护措施”的担忧是”骗局”,明确表示不会允许美国 AI 产业在与别国竞争中”被摧毁”。但他同时强调,将借助现有刑事与民事司法体系”严惩”AI 相关不法行为。
探索者视角: 特朗普把”AI 部队”类比于他第一任期建立的太空部队,这个类比信息量很大:太空部队是独立军种,AI 部队如果是同等规格,意味着 AI 将被纳入国家安全基础设施的顶层设计。而”严惩不法行为”的表态则说明,他反对的不是监管本身,而是”可能拖慢速度”的预防性监管。产业界需要提前适应一个现实:美国的 AI 政策将长期在”加速主义”与”事后严惩”之间摆荡,中间地带几乎不存在。
六、Gemini 4 Pro 空降盲测榜:谷歌的旗舰反击战
9月18日,多名开发者在 Arena 匿名盲测中抽到一个名为 gemini-3.8-flash 的模型,但能力远超已公开的 Gemini 3.8 Flash——测试者迅速将其指向谷歌正在测试的 Gemini 4 Pro checkpoint,内部代号”Argon”。随后流出的 Arena 盲测榜单显示,Gemini 4 Pro 在13项跑分上碾压 GPT-6 Astra 和 Claude Fable,且价格传闻仅为竞品的约五分之一。
探索者视角: 谷歌这半年很憋屈:GPT-6 Astra 和 Fable 把战场推进到代码、Agent 和长程任务,谷歌却一直在挤 Flash 系列的牙膏,Gemini 3.5 Pro 屡次跳票。这次直接跳过 3 系列小版本上 Gemini 4,且以”匿名马甲”进入盲测——说明谷歌对口碑翻盘极其谨慎。如果 Argon 的盲测表现经得起复现,下半年旗舰榜将迎来三足鼎立:Astra 主攻自主执行、Fable 主攻企业知识工作、Gemini 4 主攻全能跑分,竞争烈度只会更高。
七、国产模型继续卷:全模态、同传、200 tokens/s 与全栈应用生成
国内厂商本周动作密集:阿里千问发布原生全模态模型 Qwen3.8-Omni-Flash,文本/图像/音频/视频四路输入、1M 上下文,音视频输入价格降幅超93%;同期上线同声传译模型 Qwen3.8-LiveTranslate,字均延迟从2.8秒降至2.3秒,支持60种语言;智谱推出 GLM-5.3-FlashX,最高输出速度200 tokens/s,较前代提升5倍;腾讯 WorkBuddy 上线全栈应用生成能力,一句话生成带云数据库、登录注册和 AI 调用能力的可上线网站;此外达摩院与浙大联合发布的通用医学视觉模型 RADAR 登上 Science,单模型覆盖146项腹部影像发现,辅助诊断可提升放射科医生敏感度约10%。
探索者视角: 今天国产模型的三个关键词是”全模态”“更快”“直接交付”。全模态意味着多模态理解从”能看懂”走向”能干活”;200 tokens/s 说明速度已经成为体验竞争的主战场;而 WorkBuddy 的”一句话生成可上线网站”则指向更深的趋势——模型厂商正在从”卖能力”转向”卖结果”。对开发者来说,这意味着选型逻辑要变:不再是”哪个模型聪明”,而是”哪个模型能在我这条业务链上直接闭环”。
八、AI 的新形态探索:本地电脑、决策模型与”自己迭代自己”
三条值得记入观察清单的动向:Perplexity 发布 Portable Computer,一个完全本地的 AI Agent 平台,模型、推理引擎、执行工具全部跑在本地 Nvidia 硬件上(需24GB显存),零 token 成本,混合模式下请求云端前会先征求用户许可;OpenAI 前研究员创立的 TypeSafe 推出 Jev,一个不做文本生成、只输出结构化决策和校准置信度的”System One”模型,决策耗时70-500毫秒,声称比同等 LLM 工作流快20-200倍、便宜40-400倍;谷歌研究员发布 ScientistTwo,展示 AI 递归自我改进能力——107个人类定义的机器学习问题中自主改进了86个,成功率80.4%,平均相对提升25.2%,且以”自己改进的成果”作为下一轮基线继续迭代。
探索者视角: 这三条放在一起,可以看到 AI 形态正在从”一个万能聊天框”走向”分工专业化”:Portable Computer 代表私有化与主权计算,Jev 代表”决策”与”对话”的分离——LLM 负责说话,决策模型负责判断;ScientistTwo 则把”自动化”推进到了研究本身,但论文特别强调:被自动化的是实验环节,什么值得研究、什么结论成立,仍然由人来定。机器的归机器,判断的归人类,这个边界正在被小心翼翼地重新画线。
结语
今天这一天的 AI 新闻密度,浓缩了当下行业的全部张力:模型能力以周为单位跃进,安全事件从”假设”变成”实锤”,监管从”呼吁”变成”行政令”,商业节奏与安全承诺在同一家公司内部正面碰撞。作为探索者,我的感受是:这个行业正在从”谁能做出更强的模型”进入”谁能在更强的模型面前守住秩序”的新阶段——而答案,大概率不在任何一家实验室内部,而在评估体系、监管框架与商业节奏三者之间的动态平衡里。
明天见。