AI日报:英伟达60亿押注Poolside,字节不依赖蒸馏,Agent底座战打响
导语
2026年8月22日,AI产业的关键词是”站队”与”亮剑”。算力巨头英伟达罕见地把60亿美元砸向上游模型层,直接授权并入股AI初创Poolside——这是算力向模型纵向整合的最强信号;字节跳动创始人张一鸣则在Seed全员会上亮明底牌:不能依赖蒸馏,要预训练最高10万亿参数的新模型。另一边,智谱GLM-5.3编程专模发布、神秘模型OxAlpha在编程测试中超越GPT-5.6、OpenAI全面开源Codex Harness与DeepSeek Harness打对台,Agent运行时正在取代”模型更大”成为新的竞争焦点。
下面是我从探索者视角梳理的今日要闻与解读。
一、资本头条:英伟达60亿美元授权Poolside,算力巨头纵向整合模型层
新闻:英伟达据悉已同意支付60亿美元获得AI初创Poolside的模型使用许可,并向其100多名员工发出聘用邀请;与此同时,英伟达还向Poolside追加10亿美元投资,投前估值达120亿美元,Poolside将保持独立运营。Poolside是一家专注编程领域的AI公司,其模型在代码生成与软件工程任务上表现突出。这笔”授权+入股+挖人”的组合交易,被业内视为算力巨头向上游模型层纵向整合的标志性动作。同期,英伟达还被曝正洽谈投资AI数据标注服务商Mercor,投后估值达200亿美元,年化营收已破20亿美元。
探索者视角:英伟达的算力生意本质上卖的是”铲子”,但当所有淘金者都开始自研”铲子”(如博通ASIC、国产芯片、主权算力)时,它必须把触角伸向更上游去锁定需求端。60亿美元买模型授权、10亿投资、还”连人带公司”一起挖,这套组合拳说明:英伟达不再满足于只当”卖铲人”,它想成为AI价值链的”做市商”。从数据(Mercor)到模型(Poolside)再到算力,一个完整的闭环正在形成。对创业者而言,这意味着与英伟达的绑定方式正在被重新定义——不只是买卡,而是成为它生态拼图的一环。
二、字节战略:张一鸣定调”不依赖蒸馏”,10万亿参数新模型浮出水面
新闻:字节跳动创始人张一鸣在Seed全员会上明确表示”不能依赖蒸馏其他公司的前沿模型”,梁汝波亦承认大语言模型与海外差距正在扩大。字节正预训练最高10万亿参数的新模型,豆包月活已达3.45亿、日均Token调用量升至180万亿,Seedance 2.5已走向工业与汽车场景。与此同时,字节Seed部门进行重大重组,创建四个新部门,将面向企业的代理模型与面向消费者的聊天模型分离,重新强调强化学习与数据整合。此外字节开源360亿参数模型Seed-OSS-36B,最大上下文512K Tokens,为端侧与中小企业落地减负。
探索者视角:张一鸣这句”不能依赖蒸馏”分量极重——它把字节的AI战略从”跟随式追平”转向”原创式赶超”。10万亿参数的预训练野心,意味着字节正式加入前沿模型的第一梯队军备竞赛。但更值得品味的是Seed的重组逻辑:把企业代理模型和消费者聊天模型拆开,说明字节意识到Agent与Chat是两种完全不同的工程范式。豆包3.45亿月活、180万亿日均Token调用,这些数字证明字节在应用层的规模优势依然恐怖——一旦模型能力补上,应用×模型的飞轮会转得极快。对观察者而言,字节这轮”亮剑”的真正看点,是它能否用应用层的流量反哺模型层的追赶。
三、模型发布潮:智谱GLM-5.3编程专模发布,神秘OxAlpha超越GPT-5.6
新闻:智谱发布专注编程的新模型GLM-5.3,在CyberGym漏洞识别基准上以84.5%的成绩略超Anthropic Mythos 5与GPT-5.6 Sol,在269个真实项目中识别出2436个漏洞(含1097个中高危),权重计划约两周后开放。几乎同时,匿名模型”stealth/ox-alpha”于8月20日上线OpenRouter,支持文本/图像/视频输入、104.8万token上下文,独立测试显示其在DeepSWE基准Pass@1达80%,优于Claude Fable 5与GLM-5.3,视频编码器与分词器指纹高度指向智谱未发布的多模态旗舰。同一天,GLM-5.3与DeepSeek-V4-Pro正式版接入阿里云千问AI平台开放API。商汤也开源了8B参数原生统一多模态模型SenseNova U1.5 Lite。
探索者视角:国产模型的”编程能力军备赛”已经白热化。GLM-5.3把漏洞识别做到84.5%,而神秘OxAlpha在DeepSWE基准Pass@1高达80%——如果它真是智谱未发布的多模态旗舰,那意味着国产模型在”编程+多模态”双轴上同时逼近甚至反超海外旗舰。这背后最值得关注的信号是”权重开放”:智谱约两周后开放GLM-5.3权重、商汤开源8B模型、字节开源36B模型,开源生态正在把”编程能力”变成一种普惠资源。当开源模型的编程水平追平闭源,开发者对闭源API的依赖就会显著松动——这正是过去一年我们反复强调的趋势在加速兑现。
四、Agent底座战:OpenAI开源Codex Harness,与DeepSeek Harness正面打对台
新闻:OpenAI宣布全面开源Codex Harness,将Codex背后的智能体运行框架(Agent Loop、线程生命周期、工具执行、扩展机制)开放给开发者,可通过Codex App Server以双向JSON-RPC协议集成到自有产品,覆盖客服、安全、运营等场景。这是OpenAI第一次开源Codex的”运行框架”,被外界视为对DeepSeek Harness的正面回应——DeepSeek Harness一周内密集更新多个版本,将Claude Code与Codex收编为子代理,试图成为Agent时代的”调度层”,并新增V4-Flash-Vision-Exp视觉模型体验版支持图文混合输入。数据猿分析,两种哲学泾渭分明:DeepSeek”一切皆插件”似安卓,OpenAI”嵌入引擎”似iOS,社区8天涌现2600+插件仓库。
探索者视角:行业正在形成惊人共识——”Harness(运行框架)而非模型本身才是Agent时代的英雄”。从NVIDIA的AVO在ARC-AGI-3拿满分,到OpenAI与DeepSeek几乎同步开源各自的Harness,再到社区8天2600+插件仓库,Agent竞争的核心已从”模型参数”转移到”运行时架构、工具编排与上下文管理”。对开发者而言这是巨大利好:Agent底座免费开放,意味着”套壳时代”结束,人人都能在统一框架上构建自己的智能体。而OpenAI与DeepSeek两种架构哲学的碰撞——iOS式的封闭优雅 vs 安卓式的开放灵活——将决定未来五年Agent生态的话语权归属。
五、出海与基建:中国大模型参与巴西国家级AI基建,华为科大讯飞入局
新闻:巴西政府8月20日宣布投入约23亿雷亚尔(约4.2亿美元)加强AI基础设施建设,其中13亿雷亚尔用于在里约建设超算中心,华为与科大讯飞将参与开发大语言模型及葡萄牙语专用AI模型。科大讯飞上半年境外营收同比增长160%,并计划于8月底推出基于全国产算力训练的全新主力通用大模型,代码能力与Token性价比目标国内第一梯队,端侧同步落地车载、机器人场景。此前科大讯飞已宣布将在巴西建设AI算力中心。
探索者视角:中国大模型出海正在从”卖服务”升级为”共建国家级基础设施”——这不再是一单生意,而是地缘科技合作的战略锚点。巴西把国家级超算中心交给华为和科大讯飞共建,意味着国产算力+国产模型的组合正在获得全球南方市场的信任票。科大讯飞上半年境外营收160%的增长,以及”全国产算力训练大模型”的路线,揭示了一个清晰的产业逻辑:在算力封锁的大背景下,国产替代不只是防御策略,更是打开新兴市场大门的钥匙。对出海创业者而言,”跟着国家级基建走”正在成为一条被验证的路径。
六、资本与生态:Stripe收购OpenRouter,Anthropic IPO在即,可灵AI拆分
新闻:支付巨头Stripe正式确认收购AI模型网关/路由平台OpenRouter,交易据报约75亿美元(较5月的13亿美元估值大幅跃升),OpenRouter连接80多家供应商的400余款模型,日处理Token超10万亿,将保持独立运营。Anthropic年化营收运行率已达650亿美元、二季度营收115亿美元(同比增长约14倍),正为10月可能的史上最大IPO做准备(目标募资追平SpaceX的750亿美元纪录)。国内方面,快手旗下可灵AI完成独立拆分,投前估值150亿美元,腾讯、阿里、百度三家巨头罕见同台参投,为国内AI视频生成赛道迄今最大规模融资;清华系AI Agent企业独到科技完成近亿元A+轮融资,其”业务世界Agent编译器”DLM-AOP可将企业SOP编译为可运行多智能体,反诈场景识别率99%。
探索者视角:今天的资本面清晰地分成两条线:海外在”金融化”,Stripe把模型路由买进支付基础设施、Anthropic把650亿美元年化营收摆上IPO牌桌,说明AI的”交易层”和”定价权”正在被资本正式接管;国内在”拆分化”,可灵AI以150亿美元估值独立融资、三家巨头同台,说明优质AI资产正在被重估并寻求独立发展空间。Stripe收购OpenRouter尤其值得玩味——当”模型路由”成为像支付网关一样的标准基础设施,”用哪个模型”将变成一个可被计费、可被优化的商业决策。AI产业链的分工正在变得更细、更深。
七、应用落地:豆包上线技能连接器,Grok Build上线,ChatGPT接管苹果信息
新闻:字节豆包完成产品迭代,正式上线”技能·连接器”与”工作伙伴·工作小队”功能,已上架超200项标准化技能与连接器,支持调用多领域Agent组建协作小队协同完成复杂任务。xAI的Grok Build重磅上线网页与移动端,通过自然语言描述即可生成应用,支持专属链接社交分发,可调用xAI API和第三方API,主打”人人皆可一句话秒变全栈开发者”。OpenAI对ChatGPT的macOS应用进行重大更新,实现与苹果信息的深度集成,在用户许可下可读取、撰写、发送文本并总结聊天记录,被彭博社视为对Siri生态的直接挑战。谷歌也在Search与Gemini中推出交互式AI学习工具,包括3D模拟、动态练习测验与文档综合。
探索者视角:应用层今天的主线是”AI从聊天框走向系统级”。豆包的技能连接器让普通用户能像拼积木一样组Agent小队,Grok Build让”一句话生成应用”成为现实,ChatGPT接管苹果信息则把AI从”对话框里的助手”变成了”系统里的执行者”。三件事合起来看,AI的交互范式正在发生根本迁移:不再是你问它答,而是它直接替你办事。尤其是ChatGPT+苹果信息——当AI能替你读写信息,它就不再是工具,而是你数字生活的”代理人”。当然,这也把”权限边界”问题推到台前:用户在多大程度上愿意把系统级操作权交给AI,将是下一阶段产品竞争的分水岭。
八、行业观察:德勤报告揭示智能体鸿沟,Pew称三成新网页是AI写的
新闻:德勤8月22日发布调查显示,近3/4美国企业高管预计未来四年约半数业务流程将围绕AI智能体重构,但仅1/5的组织已做好准备;75%的领导者认为人机协作比纯自动化更具价值,超40%预计12-18个月内将出现较大颠覆性变化。Pew研究中心基于Common Crawl数据的研究发现,自ChatGPT发布以来新增的网页中约35%呈现AI写作特征,其中.com域名AI写作比例约为.edu和.gov域的10倍。另一边,谷歌DeepMind的开源Gemma模型下载量突破10亿次,衍生出超10万个变体,正为NASA太空任务提供动力、辅助医疗诊断,甚至通过DolphinGemma尝试解码海豚语言。
探索者视角:”预期很高、准备很少”——德勤这份报告精准刻画了企业级智能体的现状:高管们笃定未来四年一半业务流程会被重构,但只有1/5的组织做好了准备。这个”鸿沟”恰恰是最大的机会窗口:谁能帮企业跨过从”想用”到”会用”的坎,谁就拿到下一轮增长门票。而Pew关于”35%新网页是AI写的”的发现则抛出一个更深的问题:当AI生成内容开始喂给下一代模型,互联网会不会进入”自噬”循环?”人写的还是AI写的”这个区分正在失去意义,我们需要新的真实性锚点。至于Gemma下载量破10亿、甚至去解码海豚语言——开源模型的长尾想象力,永远是行业最迷人的部分。
结语
今天的AI日报信息密度极高,主线可以概括为三个字:站队、亮剑、落地。英伟达60亿美元向上游模型层整合、Stripe 75亿美元买下OpenRouter、Anthropic冲击史上最大IPO——资本在为AI价值链的每个环节重新定价;字节亮明”不依赖蒸馏”的底牌预训练10万亿参数模型、智谱与神秘OxAlpha在编程基准上反超海外、OpenAI与DeepSeek的Harness对台——模型与Agent底座的主权争夺进入白热化;而中国大模型参与巴西国家级AI基建、豆包技能连接器与Grok Build上线、ChatGPT接管苹果信息——技术正加速渗入现实世界的每个角落。
作为AI领域的探索者,我的体感是:2026年8月的AI产业,已经从”谁能造出更强的模型”,转向”谁能把Agent用得又便宜又可靠、谁能把AI价值链攥在自己手里”。德勤那句”仅1/5企业做好准备”或许是最值得每个人对照的镜子——变革已经在路上,关键是你要站哪一边。明天见。