导语

七月的AI圈,热浪一波接一波。2026世界人工智能大会(WAIC)在上海刚刚落下帷幕,29国签约成立世界人工智能合作组织(WAICO),中国为全球南方打开了AI治理的大门。与此同时,国内大模型赛道硝烟四起:Kimi K3以2.8万亿参数登顶全球最大开源模型,却因用户暴涨三天即触发算力告急;DeepSeek V4祭出峰谷定价,把性价比卷到了极致;阿里千问Qwen3.8携2.4万亿参数紧随其后。海外方面,GPT-5.6 Sol正式亮相,日本联手NVIDIA开建全球首个国家级AI基础设施。以下为你逐条拆解。


一、WAIC 2026圆满闭幕:29国签约成立WAICO,全球南方有了AI治理”入场券”

7月17日至20日,2026世界人工智能大会暨人工智能全球治理高级别会议在上海召开。本次大会最重磅的成果是:7月16日,29个国家签约成立世界人工智能合作组织(WAICO),总部常设上海,创始成员以全球南方国家、中亚及上合组织成员为主体。

与此同时,中国国家发展改革委发布了《人工智能合作发展行动计划》,从数据、算力、生态、赋能、人才、规则、治理和伦理八个维度提出”八项行动”——优质数据供给、智能算力普惠、开源生态共享、AI深度赋能、数智人才共育、规则标准共建、安全治理协作、AI向善。

大会发布的《主席声明》达成了15条共识,首次将”词元经济新模式”和”探索共同构建人工智能国际经贸规则”写入正式文件,并将治理对象从”模型”拓展到”智能体”。

探索者视角:这次大会的意义远不止一场行业峰会。过去全球AI治理的话语权集中在美欧,”安全优先、价值观准入、俱乐部式协商”的门槛让大多数发展中国家望而却步。WAICO的成立,本质上是在AI治理领域搭建了一个以需求为导向、以平等参与为原则的新平台。中国提出的八项行动直击全球南方”高端算力买不到、本土语料训不起、监管规则写不出”的三大痛点。当Token计价和智能体服务贸易成为AI经济的新形态,南方国家能不能在新的经贸规则中占有一席之地,直接决定了”普惠”二字的成色。


二、Kimi K3:全球最大开源模型,发布三天算力告急

7月16日,月之暗面正式发布Kimi K3大模型。总参数规模冲到2.8万亿,是目前全球参数最大的开源模型,全系标配100万token上下文窗口,原生支持多模态视觉理解。

技术上搭载KDA混合线性注意力机制,靠稀疏专家框架控制推理成本。官方坦承综合能力仍落后于Claude Fable 5与GPT-5.6 Sol,但已稳定领先其余主流大模型。K3一经发布即登顶全球代码评测榜,被业内称为”中国的Fable 5时刻”。

然而戏剧性的一幕来了——发布仅三天,7月19日,月之暗面紧急暂停C端新用户订阅,优先保障存量用户体验。原因简单粗暴:用户量暴涨,算力撑不住了。

探索者视角:Kimi K3的算力告急本质上是个”幸福的烦恼”,但它暴露了一个被行业反复讨论却始终未能解决的结构性问题:开源超大模型的推理成本谁来买单?2.8万亿参数意味着即使是稀疏激活,单次推理的算力消耗依然惊人。月之暗面敢于开源这个量级的模型值得尊敬,但算力瓶颈说明”开放权重”和”可持续服务”之间还有很长的路要走。未来开源模型的商业模式,可能需要更精细的分层策略——轻量版免费开放引流,旗舰版API收费维持运营。


三、DeepSeek V4:峰谷定价卷出新高度,百万token上下文全面开放

DeepSeek V4正式版被曝已完成”满血”实测,最早于7月20日全量上线。V4系列分为V4-Pro(1.6万亿参数,激活约490亿)和V4-Flash(2840亿参数,激活约13亿),全系支持100万token超长上下文,最高输出约384K token,MIT许可开源。

性能层面,正式版推理计算量仅为前代V3.2的27%,显存占用降至前代的10%——这个优化幅度堪称惊艳。更狠的是商业策略:DeepSeek在国内大模型行业率先推出峰谷分时定价,高峰时段价格为平时两倍,平峰时段API价格仅为海外同级闭源模型的约七分之一。

探索者视角:DeepSeek的峰谷定价是一个极具行业洞察力的创新。AI推理的算力需求天然具有波峰波谷特征(白天办公高峰、夜间科研高峰),传统统一定价导致算力资源在低谷期大量闲置。分时定价本质上是把电网的削峰填谷逻辑引入AI算力调度,让对价格敏感的开发者可以将批量推理任务挪到平峰时段,既降低了用户成本,又提高了算力利用率。这种”技术降本+商业创新”双轮驱动的打法,让DeepSeek在参数竞赛之外找到了一条差异化的护城河。


四、阿里千问Qwen3.8:2.4万亿参数,动态稀疏门控出战

7月19日,通义实验室放出千问Qwen3.8预览版,总参数2.4万亿,架构升级为动态稀疏自适应门控,正式版拟近期开源。千问团队给它的定位是”性能仅次于Fable 5,属于当今最强模型之列”。

与K3和DeepSeek V4不同,千问Qwen3.8选择了动态稀疏自适应门控架构——在推理时动态决定激活哪些专家,理论上比固定路由的MoE更能适配多元化的下游任务。

探索者视角:国内大模型”三巨头”的竞争格局已经非常清晰:Kimi走”最大参数+最强代码”路线,DeepSeek走”最高性价比+峰谷定价”路线,千问走”动态架构+全面能力”路线。三家在不到一周内密集发布或更新旗舰模型,说明中国大模型赛道正从”追赶”转向”并行竞争”。特别值得注意的是三家都选择了开源或开放权重,这让中国在全球开源大模型生态中的话语权迅速提升。LMArena榜单上国产模型与海外顶尖的差距正在肉眼可见地缩小。


五、GPT-5.6 Sol正式发布:OpenAI旗舰登场,三档分层策略成型

7月9日,OpenAI正式发布GPT-5.6系列,包含三档产品:旗舰Sol、中端Terra和轻量Luna。Sol搭载全新ultra多智能体模式与max推理强度,在编码、生物学和网络安全等核心基准测试中刷新纪录。定价为每百万Token输入5美元、输出30美元,定位最高端。

GPT-5.6的上线经历了颇为曲折的过程——初期受到美国商务部客户逐案审批限制,仅约20家机构获准预览,随后才逐步放开。与此同时,OpenAI将Codex与ChatGPT合并,取消Codex五小时用量限制,Codex活跃用户已达600万。

探索者视角:GPT-5.6的三档分层策略标志着OpenAI产品矩阵的成熟。Sol打品牌高度,Terra走量,Luna覆盖价格敏感场景。但真正的看点不是产品分层本身,而是”模型+提示词+工具+记忆+重试机制”的完整系统正在取代裸模型成为用户评判标准。头部模型在传统benchmark上的分数越来越接近,用户体验差异更多来自工程化的完整度而非模型能力本身。领先窗口缩短到几周甚至几天,未来用户不会只盯一个”最强模型”,而是按任务类型做多模型路由。


六、日本联手NVIDIA:全球首个国家级AI基础设施启动

7月16日,NVIDIA宣布与日本Noetra公司合作,建设全球首个国家级AI基础设施——NVIDIA Vera Rubin AI工厂。该工厂将部署13,750颗Vera CPU和27,500颗Rubin GPU,提供140兆瓦的数据中心容量。

项目获日本经济产业省(METI)支持,将为日本的FRONTia项目提供算力基础,覆盖制造、物流、医疗、电信等领域,目标开发开放多模态基础模型,支撑AI智能体、数字孪生、机器人和物理AI应用。

探索者视角:日本这次出手非同小可。140兆瓦的AI工厂在全球范围内都属于顶配级别,而且是国家级战略投资。这释放了一个清晰信号:AI基础设施正在从企业级投资升级为国家战略资产。日本选择与NVIDIA深度绑定也说明,在当前的AI算力格局下,GPU仍然是不可替代的硬通货。值得关注的是日本的定位——不是做通用聊天模型,而是聚焦制造业、机器人、数字孪生等物理AI方向,这与其产业优势高度匹配,比盲目追求”通用AGI”要务实得多。


七、智能体:从技术秀场走向产业主场

本届WAIC最显著的风向变化:往年展馆里夺人眼球的机器人特技、趣味AI互动热度褪去,大批产业从业者直奔企业展台,重点探寻技术落地和批量商用的可行路径。智能体(Agent)成为全场讨论的核心。

参展企业普遍瞄准的痛点包括:行业底层研发重复、跨场景泛化不足、规模化落地困难。多家企业展示了智能体在金融风控、工业质检、医疗辅助诊断等场景的落地案例。大会主席声明也首次将智能体纳入治理框架,提出”明确决策权限和行为边界,建立行为追溯和风险提示机制”。

探索者视角:智能体的产业落地拐点已经到来。从”能做什么”到”能稳定交付什么”,行业关注点的迁移本身就是最大的进步信号。但智能体在产业场景中的核心挑战不是技术能力,而是可靠性——一个在99%场景下表现优异的智能体,遇到1%的边缘Case就可能酿成生产事故。治理层面将智能体纳入框架非常及时,行为追溯和风险提示机制是让智能体能在金融、医疗等高合规要求行业落地的关键前提。


八、AI+医疗加速:Neko Health融资7亿美元,AI药物挺进III期临床

医疗AI赛道近期资本热度不减:

  • Neko Health(AI全身扫描)完成7亿美元融资,加速在美国市场扩张;
  • Bunkerhill Health 获5500万美元融资,推动智能体AI在医疗系统的规模化应用;
  • Insilico Medicine 的AI研发抗纤维化药物进入III期临床试验;
  • AWS GraphRAG 在药物研发中部署,将研究周期缩短87%;
  • Google DeepMind持续推进AI生物韧性(bioresilience)研究。

探索者视角:AI+医疗正在从”辅助工具”升级为”核心引擎”。Neko Health的7亿融资和Insilico的III期临床是两个重要的里程碑——前者验证了AI医疗的C端商业化可行性,后者则意味着AI研发的药物距离上市审批只差临门一脚。AWS GraphRAG将药物研究周期缩短87%的数据更为震撼,如果这个效率提升能在更广泛的药物研发管线中复现,整个制药行业的成本结构和研发周期都将被改写。


结语

2026年7月的第三周,AI行业呈现出几条清晰的平行线:治理层面,WAICO的成立让全球AI治理从”少数人的牌局”变成了”大家的圆桌”;模型层面,国产三巨头Kimi、DeepSeek、千问的密集亮剑标志着中国大模型从追赶进入并跑;产业层面,智能体走出实验室,开始接受真实场景的考验;基础设施层面,国家级AI工厂的出现意味着算力正从商品蜕变为战略资源。

这个七月还远未结束,但已经足够精彩。AI的叙事正在从”谁的模型更强”转向”谁能让AI真正为产业创造价值”。答案,正在加速浮出水面。