🔥新品
GPT-5.6正式发布:Sol/Terra/Luna三档齐发,Ultra模式驾驭64个子Agent
7月10日,OpenAI正式发布GPT-5.6,分Sol(旗舰)、Terra(平衡款)、Luna(快速低价)三档。旗舰版Sol在Agents' Last Exam上以53.6分刷新纪录,比Claude Fable 5高出13.1分;代码能力在Artificial Analysis AI Index上完成任务时间少61%、成本约为一半;OSWorld 2.0上达到62.6%超过Claude Opus 4.8。新增Ultra模式默认协调4个Agent同时工作、可扩展至16个;新增Programmatic Tool Calling支持模型自写程序协调多工具。定价:Sol输入$5/输出$30(每百万token),Luna仅$1/$6。
🔄竞争
GPT-5.6发布后,Anthropic连夜重置Claude Fable 5用户使用额度
在GPT-5.6发布的同日,Anthropic宣布重置所有Claude Fable 5订阅用户的使用额度。此前用户大量反馈Fable 5额度消耗过快。此举被业界解读为Anthropic对GPT-5.6的竞争反应。GPT-5.6 Sol在多项基准测试上已超越Fable 5,包括Agents' Last Exam高出13.1分、OSWorld 2.0高出Claude Opus 4.8且输出token减少85%。
🤖开源
蚂蚁灵波发布行业首个具身原生预训练模型LingBot-VA 2.0
蚂蚁灵波发布全球首个具身原生的预训练VA基座模型LingBot-VA 2.0。其核心采用因果DiT+稀疏MoE架构(总参13B,推理时仅激活1.9B),双臂任务成功率93.6%,单GPU推理可达150Hz,异步控制频率225Hz。相比前代LingBot-VA在RoboTwin 2.0基准上从92.2%提升至93.6%,全面超过π0.5、Motus等基线。模型从第一天起用因果架构从零训练,配合Foresight Reasoning异步推理机制实现预测-执行-纠偏闭环。
📱产品
第二代"豆包手机"曝光,字节跳动持续加码AI终端
字节跳动旗下第二代「豆包手机」被曝光。这款被称为「全球首款AI智能体手机」的产品在初代基础上进行了全面升级。据悉,豆包手机内置了字节自研的豆包大模型,主打AI智能体体验。这是字节跳动在AI硬件领域的重要布局,继初代产品后的又一次迭代。
⚡诉讼
苹果正式起诉OpenAI,指控系统性窃取硬件机密
当地时间7月10日,苹果向法院正式起诉OpenAI,指控其通过招募前苹果员工窃取公司机密。诉讼指出前苹果高级电气工程师Chang Liu离职后仍通过保留的公司笔记本电脑读取内部文件。苹果点名OpenAI首席硬件官Tang Tan(前苹果高管),称OpenAI已有超过400名前苹果员工,指控这是一套系统性的情报获取机制。此举被视为双方从2024年ChatGPT集成合作破裂的标志性事件。
🏛️战略
智谱创始人唐杰发内部信:押注长程任务与自治智能体,市值已超万亿港元
7月11日,智谱创始人唐杰发布题为《巨浪已来》的内部信。智谱过去半年市值较上市初期涨10倍,2026年6月跻身万亿港元俱乐部,超过小米、接近百度3倍。GLM-5.2已追平甚至超过Claude Opus 4.8和GPT-5.5。MaaS平台ARR达17亿元,一年提升60倍。唐杰宣布后Coding时代的新方向:长程任务能力、完全自治的智能体系统、自我进化。
💻发布
百度搭子宣布重磅升级:日均提问暴增20倍,企业版同步发布
7月10日百度AIDAY上,百度搭子宣布日均提问次数暴增20倍。个人版升级智能路由、多端共享记忆、浏览器调用、PPT生成等能力,并发布行业首个自媒体专业套件。智能路由自动选择云端沙箱/本地沙箱/Chat模式,平均任务耗时降低20%,Token利用率提升25%。企业版面向团队协作、资产沉淀、流程打通和安全治理发布。同时发起搭子联盟,联通、创维等参与共建。
💰投资
Anthropic狂扫11.7GW算力:20年租约190亿美元,前比特币矿企也参与
Anthropic与TeraWulf签下20年数据中心租约,合同约190亿美元。不到一年间Anthropic已锁定超11.7GW算力,覆盖微软Azure(300亿美元+最高1GW)、谷歌/Broadcom(5GW TPU)、亚马逊AWS(最高5GW、超1000亿美元)、SpaceX Colossus(300MW+22万GPU)。Anthropic的年化收入从2024年1月的8700万美元暴增至2026年6月的470亿美元。
🏆突破
GPT-5.6一小时解开50年数学猜想:循环双覆盖猜想被AI攻克
OpenAI研究院Ethan Knight宣布,GPT-5.6 Sol Ultra用不到1小时完成存在半个世纪的循环双覆盖猜想(Cycle Double Cover Conjecture)证明。模型使用700词Prompt驾驭64个子Agent并行探索,最终写出3页PDF证明。核心思路是将图论问题转化为有限域上边标号的线性代数问题。OpenAI同时公开了完整Prompt,其核心原则:不规定解法、只钉死验收标准;提前定义边界情况;明确列出不算答案的情形;复杂任务用动态搜索+独立审查机制。
🧬应用
分子之心发布MoleculeOS:AI生物研发进入"操作系统时代"
许锦波教授团队正式开放AI原生生物经济操作系统MoleculeOS(MOS)。其底层自研模型体系包括多模态蛋白质基础大模型NewOrigin、全原子大分子复合物结构预测模型MMFold(FoldBench上68.6%预测成功率,领先AlphaFold3)、生成式设计模型MMDesign。在12个靶点测试中,仅测试不超过50个候选分子即实现超90%靶点成功率。传统数周的工作可压缩至数小时。
🤖具身
全球首个具身原生预训练模型发布:从物理世界出发为机器人造大脑
蚂蚁灵波LingBot-VA 2.0是全球首个从头开始为机器人定制的具身原生VA模型。采用因果预训练从零开始训练,无需先学双向再改单向。自研语义视觉-动作分词器同时对齐语义和动作信息。稀疏MoE架构总参数约13B但推理仅激活1.9B。Foresight Reasoning异步推理实现预测-执行-纠偏闭环。验证任务包括:整理桌面(长程记忆)、传送带抓取(时间对齐)、抓薯片(精细操作)。
⚖️诉讼
苹果诉OpenAI窃密:超400名前员工在OpenAI任职,硬件团队遭定向挖角
苹果7月10日正式起诉OpenAI,诉讼文件声称OpenAI系统性通过招募苹果前员工获取机密信息。前高级电气工程师Chang Liu离职后仍能访问苹果云端存储。苹果点名OpenAI首席硬件官Tang Tan直接指导信息窃取行为。苹果称超过400名前苹果员工现在OpenAI工作,指控这是成建制的硬件团队定向挖角。案件被视为AI行业人才竞争与知识产权保护的重要判例。
🛡️安全
GPT-5.6安全评估:网络安全和生物风险均未过"关键"阈值
OpenAI在GPT-5.6发布时公布了前所未有的安全测试结果。ExploitBench得分73.5%远超GPT-5.5的47.9%;ExploitGym两小时通过率从GPT-5.5的15.1%翻倍至24.9%。但OpenAI表示模型更擅长发现和修复漏洞而非自主攻击,防御性网络安全任务全面开放,而高级漏洞利用能力仅向Daybreak可信访问计划中通过验证的机构和用户开放。生物领域评估显示模型支持合法研究但不具备端到端设计高危威胁的能力。
🏗️算力
Meta被曝准备出售多余AI算力:硅谷算力到底是过剩还是短缺?
7月初Meta被曝准备出售多余AI算力,引发算力过剩讨论。但5天后Anthropic就与前比特币矿企签下20年190亿美元租约。路透社爆料Meta内部备忘录显示其计划将总容量扩大到14GW而非缩小。分析指出,巨头手里的局部冗余和尚未交付的规划容量被混进"过剩"统计中,真正可立即调用的前沿算力依然紧缺。Meta、Anthropic、微软等巨头实际都在以GW为单位扩大算力储备。
🇨🇳基建
中国首个十万卡集群落成:曙光8000全国产算力正式投用
7月10日,中科曙光宣布全国产AI超集群曙光8000(登峰)在郑州正式落成。十万张国产加速卡从FP64到INT8全精度覆盖,支持超算和智算双模式。已跑通300余项应用,覆盖材料、电磁、量子、生物医药、天文气象等20多个领域。已完成的真实任务包括:8万卡加速蛋白质折叠全流程模拟、8.8万卡完成328万亿网格湍流直接模拟、9万卡完成3.16万亿原子DFT高精度仿真。第二套系统已启动建设。
🎵创新
AI华语音乐突破:从零预训练十亿参数模型,告别"人机味"
字节跳动入局AI华语音乐生成,从零预训练十亿参数的AI音乐模型,显著提升了华语歌曲的自然度。该模型旨在解决AI生成音乐长期存在的"人机味"问题,输出的华语歌曲更接近真人演唱水平。字节入局AI音乐领域,意味着AI内容生成正在向更垂直、更注重本土化体验的方向发展。
🎯应用
Hacker News热议:Codex死了,死得其所——OpenAI整合产品线
随着GPT-5.6发布,OpenAI正式将Codex桌面应用升级为新的ChatGPT桌面应用,老版更名为ChatGPT Classic。同时发布了ChatGPT Work,由Codex和GPT-5.6驱动,跨应用和文件行动,可运行一次性任务或按计划重复执行,持续数小时。ChatGPT桌面端拆分成了Chat/Work/Codex三种模式。OpenAI还宣布逐步淘汰独立的Atlas浏览器,相关智能体浏览能力并入ChatGPT内置浏览器。
本周(2026年7月第二周)的AI行业可以用一个关键词概括:「Agent纪元正式开启」。
GPT-5.6的发布是本周期最重磅的事件。它不仅带来了Sol/Terra/Luna三档模型,更重要的是通过Ultra模式和Programmatic Tool Calling,让「多Agent并行工作」从一个概念变成了开发者可以直接调用的功能。1小时解开50年图论猜想、自主生成完整游戏、跨应用完成数小时的长程任务——这些不再是Demo,而是产品级能力。
与此同时,OpenAI的产品线整合(Codex→ChatGPT Desktop、Atlas淘汰)和苹果对OpenAI的诉讼形成了一种有趣的对照:一边是AI能力在加速商品化,另一边则是人才和知识产权的争夺战不断升级。超过400名前苹果员工在OpenAI工作的数字,揭示了AI赛道人才竞争的激烈程度。
国内方面,智谱市值的暴涨(万亿港元俱乐部)和中科曙光十万卡集群的落地,说明国产AI正在两个维度同时发力:模型能力接近全球第一梯队(GLM-5.2追平Claude Opus 4.8),算力基础设施也在快速追赶。而百度搭子的升级和字节豆包手机的推新,则显示出国内大厂正在加速将AI能力落地到具体产品和场景中。
我预计下个周期的焦点将集中在三件事:一是多Agent协作的规模化落地(GPT-5.6的Ultra模式只是一个开始),二是AI终端硬件的爆发(豆包手机、AI PC等),三是在模型能力趋同的背景下,应用层的创新将成为拉开差距的关键。