🔥
阿里突袭发布Qwen3.8-Max:2.4万亿参数,冲进全球第一梯队
阿里巴巴在8月3日突袭发布新一代基座大模型Qwen3.8-Max,总参数量达到2.4万亿。在最新放榜的第三方权威榜单Arena中一路冲到全球大模型第一梯队,编程能力甚至还超过了Claude Opus 5和Fable 5的High版本。国内定价每百万Tokens输入12元、输出36元,隐式缓存命中仅1.5元,输入与输出的国际价格分别只有Opus 5的40%与24%。能端到端自主交付编程任务(官方披露可从一个空文件夹出发无人干预推进十几天交付真实项目)、在数千轮长程交互中保持目标、数百页文档及上百小时视频的多模态分析。
🔥
商汤开源SenseNova U1.5-Lite-Preview:8B轻量模型原生4K直出
商汤科技8月3日面向社区开源轻量级原生统一多模态模型SenseNova U1.5-Lite-Preview。该模型延续自研NEO-Unify架构,把语言、视觉语义与像素生成放进同一套模型,覆盖视觉理解、推理、生成与编辑。仅8B-MoT参数即可原生4K直出,支持长Prompt、多约束指令、参考图、多图组合及红框/marker精准局部编辑。相较上一代U1,在Qwen-Image-Bench上成绩从47.14提升至55.20(with Prompt Enhance),GEdit-Bench英文项从7.47升至8.17。已放上GitHub、Hugging Face与魔搭社区。
🔥
MiniMax开源通用视频模型H3:有声视频编辑全球第一,16家芯片首日适配
MiniMax于8月3日正式开源新一代通用型全模态生成系统MiniMax H3,可统一理解文本、图像、视频与音频构成的多模态上下文,生成最长15秒、最高2K分辨率并带原生立体声音频的视频。目前在Artificial Analysis有声视频编辑榜单上,MiniMax H3以1130分Elo成绩位列第一,领先Gemini Omni Flash、Wan 2.7等。系统由H3-Context-IR、H3-Base、H3-Regenerate-2K三模块组成,支持SGLang、vLLM、diffusers、ComfyUI等部署。华为昇腾、摩尔线程、海光、AMD、Intel等16家生态伙伴完成首日适配。
✨
华为诺亚开源MindMemOS:让AI Agent的记忆可迁移、可自演进
华为诺亚方舟实验室推出面向AI Agent的可迁移、自演进记忆操作层MindMemOS,将记忆从单个Agent中解耦。其以实体、属性、时间三维结构同时保存最新状态与完整演化轨迹,并通过Dreaming离线整理记忆、Feedback机制利用用户纠错信号优化记忆。在LoCoMo上取得94.03分,PersonaMem上达70.63%。在MemoryAgentBench中,Dreaming压缩19.4%-23.5%活跃记忆的同时将问答准确率最高提升10.3个百分点;基于真实轨迹的Skill演进把SpreadsheetBench-Verified任务成功率提升至57.2%。已开源至GitHub。
✨
阿里"千问办公"QwenWork开启公测,体验最新旗舰模型
阿里巴巴旗下"千问办公"(QwenWork)8月3日开启公测,个人和企业用户均可体验。用户可在该办公产品中直接体验阿里最新旗舰模型Qwen3.8。这是阿里继Qwen3.8-Max发布后,将其旗舰模型能力下沉到办公场景的关键一步,与编程、长程任务等能力形成协同。
🔥
年薪百万抢电工,Meta急到自己办技校:首批5000名学员学费全免
AI数据中心的爆发把瓶颈推向了"工地":麦克锡预测2023-2030年美国需额外培养13万名电工、24万名建筑工和15万名施工主管,而一个AI短期维护岗薪资可比传统领域高42%,优秀电工年薪高达24-28万美元。为此2026年Alphabet和Meta合计投入2.65亿美元在技工培训上(总资本开支已达3350亿美元)。其中Meta拨款1.15亿美元办起建筑工人培训学校,首批5000名学员学费、机票、住宿全免外加生活补贴,四周培训后立即上岗。微软总裁Brad Smith称"电工短缺已成为我们在美国扩建数据中心的头号障碍",2022-2026年美国暖通工程师岗位空缺增长78%。
✨
李飞飞World Labs收购SceniX:物理AI训练从"采数据"走向"造世界"
李飞飞的World Labs于7月21日宣布收购机器人仿真公司SceniX,一周后双方公布Real-to-Sim-to-Real(R2S2R)最新成果。该系统把一个真实机器人任务搬进仿真、在放大的任务场景中训练评测策略,再部署回真实机器人。SceniX补上了真实任务重建、物理属性恢复、复杂交互模拟及机器人策略训练评测能力,使世界模型从生成观察的Renderer走向预测状态变化的Simulator。收购意味着World Labs真金白银押注"世界模型的下一站是让机器人能在虚拟世界中行动、试错和学习"。
✨
具身智能按生产力重新算账:Demo高估值时代结束了
36氪与量子位观察指出,具身智能行业正从"Demo炫技"转向"按生产力估值"的新阶段。行业洗牌加速,围绕机器人的"修路人"服务商竞争激烈,仅具身智能服务商就已超过1.2万家。资本市场也在重估:商业落地能力和真实生产力指标取代单纯的演示效果,成为评判具身智能公司的核心标准。头部公司正加速从实验室走向真实产线交付。
📄
OpenAI新模型让数学家集体破防:一场关于数学未来的精神危机
36氪深度报道,OpenAI新一代模型在数学推理上的表现引发数学界的集体冲击——用2000美元即可解出10道世纪难题,正在改写数学研究的成本账本。数学家开始重新审视"人类数学到底还在追求什么"这一根本问题。这一现象与此前Claude Opus 5在IMO竞赛满分、菲尔兹奖得主预警"AI可能杀死数学"相呼应,把"AI是否会让数学研究失去意义"推到了公众视野。
📄
7个月成立23家世界模型公司,世界模型赛道进入"批量生产"
36氪统计发现,过去7个月内全球新成立了23家世界模型公司,涵盖北大22岁本科生、阿里P10、前菜鸟CTO等各类创业者背景,世界模型赛道正式进入"批量生产"阶段。这反映出资本市场对"预测世界动态、支撑具身智能与仿真"这一方向的集体押注,也预示着该赛道将从早期的概念期走向同质化竞争。
📄
具身智能挤满"修路人":机器人还没普及,12270家服务商先打起来了
36氪调研显示,具身智能产业链上游的"修路人"(零部件、本体、数据、sim2real等中间服务商)已多达12270家,在机器人尚未大规模普及的当下先一步迎来淘汰赛。行业"挤满修路人、还没有修好路"的结构性矛盾凸显,服务商之间的同质化竞争与价格战已经开始。这也侧面印证具身智能已从融资故事走向实际交付的分水岭。
⚖️
Anthropic拒签与Meta双轨发声:美国AI产业在开放权重上的联合与分裂
围绕是否"限制中国开放权重模型",美国AI产业爆发激烈争论。黄仁勋以联名公开信拉出133家公司名单施压禁止禁令,但OpenAI加入声援后,Anthropic成为硕果仅存的未签署重要实验室。其CEO Dario Amodei于7月27日发长文,明确"从不禁开放权重",而是反对"无差别开放",认为开放权重未必有助于安全防护("事实极可能恰恰相反"),建议将监管焦点从开放/闭源移向模型能力与生产流程。同期扎克伯格7月28日在《华尔街日报》发表亲笔文章《AI的未来属于每个人》,为Meta开源路线给出哲学辩护。这场之争本质上关乎AI行业的权力结构。
⚖️
谷歌被曝"早一年做出ChatGPT却硬是没敢发":赛博义父Tibo爆料
量子位援引"赛博义父"博主Tibo爆料称,谷歌内部其实早在OpenAI推出ChatGPT之前约一年就已做出了类似能力的对话式AI产品,但因风险担忧与内部审慎而未能发布。这一爆料引发关于"大厂在技术已就绪时因组织决策与安全顾虑错失先机"的广泛讨论,被网友调侃谷歌"终究还是喜提了'美国豆包'"。该事件也是当前AI安全与商业化权衡议题的注脚。
🚀
手绘图直接变海报:国产开源多模态模型把图片玩"活"了
36氪报道,国产开源多模态模型实现"手绘图直接转海报"能力,把粗糙的手绘草图一键升格为精致海报,正式版将于近期推出并开源。该应用展示了多模态生成模型在真实设计工作流中的落地价值——从创意草图到成品海报的效率跨越,是生图模型从"会画图"走向"能进创作流程"的代表性案例。
🚀
豆包输入法撕开语音口子,冲击科大讯飞"语音之王"地位
36氪深度报道,字节跳动旗下豆包输入法以AI语音能力切入,直接冲击科大讯飞长期占据的"语音输入王"地位。报道称正面临"老登困局"的科大讯飞,其传统语音份额正被集成AI大模型的输入法产品蚕食。这是AI原生公司用大模型能力降维打击传统软件巨头,重新夺回终端入口的典型案例。
🚀
"天线宝宝"机器人上门做保洁:200元/小时,纯·人工·智能
量子位报道,"天线宝宝"造型的家政机器人在国内悄然落地,上门做保洁收费约200元/小时。这一案例反映出具身智能尚未完全成熟时,行业以"人工遥操+AI辅助"(即Human-in-the-loop)方式率先切入真实服务的商业化探索,也侧面说明纯自主的家政机器人距离大规模商用仍有距离。
本周AI行业的关键词:开源反攻与Agent记忆化。
阿里Qwen3.8-Max以2.4万亿参数和"打骨折"的价格(国际输入输出价仅为Opus 5的40%与24%),在编程上反超闭源旗舰,延续了国产开源模型用性价比击穿美国闭源API高溢价的路线。MiniMax H3、商汤U1.5-Lite-Preview的同日开源,更让"国产开放权重"成为一股难以忽视的合力。与此同时,Anthropic拒签黄仁勋联名信、坚持"反对无差别开放",实际上在给这股开源潮踩刹车——开放权重之争背后,是AI行业商业利益、安全理念与全球权力结构的三重博弈。
我更关注华为MindMemOS代表的"Agent记忆化"趋势:当模型性能接近天花板,跨Agent、跨session的记忆与Skill自演进正在成为新的效率瓶颈和护城河。谁能让AI真正"记住用户并持续变强",谁就能在Agent时代掌握入口。而Meta斥资1.15亿美元办技校抢电工的新闻,则提醒我们——AI竞赛的物理瓶颈,正从算力蔓延到电力与人力这些"接地气"的环节,这条产业链上的每个角色都会被重新定价。
—— AI行业正从"谁更强"走向"谁更懂、谁更省、谁能落地",性价比、记忆与真实生产力,将成为下一个周期的关键词。