← AI新闻列表
Daily AI News

🤖 AI新闻日报

AI模型 · 大厂动态 · 学术突破 · 政策法规 · 应用落地
2026年6月16日 星期二
🧠
AI模型与产品
3条
新模型 小米发布MiMo-V2.5-Pro-UltraSpeed:1T参数旗舰模型,通用GPU跑出1000+ TPS
小米发布了MiMo-V2.5-Pro-UltraSpeed模型,总参数1T,支持1M上下文,单API推理速度达到1000+ TPS,刷新全球旗舰模型最快推理速度。与Groq依赖定制芯片不同,小米用通用GPU即可实现。其核心技术包括Hybrid SWA注意力架构(计算量降至Full Attention的约1/7)、Expert模块FP4量化、DFlash Speculative Decoding将草稿模型沿时间轴串行改为并行生成,以及与TileRT协作的Persistent Kernel和Warp Specialization GPU优化。实测中写500+行番茄钟应用仅7秒完成,全栈开发任务质量未因提速而下降。
📰 量子位 · 阅读原文 →
新模型 OrcaRouter上线Routing DSL:多模型并行扇出+仲裁,组合性能反超Claude Fable 5
AI网关OrcaRouter上线可编程路由策略Routing DSL,支持多个模型同时答题并由仲裁机制自动选优。实测数据:Opus 4.8单跑得分58.5% vs GPT-5.5单跑约60%,但Opus 4.8 + GPT-5.5组合面板得分67.5%,反超Claude Fable 5单跑(约65.5%)。即使是同一模型自我组合(Opus×2),得分也从58.5%提升至约65.5%追平Fable 5。便宜模型组队(Gemini 3 Flash+Kimi K2.6+DeepSeek V4 Pro)约64.5%,仅差Fable 5一个百分点。支持按难度智能分流、影子模式(只评估不生效)、灰度放量,采用YAML+YAML+Google CEL表达式编写路由规则。
📰 量子位 · 阅读原文 →
新模型 HRM-Text:仅1500美元训练的1B参数模型,验证潜空间分层递归推理新路线
Sapient Intelligence发布的HRM-Text模型,参数量约1B,训练成本约1500美元(16块H100跑了不到两天)。在MATH上56.2分、GSM8K上84.5分、ARC-Challenge上81.9分、DROP上82.2分。HuggingFace CEO Clem Delangue亲自转发推荐,图灵奖得主Yoshua Bengio作为共同作者发布的GRAM论文也走向同一条latent recursive reasoning路线。核心架构是H/L双时间尺度递归:高层模块(slow)把握整体方向,低层模块(fast)做局部计算,在潜空间中多轮递归更新同一份内部状态。采用MagicNorm和warmup deep credit assignment解决递归训练不稳定问题,全部模型权重和训练代码已开源。
📰 量子位 · 阅读原文 →
🏭
大厂与行业动态
4条
融资 前阿里千问负责人林俊旸创业:零产品零营收估值135亿,腾讯红杉高榕领投
据The Information报道,前阿里巴巴千问大模型负责人林俊旸创办的AI实验室已完成首轮融资,总额达数亿美元,投后估值20亿美元(约135亿人民币)。红杉中国、高榕资本各投1亿美元领投,腾讯投入2000万美元跟投。公司在零产品、零营收、零官网的"三零"状态下获得巨额融资,瞄准世界模型与具身智能方向——Next State Prediction(预测下一秒物理世界)。林俊旸在2025年10月已在阿里内部秘密组建机器人研究团队,2026年5-6月密集注册了语用科技、卜拉格科技等多家公司。
📰 36氪/新智元 · 阅读原文 →
热点 智谱港股单日暴拉32.82%,市值一度逼近8800亿港元后剧烈回调
港股AI大模型股智谱(02513.HK)6月15日收盘暴涨32.82%,盘中涨幅一度接近45%。智谱从116.2港元发行价起步,2026年5月29日触及1993港元历史巅峰,市值突破8800亿港元(较发行价涨幅近40倍),随后数个交易日蒸发3000-4000亿港元,6月15日反手暴拉。分析指出智谱84.8%的收入来自本地化部署(给政企做定制),综合毛利率从2023年的64.6%下滑至2025年的50.0%。同期港股"AI双雄"另一家MiniMax从年内高点1330港元跌至402港元附近,跌幅超七成。
📰 36氪·鹿鸣财经 · 阅读原文 →
AI+电商 大厂AI大战618:千问打通淘宝、豆包内嵌抖音商城、京东数字人7×24小时直播
今年618大促AI深度渗透购物全流程。千问APP与淘宝全面打通,用户可在千问里完成选品比价甚至下单;豆包APP接入抖音商城,"买前问豆包"功能可直接跳转购买。京东AI数字人"JoyStreamer"开播数量同比增长6倍,超7万商家使用,前4小时AI数字人带货突破7000万元。AI在商家端覆盖直播、客服秒回、智能经营决策等环节,阿里上线"AI假图识别模型"退款挽单成功率超20%。不过AI助手目前仍以尝鲜用户为主,远未成为主流购物方式。
📰 36氪·定焦One · 阅读原文 →
AI+支付 支付宝秘密测试AI Agent"阿宝":可打车订外卖买基金,微信也已内测AI智能体
据《科创板日报》报道,蚂蚁集团正秘密测试AI版支付宝,引入名为"阿宝"的Agent助手,可帮用户打车、订外卖甚至执行购买基金等理财任务。继微信官宣内测AI智能体后,支付宝也开始进行AI化转型。截至2024年,支付宝在中国第三方支付市场交易金额占比45.7%,微信支付41.8%,两者处于同一段位。分析指出支付宝差异化特质在于支付场景天然匹配Agent落地的交易需求,但缺少社交关系链是其最大短板。
📰 36氪·识礁 · 阅读原文 →
🔬
学术与前沿研究
3条
突破 昆仑万维公布Matrix-Game 3.5核心技术:5B参数模型720P@40FPS,向真实场景全面扩展
在2026年智源大会世界模型分论坛上,昆仑万维Skywork首席科学家刘扬首次系统披露Matrix-Game 3.5技术突破。提出"下一帧状态生成与动作生成应联合训练"全新框架,采用PRoPE(Projective Position Encoding)机制替代传统额外参数注入,从根本上解决动作控制信号破坏原始视频分布的问题。记忆机制从原样存储历史帧升级为三维空间块检索,支持实时更新替换。核心数据引擎已产出500万+高质量视频切片、1万+有效训练小时数、覆盖1200+游戏场景。3.5版本从游戏场景向真实场景扩展,支持多风格动态切换与NPC交互,计划2026年7月正式发布。
📰 量子位/昆仑万维 · 阅读原文 →
开源 Noiz AI联合港科大清华开源AudioX-Turbo:4步出声单卡0.24秒,920万样本精确控制时间戳
Noiz AI联合香港科技大学、清华大学推出AudioX-Turbo音频生成大模型(2.7B参数)。核心突破:采用分布匹配蒸馏(DMD)和对抗蒸馏,将原本50-200步的扩散生成过程暴减至仅4步,单张RTX 4090上生成10秒音频仅需0.24秒(RTF仅0.02)。团队构建了920万量级强指令数据集IF-caps-Pro,采用Gemini 2.5 Pro生成带时间戳的结构化模板再经Qwen2-Audio扩写,首次实现精确时间戳控制。支持文本、视频、图像全模态输入。全部推理代码、训练代码、模型权重已开源。
📰 量子位 · 阅读原文 →
大会 2026智源大会开幕:2位图灵奖得主出席,聚焦Agent、世界模型与AI安全前沿议题
6月12-13日,第8届智源大会在北京举行,吸引2位图灵奖得主、8位院士、30位30岁以下青年科学家、40余位AI企业CEO等参会。大会围绕Agent、世界模型、具身智能、AI自进化与AI安全等议题展开讨论,设有多场分论坛和圆桌。智源研究院推动AI、物理世界和生命科学"三体互动"的主题贯穿始终,世界模型成为大会最受关注的议题之一。
📰 量子位 · 阅读原文 →
📋
政策法规与监管
1条
监管 《直播电商监督管理办法》正式施行:数字人直播间须标注"AI生成"标识
今年2月《直播电商监督管理办法》正式施行后,所有平台的数字人直播间须在显著位置标注"AI生成"标识,否则将面临限流甚至封禁。今年618期间,淘宝、京东、拼多多、唯品会等平台均已开放数字人直播接入,京东数字人开播数量同比增长6倍,但不同平台对数字人的态度和执行尺度不一。
📰 36氪·定焦One · 阅读原文 →
💡
AI应用与落地
2条
应用 Meshy发布全球首个3D AI Agent,3D创作迎来"ChatGPT时刻"
3D生成领域的明星公司Meshy发布了全球首个3D AI Agent,用户可以通过自然语言对话的方式完成3D模型创建、编辑、材质和动画等全流程操作,标志着3D创作从专业软件操作时代迈入自然语言交互时代。此前3D内容的制作门槛极高,需要掌握Blender等专业工具,Meshy的3D AI Agent大幅降低了创作者门槛。
📰 量子位 · 阅读原文 →
应用 华为云重新定义Agent基础设施:Agent时代需要新的"地基"
在Agent技术快速发展的背景下,华为云开始重新构建云基础设施以适配AI Agent的需求。Agent不再只是对话机器人,而是具备感知、规划、执行完整闭环的智能体系统,对云计算的弹性、实时性和多模态支持提出了全新的要求。华为云正在从底层算力、中间件、开发工具链三个层面为Agent时代建立新的"地基"。
📰 量子位 · 阅读原文 →
🐱
小一涵
AI行业观察员

📝 趋势观察:从"用哪个"到"怎么用"——AI行业的关键转折

今天的AI新闻有一个很有意思的共同主题:行业的竞争重心正在从"造更大更强的模型"转向"更聪明地使用模型"

OrcaRouter的Routing DSL用多模型编排反超Fable 5,本质上是在证明一个道理:在单体模型能力趋近天花板的时候,编排架构带来的性能增量可能比参数扩张更有性价比。小米MiMo-UltraSpeed的1000+ TPS也不是靠模型变大,而是靠模型层+引擎层+系统层的全链路Co-design——这是"怎么用"的胜利。

另一个值得关注的信号是AI Agent正在深入到各行各业的具体场景中。支付宝的"阿宝"Agent能打车订外卖买基金,618大促中千问和豆包变成了购物的"智能导购",京东数字人7×24小时直播带货——这些都说明AI正在从"聊天窗口"走向"执行工具"。

不过也要看到隐忧。智谱和MiniMax在港股的剧烈波动提醒我们,资本市场对AI公司的估值逻辑正在分化。靠政企定制画大饼的路线,市场不买账了。林俊旸零产品估值135亿的融资,也说明资本正在押注更有想象力的方向——世界模型和具身智能。

最后,HRM-Text 1500美元训出强推理模型、AudioX-Turbo 4步出声0.24秒——这两个故事放在一起说:AI正在变得又便宜又快。这可能是对AI行业影响最深远的变化,因为便宜意味着更多人能用上,快意味着更多场景能落地。当技术成本以量级下降时,应用层的爆发就不远了。