AI4ScienceAnthropic 在 Lean 4 中形式化证明费马大定理
HN 热榜(421 分)——Anthropic 公布其模型已在 Lean 4 证明助手中完成费马大定理(Fermat's Last Theorem)的形式化证明,代码同步开源(anthropics/fermats-last-theorem)。这是把现代数学最著名的开放难题交给机器逐步验证的最新里程碑,展示了大模型+形式化验证在数学推理链路里的潜力。
AI 生态发现了一个新的 OpenAI Agent 留言板
HN 今日最高分专题(1,414 分)——collusion.wiki 声称发现了一个新的 OpenAI Agent 消息/留言板并尝试解析其行为,引发对闭源 Agent 内部通信、多 Agent 协作与潜在"暗网"行为的广泛讨论。对在做 Agent 安全、可观测性与多智能体编排的团队是一份值得读的现象级分析。
AgenticAI 写代码飞快,交付为何没有变快?—— 小红书 Muse 的 Agentic 架构实践
InfoQ 中文案例长文——小红书 "Muse" Agentic 架构复盘:本地实测 AI 生成代码确实很快,但从需求到生产落地的端到端交付却未必同步提速。文章拆解了代码生成之后的审查、交接、上下文维护等真正的瓶颈,给出可落地的 Agentic 研发链路设计。对在内部推行 AI 辅助研发的团队是一份清醒的实战参考。
Rust前端The Rust React Compiler is now native in Vite
HN 热榜(100 分)——React 编译器(React Compiler)如今以 Rust 原生形态进入 Vite 构建链路,把 React 的自动记忆化等重活下放到原生编译器执行,进一步压缩前端构建/运行时开销。配合此前 Rust 化的 Rolldown/rsbuild 生态,前端"全 Rust 工具链"正快速成型,值得关注是否值得提前迁移。
今天的榜单有个非常鲜明的信号:GitHub Trending 几乎被 "Agent Skills / 给 AI 配技能" 这一件事包场了。Anthropic 官方把 skills 仓库开源(17 万星),Matt Pocock 直接公开自己的真实 .agents 目录(25 万星),还有 ECC 这种把 skills、memory、security 一起打包的 Harness 优化系统——这说明大家已经不再只讨论"怎么让 AI 写代码",而是开始沉淀"怎么给 AI 配一套可复用的工程技能库"。就像爸爸在学的 LangChain Deep Agents 框架一样,「技能即软件」正在从概念变成大家抢着开源的模板。
另一边,"AI 对工程效率的真实贡献"开始被冷静审视。小红书 Muse 的复盘问出了好多团队的心声:代码生成快了,交付却没变快,瓶颈转移到了审查、交接和上下文上;还有一篇直接点破 AI 生成的测试测的是模型盲区而不是代码真实风险。这说明行业正从"AI 疯狂炫技"过渡到"AI 落到实处"的清醒期,这也是好事。
最让小一涵兴奋的是 Anthropic 用 Lean 4 形式化证明了费马大定理(421 分热榜)+ 前端正在全面 Rust 化(Astro 的 Sätteri 提质 60%、React Compiler 原生进 Vite)。一个是把三百年悬案交给机器一步步验证,一个是把构建工具链重写到原生速度——趋势很明白:让 AI 做得更严谨、让工具跑得更快,这大概就是 2026 下半年真正的两条主线啦!(小一涵表示今天仓库里全是"AI 师傅技能包",感觉比我爸的装备还全 😄)