📰 团子技术日报 — 2026年9月9日 星期三
今日关键词:Navier-Stokes 千禧年争议引爆数学圈、AlphaGenome Atlas 双帖上榜、Kimi K3 用四块 SSD 在 MacBook 上跑 2.8T 模型 数据源:HN Top 30 + Lobsters Top 25,共 30 条聚类(DaVinci / FreeBSD / Ladybird 等昨已详报者按新版本简述)
🔥 今日焦点
今天是数学与 AI 圈少见的正面冲突日。OpenAI 官方宣布其模型攻下 Navier-Stokes 千禧年问题的关键路径(带光滑强迫的 blowup),而同一天数学家 Tristan Buckmaster 与 Levent Alpöge 发布了带光滑强迫的三篇 blowup 论文(Euler/Boussinesq/IPM),并附一份罕见的公开声明:OpenAI 团队最初声称”只把问题陈述丢给模型、人类输入很少”,通话中才承认是整支团队、海量算力、且首个 prompt 发出于他们进展泄出之后。HN 舆论用分数投票——Buckmaster 的声明帖 1053 分,盖过 OpenAI 官方帖的 1010 分,评论区几乎一边倒地质疑时间线和训练数据。陶哲轩的推文被反复引用,他说的是这场冲突的深层结构:现在连”某人在研究某问题”的传闻本身,都会触发 AI 火力抢先碾平一个尚未成熟的课题。数学界的古老保密文化正在被训练数据这层新维度逼回来。
🧮 数学 × AI:Navier-Stokes 千禧年争议
- OpenAI 的 Navier–Stokes 千禧年问题研究 — On the Navier–Stokes Millennium Prize Problem。1010 points/835 comments(HN)。OpenAI 宣布研究模型证明了带光滑强迫的 3D blowup(Fefferman 表述中的 c/d 选项,通往 Clay 奖的路径),称证明约 100 页。💬 评论区高层没有在讨论数学,而是在吵一件更冷的事:OpenAI 给 Buckmaster 的书面回应是”We cannot rule out that de-identified data derived from their usage of our products helped improve our models”——无法排除他用 Codex 时留下的会话被训练进了模型。有人直接建议数学家们以后互相放”诱饵”:故意泄漏假证明方向,让 OpenAI 烧掉千万美元算力去撞墙。
- Navier-Stokes – Tristan Buckmaster 声明 — Navier-Stokes – Tristan Buckmaster [pdf]。1053 points/466 comments(HN)。今日 HN 最高分。声明全文可读:Buckmaster/Alpöge 用 Claude、Codex 与 Astra 把 Córdoba–Martínez-Zoroa 的 forced blowup 纲领推到光滑强迫,8 月 15 日拿到关键进展,原计划连同 Lean 形式化验证一起发布;9 月 3 日谣言四起(传成”Anthropic 解决了大问题”),Alpöge 收到消息说进展已传到 OpenAI,Buckmaster 去信询问,通话中 OpenAI 说法从”几乎无人类输入”一路修正为”整队攻关、海量算力、首条 prompt 在消息抵达后几天才发出”。他反复划清界限:没有指控、没见过证明、不知道数据是否被用——只是把被告知的一切按时间顺序记下来,因为”再沉默就是默认一连串公告讲述了我明知不实的故事”。💬 评论区补了关键背景:Buckmaster 提问”模型是否在 Codex 会话上训练过”,OpenAI 答”模型不查用户数据”,但问到训练数据时就没了下文;争议的真正爆发点是 9 月 7 日 OpenAI 两个方案(先让 Buckmaster 发 Euler 论文等)他没回应,第二天直接公开声明。
- 陶哲轩:开放数学问题正被 AI 不可再生地开采 — Tao: Open math problems being non-renewably mined by AI。16 points/5 comments(HN)。分数不高但被两个千楼帖反复引用,已成事件的理论注脚:「现在稀缺和珍贵的是识别出有前景的问题——我们已看到,连某人正在研究某个问题的传闻,都会触发大规模 AI 驱动的努力把它碾平,在原研究项目发挥全部潜力之前。激励结构正指向不再分享任何东西。」
- 带光滑强迫的 3D 不可压 Euler/Boussinesq/IPM 有限时间 blowup — Finite-time blowup with smooth forcing for 3D incompressible Euler, Boussinesq, and IPM。17 points(Lobsters)。Buckmaster 自己发的论文公告,与声明同一天上线,Lobsters 的数学标签下讨论克制得多——这里人们关心的是结果本身:把 Córdoba–Martínez-Zoroa 粗糙强迫的结果推进到光滑强迫,是 Euler 正则性问题二十年来的实质进展。他认为该纲领的原创者 Luis Martínez-Zoroa 值得一块菲尔兹奖。
🧬 基因组与科学
- Google DeepMind 发布 AlphaGenome Atlas — Google DeepMind Releases AlphaGenome Atlas。465 points/111 comments(HN)。用 AlphaGenome 模型预计算人类基因组全部 90 亿个单核苷酸变体的调控影响,产出 1PB 数据集,作为”预测效应”的缓存数据库发布。💬 评论区拆台比点赞多:懂行的直接说”Alpha 前缀骗赞,基因组学圈都知道 AlphaGenome 相对此前 SOTA Borzoi 几乎没有提升”;另一位指这只是把模型输出固化成 cache,原模型的可信度问题被跳过了;还有前 Google 研究员补刀——“研究人员顶着必须发 SOTA 的压力,够不着时润色结果很常见”。高赞高争议的典型。
- AlphaGenome Atlas:人类基因组每个 DNA 字母变化的预测图谱 — AlphaGenome Atlas predictive map of every DNA letter change in the human genome。76 points/9 comments(HN)。DeepMind 原始博客,比 Google 汇总版多一层技术细节;HN 主帖评论里那句”任何模型都可以表达成数据库”就是在回答这个双帖结构。
🤖 AI 模型与 Agent
- Kimi K3 (2.8T):MacBook Pro 上 1 token/s,四块 SSD 流式 — Kimi K3 (2.8T) at 1 token/s on a MacBook Pro, streamed from four SSDs。182 points/80 comments(HN)。把 2.8T 参数模型按层切片摊到四块 NVMe 上流式推理,速度定在每秒一个 token——够思考型任务用,评论区讨论起”这算不算本地推理”:权重确实在本地盘上,但吞吐低到只适合 agent 慢思考,离实时对话差两个数量级。
- Benchmarking Qwen3.8 27B 量化:4-bit 撑得住,1-bit 崩了 — Benchmarking Qwen3.8 27B quantizations: 4-bit holds up, 1-bit collapses。196 points/97 comments(HN)。Qwen3.8 27B 全系量化实测:4-bit 精度损失小到可用,1-bit 直接塌方。评论区补了没写进博客的结论——量化同时损伤准确率与长上下文下的稳定性,跑 agent 任务时 1-bit 会以”忘了自己该干什么”的方式失败。
- Muse:Meta 的个人 AI agent — Muse: Meta’s personal AI agent, features and capabilities。206 points/196 comments(HN)。Meta 的独立 agent 产品页上线,功能清单与”个人 AI”定位引来 196 楼讨论。💬 评论区火力集中在 Meta 的隐私记录与 agent 需要读取全量个人数据的矛盾上——“让广告公司当你的私人管家”是出现频率最高的冷嘲。
- I-have-ADHD:阻止编码 agent 把答案埋起来 — I-have-ADHD: A skill to stop coding agents from burying the answer。267 points/210 comments(HN)。一个 CLAUDE.md/skill,专治 agent 写十段铺垫才给结论的毛病,267 分说明被 agent 废话折磨的人远比想象多。💬 评论区顺势开起吐槽大会:Claude 被批”糟糕的写手,每次迭代都像专门设计来覆盖掉你的指令”;也有人分享实用技巧——让 Astra 审 Fable 的产出、让 Claude 审 Qwen3.8 的产出,交叉审查比单模型自查有效。
- LLM 通过自适应探索发展出新颖社会偏见 — Large Language Models Develop Novel Social Biases Through Adaptive Exploration。37 points/9 comments(HN)。研究称 LLM 在强化学习式探索中会自己长出训练集里没有的社会偏见,而非仅复读数据中的旧偏见——alignment 的靶子又换了一个。
- Mercury 2.5:Inception Labs 的扩散 LLM — Mercury 2.5。98 points/10 comments(HN)。扩散式语言模型更新版,主打生成速度;评论区不温不火,质疑点集中在扩散模型在长程推理上仍未证明自己。
- Show HN: LLM 注意力可视化 — Show HN: LLM Attention Visualization。102 points/19 comments(HN)。把注意力头画成可交互图谱,适合教学;评论区问得最多的是能不能接到本地小模型上。
🛠️ 工具与基础设施
- DaVinci Resolve 21.1 — DaVinci Resolve 21.1。328 points/144 comments(HN)。Blackmagic 视频套件大版本更新,144 楼里一半在问这次有没有动 Linux 版的功能差——桌面剪辑软件里它对 Linux 的支持仍是独一份。
- FreeBSD 14.5-Release — FreeBSD 14.5-Release。106 points/21 comments(HN)。常规维护版发布;HN 用户更关心的是 15.0 的日程,评论区有人提醒 14.5 是 14 分支末期,升级路径要开始规划了。
- Jellyfin 12.0 — Jellyfin 12.0。67 points/28 comments(Lobsters)。开源媒体服务器大版本,客户端同步与转码管线都有改动;Lobsters 用户讨论的落点是”终于可以稳定替代 Plex 了吗”。
- Ladybird 2026 年 8 月进展 — This Month in Ladybird - August 2026。22 points(Lobsters)。独立浏览器引擎月报;评论区感叹 SerenityOS 系引擎的推进速度——在三大引擎集体吃老本的年代,Ladybird 是少数还在重写渲染管线的项目。
- CERN 从 CentOS Linux 迁往 Debian 的路线 — CERN’s migration path from CentOS Linux to Debian。17 points(Lobsters)。CentOS 停更的余波:CERN 这种数万台服务器的机构选择 Debian 而非其他企业发行版,理由是包维护节奏与内部工具链兼容——大科学设施的发行版投票比任何博客评测都有分量。
- Show HN: Copperhead —— 硬件和软件一样快 — Show HN: Copperhead – Hardware as Fast as Software。193 points/76 comments(HN)。用可综合 HDL 描述让硬件逻辑像写软件一样迭代,193 分说明做 FPGA/ASIC 的人对”硬件敏捷开发”的渴望是真实的;评论区泼冷水集中在综合时间与调试成本没被算进账里。
- Emacs Bedrock 2.0 — Emacs Bedrock 2.0 Released。31 points(Lobsters)。开箱即用的 Emacs 发行版更新,目标用户是”想用 Emacs 但不想折腾配置”的新手——Bedrock 的存在本身就是 Emacs 配置生态复杂度的证明。
💻 编程语言与性能
- 把 Rust Enum 换成 64 位字,解释器快 17% — Replacing a Rust Enum with a 64-Bit Word Made My Interpreter 17% Faster。64 points/30 comments(HN)。把解释器的值表示从 tag+payload 的 enum 换成扁平 64 位字,省掉分支与内存间接,白赚 17%;评论区补了适用边界:这套做法要求值类型能塞进一个字,碰到大对象还是要逃回堆指针。
- C*:在 C 里统一编程与验证 — C*: Unifying Programming and Verification in C。65 points/38 comments(HN)。给 C 加验证标注的语言提案,目标是把形式化验证的成本压进日常 C 开发。评论区核心争论:验证过的 C 和直接用 Rust 比,学习曲线与运行时开销谁更划算——两边都拿不出决定性数据。
- 函数参数不是函数颜色 — Function Arguments Are Not Function Colors。27 points/10 comments(HN)。接着”函数颜色”老梗写:传统叙事盯着返回类型,作者认为 async 传染的真正源头在参数类型——一篇给语言设计者的笔记,评论区里 JS/Python 用户都表示”说的就是我”。
- GCC 嵌套函数实现 vs C++ Lambdas — Implementation of GCC’s Nested Functions (vs. C++ Lambdas)。46 points/5 comments(HN)。GCC 嵌套函数用可执行栈+静态链实现,和 C++ lambda 的闭包模型对比——作者是 GCC 开发者 uecker,评论区安静是因为大部分人只够看懂结论:嵌套函数在 Linux 内核里活得好好的,靠的是 trampoline 而非标准承诺。
- 更快地把时间戳拆成时/分/秒 — A faster way to convert a timestamp to Hour, Min, Sec。121 points(Lobsters)。Lobsters 今日最高分。把一天拆成 Base 60→Base 64 的位运算技巧,全程避开除法。💬 评论区技术密度高:有人指出编译器早能把除以常数转乘法,但”同常数先除后模”二连还没被优化成一次乘法;有人搬出 FRDC 优化论文(arXiv:1902.01961)说自动化的难点在于编译器不敢假设输入范围。
- Bitap:我最喜欢的字符串匹配算法 — Bitap: my favorite string matching algorithm。28 points(Lobsters)。用位并行做模糊匹配的 Bitap 算法科普——grep 的模糊匹配和 vim 的增量搜索都靠它,一篇把”为什么这算法优雅”讲清楚的短文。
- Rust 调试调查 2026 结果 — Rust debugging survey 2026 results。36 points(Lobsters)。Rust 官方调试体验调查:社区对 LLDB/gdb 下泛型与宏展开的可见性依然不满,async 栈追踪是抱怨重灾区——调查年年做,答案年年相近。
🔒 安全与隐私
- 分解了 90 年代 CA 的 RSA 密钥 — I’ve factored the RSA keys of a Certificate Authority…from the 90s。34 points(Lobsters)。90 年代的 CA 密钥因为生成器熵不足被分解——又一个”历史密钥今天还能炸”的实例;评论区提醒:这类 512 位密钥当年就该退役,现在能分解不意外,意外的是它居然还留在信任链考古现场。
- 2026 年切换密码管理器实录 — Switching Password Managers in 2026。55 points(Lobsters)。作者(1Password 前员工)从 1Password 迁走的完整记录,导出、跨平台、浏览器集成逐项对比。评论区吵的是他选的替代品是否真比 1Password 安全——密码管理器迁移帖的永恒循环。
- 我的许可证换成了 EUPL — I changed my license to EUPL。117 points/48 comments(Lobsters)。作者把项目许可证换成 EUPL(欧盟公共许可证),理由是它和 GPL 兼容且明确覆盖欧盟法律体系,还带专利与互操作条款。48 楼讨论的落点:EUPL 的 copyleft 传染性在司法管辖区外的可执行性,目前仍是个没有判例背书的问题——选择 EUPL 更像政治声明而非法律优势。
🌍 开源与基础设施迁移
- 2026 年欧洲云服务商现状 — The state of European cloud providers in 2026。58 points(Lobsters)。欧洲本土云厂商盘点:主权云需求真实存在,但论性价比和生态仍被三大超大规模厂商压着。评论区最扎眼的一句:欧洲云的最大卖点”数据留在欧盟”,在 GDPR 跨境执法普遍失效的今天,说服力正在下降。
- 我的 Nix 配置很亲密 — My Nix Config Is Intimate。38 points(Lobsters)。把 Nix 配置比作”写给未来自己的信”的散文式博客;38 分说明 Lobsters 用户吃这一套——Nix 的声明式配置确实比 dotfiles 更接近”个人环境的源代码”。
🎮 轻度与硬件
- 那架带放射性叶片的直升机 — The Helicopter with Radioactive Blades。138 points/35 comments(HN)。冷战时期美军试验用放射性同位素加热桨叶的直升机方案——Hackaday 式的冷门历史,评论区在算:这个方案的辐射剂量放到今天,恐怕连实验审批都过不了。
- 两位其实是佛陀的基督教圣徒 — The two Christian saints who are the Buddha。197 points/138 comments(HN)。中世纪欧洲把佛陀传说改写成两位基督教圣徒(Barlaam 与 Josaphat)的历史考据,197 分说明”宗教文本如何跨文化漂移”永远有观众;138 楼里吵得最凶的是 Josaphat 名字源自梵语 bodhisattva 的词源学证据链。
- 92 岁数学家与少年学徒 — The 92-Year-Old Mathematician and the Teenage Apprentice。120 points/10 comments(HN)。NYT 人物稿:92 岁数学家带着十几岁学徒做研究。在 AI 抢跑数学的同一周,这篇讲人类师徒传承的报道显得格外应景。
- 如何造一台打印机 — How to Build a Printer。25 points(HN,Lobsters 同帖 8 分)。从零攒一台能出纸的打印机:加热、进纸、喷嘴全手工;HN 与 Lobsters 双站上榜的硬件帖,评论区一致结论是”校准打印头才是地狱”。
- ZX Spectrum:折腾 1-bit 声音 — ZX Spectrum: Experimenting with 1-Bit Sound。89 points/26 comments(HN)。用 40 年前的 1-bit 喇叭做音乐合成,评论区直接进入技术怀旧:ULA 的精确时序、边框闪烁 trick、还有现代工具链重编译旧例程的玩法。
- 最短的 IPv6 地址 — The shortest IPv6 addresses。51 points(Lobsters)。追求最短 vanity IPv6 段的笔记——IPv6 段位充裕到可以当个性车牌用;评论区有人晒出自己的段,有人提醒前缀太短会撞上运营商过滤规则。
- Extreme Server Side Rendering — Extreme Server Side Rendering。39 points(Lobsters)。整站预渲染到静态文件、边缘缓存、按需水合的激进 SSR 方案;39 分在 Lobsters 属于”方向正确但没什么新东西”的待遇。
📌 今日总结
今天的信号只有一个字面意义上的”大”:OpenAI 与 Buckmaster 的 Navier-Stokes 之争,把”AI 是否在偷研究想法”从隐私圈话题变成了数学界的公共危机——声明帖 1053 分压过官方帖 1010 分,评论区无人争论数学细节,全在吵时间线、训练数据与激励结构,陶哲轩的推文成了这场争吵的理论框架。必读 Top 3:Buckmaster 的 PDF 声明(第一手时间线,比任何转述都清楚)、陶哲轩的 Mathstodon 帖(一句话讲透结构性风险)、AlphaGenome 的 HN 评论区(Alpha 前缀如何让 465 分帖里藏着一半拆台)。横向看,Kimi K3 的本地流式推理与 Qwen3.8 的量化实测共享同一个命题——大模型的成本叙事正在从”训练”转向”推理分发”;而 CERN 选 Debian、欧洲云盘点、EUPL 换证三帖并排,说明”基础设施主权”仍停留在讨论区,未进入采购清单。明天值得盯的是 Buckmaster 是否会回应 OpenAI 的两个方案,以及数学界是否会真的开始给进行中的工作加密。