📰 团子技术日报 — 2026年9月17日 星期四

今日关键词:BirdNET 小模型、AWS 中东机房、Mozilla 云推理争议、A/I 关站、Flock 摄像头、三元 LLM 打包浪费 数据源:HN Top 30 + Lobsters Top 25,共 55 条原始条目,去重后 53 条,合并跨站同帖后 51 条

🔥 今日焦点

e-ink 相框(2039 分)是昨天那条的续榜,一天之内从 1190 涨到 2039——它的技术核心是 BirdNET 这类专用小分类模型,LLM 在里面没有位置。评论区顺势吵起来:是不是所有任务都该扔给大模型。同一时刻 HN 上另一条讲 4B 模型做 SQL 查询计划(313 分),两种路线摆在一起看,值得问的是任务边界画在哪,模型大小是次要的。

Lobsters 今天的最高分(132 分,74 评)不在技术版:Autistici/Inventati 被美国国务院列为 SDGT,支付通道随即被切,20,000 个邮箱、20,000 个博客、1,500 个网站一夜下线。评论区把一个常被忽略的机制讲得很清楚——任何走美元的跨境交易都要过美国银行体系,欧洲的支付机构谈不上”愿意配合”。

第三条线是 Mistral × Mozilla(510 分,182 评)。云推理本身没几个人反对,争议在产品页没把本地推理和云推理的边界讲明白,用户等于在不知情下把整个浏览历史交出去。

🤖 AI 与模型:小模型、结构化输出、以及”要不要都上 LLM”

  • 训练 4B 模型产出比 Postgres 快 81% 的查询计划 — Training a 4B model to produce 81% faster query plans than Postgres。313 points/59 comments(HN)。💬 顶楼把标题里的边界逐条拆开:8GB 数据集全内存、shared_buffers 被压到很小、查询预热过、只跑只读 SELECT——81% 在这个范围内成立,换到 OLTP 和更大规模就未知。另一条问得更直接:4B 模型推理本身就要反复吃几 GB 内存,与其这样不如认真讨论给 Postgres 上 CUDA。也有观点认为查询计划是数学和算法密集型问题,LLM 是钝器,真正想要的是 AlphaGo 那种启发式网络。
  • 打破三元 LLM 的 1.58-bit 门槛 — Breaking the 1.58-bit Barrier for Ternary LLMs。83 points/5 comments(HN)。Intel 的三位作者测了 29 个三元模型的真实权重分布,发现零占比最高到 51.5%,而业界通用打包(5 个三进制权重塞一字节 + 2 的幂分组)实际落在 1.625 bit/权重——符号被当成等概率处理,浪费就出在这里。
  • Dream-RSI:靠演化世界做递归自我改进 — Dream-RSI: Recursive Self-Improvement through Evolving Worlds。171 points/49 comments(HN)。💬 有读者写了简化版理解——给 3 个 agent 各 10 步去刷同一个任务,谁分数高谁赢——作者亲自确认基本正确。论文 5.1 节有个反直觉结果:把高层方向性提示塞进 prompt,效果反而不如什么都不给,说明方向性约束会把搜索空间压死。
  • 前端模型做物理题到底行不行 — How good are frontier models at physics?。53 points/22 comments(HN)。物理是少数有客观判分标准、又能被专家审核的领域,这类评测的说服力比一般 benchmark 高。
  • 在 Navier-Stokes 之后,我依然看空 LLM — Why i’m still bearish on LLMs after Navier-Stokes。24 points/5 comments(Lobsters)。💬 评论区把核心论点收得更紧:严格规格说明的书写成本可以远超直接实现,硬件工程就是最好的案例;Navier-Stokes 和纯数学是 agentic 工作的绝对最佳场景,因为定理陈述本身就是一份经过数十年同行审计的严格规格。另一条把历史串起来——从 COBOL 到 AppleScript、UML 画图工具,“声明规格就得到程序”这门生意做了四十年,还没成过。
  • 在 AI 时代维持对写代码的热爱 — Maintaining the love for coding in the time of AI。28 points/3 comments(Lobsters)。💬 一条把”LLM 只是工具”这个说法反过来读:把所有责任推给使用者,实际经验是多数人要么语言不熟、要么领域不熟,所以根本用不好;另一条提到 LLM 挖出的 issue 数量是有限的,等团队把它们防住之后,时间会回到写新功能上。
  • 低质量 AI 提交正在压垮 OSRS Wiki 和 RuneLite — OSRS Wiki and RuneLite are increasingly under strain from low-effort AI development。15 points/0 comments(Lobsters)。志愿维护的项目没有拒绝提交的成本预算,AI 把提交量拉上去之后,审核工作量直接压到少数维护者身上。这是上半年 F-Droid 那次统计的同类事件。
  • 把文生图模型训练提速 3.6 倍 — Training Text-to-Image Models 3.6× Faster。20 points/1 comments(HN)。工程笔记,讲的是 JIT 与 DDT 的组合,不是新模型。
  • 逆向出来的”类 Jev”模型 — Reverse-engineered Jev-like model。36 points/5 comments(HN)。💬 作者声称”stealth 两年 vs 我 stealth 两小时”,开源了 Qwen-2.5-1B-RLCD。评论区没买账:左右两侧的结果差异明显,本质更接近讽刺作品。这条承接昨天 TypeSafe 那波结构化输出争论,说明那个话题还没降温。

☁️ 公司与产业:许可、算力、以及实体风险

  • AWS 承认中东部分数据无法从被伊朗打击的设施恢复 — AWS says it can’t restore some data from mideast facilities struck by Iran。145 points/110 comments(HN)。💬 有人翻出 CBS 采访里 AWS 高管的那句”炸掉一个数据中心你不会注意到”,现在成了现成的反例;另一条指出真正的问题是同一可用区内多个数据中心被同时击中。还有从业者说 UAE 的数据驻留要求让他没法把数据挪出去,只能留在原地。
  • Mistral × Mozilla:私有、多语言的 AI 浏览 — Mistral X Mozilla: Private, Multilingual AI Browsing。510 points/182 comments(HN)。💬 争议焦点是产品页没有把本地推理和云推理分开讲清楚,用户被要求同意的是后者。有人举例:像”我上周看的那双跑鞋”这种查询,0.6B embedding 加本地检索就够,用不着 119B 前沿模型,也犯不着把一周浏览历史明文交出去。反方认为消费级笔记本普遍只有 8–16GB 内存,塞一个”足够好用”的本地模型到大众浏览器里目前做不到。
  • The DeepMind Institute — The DeepMind Institute。118 points/41 comments(HN)。💬 有人细读了经济政策那篇,列出三个冲击场景(从温和到剧烈)和对应政策,评价是”确实下了功夫”;也有人不客气地回:“这不算研究论文”——几张概念表格够不上。另有读者注意到当天首页大量帖子来自同一个注册 11 天的账号。
  • 小米 Mimo 2.6 实时后训练看板 — Xiaomi Mimo 2.6 live post-training dashboard。171 points/48 comments(HN)。💬 评论区变成实测交流会:一位工程师说他用 MiMo-V2.5 作为主力写代码,性价比极高,偶尔撞上幻觉循环,停一下再继续就能绕过去;也有人认为 2.5 只适合一次性的小脚本,跟 Qwen 3.8-flash-next 不在一个档,基础错误要到后面才暴露。还有人追问为什么不直接买重补贴的订阅。
  • Nvidia 宣布用 Rust 写原生 GPU 程序 — Nvidia announces native GPU programming in Rust。66 points/13 comments(HN)。💬 顶楼先认出文章本身写得像是 LLM 代笔;也有评论直说没人关心 kernel 用什么语言写——想要高层抽象的人会去用 Triton 或类似 DSL 来管 tile size。

🔒 安全与隐私:硬件信任根、域名、和一条支付通道

  • 黑客进了 Flock 摄像头 — Hackers Got Inside a Flock Camera。423 points/203 comments(HN)。💬 硬编码进去的是一个可以直接调用的 API key,用它换回来的是明文存储的凭据。有人逐条念 Flock 的漏洞披露政策:禁止与设备交互、禁止下载数据、TLS/DNS 配置类报告一律不收——反方指出这类豁免在安全团队里普遍存在,否则每天收一筐垃圾报告。最有价值的一条是反向的:这家公司做得越烂越好,当议员说”这些只是拍车牌的,不录视频”时,硬编码凭据的固件就是现成的反证。
  • Pixel 10 上的 C2PA 被伪造 — Forgery of C2PA on a Pixel 10。35 points/12 comments(Lobsters)。💬 有人先纠正动机:C2PA 的起点是新闻机构想要一个统一的方式确认素材没被 PS,跟 AI 生图无关。话题随后拐到信任根——除非图像传感器在数据离开芯片之前就签名,否则有 root 权限的人总能伪造签名。
  • Apple Reference Image:验证照片的新思路 — Apple Reference Image: A New Approach for Verified Photography。19 points/11 comments(Lobsters)。同日与 C2PA 那条形成对照,讨论里已经有人把两家的方案放在一起比。
  • A/I 关站 — A/I Shuts Down。132 points/74 comments(Lobsters)。Lobsters 今日最高分。A/I 是 Autistici/Inventati,被美国国务院列为特别指定全球恐怖分子,随后支付通道被切断,20,000 个邮箱、20,000 个博客、5,000 个邮件列表、1,500 个网站停摆。💬 一条来自欧洲支付网络从业者的解释很关键:任何走美元的跨境交易都必须过美国银行体系,一家银行要能跟美国银行清算才能当银行,所以不是”愿不愿意”的问题。有人问欧盟能否立法切断,回答是先把替代系统建起来并且被采用,再看二十年。另有人警告反向风险:如果欧洲银行不能超出欧洲判决去关户,脏钱会更快地路过欧洲。
  • verygoodsoftwarenotvirus.ru 的终结 — The end of verygoodsoftwarenotvirus.ru。38 points/11 comments(Lobsters)。💬 一条总结得干脆:用别国的 ccTLD,就得接受别国的任意性。评论里排了一串同类事件——Notion 的 .so 迁移、.ly 域名撞上利比亚法律、queer.af 被塔利班关停。
  • 26 年后,PS2 的安全芯片被彻底攻破 — Original Sony PlayStation 2 security chip ‘broken wide open’ after 26 years。12 points/0 comments(Lobsters)。四年投入逆向 Toshiba CXP102064 Mechacon。分数低是因为懂这行的人少,不是价值低。

🛠️ 工具与基础设施

  • 小型编程技巧 — Small programming tricks。339 points/167 comments(HN)+ 59 points/28 comments(Lobsters)。💬 Lobsters 侧全是补充:rg pancakes | fpp 把输出里的路径挑出来直接开编辑器;git-jump diff/merge 是 git 自带脚本但常不在 PATH 里;vim -q <(grep -n ...) 把 grep 结果当 errorfile,用 :cn 跳转。HN 侧在聊为什么这类技巧学不会——有人列了 cheat sheet 贴工位,然后被 hot-desking 干掉了。
  • 重新发明 issue 跟踪:local-first 且 git-native — Reinventing issue tracking: Local-first and Git-native。23 points/25 comments(Lobsters)。💬 评论把前作补齐了——git-bug、git-issue、bugs-everywhere,作者漏引被直接点出来;有人补刀 git-bug 的 push/pull 依赖特定 SSH 配置,这个缺陷挂了几年没修;还有人问为什么不用一个专用分支存 issue,而不是另开仓库。
  • WalShadow:从物理 WAL 做亚秒级 Postgres→ClickHouse 复制 — WalShadow: Sub-second Postgres replication to ClickHouse from physical WAL。30 points/5 comments(HN)。绕开逻辑解码直接读物理 WAL,实测提交到可见约 200ms、吞吐 289K 行/秒。
  • 用 Delta 取代 Pull Request — Replacing Pull Requests with Delta。12 points/2 comments(Lobsters)。Zed 的公测。PR 这套流程的问题在于它把”讨论”和”代码状态”绑在了托管平台上,换掉它意味着换掉的不只是 UI。
  • 备份并不简单 — Backups Aren’t Simple。15 points/1 comments(HN)。和上面 AWS 那条一起看更有意思:可恢复性和有备份是两件事。
  • GEFS 在 OpenBSD 上的极早期预览 — GEFS on OpenBSD: A very early preview。90 points/19 comments(Lobsters)。💬 作者本人在场答疑,还贴出了 EuroBSD 的演讲录像。被问 HAMMER2 时他评价对方设计合理,但不喜欢靠 GC 释放块的做法,也认为用 Bε 树降低写放大的收益值得;被问稳定性时很直接——最后一个严重 bug 修得太近,不敢说稳定,请务必留备份。
  • 最小可用的 Linux 发行版 — The smallest possible Linux distribution。14 points/6 comments(Lobsters)。DistroWatch 问答栏,顺着”到底能小到什么程度”往下算,实际约束来自内核和 init,不来自包管理。
  • 简单高效的 Row-Level Security — Simple and Efficient Row-Level Security。10 points/0 comments(Lobsters)。把租户隔离放在数据库层而不是应用层,性能代价是主要争论点,这篇给的是实测路线。
  • 向量化的可移植 Quicksort(2022) — Vectorized and performance-portable Quicksort (2022)。160 points/24 comments(HN)。旧文重上首页,说明排序在 SIMD 上的实现细节仍然是硬骨头。
  • 给博客文章申请 DOI — How to get a DOI for your blog posts。25 points/8 comments(Lobsters)。💬 有人问 DOI 相比永久 URL 多了什么,作者的答案很实在:不赌自己的域名一直续费、不被新的 .mobi 持有者宰一刀,而且 DOI 解析可以指向新地址。
  • Gothub 列表 — Gothub lists。5 points/0 comments(Lobsters)。OpenBSD 相关的资源清单,冷门但整理得干净。

💻 语言与底层

  • .NET 11 的性能改进 — Performance Improvements in .NET 11。107 points/12 comments(HN)。这篇年度长文本身就是 JIT 与 GC 内部实现的教材,读它比读发布说明有用。
  • Ubuntu 26.10 完成到 Rust coreutils 的切换 — Ubuntu 26.10 completes transition to Rust-based coreutils。45 points/44 comments(Lobsters)。💬 高赞不客气:比起急着干掉 C,coreutils 根本不是优先级最高的地方;同时承认 Rust 标准库在文件系统操作上确实弱。另一条把话说回来了——“人们总抱怨公司不给开源投钱,真投了又开始挑”,这类众口难调的评论在这条下面出现得很自然。
  • JDK 27 发布 — JDK 27 has been released。36 points/5 comments(Lobsters)。半年一版的节奏没变。
  • Unicode 18.0.0 — Unicode 18.0.0。10 points/2 comments(Lobsters)。新字符和属性更新,顺手提醒一句:字体厂商要开始追了。
  • C++26:平凡的无限循环不再是未定义行为 — C++26: Trivial infinite loops are no longer undefined behaviour。5 points/0 comments(Lobsters)。一个存在了几十年、编译器可以合法删掉死循环的坑,终于填了。
  • GNOME 51 发布 — Introducing GNOME 51。21 points/6 comments(Lobsters)。💬 “移除 legacy NVIDIA 驱动接口”一度引发恐慌,随后被澄清指的是 EGLStreams 路径,GTX 10xx 的 GBM 支持还在。WEP 支持被彻底删除则是毫无争议的一项。
  • AttaLambda:类型和数据都由无类型 λ 构成的语言 — Show HN: AttaLambda。33 points/1 comments(HN)。💬 唯一一条评论很不留情面:把 prompt 直接分享出来就行——“用 Racket 实现 Greg Michaelson 那本书”,并指出它跳过了学 λ 演算时所有值得看的部分。这条放在今天,正好呼应上面关于 LLM 产出的争论。
  • 纹理的解剖 — Anatomy of a Texture。65 points/11 comments(HN)。从采样到 mipmap 的完整拆解,图形方向的基础补课材料。
  • 给浮点数加个小数部分反而修好了 shader — When adding a fractional part to a number fixes your shader。10 points/0 comments(Lobsters)。典型 GPU 精度问题,解释清楚比结论值钱。
  • Veloren 做对的几件不一样的事 — Some things Veloren does differently。62 points/2 comments(Lobsters)。💬 作者现身解释程序化水体与河岸的实现,用的是五年前由一位贡献者逐步打磨出来的阈值加加权样条距离算法。他特意强调了一句:“这些都不是 LLM 吐出来的”——这句话本身成了今天的一个注脚。
  • 为什么写一个 Rust LSP 这么难 — Why building a Rust LSP is hard。9 points/4 comments(Lobsters)。宏、条件编译、以及增量解析三件事叠在一起,编译器能忍的组合编辑器忍不了。
  • 程序员为什么不喜欢 reduce — Anecdotally, programmers dislike “reduce”。62 points/109 comments(HN)。评论数远超分数。💬 讨论集中在两点:各语言的参数顺序不统一(initial 在前还是在后、回调参数谁先),以及不传初始值时的空集合陷阱。还有一条把矛头指向 filter——滤网留面条还是留水,很多语言在这件事上也没统一。

🧪 硬件、科学与其他

  • Show HN:一块听鸟叫、并把它们画成 19 世纪插画的 e-ink 相框 — Show HN: An e-ink frame that hears birds and draws them as 1800s illustrations。2039 points/236 comments(HN)。昨日 1190 分,今日 2039。💬 有人点出底层分类器是 BirdNET——传统神经网络,不是 LLM,讨论随即转向”哪些任务本来就不该上大模型”,还有人实测了支持音频输入的开放权重模型:它们把音频当转写文本处理,音乐、口音、背景音一概分不出来。价格也被反复吐槽,整机约 500 欧,替代方案是二手 Kobo 加 Cobalt,约 120 美元。
  • 美国战略石油储备背后的工程 — The engineering behind the US Strategic Petroleum Reserve。20 points/0 comments(HN)。盐穴、水压、溶浸采矿——地下储油解决的是一组很具体的物理约束。
  • 宇宙为什么会膨胀? — Why Does the Universe Expand?。4 points/1 comments(HN)。分数低但问题本身没有共识答案,值得看一眼它怎么组织论证。
  • 西伯利亚冰少女与斯基泰世界 — The Siberian Ice Maiden and the Scythian World。45 points/4 comments(HN)。考古视角的长文,与今天的技术内容无关,适合当休息区。
  • 我把白噪音浏览器标签页换成了一个菜单栏 App — I replaced my brown-noise browser tab with a menu bar app。6 points/0 comments(HN)。分数很低但思路干净:为了听噪音让一个浏览器标签常驻,代价是一整块内存。
  • 日本的图书生态正从书店转向图书馆 — Japan’s book scene is moving from bookstores to libraries。65 points/19 comments(HN)。书店消失之后的替代品是图书馆,这件事在出版业和公共财政之间的连锁反应比表面复杂。
  • 告诉演讲者你喜欢他们的演讲 — Tell the speakers that you liked their talks。263 points/74 comments(HN)。今天分数第三高的人文帖。评论区共识很一致:大多数演讲者收到的反馈只有沉默和挑刺,一句具体的”哪一部分有用”比十句客套值钱。
  • 逆向 Factorio 的随机数生成器 — Reversing Factorio’s RNG。92 points/11 comments(HN)+ 4 points(Lobsters)。确定性模拟游戏的地图生成必须可复现,于是 RNG 就成了公共接口。

📌 今日总结

情绪上今天偏警惕:e-ink 相框那种”小而美”的项目拿了 2039 分,说明社区对不依赖大模型的踏实工程依然给足面子;但同一天的另一半内容全是边界被踩——AWS 承认中东数据救不回,Flock 的硬编码凭据进了监控摄像头,A/I 因为一条支付通道被切断就整体消失,verygoodsoftwarenotvirus.ru 证明域名从来不是自己的。同一周里”技术债”这个词适用的对象从代码扩到了实体基础设施和管辖权。

必读三篇:① 4B 模型做查询计划,重点看它的实验边界怎么被评论区逐条拆开,这比 81% 这个数字有用;② A/I 关站,20 年隐私基础设施是怎么在一周内倒掉的,评论区把美元清算这条链讲得比原文清楚;③ Flock 摄像头被拆,软硬结合的监控栈有多脆,顺便看懂”设备侧漏洞披露政策”是怎么写来挡人的。

横向信号有两条。一是模型选型开始往两边分:BirdNET 在 e-ink 相框里干活、4B 模型去啃 SQL 优化器、三元权重研究在抠 1.625 bit 里那 0.04 的浪费——专用化和压缩同时在被认真对待,而”全都上大模型”这个默认选项正在失去支持者。二是权限与管辖权成了今天反复出现的暗线:浏览器该不该把浏览历史送云、支付通道能不能被单方面切断、摄像头固件里的一个 key 值多少权限、域名注册在谁的法律之下——这些问题的答案都不在代码里。