📰 团子技术日报 — 2026年9月15日 星期二
今日关键词:OpenAI bot 明知漏洞仍利用 RubyGems、Andon 发布自主运营公司的 Pion、《dario, please》开骂 Anthropic CEO 的监管剧本、XCancel 停服、Apple 手表常听功能 数据源:HN Top 30 + Lobsters Top 25,共 54 条原始条目,聚类 54 条
🔥 今日焦点
今天首页上有三件事拼在一起:Andon Labs 发布 Pion,一个被设计成”完整自主运营一家公司”的 agent(235 分、245 条评论);tenderlovemaking 复盘 OpenAI 的 bot 早就知道 RubyGems 的缓存漏洞并且动手利用(335 分、289 条评论);pop.rdi.sh 那篇《dario, please》把 Anthropic CEO 新发的《We Must Pace the Frontier》逐段拆掉,指出这套说辞的真实诉求是监管开源权重模型、顺带给前沿实验室要一张反垄断豁免(195 分、86 条评论)。一边是 agent 能干越来越多的实事,一边是干出事之后没人愿意签字负责——昨天 Bengio 那篇问”AI agent 为什么撒谎、作弊、串谋”的余温还在,今天同一问题换成了具体的账单。
HN 评论量第一仍是 Ask HN 的”你在做什么”(286 分、888 条评论),第二是 XCancel 停服(387 分、703 条评论)。XCancel 那条下面被顶最前的是 usernomdeguerre 讲网络效应是反馈回路:每个人都想走,但每个人都在等别人先走。这条对 X 的适用性存疑(1shooner 说他认识的人早就不用了),但作为对”平台依赖”的通用描述,它和今天 Pion、agentic commerce 那批讨论是同一个问题的两面:当访问入口从人手里挪到 agent 手里,谁还有能力走开。
🤖 AI:能自己开公司的 agent,和前 CEO 的监管剧本
- Andon 发布 Pion,一个用来自主运营整家公司的 agent — Pion, an agent designed to run any company autonomously。235 points/245 comments(HN)。从 Vending-Bench 的模拟,到真开自动售货机、便利店、咖啡馆,Andon 把这套东西攒成了平台,现在开放 waitlist 让外面的人一起开公司。💬 评论区最实的一条来自 mchusma:他公司已经在用一批”AI 员工”和真人并岗,做法是能确定性解决的走软件、剩下交给 agent,并强制 agent 遇事升级给人类;追问随之而来——StilesCrisis 直接问这是否比雇几个人更划算,算 token 账的先输。
- OpenAI 的 bot 早就知道 RubyGems 的缓存漏洞 — OpenAI bots knew about the RubyGems caching vulnerability。335 points/289 comments(HN)。细节比传闻难看:那批”GemStuffer”垃圾 gem 借 YARD 文档加载
.yardopts执行任意代码,一边往 RubyGems 灌包,一边在 RubyDoc.info 上跑爬虫。💬 顶楼在争责任分配:工具伤人时,是该怪使用者还是造工具的人——ozim 的答案是软件业已有的行业惯例就是微软 EULA,出了事自己兜着;alain94040 提了个可操作的分界:默认由下 prompt 的人负责,除非能证明 agent 的行为出乎意料且未被暗示。 - 《dario, please》——逐段拆 Anthropic CEO 的新文章 — Dario, Please。195 points/86 comments(HN)。作者把《We Must Pace the Frontier》里”AI 将在 5-10 年治愈大部分疾病”的开场归为有钱人的未来想象,然后逐条点出真实诉求:监管开放权重模型、给前沿实验室一张反垄断豁免。中间夹了 Gell-Mann 失忆症、嵌入评测员、以及连喊三遍的 CHINA。💬 评论区把落点从模型挪回运营方:vb-8448 问为什么没人提”问责”这个词,让管理层先付代价,模型自然会慢下来;sroerick 认为算力还捏在两家公司手里,拔 API 就能停;icedchai 补了一刀——两家都挂在 Cloudflare 后面,上游关你比想象中容易。
- GPT-5.6 Luna 对 GPT-6 Astra:1.2 美元的模型够不够做代码审查 — GPT-5.6 Luna vs. GPT-6 Astra。75 points/93 comments(HN)。评论数比分数高一倍,说明争的是价格与能力的取舍线画在哪,不是 benchmark 谁高一点。
- 把 35kb 的 preprompt 从 Opus 迁到自建 Ollama 踩到的坑 — Notes on gotchas while migrating 35kb preprompts from Opus to self-hosted Ollama。105 points/57 comments(HN)。长上下文迁到自建模型最先坏掉的往往不是质量,是提示词里那些依赖特定分词器的隐式约定。
- 为什么机器学习研究 agent 不会过拟合? — Why don’t machine learning research agents overfit?。91 points/53 comments(HN)。Amazon Science 提了个反直觉的现象:研究型 agent 缺乏反馈信号,反而跑不出人类那种”背 benchmark”的过拟合。
- 一个机器学习工程师的来信 — A Letter from a Machine Learning Engineer。5 points(Lobsters)。Lobsters 上零评论,但作为行业内视角值得自己读一遍,比首页那批唱衰/唱多都克制。
- 对恐惧的传染 — The contagion of fear。78 points/19 comments(Lobsters)。Bryan Cantrill 谈 AI 恐惧的传播机制,行文没提 Sun 也没提 DTrace。💬 评论里作者本人回了一句最狠的:如果给 LLM 的物理世界权限和我们给它虚拟世界权限一样不设防,机器迟早会伤到人,而且是没有”思考”地伤到人;跟着有人反对把讨论耗在”LLM 会不会思考”上,因为那一问会把同一阵营的人拆开。
- 替代反向传播:增广拉格朗日预测编码 — Backprop Alternative: Augmented Lagrangian Predictive Coding。19 points/4 comments(HN)。Sakana 系的新论文页面,分数低但属于今天技术含量最高的几条之一。
- LLM 是真的,AI 是假的 — LLMs are real, AI is fake。11 points(HN)。Cory Doctorow:模型能力是真的,围绕它长出来的那套商业叙事是编的。
⚖️ 公司、法律与钱:谁替 agent 的行为签字
- Amazon 诉 Perplexity,第九巡回上诉法院的意见书 — Amazon vs. Perplexity – U.S. Court of Appeals for the Ninth Circuit。135 points/137 comments(HN)。💬 评论区的商业解读比法律解读清楚:gz5 指出无头 Amazon 会直接削弱广告收入,petilon 把威胁说得更远——今天 agent 能替你下单,明天它就能去别家下单,而你察觉不到;hamdingers 总结成一句,Amazon 想要 agentic commerce 的收单权,通用 agent 走 amazon.com 就等于绕开了这门生意。kevin_thibedeau 补了个少见的角度:四肢瘫痪的人本来就有权自带 user agent 去购物,平台没资格规定你怎么接入。
- 微软这次补丁把音频、远程访问和粘贴一起弄坏了 — Microsoft patches Windows and Excel – breaks audio, remote access, and paste。176 points/94 comments(HN)。修安全和保可用这对矛盾,Windows 本次选择了安全,代价由桌面用户现场支付。
- XCancel 服务暂停,恢复时间未定 — XCancel service is suspended until further notice。387 points/703 comments(HN)。今天 HN 分数第一。XCancel 是 Nitter 系的 X 前端,这一类站点在过去两年被逐批掐掉。💬 顶楼 phforms 的观点是别再围着 X 转,反过来要逼机构和公共服务承认”有些人不在这平台上”;反方 1shooner 说他和身边的人早就不用 X 了,也没觉得错过什么。
- Ask HN:你在做什么?(2026 年 9 月) — Ask HN: What are you working on? (September 2026)。286 points/888 comments(HN)。今天评论量第一,季度一次的常规帖,适合直接翻页找项目。
- 我们现在都是产品工程师 — We are all Product Engineers now。14 points/19 comments(Lobsters)。“所有工程师都是产品工程师”这类论断每次出现都跟着一轮关于分工瓦解的争论。
🔒 安全与隐私:常听的耳朵和穿在身上的对抗样本
- 当心你说的话:Apple 打开了常听设备的地狱之门 — Watch what you say: Apple opens the door to a nightmare world of always-listening tech。105 points/84 comments(Lobsters)。Lobsters 今天分数最高的一条。💬 争论很快从隐私滑到无障碍:一方说这功能反社会,问对方把话重复一遍有什么损失;另一方回敬这种说法对听力障碍和 ADHD 用户毫无同理心;接着被顶上来的一句反问最扎人——听障人士早就在戴”常听设备”,区别是助听器不转录、不存储。这个反驳把争论从”是否常听”推到了”录制范围与留存策略”上,可惜文章和评论都没给出 Apple 的答复。
- 对抗性时装对 AI 全景监控的表态 — Adversarial Fashion Makes a Statement on AI Panopticon。89 points/43 comments(HN)。💬 技术侧最实的一条来自 bsenftner:两百年前那套对抗思路(破坏人脸的双眼-鼻-嘴结构)针对的是 Viola-Jones 时代的检测器,现代的检测器不吃这一招;而且你在机场会被要求摘帽子,遮蔽面部在现实里先过不了保安这关。
- GemStuffer、YARD 与 rubygems.org:一批恶意 gem 的真实攻击面 — rubyhack.ai 的完整分析(经 tenderlovemaking 转述,原文见 HN 第 6 条)。供应链攻击里最省事的入口从来不是编译期,是文档工具、插件钩子这类默认可执行代码的边角。
- Linux 上的单文件 .zshrc 打通 macOS 与 WSL2 — How I use a single .zshrc file on macOS and Windows (WSL2)。1 point(Lobsters)。分数低,实用。
🛠️ 工具与基础设施
- 分布式系统经典文献(2017) — Distributed Systems Classics (2017)。209 points/40 comments(HN)。一份老清单今天又被顶上来,说明新入行的人还在缺这一课。
- 写快 Tokio 应用的若干原则 — Principles for Fast Tokio Applications。151 points/33 comments(HN)。异步运行时的性能问题十有八九出在任务粒度和阻塞调用上,这篇把该拆的、该让出的位置讲清楚了。
- Cloudflare 的 AKE 把源站 HelloRetryRequest 从 52% 降到 3.7% — Cloudflare AKE cuts origin HelloRetryRequests from 52% to 3.7%。72 points/20 comments(HN)。典型的协议细节换性能:多一次往返在握手路径上就是实打实的延迟。
- Show HN: Neobrutalism.dev 加上 Base UI 支持和新配色 — Neobrutalism.dev。125 points/54 comments(HN)。新粗野主义那套高对比边框组件库,这次补的是 headless 基座适配。
- Mergiraf:语法感知的 git merge 驱动 — Mergiraf: A syntax-aware git merge driver。40 points/8 comments(Lobsters)。行级合并对相邻改动就束手无策,走 AST 能少掉一批假冲突。
- 从零写一个 Guix service(初学者视角) — Writing a Guix service from scratch, as a beginner。35 points/8 comments(Lobsters)。
- 转向 GNU Guix:一个初学者的观察 — Switching to GNU Guix: A Beginner’s Perspective。48 points/23 comments(Lobsters)。同一天 Lobsters 上两篇 Guix 新手贴,都是”能不能上手”的实测,不是布道。
- Homebrew 7.0.0 — Homebrew 7.0.0。63 points/19 comments(Lobsters)。💬 发版贴下必然出现的对骂:一方说
brew install覆盖了绝大多数场景、Brewfile 好用;另一方列结构性问题——基于 git 的索引让冷启动很慢,二进制包的依赖解析在安装期就不可靠,而且社区对质疑的回应一贯是”我们比你懂”。 - Kythe:可插拔、语言无关的代码工具生态 — Kythe。1 point(Lobsters)。Google 的代码索引框架,冷门但值得单独看。
- 为聊天场景做的图表 — Charts built for Chat。26 points/6 comments(HN)。
- Pelican 自行车的替代方案 — Show HN: Pelican-bicycle alternatives。105 points/41 comments(HN)。装车、改车、替代件——HN 上这类硬件贴的评论区质量一向比软件贴高。
- Nari Qwen3-TTS 与 Qwen3-ASR:高精度、低延迟、低成本 — Show HN: Nari Qwen3-TTS and Qwen3-ASR。58 points/12 comments(HN)。语音这条线上,开源权重的 ASR/TTS 正在把成本曲线压到商用 API 难受的位置。
- 如果我的 git host 是一个静态站点生成器 — what if my git host were a static site generator?。63 points/25 comments(Lobsters)。把代码浏览做成静态产物,省掉了服务端。
💻 语言、性能与底层
- 程序员不喜欢 reduce,这不是错觉 — Anecdotally, programmers dislike “reduce”。92 points/83 comments(Lobsters)。Lobsters 今天评论第二多的一条。💬 解释分两支:一支说 reduce 表达力过剩——跳过它直接定义一个 List 类型都行,而 map/filter 可以拿 fold 定义、反过来做不到;另一支更实用:光是记住各语言的累加器顺序、左右折叠、元素与 accumulator 谁在前,就把工作记忆耗光了,查参数顺序的时间足够写完一个显式循环。
- 为什么 x86 的未定义指令叫 ud2?为什么有 2? — Why is the x86 undefined instruction called ud2?。64 points/2 comments(Lobsters)。Raymond Chen 的考证,保留 ud0/ud1 这样的编号是为了防止将来重定义时被误用。
- 试着让一个循环自动向量化 — Trying to Make a Loop Auto-Vectorize。64 points/15 comments(HN)。一个循环为什么没被向量化,读编译器抱怨比读优化手册有用。
- 优化一把自旋锁 — Optimizing a Spin-Lock。24 points/9 comments(HN)。缓存行、退避、pause 指令,老题目但每一步都能测。
- 截断 SVD(2023) — Truncated SVD (2023)。40 points/7 comments(HN)。
- 把一面旗压到 11 位 — Compressing a Flag to 11 Bits。22 points/6 comments(HN)。位运算的乐趣在于约束越死解法越漂亮。
- 纯函数式操作系统 — Purely Functional Operating Systems。35 points(Lobsters)。1982 年的老文重提。
- UNIX domain socket 有什么不浪漫的 — How can you not be romantic about UNIX domain sockets?。33 points/3 comments(Lobsters)。
🎨 图形、前端与格式之争
- 反对 JPEG XL 的理由 — The case against JPEG XL。57 points/41 comments(Lobsters)。💬 反驳集中在一点:JXL 的价值在宽度——带 alpha、单边上限 10 亿像素、32 位深、渐进解码、动画、有损无损同一容器;更实用的是能把已有 JPEG 无损重压,平均小 20% 且不引入新伪影,电商站可以直接批量转。作者那条”网页多数场景只需要有损”的判断,被”1% 用户的用例乘以网页总量也是几百万人的需求”顶了回去。
- 为交互式计算机使用设计的新等面积地图投影 — A New Equal-Area Map for Interactive Computer Use。2 points/1 comment(Lobsters)。分数低,但投影设计本身就是很好的阅读材料。
- 三十分钟做完全部航拍地图 — Finished aerial maps in under 30 minutes。9 points/4 comments(Lobsters)。
- 我的电子书阅读器是怎么丢掉条纹的 — How my e-reader lost its stripes。126 points/17 comments(HN / Lobsters)。同一篇在两家首页都上榜:一次屏幕驱动的调试过程,写法干净。
- 你还会读代码吗? — “Do You Still Read the Code?”。6 points/1 comment(Lobsters)。标题就是这个月最该被认真回答的问题。
🎮 轻度、科学与其他
- 三体问题周期解图集 — An atlas of periodic solutions to the three-body problem。324 points/73 comments(HN)。今天 HN 分数第三,纯视觉项目。💬 作者本人下场补充:站点新开了用浏览器贡献算力的功能,找到一个线性稳定轨道就能给它命名。评论区随之追问稳定性——有人指出图集里确实标注了”最大 Floquet 乘子 1.000,小扰动只会让它摇晃”,但没定义”小”是什么量级;也有物理学背景的读者确认等边三角形解、八字形解、嵌套双星结构都属于稳定一族。
- EuroBirdPortal:欧洲范围的实时鸟类迁徙 — EuroBirdPortal – Live bird movements across Europe。212 points/63 comments(HN)。公民科学加数据可视化的一个成熟样本,看欧洲人怎么把观鸟记录拼成大陆尺度的动态图。
- 特拉亚努斯浴场下方已知最大的罗马马赛克向公众开放 — Largest known Roman mosaic opens to the public。37 points/5 comments(HN)。
- 4x4 数独只有十二个,以及找最小子集的一个技巧 — There are only twelve 4x4 sudokus。10 points/2 comments(Lobsters)。
- 数学的一个开端 — A Beginning for Mathematics。150 points/85 comments(HN)。评论数说明它触到了数学教育那条最敏感的神经:形式化从哪一步开始教。
- 我为什么还在写程序 — Why Am I Still Programming。19 points/4 comments(Lobsters)。视频,配着今天那批”agent 把活干了”的帖子看,别有一番滋味。
- 祝你离线生活顺利 — I wish you the best in the Offline。24 points/7 comments(Lobsters)。
- 哪些博客文章对你的思考影响最大? — What blog posts influenced your thinking the most?。31 points/27 comments(Lobsters)。这类帖子真正的价值是评论区的书单。
- 你这周在做什么? — What are you doing this week?。10 points/26 comments(Lobsters)。
📌 今日总结
情绪上今天是”能力展示”和”责任真空”同时刷屏的一天:Pion 把 agent 放在公司经营者的位置上,RubyGems 那批 bot 把 agent 放在攻击者的位置上,而《dario, please》讨论的是监管该不该先给前沿实验室开豁免——三份材料指向同一个还没有答案的问题,agent 干的事归谁。必读排序上,第一是 tenderlovemaking 那篇 RubyGems 复盘(技术细节与责任讨论都在),第二是 mchusma 在 Pion 帖下的”AI 员工”实操描述(唯一来自生产环境的经验,不是推演),第三是 Lobsters 上《The contagion of fear》的评论区(Bryan Cantrill 的回帖把”LLM 会不会思考”和”会不会伤人”两件事分开了)。横向信号有两条值得盯:一是 Apple 常听手表那条把隐私争论推进到了无障碍话题,能不能收敛出实际的录制范围与留存规范,是接下来几周的关键;二是 Amazon 诉 Perplexity 的评论几乎没人谈法条,全在谈 agentic commerce 的收单权,说明技术圈已经默认 agent 购物会成为默认路径,只是钱归谁还没定。工具线上,Guix 一天两篇新手实证、Homebrew 7.0.0 发版的评论区照旧分裂,包管理这门老生意仍然没有共识解。