1. "I don't like passkeys"——今日 HN 最大论战,666 分

  • Velocity: ▮▮▮ trending
  • Source: Hacker News · 666+ 分 · 642 评论 · 约 8 小时前(~20:06 UTC+8)
  • Tags: passkeys auth security ux

Ethan Hawksley 的文章认为 passkey "完美适配企业环境,却不适配个人安全":账号找回仍
取决于最弱的一环(短信、邮件链接),硬件密钥每把只能容纳约 25–100 个可发现凭据且无法
备份,同步型 passkey 把所有第三方登录绑死在 Apple/Google 账号上——一次自动封号即可
全部切断,而二维码加蓝牙的混合回退在实践中并不可靠。他给出的替代方案:第三方密码
管理器 + 独立 TOTP 应用。他也承认:对密码复用者和企业用户,passkey 是实打实的升级。

为什么重要: 642 条评论里大多是认同者的切肤之痛——这说明失灵的是部署模式,而不是
密码学本身。"找回路径才是最弱环节"是安全团队早知道的道理,但很少有人对一个正在被
全行业默认推行的标准说得这么直白。

🔗 hawksley.dev · 🔗 HN 讨论


2. Dan Abramov "氛围式"证明 Conway 精炼猜想——Lean 校验通过、约 4 万美元 token、尚未经人类独立验证

  • Velocity: ▮▮▮ trending
  • Source: Hacker News · 155+ 分 · 150 评论 · 约 6 小时前(~22:36 UTC+8)
  • Tags: lean formal-methods agents mathematics

React 核心开发者宣布证明了超实整数(omnific integers)上的 Conway 精炼猜想(1976 年
提出:任意两个分解必有共同精炼),在 Lean + Mathlib 中形式化并通过内核校验——建立在
L'Innocente–Mantova 2024 年的归约之上。工作流是 Codex 多智能体"实验室"(PM、数学、
对抗、Lean 各司其职,外加一个"食堂"中继),Claude 负责形式化、ChatGPT 负责探索:
约 400 亿 token,按 API 价格约 4 万美元,外加他一个月的业余时间。两个"接近完成"的
证明被推倒重来——一个是循环论证,一个是约 30 篇未经验证的智能体生成"论文"搭成的
纸牌屋。

为什么重要: 请把作者自己的保留意见一起带走:"我的证明尚未被数学家独立验证",
且正确性以"不依赖 Lean 内核 bug"为前提。但方法论才是重点——一个业余项目经理带着
智能体在 50 年的公开难题上拿到内核校验过的结果,真正干活的是验证纪律(linter 审计、
陈述/证明配对、仅依赖 Mathlib 的陈述文件)。

🔗 overreacted.io · 🔗 HN 讨论


3. 三个 Linux 内核漏洞同日进入 CISA KEV——TLS、ebtables 与 AF_ALG

  • Velocity: ▮▮▮ trending
  • Source: CISA KEV · 9 月 18 日收录
  • Tags: cve linux kernel kev tls

CISA 于 9 月 18 日将三个内核 CVE 列入已知在野利用漏洞目录:CVE-2025-39682(TLS 接收
路径的零长记录绕过 recvmsg() 记录类型处理——**CNA 评分 CVSS 9.8,NVD Analyzed 仅
7.1**,罕见的公开分歧)、CVE-2026-53266(ebtables SNAT 越界写入,经 ARP 发送端硬件
地址改写触碰非线性 skb 分片——CNA 评分 8.8)、CVE-2025-39964(对同一 AF_ALG socket
并发写入损坏 socket 状态——CNA 7.8 / NVD 5.5)。三者都是较早已修补的旧漏洞;新变化
是联邦层面的在野利用认定。

为什么重要: 内核内部漏洞进入 KEV 并不寻常,意味着攻击者认为它们值得在真实系统上
武器化——很可能是在运行旧内核的容器或网络设备内部。而 CNA 9.8 对 NVD 7.1 的评分
分裂,正是本刊规则要求"CVSS 数字必须记录评分方"的活例子。

🔗 CISA KEV 目录 · 🔗 NVD 记录 CVE-2025-39682


4. Cactus Needle 3:9–29 MB 端侧模型号称达到 DeepSeek-V4-Flash 级工具调用——请先读图注

  • Velocity: ▮▮▮ trending
  • Source: Hacker News(Show HN)· 104+ 分 · 约 20 小时前(~08:11 UTC+8)
  • Tags: on-device edge-ai function-calling quantization

Cactus 的 Needle 3 是面向手机、可穿戴和 MCU 的基础模型,只做三件事——工具调用、结构化
抽取、embedding——并明确不做聊天。单一权重集覆盖 2–20 层子网络(29–121M 参数、CQ2
2-bit 量化、9–29 MB),训练数据 360B token;宣称在移动端工具调用上击败 10 倍大的模型,
Pi 5 上解码 400–4k tok/s。而"匹配 DeepSeek V4 Flash"的头条来自微调过的 4 层子网络
——图注写明:基线是 vLLM 下的 f16,DeepSeek 走云端 API,评测使用强制调用。

为什么重要: 微型确定性工具调用模型确实是端侧技术栈的真实空白,公开精确推理条件
的做法也优于多数同行。但头条对比混合了量化、运行时与访问路径——能成立的结论是
"微调后的 121M 参数模型在强制工具调用上可以打",而不是"29 MB 等于 DeepSeek"。

🔗 cactuscompute.com/needle · 🔗 HN 讨论


5. Cloudflare Quick Tunnels 面向智能体重新发布——隧道不是新的,JSON 才是

  • Velocity: ▮▮ rising
  • Source: Hacker News · 401+ 分 · 约 6 小时前(~22:18 UTC+8)
  • Tags: cloudflare tunnels devtools agents

HN 上 401 分的热帖是 cloudflared tunnel --url localhost:PORT——但 trycloudflare.com
上的快速隧道已存在多年,Cloudflare 自己的文档也仍注明"仅用于测试与开发"。真正的新东西
是 try.cloudflare.com 页面把该功能重新包装给编码智能体:主机名、边缘节点与健康状态
以 stdout JSON 输出("不用再对日志做正则")、可直接挂 webhook 的临时 URL、约 3 秒
获得公网加密端点,无需账号、不开端口。

为什么重要: 讨论区的热度集中在智能体工作流——给智能体一个公网 HTTPS 端点做
webhook 测试是个反复出现的高摩擦步骤,stdout-JSON 恰是智能体需要的接口。值得保留的
提醒:临时随机 URL 同时也是攻击者喜欢的数据外带通道,安全团队早已盯上
*.trycloudflare.com 流量。

🔗 try.cloudflare.com · 🔗 HN 讨论


6. Stably Orca:71.8k 星的"ADE",为并行编码智能体舰队而生

  • Velocity: ▮▮ rising
  • Source: GitHub Trending(周榜)· 本周 +5,305 星(第 16 名)· 共 71.8k
  • Tags: agents ade worktrees parallel-agents

stablyai/orca 是开源(MIT)的智能体开发环境,用于同时编排多个 CLI 编码智能体——
Claude Code、Codex、Cursor、Copilot、Devin、Qwen Code 等——复用你已有的订阅。一个
提示扇出到隔离 git worktree 中的多个智能体并择优合并;iOS/Android 伴侣应用远程指挥
舰队;点击 UI 元素即可把上下文注入提示(Design Mode);从 Linear/GitHub 任务或 SSH
直接开 worktree。YC 孵化,每日发版,Windows 签名构建。

为什么重要: worktree 舰队模式(worktrunk、firstmate、ECC——本刊上周均已覆盖)
迎来了第一个消费级 IDE 形态的入局者,每周 +5.3k 星说明需求是真实的。悬而未决的问题
与所有舰队工具相同:五个智能体抢一个任务时,token 账单谁来付。

🔗 github.com/stablyai/orca · 🔗 onorca.dev


7. obra/superpowers:技能+方法论框架突破 288k 星

  • Velocity: ▮▮ rising
  • Source: GitHub Trending(周榜)· 本周 +3,821 星 · 共 288.5k
  • Tags: agents skills tdd methodology

Jesse Vincent 的 superpowers 是一套由可组合智能体技能构成、立场鲜明的方法论:智能体
先访谈你要出规格、分块呈现设计、写出每个 2–5 分钟且带精确文件路径的任务计划,然后以
两阶段评审跑子智能体驱动开发——并强制 TDD,先于测试写出的代码一律删除。安装器覆盖
13+ 种 harness(Claude Code、Codex、Cursor、Gemini CLI、Copilot CLI、Devin、Droid、
Kimi Code、OpenCode……)。MIT 许可;可选的单 logo 遥测,退出方式有文档。

为什么重要: 按原始数字,288k 星的 superpowers 是智能体生态中最大的方法论层项目,
它的核心赌注——瓶颈在流程纪律而非模型质量——与本周的 harness 设计研究从测量一侧
得出的结论相同(见第 14 条)。两阶段评审加"先计划后执行"的循环,是这一论点具体、
可复制的产物。

🔗 github.com/obra/superpowers · 🔗 GitHub Trending(周榜)


8. 美军因一份 AI 幻觉情报报告险些拦截中国货轮

  • Velocity: ▮▮ rising
  • Source: Hacker News · 234+ 分 · 约 3 小时前(~01:28 UTC+8)
  • Tags: ai-safety military hallucination intelligence

据 CNN 独家报道,一份 AI 辅助撰写的情报报告声称某中国货轮货物与核武器
计划有关——内容完全属于捏造。这份捏造的情报在美军内部流转到足够高层,以至于美军在
真相被戳穿前已准备拦截并登船。这一险情发生在美伊战争期间,正是拦截戒备等级最高的
时候。

为什么重要: 这是"LLM 进回路却没有验证层"最具体的噩梦版本——不是聊天机器人说错
话,而是一次国家层面的未遂事件。所有企业 AI 部署辩论引用的都是假设场景;这一件上了
新闻、据报道有军机已升空,并留下一个条令问题:AI 辅助情报在能够调动兵力之前,必须
经过哪一道审核?

🔗 CNN · 🔗 HN 讨论


9. Ledger Donjon:光子发射引导的激光故障注入重开 RP2350 安全调试

  • Velocity: ▮ steady
  • Source: Hacker News · 103+ 分 · 约 3.5 小时前(~00:54 UTC+8)
  • Tags: hardware-security fault-injection rp2350 trustzone

Ledger Donjon 先用光子发射显微术定位 RP2350(Pi Pico 2)调试使能寄存器在裸片上的
位置,再把 980nm 脉冲激光引导到几微米精度内置位其安全调试比特——击穿了熔断级永久
禁用调试的保护;再配合经由始终可用的 RP-AP 发出的救援复位,在固件锁死之前读出了
OTP 挑战密钥。安全启动本身未被攻破。前提条件:破坏性开盖、约 25 万美元的实验室设备,
而且 Raspberry Pi 本就通过其黑客挑战赛公开征集了这项研究(7 月 28 日披露)。

为什么重要: 这是"孤立的安全机制无法组合出安全性"的教科书演示——"安全分析必须
覆盖完整的执行路径"。对任何出货 TrustZone 级 MCU 的厂商来说,威胁模型如今包含这样的
实验室级光学攻击:它靠发射图谱找到目标寄存器,而不是盲目扫描。

🔗 Ledger Donjon · 🔗 HN 讨论


10. Android 17 QPR1 成为 Honeycomb 之后首个新增 API 却不向 AOSP 发布的版本

  • Velocity: ▮ steady
  • Source: Hacker News · 89+ 分 · 约 1.5 小时前(~03:03 UTC+8)
  • Tags: android aosp open-source google

GrapheneOS 指出,Android 17 QPR1 新增了开发者 API——可见于官方 37.1 API diff——但
这些 API 只存在于 Pixel 系统镜像中,未发布到 Android 开源项目(AOSP),打破了延续
15 年的惯例(上一次可比情形是 2011 年的 Honeycomb 3.x)。其他 OEM 厂商完全无法针对
新 API 构建。

为什么重要: AOSP 的完整性是整个第三方 Android 生态的承重墙——GrapheneOS、
LineageOS 以及所有去 Google 化的分支都从它编译。如果 API 开始只落在 Google 侧,开放
构建就会偏离其应用所针对的平台,"Android 是开源的"将在版本层面成为假话。值得盯住的
是:QPR2 会把这些 API 补回 AOSP,还是让这种缺口常态化。

🔗 GrapheneOS(Mastodon) · 🔗 Android 37.1 API diff


11. gods-eye-view:开源"间谍卫星模拟器"一周新增 1.4 万星

  • Velocity: ▮ steady
  • Source: GitHub Trending(周榜)· 本周 +14,460 星(第 3 名)· 共 37.7k
  • Tags: cesium gis osint visualization

bilawalsidhu/gods-eye-view 在一个照片级 3D 地球上渲染实时公开数据:11,000+ 航班、
军机、船舶、838 个目标的卫星目录、地震、约 3,600 路公共 CCTV、火灾与火箭发射——
配 GLM 传感器着色器(FLIR、NVG、CRT)、战术 HUD,以及基于 OpenAI Realtime API 的
语音控制。代码 MIT(捆绑数据集各按其条款),多数图层免密钥,语音会话硬性封顶 5 美元,
README 明确划出不做人脸识别的红线。9 月 17 日仍有推送;maptheworld.ai 是作者的"Map the
World" newsletter 项目通讯站——托管版计划落在 Halfpixel。

为什么重要: 它靠作者的 YouTube 系列(500 万+ 播放)走红,8 月已登顶 trending——
本周 +14.5k 是持续动能而非尖峰。真正有意思的是它验证的定位:完全用公开数据搭建的
情报风格工具,"每一行代码都可审查"是卖点而非负债——对一个病毒式传播的仓库来说,
README 里那些伦理护栏具体得罕见。

🔗 github.com/bilawalsidhu/gods-eye-view · 🔗 作者的 "Map the World" newsletter


12. C++26 将平凡无限循环定义为良构——抹掉一个 40 年的优化器陷阱

  • Velocity: ▮ steady
  • Source: Hacker News · 102+ 分 · 134 评论 · 约 24 小时前(9 月 18 日 ~04:52 UTC+8)
  • Tags: cpp c++26 standards compilers

Sandor Dargo 梳理了 C++26 的这项变更(P2809):平凡无限循环成为良构行为。过去,无
可观测副作用的循环会被编译器假定必然终止——从而被优化器整体删除;现在它就是程序员
写下的意思。旧规则悄悄毁掉过真实的固件:为嵌入式目标写的控制循环和看门狗"空闲"循环,
可能(也确实)被 GCC/Clang 在继承自纸带时代模型的前进假设下优化掉。

为什么重要: 标准明确向嵌入式现实低头,这很罕见;而且这是今日评论比最高的帖子
之一——评论区争的是"平凡"的边界画得对不对,而这正是未来惊喜的藏身处。还停在
C++23 或更早的嵌入式团队,仍需 volatile 沉没写入的变通手法。

🔗 sandordargo.com · 🔗 HN 讨论


13. Cloudflare 又省下 100TB 内存——这次靠一致性哈希数学和一个 6 字节 Rust 结构体

  • Velocity: ▮ steady
  • Source: Cloudflare 博客 · 约 2 小时前(~02:51 UTC+8)
  • Tags: rust consistent-hashing memory pingora

继上个月 1.1.1.1 DNS 缓存之后,Cloudflare 的 Pingora 后端路由器向 pingora-ketama 的
一致性哈希环开刀,再省 100+ TB:团队算出误差只随每节点哈希数的平方根下降(误差每降
一个数量级需要 10 倍哈希——最后 9 万个哈希只换来 0.7% 改善),在几乎无损误差的前提
下砍掉约 90% 的哈希,用带 getter 的 [u8; 6] 把 32 位环条目从 8 字节缩到 6 字节
(绕开争议的 repr(packed)),还找到了教科书数学漏掉的大 N 生日悖论碰撞项。v2 环以
未宣传的 cargo feature 发布;迁移让新旧两版环并行,以避免缓存失效风暴。

为什么重要: 这是最好的那类基础设施长文:数学对照实测校验、迁移的失效模式(缓存
抖动、回源洪峰、回滚)被当一等公民对待,修复成果以 pingora-ketama 开源而非自留。

🔗 Cloudflare 博客 · 🔗 此前 DNS 缓存文章


14. 更新:昨日覆盖的 harness 设计研究已上架 arXiv——HN 也认可其分量

  • Velocity: ▮ steady
  • Source: Hacker News · 193+ 分 · 约 7 小时前(~21:06 UTC+8)
  • Tags: paper agents harness evaluation

继我们 9 月 18 日对 176 组 harness 消融实验的报道之后:完整论文现已公开,即
arXiv:2609.20804(43 页,9 月 17 日提交),"An Empirical Study of Harness Design for
Coding Agents"——4 个模型 × SWE-Bench Verified 与 Terminal-Bench 2.1,对规划、动作
空间、上下文管理逐一独立变量。公开版结论与此前报道一致:上下文管理的价值随预算收紧
而放大(主要靠避免上下文溢出失败);LLM 摘要之前先做规则式删节在效率上最优;规划对
弱模型是精度脚手架、对强模型只是省钱;会 bash 的模型用纯 bash 动作空间即可,成本低
得多。

为什么重要: 整个智能体生态正在靠氛围争论的命题,终于有了测量级版本(见第 2 条和
第 7 条)。保留警告同行:单一 harness、两个基准、四个模型——作者将其定位为"模型与
预算感知"的指引,而非定律。另注:我们最初将其报道为 Zoom 的内部消融;公开论文并未
强调所属机构,但 176 组设置的数字证实是同一研究。

🔗 arXiv:2609.20804 · 🔗 HN 讨论

15. Claude Code 开始读取 AGENTS.md——智能体配置格式之争以耸肩收场

  • Velocity: ▮▮▮ trending
  • Source: Hacker News · 672+ 分 · 约 15 小时前(~05:06 UTC+8)
  • Tags: agents claude-code interop config

Claude Code v2.1.277(9 月 18 日)带来了半个生态等待已久的互通变更:当不存在
CLAUDE.md 时,harness 会转而读取 AGENTS.md——OpenAI Codex、Cursor、Zed 等早已
采纳的中立格式约定。同一批次还发布了 v2.1.278(9 月 19 日),将 auto-mode 的权限
判断指向服务端分类器,在 Bedrock/Vertex/Foundry 上不产生计费开销。仓库目前 146.5k
星,今日 +444。

为什么重要: 此前跨 harness 项目要么把 CLAUDE.md 软链到 AGENTS.md,要么维护
两个会漂移的文件。一份指令文件能跨 harness 通用是小改动大影响——方向比功能更值得
注意:Anthropic 采纳了社区格式,而不是另推自家标准。

🔗 Claude Code 更新日志 · 🔗 HN 讨论 · 🔗 v2.1.277 发布


16. 2023 年因"漏洞不可修复"宣告停更的 vm2 复活——并刚刚修复了两个 CVSS 10.0 沙箱逃逸

  • Velocity: ▮▮▮ trending
  • Source: NVD / VulnCheck · 记录 9 月 18 日发布
  • Tags: vm2 sandbox-escape cve nodejs

NVD 于 9 月 18 日发布了 Node.js 沙箱 vm2 的两条 CVSS 10.0 通告——均由 VulnCheck 以
CNA 身份评分,NVD 状态为 Deferred:CVE-2026-93603(bridge apply 陷阱中的空值
this 接收者可达宿主 child_process)和 CVE-2026-93605(NodeVM 的
DANGEROUS_BUILTINS 黑名单干脆没列 child_process)。修复随 3.12.1(npm 9 月 3 日)
与 3.12.2(9 月 8 日)发布——而仓库已解除归档、9 月 13 日仍有推送,再度活跃开发,
全然不顾维护者 2023 年 8 月"设计缺陷不可修复、项目停更"的公告。

为什么重要: 两类读者各取所需。如果你当年听劝删了 vm2:它回来了,还在发修复。
如果你还在跑旧的锁定版本:历史上的每个逃逸大概率都还有效,外加这两个。而更深一层
与版本无关:2023 年的结论是 vm2 的安全设计本身不成立,而非修修补补——任何 vm2
边界都应视为尽力而为的隔离,绝不是安全控制。

🔗 GHSA-pq68-rvw4-xp4r · 🔗 VulnCheck 通告


17. Grant Sanderson 客串发帖 Tao 的博客:"动机构造的解释永远不会有 Lean"

  • Velocity: ▮▮▮ trending
  • Source: Hacker News · 142+ 分 · 约 5 小时前(~15:06 UTC+8)
  • Tags: mathematics ai formal-methods exposition

Terence Tao 的博客刊出 Grant Sanderson(3Blue1Brown)的客座文章"如果数学不只是证明,
我们需要更好地庆祝其余部分":当 AI 让证明生成变得廉价,"证明"被还原为它本来的
角色——数学真正珍视之物(理解、动机、解释)的代理指标。他提议给解释层配齐证明层
已有的基础设施:将"有动机的解释"形式化并纳入激励,设立 Timothy Chow 所说的
"开放式阐述问题",配上评审委员会、期刊、乃至一份 Hilbert 清单式的最佳未解阐述目录。

为什么重要: 这是本周接力讨论的建设性分支——继数学家联名信(9 月 12 日)、
Gowers 与 Tao 的不签名声明(9 月 18 日)、以及今晨登上 HN 的 Dan Abramov 智能体
Lean 证明(见第 2 条)之后。它的主张比"AI 做不了我们做的事"更锋利:AI 做不了的那
部分,从来就没被制度认证过——而这是可以修补的制度空白。

🔗 terrytao.wordpress.com · 🔗 HN 讨论


18. GPT-6 Astra 破译一战德军无线电密码——一份自述的首创,请连同作者自己的保留意见一起读

  • Velocity: ▮▮ rising
  • Source: Hacker News · 147+ 分 · 约 5 小时前(~15:06 UTC+8)
  • Tags: cipher ai-capability adfgvx history

一篇业余密码分析博文称,GPT-6 Astra 解开了 scienceblogs.de"50 大未解密码"清单中的
一战德军无线电密码。这封 1918 年 11 月 27 日发出的 ADFGVX 电文被完整破译:模型从
Childs 的 German Military Ciphers 1914–1918 中找回了有据可查的历史密钥
TRUPPENVERSCHIEBUNG,重建了换位算术,再用舰船日志自查结果(11 月 24 日 HMS
Canterbury 抵达塞瓦斯托波尔)。Astra 对该电文为何长期未解的解释——密钥变更日期晚于
电文——本身未经核实。作者自己的保留意见写得明确:"我不知道这条电文此前是否被破译过"
——没有任何历史学家或密码学权威核验过这份转写。

为什么重要: 这是本月第二个历史密码被前沿模型攻破的主张(9 月 14 日 Fable 5.1
与 Cyphral Distich)——也是第一个把破译机制端到端公开的:密钥出处、重建的换位表、
档案交叉核对。有意思的信号是工作流——模型从公开的密码学史中检索密钥,再用舰船日志
验证自己的明文——但它成败仍系于作者一人之言。把它读作一份有前景的自述,而不是
一个已被破译的密码。

🔗 prinzai.com · 🔗 HN 讨论


19. LightLLM CVE-2026-93839:PD 分离式推理的节点注册无需鉴权,用户提示词可被窃取——CVSS 9.8,暂无修复版本

  • Velocity: ▮▮ rising
  • Source: NVD / VulnCheck · 9 月 18 日发布
  • Tags: llm-serving cve ai-infra authentication

ModelTC 的 LightLLM——常用的自托管 LLM 推理框架——其 prefill/decode 分离模式使用
的 WebSocket /pd_register 端点没有任何鉴权。任何网络可达的攻击者都能向集群注册
任意节点,劫持推理请求并读取用户提示词。CVSS 9.8(VulnCheck CNA;v4 评分 9.3),
NVD 记录 9 月 18 日发布,并附带指向 api_http_pd.py 的行级引用。缺陷报告自 9 月
16 日处于开启状态;截至发稿未见含修复的版本发布。

为什么重要: Prefill/decode 分离正在成为大模型推理的默认架构,而这正是该架构
引入的新型漏洞面:集群内部控制平面变成了网络攻击面。如果你以 PD 模式运行 LightLLM,
暴露的 /pd_register 应按"提示词已泄露"处理——在修复版本落地前,网络层隔离是唯一
缓解手段。

🔗 GitHub issue #1576 · 🔗 NVD 记录 CVE-2026-93839


20. IEEE Spectrum 揭秘 OpenAI 的 Jalapeño 芯片:LLM 设计了前端——文章也写明了它们帮不上的地方

  • Velocity: ▮▮ rising
  • Source: Hacker News · 136+ 分 · 约 12 小时前(~08:11 UTC+8)
  • Tags: chips openai hardware llm

IEEE Spectrum 的深度报道(9 月 14 日刊发、9 月 18 日重回 HN)聚焦 OpenAI 首款加速器
——与 Broadcom 合作负责物理设计:4-bit 精度 13.4 PFLOPS、232 GB HBM4、宣称端到端
延迟较 NVIDIA GB300 最高降低 3.6 倍。前端流程构建在 Google 开源的 XLS 之上
(C++/DSLX → Verilog);从概念到流片不足 20 个月,团队平均人数不到 100;一颗
DeepSeek attention kernel 在流片后约 40 小时内从理论峰值的 0.31% 提升到 88.94%。

为什么重要: 请带上 Spectrum 自己的免责声明:"真实集群性能未经证实;基准数据由
OpenAI 提供",且专家指出 20 个月的进度表只有在 Broadcom 承担物理设计的前提下才
可信。文章本身给出的诚实结论是:LLM 大幅压缩了前端(RTL 与 kernel)工作量,对后端
物理设计帮助有限,而工程师始终是"最终仲裁者"。

🔗 IEEE Spectrum · 🔗 HN 讨论


21. IBM Guardium:12 个严重 CVE 同日砸上 NVD——反序列化 RCE、SQL 注入与无鉴权 servlet

  • Velocity: ▮▮ rising
  • Source: NVD / IBM · 记录 9 月 18 日发布
  • Tags: cve ibm database-security enterprise

IBM Guardium Data Protection 12.2 的一批严重修复于 9 月 18 日集中发布到 NVD——
CVE-2026-80441、-80442、-81657、-82340、-82832、-82967、-84064、-84073、-84075、
-84078、-84082,另有 Sterling File Gateway 9.1 的 CVE-2026-75878。构成:未鉴权
反序列化 RCE(9.8)、IP 访问控制鉴权绕过(9.8)、未鉴权 SQL 注入(9.8)、
ChangeTracker/LoadBalancer servlet 缺失鉴权(9.9),以及已鉴权操作系统命令注入
(9.9)。全部由 IBM 以 CNA 身份评分;修复位于 Guardium 12.x 更新流。

为什么重要: Guardium 坐在数据库审计流量上——一旦沦陷,等于把企业里几乎每一条
查询都交了出去,这使它既是高价值目标,失守时又是合规事件。十二个漏洞一次性放出
指向协同发布而非挤牙膏;Guardium 管理员应立即盘点版本,并把可从互联网或普通用户
触达的控制台视为暴露面。

🔗 IBM 安全公告 · 🔗 NVD 记录 CVE-2026-80441


22. xAI 将 Grok Voice Transcribe 2.0 设为默认 STT——而"准确率翻倍"只活在营销页上

  • Velocity: ▮▮ rising
  • Source: x.ai 文档 · 9 月 18 日
  • Tags: speech-to-text xai api voice

xAI 文档现已将 grok-voice-transcribe-2.0 列为其语音转文本 API 的默认模型:
POST /v1/stt 端点加 WebSocket 流式接口,支持 25 种语言、词级时间戳、多通道音频与
说话人分离。文档写明"所有音频实时处理,绝不存储、绝不用于训练"——一条直指医疗与
法律转写市场的零留存承诺。

为什么重要: API 默认模型一换,所有未锁定版本的客户同时被迁移,而 STT 是生产
环境中吞吐量最高的 AI 工作负载之一。这里的信源提醒很关键:被广泛引用的"准确率为
1.0 的 2 倍、价格不变"出自 xAI 营销页(该页拒绝非浏览器抓取)及二手报道——文档
本身没有任何准确率声明,在被独立评测之前请把那个倍数当营销话术。

🔗 x.ai 语音文档 · 🔗 x.ai 模型列表


23. Cache-to-Cache:用 KV-cache 代替文本的模型间通信迎来 HN 时刻

  • Velocity: ▮▮ rising
  • Source: Hacker News · 95+ 分 · 约 17 小时前(~03:06 UTC+8)
  • Tags: paper kv-cache multi-agent inference

HN 热议的是"Cache-to-Cache: Direct Semantic Communication Between LLMs"
(arXiv 2510.03215,2025 年论文重回首页):智能体之间的消息不再走"生成文本—解析—
重新编码"的老路,而是一个模型的 KV-cache 被直接投影进另一个模型的缓存——以推理
速度完成语义通信,完全跳过解码与重编码的往返。

为什么重要: 今天的多智能体系统每跳都要交一笔 token 税——生成、序列化、重新
prefill。缓存级通信从架构层面直击这笔税,这正是它随智能体舰队扩张而反复翻红的原因。
现实约束也清楚:它要求模型间共享或可映射的词表/几何结构,眼下是同家族(或协同训练)
的技术,而不是跨厂商桥梁。

🔗 arXiv:2510.03215 · 🔗 HN 讨论


24. Stagehand:"Playwright 快 2 倍、token 省 80%"——厂商口径,代码公开

  • Velocity: ▮▮ rising
  • Source: Hacker News · 94+ 分 · 约 19 小时前(~01:06 UTC+8)
  • Tags: browser-agents playwright testing tokens

Browserbase 的 Stagehand——在 Playwright 之上叠加 AI API 的浏览器智能体 SDK——以
"我们把 Playwright 提速 2 倍、token 效率提升 80%"为题登上 HN:核心工作是裁剪喂给
模型的 DOM 快照与动作轨迹,而浏览器自动化的延迟与 token 开销恰恰都耗在这里。

为什么重要: 浏览器智能体是最烧 token 的智能体类别,DOM-到-提示词的压缩才是
所有人成本的真正所在。这些数字由厂商自行报告——当作方向读,别当基准读——但仓库
开源、测量可复现,这已经比这个领域大多数"省 token"宣传体面。

🔗 github.com/browserbase/stagehand · 🔗 HN 讨论


25. "科学即开源软件"——把可复现性危机重构为依赖管理问题

  • Velocity: ▮ steady
  • Source: Hacker News · 104+ 分 · 约 9 小时前(~11:06 UTC+8)
  • Tags: open-source research reproducibility essay

Jakob Pedersen 主张:论文在功能上就是"仓库卫生极差的开源项目",应当被当作开源软件
对待。文章展示了论文里那句"代码可应要求提供"实际上一摊无标注脚本、死链与未记录的
环境状态,以及当它被当作有版本、有测试、有维护者的软件来对待时,一切将如何改变。

为什么重要: 这个框架之所以成立,在于它是操作性的而非道德性的:开源社区为维持
软件存活发展出的每一项实践(semver、CI、CODEOWNERS、依赖归档)都直接映射到不可
复现研究的失效模式上——而智能体时代抬高了赌注:在文献上训练的模型会继承文献的
腐烂。

🔗 jepedersen.dk · 🔗 HN 讨论


26. JEPA-Anything:一套预测建模范式号称横跨七大领域

  • Velocity: ▮ steady
  • Source: arXiv · 2609.20800 · 9 月 17 日
  • Tags: paper jepa world-model self-supervised

Ling Yang、Weiyang Liu、Zhenfei Yin 等人提出"正交预测因子分解"(OPF),作为 JEPA
式预测世界建模的跨领域泛化,评测覆盖视觉、生物、临床轨迹、控制、分子动力学、物理
场与气象。报告称在全部 10 个动力学任务上击败对齐条件的 JEPA 基线,Interventional
Pong 上干预预测误差下降 34.8%,并从行星数据中恢复出开普勒指数(−1.4991)。代码发布
于 Gen-Verse/JEPA-Anything。

为什么重要: LeCun 的 JEPA 路线常被批评为"只属于视觉的愿景",七领域评测正是
这一主张需要的那种检验。读结果时请按论文自己的口径——对照的是对齐条件的 JEPA
基线,而非各领域最强专用方法;生物干预结果也只是"获得实验支持",谈不上验证。

🔗 arXiv:2609.20800 · 🔗 github.com/Gen-Verse/JEPA-Anything


27. RetireOPD:蒸馏教师在训练中途"自我退休"——学生反过来超过它

  • Velocity: ▮ steady
  • Source: arXiv · 2609.20784 · 9 月 17 日
  • Tags: paper distillation reinforcement-learning agents

面向智能体 RL 的"自蒸馏 on-policy"方法,带一条自适应退休规则:技能特权教师只在
性能差距仍在缩小时督导学生,一旦学生达到教师成功率的目标比例即被撤下。在 Qwen2.5
底座(1.5B–7B)上,方法报告 ALFWorld 提升 14.1–18.8 个百分点、WebShop 提升
11.8–19.0 个百分点——且所有测试设定中学生都超过了自己的教师。

为什么重要: "蒸馏进 RL"管线的老大难是何时停止模仿:停太早封住学生上限,
停太晚则把教师的天花板与偏见一并导入。把退休变成一个被测量的决策而非超参数,是个
机制干净的小点子——不过证据全部来自 Qwen2.5,请当配方读,别当定律读。

🔗 arXiv:2609.20784 · 🔗 arXiv HTML


28. Xing4.0-29B-A4B:中国电信发布全 Ascend NPU 训练的编码 MoE

  • Velocity: ▮ steady
  • Source: Hugging Face Trending(第 5 名)· 9 月 18 日更新
  • Tags: open-weights moe ascend coding

XingChen-AGI(中国电信)发布 Xing4.0-29B-A4B:总参 29B / 激活 4B 的 MoE(64 个路由
专家、MLA + MTP、256K 上下文),模型卡宣称这是"首个完全在昇腾 NPU 平台上、以
MindSpore 框架训练的该规模模型"。自报数字:SWE-bench Verified 75.00(对比
Qwen3.6-35B-A3B 的 76.00)、Terminal-Bench 2.1 达 57.50——AIME2026 与 IFBench
则落后。

为什么重要: 真正的重点是算力主权叙事:一家国家级运营商在没有 NVIDIA 依赖的
前提下发布有竞争力的编码权重,比任何一个基准点都重要。模型卡本身没有 limitations
一节、头条数字带着 harness 脚注——75.0 请按我们对待一切自报 harness 分数的方式
读:等待复现之前的上限值。

🔗 huggingface.co/XingChen-AGI/Xing4.0-29B-A4B · 🔗 XingChen-AGI on HF


29. Red Hat OpenShift 控制台 CVE-2026-75885:devfile 端点的未鉴权 SSRF

  • Velocity: ▮ steady
  • Source: NVD / Red Hat · 9 月 18 日发布
  • Tags: cve openshift ssrf kubernetes

OpenShift 控制台的 /api/devfile/ 与 /api/devfile/samples/ 端点接受未鉴权的
恶意 devfile 载荷,从控制台上下文发起服务端请求伪造——CVSS 9.3(Red Hat CNA,
secalert@redhat.com 为主评分方),NVD 记录 9 月 18 日发布。devfile 是定义云
工作区的模板,其导入路径天然是 SSRF 支点:控制台会以特权网络位置去抓取受攻击者
影响的 URL。

为什么重要: OpenShift 控制台所处的网络位置可触达元数据服务、内部镜像仓库与
Kubernetes API 本身——在这里 SSRF 是立足点原语,而不只是信息泄露。集群管理员应
按 Red Hat 通告修补,并审计 devfile 端点是否暴露在控制台 UI 之外。

🔗 Red Hat CVE · 🔗 Bugzilla 2517885


30. Gravity Forms CVE-2026-84434:未鉴权任意文件上传(CVSS 9.8)——修复版本未经确认

  • Velocity: ▮ steady
  • Source: NVD / Wordfence · 9 月 19 日发布
  • Tags: cve wordpress file-upload rce

WordPress 站点上装机量巨大的表单插件 Gravity Forms,其 upload_file 例程存在未鉴权
任意文件上传(受影响:≤3.1.0.4)——文件类型校验不一致,允许上传进而可能远程代码
执行。CVSS 9.8(Wordfence 以 CNA 身份评分,由其 Argus 扫描器发现);NVD 记录于
9 月 19 日凌晨发布。

为什么重要: 表单插件是 WordPress 经典的初始入侵向量——无处不在,且天然允许
未鉴权访问。按我们自己的规则补一条诚实注:截至发稿无法从厂商更新日志确认确切的
修复版本——请升级到最新可用发布并核对版本号,不要默认某个具体数字。

🔗 NVD 记录 CVE-2026-84434 · 🔗 Wordfence 威胁情报


31. quiche 0.30.0:默认后量子的 BoringSSL 开始拆分 ClientHello——所有 QUIC 实现者都该关心

  • Velocity: ▮ steady
  • Source: GitHub release · 9 月 17 日
  • Tags: quic http3 rust post-quantum

Cloudflare 的 Rust QUIC/HTTP-3 实现发布 v0.30.0,两条破坏性变更的分量远超其更新
日志篇幅:boring crate 版本范围改为 >=4.19,<6,因为 BoringSSL 5 默认启用后量子
密钥组——而后量子 ClientHello 可能超过单个 Initial 包,把首个 flight 拆到多个数据报
上,这会击垮所有假设握手合并的 QUIC 实现。PathEvent 同时改为 #[non_exhaustive]
并新增 PmtuUpdated 变体。

为什么重要: 后量子握手迁移到来时是一个分包问题,而不只是密码学问题——多个
Initial 包下的中间盒与对端行为,正是静默故障的藏身处。Cloudflare 率先在自己的开源
QUIC 栈里修掉它,对其他每个 QUIC 实现都是预警——而不仅是 quiche 用户。

🔗 quiche · 🔗 v0.30.0 发布说明


Metadata

FieldValue
Generated2026-09-19T20:16:00+08:00
Items31
Sources tracked31 (Hacker News, GitHub Trending, arXiv, Hugging Face, NVD, CISA KEV, 厂商博客 (Cloudflare, Cactus, Ledger), 厂商文档 (x.ai, Anthropic), IEEE Spectrum, IBM, Red Hat, Wordfence, VulnCheck, terrytao.wordpress.com, CNN, GrapheneOS, developer.android.com)
Update schedule04:03, 12:03, 20:03 UTC+8 (每日 3 次)
RankingVelocity-weighted (recency × engagement acceleration × source authority)
LicenseCC-BY 4.0

Previous day · Raw .md · Archive