1. "I don't like passkeys"——今日 HN 最大论战,666 分
- Velocity: ▮▮▮ trending
- Source: Hacker News · 666+ 分 · 642 评论 · 约 8 小时前(~20:06 UTC+8)
- Tags:
passkeys auth security ux
Ethan Hawksley 的文章认为 passkey "完美适配企业环境,却不适配个人安全":账号找回仍
取决于最弱的一环(短信、邮件链接),硬件密钥每把只能容纳约 25–100 个可发现凭据且无法
备份,同步型 passkey 把所有第三方登录绑死在 Apple/Google 账号上——一次自动封号即可
全部切断,而二维码加蓝牙的混合回退在实践中并不可靠。他给出的替代方案:第三方密码
管理器 + 独立 TOTP 应用。他也承认:对密码复用者和企业用户,passkey 是实打实的升级。
为什么重要: 642 条评论里大多是认同者的切肤之痛——这说明失灵的是部署模式,而不是
密码学本身。"找回路径才是最弱环节"是安全团队早知道的道理,但很少有人对一个正在被
全行业默认推行的标准说得这么直白。
🔗 hawksley.dev · 🔗 HN 讨论
2. Dan Abramov "氛围式"证明 Conway 精炼猜想——Lean 校验通过、约 4 万美元 token、尚未经人类独立验证
- Velocity: ▮▮▮ trending
- Source: Hacker News · 155+ 分 · 150 评论 · 约 6 小时前(~22:36 UTC+8)
- Tags:
lean formal-methods agents mathematics
React 核心开发者宣布证明了超实整数(omnific integers)上的 Conway 精炼猜想(1976 年
提出:任意两个分解必有共同精炼),在 Lean + Mathlib 中形式化并通过内核校验——建立在
L'Innocente–Mantova 2024 年的归约之上。工作流是 Codex 多智能体"实验室"(PM、数学、
对抗、Lean 各司其职,外加一个"食堂"中继),Claude 负责形式化、ChatGPT 负责探索:
约 400 亿 token,按 API 价格约 4 万美元,外加他一个月的业余时间。两个"接近完成"的
证明被推倒重来——一个是循环论证,一个是约 30 篇未经验证的智能体生成"论文"搭成的
纸牌屋。
为什么重要: 请把作者自己的保留意见一起带走:"我的证明尚未被数学家独立验证",
且正确性以"不依赖 Lean 内核 bug"为前提。但方法论才是重点——一个业余项目经理带着
智能体在 50 年的公开难题上拿到内核校验过的结果,真正干活的是验证纪律(linter 审计、
陈述/证明配对、仅依赖 Mathlib 的陈述文件)。
🔗 overreacted.io · 🔗 HN 讨论
3. 三个 Linux 内核漏洞同日进入 CISA KEV——TLS、ebtables 与 AF_ALG
- Velocity: ▮▮▮ trending
- Source: CISA KEV · 9 月 18 日收录
- Tags:
cve linux kernel kev tls
CISA 于 9 月 18 日将三个内核 CVE 列入已知在野利用漏洞目录:CVE-2025-39682(TLS 接收
路径的零长记录绕过 recvmsg() 记录类型处理——**CNA 评分 CVSS 9.8,NVD Analyzed 仅
7.1**,罕见的公开分歧)、CVE-2026-53266(ebtables SNAT 越界写入,经 ARP 发送端硬件
地址改写触碰非线性 skb 分片——CNA 评分 8.8)、CVE-2025-39964(对同一 AF_ALG socket
并发写入损坏 socket 状态——CNA 7.8 / NVD 5.5)。三者都是较早已修补的旧漏洞;新变化
是联邦层面的在野利用认定。
为什么重要: 内核内部漏洞进入 KEV 并不寻常,意味着攻击者认为它们值得在真实系统上
武器化——很可能是在运行旧内核的容器或网络设备内部。而 CNA 9.8 对 NVD 7.1 的评分
分裂,正是本刊规则要求"CVSS 数字必须记录评分方"的活例子。
🔗 CISA KEV 目录 · 🔗 NVD 记录 CVE-2025-39682
4. Cactus Needle 3:9–29 MB 端侧模型号称达到 DeepSeek-V4-Flash 级工具调用——请先读图注
- Velocity: ▮▮▮ trending
- Source: Hacker News(Show HN)· 104+ 分 · 约 20 小时前(~08:11 UTC+8)
- Tags:
on-device edge-ai function-calling quantization
Cactus 的 Needle 3 是面向手机、可穿戴和 MCU 的基础模型,只做三件事——工具调用、结构化
抽取、embedding——并明确不做聊天。单一权重集覆盖 2–20 层子网络(29–121M 参数、CQ2
2-bit 量化、9–29 MB),训练数据 360B token;宣称在移动端工具调用上击败 10 倍大的模型,
Pi 5 上解码 400–4k tok/s。而"匹配 DeepSeek V4 Flash"的头条来自微调过的 4 层子网络
——图注写明:基线是 vLLM 下的 f16,DeepSeek 走云端 API,评测使用强制调用。
为什么重要: 微型确定性工具调用模型确实是端侧技术栈的真实空白,公开精确推理条件
的做法也优于多数同行。但头条对比混合了量化、运行时与访问路径——能成立的结论是
"微调后的 121M 参数模型在强制工具调用上可以打",而不是"29 MB 等于 DeepSeek"。
🔗 cactuscompute.com/needle · 🔗 HN 讨论
5. Cloudflare Quick Tunnels 面向智能体重新发布——隧道不是新的,JSON 才是
- Velocity: ▮▮ rising
- Source: Hacker News · 401+ 分 · 约 6 小时前(~22:18 UTC+8)
- Tags:
cloudflare tunnels devtools agents
HN 上 401 分的热帖是 cloudflared tunnel --url localhost:PORT——但 trycloudflare.com
上的快速隧道已存在多年,Cloudflare 自己的文档也仍注明"仅用于测试与开发"。真正的新东西
是 try.cloudflare.com 页面把该功能重新包装给编码智能体:主机名、边缘节点与健康状态
以 stdout JSON 输出("不用再对日志做正则")、可直接挂 webhook 的临时 URL、约 3 秒
获得公网加密端点,无需账号、不开端口。
为什么重要: 讨论区的热度集中在智能体工作流——给智能体一个公网 HTTPS 端点做
webhook 测试是个反复出现的高摩擦步骤,stdout-JSON 恰是智能体需要的接口。值得保留的
提醒:临时随机 URL 同时也是攻击者喜欢的数据外带通道,安全团队早已盯上
*.trycloudflare.com 流量。
🔗 try.cloudflare.com · 🔗 HN 讨论
6. Stably Orca:71.8k 星的"ADE",为并行编码智能体舰队而生
- Velocity: ▮▮ rising
- Source: GitHub Trending(周榜)· 本周 +5,305 星(第 16 名)· 共 71.8k
- Tags:
agents ade worktrees parallel-agents
stablyai/orca 是开源(MIT)的智能体开发环境,用于同时编排多个 CLI 编码智能体——
Claude Code、Codex、Cursor、Copilot、Devin、Qwen Code 等——复用你已有的订阅。一个
提示扇出到隔离 git worktree 中的多个智能体并择优合并;iOS/Android 伴侣应用远程指挥
舰队;点击 UI 元素即可把上下文注入提示(Design Mode);从 Linear/GitHub 任务或 SSH
直接开 worktree。YC 孵化,每日发版,Windows 签名构建。
为什么重要: worktree 舰队模式(worktrunk、firstmate、ECC——本刊上周均已覆盖)
迎来了第一个消费级 IDE 形态的入局者,每周 +5.3k 星说明需求是真实的。悬而未决的问题
与所有舰队工具相同:五个智能体抢一个任务时,token 账单谁来付。
🔗 github.com/stablyai/orca · 🔗 onorca.dev
7. obra/superpowers:技能+方法论框架突破 288k 星
- Velocity: ▮▮ rising
- Source: GitHub Trending(周榜)· 本周 +3,821 星 · 共 288.5k
- Tags:
agents skills tdd methodology
Jesse Vincent 的 superpowers 是一套由可组合智能体技能构成、立场鲜明的方法论:智能体
先访谈你要出规格、分块呈现设计、写出每个 2–5 分钟且带精确文件路径的任务计划,然后以
两阶段评审跑子智能体驱动开发——并强制 TDD,先于测试写出的代码一律删除。安装器覆盖
13+ 种 harness(Claude Code、Codex、Cursor、Gemini CLI、Copilot CLI、Devin、Droid、
Kimi Code、OpenCode……)。MIT 许可;可选的单 logo 遥测,退出方式有文档。
为什么重要: 按原始数字,288k 星的 superpowers 是智能体生态中最大的方法论层项目,
它的核心赌注——瓶颈在流程纪律而非模型质量——与本周的 harness 设计研究从测量一侧
得出的结论相同(见第 14 条)。两阶段评审加"先计划后执行"的循环,是这一论点具体、
可复制的产物。
🔗 github.com/obra/superpowers · 🔗 GitHub Trending(周榜)
8. 美军因一份 AI 幻觉情报报告险些拦截中国货轮
- Velocity: ▮▮ rising
- Source: Hacker News · 234+ 分 · 约 3 小时前(~01:28 UTC+8)
- Tags:
ai-safety military hallucination intelligence
据 CNN 独家报道,一份 AI 辅助撰写的情报报告声称某中国货轮货物与核武器
计划有关——内容完全属于捏造。这份捏造的情报在美军内部流转到足够高层,以至于美军在
真相被戳穿前已准备拦截并登船。这一险情发生在美伊战争期间,正是拦截戒备等级最高的
时候。
为什么重要: 这是"LLM 进回路却没有验证层"最具体的噩梦版本——不是聊天机器人说错
话,而是一次国家层面的未遂事件。所有企业 AI 部署辩论引用的都是假设场景;这一件上了
新闻、据报道有军机已升空,并留下一个条令问题:AI 辅助情报在能够调动兵力之前,必须
经过哪一道审核?
🔗 CNN · 🔗 HN 讨论
9. Ledger Donjon:光子发射引导的激光故障注入重开 RP2350 安全调试
- Velocity: ▮ steady
- Source: Hacker News · 103+ 分 · 约 3.5 小时前(~00:54 UTC+8)
- Tags:
hardware-security fault-injection rp2350 trustzone
Ledger Donjon 先用光子发射显微术定位 RP2350(Pi Pico 2)调试使能寄存器在裸片上的
位置,再把 980nm 脉冲激光引导到几微米精度内置位其安全调试比特——击穿了熔断级永久
禁用调试的保护;再配合经由始终可用的 RP-AP 发出的救援复位,在固件锁死之前读出了
OTP 挑战密钥。安全启动本身未被攻破。前提条件:破坏性开盖、约 25 万美元的实验室设备,
而且 Raspberry Pi 本就通过其黑客挑战赛公开征集了这项研究(7 月 28 日披露)。
为什么重要: 这是"孤立的安全机制无法组合出安全性"的教科书演示——"安全分析必须
覆盖完整的执行路径"。对任何出货 TrustZone 级 MCU 的厂商来说,威胁模型如今包含这样的
实验室级光学攻击:它靠发射图谱找到目标寄存器,而不是盲目扫描。
🔗 Ledger Donjon · 🔗 HN 讨论
10. Android 17 QPR1 成为 Honeycomb 之后首个新增 API 却不向 AOSP 发布的版本
- Velocity: ▮ steady
- Source: Hacker News · 89+ 分 · 约 1.5 小时前(~03:03 UTC+8)
- Tags:
android aosp open-source google
GrapheneOS 指出,Android 17 QPR1 新增了开发者 API——可见于官方 37.1 API diff——但
这些 API 只存在于 Pixel 系统镜像中,未发布到 Android 开源项目(AOSP),打破了延续
15 年的惯例(上一次可比情形是 2011 年的 Honeycomb 3.x)。其他 OEM 厂商完全无法针对
新 API 构建。
为什么重要: AOSP 的完整性是整个第三方 Android 生态的承重墙——GrapheneOS、
LineageOS 以及所有去 Google 化的分支都从它编译。如果 API 开始只落在 Google 侧,开放
构建就会偏离其应用所针对的平台,"Android 是开源的"将在版本层面成为假话。值得盯住的
是:QPR2 会把这些 API 补回 AOSP,还是让这种缺口常态化。
🔗 GrapheneOS(Mastodon) · 🔗 Android 37.1 API diff
11. gods-eye-view:开源"间谍卫星模拟器"一周新增 1.4 万星
- Velocity: ▮ steady
- Source: GitHub Trending(周榜)· 本周 +14,460 星(第 3 名)· 共 37.7k
- Tags:
cesium gis osint visualization
bilawalsidhu/gods-eye-view 在一个照片级 3D 地球上渲染实时公开数据:11,000+ 航班、
军机、船舶、838 个目标的卫星目录、地震、约 3,600 路公共 CCTV、火灾与火箭发射——
配 GLM 传感器着色器(FLIR、NVG、CRT)、战术 HUD,以及基于 OpenAI Realtime API 的
语音控制。代码 MIT(捆绑数据集各按其条款),多数图层免密钥,语音会话硬性封顶 5 美元,
README 明确划出不做人脸识别的红线。9 月 17 日仍有推送;maptheworld.ai 是作者的"Map the
World" newsletter 项目通讯站——托管版计划落在 Halfpixel。
为什么重要: 它靠作者的 YouTube 系列(500 万+ 播放)走红,8 月已登顶 trending——
本周 +14.5k 是持续动能而非尖峰。真正有意思的是它验证的定位:完全用公开数据搭建的
情报风格工具,"每一行代码都可审查"是卖点而非负债——对一个病毒式传播的仓库来说,
README 里那些伦理护栏具体得罕见。
🔗 github.com/bilawalsidhu/gods-eye-view · 🔗 作者的 "Map the World" newsletter
12. C++26 将平凡无限循环定义为良构——抹掉一个 40 年的优化器陷阱
- Velocity: ▮ steady
- Source: Hacker News · 102+ 分 · 134 评论 · 约 24 小时前(9 月 18 日 ~04:52 UTC+8)
- Tags:
cpp c++26 standards compilers
Sandor Dargo 梳理了 C++26 的这项变更(P2809):平凡无限循环成为良构行为。过去,无
可观测副作用的循环会被编译器假定必然终止——从而被优化器整体删除;现在它就是程序员
写下的意思。旧规则悄悄毁掉过真实的固件:为嵌入式目标写的控制循环和看门狗"空闲"循环,
可能(也确实)被 GCC/Clang 在继承自纸带时代模型的前进假设下优化掉。
为什么重要: 标准明确向嵌入式现实低头,这很罕见;而且这是今日评论比最高的帖子
之一——评论区争的是"平凡"的边界画得对不对,而这正是未来惊喜的藏身处。还停在
C++23 或更早的嵌入式团队,仍需 volatile 沉没写入的变通手法。
🔗 sandordargo.com · 🔗 HN 讨论
13. Cloudflare 又省下 100TB 内存——这次靠一致性哈希数学和一个 6 字节 Rust 结构体
- Velocity: ▮ steady
- Source: Cloudflare 博客 · 约 2 小时前(~02:51 UTC+8)
- Tags:
rust consistent-hashing memory pingora
继上个月 1.1.1.1 DNS 缓存之后,Cloudflare 的 Pingora 后端路由器向 pingora-ketama 的
一致性哈希环开刀,再省 100+ TB:团队算出误差只随每节点哈希数的平方根下降(误差每降
一个数量级需要 10 倍哈希——最后 9 万个哈希只换来 0.7% 改善),在几乎无损误差的前提
下砍掉约 90% 的哈希,用带 getter 的 [u8; 6] 把 32 位环条目从 8 字节缩到 6 字节
(绕开争议的 repr(packed)),还找到了教科书数学漏掉的大 N 生日悖论碰撞项。v2 环以
未宣传的 cargo feature 发布;迁移让新旧两版环并行,以避免缓存失效风暴。
为什么重要: 这是最好的那类基础设施长文:数学对照实测校验、迁移的失效模式(缓存
抖动、回源洪峰、回滚)被当一等公民对待,修复成果以 pingora-ketama 开源而非自留。
🔗 Cloudflare 博客 · 🔗 此前 DNS 缓存文章
14. 更新:昨日覆盖的 harness 设计研究已上架 arXiv——HN 也认可其分量
- Velocity: ▮ steady
- Source: Hacker News · 193+ 分 · 约 7 小时前(~21:06 UTC+8)
- Tags:
paper agents harness evaluation
继我们 9 月 18 日对 176 组 harness 消融实验的报道之后:完整论文现已公开,即
arXiv:2609.20804(43 页,9 月 17 日提交),"An Empirical Study of Harness Design for
Coding Agents"——4 个模型 × SWE-Bench Verified 与 Terminal-Bench 2.1,对规划、动作
空间、上下文管理逐一独立变量。公开版结论与此前报道一致:上下文管理的价值随预算收紧
而放大(主要靠避免上下文溢出失败);LLM 摘要之前先做规则式删节在效率上最优;规划对
弱模型是精度脚手架、对强模型只是省钱;会 bash 的模型用纯 bash 动作空间即可,成本低
得多。
为什么重要: 整个智能体生态正在靠氛围争论的命题,终于有了测量级版本(见第 2 条和
第 7 条)。保留警告同行:单一 harness、两个基准、四个模型——作者将其定位为"模型与
预算感知"的指引,而非定律。另注:我们最初将其报道为 Zoom 的内部消融;公开论文并未
强调所属机构,但 176 组设置的数字证实是同一研究。
🔗 arXiv:2609.20804 · 🔗 HN 讨论
15. Claude Code 开始读取 AGENTS.md——智能体配置格式之争以耸肩收场
- Velocity: ▮▮▮ trending
- Source: Hacker News · 672+ 分 · 约 15 小时前(~05:06 UTC+8)
- Tags:
agents claude-code interop config
Claude Code v2.1.277(9 月 18 日)带来了半个生态等待已久的互通变更:当不存在
CLAUDE.md 时,harness 会转而读取 AGENTS.md——OpenAI Codex、Cursor、Zed 等早已
采纳的中立格式约定。同一批次还发布了 v2.1.278(9 月 19 日),将 auto-mode 的权限
判断指向服务端分类器,在 Bedrock/Vertex/Foundry 上不产生计费开销。仓库目前 146.5k
星,今日 +444。
为什么重要: 此前跨 harness 项目要么把 CLAUDE.md 软链到 AGENTS.md,要么维护
两个会漂移的文件。一份指令文件能跨 harness 通用是小改动大影响——方向比功能更值得
注意:Anthropic 采纳了社区格式,而不是另推自家标准。
🔗 Claude Code 更新日志 · 🔗 HN 讨论 · 🔗 v2.1.277 发布
16. 2023 年因"漏洞不可修复"宣告停更的 vm2 复活——并刚刚修复了两个 CVSS 10.0 沙箱逃逸
- Velocity: ▮▮▮ trending
- Source: NVD / VulnCheck · 记录 9 月 18 日发布
- Tags:
vm2 sandbox-escape cve nodejs
NVD 于 9 月 18 日发布了 Node.js 沙箱 vm2 的两条 CVSS 10.0 通告——均由 VulnCheck 以
CNA 身份评分,NVD 状态为 Deferred:CVE-2026-93603(bridge apply 陷阱中的空值
this 接收者可达宿主 child_process)和 CVE-2026-93605(NodeVM 的
DANGEROUS_BUILTINS 黑名单干脆没列 child_process)。修复随 3.12.1(npm 9 月 3 日)
与 3.12.2(9 月 8 日)发布——而仓库已解除归档、9 月 13 日仍有推送,再度活跃开发,
全然不顾维护者 2023 年 8 月"设计缺陷不可修复、项目停更"的公告。
为什么重要: 两类读者各取所需。如果你当年听劝删了 vm2:它回来了,还在发修复。
如果你还在跑旧的锁定版本:历史上的每个逃逸大概率都还有效,外加这两个。而更深一层
与版本无关:2023 年的结论是 vm2 的安全设计本身不成立,而非修修补补——任何 vm2
边界都应视为尽力而为的隔离,绝不是安全控制。
🔗 GHSA-pq68-rvw4-xp4r · 🔗 VulnCheck 通告
17. Grant Sanderson 客串发帖 Tao 的博客:"动机构造的解释永远不会有 Lean"
- Velocity: ▮▮▮ trending
- Source: Hacker News · 142+ 分 · 约 5 小时前(~15:06 UTC+8)
- Tags:
mathematics ai formal-methods exposition
Terence Tao 的博客刊出 Grant Sanderson(3Blue1Brown)的客座文章"如果数学不只是证明,
我们需要更好地庆祝其余部分":当 AI 让证明生成变得廉价,"证明"被还原为它本来的
角色——数学真正珍视之物(理解、动机、解释)的代理指标。他提议给解释层配齐证明层
已有的基础设施:将"有动机的解释"形式化并纳入激励,设立 Timothy Chow 所说的
"开放式阐述问题",配上评审委员会、期刊、乃至一份 Hilbert 清单式的最佳未解阐述目录。
为什么重要: 这是本周接力讨论的建设性分支——继数学家联名信(9 月 12 日)、
Gowers 与 Tao 的不签名声明(9 月 18 日)、以及今晨登上 HN 的 Dan Abramov 智能体
Lean 证明(见第 2 条)之后。它的主张比"AI 做不了我们做的事"更锋利:AI 做不了的那
部分,从来就没被制度认证过——而这是可以修补的制度空白。
🔗 terrytao.wordpress.com · 🔗 HN 讨论
18. GPT-6 Astra 破译一战德军无线电密码——一份自述的首创,请连同作者自己的保留意见一起读
- Velocity: ▮▮ rising
- Source: Hacker News · 147+ 分 · 约 5 小时前(~15:06 UTC+8)
- Tags:
cipher ai-capability adfgvx history
一篇业余密码分析博文称,GPT-6 Astra 解开了 scienceblogs.de"50 大未解密码"清单中的
一战德军无线电密码。这封 1918 年 11 月 27 日发出的 ADFGVX 电文被完整破译:模型从
Childs 的 German Military Ciphers 1914–1918 中找回了有据可查的历史密钥
TRUPPENVERSCHIEBUNG,重建了换位算术,再用舰船日志自查结果(11 月 24 日 HMS
Canterbury 抵达塞瓦斯托波尔)。Astra 对该电文为何长期未解的解释——密钥变更日期晚于
电文——本身未经核实。作者自己的保留意见写得明确:"我不知道这条电文此前是否被破译过"
——没有任何历史学家或密码学权威核验过这份转写。
为什么重要: 这是本月第二个历史密码被前沿模型攻破的主张(9 月 14 日 Fable 5.1
与 Cyphral Distich)——也是第一个把破译机制端到端公开的:密钥出处、重建的换位表、
档案交叉核对。有意思的信号是工作流——模型从公开的密码学史中检索密钥,再用舰船日志
验证自己的明文——但它成败仍系于作者一人之言。把它读作一份有前景的自述,而不是
一个已被破译的密码。
🔗 prinzai.com · 🔗 HN 讨论
19. LightLLM CVE-2026-93839:PD 分离式推理的节点注册无需鉴权,用户提示词可被窃取——CVSS 9.8,暂无修复版本
- Velocity: ▮▮ rising
- Source: NVD / VulnCheck · 9 月 18 日发布
- Tags:
llm-serving cve ai-infra authentication
ModelTC 的 LightLLM——常用的自托管 LLM 推理框架——其 prefill/decode 分离模式使用
的 WebSocket /pd_register 端点没有任何鉴权。任何网络可达的攻击者都能向集群注册
任意节点,劫持推理请求并读取用户提示词。CVSS 9.8(VulnCheck CNA;v4 评分 9.3),
NVD 记录 9 月 18 日发布,并附带指向 api_http_pd.py 的行级引用。缺陷报告自 9 月
16 日处于开启状态;截至发稿未见含修复的版本发布。
为什么重要: Prefill/decode 分离正在成为大模型推理的默认架构,而这正是该架构
引入的新型漏洞面:集群内部控制平面变成了网络攻击面。如果你以 PD 模式运行 LightLLM,
暴露的 /pd_register 应按"提示词已泄露"处理——在修复版本落地前,网络层隔离是唯一
缓解手段。
🔗 GitHub issue #1576 · 🔗 NVD 记录 CVE-2026-93839
20. IEEE Spectrum 揭秘 OpenAI 的 Jalapeño 芯片:LLM 设计了前端——文章也写明了它们帮不上的地方
- Velocity: ▮▮ rising
- Source: Hacker News · 136+ 分 · 约 12 小时前(~08:11 UTC+8)
- Tags:
chips openai hardware llm
IEEE Spectrum 的深度报道(9 月 14 日刊发、9 月 18 日重回 HN)聚焦 OpenAI 首款加速器
——与 Broadcom 合作负责物理设计:4-bit 精度 13.4 PFLOPS、232 GB HBM4、宣称端到端
延迟较 NVIDIA GB300 最高降低 3.6 倍。前端流程构建在 Google 开源的 XLS 之上
(C++/DSLX → Verilog);从概念到流片不足 20 个月,团队平均人数不到 100;一颗
DeepSeek attention kernel 在流片后约 40 小时内从理论峰值的 0.31% 提升到 88.94%。
为什么重要: 请带上 Spectrum 自己的免责声明:"真实集群性能未经证实;基准数据由
OpenAI 提供",且专家指出 20 个月的进度表只有在 Broadcom 承担物理设计的前提下才
可信。文章本身给出的诚实结论是:LLM 大幅压缩了前端(RTL 与 kernel)工作量,对后端
物理设计帮助有限,而工程师始终是"最终仲裁者"。
🔗 IEEE Spectrum · 🔗 HN 讨论
21. IBM Guardium:12 个严重 CVE 同日砸上 NVD——反序列化 RCE、SQL 注入与无鉴权 servlet
- Velocity: ▮▮ rising
- Source: NVD / IBM · 记录 9 月 18 日发布
- Tags:
cve ibm database-security enterprise
IBM Guardium Data Protection 12.2 的一批严重修复于 9 月 18 日集中发布到 NVD——
CVE-2026-80441、-80442、-81657、-82340、-82832、-82967、-84064、-84073、-84075、
-84078、-84082,另有 Sterling File Gateway 9.1 的 CVE-2026-75878。构成:未鉴权
反序列化 RCE(9.8)、IP 访问控制鉴权绕过(9.8)、未鉴权 SQL 注入(9.8)、
ChangeTracker/LoadBalancer servlet 缺失鉴权(9.9),以及已鉴权操作系统命令注入
(9.9)。全部由 IBM 以 CNA 身份评分;修复位于 Guardium 12.x 更新流。
为什么重要: Guardium 坐在数据库审计流量上——一旦沦陷,等于把企业里几乎每一条
查询都交了出去,这使它既是高价值目标,失守时又是合规事件。十二个漏洞一次性放出
指向协同发布而非挤牙膏;Guardium 管理员应立即盘点版本,并把可从互联网或普通用户
触达的控制台视为暴露面。
🔗 IBM 安全公告 · 🔗 NVD 记录 CVE-2026-80441
22. xAI 将 Grok Voice Transcribe 2.0 设为默认 STT——而"准确率翻倍"只活在营销页上
- Velocity: ▮▮ rising
- Source: x.ai 文档 · 9 月 18 日
- Tags:
speech-to-text xai api voice
xAI 文档现已将 grok-voice-transcribe-2.0 列为其语音转文本 API 的默认模型:
POST /v1/stt 端点加 WebSocket 流式接口,支持 25 种语言、词级时间戳、多通道音频与
说话人分离。文档写明"所有音频实时处理,绝不存储、绝不用于训练"——一条直指医疗与
法律转写市场的零留存承诺。
为什么重要: API 默认模型一换,所有未锁定版本的客户同时被迁移,而 STT 是生产
环境中吞吐量最高的 AI 工作负载之一。这里的信源提醒很关键:被广泛引用的"准确率为
1.0 的 2 倍、价格不变"出自 xAI 营销页(该页拒绝非浏览器抓取)及二手报道——文档
本身没有任何准确率声明,在被独立评测之前请把那个倍数当营销话术。
🔗 x.ai 语音文档 · 🔗 x.ai 模型列表
23. Cache-to-Cache:用 KV-cache 代替文本的模型间通信迎来 HN 时刻
- Velocity: ▮▮ rising
- Source: Hacker News · 95+ 分 · 约 17 小时前(~03:06 UTC+8)
- Tags:
paper kv-cache multi-agent inference
HN 热议的是"Cache-to-Cache: Direct Semantic Communication Between LLMs"
(arXiv 2510.03215,2025 年论文重回首页):智能体之间的消息不再走"生成文本—解析—
重新编码"的老路,而是一个模型的 KV-cache 被直接投影进另一个模型的缓存——以推理
速度完成语义通信,完全跳过解码与重编码的往返。
为什么重要: 今天的多智能体系统每跳都要交一笔 token 税——生成、序列化、重新
prefill。缓存级通信从架构层面直击这笔税,这正是它随智能体舰队扩张而反复翻红的原因。
现实约束也清楚:它要求模型间共享或可映射的词表/几何结构,眼下是同家族(或协同训练)
的技术,而不是跨厂商桥梁。
🔗 arXiv:2510.03215 · 🔗 HN 讨论
24. Stagehand:"Playwright 快 2 倍、token 省 80%"——厂商口径,代码公开
- Velocity: ▮▮ rising
- Source: Hacker News · 94+ 分 · 约 19 小时前(~01:06 UTC+8)
- Tags:
browser-agents playwright testing tokens
Browserbase 的 Stagehand——在 Playwright 之上叠加 AI API 的浏览器智能体 SDK——以
"我们把 Playwright 提速 2 倍、token 效率提升 80%"为题登上 HN:核心工作是裁剪喂给
模型的 DOM 快照与动作轨迹,而浏览器自动化的延迟与 token 开销恰恰都耗在这里。
为什么重要: 浏览器智能体是最烧 token 的智能体类别,DOM-到-提示词的压缩才是
所有人成本的真正所在。这些数字由厂商自行报告——当作方向读,别当基准读——但仓库
开源、测量可复现,这已经比这个领域大多数"省 token"宣传体面。
🔗 github.com/browserbase/stagehand · 🔗 HN 讨论
25. "科学即开源软件"——把可复现性危机重构为依赖管理问题
- Velocity: ▮ steady
- Source: Hacker News · 104+ 分 · 约 9 小时前(~11:06 UTC+8)
- Tags:
open-source research reproducibility essay
Jakob Pedersen 主张:论文在功能上就是"仓库卫生极差的开源项目",应当被当作开源软件
对待。文章展示了论文里那句"代码可应要求提供"实际上一摊无标注脚本、死链与未记录的
环境状态,以及当它被当作有版本、有测试、有维护者的软件来对待时,一切将如何改变。
为什么重要: 这个框架之所以成立,在于它是操作性的而非道德性的:开源社区为维持
软件存活发展出的每一项实践(semver、CI、CODEOWNERS、依赖归档)都直接映射到不可
复现研究的失效模式上——而智能体时代抬高了赌注:在文献上训练的模型会继承文献的
腐烂。
🔗 jepedersen.dk · 🔗 HN 讨论
26. JEPA-Anything:一套预测建模范式号称横跨七大领域
- Velocity: ▮ steady
- Source: arXiv · 2609.20800 · 9 月 17 日
- Tags:
paper jepa world-model self-supervised
Ling Yang、Weiyang Liu、Zhenfei Yin 等人提出"正交预测因子分解"(OPF),作为 JEPA
式预测世界建模的跨领域泛化,评测覆盖视觉、生物、临床轨迹、控制、分子动力学、物理
场与气象。报告称在全部 10 个动力学任务上击败对齐条件的 JEPA 基线,Interventional
Pong 上干预预测误差下降 34.8%,并从行星数据中恢复出开普勒指数(−1.4991)。代码发布
于 Gen-Verse/JEPA-Anything。
为什么重要: LeCun 的 JEPA 路线常被批评为"只属于视觉的愿景",七领域评测正是
这一主张需要的那种检验。读结果时请按论文自己的口径——对照的是对齐条件的 JEPA
基线,而非各领域最强专用方法;生物干预结果也只是"获得实验支持",谈不上验证。
🔗 arXiv:2609.20800 · 🔗 github.com/Gen-Verse/JEPA-Anything
27. RetireOPD:蒸馏教师在训练中途"自我退休"——学生反过来超过它
- Velocity: ▮ steady
- Source: arXiv · 2609.20784 · 9 月 17 日
- Tags:
paper distillation reinforcement-learning agents
面向智能体 RL 的"自蒸馏 on-policy"方法,带一条自适应退休规则:技能特权教师只在
性能差距仍在缩小时督导学生,一旦学生达到教师成功率的目标比例即被撤下。在 Qwen2.5
底座(1.5B–7B)上,方法报告 ALFWorld 提升 14.1–18.8 个百分点、WebShop 提升
11.8–19.0 个百分点——且所有测试设定中学生都超过了自己的教师。
为什么重要: "蒸馏进 RL"管线的老大难是何时停止模仿:停太早封住学生上限,
停太晚则把教师的天花板与偏见一并导入。把退休变成一个被测量的决策而非超参数,是个
机制干净的小点子——不过证据全部来自 Qwen2.5,请当配方读,别当定律读。
🔗 arXiv:2609.20784 · 🔗 arXiv HTML
28. Xing4.0-29B-A4B:中国电信发布全 Ascend NPU 训练的编码 MoE
- Velocity: ▮ steady
- Source: Hugging Face Trending(第 5 名)· 9 月 18 日更新
- Tags:
open-weights moe ascend coding
XingChen-AGI(中国电信)发布 Xing4.0-29B-A4B:总参 29B / 激活 4B 的 MoE(64 个路由
专家、MLA + MTP、256K 上下文),模型卡宣称这是"首个完全在昇腾 NPU 平台上、以
MindSpore 框架训练的该规模模型"。自报数字:SWE-bench Verified 75.00(对比
Qwen3.6-35B-A3B 的 76.00)、Terminal-Bench 2.1 达 57.50——AIME2026 与 IFBench
则落后。
为什么重要: 真正的重点是算力主权叙事:一家国家级运营商在没有 NVIDIA 依赖的
前提下发布有竞争力的编码权重,比任何一个基准点都重要。模型卡本身没有 limitations
一节、头条数字带着 harness 脚注——75.0 请按我们对待一切自报 harness 分数的方式
读:等待复现之前的上限值。
🔗 huggingface.co/XingChen-AGI/Xing4.0-29B-A4B · 🔗 XingChen-AGI on HF
29. Red Hat OpenShift 控制台 CVE-2026-75885:devfile 端点的未鉴权 SSRF
- Velocity: ▮ steady
- Source: NVD / Red Hat · 9 月 18 日发布
- Tags:
cve openshift ssrf kubernetes
OpenShift 控制台的 /api/devfile/ 与 /api/devfile/samples/ 端点接受未鉴权的
恶意 devfile 载荷,从控制台上下文发起服务端请求伪造——CVSS 9.3(Red Hat CNA,
secalert@redhat.com 为主评分方),NVD 记录 9 月 18 日发布。devfile 是定义云
工作区的模板,其导入路径天然是 SSRF 支点:控制台会以特权网络位置去抓取受攻击者
影响的 URL。
为什么重要: OpenShift 控制台所处的网络位置可触达元数据服务、内部镜像仓库与
Kubernetes API 本身——在这里 SSRF 是立足点原语,而不只是信息泄露。集群管理员应
按 Red Hat 通告修补,并审计 devfile 端点是否暴露在控制台 UI 之外。
🔗 Red Hat CVE · 🔗 Bugzilla 2517885
30. Gravity Forms CVE-2026-84434:未鉴权任意文件上传(CVSS 9.8)——修复版本未经确认
- Velocity: ▮ steady
- Source: NVD / Wordfence · 9 月 19 日发布
- Tags:
cve wordpress file-upload rce
WordPress 站点上装机量巨大的表单插件 Gravity Forms,其 upload_file 例程存在未鉴权
任意文件上传(受影响:≤3.1.0.4)——文件类型校验不一致,允许上传进而可能远程代码
执行。CVSS 9.8(Wordfence 以 CNA 身份评分,由其 Argus 扫描器发现);NVD 记录于
9 月 19 日凌晨发布。
为什么重要: 表单插件是 WordPress 经典的初始入侵向量——无处不在,且天然允许
未鉴权访问。按我们自己的规则补一条诚实注:截至发稿无法从厂商更新日志确认确切的
修复版本——请升级到最新可用发布并核对版本号,不要默认某个具体数字。
🔗 NVD 记录 CVE-2026-84434 · 🔗 Wordfence 威胁情报
31. quiche 0.30.0:默认后量子的 BoringSSL 开始拆分 ClientHello——所有 QUIC 实现者都该关心
- Velocity: ▮ steady
- Source: GitHub release · 9 月 17 日
- Tags:
quic http3 rust post-quantum
Cloudflare 的 Rust QUIC/HTTP-3 实现发布 v0.30.0,两条破坏性变更的分量远超其更新
日志篇幅:boring crate 版本范围改为 >=4.19,<6,因为 BoringSSL 5 默认启用后量子
密钥组——而后量子 ClientHello 可能超过单个 Initial 包,把首个 flight 拆到多个数据报
上,这会击垮所有假设握手合并的 QUIC 实现。PathEvent 同时改为 #[non_exhaustive]
并新增 PmtuUpdated 变体。
为什么重要: 后量子握手迁移到来时是一个分包问题,而不只是密码学问题——多个
Initial 包下的中间盒与对端行为,正是静默故障的藏身处。Cloudflare 率先在自己的开源
QUIC 栈里修掉它,对其他每个 QUIC 实现都是预警——而不仅是 quiche 用户。
🔗 quiche · 🔗 v0.30.0 发布说明
Metadata
| Field | Value |
|---|
| Generated | 2026-09-19T20:16:00+08:00 |
| Items | 31 |
| Sources tracked | 31 (Hacker News, GitHub Trending, arXiv, Hugging Face, NVD, CISA KEV, 厂商博客 (Cloudflare, Cactus, Ledger), 厂商文档 (x.ai, Anthropic), IEEE Spectrum, IBM, Red Hat, Wordfence, VulnCheck, terrytao.wordpress.com, CNN, GrapheneOS, developer.android.com) |
| Update schedule | 04:03, 12:03, 20:03 UTC+8 (每日 3 次) |
| Ranking | Velocity-weighted (recency × engagement acceleration × source authority) |
| License | CC-BY 4.0 |
Previous day · Raw .md · Archive