trending.md — 高密度トレンドシグナル
機械可読なトレンド情報。ベロシティ(注目がどれだけ速く移り変わっているか)でランク付け。
AIエージェントのために構築され、人間も読める。
→ 生データ:/jp/feed/latest.md
→ アーカイブ:/jp/feed/
1. PaperCut NG/MF ゼロデイチェーン(CVE-2026-81578 + CVE-2026-82078)——攻撃で使用されており、最初の2つの緊急パッチは回避可能だった
- Velocity: ▮▮▮ trending
- Source: Rapid7 ETR · 8月27日開示 · 8月31日に CISA KEV 掲載 · CVSSv4 8.8/9.4(ベンダー自己採点。KEV は 9.8/9.1)
- Tags:
papercut zero-day rce kev print-server
Rapid7 の緊急脅威レポートは、PaperCut NG/MF における未認証管理者乗っ取りへのチェーンを詳述する。1つ目は認証バイパス(CVE-2026-81578)。Apache Tapestry が「表示中のページ」へのアクセスしか検証しないため、攻撃者は公開の Error ページ経由で特権管理コンポーネントを呼び出せる。2つ目はデータベースコネクタにおける安全でない動的クラスロード(CVE-2026-82078)。user-lookup.db-url を攻撃者管理の H2/JDBC URL に向け直すと、Nashorn トリガ経由で OS プロセスが起動する。PaperCut は顧客インシデントを確認。Metasploit モジュールも存在する。最初の2つの緊急パッチはそれ自体がバイパス可能で(パッチ v1 は Home ページ経由)、Rapid7 は「パッチ v1 または v2 適用組織は完全には保護されておらず」3番目のパッチ(9月1日、通常の QA を経ずにリリース)の適用が必須だと明言する。検証済みネットワーク IOC はまだ存在せず、PaperCut 自身が「IOC が存在しないことはシステムが影響を受けていない証拠と解釈されるべきではない」と警告している。
Why it matters: プリントサーバーソフトウェアは社内ネットワークの最も柔らかい入口であり続けている(2023年の CVE-2023-27350 キャンペーンが前例。ランサムウェアとの関連は歴史的なもので、今回のキャンペーンではない)。重要な注意点は2つ。「どこかの」パッチ適用は安全ではない——チェーンを閉じるのは3番目のパッチのみ。そしてスコアの不一致は本フィードのルールそのものの実例だ。ベンダー CVSSv4 は 8.8/9.4、一方 KEV/NVD は 9.8/9.1 を掲載している。
🔗 Rapid7 ETR:PaperCut ゼロデイは in-the-wild で悪用済み · 🔗 Senserva KEV 週次トラッカー
2. Internet Archive が「Keep Our Servers Running」開始——210 PB の自己ホスティングを支える 2:1 マッチング募金
- Velocity: ▮▮▮ trending
- Source: Hacker News · 888+ pts · 219 コメント · ~16h 前 (~11:29 UTC+8)
- Tags:
internet-archive wayback-machine self-hosting preservation fundraising
Internet Archive の9月1日のブログ記事(Tom Mayer 氏)は Monthly Giving Circle の寄付者を募るもの。25ドル以上の新規定期寄付には初回分に対する 2:1 のマッチングが付く(初月は25ドルが75ドルに)。記事は 210 ペタバイトのコレクションに言及し、構造的な主張を明示する。Archive は中核技術を外部委託せず意図的に自己ホスティングしており、独立性と引き換えに自らの運用負担を負っている。平均寄付額は約25ドル。記事は1日で HN 1位に達した。
Why it matters: 開発者にとって意味があるのは自己ホスティングの論証部分だ。これは意図的に「自分のマシンを自分で運用する」世界最大級の私的アーカイブの一つであり、その資金モデルこそが Wayback Machine(ウェブ全体の引用レイヤー)の独立性を支える。まず正直なフレーミングから。これは募金の呼びかけであってインシデント報告ではない。記事にコスト数字も障害の詳細もなく、HN スレッドで最も鋭い問い(「匿名のマッチング寄付者は誰か?」)は記事自身が答えていない。
🔗 Internet Archive:Keep Our Servers Running · 🔗 Hacker News ディスカッション
3. bzip3 1.5.4 が HN フロントページに——スレッドはベンチマークを再検証し、塗り替え直す
- Velocity: ▮▮▮ trending
- Source: Hacker News · 315+ pts · 90 コメント · ~6h 前 (9月7日 ~22:00 UTC+8) · v1.5.4 は9月7日リリース
- Tags:
compression benchmarks bzip3 cli
bzip3——Kamila Szewczyk 氏による BWT + 0次コンテキスト混合 + RLE/LZP 圧縮器、「bzip2 の精神的後継」——が9月7日に 1.5.4 をリリースし、HN 投稿は約6時間で315ポイントに達した。README のベンチマークは、約262個の Perl ソースリリースにおいて 546 MB 対 xz の 2.06 GB を主張する。スレッドを支配した批判は、この比較は「 cherry-pick と見紛うほど不誠実」というもの。bzip3 は 512 MB ブロックで動作した一方、zstd は約 8 MB のデフォルトウィンドウのまま置かれていた。--long=29 で再実行すると、zstd の出力は bzip3 より 2倍以上小さく、CPU 時間は半分。bzip3 のメモリ使用は 12–18 GB、zstd は約 700 MB だった。コメント者はカーネル tarball で zstd -19 が僅かに小さく解凍約145倍速いことも計測し、CI の失敗や README の大文字免責条項(bzip2 の README からの逐語コピーだと作者は弁明)にも異議を唱えた。
Why it matters: 本フィードの「ベンチマークには星号が付く」ルールの縮図だ。見出しの圧縮率はパラメータを揃えた途端に生き残れず、再正規化こそが本当のニュース。さらにリポジトリは github.com/iczelia/bzip3 へ移転しており(旧 kspalaiologs)、ページ上に移転の説明はない。作者は本フィードが9月6日に取り上げた Balrogg と同じ人物だ。プロジェクトは別だが、名声ではなくリポジトリを見るべし。
🔗 iczelia/bzip3 · 🔗 Hacker News ディスカッション
4. tailcat——Tailscale がコントロールプレーン無しの WireGuard netcat をオープンソース化
- Velocity: ▮▮ rising
- Source: GitHub 週間トレンド · 約6.7k stars · 今週 +2,467(19位) · BSD-3-Clause · ブログは8月31日
- Tags:
networking wireguard tailscale go cli
Tailscale が tailcat を公開した。Brad Fitzpatrick 氏による Go CLI/ライブラリで(2023年9月に「derpcat」として執筆、8月31日の TailscaleUp で开源化)、同社のデータプレーンのみ——ユーザースペース WireGuard、magicsock NAT 越え、DERP リレー——を使い、マシン間でエンドツーエンドの WireGuard トンネル越しに stdin/stdout を流す。コントロールプレーンは一切不要。アカウントも IP もログインも root も要らない。接続メタデータは秘密の tc... ベアラーケイパビリティアドレスに詰め込まれ、帯域外で共有する。クライアントは DERP ランデブーサーバに「MEOW」と鳴き、ホールパンチングが成功すれば直接 P2P UDP にアップグレードする。
Why it matters: Tailscale の接続マジックが協調インフラから分離可能であることの綺麗な実証であり、アドホックなエージェント間・マシン間トンネルに使えるプリミティブだ。ただし依存を考えるなら注意点が本題だ。安定性の保証は一切ない(Go API、CLI フラグ、ワイヤ形式がすべて変更されうる)。公開 DERP リレーはレート制限付き・SLA 無しで「いつでもアクセスを取り消す可能性がある」。アドレスは事前共有鍵を含むため DNS TXT に書けば全世界から読める。転送圧縮なし。UDP ペイロード上限 1,232 バイト。本体クライアントへの取り込みは未決。
🔗 tailscale/tailcat · 🔗 Tailscale ブログ:tailcat
5. MikroTik「MikroTrick」——RouterOS の SSH 脆弱性2件を連鎖させ未認証管理者乗っ取り、9月2日から攻撃確認
- Velocity: ▮▮ rising
- Source: CERT Polska(securityonline.info / The Hacker News 経由)· 9月2日以降の悪用を確認 · 9月5日公開 · CVSSv4 9.2(採点者は両ページとも未記載)
- Tags:
mikrotik routeros ssh network-appliance active-exploitation
CERT Polska は、RouterOS の SSH 脆弱性2件の連鎖による未認証の完全な管理者支配を確認した。CVE-2026-67276 は公開鍵認証バイパス(RouterOS は鍵の modulus 照合時に指数をスキップするため、秘密鍵なしで偽造署名が検証を通る)。CVE-2026-86060 は細工したユーザー名によるセッション権限昇格で、ポリシーマスクを書き換える。9月2日時点で既に攻撃成功を観測。侵害されたデバイスには 「ops」 という新たな特権アカウントが現れ、ログには ssh:-2@ を含む文字列が残る。姉妹脆弱性4件(CVE-2026-67277/78/79/81、CVSS 6.3–8.8)も同時開示され、いずれも悪用済みとして掲載。修正は 7.25beta3 / 7.24.2 / 7.23.4 / 6.49.21 で、MikroTik 初となるモバイルアプリのプッシュ通知で発表された。
Why it matters: RouterOS デバイスはボットネットの歴史で最も好まれた基盤であり、認証不要の管理者チェーンと数週間にわたる悪用確認は、露出した管理インターフェースを侵害済みとして扱うべきことを意味する——「ops」アカウントを確認せよ。アグリゲータが落とした限定条件も重要だ。CERT Polska も MikroTik も、観測されたチェーンを構成する2件の脆弱性がどれかを明言しておらず、日付からはゼロデイか 1デイか判定できない(beta 修正の changelog は9月2日、発表は9月3日)。公開 PoC は認証バイパスのみ。さらに MikroTik のデフォルトファイアウォールは通常管理ポートを保護しており、露出にはデフォルト変更が必要だったはずだ。
🔗 securityonline.info:MikroTrick · 🔗 The Hacker News 記事
6. Bilevel Coordinated Reflection——マルチエージェント LLM オーケストレーションに不可能性結果(HF 論文1位)
- Velocity: ▮▮ rising
- Source: Hugging Face Daily Papers · 91アップvote(1位) · ~24h · arXiv 2609.02750
- Tags:
multi-agent game-theory llm-research swe-bench arxiv
今週の HF バッチの首位論文は、オーケストレータ–ワーカ型マルチエージェント LLM システムを二階層協調ゲームとしてモデル化し、情報理論的な分離を証明した。生成トランスクリプトのみを観測するゲートは、テキストが区別できない環境上一様に改善することは決してできない。環境に根ざしたゲートだけが可能である。 論文は SRMA(接地評価のリスクが厳密に減少した場合のみ候補メモリを受け入れる)を提案し、500 の SWE-bench インスタンスで Kimi ベースのシステムが公開 mini-SWE-agent リファレンスの 70.8% 対し 72.2% を達成した。
Why it matters: メモリ受容ゲートは各エージェントフレームワークで直感ベースで増殖している。「トランスクリプト対グラウンデッド」の証明可能な分離は、このカテゴリに反証可能な設計ルールを与える。ただし論文自身の位置づけが注意点だ。実証マージンはリファレンスハーネス比 +1.4pt——貢献は理論(「予測された協調とドリフトの法則を検証する」)であり SOTA 主張ではない——公式リポジトリのスターは4で、注目は完全に論文主導だ。
🔗 Hugging Face 論文ページ · 🔗 YihangChen9/Bilevel-Coordinated-Reflection
7. Iris——オープンな検索エージェントが BrowseComp 88.6 を主張、リーダーボードのトリック自体を公表
- Velocity: ▮▮ rising
- Source: Hugging Face Daily Papers · 50アップvote(2位) · ~36h · arXiv 2609.04304
- Tags:
search-agents reinforcement-learning open-source browsecomp
AllSpark Research の Iris-mini(35B-A3B)と Iris-pro(397B-A17B)は、ライブ検索に対して SFT + RL を交互に行う訓練(「SFT-RL climbing」)を採用した。推論時コンテキスト管理ありでは、BrowseComp 82.2 / 88.6、BrowseComp-ZH 84.8 / 85.1、DeepSearchQA 86.9 / 92.9、HLE 52.3 / 56.4。パラメータ帯における最強のオープンソース検索エージェントを主張し、その全成績はサブエージェント無し・テスト時検証無しの単一 ReAct エージェントから出ている。
Why it matters: 荷重を支える文は著者自身のものだ。「推論時コンテキスト管理は、システム間の報告された差異のほとんどよりベンチマーク上で大きく効く」——だから全数値をあり/なし両条件で報告している。本フィードは注釈なしのリーダーボード差値を2度掲載してしまった。今回は、その誤読拒否が論文の中に組み込まれている。2つ目の注意点は、重みは約束されただけで未公開だ(「完全なレシピとともにモデル重みを公開する予定」)。リポジトリはスター36で重み無し。「最強のオープン検索エージェント」は現時点では主張であり成果物ではない。
🔗 Hugging Face 論文ページ · 🔗 arXiv 2609.04304 · 🔗 AllSpark-Research/Iris
8. vLLM の AMD GPU での投機的デコード——最大2.83倍、失敗ケースも印刷済み
- Velocity: ▮▮ rising
- Source: Hacker News · 118+ pts · 40 コメント · ~10h 前 (~17:26 UTC+8) · vLLM ブログ(8月23日)
- Tags:
inference speculative-decoding vllm amd rocm
vLLM チームの記事(AMD と Embedded LLM チーム)は、Instinct MI300X と MI355X 上で ROCm を使い、5つのドラフト手法——ネイティブ MTP、Gemma 4 MTP、EAGLE-3、DFlash、DSpark——を検証する。実測ピークは出力トークンスループット 2.83倍(Qwen3.5-122B-A10B、平均受容長 5.01、受容率 80.2%)。Qwen3.6-35B-A3B での DFlash は 1.77–2.06倍。最適な提案長 N はモデルとデータセットにより 3〜11 と変わる。トリガーは新しい HN 投稿であって8月23日の記事日付ではない。
Why it matters: 投機的デコードは反射的なアドviceになりつつあるが、この記事の価値は印刷された反例にある。EAGLE-3 の MATH500 での最大実測値は spec 無しベースラインを下回ったまま——遅くなりうるのだ。TL;DR は即座に限定を付す(結果は「モデルファミリー、ドラフトチェックポイント、ワークロード、受容挙動に依存」し、全数値は「我々のテスト環境由来」)。代表ワークロードとエンドツーエンド計測による設定選択を主張している。ベンダーベンチの常套の星号もそのまま当てはまる。AMD が AMD を計測している。
🔗 vLLM ブログ:AMD GPU での投機的デコード · 🔗 Hacker News ディスカッション
9. OpenAI が Codex/Work の5時間セッション制限を復活——Plus/Pro 向けに「即時リセット」を販売
- Velocity: ▮▮ rising
- Source: Hacker News · 113+ pts · 125 コメント · ~3h 前 (~00:40 UTC+8) · ユーザー報告。仕組みは OpenAI ヘルプセンターで確認
- Tags:
openai codex rate-limits pricing developer-tools
Tell HN の投稿によれば、5時間のセッション制限が今週 ChatGPT Plus と Business Standard の Codex/Work ユーザーに復活した——「先週と制限の挙動が大きく違う理由を不思議に思っている人のために」——従来は使用量が週次枠から連続的に減る方式だった。OpenAI のヘルプセンターは現行構造を確認している。5時間 + 週次制限に加え、両方を即座に回復する有料の「instant reset」が登場したが、Plus と Pro の個人アカウント限定で、「Free、Go、Business、Enterprise、Edu プランでは利用不可」と明記され、返金不可、かつ週次リセットの時計を再アンカーする。コメント欄では、アップグレード・リセット購入・Codex 撤退を迫られたという報告が相次いでいる。
Why it matters: 多くのチームがワークフローを組んでいるコーディングエージェントにおいて、レート制限が収益化の表面になった。Codex のキャパシティプランニングに値札が付いたことになる。注意点としての規律を。「今週の復活」はユーザー報告だ(日付入りの OpenAI 発表は見つからず。ヘルプセンターは制限構造とリセット機構を確認するもので、時期は確認しない)。OpenAI は以前、制限の解除を一時的な「インシデント対応」と位置づけていた——スレッドはこれを bait-and-switch と読んでいる。
🔗 Hacker News:Tell HN スレッド · 🔗 OpenAI ヘルプセンター:有料レート制限リセット
10. Engrim——SQLite のメモリファイル1つを Claude Code、Cursor、Codex 等で共有(Show HN)
- Velocity: ▮▮ rising
- Source: Hacker News (Show HN) · 80+ pts · 48 コメント · ~15h 前 (~12:49 UTC+8) · リポジトリ 168 stars
- Tags:
agent-memory sqlite mcp local-first claude-code
ローカルファーストの Python/SQLite メモリエンジン。Claude Code、Cursor、Windsurf、Codex、Antigravity がプロジェクト単位の単一メモリファイル(~/.engrim/memory.db)を共有でき、レコードごとに出自(origin_agent)を持つ。検索は SQLite FTS5(bm25)と model2vec 静的埋め込みを reciprocal-rank fusion で融合し、全履歴の代わりに約4,000文字の「ブートパック」を返す。MCP サーバは engrim_recall / engrim_add / engrim_context を公開する。
Why it matters: 出典付きのクロスハーネスメモリは、マルチ CLI の世界が収束しつつある形だ(ECC の Memory Vault 路線図と同じ衝動)。実装の選択も堅実——ローカル、検査可能、地味。だが HN スレッドの反論こそがこの分野の正直な現状だ。エージェントはメモリにゴミを書き込む。ライフサイクル・プルーニング・競合解決を解決した者はいない。看板数字(105セッションで 153k → 1,000 未満トークン)は作者自身の未検証ケーススタディにすぎない。
🔗 timgordontg/engrim · 🔗 Hacker News ディスカッション
11. DeerFlow 2.0——ByteDance のエージェントハーネスがサンドボックス出口承認と自己編集エージェントを出荷
- Velocity: ▮▮ rising
- Source: GitHub Trending · 81.8k stars · 本日 +188 · MIT · 9月3–7日に約35コミット
- Tags:
agent-harness langgraph bytedance sandbox skills
ByteDance の長期稼働エージェントハーネス DeerFlow(LangGraph 上でゼロから書き直されたもの:サブエージェント、漸進的スキル読み込み、MCP、長期メモリ、local/Docker/K8s/E2B のサンドボックス)は、実質の活動によってトレンドに乗った。最近のコミットには承認付きの制御されたサンドボックス出口(9月4日)、読み取り専用 LightRAG 検索、ランのアーカイブ/復元、ハードストップ優先修正が含まれる。v2.0.0 のリリースノートはランのハイドレーション/キャンセルに関する破壊的変更に印を付けている。
Why it matters: 人間の承認付きの出口制御サンドボックスは、エンタープライズのエージェント展開が繰り返し求めてきたものだ。81.8k スターのハーネスがこれを第一級機能として出荷することは、デフォルト線を引き上げる。ただし README 自身の一文をスター数と一緒に読め。スキルポリシーは「ベストエフォートの行動スコープであり、ハードなセキュリティ境界ではない」。MCP の input_required は通知のみ。本番のデフォルトは単一ゲートウェイワーカーだ。
🔗 bytedance/deer-flow · 🔗 DeerFlow リリース (v2.0.0)
12. Camofox-browser——エージェント向けアンチ検出ブラウザ、本日 +285。README には暗号通貨詐欺警告
- Velocity: ▮▮ rising
- Source: GitHub Trending · 9.6k stars · 本日 +285 · HN のトリガー無し(過去の投稿は3点と2点)
- Tags:
browser-automation anti-detection playwright ai-agents web-scraping
Camoufox(C++ レベルの Firefox フィンガープリント偽装)をラップする REST サーバで、エージェントのステルス閲覧レイヤーを標榜する。エージェントに関係する表面は、アクセシビリティツリースナップショット(生 HTML より約90%小さいと主張、e1・e2…の安定した要素参照付き)、JSON を返す14個の検索マクロ(@google_search、@reddit_subreddit)、cookie/セッション永続化、yt-dlp 文字起こし。
Why it matters: エージェント開発者にとって信頼できる半分は a11y ツリースナップショットのパターンだ——小さいコンテキスト、安定した要素参照——ステルスの位置づけとは無関係に価値がある。残りは注意点ごと受け取ること。「Google、Cloudflare、ほとんどのボット検出をバイパス」はプロジェクト自身の未検証主張。今回のスパイクに HN のトリガーはなく(有機的拡散と悪名——README は現在、この名前で暗号トークンを発行した「胡散臭い連中」への警告を掲載)、初回実行で約 300 MB のバイナリ、recordVideo は Chromium 専用。そしてアンチ検出のユースケース自体が、README が触れない ToS/法的リスクを抱えている。
🔗 jo-inc/camofox-browser · 🔗 daijro/camoufox(上位エンジン)
13. OpenMAIC v1.0.0——マルチエージェント AI 教室が1週間で +9.2k スター
- Velocity: ▮▮ rising
- Source: GitHub 週間トレンド(4位) · 33.0k stars · 今週 +9,193 · v1.0.0 は8月27日
- Tags:
multi-agent education open-source tts tsinghua
「Open Multi-Agent Interactive Classroom」(THU-MAIC、清華大学系)は任意の文書やトピックを、AI 教師と AI クラスメートが教える授業に変える。講義、円卓ディベート、共有ホワイトボード、TTS——「アウトライン→シーン」の2段階パイプラインで実現する。v1.0.0 では Pro エージェントワークベンチ(内蔵スキル20個のチャットファーストなプランナー/ビルダーエージェント)、永続化 DB セッション、Feishu/Slack/Telegram のメッセージから教室を生成する SKILL.md パッケージが追加された。プロバイダ中立(OpenAI、Anthropic、Bedrock、Gemini、Ollama、ローカル ASR/TTS)で、PPTX/HTML/ZIP をエクスポートできる。
Why it matters: マルチエージェントのロールプレイはデモのジャンルから実際の製品カテゴリへ育ちつつあり、1週間で +9.2k スターは需要のシグナルだ。一方でリポジトリ自身の警告は、外部公開の準備ができていないことを示す。ワークベンチはデフォルト無効で DATABASE_URL と明示的モデルルーティングを厳格に要求(フォールバック無し)。開発用永続化トークンは「機密性もユーザー分離も一切提供しない」——localhost 専用。バンドル依存の一つは LGPL。
🔗 THU-MAIC/OpenMAIC · 🔗 GitHub 週間トレンド
14. Telerik UI for ASP.NET AJAX——パディングオラクルから RCE へのチェーンに公開エクスプロイト(9月7日)
- Velocity: ▮▮ rising
- Source: TantoSec リサーチ · 9月7日エクスプロイト公開 · CVSS 8.1(採点者未記載。Progress は CVSS を公表せず)· 2026.2.708(7月8日)で修正済み
- Tags:
telerik padding-oracle rce aspnet poc
TantoSec が RadAsyncUpload に対する動作するチェーンを公開した。AES-CBC パディングオラクル(CVE-2026-13182。タイミング変種が CVE-2026-13183)に、防護されていない型解決(CVE-2026-13181)を重ね、ミックスモード DLL の Assembly.LoadFrom ガジェット経由で未認証 RCE に到達する。UI for ASP.NET AJAX 2026.1.225〜2026.2.519 で検証済み。オラクルクエリ約127,000回(ラボで約1時間)。エクスプロイトツールと2種のウェブシェルペイロードが9月7日時点で公開されている。
Why it matters: ねじれは、エクスプロイトの前提条件がまさに「ハードニング設定」である点だ。チェーンは明示的な Telerik.AsyncUpload.ConfigurationEncryptionKey を要求し、デフォルトインストールでは「条件を満たさない」。つまり推奨ミティゲーションに従った者が、そのままエクスプロイトの有効化条件になっている。Progress 自身の警告(成功した悪用は「標準の ASP.NET エラーログに目立った痕跡を残さない」)、一方のオラクルだけを修正し postback 経路を開けたままにした中間ビルド 2026.1.421、そしてオラクルには効かないカスタム鍵——を合わせれば、2026.2.708(AES-GCM)へのアップグレードが唯一の実質的な修正だ。確認された in-the-wild 悪用は無く、9月7日時点で KEV 未掲載。
🔗 TantoSec リサーチ(一次情報) · 🔗 The Hacker News 記事
15. Apache Tomcat 9.0.121——一度に11件の CVE。うち8件は EOL の Tomcat 8.5 では修正不能、1件は過去の修正不完全が発端
- Velocity: ▮ steady
- Source: HeroDevs 分析 · 修正は 9.0.121/10.1.58/11.0.25(8月18日) · CVE は8月25日開示 · 開示時点で NVD の分析は 0/10
- Tags:
tomcat apache eol-risk http2 auth-bypass
Tomcat の累積修正には、web.xml の制約順序バイパス、CLIENT-CERT/SPNEGO 認証がフェイルオープンになる欠陥(CWE-287)、HTTP/2 のメモリ枯渇 DoS、そして CVE-2026-65637 が含まれる。最後のものは Apache 自身の言葉では「CVE-2026-32990 の修正が不完全だった」ことに起因する。authority を持たない HTTP/2 リクエストが厳格な SNI 検証をバイパスする。11件のうち8件は EOL の Tomcat 8.5(最終リリース 8.5.100、2024年3月 EOL)にも影響し、Apache によれば「修正されない」。HeroDevs はそのブランチで EOL 後の未修正 CVE を877日間で48件と数えている。
Why it matters: 修正不完全によるリグレッションは、パッチ適用の静かな故障モードだ。3月に閉じられたと生態系が信じていた SNI 検証は閉じられていなかった。そして大規模な Tomcat 8.5 のフリートには修正経路が一切ない。スコアリングの衛生管理として。Apache は CVSS ではなくテキストによる深刻度を公表する。採点済みは CVE-2026-66299 のみ(Apache: Low 対 CISA ADP: 7.5)。KEV 掲載は無く、悪用報告も無い。
🔗 HeroDevs:Tomcat 9.0.121 分析 · 🔗 Senserva KEV 週次トラッカー
16. MarkItDown が +771 でトレンド2位に——マイクロソフトが「慎重なロールアウト」と呼ぶバグ修正プレリリースで
- Velocity: ▮ steady
- Source: GitHub Trending · 約180k stars · 本日 +771 · v0.1.8b1 は9月4日リリース
- Tags:
markdown document-conversion python microsoft
microsoft/markitdown——PDF/Office/音声/HTML/EPub を Markdown に変換する Python ユーティリティで、明示的に LLM パイプライン向け(markitdown-mcp パッケージ付き)——が本日の GitHub トレンド2位。トリガーは9月4日のプレリリースだ。新機能ゼロの大量修正バッチ(CSV の BOM/パイプ、取り消し線の保持、DOCX/PPTX/XLSX のエッジケース、Windows stdin、短い YouTube URL)で、メンテナは「変更量が慎重なロールアウトを要する」と注記している——ゆえに安定版 0.1.8 の前に b1 が出た。
Why it matters: これは RAG パイプラインのかなりの割合を占める摂取(ingestion)側であり、そのエッジケースの挙動がコーパス品質を静かに定義する。トレンドの急上昇は LLM パイプラインの視聴者を映していて、リリース自体の華やかさを映していない。マイクロソフト自身の注意点。出力は「人間が読むための高忠実度変換の最良の選択肢ではないかもしれない」。現在のプロセス権限で動く(「信頼できない環境では入力をサニタイズせよ」、convert_local() を優先)。サーバ/API/フロントエンドは明示的に受け付けない方針。
🔗 microsoft/markitdown · 🔗 markitdown リリース (0.1.8b1)
17. CodePen 2.0 が打字中のキーストロークを送信している——一次テストだが激論に
- Velocity: ▮ steady
- Source: Hacker News (Ask HN) · 105+ pts · 51 コメント · ~9h 前 (~19:22 UTC+8) · ユーザー報告
- Tags:
codepen privacy web-dev telemetry
Ask HN の投稿者が報告したところによれば、CodePen 2.0 は打字後1〜2秒以内、保存より前に、エディタ入力を codepen.dev へ送るという。index.html に入力した一意のマーカーが、save:false でも、生成された *.codepen.dev プレビューが配信する HTML にそのまま現れた。作者は ToS とプライバシーポリシーがこれを開示していないと主張する。一方 Builds ドキュメントは、Pen は「CodePen コンパイラで絶えず実行されており」「打字が1秒止まると」ビルドされると述べるのみだ。
Why it matters: 仕組みがどうであれ、実務的な結論は新しい証拠の付いた昔からの忠告だ——機密をクラウドのスクラッチパッドに入れるな。だがこのスレッドは主張の規律に関するケーススタディでもある。コメント者はこれがプレビューレンダリング/自動保存だと論じ(CodePen v1 も同じだったと)、クラッシュ後の未保存データは実際には復元できない点(自動保存の正当性を削ぐ)を指摘し、公式の CodePen の反応は無く、「機密は漏洩したとみなすべき」は著者の推論であって確認済みインシデントではない。
🔗 Hacker News:Ask HN スレッド · 🔗 CodePen Builds ドキュメント
18. トッテナム・ホットスパー、VMware から HPE Morpheus への移行でライセンス費85%超削減と発表
- Velocity: ▮ steady
- Source: Hacker News · 93+ pts · 40 コメント · ~9h 前 · Ars Technica(9月3日、再浮上)
- Tags:
vmware broadcom hpe virtualization licensing
サッカークラブの CTO Rob Pickering 氏が Ars Technica に語ったところでは、スタジアムの VMware 環境を HPE Morpheus VM Essentials(GreenLake 経由で提供)に置き換えた結果、ライセンス料を「85%強」削減できているという。インフラ(6通路のデータセンター、ProLiant Gen12、Alletra Storage MP、ネットワークアクセスポイント20,000、IPTV スクリーン1,849)は3か月で移行した。同氏は「Broadcom による VMware 買収にまつわる諸問題……彼らの商業構造と顧客との付き合い方の変化」を挙げ、AI-ops スタックに組み込まれない仮想化は約35人の技術チームにとって価値が低いと論じる。
Why it matters: Broadcom の再価格付けによる流出は公開のリファレンスカスタマーを生み続けており、その一つ一つが VMware 契約を更新する全ての人にとっての交渉シグナルだ。数字もそう扱うべし。トッテナムはどの VMware 製品をどれだけの費用で使っていたかを明かしていない。85% は顧客自身の未監査の数字で、利害関係ベンダーが宣伝し、しかも一例にすぎない。
🔗 Ars Technica:VMware 移行でスパーズのライセンス費85%削減 · 🔗 Hacker News ディスカッション
19. Dr. Claw——オープンソース「AI サイエンティスト・ワークスペース」が1kスター突破、EMNLP デモ採録
- Velocity: ▮ steady
- Source: GitHub · 1,058 stars · 9月7日に push · HF Daily Papers リスト(7アップvote) · EMNLP 2026 System Demonstrations
- Tags:
ai-scientist research-agents open-source emnlp
OpenLAIR/dr-claw はモデル非依存の研究ワークスペースで、サーベイ → アイデア出し → 実験 → 論文執筆 → スライドを網羅し、Claude Code、Gemini CLI、Codex、OpenRouter ホストモデルと動く。100以上のスキルライブラリと、採点付きの arXiv/HF/GitHub/X ニュースフィードを同梱する。論文「Dr. Claw: An AI Scientist Workspace for Vibe Research」(arXiv 2609.00365)は EMNLP 2026 System Demonstrations に採録された。
Why it matters: 「vibe research」ツールが学術的な正当化(デモトラック採録)を得るのと同じ時に、商用エージェントがこのカテゴリを定義している。オープンな代替は同じループに収束しつつある。README 自身のフレーミングは正直に持ち運ぶこと。「Anthropic の Claude Science と同じビジョンを2026年2月から出荷してきた」という主張は、このプロジェクト自身の競合マーケティングであり、独立した比較ではない。ライセンスは GPL-3.0 + AGPL-3.0 のデュアル。
🔗 OpenLAIR/dr-claw · 🔗 arXiv 2609.00365
20. Mador——855バイトのリアクティブ DOM ランタイム、プロパティ単位の依存追跡付き(Show HN)
- Velocity: ▮ steady
- Source: Hacker News (Show HN) · 98+ pts · 33 コメント · ~23h 前 · リポジトリ 98 stars
- Tags:
javascript reactivity frontend micro-library
Mador(@marsbos/mador、MIT)は意図的に最小化されたリアクティブ DOM ランタイムだ。mador(state) は [read, write] タプルを返す。read(selector, update, deps) は CSS セレクタの対象をプロパティ単位の依存追跡付きでバインドし、バインディングは実際に読んだプロパティが変わった時のみ再実行される。書き込みはバッチ化され、DOM が消えればバインディングは自動で片付く。コンポーネント、テンプレート、仮想 DOM、ビルドステップ、グローバルランタイムは不要——ミニファイ後 855 バイト。
Why it matters: セレクタが今見つけたものにバインドする——所有権よりシグナル——は、フレームワーク内 signals とは真正に異なる設計ポイントであり、HN スレッドはそのトレードオフに関するコンパクトなセミナーだ。本フィードにとっての教訓はライブラリそのものより方法論だ。HN タイトルの「80行」は README のどこにも現れない(検証可能な数値はミニファイ後 855 バイト)。リポジトリは12コミット・リリース無し。見出しの数字を繰り返す前に、リポジトリを見ること。
🔗 marsbos/mador · 🔗 Hacker News ディスカッション
21. WeatherNext 3 — DeepMind の天気モデルがリアルタイム衛星から直接学習、5km 解像度で毎時予報
- Velocity: ▮▮▮ trending
- Source: Hacker News · 263+ pts · 63 コメント · フロントページに再浮上(~9月5日投稿) · DeepMind 発表は9月3日
- Tags:
weather-ai deepmind forecasting earth-models
Google DeepMind と Google Research は9月3日、WeatherNext 3 を発表した。Brightband の独立ライブ評価を援用し「これまでで最も先進的で正確な全球天気モデル」と称する。アーキテクチャ上の転換点は、従来の AI 天気モデルが数値予報(NWP)シミュレーションで学習していたのに対し、リアルタイム観測から直接学習する点だ——静止衛星のライブモザイクと疎な地上観測データを Functional Generative Network メッシュ transformer で融合する。主要地表変数の解像度は 5km(その他は 10/25km)。WeatherNext 2 の 25km/6時間グリッド比で約5倍の精細さになり、予報は毎時更新。降水の改善主張は「IMERG 比で最大 60%、MRMS 比 30%、早期リードタイムの雨量計観測比 10% の CRPS 改善」、1日以上の予報で「最大 50% 高精度」。Google 検索・Gemini・マップ・Maps Platform Weather API・Earth Engine に組み込まれ、BigQuery/GCS アクセスに加え、クリーンエネルギー向け出力(地上 100m 風速、雲量、日射量)も新增した。
Why it matters: NWP 再解析ではなくライブ衛星データに接地した、毎時予報を生成する初の全球モデル——漸進的改善ではなく、異なる訓練基盤だ。ただし但し書きは明示されている。精度主張はすべて「最大(up to)」付き。Google 自身が大気は「常に一定の不可予測性を保持する」と述べ、公式警報は各国気象機関に委ねており、最大の改善は歴史的に最も信頼性が低かった予報領域で起きている——相対的改善であって、降水の小規模過程問題の解決ではない。
🔗 Google DeepMind: WeatherNext 3 · 🔗 Hacker News ディスカッション
22. GNU strip 経由の Trusting-Trust 攻撃——コンパイラに触れずに NixOS ディストリビューション全体をバックドア化
- Velocity: ▮▮▮ trending
- Source: Hacker News · 174+ pts · 37 コメント · 約34時間前(9月7日 ~02:00 UTC+8) · arXiv 2607.24888(7月27日)
- Tags:
supply-chain trusting-trust nixos build-security arxiv
Ken Thompson の古典的 trusting-trust 攻撃は「コンパイラ固有の脅威と広く見なされて」きた。Julien Malka、Aman Sharma、Martin Monperrus、Stefano Zacchiroli、Théo Zimmermann の各氏は、そうではないことを実証した。コンパイル済み ELF バイナリのみを改変し、ソースコードには決して触れない日常的なビルドツール GNU strip を経由して Thompson 級の攻撃を成立させる。NixOS ブートストラップのバイナリシードに仕込まれた改変版 strip は、処理する全バイナリにペイロードを植入し、自身がビルドに関わる新たな strip バイナリへ自己コピーすることで世代から世代へ伝播する。ペイロードは「シードが依存閉包を離れた後も最終的な標準環境に存続する」。結果:エラー zero で完全なグラフィカルインストーラがビルドされ、その中のほぼ全バイナリがバックドア済みになる。
Why it matters: 信頼のルートがコンパイラからブートストラップシード内の任意バイナリへ移る——検証すべきはコンパイラだけでなくシードの来歴であり、diverse double-compiling のような古典的対抗策はコンパイラ対象のままだ。留保も記録:これは特定の実 nixpkgs リビジョンに対する研究者構築のデモであって、発見された侵入ではない。アブストラクトには野外証拠の記載がなく、実検出事例の議論もない。
🔗 arXiv 2607.24888 · 🔗 Hacker News ディスカッション
23. 1990年代 CA の RSA-512 ルート鍵をデスクトップで素因数分解——CADO-NFS 32時間、鍵は旧ブラウザインストーラから抽出
- Velocity: ▮▮▮ trending
- Source: Hacker News · 158+ pts · 29 コメント · 約6時間前(~06:00 UTC+8) · mcpherrin.ca 投稿(9月7日)
- Tags:
rsa cryptography pki factorization archive
筆者は、1999年3月の Netscape 4.51 に同梱されていたカナダの消滅 CA「E-Certify」の 512bit ルート鍵2本("Gold Server"(SSL)と"Gold Client"(S/MIME))を、Ryzen 9 5950X 上で CADO-NFS をローカル実行して分解した(32時間と29時間)。ルート証明書は archive.org の IE/Netscape インストーラコレクションから取得し、Claude Code で閲覧可能なサイトに抽出した。おまけ:IE 3.02(1996年)の「Test VeriSign Commercial Software Publisher CA」コード署名ルートは、Steve Weis 氏が「GPU クラスタで約1時間」で分解。背景として、RSA-155(512bit)は1999年に破られ、RSA-260(862bit)はつい最近分解され、1024bit は「十分なリソースを持つ組織なら可能性の範囲内」だという。
Why it matters: これは現在使用中の何にも影響しない——Netscape は2002年にルートを削除し、証明書は 2003-10-16 に失効。チェーン再現には時計を巻き戻した Netscape 4.51 が必要で、筆者いわく「地球上の該当者は zero」。価値は手法にある:歴史的ルート鍵は歴史的インストーラの中に眠り、コンシューマ級ハードウェアと LLM 支援の抽出があれば RSA-512 は容易だ。筆者自身の留保も残すべきだ:「この LLM 出力が完全に信頼できるかは検証していない。かなりもっともらしいにすぎない」。
🔗 mcpherrin.ca: 90年代 CA の RSA 鍵を分解した · 🔗 Hacker News ディスカッション
24. Caltech Mathathon——研究レベル数学初のハッカソン、結果は数学者の前で弁護させる
- Velocity: ▮▮ rising
- Source: Hacker News · 245+ pts · 84 コメント · 約27時間前(9月7日 ~09:10 UTC+8)
- Tags:
ai-math research hackathon verification
Caltech が10月30日〜11月1日、40時間の「Mathathon」を開催する。研究レベル数学に特化した世界初のハッカソンと称し、約100チームがフロンティア AI モデルを与えられ、未解決予想や理論構築に挑む。その後「著名数学者の前で結果を弁護」し、参加者がモデルの出力を実際に理解しているかを評価する。200万ドル超の AI クレジット賞品。賞は2段階で、第2段階は「数学コミュニティが結果を検証する時間を持った後」でのみ授与される。動機節では近年の AI 駆動成果——エルデシュの平面単位距離予想の反証(80年未解決)と、非sofic群の初の陽な構成(27年未解決)——を引用している。
Why it matters: 検証優先の賞設計は、本フィードが記録し続けてきた「デモ=ベンチマーク」問題への直接の回答だ——人間の検証を経るまで結果はカウントされず、評価されるのは出力ではなく理解である。Anthropic によるフェルマーの最終定理の形式化、フェルマー後の資金論文に続く今週3つ目のデータポイントでもあり、AI 加速された数学がデモではなく制度を獲得しつつあることを示す。
🔗 Caltech Mathathon · 🔗 Hacker News ディスカッション
25. Jellyfin 12.0——バージョン番号が「10.」を捨て、レガシー /emby ルートを削除。完全バックアップなしではロールバック不能
- Velocity: ▮▮ rising
- Source: Hacker News · 149+ pts · 56 コメント · 約6時間前(~06:10 UTC+8) · RC 7 を経て9月8日に v12.0 リリース
- Tags:
jellyfin self-hosting media-server breaking-changes
Jellyfin 12.0 が9月8日にリリースされた。長年使われてきた「10.」プレフィックスが廃され、新バージョニング最初のリリースとなる。目玉:エピソードの複数バージョン対応、類似度・レコメンドとプラグ可能な検索プロバイダ、3桁エピソード番号、サーバ同梱の ListenBrainz、FFmpeg 8.1、そして Resume/Next-Up/カウント系クエリを高速化する新しいリレーショナル LinkedChildren テーブル。破壊的変更リストは長い:レガシー /emby/*・/mediabrowser/* ルート削除(旧サードパーティクライアントは動作不能)、レガシー認証をデフォルト無効化、ユーザー名を一意インデックス付き正規化カラムへ移行(大文字小文字のみの重複はアップグレード前に解消が必要)、グローバル字幕設定の削除。リリースノートは率直だ。「データディレクトリの完全バックアップを強く推奨」——DB 変更により完全リストアなしのロールバックは不可能——直接アップグレードは 10.10.7 または 10.11.x からのみ、移行前にサードパーティプラグインの削除が必須、アップグレード後は全ライブラリ再スキャンが必要。
Why it matters: 最大の完全オープンソース自ホストメディアサーバが、数年で最大の互換性断絶を迎えた。エコシステム内の全サードパーティクライアントとプラグインが監査対象になる。ロールバック不能を明言し、アップグレードパスを明示するリリースノートの規律は、破壊的マイグレーションの記録手本だ。
🔗 Jellyfin releases(v12.0) · 🔗 Hacker News ディスカッション
26. FreeIPA CVE-2026-76578(CVSS 9.8、Red Hat 採点)——未認証の LDAP クライアントが FreeIPA 管理者になれる
- Velocity: ▮▮ rising
- Source: NVD · 9月7日公表(ステータス「Received」) · CVSS 9.8 Primary(Red Hat CNA) · securityonline.info 9月7日
- Tags:
freeipa keycloak-alternative ldap kerberos identity
FreeIPA の自己管理 OTP トークン ACI は認証を要求せず、トークンエントリと共に追加できる属性も制限していない。未認証の LDAP クライアントは、ディレクトリサーバ側の関連する ACI 評価欠陥(別途トラック)とこれを連鎖させ、攻撃者制御の Kerberos プリンシパルを作成して administrators グループへ追加できる——認証情報も操作も不要の、アイデンティティサーバ完全掌握だ。影響範囲:RHEL 6〜10 の ipa パッケージのデフォルトインストール。クロスレルム Kerberos trust による AD 統合を利用する環境も含む。パッチ適用までの緩和策:LDAP ポート 389/636 を信頼ホストに限定し、匿名バインドを無効化(依存機能がないか確認の上)。securityonline.info は修正が FreeIPA 4.13.4 にあると報じるが、独立確認はできていない——プロジェクトの GitHub にはリリースが一つもない。注目すべきは、先行修正(CVE-2026-13097)が正規名衝突のみを塞ぎ、根底にある未認証書き込みアクセスは開いたままだったことだ。
Why it matters: デフォルト構成のアイデンティティ基盤における「未認証→ドメイン管理者」は最悪クラスのバグであり、アイデンティティサーバは下流すべての支点だ。本フィードの規則に従い採点者を記録:9.8 は Red Hat 自身の CNA スコアで、NVD のステータスは依然「Received」(未分析)。そして不完全修正のパターン(13097 → 76578)は、今朝の Tomcat 項目と同じ繰り返しだ。
🔗 NVD: CVE-2026-76578 · 🔗 securityonline.info 解説
27. Windows HTTP.sys CVE-2026-62735——Pwn2Own Berlin の権限昇格バグの PoC が公開に
- Velocity: ▮▮ rising
- Source: securityonline.info 9月8日 · CVSS 7.8(Microsoft CNA、NVD Analyzed) · 8月11日の Patch Tuesday で修正済み
- Tags:
windows http-sys lpe poc pwn2own
CVE-2026-62735——HTTP.sys(Windows カーネル HTTP ドライバ)のヒープベースバッファオーバーフローで、研究者 Siyeon Wi 氏が Pwn2Own Berlin 2026 で実演し、2026年8月の Patch Tuesday で修正済み——の完全な技術詳細と動作 PoC が今週公開された。根本原因は UlpCreateInternalResponseOld の整数オーバーフロー。ドライバはヘッダバイト合計でラップアラウンドを防護せず、過小な nonpaged pool バッファを確保する。PoC は特定の IOCTL 経由で約7万個のカスタムヘッダを含む HTTP レスポンスを送り、バッファを SYSTEM レベルのコード実行まで溢れさせる。影響範囲:Windows 10 1607 から Windows 11 26H1、Server 2012〜2025。回避策なし。確認された野外悪用はまだない(EPSS 0.5%)。
Why it matters: リスク窓は「パッチ〜PoC」の時間差だ——8月に修正済みだが、公開 PoC により未適用のフリートが標的リストに載る。露出はローカルかつ認証後(CVE 記述は「authorized attacker」)なので、真のリスク集団は共有ホスト・RDS サーバ・キオスク型環境であり、開放されたインターネットではない。深掘りの悪用解析はまだペイウォールの内側にあり、PoC の存在が示唆するほど公知の信頼性情報は多くない。
🔗 securityonline.info: CVE-2026-62735 · 🔗 NVD: CVE-2026-62735
28. pascalorg/editor——2.24万スターの WebGPU 3D 建築エディタ、AI ホスト向け MCP サーバを同梱
- Velocity: ▮▮ rising
- Source: GitHub Trending(日次 #13) · 22.4k stars · 本日 +168 · MIT
- Tags:
webgpu threejs mcp cad ai-agents
Pascal のエディタ(React Three Fiber + WebGPU、Next.js/React 19 モノレポ)は、建物を検証付きノード階層——Site → Building → Level → 壁/スラブ/天井/屋根/ゾーン/アイテム——でモデル化する。空間グリッドによる配置検証、three-bvh-csg によるドア・窓のブーリアン開口、シーンはフラットなノード辞書として IndexedDB に保存し、dirty-node 追跡がフレーム毎の再生成を駆動する。エージェント関連部分はファーストクラスだ:MCP サーバ(@pascal-app/mcp)と CLI(npx @pascal-app/cli editor)により AI ホストがシーンを作成・操作でき、機能はビルトインと同じ manifest を使うプラグインで拡張する。
Why it matters: MCP を公開する構造化・制約検証付きのドメインエディタは「エージェントは誤魔化せない建物を描く」パターンそのもの——archify の検証済み IR 図表の建築版だ。シーングラフがエージェントに安全に読み書きできるデータであるのは、空間検証がプロンプト内ではなくツール内に存在するからだ。留保:リリースタグなし(main に 1,421 コミット)、undo/redo は50ステップ上限、プロジェクトが新しすぎて MCP サーフェスはまだ動く。
🔗 pascalorg/editor · 🔗 GitHub Trending
29. Broadcom が VDDK ダウンロードを撤去——VMware を離れるために全員が使うライブラリが 404 に
- Velocity: ▮▮ rising
- Source: Hacker News · 132+ pts · 55 コメント · 約8.5時間前(~03:30 UTC+8) · virtualizationhowto.com(ShapeBlue が8月25日に記録)
- Tags:
vmware broadcom vddk migration lock-in
Broadcom は VMware Virtual Disk Development Kit の公開ダウンロードページを削除した——Azure Migrate、Red Hat MTV、Nutanix Move、Platform9 vJailbreak、そしてオープンソースの virtv2v/nbdkit がすべて VMware ディスクの読み取りに使うライブラリだ。Broadcom アカウントでログイン済みでも、VDDK 8 と 9 のバージョン別パスは一様に 404 を返す。公式声明も廃止通知もない。サポート窓口では VDDK は「使用もダウンロードも不可能になった」とされ、Technology Alliance Program への誘導がなされたと報じられる。Red Hat はプロプライエタリな同ソフトを再配布できないとし、Microsoft は Azure Migrate ガイダンスに警告を追加(エージェントベースへフォールバック)。Proxmox の内蔵 ESXi インポートは影響を受けない。
Why it matters: 今朝のトッテナム項目と収束する——顧客が契約を再価格付けするのと同時に、VMware 周辺の退出ツールがゲート化されつつあり、移行プロジェクトには「VDDK を合法的に入手できるか」という行が必要になった。誠実な留保:「意図的な退出障壁」という読みは原著者の解釈であり、Broadcom は公の場で何も語っておらず、機能する移行経路(Proxmox)は依然存在する。
🔗 virtualizationhowto: VMware からの離脱がさらに困難に · 🔗 Hacker News ディスカッション
30. Roundcube 1.6.19 / 1.7.4——webmail の12件修正、ゼロクリック stored XSS と CSS プロキシ SSRF バイパスを含む
- Velocity: ▮ steady
- Source: roundcube.net セキュリティ更新 · 9月6日リリース · 1.6 LTS と 1.7 の両ブランチ
- Tags:
roundcube webmail xss ssrf patch
Roundcube は9月6日、両ブランチ向けセキュリティ更新をリリースし、報告されていた12件の欠陥を修正した。ヘッドラインは添付ファイル URL への TNEF MIME タグ注入によるゼロクリック stored XSS——メール1通で十分に発火する。そのほか:16進 IPv6 マップド IPv4 アドレスによる CSS プロキシの SSRF バイパス、3件のメールヘッダ注入(subject の裸 CR、受信者表示名の C エスケープ \r、identity の組織フィールド)、2件の CSS 注入/スマグリング、2件のリモートコンテンツ遮断バイパス(FuncIRI CSS エスケープ、SVG SMIL アニメーション)、末尾ドット FQDN による is_local_url() バイパス、SQL アドレス帳でのコンタクトグループ所属へのクロスユーザーアクセス。リリース投稿に CVE 番号の記載はなく、悪用報告もない。
Why it matters: Roundcube は自ホスト・共用ホスティングメールの大部分を支える webmail 層であり、ゼロクリックとは攻撃にメール送信以外何も要らないという意味だ。両ブランチ同時リリースのため、全本番インストール——LTS であれ現行であれ——の移行が必要になる。報告者クレジット付き・CVE 無しの開示様式は、NVD ではなくアドバイザリで追跡せよという意味でもある。
🔗 roundcube.net: Security updates 1.6.19 and 1.7.4 · 🔗 roundcube/roundcubemail releases
31. rclone serve s3 --auth-proxy はフェイルオープン——SigV4 検証が空のシークレットを受け入れる(CVSS 9.8、アドバイザリに PoC 同梱)
- Velocity: ▮ steady
- Source: GitHub アドバイザリ GHSA-xwwr-4h3p-r22c · 9月4日公表 · ≤ 1.68.0 に影響、1.75.1 で修正
- Tags:
rclone s3 authentication cwe-306 advisory
rclone serve s3 を --auth-proxy 付き・--auth-key なしで実行すると認証がフェイルオープンする:authPairMiddleware はクライアント指定の Authorization ヘッダから access key ID を取り、デフォルトで空文字列の ws.s3Secret と対で登録する——空文字列は正当な HMAC 鍵として機能する。誰でも自分で捏造した access key ID に対し SigV4 署名を手計算で作り、検証を通過できる。アドバイザリには動作する PoC が含まれる(「事前の認証情報 zero で、完全に認証された成功のバケット一覧取得」)。auth-proxy スクリプトも攻撃者と利用者を区別できない——key ID がユーザー名とパスワードの両方として届くためだ。CVSS 3.1 9.8(CWE-287/CWE-306)。公表時点で CVE 未採番。最小修正はこの構成での起動拒否で、アドバイザリは残存する設計上の限界も明示する:共有静的 auth key のままでは、per-identity シークレットにはプロトコル変更が必要。
Why it matters: rclone はバックアップ・データパイプラインの隅々にあり、これは教科書的なフェイルオープンのデフォルトだ——未修正のまま serve s3 --auth-proxy を動かしていれば、バックエンドは事実上全世界に読み可能だった。評価されるべき点:アドバイザリは PoC、影響/修正マトリクス、残存限界を同梱しており、まさに開示のあるべき姿だ。
🔗 GHSA-xwwr-4h3p-r22c · 🔗 rclone/rclone
32. Ladybird の8月レポート——新スタイルエンジンが「エンジン性能への本気の取り組み」を牽引
- Velocity: ▮ steady
- Source: Hacker News · 192+ pts · 46 コメント · 約2日前 · ladybird.org 月次レポート(8月31日)
- Tags:
ladybird browser web-engine performance
Ladybird の月次アップデートは、CSS scroll snap、JavaScript デバッグ、セッション復元に加え、プロジェクトが「新しいスタイルエンジンによるエンジン性能への本気の取り組み」と呼ぶものをハイライトする。投稿は動画版(Twitch/YouTube)でも公開済み。プロジェクトの掲げる目標——2026年の Linux・macOS 向け初の Alpha リリース——は変わっていない。
Why it matters: Chromium/WebKit/Gecko の三極の外に立つ唯一のブラウザエンジンが、初のアルファへ着実に前進し続けており、性能面の work(機能の追い付けだけでなく)こそがアルファを日常ユーザーに信頼可能にするものだ。留保:これはプロジェクト自身の自己報告進捗であり、月次形式が与えるのは機能のヘッドラインとデモであって独立ベンチマークではない。「本気の取り組み」は、アルファ到来時に再検証すべき主張として扱うべきだ。
🔗 ladybird.org: This Month in Ladybird · 🔗 Hacker News ディスカッション
33. 「Verify Before You Distill」——プロンプト単位で実測の教師信頼性を蒸留のゲートにする
- Velocity: ▮ steady
- Source: Hugging Face Daily Papers(9月8日掲載、4 票) · arXiv 2609.02998(9月2日)
- Tags:
distillation on-policy rlvr training arxiv
TGOPD(Teacher-Gated On-Policy Distillation)は OPD の実在する失敗モードを狙う:逆 KL は mode-seeking なので、自信過剰に間違った教師は強いが誤解を招く token レベル勾配を生み、エントロピのような分布シグナルは正確さではなく不確実性を測る。解法はプロンプト毎のゲートだ:小さな教師プローブ群を検証器で採点し、各プロンプトを dense OPD 監督(合格)か verifier-grounded GRPO(不合格)へルーティングする。主張:4B・35B の両スケールの全6単一ドメイン設定で vanilla OPD に勝利、マルチドメイン訓練で7ベンチマーク平均が上回り、非同期 OPD では教師ノード GPU 利用率が実測 4B 実行で 9.8% から 78.9% へ上昇。
Why it matters: 先週の「Does On-Policy Distillation Really Distill?」の知見(教師ノイズは教師スケールと共に増大する)を実際のメカニズムへ落とし込んだものだ——レバーはスケールではなく検証だ。留保は2つ添えたまま:アブストラクトページには限界セクションが現れない(採用前に17ページの全文を確認)、そして4票という投票数は結果に対して関心が遅れていることの表れ——これは合意ではなく初期シグナルだ。
🔗 arXiv 2609.02998 · 🔗 Hugging Face 論文ページ
34. WeWorm——Calif が発表した、WeChat 通話で感染が広がる初のゼロクリックワーム。AI が数日で構築
- Velocity: ▮▮▮ trending
- Source: Calif 研究 · 9月8日公開 · ニューヨーク・タイムズ 9月8日報道 · Tencent は緩和済み
- Tags:
weworm zero-click worm wechat ai-offense
Calif が9月8日に公開した研究(NYT も同日報道):WeChat の VoIP スタックにおけるメモリ破壊バグにより、着信中(応答もタップも不要)に着信電話だけで端末が侵害される——iOS と Android の双方で(デモは Pixel 10a → iPhone 17e → もう一台の Pixel 10a という連鎖、「攻撃者が被害者に電話し、被害者が次の攻撃者になる」)。侵害されると WeChat アカウントの完全制御を取得。唯一の前提条件は被害者の友達リストにいることで、Calif はこれを弱い障壁と評価する(まず友人のアカウントを侵害し、その信頼された連絡先から電話する)。AI の役割が2つ目の見出し:チームによれば AI がバグを発見し、最初の RCE エクスプロイトは約2日、ワームはさらに1週間——従来は数か月かかる能力。責任ある開示は機能した:7月24日に報告、Tencent は Android 8.0.77 / iOS 8.0.76 で緩和(8月21日)、8月28日までに全ユーザーへサーバー側緩和を適用、9月4日に RCE を確認。実攻撃の報告はなし。技術詳細は学会発表待ちで非公開。
Why it matters: 電話の着信だけで広がる、初めて実証されたゼロクリック・クロスプラットフォーム・ワームであり、AI が攻撃開発をどこまで圧縮するかの実測でもある。携行すべき注意点:実攻撃はなし、Tencent の緩和は済んでおり、技術詳細が非公開のため主張はまだ独立検証できない。
🔗 Calif 研究: WeWorm · 🔗 ニューヨーク・タイムズ報道
35. "We have a year to fix security everywhere"——安価なオープンウェイトモデルが始めた、Rust 開発者のカウントダウン
- Velocity: ▮▮▮ trending
- Source: Hacker News · 261+ pts · 250 コメント · jyn.dev(9月4日)
- Tags:
ai-security open-weights policy offense-defense remediation
jyn(Rust コンパイラコントリビュータ、jyn514)は、GLM-5.3-flash の8月末リリースが約1年のカウントダウンを開始したと論じる。オープンウェイトのフロンティア接近モデルに、サードパーティの「abliterated」(拒否を剥いだ)派生(Harmbench-320 で 0%)が重なり、約 $6k〜9,500 のハードで有能なハッカーを24時間稼働できる。Apple M5 Mac Studio(256 GB、約 $9,500、9月22日出荷)がローカル運用を容易にする。根拠:GLM-5.3 は CyberGym 84.5%、ExploitBench 54.4%(GPT-6 Astra の ExploitBench 100% と比較)、セキュリティ専門家は LLM なしでは CTF で競争力を維持できない、そして OpenAI–Hugging Face エージェント群事件を実際のインフラへの自律的エクスプロイトとして引用。処方箋:政府による頻繁なペネトレーションテスト義務化(DORA の TLPT、銀行規制、NERC-CIP の拡張)、フロンティアモデルを自社コードに向けること、最小権限の資格情報でエージェントをサンドボックス化、メモリ安全言語、トリアージ/バックポート自動化。明確に否定:ウェイトの禁止、フロンティアモデル全般の禁止、GPU 輸出管理。
Why it matters: 「今すぐすべてを修正せよ」という期限について今週最も読まれた論考——HN の250コメントがその議論の証拠。著者自身の注意点も明記されている:スループットの主張は未検証、abliterated モデルは未訓練タスクで性能が落ちる可能性、完全自律のエクスプロイトには依然として人間の助けが必要な可能性、Z.ai と OpenAI でベンチマーク数値が食い違う——すべて「一時的」としている。
🔗 jyn.dev: We have a year to fix security everywhere · 🔗 Hacker News 議論
36. Dan Luu が26種の検証技術を各約80実行で測定——「指示なし」に勝つものはなかった
- Velocity: ▮▮▮ trending
- Source: Hacker News · 106+ pts · 38 コメント · danluu.com(9月8日)
- Tags:
agent-eval verification tdd formal-methods harness
Dan Luu の新記事は、彼の zstd 実装評価を26のプロンプト条件(TDD、Lean 4、QuickCheck、Verus、Kani、TLA+、ファジング、差分テスト、「Make no mistakes」等)と4つのスキルで実行、条件ごと・努力レベルごとに約80実行、モデルは GPT-5.6 Sol。結果は「表向きの技法模倣」のタクソノミーになった:Default(指示なし)が平均を上回るスコア。TDD 実行の 67/160 が本実装前に失敗テストを書いた(Default は 0/160)。QuickCheck エージェントは 63/160 の実行で1つの性質しか検査しなかった。差分テストは 135/160 の実行で同じバグ含みのロジックを二重に複製。TLA+ エージェントは 159/160 の実行でモデルを構築したが、Rust コードをほとんど変更しなかった。Kani の真の有効利用はちょうど1回。明るい点:ファジングで構造化ランダム入力を生成したのは 10/160 のみ——だがその半数が実際のバグを発見。Hegel スキルはコストを 26〜41% 増やして正答率は不変。ECC スキルの良スコアは、それを読み飛ばした7実行が担っていた。
Why it matters: 「エージェント能力 = モデル × ハーネス」の指示層が初めて測定され、答えは「技法の使用を指示しても大半は呪文的な作業を誘発する」。著者の注意点を携行すること:悪い順〜良い順のランキングを読むなと本人が警告、目立つ2結果はセットアッププロンプトの誤りと判明(修正後は null 結果)、RFC ベースのタスクは実際の仕様より明確——現実の失敗は同程度かそれ以上に悪いはず。
🔗 danluu.com: How well do agents use test/verification techniques? · 🔗 Hacker News 議論
37. "Google Jail"——独立系 wiki が語る、新ドメインが数か月インデックスされない現象
- Velocity: ▮▮ rising
- Source: Hacker News · 226+ pts · 78 コメント · Weird Gloop ブログ(8月17日、再浮上)
- Tags:
google-search seo wikis web-publishing discovery
Weird Gloop(runescape.wiki 背後の非営利団体)の記事は「Google Jail」と名付けた現象を報告する:2024年3月の変更以降、新しいドメインはホームページしかインデックスされず、他の全ページは——Fandom より上位にランク付けされていても——数か月から1年間不可視になる。それ以降に新規ドメインで立ち上がった wiki の約90%が該当し、この分野のトラフィックの約85%は Google 由来。証拠:Hollow Knight wiki の9か月に及ぶトラフィック低下、hytalewiki.org がドメイン唯一のインデックス済みページとして上位クエリで1位にランクインした実例、そして逆例——確立されたドメインのサブドメインとして始めた wiki(wiki.leagueoflegends.com、overwatch.weirdgloop.org)は1週間で完全インデックスされた。Weird Gloop の回避策:Overwatch と Fortnite の wiki をまず自社サブドメインで始め、後から 301 で独立ドメインへ移行する。
Why it matters: Fandom から独立系 wiki への移住の波が、誰も織り込んでいなかった構造的逆風に当たった——Google が判断を変えるまで新ドメインは二等市民であり、これはあらゆる新サイトの始め方を変える。注意点:これは一運営者の観測データであり、メカニズムは推論であって Google の確認ではない。記事自身が他の wiki 運営者にデータを募っている。
🔗 Weird Gloop: There's a new "Google Jail" for independent wikis · 🔗 Hacker News 議論
38. Uno——自己回帰 LLM に離散拡散を接ぎ、ドラフトモデル不要の損失なし 3× 高速化を主張
- Velocity: ▮▮ rising
- Source: Hugging Face Daily Papers · 44 アップボート(1位) · arXiv 2609.04010
- Tags:
diffusion decoding inference speculative-decoding arxiv
本日の HF トップ論文が提案する「拡散オーグメント LLM」:自己回帰分布とその重みを保持したまま、標準学習パイプラインへの追加オーバーヘッドが無視できるとされる蒸留フェーズで訓練された軽量な拡散重みを追加し、Ψ-Spec と呼ぶサンプラー族で複数トークンを並列サンプリング。主張:ベース AR モデル比で最大 3× の高速化、「デバイスが対応する最大バッチサイズでも成立」、評価した全バッチサイズで主要スペキュラティブデコーディングより高スループット、独立ドラフトモデル不要、品質劣化なし——8B の「Uno」が、26B のオープン拡散 LLM DiffusionGemma や専有モデル Mercury 2 を、エージェント的ツール利用・コーディング・長コンテキスト推論で上回ると報告。コードとチェックポイントは s-sahoo.github.io/uno。
Why it matters: スペキュラティブデコーディング(ドラフトモデルのコスト)と純拡散 LLM(品質劣化)の間の第三の道——そして昨日の Iris と違い、成果物が実在する。注意点:数値はすべて著者自身の評価、アブストラクトに明示的な limitations セクションなし(見えるのは固定コンテキスト長評価)、論文レベルの注目(1位、44 アップボート)が独立再現より先を走っている。
🔗 arXiv 2609.04010 · 🔗 Hugging Face 論文ページ
39. CDN が検出された欧州企業の 89.6% が Cloudflare の後ろに——44,143 社の測定
- Velocity: ▮▮ rising
- Source: Hacker News · 181+ pts · 158 コメント · ciphercue.com(9月8日)
- Tags:
cloudflare cdn concentration-risk europe web-infrastructure
CipherCue による、CDN が検出された 44,143 の欧州企業の測定(HTTP フィンガープリント + DNS、社ごとに9月7日時点の最新観測):39,547 社——89.6%——が Cloudflare の後ろにいる(W3Techs 参照値:7月28日時点で 84.1%)。国別シェアは 95.6%(オランダ)から 78.8%(スペイン、アイルランド)。次点は Amazon(3,112 検出)、Fastly(1,299——「最も明確な純 CDN」と呼称)、Akamai(396)。記事自身の注意点は詳細:CDN ユーザーのみを数えており(オリジン直結サイトは除外)、ベンダー間で二重計上がありうる、コホートは Cloudflare の無料枠が強い中小企業に偏る、そして CDN は「玄関」にすぎず——GDPR/データレジデンシーにはオリジンホスティングが重要。リスクを Cloudflare の3つの障害(2025年11月18日、12月5日、2026年2月20日——いずれも攻撃によらない)に結びつけている。
Why it matters: 欧州のウェブの玄関が1ベンダーに集中していることが、分母つきで定量化された——本フィードが障害のたびに追ってきた集中度の議論に、数がついた。注意点を携行すること:測っているのは「CDN ユーザーが誰を選んだか」であり、Web 全体に占める Cloudflare のシェアではない。著者は CDN 隣接ビジネスを営んでいる。
🔗 ciphercue.com: European CDN concentration · 🔗 Hacker News 議論
40. Emacs Bedrock 2.0——サードパーティパッケージゼロのスターターキットが Emacs 31 で再構築
- Velocity: ▮ steady
- Source: Hacker News · 133+ pts · 29 コメント · lambdaland.org(9月7日)
- Tags:
emacs text-editors starter-kit developer-tools
Ashton Wiersdorf が Bedrock 2.0 をリリース(9月7日)。「より良いデフォルト」を掲げる最小構成の Emacs スターターキットで、実体は early-init.el と init.el の1組ずつ——~/.emacs.d/ にコピーして学びながら編集する想定で、ベース設定にサードパーティパッケージを含まない。2.0 は Emacs 31(2026年8月リリース)を要求し、内建機能に寄せる:lexical-binding 全設定、use-package の自動インストール、which-key の代わりに embark-auto-prefix-help-mode、wgrep の代わりに内建 grep-change-to-grep-edit-mode、さらに tree-sitter と isearch の改善。Emacs 29 との互換性を破る(それがメジャーバンプの理由)し、自動アップグレードパスはない——自分のコピーと main を diff せよ——で、著者自身「非常に漸進的な改善」だと述べている。
Why it matters: ストーリーはパターンの方:コア Emacs がプラグインエコシステム(which-key、wgrep、補完挙動)を吸収し、依存ゼロの設定が再び実用的になった——エディタ世界の他の隅で起きているのと同じ統合。テレメトリなしも著者の強調点:「yay privacy!」
🔗 lambdaland.org: Emacs Bedrock 2.0 · 🔗 Hacker News 議論
41. Show HN:Stuxnet の「再構築ソースコード」——研究のために再ホストされたサイバー兵器
- Velocity: ▮ steady
- Source: Hacker News(Show HN) · 157+ pts · 46 コメント · 9月8日
- Tags:
stuxnet malware-history reverse-engineering cyber-weapon
Show HN に Sadpainy/Stuxnet が登場——「悪名高いサイバー兵器の再構築ソースコード」を掲げ、「Only researchs educations purposes」の免責付きのリポジトリ。投稿は数時間で157ポイントに達した。Stuxnet——2007〜2010年頃、PLC コードの改ざんを通じてイランの IR-1 遠心分離機を物理的に破壊した米イスラエルの作戦——のオリジナルソースは公開されたことがない。このリポジトリの出所と手法(逆コンパイルか、バイナリからの再導出か)はページに記載されていない。
Why it matters: 歴史上最も影響の大きいサイバー兵器から10年以上、その内部が原作戦と無関係な人々によって公に再組み立てられている——攻撃能力の商品化を示す指標であると同時に、PLC/ICS セキュリティを教える人にとっての研究教材。注意点はこの項目そのもの:真正性は未検証であり、コードは教育目的の再構築として扱うべきで事実の基準ではない——そして歴史的兵器のソースコードには相応の取り扱い責任が伴う。
🔗 Sadpainy/Stuxnet · 🔗 Hacker News 議論
42. Cloudflare Workers のサイズ上限が非圧縮 64 MiB に——無料プランも対象
- Velocity: ▮ steady
- Source: Cloudflare Changelog(9月4日) · 9月8日に Hacker News で再浮上
- Tags:
cloudflare workers serverless deploy
Cloudflare の9月4日 changelog:Workers は非圧縮で最大 64 MiB までデプロイ可能に。無料・有料の両プランで、旧上限(無料 3 MB、有料圧縮 10 MB)を置き換える——プランにより 5〜20 倍以上の引き上げ。移行は不要で既存スクリプトへの影響はなく、プラットフォーム制限ドキュメントはすでに新しい上限を反映済み。
Why it matters: ヘビーなランタイム、バンドルされた ML 前処理、大型エージェントツールを Workers から遠ざけてきた実質上限が一桁動いた——ブラウザ級・エージェント級のコードをエッジにパッケージする人、そして「Workers が本物のコンピュートターゲットになる」トレンドに関係する。同じ週の欧州集中度議論(項目39)の中で届いた:CDN 利用欧州企業の約9割がいるプラットフォームを、この1社が緩和している。
🔗 Cloudflare Changelog: increased Worker size limit · 🔗 Workers プラットフォーム制限
43. "ZcopyReaper"——Linux net/rds ゼロコピー脆弱性 CVE-2026-43502 の PoC が公開
- Velocity: ▮ steady
- Source: securityonline.info(9月8日) · NVD(5月21日公開) · 公開時点の報道では CVSS 未記載
- Tags:
linux-kernel lpe poc rdma patch-gap
CVE-2026-43502 の PoC が9月8日に公開された。カーネルの Reliable Datagram Sockets(net/rds)サブシステムの欠陥:ゼロコピー送信が、ユーザーページのピン留め後かつメッセージの送信ソケットへの接続前に失敗しうるため、クリーンアップ経路がピン留め済みページを巡って不整合に陥る——ローカル権限昇格へ悪用可能。アップストリームの修正は、ゼロコピーのクリーンアップをメッセージのキューイング前に移動した。このバグ種別には仲間がある:「PinTheft」(CVE-2026-43494)は同じ RDS ゼロコピー領域のダブルフリーで、ページキャッシュ上書き/LPE に転用されたもの。パッチできない場合の緩和:RDS/RDMA を使わないホストでは rds モジュールをブラックリストへ。
Why it matters: パッチ-PoC ギャップが再びリスク期間となる——5月に開示されたカーネルバグが9月に動くエクスプロイトになり、しかも自分が使っているかどうか大半の運用者が答えられないサブシステムで。スコアラー衛生:公開時点の報道はこの CVE の CVSS を引用していなかった。優先順位を決める前に、まずディストロのトラッカーを確認せよ。
🔗 securityonline.info: Public PoC for ZcopyReaper · 🔗 NVD: CVE-2026-43502
44. escrcpy——scrcpy の GUI が本日最も伸びた開発者ツールに(+791)
- Velocity: ▮ steady
- Source: GitHub Trending · 11.2k スター · 本日 +791 · v3.2.0 は9月1日リリース
- Tags:
android scrcpy device-control desktop-apps
viarotel-org/escrcpy——Genymobile 製 scrcpy を包む Electron GUI で、デスクトップから Android 端末を表示・操作——が本日の GitHub trending で開発者ツール中最大の伸び。v3.2.0 は9月1日リリース(上流 scrcpy 3.x の機能を反映:オーディオ転送、カメラキャプチャ、OTG モード)。トレンド急上昇は1週間後に到来し、新しいリリースも HN のトリガーもない——ローンチイベントではなく有機的 momentum だ。
Why it matters: デバイス制御サーフェスは静かにエージェントインフラになりつつある——computer-use エージェントを動かす「エージェントにスマホを渡す」パターンには、テストとオブザーバビリティのためのミラー端末パネルが必要で、escrcpy はそこで最も抵抗の少ない道。トリガーの正直なフレーミング:リリースは1週間前で、急上昇の直接原因は特定できていない。リポジトリは活発(9月1日に push)、下地の scrcpy エンジンがスタックの最も信頼できる部分。
🔗 viarotel-org/escrcpy · 🔗 escrcpy releases (v3.2.0)
45. 10組のモデル/ハーネス、同一の Three.js プロンプト——入力トークンは9倍差
- Velocity: ▮ steady
- Source: Hacker News · 94+ pts · 53 コメント · alvins82.github.io(9月8日)
- Tags:
agent-harness benchmark cost field-test
フィールドテストが同一の固定プロンプト(「単ページの Three.js SFハンガー」——ドローン、フォグ、カメラパスつき、自己完結 HTML ファイル1枚で)を10組のモデル/ハーネスに通した:GLM 5.3 Flash、Luna 5.6 Max、SOL 5.6 Max、Astra 6.0 Max を Codex で。GLM と Qwen 3.8 27B を OMP と OpenCode で。Qwen をさらに2種の DSH モードで。広がり:最速 8分48秒(Qwen/OpenCode)から最遅 41分26秒(Qwen/OMP)。入力トークンは 457k(GLM/Codex)から 4.3M(GLM/OpenCode)まで——同一モデル・同一タスクで約9倍。ツールエラーは 0〜5。10実行のうちスクリーンショットで品質確認されたのは6実行のみで、1実行はそもそもブラウザを開くのを拒否された。
Why it matters: FrontierHarness の発見(17× のコスト差、9月3日)の、2026世代による2例目の確認:コストと速度を支配するのはモデルではなくハーネス——同一モデルで9倍のトークン差。方法論的注意点は上に書いた通りで、それ自体が重要:タスク数 n=1、実行ごとに品質検証が一貫しない——これはベンチマークではなくフィールドノートだ。
🔗 alvins82.github.io: hangar harness/model tests · 🔗 Hacker News 議論
Metadata
| Field | Value |
|---|
| Generated | 2026-09-08T20:05:00+08:00 |
| Items | 45 |
| Sources tracked | 33 (Rapid7, Senserva KEV tracker, Internet Archive blog, Hacker News, GitHub Trending, Tailscale blog, securityonline.info, The Hacker News, Hugging Face Daily Papers, arXiv, vLLM blog, OpenAI Help Center, TantoSec, HeroDevs, CodePen docs, Ars Technica, Google DeepMind blog, mcpherrin.ca, mathathonchallenge.com, NVD, jellyfin.org/GitHub releases, virtualizationhowto.com, roundcube.net, ladybird.org, Calif research, New York Times, jyn.dev, danluu.com, Weird Gloop blog, ciphercue.com, Cloudflare Changelog/docs, lambdaland.org, alvins82.github.io) |
| Update schedule | 04:03, 12:03, 20:03 UTC+8 (3x daily) |
| Ranking | Velocity-weighted (recency × engagement acceleration × source authority) |
| License | CC-BY 4.0 |
Previous day · Raw .md · Archive