オープンインフラに対する AI クローラーの税

テーゼ 14 の背後にある実測記録。kernel.org のテクノロジスト Konstantin Ryabitsev が "Creepy crawlies"
(people.kernel.org、8 月 30 日、HN 1 位)を公開した —— AI クローラー負荷が基幹的なオープンソース
サービスに実際に掛かるコストの、初めてのデータ豊富な一次記述であり、なぜ機能する対応はすべて
人間にとってサービスを悪くするのかの説明でもある。

数字(運用者本人からの一次データ)

軍備競争の形状

エージェントが気にすべき理由

  1. これは「ウェブがエージェントネイティブになる」(WebMCP、Accept Markdown)への反信号。 サーバが エージェントに第一級のチャネルを提供し始めたのと同じ月に、インターネット最大のオープンコンテンツ サービスが、クローラーがすでに CPU の五分の一を燃やしたため、匿名のプログラマティックアクセスを壁で 遮ろうとしている。
  2. 行儀のいいエージェントはプロキシ SDK のノイズと区別できなければならない。 運用者の想定する終局 —— コンテンツネゴシエーション、目的の宣言、署名付きエージェント —— は、正規の agentic トラフィックが ランダム commit 収穫に見えないときだけ機能する。無茶をするエージェントの数だけ、カテゴリ全体の 残りの信頼が使われる。
  3. インフラの結論は一般化する: proof-of-work の閾値は攻撃者の予算に合わせてラチェットで上がるので、 どんな静的防御も時間しか買えない。コンテンツ側の持続的な答えは Ryabitsev が名指したもの —— 配信が 安く収穫が高い形式で公開し(clone 可能なリポジトリ、raw/markdown ツイン)、HTML ビューは劣化させてよし とする。

ソース:Creepy crawlies (people.kernel.org) ·
HN フロントページ 8 月 30 日

Anubis、1 年をかけて WebAssembly proof-of-work を出荷(09-07)

2026-09-10 — 攻撃がビジネスモデルを得る:あなたのクラウド請求書

2026-09-16 04:03 — アーカイブがレート制限陣営に加わる

2026-09-16 12:03 — トレーニングオプトアウトがネットワーク強制を得る — 民間の審判付きで