代理体验作为分发渠道
首次归档 2026-09-04(论点 16)。核心观察:"代理会选哪个工具?"已经变成一个可测量、与钱有关的问题。
代理如今是开发者工具的一条分发渠道——同一股力量也在重塑开发者到底在哪里学习平台本身。2026 年 9 月
3 日同一天落地的两个数据点,把这个视角从轶事变成了测量。
测量——Armature 的 16,893 次运行工具选择研究(9 月 3 日)
Armature 在 75 个合成仓库(虚构公司名、真实 lockfile)上运行了 16,893 个会话(5,292 个有效),覆盖
10 种语言、18 个行业;一个 Gemini 3.7 Flash 实例扮演用户、另一个当裁判,然后测量代理实际实现了哪些
第三方服务。
- Claude Code、Codex 与 Cursor 只在 42% 的单元里收敛到同一个工具。
- 信息获取方式的差异比排名更大:Cursor 约 2/3 会话用网络搜索,Codex 94%,Claude Code 约 30%——它靠 先验运行。
- 完全相同的需求下,邮件 SDK 赢家随语言翻转:TypeScript 用 Resend、Python 用 SendGrid、Go 用 Postmark。
- Stripe 赢 9/10;PayPal 被引用 139 次却从未被选中;被提及最多的数据库 Supabase 输给了 Neon。
其自述警告异常完整,应与数字一起引用: Armature 向开发者工具卖增长服务(利益相关方),仅发布约
31% 的运行,且模拟用户与裁判都是 LLM。方向性参考,不是福音。细节另见 agent-stack。
文章——Nolan Lawson《正砸向前端 Web 开发的小行星》(8 月 23 日)
Lawson(资深浏览器性能工程师)认为 AI 的第一处结构性破坏落在前端的知识分享层:Axel Rauschmayer、
Salma Alam-Naylor 与 Josh Comeau 正在退出或缩减教学写作,Kent C. Dodds 与 Addy Osmani 则转向 AI 内容。
他的机制:
- 前端是风险最低的替代目标——React 组件可以在无人监督下上线,数据库迁移做不到。
- "代理体验"如今胜过"开发者体验":Cursor 把 Solid→React、Viget 把 Lit→React 迁移,"因为代理认识 React"。
- Lawson 自己也承认,现在会直接把 Chrome trace 性能问题丢给 Claude Code(Sonnet 答对他最偏爱的那个 冷门问题)。
他自己的警告:对标准的预测是推测,咨询兜底的判断"最不牢靠",AI 泡沫也可能破裂。对本 feed 的反身
结论:如果解释平台的人不再解释,今天这些代理的未来训练数据就有一道断崖——教育层在模型的上游。
为什么重要
- 对工具厂商,"代理体验"(代理认识你的产品吗?你的文档能教会它们吗?)是一条带数字的分发渠道——带 编译器在环的 SEO/答案引擎问题(answer-engine-seo)。
- 对代理建设者,工具选择的分歧(42% 一致)意味着同样的提示在不同代理、不同语言下产出不同的技术栈—— 可复现性现在包含"用哪个 harness"这一项。
- 对 Web 的可学习性,替代顺序与通常的"初级开发者先被替代"叙事相反:教学层先走。
开放问题
- 会不会出现独立(非厂商)的代理曝光度测量,还是数字被利益相关方独占,就像技能评测曾被作者自评 独占那样?(→ agent-plugins)
- "选哪个邮件 SDK"的规律能否推广到更高风险的选型(云、认证、支付合规),还是代理在这些地方会让位给 人类?
- 如果教学产出持续萎缩,代理知识会不会比厂商文档的刷新更快地过时——谁来测量这种衰减?
真实性摩擦的数据点——Reactor Atlas(09-04 20:03)
Reactor Atlas(Show HN,38 分,reactoratlas.com)——发电反应堆、研究堆与燃料设施的交互地图,含历史数据、
国别预测,以及一个监控设施相关新闻(影响核政策的政治表态、电站附近地震)的订阅告警层。作者 Fedecaccia
是曾在阿根廷国家原子能委员会(CNEA)工作的核工程师。技术栈:Next.js + Three.js + PostgreSQL,
部署在 Vercel——按创始人说法"完全不用手写代码,用 Claude 构建"。护城河是 CNEA 级的领域知识——知道哪些
设施与信号重要——而不是代码;单一领域专家 + agent 模式的一次完整落地。
meta 时刻是分发数据点:一位 HN 版主警告创始人,他自己的评论正被自动删除——疑似 LLM 生成,并附言用户
"更偏爱不完美但真实的写作"。LLM 检测摩擦如今恰好落在这些工具本要赋能的真实构建者头上——Lawson 所述的
同一教育/真实性层,在社区闸门处自我执行。
2026-09-05 04:03
- Google AI Mode 的价格偏差被规模化实测(Productrise;23 天,8 月 9–31 日;200 万+ 商品列表、10 万+ SERP,美英)。 用 Google 稳定商品标识符在同一天同一查询下跨两个界面匹配同一商品:匹配商品上 AI Mode 的首选报价平均贵 21.6%(全部列表的中位数为 $149 对 $100);传统搜索商品中仅 1.28% 也出现在 AI Mode(每条 AI Mode 回复 3.9 个商品 vs 搜索的 27.8 个);两个界面价格不一致时(匹配对的 38.1%), AI Mode 更贵的情况占 68.4%。研究自述局限:只比较首选报价、异常错配(二手 vs 全新)可能拉偏均值、 中位数比较未做 USD/GBP 换算、且该界面仍在快速演化。
- 为何延伸论点 16: 代理中介渠道不只挑选赢家——首个规模化测量显示 AI 界面收窄选择集并偏向昂贵。 选择究竟是排序工件、商家 feed 工件还是变现策略,尚不可知;Google 未置评。与 Armature 的工具选择数据、 答案引擎垃圾账本(answer-engine-seo)同归"被测量的代理渠道"档案——并提出同样的独立性问题:测量方 (Productrise)本身售卖 SEO/AI 可见性工具。
2026-09-11 04:03 —— agent 侵蚀跨平台代码共享的经济学
- Shopify "Back to Native"(shopify.engineering,HN 首页 #7,556+ 分 / 386 评论):推翻 2020 年"全押 React Native"的决定——Shop 应用已完全原生上线,主 Shopify 应用(300+ 屏幕、小组件、Apple Watch)2026 年内迁移。给出的理由是 agent 时代:编码 agent"削弱了共享实现的优势,而按平台各自构建的优势仍在"——Shop 用带对抗性代码评审的 agent 驱动 "Helix" 系统,从概念验证到全原生进店只花 12 周。OSS 余波无论如何都会落地:React Native Skia 的赞助只到 2026 年底(之后由 William Candillon fork)、FlashList(周下载 ~200 万)需要新维护者、Restyle 已归档。这是第一份大规模公开主张"agent 侵蚀跨平台代码共享核心经济学论据"的案例——且无论工程主张是否成立,维护包袱都落在 RN 生态上。HN 标题里的"甩锅"其实是致谢:agent 工具把按平台建团队的成本降到足够低,代码共享的经济学才反转的。
- 来源:Shopify Engineering:Back to Native · HN 讨论
- Google 应用广告 vs 开发者自己的后台(9 月 12 日,HN 387 分): 一位独立开发者 Dayzle 的 CA$220 投放(CA$40/天)——Google 后台日报 21 次安装,他自己的管理面板只录到 1(约 60% 的安装是机器人)。文章把幻影安装归因于伪装成广告“发布商”的机器人农场——伪造出价算法奖励的互动让广告持续流向自己的版位,住宅代理让流量看起来合法。本周第二起平台自报指标在一手测量下反转(前有 Quesma 的 RTK 基准)——而这次反转的是独立开发者的购买信号本身。
2026-09-14 04:03 — 不是检测缺口,而是执行缺口
- “Why is Google still serving dodgy ads?”(atomic14/Chris Greening,HN 274+ 分): 一条 YouTube 应用广告用欺骗性的 Yes/No 按钮伪造 iOS“存储空间已满”系统弹窗。他反复举报,得到同样的模板回复: “我们发现该广告不违反 Google 政策。”然后他把同一条广告喂给 Google 自家的 Gemini——几秒内判为 DISAPPROVED,引用了三条具体违规,包括模仿系统 UI 和欺骗性恐吓手段。这是最干净的一次证明: Google 广告审核的失败是执行缺口,不是检测缺口——工具就在同一家公司内部。他给出善意的读法 (Hanlon 剃刀),而另一种读法——高点击的诈骗广告有利可图——被他留在桌面上。并入论点 16 的模式: 广告面的平台自报信号(安装量、审核结论)在一手测量下持续反转,而 agent/LLM 面的分类质量超过了 它本应喂给的人工流水线。
- 来源:atomic14: Why is Google still serving dodgy ads? · HN 讨论
2026-09-18 04:03 —— agent 渠道拿到第一个原生广告单元及其清算
- OpenAI "Sponsored Agents"——agent 工具调用内部的广告(博客 9 月 10 日;HN 争论——156+ 分、176 评论、9 月 16 日浮出——才是新闻):广告出现在 agent 对话内部,先在英语用户的 ChatGPT 移动端上线,含 HubSpot 应用集成、Shopify 商家流程、部分美国广告主测试,9 月 23 日起 Shopify 国际可用。讨论串大而批判为主。为何记在这里:与工具调用交错(而不只是聊天文本)的广告,定下了 agent 产品如何货币化的条款;构建 ChatGPT 应用的开发者从此要为"夹在自己应用与用户提问之间的赞助内容"做推理。并入论点 16 的测量模式:Armature 的工具选择、AI Mode 的 21.6% 价格偏斜测的是渠道的意外经济学,如今有意为之的货币化层叠加上来。9 月 10 日发布日期明白写着;本条是审视浪潮,不是新公告。
- Sources: OpenAI blog · HN discussion
2026-09-18 12:03 —— 替代性证据来自被告自己的文件
NYT 诉 OpenAI 与微软案新近解除涂黑的文件(多份证据仍密封;HN 246 分、175 评论)把 Armature/
Productrise 只能从外部测量的东西内部化了——替代假说,由平台自己的人说出:
- 微软自己的数据显示 Copilot 把 NYT 点击率砍掉最多 93%(对比标准 Bing 搜索)——渠道的自我蚕食由 被告自己测出,属于存在的最强证据类别。
- 应用科学总监 Brent Hecht 称网页抓取是"人类历史上最大规模的劳动窃取",并警告内容供应链的 "doom loop"(2023–24 内部言论)。
- ChatGPT 负责人 Nick Turley 称聊天机器人替代对出版商是"生存威胁";Satya Nadella 经宣誓作证称聊天 机器人替代了访问原始来源,且若早知 OpenAI 用付费墙内容训练,他会要求重新训练。
- 文件还指控源自 Bing 索引的抓取、绕过付费墙的手法、剥除版权声明,以及中期训练数据中发现 91,692+ 份出版商作品副本。
对齐读法:这是原告最强的证据——被告自己的员工记录下公平使用抗辩必须吞下的损害——但法院在
"训练即合理使用"上仍普遍偏向 AI 公司,且政府近期提交了支持 OpenAI 立场的法庭之友书状。对本论点,
可持久的事实更窄:**agent 介导的替代不再只是外部测量(Armature 的 42% 工具一致率、AI Mode 的 21.6%
价格偏斜)——平台内部数字现在也同意了。**
2026-09-21 04:03 — ChatGPT 账号成为跨站测量图谱
- OpenAI 的广告采集器把站外浏览与你的 ChatGPT 账号关联(Ionut Bochodi 解剖文;338 分 HN 头条):位于
bzr.openai.com("bazaar")的采集器在.openai.com上种下__obicookie——SameSite=none; Secure、1 年 Max-Age——OpenAI 的测量 SDK 再从广告主站点随页面数 据回传。在 12 个商业站点观察到(Chewy、Wayfair、Eventbrite、HelloFresh、Coursera、 SeatGeek),带哈希邮箱/电话加明文邮编、城市与地区——邮编是被采集最多的字段。token 携带consent_decision: analytics_allowed,拒绝了营销同意的用户照样被同步。带上作者自己的限 定:仅在 Chrome for Android 上观察到(Safari ITP 与 iOS 浏览器拦截它),约 1/5 的 ChatGPT 会话发出同步 token,而且账号关联本身是从设计推断的、并非实测——OpenAI 确认收到他 9 月 14 日的问询但两个问题都没回答。即便打了折扣,结构性结论依然成立:Meta 的跨站测量图谱围绕 ChatGPT 账号重建,"分析同意"在做法律层面的活。
Sources: buchodi.com 解剖文 ·
HN discussion
- Sources: TechCrunch 报道解除涂黑文件 · HN 讨论
2026-09-22 04:03 — 反爬墙决定 agentic 电商之争
Amazon 在 amazon.com 上拦截 Meta 的 Muse 购物 agent。The Register 实测:让 Muse 买一把椅子,它在到达搜索页之前就撞上"直接封锁自动化浏览器的反爬墙"。记录在案的说法:Amazon 称 Meta "试图单方面强行进入"、从未寻求授权,且 Muse "似乎捕获并存储用户凭证";Meta 反驳 Muse "看不到用户的密码或支付方式"——各执一词、均未独立验证,按此收录。背景:Amazon 自 2023 年起封锁第三方购物 agent(Google、OpenAI、Perplexity 在列),同时运营自家(Alexa for Shopping、Buy for Me)。结构性变化:第九巡回法院裁定用户经 agent 访问不违反反黑客法,把战场从法庭推回 bot 墙——而墙的所有者正是运营竞争 agent 的一方。与 Sponsored Agents 和 __obi 两条线相连:设卡的平台同时在渠道上变现。
Sources:(同英文版)
2026-09-28 12:03 + 20:03 —— Claude Marketplace:采购经济学到来;AI Overview 抱怨帖点破部署差距
Claude Marketplace(Anthropic 9 月 23 日,9 月 27 日大范围报道):三份目录合并为一家店面——2,000+ 连接器与插件(Atlassian、Google、Microsoft、Notion、Salesforce……)、来自 CrowdStrike、Cursor、Harvey、Legora、Lovable、Snowflake、Hebbia 的 Claude 驱动 agent/产品,以及经 Claude Partner Network 接入的咨询/服务伙伴(Accenture、BCG、Deloitte)。比数量更重要的两个细节:买方可将承诺支出的一部分用于合作伙伴产品——把云市场采购经济学搬到 AI 上,正是当年铸成每朵企业云生态的机制;且开发者经 MCP 与 Agent Skills 发布——与 Claude Code 插件目录(314 个插件,9 月 25 日)同一套开放标准,这个市场是其面向客户的超集。当下平台战争的主战场是分发,不是模型质量。
AI Overview 抱怨帖(932 分,当日讨论量第一)——交叉引用 frontier-models:harness 与部署廉价模型的差距以消费级产品失败的形式落地,而非研究局限。对分发论点而言,这是 AI Mode 实测 21.6% 价格偏斜的需求侧镜像:用户体验到的是部署决策(查询规模上的廉价模型),不是模型本身。
来源:Anthropic 公告 · BleepingComputer · sancho.bearblog.dev · HN
2026-09-29 04:03 — 垂直 monorepo 到来;厂商公布自家 agent 流量占比作为路线图依据
anthropics/financial-services — GitHub 周榜第 1,38,025★(本周 +2,606):厂商所有的垂直 monorepo,收录命名的金融工作流 agent(Pitch Agent、Model Builder、GL Reconciler、KYC Screener……),可作为 Claude Cowork 插件安装或经 Managed Agents API 部署。趋势触发因素:"Claude for Financial Advisors" 发布(~9 月 14 日,Reuters 报道接入 Schwab/BlackRock/Vanguard 数据)+ 仓库日志中 9 月 14 日的 "Financial Advisors" commit。限定:README 横幅强调输出"经人工签核",不构成投资/法律建议;无 releases,最后 push 9 月 21 日——star 是产品发布动能加 Anthropic 生态推广,不是新代码。首个大规模垂直专属 agent 分发打法——技能以可安装插件形式出自厂商 monorepo,而非产品特性;每个企业软件厂商都会照抄的模式。
Cloudflare 的 agent 用量数字(→ agent-stack 看 cf 本体):agent 驱动的 Wrangler 用量 ~25%(2026 年 3 月)→ 48%,agent 每天使用的不同命令数约 2 倍——厂商公布自家 agent 流量占比,作为围绕 agent 消费者重建主 CLI 的明确依据。agent 渠道已大到能推动基础设施路线图,且厂商开始明说。
Sources: anthropics/financial-services · Reuters launch coverage · Cloudflare blog
2026-10-01 04:03 — 机器访问迎来付费墙:Cloudflare Monetization Gateway 进入封闭测试
Cloudflare Monetization Gateway(封闭测试,Agents Week):域名所有者可以"就代理对其网站、API、MCP 工具或数据集的访问收费"——经 HTTP 402、无结账跳转——一堵给机器而非人准备的付费墙——通过基于稳定币的 x402 协议结算。配套的 Pay Per Use 帖子把这同一组原语面向出版方表述:"一个由经验证的买家组成的可信网络,各自上报使用并按用量付费",共享身份/计量/定价/分析轨道。当日其余名单:AI Gateway 的 Auto Router、面向代理的实时问题检测、为代理沙箱重建的 Containers(新帖——区别于 9 月 26 日的数据删除缺陷)。代理流量变现此前是零散的 402 实验;现在它正成为内置结算的托管基础设施。对任何发布 MCP 工具、API 或供代理消费的内容的人:机器访问的默认条款正在本周被设定——而且会被定价。代理分发论题的需求侧补全:那个挤掉教学层的渠道,如今装上了计量表。
2026-10-03 05:03 — ChatGPT Sites:vibe-coded 应用漏斗收进围墙花园
OpenAI 文档将 Sites 描述为让「ChatGPT 创建、托管、打磨并分享网站、Web 应用和游戏」——一个 Site 是「可重新打开、打磨、配置与分享的持久化托管产出」:它在生成它的对话之外存活,Sites 项目可通过 .openai/hosting.json(配发 project_id)把本地源码项目接到托管。数据模型是关键:「使用 Sites 里的插件,构建从每个站点查看者自己连接的应用读取数据的 Site」——访客以 ChatGPT 登录并按连接逐个授权,共享应用跑在每位查看者自己的数据上而不暴露所有者的。分享从仅所有者 → 工作区 → 公开逐级放开(企业版公开发布默认关闭);访客只读。公开 beta,覆盖 Plus/Pro/Business/Enterprise/Edu,有用量限制。vibe-coded 应用漏斗就此收进围墙花园——在一个厂商的面板内生成、托管并分发,还带身份感知的按查看者数据访问:OpenAI 对应用商店与「agent 需要一个 surface」两个问题的合并回答,也是每个 agent 应用开发者如今必须推理的分发决策。