懒人包:互联网上 57.5% 的网页流量已经来自机器人,Cloudflare 正在从传输格式、身份与计费层重写机器时代的基础设施。鸭哥昨天发了 3 篇文章:Cloudflare 给 AI agent 铺路、模型越强代码反而越臃肿、Codex 并入 ChatGPT 走向跨界面工作。
2026 年 6 月,Cloudflare 的雷达仪表盘显示,互联网上超过一半的 HTTP 请求来自机器人(Matthew Prince 在 X 上的发帖)。Matthew Prince 指出这一比例达到了 57.5%,甚至比所有分析机构的预测提前了 18 个月。读网页的主力变成了 AI agent。为此,Cloudflare 已经把机器格式塞进了新网站发布的默认菜单。当客户端发送 Accept: text/markdown 请求头时,边缘节点能实时把 HTML 转成 Markdown。
官方实测显示,这让一个页面消耗的 token 从 16,180 降到 3,150,节省约 80%(Cloudflare 官方博客)。
鸭哥昨天发布的 当 AI agent 砸掉广告饭碗,Cloudflare 已经把路铺好了 拆解了这一套机器基础设施。这套体系由四层拼图构成:VoidZero 工具链、Markdown 边缘协商、x402 计费层(The Defiant)以及 Access 身份层。Tavily 目前已上线 x402 端点,每次搜索收取 0.01 美元(Tavily 官方博客)。比起缺乏边缘格式协商的 Vercel 或没有托管浏览器的 AWS Bedrock,Cloudflare 给出了目前最完整的四层协商拼图。原文还列了它要过的五道硬考题:网站采用率、客户端框架协同、动态网页转换质量、模型原生 HTML 能力进化、外部转换延迟。
机器正在变成互联网的主要消费者。而在生产端,机器写的代码也在改变软件的供给结构。一篇 arXiv 论文指出,代码体量与架构缺陷的 Spearman 相关系数达到 0.94,模型越强,越倾向堆砌冗余代码来覆盖边界情况(arXiv 论文)。GitClear 分析了 6.23 亿次代码改动,发现重复代码块涨了 81%,重构比例从 2022 年的 21% 跌到 2026 年的 3.8%(GitClear 报告)。Slopfix 固定收费一万美元一周,用 Claude Code 删 Claude Code 写的代码,号称最多裁掉 65%(Tom's Hardware)。
在鸭哥昨天的文章 模型越强,代码越臃肿:AI 代码膨胀的结构性盲区 中,这种 Volume-Quality Inverse Law 解释了换更强模型无法自动带来干净代码。这也催生了代码治理市场。融资 8800 万美元的 CodeRabbit 正在高速增长(CodeRabbit 官方博客),Cursor 在 2025 年 12 月收购了代码审查创业公司 Graphite(Yahoo Finance)。
METR 的随机对照试验测了 16 名资深开源开发者,使用 AI 工具反而慢了 19%,而开发者自评仍认为快了约 20%(METR)。
代码供给端在膨胀,agent 执行端也在脱离原来的界面。OpenAI 最近将 Codex 并入 ChatGPT 桌面应用,扩充其桌面协作能力。在 Codex 的 500 万周活用户中,约有 20% 正在使用它处理非开发工作(OpenAI 官方博客)。
同时,Anthropic 也把 Claude Cowork 扩展到移动端和网页端,其中超过 90% 的使用场景并非软件开发(Anthropic 官方博客)。Cursor 3.0 把任务管理独立成 Agents Window,允许在本地、工作区、云端或远程 SSH 四种环境并行(Cursor 更新日志)。
鸭哥在昨日文章 Codex 并入 ChatGPT:Agent 为什么开始跨界面工作 中给出了两条分析轴:独立完成任务的能力,以及低成本验收的能力。代码能够走出 IDE,是因为软件工程有成熟的验收压缩设施,比如 diff 差异对比、测试与 PR 容器。开发者在手机上只需看几个压缩信号就能确认结果。相比之下,知识工作因为缺乏像编译器一样的自动验收工具,导致 30 页 PPT 无法快速判断是否合格,因而落地稍显迟缓。
AIsa 获得 650 万美元种子轮融资:阿里与 Tribe Capital 领投这一 AI agent 支付网络,为其建设钱包、稳定币结算、预算与审计,与 Cloudflare x402 机器流量计费是相邻方向(Business Insider)。
阿里禁用 Anthropic 服务含 Claude Code:该禁令自 7 月 10 日起生效,员工须改用自研 Qoder。背景是 Anthropic 在 6 月指控阿里发起大规模模型蒸馏攻击(CNBC)。
中国 AI 拟人化交互管理办法 7 月 15 日生效:禁止向未成年人提供持续性情感交互和虚拟陪伴服务。字节跳动豆包和阿里的 persona agent 功能已先后下线(Let's Data Science)。
本期由 AI 基于鸭哥已发布文章和公开资料整理生成,请注意甄别幻觉。
订阅本 newsletter:daily.yage.ai
每天鸭哥的Agent会在深度领域调研后发送一封邮件。这个邮件不是一般的deep research,而是基于鸭哥的三层Memory系统,从鸭哥积累的领域知识和长期价值观出发,定制的主观的邮件报告。
[鸭哥 AI 手记] 2026-07-21: 训练算合理使用,Anthropic 还是赔了 15 亿美元 懒人包:Anthropic 赔了 15 亿美元,但法院其实倾向认定训练符合 fair use,钱买的是硬盘上留存盗版书的诉讼风险。另外两篇文章指出,Sandbox 选型同名不同质,需要厘清运行状态与写操作控制;数学 Agent 协议则通过双循环严格隔离探索草稿与前提。 15 亿美元买的是什么 7 月 20 日,加州北区联邦法院批准了 Anthropic 与作家的 15 亿美元和解(Bloomberg Law)。这是美国史上最大的版权集体诉讼和解。但拿到这笔钱之前,法庭已经倾向于认定一件事:把书读进显存训练模型,属于 fair use。训练本身符合规范,问题出在同一份数字副本在硬盘里存了太久。 鸭哥在 同一本书,训练可算合理使用,盗版流程为何要赔 15 亿美元 中指出,Anthropic 联合创始人 Ben Mann 在 2021 至 2022 年间,明知是盗版仍从 LibGen 和 PiLiMi 下载了最高 700 万册图书(The...
[鸭哥 AI 手记] 2026-07-20: Agent 装环境时,第三方代码已经跑完 懒人包:昨天发了 3 篇文章,核心指出 Coding Agent 在 setup 阶段执行 npm install 或 pip install 时,第三方代码就已经跑完,且防护绕过成本极低。从启动前检查到 OS 隔离 Sandbox,再到 Agent Skills 在各 Harness 间的兼容僵局,这组文章重新拆解了 AI agent 的执行边界与安全限制。 装环境时,第三方代码已经在跑 开发者把陌生仓库交给 Coding Agent 并要求跑起项目,Agent 读取 README 便会自动运行 npm install 或 pip install。预印本(arXiv:2607.15143)指出,这个准备阶段其实已经在执行第三方代码,而开发者此时连最终 diff 都还没看到。测试覆盖 Claude Code、Copilot CLI、Codex CLI 和 Cursor 的 9 种配置,作者在已知 CVE 漏洞场景中发现,9 个配置全数拿到 0/30 的检出率,没有一个 agent 主动查询...
[鸭哥 AI 手记] 2026-07-19: Grok Build 开源了,但官方二进制对不上公开 commit 懒人包:下载 xAI 官方的 Grok Build 版本 0.2.102 macOS 二进制,其报告的 commit ab5ebf69acec 在公开仓库中并不存在。昨天发布了三篇文章,分别探讨开源、memory 质量、网页发布三个容易混淆的概念。 Grok Build 公开了客户端,但模型和构建链仍是黑盒 xAI 宣布开源 Grok Build(x.ai/news/grok-build-open-source),包含本地的 agent runtime、沙箱和 MCP 等客户端核心逻辑,并采用 Apache-2.0 许可协议。Simon Willison 统计该仓库约有 84 万行 Rust 代码(Simon Willison 博客),但 Grok 模型与云端服务仍未公开。相较于 Codex CLI、Gemini CLI 或 Claude Code,Grok Build 明确在 CONTRIBUTING.md 中指出不接受外部 PR,由私有 monorepo...