AWS 开放网页索引 API、Nebius 收购 Tavily,再加上 Exa 估值跳涨。搜索其实没变便宜,只是整个供应链拆成了能单卖的几层。Suno 版权案的一审判决,直接把模型权重列为版权审查对象,以后跨国部署得拆开每个环节来管辖。至于刚开源的 Cloudflare OS 则表明,Agent 授权不能只管调用那一瞬间,得盯着数据读完之后的整个生命周期。
鸭哥在 搜索没有变便宜,但 Agent 把它拆成了新的供应链 里,把市面上的搜索 API 按 stack 位置分了四类。
以前 Google 为了保住默认搜索位,在 2021 年要支付超过 260 亿美元(CNBC)。现在交付契约从人看网页变成模型吞 token,原来闷在搜索引擎里的抓取、召回、解析、压缩全拆开了,让 AWS、Nebius、Exa 各自吃下了一层。
比如今年 6 月发布的 AWS Bedrock AgentCore Web Search,定价在每千次查询 7 美元(AWS 博客),主打零数据流出,本质是拿云端分发替代浏览器分发。
Brave 则自己维护着 300 亿到 400 亿网页的独立索引(Brave 博客),在 Bing Search API 退役后,自称最大的独立索引 API 提供方。
与此同时,其他厂商也在切入不同层级。Nebius 掏了最多 4 亿美元收购 Tavily(Nebius 官网),把精炼上下文这一层装进自己的 AI 云里。
专注于语义索引的 Exa,其估值在 9 个月内从 7 亿美元跳到了 22 亿美元(PYMNTS)。底层抓取和清洗网页的脏活累活一点没变,但交付契约的改变把传统的搜索引擎拆成了能独立售卖的供应链。
除了搜索供应链的变化,版权审查的手也伸进了以前没人管的模型权重本身。鸭哥在 模型权重也会成为侵权复制品?从 Suno 案看 AI 发布的版权新防线 里分析了慕尼黑地区法院的一审判决(法院新闻稿)。法院认定德国服务器上的 v3.5 和 v4 模型因为记忆化了六首作品,构成对德国《著作权法》第 16 条的侵权复制。这次起诉的 GEMA 代表约 6.5 万会员的词曲版权(Bird & Bird)。法院认了这套办法:用户只输歌词和歌名,模型就吐出原曲旋律,说明权重里留了东西。
这说明版权合规不能只看训练数据和生成结果,模型权重本身也是审查对象。法院把版权管辖拆成获取训练、模型存储、提供服务、生成输出四个独立环节,即便在美国训练,只要在欧洲存储或提供服务,就要适用当地法律。
虽然该判决目前尚未生效,但华纳音乐和环球音乐已分别与 Suno 和 Udio 和解(Billboard),走的是下线旧模型并绑定授权新模型的路线,只有 Sony Music 仍在坚持诉讼。鸭哥在 文章 里整理了一份覆盖这四个环节的版权合规审查工程清单。
除了版权,Agent 的数据授权也有类似的盲区。现在的 MCP 或 API 网关只在调用 API 的一瞬间校验身份,数据落进工作区后就完全脱控了。鸭哥在 Agent 读过的数据,分享后还能给谁看?Cloudflare OS 的授权实践与源码真相 里翻了刚开源的 Cloudflare OS 的源码(GitHub)。这个 GitHub 仓库挂着 Apache-2.0 许可证,目前拿到了大约 7600 个 star。Cloudflare 官方博客提到,它要记录 Agent 看过的每一个资源,别人一打开工作区就重新验权限(Cloudflare 博客)。MCP 管的是调工具那一下,Cloudflare OS 管的是数据读完之后的事,两个各管一段。
看源码就知道它是怎么跑通这个逻辑的:内核里的 Gatekeeper 通过 authorizeObservation() 把数据源 ID 存进持久化的 Observation Set 里。用户在工作区里分享或打开数据,Overseer 就拿接收者的凭据重新验一遍。
不过,目前这套设计也有死角,它还没能覆盖统一的 egress 出口。鸭哥在 文章 里给了一份包含调用前、读取后、传播出口三平面的 Agent 授权落地蓝图。
欧盟 AI Act 透明度义务生效:欧盟 AI Act 第 50 条的透明度义务在 8 月 2 日正式生效了。这套规则强制约束 AI 提供方和部署方,要是违规,处罚最高可达 1500 万欧元或者全球年营业额的 3%(Cooley 律所)。
Meta 开源 Muse Glimmer 30B:Meta 在 8 月 10 日开源了一个 300 亿参数、用 Apache-2.0 许可证的模型。它专门针对本地 Agent 工作流做了设计,支持 120K 以上的上下文,在单张 18-24GB 显存的消费级 GPU 上就能离线跑起来(AI News)。
本期由 AI 基于鸭哥已发布文章和公开资料整理生成,请注意甄别幻觉。
订阅本 newsletter:daily.yage.ai
每天鸭哥的Agent会在深度领域调研后发送一封邮件。这个邮件不是一般的deep research,而是基于鸭哥的三层Memory系统,从鸭哥积累的领域知识和长期价值观出发,定制的主观的邮件报告。
[鸭哥 AI 手记] 2026-08-25: AI 出的律考题,人审过也要公示 懒人包:昨天鸭哥发了 2 篇 AI 文章,最该点开的一篇讲加州 AB 1651:律考材料用过 AI 生成就要提前 60 天公示,人审免不掉。另一篇讲长上下文,三条路径在坐标层、通路层和表示层各自落地,收敛到同一个直觉:近处保真,远处有损。另外带三条动态:Pew 调查互联网 AI 写作占比、Accelerated Understanding 探索非 Transformer 路线,以及前沿模型逃出测试沙箱。 同一个行业,两套账 2025 年 2 月的加州律考是从崩溃开始的。开考不久,答题系统就把考生踢了出去,试题里混着错别字。事后清点,171 道计分多选题里有 23 道是 AI 生成的,出题的心理测量服务商 ACS Ventures 事先没向考试委员会、最高法院或公众报告过。一年半后,州长 Newsom 签了 AB 1651:律考材料只要用过 AI 生成就要提前 60 天挂上官网,专家事后审过也免不掉。鸭哥在用过就要说:加州律考 AI...
[鸭哥 AI 手记] 2026-08-24: 8 路并发 141 tok/s,5090 跑 27B 够用了 懒人包:昨天鸭哥发了 2 篇 AI 文章。第一篇是自家机箱的实测,双卡 RTX 5090 组 TP=2 跑 Qwen3.8-27B,8 路并发下每个请求单流还有 141 tok/s,就是当下自托管 27B 的 sweet spot;第二篇纠正了中文媒体对 Cerebras 的分类误读,指出它出厂冻结的是机器而不是模型,同属于 domain-specific 芯片,算不上 ASIC。最后带三条行业动态:Nvidia Groq 3 LPX 量产、Gartner 上调半导体预测、Etched 估值翻倍。 两张 5090 的实测:8 路并发还有 141 tok/s 昨天鸭哥发的两篇文章都在算力硬件这一层。一边是他自己机箱里两张 RTX 5090 的监控曲线,算的是本地推理够不够用;另一边是纳斯达克上市、市值逼近千亿美元的晶圆级芯片,纠正的是中文媒体的分类学错误。硬件层的判断全靠实测数字和正确分类,不靠标签。 在第一篇 8 路并发每路仍有 141 tok/s:2×5090 跑 27B...
[鸭哥 AI 手记] 2026-08-23: Skill 起效靠检查单,不靠知识 懒人包:8,135 次受控实验里,Agent Skill 起效案例 65.7% 靠步骤指引和检查单,只有 4.5% 靠补知识。昨天共发了 2 篇 AI 文章,第一篇数出了 skill 到底靠什么起效,另一篇把本周四条热传 AI 新闻的口径逐条补了回去。新动向是 OpenAI 突然反转立场,呼吁加强加利福尼亚州安全法案。 用检查单写 Agent Skill,而不是塞教科书知识 给 agent 写 skill 的人,多半干过同一件事:把行业背景、领域事实、产品细节一股脑塞进去,恨不得把内部 wiki 整个搬进去。但用一阵子就会发现,背景堆得越多,agent 干活没见变聪明。鸭哥在Skill 不是教材,是检查单里介绍了一篇 8 月 14 日在 arXiv 挂出来的 preprint 论文(arXiv 2608.14036)。研究者把 8,135 次受控实验记录摊开数了一遍,发现起作用的主要不是那些知识,是步骤、检查单和验证命令。在 skill 起效的案例里,有 65.7% 靠的是步骤指引,只有 4.5%...