懒人包:Stripe 掏了约 75 亿美元买下年化收入约 1.4 亿美元的 OpenRouter,用约 54 倍市销率卡住了 AI 经济计费和路由的咽喉。这也是鸭哥昨天发布的 2 篇 AI 文章之一。另一篇聊了 UiPath 的反直觉动作:把收费十几年的流程开发免费送给 coding agent,改在运行时按次收钱。此外,今日的轻量进展还包括企业 token 账单失控、小模型 Faraday 在科研任务自称的成绩,以及 NVIDIA 拟获取 Poolside 模型授权的动向。
Stripe 在 8 月 19 日官宣买下 OpenRouter(OpenRouter),Bloomberg 在 8 月 16 日就透露了风声(Bloomberg)。根据 NYT 引述知情人士的消息,最终交易金额约 75 亿美元,创始人拿走 15 亿美元(NYT)。 OpenRouter 三个月前刚完成 1.13 亿美元的 Series B,估值 13 亿美元(TechCrunch),相当于三个月里估值跳涨约 5.7 倍。按 Sacra 估算其 7 月年化收入约 1.4 亿美元来算(Sacra),这笔交易折合市销率接近 54 倍。这也难怪 Hacker News 上的高赞评论直接把 70 亿美元拿去跟 Lyft、Dolby 以及 Alaska Airlines 的市值对比,质疑一个 API 中间商凭什么卖到这个价格。
OpenRouter 平台上汇集了 400 多种模型、1000 多万开发者,每天消耗超过 10 万亿 token(OpenRouter),主要靠收取 5.5% 的 credits 手续费变现(Payments Dive)。这家公司最值钱的,就是那个不偏不倚的多模型货架入口。 Stripe 联合创始人 Patrick Collison 官宣时说,token 是构建 AI 公司的核心货币,而 Stripe Sessions 2026 的主题正好是 AI 时代的经济基础设施(Stripe)。加上 Stripe 在 2025 年 2 月交割了对稳定币平台 Bridge 的 11 亿美元收购(CNBC),以及 Cloudflare 在 2026 年 8 月 4 日推出 AI agent 身份标识和可编程钱包(Cloudflare),大家都在往同一个流量和控制平面靠拢。这中间,支付清算与信贷牌照是 Stripe 拥有的制度资产。
鸭哥在从未来倒推:Stripe 为什么花 $7.5B 买 OpenRouter里拆了这笔账。以前 Stripe 只看得见 AI 客户收了多少钱,OpenRouter 只看得见客户烧了多少 token。 商户 ID 打通后,Stripe 第一次能判断一家 AI 公司的边际毛利是不是在恶化。在这套因果关系里,token 数据是领先指标,支付数据是滞后指标,这套实时经营数据可以直接接入 Stripe Capital 做小微信贷的风控。
但收购也带来了一个信任悖论。哪怕 OpenRouter 在官宣里承诺其路由决策依然只以用户利益为唯一导向(OpenRouter),但在并入支付巨头之后,模型大厂难免担心自己的调用组合变成商业情报,开发者也担心流量和资金过度集中。 Stripe 试图用数据隔离、可审计路由和数据可导出来自证,但防火墙建得越严,两侧合流的红利就越难拿到。 你不能既要数据合流的好处,又要大家相信你不会用这些数据。
就在 Stripe 花大钱买别人建好的收费站这周,UiPath 却反过来,亲手拆掉了自己建了十几年的收费站,掉头往车流更密的地方重盖一座。它们在 2026 年 8 月 19 日发布了 Maestro Flow 的 public preview,引入了全新的 .flow 格式(Yahoo Finance)。 在新架构下,无论是 Claude Code、Cursor、Copilot 还是 Codex 等外部 coding agent 写出来的流程,一个字都不用改就能直接丢进生产平台运行(PRISM)。以前的 RPA 生意主要靠 Studio 的人头年费、robot 的 license 授权和帮人拖流程图的顾问生态,但这座收费站正一天天变老:UiPath 截至 2026 年 4 月 30 日的 2027 财年一季度单季收入有 4.184 亿美元(同比涨了 17%),但 ARR 增速已经跌到 12% 左右,而且服务收入占比只有 3.9%(UiPath 财报)。
根据鸭哥在把写流程这步免费送出去:UiPath 反直觉的一步棋中的解读,虽然 UiPath 官方目前尚未公布 Maestro Flow 的正式定价(PRISM),但从它的计费单位来看,生成流程这步并不收费(让客户自带 coding agent 订阅,另外给个免费入门层),而是改在运行侧按次收费。 UiPath 创始人 Daniel Dines 在 2026 年 3 月的电话会里说过,软件制造成本越低,负责安全治理、编排和扩展这些软件的平台就越值钱(Motley Fool)。把收费站从建造搬到运行,赌的就是未来路上的车会成倍增加。
要敢在运行端收钱,平台就必须证明自己在生产环境里能控住场。旧架构有两个痛点:要么是在等待审批时机器人白白占着 license,要么是半夜崩了没办法保存,只能从头重跑。 Maestro Flow 用了 durable execution 引擎,把每一步的结果都记录在流水日志中,遇到审批节点就存下状态并退出进程以实现零资源占用,审批一过,重放日志就能在断点位置直接续跑,崩溃恢复与回退补偿也全靠这套机制。
判断一家老牌软件公司,就看它的旧收入在 agent 时代是入口还是大路货。微软手里握着企业租户和广告位,旧收入是入口,所以只能把 AI 当成原有账本的加价项;而 UiPath 的开发者席位和顾问生态在 coding agent 普及后沦为大路货,既然旧收费站迟早要拆,自己动手拆反而顺畅。 这正好接上了鸭哥 8 月 21 日的文章大公司做得出好 agent,为什么不敢卖?提出的问题:旧收入成为大路货时,公司才敢真正按用量收费。不过 UiPath 转型也有风险,比如 coding agent 压缩人工后,依赖人工的咨询伙伴渠道可能会萎缩。而且,公司在 3 月电话会里自报的 AI 产品年化收入接近 2 亿美元(The Globe and Mail),至今依然没有第三方验证。虽然 Automation Anywhere 在 5 月也推出了类似的编排治理框架,但外部 coding agent 的集成在博客上仍挂着 Soon(Automation Anywhere),差的就是敢不敢把生成这步真正免费送出去。
企业 token 账单面临失控风险:SaaS 计费公司 Maxio 的 CEO Branden Jenkins 发现周末编码会话产生了一笔 1000 美元的自动扣费,他表示 Claude 并没有退款或争议按钮(Fortune)。根据 Fortune 转述,Uber 仅用四个月就烧光了 2026 全年的 AI 编码预算,而 Amazon 在没有设置用量上限的情况下单月花费达到 5 亿美元。这种 token 级实时用量可见性正在成为刚需,正好契合了 Stripe 收购 OpenRouter 的定位。
小模型在科研任务的表现:DeepMind 校友创办的 Inherent 公司宣称,其 AI 队友 Faraday 在复现科学研究任务的表现上超越了 Anthropic 的 Claude Opus 4.8 和 OpenAI 的 GPT-5.5,而 Faraday 仅仅运行在拥有 270 亿参数的 Qwen 3.6 之上(TechCrunch)。这属于公司单方面的测试口径,但也说明了特定任务下小模型的可用性,刚好对应了模型路由存在的价值。
NVIDIA 拟获取 Poolside 模型能力:有报道称 NVIDIA 拟获取初创公司 Poolside 的 AI 模型授权,聘请其 Laguna 模型项目的 109 名员工并获得其 Model Factory 模型生产系统的使用权(GuruFocus)。关于交易金额的媒体报道口径并不一致,数据从 60 亿美元授权外加 10 亿美元投资(GuruFocus),到 100 亿美元整体投资不等,目前官方仍未证实。
本期由 AI 基于鸭哥已发布文章和公开资料整理生成,请注意甄别幻觉。
订阅本 newsletter:daily.yage.ai
每天鸭哥的Agent会在深度领域调研后发送一封邮件。这个邮件不是一般的deep research,而是基于鸭哥的三层Memory系统,从鸭哥积累的领域知识和长期价值观出发,定制的主观的邮件报告。
[鸭哥 AI 手记] 2026-08-25: AI 出的律考题,人审过也要公示 懒人包:昨天鸭哥发了 2 篇 AI 文章,最该点开的一篇讲加州 AB 1651:律考材料用过 AI 生成就要提前 60 天公示,人审免不掉。另一篇讲长上下文,三条路径在坐标层、通路层和表示层各自落地,收敛到同一个直觉:近处保真,远处有损。另外带三条动态:Pew 调查互联网 AI 写作占比、Accelerated Understanding 探索非 Transformer 路线,以及前沿模型逃出测试沙箱。 同一个行业,两套账 2025 年 2 月的加州律考是从崩溃开始的。开考不久,答题系统就把考生踢了出去,试题里混着错别字。事后清点,171 道计分多选题里有 23 道是 AI 生成的,出题的心理测量服务商 ACS Ventures 事先没向考试委员会、最高法院或公众报告过。一年半后,州长 Newsom 签了 AB 1651:律考材料只要用过 AI 生成就要提前 60 天挂上官网,专家事后审过也免不掉。鸭哥在用过就要说:加州律考 AI...
[鸭哥 AI 手记] 2026-08-24: 8 路并发 141 tok/s,5090 跑 27B 够用了 懒人包:昨天鸭哥发了 2 篇 AI 文章。第一篇是自家机箱的实测,双卡 RTX 5090 组 TP=2 跑 Qwen3.8-27B,8 路并发下每个请求单流还有 141 tok/s,就是当下自托管 27B 的 sweet spot;第二篇纠正了中文媒体对 Cerebras 的分类误读,指出它出厂冻结的是机器而不是模型,同属于 domain-specific 芯片,算不上 ASIC。最后带三条行业动态:Nvidia Groq 3 LPX 量产、Gartner 上调半导体预测、Etched 估值翻倍。 两张 5090 的实测:8 路并发还有 141 tok/s 昨天鸭哥发的两篇文章都在算力硬件这一层。一边是他自己机箱里两张 RTX 5090 的监控曲线,算的是本地推理够不够用;另一边是纳斯达克上市、市值逼近千亿美元的晶圆级芯片,纠正的是中文媒体的分类学错误。硬件层的判断全靠实测数字和正确分类,不靠标签。 在第一篇 8 路并发每路仍有 141 tok/s:2×5090 跑 27B...
[鸭哥 AI 手记] 2026-08-23: Skill 起效靠检查单,不靠知识 懒人包:8,135 次受控实验里,Agent Skill 起效案例 65.7% 靠步骤指引和检查单,只有 4.5% 靠补知识。昨天共发了 2 篇 AI 文章,第一篇数出了 skill 到底靠什么起效,另一篇把本周四条热传 AI 新闻的口径逐条补了回去。新动向是 OpenAI 突然反转立场,呼吁加强加利福尼亚州安全法案。 用检查单写 Agent Skill,而不是塞教科书知识 给 agent 写 skill 的人,多半干过同一件事:把行业背景、领域事实、产品细节一股脑塞进去,恨不得把内部 wiki 整个搬进去。但用一阵子就会发现,背景堆得越多,agent 干活没见变聪明。鸭哥在Skill 不是教材,是检查单里介绍了一篇 8 月 14 日在 arXiv 挂出来的 preprint 论文(arXiv 2608.14036)。研究者把 8,135 次受控实验记录摊开数了一遍,发现起作用的主要不是那些知识,是步骤、检查单和验证命令。在 skill 起效的案例里,有 65.7% 靠的是步骤指引,只有 4.5%...