[鸭哥 AI 手记] 2026-07-13: 同一个 hello,GPT-5.6 贵了 80 倍


[鸭哥 AI 手记] 2026-07-13: 同一个 hello,GPT-5.6 贵了 80 倍

懒人包:同一个 hello,标准模式和顶配设置能差出 80 倍账单。鸭哥昨天发了 2 篇文章:一文带你算清 GPT-5.6 复杂的控制维度账单,另一文则探讨了 Turso 让每个 agent 独占一个数据库的产品豪赌。

别掉进名字的恶搞陷阱,GPT-5.6 的多维账单极易失控

OpenAI 发布 GPT-5.6 后,社区给它拼了个名字:GPT-5.6 Sol Pro Max Fast。听起来像把 iPhone 包装盒上所有后缀都勾了一遍。但它不是单纯的段子。

Sol、Pro、Max、Fast 对应的是 API 底层四个独立的控制维度。鸭哥做了一个计费测试。同一个简短问候,标准模式花费 $0.00021,开到 Pro + Max + Priority 后变成 $0.01695,差了约 80 倍。

在 Pro 模式下,input token 从 12 涨到约 1520,但 reasoning_tokens 回显为 0。这四个参数从机制上决定了模型的思考和表达。

这之中,推理模式由 reasoning.modestandard / pro)控制,思考深度归 reasoning.effort 负责。表达详略归 text.verbosity 控制。调用状态则用 previous_response_id 在云端延续。

最后一维是服务调度。service_tier 分四档,Priority 计费是 Standard 的两倍,Flex 和 Batch 只要一半(官方 pricing)。这四个维度任意组合,计费也会成倍上涨。

社区对 reasoning_tokens 的隐藏计费有广泛投诉,Langfuse 也报告了双算 bug(Langfuse GitHub)。

想要了解四层控制面的拆解,以及 Responses API 迁移时间线(Assistants API 将在 2026-08-26 关闭),可以阅读 GPT-5.6 Sol Pro Max Fast:这个玩笑为什么成立了


搞定调用维度之后,Agent 的数据库该怎么放?

搞懂单次 API 调用的控制维度只是第一步,第二步是解决 agent 跑任务时状态存哪里的问题。这同样比你以为的复杂。在 从每个租户一库到每个 Agent 一库:Turso 的产品赌注与竞争版图 中,鸭哥探讨了高密度数据库部署对 agentic 开发的改变。

Turso 的思路非常直白:给每个 agent 配一个独立数据库。agent 调一次工具,系统就克隆一个分支。跑成了合并回去,跑废了直接删掉。

这听起来像每个租户一库的升级版,但它改变的是物理边界。以前几十个租户共用一个大 Postgres,靠逻辑策略隔开。现在每个 agent 有自己的文件,读写不走网络,其进度不再互相干扰。

AgentFS 把文件系统、键值存储和审计日志全封进本地可读写的 SQLite 文件。面对这种物理密度的跃升,同行的路子走得各有不同。Cloudflare Durable Objects 已原生支持 SQLite 存储,但没有离线同步能力(Cloudflare 文档)。Electric 和 PGlite 插件只做单向读复制,本地写回云端仍需自建(PGlite 同步文档)。

Realm 同步服务在 2025-09-30 停服(MongoDB 官方)。传统同步退场,给新一代引擎和 AgentFS 腾出了生态空白。

在体量上,Turso 仍是 seed 期公司(2022 年 $7M seed,约 22 人),无公开 A 轮。而其对手 Neon,Databricks 以约 $10 亿将其收购(收购公告)。据报道 Neon 上 80% 以上的库由 AI agent 创建。

如果只在单机跑,本地 SQLite 已经足够。但要搞懂分布式治理的代价,建议点开原文看鸭哥的拆解。


也值得知道

AI 价格战全面爆发:OpenAI 推出超低价 Luna 选项。Meta 首次对 Muse Spark 1.1 收费,扎克伯格公开批评其他实验室“定价极端”,xAI 则宣称 Grok 4.5 的 token 效率是同类两倍。模型采购复杂度正在升级,开发者得精细到按任务路由(LA Times)。

Databricks 以约 $10 亿收购 Neon,且 80% 库由 AI agent 创建:Databricks 针对这一趋势推出 Agent Plan,支持使用 masked-PII branching 克隆分支,服务需要海量分支库的 AI 平台(Databricks 公告)。

Apple 起诉 OpenAI 窃取商业秘密:Apple 于 7 月 10 日提起诉讼,指控两名前员工窃取商业秘密。此案也将两家公司在 AI 合作和硬件底层上的紧张关系彻底摆上了台面(LA Times / TechCrunch)。


本期由 AI 基于鸭哥已发布文章和公开资料整理生成,请注意甄别幻觉。

订阅本 newsletter:daily.yage.ai

鸭哥每日AI要闻

每天鸭哥的Agent会在深度领域调研后发送一封邮件。这个邮件不是一般的deep research,而是基于鸭哥的三层Memory系统,从鸭哥积累的领域知识和长期价值观出发,定制的主观的邮件报告。

Read more from 鸭哥每日AI要闻

[鸭哥 AI 手记] 2026-07-21: 训练算合理使用,Anthropic 还是赔了 15 亿美元 懒人包:Anthropic 赔了 15 亿美元,但法院其实倾向认定训练符合 fair use,钱买的是硬盘上留存盗版书的诉讼风险。另外两篇文章指出,Sandbox 选型同名不同质,需要厘清运行状态与写操作控制;数学 Agent 协议则通过双循环严格隔离探索草稿与前提。 15 亿美元买的是什么 7 月 20 日,加州北区联邦法院批准了 Anthropic 与作家的 15 亿美元和解(Bloomberg Law)。这是美国史上最大的版权集体诉讼和解。但拿到这笔钱之前,法庭已经倾向于认定一件事:把书读进显存训练模型,属于 fair use。训练本身符合规范,问题出在同一份数字副本在硬盘里存了太久。 鸭哥在 同一本书,训练可算合理使用,盗版流程为何要赔 15 亿美元 中指出,Anthropic 联合创始人 Ben Mann 在 2021 至 2022 年间,明知是盗版仍从 LibGen 和 PiLiMi 下载了最高 700 万册图书(The...

[鸭哥 AI 手记] 2026-07-20: Agent 装环境时,第三方代码已经跑完 懒人包:昨天发了 3 篇文章,核心指出 Coding Agent 在 setup 阶段执行 npm install 或 pip install 时,第三方代码就已经跑完,且防护绕过成本极低。从启动前检查到 OS 隔离 Sandbox,再到 Agent Skills 在各 Harness 间的兼容僵局,这组文章重新拆解了 AI agent 的执行边界与安全限制。 装环境时,第三方代码已经在跑 开发者把陌生仓库交给 Coding Agent 并要求跑起项目,Agent 读取 README 便会自动运行 npm install 或 pip install。预印本(arXiv:2607.15143)指出,这个准备阶段其实已经在执行第三方代码,而开发者此时连最终 diff 都还没看到。测试覆盖 Claude Code、Copilot CLI、Codex CLI 和 Cursor 的 9 种配置,作者在已知 CVE 漏洞场景中发现,9 个配置全数拿到 0/30 的检出率,没有一个 agent 主动查询...

[鸭哥 AI 手记] 2026-07-19: Grok Build 开源了,但官方二进制对不上公开 commit 懒人包:下载 xAI 官方的 Grok Build 版本 0.2.102 macOS 二进制,其报告的 commit ab5ebf69acec 在公开仓库中并不存在。昨天发布了三篇文章,分别探讨开源、memory 质量、网页发布三个容易混淆的概念。 Grok Build 公开了客户端,但模型和构建链仍是黑盒 xAI 宣布开源 Grok Build(x.ai/news/grok-build-open-source),包含本地的 agent runtime、沙箱和 MCP 等客户端核心逻辑,并采用 Apache-2.0 许可协议。Simon Willison 统计该仓库约有 84 万行 Rust 代码(Simon Willison 博客),但 Grok 模型与云端服务仍未公开。相较于 Codex CLI、Gemini CLI 或 Claude Code,Grok Build 明确在 CONTRIBUTING.md 中指出不接受外部 PR,由私有 monorepo...