
9月30日凌晨OpenAI 把同一代的脑子拆成两档卖一档叫 Astra一档叫 Sol。官方给出的说法是Sol 的性能接近 Astra价格只要五分之一。看起来是一次干脆的降价。但把定价页翻到细则那一层会发现真正被砍掉 95% 的只有一栏。Sol 最便宜的那一栏是缓存先用一句话说清什么是缓存输入你每一轮都重复发送、内容却不变的那段文字服务端记住一份下次直接复用不再按全价重新算一遍。短上下文下输入不超过 27.2 万 tokenSol 的标准价是每百万 token 输入2 美元、输出10 美元而命中缓存的输入是0.10 美元。0.10 美元这个数字值得单独看它比标准输入便宜95%也比一周前发布的 GPT-6 Sol 的缓存价低50%。Astra 的标价是输入 10 美元、输出 50 美元。五分之一这句比的是标准输入和输出不是整张表。放到真实场景里一个 agent 每轮都带着同样的三万 token 系统提示和工具清单。缓存命中前这部分按 2 美元一档计费命中后它掉到 0.10 美元一档。同一段文字价格差二十倍开关只有一个就是它有没有被原样复用。整张表其实是四个价格带不是一个价便宜和更贵同时写在同一张表上。上下文一旦超过 27.2 万 token输入涨到4 美元、输出涨到15 美元。长文档、整库代码、跨天会话恰好落在这条线上面。处理速度也一样。批量和弹性两档直接半价输入 1 美元、输出 5 美元快速档价格变成两倍输入 4 美元、输出 20 美元。Ultrafast 更极端把 Astra 拉到每秒300token价格是标准档的六倍Sol 的超快版官方写的是未来数日。所以你省不省钱一半看模型一半看你把活儿扔进哪一档。“接近 Astra”到底接近到什么程度官方给的是任务成本科学终端类任务Sol 平均每个任务5.47 美元Astra23.80 美元Claude Opus 5.5 是 23.21 美元。第三方评测机构 Artificial Analysis 当晚给出的独立数字更能说明问题。Sol 的智能指数是52Astra 是53接近这两个字站得住但同一张表里排第一的是 Opus 5.5 的58。按每个评测任务的成本算Sol 是0.72 美元Astra 是3.26 美元折算下来约 22%。官方那句五分之一经得起外部核对。另有一处没被当成卖点讲低推理强度下Sol 的事实错误率从 GPT-6 Sol 的 11.4% 降到 7.7%。两个容易看错的地方先说一个最常听到的判断Sol 比上周的 GPT-6 Sol 便宜很多。这么想有道理发布会的核心口号就是五分之一价格。但它解释不了定价页上那两行没变过的数字Sol 的输入和输出标价跟一周前的 GPT-6 Sol 完全相同动的只有缓存那一栏。更准确的理解是这不是一次全面降价而是一次结构性降价钱省在重复内容这个口子上省多省少取决于你有多少内容可以重复。再看第二个便宜 80%账单就该砍掉 80%。在 agent 类任务上这个判断基本成立官方和第三方给出的单任务成本都指向同一个方向。但它解释不了两件事上下文超过 27.2 万 token 时输入价格变成两倍想要低延迟还得付六倍价。更准确的说法是账单两头都得看。后台批量跑数据降幅最明显实时交互里追速度成本可能反过来上去。这一轮实际该动的地方把你每轮都发的那段固定前缀系统提示、工具定义、规则文件放到最前面中间别插变量。前缀一旦被打断缓存就命不中那 95% 的折扣直接消失。这是整张定价表里最容易拿到、也最容易丢掉的一块。长上下文的活儿先数 token过线就换档别等账单出来才发现。需要人盯着等的交互场景才值得买速度后台批处理用批量档叠缓存差价能到几十倍。Sol 和 Astra 的差距是一个百分点。你和账单的差距往往是你有没有把那段前缀固定下来。你手上的项目每轮重复发送的上下文占了多大比例如果现在把它拆出来账单能少几成如果觉得今天这篇有启发,点个在看,顺手转发给需要的朋友;想第一时间收到推送,可以星标我⭐。关注我,每天陪你聪明看世界 —— 看懂热搜,玩懂AI。