GPT-5.6 Luna API 价格详解:1 亿缓存 Token 成本、LinkAGI 接入与 Codex 配置

发布时间:2026/7/22 4:55:07
GPT-5.6 Luna API 价格详解:1 亿缓存 Token 成本、LinkAGI 接入与 Codex 配置 LinkAGI 控制台https://api.linktoagi.com本文以 2026 年 7 月 19 日的 OpenAI 官方价格和 LinkAGI 模型广场页面价为基础完整拆解 GPT-5.6 Luna 的普通输入、缓存输入和输出成本并给出可运行的费用计算代码与不同客户端的 Base URL。先说明最容易被误解的结论多次请求累计读取 1 亿缓存输入 TokenLinkAGI 当前约 1.2 元1 亿普通输入约 12 元1 亿输出约 72 元。“1 亿 Token 不到 10 元”只适用于缓存读取不是所有 Token 的统一价格。1. 为什么同样是 Token会有三种价格一次模型请求至少要区分三类用量普通输入input本次需要新计算的提示词和上下文。缓存输入cached input与之前请求完全一致、可以复用计算结果的提示词前缀。输出output模型本次重新生成的内容。Prompt Caching 缓存的不是答案而是完全相同的提示词前缀计算。即使命中缓存模型仍会重新生成回答输出 Token 也会正常计费。OpenAI 官方文档说明Prompt 至少达到 1024 Token 才符合缓存条件。固定的系统指令、工具定义、项目规范和示例应该放在前面用户问题、时间戳和本轮任务等动态内容放在后面。这正是 Codex、Claude Code 等编程 Agent 容易获得缓存收益的原因系统指令、工具 Schema、仓库规范和历史上下文往往会在连续多轮请求中重复出现。2. OpenAI 官方价格与 LinkAGI 页面价OpenAI API Standard 服务等级下当 GPT-5.6 Luna 单次输入不超过 272K Token 时每 100 万 Token 的官方价格为计费项目OpenAI 官方LinkAGI 当前页面价普通输入$1.00¥0.12缓存输入$0.10¥0.012输出$6.00¥0.72上表只展示双方各自标价官方使用美元LinkAGI 使用人民币。汇率会变化因此不把它描述成固定倍数折扣。单次输入超过 272K Token 时OpenAI 官方长上下文价格另计不能直接套用本表。LinkAGI 当前模型广场实页如下价格仍应以访问时的实时页面为准3. 一亿 Token 的三笔账1 亿 Token 等于 100 个“1M Token”计费单位。普通输入100 × ¥0.12 ¥12 缓存输入100 × ¥0.012 ¥1.20 输出 100 × ¥0.72 ¥72所以严谨的宣传口径应该是**累计读取 1 亿 GPT-5.6 Luna 缓存输入 TokenLinkAGI 当前约 1.2 元。**它不包含普通输入、输出、缓存写入和工具调用费用也不是一次请求塞入 1 亿 Token。4. 一个更接近编程 Agent 的混合示例假设一段时间内累计使用 100M Token其中80M 为缓存输入15M 为普通输入5M 为输出。按 LinkAGI 当前价格缓存输入80 × 0.012 0.96 元 普通输入15 × 0.12 1.80 元 输出 5 × 0.72 3.60 元 合计 6.36 元按 OpenAI Standard 短上下文价格同一组 Token 为 8 15 30 53 美元。双方都暂不计算缓存写入和工具调用费用。这是一组便于复算的示例不代表所有用户的真实账单。可运行的 Python 费用计算器下面的代码已经本地运行验证输出总费用为 6.36 元PRICE_PER_MILLION_RMB{input:0.12,cached_input:0.012,output:0.72,}defestimate_cost(input_million,cached_input_million,output_million):parts{input:input_million*PRICE_PER_MILLION_RMB[input],cached_input:cached_input_million*PRICE_PER_MILLION_RMB[cached_input],output:output_million*PRICE_PER_MILLION_RMB[output],}returnparts,sum(parts.values())breakdown,totalestimate_cost(input_million15,cached_input_million80,output_million5,)print(breakdown)print(ftotal: RMB{total:.2f})运行结果{input: 1.8, cached_input: 0.96, output: 3.6} total: RMB 6.36更换三个输入值就能估算自己的工作负载。正式对账仍以控制台调用日志为准。5. LinkAGI 五步接入打开https://api.linktoagi.com/register使用页面当前支持的邮箱注册并完成验证码验证。在钱包管理中小额充值当前支持微信支付和支付宝。进入令牌管理为不同项目创建独立 API Key。按客户端填写 Base URL 和 API Key。先发起一次小额测试再到使用日志核对模型、状态、Token 数量和扣费。Base URL 速查客户端Base URL备注Claude Code / Anthropichttps://api.linktoagi.com使用 Anthropic 类型配置Codex / OpenAI Responseshttps://api.linktoagi.com/v1同时设置wire_api responsesGemini CLIhttps://api.linktoagi.com按文档配置模型与 KeyOpenAI-compatible 客户端https://api.linktoagi.com/v1例如 Cherry Studio、ChatBoxCodex 的提供方配置示意[model_providers.linkagi] name LinkAGI base_url https://api.linktoagi.com/v1 env_key OPENAI_API_KEY wire_api responsesAPI Key 请通过环境变量注入不要提交到 Git 仓库也不要放在浏览器前端代码中。6. 常见问题与排查为什么缓存 Token 一直很少先检查 Prompt 是否达到 1024 Token然后检查系统指令、工具定义和示例等前缀是否在每次请求中完全一致。时间戳、随机 ID 等动态内容如果放在前缀里也会降低命中率。“1 亿缓存输入约 1.2 元”是完整账单吗不是。它只计算 cached input。普通输入、输出、缓存写入和工具费用需要分别计算。缓存读取量也是多次请求的累计值不代表一次请求的上下文长度。单次上下文超过 272K 怎么办OpenAI 官方对 GPT-5.6 Luna 的长上下文有单独计费规则。本文只比较 Standard、单次输入不超过 272K 的场景使用 LinkAGI 时以模型广场和实际调用日志为准。出现 401、404 或 504 怎么排查401检查 API Key 是否正确、是否带多余空格、环境变量是否生效。404优先检查客户端类型与 Base URLCodex/OpenAI-compatible 通常需要/v1Claude Code 使用根地址。504通常表示请求耗时超过网关等待时间。先缩短单次任务并重试再通过问题反馈入口提交时间、模型与请求类型正式业务应保留备用渠道。7. 入口与参考资料LinkAGI 控制台https://api.linktoagi.com实时模型价格https://api.linktoagi.com/pricing中文使用文档https://docs.linktoagi.com问题反馈、商务咨询与企业技术支持https://docs.linktoagi.com/about.html#support联系邮箱linktoagi163.com官方参考OpenAI API Pricinghttps://developers.openai.com/api/docs/pricingOpenAI Prompt Cachinghttps://developers.openai.com/api/docs/guides/prompt-cachingGPT-5.6 Lunahttps://developers.openai.com/api/docs/models/gpt-5.6-luna价格核对日期2026 年 7 月 19 日。LinkAGI 实时价格以模型广场和实际账单为准。