<?xml version="1.0" encoding="utf-8" standalone="yes"?><rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom"><channel><title>API价格 on Huoke.Me - 跨境生活，从理财开始！</title><link>https://blog.huoke.me/tags/api%E4%BB%B7%E6%A0%BC/</link><description>Recent content in API价格 on Huoke.Me - 跨境生活，从理财开始！</description><generator>Hugo</generator><language>cn</language><lastBuildDate>Sat, 05 Sep 2026 17:39:00 +0800</lastBuildDate><atom:link href="https://blog.huoke.me/tags/api%E4%BB%B7%E6%A0%BC/index.xml" rel="self" type="application/rss+xml"/><item><title>Astra和Fable缓存差4倍</title><link>https://blog.huoke.me/posts/astra-fable/</link><pubDate>Sat, 05 Sep 2026 17:39:00 +0800</pubDate><guid>https://blog.huoke.me/posts/astra-fable/</guid><description>&lt;blockquote>
&lt;p>🎯 GPT-6 Astra与Claude Fable 5.1的基础输入、输出价格都是每百万Token 10美元和50美元。缓存读取分别为1美元和0.25美元，相差4倍。Agent反复读取同一仓库时，这一行会逐渐压过模型标价。&lt;/p>&lt;/blockquote>
&lt;p>&lt;img src="https://blog.huoke.me/img/posts/astra-fable/hero.webp" alt="Astra与Claude Fable 5.1缓存成本对比" title="Astra与Fable 5.1缓存价格对比" width="1200" height="630" loading="lazy" decoding="async">
&lt;/p>
&lt;p>两个模型的首页价格看起来完全相同。短对话的费用也几乎一样。差距会在长代码库、多轮工具调用和重复读取系统上下文时出现。&lt;/p>
&lt;p>社区里流传的“缓存贵8倍”缺少统一比较口径。按两家当前官方API价格，Astra与Fable 5.1的缓存读取差距是4倍。云平台、区域推理和其他模型组合可能产生更大差距，需要单独列账。&lt;/p>
&lt;hr>
&lt;h2 id="-官方价格放到同一张表">📌 官方价格放到同一张表&lt;/h2>
&lt;p>OpenAI的&lt;a href="https://developers.openai.com/api/docs/models/gpt-6-astra" target="_blank" rel="noopener noreferrer">Astra模型页&lt;/a>
和Anthropic的&lt;a href="https://www.anthropic.com/claude-fable-and-mythos-5-1" target="_blank" rel="noopener noreferrer">Fable 5.1发布说明&lt;/a>
给出了当前公开价格。&lt;/p>
&lt;table>
 &lt;thead>
 &lt;tr>
 &lt;th>每100万Token&lt;/th>
 &lt;th style="text-align: right">GPT-6 Astra&lt;/th>
 &lt;th style="text-align: right">Claude Fable 5.1&lt;/th>
 &lt;/tr>
 &lt;/thead>
 &lt;tbody>
 &lt;tr>
 &lt;td>普通输入&lt;/td>
 &lt;td style="text-align: right">$10.00&lt;/td>
 &lt;td style="text-align: right">$10.00&lt;/td>
 &lt;/tr>
 &lt;tr>
 &lt;td>5分钟缓存写入&lt;/td>
 &lt;td style="text-align: right">$12.50&lt;/td>
 &lt;td style="text-align: right">$12.50&lt;/td>
 &lt;/tr>
 &lt;tr>
 &lt;td>1小时缓存写入&lt;/td>
 &lt;td style="text-align: right">以OpenAI当前缓存规则为准&lt;/td>
 &lt;td style="text-align: right">$20.00&lt;/td>
 &lt;/tr>
 &lt;tr>
 &lt;td>缓存读取&lt;/td>
 &lt;td style="text-align: right">$1.00&lt;/td>
 &lt;td style="text-align: right">$0.25&lt;/td>
 &lt;/tr>
 &lt;tr>
 &lt;td>输出&lt;/td>
 &lt;td style="text-align: right">$50.00&lt;/td>
 &lt;td style="text-align: right">$50.00&lt;/td>
 &lt;/tr>
 &lt;/tbody>
&lt;/table>
&lt;p>Fable 5.1把缓存读取降到了基础输入价的2.5%。Anthropic称，相比Fable 5，典型工作负载成本约下降25%，复杂编码和高度Agent化任务最多可下降约45%。这些比例来自其2026年8月实际用量样本，具体账单仍由缓存命中率和输出长度决定。&lt;/p>
&lt;p>Astra缓存写入按普通输入的1.25倍计费。缓存读取是普通输入的10%，属于OpenAI当前公开费率。&lt;/p>
&lt;hr>
&lt;h2 id="-三种负载怎么算">🧮 三种负载怎么算&lt;/h2>
&lt;p>统一公式如下：&lt;/p>
&lt;div class="highlight">&lt;pre tabindex="0" style="background-color:#f8f8f8;-moz-tab-size:2;-o-tab-size:2;tab-size:2;">&lt;code class="language-text" data-lang="text">&lt;span style="display:flex;">&lt;span>总成本 = 普通输入Token × 输入单价
&lt;/span>&lt;/span>&lt;span style="display:flex;">&lt;span> + 缓存写入Token × 写入单价
&lt;/span>&lt;/span>&lt;span style="display:flex;">&lt;span> + 缓存读取Token × 读取单价
&lt;/span>&lt;/span>&lt;span style="display:flex;">&lt;span> + 输出Token × 输出单价
&lt;/span>&lt;/span>&lt;/code>&lt;/pre>&lt;/div>&lt;p>所有Token先除以1,000,000，再乘表中单价。以下示例只比较Token费用，工具调用、失败重试、区域加价和长上下文附加费另算。&lt;/p></description></item></channel></rss>