DevDay の翌週、チャットに多いのは「Astra が勝った」ではない。OpenAI の Agents API、Anthropic の Fable キャッシュ単価、Google の Flash キャンペーン倒計時——コンソールのスクショが三枚重なる。同じ「管理画面にエクスポートを足せ」というチケットに、$10/$50 を貼る人と $0.75 を貼る人がいて、経理は月末が桁違いにならないかと聞く。
モデルページ、Agent ページ、席ページは、しばしば別の請求書だ。製品シェルの切り方は Claude Code、Codex、Gemini 3.8 Flash 比較;Astra 自身の壁時計と Token は GPT-6 Astra のコーディング実測。ここは API だけ:価格、速度、Agent 能力、そしてこの三つを単独で読めない理由。
この更新のあと、API は何枚の請求を比べているか
2026年9月の公開面では、少なくともこれだけ重なった。gpt-6-astra が API と Azure / Bedrock に入り、9月10日に Agents API がパブリックベータ(Codex harness をホスト、追加のインターフェース料なし、Token とツール課金)。Anthropic は Fable 5.1 のキャッシュ読みを $0.25 に下げ、Gemini 3.8 Flash は導入価格を 2026-12-31 まで掲げた。Agent Builder のキャンバスは 11月30日 に終了予定で、Agents SDK へ移す。
「どちらが賢いか」から始めない。先に請求の形を揃える:
| 帳簿 | OpenAI | Anthropic | |
|---|---|---|---|
| モデル API | Astra / Sol / Terra を Token 課金 | Fable / Opus / Sonnet を Token 課金 | Flash を Token 課金(席は別) |
| キャッシュ | 読み $1、書き $12.50;272K 超はリクエスト全体に加算 | Fable 5.1 読み $0.25 | キャッシュ対応、単価は旗艦よりずっと安い |
| Agent ランタイム | Agents API:サンドボックス、MCP、圧縮、サブ Agent | Claude Code / Messages のツールループ | Antigravity、Managed Agents |
| 追加課金 | Computer use はツール呼び出しごと;Fast は約 ×2 | Opus Fast(プレビュー、Fable 対象外) | 思考レベルとツール周回が Token を押し上げる |
数字は 2026年9月 の公開リスト価格に揃えている。為替・税・キャンペーンは動く。発注前に公式ページを再確認する。
単価と、タスク1件のコストは同じか
100万 Token あたり(入力 / 出力):
| モデル | 入力 | 出力 | キャッシュ読み | リストを読むときに先に見るもの |
|---|---|---|---|---|
| Gemini 3.8 Flash(2026-12-31 まで) | $0.75 | $3.75 | 旗艦より大幅に安い | 2027-01-01 から $1.50 / $7.50 |
| GPT-5.6 Terra | $2 | $12 | — | Codex / API の日常帯 |
| Claude Sonnet 5 | $2 | $10 | 入力の 0.1× | 多くのコーディングの既定の起点 |
| GPT-5.6 Sol | $4 | $20 | — | ひとつ前の旗艦 |
| Claude Opus 5 | $5 | $25 | 入力の 0.1× | Anthropic は「ほとんどの仕事はまずこれ」 |
| GPT-6 Astra | $10 | $50 | $1 | 272K 超:入力とキャッシュ約 ×2、出力約 ×1.5;Fast ×2 |
| Claude Fable 5.1 | $10 | $50 | $0.25 | 5分キャッシュ書き $12.50;1時間書き $20 |
中くらいのターンを 入力 80k + 出力 8k で雑に見ると、Flash 約 $0.09、Sonnet 約 $0.24、Terra 約 $0.26、Sol 約 $0.48、Opus 約 $0.60、Astra / Fable 約 $1.20。Agent は一発で終わらない。キャッシュヒット、思考レベル、ツール周回が、「Token 単価が安い」と「チケットが安い」をねじる。
Flash の導入価格は旗艦ステッカーのおよそ十三分の一だが、「無料の Claude」ではない。Google は明記している:難しい仕事では 3.8 が推論ステップとツール周回を増やす。安い脳 + 密なツールでも、1件の Token は中位モデルに近づき得る。月次でサブスク、API、マシンをどう重ねるかは AI Coding Agent の月額は結局いくら。
壁時計の速さは、どの段階のスイッチに隠れるか
三社とも「速い」をモデル名ではなく段階に隠している。
- Astra:
reasoning.effortは low / medium / high / xhigh / max(noneはない)。段階が上がるほど周回とブラウザ確認が増える。API の Fast は壁時計もリスト価格もおよそ 2 倍。発表ページの OSWorld 2.0:Astra 約 72.6% / 40 分、Sol 約 65.7% / 75 分。 - Fable 5.1:公式表では Opus 5、Sonnet 5 より 遅い。思考は適応型で既定は
high。買っているのは長距離の判断であり、最初の Token ではない。 - Flash:Flash 級の初回バイト。思考レベルは low / medium / high(
minimalはエラー)。日常は effort を low にすると時計と Token が一緒に下がる。難しい仕事では自分で周回を足す。
最初の Token が速いことは、チケットが終わったことではない。Astra はキューと CI を先に緑にすることが多く、空状態は二周目になりやすい。Fable は UI とリスク説明の手戻りが少ないことが多い。同じプロジェクトでの打ち方は GPT-6 Astra vs Claude Fable 5.1:同じプロジェクトで比べる。
Agent 能力:モデル、シェル、ホストされたランタイムを分ける
2026年に API を選ぶなら、少なくとも三層に分ける。
- モデル:正しい変更か、権限を越えないか、リポジトリをコンテキストに爆発させないか。
- シェル:Codex、Claude Code、Antigravity——権限、サンドボックス、MCP、サブ Agent の既定が違う。
- ホストされたランタイム:Agents API は Codex harness を一度の HTTP に載せる。サンドボックスか自前マシンかを選び、OpenAI がオーケストレーション、圧縮、復旧を担う。追加のインターフェース料はなく、Computer use などのツールは別課金。
OpenAI 側には摩擦がもう二つある。ツール呼び出しは Responses API が必要(Chat Completions では足りない)。本番のミスアライメント監視は確認ダイアログだけでなく、API タスクをその場で止めることがある。Astra の computer use は Agents' Last Exam と OSWorld の数字がよく、フォーム、CRM、ブラウザ QA 向き。サイバー能力は Critical に達し、防御寄りのレビューはできるが、高度な悪用系の依頼は拒否される。
Claude 側の長所は依然 MCP + キャッシュ経済 + 長距離の慎重さ。Gemini 側は 安いスループット + マネージド Agent だが、Code Assist / Enterprise の席とモデル請求は別行だ。Flash を Codex のような多バックエンドシェルに繋ぐのは、よくある「安い脳 + 成熟したループ」。
# 同じチケットのよくある分け方(唯一解ではない)
Flash / Terra / Sonnet → 探り、テスト、読み取り専用のリポジトリスイープ
Sol / Opus → 公開 API を変え、diff を閉じる
Astra / Fable 5.1 → モジュール横断、一晩、成果物かキャッシュ
Agents API / Claude Code → サンドボックスと再開が要るときだけホスト
陣営ではなく、タスクで組み合わせる
| 今やっていること | まず試す API 帯 |
|---|---|
| 短いバッチ、マルチモーダル、文書スイープ | Gemini 3.8 Flash、thinking=low |
| 日常の API 変更、テスト追加、PR クローズ | Sonnet 5 または Terra;必要なら Sol / Opus |
| モジュール横断のリファクタ、一晩 Agent | Fable 5.1(キャッシュ)または Astra(computer use / 業務文書) |
| ブラウザのフォーム、デスクトップ操作、サイト QA | Astra + Responses / Agents API |
| 予測できる請求 | 安い既定 + API の月次キャップ。サブスクは壁で止まり、API は壁で課金する |
対照表に書きにくいが、予算を貫通しやすい点:
- すでに ChatGPT Plus / Claude Pro を払っているのに、同じ Agent 用に上限なし API を開くのは二重計上。
- Astra Fast + 272K 超 は掛け算になる。「窓が大きいからリポジトリを貼ってよい」ではない。
- Agent Builder のワークフローは 11月30日までに Agents SDK へ移す。キャンバスを長期アーキテクチャにしない。
- 混用のほうが陣営より安いことが多い:難しいバグは一つのシェル、スループットは Flash、一晩はキャッシュに強い旗艦。
よくある質問
Astra と Fable 5.1 は同じステッカーだから、どちらでもよいか?
ステッカーは同じでも、コンテキストの二度目の読みが違う。長いセッションと繰り返しのリポジトリスイープでは、先にキャッシュ読みを見る。computer use、業務成果物、Codex / Agents API のできあい harness が要るなら Astra を見る。
Gemini 3.8 Flash を本番の既定にできるか?
スループットの既定にはできる。特に 2026年末までは。難しい仕事では自分で周回を足すので、1件が最安とは限らない。端末ループ、権限、MCP にはまだシェルが要る。個人向け Code Assist は締まっている。2025年の無料の印象で予算を組まない。
Agents API に今すぐ移るべきか?
クラウドのサンドボックス、セッション再開、自分で harness を育てたくないなら、パイロットの価値はある。追加のインターフェース料はないが、Token、ツール、タスクを止める監視はコストになる。Claude Code ですでに滑らかな長距離仕事を、DevDay に新しい API が出たからといって全員引っ越す必要はない。
API が安くても、蓋を閉じないマシンが要る
Token はクラウドで計算され、リポジトリ、テスト、MCP、サンドボックスは目の前のマシンで走る。ノートの蓋を閉じるとセッションが切れ、Prompt Cache が切れ、次の「続ける」は全量入力になる——Astra は 272K 超でリクエスト全体にも加算する。Mac mini の待機はおよそ 4W で、Agent を蓋の再起動ではなく、あなたのローリングウィンドウで動かせる。
Apple Silicon の統一メモリは大きなリポジトリの索引と並列テストに向く。macOS は Unix、Homebrew、Docker、SSH を備え、Codex、Claude Code、自前の Agents ループから WSL が一層減る。同価格帯の Windows 機よりクラッシュは少なく、無人運転は安定し、Gatekeeper と SIP が Agent を常時載せるリスクも下げる。
三社 API の単価とキャッシュをすでに削っているなら、マシンを落とさないことのほうが、旗艦をもう一段上げるより安いことが多い——プランを見る。お金は再ウォームアップではなく、コードを変えるほうに使う。
