Kvmzen ブログ
← 技術の実践に戻る

OpenAI DevDay 2026 後、AI API はどう選ぶ?OpenAI、Claude、Gemini のモデル価格・速度と Agent 能力の比較

AIDevelopment ·約 13 分

OpenAI DevDay 2026 後、AI API はどう選ぶ?OpenAI、Claude、Gemini のモデル価格・速度と Agent 能力の比較 - Kvmzen

DevDay の翌週、チャットに多いのは「Astra が勝った」ではない。OpenAI の Agents API、Anthropic の Fable キャッシュ単価、Google の Flash キャンペーン倒計時——コンソールのスクショが三枚重なる。同じ「管理画面にエクスポートを足せ」というチケットに、$10/$50 を貼る人と $0.75 を貼る人がいて、経理は月末が桁違いにならないかと聞く。

モデルページ、Agent ページ、席ページは、しばしば別の請求書だ。製品シェルの切り方は Claude Code、Codex、Gemini 3.8 Flash 比較;Astra 自身の壁時計と Token は GPT-6 Astra のコーディング実測。ここは API だけ:価格、速度、Agent 能力、そしてこの三つを単独で読めない理由。

$10/$50
旗艦帯のよくあるリスト価格(100万 Token あたり)
3
同時に開いておくコンソール
272K
Astra の長コンテキスト加算しきい値

この更新のあと、API は何枚の請求を比べているか

2026年9月の公開面では、少なくともこれだけ重なった。gpt-6-astra が API と Azure / Bedrock に入り、9月10日に Agents API がパブリックベータ(Codex harness をホスト、追加のインターフェース料なし、Token とツール課金)。Anthropic は Fable 5.1 のキャッシュ読みを $0.25 に下げ、Gemini 3.8 Flash は導入価格を 2026-12-31 まで掲げた。Agent Builder のキャンバスは 11月30日 に終了予定で、Agents SDK へ移す。

「どちらが賢いか」から始めない。先に請求の形を揃える:

帳簿 OpenAI Anthropic Google
モデル API Astra / Sol / Terra を Token 課金 Fable / Opus / Sonnet を Token 課金 Flash を Token 課金(席は別)
キャッシュ 読み $1、書き $12.50;272K 超はリクエスト全体に加算 Fable 5.1 読み $0.25 キャッシュ対応、単価は旗艦よりずっと安い
Agent ランタイム Agents API:サンドボックス、MCP、圧縮、サブ Agent Claude Code / Messages のツールループ Antigravity、Managed Agents
追加課金 Computer use はツール呼び出しごと;Fast は約 ×2 Opus Fast(プレビュー、Fable 対象外) 思考レベルとツール周回が Token を押し上げる

数字は 2026年9月 の公開リスト価格に揃えている。為替・税・キャンペーンは動く。発注前に公式ページを再確認する。

単価と、タスク1件のコストは同じか

100万 Token あたり(入力 / 出力):

モデル 入力 出力 キャッシュ読み リストを読むときに先に見るもの
Gemini 3.8 Flash(2026-12-31 まで) $0.75 $3.75 旗艦より大幅に安い 2027-01-01 から $1.50 / $7.50
GPT-5.6 Terra $2 $12 Codex / API の日常帯
Claude Sonnet 5 $2 $10 入力の 0.1× 多くのコーディングの既定の起点
GPT-5.6 Sol $4 $20 ひとつ前の旗艦
Claude Opus 5 $5 $25 入力の 0.1× Anthropic は「ほとんどの仕事はまずこれ」
GPT-6 Astra $10 $50 $1 272K 超:入力とキャッシュ約 ×2、出力約 ×1.5;Fast ×2
Claude Fable 5.1 $10 $50 $0.25 5分キャッシュ書き $12.50;1時間書き $20

中くらいのターンを 入力 80k + 出力 8k で雑に見ると、Flash 約 $0.09、Sonnet 約 $0.24、Terra 約 $0.26、Sol 約 $0.48、Opus 約 $0.60、Astra / Fable 約 $1.20。Agent は一発で終わらない。キャッシュヒット、思考レベル、ツール周回が、「Token 単価が安い」と「チケットが安い」をねじる。

同じ旗艦ステッカーでも、リポジトリの二度目の読みで請求が分かれる
Astra も Fable 5.1 も $10 / $50。長いセッションでは Anthropic がキャッシュ読みを $0.25(基価の約 2.5%)まで下げ、OpenAI のキャッシュ読みは $1 のまま。同じ大きなリポジトリを何度も貼ると、Fable 側は旗艦単価を回収しやすい。Astra 側は先に 272K のしきい値と Fast スイッチを抑える。

Flash の導入価格は旗艦ステッカーのおよそ十三分の一だが、「無料の Claude」ではない。Google は明記している:難しい仕事では 3.8 が推論ステップとツール周回を増やす。安い脳 + 密なツールでも、1件の Token は中位モデルに近づき得る。月次でサブスク、API、マシンをどう重ねるかは AI Coding Agent の月額は結局いくら

壁時計の速さは、どの段階のスイッチに隠れるか

三社とも「速い」をモデル名ではなく段階に隠している。

  • Astrareasoning.effort は low / medium / high / xhigh / max(none はない)。段階が上がるほど周回とブラウザ確認が増える。API の Fast は壁時計もリスト価格もおよそ 2 倍。発表ページの OSWorld 2.0:Astra 約 72.6% / 40 分、Sol 約 65.7% / 75 分
  • Fable 5.1:公式表では Opus 5、Sonnet 5 より 遅い。思考は適応型で既定は high。買っているのは長距離の判断であり、最初の Token ではない。
  • Flash:Flash 級の初回バイト。思考レベルは low / medium / high(minimal はエラー)。日常は effort を low にすると時計と Token が一緒に下がる。難しい仕事では自分で周回を足す。

最初の Token が速いことは、チケットが終わったことではない。Astra はキューと CI を先に緑にすることが多く、空状態は二周目になりやすい。Fable は UI とリスク説明の手戻りが少ないことが多い。同じプロジェクトでの打ち方は GPT-6 Astra vs Claude Fable 5.1:同じプロジェクトで比べる

Agent 能力:モデル、シェル、ホストされたランタイムを分ける

2026年に API を選ぶなら、少なくとも三層に分ける。

  1. モデル:正しい変更か、権限を越えないか、リポジトリをコンテキストに爆発させないか。
  2. シェル:Codex、Claude Code、Antigravity——権限、サンドボックス、MCP、サブ Agent の既定が違う。
  3. ホストされたランタイム:Agents API は Codex harness を一度の HTTP に載せる。サンドボックスか自前マシンかを選び、OpenAI がオーケストレーション、圧縮、復旧を担う。追加のインターフェース料はなく、Computer use などのツールは別課金。

OpenAI 側には摩擦がもう二つある。ツール呼び出しは Responses API が必要(Chat Completions では足りない)。本番のミスアライメント監視は確認ダイアログだけでなく、API タスクをその場で止めることがある。Astra の computer use は Agents' Last Exam と OSWorld の数字がよく、フォーム、CRM、ブラウザ QA 向き。サイバー能力は Critical に達し、防御寄りのレビューはできるが、高度な悪用系の依頼は拒否される。

Claude 側の長所は依然 MCP + キャッシュ経済 + 長距離の慎重さ。Gemini 側は 安いスループット + マネージド Agent だが、Code Assist / Enterprise の席とモデル請求は別行だ。Flash を Codex のような多バックエンドシェルに繋ぐのは、よくある「安い脳 + 成熟したループ」。

# 同じチケットのよくある分け方(唯一解ではない)
Flash / Terra / Sonnet     → 探り、テスト、読み取り専用のリポジトリスイープ
Sol / Opus                 → 公開 API を変え、diff を閉じる
Astra / Fable 5.1          → モジュール横断、一晩、成果物かキャッシュ
Agents API / Claude Code   → サンドボックスと再開が要るときだけホスト

陣営ではなく、タスクで組み合わせる

今やっていること まず試す API 帯
短いバッチ、マルチモーダル、文書スイープ Gemini 3.8 Flash、thinking=low
日常の API 変更、テスト追加、PR クローズ Sonnet 5 または Terra;必要なら Sol / Opus
モジュール横断のリファクタ、一晩 Agent Fable 5.1(キャッシュ)または Astra(computer use / 業務文書)
ブラウザのフォーム、デスクトップ操作、サイト QA Astra + Responses / Agents API
予測できる請求 安い既定 + API の月次キャップ。サブスクは壁で止まり、API は壁で課金する

対照表に書きにくいが、予算を貫通しやすい点:

  1. すでに ChatGPT Plus / Claude Pro を払っているのに、同じ Agent 用に上限なし API を開くのは二重計上。
  2. Astra Fast + 272K 超 は掛け算になる。「窓が大きいからリポジトリを貼ってよい」ではない。
  3. Agent Builder のワークフローは 11月30日までに Agents SDK へ移す。キャンバスを長期アーキテクチャにしない。
  4. 混用のほうが陣営より安いことが多い:難しいバグは一つのシェル、スループットは Flash、一晩はキャッシュに強い旗艦。
先に既定モデルを決め、旗艦は例外として書く
Sonnet / Terra / Flash をリポジトリの既定にし、Opus、Sol、Astra、Fable はモジュール横断か一晩のときだけ開く。全員を $10/$50 にしてから請求を削るより、経理ミーティングが一つ減る。

よくある質問

Astra と Fable 5.1 は同じステッカーだから、どちらでもよいか?
ステッカーは同じでも、コンテキストの二度目の読みが違う。長いセッションと繰り返しのリポジトリスイープでは、先にキャッシュ読みを見る。computer use、業務成果物、Codex / Agents API のできあい harness が要るなら Astra を見る。

Gemini 3.8 Flash を本番の既定にできるか?
スループットの既定にはできる。特に 2026年末までは。難しい仕事では自分で周回を足すので、1件が最安とは限らない。端末ループ、権限、MCP にはまだシェルが要る。個人向け Code Assist は締まっている。2025年の無料の印象で予算を組まない。

Agents API に今すぐ移るべきか?
クラウドのサンドボックス、セッション再開、自分で harness を育てたくないなら、パイロットの価値はある。追加のインターフェース料はないが、Token、ツール、タスクを止める監視はコストになる。Claude Code ですでに滑らかな長距離仕事を、DevDay に新しい API が出たからといって全員引っ越す必要はない。

API が安くても、蓋を閉じないマシンが要る

Token はクラウドで計算され、リポジトリ、テスト、MCP、サンドボックスは目の前のマシンで走る。ノートの蓋を閉じるとセッションが切れ、Prompt Cache が切れ、次の「続ける」は全量入力になる——Astra は 272K 超でリクエスト全体にも加算する。Mac mini の待機はおよそ 4W で、Agent を蓋の再起動ではなく、あなたのローリングウィンドウで動かせる。

Apple Silicon の統一メモリは大きなリポジトリの索引と並列テストに向く。macOS は Unix、Homebrew、Docker、SSH を備え、Codex、Claude Code、自前の Agents ループから WSL が一層減る。同価格帯の Windows 機よりクラッシュは少なく、無人運転は安定し、Gatekeeper と SIP が Agent を常時載せるリスクも下げる。

三社 API の単価とキャッシュをすでに削っているなら、マシンを落とさないことのほうが、旗艦をもう一段上げるより安いことが多い——プランを見る。お金は再ウォームアップではなく、コードを変えるほうに使う。

関連記事

期間限定オファー

1 台の Mac を超えた、クラウド上のあなたの開発基地

専有算力 · グローバルノード · 月額サブスクリプション · ハードウェア不要

ホームに戻る
期間限定オファー プランを見る