- とにかく安く → GPT-6 Luna。いちばん強い推論(max)にしても1タスク約11円で、Claude Haiku 4.5(約43円)より賢い(37点 対 17点)
- 値段と賢さのバランス → GPT-6.1 Sol(推論 high)。1タスク約50円で50点。Claude から選ぶなら Opus 5.5(medium)(約210円で51点)
- いちばん賢く → Claude Opus 5.5(max)。57.6点で全社トップ。1タスク約940円と安くはないが、最上位の Fable 5.1(max、約1,199円・53.4点)より安くて賢い
数字は2026年9月30日時点。単価・コンテキスト長は公式ページ(Anthropic の料金・モデル一覧、OpenAI の料金・モデル一覧)、賢さと1タスクあたりの費用は Artificial Analysis の計測値。円は1ドル=157.12円で換算。

単価だけでは実際の費用は比べられない
いまのモデルは、答える前に「考える」ぶんのトークン(思考トークン)も出力として課金されます。推論の強さを上げるほど、1問に使うトークンが増えます。Artificial Analysis の計測では、1タスクあたりの出力は Claude Opus 5.5(max)が約11.9万トークン、GPT-6 Astra(max)は約2.7万トークン。4倍以上の差があります。
わかりやすいのが Claude Sonnet 5.5 です。単価は Opus 5.5 のちょうど半分なのに、max では1タスクで約19.3万トークンを使うため、1タスク約1,195円と Opus 5.5(max、約940円)より高くつきます。同じ OpenAI の GPT-6 Astra と GPT-6.1 Sol は単価が5倍違い、実費も同じ強さどうしで4.5〜7倍違います。それでいて点数の差は1〜4点ほど。多くの用途では Sol で足ります。
上の図の横軸を「1トークンの単価」ではなく「1タスクあたりの実費」にしているのはこのためです。モデルを選ぶときは、モデル名だけでなく「推論の強さをどこに設定するか」までセットで考えるのが近道です。
早見表:単価・賢さ・読める長さ
| モデル | 入力 (100万トークン) | 出力 (100万トークン) | AA の点数 (最高値と推論の強さ) | 一度に読める長さ (トークン) |
|---|---|---|---|---|
| Claude Fable 5.1 | $10 | $50 | 53.4(max) | 100万 |
| Claude Opus 5.5 | $4 | $20 | 57.6(max) | 100万 |
| Claude Sonnet 5.5 | $2 | $10 | 56.0(max) | 100万 |
| Claude Haiku 4.5 | $1 | $5 | 16.9(思考あり) | 20万 |
| GPT-6 Astra | $10 | $50 | 52.7(max) | 105万 |
| GPT-6.1 Sol | $2 | $10 | 51.8(max) | 105万 |
| GPT-6 Luna | $0.1 | $0.5 | 37.3(max) | 105万 |
読み方のコツを3つ。
- GPT-6 Luna の単価は桁違いに安い(入力 $0.1、Claude Haiku 4.5 の10分の1)。ただし賢さは上位モデルと20点ほど差がある。
- 読める長さは OpenAI の3つが105万トークン(うち入力は92.2万まで)。ただし入力が27.2万トークンを超えると、入力は2倍・出力は1.5倍の料金になる。Anthropic は100万トークンまで同じ単価。
- Claude Opus 5.5 は、上位の Fable 5.1 より単価が安い(入力 $4 対 $10)のに AA の点数は上。Fable 5.1 は公式に「難しい推論と長時間の自律作業向け」とされ、別の物差し(下の表の ECI)では GPT-6 Astra に次ぐ2位につけている。
「1回いくら」に直すと
| モデル | ブログ記事を1本書かせる | 100ページの PDF を要約 | チャット100往復 |
|---|---|---|---|
| Claude Fable 5.1 | 58円 | 141円 | 677円 |
| Claude Opus 5.5 | 23円 | 57円 | 328円 |
| Claude Sonnet 5.5 | 12円 | 28円 | 222円 |
| Claude Haiku 4.5 | 5.8円 | 14円 | 111円 |
| GPT-6 Astra | 58円 | 141円 | 1,109円 |
| GPT-6.1 Sol | 12円 | 28円 | 164円 |
| GPT-6 Luna | 0.6円 | 1.4円 | 11円 |
前提は次のとおりです。
- ブログ記事: 指示と資料で入力2,000トークン、本文(日本語5,000字前後)で出力7,000トークン
- PDF の要約: 100ページ分の本文で入力8万トークン、要約で出力2,000トークン
- チャット100往復: 最初の指示2,000トークン、1往復で質問200・回答500トークン。毎回それまでの履歴を送り直し、履歴はキャッシュから読む(キャッシュ読み・書きの単価を使用)
- 思考トークンは入れていない。推論を強くすると、出力が上の数字の数倍になることがある(Artificial Analysis の計測では、同じモデルでも low と max で出力が4倍〜20倍以上違う)
- Claude(4.7 以降)は新しいトークナイザで、Anthropic によると同じ文章が約30%多いトークン数になる。同じ日本語でも、Claude 側はこの表より高めに出る可能性がある
チャットで GPT-6 Astra が高いのは、キャッシュから読む単価(100万トークンあたり $1.00)が Claude Fable 5.1($0.25)の4倍あるため。履歴を何度も読み直す使い方では、キャッシュ単価の差が効きます。
物差しを変えると1位が変わる
| 物差し | 何を測っているか | 全体の1位 | 今回のモデルの並び |
|---|---|---|---|
| Artificial Analysis Intelligence Index | エージェント作業・端末操作・科学計算のコード・難問(HLE)など10種のテストを同じ条件で走らせてまとめた点数 | Claude Opus 5.5(max)57.6 | Opus 5.5 → Sonnet 5.5 → Fable 5.1 → GPT-6 Astra → GPT-6.1 Sol |
| Epoch Capabilities Index(ECI) | 公開されている50以上のベンチマークを統計的に1本の物差しに並べ直した能力指数 | GPT-6 Astra 166.6 | GPT-6 Astra(166.6)→ Fable 5.1(165.0)。Opus 5.5・Sonnet 5.5・GPT-6.1 Sol はまだ載っていない |
| Arena(テキスト) | 人が2つの回答を見比べてよいほうに投票した結果から出すレーティング(文体の補正あり) | Claude Opus 5.5(high)1509 | Opus 5.5(1位)→ Fable 5.1(5位)→ GPT-6 Astra(26位)→ GPT-6 Luna(86位)→ Haiku 4.5(137位) |
3つとも「Anthropic か OpenAI の最上位クラスが1位」という点は同じですが、誰が1位かは物差し次第です。ECI では GPT-6 Astra が、AA と Arena では Claude Opus 5.5 がトップ。ただし Opus 5.5 は9月22日に出たばかりで ECI にはまだ載っておらず、Arena の順位も誤差の幅(±12)が大きめです。点差が数点なら「ほぼ同格」と読むのが無難です。
詳細表:キャッシュ・割引・最大出力・知識の締め切り
| モデル | キャッシュ読み (100万) | キャッシュ書き (100万) | 長い入力の料金 | 最大出力 (トークン) | 知識の締め切り |
|---|---|---|---|---|---|
| Claude Fable 5.1 | $0.25 | $12.50 | 100万トークンまで同額 | 12.8万 | 2026年6月 |
| Claude Opus 5.5 | $0.20 | $5 | 100万トークンまで同額 | 12.8万 | 2026年6月 |
| Claude Sonnet 5.5 | $0.20 | $2.50 | 100万トークンまで同額 | 12.8万 | 2026年6月 |
| Claude Haiku 4.5 | $0.10 | $1.25 | —(上限20万) | 6.4万 | 2025年2月 |
| GPT-6 Astra | $1.00 | $12.50 | 27.2万超は入力2倍・出力1.5倍 | 12.8万 | 2026年4月30日 |
| GPT-6.1 Sol | $0.10 | $2.50 | 27.2万超は入力2倍・出力1.5倍 | 12.8万 | 2026年4月30日 |
| GPT-6 Luna | $0.01 | $0.125 | 27.2万超は入力2倍・出力1.5倍 | 12.8万 | 2026年5月18日 |
既定の推論の強さはモデルごとに違います。Claude Opus 5.5・GPT-6.1 Sol・GPT-6 Luna は medium、Claude Fable 5.1・Sonnet 5.5 は high(GPT-6 Astra は公式ページに記載なし)。API でそのまま呼ぶと、上の図の medium か high の点あたりになります。
載せなかったモデル
- Claude Mythos 5.1: 招待制(Project Glasswing)で一般には使えないため
- GPT-6 Sol: 同じ単価で後継の GPT-6.1 Sol が出ており、AA の点数も 6.1 Sol が上のため
- Claude Opus 5 / Sonnet 5、GPT-5.6 / 5.5 系など: 公式にはまだ使えるが、各社の現行ラインナップ(モデル一覧の先頭)から外れているため
動画で見る
実際に同じお題を出して比べた動画です。点数だけでは見えない「クセ」がわかります。
参考文献
- Anthropic「Pricing」、「Models overview」(2026年9月30日閲覧)
- OpenAI「Pricing」、「Models」、各モデルページ(GPT-6 Astra・GPT-6.1 Sol・GPT-6 Luna)(2026年9月30日閲覧)
- Artificial Analysis(Intelligence Index v4.3.2、Cost per Task、Output Tokens per Task。2026年9月30日取得)。図は同サイトの数値をもとに当サイトが作成
- Epoch AI「Epoch Capabilities Index」(データは CC BY 4.0。2026年9月30日取得)
- Arena「Text Leaderboard」(2026年9月25日更新分)
- 為替: 欧州中央銀行(ECB)参照レート 2026年9月29日 1ドル=157.12円(Frankfurter 経由で取得)

コメント