2026年8月2日(日) 更新: 2026-08-02

AI TIMES

エーアイ・タイムズ ・ JAPAN & WORLD
日本と世界のAIを、最速で。


AI相場

主要AIモデルのAPI価格を、各社の公式価格ページ・モデルドキュメントと逐語照合した一覧です。掲載値は標準・短コンテキスト(≤200K)の通常入出力料金で、キャッシュ・バッチ・優先処理・長コンテキスト割増は含みません。推測値は載せません(裏取り済みのものだけを表示します)。価格は頻繁に変わるため、毎日再照合します。

Model & Price Index — 全15件as of 2026-08-02
モデル入力 $/1M出力 $/1M文脈直近出典
Claude Fable 5 Anthropic
Anthropicの最上位・一般提供モデル(claude-fable-5、2026-06-09提供開始)。長時間の自律エージェント向けの最高性能。掲載は標準料金で、プロンプトキャッシュ書込$12.50/読出$1・US限定推論の1.1倍は別。2026-07-20からMax・Team Premiumプランの標準機能にも。 同価格・同スペックの Claude Mythos 5 は招待制(Project Glasswing)のため本表には載せない。
$10$501000K新規出典 ↗
Claude Opus 5 Anthropic
2026-07-24提供開始。Anthropicは「最上位 Claude Fable 5 のフロンティア級の知能に近づきながら価格は半額」と位置づける。価格は前世代 Opus 4.8 と同額(入力$5・出力$25)に据え置かれた=同じ支払いのまま性能だけ上がった形。Claude Maxの既定モデル、Claude Proで選べる最上位。Fast mode(既定の約2.5倍速)は基本料金の2倍。コンテキスト100万トークン・最大出力128kは公式のモデル比較表で確認。
$5$251000K新規出典 ↗
Claude Opus 4.8 Anthropic
2026-07-24に同額(入力$5・出力$25)の後継 Claude Opus 5 が提供開始。Anthropicは Opus 5 が Frontier-Bench v0.1 で Opus 4.8 の性能を2倍以上に伸ばしつつ1タスクあたりのコストは下がるとしており、同じ単価なら Opus 5 を選ぶ理由が強い。Opus 4.8 も引き続き提供中。
$5$251000K新規出典 ↗
GPT-5.6 OpenAI
既定の gpt-5.6(Sol)。標準・短コンテキストの通常料金。★GPT-5.6には3変種があり、下位2つ(Terra・Luna)は2026-07-31に値下げされた(本表に別行で掲載)。他社の比較表が「GPT-5.6 = $1/$6」と書いていることがあるが、それは値下げ前のLunaの価格で、現在のLunaは$0.2/$1.2、既定のSolは$5/$30(2026-08-01にOpenAI公式価格ページとモデルドキュメントの2箇所で再確認)。長コンテキストは倍額。
$5$301050K新規出典 ↗
GPT-5.6 Terra OpenAI
GPT-5.6の中位モデル。OpenAIが現地時間2026-07-30(JST 07-31)に値下げを発表・同日適用で $2.5/$15 → $2/$12(入出力とも20%減)。公式価格ページの表と gpt-5.6-terra のモデルドキュメント(1,050,000 context window)で逐語照合。
$2$121050K 入出力とも −20%(現地時間07-30改定)出典 ↗
Gemini 3.1 Pro Google
Vertex表記は Gemini 3.1 Pro Preview。入力≤200Kの通常料金(>200Kは入力$4/出力$18)
$2$121000K新規出典 ↗
Claude Sonnet 5 Anthropic
掲載値は今日課金される価格=導入価格の入力$2/出力$10。公式Pricingは同じモデルを期間で2行に分けており、『Claude Sonnet 5 through August 31, 2026』が$2/$10、『Claude Sonnet 5 starting September 1, 2026』が$3/$15。2026-09-01から標準価格$3/$15へ上がる(提供終了日・料金改定カレンダーに掲載)。★2026-07-28訂正: それまで当欄は未来の行の$3/$15を現在の相場として載せていた(照合器がモデル名だけを錨にしていたため毎日PASSしていた)。新トークナイザーで同じ文章でも約30%多くトークンを生成するため、実コストは単価ほど下がらない。
$2$101000K新規出典 ↗
Kimi K3 Moonshot AI
公式Pricing原文と逐語照合: kimi-k3 は1Mトークンあたり入力$3.00(キャッシュミス時)/キャッシュヒット時$0.30/出力$15.00、コンテキストは1,048,576トークン(表示は1,048K)。公式技術ブログは「2.8兆パラメータに達した初のオープンソースモデル」とし、完全な重みは2026年7月27日までに公開予定と明記。★正式な提供開始日は公式に明記がないため released は空のまま(推測を載せない)。参考として公式の「Kimi K3 Launch Top-Up Rebate」は2026-07-15(PDT)開始、技術ブログのベンチマークは2026-07-16時点の値。Claude Sonnet 5 の標準価格と同額の$3/$15。 ★2026-07-28 07:00 JST 再照合: 公式Pricingは入力$3.00(キャッシュヒット$0.30)/出力$15.00/1,048,576トークンから変更なし。★**重みが公開された**: Hugging Face 公式APIで moonshotai/Kimi-K3 が公開(private:false・gated:false)で存在することを機械確認。リポジトリの最終更新は 2026-07-27T16:29:18Z=**2026-07-28 01:29 JST**(米太平洋時間では07-27午前=予定日「7月27日」内)。safetensors 96分割・全118ファイル・blob合計約1,561GB、compressed-tensors 形式の量子化済みチェックポイント。config.json はマルチモーダル(vision_config あり・HFのpipelineは image-text-to-text)で、text_config は kimi_linear・93層・hidden 7168・experts 896(うちトークンあたり16+共有2)・max_position_embeddings 1,048,576(=公式Pricingのコンテキストと一致)。ライセンスは MIT 系の文面に**収益条項2つ**を足した独自の「Kimi K3 License」(Model as a Service事業で連続12か月の売上2,000万ドル超なら別途契約が必要/MAU1億人超または月商2,000万ドル超の商用製品ではUIに「Kimi K3」の表示義務)=OSI的な意味での無制限のオープンソースではない。★正式な提供開始日は公式に明記がないままなので released は空のまま(重みの公開日は提供開始日ではない)。参考として公式の「Kimi K3 Launch Top-Up Rebate」は2026-07-15(PDT)開始。Claude Sonnet 5 の標準価格と同額の$3/$15。
$3$151048K新規出典 ↗
Gemini 3.6 Flash Google
2026-07-21提供開始のGoogleの主力Flash(一般提供・入力1M/出力64k)。入力は3.5 Flashと同額だが出力は$9→$7.5と安い。Global/Non-globalの差が無い一律料金。Google自身は3.5 Flash比でトークン消費が最大17%減と説明(=単価に加え使用量でも下がる)。価格はVertex価格表とDeepMindモデルカードの2ソースで一致確認。
$1.5$7.51000K新規出典 ↗
Gemini 3.5 Flash Google
Vertex表記は Gemini 3.5 Flash。掲載はGlobalエンドポイントの標準料金(Non-globalは入力$1.65/出力$9.90)。2026-07-21に後継の Gemini 3.6 Flash ($1.5/$7.5) が出たため、同じ入力単価なら3.6 Flashの方が安い。
$1.5$91000K新規出典 ↗
Gemini 3 Flash Google
Vertex表記は Gemini 3 Flash Preview。音声入力は$1。
$0.5$31000K新規出典 ↗
Claude Haiku 4.5 Anthropic$1$5200K新規出典 ↗
Gemini 3.5 Flash-Lite Google
2026-07-21提供開始の最新Flash-Lite(一般提供・入力1M/出力64k)。掲載はGlobalエンドポイント(Non-globalは入力$0.33/出力$2.75)。前世代の3.1 Flash-Lite ($0.25/$1.5) より高いが、Google公表のコーディング評価では大きく上回る(=最安が欲しいなら3.1、性能なら3.5)。価格はVertex価格表とDeepMindモデルカードの2ソースで一致確認。
$0.3$2.51000K新規出典 ↗
Gemini 3.1 Flash-Lite Google
Vertex表記は Gemini 3.1 Flash-Lite。掲載はGlobalエンドポイントの通常料金(Non-globalは入力$0.275/出力$1.65)。音声入力は$0.5。コンテキスト1,048,576トークン。掲載11モデル中の最安。
$0.25$1.51000K新規出典 ↗
GPT-5.6 Luna OpenAI
★本表で最も安い。OpenAIが現地時間2026-07-30(JST 07-31)に値下げを発表・同日適用で $1/$6 → $0.2/$1.2(入出力とも80%減)。文脈長は上位のSolと同じ1,050,000トークンで、Gemini 3.1 Flash-Lite($0.25/$1.5)より入出力とも安い。公式価格ページの表と gpt-5.6-luna のモデルドキュメントで逐語照合。
$0.2$1.21050K 入出力とも −80%(現地時間07-30改定)出典 ↗

一次情報(公式価格ページ): anthropicopenaigoogle。掲載値は 2026-08-02 に照合。 円換算は 1USD=160.24円(欧州中央銀行(ECB)参照レート / Frankfurter API・2026-07-31公表)で計算。毎日取り直しています。実際の請求は各社・カード会社の換算レートによります。

この料金表の読み方 — 入力・出力・文脈の3項目

APIの料金は「入力(モデルに読ませる分=指示文や文書)」と「出力(モデルが生成する分)」で単価が分かれています。単位の $/1M は100万トークンあたりの米ドルです。多くのモデルで出力の単価は入力より高く設定されているため、長い文書を読ませて短い答えをもらう使い方は安く、短い指示で長文を書かせる使い方は高くつきます。

トークンは、モデルが文章を数える単位です。同じ内容でも言語やモデルのトークナイザーによって数が変わり、日本語は英語より多くなりがちです。モデルの世代交代でトークンの数え方自体が変わることもあり、その場合は単価の下げ幅どおりに実コストが下がらないことがあります(該当するモデルは表の注記に書いています)。文脈は1回のやり取りで扱える入力と出力の合計の上限で、200Kなら約20万トークン、1000Kなら約100万トークンです。

この表が載せるもの・載せないもの

掲載しているのは標準・短コンテキスト(入力200Kトークン以下)の通常入出力料金です。各社には、同じ前置きを再利用すると安くなるキャッシュ、非同期でまとめて処理すると安くなるバッチ、逆に高くなる長コンテキスト割増優先処理といった料金の階層もありますが、条件が多層で1枚の表に並べると誤読を招くため載せていません。正確な見積もりは各行の出典(公式価格ページ)で確認してください。

また、この表は公式ページと逐語照合できた値だけを載せます。裏取りできないモデルは掲載を見送ります(推測値を出すより、載せないほうが誠実だと考えています)。照合日は表の右上の as of に、直近の値動きは「直近」列に出ます。

価格帯での使い分けの目安

各社のモデルは、おおむね「最上位(フラッグシップ)・中位・軽量」の3つの価格帯に分かれます。Anthropic は Opus / Sonnet / Haiku、Google は Pro / Flash / Flash-Lite の順に、高性能・高単価から軽量・低単価になります。単価は帯の間で桁ちがいになることが多く、「すべてを最上位モデルで処理しない」ことがAPIコスト設計の基本です。

なお、この表が米ドル表記なのは各社の公式価格がドル建てのためです。円での目安は当日の為替レートを掛けて計算してください。

この価格で実際にいくら? — タスク1回あたりの試算

単価だけでは実感しにくいので、入力1万トークン・出力2千トークン(長めの文書を1本読ませ、要約や回答を1つ返す程度)のタスクを1回・1,000回動かしたときの概算費用を、上の表の単価から計算しました。安い順です。最上位モデルと最軽量モデルとで1タスクあたりの費用が桁で変わることが、金額で見るとはっきり分かります。

タスク1回あたりの費用(入力1万・出力2千トークン/安い順)as of 2026-08-02
モデル1回1,000回1,000回(円)
GPT-5.6 Luna OpenAI$0.0044$4.40¥705
Gemini 3.1 Flash-Lite Google$0.0055$5.50¥881
Gemini 3.5 Flash-Lite Google$0.0080$8.00¥1,282
Gemini 3 Flash Google$0.0110$11.00¥1,763
Claude Haiku 4.5 Anthropic$0.0200$20.00¥3,205
Gemini 3.6 Flash Google$0.0300$30.00¥4,807
Gemini 3.5 Flash Google$0.0330$33.00¥5,288
Claude Sonnet 5 Anthropic$0.0400$40.00¥6,410
GPT-5.6 Terra OpenAI$0.0440$44.00¥7,051
Gemini 3.1 Pro Google$0.0440$44.00¥7,051
Kimi K3 Moonshot AI$0.0600$60.00¥9,614
Claude Opus 5 Anthropic$0.1000$100.00¥16,024
Claude Opus 4.8 Anthropic$0.1000$100.00¥16,024
GPT-5.6 OpenAI$0.1100$110.00¥17,626
Claude Fable 5 Anthropic$0.2000$200.00¥32,048

※ すべてのモデルで同じトークン数と仮定した単純比較です。実際のトークン数は言語やモデルのトークナイザーで変わり(同じ文章でも日本語は英語より多く、Sonnet 5 は新トークナイザーで約30%多くなります=表の注記参照)、キャッシュ・バッチ・長コンテキスト割増などの割引・割増も含みません。正確な費用は各行の出典(公式ページ)で確認してください。

よくある質問

Q. この価格はどこから取っていますか?

A. Anthropic・OpenAI・Google(Vertex AI)の公式価格ページとモデルドキュメントです。掲載前に原文と逐語照合し、照合できた値だけを載せます。照合日は表の右上(as of)に表示しています。

Q. 実際の請求はこの表のとおりになりますか?

A. 概算の起点にはなりますが、そのままではありません。キャッシュやバッチで安くなる仕組み、長コンテキストや地域(エンドポイント)で高くなる料金があるモデルもあります(表の注記に記載)。正確な見積もりは各行の出典から公式ページで確認してください。

Q. なぜ円ではなくドル表記ですか?

A. 各社の公式価格が米ドル建てのためです。為替で毎日動く円換算を載せると、価格改定と為替変動の区別がつかなくなります。円の目安は当日のレートを掛けて計算してください。

Q. 入力と出力はどちらが高いですか?

A. 多くのモデルで、出力(モデルが生成する分)の単価が入力より高く設定されています。読ませる量が多く出力が短い用途ほど安く、短い指示で長文を生成させる用途ほど高くなります。