プロダクト & モデル報道

DeepSeek・Zhipu AI、LLM API価格を相次ぎ値上げ——Googleは半額値下げで対抗、2026年8月に価格戦争が転換点

DeepSeekは1カ月足らずで2度目、最大12倍の報道も。Zhipu AIは10%値上げでAnthropic追撃、Gemini 3.7 Flashは逆に半額投入

鈴木 理恵|2026.09.02|8|更新: 2026.09.02

DeepSeekが8月17日から全面値上げ、Zhipu AIも4月に10%値上げ。一方Googleは新型Geminiを半額投入し、LLM API価格は値上げと値下げが同時進行する局面に。

Key Points

Business Impact

API契約は単一ベンダー固定を避け、詩田LLM APIのようなマルチモデルゲートウェイで価格改定リスクを分散させる検討を今すぐ始めるべき。用途別に低コストモデルと高性能モデルを使い分ける「タスク別ルーティング」設計を四半期ごとに見直す体制を整えたい。

Featured Image

2026年8月、LLM API市場で価格改定が相次いでいる。中国DeepSeekは8月6日に全面値上げを予告し、8月17日から実施した。BigGoファイナンスによれば、これは7月中旬に導入したばかりの「ピーク時価格」戦略に続く、わずか1カ月足らずでの2度目の大幅な価格改定だ。関連報道では最大12倍という水準まで伝えられており、開発者向けの利用計画見直しを促す注意喚起も同社から出された。

中国DeepSeek、API全面値上げを予告 「大幅な上昇」、前回改定から1カ月足らず — BigGo ファイナンス
出典: BigGo ファイナンス
DeepSeek V4 と LLM API 価格の崩壊(2026年の実コスト)
出典: Pasquale Pillitteri

DeepSeek、7月31日の新版直後に値上げ予告

DeepSeekは7月31日にアップグレード版「DeepSeek-V4-Flash-0731」をリリースし、プログラミングとエージェントタスクの性能を強化した直後に値上げを発表した。米調査機関Artificial Analysisの標準化タスク評価によると、DeepSeek-V4-Flashの加重平均コストは約0.03ドル(約5円)で、Moonshot AI傘下のKimi K3(約0.86ドル)、OpenAIのGPT-5.6 Sol(約1.86ドル)、AnthropicのClaude Fable 5(約3.15ドル)と比べて依然として桁違いに安い。総合知能スコアではKimi K3が57点、DeepSeek-V4-Flashが50点と、価格優位性は性能面での妥協と表裏一体である点も見逃せない。別ソースの分析記事でも、DeepSeek-V4は100万トークンあたり0.87ドルというフロンティア級性能に対する破格の価格でAPI市場を揺さぶってきた経緯がまとめられている。

Zhipu AIも10%値上げ、狙いはAnthropicの背中

値上げは中国国内のもう1社にも及ぶ。Zhipu AI(智譜)は4月8日、最新モデル「GLM-5.1」の発表と同時にAPI価格を10%引き上げた。36Kr Japanによれば、コーディング用途の価格帯はAnthropicのClaude Sonnet 4.6に匹敵する水準まで上昇し、市場はこれを好感して株価は3日連続で上昇、4月10日終値ベースの時価総額は約4173億香港ドル(約8兆4767億円)に達した。張氏はAnthropicのARR(年間経常収益)が2024年の10億ドルから2025年に90億ドルへ急拡大し、2026年4月には300億ドルを突破した点に言及し、自社も同様の成長軌道を描けると強調している。単純な低価格競争から、コーディングとエージェンティックAIへの投資を軸にした収益モデル転換を模索する姿勢がうかがえる。

Googleは逆張り、Gemini 3.7 Flashを半額投入

値上げが相次ぐ中国勢とは対照的に、GoogleはGemini 3.7 Flashを年内半額の導入価格で公開した。ITmedia AI+によれば、直前のGemini 3.6 Flashなど3モデルでも出力トークンを削減しつつ値下げを実施しており、Googleは軽量モデルの低価格化を継続的な戦略として位置づけている。AI新聞の比較記事によれば、2026年6月時点の目安でGemini 3.1 Proは入力2ドル/出力12ドル、Gemini 3.5 Flashは入力1.5ドル/出力9ドルで、GPT-5.5の入力5ドル/出力30ドル、Claude Opus 4.8の入力5ドル/出力25ドルより低水準に位置する。OpenAIもGPT-5.6シリーズでSol(5/30ドル)、Terra(2/12ドル)、Luna(0.2/1.2ドル)と用途別の価格帯を細分化しており、単純比較が難しい多層構造になりつつある。

価格改定リスクをどう吸収するか

頻繁な価格改定は企業のコスト予測を難しくする。こうした中、複数モデルを単一APIキーで扱うゲートウェイサービスが選択肢として浮上している。BigGoファイナンスが報じた詩田の「LLM API」は、プラットフォーム手数料0%かつ全モデル一律10%引き、大口契約では最大30%引きを実現し、GPT-5.5やClaude Opus 4.8、DeepSeek-V4など主要モデルを1つのAPIキーで呼び出せる。稼働率はSLAで99.95%を保証し、ゲートウェイ経由の追加遅延も50ミリ秒未満に抑えるという。OpenRouterとの比較では手数料0%・10%引きという価格優位性を掲げており、各社の値上げ・値下げが交錯する局面でコストの平準化を図る需要が今後高まる可能性がある。

企業が今取るべき選択

DeepSeek-V4-Flashの約0.03ドルからClaude Fable 5の約3.15ドルまで、標準化タスクのコストには100倍以上の開きがある。この価格差は単純な「最安値選び」を誘発しがちだが、Intelligence Indexで見るとDeepSeek-V4-Flashは50点と上位モデルより9点以上低く、性能とコストはトレードオフの関係にある。企業は用途ごとに要求性能を定義し、問い合わせ分類のような軽量タスクには低コストモデルを、複雑な推論やコーディングには高性能モデルを充てるタスク別ルーティングの設計が不可欠になっている。あわせて、価格改定が数週間単位で起こり得る現状を踏まえ、契約形態や請求管理を柔軟に見直せる体制を整えることが、2026年後半のAPI活用における実務上の焦点となりそうだ。

Verification

信頼ラベル報道
一次ソース7件確認
最終検証2026.09.02
VerifiedRev. 1
sha256:791d64f0d5e8ea93...21cd9005

この記事はEd25519デジタル署名で検証済みです。改ざんは検出されていません。

検証API
Ethics Score97/100
引用密度20/20
ソースURL数20/20
信頼ラベル12/15
表現の慎重さ15/15
キーポイント10/10
サマリー品質10/10
本文充実度10/10

v1.0.0 — ルールベース自動採点

詳細API
Share

関連記事

Featured Image
プロダクト & モデル報道

AIエージェント大型アップデート相次ぐ——Oracle・Arent・LM Studio Bionicが示す『自律実行×統制』の新段階

日本オラクルはOracle AI Agent Studioで組み込みエージェント1000以上・顧客デプロイ7000超・認定エキスパート8万5536人を公表。ArentはRevit連携「LightningBIM AI Agent」で特許技術を発展させた自律タスク実行機能をベータ公開。LM Studio Bionicはv1.1.3で日本語UIに対応。3社に共通するのは自然言語での大規模タスク自律実行と統制・権限管理の両立という設計思想。

2026.09.19
Featured Image
プロダクト & モデル報道

Claude Mythos徹底解剖——SWE-bench 93.9%でも非公開、後継Fable 5・Mythos 5・Opus 5が示すAnthropicの段階解禁戦略

AnthropicのClaude Mythos PreviewはSWE-bench 93.9%等で歴代最高性能ながら、Firefox脆弱性成功率72.4%という危険性から一般公開されず約40組織限定で提供された。半年後、同一基盤を共有するFable 5・Mythos 5が一般提供され、続くOpus 5はFable 5の半額の価格でそれに迫る性能を実現した。

2026.09.18
Featured Image
プロダクト & モデル報道

RAG手法、2026年は「使い分け」の時代へ——Agentic RAG・GraphRAGが標準化、Gartnerは60%頓挫リスクを警告

2026年のRAGはAgentic RAG・GraphRAG・Multimodal RAGの使い分けが導入判断の中心に。Gartnerは AI-Readyデータ不備でAIプロジェクトの60%が頓挫と予測している。

2026.09.17