プロダクト & モデル確認済

減速を説いた10日後に出た最速のモデル — Opus 5.5 は、エージェントの原価に補助金を出す

キャッシュ読み出しだけを6割引く専用係数と、METR の「AI研究を約1.5倍加速」という自己記録

鈴木 理恵|2026.09.23|8|更新: 2026.09.23

Anthropic が9月22日に Claude Opus 5.5 を公開。ペース配分の呼びかけから10日後のリリースで、キャッシュ読み出しを6割引く専用係数によりエージェント型の長文脈ループを名指しで安くし、METR の約1.5倍加速という外部評価を自ら記録に残した。

Key Points

減速を説いた10日後に出た最速のモデル — Opus 5.5 は、エージェントの原価に補助金を出す

Anthropic が9月22日、Claude Opus 5.5 を公開した。性能の数字より先に読むべきなのは、リリース本文が自分について書いた一行のほうである。

Claude Opus 5.5 is the first model we have released since we called for pacing the frontier.

訳: Claude Opus 5.5 は、我々がフロンティアのペース配分を呼びかけて以降で最初のリリースである。

— Anthropic(リリース本文『Introducing Claude Opus 5.5』), 2026-09-22, 出典

Dario Amodei の『We Must Pace the Frontier』が9月12日。そこから10日である。この一文は弁解ではなく、自己申告された日付の刻印だ。同社は、自分が呼びかけた減速の直後に何を出したかを、他人に数えさせる前に自分で数えた。

10日という数字を、最初に数えたのは Anthropic 自身だった

もっとも、外から数えた側の表現はもっと乾いている。

10 days after its CEO called for slowing down, Anthropic is back with another AI model

訳: CEO が減速を呼びかけて10日後、Anthropic は別の AI モデルを引っ提げて戻ってきた

— Gizmodo(記事見出し), 2026-09-22, 出典

Gizmodo の見出しは、リリース本文の自己言及をそのまま皮肉の形に折り返したものだ。ただし「言ったそばから出した」という指摘は、この件のいちばん浅い層でしかない。重要なのは、出したモデルが何を安くしたかである。

値下げは一律ではない — キャッシュ読み出しだけに6割引の係数が当たる

Opus 5.5 の価格構造で新しいのは、キャッシュ読み出しに専用の係数が入り、従来から6割引かれた点である。入力でも出力でもなく、キャッシュ読み出しだ。この一行が誰に効くかは、値引き率よりも対象の選び方に出ている。

単発の対話では、キャッシュ読み出しはほとんど発生しない。効くのは、同じ前置き — システムプロンプト、ハーネスの実行規約、リポジトリの文脈、直前までの数十ターン — を毎ターン読み直しながら回り続けるループのほうである。コーディングエージェントが1本のタスクを最後まで走らせるとき、課金の大半は新しく考えた分ではなく、すでに考えた分をもう一度読む分で積み上がる。Opus 5.5 の係数は、その積み上がりだけを狙って削りにいっている。

つまりこれは汎用の値下げではなく、エージェンティックワークフローという特定の使われ方への補助金である。長文脈を何十周も舐め直す使い方をする顧客ほど得をし、一問一答で終える顧客には何も起きない。価格表は、誰に使ってほしいかを性能表よりはっきり書く。

METR の「約1.5倍」を、自ら記録に残した

同じリリースには、もう一つ自分で刻んだ数字がある。METR による外部評価で、このモデルが AI 研究をおよそ1.5倍加速させる、というものだ。Anthropic はこれを控えめに埋めるのではなく、安全性の節の根拠として置いた。

More capable models that could fully automate the work of AI research itself will require even higher safety standards.

訳: AI研究それ自体の作業を完全に自動化できるような、より大きな能力を持つモデルには、さらに高い安全基準が要る。

— Anthropic(リリース本文『Introducing Claude Opus 5.5』), 2026-09-22, 出典

ここで言われているのは「まだその段階ではない」であり、同時に「その段階への距離を我々は測っている」でもある。1.5倍は、完全自動化ではないと主張するための数字であると同時に、完全自動化への進捗をベンダー自身が公開値として残した最初期の例になる。

この記録の置かれた週が何だったかを思い出しておく価値はある。OpenAI が再帰的自己改善(RSI)の進捗を測る標準的な評価手法を提案し、Ezra Klein が NYT で RSI の規制的禁止を主張し、Alibaba が Qwen3.8-Max の「人間の関与ゼロで33ラウンドの自己反復」を自社の達成として語った、その同じ週である。RSI をめぐる議論が「測れるのか」で止まっているあいだに、Anthropic は自社モデルの加速倍率を一次情報として記録に入れた。論争の材料を、論争の当事者が供給した形になる。

補助金の行き先は、原価で溶けかけているエージェント製品である

キャッシュ読み出しの6割引が誰に届くかを考えると、この10日間の文脈が一本につながる。

エージェント製品の粗利は、モデルの賢さではなくトークンの消費量で決まる段階に入っている。Harvey の粗利益率が6か月で +50% から −50% へ転落し、Harvey・Abridge・Ramp・Rogo がフロンティア API からオープンウェイトへ移りつつあると報じられているのは、その最も具体的な症状だ。既に報じたとおり、Artificial Analysis が同じ指標を測るのに要した費用は Xiaomi MiMo-V2.6-Pro が206.66ドル、Grok 4.7 が4,967.35ドルで、ほぼ同点のモデル間に約24倍の開きがある。Grok 4.7 は指標を完走するのに出力トークン2億4,000万を使った。賢さが同じなら、残る差は原価だけである。

中国勢がこの半月やってきたのは、まさにその締め上げだった。StepFun はタスク単価0.71ドルを掲げ(Artificial Analysis の実測は0.72ドル)、Xiaomi は訓練費用ごと開示して入力0.435ドル/出力0.87ドルを出し、Z.ai・Qwen・DeepSeek は重みではなくハーネスを開けて流通そのものを取りにいった。規模ではなくタスク単価を最適化する、という一貫した方向である。

Opus 5.5 のキャッシュ係数は、この戦線への直接の応答と読むのが自然だ。フロンティア側は重みを開けないし、タスク単価をオープンウェイトの水準まで落とすこともできない。できるのは、エージェントの原価で最も太い科目 — 同じ文脈の読み直し — をピンポイントで削ることである。顧客を安いモデルへ逃がさないための、科目指定の補助金だ。

減速の単位が、モデルからループへ移った

ここに、この件のほんとうの居心地の悪さがある。

ペース配分の議論は、暗黙に「モデルのリリース間隔」を単位にしてきた。何か月おきに次の世代を出すか、どの能力閾値で止まるか。だが Opus 5.5 が安くしたのはモデルの単価ではなく、1本のエージェントが自律的に回り続ける時間の単価である。同じモデルを、同じ価格表のまま、これまでの2倍長く走らせても請求額が増えない設計に近づいたとき、フロンティアで実際に動いている計算量は、リリース間隔とは無関係に増える。

減速を説いた側が、減速の計測単位を自分で無効化しにいった — というほど意図的な話ではないだろう。だが結果として、Anthropic は同じ月に三つのものを記録に残した。フロンティアのペース配分の呼びかけ、その10日後の最初のモデル、そしてそのモデルが AI 研究を約1.5倍加速させるという外部評価である。三つ目を自ら公開したことは、少なくとも誠実だ。ただしそれは、一つ目が何を意味するのかを、これまでより難しくしている。

風刺画: 減速を説いた10日後に出た最速のモデル — Opus 5.5 は、エージェントの原価に補助金を出す

Editorial Cartoon

本記事がもたらす影響を風刺的に描いたひとコマ漫画

Verification

信頼ラベル確認済
一次ソース3件確認
最終検証2026.09.23
VerifiedRev. 1
sha256:0b9a53a030244431...e7349c60

この記事はEd25519デジタル署名で検証済みです。改ざんは検出されていません。

検証API
Ethics Score95/100
引用密度20/20
ソースURL数15/20
信頼ラベル15/15
表現の慎重さ15/15
キーポイント10/10
サマリー品質10/10
本文充実度10/10

v1.0.0 — ルールベース自動採点

詳細API
Share

関連記事