開発者を失望させる650億ドルのモデル
Anthropicの財務状況は紛れもなく順調であり、2026年7月末時点での年間収益ランレートは650億ドルを超えたと報じられている。Claude Codeはプロのワークフローに深く浸透しているが、この巨大な成功の裏には重大な欠陥が隠されている。それは、2026年7月にリリースされた「Claude Opus 5」の不調である。このフラッグシップモデルは飛躍的な進化を約束していたが、多くの開発者に失望をもたらした。
AnthropicはOpus 5のベンチマーク性能を誇示し、コーディングテスト「Frontier-Bench」ではOpus 4.8の2倍以上、ARKGIA3では競合他社の3倍のスコアを達成したと主張した。こうした統計は比類なき知能を印象づけた。しかし、T3 chatのCEOであるTheo Brown氏のような開発者にとって、現実は全く異なるものだった。Brown氏はOpus 5を日常業務において「ひどい」と評し、冗長で過剰に設計されており、些細な問題を大規模な書き直しに発展させがちだと指摘した。Code Rabbitのレビューテストでも、ベースラインよりも既知の問題を検出できず、価値の低い指摘が4倍も多く生成されることが確認された。
この乖離は、「ベンチマーク上の知能」と「実用的な判断力」の間に明白な隔たりがあるという根本的な問題を露呈している。Opus 5は構造化された定義済みのテストでは優れているが、初期のClaudeバージョンを人気たらしめていた微妙で実用的な要求には対応できていない。純粋な問題解決能力は明らかだが、現実のシナリオにおける判断力の欠如が、同社がターゲットとする開発者を遠ざけ、Anthropicが切実に必要としている信頼を損なっている。
デジャヴ:「秘密のナーフ」の再来
Opus 5の混乱したローンチは孤立した出来事ではなく、Anthropicの過去の痛ましい反響であった。数ヶ月間、開発者たちは自分たちが対価を支払っているモデルの安定性と実際の知能に疑問を抱いており、この問題は最新のリリースよりもずっと前から始まっていた。このような密かな性能低下のパターンが信頼を著しく損なっており、現在の反発は予測可能な結果であった。
ユーザーがこの「秘密のナーフ」現象を最初に経験したのは3月のことである。Anthropicは「Claude Code」のデフォルトの推論負荷を「高」から「中」に密かに変更した。後に同社は、これがより高速な応答のために「わずかに知能を低下させた」ものだと認めた。これは単なる設定変更ではなく、有料顧客に対する製品能力の根本的な変更であった。
さらに問題を複雑にしたのは、別の「キャッシュバグ」により長時間のセッションでClaudeが物忘れをし、ユーザーが何度も作業の文脈を再入力せざるを得なくなったことである。その後、応答を短縮するためのシステム指示が意図せず「コーディング能力の3%低下」を引き起こした。Anthropicはこれらをモデルの直接的なナーフではないと主張したが、ユーザーにとっての実質的な結果は同じであり、アシスタントの能力が低下したことに変わりはなかった。
Anthropicは技術的にはAPIの安定性を主張し、モデルの「ナーフ」を否定している。しかし、隠れた製品レイヤーが明らかにパフォーマンスを低下させている状況では、こうした意味論的な区別は何の慰めにもならない。開発者にとって結論は明白である。技術的な説明がどうであれ、繰り返し劣化した体験を提供する企業は、無条件の忠誠を得る権利を失うということである。
「安全性」が「不安定さ」と感じられるとき
AnthropicはOpus 5を世代を超えた飛躍と謳っていますが、モデル名そのものは一貫したエクスペリエンスを保証するものではありません。Anthropic自身のドキュメントでも、Claude、Claude Code、またはClaude Cowork内でフラグが立てられた特定のサイバーセキュリティ関連のリクエストが、Opus 4.8にフォールバックされる可能性があることを認めています。その他の安全性や生物学に関するクエリも、内部分類器に応じてFable、Opus、および旧モデルの間でルーティングされます。
これは秘密ではなく、Anthropicはこのシステムを公表しています。しかし、これは「同じ」モデルを選択した2人の顧客が、プロンプトを変更しなくても全く異なる機能を受け取る可能性があることを意味します。さらに、単語の選択に影響を与える微妙なテキストのウォーターマーキングが加わることで、Claudeは安定した製品というよりも、Anthropicがその時々の内部優先順位に基づいて絶えず作り変える流動的なサービスのように感じられます。
Anthropicの「責任あるAI」への絶え間ない追求がこれらの選択の根底にあり、この企業姿勢が7月までに年間収益ランレートを650億ドル超に押し上げる原動力となりましたAnthropicは投資家に対し、7月の年間収益ランレートが650億ドルに達したと伝えています。しかし、このコントロールへのコミットメントは、どれほど崇高であっても、予測可能性を直接的に犠牲にしています。ユーザーは、絶えず変化するターゲットのように感じられるAIに対してプレミアム価格を支払っており、これがエンタープライズ導入に不可欠な根本的なユーザーの信頼を損なっています。
この記事が気に入ったら、毎朝同じようなものをメールで受け取れます。
1日1通 · 2クリックで解除 · サードパーティのトラッキングなし
出口は混雑しつつある
2026年7月までに報告されたAnthropicの650億ドルの年間収益ランレートは財務的な勝利を物語っていますが、この成功はより深い脆弱性を隠蔽しています。競争の激しい市場では、OpenAI、Google、XAIから、強力で多くの場合より安価な代替手段が提供されています。豊富な選択肢を持つ開発者は、一貫した結果を出せないプレミアム価格のモデルに対して忍耐力を持ち合わせていません。
Opus 5の高額なトークン単価(入力100万トークンあたり5ドル、出力100万トークンあたり25ドル)は問題の一部に過ぎません。Code Rabbitによる独立した分析では、Opus 5は同等のレビュー作業において、GPT 5.6のベースラインと比較して約50%多くの入力トークンと65%多くの出力トークンを消費することが明らかになりました。この非効率性は実質的なコストを大幅に引き上げ、Anthropicの製品を本番ワークフローにとって法外に高価なものにしています。
Anthropicの収益は堅調を維持していますが、これは遅行指標であり、開発者の信頼という極めて重要な競争において決定的に敗北しつつあります。リスクは突然の崩壊ではなく、静かで陰湿な移行です。かつてClaudeに深く組み込まれていたワークフローは、信頼性、予測可能性、費用対効果を提供する競合他社へと着実にシフトしています。この緩やかな出口は、急速に混雑しつつあります。
よくある質問
Claude Opus 5に関する主な不満は何ですか?
強力なベンチマークスコアにもかかわらず、多くの開発者はClaude Opus 5が冗長で遅く、実際のコーディングタスクに対して過剰に設計されていると感じており、単純な問題を複雑な書き換えに変えてしまったり、以前のバージョンよりもパフォーマンスが低下したりすることがよくあります。
なぜユーザーはAnthropicへの信頼を失いつつあるのですか?
Opus 5の問題は、Claude Codeのデフォルトの推論能力を低下させるなど、パフォーマンスに悪影響を及ぼした過去の事前告知なしの変更に続くものです。このパターンにより、開発者は製品が不安定であり、モデル名が必ずしも一貫したエクスペリエンスを保証するものではないと感じるようになっています。
Claude Opus 5は競合他社よりも高価ですか?
はい。Opus 5のAPI価格は、OpenAIのGPT-5.6 SolやGoogleのGemini 3.7 Flashといった競合他社よりも高価です。テストでは、同じタスクに対して大幅に多くのトークンを消費する可能性があり、ユーザーの総コストをさらに押し上げることが示されています。
動画で言及されている「秘密のナーフ(secret nerfs)」とはどういう意味ですか?
この用語は、ユーザーが認識するClaudeのパフォーマンス低下を指します。Anthropicはコアモデルを意図的に弱体化させたことは否定していますが、アプリケーションレベルの変更によりユーザー体験が低下したことは認めており、数週間にわたる苦情の後にようやく修正されました。

