クロード氏が「頭が悪くなった」と認める:GPT-5.5のリリース後に3つの重大なバグが発覚

クロード氏、「頭が悪くなった」と認める GPT 5.5のリリース後に3つの重大なバグが発覚

ちょうど『』の発売時期に合わせて GPT-5.5, 、クロードはついにそれを認めた:

クロード、「頭が悪くなっている」と認める

はい、モデルの性能は「低下」し、すべての利用上限がリセットされました。.

1か月以上にわたる否定の末、ついに情報漏洩の不具合について、直接 アンソロピック それ自体:

  • 推論レベルが「高」から「中」へと静かに引き下げられた“
  • キャッシュのバグにより、毎ターン思考の痕跡が消去されてしまった
  • 25語というプロンプトの文字数制限が、出力の質を著しく低下させた

これら3つの不具合が重なったことで、クロードの全体的な体験は深刻な打撃を受けた。.

競合他社がちょうどいいタイミングでプレッシャーをかけてくれたのは幸いだった。「ユーザーを教育する」という試みは、明らかにうまくいかなかっただろう。.

とはいえ、バグの修正はいつでも良いことだ。ただ……そのタイミングが怪しい。GPT-5.5がリリースされた途端、突然クロードが「敗北を認めた」のだ。“

5.5はデバッグの助けになりましたか?

ダリオ……まさか、GPT-5.5のリリースに合わせて逆転劇の伏線を作るために、わざとクロードの性能を下げたわけじゃないよね?

クロードのパフォーマンス低下の原因として確認された3つの不具合

まず、これは初めてのことではありません。.

昨年8月、AnthropicはOpus 4.0および4.1に関する同様の事後分析を公開し、そこでも「モデルの品質を低下させるつもりは全くなかった」と述べていた。“

今回、新たに公開された事後分析のタイトルは “「最近の3つの号に関する事後分析」”

“「最近」という点が重要です――単に「今」だけでなく、過去一定期間にわたってのことです。.

地域の人々はすでに気づいていた

クロードの容態が悪化していることは、しばらく前から広く話題になっていた。.

10日以上前、AMD AI部門のシニアディレクターであるステラ・ローレンゾ氏が、GitHubに詳細な監査報告書を公開しました:

AMDのAI担当シニアディレクター、ステラ・ローレンゾ氏がGitHubに詳細な監査報告書を公開した
  • 6,852件の会話
  • 17,871個の推論ブロック
  • 230,000回以上のツール呼び出し

調査結果:2月以降、推論の深さが急激に低下した。.

より詳細な観察結果:

  • クロードは次第に……に陥り始めた 推論ループ
  • 同社はますます 最も簡単な解決策, 、正しいものではありません

一方、BridgeMind社のBridgeBenchベンチマークでは、次のような結果が示された。 作品4.6 精度は83.3%から68.3%へと低下し、順位は#2から#10へと下がった。.

BridgeMind社のBridgeBenchベンチマークによると、Opus 4.6の精度は83.3%から68.3%へと低下し、順位は#2から#10へと下がった。.

その方法論は後に批判されたものの、その説は定着してしまった:

クロードはどんどんバカになってきている。.

人々は、ある用語まで作り出した―― AIによるシュリンクフレーション. 価格は同じだが、成分が薄められている。.

つまり、ユーザーはまるで「キッズメニュー」を注文したような気分になったのです。“

3つのバグについて解説

推論レベルの静かな低下

3月4日、クロード・コードの債務不履行 推論レベル 遅延に関する懸念から、「高」から「中」に引き下げられました。.

しかし、UIには依然として「高」と表示されていた。“

ユーザーはフルパワーで利用していると思っていたが、実際には機能制限版だった。.

この状態は1か月以上続いた後、元に戻された。.

話せば話すほどバカになっていく

3月26日、キャッシュの最適化が導入されました:

  • 意図:1時間操作がない場合、以前の推論を消去する
  • 実際:バグの影響で、データが消去されてしまいました すべてのターン

結果

  • クロードは働き続けたが、自らの目標を忘れてしまった
  • 症状:物忘れ、同じことを繰り返す、道具の使い方が乱雑

さらに悪いことに:

推論結果が絶えず消去されていたため、キャッシュがヒットすることがなく、トークンの使用量が急増した。.

修理には15日かかりました。.

たった1行のプロンプトで出力の質が著しく低下した

4月16日、システム指示が追加されました:

  • ツール呼び出し間の単語数は最大25語
  • 最終回答は100語以内に限ります

影響:

4月:自業自得のトラブルの連続

タイムラインを見てみると、4月は単なる不具合にとどまらず、一連の疑問の残る動きがあった。.

4月4日 — サードパーティ製ツールのブロック

Anthropicは次のようなツールの利用をブロックしました OpenClaw Pro/Maxのサブスクリプションの利用から。.

引き続きご利用になりたいですか?API課金に切り替えてください。.

4月21日 — 目立たない価格改定

Claude Code が削除されました 「Proプラン」のページから。.

サポートドキュメントが以下から変更されました:

  • “「Pro または Max」→「Max のみ」”

批判が巻き起こった後、グロース部門責任者のアモル・アヴァサレ氏は、これは単なる「2%」のA/Bテストに過ぎないと主張した。.

問題:変更はサイト全体に及んだ。.

数時間以内に元に戻されました。.

価格設定の現実

  • プロ:$20/月 → $240/年
  • 最大5倍:$100/月 → $1200/年(5倍増)
  • 最大20倍:$2400/年(10倍増)

中間層はありません。.

4月23日 — 事後検証と「補償」“

その見返りとは? 利用枠のリセットです。.

一部のユーザーからは次のような指摘がありました:

それは、Opus 4.7のリリース時にすでに起きていました。.

つまり、この「補償」は、基本的には単なる通常のサイクルリセットに過ぎなかったのです。.

ユーザーはそれを信じていない

反応は賛否両論だ。.

ある人はこう言います:

  • 不具合はつきものです
  • 事後検証は透明性が高い
  • ボリス・チェルニーはHacker Newsで積極的に反応した

また、別の問題に注目する人々もいます:

2ヶ月間の沈黙

  • 公式な発表はない
  • Xでは散発的な返信しか見られない
  • 一貫性のないメッセージ

「キャッシュの最適化」に対する疑念“

一部の人々は、このタイミング(キャッシュの有効期限と一致していること)が以下のことを示唆していると見ている:

レイテンシの最適化ではなく、コスト削減です。.

A/Bテストへの反発

ユーザーごとに異なる製品構成が、何の前触れもなく提供されました。.

信頼は再び打撃を受けた。.

移住はすでに始まっている

Hacker Newsで見られる興味深い傾向の一つ:

「移住の体験談」を語る人々。“

ある人は、無意識のうちに コーデックス 2月のことだが――クロードの衰えが彼らをそうさせたのかもしれないと、今になって気づいた。.

また、GPT-5.4はすでにOpus 4.6を上回る性能を発揮しているという声もある。.

中には、MiniMaxをサプリメントとして摂取している人もいます:

  • $40 → 5時間サイクルあたり4500件のメッセージ
  • 推論の完全な可視性

風景は一変した

6か月前、「コーディングにはClaudeを使う」というのが、ほぼ共通認識となっていた。.

現在:

  • Codexのアクティブユーザー数は400万人と報じられている
  • GPT-5.5は、コーディングとコンピュータ操作に重点を置いています
  • OpenAIのスタッフは、これを「参謀長」モデルとさえ表現している

クロードの容態が必ずしも悪化したわけではない。.

他の選手たちは調子を上げた――その一方で、クロードは最悪のタイミングでつまずいてしまった。.

ウィンドウが小さくなっている

Anthropicは現在、以下のことを行うための時間が以前よりも少なくなっています:

  • バグを修正する
  • 信頼を取り戻す

一方:

  • GPT-5.5はすでにリリースされています
  • DeepSeek V4 準備が整いました

そして、人々は待っている:

ジェミニ、次は君の番だ。.

上部へスクロール