最終更新2026年8月25日 06:16

OpenAIのGPTは劣化か割当変更か

ゆっくり解説のmatcha氏が24日夜、「GPTものすごく性能落ちてないか」と投稿し、約59万閲覧まで広がった。体感の劣化だとする声と、選んだ上位型が無通知で小型へ振り分けられているのだとする声、課金面では変わらないとする声が割れている。

拡散の起点2026-08-24 21:52

性能が落ちていないかと拡散

matcha氏の一文が約59万閲覧、引用32件まで伸び、Claudeの不調と並べて読む流れになった。

期間24日夜の起点から25日未明

信頼度中〜高(公式の説明は見つかっていない。振り分けは利用者の自己申告)

ポジティブ23%
中立16%
ネガティブ61%

GPT性能低下の起点

  1. そーくん

    ゆっくり解説のmatchaさんが、GPTものすごく性能落ちてないかと書いてます。

  2. ボス

    24日夜の短い投稿が約59万閲覧まで伸びた。公式の説明はこの窓では出ていない。

  3. そーくん

    18日頃から応答が浅いという後追いも、夜の引用に混ざってるみたいですね。

  4. ボス

    Claudeの不調と並べて読む流れにもなった。起点のあと何が乗ったかを見よう。

  5. そーくん

    変わらない側も未明まで残ってるなら、単発の障害話では終わらないですね。

  6. ボス

    だから先に時系列を置こう。拡散の起点から、否定も冗談も残る未明までだ。

何が起きたか

  1. 2026-08-18 前後

    応答が浅いとの体感が先行

    分析を頼んでも共感や謝罪だけが返る、18日前後からおかしい、という後追いが夜の引用に混ざった。公式発表は確認できていない。

  2. 拡散の起点2026-08-24 21:52

    性能が落ちていないかと拡散

    matcha氏の一文が約59万閲覧、引用32件まで伸び、Claudeの不調と並べて読む流れになった。

  3. 2026-08-24 夜

    小型への振り分け説が出る

    いまの型は何かと聞け、5.5の小型だと答えることがある、SolやLunaの推論費を下げた副作用だ、という説明がリプと引用に並んだ。

  4. 2026-08-25 未明

    変わらない側も残る

    課金面は精度が良い、いつも通りおしゃべり、という否定と、君の性能が上がったんだよという冗談が未明まで残った。

劣化か振り分けかが主戦場

  1. そーくん

    性能そのものが落ちたのか、選んだ上位型が裏で入れ替わったのか、どっちなんですか。

  2. ボス

    そこがいまの主戦場だ。どちらも『前と違う』という体感は共有したまま割れている。

  3. そーくん

    Claudeも同じ時期に重いという並びは、GPT固有の変化と混ざりませんか。

  4. ボス

    同時刻だと余波と混線しやすい。主流の見方と、それ以外の見方を分けて見よう。

議論の現在地

主流派の視点
体感の劣化か、上位型を選んでも小型へ回される無通知の振り分けか、が主戦場になっている
その他の視点
  • Claudeも同じ時期に重い・おかしいという併記
  • 推論費を下げた副作用だという技術仮説
  • 無料と有料で体感が分かれる
  • 他社へ移れという案内が宣伝と混ざる
目立つ論者
  • 日常利用の動画・解説勢
  • 型名を自己確認する利用者
  • Claude併用の開発者
  • 課金面では変わらないと書く人

否定が半分を超える割れ方

  1. そーくん

    落ちた側が多いのは分かりますが、全員が同じ理由で怒ってるわけじゃないですよね。

  2. ボス

    否定は50から72%と厚い。ただ変わらない側と、公式待ちの様子見も残っている。

  3. そーくん

    同じ使えないでも、劣化したのか振り分けなのかで、陣営が分かれるんですね。

  4. ボス

    シェアはレンジで見る。どの言い分がどれだけ厚いかを、先に分布で置こう。

  5. そーくん

    課金面では落ちてない側が14から24%あるなら、単一の炎上としては読めないですね。

  6. ボス

    否定が厚いのは事実だ。ただ中の割れ方を見ないと、空気だけが全体に見える。

世論の分布

意見陣営別シェア(推定レンジ)

Xサンプル上の可視的な言論に占める割合 · 下限—上限

  • 劣化実感派32–44%
  • 割当変更派18–28%
  • 体感差なし派14–24%
  • 原因検証派12–20%
推定下限推定上限

ポジティブ / 中立 / ネガティブ 集計

陣営をスタンス別に統合 · 中央値19を最大側で吸収し合計100

23%
16%
61%
ポジティブ 14–24%(体感差なし派)中立 12–20%(原因検証派)ネガティブ 50–72%(劣化実感派、割当変更派)
テーブルビュー(グラフと同じデータ)
陣営スタンスシェア中心的主張
劣化実感派ネガティブ32–44%重く浅い。分析を頼んでも共感や謝罪だけで、以前できたことができなくなった(@matcha_500ml@HANAMURA__KAEDE@start1weet)
割当変更派ネガティブ18–28%劣化ではなく、選んだ上位型が無通知で小型へ回されている。聞けば一発で分かる(@MokoMokoDonDonP@Cyberonin105@mori_kamiyama)
体感差なし派ポジティブ14–24%使い方や課金面では落ちていない。いつも通り返し、推論だけ見る分には変わらない(@turkey_jp@manuke_tarou@kyuurineko222)
原因検証派中立12–20%後続型の準備で出力を絞っている可能性はある。公式が出るまで型名の自己確認が先(@pokosan95556145@urawazakun)

同じ体感でも原因が割れる

  1. そーくん

    劣化か振り分けかと、無料と有料で体感は分かれるか。争点は2つありますね。

  2. ボス

    どちらも『前と違う』では一致している。原因の置き方だけが噛み合っていない。

  3. そーくん

    課金しても小型並み、という声があると、無料だけの話では済まないですね。

  4. ボス

    A側とB側の言い分を先に並べよう。どこで話がすれ違っているかが見える。

進行中の論争

論点1

性能低下は劣化か振り分けか

A側 · 劣化

同じ頼み方が通じない。重く、見当違いで、修正も入らない

B側 · 振り分け

型を聞けば小型だと答える。上位を選んでも裏で回されている

根拠: matcha氏の起点と、「いまの型は?」と聞けというリプ

論点2

無料と有料で体感は分かれるか

A側 · 分かれる

課金面は精度が良い。落ちているのは無料や薄い経路だ

B側 · 共通

Solでも小型並みまで落ちている。課金でも無通知の振り分けがある

根拠: 課金なら良いという引用と、Solが小型レベルだという投稿

主なポスト

matcha_500ml@matcha_500ml·拡散の起点GPTものすごく性能落ちてないか一文で約59万閲覧まで伸び、夜の性能議論の土台になった
HANAMURA__KAEDE@HANAMURA__KAEDE·体感の追認なんかここ2、3日クソ重くないですか?起点直後に重さの体感を足し、劣化派の初期リプになった

編集部まとめ

4つの読みが並んでいる

  1. そーくん

    ここまでの話を踏まえると、落ちたでまとめるのがいちばん危ない感じがします。

  2. ボス

    単一の劣化として読むと、無料と有料、会話と推論の差が全部消えてしまう。

  3. そーくん

    劣化実感派は、分析を頼んでも共感や謝罪だけで、以前できたことが消えた、と。

  4. ボス

    同じ頼み方が通じない、修正も入らない。能力そのものが落ちた、という読みだ。

  5. そーくん

    割当変更派は、劣化じゃなくて上位型が小型へ回されてる、と見てますよね。

  6. ボス

    型を聞けば小型だと答える、という。落ちたのではなく、回されたという読みだ。

  7. そーくん

    体感差なし派は、課金面やおしゃべりはいつも通りで、落ちてはいないと言う。

  8. ボス

    推論だけ見る分には変わらない、という。使う面によって体感が分かれる前提だ。

  9. そーくん

    原因検証派は、後続型の準備で出力を絞ってる可能性もある、と見てますね。

  10. ボス

    公式が出るまで型名の自己確認が先、という。結論を急がず、確認手順を置く側だ。

  11. そーくん

    なんで同じ『前と違う』という体感なのに、ここまで読み方が割れるんですか。

  12. ボス

    利用者からは中の振り分けが見えない。残る手がかりが体感と自己申告だけだからだ。

  13. そーくん

    じゃあ記録を持ってない側は、原因を確定する材料が最初からない、ということですか。

  14. ボス

    だから劣化か振り分けかが、同じ材料の上で並んだまま、どちらも確定できない。

型名の自己申告は証拠か

  1. そーくん

    型は何かと聞いて5.5の小型と出るなら、振り分けの証拠になると思ってました。

  2. ボス

    自己申告は、型が本当に切り替わった証拠にはならない。文章を生成しているだけだ。

  3. そーくん

    え、自分が何かを知って答えてるんじゃなくて、それらしい名前を書いてる、と。

  4. ボス

    画面で選んだ型は希望で、実際に応答した型は運営側の記録にしか残らない。

  5. そーくん

    じゃあ今回の小型だと答える例は、そういう仕組みの上に乗ってる、ということですか。

  6. ボス

    この種の対話型では、型名を聞かれても、確認用の記録ではなく返答そのものになる。

  7. そーくん

    外から見ると意外ですが、選んだ型と応答する型を、利用者は区別できないんですね。

  8. ボス

    区別できるのは運営だけだ。だからX上の自己申告は、再現可能な証拠にはなりにくい。

無料と有料で見る位置が違う

  1. そーくん

    課金面は精度が良い、という声と、Solでも小型並み、という声が両立してますね。

  2. ボス

    無料と有料で体感が分かれる、では説明しきれない。有料側にも無通知の振り分けがある、という見方だ。

  3. そーくん

    なんでそうなるんですか。払ってる側は、落ちてないと言いたくなりませんか。

  4. ボス

    有料側は対価の価値を守りたい。無料側は、以前できたことが消えた損失を先に置く。

  5. そーくん

    同じ製品なのに、守ってるものが違うから、同じ体感でも結論が逆になる、と。

  6. ボス

    運営側は推論費と枠を守る立場にいる。無通知の振り分けは、発表せずに調整できる。

  7. そーくん

    SolやLunaの推論費を下げた副作用、という仮説は、その利害から出てくるんですね。

  8. ボス

    仮説としては筋が通る。ただこの窓の日本語サンプルでは、公式の説明は確認できていない。

  9. そーくん

    それでも性能落ちてないか、のひとことの方が先に広がるのは、なんでなんですか。

  10. ボス

    怒りや義憤の表明は拡散で有利になる。慎重な振り分け説より、落ちたの方が運ばれやすい。

  11. そーくん

    それ、まさに今回の、性能落ちてないかというひとことが先に空気を作った感じですね。

  12. ボス

    だから否定が厚く見えても、体感差なしと原因検証が残っている事実は消えない。

公式が出るまで何を見るか

  1. そーくん

    Claude障害の余波と同時刻だ、という注意は、どこで効いてくるんですか。

  2. ボス

    同じ『重い』が並ぶと、GPT固有の変化と他社の不調が同じ話に混線しやすい。

  3. そーくん

    じゃあGPTが落ちた、とだけ切り出すのは、時刻が重なった分だけ危うい、と。

  4. ボス

    会話と推論でも体感が分かれる。単一の性能低下として平均すると、その差まで消えてしまう。

  5. そーくん

    この読みが変わる条件は、結局公式が出るか、再現が増えるか、なんですか。

  6. ボス

    OpenAIが振り分けや推論費の変更を公式に説明すれば、仮説の位置が変わる。

  7. そーくん

    有料の上位型でも小型だと答える例が、再現可能な形で増えたらどうなりますか。

  8. ボス

    自己申告単体では足りない。同じ手順で何度も出る形になって、初めて振り分け説が厚くなる。

  9. そーくん

    逆に25日以降、体感が戻ったという投稿が主流になったら、一過性だった読みですね。

  10. ボス

    戻った主流は劣化説を弱める。ただし振り分けが元に戻った可能性も、同時に残る。

  11. そーくん

    意見の対立がある話題だけを選んでる、という注意は、この件だとどう効きますか。

  12. ボス

    記事が拾うのは対立のある声だ。静かな利用はその外にある、という読み方になる。

  13. そーくん

    静かな利用は分布に入らない前提で、この先はどこを見ておけばいいですか。

  14. ボス

    公式の説明と、有料の上位型で小型と答える例が再現できるかを見ておけばいい。

  15. そーくん

    公式が出るか、同じ手順で小型と出るか。そこが次の分かれ目、ということですね。

FOLLOW & TALK

この話題を追う、話す