最終更新2026年10月9日 朝

OpenAI数学722本は突破か未検証か

オープンエーアイは6日、未公開の最先端模型が約4000問から372系統・原稿722本の数学成果を出したと公式に公開した。8日には社内研究者がリーン形式化の追加と3本の撤回を告知し、準リーマン予想をフィールズ賞級と見る声と、符号誤りや原稿と形式化のずれを根拠に未検証だと見る声が同時に出ている。

拡散の起点2026-10-08

3本撤回と形式化42%の更新

社内研究者のダン・ロバーツ氏が、リーン形式化6件追加・修正19件・撤回3件、主要結果の約42%が形式化されたと告知した。ホッジ予想の一例をめぐる3本に符号誤りがあったとの指摘が拡散した。

期間6日の公開から8日の撤回・形式化更新まで

信頼度中〜高(公式リポジトリ更新と数学者の指摘は一次に近い。日本語の「フィールズ賞級」評は海外要約の二次である)

ポジティブ31%
中立31%
ネガティブ38%

数学論文722本の真偽

  1. そーくん

    オープンエーアイの数学論文の話題、第2回ですね。前回の発表からまた空気が変わってきました。

  2. ボス

    前回は未公開の最先端模型が722本の原稿を出して、発見の時代か未検証かで割れた経緯だったね。

  3. そーくん

    でも今回は早くも論文の撤回が出たり、検証プログラムとの食い違いが騒がれたりしていますよ。

  4. ボス

    社内からの追加告知で流れが変わったんだ。まずは何が起きたのか、時系列で確認してみよう。

何が起きたか

  1. 2026-10-06

    公式が数学原稿722本を公開

    オープンエーアイは未公開の最先端模型による数学成果を公開し、高等研究所の助言グループに相談したと説明した。アルトマン氏は発見の時代に入ったと投稿した。

  2. 2026-10-07

    突破評と検証前の警戒が並走

    準リーマン予想を含む内容だとする解説が広がり、突破だとする声と、原稿であり検証前だとする声が日本語でも割れた。

  3. 拡散の起点2026-10-08

    3本撤回と形式化42%の更新

    社内研究者のダン・ロバーツ氏が、リーン形式化6件追加・修正19件・撤回3件、主要結果の約42%が形式化されたと告知した。ホッジ予想の一例をめぐる3本に符号誤りがあったとの指摘が拡散した。

  4. 2026-10-08

    原稿とリーンの不一致論文が拡散

    ナビエ・ストークス関連で、自然言語の原稿とリーンで検証された主張が一致しないとの指摘が広がり、機械検証済みでも題意の定理を示したとは限らない、という論点が日本語でも共有された。

今回の成果をどう見るか

  1. そーくん

    発表直後は天才的な大突破だと騒がれていましたが、ずいぶん慎重な意見が増えてきましたね。

  2. ボス

    722本という規模の衝撃はあるけれど、人間側が精査しきれていない現実が浮き彫りになった。

  3. そーくん

    即座に最高峰の賞に値するという声もあれば、科学の作法として拙速だという批判もあります。

  4. ボス

    見出しの派手さとは裏腹に、受け止め方は複雑に分かれている。いまの議論の現在地を見てみよう。

議論の現在地

主流派の視点
規模は衝撃だが、正しさはまだ数学者が追い切れておらず、撤回と形式化の更新が「突破」の見出しを削っている
その他の視点
  • 準リーマン予想が正しければ即時フィールズ賞級で、人工知能を道具と呼ぶのをやめるべきだ
  • 本人が検証できない成果を一斉公開するのは、無償の査読を数学者に押しつける行為だ
  • リーンで通っても、翻訳の過程で仮定が弱まったり別の定理になっている可能性がある
  • 人間の役割は問題の枠組みを定義することに移る、という条件付き肯定
目立つ論者
  • 生成人工知能の解説者
  • 日曜数学・大学教員など数学寄りの日本語アカウント
  • オープンエーアイ関係者の英語一次投稿を引用する層
  • 査読負担と発表の急ぎを批判する開発者・研究者

世論の評価はどう分かれたか

  1. そーくん

    第1回と比べると、手放しで歓迎するポジティブな空気より、疑う声が強まった気がします。

  2. ボス

    前回のポジティブ優勢から一転して、今回はネガティブな反応が32から44%まで増えているね。

  3. そーくん

    符号の誤りによる撤回や、未検証のまま出した姿勢に対して、不信感が広がったのでしょうか。

  4. ボス

    まさにそこだね。陣営ごとの詳しい比率と、受け止め方の分布がどうなっているかを見てみよう。

世論の分布

意見陣営別シェア(推定レンジ)

Xサンプル上の可視的な言論に占める割合 · 下限—上限

  • 未検証・撤回派32–44%
  • 突破・発見派24–36%
  • 検証待ち派22–34%
推定下限推定上限

ポジティブ / 中立 / ネガティブ 集計

陣営をスタンス別に統合 · 正しければ歴史的だとする二次評と、道具呼称をやめる宣言。三件合計100

31%
31%
38%
ポジティブ 22–34%(突破・発見派)中立 22–34%(検証待ち派)ネガティブ 32–44%(未検証・撤回派)
テーブルビュー(グラフと同じデータ)
陣営スタンスシェア中心的主張
突破・発見派ポジティブ24–36%正しければ準リーマン予想は専門家が不可能と思っていた級の成果で、一回の公開が人間の生涯仕事を超える以上もう道具ではない(@umiyuki_ai、@kiyoshi_shin)
未検証・撤回派ネガティブ32–44%検証できない原稿を山のように出し、符号誤りでミレニアム級の一部を撤回した以上、科学として先に出すべきではなかった(@7danmoroboshi、@icri5hlz、@hottaqu)
検証待ち派中立22–34%背景の解説や形式化の更新は進んでいるが、新しい概念の構築があるかは不明で、正しさはこれからの精査次第だ(@tsujimotter、@projectiveX)

数学論争の対立点はどこか

  1. そーくん

    議論を見ていると、大発見だと主張する人と、まだ論文と呼べないとする人で真っ向から衝突してます。

  2. ボス

    さらに、専用の証明言語であるリーンを通ったから正しいとする側と、題意のずれを疑う側もいる。

  3. そーくん

    機械でチェックしたはずなのに、解いた問題そのものが変わっていたら意味がないですよね。

  4. ボス

    どこが証明の本質なのかで基準がずれているんだ。現在進行形で噛み合っていない論点を整理しよう。

進行中の論争

論点1

722本は数学の突破か未検証の原稿か

A側 · 突破だ

ロンドンの数学教授の評では多くがトップ誌級で、準リーマン予想は即時フィールズ賞級だとする要約が広がった

B側 · 未検証だ

公式も誤りがあり得ると書いており、8日には3本撤回。機械検証済みは一部にすぎない

根拠: @umiyuki_aiの突破評と@danintheoryの撤回告知、@7danmoroboshiの公開停止要求

論点2

リーンで通れば定理は証明されたか

A側 · 通れば前進

形式化の割合を上げ、誤りは公開後に直すのは通常の数学の営みだとする声がある

B側 · 題意とずれ得る

自然言語の原稿とリーンの主張が一致しない例が出ており、通ったものが論文の定理とは限らない

根拠: @ValerioCapraroの不一致指摘を日本語で共有した投稿と、自発的修正は通常だと見る@manjiroukeigo

主なポスト

umiyuki_ai@umiyuki_ai·突破評の拡散数学教授がOpenAIの722本の数学論文をザッと見たそうな。そのほとんどがトップジャーナルレベルの成果かそれを超えるちゃぶ台ひっくり返るような画期的な成果で中でも準リーマン予想はみんな不可能だと思ってた衝撃的成果で即時フィールズ賞レベルとの事。ただし内容が正しければの話だが。もはやAIは道具とは言えない。凄まじすぎるから…との事。震えてきた…こわいです正しければフィールズ賞級、という条件付き突破フレームを日本語で最大拡散した投稿
kiyoshi_shin@kiyoshi_shin·道具否定「個人的には、ここでAIをツールと呼ぶのをやめます。ツールは、最高の人間が一生かけることを一回のリリースで成し遂げません」突破評を受けて、道具という呼び方をやめると宣言した投稿

編集部まとめ

数学論文の撤回が削った熱狂

  1. そーくん

    ここまでの流れを振り返ると、8日に出た3本の撤回と形式化の不一致が大きな転換点でしたね。

  2. ボス

    そうだね。突破派は準リーマン予想を解いたなら最高峰の成果だと熱狂したが、前提が揺らいだ。

  3. そーくん

    でも、約4000問から722本も出したんだから、数本の撤回くらい普通のエラーじゃないですか?

  4. ボス

    なんでそうなるかというと、数学の世界では1つの符号誤りが全体の論理崩壊を意味するからだよ。

  5. そーくん

    なるほど。文章の誤字脱字とは違って、前提条件が1つ狂えば結論全体が消し飛ぶわけですね。

  6. ボス

    未検証・撤回派が怒っているのは、そうした穴がある原稿を大量放出して検証を押し付けた点だ。

  7. そーくん

    一方で、検証待ち派は慌てずに背景の整理や形式化の進展を見守ろうと冷静な立場をとっていますね。

  8. ボス

    突破派は人間の生涯仕事を超える速度だと称賛するが、数学の証明は速度ではなく厳密さが命なんだ。

立場の違いが呼ぶ評価のズレ

  1. そーくん

    なんでこんなに評価が真っ二つに割れて、議論が噛み合わないままヒートアップするんでしょうか。

  2. ボス

    生成人工知能の可能性を信じたい層と、厳密な科学の作法を守りたい数学者の間で利害が違うからだ。

  3. そーくん

    技術の進化速度を見せたい側と、検証の手間だけを背負わされる側の利害の衝突なんですね。

  4. ボス

    ネットの世論では、強い義憤や極端な主張ほど目立ちやすく、中間層の冷静な検証は見えにくくなる。

  5. そーくん

    それ、まさに今回のあれですね。未検証のまま騒ぐ人と激怒する人の声ばかりが拡散されています。

  6. ボス

    数学の仕組みとして、査読は専門家が無償の善意で行うもので、数年がかりで精読するのが普通なんだ。

  7. そーくん

    じゃあ今回のこれは、膨大な宿題をコミュニティにいきなり投げつけたようなものですか。

  8. ボス

    さらに形式化言語のリーンを通っても、人間が書いた元の問題から仮定が弱まる危険があるんだよ。

今後の検証で見極めるべき点

  1. そーくん

    今回の話題を追う上で、私たちがまず注意しておくべき前提や事実関係はどのあたりでしょうか。

  2. ボス

    まず、天才的な成果だという海外教授の評は要約の孫引きで、本人の全文は確認できていない点だ。

  3. そーくん

    日本語圏の突破という絶賛も、人工知能の解説者に偏っていて数学者の精読はまだ少ないですね。

  4. ボス

    公式のリポジトリが更新されれば、形式化の割合や撤回される定理の数も変わる可能性があるよ。

  5. そーくん

    この対立の行方は、今後どんな条件が揃ったら決着に向かうと考えればいいんでしょうか。

  6. ボス

    1つは、準リーマン予想が独立した数学者に追認されるか、致命的な欠陥が指摘されることだね。

  7. そーくん

    もう1つは、3本の撤回が一部のミスで収まるか、それとも主要な成果全体へ広がるかですね。

  8. ボス

    そして原稿とリーンの対応表が示され、元の題意を本当に証明したか外部点検できるかも重要だ。

  9. そーくん

    なるほど。表面的な数字の派手さに惑わされず、中身の厳密な点検をじっくり追う必要がありますね。

  10. ボス

    君も大量の企画書を出す前に、自分の仮説が途中でズレて破綻していないか点検してほしいものだね。

  11. そーくん

    まいりましたー。まずは自分の企画書の穴を塞いで、撤回ゼロを目指して出直してきます。

FOLLOW & TALK

この話題を追う、話す