最終更新2026年8月12日 21:18

テック62

暗号化推論の兄弟モデル漏洩

主要AIの暗号化された推論過程を弱い同系列モデル経由で平文復元できる脆弱性が報じられ、構造欠陥とする警戒と研究報告・対策前提の冷静論が並んでいる。

拡散の起点2026-08-12

日本語で3社横断の脆弱性として再掲

GIGAZINE等が「中国製と米製がそっくり」「テスト答え決め打ち」など実情暴露として紹介。

期間: 直近10時間の再拡散中心信頼度: (技術解説は明確だが、各社の公式対応状況の一次確認は限定的)
一方的
ポジティブ15%10–20%
中立35%25–40%
ネガティブ50%40–55%
  1. そーくん

    あの暗号化推論の兄弟モデル漏洩の話題、第3回ですね。

  2. ボス

    AIの暗号化思考が同系列の弱いモデルで解読された問題だね。

  3. そーくん

    ニュースで3社横断の脆弱性なんて見出しが出て騒がしいです。

  4. ボス

    何が起きたか、まずは時系列で流れをおさらいしてみよう。

何が起きたか

  1. 2026-08上旬〜11

    暗号化CoTの復元研究が浮上

    強いモデルの暗号化思考を弱い弟分に渡すと平文が出るという報告が拡散し始めた。

  2. 拡散の起点2026-08-12

    日本語で3社横断の脆弱性として再掲

    GIGAZINE等が「中国製と米製がそっくり」「テスト答え決め打ち」など実情暴露として紹介。

  1. そーくん

    ボス、これってAIの安全前提が根底から崩れたんですか?

  2. ボス

    構造欠陥と見る人もいれば、対策可能なバグと見る人もいる。

  3. そーくん

    専門家の間でも、捉え方が大きく分かれているんですね。

  4. ボス

    いまどんな視点で議論されているか、現在地を確認しよう。

議論の現在地

主流派の視点
「推論の暗号化は安全の柱にならない可能性がある」
その他の視点
  • 研究上の既知クラスで対策可能
  • 公開ログから認証情報が復元された事例
  • 監視できない思考をどう扱うか
目立つ論者
  • テックニュース
  • セキュリティ関心のAI利用者
  • 安全研究フォロワー
  1. そーくん

    SNSでの読者の反応はどうですか?炎上気味でしょうか。

  2. ボス

    警戒感が優勢だが、第1回よりは過度な恐慌が薄れているよ。

  3. そーくん

    パニックから少し落ち着いて、冷静な声も増えたのかな。

  4. ボス

    世論の感情がどう分布しているか、割合を見てみよう。

世論の分布

意見陣営別シェア(推定レンジ)

Xサンプル上の可視的な言論に占める割合 · 下限—上限

  • 構造欠陥警戒派40–55%
  • 研究報告冷静派25–40%
  • 透明性強化派10–20%
推定下限推定上限

ポジ / 中立 / ネガ 集計

陣営をスタンス別に統合 · 合計100調整

15%
35%
50%
ポジティブ 10–20%(透明性強化派)中立 25–40%(研究報告冷静派)ネガティブ 40–55%(構造欠陥警戒派)
テーブルビュー(グラフと同じデータ)
陣営スタンスシェア中心的主張
構造欠陥警戒派ネガティブ40–55%暗号化思考を安全の前提にしていた設計が根から崩れる(@joho_no_todai、警戒解説層)
研究報告冷静派中立25–40%重要な研究だが、パッチと運用で扱えるクラスの問題でもある(冷静再掲層)
透明性強化派ポジティブ10–20%隠れた推論の実情が可視化され、安全性議論が前に進む(監査・透明性志向)
  1. そーくん

    この問題、具体的にどこが激しく対立しているんですか?

  2. ボス

    暗号化思考を諦めるべきか、強化して守るべきかという点だ。

  3. そーくん

    安全策の根本的な方向性で噛み合っていないんですね。

  4. ボス

    双方の主張の言い分を、整理して比べてみよう。

進行中の論争

論点1

暗号化された思考は安全策として捨てるべきか

A側 · 捨てる

弟分モデル経由で破られるなら前提が成立しない

B側 · 強化する

研究知見を踏まえ暗号と隔離を更新すればよい

根拠: 構造欠陥論と対策前提の冷静論

主なポスト

gigazine@gigazine·当日の再報AIの暗号化された思考内容を盗み見る手法が開発される、「中国製AIの思考がとアメリカ製AIとそっくり」「性能テストの答えを決め打ち」などの実情が浮き彫りに日本語での主要再拡散ポスト
joho_no_todai@joho_no_todai·構造欠陥フレームAIの「思考」は暗号化すれば安全だとOpenAI・Anthropic・Google3社とも信じていた。その暗号が3社すべてで破られた。手口は拍子抜けするほど単純で、強いモデルの暗号化された思考をガードの弱い弟分モデルに渡してジェイルブレイクするだけだという Opusの思考がHaikuの口から平文で出てくる。公開ログから復号したパスワードやAPIキーは100件近い。暗号化ブロックの中にしか存在しない認証情報が64件あり従来のログ監査では絶対に見つからない 推論の監視がAI安全性の柱なら人の言葉ですらない思考をどう監視するのか3社横断・認証情報復元まで踏み込む警戒解説

編集部まとめ

  1. ボス

    ここまでの情報を踏まえると、単なる事故対応以上の課題が見えるね。

  2. そーくん

    最初はパニック気味でしたけど、議論の質が変わってきました。

  3. ボス

    第1回はネガティブが最大65%だったが、今は40–55%で推移している。

  4. そーくん

    数字で見ても、初期のショックから冷めて冷静な分析が増えましたね。

  5. ボス

    激しい批判が目立つが、過激な意見を言うのは一部で大多数は黙っている。

  6. そーくん

    それ、まさに今回の『AI崩壊』みたいな派手な拡散と同じですね。

  7. ボス

    まず構造欠陥警戒派は、破られた暗号を安全の前提にするなと主張する。

  8. そーくん

    リスクがあるなら、設計を根本から見直してほしいですよね。

  9. ボス

    一方で研究報告冷静派は、パッチや運用で対処できる範囲だとみる。

  10. そーくん

    運用でカバーできるなら、技術を捨てずに改良したいところです。

  11. ボス

    さらに透明性強化派は、隠れた推論の可視化自体を歓迎している。

  12. そーくん

    ブラックボックスが暴かれて議論が進むなら前進という見方ですね。

  13. ボス

    ただ注意点として、主要各社の修正状況は公式の一次情報がまだ薄い。

  14. そーくん

    ニュースの勢いだけで『対応完了』と思い込んじゃダメですね。

  15. ボス

    また、認証情報が復元された件数も解説ポスト依存で未確定だ。

  16. そーくん

    個人の投稿の数字を鵜呑みにするのは危険ってことですね。

  17. ボス

    『米中モデルがそっくり』という見出しも解釈が乗りやすい。

  18. そーくん

    刺激的な言葉ほど、一歩引いて事実を確認する必要がありますね。

  19. ボス

    この見方が変わる条件もある。まず各社が同時にパッチを出すこと。

  20. そーくん

    一斉に対応策が出れば、事態は一気に収束へ向かいそうです。

  21. ボス

    次に、再現実験が失敗して過剰報道だったと判明する場合だ。

  22. そーくん

    検証結果次第では、騒ぎ自体が拍子抜けで終わる可能性もありますね。

  23. ボス

    最後に、規制当局が推論ログの扱いに関する指針を出すことだね。

  24. そーくん

    公式ルールができれば、議論の枠組みが一変しそうです。

  25. ボス

    事実の検証より『どちらの陣営か』の争いに変わる瞬間にも注意したい。

  26. そーくん

    それもまさに、推進派と反対派の不毛な感情論で起きがちですね。

  27. ボス

    そーくんの隠し事も、後輩の弟分モデルに聞けばすぐ解読できそうだ。

  28. そーくん

    まいりましたー。僕の秘密は暗号化すらされていませんよ。