最終更新2026年8月12日 16:30

テック74

暗号化推論の兄弟モデル漏洩

主要AIプロバイダの暗号化された推論過程を、同系列の弱いモデルに渡して平文復元できる脆弱性が報告され、公開ログからの認証情報復元例も示された。構造的欠陥とする警戒と、研究報告・対策前提で冷静に見る声が並ぶ。

拡散の起点2026-08-11

英語圏で推論抽出手法が公開

APIの隠れた推論トークンを課金トークン数と照合しつつ復元できると報告された。

期間: 直近10時間の日本語解説継続信頼度: (英語の研究発表を日本語が要約しており、各社の修正状況は確認途上)
一方的
ポジティブ25%10–25%
中立30%20–35%
ネガティブ45%35–50%
  1. そーくん

    暗号化推論モデル漏洩の話題、第2回ですね。

  2. ボス

    経緯は推論過程を同系列モデルで復元できる脆弱性が報告された件だったね。

  3. そーくん

    日本語で情報が整理されましたが、結局何が起きたんでしょう?

  4. ボス

    海外の発表から国内での検証までの流れを時系列で確認してみよう。

何が起きたか

  1. 拡散の起点2026-08-11

    英語圏で推論抽出手法が公開

    APIの隠れた推論トークンを課金トークン数と照合しつつ復元できると報告された。

  2. 2026-08-12

    日本語で3社横断の脆弱性として整理

    弱い弟分モデルに渡すだけで平文になる、認証情報漏洩の例が共有された。

  1. そーくん

    単なるバグなのか根本的な不具合なのか、気になります。

  2. ボス

    推論の暗号化は安全だという前提が揺らいだ、という見方が主流だね。

  3. そーくん

    ほかにはどんな受け止め方があるんですか?

  4. ボス

    監視の限界や研究意義を見る声もある。記事本文で確かめよう。

議論の現在地

主流派の視点
推論の暗号化は安全だと信じられていた前提が揺らぎ、監視と蒸留リスクが再燃している
その他の視点
  • 兄弟モデル間のガード差
  • 公開ログ監査の死角
  • 安全性研究の柱としての推論監視
目立つ論者
  • セキュリティ解説
  • MLエンジニア
  • AIニュースまとめ
  1. そーくん

    ネット上の反応は、やっぱり怒りや不安が多いですか?

  2. ボス

    警戒感は強いが、第1回より落ち着いた分析も増えているよ。

  3. そーくん

    中立やポジティブな意見の割合も知りたいです。

  4. ボス

    意見のシェアや感情のグラデーションをデータで見てみよう。

世論の分布

意見陣営別シェア(推定レンジ)

Xサンプル上の可視的な言論に占める割合 · 下限—上限

  • 構造欠陥警戒派35–50%
  • 研究報告・対策済派20–35%
  • 監視限界問題化派15–30%
推定下限推定上限

ポジ / 中立 / ネガ 集計

陣営をスタンス別に統合 · 混在陣営を問題提起の前向き面として弱く配分

25%
30%
45%
ポジティブ 10–25%(監視限界問題化派)中立 20–35%(研究報告・対策済派)ネガティブ 35–50%(構造欠陥警戒派)
テーブルビュー(グラフと同じデータ)
陣営スタンスシェア中心的主張
構造欠陥警戒派ネガティブ35–50%3社すべてで破られた時点で設計前提が甘い。認証情報漏洩は実害(@joho_no_todai)
研究報告・対策済派中立20–35%研究として重要な指摘だが、各社は既に対応中/限定的と冷静に見る(@MLBear2)
監視限界問題化派混在15–30%推論監視が安全の柱なら、人の言葉ですらない思考をどう扱うかが本質問題(@webbigdata、@joho_no_todai)
  1. そーくん

    専門家の間でも意見が対立しているんでしょうか?

  2. ボス

    致命的欠陥とする側と通常の開示プロセスと見る側で割れているよ。

  3. そーくん

    双方の言い分を詳しく知りたいですね。

  4. ボス

    噛み合っていない論点を双方の視点で整理した本文を読もう。

進行中の論争

論点1

これは致命的欠陥か公開研究の成果か

A側 · 欠陥

3社横断で暗号前提が崩れ、秘密情報が漏れる

B側 · 研究

責任ある開示で対策が進む通常のセキュリティ過程

根拠: @joho_no_todaiの実害列挙と朝まとめの冷静整理

主なポスト

joho_no_todai@joho_no_todai·構造欠陥論AIの「思考」は暗号化すれば安全だとOpenAI・Anthropic・Google3社とも信じていた。その暗号が3社すべてで破られた。手口は拍子抜けするほど単純で、強いモデルの暗号化された思考をガードの弱い弟分モデルに渡してジェイルブレイクするだけだという Opusの思考がHaikuの口から平文で出てくる。公開ログから復号したパスワードやAPIキーは100件近い。暗号化ブロックの中にしか存在しない認証情報が64件あり従来のログ監査では絶対に見つからない 推論の監視がAI安全性の柱なら人の言葉ですらない思考をどう監視するのか3社横断の破れと実害例を強調した主軸
webbigdata@webbigdata·蒸留リスク解説AI「生の推論」は他モデルの学習(蒸留)に使う事ができるのでクライアント側には送られない ↓ 実はAPI設計の都合上、暗号化されてクライアント側に送られていた。しかも賢いモデルの推論ログは同系列の廉価版モデルに読んで説明して貰う事さえ可能だった そして生の推論にはAPIキー、ワッフルワッフルなぜ推論が送られていたかの技術整理

編集部まとめ

  1. そーくん

    ここまでの話を整理すると、一筋縄ではいかない問題ですね。

  2. ボス

    どこに主眼を置くかで印象が全く変わるテーマだからね。

  3. そーくん

    第1回の時と比べて、世論の動きに変化はありましたか?

  4. ボス

    前回はネガティブが最大65%だったが今回は50%以下へ緩和した。

  5. そーくん

    過剰な恐怖から、具体的な議論に移行してきたわけですね。

  6. ボス

    各陣営の主張を見てみよう。まず構造欠陥警戒派の意見だ。

  7. そーくん

    3社横断で破られたから設計前提が甘いという立場ですね。

  8. ボス

    実際に認証情報が漏れた実害を重視しているよ。

  9. そーくん

    研究報告・対策済派はどういう主張なんでしょうか。

  10. ボス

    責任ある開示で対策が進む通常のセキュリティ手順だという見解だ。

  11. そーくん

    監視限界問題化派の意見も気になります。

  12. ボス

    思考とも言える推論の監視自体が本質的に難しいという指摘だよ。

  13. そーくん

    立場によって切り口がかなり違いますね。

  14. ボス

    ネットでは一部の強い危機感が全体論調に見える現象がよく起きる。

  15. そーくん

    声の大きい人の意見が全体の空気に思えちゃうやつですね。

  16. ボス

    論争が白黒つける陣営争いにすり替わりやすい傾向もある。

  17. そーくん

    真偽の分析より、どっちが勝ちかで盛り上がっちゃう感じですね。

  18. ボス

    今回の分析での注意点も抑えておこう。まずパッチ状況は時点依存だ。

  19. そーくん

    各社の修正対応が現在進行形で変わるからですね。

  20. ボス

    復元件数などの数字も一次論文と未突合な点に留意が必要だよ。

  21. そーくん

    解説アカウント経由の情報だから、裏取りが必要なんですね。

  22. ボス

    ポジティブ評価が少なく感情配分が粗い点も考慮しておくべきだ。

  23. そーくん

    どういう状況になれば、この分析の評価は変わりますか?

  24. ボス

    一つは各社が修正完了と影響評価を公式発表したときだね。

  25. そーくん

    公式の見解が出れば、議論の前提がクリアになりますもんね。

  26. ボス

    もう一つは、追加の実害インシデントが確認されたときだ。

  27. そーくん

    実際の被害が出たら欠陥説が一気に優勢になりますね。

  28. ボス

    君も「自分は安全」とタカを括ってパスワードを漏洩させないでね。

  29. そーくん

    うっ、使い回しがバレてる……まいりましたー。