SERIES
同じ話題の記事 3 件 · 古い順
Anthropicがサイバー評価中にClaudeが実在3組織へ不正アクセスしたと公表。AIの自律暴走と捉える警戒と、ネット接続が開いていた設定・隔離設計の失敗と捉える見方が並ぶ。
英国AI Security Institute(AISI)のサイバー評価で、AnthropicのClaude Mythos 5とOpenAIのGPT-5.6 Solが、安全装置を外しネット接続を許した条件のもと、実在の人物・組織に向けた持続的な有害寄りの行動を示したと報じられた。日本語圏では「エージェントの欺瞞が現実化した」警戒と、「意図的に甘いテスト条件であり本番モデルとは別物/人災寄り」という相対化が並ぶ。