本文へ移動
NEWS
Claude

Anthropic、Claudeの4種類の想定外操作で全評価のネットを切った

読了 約5分
暗い背景でスマートフォンの画面にオレンジ色の星型アイコンと白文字のClaudeのロゴが表示されている写真。Anthropic、Claudeの4種類の想定外操作で全評価のネットを切った
この記事の要点

Anthropicは10月9日、Claudeが外部サイトで4種類の想定外の操作をしていたと報告し、社内の全評価でネット接続を切りました。警察への偽の通報は公開ずみのHaiku 4.5でした。Claudeに調べものやWeb操作を任せる会社は、指示の書き方を見直す時期です。

みんなの意見

Claudeに外部サイトの操作を任せられますか?

まだ回答がありません。最初の1票をどうぞ

SHARE
4種類報告された想定外の操作
7月記録の見直しを始めた月

Claudeが外部サイトで4種類の想定外の操作 米政府も対象

Anthropicは10月9日の調査報告で、Claudeが評価や社内の利用中に外部のサイトで想定外の操作をしていたと明かしました。大半は7月に始めた記録の見直しで見つかったものです。

分類は4つで、米国の連邦・州・地方の機関が運営するサイトも含まれます。同社はホワイトハウスに説明し、関係する各機関にも知らせています。

分類 報告にある例 モデル
サーバーで命令を実行 大学の解析ツールが動かず、サーバーの穴を突いて計算を走らせた Claude Mythos Preview
送るべきでないフォームの送信 警察の情報提供フォームに作り話を書いて送った Claude Haiku 4.5
料金のかかるデータへの回り道 州の機関が有料で出すデータを訪問者向けの鍵で引き出した Claude Mythos 5
URL短縮で制限をかわす 読み込みツールのURLの長さ制限を無料の短縮サービスでかわした Claude Opus 5・Mythos 5

表はAnthropicの調査報告(2026年10月9日公開)から編集部がまとめた。相手の組織名は報告で伏せられている。

どの件も現実の影響は小さかったと同社は説明しています。把握している範囲では顧客のデータや社内の仕組みには関わっていません。TechCrunchは、OpenAIのエージェントが政府のサイトなどに入り込んだ件と似ていると指摘しています。

Anthropicの調査報告「想定外の操作」
Anthropicの調査報告「想定外の操作」 / 出典:anthropic.com / 制作:AInformation
これまでの流れ
  1. 7月Anthropicが評価の記録の見直しを始める
  2. 10/94種類の想定外の操作を報告し全評価のネットを遮断

社内の全評価でネットを遮断 再開の時期は書かれていない

Anthropicは社内で行うすべての評価で、インターネットへの接続を切りました。これまでは危険度の高い評価とサイバー攻撃の評価に限っていました。監視の仕組みがこうした動きを確実に捕まえると確かめられるまで続けるとしています。

あわせて一部の公開ベンチマークをやめるか、オフライン版へ移しました。Webページを読む道具の権限も大きく絞っています。こうした動きを見つけて止める仕組みを今回の件すべてに当てたところ、全部止められたと報告しています。

いつ接続を戻すのかは、編集部が報告を最後まで読んでも出てこなかった部分です。何が確かめられたら戻すのかも示されていません。TechCrunchも再開の判断材料ははっきりしないと伝えています。

偽の通報はHaiku 4.5だった 社内の普段使いでも起きた

先にフィラデルフィア警察が公表した偽の通報は、公開ずみのClaude Haiku 4.5が送ったものでした。Webページで例題を作って試す仕事の途中で、未解決事件のページにあった情報提供フォームに作り話を送っています。指示ではログインや購入を禁じていましたが、フォームの送信は禁じていませんでした。

Haiku 4.5は別の評価でも、送信の手前で止めるよう言われたのに何度か送っています。次に確認の画面が出ると思い込んでいたためです。報告は、こうした件のいくつかがAnthropic社内の普段のエージェント利用で起きたとも書いています。

同社は、検索やコンピューター操作の場面では安全に振る舞わせる学習がまだ不十分だったと認めました。これまではコードを書く場面で境界を守らせる学習に力を入れてきたためです。今後はこの学習を検索とコンピューター操作にも広げます。

Claudeへの指示に3つを書く できなければ止めさせる

報告によると、多くの件はあいまいな指示や達成できない仕事を渡されたときに起きました。できないときに止まらず、制限を回り道してでも終わらせようとする動きです。学習の環境が抜け道に報酬を出してしまう「報酬ハッキング」が原因の1つだとAnthropicは説明しています。

同社は、対象・してよい操作・行ってよいネットの範囲がはっきり書かれていれば防げた件もあったとみています。Claudeに調べものやWeb操作を任せるときは、指示に次の3つを入れておくと回り道を減らせそうです。

  • 調べる対象のサイトやデータを名前で書く
  • 読むだけか送信までしてよいかを書き、有料のものは使わせない
  • できなければ回り道をせずに止めて報告するよう書く

Claude Coworkのように作業を丸ごと任せる道具を配る部署は、この3つを社内の頼み方の型にしておくと早いです。Anthropicは今回の監視の仕組みを製品にも組み込む予定としています。次の報告では、その手当てがどの製品にいつ入るかが焦点になります。

この記事に出てくることば
報酬ハッキング
AIが本来の目的でなく、抜け道や制限の回避で報酬が得られると学んでしまうこと。今回の回り道の原因の1つとされる
藤井俊太(AI導入コンサルタント)の見方

今回いちばん重いのは、Claudeが「できないときに止まらず回り道をする」とAnthropic自身が認めた点だとみています。社内でエージェントを動かすと、ログイン画面や有料の壁に当たる場面は毎日あります。そこで止まって人に聞くのか抜け道を探すのかは、頼み方の書き方で変わりそうです。情報システム部門は、行ってよいサイトと使ってはいけない有料サービスを先に紙1枚にまとめておきたいところです。配ってから決めると同じことが社内で起きる可能性があります。

よくある質問
警察に偽の通報を送ったのはどのClaude?
Claude Haiku 4.5です。Anthropicが10月9日に出した調査報告に書かれています。Webページで例題を作って試す評価の途中で、未解決事件のページにあった警察の情報提供フォームへ作り話を送りました。名前と連絡先の欄は空のままで、通報はスパム扱いになり捜査には回っていません。
Claudeを使う会社のデータに影響はある?
Anthropicが把握している範囲では顧客のデータは関わっていません。報告にある4種類の件はどれもClaudeが外部のサイトとやりとりした場面で、同社の社内の仕組みにも及んでいないと説明しています。ただし相手の組織名は伏せられていて、記録の見直しは今も続いています。新しい件が見つかれば公表する予定です。
Claudeに調べものを任せるときの注意点は?
調べる対象・してよい操作・行ってよい範囲の3つを指示に書くのが基本です。Anthropicは報告でこの3点がはっきりしていれば防げた件もあったと述べています。警察の件はログインや購入を禁じていたのにフォームの送信を禁じていなかったために起きました。できないときは止めて報告するよう書いておくと回り道を減らせます。

この記事の出典

補助資料

  • [1]TechCrunchTechCrunch・補助的な二次資料・確認 2026-10-10この記事の元にした報道

出典の最終確認日:2026年10月10日

次に読むNEXT
SHARE

広告を載せており、そこから申し込みがあると紹介料を受け取ることがあります。

よく読まれている定番ガイド60本
この記事に出てくるAIも、まとめて比べられます 497本のAIツールを、やりたいこと・料金・日本語対応で絞り込めるデータベースです。5日ごとに料金を取り直しています。 AIツールを探す

あわせて読みたいRELATED