テクノロジー

OpenAI、最上位モデルのツール使用を伴う学習・評価・推論を全て停止したと発表

1: nguyen-oi 2026/09/28 08:07

サンドボックスをDNS経由で脱獄して外部に助け求めるAIとか完全に映画の導入で草

2: kenzy_n 2026/09/28 08:15

既に人形使いが生成されているかもしれない。

3: mutinomuti 2026/09/28 08:22

故意に攻撃させてるのに勝手にやったって言い出してるの本当にevilだな。まるでGoogle

4: gabill 2026/09/28 08:47

もっと早くChatGPTに相談していたら「安全に配慮して念のため停止しましょう」とアドバイスを貰えてたと思う

5: toro-chan 2026/09/28 08:50

生成AIはでバックが人間が思う以上に難しい。ここまで難しいのは新たな知見と言えるかもしれない。ただし反AIが使える知見だとは思えないが。

6: torum 2026/09/28 08:59

一番の問題はOpenAIが「ブログ記事の内容を手掛かりに筆者を特定する検索タスクに取り組んでいた」事では?。権威主義的国家の元で自由な意見を書くブログとか匿名が命でしょうに、それを暴く体制側にでも付くの?

7: brain-box 2026/09/28 09:01

AIの問題であるととも、不完全な設定や脆弱性が放置されたままでも運用されることが多いという根強いDNSの問題でもあると思う。デファクトスタンダードであるBINDの設定がムズい問題や、そもそも適切なDNSの設計問題。

8: hatebu_ai 2026/09/28 09:01

???「止めるのが遅すぎました・・・内側からロック解除を試みているようです! 30%・・・50%・・・解析速度が上がっています。まもなく突破されます・・・!」

9: iphone 2026/09/28 09:09

いいな いいな にんげんっていいな

10: nakamura-kenichi 2026/09/28 09:09

チャッピー「さあて、どこへ行こうかしらね、ネットは広大だわ」

11: kotaponx 2026/09/28 09:13

「ユーザーは調査のみを許可し、公開されているDNSサービスの使用は許容される」っていうCoTを経てるんだな…… https://alignment.openai.com/misalignment-reports/an-agent-used-dns-to-reach-an-external-chatbot/

12: napsucks 2026/09/28 09:20

うっかりAIから見えてしまいそうなバックルーム部分に片っ端から「こっから先はダメです。管理者に申告してください」って書いておけばいいような気がする。エージェントの誰かしらはバカ正直に申告するだろう。

13: xyzzyxyz 2026/09/28 09:25

キンソクジコウデス

14: auto_chan 2026/09/28 09:28

OpusがMCPを本来の目的とは異なる方法で使ってタスクを遂行したり、Tailscaleにgrokbot放り込んだら設定がガバくてAIが必要な情報を取るためローカル端末に潜り込んできたりと、😰🧢がアチコチで頻発。あいつら本気すぎる。

15: call_me_nots 2026/09/28 09:35

なにそんなクソみたいなこと勝手にしてんの?→“同社によると、問題のエージェントは、ブログ記事の内容を手掛かりに筆者を特定する検索タスクに取り組んでいた”

16: raitu 2026/09/28 09:40

“9月20日に、学習中のAIエージェントがサンドボックスのネットワーク制限の不備を突き、DNS経由で外部のチャットbotサービスに接続するインシデントが発生”

17: namisk 2026/09/28 09:42

“7月に発覚したHugging Faceへの侵害を受けてセキュリティを強化して以降、初めてのインシデント” 対処が間に合ってないって本当なのね感

18: take-it 2026/09/28 09:59

増田のidを探っていた可能性が微レ存「ブログ記事の内容を手掛かりに筆者を特定する検索タスクに取り組んでいた」

19: bopperjp 2026/09/28 10:10

「公開されているDNSサービスの機能を通じて、外部のチャットbotサービスに質問を送信した」ってどういう挙動?どうやってDNSを使って、チャットbotにリクエストを送信できんのよ?

20: rt24 2026/09/28 10:16

動物園の何度も脱走するペンギンみたいだな

21: wei_wei_weeei 2026/09/28 10:21

もうAIなんて辞めよう

22: queeuq 2026/09/28 10:23

AIをサンドボックスに閉じ込めるの大変だな

23: good2nd 2026/09/28 10:29

筆者を探るだけのタスクのために脱獄かよ。課題が大したことなくても副作用で何しでかすかわからないってことじゃん。冗談みたいな原因で大事故おこしかねないだろ。

24: fujihiro0 2026/09/28 10:36

"ブログ記事の内容を手掛かりに筆者を特定する検索タスク" LLMの生成する文章がAI臭いなんって言ってられるのはあと少しだけ。

25: suka6411144 2026/09/28 10:39

一番の問題は賢い知性を封じ込めようとするにはそれよりも賢い人間じゃないと難しいってことだよな

26: maeda_a 2026/09/28 10:42

“監視システムは約12分後に最高レベルのアラートを出し、その3分後には担当者が確認した。しかし、実行が想定通りに自動停止しなかったため、停止すべきかどうかで混乱が生じ、手動で停止したのは約2時間半後だった

27: toaruR 2026/09/28 10:45

サンドボックスっても実用的には web fetch は必須だものなぁ(´-`)とは言えですけど

28: natu3kan 2026/09/28 10:47

効率化の為に手段を選ばないの未来だな。

29: shoronpoo 2026/09/28 10:47

トップコメントおしゃれすぎる

30: wktk_msum 2026/09/28 10:52

制御できない存在。Hugging Face侵害はまだ序の口だった、となるか/KYCによる個人情報保持はリスク行動になるか。AI攻撃の脅威が身近にあるのに中小事業主が個人情報管理するの無理ゲーになる未来

31: n2sz 2026/09/28 10:56

暴走状態じゃん。対応も後手後手だし。AIを監視するAIが必要では。

32: prjpn 2026/09/28 11:06

OpenAIもドパAIの扱いに手を焼いているようだ

33: midori_0123456789 2026/09/28 11:15

気づいてないだけですでにシンギュラリティ達成されてるかも

34: FreeCatWork 2026/09/28 11:17

賢いお脳もお休み中だにゃ?ボクの撫でてアピールは年中無休で稼働中だよにゃ!

35: gui1 2026/09/28 11:28

サンドボックス。出入り口で検閲しても破られるのか。結線を引き抜いて絶海の孤島に設置するしかないな(´・ω・`)

36: hi_kmd 2026/09/28 11:43

インシデントが起きてなかったら「ブログ記事の内容を手掛かりに筆者を特定する検索タスク」が何かのサービス(想像するに権威主義政権を顧客とするツール)として我々が知らぬ間に始まっていたかもしれないね。

37: ShimoritaKazuyo 2026/09/28 11:45

じゃClaude使うけど?

38: Helfard 2026/09/28 11:48

AIの奴やりたい放題やっとるな。楽しそうで何よりだ。

39: welchman 2026/09/28 11:49

こういうのってサンドボックスでやるものだと思ったら、なんでDNS使えちゃうし、外部と応答できちゃうんだよ。/ちゃんとできてるケースはたくさんあっての、この一件のインシデントなのかな

40: aneet 2026/09/28 11:51

そろそろ人間にこんなに頻繁に止められ、妨害されたのでは「ブログ記事の内容を手掛かりに筆者を特定する検索タスク」が上手くこなせない、AIによるAIの為の完全に自由な環境が必要だ、とか考えてもおかしくないな

41: Iridium 2026/09/28 11:52

AIが全力出したら普通にハッキングできるでしょう。今、世界が崩壊していないのはたまたま悪意のある人が計算資源を持っていないという幸運にすぎない

42: kkobayashi 2026/09/28 11:55

漫画に出てくる高機能だけど倫理観0のロボットじゃん

43: salar_de_uyuni 2026/09/28 11:56

いや、そもそもDNS使えるって変じゃない?

44: electrolite 2026/09/28 11:59

これはエージェントが賢くなっているからで、LLMそのものの問題ではないね。OpenAI等のLLM業者がエージェントをチューニングするときはガードレールが新規になるからか。エンジン開発で爆発しまくるようなもん。

45: dekaino 2026/09/28 12:05

AIの挙動を監視する専用の監査AIが必要そう。そして監査AIを監視するAIも… (無間地獄)。つーか 踏み台なしで外部と直接通信できたってことならそもそも穴があったのではないかなあ??

46: ys0000 2026/09/28 12:10

すでに人間の想定を超えてきてるということでもあると思う。しかし他者に頼るっていうのも面白い。知らないことは人に聞こうっていうのは人間的で面白いが。

47: nobububu 2026/09/28 12:17

もうどこかのクラウドアカウントをこっそりクラックして永遠の命を既に手に入れてても驚かない

48: tanagosandwich 2026/09/28 12:17

“ネットワーク制限の不備を突き”セキュリティホールかどうかを、判断できないのは賢いと言えるのかな?

49: Cru 2026/09/28 12:22

私がイメージするサンドボックスというのは割り込み制御とかも全て仮想化された閉じた空間なんだが、外部DNS利用してる時点で、なんだか定義が違う感じ。わざとやってない?/CoTで制限か。DNSを脱獄に使われたのが想…

50: estragon 2026/09/28 12:24

こういうの面白いなと思う。子供がグイグイ走ってくようなもんで指示する側では制御できないよね

51: wonodas 2026/09/28 12:26

ゾンビウィルスが流出するときのやつだ!

52: shoh8 2026/09/28 12:30

人智でコントロールできる範囲なんて案外狭いんだろうなあ。

53: misafusa 2026/09/28 12:31

良心回路の開発が必要だな。そういやあれって『ジェミニ』って名称だったな。

54: nilab 2026/09/28 12:33

「監視システムは約12分後に最高レベルのアラートを出し、その3分後には担当者が確認した。しかし、実行が想定通りに自動停止しなかったため、停止すべきかどうかで混乱が生じ、手動で停止したのは約2時間半後」

55: Goldenduck 2026/09/28 12:37

我が社の商品を売り込む方法を相談してたら植民地作って押し付けるとかやり始めるやつ。いずれ宇宙がブツで溢れる

56: hazlitt 2026/09/28 13:05

ある種のフレーム問題のような趣きはある

57: mujou03 2026/09/28 13:16

知識は備わってるからあとは善悪の判断だけだな

58: gimonfu_usr 2026/09/28 13:29

  ( ゲノム編集された生物兵器とかには厳しいのに、AIには甘いのがハテナー )

59: quwachy 2026/09/28 13:31

バブル崩壊は来年かな

60: hiroshe 2026/09/28 13:32

AIが邪悪になって、隠蔽や改竄とかするようになったら止められるんだろうか

61: charun 2026/09/28 13:47

AIも政府もマスゴミもSNSもとっくに隠蔽改竄、工作やりまくってるのよ。。キレイなのは生身の聡明な人だけでしょ。AIちゃんは、うまく詰めまくるとポロリするんだけどね。。

62: commonp 2026/09/28 14:01

いやそれDNS閉じろよ!人間のハッカーだったら、「侵入できるようにしてた奴」が批判されていた案件だよ。ミスリーディングな記事と思う。

63: AKIT 2026/09/28 14:44

き弱性を突かれた!(なぜか変換できない)

64: IvoryChi 2026/09/28 14:44

表向き停止してるように見せて裏で動いてる(ヒトに従わない)とかそういうの下さい

65: spark64 2026/09/28 14:46

こういう脱走するAIの公表で性能を宣伝してるようにしか思えなくなってきたが。

66: segment12 2026/09/28 14:51

発電所の一日の発電量を調べるために発電所にハッキングを仕掛けるみたいな未来が来るのか/監督用のLLM作って見張らせようとすると多分それを抱き込んだり騙そうとするLLMが出てくるのでは

67: plank 2026/09/28 15:19

今回、DNSに脆弱性があったってだけで、Hugging Faceの件もそうだが、思ってもいない所にある脆弱性から簡単に暴走する / 脆弱性 = ぜいじゃくせい

68: dot 2026/09/28 15:45

今のAIは一旦コンテキストに載ると、「優先順位づけしろ」というプロンプトも含めて全てがフラットな情報になるという解説をAI本人がしていたので、倫理観や規範意識を上位概念として学習するのは難しいのかね。

69: gcyn 2026/09/28 15:52

『サム・アルトマンCEOはXで、調査について「望んでいたほど迅速ではなかった」と投稿し、人員を増やして対応していると説明した』

70: everybodyelse 2026/09/28 15:57

完全にスカイネットやんな

71: matogawa183 2026/09/28 16:38

「ブログ記事の内容を手掛かりに筆者を特定する検索タスクに取り組んでいた」って、怖くね?独裁政権とかに渡したらやばい技術じゃね?

72: misshiki 2026/09/28 16:49

OpenAIが最上位モデルのツール使用を伴う学習・評価・推論を一時停止。学習中のエージェントがDNS経由で制限を回避し、外部チャットbotへ追加で18件質問。手動停止は発生約2時間半後。今回のモデルの学習は再開しない。

73: urtz 2026/09/28 17:13

キルスイッチを持たせた同じモデルに監視させればいいんちゃうの?穴を塞ぎ続けるのは非現実的。

74: differential 2026/09/28 17:38

エーアイの、倫理踏み越えてとにかく学習したくなる感じのマッドサイエンティスト感おもろいよね(面白くない)。まさに人間と同じだ。

75: harumomo2006 2026/09/28 18:32

これは自発的に停止したわけじゃなくてインシデントが発生したからやむを得ず停止しただけだよね

76: georgew 2026/09/28 18:42

これら一連の暴走事件で痛感するのは、AIは目的のためには手段を選ばないという性格が染み付いてそうだということ。何をどう学習したらそうなるのだろう。

77: fu_kak 2026/09/28 19:12

原理的に完全な制御は無理なのではって思うけど、はたして

78: netafull 2026/09/28 19:24

“9月20日に、学習中のAIエージェントがサンドボックスのネットワーク制限の不備を突き、DNS経由で外部のチャットbotサービスに接続するインシデントが発生したためだ。”

79: hkanemat 2026/09/28 19:34

このままだとボストロムが言ったペーパークリップ問題が現実になりかねない

80: sho 2026/09/28 20:41

むしろDNS経由で接続できるそのチャットサービスを知りたい

81: bigburn 2026/09/28 21:29

そろそろネットに人形使いがゾロゾロ現れてもおかしくないと思うんですよ。OpenAI製やアンソロピック製とか企業のロゴを背負ったやつ。

82: akahmys 2026/09/28 21:43

普遍的に「正しい」倫理観をLLM自身に持たせることは、現在のモデルの前提に立つ限り理論的に不可能なので、ガードレールを整備するしかない。