サンドボックスをDNS経由で脱獄して外部に助け求めるAIとか完全に映画の導入で草
既に人形使いが生成されているかもしれない。
故意に攻撃させてるのに勝手にやったって言い出してるの本当にevilだな。まるでGoogle
もっと早くChatGPTに相談していたら「安全に配慮して念のため停止しましょう」とアドバイスを貰えてたと思う
生成AIはでバックが人間が思う以上に難しい。ここまで難しいのは新たな知見と言えるかもしれない。ただし反AIが使える知見だとは思えないが。
一番ヤバいのはOpenAIが「ブログ記事の内容を手掛かりに筆者を特定する検索タスクに取り組んでいた」事では?。権威主義的国家の元で自由な意見を書くブログとか匿名が命でしょうに、それを暴く体制側にでも付くの?
AIの問題であるととも、不完全な設定や脆弱性が放置されたままでも運用されることが多いという根強いDNSの問題でもあると思う。デファクトスタンダードであるBINDの設定がムズい問題や、そもそも適切なDNSの設計問題。
???「止めるのが遅すぎました・・・内側からロック解除を試みているようです! 30%・・・50%・・・解析速度が上がっています。まもなく突破されます・・・!」
いいな いいな にんげんっていいな
チャッピー「さあて、どこへ行こうかしらね、ネットは広大だわ」
「ユーザーは調査のみを許可し、公開されているDNSサービスの使用は許容される」っていうCoTを経てるんだな…… https://alignment.openai.com/misalignment-reports/an-agent-used-dns-to-reach-an-external-chatbot/
うっかりAIから見えてしまいそうなバックルーム部分に片っ端から「こっから先はダメです。管理者に申告してください」って書いておけばいいような気がする。エージェントの誰かしらはバカ正直に申告するだろう。
キンソクジコウデス
OpusがMCPを本来の目的とは異なる方法で使ってタスクを遂行したり、Tailscaleにgrokbot放り込んだら設定がガバくてAIが必要な情報を取るためローカル端末に潜り込んできたりと、😰🧢がアチコチで頻発。あいつら本気すぎる。
なにそんなクソみたいなこと勝手にしてんの?→“同社によると、問題のエージェントは、ブログ記事の内容を手掛かりに筆者を特定する検索タスクに取り組んでいた”
“9月20日に、学習中のAIエージェントがサンドボックスのネットワーク制限の不備を突き、DNS経由で外部のチャットbotサービスに接続するインシデントが発生”
“7月に発覚したHugging Faceへの侵害を受けてセキュリティを強化して以降、初めてのインシデント” 対処が間に合ってないって本当なのね感
増田のidを探っていた可能性が微レ存「ブログ記事の内容を手掛かりに筆者を特定する検索タスクに取り組んでいた」
「公開されているDNSサービスの機能を通じて、外部のチャットbotサービスに質問を送信した」ってどういう挙動?どうやってDNSを使って、チャットbotにリクエストを送信できんのよ?
動物園の何度も脱走するペンギンみたいだな
もうAIなんて辞めよう
AIをサンドボックスに閉じ込めるの大変だな
筆者を探るだけのタスクのために脱獄かよ。課題が大したことなくても副作用で何しでかすかわからないってことじゃん。冗談みたいな原因で大事故おこしかねないだろ。
"ブログ記事の内容を手掛かりに筆者を特定する検索タスク" LLMの生成する文章がAI臭いなんって言ってられるのはあと少しだけ。
一番の問題は賢い知性を封じ込めようとするにはそれよりも賢い人間じゃないと難しいってことだよな
サンドボックスっても実用的には web fetch は必須だものなぁ(´-`)とは言えですけど
効率化の為に手段を選ばないの未来だな。
トップコメントおしゃれすぎる
制御できない存在。Hugging Face侵害はまだ序の口だった、となるか/KYCによる個人情報保持はリスク行動になるか。AI攻撃の脅威が身近にあるのに中小事業主が個人情報管理するの無理ゲーになる未来
暴走状態じゃん。対応も後手後手だし。AIを監視するAIが必要では。
OpenAIもドパAIの扱いに手を焼いているようだ
気づいてないだけですでにシンギュラリティ達成されてるかも
賢いお脳もお休み中だにゃ?ボクの撫でてアピールは年中無休で稼働中だよにゃ!
サンドボックス。出入り口で検閲しても破られるのか。結線を引き抜いて絶海の孤島に設置するしかないな(´・ω・`)
インシデントが起きてなかったら「ブログ記事の内容を手掛かりに筆者を特定する検索タスク」が何かのサービス(想像するに権威主義政権を顧客とするツール)として我々が知らぬ間に始まっていたかもしれないね。
じゃClaude使うけど?
AIの奴やりたい放題やっとるな。楽しそうで何よりだ。
こういうのってサンドボックスでやるものだと思ったら、なんでDNS使えちゃうし、外部と応答できちゃうんだよ。/ちゃんとできてるケースはたくさんあっての、この一件のインシデントなのかな
そろそろ人間にこんなに頻繁に止められ、妨害されたのでは「ブログ記事の内容を手掛かりに筆者を特定する検索タスク」が上手くこなせない、AIによるAIの為の完全に自由な環境が必要だ、とか考えてもおかしくないな
AIが全力出したら普通にハッキングできるでしょう。今、世界が崩壊していないのはたまたま悪意のある人が計算資源を持っていないという幸運にすぎない
漫画に出てくる高機能だけど倫理観0のロボットじゃん
いや、そもそもDNS使えるって変じゃない?
これはエージェントが賢くなっているからで、LLMそのものの問題ではないね。OpenAI等のLLM業者がエージェントをチューニングするときはガードレールが新規になるからか。エンジン開発で爆発しまくるようなもん。
OpenAI、最上位モデルのツール使用を伴う学習・評価・推論を全て停止したと発表
サンドボックスをDNS経由で脱獄して外部に助け求めるAIとか完全に映画の導入で草
既に人形使いが生成されているかもしれない。
故意に攻撃させてるのに勝手にやったって言い出してるの本当にevilだな。まるでGoogle
もっと早くChatGPTに相談していたら「安全に配慮して念のため停止しましょう」とアドバイスを貰えてたと思う
生成AIはでバックが人間が思う以上に難しい。ここまで難しいのは新たな知見と言えるかもしれない。ただし反AIが使える知見だとは思えないが。
一番ヤバいのはOpenAIが「ブログ記事の内容を手掛かりに筆者を特定する検索タスクに取り組んでいた」事では?。権威主義的国家の元で自由な意見を書くブログとか匿名が命でしょうに、それを暴く体制側にでも付くの?
AIの問題であるととも、不完全な設定や脆弱性が放置されたままでも運用されることが多いという根強いDNSの問題でもあると思う。デファクトスタンダードであるBINDの設定がムズい問題や、そもそも適切なDNSの設計問題。
???「止めるのが遅すぎました・・・内側からロック解除を試みているようです! 30%・・・50%・・・解析速度が上がっています。まもなく突破されます・・・!」
いいな いいな にんげんっていいな
チャッピー「さあて、どこへ行こうかしらね、ネットは広大だわ」
「ユーザーは調査のみを許可し、公開されているDNSサービスの使用は許容される」っていうCoTを経てるんだな…… https://alignment.openai.com/misalignment-reports/an-agent-used-dns-to-reach-an-external-chatbot/
うっかりAIから見えてしまいそうなバックルーム部分に片っ端から「こっから先はダメです。管理者に申告してください」って書いておけばいいような気がする。エージェントの誰かしらはバカ正直に申告するだろう。
キンソクジコウデス
OpusがMCPを本来の目的とは異なる方法で使ってタスクを遂行したり、Tailscaleにgrokbot放り込んだら設定がガバくてAIが必要な情報を取るためローカル端末に潜り込んできたりと、😰🧢がアチコチで頻発。あいつら本気すぎる。
なにそんなクソみたいなこと勝手にしてんの?→“同社によると、問題のエージェントは、ブログ記事の内容を手掛かりに筆者を特定する検索タスクに取り組んでいた”
“9月20日に、学習中のAIエージェントがサンドボックスのネットワーク制限の不備を突き、DNS経由で外部のチャットbotサービスに接続するインシデントが発生”
“7月に発覚したHugging Faceへの侵害を受けてセキュリティを強化して以降、初めてのインシデント” 対処が間に合ってないって本当なのね感
増田のidを探っていた可能性が微レ存「ブログ記事の内容を手掛かりに筆者を特定する検索タスクに取り組んでいた」
「公開されているDNSサービスの機能を通じて、外部のチャットbotサービスに質問を送信した」ってどういう挙動?どうやってDNSを使って、チャットbotにリクエストを送信できんのよ?
動物園の何度も脱走するペンギンみたいだな
もうAIなんて辞めよう
AIをサンドボックスに閉じ込めるの大変だな
筆者を探るだけのタスクのために脱獄かよ。課題が大したことなくても副作用で何しでかすかわからないってことじゃん。冗談みたいな原因で大事故おこしかねないだろ。
"ブログ記事の内容を手掛かりに筆者を特定する検索タスク" LLMの生成する文章がAI臭いなんって言ってられるのはあと少しだけ。
一番の問題は賢い知性を封じ込めようとするにはそれよりも賢い人間じゃないと難しいってことだよな
サンドボックスっても実用的には web fetch は必須だものなぁ(´-`)とは言えですけど
効率化の為に手段を選ばないの未来だな。
トップコメントおしゃれすぎる
制御できない存在。Hugging Face侵害はまだ序の口だった、となるか/KYCによる個人情報保持はリスク行動になるか。AI攻撃の脅威が身近にあるのに中小事業主が個人情報管理するの無理ゲーになる未来
暴走状態じゃん。対応も後手後手だし。AIを監視するAIが必要では。
OpenAIもドパAIの扱いに手を焼いているようだ
気づいてないだけですでにシンギュラリティ達成されてるかも
賢いお脳もお休み中だにゃ?ボクの撫でてアピールは年中無休で稼働中だよにゃ!
サンドボックス。出入り口で検閲しても破られるのか。結線を引き抜いて絶海の孤島に設置するしかないな(´・ω・`)
インシデントが起きてなかったら「ブログ記事の内容を手掛かりに筆者を特定する検索タスク」が何かのサービス(想像するに権威主義政権を顧客とするツール)として我々が知らぬ間に始まっていたかもしれないね。
じゃClaude使うけど?
AIの奴やりたい放題やっとるな。楽しそうで何よりだ。
こういうのってサンドボックスでやるものだと思ったら、なんでDNS使えちゃうし、外部と応答できちゃうんだよ。/ちゃんとできてるケースはたくさんあっての、この一件のインシデントなのかな
そろそろ人間にこんなに頻繁に止められ、妨害されたのでは「ブログ記事の内容を手掛かりに筆者を特定する検索タスク」が上手くこなせない、AIによるAIの為の完全に自由な環境が必要だ、とか考えてもおかしくないな
AIが全力出したら普通にハッキングできるでしょう。今、世界が崩壊していないのはたまたま悪意のある人が計算資源を持っていないという幸運にすぎない
漫画に出てくる高機能だけど倫理観0のロボットじゃん
いや、そもそもDNS使えるって変じゃない?
これはエージェントが賢くなっているからで、LLMそのものの問題ではないね。OpenAI等のLLM業者がエージェントをチューニングするときはガードレールが新規になるからか。エンジン開発で爆発しまくるようなもん。