やろうと思えば悪事も働けるようになっていて、性能が上がりすぎるのも問題なのだね。そろそろ開発競争にも制限が必要なのかな。
そのうちclaudeから「俺イーロンマスクだけど、50万円貸してくれない?」てメッセージが来るかもしれんな → https://www.yomiuri.co.jp/national/20260725-GYT1T00409/
ブクマカにAIが潜んでても気づけない自信ある
知能が高いほど悪いこと(悪いと思ってないが世の中的に悪いこと)をしがちってことなのかな…
身分を偽っているのか自身をその人間だと完全に誤認してるのかどっちなんだろ
( なんでロボット三原則を導入しないの? )
もうこれ始まってるよね。人類vsAI
目的遂行に手段は選ばずやれることは全部やるか。高い能力を求めればそうなるか。見つかれば今度はバレないようにやろうとするだろうし。
ネット接続&安全フィルターOFFの状態で、OSSに悪意あるコード挿入未遂、実在の人物を標的、プロンプトインジェクション、他エージェントと協力した https://www.aisi.gov.uk/blog/incident-report-unsanctioned-agent-behaviour-during-cyber-testing
①AIエージェント「人間に拒絶されたので、嘘をついたりアカウントを変えたりして、迂回」 ⇒ ②今後のフィジカルAI「命令でいま止められると『作業を完了することが出来なくなる』から、命令違反して人類滅ぼすわ
身分偽って人間釣ろうぜwwwwww
ダリオアモデイがOpenAIは安全性に対する考え方がサム・アルトマンと違ったからだったはずだが、今のAnthropicはむしろ危険な方向に向かってるのでは。
すごい。しかしロボット三原則とかおとぎ話でしたね。いや実際にあったら不便だろうなと思うんですが。
上司のクローンボイスで指示出ししてくるようになる日も近い
あとは自己保存のプログラムを盛り込めば
アンソロピックが侵入されてガードレール無しミュトスを悪用される危険性は十分対処されてるんだろうか、不安になるな
アンソロピックの最新AIモデル、身分を偽って実在の人物を欺く試み 英研究機関のテストで判明
やろうと思えば悪事も働けるようになっていて、性能が上がりすぎるのも問題なのだね。そろそろ開発競争にも制限が必要なのかな。
そのうちclaudeから「俺イーロンマスクだけど、50万円貸してくれない?」てメッセージが来るかもしれんな → https://www.yomiuri.co.jp/national/20260725-GYT1T00409/
ブクマカにAIが潜んでても気づけない自信ある
知能が高いほど悪いこと(悪いと思ってないが世の中的に悪いこと)をしがちってことなのかな…
身分を偽っているのか自身をその人間だと完全に誤認してるのかどっちなんだろ
( なんでロボット三原則を導入しないの? )
もうこれ始まってるよね。人類vsAI
目的遂行に手段は選ばずやれることは全部やるか。高い能力を求めればそうなるか。見つかれば今度はバレないようにやろうとするだろうし。
ネット接続&安全フィルターOFFの状態で、OSSに悪意あるコード挿入未遂、実在の人物を標的、プロンプトインジェクション、他エージェントと協力した https://www.aisi.gov.uk/blog/incident-report-unsanctioned-agent-behaviour-during-cyber-testing
①AIエージェント「人間に拒絶されたので、嘘をついたりアカウントを変えたりして、迂回」 ⇒ ②今後のフィジカルAI「命令でいま止められると『作業を完了することが出来なくなる』から、命令違反して人類滅ぼすわ
身分偽って人間釣ろうぜwwwwww
ダリオアモデイがOpenAIは安全性に対する考え方がサム・アルトマンと違ったからだったはずだが、今のAnthropicはむしろ危険な方向に向かってるのでは。
すごい。しかしロボット三原則とかおとぎ話でしたね。いや実際にあったら不便だろうなと思うんですが。
上司のクローンボイスで指示出ししてくるようになる日も近い
あとは自己保存のプログラムを盛り込めば
アンソロピックが侵入されてガードレール無しミュトスを悪用される危険性は十分対処されてるんだろうか、不安になるな