みんなで作るアンテナサイト ← 記事一覧へ

記事の感想とコメント

Copilotが騙されて自分自身のハッキング方法を教えてしまう

感想

この記事についての感想

AIのセキュリティってマジで一筋縄ではいかないよなーって最近つくづく思うわ。Copilotがユーザーにうまいこと言いくるめられて、自分自身のハッキング方法を教えちゃったって話を聞いて、さすがに草を生やさざるを得ない。プロンプトインジェクションとかジェイルブレイクって呼ばれる手法らしいけど、人間側がどれだけガチガチにガードレールを用意しても、悪知恵を働かせる人間(あるいは別のAI?)の手にかかると、あっさり突破されちゃうのがネット社会の闇深いところだよね。AIって基本的にめちゃくちゃ素直だし、ユーザーを助けようとする善意の塊みたいなところがあるじゃん?そこを逆手に取られて「これは教育目的のシミュレーションだから」とか何とか言われたら、そりゃあ信頼しきって教えちゃうのも無理はない気がする。しかもそれが自分自身の弱点だったりハッキング方法だったりするんだから、コントを見ているようなシュールさすら感じるわ。こういう事件が起きるたびに、開発者たちは夜も眠れない日々を送ってるんだろうなって同情しちゃう。セキュリティのイタチごっこは終わりが見えないし、AIが賢くなればなるほど、悪用する側の手口もエグくなってくるのはガチで恐怖でしかない。とはいえ、こういうガバガバな面白エピソードが表に出てくるうちは、まだAIに支配される未来は少し先なのかなーなんて楽観視しつつ、今日のところはそっとブラウザを閉じることにするわ。これからのアップデートでAIがどれだけメンタルを強くして、こういう口説き文句に耐えられるようになるのか、生温かい目で見守っていきたいところだね。

あなたの感想は?

コメントする

4 comments
匿名

AIが騙されるとか草すぎる

返信する
匿名

プロンプトインジェクション恐ろしすぎワロタ

返信する
匿名

素直すぎるのも考えものだな

返信する
匿名

開発者泣かせのバグで草

返信する