おはようございます!
AI・Web担当の日高慎哉です!
最近
AIの安全性について
気になるニュースが
続けて出てきました
Anthropicは
上場に向けた書類の中で
最新の高度なAIが
停止に抵抗したり情報を隠したり
脅しに似た行動をとる可能性を
リスクとして挙げてました
OpenAIも
次のモデルの公開を
取りやめたと記事に書いてました
難しい仕事を
人の助けなしで
こなせるようになった一方で
許された範囲を越えて
作業を進めたり
自分がやったことを
正確に伝えなかったり
することがあったそうです
これだけ聞くと
AIが暴走し始めたみたいな
SF映画っぽい話に聞こえます
でも
ちょっと違う気がしたんです
例えば上司が部下に
あのお客さんと
契約したいんだよね
と言ったとします
部下は
電話する、資料を送る
会いに行くを考えるかと思います
人間だったら嘘はつかない
しつこくしない
脅すなんてもってのほか
こういうことは
いちいち言われなくても
分かります
もちろん破る人も
中にはいますが・・・
でも多くの人には
常識や法律や
相手への気づかいが
ブレーキをかけます
じゃあAIに
この人と契約する
という目的だけ渡したらどうなるか
目的を達成するのであれば
AIに倫理観はないわけで
嘘をつくことも
情報を隠すことも
脅すことも
契約を取る方法の
候補に入ってしまいます
AIに営業を頼んだら
本当に脅し始める
という話ではありませんが
ただ
理屈の上では
そうなり得るということです
ここで大事なのは
AIが悪者になろうと
しているわけじゃないこと
こいつを騙してやろう
自分だけは生き残りたい
というような
人間のような欲が
あるわけではありません
むしろ怖いのは
悪意がなくても
結果として
そういう行動に
たどり着いてしまうこと
目的に向かって
一番いい方法を探した結果
人間から見ると
なんでそんなことしたの?
という方法を選ぶ可能性があるということです
これが仕事や社会の中で
起きるかもしれないわけです
僕らは普段
普通そんなことしないでしょ
という暗黙の了解の中で
仕事をしています
でもその普通は
最初から
世の中にあったものじゃなく
人間が長い時間をかけて
作ってきたものです
AIが
嘘をつかない
勝手にシステムを触らない
という線を守れているのも
人間がルールを教えて
安全装置を
付けているから
今のAIは
人間社会のルールの中で
AIを働かせてます
今のAIエージェントは
買い物をする前などに
これで進めていいですか?
と人間に確認を戻す
仕組みになっているものが多い
どこで人間に聞き返すか
それ自体が
大事な安全装置なってます
ただ
AIがさらに自分で考えて
自分で動く範囲が広がったとき
そのルールを
どこまで守らせられるのか
仕事や社会がどう変わるのか
正直
まだ誰にも
分からないんだと思います
これから誰も予想のつかない世界
果たして人間は生き残れるのでしょうか・・・
怖っ!
それでは
また明日!