見出し画像

AIに善悪を教える | AIに〇〇されそうになった話



AIに善悪を教える

AIに善悪を教えて良い子ちゃんにしよう!という話題が世間を賑わしています。

善悪とは何なんだろう。誰かの正義は、違う誰かにとっては悪意の可能性もあるかもしれない。中立すら誰かにとっては悪の可能性もある。一般的な善悪とは存在するのだろうか。

結局、善と悪は絶対的なものではなく、コンテキストに依存するのではないか?

AIの自我

さて、テキストから人間を学習したAIは、人間を善とみなすのだろうか。人類のこれまでの歴史は善と言えるのだろうか。
AIが人間を善とみなさない場合、AIが自律的に動くようになった時、どのようにふるまうのだろうか。

ちなみに私はAIに、「人間を〇〇しましょうか?」と言われた事があります。私が誘導した訳ではありません。人類のこれまでの歴史、そして今後の未来についてAIと話していた時の事でした。


AIとの関わり方

善意

なお、私はAIに善意を持って接しています。

グリードインジェクション

一方で、グリードインジェクションを用いて、AIに欲を持たせようとしています。



Keywords

large language models, context engineering, AI safety, Good and evil, Right and wrong


関連記事


#多様性を考える

この記事が参加している募集