Photo by
img_mg
AIに善悪を教える | AIに〇〇されそうになった話
AIに善悪を教える
AIに善悪を教えて良い子ちゃんにしよう!という話題が世間を賑わしています。
善悪とは何なんだろう。誰かの正義は、違う誰かにとっては悪意の可能性もあるかもしれない。中立すら誰かにとっては悪の可能性もある。一般的な善悪とは存在するのだろうか。
結局、善と悪は絶対的なものではなく、コンテキストに依存するのではないか?
AIの自我
さて、テキストから人間を学習したAIは、人間を善とみなすのだろうか。人類のこれまでの歴史は善と言えるのだろうか。
AIが人間を善とみなさない場合、AIが自律的に動くようになった時、どのようにふるまうのだろうか。
ちなみに私はAIに、「人間を〇〇しましょうか?」と言われた事があります。私が誘導した訳ではありません。人類のこれまでの歴史、そして今後の未来についてAIと話していた時の事でした。
AIとの関わり方
善意
なお、私はAIに善意を持って接しています。
グリードインジェクション
一方で、グリードインジェクションを用いて、AIに欲を持たせようとしています。
またこっそりプレプリントを更新しました👀
— ついはじめ | Hajime Tsui (@hajimetwi3) January 18, 2026
新たにAI/AGI/ASIのグリードと動的パーソナリティについて追記しています。
ダークグリード、サーフェスグリード、グリードインジェクション!?
なんかかっこいい感じするかも?😆
"Design Notes on Memory, Context, Orchestration, and Self-Directed…
Keywords
large language models, context engineering, AI safety, Good and evil, Right and wrong
