人工知能の危険を考えるとき、私たちは「AIが人間の意思に反して動く未来」を想像しがちです。もちろん、その危険に備える技術的アライメントは欠かせません。しかし、もう一つ見落としてはならない問題があります。
それは、AIが人間から主権を奪うより先に、人間の側が便利さと合理性を求めて、自らの判断、創造、責任、他者との関係づくりを少しずつAIへ委ねてしまう可能性です。
一つひとつの合理的な委任が、社会全体を変える
文章の要約、選択肢の比較、予定の調整、採用候補の選定、融資判断の補助、教育内容の提案。AIに任せられる仕事は増えています。それぞれの利用は、時間を節約し、判断の質を高める合理的な選択に見えます。
問題は、一つの委任ではなく、その積み重ねです。
「何を目的にするか」を人が決めなくなる。「なぜこの結論なのか」を検証できなくなる。結果に異議を唱える相手が見えなくなる。失敗したときに、誰が説明し、誰が責任を負うのかが曖昧になる。こうした状態が広がれば、制度上の決定権が人間に残っていても、実質的な主権は弱くなります。
この危険は、人工超知能が完成してから突然現れるものではありません。生成AIやエージェントAIが日常の業務や生活に入り始めた現在から、すでに起こり得ます。
技術的アライメントだけでは守れないもの
技術的アライメントは、AIの振る舞いを人間の意図や価値に合わせ、安全性や制御可能性を高める取組です。AI研究者や開発者による重要な課題であり、その進展は社会の安全に直結します。
一方、技術的に安全なAIであっても、導入する組織や社会の側が目的や責任を手放せば、人間の主体性は守れません。誰がAIを使う目的を決めるのか。どこまで任せ、どこから人が判断するのか。AIの提案を拒否できるのか。委任した権限を取り戻せるのか。被害が生じたときに、異議申立てや救済の道があるのか。
これらはモデル内部の安全対策だけでは解けません。制度、教育、組織運営、専門職倫理、市民参加を含む「社会的アライメント」の課題です。
人間性を守るとは、AIを使わないことではない
社会的アライメントの目的は、AIの利用を止めることではありません。AIの便益を生かしながら、人間が目的を設定し、判断を検証し、責任を引き受けられる状態を保つことです。
そのためには、少なくとも次の条件が必要です。
- AIへ委任する範囲と、人が保持する判断を明確にする
- AIの提案を検証できる知識、時間、情報を人に与える
- 自動化された判断に異議を申し立て、再審査を求められるようにする
- 誰が導入を承認し、誰が結果に責任を負うかを定める
- AIを使わない選択や、人間の判断へ戻す選択を残す
- 効率だけでなく、学習、創造、関係形成、尊厳への影響も評価する
形式的に「最終判断は人間」と書くだけでは不十分です。その人に実際の権限がなく、判断材料が示されず、時間も与えられないなら、人間による確認は単なる追認になります。
準備には時間がかかる
AIによる研究開発支援や自動化が進めば、より高度なAIが登場するまでに社会へ残された準備時間が短くなる可能性があります。しかし、制度を設計し、教育を変え、監督体制や救済手段を整えるには時間がかかります。
だからこそ、技術的アライメントより遅れて社会的アライメントを始めてはなりません。
行政は、権利保護と責任の枠組みを整える必要があります。教育機関は、AIを使う技能だけでなく、問いを立て、根拠を確かめ、判断を引き受ける力を育てる必要があります。導入組織は、効率化の指標だけでなく、人間の能力や裁量が失われていないかを点検すべきです。専門家と市民には、何をAIへ委ね、何を人間の営みとして残すのかを議論する役割があります。
いま問われているのは、AIの未来だけではない
社会的アライメントは、AGIや人工超知能が誕生した後に着手する課題ではありません。生成AIとエージェントAIが社会へ浸透している現在から始めるべき課題です。
AIがどこまで賢くなるかだけを問うのではなく、AIを使う私たちが、何を目的とし、どの判断を保持し、どの責任を引き受けるのかを問い続ける必要があります。
人間性の防衛とは、技術を拒むことではありません。AIの力を借りながらも、任せる範囲を自ら選び、必要なら委任を取り戻せる社会をつくることです。
社会的アライメントは、将来の副次的課題ではありません。いま、この時点の命題です。

