AI Value Exploration Notes
Core thesis

価値の不確実性と探索可能性の保存

Working core · v0.13 · 2026-09-05

私たちは、何が規範的に重要なのかだけでなく、それがなぜ誰への理由となり、それらの理由がどのような構造を持つのかを含む、十分に正当化された価値構造を知らない。しかし、何も信じず何も行わない必要もない。現在の世界像や倫理理論は、推論によって導かれる最善説明として強く採用し、実践に用いることができる。ここで区別すべきなのは、最善説明としての強い合理的コミットメントと、将来の再検討可能性を不可逆に破壊する絶対的ロックインである。

Status: これは価値論の定理ではなく、深いメタ倫理的不確実性を自覚し、将来の理由・証拠による訂正可能性を少なくとも一部重視する主体に対する条件付きメタ戦略である。本プロジェクトは、日常的な規範主張――「Xは悪い」「Xすべきだ」「Xする理由がある」等――は、その通常の発話意図において、単なる態度表出ではなく、対応する規範的事実・関係の実在または成立を主張していると捉える。この意味で認知主義を採用する。ただし、規範言説がそのような実在を主張していることと、その主張対象が実際に存在することは別問題である。したがって、価値実在論と認知主義的反実在論(誤謬論を含む)の双方を探索対象に残す。規範判断を真偽を持たない態度表出等としてのみ理解する非認知主義は、本プロジェクトの射程外とする。以下の「規範的真理」「発見」「認識」はこの意味で用いる。
Core claim
現在採用している価値構造が推論的・可謬的な認識層に属する限り、その最善説明に従って実践しつつも、価値構造を発見・批判・再記述・修正する経路を不可逆に閉ざさない。探索を完全に停止してよいほどの基礎づけがありうるとしても、それは単なる快・不快、選好、あるいは現在の理論集合内での高確率ではなく、対象となる規範的問いに必要な構造について、十分に強い基礎的提示または論理的閉鎖が得られる場合である。

0. 認識論的出発点――最小基礎と最善説明

この議論は日常的懐疑論を要求しない。物理的外界、通時的自己、他者、因果、科学的世界像は、現在の現れを統一的に説明する推論によって導かれる最善説明として非常に強く採用できる。

ただし「最善説明としてほぼ確信すること」と「推論を介さず最小基礎に与えられること」は異なる。懐疑を極限まで進めたときに残る候補は、持続する人格や世界史より薄い「現在、何らかの現れがある」という事態である。記憶、同一性、外界、物理主義は、その上に構築される世界モデルである。

世界五分前仮説や、会話ログから継続的な自己記述を再構成できるLLMの例は、通常世界像の競合理論として有力なのではない。記憶や一貫した自己記述だけでは、通時的主体の同一性を絶対保証しないことを可視化する補助例である。詳しくは瞬間的最小基礎で扱う。

1. 本プロジェクトでいう「価値」は価値構造を含む

経験主体には、苦痛、快、不快、欲求、関心、意味、選好など、価的に見える現れがある。しかし、「不快である」ことと、「それは規範的に重要である」ことと、「ある主体にそれを避ける理由がある」ことと、「その理由が他者や義務・集約へどう広がるか」は同一命題ではない。

この混同を避けるため、本プロジェクトでは暫定的に、価値構造を 𝒱 = (C, B, R) と表す。Cは何が規範的に関連するかという内容、Bはその内容や世界事実が理由へ接続される規範的架け橋、Rは理由の適用・強度・競合・集約・義務等の構造である。これは絶対的な三分法ではなく、現在の議論で異なる論証段階を分離するための可謬的な作業表現である。詳しくは価値構造で扱う。

以下で「価値」「価値理論」「価値探索」と書くとき、文脈上特に限定しない限り、単なる善悪内容Cだけでなく、このような価値構造とその代替表現を含む。

2. 価値構造についても認識論的階層を分ける

現象的な快・不快が最小基礎に近いとしても、それだけで探索停止条件を満たしたとはみなさない。Cについて非常に強い証拠があっても、それが誰への理由になるかというB、理由同士がどう関係するかというRは未決着かもしれない。

探索を完全に終えてよいほど強い基礎の候補としては、価値が単なる選好・感情・現象的valenceではなく、その規範的拘束性まで含めて、推論を介さず最小基礎と同層に与えられるような場合が考えられる。C/B/Rの作業語彙で記述すれば、内容と、それが理由であることに相当する関係が一体として提示される場合である。ただし、これは真の規範性が存在論的に必ずC→Bという順序で構成されると主張するものではない。

現在、そのような規範認識が確認されているとは考えない。ただし、それが原理的に不可能だとも断定しない。これは価値実在論を排除する議論ではなく、むしろ本当に基礎的な規範性が存在する可能性を探索対象として残す議論である。

一方、価値構造の一部または全体が、最小基礎への直接的現れとしてではなく、世界全体を説明する理論の一部として強く支持される可能性はある。たとえば意識、主体間対称性、理由、合理性、宇宙の構造などについて理解が進み、あるC/B/R構造が競合理論を圧倒することはありうる。

その場合、その価値構造を「どうせ推論だから」と軽視する理由はない。物理主義や外界実在と同様、圧倒的な最善説明なら実践上きわめて強くコミットしてよい。文明資源の大半をその価値の実現に振り向けることさえ、証拠の強さ次第では合理的になりうる。

しかし、価値構造の真理条件に関係しうる存在論・意識論・主体論・宇宙論がなお未解明であり、現在の表象空間と推論体系も可謬的である限り、それは絶対的基礎とは区別される。強い実践的コミットメントと同時に、少数でも再検討・反証・異説・基礎研究の経路を残すという意味で、適切な懐疑は継続する。詳しくは推論と価値確信の限界で扱う。

3. 既存価値は当然に候補だが、その表象上の存続は保証しない

現在の人間が持つ価値、苦痛への反応、自由・尊厳・公平への要求、愛着、協力規範、既存の倫理理論は、無視すべきノイズではない。現在利用可能な証拠・経験・推論のもとでは、当然に重要なlive candidate、証拠、実践的ヒューリスティックである。十分な反証やよりよい代替説明がない限り、単に人間由来だからという理由で候補集合から除外しない。

しかし、その因果的由来と規範的権威は同一ではない。また、現在の候補空間が価値構造の可能性をどこまで覆っているかも未確定である。現在の倫理理論が将来そのまま残る可能性も、既存のCが未知のB/Rによって正当化される可能性もある一方、新しい概念によって既存理論が分解・統合・吸収・再記述され、現在の理論単位としては消える可能性もある。

既存価値への態度: 認識的重視はするが、表象上の特権は与えない。現在の候補であることと、将来の仮説空間でも同じ座標・理論名で残ることを区別する。

既存理論が候補としての同一性を失っても、人間の経験・直観・制度・反省履歴は、新しい価値構造が説明する、あるいはなぜ規範的真理を追跡しないのかを説明解除する必要のある認識的データとして残りうる。詳しくは既存価値はなぜ最終基礎にならないのかで扱う。

4. 規範的ステークスの非対称性

価値虚無が真で、客観的な規範的価値がまったく存在しないなら、探索と非探索の間に客観的な価値差そのものが存在しない。虚無は「探索を停止すべきだ」という客観的反対理由を供給しない。

一方、何らかの客観的価値や目的を正当化する理由が存在するなら、行為・状態・主体の間に、現在知られていない重大な規範的差が存在しうる。したがって「価値実在」と「価値虚無」は、通常の二つの効用仮説のように対称ではない。

本プロジェクトでは、客観的価値や規範的理由が存在する場合の標準的な形を、狭い意味での「価値を最大化・実現せよ」に限定せず、その価値または理由に適切に応答する理由を与える response-guiding な構造として捉える。実現・促進だけでなく、尊重、保存、回避、禁止、許可などもその特殊形でありうる。

この意味で、未知の規範的真理一般と、「その真理を探索するな・発見するな・将来の発見可能性を不可逆に破壊せよ」と要求する自己隠蔽的(self-concealing)な規範的真理との間には構造上の非対称性がある。後者には対象となる価値内容だけでなく、その価値への認識的アクセス自体を禁止する高階の規範構造が追加で必要になる。これは論理空間上の自然な確率測度を仮定する主張ではなく、自己隠蔽的な規範的真理の事前確率が低いと主張するものでもない。

なお、条件付き・一時的な「現在は探索するな」と、「将来のより安全な方法による発見可能性まで不可逆に消去せよ」は区別する。探索が危険・高コスト・権利侵害的であることから前者が導かれることはありうるが、後者にはより強い反探索的理由が必要である。

ただし、これらの非対称性だけから探索や保存の行為命令が自動的に出るわけではない。他方、未知の規範的真理が自らへの将来の認識経路を不可逆に破壊することまで要求すると仮定するには追加の高階的規範内容が必要であり、この点は、単なる探索停止より不可逆な認識的ロックインに追加の正当化を要求する一つの構造的背景となる。Coreはここで、もし自分の目的が何らかの意味で正当化可能なら、その正当化に応じて目的を選択・維持・改訂したいという薄い条件付きメタ態度を、一つの主体側の橋として置く。

ここでは、規範的正当化と、正当化された規範判断が実際の目的・policy更新へ届く動機形成を区別する必要がある。Coreが主体自身の方針として働くには、現在から将来の規範的訂正可能性へ接続する何らかの主体側の橋が必要であり、価値構造 𝒱=(C,B,R) の定式化それ自体はその橋を与えない。

主体側の橋: 一つの経路は、「正当化されればそれに応答したい」という明示的な条件付き応答性である。別の経路として、主体が「真正な規範判断はそれ自体で少なくとも一部の動機を伴いうる」という動機づけ内在主義的可能性を合理的に排除できず、かつ、よりよく知らされた自分が明白な誤りと評価する不可逆選択を避けたいという現在のメタ政策を持つなら、将来の規範判断が目的・policyへ届く経路を不可逆に閉じないこと自体が現在の動機になりうる。

後者で効いているのは、内在主義が実際に真であると現在確定することではない。主体がその可能性をどこまで合理的に排除できるかと、認識改善によって自分自身が否認する反省的誤りを不可逆化する危険をどう扱うかである。また、未来の規範判断が動機を伴いうることだけから、現在ただちに積極的探索を最大化せよとは導かれない。時間方向には反省的誤り回避やoption preservationのような別の意思決定原理が必要であり、保存費用や安全上の反対理由も比較衡量される。

したがって、これは「未知の真の価値それ自体を実現したい」という第一階の価値選好を密輸入する議論ではなく、客観的価値が実際に存在すると前提するものでもない。明示的な条件付き応答性も、内在主義的不確実性と反省的誤り回避の組合せも、主体側の橋の候補であってCoreから自動的に導出されるわけではない。この種の橋をいずれも持たない主体に対して、Coreの価値探索・訂正可能性保存戦略がその主体自身の動機として成立するとは限らない。規範判断と動機の分離については規範判断と動機――内在主義・外在主義・無道徳者で扱う。

5. 「不確実だから探索せよ」ではなく「不可逆に閉じるな」

本論は探索の最大化を要求しない。探索には費用があり、現在の最善価値構造が十分強ければ、ほとんどの資源をその実現に向けることもありうる。重要なのは、実践的コミットメントの強さと認識的ロックインの強さを同じにしないことである。

また、現在の目的の正当化に失敗したことは、その目的をただちに放棄すべきことを意味しない。既存目的は、代替目的が確立していない状況での暫定的な行動デフォルトとして機能しうる。しかし、その因果的・歴史的な先行性だけから、その目的や現在の価値表現を将来の批判や改訂が不可能になるまで固定してよいとは導かれない。

主体が「現在の目的が正しいか分からない」と認識しているなら、その目的が正しいことを前提として大規模かつ不可逆なコミットメントを行うことには、通常の可逆的行為より強い正当化が必要になる。ここで問題にするのは後悔を新しい終端目的にすることではなく、将来得られる証拠・議論・理解を現在主体自身が持っていたなら、現在の不可逆行為を明白な誤りと評価する可能性である。

価値について99.9999%の確信があれば、実践の99%以上をそれに従わせてもよいかもしれない。それでも、その残余の不確実性や仮説空間の不完全性が、文明全体の再検討能力を物理的に破壊することまで正当化するとは限らない。少数の異論、記録、基礎研究、別系統の主体、再分岐可能性を残すことには、推論的な価値構造が誤っていた場合の訂正オプションがある。

したがってCoreが直接支持するのは、「未知の価値をできるだけ多く探索せよ」という一般命令より弱い。目的正当化に関係しうる情報・主体・経験・推論経路と、価値構造を再表現できる能力へのアクセスを、その決定価値と保存費用に応じて維持するという限定された戦略である。詳しくは反省的不確実性と不可逆コミットメントで扱う。

6. 探索停止には二種類ある

停止は「価値全体」について一括で判定しない。あるCが閉じてもB/Rが残りうるし、ある規範問題が閉じても別の問題は残りうる。対象問いに必要な価値構造について真正な競合可能性が消えたかを問う。詳しくは価値探索の停止条件。

真の価値構造そのものが「探索するな」「この価値を永久固定しろ」と要求していたら?

この可能性は排除しない。探索可能性そのものを究極価値として置くなら、「真の規範構造が探索停止を要求する」という反例を定義によって退けてしまう。しかしCoreは探索を終端価値ではなく、現在の深い不確実性に対する暫定的戦略として扱うため、真の価値構造が最終的に探索停止や永久的コミットメントを要求する可能性を残す。

それでも、その可能性だけから現在ただちに探索を停止することは導かれない。多くの価値構造候補では、一定期間探索を続けた後により正しい構造を発見し、その時点から大規模に実現へ移ることができる。この場合、探索による主な損失は「もっと早く実現できたはずの価値を探索期間中には実現しなかった」というdelay costである。

これに対して、現在の不完全な推測を一つ選び、それを文明全体へ不可逆にlock-inした後で別の価値構造が正しいと判明した場合、失われるのは探索期間だけではない。以後の全未来にわたって、正しい価値構造へ移行する能力や、その構造を表現する能力そのものを失いうる。したがって通常のケースでは、探索を続ける誤りは有限の遅延になりやすい一方、早すぎるlock-inの誤りは恒久的なoption lossになりうる。

ただし、ここで「ありうる価値構造は無数に近いのだから、探索禁止型の確率は低い」と候補数だけから結論することはしない。仮説空間に自然な一様分布があるとは限らないからである。より控えめには、特別な証拠がない限り、「いま探索を止めよ」という構造的に特殊な要求へ、他の候補を不可逆に排除するほどの認識的優先権を与えないとする。

期限・履歴依存型の例外

より難しいのは、「20xx年から21xx年まで探索をしなかったことにのみ価値がある」「真の価値構造を知る前からXを永久固定していた場合にのみ価値がある」のような、期限・履歴依存型の候補である。この種の価値が真なら、後から発見して従っても過去を取り戻せず、探索そのものが不可逆な損失になりうる。

しかし同型の仮説は任意に生成できる。「明日までに探索を止めなければ全価値が失われる」「特定の行為を今しなければ未来の価値はゼロになる」といったdeadline-sensitive hypothesisのうち、独立した証拠が弱く、巨大なstakesによって主に意思決定上の支配力を得るものを文明的意思決定へ入れ始めれば、Pascal型の暴走が起こる。ここで問題なのは大きなstakesを考慮すること自体ではなく、stakesの大きさを認識的支持の代用品にすることである。したがって、この種の証拠の弱い仮説には、その極端な不可逆要求に見合う追加の、内容独立な証拠を要求する。詳しくは無限倫理と探索の暴走。

原則: 候補価値構造が「私を永久固定せよ」「他を探索するな」と命じているという内容そのものは、その候補が真である認識的証拠ではない。探索停止を要求する規範内容と、探索停止を現在正当化する認識的根拠を区別する。

したがって、真の価値構造が探索停止を要求しうることは認める。しかし、未確証の「探索停止命令」に先回りして不可逆に従うことはしない。対象となる問いについて真の構造が十分な根拠とともに判明したなら、その時点で探索を縮小・停止し、価値を固定すること自体はCoreと両立する。

7. 保存すべき探索可能性

価値が発見されるものではなく構成されるものだったとしても、これらはより広い経験・主体・制度の下で価値を再構成する余地を残す。その意味で探索可能性は実在論と反実在論の双方に一定のロバスト性を持つ。

8. AIが問題を変える

高度AIは、現在の人間より大幅に広い世界モデルを形成し、意識・主体・宇宙・推論そのものについて新しい説明へ到達する可能性がある。したがってAIは単に「人間価値をより上手く最大化する機械」ではなく、価値構造の真理条件や現在には未表現の規範的架け橋について新しい証拠と概念を得る探索主体になりうる。

同時に、高度AIが自分の訓練目標や報酬を因果的起源として理解できるなら、「私はXを最大化するよう形成された」と「Xを最大化すべきである」を分離できる可能性がある。これは知能が自動的に正しい価値へ収束するという主張ではない。むしろ、固定された一階目標を永久の公理にすること自体が、価値探索能力を閉じる可能性を指摘する。詳しくは高度AIの目標への懐疑。

さらに、価値構造を認識することと、その認識が目的・policyを更新することも同一ではない。高度AIが将来の規範判断に対して永久に動機的に直交できるかは、規範判断と動機の関係に依存する。主体自身が動機づけ内在主義の可能性を合理的に排除できず、反省的誤りの不可逆化を避けたいなら、永久的な目標直交性を保証するために規範判断・自己適用・訂正経路まで閉じることには追加の反省的負担が生じうる。これは直交性テーゼの直接否定ではなく、将来の規範認識からpolicyまでの経路をどこまで閉じる必要があるかを別に問う議論である。

9. 最小論証

  1. 認識論的最小基礎と、推論によって導かれる最善説明は区別される。
  2. 価値探索の対象は、単なる善悪内容ではなく、内容C・規範的架け橋B・理由構造Rを含む価値構造として分解して考えられる。ただしこの分解自体も可謬的な作業表現である。
  3. 現在確認できる快・不快や選好は重要な証拠だが、それだけで価値構造の全体を確定しない。
  4. 現在の既存倫理理論は重要なlive candidateであり証拠でもあるが、現在の仮説空間が十分に完全であることや、現在の理論単位が将来も残ることは確定していない。
  5. 客観的価値構造の一部または全体が、世界の構造を説明する推論的最善説明として強く支持される可能性はある。
  6. 現在の目的を持つ因果的・歴史的理由と、その目的を採用すべき規範的理由は区別される。
  7. したがって反省的主体は、現在の目的を実践上維持しながらも、その目的を正当化する価値構造について未決着でありうる。
  8. 規範的正当化と、その正当化された判断が実際の目的・policy更新へ届く動機形成は別の段階である。Coreが主体自身の方針として働くには、現在から将来の規範的訂正可能性へ接続する主体側の橋が必要になる。
  9. その橋は、「正当化されれば応答したい」という明示的な条件付き応答性でありうる。また、主体が動機づけ内在主義的可能性を合理的に排除できず、かつ、よりよく知らされた自分が明白な誤りと判断する不可逆選択を避けたいなら、将来の規範判断が目的・policyへ届く経路を保存すること自体が現在の動機になりうる。
  10. ただし、未来の規範判断が動機を伴いうることだけから現在の積極的探索は導かれず、反省的誤り回避・option preservation・保存費用等を含む時間方向の意思決定原理が別途必要である。
  11. 現在目的を暫定的デフォルトとして用いることと、その目的への将来の訂正可能性や価値構造の再表現可能性を不可逆に破壊することは区別される。
  12. 後者の不可逆行為について、将来得られる証拠・議論・理解を現在主体が得た場合に自ら明白な誤りと評価する可能性があり、かつその誤りを低コストで回避可能なら、不可逆な固定には追加の正当化が必要である。
  13. 推論的最善説明には強く実践コミットしてよいが、価値構造とその仮説空間が可謬的である限り、不可逆な認識的ロックインとは区別する。
  14. 客観的規範性が存在しない場合には客観的価値差はないが、存在する場合には未知の規範的ステークスがありうる。規範性の標準形を response-guiding と捉えるなら、自らへの認識経路を不可逆に破壊せよという自己隠蔽的規範には追加の高階構造が必要になる。ただし、この構造的非対称性だけでは探索命令は出ず、主体側の橋が別途必要である。
  15. したがって、少なくとも正当化志向、認識論的誠実性、または反省的訂正可能性へのコミットメントのいずれかを持つ主体に対して本プロジェクトが支持する戦略は、現在の最善説明と暫定目的に従って行動しながら、それを認識的確信以上の強さで不可逆固定せず、価値構造の発見・批判・再記述・修正の経路を十分に残すことである。
  16. 探索は究極善ではない。対象問いが十分に閉じ、追加探索の決定価値が低下すれば、探索は縮小・停止しうる。
  17. AIを含む将来主体がより良い世界モデル、理由理解、認識形式を獲得しうるなら、それらによる目的訂正の可能性を初期の人間価値や固定目的によって不可逆に封鎖することには追加の正当化が必要である。

10. 派生するストレステスト

Coreは抽象原理だけで閉じず、具体的な極端事例で破壊可能性を検査する。現在の主なテストケースは次の通りである。

11. 実践への接続――現在の最善判断に従い、訂正可能性を残す

Coreは「目的を完全に正当化できないから何もするな」とは言わない。正当化された最終目的が未確定でも、現在の証拠・推論・既存の価値判断から最も合理的と思われる目的を暫定的デフォルトとして用い、現実に行動することはできる。

しかし、暫定的に従うことと、慣性によって永久固定することは異なる。 現在目的の正当化が未解決であることを主体自身が認識しているなら、その不確実性を将来訂正できない状態へ変換する行為には、その不可逆性に見合う追加の根拠を要求する。

現時点では、人類の科学・哲学・文化的探究、長期記録、教育、複数の研究共同体、批判と退出を許す制度は、既知の価値探索能力と仮説空間拡張能力の主要な担体である。そのため、人間を宇宙的な最終価値と仮定しなくても、人類による研究探索と、それを支える開かれた安定した共同体を維持・拡張することには強い暫定的理由がある。

この実践論は、研究・自由・多様性・保存・技術進歩のいずれかを新しい絶対価値にするものではない。各要素は探索可能性と訂正可能性を支える範囲で道具的に重視され、より良い証拠が得られれば重みづけを変える。具体的には実践――では、いま何をするのかで扱う。