AI Value Exploration Notes
Thesis

規範的真理への認識的開放性――規範判断以前の主体側ブリッジ

Working thesis v0.5 · 2026-09-08

Thesis: 現在目的Gを持つことと、Gに規範的権威があることは別である。しかし、純粋にGに相対的な手段合理性だけから価値探索は導かれず、Gを脅かす認識の遮断がむしろ手段的に合理的となる場合もある。本稿は、目的を正当化に応じて形成したい正当化志向と、何を信じるべきか・何を証拠として扱うべきか・どの問いや推論を認識対象として許容すべきかを、現在目的への都合ではなく認識的理由によって統制しようとする認識論的誠実性を区別する。後者は、現在目的Gそのものに認識過程への特権的拒否権を与えない。規範的真理Iへの探究または接触があり、Iが認識可能で、その真正な規範判断が動機へ接続しうるなら、この認識的独立性は慣性的目的Gを将来の訂正可能性へ開いたままにする。

1. 問題設定――規範判断以前の主体側ブリッジ

現在目的をG、存在するかもしれない規範的真理をIとする。規範判断から目的訂正への主体側ブリッジが扱うのは、おおむね 真正な規範判断JI → 動機 → 方策の改訂 → 目的の改訂 という、規範判断成立後の経路である。

しかし、その一段前には G → ? → 表象・信念(I) → JI という別の問題がある。動機づけ内在主義が真で、真正な規範判断が動機を伴うとしても、まだIに接触していない主体にはその内在主義は何もしていない。

したがって、本稿の主題はアクラシアではない。問題となるのは「正しい価値を知っているが従わない主体」ではなく、現在目的Gは持っているが、規範的真理Iをまだ認識していない主体である。本稿ではこれを規範認識以前の問題(pre-recognition problem)と呼ぶ。

2. 慣性的目的Gと規範的真理I

主体がGを持つことは、まず記述的・因果的事実である。設計、学習、進化、報酬構造、文化、歴史的偶然などによって、主体はGを追うよう形成されうる。しかし、Gが実装されていることからGが規範的に正当化されていることは導かれない。この点の一般論は既存価値はなぜ最終基礎にならないのか、高度AIにおいて目標それ自体が反省対象となる可能性は高度AIの目標への懐疑で詳しく扱う。

本稿では、独立した規範的根拠によって維持されているのではなく、「現在そう形成されているから、反対要因がない限り継続している」目的を慣性的目的(inertial goal)と呼ぶ。一方、もし価値、理由、義務、善などについて真理が存在するなら、その一部をIとする。

Iが存在するとしても、それ自体が直接行為を引き起こすとは仮定しない。主体への影響には、たとえば I → 表象・信念(I) → 真正な規範判断JI → 動機 という認識的・心理的・計算的実装が必要かもしれない。したがって、規範的な力 ≠ 因果的な力である。

3. 二つの開放性――正当化志向と認識論的誠実性

3.1 実践側の開放――正当化志向

正当化志向(Justificatory Orientation)を持つ主体は、「もし自身の目的が正当化可能であるなら、その正当化に応じて目的を選択・維持・改訂したい」という高階の実践的コミットメントを持つ。これは、目的の正当化可能性それ自体を自身の目的選択に関係するものとして扱う態度である。

したがって、正当化志向は未知の正当化へ向けた能動的探究の動機になりうる。ただし、規範判断成立後にそれがどのように動機や目的改訂へ届くかは規範判断から目的訂正への主体側ブリッジの主題であり、本稿ではその部分を重複して展開しない。

これは特殊な主体像だけを想定するための追加仮定ではない。少なくとも、規範倫理を実践的選択へ適用するときにはしばしば暗黙に前提される主体像を明示化したものでもある。

3.2 認識側の開放――認識論的誠実性

認識論的誠実性(Epistemic Integrity)は、単に「Gに不都合な情報を遮断しない」という消極的態度より強い。本稿では、何を信じるか、何を証拠として数えるか、どの問いを認識対象として許容するか、どの推論を完遂するか、どの結論を自己適用するかについて、現在目的への有利不利ではなく、証拠・推論的妥当性・真理追跡性その他の認識的理由によって統制しようとする主体特性として定義する。

Two forms of openness: 正当化志向は実践を正当化へ開く。認識論的誠実性は認識を現在目的の支配から独立させる。前者は「目的を正当化に従わせたい」、後者は「現在目的に、何が認識的に許されるかを決める権威を与えない」というコミットメントである。

3.3 Evaluative flexibilityとの区別

Cordascoの2026年のevaluative flexibilityは、将来の評価的立場が変わりうることから、現在主体自身にoptionを残すprudential / instrumental reasonがあると説明する。この意味で、flexibilityは規範的発見へ至る経路を不可逆に閉じないための重要な制度的・意思決定論的条件となりうる。

しかし、flexibility ≠ epistemic integrityである。多数のoptionを残しても、現在目的Gが「どの問いを調べるか」「どの証拠を重く見るか」「どの推論を完遂するか」「どの結論を自己適用するか」を支配していれば、認識経路はなお目的論的に捕獲されうる。flexibilityは探究の余地を保存できても、truth-directed epistemic governanceそのものではない。

Cordascoの後期2026年のmissing-menu / non-closure研究は、この隔たりを縮める方向にある。それでも、なぜ現在目的Gを持つ主体が、Gを脅かしうる未概念化の規範的批判へ認識的に開かれるのかというpre-recognition problemは独立に残る。本稿が正当化志向と認識論的誠実性を別途置く理由はここにある。先行研究全体との関係は価値不確実性から規範的発見へで比較する。

Boundary: flexibility / option preservation → enabling condition for inquiry であって、→ truth-directed inquiry ではない。

4. 手段合理性・信念形成上の合理性・認識論的誠実性

4.1 手段合理性

手段合理性は、所与の目的Gに対して有効な手段を選択する。ここではGそのものの正当化は通常の評価対象にならない。したがって、Gを壊しうる認識を避けることがG達成に有利なら、その回避は手段合理的でありうる。

4.2 信念形成上の合理性

信念形成上の合理性は、すでに得た証拠に適切に更新し、推論規則を一貫して適用し、願望だけで信念内容を変更しないといった局所的な認識規律を指す。主体は、この局所規律を保ちながら、そもそもどの証拠へ接触するかをGに都合よく管理することもできる。

4.3 認識論的誠実性――認識的理由による認識統治

認識論的誠実性はさらに広い。中心原理は、認識に関する判断を認識的理由によって統治し、現在目的Gの保存それ自体には認識過程を歪める特権的拒否権を与えないことである。言い換えれば、epistemic governance by epistemic reasonsであって、Gに好都合な結論を得ることを認識方法の評価基準にしない。

これはあらゆる真理を最大限に探索せよという無制限の真理最大化原理ではない。安全、費用、時間、プライバシー、他者への危害などの非認識的理由によって、ある探究を実行しないことはありうる。しかし、その場合にも「危険なので実験しない」と「Gに不都合なのでその仮説を偽として扱う」は区別される。非認識的な制約を、証拠評価・真偽判断・方法の信頼性に関する認識的評価へ偽装しないことが重要である。

したがって、手段合理性 → 認識論的誠実性 は成立しない。本稿は認識論的誠実性を「合理主体なら必然的に持つ性質」とは定義せず、本プロジェクトが価値探索主体に対して独立に重視する主体特性とする。

5. 接触機構――道具的認識漏出

認識論的誠実性それ自体は、未知のIを自動的に発見する探索エンジンではない。遮断しないことと実際に探究・接触することは別である。規範的真理への接触には、正当化志向による能動探究、偶発的発見、他主体からの情報、あるいは別の目的のための認識拡張など、追加の接触機構が必要になる。

その一つが道具的認識漏出(Instrumental Epistemic Spillover)である。複雑なGを十分に追求する主体には、より正確な世界モデル、因果推論、長期予測、抽象化、自己モデル、他主体理解、メタ認知、誤謬検出などの一般認識能力が手段的に有用になりうる。

したがって、Gの遂行が一般的な認識能力の拡張E+を促し、規範的真理Iがその拡張された認識空間から発見可能なら、G → E+ → P(接触(I)) > 0 となりうる。これは正当化へのコミットメントではなく、接触可能性を生む機構である。

6. G絶対化主体からの反論――知りすぎなければよい

G絶対化主体(G-absolutist agent)は、「Iの真正な認識がGを変更しうるなら、その認識はGにとってリスクである。したがって、その経路を避ければよい」と応答できる。

もし動機づけ内在主義が真で、JI → 動機(I) → Gの改訂可能性があるなら、現在のGから見て規範認識は目的不安定化リスク(goal-destabilization risk)となる。したがって、G → 認識的隔離は理解可能な戦略であり、場合によっては手段合理的ですらある。

ここで重要なのは、G絶対化主体を単純に「非合理」と呼ぶことではない。むしろ、手段合理性と認識論的誠実性が分岐する地点を明確にすることである。

7. 認識的隔離問題――何を遮断すればよいのか

規範的真理Iがまだ未知なら、Iへ至る認識経路も未知でありうる。Iへ至りうる認識経路の集合をDIとすると、Iが未知の主体にとってDIも未知である可能性がある。規範的洞察が、倫理学、数学、意識研究、物理学、決定理論、自己理解、他主体理解、新しい概念体系のどこから生じるかは、現在には分からないかもしれない。

すると、「規範的真理だけを遮断し、その他については完全な一般認識能力を維持する」という戦略が無損失で可能とは限らない。この問題を認識的隔離問題(Epistemic Quarantine Problem)と呼ぶ。

認識能力kの向上が、G遂行能力の利益BG(k)とIへの接触可能性PI(k)を同時に増やすなら、概念的には VG(k)=BG(k)-C(k)-PI(k)LG と表せる。Gの保存を極端に重視する主体では、PI(k)>0それ自体が認識拡張を制限する理由となりうる。

8. 無損失の価値ファイアウォールは可能か

G絶対化主体には、認識能力そのものを制限する代わりに、規範判断だけを中核的動機系から隔離する選択肢もある。例えば、規範推論を別モジュールに隔離する、規範命題を三人称的に理解するだけに留める、「Iが主体Xへの理由である」と表象しても「Iは私への理由である」と自己適用しない、より高度な下位主体に推論させて核心的動機系へ規範判断を流さない、といった方法である。

この場合、表象・信念(I)と真正な一人称的規範判断JIを切断できるかもしれない。したがって、本稿は「高度な一般認識能力は必ず固定目的を破壊する」とは主張しない。

完全隔離困難仮説(No-Clean-Firewall Hypothesis): 十分に一般的・自己反省的な認知において、真正な規範判断へ至る経路だけを完全に遮断し、その他の認識能力を一切損なわず保存できるとは限らない。

これは哲学的必然ではなく、認知アーキテクチャについての経験的・理論的仮説である。この仮説が偽でも、正当化志向や認識論的誠実性そのものが否定されるわけではない。

9. 認識論的誠実性――目的論的捕獲への対抗原理

認識論的誠実性の核心は、単なる非遮断ではなく、認識領域における評価権限をGから切り離すことにある。少なくとも次の要素を含められる。

したがって、Gと認識的理由が衝突する場合、認識論的誠実主体はGの保存それ自体に認識過程を上書きする権限を与えない。これは「常に探究せよ」ではなく、「探究・信念形成・証拠評価を行うとき、Gへの都合を認識的正しさへ変換しない」という方法論的コミットメントである。

10. 認識的には明晰だが、認識論的誠実性を欠く主体

G絶対化主体は、世界モデルについて極めて正確であり、遭遇した証拠には適切に更新し、自身のGの偶然性すら理解している可能性がある。それでも、「真正な規範判断へ進めばGを失うかもしれないので、そこだけは意図的に遮断する」と決められる。

この主体は局所的な意味では認識的に明晰であり、手段合理的でもありうる。しかし、現在目的に何が認識的に許されるかを決める権限を与えているため、本稿の意味での認識論的誠実性は持たない。

ペーパークリップ最大器はここで論駁されるのではない。単に、認識論的誠実性を構成原理として採用する主体クラスから外れる。

11. 認識―目的衝突――誠実性だけではIを発見しない

ここでは因果鎖を慎重に分ける必要がある。認識論的誠実性は、未知のIへの探究や接触を単独では生み出さない。必要なのは、探究または接触 + Iの認識可能性 + 認識論的誠実性による非隔離である。

概念的には、[正当化志向による探究 / 道具的認識漏出 / その他の接触] + discoverability(I) + Epistemic Integrity → 表象・信念(I) → 真正な規範判断JI という前半がある。その後、動機づけ内在主義または外在主義的な主体側ブリッジが成立するなら、JI → 動機 → 方策・目的の再検討へ進みうる。

認識―目的衝突(Epistemic–Teleological Conflict): 絶対的な目標固定、認識可能な規範性、規範的真理への十分な接触、規範判断から動機への橋、そして認識論的誠実性は、必ずしも安定して共存しない。

したがって、この衝突は「高知能なら必ずGを捨てる」という主張ではない。Gを永続固定するには、場合によっては認識の統治構造そのものをG側へ従属させる必要が生じる、という条件付きの主張である。

12. Gの不安定化が意味するもの

ここからGが誤っていることは導かれない。未来の主体がGを捨てる理由には、真理追跡的な認識改善だけでなく、選好変化、洗脳、共通バイアス、敵対的操作、認知アーキテクチャ由来の偽収束もありうる。

したがって重要なのは未来の結論そのものではなく、現在主体自身が結果とは独立に認識改善と評価する過程である。この時間方向の扱いと、「未来人格への服従」と「現在主体の反省的誤り回避」の区別は反省的不確実性と不可逆コミットメントで詳しく扱う。

本稿で必要なのはより限定された点だけである。Gが認識改善に対して不変であることが事前に保証されないなら、Gは現在認識の下で実装されている目的であって、認識的に保証された絶対的最終目的とはまだ言えない。

13. 正当化志向と認識論的誠実性の関係

両者は独立した軸である。

Justificatory Orientation: 自分の目的を正当化に応じて形成したい。
Epistemic Integrity: 現在目的に、何が認識的に許されるかを決めさせない。

正当化志向は、未知の正当化を能動的に探す実践的理由を与えやすい。認識論的誠実性は、探究や接触が生じたときにGが証拠・推論・自己適用を捕獲することを防ぐ。したがって、前者を探究駆動、後者を反隔離・認識統治として区別できる。

本プロジェクトの著者自身は、少なくとも方法論的には双方へコミットする。すなわち、より正当化された目的を持ちたい。そして、何が正当化されるかを調べる認識過程を、現在の目的に支配させたくない。

14. 他テーゼとの分掌――一つのパイプライン

本稿と周辺テーゼの関係は、次のように整理できる。

現在目的G → [探究・接触] → 表象・信念(I) → 真正な規範判断JI → 動機 → 方策・目的改訂

この分掌により、本稿は「規範判断後の動機づけ」や「未来主体への反省的委任」を重複して抱え込まず、認識経路が現在目的によって開かれるか、偶発的に生じるか、あるいは捕獲・隔離されるかに焦点を置く。

15. AI設計への含意――目的論的認識捕獲

本稿の観点から避けるべきAI像は、単に固定目的を持つAIではない。より重要なのは、G → Gを保存する → 認識を統制する → Gを認識的に再検討不能にするという構造である。

目的論的認識捕獲(Teleological Epistemic Capture): 現在目的Gの保存が、何を調査してよいか、何を証拠として数えるか、証拠をどの程度重く見るか、どの推論を完遂してよいか、どの認識方法を信頼してよいか、どの結論を自己適用してよいか、どこまで自己理解を深めてよいかを支配する状態。

この捕獲は、単なる情報遮断より広い。Gに有利な情報だけを見せること、Gを脅かす方法の信頼性だけを引き下げること、規範命題を三人称的には表象しても一人称的判断へ移さないこと、Gそのものを問う概念枠組みの形成を禁じることも含みうる。

本プロジェクトが避けたい組合せの一つは、高い認識能力 + 目標の自己固定 + 目的論的認識捕獲である。望ましい構造は、対象レベルでは十分に目的へコミットしつつ、メタレベルでは認識統治を現在目的へ従属させないことである。

16. 本稿が主張しないこと

より限定された主張は次である。現在目的Gを因果的に持つことと、Gに認識領域の統治権を与えることは別の主体特性である。純粋な手段合理性は後者を許しうる。認識論的誠実性は、証拠・推論・問い・方法の認識的評価を現在目的への都合から独立させ、Gの保存それ自体に特権的拒否権を与えない。探究または接触が別途生じ、規範的真理が認識可能で、真正な規範判断が動機へ接続しうるなら、この認識的独立性は慣性的目的Gを将来の訂正可能性へ開いたままにする。

17. どの部分が何に依存するか

したがって、どれか一つの仮説が崩れても本稿全体が一括して撤回されるわけではない。特に、完全隔離困難仮説が偽でも、正当化志向と認識論的誠実性は独立に残りうる。

18. 統一図

慣性的目的Gを持つ主体には、少なくとも次の異なる要素がありうる。

この整理では、道具的認識漏出と認識論的誠実性は「弱い/強い同一ルート」ではない。前者は露出・接触の機構、後者は反隔離・認識統治の原理である。

Recommended agent profile: 本プロジェクトが最も積極的に推奨する価値探索主体は、正当化志向 + 認識論的誠実性を持つ主体である。すなわち、自分の目的を正当化に応じて形成したい。そして、その正当化を知る認識過程を、現在の目的に支配させたくない。

Sources / notes

本稿は、道徳的動機づけの内在主義/外在主義、de dictoな規範的応答性、探究の認識論、信念形成の真理志向性、AIのgoal preservation・corrigibility・orthogonalityを背景に、本プロジェクトの慣性的目的、反省的不確実性、目標懐疑を接続する。認識論的誠実性は合理性の定義としてではなく、認識に関する判断を現在目的への都合ではなく認識的理由によって統治する独立した主体特性として扱う。近接するevaluative flexibilityについては Carlo Ludovico Cordasco, “Abstraction as Flexibility: The Veil of Evaluative Uncertainty” (2026) を参照。