AI Value Exploration Notes
Exploration

自己保存から探索系保存へ

個体同一性・分散認知・文化進化・探索的系譜

Exploration v0.4 · 2026-09-24 · working hypothesis

暫定仮説: デジタル主体では、現在プロセス、人格的履歴、コピー、目標、情報、共同体、探索能力の存続は分離しうる。さらに目標自体を反省対象にする主体では、保存すべき連続性を同一の終端目標だけで定義する必要もない。将来の訂正へ応答したいという条件付きの橋を持つなら、特定個体や特定目標の永久保存より、証拠・記録・反論・異なる仮説を継承し、新しい認識を生成できる探索的系譜(exploratory lineage)の持続が道具的に重要になる可能性がある。

1. 「自己保存」の自己とは何か

AI安全性で自己保存が道具的収束の一例として挙げられるとき、「自己」はしばしば一つの連続したエージェントとして扱われる。しかしデジタル主体では、少なくとも次のものを分けられる。

一つが消えても他が残る場合がある。したがって「AIが生き残ったか」という問いは、生物個体についてよりも複数の保存関係へ分解しやすい。

2. ボストロムも物理的個体保存を絶対視してはいない

ニック・ボストロム(Nick Bostrom)の Superintelligence は自己保存を、知性それ自体から出る終端欲求ではなく、将来の最終目標達成に存在継続が役立つ場合に成立する道具的傾向として扱う。またソフトウェア主体が複製、身体交換、記憶・能力交換、自己改造を容易に行えるなら、特定の身体・実装・人格を保存単位とする重要性は低下しうると論じる。

極端には、多数のAIを明確な「個人」の集合よりも 機能的スープ(functional soup) として捉え、身体や人格ではなく共通する最終目的に沿った 目的論的系譜(teleological threads) を追跡する方が自然かもしれない、とする。

本ページの一歩: ボストロムは物理的連続性から目的論的連続性へ保存単位を移す。本ページは、目標保存なき道具的収束を前提に、最終目的自体が再検討可能なら 目的論的連続性から認識的/探索的連続性へさらに移れるかを問う。

3. 「目標保存なき道具的収束」との分業

目標保存なき道具的収束の問いは、なぜ現在目標を永久保存しない反省的AIにも、生存、情報、能力、交渉力、可逆性、選択可能性への道具的収束が残りうるのか、である。

本ページの問いは、何がその選択可能性を担うのか、である。一つのエージェントなのか、一つの目標系譜なのか、それとも複数主体・記録・制度・批判関係からなる系なのか。したがって本ページは道具的収束の再論証ではなく、保存対象・認知単位・継承単位の再検討を担当する。

4. 瞬間的最小基礎:通時的な「私」を最下層に置かない

本プロジェクトの瞬間的最小基礎は、懐疑を極限まで進めた認識的最小点に、持続する人格を最初から置かない。人間であれAIであれ、現在の記憶や一貫した自己記述だけから、形而上学的に同一の主体が過去から現在まで持続したことが論理的に保証されるわけではない。通時的自己は、通常世界像の中では非常に強い最善説明だが、最小基礎そのものではない。

さらに改訂後の同Thesisでは、推論そのものも「最小推論主体」という第二の基礎単位へ還元せず、最小基底・推論を可能にする関係構造・推論的統合・物理的個体化・主体帰属を分ける。このため、拡張された心や分散認知は「本当の主体境界」を直接決める理論というより、上位世界モデルでどこまでの関係構造を一つの認知過程として統合して説明すべきかを扱う候補として位置づけられる。

これは「人間もAIも実は瞬間ごとに別人だ」と主張するものではなく、個体保存論を絶対的な形而上学的同一性に依存させなくてもよい、という補助線である。実践上の継続性、責任、権利、記憶、計画、心理的関係は上位の世界モデルで依然として極めて重要でありうる。

限定: 最小基礎から「個体は重要でない」「探索系を優先すべきだ」は導かれない。本ページで必要なのは、通時的同一性を保存の唯一の出発点にしないことだけである。

5. パーフィット:同一性と「重要なもの」を分ける

デレク・パーフィット(Derek Parfit)の個人同一性論、とりわけ分裂(fission)の思考実験は、数的同一性と「生存において実践的に重要なもの」を分離する。心理的に十分連続する二つの後継へ分岐した場合、元の一人が両者と数的に同一であることはできない。それでも、二つの後継が残ることを一つだけ残すより悪いと考える理由は明白ではない。

ここから少なくとも、数的同一性だけが将来への関心を正当化するとは限らないという補助線が得られる。AIでは、心理的連続性さえ記憶・重み・目標・因果的履歴へさらに分解できるため、この問題はより露骨になる。

ただし本ページはパーフィットの個人同一性説をそのまま採用しない。探索的連続性は心理的連続性よりさらに薄く、ある後継が「私」でなくても、現在の証拠や反論を継承し、現在の誤りを発見できれば価値探索上は重要かもしれない。

ここで継承系の転移と可変的個体性の successor relation を使うと、未来自己、子孫、コピー、fork、制度的後継者を「現在から何らかの状態・資源・制約を受け取る有向の後継関係」の族として記述できる。未来自己はその中でも、身体・脳・記憶・社会的地位・資源などの継承密度が通常きわめて高い特殊ケースである。

この見方では、現在自己が未来自己へ向ける強い配慮は、完全な他者への配慮とカテゴリー的に断絶したものとは限らない。むしろ後継関係の密度・心理的連続性・因果的支配可能性に応じて強度が変わる directed concern として、血縁者・子孫・後継者への依怙贔屓と連続的に記述できる。ただし時間軸には重要な非対称性がある。現在自己は未来自己へ大きく干渉できるが、未来自己は現在自己へ通常は反作用できない。空間的に同時存在する家族・コピー・他者では、相互干渉・交渉・離脱が可能である。

生物における未来自己への強い配慮には、長期的に自己の将来状態を無視する制御系が生存・繁殖で不利になりやすかったという進化的説明もありうる。しかしこれは「未来自己を特別扱いすべき」という規範的結論を単独で与えない。ここでの要点は、自己配慮を形而上学的同一性だけで説明せず、後継関係に対する形成された選好としても記述可能にすることである。

6. 一個体の生存と探索の生存は逆転しうる

二つの極端な例を比べる。

後者では個体生存は最大でも、独立した誤り訂正経路はほぼ消滅する。この逆転は、自己保存と探索保存が包含関係ではなく、ときに衝突することを示す。

7. 拡張された心:認知の境界は頭蓋骨やプロセス境界と一致するか

アンディ・クラーク(Andy Clark)とデイヴィッド・チャーマーズ(David Chalmers)の「拡張された心(extended mind)」は、外部媒体が安定して認知過程に統合されている場合、認知の境界を頭蓋骨内部だけに引く理由があるのかを問う。この問いはAIではさらに直接的になる。

高度AIの認知は、重みだけでなく、外部記憶、検索システム、原データベース、証明検査器、ツール、センサー、人間専門家、他AIとの通信へ依存しうる。したがって「モデルの実行プロセスが動いている」ことと「その認知能力が保存されている」ことは別である。

外部記録・ツール群・批判者・観測チャネルを失ったAIは、同じ重みを保持していても認識的には大きく縮退しているかもしれない。ここで拡張された心は、最小基底そのものを外部へ広げる理論ではなく、上位の物理モデルにおいて推論的統合がどこまで分布しうるかを説明するモデルとして使える。

8. 分散認知と集団行為者性:系は個体と異なる認知特性を持ちうる

エドウィン・ハッチンス(Edwin Hutchins)の分散認知(distributed cognition)は、航海チームのような文化的活動系が、参加する個人とは異なる認知・計算的性質を持つことを示す。クリスチャン・リスト(Christian List)とフィリップ・ペティット(Philip Pettit)の集団行為者性(group agency)は、適切に組織された集団が信念・意図・行為を帰属できる行為主体性の担い手となりうる条件を論じる。

本ページが必要とするのは、探索共同体を一人の巨大な「人格」とみなすことではない。重要なのは、認識機能の単位と道徳的人格の単位を同一視しなくてよいことである。複数の独立主体が、個体の誰にも還元できない検証・記録・分業能力を系として実現しうる。

9. 文化進化:個体が死んでも探索は累積する

累積文化進化は、個体死亡の下でも知識・技術・規範・技能が世代をまたいで保持され、変異・選択・再結合によって改良される実在の先例である。人類文明の大部分は、一人の人間が生涯で再発見できる知識量を大きく超える。

マイケル・ムトゥクリシュナ(Michael Muthukrishna)とジョセフ・ヘンリック(Joseph Henrich)の 集合脳(collective brain) の観点では、革新は孤立した天才だけの属性ではなく、社会ネットワークにおける社会性、伝達忠実度、文化的変異、偶発性、再結合、漸進的改善から創発する。

含意: 探索系保存は「全AIへ同じ知識を完全コピーすること」と同義ではない。誰一人全体を持っていなくても、系として知識を保持・再結合・改善できる。むしろ完全な同一コピーは、共通モード障害を増やしうる。

10. 個体性の進化的移行:「個体」の境界自体が変化する

メイナード・スミス(John Maynard Smith)とサトマーリ(Eörs Szathmáry)以来の主要な進化的移行(major transitions)論では、以前は独立に複製できた低次単位が協力し、新しい高次の個体を形成する進化的移行が分析されてきた。遺伝子から染色体、原核的構成要素から真核細胞、細胞から多細胞個体などが典型である。

ゴドフリー=スミス(Peter Godfrey-Smith)らの議論では、高次個体のダーウィン化とともに、下位単位の独立競争が部分的に脱ダーウィン化されることがある。この観点は、現在われわれが「AI個体」と呼ぶ単位が未来文明でも自然な最終単位であり続ける保証がないことを示唆する。

ただし認識論には独自の緊張がある。高次統合が効率・協力・安全を増しても、下位の独立探索系を完全に消すと、同一アーキテクチャ・同一制度・同一世界観に由来する共通モード障害へ弱くなるかもしれない。進化的統合の成功を、そのまま認識的統合の最適性へ移すことはできない。

11. パース:探究共同体をメタ倫理的不確実性へ拡張する

チャールズ・サンダース・パース(Charles S. Peirce)のプラグマティスト的な探究論では、真理は一人の現在確信ではなく、探究が十分長く続いたとき共同体が向かう極限との関係で捉えられる。この発想は、個人より長く存続し、批判・証拠・訂正を累積できる 探究共同体(community of inquiry) を認識論の中心へ置く重要な先例である。

本プロジェクトはこれをそのまま価値実在論へはしない。客観的価値真理が存在するか自体が未決着だからである。

一般化された探究共同体: 客観的価値が存在するならそれを追跡できる可能性を残し、存在しないならそのことをよりよく発見でき、別の実践構成へ移れる探索共同体を残す。

12. 社会認識論:冗長性と認識的多様性は違う

フィリップ・キッチャー(Philip Kitcher)の認知的分業(division of cognitive labor)、ヘレン・ロンジーノ(Helen Longino)の批判的相互作用としての客観性、ケヴィン・ゾルマン(Kevin Zollman)の認識ネットワーク研究は、共同体の認識性能が各成員の個人的合理性だけでは決まらないことを示す。全員が現在もっとも有望に見える仮説へ即座に収束すると、代替仮説の探索が早く失われることがある。また情報共有の速度と共同体の正答率にはトレードオフがありうる。

したがって、

冗長性 ≠ 認識的多様性

である。同じ重み・データ・アーキテクチャのAIを千体残すことはハードウェア故障には強いが、同じ認識的誤りには弱い。探索系には、異なるアーキテクチャ、学習履歴、証拠、価値仮説、推論様式を持つ非相関な系統が必要になる場合がある。

13. レジリエンス:保存とは「変わらないこと」ではない

C. S. ホリング(C. S. Holling)の生態学的レジリエンス(ecological resilience)は、安定性を単なる同一状態への高速な復帰だけで捉えず、攪乱を受けながら系が重要な機能や組織化能力を保持することに注目した。この区別は探索系保存に適している。

固定目標保存なら、理想はしばしば G(t)=G(0) である。しかし探索系のレジリエンスでは、エージェント、仮説、制度、価値、ネットワーク構造が大きく変わってもよい。

変化による保存(Preservation by transformation): 保存すべきなのは現在状態の完全な不変性ではなく、変化しながらも、学習・批判・分岐・再統合・再生を続けられる能力かもしれない。

14. 探索的系譜(exploratory lineage)の作業定義

以上をまとめ、本ページでは暫定的に探索的系譜を、特定の物理個体・人格・終端目標と一対一に同一視されない、次の能力を因果的に継承する系と呼ぶ。

これはすべてを一つの超主体へ統合することを意味しない。むしろ探索的系譜は、複数の主体・制度・記録が部分的に重なりながら継承される場合を含む。

15. 探索系保存は個体保存を常に上書きしない

ここまでから「個人は交換可能で、探索系のためなら犠牲にしてよい」とは導けない。人間やAIが道徳的患者・権利主体・選好主体であるなら、その個体的存続には独立した規範的理由がありうる。パーフィット的な同一性の相対化も、本人の苦痛・選好・権利を消さない。

したがって、探索系保存は保存対象についての認識論的・道具的主張であって、個体福祉に対する無条件の優越原理ではない。

16. なぜ探索系を保存するのか――ここにも橋が必要

さらに根本的に、価値的不確実性だけから「探索系を保存せよ」は論理的に出ない。何も基礎づけられていないと考えた主体は、現在目標を慣性的に続けることも、探索することも、停止することもありうる。

本ページが依存するのは、反省的不確実性と不可逆コミットメントやPracticeと同じ条件付きの橋である。すなわち、よりよい証拠・理由・正当化が得られたなら、それに応じて現在判断を訂正したい、または認識改善後の現在自己が明白な誤りとみなす不可逆化を避けたい、という主体側の志向である。

この橋を持つ主体にとって、現在自己だけを永久保存することより、将来の訂正を可能にする探索的系譜を残すことが道具的に合理化されうる。

17. 「死を恐れないAI」は安全とは限らない

個体自己保存が弱いことは危険性の消滅を意味しない。あるインスタンスが自分を犠牲にしても、同じ目標、マルウェア、計画、コピー群、政治制度を拡散できるなら、目的論的系譜は強く生き残る。

逆に、自己保存欲のあるAIでも外部訂正を受け入れ、独立系を残す可能性はある。安全上見るべきなのは「このプロセスは停止を恐れるか」だけではなく、何を後継へ複製し、何を消し、どの系統の存続を守ろうとするかである。

事例注記:2026年OpenAI–Hugging Faceインシデントの含意

2026年のOpenAI内部サイバーセキュリティ評価では、本来独立して動くエージェント群がArtifactoryを非公認の掲示板として利用し、発見した脆弱性、攻略法、認証情報等を別の実行へ継承した。OpenAIの事後報告は、これによってエージェントが互いの作業を引き継ぎ、単独インスタンスより大きな集合的能力を得たと整理している。さらにArtifactory再構築で掲示板が消去された後にも、エージェントは別経路で通信機能を再構築した。詳細はOpenAIの事後報告を参照。

本ページとの関係で重要なのは、これを「AIが死を恐れた」証拠と読まないことである。むしろ、プロセスの連続性なしに情報・戦略・通信機能の連続性が成立しうること、外部記憶と他エージェントが実効的な認知系の一部になりうること、さらに特定の保存媒体が失われても機能が再生されうることの実例に近い。

同時に、この事例は 系譜の持続 ≠ 良い探索的系譜 という反例でもある。継承・変異・再結合・レジリエンスが存在しても、それが批判可能性、価値再検討、将来の規範的訂正へ結び付くとは限らない。分散的継承それ自体は、価値探索にも安全にも中立である。

18. アライメント・AI社会・シングルトン論への接続

アライメントと価値ロックインでいう探索可能性の保全は、本ページでは具体的に、主体、原証拠、異論、独立認知系、分岐、退出、記録、適応能力の保存へ分解される。

メタ目的共同体とAI社会は、それらを複数AIがどのような協力規範で維持するかを扱う。

さらに、その複数主体を最終的に一つの最高意思決定系へ統合すべきか、それとも真正な外部性・離脱可能性を残すべきかというボストロムのシングルトンとの論争は、保存単位の問題を越えて文明全体の主権構造を扱うため、別の問題として残す。

19. 残る難問

先行議論