戻る
E-010 / エッセイ

履歴が役立つのはいつか:RP002Aの実践

Autorite連載 · 4/4 · 実践。三つの合成世界、七つの比較、完了した研究の限界。

前章までの問い、概念的な姿勢、方法を、 RP002A:履歴の有用性の境界 で読みます。

特定の合成生成器による有限の予測研究であり、稼働中の製品ではありません。2026年10月10日に確認した公開版の、第二の確認研究とパッケージレビューを使います。

三つの世界

  • E0: 現在の観測が課題に十分な情報を与える。
  • E1: 同じ観測に異なる状態が対応し、観測履歴が情報を加えうる。
  • E2: 履歴は変動するが未来の課題に有用な情報を加えない。

「履歴が多いほど常によい」という説明の代替条件です。現実のあらゆる環境を代表するとは主張しません。

四つの比較対象

B0 は現在の観測、 B1 は有限の履歴窓、 B2 は学習した再帰状態を使います。 B3 は生成器の法則を知り、観測履歴で条件付けますが、実現した隠れた状態への特権アクセスは持ちません。

B2との差だけでは、再帰性だけが原因とも、すべての課題で必要ともいえません。固定した学習予算の特定アルゴリズムの比較です。

完了した研究の結果

第二の確認研究は独立した60単位、学習モデルの当てはめ120回を完了し、世界ごとに独立反復20件を持ちます。事前に定めた七比較の結果は 利益2件、同等性4件、判定不能1件 でした。

E1では有限履歴と再帰予測器が、現在観測より利益があるという基準を満たしました。E0/E2の四比較は、宣言した許容幅で予測損失の同等性を満たしました。

表現の同一性や、あらゆる履歴効果の不存在ではありません。固定アルゴリズムの予測損失についての、許容幅付きの結果です。

小さな差が判定不能のままだった理由

最後のE1比較はB2がB1を事前の利益閾値以上に改善するかを問いました。調整済み差の区間は約−0.000853〜−0.000568 nats、必要な閾値は−0.01 natsです。

区間が負でも基準には届きません。後から同等性へ切り替えず、判定不能を残しました。未実行ではなく完了した判断です。

マージンはこの試験条件に固有の工学的許容幅です。統計解釈は七比較について宣言した独立性と正規理論の仮定を保持します。仮定不要・分布不要の保証ではありません。

閉じたパッケージ、開いた問い

第一の確認研究は未完了のまま別に保存されています。第二は独立に承認され、試行間で標本や結果は合算していません。保存物、予測、分析の再生が報告されています。この記事は新しい実験を始めず、ここで監査を再実行したとも主張しません。

内部レビューは、Cycle 01で定めた義務についてRP002Aを閉じました。13義務の1件が解決し、サイクルや広い表現・履歴の問いは開いたままです。外部査読でも一般的な記憶理論でもありません。

普遍的な答えではなく、区別と測定を明示すると履歴の有用性の境界を研究できる、という具体的な道を示します。

連載を読む

出典と版

この文章は次の日に確認した公開版に基づきます: 2026年10月10日. リンクはその版に固定しています。説明例は編集上の解釈であり、研究結果は元の範囲を保持します。その後、研究が変わっている可能性があります。

つながり

一部であるAutorite:問い、哲学、方法、実践

Autorite連載の第4章。

探究するAutorite

連載のこの段階からAutoriteを読みます。