¿Cuándo ayuda la historia? La aplicación RP002A
Serie Autorite · 4/4 · Aplicación. Tres mundos sintéticos, siete comparaciones y los límites del estudio terminado.
Los capítulos anteriores plantearon una pregunta, discutieron su postura conceptual y su método. Aquí se sigue esa secuencia en RP002A: límites de utilidad de la historia.
Es un estudio finito de predicción con generadores sintéticos definidos, no un producto desplegado. Se utiliza la revisión pública examinada el 10 de octubre de 2026, incluida la segunda confirmación y la revisión del paquete.
Tres mundos
- E0: la observación presente proporciona suficiente información para la tarea.
- E1: la observación confunde estados diferentes; la historia observada puede aportar información.
- E2: las historias varían sin aportar información relevante para la tarea futura.
Estas condiciones contrastan la idea de que más historia siempre ayuda; no representan todos los entornos reales.
Cuatro referencias
B0 usa la observación actual; B1, una ventana de historia finita; B2, un estado recursivo aprendido. B3 conoce la ley del generador y condiciona sobre historia observada, sin acceso privilegiado a los estados ocultos realizados.
Una diferencia respecto a B2 no demuestra que la recursividad sea su única causa ni que sea necesaria para todas las tareas. Se comparan algoritmos específicos con presupuesto de entrenamiento fijo.
Resultados del estudio terminado
La segunda confirmación completó 60 unidades independientes y 120 ajustes de modelos aprendidos, con 20 réplicas independientes por mundo. Se conservaron los siete resultados predeclarados: dos beneficios, cuatro equivalencias y uno indeterminado.
En E1, la historia finita y el predictor recursivo cumplieron el criterio de beneficio frente a la observación actual. Las cuatro comparaciones E0/E2 cumplieron equivalencia de pérdida predictiva dentro de la tolerancia.
Esto no prueba representaciones idénticas ni ausencia de todos los efectos históricos: trata de la pérdida de esos algoritmos dentro de la tolerancia declarada.
Por qué una pequeña diferencia quedó indeterminada
La comparación final E1 preguntó si B2 mejoraba B1 más allá del umbral previo de beneficio. El intervalo ajustado fue aproximadamente de −0.000853 a −0.000568 nats; el umbral exigido era −0.01 nats.
Que el intervalo fuera negativo no bastó. Se mantuvo «indeterminado», sin convertirlo después en equivalencia. Es una decisión completada, no una ejecución ausente.
El margen es una tolerancia de ingeniería específica del escenario de prueba. La interpretación conserva los supuestos declarados de independencia y teoría normal para siete comparaciones; no es una garantía libre de supuestos o distribuciones.
Paquete cerrado, preguntas abiertas
La primera confirmación quedó incompleta y se preservó por separado. La segunda se autorizó independientemente: no se agruparon muestras ni resultados entre intentos. Se informó de reproducción de artefactos, predicciones guardadas y análisis. Este artículo no inicia experimentos ni afirma haber repetido aquí esa auditoría.
Una revisión interna cerró RP002A para su compromiso definido de Cycle 01. Se resolvió una de 13 obligaciones; el ciclo y las preguntas generales siguen abiertos. No es revisión externa por pares ni una teoría general de memoria.
La aplicación no ofrece una respuesta universal: muestra cómo investigar fronteras de historia útil cuando se explicitan distinciones y medidas.
Continuar la serie
Fuentes y revisión
Este texto utiliza la revisión pública examinada el 10 de octubre de 2026. Los enlaces están fijados a esa revisión. Los ejemplos explicativos son interpretaciones editoriales; los hallazgos mantienen su ámbito original. El proyecto puede haber cambiado posteriormente.
Se conecta con
Capítulo 4 de la serie Autorite.
Explora Autorite mediante este paso de la serie.