Estado potencial estructurado
Una traza x abre un espacio estructurado declarado 𝓜ₓ de actualizaciones posibles e induce un potencial estructurado explícito 𝒫₀ sobre ese espacio. Una representación oculta arbitraria no es suficiente.
Nuestra tesis es que la inteligencia no debería reducirse a una aplicación directa de la entrada a la salida, ni a la manipulación de representaciones cuya estructura potencial permanece implícita, sino entenderse como un proceso de actualización contextual: la transformación de significados posibles en actualizaciones diferencialmente estabilizadas bajo restricciones contextuales.
Esta intuición se inscribe directamente en el enfoque dinámico de la polisemia desarrollado por Bernard Victorri y Catherine Fuchs, y ampliado posteriormente, entre otros, por Fabienne Venant en La construction du sens : un système complexe dynamique (2007). En este enfoque, el significado lingüístico se trata como un continuo y los significados se representan no como puntos aislados, sino como regiones.
En la construcción del significado de palabras y expresiones lingüísticas pueden surgir tres casos: significado preciso, ambigüedad o indeterminación.
La geometría del potencial semántico contiene una cuenca dominante estrecha.
Varias cuencas estrechas permanecen fuertemente ponderadas.
El potencial semántico es único y amplio.
El malentendido, tanto en la comunicación no verbal como en la verbal, sigue siendo siempre posible. Cuando un hablante produce una huella, el oyente construye una interpretación a partir de su propia historia contextual situada. Ambas construcciones pueden solaparse lo suficiente para permitir la comunicación, divergir ligeramente o separarse hasta producir un malentendido.
Esta tipología es uno de los antecedentes conceptuales más directos de GPM.
Un sistema es un Geometric Potential Model si y solo si se cumplen conjuntamente tres condiciones:
Una traza x abre un espacio estructurado declarado 𝓜ₓ de actualizaciones posibles e induce un potencial estructurado explícito 𝒫₀ sobre ese espacio. Una representación oculta arbitraria no es suficiente.
El contexto transforma causalmente el potencial mediante una vía declarada.
La actualización depende causalmente de 𝒫_C. Si el potencial puede eludirse, destruirse o sustituirse sin cambiar sistemáticamente el comportamiento, el sistema no es un GPM.
Un sistema que no cumpla cualquiera de estas tres condiciones no es un GPM, independientemente del vocabulario utilizado para describirlo.
La primera gran diferencia concierne al mecanismo principal del cálculo contextual. Los LLMs contemporáneos se organizan alrededor de la atención: las representaciones de tokens consultan, ponderan y agregan otras representaciones de tokens. Un GPM se organiza alrededor de la actualización: el contexto deforma un potencial estructurado explícito y la salida se lee del campo resultante.
La estructura geométrica ya existe en las redes neuronales convencionales. GPM le otorga otro estatuto arquitectónico: el potencial actual se convierte en un estado explícito, modelado por el contexto y causalmente necesario para la actualización. Los parámetros aprendidos definen cómo se construye este estado. El potencial mismo describe el paisaje actual de las actualizaciones posibles.
Representaciones latentes: una estructura geométrica puede emerger en las activaciones
¿Qué estructura ha aprendido la red en su espacio de representación?
Potencial geométrico: su morfología constituye un estado causal de la actualización
¿Cómo está estructurado y deformado por el contexto el espacio de las actualizaciones posibles?
Los LLMs se entrenan principalmente para producir una distribución sobre las continuaciones. En un GPM, la probabilidad puede representar el potencial o servir para su lectura, y un modelo probabilístico latente suficientemente rico puede codificar distintos estados potenciales. La estructura potencial que desempeña una función de mediación causal permanece explícitamente identificable durante todo el proceso.
se entrena principalmente para producir una distribución sobre las continuaciones
¿Qué probabilidad debe asignarse a las distintas salidas?
exige que una geometría potencial explícita desempeñe un papel causal en la actualización
¿Cuál es la morfología de las posibilidades de las que surge esta distribución?
Estados potenciales diferentes pueden conducir a la misma probabilidad de salida. Por ejemplo, una ambigüedad entre dos posibilidades bien diferenciadas y una indeterminación difusa pueden producir ambas una distribución de 50/50. Sin embargo, cuando interviene un nuevo contexto, no evolucionan de la misma manera. Por tanto, la probabilidad de salida por sí sola no basta para distinguirlas. Un GPM busca preservar esta diferencia para que siga siendo explícita, causalmente activa y comprobable.
Con pesos fijos y una cadena totalmente funcional sin muestreo, un GPM es determinista durante la inferencia: la misma entrada sigue la misma trayectoria interna y produce el mismo resultado. En cambio, los productos basados en LLM suelen utilizar una decodificación estocástica, que puede generar continuaciones diferentes para un mismo prompt.
suele muestrear una distribución del siguiente token
El mismo prompt puede producir una continuación diferente
sigue una trayectoria de estado reproducible cuando la inferencia y la decodificación están fijadas
Misma versión del modelo + misma entrada → mismo resultado
La reproducibilidad se convierte en un contrato de ejecución. Al fijar la versión del modelo, el entorno de ejecución, el estado inicial y la política de decodificación, la trayectoria completa — desde el primer estado potencial hasta la lectura final — puede reproducirse paso a paso.
GPM organiza la inferencia en torno a una geometría potencial explícita. El contexto deforma esta geometría, el sistema se estabiliza en un estado estructurado y la actualización se lee desde ese estado mediante una cadena causal declarada. Los bloques Transformer y el enrutamiento derivado de la atención no intervienen en este proceso.
Tres preguntas permiten leer este panorama con mayor claridad. ¿Contiene la arquitectura autoatención softmax clásica? ¿Se basa en una memoria asociativa K/V con una lectura de tipo Q? ¿Desciende su mecanismo arquitectónicamente de la atención? Las dualidades matemáticas pueden conectar operadores diferentes mientras sus cadenas de cálculo siguen siendo fundamentalmente distintas.