El debate entre «comprensión genuina» y «coincidencia estocástica de patrones» quizá sea un falso binomio, y resolverlo podría cambiar cómo diseñamos, desplegamos y pensamos los sistemas que estamos construyendo.
¿Qué significa siquiera «comprender»?
Cuando GPT-4 resuelve un acertijo lógico inédito que nunca vio en el entrenamiento, algo está ocurriendo claramente. Llámelo inferencia, llámelo interpolación, llámelo emergencia, pero despacharlo como «mera predicción» se parece cada vez más a una evasiva intelectual. La pregunta que merece la pena no es si los modelos comprenden, sino qué queremos decir realmente cuando usamos esa palabra.
Los filósofos de la mente llevan siglos discutiendo la naturaleza de la comprensión. El célebre argumento de la habitación china de John Searle —publicado en 1980— proponía que una máquina que manipulara símbolos según reglas podría superar cualquier prueba lingüística sin comprender nada. Los modelos de lenguaje actuales han reabierto ese debate con una fuerza incómoda.
Los científicos cognitivos distinguen entre procesamiento sintáctico (manipular símbolos por su forma) y semántico (captar qué significan esos símbolos). La crítica tradicional a la IA sostiene que las máquinas solo hacen lo primero. Pero esa línea se difumina.
Cuando un modelo razona sobre un contrafáctico —«si la sala hubiera estado más caliente, ¿la reacción habría sido más rápida?»— no está recuperando una respuesta almacenada. Está modelando relaciones causales. Si eso constituye comprensión o una interpolación de patrones extremadamente sofisticada quizá sea una pregunta sin respuesta limpia.
La tradición pragmatista en filosofía cortaría el nudo de otro modo: ¿importa? Si un sistema produce resultados correctos de forma fiable, construye representaciones internas que se transfieren entre dominios y se comporta como si comprendiera, el residuo metafísico puede ser irrelevante para casi cualquier fin práctico.
«La cuestión no es si el mapa comprende el territorio. La cuestión es si le lleva a usted a casa.»
Paráfrasis de una postura que gana terreno en la investigación aplicada, 2025
Nombre de tu producto
Una o dos frases sobre qué hace este producto y por qué encaja con quien lee este journal. Mantén el tono del texto que lo rodea: se lee mejor y convierte mejor.
Saber más →La máquina de predecir
Todos los modelos de lenguaje basados en transformers comparten el mismo objetivo durante el entrenamiento: predecir el siguiente token. Eso es todo. De esa meta humilde —aplicada a escala, sobre billones de ejemplos— emerge algo capaz de redactar escritos jurídicos, depurar código, explicar el entrelazamiento cuántico y consolar a quien sufre.
El mecanismo es la atención, presentada en el artículo de referencia de 2017 «Attention Is All You Need». En vez de procesar el texto de forma secuencial como las redes recurrentes anteriores, los transformers aprenden a ponderar la relevancia de cada token respecto de todos los demás de la secuencia. Eso les permite capturar dependencias a larga distancia: el modo en que un pronombre situado 300 palabras después se relaciona con el nombre al que remite al principio.
Idea clave Lo notable no es el mecanismo en sí, sino que predecir bien los tokens exige construir un modelo implícito del mundo que los generó. Gramática. Causalidad. Normas sociales. Intuiciones físicas. Nada de eso está programado. Emerge.
¿Importa la respuesta?
Para quienes trabajan en seguridad y alineamiento, importa muchísimo. Un sistema que modele genuinamente el mundo —incluidos valores humanos, intenciones y dinámicas sociales— presenta un perfil de riesgo radicalmente distinto al de uno que sea extremadamente bueno imitando estadísticamente. El primero podría generalizar sus objetivos de formas imprevisibles. El segundo, en teoría, está más acotado.
Quizá la postura más honesta sea esta: los modelos de lenguaje actuales ocupan una categoría genuinamente nueva, una que nuestro vocabulario existente describe mal. No son inteligentes en el sentido humano. No son mero autocompletado. Son algo que todavía estamos aprendiendo a ver con claridad.