Los modelos de lenguaje no comprenden. Predicen. Y puede que eso baste.
El debate entre «comprensión genuina» y «coincidencia estocástica de patrones» quizá sea un falso binomio. Cuando un modelo razona sobre un problema nuevo, ¿qué ocurre exactamente por debajo?
Leer entrada →El mecanismo de atención es el invento más importante de la década. Aquí está el porqué.
En 2017, un artículo titulado «Attention Is All You Need» reescribió en silencio las reglas del aprendizaje automático. Ocho años después, desde la medicina hasta el derecho funcionan sobre su arquitectura.
La AGI no llegará. Se acumulará.
Seguimos imaginando la AGI como un acontecimiento único: el instante en que una máquina nos supera. Pero la evidencia apunta a algo más extraño: una difusión lenta y desigual que quizá ni notemos.
¿Puede un modelo ser creativo? La respuesta sorprendente de la ciencia cognitiva.
La ley de escalado que lo cambió todo — y sus límites
Leer entrada →Durante años la industria operó sobre una fe simple: haz el modelo más grande, entrénalo con más datos y será más inteligente. Ahora, con los rendimientos decrecientes a la vista, se preguntan qué viene después de la escala.
El problema de la memoria: por qué las ventanas de contexto son el talón de Aquiles de la IA
Todo modelo transformer tiene un límite duro de cuánto puede sostener en mente a la vez. No es un fallo que se parchea: es una restricción arquitectónica de fondo con implicaciones profundas.
Nombre de tu producto
Una o dos frases sobre qué hace este producto y por qué encaja con quien lee este journal. Mantén el tono del texto que lo rodea: se lee mejor y convierte mejor.
Saber más →