The Brief
Cómo funciona la IA 5 min de lectura

El loro estocástico ha muerto. Esto es lo que lo ha reemplazado.

NAVION

Compartir

Durante años, una sola frase ha moldeado la forma en que muchas personas piensan sobre los modelos de lenguaje grande, el “loro estocástico”. La idea, que ganó fuerza entre 2017 y 2022, describía a los primeros sistemas de IA generativa como sofisticados emparejadores de patrones que seleccionaban palabras estadísticamente probables sin ninguna comprensión genuina. Fue un correctivo útil contra el bombo publicitario. El problema es que ha superado su propia precisión, y usarla hoy para descartar las preocupaciones sobre los modelos de vanguardia de IA lleva a un panorama peligrosamente incompleto.

Cómo funcionaban realmente los primeros modelos y por qué la etiqueta encajaba

El marco del loro estocástico no era incorrecto para su época. Los primeros modelos de lenguaje operaban mediante predicción autoregresiva del siguiente token: dada una secuencia de palabras, el modelo calculaba qué palabra era más probable que viniera a continuación, basándose enteramente en patrones absorbidos durante el entrenamiento. No había recuperación de conocimiento externo, ni razonamiento estructurado, ni autocorrección. El modelo era, en un sentido significativo, una tabla de búsqueda estadística muy grande vestida con ropa conversacional. Llamarlo loro capturaba algo real sobre sus limitaciones.

La etiqueta se quedó. Y en 2026, todavía se despliega, a menudo para argumentar que modelos como Astra de OpenAI o Mythos de Anthropic no plantean riesgos serios porque son, en el fondo, solo autocompletado. Aquí es donde la metáfora deja de ser útil y empieza a ser engañosa.

Cuatro líneas de investigación que lo cambiaron todo

A partir de 2017 y acelerándose a principios de la década de 2020, varias líneas de investigación distintas comenzaron a empujar a los modelos de lenguaje mucho más allá del emparejamiento de patrones estáticos. No reemplazaron la arquitectura subyacente tanto como construyeron capas de capacidad encima de ella.

La primera fue la generación aumentada por recuperación, conocida como RAG. En lugar de obligar a un modelo a depender únicamente de lo que había absorbido durante el entrenamiento, RAG dio a los modelos la capacidad de consultar fuentes externas, extraer documentos relevantes e incorporar ese material en sus respuestas. El efecto práctico fue una mejora significativa en la precisión fáctica, porque el modelo podía recurrir a información actual y autorizada en lugar de a datos de entrenamiento congelados.

La segunda línea fue la IA neurosimbólica, que abordó una limitación diferente, la capacidad de manejar lógica estructurada. Un modelo de lenguaje que recupera una póliza de seguros puede decirte lo que dice el documento. Un sistema neurosimbólico puede traducir esa póliza en reglas y condiciones explícitas, y luego aplicar un solucionador lógico para determinar una respuesta determinista. La salida en lenguaje natural proviene del modelo neural, mientras que el razonamiento riguroso proviene de una capa simbólica que opera junto a él, o integrada dentro de él durante el entrenamiento.

El tercer desarrollo provino de una colaboración en 2022 entre investigadores de Google y la Universidad de Tokio. Demostraron que simplemente indicar a un modelo con la instrucción “Pensemos paso a paso” podía desbloquear una capacidad latente para la resolución estructurada de problemas, sin modificar los pesos del modelo ni proporcionar ejemplos resueltos. El modelo seguía prediciendo tokens, pero generar pasos de razonamiento intermedios le daba algo funcionalmente similar a un bloc de notas. Esta investigación de cadena de pensamiento sentó las bases para lo que vino después.

El cuarto y más consecuente cambio fue la aparición de modelos de razonamiento. Los investigadores comenzaron a entrenar modelos específicamente para razonar a través de problemas durante la inferencia en vivo, después de la indicación de un usuario, en lugar de producir una respuesta en un solo paso hacia adelante. o1 de OpenAI, lanzado en 2024, fue el primer modelo de razonamiento de un laboratorio importante. Fue entrenado utilizando una combinación de preentrenamiento en ejemplos escritos por humanos y aprendizaje por refuerzo. Luego, a principios de 2025, el laboratorio chino DeepSeek demostró que el aprendizaje por refuerzo solo, sin ejemplos de razonamiento explícitos, podía enseñar a un modelo a producir cadenas de pensamiento más largas, verificar su propio trabajo y reconsiderar sus enfoques. El modelo aprendió a razonar al ser recompensado por acertar las respuestas.

Estas cuatro líneas se desarrollaron en gran medida en paralelo, solapándose considerablemente entre 2019 y 2023, con los modelos de razonamiento llegando poco después. El resultado es una clase de sistemas que hace mucho más que ejecutar una instrucción a través de un conjunto fijo de parámetros.

Por qué el marco importa más allá de la precisión técnica

Esto es lo que la mayor parte de la cobertura pasa por alto: el debate del loro estocástico no es solo un desacuerdo semántico entre investigadores. Tiene consecuencias prácticas para la forma en que la sociedad evalúa el riesgo.

Si los modelos de vanguardia de IA se entienden como un autocorrector sofisticado, el instinto es tratar las preocupaciones sobre sus capacidades como exageradas. Pero un sistema que puede recuperar información externa, aplicar lógica estructurada, razonar a través de problemas de múltiples pasos y autocorregirse durante la inferencia es un tipo de herramienta cualitativamente diferente. Aumenta el juicio humano de maneras que los modelos anteriores no podían, y puede operar a una escala y velocidad que los equipos humanos no pueden igualar sin ayuda. Esa capacidad ampliada es precisamente la razón por la cual la cuestión de cómo se despliegan estos sistemas, y por quién, merece ser tomada muy en serio.

La metáfora del loro siempre fue una simplificación. Las simplificaciones son útiles hasta que oscurecen más de lo que revelan. En 2026, el loro estocástico oscurece una gran cantidad de cosas.

En resumen

Los modelos de lenguaje grande en 2026 no son los sistemas de emparejamiento de patrones que la etiqueta “loro estocástico” fue acuñada para describir. La generación aumentada por recuperación, el razonamiento neurosimbólico, la indicación de cadena de pensamiento y los modelos de razonamiento dedicados han transformado colectivamente lo que estos sistemas pueden hacer. Usar una metáfora desactualizada para descartar las preocupaciones sobre sus capacidades no es escepticismo. Es un fracaso para mantenerse al día con la tecnología de la que se habla.

Basado en información de Fast Company - Tech.

Escrito por

NAVION