Qué es de verdad el RAG, para quien vende maquinaria
La recuperación separa al asistente que cita tu catálogo actual del que se inventa una versión plausible. El mecanismo, sin jerga.
Alguien de tu sector ha empezado a decir RAG en las reuniones. Significa generación aumentada por recuperación, y detrás de las siglas hay un mecanismo que conviene entender si vendes productos técnicos: decide si un asistente describe la máquina que realmente fabricas o un promedio plausible de todo lo que ha leído sobre máquinas parecidas.
Dos clases de memoria
Un modelo de lenguaje tiene algo parecido a dos memorias, y no se comportan igual.
La primera es lo que absorbió durante el entrenamiento. Enorme, congelada y sin fecha. El modelo no guarda tu ficha de producto como página. Guarda regularidades estadísticas sobre cómo van juntas las palabras, y ahí entra la forma del vocabulario de tu sector y, si se escribió lo suficiente sobre ti, el nombre de tu empresa acompañando a ciertos productos. Esta memoria tiene fecha de corte y no puedes actualizarla. Tampoco se puede inspeccionar: nadie puede señalar un punto y decir que tu rango de tolerancia está guardado ahí.
La segunda memoria es lo que el sistema va a buscar en el momento de responder. Eso es la recuperación. Antes de escribir una palabra, la maquinaria recoge un puñado de documentos que parecen pertinentes para la pregunta, los pega en el contexto de trabajo del modelo y le pide que responda con ellos. Se parece más a entregarle a alguien una carpeta de impresiones y pedirle un resumen que a preguntarle qué recuerda.
La generación aumentada por recuperación es simplemente la combinación: la memoria absorbida del modelo, más una carpeta de documentos reunida para esta pregunta concreta. Que tu nueva línea aparezca en una respuesta depende casi siempre de la segunda mitad, no de la primera.
Qué se recupera, y cómo
Aquí está la parte que sorprende a quien vende maquinaria. La recuperación no trae tu web. Trae pasajes.
Los documentos se parten en fragmentos: unos pocos párrafos cada uno, a veces menos. Esos fragmentos se indexan por significado y no por palabra exacta, y por eso una pregunta sobre bombas para fluidos agresivos puede traer un pasaje que nunca usa la palabra agresivo. Cuando llega una pregunta, el sistema sube los fragmentos más cercanos en significado, y solo esos llegan al modelo. Todo lo demás de la página, incluida la frase tres pantallas más arriba que daba contexto al pasaje, se queda fuera.
La consecuencia práctica es incómoda si tu documentación está hecha como la mayoría de la documentación industrial. Imagina una ficha donde la designación del modelo está en un encabezado, el material aparece en una tabla dos secciones más abajo y la temperatura de servicio solo existe en el pie de un esquema. Cada uno de esos datos puede ser recuperable por separado. Ninguno viaja con los demás. Un fragmento con un rango de temperatura y ningún nombre de producto no le sirve casi de nada a un sistema que debe decir cuál de tus modelos aguanta esa temperatura.
Por qué el asistente describe un producto descatalogado
Cuando la recuperación no encuentra nada aprovechable, el modelo no se detiene. Responde desde la memoria absorbida, y de ahí salen las respuestas equivocadas pero verosímiles: una designación retirada, una especificación de la generación anterior, una certificación que tiene tu competidor y tú no. El texto sale con la misma seguridad que un dato recuperado. No hay diferencia visible entre una respuesta construida sobre tu ficha técnica actual y otra montada con residuos estadísticos.
Por eso mismo, corregir una información equivocada casi nunca pasa por discutir con el modelo. Si la carpeta recuperada contiene una afirmación clara, actual y autosuficiente, el modelo tiene un motivo fuerte para usarla. Si vuelve vacía, se repliega sobre la memoria, y en la memoria vive la versión antigua de tu empresa.
Qué hace recuperable a un pasaje
Nada de lo que sigue exige software nuevo, y nada es exótico.
- Párrafos autosuficientes. Un pasaje debe tener sentido para quien solo ha leído ese pasaje. Repite la designación del producto dentro del párrafo que declara la especificación, aunque le resulte redundante a un lector humano que ve el encabezado.
- Datos como frases, no solo como celdas o etiquetas de un plano. Las tablas son recuperables cuando son texto de verdad, pero una frase llana que declara material, rango y norma sobrevive mucho mejor al troceado.
- Texto que se pueda alcanzar. Una especificación que solo existe dentro de un archivo descargable, o tras un área privada, es una especificación que la recuperación normalmente no alcanza. Lo mismo vale para el contenido que aparece solo después de ejecutarse un script en el navegador.
- El vocabulario del comprador, no solo el tuyo. La recuperación trabaja sobre el significado, pero parte de las palabras escritas en la página. Si el sector dice bomba de lodos y tu catálogo solo indica la referencia interna de serie, la distancia entre ambas es mayor de lo que parece.
- Una página por cosa. Una sola página con toda una familia de productos le da a la recuperación un montón de fragmentos parecidos sin forma de distinguirlos. Páginas separadas producen pasajes separados y más limpios.
Una prueba para hoy
Elige una especificación realmente vigente y razonablemente concreta: un rango de servicio, un material, una compatibilidad. Hazle a un asistente que consulta la web una pregunta cuya respuesta exija esa especificación, sin nombrar tu empresa. Repite la pregunta nombrándola. Después pide la fuente.
Si la respuesta es correcta y la fuente es una página tuya, la recuperación te alcanzó. Si es correcta pero la fuente es un distribuidor o un marketplace, llegó a tu especificación a través de la página de un tercero: conviene saberlo, porque son ellos los citados y es su descripción de tu producto la que circula. Si la respuesta es incorrecta y no ofrece ninguna fuente, estás viendo memoria absorbida sin nada que la corrija.
Lo que esto no hace
Hacer recuperables tus páginas es un requisito previo, no una palanca. Nadie, nosotros incluidos, puede garantizar que un asistente te cite, y ningún proveedor de herramientas tiene acceso privilegiado al modo en que estos sistemas ordenan lo que recuperan. Lo que sí se puede hacer con honestidad es medir: PSentry comprueba si tu marca aparece en las respuestas de ChatGPT, Claude, Gemini y Perplexity, en cada idioma y mercado donde vendes, y en qué fuentes se apoyan esas respuestas. Mide e informa. No edita tus páginas, no toca el índice de recuperación de ningún asistente y no promete que un cambio en tu web produzca un cambio en una respuesta.
Entender el mecanismo compensa igualmente la tarde que cuesta. Convierte una inquietud difusa sobre la IA en una lista concreta de cosas de tu propia documentación que puedes comprobar, arreglar y volver a comprobar.
Preguntas Frecuentes
¿La recuperación es un buscador con pasos extra?
Usa búsqueda, pero el objetivo es distinto. Un buscador devuelve enlaces para que los abra una persona. La recuperación devuelve pasajes para que un modelo escriba a partir de ellos, y por eso importa más la calidad del párrafo suelto que la de la página entera.
¿El contenido de mi web se usa para entrenar los modelos?
Depende del proveedor y de lo que permita tu sitio, y es una cuestión aparte. El entrenamiento es lento, opaco y ajeno a tu control. La recuperación ocurre en el momento de la respuesta y depende de cosas comprobables: si la página es accesible, si el texto es real, si el pasaje se sostiene solo.
¿Necesito una base vectorial o un sistema RAG interno?
Para esto no. Montar tu propia recuperación sirve para responder sobre documentos internos. Que te citen los asistentes públicos depende de la recuperación que ya ocurre en la web abierta, donde tu única entrada son las páginas que publicas.
¿Un archivo llms.txt hace recuperable mi contenido?
Publicarlo cuesta poco y puede ayudar a los sistemas que decidan leerlo, pero trátalo como una pista, no como un mecanismo. Lo que consume la recuperación hoy es una página bien formada con texto real, y ningún archivo auxiliar compensa una especificación encerrada en un documento escaneado.
¿Por qué el asistente cita a mi distribuidor y no a mi web?
Normalmente porque el distribuidor declara la especificación como texto en una página accesible mientras el fabricante la guarda en un archivo descargable. La recuperación toma el pasaje que alcanza, y la atribución sigue al pasaje.