Volver al blog Perplexity enseña sus fuentes, pero medir sigue siendo difícil

Perplexity enseña sus fuentes, pero medir sigue siendo difícil

Es la única plataforma de IA que imprime las páginas que hay detrás de su respuesta. Eso la convierte en tu mejor instrumento de diagnóstico y en un mal sustituto de las demás.

Pregúntale a ChatGPT por qué recomendó a un proveedor concreto y obtendrás una racionalización, no un recibo. Escribe prosa fluida sobre por qué esas marcas son buenas opciones, y nada de eso te dice de dónde salió la convicción. No puede decírtelo: buena parte de lo que sabe de tu mercado lo absorbió durante el entrenamiento, y no hay ninguna página a la que señalar.

Perplexity funciona de otra manera. Recupera páginas mientras responde, escribe encima de lo que ha recuperado e imprime la lista de lo que ha leído. Para quien intenta medir cómo hablan de una marca los sistemas de IA, esa lista es el objeto más valioso de toda la categoría. Es el único sitio donde puedes ver, sin adivinar, qué páginas está usando un modelo para describirte a ti y para describir a las empresas que nombra en tu lugar.

Y también es, y esta es la parte que se salta todo el mundo, insuficiente.

Por qué la recuperación vuelve legible a Perplexity

Un modelo que responde de memoria está reproduciendo patrones estadísticos formados sobre un corpus que no puedes inspeccionar. Un modelo que responde por recuperación ha ido a buscar páginas en vivo, las ha metido en su contexto y las ha resumido. Solo el segundo proceso deja rastro, y Perplexity enseña ese rastro dentro de la propia respuesta. Ya no estás interpretando un resultado. Estás leyendo una bibliografía.

Las fuentes son el hallazgo, no la respuesta

Casi todo el mundo lanza una consulta, mira si aparece su marca y ahí se detiene. Es lo menos informativo de la página.

Lanza una pregunta de compra de tu categoría, de esas que alguien hace antes de saber que existes, y luego ignora la prosa por completo. Vete a la lista de fuentes y pregúntate qué clase de páginas hay en ella. En algunas categorías son webs de reseñas independientes. En otras, documentación, una plataforma de venta, un par de publicaciones sectoriales o hilos de foro donde los profesionales discuten entre ellos. En otras son entradas de blog de la competencia, que la primera vez produce una sensación rara: el modelo está describiendo tu mercado usando el contenido de una rival como texto de referencia.

Esa lista es el mapa de dónde se construye de verdad la autoridad en tu categoría. No donde tú crees que se construye, ni donde lo da por hecho tu plan de contenidos. Donde decide ir a buscar un sistema de recuperación al que le acaban de hacer una pregunta de compra real.

Lee las fuentes que usa para tus competidores

Aquí está el movimiento que compensa el esfuerzo. No preguntes solo por ti. Haz la pregunta que nombra a una competidora, o la pregunta comparativa abierta que saca a varias a la superficie, y mira qué páginas recuperó Perplexity para describirlas a ellas.

Lo que buscas son asimetrías. Una competidora descrita a partir de varias páginas independientes de terceros está en una posición muy distinta de otra descrita a partir de su propia página de inicio, aunque a las dos las nombren en la misma respuesta. La primera tiene una web que habla de ella. La segunda tiene un sitio web. No son el mismo activo, y solo uno de los dos sobrevive a un sistema que decide dar más peso a las fuentes independientes.

La prueba funciona también al revés, y conviene hacerla con honestidad: si todas las páginas que el modelo usó para describirte las escribiste tú, acabas de aprender algo incómodo sobre lo delgado que es el registro independiente de tu marca.

Por qué su lista de fuentes te habla de las plataformas que esconden la suya

La objeción evidente es que quizá Perplexity no sea el sitio donde la mayoría de tus compradores hace sus preguntas. Deja el argumento del uso a un lado y trátala como un instrumento, no como un destino.

Las páginas que saca a la luz son, a grandes rasgos, las páginas que la web abierta ha consagrado como respuestas autorizadas a esa pregunta, y son las mismas páginas que las demás plataformas rastrearon, indexaron y usaron para entrenarse. El mecanismo difiere y las ponderaciones son incognoscibles, pero el sustrato es compartido: hay una sola web, y todas la están leyendo. Así que la lista de fuentes que extraes de Perplexity es una hipótesis de trabajo sobre dónde se gana la visibilidad en las cuatro plataformas, obtenida de la única que te enseña los deberes.

Una hipótesis, no una prueba. Y eso nos lleva a la parte difícil.

Enseñar las fuentes no vuelve fácil el seguimiento

La respuesta se mueve, y las fuentes se mueven con ella

Lanza dos veces la misma consulta y puedes obtener respuestas distintas, sacadas de un conjunto de páginas en parte distinto. El paso de recuperación es una búsqueda, y las búsquedas no son estables ni en el tiempo ni entre sesiones. El paso de generación que va encima es probabilístico por diseño.

La consecuencia es tajante, y casi todos los consejos sobre monitorización se niegan calladamente a aceptarla: el resultado de una consulta suelta no es una medición. Es una muestra de una distribución que no has caracterizado. Comprueba una vez, encuéntrate citado, anótalo como victoria y habrás anotado ruido. Y al revés también: faltar una vez significa muy poco.

Lo real es el patrón. La marca que aparece en la mayoría de las ejecuciones de una pregunta, a lo largo del tiempo, está de verdad presente en el espacio de respuestas del modelo. La fuente que reaparece una y otra vez es la que de verdad sostiene tu categoría. Lo que sale una sola vez es una moneda al aire que te tocó ver.

Una cita y una mención son sucesos distintos

Perplexity puede citar tu página como fuente y no nombrar tu marca en el texto de la respuesta. Te ha leído, te ha usado y le ha entregado la recomendación a otro. Tu contenido era lo bastante bueno para alimentar la respuesta y tu posicionamiento no era lo bastante fuerte para ser la respuesta.

Ocurre también lo contrario: tu marca, nombrada en la prosa, con la cita apuntando a la página de otro. Los dos desenlaces importan y significan cosas opuestas. Regístralos como un solo número y habrás destruido la distinción que te habría dicho qué hacer a continuación.

Que te citen aquí no dice nada de las otras tres

Esta es la que pilla a la gente. Perplexity recupera, así que una página publicada hace poco puede influir en sus respuestas con relativa rapidez. ChatGPT, Claude y Gemini se apoyan, en grados variables y no declarados, en lo que absorbieron durante el entrenamiento, y los datos de entrenamiento tienen fecha de corte. Si tu marca se volvió notable después de ese corte, o nunca acumuló suficiente cobertura independiente como para registrarse, puede estar completamente ausente de la memoria de un modelo mientras Perplexity te cita alegremente cada vez.

Un buen resultado en Perplexity es una noticia genuinamente buena sobre tu presencia recuperable en la web. No es prueba de visibilidad en ningún otro sitio, y tomarlo como sustituto de las demás te dejará confiado y equivocado a la vez.

Qué anotar en cada ejecución

Si lo haces a mano, lleva un registro, y conserva siempre los mismos campos. Los campos son lo que convierte una sesión de navegación en datos.

  • La pregunta exacta, literal. Una pregunta reformulada es otra pregunta, y sus resultados no son comparables con los anteriores.
  • El idioma en el que se hizo, y el mercado al que se refiere. Dos variables, y las dos mueven la respuesta.
  • Si tu marca fue nombrada, y más o menos dónde: en la frase de apertura, en mitad de una lista, en un inciso final.
  • Cómo te caracterizaron. Que te nombren como la opción por defecto y que te nombren como la alternativa barata no son el mismo desenlace, y un campo de sí o no jamás lo va a capturar.
  • Cada fuente citada, con la URL entera, marcada como tuya, de una competidora o independiente.
  • Qué competidores fueron nombrados, incluidos los que tú no consideras competidores. Los nombres inesperados son lo más informativo del registro.
  • La marca de tiempo, porque nada de esto significa nada hasta que lo compares con la misma pregunta lanzada más tarde.

Haz esto con un puñado de preguntas, varias ejecuciones cada una, y la forma de tu posición empieza a aparecer. Hazlo con el conjunto de preguntas que de verdad cubre tu mercado, en todos los idiomas en los que vendes, y te quedarás sin tardes.

Donde automatizar deja de ser opcional

Ese techo es donde una herramienta de medición se gana el sitio. Es lo que hace PSentry: lanza tu conjunto de preguntas en ChatGPT, Claude, Gemini y Perplexity, en cada idioma y mercado donde vendes, anota a quién nombraron y qué fuentes se citaron, y muestra cómo cambia todo eso con el tiempo.

Dos límites, dichos con claridad. Los análisis se lanzan según calendario, dos veces al mes, y no de forma continua: esto es medición, no un sistema de avisos. Y medición es todo lo que es. No manipula lo que estos sistemas dicen de ti, y ningún proveedor honesto afirmará lo contrario. Lo que obtienes es una lectura repetida y estable de un blanco móvil, que es lo único que vuelve legible el blanco.

Preguntas Frecuentes

Si Perplexity cita mi página, ¿empezarán a citarla los demás modelos?

No como consecuencia. No existe mecanismo por el cual la cita de un sistema se propague a otro. Lo que sí puede pasar es que la condición de fondo, una página lo bastante rastreable y clara como para poder recuperarse, la vuelva también más aprovechable para los sistemas que rastrean la web y se entrenan con ella. La cita es un síntoma de esa condición, no la causa de nada que venga después.

¿Debería escribir contenido pensado específicamente para Perplexity?

Escribir para un solo sistema de recuperación es apostar estrecho por un detalle de implementación que sus creadores pueden cambiar sin avisarte. La versión duradera de ese instinto consiste en escribir páginas que contesten una pregunta real de forma directa y arriba del todo, porque todos los sistemas de recuperación premian el texto que se puede levantar y reutilizar sin retocarlo.

¿Bloquear a PerplexityBot me borra de sus respuestas?

Retira tus páginas de lo que puede descargar, así que ya no puede usar tu sitio como fuente, aunque todavía puede describirte a partir de lo que escribieron otros. Abre tu robots.txt y míralo. Muchísimos sitios añadieron reglas indiscriminadas contra los rastreadores de IA durante el pánico del rastreo masivo y no volvieron a revisarlas, y quien las añadió no suele ser quien hoy responde de si la marca aparece en las respuestas de la IA.

¿Cuántas ejecuciones de una pregunta son suficientes?

No hay un umbral que convierta el ruido en señal de golpe. Una ejecución es una anécdota, un puñado empieza a insinuar una tendencia, y un conjunto repetido a lo largo del tiempo es lo único sobre lo que merece la pena actuar. Si un resultado cambia de una ejecución a otra, esa inestabilidad ya es el hallazgo: estás en la frontera del espacio de respuestas del modelo, y no cómodamente dentro.