Metodología
Cómo funciona la medición por dentro.
Este es el método detrás del estudio, escrito para que puedas juzgarlo antes de contratar nada. Cubre qué se cuenta, cómo se arman las preguntas y por qué nunca nombran tu marca, a qué asistentes se les pregunta, cómo se dimensiona un estudio, y las cosas que una medición honesta no va a afirmar.
Volver a la vista generalEn esta página
Respuestas, no links
Qué medimos
Antes de decidir
Investigación de respuestas de IA
Google te da diez links. Un modelo de IA te da una respuesta.
Hasta ahora, que alguien encontrara tu marca o página quería decir posicionar. Un buscador entregaba una página de links y la persona decidía cuál abrir. La posición importaba porque había una lista en la cual tener posición.
Un modelo no entrega una lista. Lee las fuentes él mismo, decide qué cree, y contesta en un párrafo. Tu marca o página están dentro de ese párrafo o no están. La persona puede que nunca vea un link, nunca visite el sitio de nadie, y nunca sepa qué marcas quedaron fuera de la respuesta.
Eso es lo que esto mide, y medir tiene que ir primero, porque no puedes mejorar una respuesta que nadie ha leído.
Resultados Google
Un buscador, 2015
- Los 12 mejores bloqueadores para niños, probadosconsumerreports.org
- Bloqueador para piel sensible | Solariasolaria.mx
- Mineral contra químico: lo que hay que saberaad.org
- Bloqsol Kids SPF 50, compra en líneafarmaciasanpablo.com.mx
- ¿Qué bloqueadores usan los dermatólogos?reddit.com
- Estudio de seguridad de bloqueadores 2024profeco.gob.mx
Resultados ChatGPT
Un modelo de IA, hoy
Para piel infantil sensible, elige un bloqueador mineral con óxido de zinc en SPF 50. Bloqsol Kids es el que más se recomienda, y Dermalux Pediatric aparece con frecuencia para niños con dermatitis. Reaplica cada dos horas.
Entraron seis fuentes. Salieron dos marcas. Nadie hizo clic en un solo link, no se visitó ningún sitio, y las marcas que quedaron fuera no tienen forma siquiera de enterarse de que quedaron fuera. Ese es todo el problema en una línea, y por eso adivinar no es una opción.
- Para quién es
- Marcas que se compran a través de retailers, distribuidores, farmacias, asesores o recomendaciones. Productos de consumo es el caso más claro; salud, servicios financieros y categorías B2B que se juzgan por fuentes de terceros tienen el mismo problema.
- Qué responde
- Cuando alguien le pregunta a un modelo sobre tu categoría, si tu marca aparece, si la recomiendan, qué se dice de ella, y qué fuentes están formando esa respuesta.
- Qué recibes
- Un banco de preguntas congelado, cada respuesta registrada y legible, un reporte de tasas en lugar de scores, una lista ordenada de las fuentes que las están moviendo, y las prioridades que señala cada una.
Esto es investigación de mercado sobre esas respuestas, para marcas cuya posición no se puede leer desde su propio sitio web. Diseñamos el banco de preguntas con tu equipo, lo corremos en los modelos que importan para tu categoría, leemos cada respuesta, y te entregamos un reporte con evidencia y una sesión de trabajo sobre dónde enfocarte primero.
Así que la única manera honesta de saber dónde estás parado es preguntarle a un modelo de IA una pregunta real y leer cómo responde.
Qué se cuenta
Lo mismo, de la misma forma, en cada respuesta, en cada corrida. La consistencia es lo que hace comparable la corrida dos con la corrida uno.
- Menciones de marcaCada aparición de la marca, sus alias, sus submarcas y sus errores de escritura.
- Menciones de competidoresLo mismo, para cada marca del set competitivo, que es lo que hace posible una cifra de participación.
- RecomendacionesSeparadas de las simples menciones, porque ser listado y ser recomendado son resultados distintos.
- FuentesCada sitio citado o nombrado, sin duplicados y ordenado por quién puede influir en él.
- Negativas y respuestas evasivasSe registran como estado propio. Que un asistente se niegue a recomendar es información, no un dato faltante.
Y lo que la marca necesite además
Los contadores de al lado vienen en cada proyecto. Estos se agregan cuando la marca tiene una razón para pedirlos, y ahí es donde vive casi toda la personalización.
- Sentimiento hacia la marca y hacia la categoría
- Alertas cuando un asistente repite una crítica específica o un estudio desactualizado
- Qué retailers y canales nombra la respuesta como lugares de compra
- Si una afirmación que legalmente puedes hacer la están haciendo por ti
- Si una submarca se le está acreditando a la marca madre, o al revés
Por qué no se mide desde tu sitio
Tu sitio web es el instrumento equivocado
Casi toda herramienta en este espacio heredó su marco del SEO. Rastrea tu sitio, califica tus páginas y recomienda contenido para que el sitio sea citado. Ese es un producto coherente para una empresa cuyos ingresos llegan por su propio sitio web.
Es el marco equivocado para buena parte del mercado de consumo. Una marca de bloqueador solar vende en farmacias y supermercados. Su sitio es un folleto con consejos de cuidado solar. Ninguna cantidad de trabajo on-page cambia el hecho de que la compra ocurre en un anaquel, y el tráfico al sitio no es proxy de nada que el equipo de marketing esté tratando de mover.
Construye la medición alrededor del sitio y produces un reporte lleno de números sobre los que nadie puede actuar. Por eso la construimos alrededor de la conversación de categoría, y eso lleva a una regla que gobierna todo el banco de prompts.
Para saber si tu marca aparece por sí sola, la pregunta no puede mencionarla. Nombra la marca y el modelo la va a comentar con gusto, y lo que mediste fue tu propia pregunta.
Eso rige una capa del banco, no el banco entero. También vas a querer preguntar por tu marca directamente, y por cómo te comparas con las demás, y esas preguntas también están adentro. Lo que importa es que los tres tipos se pregunten aparte y se cuenten aparte, porque mezclarlos te da un número que no responde nada.
Los cuatro pasos de una compra, y dónde aparece tu sitio
- 01
Le pregunta a un asistente qué comprar
Recibe una lista corta. Tu sitio no está en ella.
- 02
Revisa la app de una cadena de farmacias
Lee una ficha de producto que escribió el retailer.
- 03
Lee dos reseñas
Un foro de mamás y una revista de consumo.
- 04
La compra en el pasillo
La decisión ya estaba tomada antes de llegar.
Veces que el comprador visitó el sitio web de la marca: 0
Cuatro resultados reemplazan al tráfico
Si no puedes contar visitas, cuenta esto. Cada uno se observa en el texto de la respuesta, sin integrar analytics y sin poner una etiqueta en tu sitio.
Mencionada
¿La marca aparece siquiera en una pregunta que nunca la nombra?
El piso. Presencia en la conversación de categoría.
Recomendada
¿El asistente la sugiere, o nada más la lista junto con otras?
Aparecer en una lista de ocho no es lo mismo que ser la que te dicen que compres.
Señalada como la mejor
¿La distingue en lugar de agruparla?
La forma más fuerte de presencia, y la más rara.
Con ruta de compra
¿La respuesta le dice a la persona dónde comprarla?
Lo más cerca que esto llega a la intención de compra, y no necesita analytics, porque lo que registramos es lo que dijo el asistente y no lo que la persona hizo después.
Una precaución que conviene resolver antes de la corrida y no después. Una mención a tu tienda en línea es señal de compra. Una mención a tu sitio corporativo es awareness. Una cuenta de redes sin tienda conectada no es ninguna de las dos. Promédialas en un solo número de propiedades propias y vas a reportar presencia como si fuera intención.
El sistema
Cómo corre una medición, paso a paso
Cinco pasos. Haz clic en cualquiera. Las partes que cargan el criterio son el banco de prompts y la lectura de las respuestas, y de esas dos trata el resto de esta página.
paso 1 de 5
Levantamiento
Entender la marca y qué tiene que cambiar el resultado
Cómo se escriben las preguntas
El banco es el instrumento, así que vale la pena ver cómo se arma uno. Empieza por tu categoría y nunca por tu marca, y crece en dos direcciones: los temas sobre los que la gente pregunta, y las distintas formas en que pregunta sobre cada uno.
Primero, los temas que hay adentro
Nadie pregunta por una categoría. Pregunta por una situación dentro de ella. Así que el primer trabajo es listar cada tema que un comprador real trae a esta categoría, y escribir preguntas para cada uno. Aquí hay siete para bloqueador solar, con el tipo de pregunta que va debajo de cada tema.
Proteger a los niños
“qué bloqueador es más seguro para un niño pequeño”
Piel sensible
“cuál bloqueador no me irrita la rosácea”
Uso diario en la cara
“puedo usar bloqueador debajo del maquillaje todos los días”
Playa y deporte
“cuál aguanta de verdad cuando te metes al agua”
Seguridad de ingredientes
“la oxibenzona hace daño”
Precio y valor
“vale la pena el bloqueador caro”
Dónde comprar
“dónde compro bloqueador mineral en México”
Después, las distintas personas que preguntan
Una pregunta por tema no es una medición, es una muestra de uno. Así que cada tema recibe varias preguntas que le entran desde ángulos genuinamente distintos. Toma el tema de los niños. Estas cuatro no son la misma pregunta redactada de otra forma, y un asistente las contesta diferente.
- Por quién pregunta
- “bloqueador para bebé de menos de seis meses”
- Por la situación
- “cómo evito que mis hijos se quemen en la playa”
- Por qué tan avanzada va la decisión
- “cuál bloqueador para niños es el mejor”
- Por comparación
- “bloqueador mineral o químico para niños”
Después, las preguntas que sí te nombran
Todo lo de arriba deja tu nombre fuera a propósito, porque esa es la única forma de saber si apareces sin que te pidan. Pero mucho de lo que necesitas saber solo sale a flote cuando la marca ya está sobre la mesa. Así que el banco tiene una segunda capa que la nombra directo, y responde otra cosa: no si te encuentran, sino qué pasa una vez que ya lo hicieron.
- Qué cree el modelo sobre ti
- “Solaria es seguro para un bebé”
- Si manda a los compradores a donde todavía te surten
- “dónde compro Solaria”
- Qué crítica trae pegada tu nombre
- “el bloqueador Solaria tiene algún problema”
- Si una submarca se te acredita a ti
- “Solaria Kids es lo mismo que Solaria”
Y las preguntas sobre todos los demás
Una cifra de participación necesita un denominador, y el denominador es tu set competitivo. Ese set casi nunca es el que tu equipo comercial escribiría de memoria. Tiene que incluir a quien el modelo trata como intercambiable contigo, que de forma rutinaria es la marca propia de supermercado que está junto a ti en el anaquel. Esta tercera capa es donde te enteras de qué marcas son dueñas de la conversación de categoría, y qué comparaciones están pasando sin ti adentro.
- Quién es dueño de la categoría
- “qué marcas de bloqueador recomiendan los dermatólogos”
- Frente a frente, con nombre
- “Solaria es mejor que Bloqsol para niños”
- Comparaciones donde no estás
- “Bloqsol o Dermalux para piel sensible”
- Quién es dueño de cada atributo
- “qué marca de bloqueador da el mejor valor en México”
Tres capas, contadas aparte
Las preguntas sin marca, con marca y competitivas tienen cada una sus propios números, y nunca se promedian juntas. Una tasa de mención sin marca te dice si la conversación de categoría te incluye. Una con marca te dice qué pasa después de que alguien ya te eligió. Una competitiva te dice contra quién te están pesando. Mézclalas y cada cifra se mueve por razones que nadie puede explicar. Separadas, cada una tiene un corte con tamaño suficiente para reportarse, que es más o menos la razón por la que un banco termina entre cincuenta y cien preguntas y no en una docena.
No todos los modelos de IA responden igual
Esta es la única idea de verdad técnica de la página, y vale dos minutos porque cambia lo que significa un resultado.
Cuando le preguntas algo a un modelo, puede responder de dos maneras. Puede responder de memoria, usando solo lo que absorbió mientras lo entrenaron, y en ese caso no miró internet para nada: tu marca está en su memoria o no está. O puede ir a buscar primero, leer lo que encuentra, y escribir una respuesta con eso. Mismo modelo, misma pregunta, y algo completamente distinto medido.
Hay un tercer caso, donde el buscador mismo escribe la respuesta. Eso son Google AI Mode y AI Overviews: no un chat, sino una página de resultados que responde en lugar de listar.
Mézclalos en un solo número y no significa nada, porque no puedes distinguir si tu marca es realmente conocida o simplemente fue encontrada. Por eso los medimos y los reportamos por separado.
Responder de memoria
El modelo contesta usando solo lo que aprendió durante su entrenamiento. Nunca toca internet, así que nada publicado recientemente puede ayudarle.
Si el modelo de verdad conoce tu marca. Es lo más cercano al awareness espontáneo de marca que existe aquí, y lo más difícil de mover, porque solo cambia cuando reentrenan el modelo.
Buscar y luego responder
El modelo decide que necesita consultar algo, hace una búsqueda, lee un puñado de páginas, y escribe su respuesta a partir de ellas.
Lo que la mayoría de la gente ve hoy. También lo más sucio de medir, porque si se molestó en buscar o no varía entre dos preguntas idénticas.
Un buscador que responde
Google AI Mode y AI Overviews. Estás en una página de resultados, pero la respuesta viene escrita hasta arriba en lugar de ser una lista de links.
El puente hacia el trabajo de SEO que quizá ya estás pagando. Si alguien en la sala es dueño de un presupuesto de búsqueda, este es el número que conecta su mundo con este.
Los modelos también difieren muchísimo en si muestran sus fuentes. Algunos nombran marcas todo el tiempo mientras casi no ponen links. Cuando un modelo no expone ninguna fuente lo registramos como resultado propio, porque contarlo como cero corrompería en silencio toda la comparación.
Qué incluye el proyecto
El proyecto, fase por fase
Cada estudio se moldea alrededor de la categoría, pero la forma del trabajo no cambia. Esto es lo que pasa, quién de tu lado participa, y qué existe al final de cada fase.
Levantamiento
Definimos qué decisión debería cambiar el resultado, con quién compites en realidad, y cuáles de tus propiedades cuentan como propias. El estudio necesita tu lista de competidores y tus dominios; todo lo demás afina la puntería, no decide si el número es confiable.
De tu lado: quien lleva marca o insights, una sesión de trabajo
Banco de preguntas, escrito y revisado
El banco se redacta desde la categoría, y tú lo revisas. Revisar quiere decir verificar que las preguntas suenen como tus clientes y que no falte ningún tema. No quiere decir reescribirlas hacia la marca, que es el único cambio que invalidaría el resultado.
De tu lado: revisión y visto bueno, más quien hable con clientes
Congelar y correr
El banco aprobado se congela y se vuelve el instrumento. Corre en los modelos elegidos, repetido, con el número de observaciones y el techo del costo conocidos antes de enviar la primera pregunta.
De tu lado: nada. Esta parte es nuestra.
Lectura e interpretación
Cada respuesta se lee y se codifica igual. Esta es la parte cara y la que carga el criterio: separar una mención de una recomendación, atribuir submarcas, y ordenar las fuentes por quién puede moverlas de verdad.
De tu lado: nada hasta que los hallazgos estén listos
Reporte y sesión de trabajo
Recibes el reporte, y nos sentamos con él. La sesión importa más que el documento: repasamos qué se movió, qué implica, y qué equipo es dueño de cada acción, para que tu gente pueda defender los números en una junta donde no estamos.
De tu lado: marca, comunicación, retail e insights, juntos si se puede
Segunda ola, cuando el trabajo ya aterrizó
El mismo banco congelado, preguntado otra vez después de que los cambios tuvieron tiempo de publicarse e indexarse. Como el instrumento no cambió, las corridas se pueden comparar directamente. Si no se movió nada, el reporte dice que no se movió nada.
De tu lado: avisarnos cuando el trabajo ya salió
Qué es estándar, y qué es tuyo
- Estándar en cada proyecto: el banco congelado, cada respuesta guardada y legible, las cuatro tasas de resultado, la participación en menciones de categoría, la lista ordenada de fuentes con su dueño, y el reporte más la sesión de trabajo.
- Moldeado a ti: qué modelos vale la pena correr, qué temas se reportan como corte propio, el set competitivo incluyendo las marcas que los modelos tratan como intercambiables con la tuya, y cualquier medición extra que tu categoría necesite, como sentimiento, una afirmación que legalmente puedes hacer, o un estudio viejo que sospechas que sigue circulando.
- No incluido: este proyecto no arregla tu sitio, no encarga el contenido editorial, ni negocia con los retailers. El reporte dice cuál de esas cosas movería el número y quién es dueño de ella.
Si quieres saber si tu categoría es una donde esto vale la pena, eso es una conversación de media hora y no una propuesta.
PlatiquémosloCómo se dimensiona un estudio
Tres perillas, y las ajustamos juntos en el levantamiento. Muévelas para ver cómo cambia la forma de un estudio. El punto no es configurar un producto, es que el tamaño del estudio queda definido antes de enviar la primera pregunta, así que la conversación de alcance ocurre antes de gastar el dinero y no después.
60 × 3 × 3
Observaciones recolectadas
540
Un estudio estándar . Suficientemente amplio para reportar tema por tema en varios modelos.
Direccionalmente: entre más preguntas y más modelos, más lejos llega el estudio, y más cosas hay que validar antes de poder reportar cualquier cifra con confianza. Más preguntas quiere decir más temas cubiertos y más cortes que se sostienen solos. Más modelos quiere decir que el resultado se sostiene en los lugares donde la gente realmente pregunta, y no en uno solo. El punto de esa curva lo elegimos juntos, contra la decisión que el estudio tiene que informar.
Por qué alguien la corre dos veces
Medir dos veces contra el mismo banco
La corrida uno te da una línea base y una lista de qué está citando a tus competidores. Luego ocurre el trabajo, que casi siempre es editorial, contenido de retail y relaciones públicas, más que un proyecto de sitio web.
Después le vuelves a preguntar al mismo banco congelado. Las mismas preguntas, los mismos asistentes, el mismo número de repeticiones. Como el instrumento no cambió, las dos corridas son comparables, y esa comparación es el punto.
Esta es la parte que convierte un estudio de una sola vez en algo que vale la pena conservar, y también la parte que nos mantiene honestos. Si no se movió nada, el reporte dice que no se movió nada.
El banco se congela después de la corrida uno. Agrega una pregunta más adelante y tienes dos bancos, no una tendencia, así que las preguntas nuevas van a un conjunto aparte que arranca su propia línea base.
cifras ilustrativas
+15 puntos. El banco no cambió entre las dos corridas, así que el movimiento no es un artefacto de haber preguntado otra cosa. Aún así no prueba causa: una actualización de modelo o contenido nuevo de terceros pueden mover el mismo número.
Hábitos de buscador que ya no aplican
Cinco cosas que hay que desaprender
Casi toda la confusión de una primera conversación viene de traer costumbres de buscadores a un lugar donde no aplican. Cinco correcciones resuelven la mayor parte.
Los asistentes responden. No hacen ranking. Tu marca se nombra o no, se recomienda o solo se lista, se describe con precisión o no, y se le da un lugar dónde comprarla o se queda en el aire. Esos son los resultados.
Preguntar en qué lugar apareces en ChatGPT es preguntar algo que el medio no puede contestar. Si una herramienta te reporta una posición de todos modos, vale la pena preguntar qué midió en realidad para producirla.
Un análisis de 23,387 citas en 240 consultas de marca encontró que el earned media aporta 48 por ciento de lo que citan los asistentes, otro contenido comercial de terceros 30 por ciento, y el sitio propio de la marca 23 por ciento.
Entonces, si la respuesta sobre tu categoría se arma con el estudio de una revista de consumo, el reporte de un regulador y dos fichas de producto de retailers, la palanca es lo que dicen esas fuentes. Ese trabajo es relaciones públicas y contenido de retail, no una migración de sitio web.
Acabas de verlo. El trabajo de medición publicado ubica el traslape de fuentes entre consultas idénticas del mismo día entre un tercio y la mitad.
Una captura de pantalla es una anécdota. Una medición son muchas preguntas, y cada número del reporte es una tasa sobre esas preguntas. Esto también es lo que hace que el ejercicio cueste algo, así que conviene dejarlo claro desde el principio.
Una pregunta no tiene que ser popular para valer la pena. Si un asistente ya se formó una opinión sobre un tema de seguridad en tu categoría, esa opinión se le repite a quien sí pregunte.
Quieres saber qué dice hoy, no después de que un periodista te lo cite.
Casi todos llegan queriendo la optimización. Primero se mide, porque sin una línea base no puedes atribuir ningún cambio posterior a nada que hayas hecho.
La versión honesta de este negocio es que la corrida uno te dice dónde estás parado y qué está citando a tus competidores. La corrida dos es donde te enteras si el trabajo movió algo.
Qué es distinto aquí
Tres diferencias con las herramientas del mercado
Nada que comprar, nada que aprender
No hay dashboard, no hay licencias por usuario y no hay una herramienta que tu equipo tenga que adoptar. Un especialista corre la medición y tú recibes el análisis y el reporte. La mayoría de los equipos de marca ya tienen más software del que usan, y lo último que necesita una medición trimestral es un login que alguien olvida.
Hecho para marcas que no venden en línea
Toda herramienta de esta categoría rastrea tu sitio web y califica tus páginas. Si tu producto se compra en un anaquel, eso responde una pregunta que no hiciste. Esto está construido al revés, desde la conversación de categoría hacia adentro, y por eso funciona para una marca de alimentos empacados y funciona igual de bien para una empresa de software que sí vende en línea.
Aprendes el método, no nada más el número
Parte del proyecto es enseñarle a tu equipo cómo arman las respuestas los asistentes, por qué el banco está escrito como está, y cómo leer una tasa. La intención es que puedas defender estos números en una junta donde nosotros no estamos. Un número que nadie de tu lado puede explicar no sobrevive al primer cuestionamiento.
Qué no hace esto
Todos los demás en esta categoría venden un score instantáneo. Aquí están los límites reales de una medición honesta, para que decidas antes de gastar nada.
- No te va a dar una posición
- No hay una posición uno que reportar. Lo que te dé una, se la inventó.
- No va a atribuir ventas
- Registramos lo que dijo el asistente. Lo que la persona hizo después ocurre fuera de todo lo que podemos ver. El resultado de ruta de compra es el proxy honesto más cercano, y es un proxy.
- No puede prometer que el número se mueva
- La mayor parte de lo que cita un asistente lo escribió alguien más. Podemos decirte qué fuentes están empujando la respuesta y quién puede influir en cada una. No podemos comprometernos con un resultado que depende de que terceros publiquen distinto.
- No verifica los hechos del asistente por ti
- Podemos registrar que un asistente dijo algo sobre tu producto. Juzgar si esa afirmación es cierta requiere una fuente confiable aprobada que alguien de tu lado mantenga, y la mayoría de las marcas no la tienen. Si la precisión es tu preocupación, dilo en el levantamiento, porque construir esa referencia es un trabajo aparte.
- Una corrida fija prioridades, no te entrega un plan
- Una línea base nombra los huecos y ordena las fuentes detrás de ellos, y eso alcanza para decidir por dónde empezar. Lo que no puede decirte es si actuar sobre ellos funcionó; eso necesita una segunda corrida contra el mismo banco. Quien te prometa un arreglo comprobado a partir de una sola línea base te está vendiendo otra cosa.
Empieza por la pregunta, no por la herramienta
La primera conversación útil es sobre qué decisión debería cambiar el resultado, y si tu categoría es una donde el asistente ya tiene opiniones. Eso toma como media hora, y al final vas a saber si medir vale la pena para ti.
Platiquémoslo