Metodología
Esta página documenta cómo se construyen los indicadores del benchmark, incluidos los criterios de exclusión de datos. Todas las cifras se leen de la base de datos al momento de la carga.
Qué se mide
Se envían conjuntos estructurados de preguntas a 3 modelos de lenguaje (ChatGPT, Gemini y Claude) sobre 15 industrias en 20 mercados. De cada respuesta se registra qué marcas se mencionan, en qué orden, si existe una recomendación explícita y el tono del contexto en que aparece cada mención.
Las consultas se realizan contra las versiones vigentes de API de cada familia de modelos. El identificador exacto de cada modelo queda registrado en cada corte: ChatGPT (gpt-4o-mini-2024-07-18), Gemini (gemini-3.1-flash-lite), Claude (claude-haiku-4-5-20251001) (corte del 31 de agosto de 2026).
Total acumulado: 277.815 respuestas analizadas desde el .
Detección de menciones y criterios de exclusión
Las marcas se extraen del texto de las respuestas. Este proceso genera dos clases de falsos positivos, y ambas se filtran antes de la publicación.
Términos genéricos. El proceso de extracción puede capturar títulos de sección y sustantivos comunes como si fueran marcas. Se mantiene un registro curado de marcas y solo se publica lo que figura en él. Las 100 entradas de mayor frecuencia fueron revisadas manualmente.
Coincidencias parciales. Un nombre de marca corto puede estar contenido dentro de una palabra no relacionada. Cada mención se valida exigiendo que el nombre aparezca como palabra completa en su contexto. Sin esta validación, las marcas de pocos caracteres acumularían menciones que no se refieren a ellas.
Cifras de la corrida del 29 de agosto de 2026, sobre 1.672.060 menciones procesadas. Se recalculan semanalmente.
- Contabilizadas
- 62,9%
- Fuera del registro de marcas
- 31,5%
- Excluidas por coincidencia parcial
- 5,6%
Expresado sobre el subconjunto de menciones que coinciden con una marca del registro, el 8,1% resultó ser un falso positivo y fue excluido.
Cuándo publicamos una vista
Un mercado cruzado con una industria, por ejemplo Seguros en Uruguay, es una vista. No todas se publican: por debajo de cierto volumen, el ranking sería más ruido de muestreo que una lectura real del mercado.
- Una vista se publica si, en al menos uno de sus dos cortes más recientes, reúne 90 menciones verificadas o más y 8 marcas o más con 3 menciones o más cada una.
- Se evalúa el mejor de los dos cortes, no solo el más reciente, para que una vista no aparezca y desaparezca de una semana a la siguiente por una variación de muestreo que cruza el umbral en cualquier dirección.
- Una vista que no reúne los dos requisitos en ninguno de los dos cortes no se renderiza: muestra el mismo estado que una combinación que todavía no tuvo un corte.
Dentro de una vista ya publicada, ninguna fila con menos de 3 menciones aparece en la tabla, en la dona de participación ni en el podio por modelo. Una vista con pocas marcas por encima de ese piso publica menos de diez filas en lugar de completar con marcas que no lo alcanzan.
Criterios para publicar un movimiento
Cada corte se apoya en un número acotado de respuestas. Con ese volumen, una marca con pocas menciones puede desplazarse varias posiciones por variaciones mínimas. Publicar ese desplazamiento como tendencia equivaldría a reportar ruido de muestreo.
Por ese motivo se aplican umbrales mínimos:
- Los indicadores de movimiento por fila requieren al menos 5 menciones en ambos cortes comparados.
- La sección de mayores movimientos requiere al menos 8 menciones en ambos cortes. El umbral es más exigente porque esa sección afirma que un movimiento estuvo entre los principales del período.
- El mínimo se exige en ambos cortes para evitar que una marca figure entre los mayores ascensos a partir de un solo corte favorable.
La ausencia de indicador no significa ausencia de cambio. Significa que el movimiento no puede medirse con confianza estadística. Esos casos se señalan como "sin dato" o "nueva", nunca como cero. Son afirmaciones distintas y se mantienen separadas.
Cadencia de medición
La medición se agrupa en cortes semanales. Los cambios relevantes en las respuestas de los modelos ocurren cuando se actualiza una versión o cuando cambia el contenido del que se alimentan, procesos cuya escala temporal es de semanas, no de días. Una frecuencia diaria multiplicaría el volumen de consultas sin aportar señal adicional.
Cada mercado se releva con una frecuencia de una a tres semanas, por lo que algunas combinaciones de mercado e industria presentan semanas sin medición. Esos períodos no se interpolan: la línea de tendencia se interrumpe donde no hubo medición, dado que trazar una recta sobre un período no medido implicaría afirmar una tendencia no observada.
Las líneas de tendencia se muestran a partir de 3 cortes. Por debajo de ese mínimo se indica que la serie está en construcción y desde qué fecha.
Fecha de cada corte
27 cortes en el registro, del más reciente al más antiguo.
Limitaciones conocidas
- El tono se determina mediante análisis automático del contexto de cada mención, no mediante revisión humana. Es un indicador de dirección general y no debe usarse para comparaciones finas entre marcas.
- Los proveedores actualizan sus modelos sin previo aviso. Un movimiento en el ranking puede originarse en el mercado o en un cambio del modelo, y ambas causas no siempre son distinguibles desde fuera.
- El mercado de Brasil se consulta en inglés. Su ranking refleja las respuestas de los modelos en ese idioma sobre el mercado brasileño.
- Una marca nueva no aparece en los rankings hasta acumular el volumen mínimo requerido para ingresar al registro. Este criterio prioriza la exclusión de ruido sobre la cobertura inmediata.