ChatGPT, Gemini y Claude no recomiendan la misma plataforma de e-commerce. Estos son los datos.
Hacele la misma pregunta a ChatGPT, Gemini y Claude: "¿Qué plataforma uso para crear una tienda online y vender?". Uno esperaría más o menos la misma respuesta. No es así.
En nuestro último corte semanal (24 de agosto de 2026), la plataforma más mencionada por ChatGPT fue Wix. La de Gemini fue Magento. La de Claude fue Shopify. Y Shopify, que es el líder general sumando los tres modelos, ni siquiera aparece en el top 3 de ChatGPT.
Estos datos salen del Benchmark de Visibilidad IA de AuraMetrics, donde medimos qué marcas nombran los tres modelos en 15 industrias y 20 mercados, con 277.257 respuestas de IA analizadas hasta hoy. Acá va lo que muestran los datos de e-commerce y por qué cambian la forma de pensar la "visibilidad en IA".
La foto general: Shopify lidera, pero por poco
Sumando los tres modelos en el corte global de e-commerce, el share of voice queda así:
- Shopify: 15,8% de share of voice, 19 menciones, 84% de tono favorable
- Magento (Adobe Commerce): 13,3% de share of voice, 16 menciones, 50% de tono favorable
- BigCommerce: 11,7% de share of voice, 14 menciones, 29% de tono favorable
- WooCommerce: 11,7% de share of voice, 14 menciones, 64% de tono favorable
- Wix: 10,8% de share of voice, 13 menciones, 31% de tono favorable
- Squarespace: 5,0% de share of voice, 6 menciones, 33% de tono favorable
- Mercado Pago: 3,3% de share of voice, 4 menciones, 0% de tono favorable
- IKEA: 2,5% de share of voice, 3 menciones, 0% de tono favorable
- Wayfair: 2,5% de share of voice, 3 menciones, 67% de tono favorable
Corte del 24 de agosto de 2026. E-commerce, mercado global. 18 respuestas de IA analizadas, 120 menciones de marca verificadas.
Dos cosas saltan a la vista antes de separar por modelo. Primero, el top 5 está apretado en cinco puntos porcentuales. No hay una marca dominante; hay un líder y cuatro que lo persiguen. Segundo, mención y recomendación no son lo mismo: BigCommerce y Shopify tienen un share parecido, pero el 84% de las menciones de Shopify aparecen en contexto favorable contra un 29% de BigCommerce. Que te nombren mucho pero enmarcado como "más complejo" o "solo para empresas grandes" es un tipo de visibilidad muy distinto.
Separado por modelo, el ranking se desarma
Acá se pone interesante. Los tres modelos reciben exactamente los mismos prompts. Esto es lo que cada uno pone en el podio:
ChatGPT
- Wix, 8 menciones
- Magento, 7 menciones
- BigCommerce, 6 menciones
Gemini
- Magento, 8 menciones
- Shopify, 7 menciones
- BigCommerce, 6 menciones
Claude
- Shopify, 6 menciones
- WooCommerce, 4 menciones
(ninguna tercera marca llegó al podio en este corte)
Entre paréntesis, menciones en este corte.
Leé esa tabla dos veces:
- Wix lidera en ChatGPT y no aparece en los otros dos podios. Si tu única herramienta de tracking es ChatGPT, concluirías que Wix está ganando. No es así en el total: está quinto y bajó dos puestos respecto al corte anterior.
- Shopify, el líder combinado, no está en el top 3 de ChatGPT. Un equipo de marketing de Shopify mirando solo ChatGPT pensaría que tiene un problema de visibilidad. Mirando solo Claude, pensaría que es intocable.
- Claude nombra menos marcas y las concentra. Su podio tiene dos entradas porque tiende a dar respuestas más cortas y decididas. Eso hace que cada mención en Claude valga proporcionalmente más y sea más difícil de conseguir.
- BigCommerce es la única marca que aparece consistente en el mismo lugar en dos modelos. La consistencia entre modelos es una fortaleza en sí misma, aunque sea desde el tercer puesto.
La conclusión no es que un modelo "tenga razón". Es que cada modelo tiene sus propias fuentes, sus propios datos de entrenamiento y su propia idea de qué es una buena respuesta. No coinciden, y van a seguir sin coincidir.
Por qué importa para tu marca
1. La "visibilidad en IA" como un solo número engaña. Un share of voice combinado esconde que podés ser fuerte en un modelo e invisible en otro. Si tus compradores usan Gemini (cada vez más, a través del AI Mode de Google) y vos optimizás solo para lo que dice ChatGPT, estás midiendo el canal equivocado.
2. Cada modelo premia señales distintas. Nuestros cortes muestran de forma consistente que Gemini se apoya en fuentes estructuradas, ricas en entidades, y en el knowledge graph de Google; ChatGPT toma mucho de artículos comparativos y listados; Claude prefiere el consenso conciso y establecido. Dónde está citada tu marca (y por quién) determina qué modelo la levanta. Por eso medimos las fuentes clave junto con las menciones.
3. Las diferencias son la oportunidad. Donde los modelos no coinciden es exactamente donde un esfuerzo de contenido dirigido puede mover la aguja. Shopify tiene espacio en ChatGPT. Wix tiene espacio en Gemini y Claude. Magento está bien posicionado en dos modelos pero con un 50% de tono favorable, lo que sugiere que sus menciones vienen con reparos que vale la pena trabajar.
4. Las muestras chicas se mueven rápido. Cada corte semanal de una industria son unas pocas decenas de respuestas. Cambios de uno o dos puestos de una semana a otra son normales y no deberían generar pánico ni festejo. El patrón que importa es el que se sostiene durante cuatro o más cortes. Por eso publicamos la serie semanal y no solo la última foto.
Lo que los modelos entienden mal
Un detalle más de este corte. Mercado Pago, IKEA y Wayfair aparecen como respuesta a "qué plataforma uso para armar una tienda". Ninguna de las tres es una plataforma de e-commerce. Mercado Pago es un medio de pago; IKEA y Wayfair son retailers.
Los modelos confunden "empresas asociadas a vender online" con "herramientas para vender online". Pasa más de lo que uno pensaría, y es un recordatorio de que el conteo bruto de menciones necesita verificación antes de tomar decisiones. En nuestro benchmark, cada mención se verifica contra un catálogo de marcas antes de contar.
Cómo construimos estos números
- Tres modelos: ChatGPT, Gemini y Claude, consultados con prompts idénticos.
- Los prompts describen una necesidad real de compra ("quiero crear una tienda online y vender, qué uso") sin nombrar ninguna marca.
- Cada respuesta se procesa para detectar menciones de marca, se cruza contra un catálogo verificado y se clasifica por tono (favorable, neutral, desfavorable).
- Cortes semanales. La serie es pública y se puede ver como tabla en la página del benchmark.
Benchmark en vivo, las 15 industrias y los 20 mercados: aurametrics.io/es/benchmark
¿Tu marca está en el ranking?
El benchmark cubre las marcas más grandes de cada industria. Si la tuya no está en la lista, o está pero con un tono que no te gusta, podés correr una auditoría gratuita y ver exactamente qué dice cada modelo cuando alguien pregunta por tu categoría.
Escrito por
