"¿Cuál es la IA más usada del mundo?" parece una pregunta con una sola respuesta. No la tiene. Depende de si mides quién recibe más tráfico web, quién gana cuando usuarios anónimos comparan dos respuestas sin saber de qué modelo vienen, o cuántos tokens procesan de verdad los desarrolladores que pagan por ello. Cada una de esas tres formas de medir tiene un ganador distinto en agosto de 2026, y las tres están basadas en datos reales, no en cuál hace más ruido en redes.

Tres formas de medir "más usada", tres públicos distintos

El tráfico web mide a cuánta gente corriente visita la página o la app de una IA para hacerle una pregunta. La preferencia ciega mide qué respuesta prefiere la gente cuando no sabe qué modelo la escribió — un panel de millones de votos anónimos. Y el volumen de tokens en producción mide cuánto están usando de verdad los desarrolladores que construyen productos encima de esos modelos y pagan por cada palabra que procesan. Son tres públicos casi sin solape: el usuario de a pie, el votante curioso, y el ingeniero que factura por API. No hay razón para que coincidan, y en 2026 no coinciden.

El tráfico manda ChatGPT, pero se está desinflando su cuota

Según el informe oficial de Similarweb sobre el panorama de la IA generativa, publicado el 29 de julio de 2026, la cuota mundial de tráfico web de ChatGPT cayó de aproximadamente el 76% en junio de 2025 al 53% en mayo de 20261. En el mismo periodo, Gemini pasó de menos del 9% a rondar el 27-28%, y Claude — que partía de un 2% casi anecdótico — subió a cerca del 9%, el mayor crecimiento proporcional de cualquier plataforma medida. ChatGPT no está recibiendo menos visitas en términos absolutos — sus visitas siguen creciendo — pero el resto del pastel crece más rápido que él.

Cuota mundial de tráfico web en IA generativa, junio 2025 → mayo 2026

Junio 2025 Mayo 2026

Fuente: Similarweb, informe "2026 Generative AI Landscape" (29 de julio de 2026) — ver fuente 1.

Cuando la comparación es a ciegas, gana Claude

Arena (el proyecto antes conocido como LMArena, fundado por investigadores de Berkeley) mide algo completamente distinto al tráfico: enfrenta dos modelos anónimos con el mismo prompt y deja que una persona vote cuál respondió mejor, sin decirle de qué modelo viene cada respuesta hasta después de votar2. Es la puntuación Elo más citada de la industria porque mide preferencia humana real, no benchmarks que un modelo puede haber memorizado. A fecha de esta escritura, seis de los diez primeros puestos del ranking de texto los ocupan variantes de Claude3:

#ModeloEloOrganización
1Claude Fable 51508Anthropic
2Claude Opus 4.6 (high)1504Anthropic
3Claude Opus 4.7 (high)1502Anthropic
4Muse Spark 1.2 (xHigh)1498Meta
5Claude Opus 4.61497Anthropic
6Claude Opus 4.71494Anthropic
7Claude Opus 5 (high)1493Anthropic
8Muse Spark 1.11491Meta
9Gemini 3.7 Flash (high)1490Google
10Kimi K3 (max)1489Moonshot AI

Fuente: Arena (arena.ai), ranking de texto por Elo, consultado el 26 de agosto de 2026 — ver fuente 3.

Merece una advertencia honesta: Arena no está libre de problemas. Un estudio de febrero de 2025 mostró que unos pocos cientos de votos coordinados bastan para mover el ranking, y en abril de ese mismo año Meta fue sorprendida enviando a competir una versión de Llama 4 distinta de la que luego publicó, lo que obligó a la plataforma a cambiar sus normas2. Es la mejor medida pública de preferencia humana que existe, no una medida perfecta.

En producción real, ganan tres modelos chinos que casi nadie conoce por su nombre

OpenRouter enruta peticiones de miles de desarrolladores hacia cientos de modelos distintos, y publica cuántos tokens procesa cada uno — el dato más cercano que existe a "cuánto se usa esto de verdad" fuera de los propios laboratorios. Mirando el acumulado de 30 días a fecha del 25 de agosto de 2026, según datos de OpenRouter recopilados por el agregador Tokenmaxxing4, tres modelos chinos de pesos abiertos concentran más volumen que cualquier chatbot de marca occidental:

DeepSeek V4 Flash
36,4T
Tencent Hy3
33,1T
Xiaomi MiMo V2.5
28,4T
"Ox Alpha" (stealth)
23,2T
Nemotron 3 Ultra
13,6T

Tokens procesados en 30 días (billones), OpenRouter vía Tokenmaxxing, datos al 25 de agosto de 2026. En verde, modelos de origen chino y pesos abiertos — ver fuente 4.

DeepSeek, Tencent y Xiaomi suman entre los tres casi 98 billones de tokens en 30 días — más que "Ox Alpha", un modelo sin marca pública que lidera el pico de un solo día pero no el acumulado mensual, y que ni siquiera se sabe con certeza quién lo entrena. El motivo del dominio chino no es un misterio: son gratuitos o casi, de pesos abiertos, y cualquier desarrollador puede autoalojarlos sin depender de la API de nadie. Cuando quien decide es un ingeniero mirando una factura, el precio pesa más que la marca.

Por qué cada uno gana en lo suyo

ChatGPT gana en tráfico porque fue la puerta de entrada de cientos de millones de personas a la IA generativa y sigue siendo la más reconocible por defecto. Claude gana en preferencia ciega porque, cuando se elimina la marca de la ecuación, la calidad de la respuesta es lo único que queda — y ahí Anthropic lleva meses invirtiendo específicamente en eso. Y los modelos chinos ganan en volumen de producción porque ese público no elige por reputación, elige por coste por token y por poder correr el modelo donde le convenga. No hay una sola "IA más usada" del mismo modo que no hay un solo "coche más vendido": depende de si hablas de unidades, de facturación o de qué marca prefieren los que hacen pruebas de choque a ciegas.

Qué hacer con esto

Si vas a recomendar una IA a alguien que la va a usar en el día a día para escribir, buscar o resolver dudas, el tráfico y la cuota de mercado son la señal correcta — son el equivalente a "qué usa todo el mundo", y ahora mismo eso sigue siendo mayoritariamente ChatGPT, con Gemini ganando terreno rápido por venir integrado en Android, Chrome y Workspace. Si estás decidiendo qué modelo te da mejores respuestas para tareas de razonamiento o escritura, mira Arena antes que cualquier cifra de marketing — con la reserva de que ningún panel de votos es inmune a manipulación. Y si estás construyendo un producto y el coste por token es lo que decide el margen, los leaderboards de OpenRouter dicen más que cualquier anuncio de laboratorio. Tres preguntas distintas, tres tablas distintas — el error es intentar responderlas todas con un solo ranking.

Fuentes

  1. Similarweb, "2026 Generative AI Landscape" (29 de julio de 2026), cuota mundial de tráfico web por plataforma, junio 2025 – mayo 2026. aisearch.similarweb.com
  2. Arena (antes LMArena), metodología de comparación anónima por pares y puntuación Elo; limitaciones documentadas de manipulación de votos (febrero de 2025) y el caso Meta/Llama 4 (abril de 2025). en.wikipedia.org/wiki/LMArena
  3. Arena, ranking de texto por Elo, consultado el 26 de agosto de 2026. arena.ai/leaderboard
  4. OpenRouter, datos de uso de tokens por modelo, vía Tokenmaxxing (25 de agosto de 2026). openrouter.ai/rankings