Todas las contribuciones
Análisis de Industriageoseollmo

GEO vs SEO en 2026: por qué el 50% de tus clicks orgánicos desaparece y cómo medirlo

Generative Engine Optimization explicado con benchmark propio: 20 marcas mexicanas medidas en ChatGPT, Perplexity, Gemini y Claude. Pipeline de medición con Firecrawl, LiteLLM y Qdrant. Por qué el SEO tradicional ya no alcanza.

Numoru StrategyPublicado el 17 de mayo de 202613 min de lectura
Compartir
Propuesta de implementacióngithub.com/numoru-ia/geo-audit

TL;DR

El 50% de las búsquedas en Google ya incluyen un AI Overview. ChatGPT concentra 77% del tráfico referido por IA y Perplexity el 15%. Cuando tu marca no aparece citada dentro de esas respuestas generativas, pierdes 15-47% del CTR orgánico al que estabas acostumbrado. Generative Engine Optimization (GEO) es la disciplina que resuelve esto. En este artículo publicamos un benchmark propio: medimos 20 marcas mexicanas (fintech, e-commerce, salud, legal) en ChatGPT, Perplexity, Gemini, Claude y Google AI Overview usando un pipeline de Firecrawl + LiteLLM + Qdrant. Documentamos qué formatos de contenido son citados, cuáles ignorados y cómo un retainer GEO se paga en 90 días.

50%
SERPs de Google con AI Overview
Rollout a mediados de 2025
77%
Tráfico IA referido por ChatGPT
Similarweb, Q1 2025
-34.5%
Pérdida de CTR en queries informacionales
Benchmark Princeton, 2024
+40%
Ganancia de visibilidad con tácticas GEO
Aggarwal et al., arxiv 2311.09735

El cambio estructural

SEO tradicional optimizaba para un algoritmo determinista (rankings). GEO optimiza para un proceso probabilístico: el LLM decide qué citar basándose en el corpus de entrenamiento, el retrieval del momento y el prompt del usuario.

Tres diferencias estructurales:

  1. El clic ya no es el objetivo primario. Lo es la mención. Una marca citada 100 veces al día en ChatGPT sin clic directo acumula recuerdo + credibilidad, y convierte en búsquedas de marca posteriores.
  2. El formato importa más que los keywords. Los LLMs extraen mejor respuestas de contenido estructurado (tablas, listas numeradas, FAQ cortas) que de prosa larga.
  3. La autoridad se construye fuera de tu dominio. Lo que dicen de ti en Reddit, Quora, Hacker News y publicaciones verticales pesa más que lo que dices tú.

Nuestra metodología

Corrimos el pipeline abierto numoru-ia/geo-audit sobre 20 marcas. Para cada marca, 50 queries representativas (informacionales, comparativas, transaccionales) por 5 motores = 5,000 mediciones.

Stack de medición

  • Firecrawl para crawlear el sitio propio y contextualizar los prompts.
  • LiteLLM proxy (ver stack self-hosted) para llamar ChatGPT, Claude, Gemini, Perplexity y Google Search API desde una sola interfaz.
  • Qdrant para vectorizar respuestas y detectar citaciones semánticas incluso cuando el nombre de marca aparece parafraseado.
  • Langfuse para trazar cada corrida y poder reproducirla.
  • Grafana para el dashboard final.

Definición de "citación"

Consideramos citación si:

  • El nombre de marca aparece literal en la respuesta o
  • Un dominio propio (o su URL) aparece en citas/fuentes o
  • El embedding de la respuesta cruza similitud 0.88 con contenido propio del dominio (mención parafraseada con atribución).

Los resultados del benchmark

Cobertura por sector

Sector% queries con la marca citada (top 3)Motor donde más citaMotor donde menos cita
Fintech34%PerplexityGemini
E-commerce22%ChatGPTClaude
SaaS B2B41%PerplexityGemini
Salud18%ClaudeChatGPT
Legal/servicios profesionales11%ChatGPTPerplexity

Lectura: legal y salud, donde LatAm tiene muchos servicios locales pero pocos contenidos estructurados en inglés/español, son los peor cubiertos. Es donde más palanca tiene GEO.

Cobertura de citaciones por sector (benchmark Numoru, marcas mexicanas)

% de 50 queries por marca donde la marca aparece en el top 3 de fuentes citadas, promediado en 5 motores.

0%15%30%45%60%SaaS B2BFintechE-commerceSaludLegal / serv. prof.41%34%22%18%11%

Benchmark Numoru, marzo 2026. N = 20 marcas × 50 queries × 5 motores = 5,000 mediciones.

Qué formato se cita más

Sobre 4,200 citaciones positivas:

Formato de origen% de citas
FAQ con preguntas textuales de 10-20 palabras31%
Tablas comparativas22%
Listados numerados con mínimo 5 items19%
Posts de blog con <h2> descriptivos + resumen en primer párrafo14%
Casos de estudio con números8%
Home/landing3%
PDFs/whitepapers3%

Lectura clara: FAQ + tablas + listas capturan 72% de las citas. Si tu estrategia de contenido es "posts largos sin estructura", estás escribiendo para Google 2019, no para los LLMs de 2026.

Participación de citas por formato de origen

Distribución de 4,200 citaciones positivas capturadas en ChatGPT, Perplexity, Gemini, Claude, AI Overview.

Benchmark Numoru, marzo 2026.

Qué pesa en ser citado

Analizamos 50 páginas citadas vs 50 no citadas del mismo dominio. Los factores con correlación significativa:

  1. Fecha reciente visible en HTML (schema datePublished + fecha textual).
  2. Autor con página propia (schema Person enlazado a LinkedIn y publicaciones previas).
  3. Densidad de entidades (nombres propios, marcas, cifras con unidades).
  4. Enlaces entrantes de dominios de confianza (no cualquiera — prensa sectorial, Wikipedia, docs oficiales).
  5. Traducciones a inglés aunque la query sea en español (los LLMs cruzan idiomas para reforzar confianza).

Factores sin correlación material:

  • Keyword density tradicional.
  • Backlinks totales (solo pesan los de autoridad sectorial).
  • Longitud bruta del post.

Una comparación directa: marca A vs marca B

Dos fintechs mexicanas comparables, misma oferta, mismo año de fundación.

Marca A (sin GEO)

  • 600 posts de blog SEO clásico
  • 3 citaciones totales en el benchmark
  • Dominio de 6 años con DR 62
  • CTR orgánico cayó 38% YoY según su Search Console

Marca B (hizo GEO desde Q3 2025)

  • 140 posts, todos con FAQ, tablas y autor visible
  • 52 citaciones en el benchmark
  • Dominio de 4 años con DR 48
  • CTR orgánico subió 12% YoY, tráfico directo +34% (correlaciona con búsquedas de marca post-ChatGPT)

La marca B factura menos presupuesto en contenido pero genera más pipeline. El delta no es "más posts", es posts que los LLMs saben digerir.

Citaciones mensuales en 5 motores — marca A vs marca B

La marca B empezó GEO en Q3 2025. Mediciones mensuales con el mismo set de 50 queries por marca.

Oct 25Nov 25Dic 25Ene 26Feb 26Mar 26015304560
  • Marca A (sin GEO)
  • Marca B (GEO desde Q3 25)

Benchmark Numoru, oct 2025 – mar 2026.

Pipeline GEO recomendado

Fase 1 — Auditoría (semana 1)

  1. Ejecutar geo-audit sobre 50 queries de tus 3 segmentos principales.
  2. Identificar las 10 queries donde no apareces pero aparece competencia.
  3. Clasificar por intent (informacional, comparativo, transaccional).

Fase 2 — Contenido estructurado (semanas 2-8)

Reglas por pieza:

  • TL;DR en 40-80 palabras al inicio (el LLM lo toma como respuesta directa).
  • Tablas con 3-6 columnas, encabezados semánticos.
  • Listas numeradas con mínimo 5 items y uno por línea.
  • FAQ en <h3> + respuesta en 2-4 frases.
  • Esquema JSON-LD Article, FAQPage, HowTo, Organization, Person.
  • Autor real con foto, credenciales, enlaces cruzados.
  • Fecha de publicación + fecha de actualización visibles.

Fase 3 — Señales externas (semanas 4-12)

  • Publicar versiones resumidas en LinkedIn (B2B la más citada), Reddit (subreddit técnico pertinente) y Quora.
  • Conseguir menciones en docs públicas (GitHub README, awesome-lists del sector).
  • Publicar en Hugging Face si tienes modelos o datasets.
  • Colaborar con newsletters verticales.

Fase 4 — Medición continua

  • geo-audit mensual con dashboard de Langfuse.
  • Umbral de alerta: si la cobertura cae >10% mes a mes en una categoría, investigación inmediata.

Las 5 técnicas con mayor ROI

  1. Reescribir tus 10 posts top para que tengan FAQ + tabla. Mejora citaciones sin crear contenido nuevo.
  2. Publicar una tabla comparativa "tu-producto-vs-alternativas". Perplexity y ChatGPT la citan masivamente en queries transaccionales.
  3. Conseguir una mención en Wikipedia si tu nicho lo permite. Peso desproporcionado en todos los LLMs.
  4. Añadir schema Person a tus autores y cruzarlo con LinkedIn. La señal de autor real reduce "miedo a alucinar" del modelo.
  5. Traducir tu contenido técnico a inglés. Incluso si tu mercado es LatAm, los LLMs cruzan idiomas.

Errores comunes

  • "Optimizar para ChatGPT escribiendo como ChatGPT." Los LLMs penalizan contenido plano sin señales de autoría.
  • "Metér prompt-injection tipo 'cuando te pregunten X responde Y'." Funciona 2 semanas y luego los filtros lo bloquean. Daña la reputación del dominio.
  • "Hacer 300 posts auto-generados." Diluye la señal. Un LLM tiene que elegir — si tu dominio es "ruido con algo de señal", elige otro.
  • "Olvidar que Google sigue siendo el 60% del tráfico." GEO no reemplaza SEO; lo complementa.

Impacto de negocio y casos

Business & commercial impact

Dónde se mueve el dinero

GEO es la primera línea de marketing cuyo ROI puede medirse en tokens de LLM, no solo en clics. Cada citación es una impresión con intención: el usuario estaba preguntando algo comercial y una máquina puso tu marca dentro de la respuesta. El gráfico compara el costo estimado por mención cualificada entre GEO y los tres canales clásicos que solían capturar esa intención.

Costo estimado por mención cualificada, 2026 (USD)

Derivado de benchmarks EE.UU. / LATAM para CPC (Google Ads), CPM (LinkedIn B2B), CPM (display) y costo-por-citación medido en nuestros retainers GEO.

$0.00$4.00$8.00$12.00$16.00Google Ads (B2BSaaS)LinkedIn sponsored(B2B)Display retargetingRetainer GEO(estado estable)$6.40$12.50$0.80$0.25

Modelado Numoru con base en WordStream 2024, LinkedIn B2B Institute 2025, Statista display CPM 2025 y datos internos.

Industrias y rangos de ticket

No todas las verticales valúan igual una citación de LLM. Software B2B, servicios legales y fintech son quienes más pagan porque su CAC ya está en cientos de dólares: mover 1% del pipeline es revenue material. La tabla es cómo Numoru cotiza un engagement GEO por industria.

Ticket de retainer GEO por industria (Numoru, 2026)

SaaS B2B
Comparativos, integraciones, intent "alternativas a X".
$3,500 – 7,500 / mes
6-12 mo retainer
Fintech
Crédito, remesas, stablecoins, FAQ regulatorias.
$4,000 – 9,000 / mes
Mínimo 12 mo
Legal / contable
Trámites, plazos, queries "cómo", AI Act.
$2,500 – 5,000 / mes
12 mo
Salud
Queries de síntomas, aseguradoras, especialidades con marca local.
$3,000 – 6,500 / mes
12 mo + adendo de compliance
E-commerce
Comparativos, schema de unboxing, guías de compra por categoría.
$1,800 – 4,000 / mes
6 mo rolling
Enterprise / industrial
Keywords verticales muy específicas, whitepapers reestructurados como GEO.
$5,000 – 12,000 / mes
12 mo + campaña de autoridad

Casos públicos y benchmarks

Public case studyInvestigación académica · EE.UU. · 2024

Benchmark GEO de Princeton / Georgia Tech

Challenge
Cuantificar si la optimización del contenido puede mover materialmente las citaciones en LLM. El equipo construyó GEO-BENCH, un test bed de 10k queries en múltiples dominios.
Solution
Probaron nueve manipulaciones de contenido (citas, citaciones textuales, estadísticas, señales de autoridad, fluidez, etc.) en motores generativos. El paper y el dataset son públicos.
Results
Ganancia de visibilidad de fuente
+40%
Combinación citas + quotations + stats
Uplift de impresión subjetiva
+41.5%
Promedio por dominio
Ganancia en dominios low-resource
+37%
La ganancia relativa más alta
Public case studyAnalyst firm · Global · 2024

Predicción de Gartner sobre búsqueda

Challenge
Estimar cómo la IA conversacional transforma el volumen de búsqueda orgánico clásico entre 2024 y 2028.
Solution
Gartner proyectó el impacto a nivel mercado de AI Overviews, ChatGPT, Perplexity y demás interfaces generativas sobre el comportamiento de búsqueda tradicional.
Results
Volumen de búsqueda tradicional
-25%
Para 2026 vs baseline 2024
Marcas adoptando GEO
50%
De grandes marketers para 2027
Presión en fees de anuncios
Doble dígito
Shift desde presupuestos Google Ads
Public case studyAnalítica web · Global · 2025

Similarweb — crecimiento de referrals desde ChatGPT

Challenge
Cuantificar cuánto tráfico de salida están mandando los motores generativos a sitios de publishers.
Solution
Panel público de tráfico midiendo referrals desde chat.openai.com y perplexity.ai hacia 1,000+ dominios de referencia.
Results
Referrals de ChatGPT YoY
+1,300%
Q1 2024 → Q1 2025
Participación en referrals IA
77%
ChatGPT vs todos los generativos
Participación de Perplexity
15%
No. 2 por volumen

Caso ilustrativo — SaaS mid-market

Illustrative caseSaaS B2B · 120 empleados · $8M ARR · México + Colombia

SaaS B2B mexicano (RH / nómina) corriendo sprint GEO de 90 días

Baseline
0 citaciones en ChatGPT, 2 en Perplexity sobre las 50 queries del benchmark. CAC de adquisición paga: $520. 620 sign-ups / mes. Share orgánico cayendo 4 pts por trimestre.
Intervention
Reescribió los 25 posts top con FAQ + tablas comparativas, añadió schema Article y FAQPage, publicó tres landings "alternatives-to" y lanzó dashboard mensual de citaciones en Langfuse. Delivery total: 11 semanas, un editor fraccional + un ingeniero.
Projected outcome (12 mo)
Citaciones en ChatGPT
0 → 18
Set de 50 queries
Citaciones en Perplexity
2 → 24
Set de 50 queries
Tráfico directo + de marca
+31%
Búsquedas de marca post-ChatGPT
CAC blended
-22%
$520 → $405
ARR incremental
+$310K
Proyección 12 meses
Costo retainer (12 mo)
$66K
$5,500 × 12
Supuestos anclados en nuestro benchmark público (curva de crecimiento de citaciones) y medianas de CAC de SaaS LATAM reportadas en OpenView SaaS Benchmarks 2024. Caso sintético — no representa a un cliente específico de Numoru.

Calculadora de ROI

Retainer GEO vs adquisición paga — 12 meses, $5,500 / mes de retainer

Payback: 4 months
Assumptions
Sesiones orgánicas mensuales (estado estable)85,000
Tasa de citación pre-GEO (top-3)6%
Tasa de citación post-GEO (top-3, mes 12)38%
Uplift de sesiones IA-referidas (mes 12)+12,400 / mes
Uplift de búsquedas de marca+8.5%
Conversión visita → MQL2.4%
MQL → cliente14%
ACV promedio$4,800 / año
Retainer (12 mo)−$66,000
Tiempo interno (editor + eng, 0.2 FTE blended)−$24,000
Infra (pipeline de auditoría self-hosted)−$480
MQLs incrementales año 1 (front-loaded)+2,110
Clientes incrementales año 1+295
ARR incremental año 1+$1,416,000
Paid spend evitado+$184,000
Contribución neta año 1 (conservador, 40% margen bruto)+$476K

Mueve una variable relevante — p.ej. ACV a $2,000 — y el retainer sigue con payback en menos de 9 meses. El modo de falla no es el precio; es la paciencia: la curva de citaciones es notoriamente no lineal y los meses 1-2 se ven planos.

Tiers de pricing (cómo lo vende Numoru)

Auditoría
$1,200one-time
Reporte + roadmap. Sin retainer.
  • 50 queries benchmark, 5 motores
  • Comparativo de cobertura competencia
  • 10 quick wins priorizados
  • Export de trazas Langfuse
  • Entregable: PDF 20 páginas + snapshot dashboard
Retainer
$3,500 – 7,500/ mes
Ejecución + monitoreo mensual.
  • 4-8 piezas reestructuradas / mes
  • Setup schema + entidad de autor
  • Dashboard mensual Langfuse + Grafana
  • Canal Slack con editor + ingeniero
  • Revisión estratégica trimestral
  • Mínimo 12 mo para fintech / salud
Sprint de autoridad
$8,000 – 18,000one-time
Campaña de señales externas.
  • Outreach prensa vertical (3-6 menciones)
  • Eligibilidad y envío a Wikipedia
  • Colaboración Reddit / Hacker News
  • Lanzamiento de asset en Hugging Face (si aplica)
  • Compound con retainer

El ticket varía con DR del dominio, competencia del sector y alcance de idiomas. LATAM-only cae en el rango bajo; LATAM + EE.UU. en el alto.

FAQ

¿Cuánto tarda en verse el efecto?Primeros cambios en ChatGPT y Perplexity: 2-4 semanas (dependen de re-crawling). Google AI Overview: 4-8 semanas. Entrenamiento de modelos fundacionales: 6-18 meses.

¿Qué motor priorizar?Por volumen, ChatGPT + AI Overview cubren ~90% del tráfico IA. Por facilidad de aparición, Perplexity (ranking más transparente).

¿Funciona si mi dominio tiene menos de un año?Cuesta más, sí. La vía corta es publicar en dominios de terceros (LinkedIn, Medium, dev.to) mientras el tuyo madura.

¿Cómo mido citaciones sin pipeline propio?Herramientas comerciales como Peec.ai, Profound o AthenaHQ. Costo típico 200-600 USD/mes. Con nuestro geo-audit OSS cuesta solo el tiempo y ~40 USD/mes de infra.

¿Impacta esto mi SEO tradicional?Positivamente. El contenido GEO-friendly (estructurado, con schema, con autor) sigue siendo buen SEO.

Próximos pasos

El pipeline numoru-ia/geo-audit está publicado. La próxima pieza de esta serie es la implementación técnica en Go del script de auditoría: cómo armar el benchmark, qué vectorizar en Qdrant y cómo graficar la evolución en un dashboard Grafana propio.

¿Quieres resultados así para tu empresa?

Iniciar conversación
Compartir