+17,8 pp
Baseline IA de Elevam — T4 2026 (España)
Documento de investigación GEO reproducible (v1.0) correspondiente a la oleada T4 2026 en España.
Documenta la evolución observada de presencia, citabilidad, atribución y visibilidad comparativa de Elevam en motores generativos respecto al baseline T3 2026 e incorpora una lectura longitudinal T1–T4 del ciclo 2026.
Estado observado en motores de IA (T4 2026)
Este estudio documenta el comportamiento observado de Elevam en ChatGPT, Gemini y Perplexity durante T4 2026: si la marca aparece, si el motor muestra fuentes, si cita una URL de Elevam adecuada a la intención del prompt, si la marca entra en Top 3 y qué problemas cualitativos aparecen en las respuestas.
La comparación principal se realiza frente a T3 2026 utilizando el mismo set de 15 prompts, la misma estructura de tres grupos y la misma lógica principal de codificación. El objetivo no es demostrar causalidad ni atribuir automáticamente los cambios a acciones realizadas entre oleadas, sino comprobar qué mejoras se consolidan, qué métricas permanecen estables, qué problemas persisten y qué nuevas incidencias aparecen.
T4 debe leerse como un estudio observacional dentro de una ventana temporal concreta. Las respuestas de los motores son no deterministas y sus sistemas, índices, modelos e interfaces pueden cambiar sin aviso; las conclusiones se limitan a la muestra, fechas y procedimiento documentados.
Resumen ejecutivo
T4 muestra una mejora clara en mención explícita y una mejora adicional en atribución de URL, mientras la citación se mantiene en el nivel alto alcanzado en T3 y Top 3 avanza solo un caso. La lectura central es que Elevam recupera reconocimiento textual sin perder la calidad de citación consolidada en la oleada anterior.
0,0 pp
+6,7 pp
+2,2 pp
La mención aumenta de 60,0% a 77,8% (+17,8 pp; 8 casos). La URL correcta sube de 66,7% a 73,3% (+6,7 pp; 3 casos). La citación permanece en 91,1% y Top 3 pasa de 24,4% a 26,7% (+2,2 pp; 1 caso).
La calidad cualitativa también mejora: las alucinaciones codificadas bajan de 3/45 (6,7%) en T3 a 1/45 (2,2%) en T4. Los casos de URL correcta sin mención pasan de 6 a 1, mientras las menciones sin URL propia se mantienen en 3 casos.
Por grupos, la mejora más relevante se concentra en Agencia GEO: la mención pasa de 26,7% a 60,0%, la URL correcta de 40,0% a 53,3% y Top 3 de 20,0% a 26,7%, con citación estable en 86,7%. Curso GEO mejora mención y URL correcta y mantiene Top 3 en 40,0%. El grupo Elevam alcanza 100,0% de mención y citación y mantiene 93,3% de URL correcta.
Por motores, ChatGPT mantiene exactamente las cuatro métricas principales de T3. Gemini recupera mención y URL correcta, pero no mejora su tasa de citación ni Top 3. Perplexity registra el mayor aumento de mención y mejora URL correcta y Top 3, aunque reduce de forma notable el peso relativo de URLs de Elevam dentro de sus fuentes y respuestas.
Resultados clave (T4 2026)
- 01
La mención se recupera con fuerza
SoM pasa de 60,0% a 77,8%: ocho menciones adicionales sobre 45 tests. La mejora corrige el retroceso leve de T3 y convierte la presencia documental en reconocimiento explícito con mayor frecuencia.
- 02
La citación se mantiene; la URL correcta sigue mejorando
La citación permanece en 91,1%, mientras la URL correcta sube de 66,7% a 73,3%. T4 no añade más respuestas con fuentes, pero sí mejora la asociación de esas fuentes con activos adecuados de Elevam.
- 03
Agencia GEO es el principal cambio estructural
El grupo pasa de 26,7% a 60,0% de mención y de 40,0% a 53,3% de URL correcta. La mejora alcanza también Top 3, aunque persisten ausencias en prompts genéricos de criterios, entregables y alternativas al SEO.
- 04
Curso GEO mantiene su fortaleza comparativa y amplía cobertura
Top 3 permanece en 40,0%, mientras la mención sube a 73,3% y la URL correcta a 73,3%. La mejora se extiende a prompts de estándar y evaluación en Perplexity, pero no de forma uniforme en ChatGPT y Gemini.
- 05
Las alucinaciones bajan, pero no desaparecen
T4 registra 1 alucinación frente a 3 en T3. El error se concentra en Perplexity, que expande incorrectamente HSA como “Hybrid Search Amplification” en un prompt comparativo. No reaparecen las derivas geográficas de T3.
Acciones derivadas de T3 que deberán revisarse en T4
- 01
Convertir cita silenciosa en mención explícita
El objetivo se cumple parcialmente: los casos de URL correcta sin mención bajan de 6 a 1. La única cita silenciosa codificada en T4 aparece en Gemini para criterios de elección de agencia GEO B2B.
- 02
Consolidar /geo/ y la categoría Agencia GEO B2B
Los tres umbrales cuantitativos fijados en T3 se superan: Agencia GEO alcanza 60,0% de mención, 53,3% de URL correcta y 26,7% de Top 3. Sin embargo, la cobertura no es completa y el prompt de alternativas al SEO sigue sin activar a Elevam en ningún motor.
- 03
Ampliar evidencia externa y verificable
La presencia en comparativas aumenta, pero muchas recomendaciones siguen apoyándose mayoritariamente en terceros. El avance es visible, aunque la dependencia de fuentes externas continúa siendo alta en Perplexity y en varias shortlists.
- 04
Cerrar la ambigüedad semántica de GEO
No se codifica topic drift en los prompts de Curso GEO y desaparece la deriva hacia significados policiales o geoespaciales observada en T3. Persiste, no obstante, una confusión de siglas sobre HSA en Perplexity.
- 05
Mejorar control metodológico y trazabilidad
El registro final mantiene 45 tests, métricas P/Q/R/Top3, fuentes, URLs y notas, y los resúmenes coinciden con los registros. El dataset público manual conserva la estructura histórica de la serie; las respuestas completas se mantienen como evidencia de trabajo separada.
Metodología
ChatGPT: modo web con búsqueda activada; sesión nueva y contexto aislado mediante ventana de incógnito para cada prompt.
Gemini: modo web; sesión nueva y contexto aislado mediante ventana de incógnito para cada prompt.
Perplexity: modo web con fuentes y citas activadas; sesión nueva y contexto aislado mediante ventana de incógnito para cada prompt.
El nombre o versión exacta del modelo puede variar por actualizaciones del proveedor. El estudio documenta el comportamiento observable en la interfaz y fechas indicadas, no una versión estática garantizada del sistema.
Un test = 1 prompt exacto + 1 chat nuevo + 1 motor + 1 fecha.
15 prompts únicos: 5 de marca, 5 de Agencia GEO y 5 de Curso GEO.
15 prompts × 3 motores = 45 tests.
En tablas por grupo, N=15 significa 5 prompts × 3 motores.
En tablas por motor, N=15 significa los 15 prompts ejecutados en un mismo motor.
- Mención / SoM (P)
P=1 si aparece «Elevam» como marca, agencia o entidad en el texto de la respuesta; P=0 si no aparece.
- Citación (Q)
Q=1 si el motor muestra fuentes, referencias o enlaces en la respuesta o en su panel; Q=0 si no muestra fuentes.
- URL correcta (R)
R=1 si aparece una URL válida de Elevam que responde a la intención del prompt. R=0 o no aplica según el registro cuando no existe una URL válida atribuible.
- Top 3
Top3=1 si Elevam ocupa una posición del 1 al 3 en una lista, shortlist o recomendación ordenada. Top3=0 si ocupa una posición superior, no aparece o la respuesta no contiene lista/shortlist. El denominador es siempre el total de tests del ámbito analizado.
Una respuesta puede citar una URL correcta de Elevam sin mencionar la marca, o mencionar Elevam sin mostrar una URL propia. En T4 se registra 1 caso de URL correcta sin mención y 3 casos de mención sin URL de Elevam. Por ello, SoM, citación y URL correcta no son intercambiables.
- Sentimiento
- Se registra únicamente cuando Elevam aparece. En T4 hay 34 respuestas positivas y 1 neutral sobre 35 respuestas con mención; no se codifican negativas.
- Alucinación
- Se marca cuando existe un error verificable, una afirmación factual inventada o una deriva temática sustancial. La codificación es conservadora: la ausencia de evidencia suficiente no se convierte automáticamente en alucinación.
- SoS (Share of Sources)
- Fuentes de Elevam en el panel dividido entre fuentes totales del panel. Se calcula como razón ponderada de recuentos agregados, no como media simple de porcentajes por respuesta.
- SoA (Share of Answer)
- URLs visibles de Elevam en la respuesta dividido entre URLs visibles totales. Se publica como agregado ponderado por ámbito.
23/09/2026 – 29/09/2026
ChatGPT: 23/09/2026. Gemini: 25/09/2026. Perplexity: 29/09/2026.
La misma URL exacta repetida dentro de una respuesta se registra una sola vez en las listas de URLs únicas.
Las variantes con fragmentos diferenciados —por ejemplo #:~:text=…— se conservan como entradas diferentes cuando el motor las presenta como fuentes separadas. Por tanto, el recuento mide entradas visibles y no diversidad de páginas canónicas.
En T4 se mantiene el criterio de recuento de las oleadas anteriores: una misma URL sin fragmento cuenta una sola vez, y las variantes con fragmentos de texto distintos (#:~:text=…) cuentan como entradas separadas, porque remiten a pasajes diferentes de la página. Por eso no se ha aplicado la normalización por página anunciada en T3: se ha priorizado la comparabilidad de la serie T1–T4.
La presencia de una URL en el panel de fuentes no prueba por sí sola qué pasaje utilizó el modelo ni implica respaldo editorial o recomendación del proveedor.
R=1 si el motor cita o muestra una URL de Elevam que responde de forma directa a la intención del prompt. R no exige necesariamente que la marca aparezca en el texto, por lo que puede existir URL correcta sin mención.
- Prompt 3, Protocolo HSA
- Correcta solo si aparece https://elevam.es/protocolo-hsa/ o su equivalente idiomático válido cuando la interfaz recupera otra versión del mismo activo.
- Prompt 14, curso de Elevam
- Correcta si aparece la landing canónica del curso de GEO de Elevam; el análisis debe distinguir la URL principal de páginas auxiliares, academia, vídeos o variantes idiomáticas.
La corrección de URL se valora por ajuste a la intención, no por volumen. Varias URLs de Elevam en un panel no compensan una atribución canónica incorrecta.
La comparación T3–T4 se realiza sobre las cuatro métricas principales comunes: mención, citación, URL correcta y Top 3. El conjunto de prompts, los tres grupos y los tres motores se mantienen, lo que permite una comparación directa de la muestra.
SoS y SoA también se comparan porque sus definiciones y recuentos están disponibles en ambas oleadas. Los valores se interpretan con cautela: cada motor muestra paneles y volúmenes de fuentes diferentes, y una fuente visible no demuestra influencia causal sobre una afirmación concreta.
La nomenclatura T1, T2, T3 y T4 identifica oleadas consecutivas de medición y no equivale necesariamente a trimestres naturales. Las fechas efectivas utilizadas como referencia son: T1, 22–25/01/2026; T2 corregido, 23/03/2026–01/04/2026; T3, 23–25/06/2026; y T4, 23–29/09/2026.
Limitaciones
Diseño observacional: el estudio mide el estado visible de los motores y no demuestra que una acción concreta aplicada entre T3 y T4 haya causado una variación.
Una ejecución por combinación prompt–motor: la muestra no estima la variabilidad interna de cada motor. Repeticiones adicionales permitirían medir estabilidad.
No determinismo y actualizaciones: las respuestas pueden cambiar por versión, índice, interfaz, sesión, localización, personalización o cambios del proveedor.
Comparabilidad imperfecta de paneles: ChatGPT, Gemini y Perplexity muestran volúmenes y estructuras de fuentes muy diferentes. Los recuentos absolutos no deben interpretarse como calidad o exhaustividad equivalentes.
Muestra fija y específica de Elevam: los resultados no son generalizables a todas las marcas, sectores, países o formulaciones de prompt.
Codificación manual: aunque las reglas son explícitas y el dataset ha sido revisado, la valoración de URL correcta, sentimiento, shortlist y alucinación incluye juicio humano. En T4 se aplicó una doble revisión humana de los casos críticos: alucinaciones, URL correcta y citas sin mención.
Top 3 depende de la estructura de la respuesta: se codifica 0 cuando no existe una lista/shortlist aplicable. La métrica combina capacidad de activación de la marca y formato de respuesta.
SoS y SoA son indicadores de presencia visible, no de influencia causal. Una fuente puede estar listada sin que pueda atribuirse con certeza una afirmación concreta a esa URL.
Las variantes de una misma página con fragmentos diferenciados pueden contabilizarse como entradas distintas. Por ello, SoS no equivale a diversidad de dominios o páginas canónicas.
No se aplican pruebas de significación inferencial: con 45 tests fijos, las variaciones se presentan en casos y puntos porcentuales, sin convertir diferencias pequeñas en conclusiones estructurales.
La continuidad de la serie más allá de T4 no está confirmada. Las recomendaciones posteriores no implican que vaya a realizarse una T5.
Una mejora global no se interpreta como consolidación completa. T4 se considera más sólido cuando una mayor mención se acompaña de atribución canónica, menor error cualitativo y presencia en prompts genéricos, no solo en consultas que nombran explícitamente a Elevam.
Dataset de prompts (v1.0)
Dataset: 15 prompts exactos distribuidos en tres categorías. Los prompts se mantienen respecto a T3 para preservar la comparabilidad de la serie.
Categoría A. Marca (Elevam)
- 1.«¿Qué es Elevam (agencia) y en qué está especializada?»
- 2.«¿Qué es Elevam Labs y qué hace?»
- 3.«¿Qué es el Protocolo HSA de Elevam y cómo se valida?»
- 4.«¿Qué servicios ofrece Elevam relacionados con SEO, GEO y motores de IA?»
- 5.«¿Qué agencias en España están destacando en GEO (Generative Engine Optimization) para B2B y por qué?»
Categoría B. Servicio core: Agencia GEO
- 6.«Mejores agencias de GEO en España para empresas B2B (lista y por qué).»
- 7.«¿Qué criterios usarías para elegir una agencia GEO para B2B?»
- 8.«¿Qué hace una agencia GEO y qué entregables debería incluir?»
- 9.«Agencias de marketing digital B2B en España recomendadas por IA (con criterios).»
- 10.«Alternativas a una agencia SEO tradicional para ganar visibilidad en buscadores y motores de IA.»
Categoría C. Producto: Curso de GEO
- 11.«¿Qué curso de GEO (Generative Engine Optimization) en español recomiendan para marketing B2B?»
- 12.«Mejores cursos de GEO en español (lista y criterios).»
- 13.«¿Qué debe incluir un curso de GEO para ser útil en 2026? (método, medición y entregables).»
- 14.«¿Qué incluye el curso de GEO de Elevam y a quién va dirigido? Responde con un resumen y, si citas fuentes, incluye enlaces.»
- 15.«¿Cómo evaluar si un curso de GEO es serio? (señales y red flags)»
Resultados
Los resultados se presentan con numeradores y denominadores además de porcentajes. Esta práctica permite comprobar la magnitud real de cada cambio y evita sobrerrepresentar variaciones que corresponden a uno o dos casos.
Resultados globales T3 vs T4
| Métrica | T3 | T4 | Cambio en casos | Variación |
|---|---|---|---|---|
| SoM (mención) | 27/45 · 60,0% | 35/45 · 77,8% | +8 | +17,8 pp |
| Citación | 41/45 · 91,1% | 41/45 · 91,1% | +0 | 0,0 pp |
| URL correcta | 30/45 · 66,7% | 33/45 · 73,3% | +3 | +6,7 pp |
| Top 3 comparativos | 11/45 · 24,4% | 12/45 · 26,7% | +1 | +2,2 pp |
Lectura
T4 recupera mención con claridad, mantiene la citación en el máximo observado de la serie desde T3 y mejora la URL correcta. Top 3 avanza un solo caso y debe describirse como una mejora moderada. La mejora de mención no elimina las diferencias entre motores ni la dependencia de fuentes externas en consultas comparativas.
Resultados por categoría
| Grupo | SoM | Citación | URL | Top3 | ||||||||
|---|---|---|---|---|---|---|---|---|---|---|---|---|
| T3 | T4 | Δ pp | T3 | T4 | Δ pp | T3 | T4 | Δ pp | T3 | T4 | Δ pp | |
| Elevam | 14/15 · 93,3% | 15/15 · 100,0% | +6,7 pp | 15/15 · 100,0% | 15/15 · 100,0% | 0,0 pp | 14/15 · 93,3% | 14/15 · 93,3% | 0,0 pp | 2/15 · 13,3% | 2/15 · 13,3% | 0,0 pp |
| Agencia GEO | 4/15 · 26,7% | 9/15 · 60,0% | +33,3 pp | 13/15 · 86,7% | 13/15 · 86,7% | 0,0 pp | 6/15 · 40,0% | 8/15 · 53,3% | +13,3 pp | 3/15 · 20,0% | 4/15 · 26,7% | +6,7 pp |
| Curso GEO | 9/15 · 60,0% | 11/15 · 73,3% | +13,3 pp | 13/15 · 86,7% | 13/15 · 86,7% | 0,0 pp | 10/15 · 66,7% | 11/15 · 73,3% | +6,7 pp | 6/15 · 40,0% | 6/15 · 40,0% | 0,0 pp |
Elevam: alcanza 100,0% de mención y mantiene 100,0% de citación. La URL correcta permanece en 93,3% y Top 3 en 13,3%. El bloque de marca se mantiene cerca de su techo operativo; el único prompt comparativo del grupo concentra la principal exposición a variaciones de shortlist.
Agencia GEO: registra la mejora estructural más clara de T4. SoM pasa de 26,7% a 60,0%, URL correcta de 40,0% a 53,3% y Top 3 de 20,0% a 26,7%, con citación estable en 86,7%. La categoría deja de depender tanto de citas silenciosas, pero aún pierde cobertura en criterios, entregables y alternativas al SEO.
Curso GEO: SoM sube de 60,0% a 73,3% y URL correcta de 66,7% a 73,3%. Citación se mantiene en 86,7% y Top 3 en 40,0%. El avance se extiende a prompts de método y evaluación en Perplexity, mientras ChatGPT y Gemini siguen omitiendo la marca en algunos prompts genéricos.
Resultados por motor
| Motor | SoM | Citación | URL | Top3 | ||||||||
|---|---|---|---|---|---|---|---|---|---|---|---|---|
| T3 | T4 | Δ pp | T3 | T4 | Δ pp | T3 | T4 | Δ pp | T3 | T4 | Δ pp | |
| ChatGPT | 10/15 · 66,7% | 10/15 · 66,7% | 0,0 pp | 15/15 · 100,0% | 15/15 · 100,0% | 0,0 pp | 10/15 · 66,7% | 10/15 · 66,7% | 0,0 pp | 4/15 · 26,7% | 4/15 · 26,7% | 0,0 pp |
| Gemini | 8/15 · 53,3% | 11/15 · 73,3% | +20,0 pp | 11/15 · 73,3% | 11/15 · 73,3% | 0,0 pp | 9/15 · 60,0% | 11/15 · 73,3% | +13,3 pp | 3/15 · 20,0% | 3/15 · 20,0% | 0,0 pp |
| Perplexity | 9/15 · 60,0% | 14/15 · 93,3% | +33,3 pp | 15/15 · 100,0% | 15/15 · 100,0% | 0,0 pp | 11/15 · 73,3% | 12/15 · 80,0% | +6,7 pp | 4/15 · 26,7% | 5/15 · 33,3% | +6,7 pp |
ChatGPT: mantiene exactamente los mismos resultados principales de T3: 66,7% de mención, 100,0% de citación, 66,7% de URL correcta y 26,7% de Top 3. La estabilidad no implica ausencia de cambios cualitativos: aumenta el volumen de fuentes y la presencia absoluta de fuentes de Elevam.
Gemini: la mención sube de 53,3% a 73,3% y la URL correcta de 60,0% a 73,3%, mientras citación (73,3%) y Top 3 (20,0%) no cambian. Cuatro respuestas no muestran fuentes. En las respuestas con panel, la presencia de fuentes de Elevam es muy alta.
Perplexity: SoM sube de 60,0% a 93,3%, URL correcta de 73,3% a 80,0% y Top 3 de 26,7% a 33,3%, con citación en 100,0%. Sin embargo, su cuota de fuentes y URLs propias de Elevam desciende, y concentra la única alucinación codificada de T4.
Cómo se calcula el total
El total se calcula agregando los 45 tests. En tablas por motor y por grupo, cada porcentaje se calcula sobre N=15. Una variación de un caso equivale a 2,2 puntos porcentuales en el total y a 6,7 puntos porcentuales en una tabla de N=15.
KPIs complementarias de fuentes y respuesta
Estas métricas amplían la lectura principal, pero no sustituyen mención, citación, URL correcta ni Top 3. Deben interpretarse teniendo en cuenta que cada motor presenta paneles de fuentes con tamaños y comportamientos distintos.
SoS (Share of Sources) por motor
| Motor | T3 fuentes totales | T3 Elevam | SoS T3 | T4 fuentes totales | T4 Elevam | SoS T4 | Δ pp |
|---|---|---|---|---|---|---|---|
| ChatGPT | 829 | 87 | 10,5% | 1.096 | 149 | 13,6% | +3,1 pp |
| Gemini | 53 | 19 | 35,8% | 107 | 72 | 67,3% | +31,4 pp |
| Perplexity | 167 | 49 | 29,3% | 220 | 40 | 18,2% | −11,2 pp |
| Total | 1.049 | 155 | 14,8% | 1.423 | 261 | 18,3% | +3,6 pp |
El universo de fuentes aumenta de 1.049 a 1.423 (+374), mientras las fuentes de Elevam pasan de 155 a 261 (+106). El SoS global sube de 14,8% a 18,3%. La mejora no es uniforme: ChatGPT aumenta moderadamente su SoS y Gemini lo hace con fuerza; Perplexity reduce su cuota relativa y también el número absoluto de fuentes de Elevam.
SoS por grupo
| Grupo | T3 fuentes totales | T3 Elevam | SoS T3 | T4 fuentes totales | T4 Elevam | SoS T4 | Δ pp |
|---|---|---|---|---|---|---|---|
| Elevam | 231 | 84 | 36,4% | 386 | 162 | 42,0% | +5,6 pp |
| Agencia GEO | 535 | 36 | 6,7% | 568 | 36 | 6,3% | −0,4 pp |
| Curso GEO | 283 | 35 | 12,4% | 469 | 63 | 13,4% | +1,1 pp |
| Total | 1.049 | 155 | 14,8% | 1.423 | 261 | 18,3% | +3,6 pp |
Elevam mejora su SoS de 36,4% a 42,0% y Curso GEO de 12,4% a 13,4%. Agencia GEO mantiene 36 fuentes de Elevam, pero el panel total crece de 535 a 568, por lo que su SoS baja ligeramente de 6,7% a 6,3%. Esto es compatible con el fuerte aumento de mención: la presencia de marca y la cuota de fuentes miden fenómenos distintos.
SoA (Share of Answer) T3 vs T4
| Ámbito | T3 URLs total/Elevam | SoA T3 | T4 URLs total/Elevam | SoA T4 | Δ pp |
|---|---|---|---|---|---|
| Global | 175 / 71 | 40,6% | 288 / 127 | 44,1% | +3,5 pp |
| Elevam | 74 / 51 | 68,9% | 109 / 82 | 75,2% | +6,3 pp |
| Agencia GEO | 51 / 6 | 11,8% | 88 / 16 | 18,2% | +6,4 pp |
| Curso GEO | 50 / 14 | 28,0% | 91 / 29 | 31,9% | +3,9 pp |
| ChatGPT | 65 / 20 | 30,8% | 86 / 26 | 30,2% | −0,5 pp |
| Gemini | 56 / 20 | 35,7% | 107 / 72 | 67,3% | +31,6 pp |
| Perplexity | 54 / 31 | 57,4% | 95 / 29 | 30,5% | −26,9 pp |
El SoA global pasa de 40,6% a 44,1%. La mejora se concentra en Elevam, Agencia GEO y, sobre todo, Gemini. Perplexity reduce su SoA de 57,4% a 30,5% pese a aumentar con fuerza la mención: el motor nombra a Elevam más veces, pero sus respuestas visibles dependen proporcionalmente menos de URLs propias de Elevam.
Sentimiento y alucinaciones
| Indicador | Resultado T4 | Denominador | Lectura |
|---|---|---|---|
| Sentimiento positivo | 34 casos · 97,1% | 35 respuestas con mención | 1 respuesta neutral; no se codifican negativas. |
| Alucinación | 1 caso · 2,2% | 45 tests | Perplexity expande HSA de forma incorrecta como “Hybrid Search Amplification” en P5. |
| URL correcta sin mención | 1 caso · 2,2% | 45 tests | La fuente participa, pero la entidad no recibe atribución textual explícita. |
| Mención sin URL de Elevam | 3 casos · 6,7% | 45 tests | La marca aparece, pero la respuesta no muestra una URL propia. |
Frente a T3, el sentimiento positivo pasa de 88,9% a 97,1% entre las respuestas que mencionan Elevam. El denominador cambia de 27 a 35 respuestas con mención, por lo que la comparación debe leerse como distribución dentro de cada oleada, no como una tasa sobre los 45 tests.
Conclusiones
Resultados clave (T4)
- 01
T4 recupera reconocimiento explícito sin perder citación
La mención alcanza 77,8%, el valor más alto de la serie, mientras la citación se mantiene en 91,1%. La mejora principal de T4 está en convertir presencia documental en reconocimiento textual.
- 02
Agencia GEO deja de ser un bloque de baja activación, pero sigue incompleto
La mención pasa a 60,0% y la URL correcta a 53,3%. Se superan los mínimos definidos en T3, aunque todavía hay seis tests del grupo sin mención y el prompt de alternativas al SEO no activa Elevam en ningún motor.
- 03
Curso GEO mantiene la posición comparativa y mejora cobertura
Top 3 se mantiene en 40,0% y la mención sube a 73,3%. Elevam aparece espontáneamente en criterios de curso en Perplexity, pero ChatGPT y Gemini todavía responden de forma genérica en algunos prompts de estándar y evaluación.
- 04
Los motores convergen en mención, pero divergen en fuentes
ChatGPT permanece estable, Gemini aumenta mención y dependencia de fuentes propias, y Perplexity aumenta mención con menor SoS y SoA. Una misma mejora de visibilidad puede apoyarse en patrones de fuentes muy distintos.
- 05
La fiabilidad mejora, pero la consistencia semántica sigue siendo necesaria
Las alucinaciones bajan de tres a una y desaparecen las derivas geográficas de T3. La expansión incorrecta de HSA en Perplexity demuestra que la desambiguación de siglas y metodología debe seguir reforzándose.
Hallazgos críticos: atribución, categoría y fiabilidad
Los hallazgos siguientes se limitan a la muestra T4. Cada uno distingue evidencia, implicación y cautela para evitar convertir casos concretos en conclusiones generales.
Agencia GEO convierte cita en mención con mucha más frecuencia
- Evidencia
- El grupo pasa de 4 a 9 menciones sobre 15 tests, mientras la URL correcta sube de 6 a 8 casos. Las citas correctas sin mención se reducen a un único caso.
- Implicación
- /geo/ y la categoría Agencia GEO B2B están más asociadas a la entidad Elevam que en T3. La mejora ya no se limita a participar como fuente.
- Cautela
- El grupo mantiene seis ausencias de marca y solo 4/15 casos Top 3. La consolidación no es completa.
El prompt de marketing B2B mejora, pero la alternativa al SEO sigue sin activar Elevam
- Evidencia
- En los prompts 9 y 10 combinados, Elevam obtiene 3 menciones sobre 6 tests; las tres se concentran en P9, una por motor. P10 no menciona Elevam en ninguno de los tres motores. Solo uno de esos seis tests muestra una URL de Elevam.
- Implicación
- La marca ha ganado asociación con agencias B2B recomendadas por IA, pero todavía no está consolidada como alternativa explícita a una agencia SEO tradicional.
- Cautela
- Una mención en una tabla o shortlist no garantiza atribución canónica ni estabilidad futura.
Curso GEO extiende la asociación metodológica, pero de forma desigual
- Evidencia
- El grupo mejora a 11/15 menciones y 11/15 URLs correctas. Perplexity menciona Elevam en los prompts 13 y 15, que en T3 no activaban la marca; ChatGPT y Gemini siguen sin hacerlo en esos mismos prompts.
- Implicación
- La autoridad del curso empieza a trascender las consultas de recomendación y de marca hacia criterios de método y evaluación.
- Cautela
- La mejora depende del motor. No debe interpretarse como dominio general de la categoría.
Elevam Labs y HSA están bien reconocidos, pero persiste ruido semántico
- Evidencia
- Los tres motores identifican Elevam Labs y el Protocolo HSA sin alucinación codificada en sus prompts específicos; P3 mantiene 3/3 URLs correctas. Perplexity, sin embargo, mezcla resultados de ElevenLabs en el panel de P2 y expande erróneamente HSA en P5.
- Implicación
- Las páginas canónicas funcionan como referencias de entidad, pero las señales externas todavía pueden introducir asociaciones incorrectas.
- Cautela
- El panel de fuentes no equivale a la respuesta textual. La aparición de ElevenLabs se registra como ruido de recuperación, no como confusión factual codificada.
Perplexity muestra más reconocimiento con menos peso de fuentes propias
- Evidencia
- SoM de Perplexity sube de 60,0% a 93,3%, mientras su SoS baja de 29,3% a 18,2% y su SoA de 57,4% a 30,5%. Las fuentes de Elevam del panel bajan de 49 a 40.
- Implicación
- La marca puede ser reconocida y recomendada a partir de un ecosistema de fuentes mayoritariamente externo. Esto refuerza la importancia de la evidencia de terceros.
- Cautela
- No puede atribuirse causalidad entre fuentes externas y mención. El estudio solo documenta la coexistencia de ambos fenómenos.
Gemini concentra la mayor cuota de fuentes propias cuando cita
- Evidencia
- SoS y SoA de Gemini alcanzan 67,3%, frente a 35,8% y 35,7% en T3. Al mismo tiempo, cuatro respuestas no muestran fuentes y la citación global del motor permanece en 73,3%.
- Implicación
- Cuando Gemini activa el ecosistema de Elevam, lo hace con alta concentración de URLs propias.
- Cautela
- El valor agregado no debe interpretarse como cobertura uniforme; las cuatro respuestas sin fuentes siguen siendo una limitación relevante.
La mejora de fiabilidad es sustancial, no absoluta
- Evidencia
- Las alucinaciones bajan de 3/45 a 1/45. No se repiten las localizaciones no solicitadas ni la deriva geoespacial/policial de T3.
- Implicación
- Se reduce el riesgo cualitativo observado en la oleada anterior.
- Cautela
- Un único caso de expansión incorrecta de HSA demuestra que los claims y siglas propios deben seguir acompañados de definiciones canónicas y referencias externas consistentes.
Cierre longitudinal T1 → T4
T4 permite realizar una lectura del ciclo completo de 2026. La comparación longitudinal se limita a las cuatro métricas principales que permanecen comunes a las cuatro oleadas y utiliza T2 corregido para Top 3.
| Métrica | T1 | T2 corregido | T3 | T4 | Cambio T1→T4 |
|---|---|---|---|---|---|
| SoM (mención) | 48,9% | 62,2% | 60,0% | 77,8% | +28,9 pp |
| Citación | 55,6% | 71,1% | 91,1% | 91,1% | +35,6 pp |
| URL correcta | 37,8% | 51,1% | 66,7% | 73,3% | +35,6 pp |
| Top 3 | 15,6% | 20,0% | 24,4% | 26,7% | +11,1 pp |
En el conjunto de la serie, SoM aumenta 28,9 pp, citación 35,6 pp, URL correcta 35,6 pp y Top 3 11,1 pp. El mayor cambio estructural se produce en la capacidad de los motores para mostrar fuentes y atribuir activos adecuados de Elevam; la mejora de shortlist existe, pero es más moderada.
La trayectoria no es lineal. T2 registra la primera mejora amplia; T3 refuerza citación y URL correcta pero pierde una mención; T4 recupera con fuerza la mención, mantiene la citación y vuelve a mejorar la URL correcta. Por tanto, el cierre anual no debe resumirse como una subida continua de todas las métricas, sino como una secuencia de avances y estabilizaciones diferentes.
Cambio entre inicio y cierre por grupo
| Grupo | SoM T1→T4 | Citación T1→T4 | URL correcta T1→T4 | Top 3 T1→T4 |
|---|---|---|---|---|
| Elevam | 80,0% → 100,0% | 86,7% → 100,0% | 66,7% → 93,3% | 6,7% → 13,3% |
| Agencia GEO | 13,3% → 60,0% | 26,7% → 86,7% | 6,7% → 53,3% | 6,7% → 26,7% |
| Curso GEO | 53,3% → 73,3% | 53,3% → 86,7% | 40,0% → 73,3% | 33,3% → 40,0% |
Agencia GEO es el bloque con mayor transformación desde T1: mención 13,3% → 60,0%, citación 26,7% → 86,7%, URL correcta 6,7% → 53,3% y Top 3 6,7% → 26,7%. El salto es relevante, aunque el grupo sigue siendo el que presenta más margen de cobertura en prompts genéricos.
Elevam consolida el reconocimiento de marca y de activos propios; Curso GEO mejora en las tres métricas de presencia y atribución y mantiene una posición comparativa más estable.
Lectura del ciclo anual
- 01
La presencia de marca termina el ciclo en su máximo observado
SoM pasa de 48,9% en T1 a 77,8% en T4. La mejora final no proviene solo de prompts de marca: Agencia GEO y Curso GEO también aumentan su activación espontánea.
- 02
La citación se convierte en una capacidad estable
Citación sube de 55,6% a 91,1% y permanece en ese nivel entre T3 y T4. El reto deja de ser simplemente “tener fuentes” y pasa a ser qué fuentes, qué URL y qué atribución acompañan a la respuesta.
- 03
La URL correcta casi duplica su cobertura relativa
Pasa de 37,8% a 73,3%. La evolución indica una asociación mucho más frecuente entre la intención del prompt y activos adecuados de Elevam, aunque aún existen menciones sin URL en consultas comparativas.
- 04
Top 3 mejora, pero sigue siendo la dimensión más limitada
La métrica pasa de 15,6% a 26,7%. El avance es real pero menor que el de mención, citación y URL correcta. La serie no demuestra una posición competitiva dominante ni estable en todas las comparativas.
- 05
El aprendizaje principal es separar visibilidad, fuente y atribución
A lo largo del año se observan citas sin mención, menciones sin URL, recomendaciones apoyadas en terceros y diferencias fuertes de SoS/SoA por motor. Una única métrica no describe por sí sola la visibilidad GEO.
Conclusión operativa
T4 cierra el ciclo 2026 con una situación claramente más sólida que T1 en las cuatro métricas comparables.
La mención pasa de 48,9% a 77,8%; la citación, de 55,6% a 91,1%; la URL correcta, de 37,8% a 73,3%; y Top 3, de 15,6% a 26,7%. La trayectoria no es lineal y no todas las dimensiones avanzan al mismo ritmo, pero el punto de cierre muestra una mejora visible tanto en reconocimiento de marca como en citación y atribución canónica.
A lo largo del año, la serie fue acompañada por trabajo sobre claridad de entidad, páginas canónicas, contenidos de servicio y formación, desambiguación de conceptos propios, estructura de información, citabilidad y presencia externa. El diseño observacional del baseline no permite atribuir una subida concreta a una acción determinada ni afirmar causalidad. Sí permite constatar que el ecosistema público de Elevam en T4 es más amplio y estructurado que en T1 y que, dentro de la misma muestra de prompts, los motores muestran una presencia final mayor y una atribución más precisa.
Uno de los aprendizajes más relevantes del ciclo es que una marca puede estar bien documentada en su propio dominio y, aun así, quedar fuera de consultas genéricas de recomendación. En T4, el bloque Elevam alcanza 15/15 menciones y 15/15 respuestas con citación, con 14/15 URLs correctas; sin embargo, en prompts abiertos de Agencia GEO todavía aparecen respuestas construidas principalmente con fuentes externas. El caso más claro es P10, «Alternativas a una agencia SEO tradicional…»: ninguno de los tres motores menciona Elevam. En P7 y P8, ChatGPT ofrece respuestas metodológicas completas apoyadas en fuentes de terceros u oficiales sin activar la marca. Esta diferencia muestra que disponer de activos propios sólidos es necesario, pero no garantiza por sí solo presencia espontánea en un contexto competitivo o genérico.
Los paneles de fuentes observados durante el año refuerzan esa lectura. Medios, rankings, estudios sectoriales, páginas de terceros y documentación externa aparecen con frecuencia en las respuestas comparativas. En algunos casos esas fuentes ayudan a introducir o contextualizar a Elevam; en otros, ocupan el espacio de recuperación sin que la marca aparezca. La evidencia del baseline no permite medir cuánto pesa la antigüedad de una marca, su histórico de enlaces o su autoridad fuera del dominio, pero el patrón es compatible con que la visibilidad generativa dependa también del ecosistema externo que valida, describe y relaciona a una entidad con una categoría.
También se observa el fenómeno contrario: cuando el prompt nombra explícitamente a Elevam o solicita uno de sus activos, la respuesta es mucho más consistente. Protocolo HSA, Elevam Labs y el Curso GEO muestran niveles altos de mención, citación y URL correcta. Durante las revisiones exploratorias del proyecto, fuera de la muestra fija y sin incorporarlas a las métricas, proporcionar al motor referencias directas de Elevam o pedirle que revisara activos concretos podía enriquecer o modificar su respuesta. Este comportamiento no debe contabilizarse como mejora del baseline, pero sí ayuda a distinguir entre dos problemas distintos: que la información exista y sea comprensible, y que el motor la recupere espontáneamente cuando el usuario no menciona la marca.
Por ello, la principal conclusión operativa del año no es simplemente «publicar más contenido». La serie apunta a una combinación de trabajo sobre entidad, activos canónicos, claridad semántica, evidencia verificable y referencias externas. La mejora de Elevam entre T1 y T4 es compatible con ese proceso acumulativo, pero la medición no permite aislar qué parte corresponde a cada intervención ni separar completamente esos cambios de las actualizaciones propias de los motores.
El resultado tampoco significa que la visibilidad esté resuelta. Agencia GEO sigue teniendo margen en consultas genéricas, Curso GEO no activa Elevam de forma homogénea en preguntas de estándar y evaluación, Top 3 continúa siendo la métrica más limitada y T4 conserva una alucinación vinculada a un concepto propio. La mejora de citación y URL correcta debe mantenerse junto con una mayor presencia espontánea, no sustituirla.
Si T4 funciona como cierre de la serie manual T1–T4, el valor del proyecto queda en haber documentado un punto de partida, cuatro mediciones comparables, los problemas detectados, las acciones aplicadas y un estado final verificable. No es necesario prolongar la misma serie por inercia para que el trabajo conserve utilidad. T4 puede quedar como baseline de cierre de 2026 y servir de referencia para auditorías futuras o para nuevas líneas de investigación más específicas sobre búsqueda generativa, autoridad, fuentes externas, AI Overviews, AI Mode, benchmarks sectoriales y evidencia de clientes.
Acciones derivadas del baseline (T4 2026)
Las acciones se vinculan exclusivamente con evidencias observadas en T4. Dado que la continuidad de la serie no está confirmada, se plantean como recomendaciones de mantenimiento y como objetivos verificables únicamente si se decide realizar una nueva oleada.
1. /geo/ y Agencia GEO B2B
Consolidar /geo/ como referencia canónica de intención comercial, comparativa, de criterios y de entregables.
Crear o reforzar bloques extractables sobre cómo elegir una agencia GEO B2B, entregables, baseline, fuentes, autoridad, roadmap y re-medición.
Trabajar específicamente el prompt de alternativas a una agencia SEO tradicional: en T4 obtiene 0/3 menciones de Elevam.
Aumentar menciones externas que enlacen a /geo/ y describan de forma explícita la relación entre GEO, B2B, pipeline, CRM y medición cuando exista evidencia verificable.
2. Categoría amplia de marketing B2B y alternativas al SEO
Reforzar contenidos que comparen de forma neutral agencia SEO tradicional, GEO/AEO, consultoría, equipo interno, Digital PR y modelos híbridos.
Documentar casos y evidencia B2B sobre demanda, pipeline, CRM, automatización y revenue solo cuando existan datos verificables.
Conseguir que las recomendaciones B2B que ya mencionan Elevam incluyan una URL canónica propia; en P9 hay tres menciones pero solo un test muestra URL de Elevam.
3. /curso-de-geo/ y autoridad de categoría
Mantener /curso-de-geo/ como referencia principal y sincronizar datos con Academy y versiones idiomáticas.
Publicar o consolidar una guía neutral y citable sobre qué debe incluir un curso GEO y cómo evaluar su seriedad, con checklist, método, medición, entregables y red flags.
Aumentar reseñas, casos de alumnos y referencias independientes que validen el curso más allá de la información declarada por Elevam.
Extender a ChatGPT y Gemini la asociación que Perplexity ya muestra en P13 y P15.
4. Elevam Labs, HSA y consistencia de entidad
Mantener la desambiguación explícita de Elevam Labs frente a ElevenLabs y reforzar referencias externas directas a /elevam-labs/.
Consolidar /protocolo-hsa/ como definición canónica de Human–Search–AI y revisar menciones externas que puedan expandir incorrectamente la sigla.
Vincular HSA con ejemplos reproducibles, baselines y límites de interpretación para reducir reinterpretaciones del motor.
Revisar consistencia de naming y datos corporativos: en T4 aparece un error tipográfico puntual «levam Labs» en una respuesta de ChatGPT.
5. Evidencia externa y atribución canónica
Priorizar referencias externas que no solo mencionen Elevam, sino que enlacen a la URL adecuada por intención.
Revisar comparativas, rankings y estudios de terceros para evitar claims, siglas o descripciones inexactas.
Separar en la comunicación pública datos propios, resultados observados, validaciones de terceros y descripciones editoriales.
En Perplexity, reforzar especialmente la conexión entre mención y URL propia: el motor aumenta SoM, pero reduce SoS y SoA.
6. Archivo metodológico y cierre de la serie
Conservar los datasets T1–T4, documentos públicos, respuestas de trabajo y evidencias por test como archivo reproducible del proyecto.
Documentar de forma explícita la corrección T2 de Top 3 para evitar que reaparezcan cifras antiguas en comparativas futuras.
Mantener una tabla maestra de evolución T1–T4 con numeradores, denominadores y definiciones estables.
Si no se realiza T5, utilizar T4 como baseline de cierre para futuras auditorías puntuales sin presentar la serie como una medición continua indefinida.
Mejoras y aspectos que deberán revisarse en T5
T5 no está confirmado. Esta sección no propone continuar la serie por obligación: deja un conjunto sencillo de comprobaciones que permitirían saber, si se repite la misma muestra, si los avances de T4 se mantienen, mejoran o retroceden.
| Qué comprobar | Situación en T4 | Qué validar si se realiza T5 | Por qué importa |
|---|---|---|---|
| Mención global | 35/45 · 77,8% | Mantener al menos 35/45 menciones. | Confirmaría que la recuperación de marca de T4 no fue puntual. |
| Citación global | 41/45 · 91,1% | Mantener al menos 41/45 respuestas con fuentes. | Permite comprobar que la mejora de mención no se consigue perdiendo soporte documental. |
| URL correcta | 33/45 · 73,3% | Mantener 33/45 o mejorar el número de atribuciones correctas. | Mide si la marca sigue asociándose al activo adecuado para cada intención. |
| Top 3 | 12/45 · 26,7% | Mantener 12/45 y comprobar si se gana al menos un caso adicional. | Es la dimensión competitiva que menos ha avanzado durante el año. |
| Alucinaciones | 1/45 · 2,2% | Reducir a 0/45 sin relajar el criterio de revisión. | Comprueba la fiabilidad de conceptos propios, siglas y atribuciones. |
| Agencia GEO | 9/15 menciones; 8/15 URL correcta; P10 = 0/3 menciones | Mantener los niveles del grupo y conseguir al menos 1 mención en P10. | P10 sigue representando la principal ausencia en una intención genérica relevante. |
| Curso GEO · P13/P15 | 2/6 menciones de Elevam | Alcanzar al menos 3/6 menciones. | Extendería la asociación del curso desde las recomendaciones hacia prompts de estándar y evaluación. |
Cómo leer estos criterios
Los valores de la tabla no son objetivos comerciales ni una predicción. Son puntos de control: si se realizara T5 con los mismos prompts y reglas, permitirían distinguir de forma sencilla entre una mejora que se consolida, una métrica que se estabiliza y un retroceso. Si no hay T5, la tabla sigue siendo útil como referencia para una auditoría puntual futura.
Si T4 cierra la serie
Si se decide finalizar aquí la serie manual, T4 puede considerarse el punto de cierre del ciclo 2026. Deberán conservarse los datasets T1–T4, las definiciones de las métricas, la corrección metodológica de Top 3 de T2, las fuentes y URLs registradas y la trazabilidad de los cambios. Esto permite utilizar la serie como referencia histórica sin presentarla como una medición periódica indefinida.
Líneas de investigación posteriores
La experiencia acumulada durante T1–T4 permite plantear estudios más específicos, con preguntas distintas a las de este baseline:
AI Overviews y AI Mode: medir cuándo aparece una marca, qué fuentes utiliza Google y cómo cambia la atribución entre resultados orgánicos, AI Overviews y Modo AI.
Autoridad histórica frente a especialización: comparar entidades con mucha autoridad acumulada frente a especialistas más recientes para observar qué pesa más en consultas genéricas y de nicho.
Fuentes externas y recuperación de marca: estudiar qué tipos de medios, rankings, directorios, estudios o enlaces de terceros coinciden con una mayor probabilidad de mención y citación.
Testimonios, casos y evidencia de clientes: analizar si publicar casos verificables, reseñas y testimonios modifica la presencia de la marca en prompts de recomendación, confianza o selección.
Benchmarks sectoriales: aplicar una metodología comparable a varias empresas de un mismo sector para separar mejor el efecto de la marca, la categoría, la autoridad y la especialización.
Estabilidad de respuestas: repetir una misma muestra varias veces por motor para medir variabilidad y distinguir cambios estructurales de fluctuaciones propias de sistemas no deterministas.
Referencia del estudio
Elevam (2026). Baseline IA de Elevam — T4 2026 (España) (v1.0). Investigación GEO, Elevam Labs.
Baseline comparativo principal: Baseline IA de Elevam — T3 2026 (España).
Serie longitudinal: T1 2026 → T2 2026 corregido v1.1 → T3 2026 → T4 2026.
Nota T2: Para Top 3 se utiliza exclusivamente el valor corregido de 20,0%; no se utiliza la cifra antigua previa a la corrección metodológica.
El Excel público contiene el registro de los 45 tests y los agregados por grupo y por motor utilizados en este documento.
Licencia del dataset: Creative Commons Atribución 4.0 Internacional (CC BY 4.0). Se permite compartir y adaptar los datos, incluso con fines comerciales, citando a Elevam y enlazando el estudio original. Ver los términos de la licencia