Salta al contingut
Investigació GEO · Baseline T3 2026

De la mesura manual a Antropus

Tres formes de mesurar el mateix baseline: manual (Protocol HSA), importada i nativa.

15 prompts × 3 motors (ChatGPT · Gemini · Perplexity) = 45 tests · Espanya · mode web

Publicat24/07/2026
01 · Context i objectiu

De baselines manuals a un sistema automàtic

Durant aproximadament nou mesos s'ha mesurat la visibilitat de la marca Elevam als motors d'IA generativa mitjançant baselines manuals (T1, T2 i T3), d'acord amb el Protocol HSA (Human · Search · AI). Aquesta mesura és rigorosa i traçable, però s'executa de manera artesanal: els prompts es llancen un a un a les aplicacions oficials, les respostes es copien manualment i cada test es codifica a mà.

Aquest informe documenta l'evolució d'aquesta feina cap a Antropus, l'eina que operacionalitza el Protocol HSA i el converteix en un sistema automàtic, consistent i auditable. Per fer-ho amb transparència, un mateix baseline —el T3— s'ha mesurat de tres formes diferents i s'han comparat entre si:

Via manual

Mesura humana original, sobre les respostes capturades a les aplicacions oficials.

Via importada

Aquestes mateixes respostes, analitzades per Antropus en lloc d'una persona.

Via nativa

Antropus mesurant de principi a fi pel seu compte, amb els mateixos prompts.

Objectiu

No es pretén determinar «qui encerta» —la mesura manual tampoc no constitueix una veritat absoluta—, sinó respondre a una pregunta més útil: en quin grau concorda Antropus amb una mesura manual rigorosa i què aporta allà on difereix. Quan dos mètodes independents mesuren el mateix i coincideixen, la mesura guanya solidesa; on no coincideixen, es documenta el motiu.

02 · Metodologia de la comparació

Mateix material, tres vies

Les tres vies parteixen del mateix material —els mateixos quinze prompts sobre la marca, els seus serveis i la seva formació, distribuïts en sis tipus d'intenció de cerca— i es diferencien en dues variables: qui puntua les respostes i per quin canal s'obtenen.

ViaCom s'obtenen les respostesQui les puntua
ManualAplicacions oficials (ChatGPT, Gemini, Perplexity), amb navegació activadaUna persona, d'acord amb el Protocol HSA
ImportadaLes mateixes respostes de les aplicacions, importades a AntropusAntropus (automàtic)
NativaAntropus consulta els motors pel seu compte, a través de l'APIAntropus (automàtic)
Aïllament de variables

Aquesta separació en tres vies permet atribuir cada diferència a una causa concreta. La comparació entre la via manual i la importada manté constants les dades i canvia únicament l'avaluador (humà davant d'Antropus), per la qual cosa aïlla el mètode de puntuació. La comparació entre la importada i la nativa manté constant l'avaluador i canvia el canal d'obtenció, per la qual cosa aïlla el canal de mesura.

2.1 · Dades d'origen

El conjunt de dades està format per 45 respostes reals capturades a les aplicacions oficials de ChatGPT, Gemini i Perplexity, en mode web amb navegació activada, sessió nova i incògnit per prompt. De cada test es va conservar el prompt exacte, la resposta íntegra, les URLs del panell de fonts, la URL canònica esperada i la categoria d'intenció. Aquest mateix material és el que es va importar a Antropus per a la via importada. La via nativa va reutilitzar únicament els quinze prompts; les respostes les va obtenir Antropus pel seu compte. Tots dos conjunts de dades es publiquen íntegres com a annex d'aquest informe.

2.2 · La via nativa: l'aplicació davant de l'API

A diferència de les vies manual i importada —que parteixen de respostes obtingudes a les aplicacions oficials—, la via nativa no utilitza aquestes aplicacions: consulta els motors a través de la seva API. L'API és la connexió tècnica per la qual els programes, i no les persones, accedeixen de manera automàtica a un model d'IA. Dit de manera senzilla, l'aplicació és la porta per on entra un usuari i l'API és la porta per on entren les eines i el programari.

Convé precisar que els resultats obtinguts per aplicació i per API mai no seran idèntics. L'aplicació oficial és un producte acabat, amb els seus propis mecanismes per cercar a la web, ordenar les fonts i adaptar la resposta; l'API ofereix un accés més directe i amb menys capes. Davant de la mateixa pregunta, cada canal pot mostrar fonts diferents: no es tracta que un mesuri bé i l'altre malament, sinó de dues vies diferents del mateix model.

Això té una conseqüència pràctica. La majoria d'eines d'anàlisi GEO mesuren per API, atès que automatitzar les aplicacions a gran escala no resulta viable; i l'API tendeix a mostrar les pàgines pròpies de la marca amb menys freqüència, com s'observa en aquest estudi. Per això, la forma més fidel al que percep un usuari real és importar les respostes de la mateixa aplicació. Antropus admet totes dues vies, de manera que l'elecció no es realitza a cegues: el rellevant és saber què mesura cadascuna.

2.3 · Diferències de disseny declarades per endavant

Abans de comparar, es van declarar les diferències de definició entre tots dos sistemes, amb la finalitat de no presentar com a «error» allò que respon a un criteri diferent:

  • Validesa metodològica. Antropus exclou de les mètriques els tests contaminats —per exemple, quan la resposta es desvia del tema—; la mesura manual els comptabilitzava.

  • Citació. Antropus comptabilitza també les cites textuals sense enllaç; la mesura manual exigia una font mostrada.

  • URL correcta. Amb URL canònica declarada, Antropus exigeix la pàgina exacta esperada; la mesura manual acceptava qualsevol pàgina del domini.

  • Top 3. Antropus només comptabilitza rànquings ordenats; la mesura manual admetia llistes no ordenades.

  • Deduplicació d'URLs. La mesura manual computa una sola vegada la mateixa URL repetida. En aquest cas la diferència no afecta, ja que es va importar el panell de fonts ja depurat.

2.4 · El denominador canònic

D'acord amb la documentació metodològica d'Antropus, abans de calcular cap mètrica els tests es filtren en tres passos imbricats: produïts (sense fallada tècnica), aplicables (el motor va respondre) i visibles (sense invalidació metodològica). Les mètriques es calculen sobre els tests visibles, que constitueixen el denominador canònic. Una fallada de proveïdor o una resposta invàlida no es comptabilitzen com a «la marca no va aparèixer»: s'exclouen, no es penalitzen.

En aquest baseline, dels 45 tests executats, la via importada deixa 42 visibles (validesa del 93,3%) i la nativa també 42 visibles, en el seu cas sobre 44 aplicables, cosa que situa la seva validesa en el 95,5%. Els tests exclosos per la via nativa són dues confusions d'entitat —una a ChatGPT i una altra a Gemini— més una fallada de proveïdor al mateix Gemini, que queda fora del denominador d'aplicables. Per aquest motiu el SoM manual (27/45) i el d'Antropus (27/42) empren denominadors diferents, malgrat coincidir el nombre de mencions.

Precisió: la documentació d'Antropus descriu un flux general que pot repetir cada test per fer la mitjana de la variabilitat. En aquesta importació, cada test va incorporar l'única resposta capturada manualment, sense repetició.

Text del panell Antropus que explica com es mesura.
Panell Antropus · «Com es mesura»: el denominador canònic són els tests visibles.
Text del panell Antropus amb els principis del que no es fa.
Panell Antropus · «El que NO fem»: null ≠ 0, el mode no s'infereix, sense històric inventat.
Veure Protocol HSA (Human · Search · AI)
03 · Les mètriques de cada versió

Correspondència entre les mètriques HSA i Antropus

Per transparència, es deixa constància que la mesura manual i Antropus no empren exactament les mateixes mètriques. Antropus parteix de les definides al Protocol HSA i incorpora capes addicionals. La correspondència és la següent:

Mètrica manual (HSA)Mètrica AntropusQuè canvia
Menció (SoM)SoM · MencionsMateix concepte; Antropus verifica a més que la menció correspongui a la marca correcta i no a una d'homònima
Citació (Q)CR · CitacióAntropus comptabilitza també les cites de text sense enllaç («segons…»), no només els enllaços mostrats
Hi ha URL pròpia citada?CS · Citació de marcaEquivalents: si apareix alguna pàgina del domini propi com a font
URL correcta (R)URL correcta (R)Antropus exigeix la pàgina canònica esperada per a aquesta intenció (criteri més estricte)
Top 3Top 3Antropus només comptabilitza quan existeix una llista realment ordenada
SoS / SoASoS / SoAMateixa definició: quota de fonts pròpies sobre el total
— (no existia)SoR · RecomanacióNova: mesura amb quina força recomana la IA, no només si la marca apareix
— (no existia)ValidesaNova: descarta les respostes no mesurables en lloc de comptabilitzar-les com a absència
(judici humà)Verificació de dubtesNova: assenyala com a «sense verificar» allò que no pot confirmar i ho consulta

Denominadors declarats per Antropus: SoM, CS i CR es calculen sobre tests visibles; Top 3, sobre respostes amb rànquing ordenat; URL correcta, sobre respostes amb URL canònica esperada.

04 · Resultats: comparativa de mètriques

Les xifres finals de les tres vies

La taula següent recull les xifres finals de les tres vies sobre el mateix baseline T3. Les columnes manual i importada operen sobre les respostes capturades a les aplicacions entre el 23 i el 25 de juny de 2026; la columna nativa, sobre respostes obtingudes per API el 23 de juliol de 2026. Les xifres de la via nativa es presenten arrodonides a números enters, igual que el panell d'Antropus; el seu detall amb decimals figura a l'Excel annex.

MètricaManualImportadaNativaDenominador
Tests executats454545
Tests vàlids454242després de validesa
Mencions vàlides (nre.)272723absolut
SoM60,0%64,3%55%tests vàlids
Citació (CR)91,1%100%93%tests vàlids
Citació de marca (CS)66,7%*67%41%tests vàlids
URL correcta (estricta)60%31%amb canònica
Top 3 (base comparable)24,4%≈10%≈7%tests vàlids
SoS (quota de fonts)14,8%15%17%total fonts
SoR (recomanació)57,1%45%amb RSW mesurat
Validesa93,3%96%tests executats

* La mètrica «URL correcta» del mètode manual equival funcionalment a la «Citació de marca» d'Antropus, segons s'explica a «Per què no coincideixen». Les mencions es comptabilitzen sobre els tests vàlids de cada via: 27 sobre 45 a la manual, 27 sobre 42 a la importada i 23 sobre 42 a la nativa. Les dues primeres columnes no comparteixen denominador amb la tercera, de manera que la comparació pertinent és la de percentatges, no la de valors absoluts.

Distribució de la validesa. A la via nativa, els 42 tests vàlids es reparteixen en 14 de ChatGPT (93,3% de validesa), 13 de Gemini (92,9%) i 15 de Perplexity (100%). El Top 3 s'expressa sobre base comparable —el total de tests vàlids—, atès que el panell d'Antropus el calcula sobre les respostes que contenen un rànquing ordenat i arroja un 44% a la via importada i un 27% a la nativa sobre aquest denominador restringit.

Captura del panell Antropus amb la visió general de la via importada i un SoR del 57,1%.
Panell Antropus · visió general de la via importada: SoR 57,1%, «recomanació raonable».
Captura del panell Antropus amb la visió general de la via nativa i un SoR del 45%.
Panell Antropus · visió general de la via nativa: SoR 45%, «recomanació irregular».
05 · Quant concorda Antropus amb la mesura manual?

Manual davant d'importada: concordança gairebé total

La comparació pertinent per respondre a aquesta pregunta és la que enfronta la via manual amb la importada, atès que totes dues operen sobre exactament les mateixes 45 respostes i només difereixen en l'avaluador. En les mètriques que mesuren el mateix, la concordança resulta pràcticament total.

Mètrica de mateix concepteManualImportadaConcordança
Mencions vàlides (nre. absolut)2727100%
Mencions · ChatGPT1010100%
Mencions · Gemini88100%
Mencions · Perplexity99100%
Quota de fonts pròpies (SoS)14,8%15%≈99%
Citació de marca66,7%67%≈99,5%

Tots dos percentatges es calculen sobre denominadors diferents —45 tests a la via manual i 42 a la importada—, per la qual cosa corresponen a trenta i vint-i-vuit casos respectivament. La coincidència dels percentatges és, en part, efecte d'aquesta diferència de base. La concordança plenament robusta és la del recompte de mencions, que es compara sobre xifres absolutes idèntiques i coincideix tant en el total com en el repartiment per motor.

Lectura del resultat

La coincidència no es limita a l'agregat: el nombre de mencions és idèntic i el seu repartiment per motor també ho és (10, 8 i 9). Que dos mètodes independents convergeixin d'aquesta manera sobre les mateixes dades constitueix la forma més sòlida d'acreditar la fiabilitat d'una mesura —validesa convergent—. La fiabilitat, entesa com a consistència i reproductibilitat, no s'afirma: s'evidencia.

Abast de l'afirmació

D'aquest resultat no es dedueix que Antropus sigui «més veraç» en termes absoluts que la mesura manual: aquesta última tampoc no constitueix un patró de referència infal·lible. El que s'acredita és que tots dos mètodes, aplicats a les mateixes dades, arroja el mateix resultat allà on mesuren el mateix. On les xifres difereixen —URL correcta, Top 3 i validesa— no existeix desacord, sinó una definició més exigent o una mètrica nova, segons es detalla a continuació.

06 · Per què determinades xifres no coincideixen

Cada divergència té una causa identificable

En cap cas Antropus mesura amb menor rigor: mesura sobre dades més netes, amb criteris més exigents o incorpora dimensions que la mesura manual no contemplava.

6.1 · La menció ascendeix del 60,0% al 64,3%

Antropus detecta el mateix nombre de mencions que la mesura manual: 27. La diferència percentual procedeix exclusivament del denominador, ja que Antropus exclou tres respostes que es desvien del tema i no avaluen realment la marca. El càlcul no es contamina, per tant, amb casos no vàlids. No es mesura més: es mesura sobre dades més netes.

6.2 · La citació ascendeix del 91,1% al 100%

A la mesura manual només es comptabilitzava com a cita la presència d'un enllaç mostrat pel motor. Antropus comptabilitza a més les cites de text —del tipus «segons determinada font»— encara que no s'acompanyin d'enllaç. D'aquí que la seva xifra resulti superior: es detecten atribucions que la revisió visual no registrava.

6.3 · La URL correcta descendeix

La mesura manual considerava correcta qualsevol URL del domini propi. Antropus aplica un criteri més estricte: només es comptabilitza com a correcta la pàgina canònica esperada per a aquesta intenció concreta. Si davant d'una consulta comparativa el motor enllaça la pàgina de contacte en lloc de la de servei, la mesura manual ho donava per vàlid i Antropus no. La xifra resultant és menor, però també més exigent amb la qualitat de l'atribució. Aquesta distinció explica igualment per què la «URL correcta» del mètode manual equival, a la pràctica, a la «Citació de marca» d'Antropus: totes dues responen a la pregunta de si el motor cita alguna pàgina pròpia. La «URL correcta» d'Antropus constitueix una mètrica nova i més severa.

6.4 · El Top 3 descendeix

La mesura manual comptabilitzava el Top 3 amb un criteri flexible. Antropus únicament el comptabilitza quan existeix una llista realment ordenada —primera, segona i tercera posició— i la marca hi figura; una enumeració sense ordre no computa. Es tracta, per tant, d'un criteri més estricte sobre què constitueix un rànquing.

6.5 · Mètriques sense equivalent a la mesura manual

Tres dimensions no tenen contrapartida al mètode manual i expliquen per si soles part del valor afegit: el SoR, que pondera la força de la recomanació en lloc de limitar-se a registrar la presència; la validesa, que quantifica quina proporció de la mesura és metodològicament aprofitable; i la verificació de dubtes, mitjançant la qual el sistema assenyala com a «sense verificar» aquelles afirmacions que no pot confirmar i les sotmet a consulta en lloc de donar-les per bones.

07 · El canal de mesura condiciona el resultat

Importada davant de nativa: aplicació vs API

La comparació entre la via importada i la nativa manté constant l'avaluador —en totes dues puntua Antropus— i modifica únicament el canal pel qual s'obtenen les respostes: l'aplicació oficial davant de la connexió tècnica emprada per les eines d'anàlisi. L'efecte sobre les mètriques de citació resulta acusat.

  • Citació de marca: del 67% al 41%. La marca apareix com a font en un nombre sensiblement menor de respostes.

  • URL correcta: del 60% al 31%. I quan apareix, amb menor freqüència es tracta de la pàgina adequada.

  • Recomanació (SoR): del 57,1% al 45%. La força mitjana amb què el motor recomana la marca també es redueix.

Interpretació

Es tracta del mateix model consultat per canals diferents. A través de l'aplicació —com a la mesura manual—, el motor cita amb major freqüència les pàgines pròpies de la marca; a través de l'API, les cita menys. La conclusió resulta rellevant per a qualsevol marca: la visibilitat en IA depèn del canal des del qual es mesuri. L'aplicació reflecteix el que percep un usuari real; l'API, el que perceben les integracions i eines. Totes dues són legítimes i responen a preguntes diferents.

Nota metodològica: la via nativa es va executar en data posterior a la manual, per la qual cosa una part de la diferència és atribuïble al transcurs del temps. No obstant això, la magnitud de la caiguda —de l'ordre de vint-i-set punts en citació de marca— apunta principalment al canal.

Panell de fonts citades de la via importada.
Panell Antropus · fonts citades (importada): CR 100%, CS 67%, SoS 15%; 16 dominis (8 propis, 8 de tercers).
Panell de fonts citades de la via nativa.
Panell Antropus · fonts citades (nativa): CR 93%, CS 41%, SoS 17%; 5 dominis (1 propi, 4 de tercers).
08 · Radiografia per motor i per tipus de cerca

On resideix la informació accionable

La mesura aporta un nivell de detall que la mitjana global oculta: el comportament de cada motor i de cada tipus de pregunta. Les xifres d'aquest apartat procedeixen de la via nativa (mesura per API). Convé llegir-les a la llum de l'anterior: la connexió tècnica atribueix menys citació de marca que l'aplicació oficial, per la qual cosa aquests percentatges representen el terra de visibilitat —el que perceben les integracions i les eines d'anàlisi—, no el sostre. El diagnòstic relatiu entre motors i entre intencions es manté vàlid, atès que totes les xifres s'han obtingut pel mateix canal.

8.1 · Per motor

MotorSoRCitació marcaURL correctaValidesa
Perplexity63%60%53%100%
ChatGPT41%57%36%93%
Gemini29%0%0%93%
  • Perplexity constitueix el punt fort: cita pàgines del domini propi en tres de cada cinc respostes i, en més de la meitat, la pàgina correcta.

  • ChatGPT cita, però s'equivoca de pàgina: referencia el domini propi en més de la meitat de les respostes, si bé en la majoria dels casos no enllaça la pàgina adequada per a la intenció consultada.

  • Gemini menciona la marca però no cita les seves pàgines: la recomana en certa mesura, encara que no cita el domini propi en cap resposta; les fonts que mostra són de tercers que parlen de la marca.

Taula del panell Antropus amb el rendiment per motor de la via importada.
Panell Antropus · rendiment per motor (importada): ChatGPT 63% SoR, Gemini 55%, Perplexity 54%.
Taula del panell Antropus amb el rendiment per motor de la via nativa.
Panell Antropus · rendiment per motor (nativa): Perplexity 63% SoR, ChatGPT 41%, Gemini 29%.

8.2 · Per tipus de cerca

En desagregar per intenció de l'usuari emergeix el patró de major rellevància comercial: la marca obté bons resultats quan la consulta versa sobre si mateixa o sobre la seva formació, i perd presència quan l'usuari compara o decideix sense conèixer-la prèviament.

Tipus de cercaSoRMencióCita marca
Marca69%100%75%
Producte (formació)56%67%42%
Descobriment34%38%38%
Comparació38%25%13%
Decisió17%33%33%
Confiança17%33%33%
Diagnòstic

Quan l'usuari ja coneix la marca o cerca la seva formació, aquesta apareix amb solidesa (SoM del 100% i del 67%, respectivament). Quan compara agències sense conèixer-la prèviament, en canvi, cau al punt més baix del recorregut: es menciona en tot just un de cada quatre casos (SoM 25%) i rarament cita el domini propi (13%). És precisament «Comparació» —el tram en què l'usuari avalua opcions abans de contractar— on es concentra la major pèrdua de presència.

Gràfic radar i taula de rendiment per intenció de la via importada.
Panell Antropus · rendiment per intenció (importada): Marca 89% SoR, Producte 69%; Decisió invisible.
Gràfic radar i taula de rendiment per intenció de la via nativa.
Panell Antropus · rendiment per intenció (nativa): Marca 69% SoR, Producte 56%.
09 · De la mesura a l'acció

El mateix pla, generat automàticament

Antropus no es limita a mesurar: a partir dels resultats genera un diagnòstic prioritzat. Sobre aquest baseline es van identificar 44 incidències agrupades en 7 patrons, encapçalats per l'absència de fonts pròpies —la marca es cita, però cap URL pròpia no la fonamenta— (8 casos), la manca d'activació de la marca en la seva categoria (8 casos) i l'exclusió del shortlist comparatiu (6 casos), seguits de la desviació canònica (4 casos) i la confusió d'entitat (2 casos). D'aquest diagnòstic es deriva un pla de vuit accions amb mètrica objectiu i criteris d'èxit quantificats per a la mesura següent: la primera, de caràcter operatiu, consisteix a repetir l'únic test que Gemini no va completar per una fallada tècnica de proveïdor; les set restants són estratègiques.

La dada de major rellevància de l'estudi és que aquest pla, generat de manera automàtica, coincideix amb les accions que es van derivar manualment després de l'anàlisi humana del baseline T3.

PrioritatManual (T3)ImportadaNativa
Crear contingut comparatiu
Generar evidència pròpia citable
Reforçar les pàgines canòniques correctes
Investigar els competidors que ocupen la recomanació
Construir un full de ruta / propera mesura
Clarificar les sigles i l'entitat de la marca

El detall tàctic varia en funció del que ha detectat cada mesura: l'estudi manual incidia en l'expansió literal «GEO = Generative Engine Optimization» i en la desambiguació d'HSA; la via importada prioritza el marcatge schema.org; la nativa, resoldre l'ambigüitat de sigles sorgida en les seves respostes. La direcció estratègica, tanmateix, és idèntica en les tres.

Triple confirmació

La correspondència no constitueix un cas aïllat. Els plans de la via importada i de la nativa —tots dos generats per Antropus, però sobre dades diferents— coincideixen al seu torn en les seves prioritats principals. El mateix pla estratègic emergeix, per tant, de la mesura manual, de la importada i de la nativa. No es tracta d'una recomanació fruit de l'atzar ni d'una única mesura, sinó d'una direcció estable que se sosté amb independència de com es mesuri.

9.1 · El cost d'obtenir aquest diagnòstic

La diferència operativa entre tots dos mètodes resulta substancial. La mesura manual exigeix obrir cada aplicació, llançar els quinze prompts un a un en sessió nova, copiar les respostes íntegres, registrar les URLs del panell, deduplicar-les i codificar a mà les mètriques de cadascun dels 45 tests; a la qual cosa el mateix protocol afegeix una doble revisió d'al·lucinacions, URL correcta i casos de cita sense menció abans de donar per tancada la mesura. A la pràctica, completar un baseline per aquest procediment requereix aproximadament tres jornades de treball, a raó d'un motor per jornada.

La via nativa va completar aquests mateixos 45 tests, sobre els tres motors, en aproximadament 45 minuts i sense intervenció humana, lliurant a més el desglossament per motor i per intenció i el pla d'acció prioritzat.

Convé precisar l'abast de l'estalvi en cada via. La via importada manté la captura manual de les respostes —ja que el seu valor rau precisament a recollir el que mostra l'aplicació a l'usuari— i automatitza únicament la codificació i l'anàlisi. La via nativa automatitza el procés complet, captura inclosa. En tots dos casos s'elimina la variabilitat de la codificació humana i el treball de control metodològic que el mètode manual ha d'incorporar com a tasca addicional.

Expressat en termes operatius, una mesura que ocupava tres jornades de treball especialitzat es resol en menys d'una hora. Aquest salt no només redueix cost: habilita una freqüència de mesura que el mètode manual fa materialment inviable, i que és precisament la que permet construir sèries temporals fiables.

Llista d'accions recomanades de la via importada.
Panell Antropus · pla d'acció prioritzat (importada): 8 accions, totes de prioritat alta.
Llista d'accions recomanades de la via nativa.
Panell Antropus · pla d'acció prioritzat (nativa): 8 accions, una crítica (repetir el test que Gemini no va completar).
Captura del panell Antropus amb un baseline natiu en execució al 60%.
Panell Antropus · baseline natiu en execució: 27 de 45 tests (60%), tres motors per API.
10 · Quan convé cada via

Dues vies legítimes per a preguntes diferents

Totes dues vies són legítimes i responen a preguntes diferents. L'elecció no s'ha de realitzar per defecte, sinó en funció de l'objectiu de la mesura.

10.1 · Quan convé la via importada

  • Quan l'objectiu és conèixer el que percep un usuari real. Les respostes procedeixen de l'aplicació oficial, l'entorn en què el client potencial realitza les seves consultes.

  • Quan la fidelitat preval sobre la freqüència. Auditories, informes de direcció o presentacions a client en què resulta determinant reflectir l'experiència real.

  • Quan ja es disposa de respostes capturades. Permet aprofitar mesures prèvies —incloses les manuals— i puntuar-les amb criteri homogeni i auditable.

  • Quan es vol evitar el biaix del canal tècnic. Atès que l'API tendeix a mostrar menys les pàgines pròpies, la via importada evita infravalorar la visibilitat real.

Limitació: requereix captura manual de les respostes, per la qual cosa no escala a mesures freqüents o amb gran volum de prompts.

10.2 · Quan convé la via nativa

  • Quan es requereix freqüència i escala. Seguiment periòdic, volums elevats de prompts o monitoratge continu sense intervenció humana.

  • Quan s'analitza l'evolució en el temps. En mantenir sempre el mateix canal i els mateixos criteris, les sèries temporals resulten comparables entre si.

  • Quan es necessita diagnòstic i pla d'acció amb rapidesa. El desglossament per motor i intenció i el pla prioritzat s'obtenen en minuts.

  • Quan interessa el canal que empren les eines i integracions. És la superfície que consumeixen els sistemes automàtics, i també mereix ser mesurada.

Limitació: mesura el canal API, que pot arrojar una citació del domini propi inferior a la que percep un usuari a l'aplicació.

10.3 · Criteri recomanat: ús combinat

El plantejament més sòlid no consisteix a triar una via, sinó a combinar-les amb funcions diferenciades: la via nativa com a mesura periòdica de seguiment —per la seva capacitat de repetir-se amb freqüència i en condicions homogènies, cosa que permet construir tendència— i la via importada com a validació puntual en les fites rellevants, per contrastar aquesta tendència amb l'experiència real de l'usuari a l'aplicació.

Aplicat a un cicle de treball habitual: seguiment natiu amb la periodicitat que requereixi el projecte, i una mesura importada per trimestre —coincidint amb el tancament del baseline— que actuï com a punt de calibratge. D'aquesta manera s'obté simultàniament escala i fidelitat, i es coneix en tot moment què mesura cada xifra.

11 · Conclusió

Tres conclusions sobre un mateix baseline

L'estudi acredita, sobre un mateix baseline mesurat de tres formes diferents, tres conclusions:

01

Antropus és fiable

Allà on mesura el mateix que la mesura manual, coincideix de manera pràcticament total: idèntic nombre de mencions, idèntic repartiment per motor i quota de fonts equivalent. Es tracta de validesa convergent entre dos mètodes independents.

02

Antropus mesura amb major rigor i major detall

Descarta les respostes no vàlides, exigeix la pàgina canònica correcta, distingeix el comportament de cada motor i de cada tipus de cerca, i pondera la força de la recomanació a més de la mera presència.

03

Antropus tradueix la mesura en acció, de manera automàtica

El pla de millora que genera coincideix amb el que un equip humà va derivar després de dies d'anàlisi, i s'obté en minuts.

Antropus mesura la visibilitat d'una marca a la IA amb el mateix criteri que un analista humà rigorós —de manera automàtica, consistent i auditable— i no s'atura en la dada: assenyala què s'ha de fer per millorar-la.

Abast i límits

La mesura manual no constitueix una veritat absoluta, per la qual cosa no s'afirma que Antropus sigui «més veraç» en termes absoluts, sinó que concorda amb ella allà on mesuren el mateix i la supera en rigor i detall allà on difereixen. El mateix sistema explicita els seus límits —assenyala el que no pot verificar, distingeix el no mesurable del mesurat en zero i no infereix allò que no s'ha declarat—. Aquesta transparència és la que sosté la seva credibilitat com a eina d'analítica GEO.

Taula de registre de respostes de la via nativa.
Panell Antropus · registre de respostes (nativa): 45 tests; 15 recomanades; 23 entitats correctes, 2 incorrectes i 1 ambigua.
Annex · Conjunts de dades

Dades per a la verificació íntegra

Amb la finalitat de permetre la verificació íntegra dels resultats, es publiquen els dos conjunts de dades emprats en aquest informe:

Dades d'origen importades

Respostes reals capturades a ChatGPT, Gemini i Perplexity i importades a Antropus, amb el prompt, la resposta completa, les URLs citades, la URL canònica esperada i la categoria d'intenció de cada test.

baseline-manual-T3-import-antropus.xlsx· 123 KB

L'arxiu de la via nativa conté la codificació completa per test, de manera que permet recalcular íntegrament les xifres d'aquesta columna. L'arxiu d'importació recull les dades d'entrada —prompt, resposta, URLs citades, URL canònica i categoria—, això és, el material exacte que es va sotmetre a avaluació, però no la codificació resultant; les columnes manual i importada no són, per tant, recalculables des d'aquest annex.

Llicència del dataset: Creative Commons Reconeixement 4.0 Internacional (CC BY 4.0). Es permet compartir i adaptar les dades, fins i tot amb finalitats comercials, citant Elevam i enllaçant l'estudi original. Veure els termes de la llicència