Nuestro sitio web utiliza cookies para mejorar y personalizar su experiencia y para mostrar anuncios (si los hay). Nuestro sitio web también puede incluir cookies de terceros como Google Adsense, Google Analytics, Youtube. Al utilizar el sitio web, usted acepta el uso de cookies. Hemos actualizado nuestra Política de Privacidad. Haga clic en el botón para consultar nuestra Política de privacidad.

Néstor Romero: «El campo del GEO (Generative Engine Optimization) mide mucho y valida poco»

En las páginas del volumen 2, número 24 (2026) de la publicación académica Latitude: Multidisciplinary Research Journal —bajo el sello de Quality Leadership University (QLU) en Ciudad de Panamá— ha visto la luz el estudio «Medición de la presencia de marca en la optimización para motores generativos: una revisión de alcance sobre métricas y validez», cuya autoría corresponde a Néstor Romero-Ramos, Yulianna Lobach, David Abreu-Abreu, Isaac Castillo-Hernández, Juan Carlos García-Cordero y Daniel García-Cordero. Dicha investigación, de libre acceso para la ciudadanía, constituye el debut bibliográfico de la agenda de estudio centrada en la Generative Engine Optimization (GEO) que Centria Group impulsa en colaboración con diversos centros de educación superior y universidades de cuatro naciones.

El artículo responde a una pregunta que el marketing digital todavía no sabe contestar con rigor: cuando un asistente de inteligencia artificial recomienda un banco, un seguro o un hotel, ¿cómo se mide si una marca está presente en esa respuesta, con qué prominencia y con qué fiabilidad? Para responderla, el equipo realizó una revisión de alcance (scoping review) siguiendo la metodología del Joanna Briggs Institute (JBI) y reportada conforme a la extensión PRISMA-ScR, que mapea de forma sistemática cómo la literatura emergente mide la presencia, la visibilidad y la citación de fuentes y marcas en los motores generativos.

«Cerca de veinte años atrás, el posicionamiento en la red dependía de una destreza muy específica: salir en un directorio de búsqueda y captar clics. Actualmente, la audiencia ya no se topa con diez enlaces azules, sino que obtiene una contestación elaborada que agrupa y reinterpreta múltiples portales, mencionándolos de manera incompleta o asimétrica. El dilema actual ya no consiste en averiguar si nuestro hipervínculo se muestra y recibe visitas, sino en comprobar si nuestra información figura en el interior de esa contestación que el consumidor consume en realidad», señala Néstor Romero, investigador firmante del informe y director de operaciones de Centria Group.

Del clic a la respuesta: por qué las métricas del SEO dejan de servir

El análisis arranca de una realidad que el propio corpus corrobora mediante datos empíricos: las referencias empleadas por una inteligencia artificial generativa coinciden escasamente con los resultados orgánicos clásicos, y el criterio de elección difiere según la plataforma. En otras palabras, aparecer en los primeros puestos de Google no garantiza presencia en un chatbot conversacional, lo que echa por tierra la traslación automática de métricas y exige replantizar las mediciones y los métodos. A este escenario se une el impacto de las «cero clics», potenciado por las respuestas sintéticas que ofrecen los motores de búsqueda actuales: gran parte de las búsquedas culminan sin que el internauta navegue hacia ninguna página web.

«La cuota de citación es la métrica que la práctica profesional trata como central, y en la literatura académica está formalizada en un único estudio. Esa brecha entre industria y academia es en sí misma un hallazgo», dijo Néstor Romero.

¿Qué cambios se aprecian entre el SEO y el GEO?

Dimensión SEO (búsqueda tradicional) GEO (motores generativos)
Unidad de visibilidad Un puesto en una lista de diez enlaces La presencia dentro de una única respuesta sintetizada
Métrica central Posición orgánica, clics, impresiones, CTR Citación, prominencia, absorción textual, cuota de citación
Decisión del usuario Elige entre varias fuentes que ve Recibe una respuesta que integra y reformula fuentes, citándolas de forma parcial o desigual
Comportamiento del sistema Determinista y relativamente estable Estocástico: la misma pregunta puede producir respuestas distintas
Transferencia de indicadores No transferible: las fuentes que cita un motor generativo se solapan poco con las que posicionan en la búsqueda tradicional

Cómo se hizo: cuatro rutas de búsqueda y una política explícita de preprints

Para compensar los puntos ciegos particulares de cada método, el proceso integró cuatro vías complementarias: un sistema de hallazgo impulsado por inteligencia artificial, búsquedas multilingües y replicables en OpenAlex, seguimiento de referencias a partir de nodos clave, y comprobación en un repertorio indexado (Web of Science; Scopus no estuvo disponible). Una vez eliminados los duplicados mediante DOI —evitando el título debido a los frecuentes conflictos en denominaciones genéricas dentro de esta disciplina—, dos investigadores examinaron los resúmenes por separado, solucionando cualquier desacuerdo de común acuerdo. Finalmente, se revisaron 36 documentos íntegros, seleccionando 23 investigaciones originales, además de dos revisiones catalogadas de manera independiente a modo de contexto teórico.

«Gran parte del saber producido en nuestro idioma acerca de este asunto no trasciende a las redes internacionales. Rescatarlo va más allá de un simple afán de completitud; pone al descubierto un prejuicio idiomático oculto en la disciplina», subrayó Néstor Romero.

Siete grupos de indicadores y ningún modelo que los agrupe

El análisis señala siete familias de indicadores parcialmente interconectadas —aparición/citación, relevancia/ubicación, absorción/influencia, clasificación en listados, consistencia, tono/marco y porcentaje de citación— que operan careciendo de un estándar unificado común. Asimismo, la investigación subraya que el límite teórico más fructífero de esta disciplina radica en la separación entre citación (la elección de una referencia) y absorción (la integración real de sus datos dentro del texto generado), dividiendo así en dos planos lo que tradicionalmente se evaluaba como una simple dicotomía.

Las siete familias de métricas identificadas

Familia Definición operativa Ejemplos en la literatura
Aparición / citación Se alude o menciona directamente a la marca o fuente Aggarwal et al. (2024); Khedekar y Bansal (2026)
Prominencia / posición Saliencia y ubicación que ocupa la cita Aggarwal et al. (2024); Murár (2025)
Absorción / influencia Aporte textual real proveniente de la fuente Zhang et al. (2026)
Ranking en listas Modificación en la jerarquía del elemento Bagga et al. (2025); Nimase et al. (2026); Kumar y Lakkaraju (2024)
Estabilidad Grado de consistencia temporal y entre distintas ejecuciones Schulte et al. (2026); Chen et al. (2025)
Sentimiento / encuadre Contexto y valencia asociados a la referencia Khedekar y Bansal (2026); Kumar (2026)
Cuota de citación Porcentaje de menciones en comparación con la competencia Khedekar y Bansal (2026)

La unidad de análisis se mueve: de la URL a la marca y a la trayectoria de los agentes

No hay acuerdo sobre qué se evalúa con precisión. El corpus evidencia un cambio paulatino que va desde el origen o la URL —legado directo del posicionamiento orgánico— hasta la marca o entidad, pasando por el archivo, el artículo y, en las investigaciones más recientes, llegando a estructuras más complejas como el recorrido de navegación de los agentes. Dicha evolución pone de manifiesto el traslado del interrogante dentro de la disciplina, aunque esto conlleva un precio: las investigaciones basadas en elementos diferentes no resultan directamente equiparables, lo que consolida la imposibilidad de llevar a cabo un metaanálisis.

La IA no siempre contesta igual, y prácticamente nadie lo mide

Dado que los motores generativos funcionan de manera estocástica, son capaces de arrojar contestaciones diferentes frente a una idónea idéntica consulta. Una evaluación certera demanda, por ende, duplicar las pruebas o bien representar de forma explícita la variabilidad. No obstante, tan solo una pequeña parte de las investigaciones procede de este modo riguroso. Dentro del grupo que sí implementa estas prácticas sobresalen iniciativas que realizan cinco corridas por cada petición, completan doscientos exámenes junto a variaciones de secuencia, aplican estudios de sensibilidad para idioma y refraseo, o bien consideran la visibilidad en calidad de distribución en vez de como un dato aislado. El porcentaje restante suele fundamentarse en una única ejecución.

«Una medición de una sola ejecución es, en este dominio, epistemológicamente frágil. Cualquier instrumento robusto tiene que incorporar la repetición y la modelización de la incertidumbre como requisito, no como un refinamiento opcional», señala Romero.

El descubrimiento principal: un terreno que abarca bastante pero comprueba escasamente

La conclusión determinante del estudio es que ningún trabajo del corpus somete su instrumento de medición a validación psicométrica en sentido estricto. Lo que existe son controles adyacentes y aislados —métricas de estabilidad, fidelidad de la atribución, triangulación por diseño o robustez al orden—, y la fiabilidad intercodificadores, requisito básico de cualquier instrumento, apenas se reporta. La validez, cuando se argumenta, descansa en la coherencia interna de benchmarks creados ad hoc antes que en propiedades de medición. De ahí la conclusión central del mapeo: no existe todavía un instrumento integrado y validado para medir la presencia generativa de marca.

«Encontramos un campo que mide mucho y valida poco. Lo que falta no son ideas de medición, que abundan: lo que falta es validez de constructo y fiabilidad documentada. Y conviene decirlo con precisión, porque confundir un benchmark con un instrumento validado infla la aparente madurez metodológica del campo. Ese vacío es, exactamente, la oportunidad científica», afirma Néstor Romero.

Una brecha entre la práctica profesional y la academia

El texto expone una discrepancia notable entre aquello que el sector valora como prioritario y lo que la investigación científica ha consolidado. La proporción de citas (citation share) —un indicador al que la actividad profesional otorga un carácter determinante y ve como un candidato idóneo para lograr validez convergente— se sustenta fundamentalmente en una única investigación. Por otra parte, las categorías de tono y enfoque cuentan con un respaldo igual de limitado, a pesar de que la investigación más amplia del conjunto, centrada en más de cien firmas, las señala como el indicador más voluble de todos.

«La presencia en Google no anticipa el impacto dentro de un asistente generativo. Tal circunstancia anula la traslación automática de métricas, lo que exige replantear tanto los objetos de análisis como las metodologías».

«La visibilidad generativa resulta manipulable, lo que impone a la medición una exigencia ajena a sus estándares habituales: la resistencia a la manipulación concebida como cualidad intrínseca del instrumento».

La ciencia en español, invisible: una lección metodológica

La revisión aporta además un hallazgo metodológico de interés directo para la comunidad hispanohablante. Existe un estrato de investigación en español, publicado en revistas de Biblioteconomía y Documentación, que aborda la visibilidad ante la IA generativa desde ángulos complementarios —la volatilidad de la presencia de marca en recomendaciones turísticas generadas por IA, o la optimización de repositorios académicos para su rastreo por motores generativos— y que la literatura anglófona dominante tiende a pasar por alto. Su recuperación solo fue posible mediante búsqueda multilingüe, lo que evidencia un sesgo lingüístico latente en el campo.

A esto se añade otra enseñanza derivada del propio procedimiento: al realizar la comprobación en una base indexada se obtuvieron 360 documentos preliminares, de los cuales se examinaron los 136 accesibles de forma libre, tratándose en su mayor parte de interferencias temáticas debidas a la coincidencia de palabras, sin que se sumara ninguna investigación de evaluación inédita apta. En resumen, este ámbito se caracteriza por priorizar los preprints y sufrir una cobertura insuficiente en los índices convencionales; de hecho, el 64 % del conjunto de referencias posibles se publica mediante arXiv o SSRN, mientras que el 98 % carece de un cuartil catalogado.

«Este resultado lo reportamos como hallazgo metodológico y no como una limitación escondida. En un campo born-digital, la revista no funciona como indicador de calidad, y las herramientas de descubrimiento asistidas por IA tienden a infracubrir precisamente la evidencia revisada por pares y los benchmarks más relevantes. Hay que complementarlas con rastreo de citas y fuentes reproducibles», explica el investigador.

La visibilidad generativa se puede manipular

Una parte de los análisis examinados evidencia que la visibilidad dentro de los motores generativos es susceptible de alteración adversarial, ya sea por medio de tácticas para alterar el posicionamiento en buscadores conversacionales o a través de la optimización discreta de prompts. Dicha investigación traslada semejantes conclusiones al ámbito métrico, sugiriendo que la solidez ante cualquier manipulación tendría que integrarse entre las características indispensables de toda herramienta de visibilidad.

«Una referencia comparativa valora la eficacia de una estrategia o el cambio de posición de un elemento, pero no determina si un indicador refleja fielmente un concepto abstracto. Mezclar ambos planos magnifica el grado de desarrollo aparente de la disciplina».

Una medición de una sola ejecución resulta, en este ámbito, epistemológicamente frágil; al fin y al cabo, los motores generativos son capaces de emitir respuestas diferentes ante un mismo interrogante.

Qué viene ahora: del diagnóstico al instrumento

Los autores concluyen que el vacío detectado —en validez de constructo y en fiabilidad documentada— constituye la apertura que justifica desarrollar y validar formalmente un índice específico de presencia generativa, y sitúan esa tarea como la continuación natural del trabajo publicado, y no como una afirmación ya demostrada. Es precisamente la línea en la que el equipo trabaja en la fase siguiente.

Nuestro objetivo es pasar del diagnóstico a la herramienta: construir y validar un índice que cualquier organización, del tamaño que sea, pueda usar para saber con base científica qué presencia tiene su marca cuando la inteligencia artificial responde por ella», adelanta Néstor Romero.

Limitaciones señaladas por los autores

El texto aclara sus propias limitaciones: la fragilidad del soporte empírico dentro de un ámbito tan novedoso y dominado por preprints, lo cual vuelve provisionales las deducciones; la imposibilidad de reproducir el trayecto de hallazgo original —contrarrestada, si bien no del todo, mediante OpenAlex, el seguimiento de citas y el cotejo indexado—; el acotamiento lingüístico al español e inglés junto con la carencia de acceso institucional para validar en Scopus; una codificación llevada a cabo parcialmente sobre los resúmenes, con métricas de incorporación provisionales; un riesgo de circularidad, puesto que bastantes investigaciones utilizan modelos de lenguaje para evaluar su propia ejecución; así como la vigencia temporal acotada de cualquier instantánea sobre una disciplina fundamentada en tecnologías privativas en mutación permanente.

Ficha del estudio

Campo Información
Título Medición de la presencia de marca en la optimización para motores generativos: una revisión de alcance sobre métricas y validez
Título en inglés Measuring brand presence in Generative Engine Optimization (GEO): A scoping review of metrics and validity
Autoría Romero-Ramos, N.; Lobach, Y.; Abreu-Abreu, D.; Castillo-Hernández, I.; García-Cordero, J. C.; García-Cordero, D.
Revista Latitude: Multidisciplinary Research Journal (Quality Leadership University, Panamá)
Volumen y número Volumen 2, número 24 (2026), julio-diciembre
Páginas 23-39
DOI https://doi.org/10.55946/latitude.v2i24.295
Enlace al artículo https://revistas.qlu.ac.pa/index.php/latitude/article/view/295
Recepción / aceptación / publicación 15 de julio de 2026 / 8 de agosto de 2026 / 17 de agosto de 2026
Licencia Creative Commons Reconocimiento-NoComercial-CompartirIgual 4.0 (CC BY-NC-SA 4.0). Acceso abierto.
Diseño metodológico Revisión de alcance (scoping review) según metodología del Joanna Briggs Institute (JBI), reportada conforme a PRISMA-ScR
Autor corresponsal Néstor Romero-Ramos (nromero@qlu.pa)

Para profundizar en la metodología, los hallazgos y las implicaciones del análisis, puede solicitar el informe completo sobre la banca panameña ante la inteligencia artificial.

Referencias completas del artículo

Las 27 referencias bibliográficas empleadas en la investigación difundida se presentan completas en estilo APA. De este modo, los medios de comunicación disponen del acceso directo para conectar con la documentación original.

  • Aggarwal, P., Murahari, V., Rajpurohit, T., Kalyan, A., Narasimhan, K., y Deshpande, A. (2024). GEO: Generative engine optimization. En Proceedings of the 30th ACM SIGKDD Conference on Knowledge Discovery and Data Mining. ACM. https://doi.org/10.1145/3637528.3671900
  • Alcaraz Martínez, R., y Sulé, A. (2026). Generative engine optimization (GEO): Revisión de enfoques, métricas y estrategias. Ibersid, 20(1), Artículo 5156. https://doi.org/10.54886/ibersid.v20i1.5156
  • Bagga, P., Farias, V. F., Korkotashvili, T., Peng, T., y Wu, Y. (2025). E-GEO: A testbed for generative engine optimization in e-commerce [Preprint]. arXiv. https://doi.org/10.48550/arXiv.2511.20867
  • Chen, M., Wang, X., Chen, K., y Koudas, N. (2025). Generative engine optimization: How to dominate AI search [Preprint]. arXiv. https://doi.org/10.48550/arXiv.2509.08919
  • Chen, M., Wang, X., Chen, K., y Koudas, N. (2026). Navigating the shift: A comparative analysis of web search and generative AI response generation [Preprint]. arXiv. https://doi.org/10.48550/arXiv.2601.16858
  • Chen, X., y Liao, Y. (2025). Caption injection for optimization in generative search engine [Preprint]. arXiv. https://doi.org/10.48550/arXiv.2511.04080
  • Khedekar, P., y Bansal, G. (2026). Strategic GEO: How generative engine optimization reshapes competitive advantage in consumer markets. International Journal of Data Science and Machine Learning, 6(1). https://doi.org/10.55640/ijdsml-06-01-02
  • Kim, S., Jeong, W., Kim, S., Lee, S., y Lee, D. (2026). SAGEO Arena: A realistic environment for evaluating search-augmented generative engine optimization [Preprint]. arXiv. https://doi.org/10.48550/arXiv.2602.12187
  • Kumar, A., y Lakkaraju, H. (2024). Manipulating large language models to increase product visibility [Preprint]. arXiv. https://doi.org/10.48550/arXiv.2404.07981
  • Kumar, P. (2026). Generative engine optimization at scale: Measuring brand visibility across AI search engines [Preprint]. arXiv. https://doi.org/10.48550/arXiv.2606.20065
  • Liu, Z., y Xu, P. (2026). Think before writing: Feature-level multi-objective optimization for generative citation visibility [Preprint]. arXiv. https://doi.org/10.48550/arXiv.2604.19113
  • Lüttgenau, F., Colic, I., y Ramirez, G. (2025). Beyond SEO: A transformer-based approach for reinventing web content optimisation [Preprint]. arXiv. https://doi.org/10.48550/arXiv.2507.03169
  • Ma, L., Qin, J., Xu, X., y Tan, Y. (2025). When content is Goliath and algorithm is David: The style and semantic effects of generative search [Preprint]. arXiv. https://doi.org/10.48550/arXiv.2509.14436
  • Munn, Z., Peters, M. D. J., Stern, C., Tufanaru, C., McArthur, A., y Aromataris, E. (2018). Systematic review or scoping review? Guidance for authors when choosing between a systematic or scoping review approach. BMC Medical Research Methodology, 18, Artículo 143. https://doi.org/10.1186/s12874-018-0611-x
  • Murár, P. (2025). Reframing SEO for the age of generative engines. Media & Marketing Identity. https://doi.org/10.34135/mmidentity-2025-80
  • Nimase, O., Chen, Z., Qi, G., Zhao, Y., y Hu, X. (2026). GEO-Bench: Benchmarking ranking manipulation in generative engine optimization [Preprint]. arXiv. https://doi.org/10.48550/arXiv.2605.29107
  • Oruesagasti, J. (2026). Algorithmic trust and compliance: Benchmarking brand notability for UK iGaming entities in generative search [Preprint]. ResearchGate. https://doi.org/10.13140/rg.2.2.15316.46721
  • Pfrommer, S., Bai, Y., Gautam, T., y Sojoudi, S. (2024). Ranking manipulation for conversational search engines [Preprint]. arXiv. https://doi.org/10.48550/arXiv.2406.03589
  • Puerto, H., Gubri, M., Green, T., Oh, S. J., y Yun, S. (2025). C-SEO Bench: Does conversational SEO work? [Preprint]. arXiv. https://doi.org/10.48550/arXiv.2506.11097
  • Quintana-Gómez, Á. (2026). Generative engine optimization (GEO) y visibilidad de marcas en recomendaciones turísticas generadas por IA: Un análisis exploratorio. Revista Prisma Social, (52), 21-38. https://doi.org/10.65598/rps.5975
  • Rajpoot, P., y Raghuvanshi, D. R. (2026). An exploratory study on the impact of generative AI (Search Generative Experience – SGE) on organic visibility. International Scientific Journal of Engineering and Management. https://doi.org/10.55041/isjem06077
  • Reyes-Lillo, D., Morales-Vargas, A., y Rovira, C. (2025). Generative engine optimization en repositorios digitales: Optimización de la visibilidad para la IA generativa. INFONOMY, 3(5), Artículo e25034. https://doi.org/10.3145/infonomy.25.034
  • Schulte, J., Bleeker, M., y Kaufmann, P. (2026). Don’t measure once: Measuring visibility in AI search (GEO) [Preprint]. arXiv. https://doi.org/10.48550/arXiv.2604.07585
  • Tang, Y., Fan, Y., Yu, C., Yang, T., Zhao, Y., y Hu, X. (2025). StealthRank: LLM ranking manipulation via stealthy prompt optimization [Preprint]. arXiv. https://doi.org/10.48550/arXiv.2504.05804
  • Tian, Z., Chen, Y., Tang, Y., Liu, J., y Jia, R. (2026). Diagnosing and repairing citation failures in generative engine optimization [Preprint]. arXiv. https://doi.org/10.48550/arXiv.2603.09296
  • Tricco, A. C., Lillie, E., Zarin, W., O’Brien, K. K., Colquhoun, H., Levac, D., Moher, D., Peters, M. D. J., Horsley, T., Weeks, L., Hempel, S., … Straus, S. E. (2018). PRISMA Extension for Scoping Reviews (PRISMA-ScR): Checklist and explanation. Annals of Internal Medicine, 169(7), 467-473. https://doi.org/10.7326/M18-0850
  • Zhang, K., He, X., y Yao, J. (2026). From citation selection to citation absorption: A measurement framework for generative engine optimization [Preprint]. arXiv. https://doi.org/10.48550/arXiv.2604.25707
Por Alice Escalante Quesada