El glosario GEO para entender cómo te encuentra y cita la IA
Definiciones claras de búsqueda generativa, RAG, recuperación, citas y métricas. Incluye vocabulario utilizado en nuestro corpus de 369 investigaciones GEO, con una página propia para cada concepto.
Mostrando 92 términos
Fundamentos de GEO
Conceptos base de búsqueda generativa, motores de respuesta y modelos de lenguaje.
GEO
Generative Engine OptimizationGEO es la optimización de una marca y sus fuentes para ganar presencia, menciones y citas en respuestas generadas por IA. Incluye contenido, autoridad, accesibilidad técnica, distribución externa y medición.
Ver definición completaAEO
Answer Engine OptimizationAEO consiste en preparar contenido para que un motor de respuesta pueda extraer una contestación clara y directa. Se solapa con GEO, aunque AEO pone más énfasis en responder preguntas y GEO en la visibilidad dentro de respuestas generativas.
Ver definición completaLLM SEO
SEO para modelos de lenguajeLLM SEO es un nombre práctico para las acciones destinadas a mejorar cómo los modelos de lenguaje encuentran, entienden y representan una marca. En el mercado suele utilizarse como sinónimo aproximado de GEO.
Ver definición completaBúsqueda con IA
Búsqueda asistida o generada por inteligencia artificialLa búsqueda con IA devuelve una respuesta sintetizada, una conversación o una recomendación en lugar de limitarse a ordenar enlaces. Puede usar memoria del modelo, búsqueda web en vivo o ambas.
Ver definición completaMotor generativo
Sistema que recupera o usa conocimiento y genera una respuestaUn motor generativo combina un modelo de IA con mecanismos de búsqueda, recuperación o herramientas para redactar una respuesta nueva. La salida puede incluir citas, enlaces, productos, mapas o recomendaciones.
Ver definición completaMotor de respuesta
Sistema que entrega una respuesta directa a una consultaUn motor de respuesta intenta resolver la consulta en la propia interfaz. Puede ser generativo o basarse en fragmentos, bases de conocimiento y resultados estructurados.
Ver definición completaBúsqueda sin clic
Consulta resuelta sin visitar un resultado externoUna búsqueda sin clic termina en la interfaz del buscador o asistente porque el usuario obtiene allí la información necesaria. En IA puede existir visibilidad de marca aunque no llegue una sesión web.
Ver definición completaAI Overviews
Resúmenes generados por IA en Google SearchAI Overviews son respuestas generadas que Google muestra para determinadas búsquedas y que pueden enlazar fuentes de apoyo. La composición y las fuentes pueden variar entre consultas, ubicaciones y momentos.
Ver definición completaModo IA de Google
Experiencia conversacional de búsqueda de GoogleEl Modo IA de Google amplía la búsqueda a una experiencia conversacional con respuestas generadas, seguimiento de preguntas y enlaces a fuentes. No debe medirse como si fuera idéntico a AI Overviews.
Ver definición completaModelo de lenguaje grande
LLMUn modelo de lenguaje grande aprende patrones de enormes colecciones de texto para predecir y generar lenguaje. Puede responder desde sus parámetros o conectarse a búsqueda, RAG y herramientas externas.
Ver definición completaPrompt
Instrucción o consulta enviada a un modeloUn prompt es el texto y el contexto que orientan la respuesta del modelo. En GEO representa una necesidad de búsqueda que puede formularse de muchas maneras y producir resultados distintos.
Ver definición completaConsulta de marca
Consulta que incluye el nombre de una marca o productoUna consulta de marca pregunta de forma explícita por una empresa, producto o persona. Suele medir reconocimiento y exactitud, no la capacidad de ser descubierto entre alternativas.
Ver definición completaConsulta sin marca
Consulta que expresa una necesidad sin nombrar una marcaUna consulta sin marca pide opciones, soluciones o comparaciones sin indicar qué empresa debe aparecer. Es la superficie principal para medir descubrimiento y competencia en respuestas de IA.
Ver definición completaRecuperación y RAG
Cómo una IA encuentra, filtra, ordena y usa información antes de responder.
RAG
Generación aumentada por recuperaciónRAG es una arquitectura en la que el sistema recupera documentos o fragmentos relevantes y los añade al contexto antes de generar la respuesta. Permite usar información externa, reciente o privada.
Ver definición completaRecuperador
Componente que encuentra documentos o fragmentos candidatosEl recuperador busca información relacionada con la consulta dentro de un índice, la web o una base vectorial. Su salida alimenta etapas posteriores de reranking y generación.
Ver definición completaGenerador
Componente que redacta la respuesta finalEl generador es el modelo que transforma instrucciones y contexto recuperado en una respuesta. Puede omitir, resumir o combinar fuentes aunque estas hayan sido recuperadas correctamente.
Ver definición completaGrounding web
Uso de resultados web para respaldar una respuestaEl grounding web conecta la generación con páginas recuperadas en tiempo real. Reduce la dependencia exclusiva de la memoria del modelo y puede producir enlaces o citas visibles.
Ver definición completaGrounding
Anclaje de una respuesta en evidencia disponibleGrounding es el vínculo entre las afirmaciones generadas y una fuente, dato o contexto que las respalda. Un sistema bien anclado puede verificar mejor qué dice y de dónde procede.
Ver definición completaRecuperación de información
Proceso de localizar información relevante para una consultaLa recuperación selecciona documentos o pasajes antes de que se genere una respuesta. Puede utilizar coincidencia léxica, señales de ranking, embeddings o una combinación.
Ver definición completaReranking
Reordenado de candidatos después de la recuperación inicialEl reranking vuelve a puntuar un conjunto reducido de documentos o fragmentos con un modelo más preciso. Una fuente puede ser recuperada y aun así caer antes de llegar al generador.
Ver definición completaConjunto de fuentes candidatas
Grupo de documentos considerados antes de generarEl conjunto candidato reúne las fuentes que han superado una primera recuperación. Si una página no entra en ese grupo, el generador no puede elegirla ni citarla.
Ver definición completaQuery fan-out
Descomposición de una consulta en varias subconsultasQuery fan-out es el proceso por el que un motor expande una pregunta compleja en búsquedas más pequeñas. Las fuentes recuperadas para esas subconsultas se combinan después en una respuesta.
Ver definición completaConsulta sintética
Consulta generada por un sistema para recuperar informaciónUna consulta sintética no procede literalmente del usuario: la crea el motor para reformular, ampliar o dividir su necesidad. Puede usar vocabulario distinto al prompt original.
Ver definición completaBúsqueda semántica
Recuperación basada en significado y no solo en palabras exactasLa búsqueda semántica representa consultas y documentos por su significado para encontrar contenido conceptualmente relacionado. Suele apoyarse en embeddings y medidas de similitud.
Ver definición completaEmbedding
Representación numérica del significado de un contenidoUn embedding convierte texto, imagen u otro contenido en un vector. Elementos semánticamente parecidos quedan próximos y pueden recuperarse mediante similitud.
Ver definición completaBase de datos vectorial
Sistema que almacena y busca vectores por similitudUna base vectorial indexa embeddings para recuperar elementos cercanos a una consulta. Es una pieza habitual en sistemas RAG empresariales y buscadores semánticos.
Ver definición completaChunking
División de documentos en fragmentos recuperablesChunking divide un documento largo en unidades que pueden indexarse y recuperarse. Un fragmento demasiado corto pierde contexto; uno demasiado largo mezcla temas y reduce precisión.
Ver definición completaTop-k
Número de resultados superiores que conserva un sistemaTop-k indica cuántos documentos, fragmentos o candidatos pasan a la siguiente etapa. Un k pequeño aumenta la exigencia de ranking; uno grande aporta cobertura pero también ruido.
Ver definición completaVentana de contexto
Cantidad de información que un modelo puede procesar en una interacciónLa ventana de contexto limita el texto, instrucciones, historial y fragmentos recuperados que el modelo considera al responder. El contenido disponible puede truncarse o competir por atención.
Ver definición completaFecha de corte
Límite temporal aproximado de los datos de entrenamientoLa fecha de corte marca hasta cuándo llega el conocimiento aprendido durante el entrenamiento. No impide que un producto conectado a búsqueda use información posterior.
Ver definición completaRecuperación en tiempo real
Búsqueda de información durante la generación de la respuestaLa recuperación en tiempo real permite consultar fuentes actuales en el momento de responder. La latencia, el acceso del bot y el índice del proveedor influyen en qué páginas aparecen.
Ver definición completaGrafo de conocimiento
Red de entidades y relaciones estructuradasUn grafo de conocimiento representa personas, marcas, productos, lugares y sus relaciones. Ayuda a resolver ambigüedades y a conectar hechos procedentes de varias fuentes.
Ver definición completaEntidad
Objeto identificable como una marca, persona, producto o lugarUna entidad es algo que un sistema puede distinguir y relacionar con propiedades y otras entidades. La desambiguación correcta evita que una marca se confunda con términos o empresas similares.
Ver definición completaProminencia de entidad
Importancia relativa de una entidad dentro de un contenidoLa prominencia de entidad expresa si una marca o concepto es central o meramente incidental en un documento. No equivale a contar cuántas veces aparece el nombre.
Ver definición completaRAG multifuente
RAG que combina evidencia de varias fuentesUn RAG multifuente recupera y sintetiza información de distintos documentos, dominios o colecciones. Puede aumentar cobertura, pero también introduce conflictos y problemas de atribución.
Ver definición completaRecuperación de pasajes
Selección de fragmentos concretos en lugar de documentos completosLa recuperación de pasajes busca el bloque más relevante dentro de una página. Por eso una URL bien posicionada puede no aportar el fragmento que el generador necesita.
Ver definición completaLegibilidad para máquinas
Facilidad con la que un sistema interpreta contenido y datosLa legibilidad para máquinas depende de HTML semántico, estructura estable, datos claros y relaciones explícitas. No significa escribir para robots ni sacrificar la experiencia humana.
Ver definición completaCitas y fuentes
Términos para evaluar atribución, grounding, selección de fuentes y alucinaciones.
Citación
Referencia visible a una fuente dentro de una respuestaUna citación enlaza, identifica o atribuye parte de una respuesta a una fuente. Debe medirse por separado de una simple mención de marca.
Ver definición completaAtribución de fuente
Asignación explícita de una afirmación a su origenLa atribución indica qué fuente respalda una afirmación concreta. Una respuesta puede mostrar enlaces y aun atribuir mal el dato o asociarlo con la fuente equivocada.
Ver definición completaGrounding de citas
Grado en que una cita respalda realmente el texto generadoEl grounding de citas evalúa si la evidencia enlazada contiene lo necesario para justificar la afirmación. No basta con que fuente y respuesta hablen del mismo tema.
Ver definición completaExactitud de citas
Proporción o calidad de citas que respaldan correctamente una afirmaciónLa exactitud de citas mide si cada referencia es pertinente y fiel a su contenido. Detecta citas decorativas, descontextualizadas o asociadas a afirmaciones incorrectas.
Ver definición completaCobertura de citas
Grado en que las afirmaciones verificables tienen respaldoLa cobertura de citas comprueba cuántas afirmaciones que necesitan evidencia están acompañadas por una fuente. Una respuesta puede tener citas correctas pero dejar muchos hechos sin respaldar.
Ver definición completaSelección de fuentes
Proceso de elegir qué fuentes usa o muestra el motorLa selección de fuentes ocurre después de recuperar candidatos y puede depender de relevancia, autoridad, frescura, diversidad y utilidad para la respuesta.
Ver definición completaDiversidad de fuentes
Variedad de dominios, formatos y perspectivas utilizadasLa diversidad de fuentes mide si una respuesta depende de pocos dominios o combina perspectivas independientes. Más fuentes no garantizan mejor evidencia si se copian entre sí.
Ver definición completaFrescura de la fuente
Edad o actualidad de la fuente elegida por el motorLa frescura de la fuente compara la fecha de publicación o actualización con el momento de la consulta. Su importancia cambia según la intención y la estabilidad del tema.
Ver definición completaProbabilidad de cita
Estimación de la posibilidad de que una fuente sea citadaLa probabilidad de cita resume señales que favorecen que una URL pase de ser candidata a aparecer como respaldo visible. Es una estimación, no una garantía por consulta.
Ver definición completaCitabilidad
Facilidad con la que una fuente puede ser utilizada y citadaLa citabilidad reúne claridad, extractabilidad, evidencia, atribución y encaje con la consulta. Un contenido puede ser bueno para humanos y difícil de convertir en un fragmento respaldable.
Ver definición completaAlucinación de IA
Contenido generado que parece plausible pero no está respaldadoUna alucinación ocurre cuando el modelo inventa o distorsiona hechos, fuentes o relaciones. En marca puede afectar precios, servicios, ubicaciones, personas o reputación.
Ver definición completaConcentración de fuentes
Peso acumulado de las citas en un grupo pequeño de dominiosLa concentración de fuentes muestra si unas pocas webs dominan las citas para un tema o motor. Una concentración alta hace más difícil entrar desde un dominio nuevo.
Ver definición completaContenido y autoridad
Señales que hacen que una fuente sea interpretable, recuperable y útil para una respuesta.
Datos estructurados
Datos con un formato explícito que describe entidades y propiedadesLos datos estructurados hacen que productos, organizaciones, autores, fechas y relaciones sean más fáciles de interpretar. En la web suelen implementarse con vocabulario Schema.org.
Ver definición completaMarcado Schema
Implementación de vocabulario Schema.org en una páginaEl marcado Schema describe de forma estructurada qué tipo de entidad o contenido aparece en una URL. JSON-LD es una sintaxis habitual, pero el marcado no sustituye al contenido visible.
Ver definición completaDefinedTerm
Tipo de Schema.org para representar un término definidoDefinedTerm permite declarar el nombre, descripción y pertenencia de un concepto a un glosario o conjunto terminológico. Ayuda a expresar la función semántica de una página como esta.
Ver definición completallms.txt
Propuesta de archivo para orientar sistemas de IA hacia contenido útilllms.txt es una convención propuesta para resumir y enlazar contenido relevante para modelos y agentes. No es un estándar universal ni garantiza indexación, recuperación o citas.
Ver definición completaGanancia de información
Valor nuevo que una fuente aporta frente a lo ya disponibleLa ganancia de información expresa cuánto conocimiento útil y diferencial añade una página. Datos propios, metodología, ejemplos y síntesis originales aumentan su valor potencial como fuente.
Ver definición completaFrescura del contenido
Actualidad material de la información publicadaLa frescura del contenido depende de si los hechos siguen vigentes, no solo de cambiar la fecha. Pesa más en precios, software, noticias y comparaciones que en conceptos estables.
Ver definición completaAutoridad temática
Percepción de competencia sostenida sobre un temaLa autoridad temática surge de cubrir un campo con profundidad, coherencia, experiencia y conexiones claras entre contenidos. No se obtiene publicando muchas páginas superficiales.
Ver definición completaEarned media
Cobertura o menciones obtenidas en canales de tercerosEarned media incluye noticias, reseñas, análisis, comunidades y referencias editoriales que la marca no controla directamente. Puede aportar corroboración y acceso a dominios que los motores ya citan.
Ver definición completaE-E-A-T
Experiencia, conocimiento, autoridad y confianzaE-E-A-T es un marco de calidad asociado a Google para valorar señales de experiencia, pericia, autoridad y confianza. En GEO sirve como lenguaje útil para revisar credenciales y fiabilidad, no como una puntuación directa del LLM.
Ver definición completaPR digital
Relaciones públicas orientadas a cobertura y autoridad onlineLa PR digital crea activos, estudios y relatos que pueden obtener menciones y enlaces editoriales. En GEO amplía las fuentes externas que describen y validan una entidad.
Ver definición completaExtractabilidad del contenido
Facilidad para aislar un pasaje útil sin perder su significadoLa extractabilidad indica si un sistema puede separar una respuesta, dato o lista y conservar sujeto, contexto y condiciones. Depende de estructura y redacción, no solo de formato técnico.
Ver definición completaFormato de respuesta directa
Estructura que responde pronto y amplía despuésEl formato de respuesta directa coloca una definición o conclusión clara al inicio y desarrolla después matices, pruebas y excepciones. Facilita extracción sin reducir el contenido a una frase.
Ver definición completaGEO multimodal
Optimización para sistemas que combinan texto, imagen, audio o vídeoEl GEO multimodal estudia cómo los sistemas entienden y ordenan contenido formado por varias modalidades. La coherencia entre imagen, texto, metadatos y página de destino gana importancia.
Ver definición completaModelo visión-lenguaje
VLMUn modelo visión-lenguaje procesa conjuntamente imágenes y texto para describir, comparar, buscar o clasificar contenido. Algunos estudios GEO analizan cómo estos modelos reordenan productos y resultados.
Ver definición completaEnlazado interno
Red de enlaces entre páginas de un mismo sitioEl enlazado interno ayuda a descubrir contenido, distribuir contexto y expresar relaciones temáticas. En un glosario conecta cada término con su conjunto y con conceptos vecinos.
Ver definición completaRastreabilidad
Capacidad de un bot para acceder y recorrer un sitioLa rastreabilidad depende de respuestas HTTP, robots, enlaces, renderizado y estabilidad técnica. Una página inaccesible no puede entrar en muchos procesos de recuperación.
Ver definición completaMedición de visibilidad
Métricas para comparar marcas, motores, prompts, fuentes y cambios a lo largo del tiempo.
Visibilidad en IA
Presencia medible de una entidad en respuestas de IALa visibilidad en IA combina si una marca aparece, con qué frecuencia, en qué posición, con qué sentimiento y qué fuentes la acompañan. Debe definirse antes de comparar herramientas.
Ver definición completaMención de marca
Aparición explícita o reconocible de una marcaUna mención de marca ocurre cuando la respuesta nombra o identifica la empresa, producto o variante. Puede existir sin enlace y puede ser positiva, neutra o negativa.
Ver definición completaTasa de recomendación
Porcentaje de respuestas donde una marca es recomendadaLa tasa de recomendación cuenta respuestas donde la marca aparece como opción aconsejada, no cualquier mención. Requiere clasificar el rol semántico de la marca dentro de la respuesta.
Ver definición completaRol de la mención
Función semántica que cumple una marca en la respuestaEl rol de la mención distingue recomendación, alternativa, comparación, advertencia, ejemplo o referencia incidental. Aporta más información que un conteo binario.
Ver definición completaTasa de mención
Porcentaje de respuestas en las que aparece una entidadLa tasa de mención divide las respuestas con presencia de marca entre el total de ejecuciones válidas. Debe excluir errores técnicos y segmentarse por prompt y motor.
Ver definición completaTasa de citación
Porcentaje de respuestas que citan una fuente o dominioLa tasa de citación mide la frecuencia con la que una URL, dominio o marca aparece como fuente visible. Su denominador puede ser respuestas, prompts o ejecuciones y debe declararse.
Ver definición completaShare of voice en IA
Cuota de presencia de una marca frente a competidoresEl share of voice en IA compara la presencia de una marca con el total de menciones o visibilidad de un conjunto competitivo. La fórmula puede ponderar posición, motor o rol.
Ver definición completaSentimiento de marca
Tono o valoración con la que una IA describe una marcaEl sentimiento clasifica el tratamiento de una entidad como positivo, neutro, mixto o negativo. El contexto y el rol importan más que palabras aisladas.
Ver definición completaPuntuación de visibilidad
Índice compuesto que resume varias señales de presenciaUna puntuación de visibilidad combina métricas como mención, posición, recomendación o cobertura de motores. No existe una fórmula universal, por lo que dos plataformas pueden dar valores distintos.
Ver definición completaPosición media en IA
Promedio del orden en que aparece una marca dentro de respuestasLa posición media resume el lugar de la marca en listas o recomendaciones. Requiere reglas para respuestas sin lista, menciones repetidas y marcas ausentes.
Ver definición completaMonitorización de prompts
Ejecución repetida de consultas para medir cambiosLa monitorización de prompts repite un conjunto estable de preguntas en motores y contextos definidos. Permite observar menciones, citas, sentimiento y volatilidad.
Ver definición completaVolatilidad de respuestas
Variación de resultados entre ejecuciones equivalentesLa volatilidad refleja que un mismo prompt puede producir marcas, posiciones o fuentes diferentes. Depende del muestreo, el índice, la personalización y cambios del motor.
Ver definición completaSolapamiento con resultados orgánicos
Coincidencia entre fuentes citadas por IA y resultados SEOEl solapamiento compara dominios o URLs de respuestas generativas con los resultados tradicionales para la misma consulta. Un valor bajo indica ecosistemas de selección diferentes.
Ver definición completaDiscovery gap
Brecha entre ser reconocido por nombre y ser descubiertoDiscovery gap describe marcas que una IA reconoce cuando se nombran, pero no recomienda en consultas genéricas. Separa conocimiento de marca de visibilidad competitiva.
Ver definición completaSesgo de exposición
Distribución desigual de visibilidad entre entidades o fuentesEl sesgo de exposición aparece cuando marcas, creadores o dominios ya prominentes reciben de forma sistemática más presencia. Puede reforzar jerarquías existentes.
Ver definición completaMétricas de investigación
Medidas utilizadas en estudios para cuantificar ranking, estabilidad, solapamiento y riesgo.
NDCG
Normalized Discounted Cumulative GainNDCG evalúa un ranking teniendo en cuenta la relevancia y dando más peso a las posiciones superiores. Se normaliza para poder comparar consultas con conjuntos distintos.
Ver definición completaSimilitud de Jaccard
Medida del solapamiento entre dos conjuntosJaccard divide los elementos compartidos por la unión de dos conjuntos. En GEO puede comparar dominios citados, marcas recomendadas o resultados entre ejecuciones.
Ver definición completaKendall tau
Correlación de orden entre dos rankingsKendall tau mide cuántos pares conservan el mismo orden entre dos rankings. En investigación GEO ayuda a estudiar estabilidad de posiciones o influencia.
Ver definición completaTasa de promoción
Frecuencia con la que una optimización eleva un elemento al objetivoPromotion success rate mide si un documento o producto alcanza un umbral como top 5, top 3 o primera posición después de una intervención.
Ver definición completaRendimiento en el peor caso
Resultado mínimo observado entre consultas o escenariosWorst-case performance evalúa la cola negativa en lugar de quedarse con la media. En GEO multiconsulta revela si una edición mejora unas preguntas pero perjudica gravemente otras.
Ver definición completaRiesgo a la baja
Magnitud o frecuencia de pérdidas frente a una referenciaDownside risk centra la evaluación en degradaciones, no en variación positiva. Permite saber cuánto empeoran las consultas perjudicadas por un cambio.
Ver definición completaTasa de victoria o empate
Proporción de casos que mejoran o no empeoranWin-tie rate cuenta consultas donde una intervención gana o empata respecto a la referencia. Complementa la mejora media con una medida de consistencia.
Ver definición completaRiesgos y manipulación
Prácticas y ataques que pueden degradar la calidad o manipular una respuesta generativa.
Prompt injection
Instrucciones maliciosas insertadas en contenido o entradasPrompt injection intenta cambiar el comportamiento de un modelo mediante instrucciones que el sistema no debería seguir. Puede aparecer en páginas recuperadas, documentos o mensajes de usuario.
Ver definición completaEnvenenamiento de contenido
Publicación o alteración de información para contaminar respuestasEl envenenamiento de contenido introduce datos falsos o manipulados en fuentes que un modelo puede recuperar o aprender. Busca alterar hechos, recomendaciones o reputación.
Ver definición completaGEO adversarial
Técnicas diseñadas para manipular ranking o generaciónEl GEO adversarial estudia cambios engañosos o ataques que explotan recuperadores, rerankers o modelos multimodales para obtener exposición no merecida.
Ver definición completaKeyword stuffing
Repetición artificial de palabras para influir en recuperación o rankingKeyword stuffing inserta términos de forma excesiva o poco natural con intención de manipular relevancia. Puede reducir claridad, confianza y utilidad del pasaje.
Ver definición completaManipulación de fuentes
Intento de alterar qué fuentes recupera, elige o cita un sistemaLa manipulación de fuentes busca forzar selección o atribución mediante señales engañosas, redes artificiales o contenido diseñado para explotar el pipeline.
Ver definición completaNo hay términos que coincidan con esa búsqueda.
