Saltar al contenido
Estudio original

Diez o más nombres de host citados en 28 de 253 respuestas de Google AI Overviews observadas

En la muestra de Bee LLM Observatory, alrededor de una de cada nueve respuestas con citas de Google AI Overviews alcanzó diez nombres de host distintos. El dato describe amplitud de referencias, no calidad.

5 min de lectura

Una lista extensa de fuentes en una minoría de respuestas

De las 253 respuestas con citas de Google AI Overviews observadas, 28 citaron al menos diez nombres de host distintos: el 11,07 %. Es aproximadamente una de cada nueve respuestas dentro de ese grupo. La cifra corresponde exclusivamente a respuestas muestreadas que contenían citas válidas; no indica qué porcentaje de todas las respuestas de ese canal incluye tantas referencias.

El resultado procede de preguntas monitorizadas por Bee LLM, con pesos desiguales entre preguntas y cuentas. Por tanto, permite describir una muestra concreta, pero no establecer la frecuencia habitual para cualquier usuario. Dentro de ese alcance, las respuestas con una lista tan amplia de hosts fueron una minoría.

Resultados de la muestra descrita en este artículo
Motor / canalRespuestas con citasRespuestas que cumplen el criterioPorcentaje
Gemini400256.25%
Google AI Overviews2532811.07%

Qué significa llegar a diez

La medida cuenta nombres de host distintos presentes en las citas de una respuesta. Un hostname es la parte de una dirección web que identifica el servidor o sitio al que apunta. Citar varias páginas del mismo hostname no multiplica su aportación al recuento: para este umbral importa cuántos nombres diferentes aparecen.

Conviene mantener esa precisión porque diez hostnames no equivalen necesariamente a diez organizaciones independientes. Los nombres pueden incluir subdominios, y el recuento no examina quién controla cada fuente. Tampoco mide diez argumentos distintos, diez comprobaciones de una afirmación ni diez perspectivas enfrentadas. Mide la extensión de la lista de hosts citados.

Amplitud de referencias no significa mayor fiabilidad

La lectura más directa es que algunas respuestas reúnen referencias distribuidas entre bastantes destinos web. Eso puede interesar al lector que quiera explorar las fuentes, pero el agregado no permite saber si cada enlace aporta información nueva, repite otra referencia o respalda adecuadamente la frase a la que acompaña.

El umbral tampoco distingue una respuesta que alcanza exactamente diez hostnames de otra que cita muchos más. Sin evaluar el contenido y la relación entre afirmaciones y fuentes, no puede convertirse este porcentaje en una nota de calidad. Una respuesta por debajo del umbral podría estar bien documentada; otra por encima podría requerir comprobaciones adicionales.

El resultado al dar el mismo peso a cada pregunta

La cifra principal, el 11,07 %, da el mismo peso a cada respuesta. Así, una pregunta que se haya ejecutado más veces aporta más observaciones al porcentaje. El segmento de Google AI Overviews comprende 70 prompts, es decir, preguntas o instrucciones utilizadas para obtener respuestas.

Como comprobación de sensibilidad, al dar el mismo peso a cada prompt el porcentaje es del 10,52 %. Esta variante mantiene la interpretación: aproximadamente una décima parte alcanza el umbral. No es un margen de error ni una estimación de la población general. Solo muestra cómo cambia el resumen al modificar el peso de las preguntas; no iguala también el de las cuentas.

Otro canal observado, sin comparación controlada

El agregado publicado también incluye Gemini: 25 de sus 400 respuestas con citas alcanzaron diez hostnames distintos, un 6,25 %, sobre 101 prompts. Al ponderar los prompts por igual, la cifra es del 7,78 %. Aquí el ajuste eleva el porcentaje, aunque las respuestas que alcanzan el umbral siguen siendo minoritarias.

Las cifras de ambos canales son descriptivas. No proceden de una prueba con las mismas preguntas y condiciones: pueden variar los prompts, el peso de las cuentas y los métodos de recogida. No justifican una clasificación de motores. Las etiquetas identifican canales de recogida; un canal API no debe confundirse con la aplicación de consumo correspondiente. Tampoco cabe atribuir cero a motores ausentes del agregado.

Cuándo y cómo se construyó la muestra

Este artículo se publica el 29 de septiembre de 2026. Las observaciones corresponden a siete días completos anteriores: desde el 21 de septiembre a las 00:00 hasta el 28 de septiembre a las 00:00, sin incluir ese último instante, en horario de Europe/Madrid. La fecha de publicación no forma parte del periodo observado.

La selección conserva la última respuesta por ejecución y modelo almacenado, únicamente de ejecuciones completadas y con texto no vacío ni de error. Excluye prompts de marca y cuentas cuyo correo contiene «demo». Cuenta las citas registradas con un método conocido, no cualquier dirección web detectada en el texto. Los registros vacíos o sin información de citas quedan fuera del denominador principal.

Qué cobertura tiene el dato

El control de calidad registra 2.459 respuestas válidas de motores conocidos. De ellas, 18 carecían de telemetría de citas, dejando 2.441 respuestas medidas; 2.138 tenían citas. Este conjunto con citas abarca 161 prompts, 29 proyectos y 26 cuentas. Es la cobertura global del agregado, no el tamaño de cada segmento publicado.

Para publicar segmentos se exigen al menos 100 respuestas, diez prompts, tres proyectos y tres cuentas; los casos que cumplen la medida deben abarcar al menos tres cuentas. Esos mínimos aportan cobertura, pero no convierten la muestra en representativa. Los datos no describen todas las conversaciones con IA ni cuotas de mercado, y no incluyen información individual de personas, cuentas, proyectos, preguntas o respuestas.

Preguntas frecuentes

¿El 11,07 % se refiere a todas las respuestas?

No. Se refiere a las 253 respuestas de Google AI Overviews muestreadas que tenían citas válidas. De ellas, 28 alcanzaron el umbral.

¿Diez hostnames significan diez fuentes independientes?

No necesariamente. El recuento identifica nombres distintos en las direcciones citadas, pero no verifica que pertenezcan a organizaciones independientes.

¿Publicar en más sitios garantiza aparecer citado?

No. Este agregado describe referencias observadas y no prueba ninguna relación causal entre publicar contenido y conseguir citas.