CLIRO DATASET
Qué citan realmente los motores de IA,medido todos los días
Cliro corre prompts contra los principales motores de IA todos los días y registra qué marcas se mencionan y qué fuentes se citan. Esta página explica qué mide ese dataset, cómo se recolecta y qué no prueba.
- Sale de respuestas reales, no de lo que el modelo dice de sí mismo
- El mismo método de recolección en todos los motores
- El método y los límites se publican junto con los números
De un vistazo
- Motores de IA cubiertos
- 7
- Frecuencia de recolección
- Diario
Acá sólo figuran cifras que efectivamente medimos. Lo que todavía no está publicado se omite en vez de estimarse.
Qué hay en el dataset
Cada registro ata una respuesta de un motor a las marcas mencionadas y a las fuentes citadas en ella. La cobertura abarca ChatGPT, Gemini, Claude, Perplexity, Grok, Google AI Mode y Microsoft Copilot.
Por motor
Cada respuesta se atribuye al motor que la produjo, así la cobertura se compara motor por motor en vez de promediarse en un solo número.
Por categoría
Los prompts se agrupan por industria e intención de compra, que es lo que hace comparable la visibilidad entre marcas que compiten por las mismas respuestas.
Por mercado
Las respuestas se recolectan por mercado, así una marca visible en un país e invisible en otro no se promedia en un medio engañoso.
Por fuente citada
Cada citación conserva el dominio del que salió, que es lo que vuelve accionable la visibilidad: se ve qué sitios leen realmente los modelos.
En el tiempo
La recolección es continua, así los cambios se leen como tendencia y no como una foto suelta que puede o no ser representativa.
Cómo se recolecta
El método completo en cuatro pasos. Si un número de esta página no se puede rastrear a través de ellos, no va acá.
- 1
Los prompts se ejecutan, no se scrapean
Cada prompt se manda a cada motor y la respuesta se guarda tal como fue servida. No se infiere nada de lo que el modelo diga sobre sí mismo.
- 2
Menciones y citaciones van separadas
Una marca nombrada en el texto y una fuente linkeada como cita se registran como cosas distintas, porque lo son: ser mencionado y ser la fuente no son el mismo tipo de visibilidad.
- 3
La agregación va después de la atribución
Las tasas se calculan siempre sobre respuestas totales, nunca sobre menciones, así una marca no puede verse mejor simplemente por aparecer en menos respuestas.
- 4
La recolección es continua
Los prompts se vuelven a correr con una frecuencia fija, que es lo que hace comparable la serie en el tiempo en vez de dejar fotos sueltas.
Qué no prueba este dataset
Va adelante, porque los límites son lo que hace confiable al resto.
No es un censo de las respuestas de IA
Cubre los prompts que se trackean, no todo lo que pregunta cualquiera. Describe una muestra medida y así hay que leerlo.
El resultado depende de los prompts
Cambiás la redacción y cambia la respuesta. Las comparaciones sólo valen entre marcas medidas sobre el mismo set de prompts.
Los modelos cambian debajo del dato
Los motores actualizan sus modelos sin avisar, así que un salto de visibilidad puede venir del modelo y no de algo que haya hecho la marca.
Cómo citar este dataset
El uso de las cifras es libre, también comercial. Sólo pedimos atribución con link, que es además lo que le permite a un lector verificar el número.
Cita sugerida
Cliro Dataset, Cliro — https://www.usecliro.com/cliro-dataset
