CLIRO DATASET

Qué citan realmente los motores de IA,medido todos los días

Cliro corre prompts contra los principales motores de IA todos los días y registra qué marcas se mencionan y qué fuentes se citan. Esta página explica qué mide ese dataset, cómo se recolecta y qué no prueba.

  • Sale de respuestas reales, no de lo que el modelo dice de sí mismo
  • El mismo método de recolección en todos los motores
  • El método y los límites se publican junto con los números

De un vistazo

Motores de IA cubiertos
7
Frecuencia de recolección
Diario

Acá sólo figuran cifras que efectivamente medimos. Lo que todavía no está publicado se omite en vez de estimarse.

Qué hay en el dataset

Cada registro ata una respuesta de un motor a las marcas mencionadas y a las fuentes citadas en ella. La cobertura abarca ChatGPT, Gemini, Claude, Perplexity, Grok, Google AI Mode y Microsoft Copilot.

Por motor

Cada respuesta se atribuye al motor que la produjo, así la cobertura se compara motor por motor en vez de promediarse en un solo número.

Por categoría

Los prompts se agrupan por industria e intención de compra, que es lo que hace comparable la visibilidad entre marcas que compiten por las mismas respuestas.

Por mercado

Las respuestas se recolectan por mercado, así una marca visible en un país e invisible en otro no se promedia en un medio engañoso.

Por fuente citada

Cada citación conserva el dominio del que salió, que es lo que vuelve accionable la visibilidad: se ve qué sitios leen realmente los modelos.

En el tiempo

La recolección es continua, así los cambios se leen como tendencia y no como una foto suelta que puede o no ser representativa.

Cómo se recolecta

El método completo en cuatro pasos. Si un número de esta página no se puede rastrear a través de ellos, no va acá.

  1. 1

    Los prompts se ejecutan, no se scrapean

    Cada prompt se manda a cada motor y la respuesta se guarda tal como fue servida. No se infiere nada de lo que el modelo diga sobre sí mismo.

  2. 2

    Menciones y citaciones van separadas

    Una marca nombrada en el texto y una fuente linkeada como cita se registran como cosas distintas, porque lo son: ser mencionado y ser la fuente no son el mismo tipo de visibilidad.

  3. 3

    La agregación va después de la atribución

    Las tasas se calculan siempre sobre respuestas totales, nunca sobre menciones, así una marca no puede verse mejor simplemente por aparecer en menos respuestas.

  4. 4

    La recolección es continua

    Los prompts se vuelven a correr con una frecuencia fija, que es lo que hace comparable la serie en el tiempo en vez de dejar fotos sueltas.

Qué no prueba este dataset

Va adelante, porque los límites son lo que hace confiable al resto.

  • No es un censo de las respuestas de IA

    Cubre los prompts que se trackean, no todo lo que pregunta cualquiera. Describe una muestra medida y así hay que leerlo.

  • El resultado depende de los prompts

    Cambiás la redacción y cambia la respuesta. Las comparaciones sólo valen entre marcas medidas sobre el mismo set de prompts.

  • Los modelos cambian debajo del dato

    Los motores actualizan sus modelos sin avisar, así que un salto de visibilidad puede venir del modelo y no de algo que haya hecho la marca.

Cómo citar este dataset

El uso de las cifras es libre, también comercial. Sólo pedimos atribución con link, que es además lo que le permite a un lector verificar el número.

Cita sugerida

Cliro Dataset, Cliro — https://www.usecliro.com/cliro-dataset