Comparación publicada

Cómo se mide el benchmark de Obside

La comparación de la página de inicio es un benchmark de producción, no un gráfico ilustrativo. Esta página publica los resultados agregados, el protocolo de evaluación y las limitaciones necesarias para interpretarlo.

Instantánea del benchmark

Asistentes en producción, datos de referencia en vivo, puntuación a ciegas.

Resultados agregados

Las mismas puntuaciones publicadas, una sola fuente de verdad

El gráfico de la página de inicio y el resultado descargable usan este mismo conjunto de datos. Las puntuaciones combinan exactitud, relevancia y frescura en una escala de 10 puntos.

AsistentePuntuación / 10
Obside
9.7
ChatGPT
8.4
Gemini
8.1
DeepSeek
8.0
Claude
7.9

Protocolo de evaluación

Mismos prompts, respuestas anonimizadas

  1. 01Cada asistente recibe el mismo conjunto de prompts financieros.
  2. 02Las respuestas se recogen con acceso a datos en vivo o búsqueda web activado cuando el producto lo permite.
  3. 03Los nombres de los modelos se eliminan antes de la evaluación.
  4. 04Un juez neutral independiente puntúa cada respuesta frente a datos de referencia en vivo.
  5. 05Las puntuaciones por dimensión se agregan y normalizan en una escala de 10 puntos.

Interpretación

Una instantánea, no un ranking universal

Los resultados describen este conjunto de prompts y los productos disponibles durante la ejecución de julio de 2026. Las versiones de los modelos, los sistemas de búsqueda, las condiciones de mercado y la disponibilidad de datos cambian con el tiempo, así que futuras ejecuciones pueden producir rankings distintos.

El benchmark mide la calidad de las respuestas a preguntas financieras. No mide rendimientos de inversión y no constituye asesoramiento financiero.