Veröffentlichter Vergleich

So wird der Obside-Benchmark gemessen

Der Vergleich auf der Startseite ist ein Produktions-Benchmark, keine illustrative Grafik. Diese Seite veröffentlicht die aggregierten Ergebnisse, das Bewertungsprotokoll und die Grenzen, die zur Interpretation nötig sind.

Benchmark-Snapshot

Produktions-Assistenten, Live-Referenzdaten, verblindete Bewertung.

Aggregierte Ergebnisse

Dieselben veröffentlichten Scores, eine Quelle der Wahrheit

Das Startseiten-Diagramm und das herunterladbare Ergebnis nutzen denselben Datensatz. Die Scores kombinieren Genauigkeit, Relevanz und Aktualität auf einer 10-Punkte-Skala.

AssistentScore / 10
Obside
9.7
ChatGPT
8.4
Gemini
8.1
DeepSeek
8.0
Claude
7.9

Bewertungsprotokoll

Gleiche Prompts, anonymisierte Antworten

  1. 01Jeder Assistent erhält dasselbe Set an Finanz-Prompts.
  2. 02Antworten werden mit aktiviertem Live-Daten- oder Websuche-Zugang gesammelt, wo das Produkt es unterstützt.
  3. 03Modellnamen werden vor der Bewertung entfernt.
  4. 04Ein separater neutraler Richter bewertet jede Antwort gegen Live-Referenzdaten.
  5. 05Die Dimensions-Scores werden aggregiert und auf eine 10-Punkte-Skala normalisiert.

Interpretation

Eine Momentaufnahme, kein universelles Ranking

Die Ergebnisse beschreiben dieses Prompt-Set und die im Juli-2026-Lauf verfügbaren Produkte. Modellversionen, Suchsysteme, Marktbedingungen und Datenverfügbarkeit ändern sich; künftige Läufe können andere Rankings ergeben.

Der Benchmark misst die Antwortqualität bei Finanzfragen. Er misst keine Anlagerenditen und ist keine Finanzberatung.