Veröffentlichter Vergleich
So wird der Obside-Benchmark gemessen
Der Vergleich auf der Startseite ist ein Produktions-Benchmark, keine illustrative Grafik. Diese Seite veröffentlicht die aggregierten Ergebnisse, das Bewertungsprotokoll und die Grenzen, die zur Interpretation nötig sind.
Benchmark-Snapshot
Produktions-Assistenten, Live-Referenzdaten, verblindete Bewertung.
Aggregierte Ergebnisse
Dieselben veröffentlichten Scores, eine Quelle der Wahrheit
Das Startseiten-Diagramm und das herunterladbare Ergebnis nutzen denselben Datensatz. Die Scores kombinieren Genauigkeit, Relevanz und Aktualität auf einer 10-Punkte-Skala.
| Assistent | Score / 10 |
|---|---|
| Obside | 9.7 |
| ChatGPT | 8.4 |
| Gemini | 8.1 |
| DeepSeek | 8.0 |
| Claude | 7.9 |
Bewertungsprotokoll
Gleiche Prompts, anonymisierte Antworten
- 01Jeder Assistent erhält dasselbe Set an Finanz-Prompts.
- 02Antworten werden mit aktiviertem Live-Daten- oder Websuche-Zugang gesammelt, wo das Produkt es unterstützt.
- 03Modellnamen werden vor der Bewertung entfernt.
- 04Ein separater neutraler Richter bewertet jede Antwort gegen Live-Referenzdaten.
- 05Die Dimensions-Scores werden aggregiert und auf eine 10-Punkte-Skala normalisiert.
Interpretation
Eine Momentaufnahme, kein universelles Ranking
Die Ergebnisse beschreiben dieses Prompt-Set und die im Juli-2026-Lauf verfügbaren Produkte. Modellversionen, Suchsysteme, Marktbedingungen und Datenverfügbarkeit ändern sich; künftige Läufe können andere Rankings ergeben.
Der Benchmark misst die Antwortqualität bei Finanzfragen. Er misst keine Anlagerenditen und ist keine Finanzberatung.