공개된 비교
Obside 벤치마크는 어떻게 측정되나
홈페이지의 비교는 프로덕션 벤치마크이지, 설명용 차트가 아닙니다. 이 페이지는 종합 결과, 평가 프로토콜, 해석에 필요한 한계를 공개합니다.
벤치마크 스냅샷
프로덕션 어시스턴트, 라이브 참조 데이터, 블라인드 채점.
종합 결과
공개된 점수와 동일, 단일한 출처
홈페이지 차트와 다운로드 가능한 결과는 이 동일한 데이터셋을 사용합니다. 점수는 정확성, 관련성, 신선도를 10점 척도로 결합합니다.
| 어시스턴트 | 점수 / 10 |
|---|---|
| Obside | 9.7 |
| ChatGPT | 8.4 |
| Gemini | 8.1 |
| DeepSeek | 8.0 |
| Claude | 7.9 |
평가 프로토콜
동일한 프롬프트, 익명화된 답변
- 01모든 어시스턴트가 동일한 금융 프롬프트 세트를 받습니다.
- 02제품이 지원하는 경우 라이브 데이터 또는 웹 검색 접근을 활성화한 상태로 답변을 수집합니다.
- 03평가 전에 모델 이름을 제거합니다.
- 04별도의 중립 심사자가 라이브 참조 데이터에 비추어 각 답변을 채점합니다.
- 05항목별 점수를 종합해 10점 척도로 정규화합니다.
해석
스냅샷일 뿐, 보편적 순위가 아닙니다
결과는 이 프롬프트 세트와 2026년 7월 실행 시점에 이용 가능했던 제품을 반영합니다. 모델 버전, 검색 시스템, 시장 상황, 데이터 가용성은 계속 변하므로, 향후 실행에서는 다른 순위가 나올 수 있습니다.
이 벤치마크는 금융 질문에 대한 답변 품질을 측정합니다. 투자 수익률을 측정하지 않으며, 금융 조언이 아닙니다.