공개된 비교

Obside 벤치마크는 어떻게 측정되나

홈페이지의 비교는 프로덕션 벤치마크이지, 설명용 차트가 아닙니다. 이 페이지는 종합 결과, 평가 프로토콜, 해석에 필요한 한계를 공개합니다.

벤치마크 스냅샷

프로덕션 어시스턴트, 라이브 참조 데이터, 블라인드 채점.

종합 결과

공개된 점수와 동일, 단일한 출처

홈페이지 차트와 다운로드 가능한 결과는 이 동일한 데이터셋을 사용합니다. 점수는 정확성, 관련성, 신선도를 10점 척도로 결합합니다.

어시스턴트점수 / 10
Obside
9.7
ChatGPT
8.4
Gemini
8.1
DeepSeek
8.0
Claude
7.9

평가 프로토콜

동일한 프롬프트, 익명화된 답변

  1. 01모든 어시스턴트가 동일한 금융 프롬프트 세트를 받습니다.
  2. 02제품이 지원하는 경우 라이브 데이터 또는 웹 검색 접근을 활성화한 상태로 답변을 수집합니다.
  3. 03평가 전에 모델 이름을 제거합니다.
  4. 04별도의 중립 심사자가 라이브 참조 데이터에 비추어 각 답변을 채점합니다.
  5. 05항목별 점수를 종합해 10점 척도로 정규화합니다.

해석

스냅샷일 뿐, 보편적 순위가 아닙니다

결과는 이 프롬프트 세트와 2026년 7월 실행 시점에 이용 가능했던 제품을 반영합니다. 모델 버전, 검색 시스템, 시장 상황, 데이터 가용성은 계속 변하므로, 향후 실행에서는 다른 순위가 나올 수 있습니다.

이 벤치마크는 금융 질문에 대한 답변 품질을 측정합니다. 투자 수익률을 측정하지 않으며, 금융 조언이 아닙니다.