벤치마크 · 2026년 7월 측정

DoubleDive의 AI는
얼마나 똑똑한가요?

학생들이 실제로 치르는 가장 어렵고 가장 최신인 시험 — 어떤 AI의 학습 데이터에도 포함될 수 없는 2026년 신규 출제 시험 — 에 DoubleDive 전체 파이프라인을 그대로 응시시키고 점수를 공개합니다.

2026 수능: 프런티어 AI 전부보다 높은 점수

2026학년도 수능 벤치마크에서 DoubleDive는 어떤 단일 프런티어 모델보다 높은 원점수를 기록했습니다.

DoubleDive 590/600
C사 최고사양 모델 570/600
G사 최고사양 모델 524/600

국어 · 영어 · 수학 · 물리 · 생활과 윤리 만점 — 전 과목 만점은 DoubleDive가 유일합니다.

AIME · JEE Advanced 동시 만점은 DoubleDive뿐

세계에서 가장 어려운 수학 시험 두 개 — AIME 2026 I과 JEE Advanced 2026 수학 — 를 모두 만점으로 통과한 AI는 DoubleDive가 유일합니다.

DoubleDive 49/49
C사 최고사양 모델 48/49
G사 최고사양 모델 48/49
AIME 2026 I 15/15

미국 수학올림피아드(USAMO)로 가는 관문 시험.

JEE Advanced 2026 수학 34/34

인도 IIT 입학시험 — 세계에서 가장 어려운 수학 시험으로 꼽힙니다.

2026 미국 시험 — 거의 전 문항 정답

미국 학생들이 실제로 치르는 대표 시험들의 2026년 신규 출제판 결과입니다.

2026 SAT 120/120

수학·읽기와 쓰기 전 문항 정답 — SAT 만점.

F=ma 2026 25/25

미국 물리올림피아드 선발 시험 만점.

미국 화학올림피아드 2026 59/60

USNCO Local 시험.

Regents 미국사·정부 2026 28/28

뉴욕주 Regents 시험 전 문항 정답.

측정 방법

모든 점수는 2026년 7월, 각 시험의 최신(2026년) 출제판으로 자체 측정했습니다. 테스트한 모든 모델의 학습 데이터 마감 이후 공개된 시험이므로, 문제가 학습 데이터에 포함되었을 가능성이 없습니다.

DoubleDive는 실서비스 파이프라인 그대로 응시합니다: 문제마다 오케스트레이터가 가장 잘 푸는 모델로 라우팅하고, 모델 간 교차 검증을 거쳐 결과를 확정합니다. 비교 대상은 동일 입력에 대한 각 사 최고사양 모델의 단독 호출입니다.

수능 점수는 원점수 기준입니다. SAT®(College Board), F=ma(AAPT), 미국 화학올림피아드(American Chemical Society), Regents(NYSED)는 각 기관의 상표이며, 해당 기관은 DoubleDive를 보증하거나 후원하지 않습니다.

이 시험들을 푸는 바로 그 AI가
소크라테스식으로 가르칩니다

가입 시 무료 크레딧이 제공됩니다. 설치 없이 브라우저에서 바로 시작하세요.

무료로 시작하기