벤치마크 · 2026년 7월 측정 · 학습 데이터 이후 출제된 시험

DoubleDive의 AI는 얼마나 똑똑한가요?

학생들이 실제로 치르는 가장 어렵고 가장 최신인 시험 — 어떤 AI의 학습 데이터에도 포함될 수 없는 2026년 신규 출제 시험 — 에 DoubleDive 전체 파이프라인을 그대로 응시시키고 점수를 공개합니다.

2026 수능

프런티어 AI 전부보다 높은 점수

2026학년도 수능 벤치마크에서 DoubleDive는 어떤 단일 프런티어 모델보다 높은 원점수를 기록했습니다.

DoubleDive590/600
C사 최고사양 모델570/600
G사 최고사양 모델524/600
국어 · 영어 · 수학 · 물리 · 생활과 윤리 만점 — 전 과목 만점은 DoubleDive가 유일합니다.
국제 수학 시험

AIME · JEE Advanced 동시 만점은 DoubleDive뿐

세계에서 가장 어려운 수학 시험 두 개 — AIME 2026 I과 JEE Advanced 2026 수학 — 를 모두 만점으로 통과한 AI는 DoubleDive가 유일합니다.

DoubleDive49/49
C사 최고사양 모델48/49
G사 최고사양 모델48/49
AIME 2026 I15/15

미국 수학올림피아드(USAMO)로 가는 관문 시험.

JEE Advanced 2026 수학34/34

인도 IIT 입학시험 — 세계에서 가장 어려운 수학 시험으로 꼽힙니다.

2026 미국 시험

거의 전 문항 정답

미국 학생들이 실제로 치르는 대표 시험들의 2026년 신규 출제판 결과입니다.

2026 SAT120/120

수학·읽기와 쓰기 전 문항 정답 — SAT 만점.

F=ma 202625/25

미국 물리올림피아드 선발 시험 만점.

미국 화학올림피아드 202659/60

USNCO Local 시험.

Regents 미국사·정부 202628/28

뉴욕주 Regents 시험 전 문항 정답.

측정 방법

어떻게 측정했나

모든 점수는 2026년 7월, 확보 가능한 가장 최신(2026년) 시험판으로 자체 측정했습니다 — 테스트한 모든 모델의 학습 데이터 마감 이후에 출제된 시험이라, 어떤 문항도 학습 데이터에 포함될 수 없습니다.

DoubleDive는 실제 서비스 파이프라인 그대로 응시합니다: 문제마다 오케스트레이터가 가장 적합한 모델에 라우팅하고, 모델끼리 교차 검증한 뒤 결과를 검산합니다. 비교 대상은 같은 입력에 대한 각 사 최고사양 모델의 단독 호출입니다.

수능 점수는 원점수 기준입니다. SAT®(College Board), F=ma(AAPT), 미국 화학올림피아드(ACS), Regents(NYSED)는 각 소유자의 상표이며, 이들은 DoubleDive를 보증하거나 후원하지 않습니다.

이 시험들을 만점 받는 AI가, 아이에게는 정답 대신 질문을 던집니다.

가입 시 무료 크레딧 · 카드 등록 불필요 · 브라우저에서 바로

무료로 시작