AI 추론 성능 순위 2026

GPQA(대학원급 추론) 벤치마크 기준 AI 모델 순위

매일 업데이트 · 2026-10-08 기준 · 9시간 전 업데이트

AI 추론 성능 순위 2026 TOP 20

Artificial Analysis 기반
1
—

GPT-6 Astra

OpenAI

100
2
—

Gemini 3.8 Flash

Google

99
3
—

Grok 4.6

SpaceXAI

98
4
—

Gemini 3.7 Flash

Google

98
5
—

Gemini 3.1 Pro Preview

Google

97
6
—

GPT-5.6 Sol

OpenAI

97
7
—

Muse Spark 1.3

Meta

97
8
—

Claude Fable 5.1

Anthropic

97
9
—

Claude Opus 5

Anthropic

97
10
—

GPT-5.5

OpenAI

97
11
—

Kimi K3

Kimi

97
12
—

Qwen3.8 2.4T A95B

Alibaba

97
13
—

Grok 4.5

SpaceXAI

96
14
—

MiniMax-M3

MiniMax

96
15
—

DeepSeek V4 Pro 0813

DeepSeek

96
16
—

Gemini 3.6 Flash

Google

96
17
—

Qwen3.8 Max

Alibaba

96
18
—

Claude Fable 5

Anthropic

96
19
—

GPT-5.6 Terra

OpenAI

96
20
—

Qwen3.7 Max

Alibaba

95

점수는 카테고리별 최고점 기준 정규화됩니다. 전체 순위는 AI 순위 페이지에서 확인하세요.

자주 묻는 질문

추론 문제에 가장 강한 AI는 무엇인가요?
GPQA(대학원급 추론 벤치마크) 기준 최신 순위를 참고하세요. 추론 특화 모델(Reasoning 모드)이 일반 모델보다 점수가 높게 나타나는 경향이 있습니다.
AI 추론 순위는 어떤 벤치마크를 사용하나요?
GPQA(Graduate-Level Google-Proof Q&A)를 사용합니다. 대학원 수준의 과학·논리 추론 능력을 평가하는 벤치마크로, 최신 플래그십 모델도 즉시 반영됩니다.