AI 추론 성능 순위 2026
GPQA(대학원급 추론) 벤치마크 기준 AI 모델 순위
매일 업데이트 · 2026-10-08 기준 · 9시간 전 업데이트
AI 추론 성능 순위 2026 TOP 20
Artificial Analysis 기반1
—
GPT-6 Astra
OpenAI
100
2Google
—
Gemini 3.8 Flash
99
3
—
Grok 4.6
SpaceXAI
98
4Google
—
Gemini 3.7 Flash
98
5Google
—
Gemini 3.1 Pro Preview
97
6
—
GPT-5.6 Sol
OpenAI
97
7
—
Muse Spark 1.3
Meta
97
8
—
Claude Fable 5.1
Anthropic
97
9
—
Claude Opus 5
Anthropic
97
10
—
GPT-5.5
OpenAI
97
11
—
Kimi K3
Kimi
97
12
—
Qwen3.8 2.4T A95B
Alibaba
97
13
—
Grok 4.5
SpaceXAI
96
14
—
MiniMax-M3
MiniMax
96
15
—
DeepSeek V4 Pro 0813
DeepSeek
96
16Google
—
Gemini 3.6 Flash
96
17
—
Qwen3.8 Max
Alibaba
96
18
—
Claude Fable 5
Anthropic
96
19
—
GPT-5.6 Terra
OpenAI
96
20
—
Qwen3.7 Max
Alibaba
95
점수는 카테고리별 최고점 기준 정규화됩니다. 전체 순위는 AI 순위 페이지에서 확인하세요.
자주 묻는 질문
추론 문제에 가장 강한 AI는 무엇인가요?
GPQA(대학원급 추론 벤치마크) 기준 최신 순위를 참고하세요. 추론 특화 모델(Reasoning 모드)이 일반 모델보다 점수가 높게 나타나는 경향이 있습니다.
AI 추론 순위는 어떤 벤치마크를 사용하나요?
GPQA(Graduate-Level Google-Proof Q&A)를 사용합니다. 대학원 수준의 과학·논리 추론 능력을 평가하는 벤치마크로, 최신 플래그십 모델도 즉시 반영됩니다.
