AI 출력 속도 순위 2026

API 기준 초당 출력 토큰 수(TPS) 실측값 순위

매일 업데이트 · 2026-10-08 기준 · 9시간 전 업데이트

AI 출력 속도 순위 2026 TOP 20

Artificial Analysis 기반
1
—

Celeris-1

Celeris

100 tok/s
2
—

Mercury 2.5

Inception

35 tok/s
3
—

Ling 3.0 Flash

InclusionAI

18 tok/s
4
—

Trinity Large Thinking

Arcee AI

18 tok/s
5
▲1

Ling-3.0-flash-Fin

InclusionAI

17 tok/s
6
▼1

Gemini 3.5 Flash-Lite

Google

17 tok/s
7
—

Nemotron 3.5 Lightning

NVIDIA

15 tok/s
8
▲3

gpt-oss-20b

OpenAI

13 tok/s
9
—

Ministral 3 3B

Mistral

12 tok/s
10
—

Nova Micro

Amazon

12 tok/s
11
▼3

Nemotron 3 Nano Omni 30B A3B Reasoning

NVIDIA

12 tok/s
12
▲2

Granite 4.2 3B

IBM

11 tok/s
13
▲2

Qwen3.5 Omni Flash

Alibaba

11 tok/s
14
▼1

NVIDIA Nemotron 3 Nano 30B A3B

NVIDIA

11 tok/s
15
▲3

DeepSeek V4.1 Flash

DeepSeek

11 tok/s
16
▲1

Ling 3.1 Flash

InclusionAI

11 tok/s
17
▼1

DeepSeek V4 Flash Vision

DeepSeek

11 tok/s
18
▼6

Nova 2.0 Lite

Amazon

11 tok/s
19
—

NVIDIA Nemotron Nano 12B v2 VL

NVIDIA

10 tok/s
20
—

gpt-oss-120b

OpenAI

10 tok/s

점수는 카테고리별 최고점 기준 정규화됩니다. 전체 순위는 AI 순위 페이지에서 확인하세요.

자주 묻는 질문

가장 빠른 AI 모델은 무엇인가요?
출력 속도는 서버 부하에 따라 변동합니다. 소형 모델(Mini, Flash, Haiku 등)이 일반적으로 더 빠른 경향이 있습니다.
AI 속도는 어떻게 측정하나요?
Artificial Analysis가 API를 통해 초당 출력 토큰 수(tokens/sec)를 실측합니다. 동일 조건에서 반복 측정한 중앙값을 사용합니다.