Flux AI

Flux AI

AI 이미지High모켓지수 기준OSS 표준

소개

Flux AI는 Stable Diffusion 핵심 개발자들이 2024년 설립한 Black Forest Labs가 만든 생성형 AI 모델군입니다. rectified flow transformer 아키텍처를 기반으로 텍스트-이미지 생성에서 텍스트 렌더링 정확도와 인체 해부학적 표현이 업계 최고 수준으로 평가받으며, Max·Pro·Flex·Klein·Dev 등 품질·속도·비용별 티어를 제공합니다. 최신 세대는 이미지에 더해 영상·오디오·로보틱스 액션까지 하나의 아키텍처로 통합했고, 오픈웨이트(Apache 라이선스) 버전은 로컬에서 무료로 실행할 수 있습니다. Adobe Photoshop·ComfyUI·Grok 등 주요 플랫폼과 통합되며 API는 이미지 크기(메가픽셀) 기반 종량제로 제공됩니다.

장점

  • 오픈웨이트(Dev·Schnell·Klein)를 Apache 라이선스로 공개해 로컬 무료 실행·상업 이용 가능
  • 텍스트 렌더링 정확도가 업계 최고 수준이라 텍스트가 들어간 이미지 생성에 탁월
  • 인체 비율·해부학적 정확성이 이전 세대 대비 크게 향상
  • Adobe Photoshop·Grok·ComfyUI 등 주요 플랫폼과 폭넓게 통합
  • API가 이미지 크기(메가픽셀) 기반 종량제라 저해상도·소규모 사용 시 비용 부담이 낮음

단점

  • 한국어 UI 미지원, 한국어 프롬프트 이해도 제한적
  • 최고 품질 티어(Max)와 고해상도·편집·다중참조 작업은 종량 비용이 빠르게 늘 수 있음
  • 오픈웨이트 로컬 실행에는 VRAM 12GB+ 고사양 GPU 필요
  • 학습 데이터 출처 미공개로 저작권 논란 존재

핵심 기능

텍스트-이미지 생성

자연어 프롬프트로 포토리얼리스틱 이미지를 고해상도(최대 4메가픽셀)로 생성

이미지 편집 도구(Flux Tools)

Fill(인페인팅/아웃페인팅), Depth(깊이맵), Canny(엣지), Redux(이미지 믹싱) 등 편집·컨트롤 도구 제공

Kontext 인컨텍스트 편집

생성된 이미지를 대화형으로 반복 수정·편집하는 인컨텍스트 편집 기능

멀티 레퍼런스 컨트롤

여러 참조 이미지를 기반으로 스타일과 구도를 제어하며 이미지 생성

오픈웨이트 모델 제공

Dev·Schnell·Klein 등을 Apache 라이선스로 공개해 로컬 무료 실행 및 ComfyUI 생태계 호환

저지연 경량 티어

Klein 티어는 고성능 하드웨어에서 1초 안팎의 빠른 이미지 생성 지원

멀티모달 통합 모델

최신 세대는 이미지에 더해 최대 20초 영상·동기화 오디오, 로보틱스 액션 예측까지 하나의 아키텍처로 통합한다. 영상은 API로 정식 제공되고 이미지·액션 모달리티는 순차 롤아웃 중이다.

공식 사이트 2026-08-17 검증

요금제

2026-08-17 기준

FLUX.2 [max]

$0.07​/​MP

(첫 MP, 추가 $0.03/MP)

  • 최고 화질
  • 최대 4MP 해상도
  • 상업 프로덕션 최적화

FLUX.2 [pro]

$0.03​/​MP

(추가 $0.015/MP)

  • 품질·속도 균형
  • 대량 전문 워크플로우
  • 참조 이미지 입력 지원

FLUX.2 [klein] 9B

$0.015​/​MP

(추가 $0.002/MP)

  • 고처리량·저지연
  • 실시간 애플리케이션
  • 대규모 비용 효율

FLUX.2 [klein] 4B

$0.014​/​MP

(추가 $0.001/MP)

  • 초경량 4B 모델
  • 최고 생성 속도
  • FLUX.2 중 최저 비용

FLUX.2 [flex]

$0.05​/​MP

  • 해상도 기반 유연 과금
  • 생성 해상도만큼만 지불
  • 이미지당 최소금액 없음

Flux AI와 함께 쓰는 AI 콤보

여러 AI 도구를 묶어서 만든 검증된 워크플로우

자주 묻는 질문

Flux AI는 무료로 사용할 수 있나요?

Dev·Schnell 등 오픈웨이트 모델은 로컬에서 무료로 실행할 수 있고, 공식 Playground에서도 체험할 수 있습니다. 클라우드 API는 이미지 크기(메가픽셀) 기반 종량제로 과금됩니다.

Flux AI와 Midjourney/GPT Image의 차이점은?

Flux는 오픈웨이트 버전을 제공해 로컬 실행이 가능하고, 텍스트 렌더링 정확도와 인체 해부학적 정확성에서 강점이 있습니다. Midjourney는 예술적 스타일에, GPT Image는 ChatGPT 통합에 강점이 있습니다.

어떤 모델 티어를 선택해야 하나요?

대량 생성은 Klein(가장 빠름·저렴), 프로덕션 품질은 Pro, 최고 품질은 Max를 권장합니다. 개발·테스트 목적이면 무료 오픈웨이트 Dev를 사용하세요.

로컬에서 실행하려면 어떤 사양이 필요한가요?

VRAM 12GB 이상의 GPU가 권장됩니다. ComfyUI, Stable Diffusion WebUI Forge 등을 통해 실행할 수 있으며, Hugging Face에서 모델 웨이트를 다운로드합니다.

한국어 프롬프트를 사용할 수 있나요?

영어 프롬프트에 최적화되어 있으며, 한국어 등 비영어 프롬프트의 이해도는 제한적입니다. 최상의 결과를 위해 영어 프롬프트 사용을 권장합니다.

생성한 이미지의 저작권은 누구에게 있나요?

모든 모델 버전에서 사용자가 생성 결과물의 소유권을 보유하며, 상업적 사용도 가능합니다.

Flux AI는 어떤 도구·플랫폼과 연동되나요?

Adobe Photoshop(Kontext 베타), Grok(xAI), Mistral Le Chat, ComfyUI, Replicate, Hugging Face 등과 통합되어 있습니다.

이미지 외에 영상·오디오도 만들 수 있나요?

최신 세대 모델은 최대 20초 영상과 동기화 오디오를 지원합니다. 영상은 API로 정식 제공되며, 로보틱스 액션 예측 등 일부 모달리티는 순차 롤아웃 중입니다.

사용자 리뷰

불러오는 중...