Replicate

Replicate

소개

Replicate은 수천 개의 오픈소스 머신러닝 모델을 클라우드 API로 실행할 수 있는 개발자 플랫폼이다. 이미지·영상·음성 생성부터 대형 언어 모델까지 커뮤니티가 공개한 모델을 코드 한 줄로 호출하고, 오픈소스 패키징 도구 Cog로 자체 모델을 API 서버로 자동 배포할 수 있다. 트래픽에 따라 자동으로 확장·축소되고 실제 사용한 초 단위 컴퓨팅 시간만큼만 과금돼, ML 인프라를 직접 구축하지 않고 AI 기능을 제품에 빠르게 붙이려는 개발자와 스타트업에 적합하다.

장점

  • 코드 한 줄로 수천 개 오픈소스 모델을 바로 호출해 ML 인프라 구축 없이 빠르게 프로토타이핑할 수 있다.
  • Cog 패키징으로 자체 학습한 모델도 API 서버로 자동 배포된다.
  • 트래픽에 맞춰 자동 확장되고 미사용 시 0으로 축소돼 유휴 비용을 줄인다.
  • CPU부터 H100까지 GPU를 골라 쓰고 실제 처리한 초 단위만큼만 과금된다.
  • SDXL 등 인기 이미지 모델의 파인튜닝을 지원해 도메인 특화 결과물을 만들 수 있다.

단점

  • 인터페이스와 문서가 영어 전용이라 한국어 지원이 없다.
  • 종량제 특성상 대규모 트래픽에서는 비용 예측이 어렵고 유료 사용이 사실상 필수다.
  • API·코드 통합을 전제로 해서 비개발자가 바로 쓰기는 어렵다.
  • 프라이빗 모델은 유휴 시간에도 인스턴스 가동 비용이 부과된다.

핵심 기능

코드 한 줄로 모델 실행

커뮤니티가 올린 수천 개의 오픈소스 ML 모델을 API 호출 한 번으로 실행한다.

Cog 커스텀 배포

오픈소스 패키징 도구 Cog로 자체 모델을 API 서버로 자동 배포한다.

모델 파인튜닝

SDXL 같은 이미지 모델을 자체 데이터셋으로 미세조정해 특정 스타일에 최적화한다.

자동 스케일링

트래픽에 따라 자동으로 확장되고 미사용 시 0으로 축소된다.

초 단위 종량 과금

요청을 처리하는 데 실제로 걸린 컴퓨팅 시간만큼만 비용을 낸다.

다양한 GPU 선택

CPU부터 T4·L40S·A100·H100까지 하드웨어를 골라 쓸 수 있다.

공식 사이트 2026-07-28 검증

요금제

2026-07-28 기준

CPU

$0.36​/​hr

($0.000100/초)

  • 가벼운 모델·전처리 작업용

Nvidia T4 GPU

$0.81​/​hr

($0.000225/초)

  • 표준 GPU 추론
  • 공개 모델 실행에 적합

Nvidia A100 (80GB)

$5.04​/​hr

($0.001400/초)

  • 대형 모델·고성능 추론

Nvidia H100 GPU

$5.49​/​hr

($0.001525/초)

  • 최고 성능 GPU
  • 대규모 파인튜닝·추론

Enterprise

Custom

(문의)

  • 볼륨 할인
  • 전담 지원
  • 높은 GPU 한도

이 도구가 잘하는 업무

자주 묻는 질문

Replicate은 어떤 서비스인가요?

수천 개의 오픈소스 AI 모델을 클라우드 API로 실행하고 커스텀 모델을 배포할 수 있는 개발자 플랫폼입니다.

코딩을 몰라도 쓸 수 있나요?

기본적으로 API 호출과 코드 통합을 전제로 하므로 개발 지식이 필요합니다. 웹에서 일부 모델을 직접 실행해 볼 수는 있습니다.

내가 만든 모델도 올릴 수 있나요?

네, 오픈소스 패키징 도구 Cog로 자체 모델을 패키징하면 API 서버로 자동 배포됩니다.

어떤 종류의 모델을 실행할 수 있나요?

이미지·영상·음성·음악 생성과 대형 언어 모델 등 커뮤니티가 공개한 다양한 모델을 지원합니다.

비용은 어떻게 청구되나요?

선택한 GPU 종류에 따라 실제 사용한 컴퓨팅 시간을 초 단위로 과금하는 종량제 방식입니다.

파인튜닝을 지원하나요?

네, SDXL 같은 이미지 모델을 자체 데이터셋으로 미세조정해 특정 스타일에 최적화할 수 있습니다.

한국어를 지원하나요?

인터페이스와 문서가 영어로만 제공되며 별도의 한국어 페이지는 없습니다.

사용자 리뷰

불러오는 중...