기간 한정연간 멤버십:30% 할인및 GPT Image, MiniMax H3 등 모델 무제한 이용
새로운 AI Chat · 매일 무료 체험 횟수 제공
지금 업그레이드
Pixmind
API Platform

모델 카탈로그

모델은 자유롭게 선택하고, API 연동은 그대로 유지하세요.

PixMind에서 제공하는 모델 라우트를 검색하고 기능과 과금 단위를 비교한 다음, 안정적인 모델 ID를 연동 코드에 복사하세요.

이미지, 동영상 및 LLM 라우트가 제공됩니다. 아직 계획 중인 개별 모델은 카드에 명확히 표시됩니다.
76개 모델 라우트
19개 공급자
43개 사용 가능 라우트

결과 76개

Google사용 가능

Nano Banana Pro

다국어 텍스트 표현, 구조화된 시각 디자인, 참조 이미지 융합, 정밀한 자연어 편집에 강합니다.

텍스트-이미지이미지 편집다중 참조+1
nano-banana-pro

API 예상 가격

$0.13/이미지

공식가 대비 19% 저렴

OpenAI사용 가능

GPT Image 2

포스터, 제품 이미지, 인포그래픽 및 반복적인 디자인 작업을 위한 정밀 제어 이미지 생성과 편집을 제공합니다.

텍스트-이미지이미지 편집다중 참조+1
gpt-image-2

API 예상 가격

$0.050/이미지

공식가 대비 17% 저렴

ByteDance사용 가능

Seedream 5.0 Pro

뛰어난 구도와 디테일, 참조 일관성, 고해상도 출력을 갖춘 상업용 비주얼에 적합합니다.

텍스트-이미지이미지 편집다중 참조+1
seedream-5.0-pro

API 예상 가격

$0.060/이미지

공식가 대비 25% 저렴

Midjourney사용 가능

Midjourney V7

독특한 아트 디렉션, 완성도 높은 미학, 참조 이미지 기반의 시각적 탐색에 적합합니다.

텍스트-이미지다중 참조캐릭터 일관성+1
mj-v7

API 예상 가격

$0.030/이미지

공식가 대비 63% 저렴

Pixmind예정

Pixmind

PixMind의 무료 이미지 생성 라우트로, 일상적인 빠른 텍스트-이미지 작업에 적합합니다.

텍스트-이미지
z-image

출시 예정

가격 공개 예정

Google예정

Nano Banana Pro Eco

Nano Banana Pro의 경제형 라우트로, 텍스트-이미지, 이미지 편집, 참조 이미지를 지원합니다.

텍스트-이미지이미지 편집다중 참조+1
nano-banana-pro-lite

출시 예정

가격 공개 예정

Google사용 가능

Nano Banana 2

Google Nano Banana 2 고속 이미지 생성, 1K/2K/4K 해상도를 지원합니다.

텍스트-이미지이미지 편집다중 참조+1
nano-banana-2

API 예상 가격

$0.090/이미지

공식가 대비 31% 저렴

Google예정

Nano Banana

원형 Nano Banana 이미지 생성 라우트로, 다양한 텍스트-이미지 및 편집 작업에 적합합니다.

텍스트-이미지이미지 편집다중 참조
nano-banana

출시 예정

가격 공개 예정

Google사용 가능

Nano Banana 2 Eco

Nano Banana 2 경제형으로, 속도·화질·비용의 균형이 좋아 일상 생성에 적합합니다.

텍스트-이미지이미지 편집다중 참조+1
nano-banana-2-eco

API 예상 가격

$0.050/이미지

공식가 대비 38% 저렴

Midjourney예정

Midjourney Niji 7

Midjourney의 애니메이션·일러스트 특화 모델로, 스타일화된 캐릭터와 생동감 넘치는 작품에 적합합니다.

텍스트-이미지이미지 편집다중 참조
mj-niji7

출시 예정

가격 공개 예정

Midjourney예정

Midjourney V8.2

Midjourney V8.2, 더 세련된 미학과 향상된 프롬프트 부합도, 풍부한 아트 디렉션을 제공합니다.

텍스트-이미지이미지 편집다중 참조
mj-v8.2

출시 예정

가격 공개 예정

Midjourney예정

Midjourney V8.1

Midjourney V8.1, 화질과 일관성이 강화되어 완성도 높은 크리에이티브 출력에 적합합니다.

텍스트-이미지이미지 편집다중 참조
mj-v8.1

출시 예정

가격 공개 예정

ByteDance예정

Seedream 5.0

ByteDance Seedream 5.0 상업용 이미지 생성, 뛰어난 구도와 디테일을 제공합니다.

텍스트-이미지이미지 편집다중 참조+1
seedream-5.0

출시 예정

가격 공개 예정

ByteDance예정

Seedream 4.5

Seedream 4.5 밸런스형 이미지 생성, 안정적인 화질로 일상 크리에이티브에 적합합니다.

텍스트-이미지이미지 편집다중 참조+1
seedream-4.5

출시 예정

가격 공개 예정

ByteDance예정

Seedream 4.0

Seedream 4.0 이미지 생성, 텍스트-이미지 및 편집을 지원하며 프로덕션 비주얼에 적합합니다.

텍스트-이미지이미지 편집다중 참조+1
seedream-4.0

출시 예정

가격 공개 예정

OpenAI예정

GPT Image 1.5

GPT Image 1.5 정밀 제어 생성과 편집, 디자인 중심 비주얼에 적합합니다.

텍스트-이미지이미지 편집다중 참조
gpt-image-1.5

출시 예정

가격 공개 예정

OpenAI예정

GPT Image 4o

GPT Image 4o 다목적 이미지 생성, 정확한 프롬프트 부합과 강력한 편집을 제공합니다.

텍스트-이미지이미지 편집다중 참조
gpt-image-4o

출시 예정

가격 공개 예정

OpenAI예정

GPT Image 2 Eco

GPT Image 2 경제형, 대량·비용 민감 생성 및 편집에 적합합니다.

텍스트-이미지이미지 편집다중 참조+1
gpt-image-2-eco

출시 예정

가격 공개 예정

Alibaba예정

Wan 2.6 Image

Alibaba Wan 2.6 이미지 생성 및 편집, 다국어 크리에이티브 워크플로를 지원합니다.

텍스트-이미지이미지 편집다중 참조
wan2.6-image

출시 예정

가격 공개 예정

Alibaba예정

Wan 2.7 Image Pro

Wan 2.7 Image Pro, Alibaba의 상위 라우트로 더 선명한 프로덕션급 비주얼에 적합합니다.

텍스트-이미지이미지 편집다중 참조+1
wan2.7-image-pro

출시 예정

가격 공개 예정

Alibaba예정

Qwen Image 2.0 Pro

Qwen Image 2.0 Pro 텍스트-이미지, 읽기 쉬운 타이포그래피와 풍부한 디테일을 제공합니다.

텍스트-이미지
qwen-image-2.0-pro

출시 예정

가격 공개 예정

Krea사용 가능

Krea 2 Turbo

다양한 화면비, 재현 가능한 시드, 1K 및 2K 출력을 지원하는 빠른 Krea 텍스트 이미지 생성 모델입니다.

텍스트-이미지고해상도
krea-2-turbo

API 예상 가격

$0.010/이미지

공식가 대비 56% 저렴

Grok AI예정

Grok Imagine 1.5

Grok Imagine 1.5 이미지 생성, 대담하고 표현력 있는 비주얼 스타일에 적합합니다.

텍스트-이미지이미지 편집다중 참조
grok-imagine-1.5

출시 예정

가격 공개 예정

Recraft예정

Recraft V4 Vector

Recraft V4 벡터 생성, 깔끔하고 확장 가능한 인쇄용 디자인 작업물을 제공합니다.

텍스트-이미지SVG 벡터 출력
recraftv4_vector

출시 예정

가격 공개 예정

Recraft예정

Recraft V4 Pro Vector

Recraft V4 Pro 벡터 생성, 프로급 품질로 전문 디자인에 적합합니다.

텍스트-이미지SVG 벡터 출력
recraftv4_pro_vector

출시 예정

가격 공개 예정

Recraft예정

Recraft Image to Vector

Recraft 이미지-벡터 변환, 래스터 이미지를 편집 가능한 벡터로 바꿔줍니다.

이미지 편집SVG 벡터 출력
recraft-vectorize

출시 예정

가격 공개 예정

Google사용 가능

Veo 3.1

이미지 가이드, 장면 제어, 시작/종료 프레임 및 네이티브 오디오를 지원하는 영화 같은 동영상 생성 모델입니다.

텍스트-동영상이미지-동영상네이티브 오디오+1
veo-3.1

API 예상 가격

$0.36/

공식가 대비 20% 저렴

MiniMax사용 가능

MiniMax H3

텍스트, 이미지, 첫/마지막 프레임, 멀티모달 참조로 네이티브 2K 동기화 오디오 영상 생성.

텍스트-동영상이미지-동영상네이티브 오디오+2
minimax-h3

API 예상 가격

$0.090/
ByteDance사용 가능

Seedance 2.0 Pro

캐릭터, 장면, 움직임과 사운드를 조율하는 다중 참조 동영상 제작에 적합합니다.

텍스트-동영상이미지-동영상다중 참조+1
seedance-2.0-pro

API 예상 가격

$0.072/

공식가 대비 20% 저렴

ByteDance사용 가능

Seedance 2.5

최대 50개의 다중 모달 참조, 4K 출력, 영역 수준 편집을 지원하는 네이티브 30초 단일 샷 동영상.

텍스트-동영상이미지-동영상다중 참조+2
seedance-2.5

API 예상 가격

$0.072/

공식가 대비 20% 저렴

Kuaishou사용 가능

Kling V3

프로덕션 장면을 위한 고품질 이미지 애니메이션과 카메라 또는 피사체 모션 제어를 제공합니다.

텍스트-동영상이미지-동영상다중 참조+1
kling-v3-motion-control

API 예상 가격

$0.16/

공식가 대비 20% 저렴

Alibaba사용 가능

Wan 2.7 Video

하나의 동영상 라우트에서 텍스트, 이미지, 다중 참조 및 시작/종료 프레임 워크플로를 지원합니다.

텍스트-동영상이미지-동영상다중 참조+1
wan2.7-video

API 예상 가격

$0.12/

공식가 대비 20% 저렴

Alibaba사용 가능

Wan 3.0 Video

멀티모달 참조, 동기화 오디오, 2~30초 클립, 최대 1080p 출력을 지원하는 Wan 3.0 비디오 생성 모델입니다.

텍스트-동영상이미지-동영상다중 참조+2
wan3.0-video

API 예상 가격

$0.060/

공식가 대비 14% 저렴

OpenAI사용 가능

Sora 2 Pro

이미지 가이드와 오디오 출력을 지원하며, 더 길고 창의적인 장면을 섬세하게 생성하는 데 적합합니다.

텍스트-동영상이미지-동영상네이티브 오디오+1
sora-2-pro

API 예상 가격

$0.048/

공식가 대비 20% 저렴

PixVerse사용 가능

PixVerse V5

텍스트-동영상, 이미지 애니메이션, 전환, 효과와 사운드를 빠르게 구상할 수 있습니다.

텍스트-동영상이미지-동영상시작/종료 프레임+1
pixverse-v5

API 예상 가격

$0.067/

공식가 대비 20% 저렴

MiniMax사용 가능

Happy Horse 1.0

숏폼 크리에이티브 동영상을 위한 참조 캐릭터 연기와 표현력 있는 움직임에 적합합니다.

텍스트-동영상이미지-동영상다중 참조+1
happyhorse-1.0

API 예상 가격

$0.176/

공식가 대비 20% 저렴

Kling AI사용 가능

Kling 3.0 Turbo

Kuaishou Kling 3.0 Turbo, 빠른 텍스트-동영상·이미지-동영상 라우트로 빠른 초안에 적합합니다.

텍스트-동영상이미지-동영상
kling-3.0-turbo

API 예상 가격

$0.13/

공식가 대비 19% 저렴

ByteDance예정

Seedance 2.0 Fast

Seedance 2.0 Fast, 더 빠른 Seedance 라우트로 빠른 영상 완성에 적합합니다.

텍스트-동영상이미지-동영상
seedance-2.0-fast

출시 예정

가격 공개 예정

ByteDance예정

Seedance 2.0 Mini

Seedance 2.0 Mini, 효율적인 숏폼 영상 생성에 적합한 경량 변형입니다.

텍스트-동영상이미지-동영상
seedance-2-0-mini

출시 예정

가격 공개 예정

OpenAI예정

Sora 2

OpenAI Sora 2 동영상 생성, 텍스트-동영상·이미지-동영상 크리에이티브 샷에 적합합니다.

텍스트-동영상이미지-동영상
sora-2

출시 예정

가격 공개 예정

OpenAI예정

Sora 2 Eco

Sora 2 경제형, 비용 효율적인 동영상 생성에 적합합니다.

텍스트-동영상이미지-동영상
sora-2-eco

출시 예정

가격 공개 예정

Google예정

Veo 3

Google Veo 3 영화 같은 동영상 생성, 이미지 가이드와 오디오를 지원합니다.

텍스트-동영상이미지-동영상
veo-3

출시 예정

가격 공개 예정

Google예정

Veo 3.0 Fast

Veo 3.0 Fast, 더 빠른 Veo 라우트로 빠른 반복에 적합합니다.

텍스트-동영상이미지-동영상
veo-3.0-fast

출시 예정

가격 공개 예정

Google예정

Veo 3.1 Eco

Veo 3.1 경제형, 화질과 비용의 균형이 좋습니다.

텍스트-동영상이미지-동영상
veo-3.1-eco

출시 예정

가격 공개 예정

Google예정

Veo 3.1 Fast Eco

Veo 3.1 Fast Eco, 가장 비용 최적화된 Veo 라우트로 빠르고 경제적입니다.

텍스트-동영상이미지-동영상
veo-3.1-fast-eco

출시 예정

가격 공개 예정

PixVerse예정

PixVerse V6

PixVerse V6 동영상 생성, 텍스트-동영상, 이미지 애니메이션, 효과를 지원합니다.

텍스트-동영상이미지-동영상
pixverse-v6

출시 예정

가격 공개 예정

Alibaba예정

Wan 2.6 I2V

Alibaba Wan 2.6 이미지-동영상, 정지 이미지를 움직이게 만듭니다.

이미지-동영상
wan2.6-i2v

출시 예정

가격 공개 예정

Alibaba예정

Wan 2.6 T2V

Alibaba Wan 2.6 텍스트-동영상, 프롬프트를 움직이는 영상으로 바꿔줍니다.

텍스트-동영상
wan2.6-t2v

출시 예정

가격 공개 예정

Alibaba예정

Wan 2.6 I2V Flash

Wan 2.6 I2V Flash, 빠른 이미지-동영상 변형으로 빠른 애니메이션에 적합합니다.

이미지-동영상
wan2.6-i2v-flash

출시 예정

가격 공개 예정

Anthropic사용 가능

Claude Fable 5

자율 지식 작업, 장문 추론과 코딩을 위한 Anthropic Mythos급 라우트입니다. 긴 작업의 맥락을 유지하고 시각 입력과 도구를 함께 다루는 에이전트에 적합합니다.

텍스트비전추론+3
claude-fable-5
입력$8.07/100만 토큰
출력$40.33/100만 토큰
Anthropic사용 가능

Claude Opus 5

고난도 추론, 엔드투엔드 소프트웨어 작업, 시각 분석과 자율 도구 실행을 위한 Anthropic 플래그십 라우트입니다. 최저 비용보다 결과 품질과 작업 지속성이 중요한 워크플로에 적합합니다.

텍스트비전추론+3
claude-opus-5
입력$4.04/100만 토큰
출력$20.17/100만 토큰
Anthropic사용 가능

Claude Sonnet 5

프로덕션 코딩, 에이전트, 전문 문서 작성과 시각 추론을 위한 균형형 Claude 라우트입니다. Opus보다 낮은 비용으로 강한 다단계 실행이 필요할 때 실용적인 기본 선택입니다.

텍스트비전추론+3
claude-sonnet-5
입력$1.62/100만 토큰
출력$8.07/100만 토큰
Anthropic사용 가능

Claude Opus 4.8

복잡한 추론, 코딩, 비전과 도구 실행을 위한 고성능 Opus 라우트입니다. 신중한 계획, 저장소 맥락과 여러 단계의 일관된 판단이 필요한 장기 작업에 적합합니다.

텍스트비전추론+3
claude-opus-4-8
입력$4.04/100만 토큰
출력$20.17/100만 토큰
Anthropic사용 가능

Claude Opus 4.8 CC

코딩과 도구 워크로드에 초점을 둔 Claude Opus 4.8 비용 최적화 버전입니다. Opus급 작업 처리 능력을 유지하면서 반복 엔지니어링 호출 비용을 낮추고 싶을 때 유용합니다.

텍스트추론도구 호출+2
claude-opus-4-8-cc
입력$2.56/100만 토큰
출력$12.77/100만 토큰
Google예정

Gemini Pro

텍스트, 비전, 추론, 스트리밍 및 도구 사용을 위한 멀티모달 라우트로 제공될 예정입니다.

텍스트비전이미지 입력+4
google/gemini-pro

출시 예정

가격 공개 예정

DeepSeek예정

DeepSeek Reasoner

기술 분석, 코딩 및 스트리밍 응답을 위한 추론 중심 라우트로 제공될 예정입니다.

텍스트추론코딩+1
deepseek/deepseek-reasoner

출시 예정

가격 공개 예정

DeepSeek사용 가능

DeepSeek V4 Pro

100만 토큰 컨텍스트로 복잡한 추론, 소프트웨어 아키텍처, 정밀 코드 리뷰, 장문서 분석을 지원하는 고성능 DeepSeek V4 텍스트 경로입니다.

텍스트추론코딩+1
deepseek-v4-pro
입력$1.12/100만 토큰
출력$3.36/100만 토큰
DeepSeek사용 가능

DeepSeek V4 Flash

100만 토큰 컨텍스트로 대량 추출, 분류, 재작성, 요약, 경량 코딩을 처리하는 비용 효율적인 DeepSeek V4 텍스트 경로입니다.

텍스트추론코딩+1
deepseek-v4-flash
입력$0.38/100만 토큰
출력$1.12/100만 토큰
智谱 AI사용 가능

GLM-5.3

복잡한 소프트웨어 엔지니어링과 장기 에이전트를 위한 Zhipu AI 대형 추론 라우트입니다. 저장소 규모 분석, 다단계 도구 사용과 앞선 판단을 유지해야 하는 스트리밍 기술 작업에 적합합니다.

텍스트추론도구 호출+2
glm-5.3
입력$1.48/100만 토큰
출력$5.17/100만 토큰
智谱 AI사용 가능

GLM-5.3-Flash

집중형 코딩, 시각 추론과 에이전트 하위 작업을 위한 비용 효율적인 멀티모달 GLM 라우트입니다. 전체 GLM-5.3 비용 없이 긴 맥락과 도구 워크플로가 필요한 대량 작업에 적합합니다.

텍스트비전이미지 입력+2
glm-5.3-flash
입력$0.15/100만 토큰
출력$0.52/100만 토큰
OpenAI사용 가능

GPT-5.6 Sol

복잡한 추론, 코딩, 비전과 에이전트 실행을 위한 GPT-5.6 플래그십 라우트입니다. 더 높은 토큰 비용보다 품질이 중요한 명령줄, 다단계 엔지니어링과 도구 작업에 적합합니다.

텍스트비전추론+2
gpt-5.6-sol
입력$3.90/100만 토큰
출력$23.39/100만 토큰
OpenAI사용 가능

GPT-5.6 Terra

일상 코딩, 추론, 시각 입력과 도구를 위한 GPT-5.6 균형형 티어입니다. 매 요청마다 Sol을 쓰지 않으면서 안정적인 에이전트 능력이 필요할 때 적합합니다.

텍스트비전추론+2
gpt-5.6-terra
입력$1.56/100만 토큰
출력$9.36/100만 토큰
OpenAI사용 가능

GPT-5.6 Luna

대량의 지연 민감 텍스트 작업을 위한 경량 GPT-5.6 티어입니다. 깊은 멀티모달 추론보다 비용 효율이 중요한 채팅, 추출, 분류와 간단한 스트리밍에 적합합니다.

텍스트스트리밍
gpt-5.6-luna
입력$0.16/100만 토큰
출력$0.94/100만 토큰
Google사용 가능

Gemini 3.1 Pro Preview

복잡한 추론, 소프트웨어 엔지니어링과 멀티모달 분석을 위한 Google의 프런티어 프리뷰 라우트입니다. PixMind에서 텍스트, 이미지와 동영상을 받아 Pro급 깊이와 도구가 필요한 어려운 작업에 적합합니다.

텍스트비전이미지 입력+4
gemini-3.1-pro-preview
입력$2.02/100만 토큰
출력$12.10/100만 토큰
Google사용 가능

Gemini 3.5 Flash

Flash급 비용과 속도로 강한 코딩, 추론과 멀티모달 이해를 제공하는 고효율 Gemini 모델입니다. 처리량과 시각 분석 능력을 함께 유지해야 하는 반응형 에이전트와 병렬 처리에 적합합니다.

텍스트비전이미지 입력+4
gemini-3.5-flash
입력$1.43/100만 토큰
출력$8.65/100만 토큰
Google사용 가능

Gemini 3.6 Flash

코딩, 에이전트 워크플로와 완성도 높은 웹·앱 출력을 위한 반응형 멀티모달 라우트입니다. Flash급 효율을 유지하면서 더 강한 추론과 시각 맥락이 필요한 프로덕션 작업에 적합합니다.

텍스트비전이미지 입력+4
gemini-3.6-flash
입력$1.01/100만 토큰
출력$5.19/100만 토큰
Google사용 가능

Gemini 3.8 Flash

장기 소프트웨어 엔지니어링, 자율 에이전트와 복잡한 다단계 워크플로를 위한 Google의 가장 강력한 Flash급 라우트입니다. PixMind에서 텍스트, 이미지, 오디오, 동영상과 PDF 입력을 추론, 도구, 코딩 및 스트리밍 텍스트 출력과 결합합니다.

텍스트비전이미지 입력+7
gemini-3.8-flash
입력$1.01/100만 토큰
출력$5.19/100만 토큰
Google사용 가능

Gemini 3.7 Flash

빠른 에이전트 워크플로, 코딩과 안정적인 다단계 추론을 위한 Google 멀티모달 Flash 라우트입니다. 텍스트, 이미지 또는 동영상 맥락을 스트리밍 출력과 결합하는 제품에 적합합니다.

텍스트비전이미지 입력+2
gemini-3.7-flash
입력$1.01/100만 토큰
출력$5.19/100만 토큰
Google사용 가능

Gemini 3.5 Flash-Lite

집중적이고 반복 가능한 하위 작업을 위한 Google의 가장 비용 효율적인 Flash 티어입니다. 최대 추론 깊이보다 비용이 중요한 대량 채팅, 추출, 분류와 경량 에이전트에 적합합니다.

텍스트비전이미지 입력+2
gemini-3.5-flash-lite
입력$0.41/100만 토큰
출력$3.37/100만 토큰

API 별도 가격

API 사용량은 PixMind Studio와 별도로 과금됩니다

Studio 크레딧에는 제작 인터페이스, 워크플로 도구, 저장 공간 및 제품 서비스가 포함됩니다. API는 프로그래밍 방식의 대량 호출을 위한 별도 종량제 원장을 사용합니다. 출시 예상 가격은 동일한 Studio 기본 구성보다 약 20% 낮게 책정되며, 최종 요청 가격은 해상도, 길이, 오디오, 품질 및 출력 수에 따라 달라집니다.