빠른 시작
내 Comfy 워크스페이스에서 키를 생성하고COMFY_API_KEY로 내보내세요. Python 및 TypeScript 스니펫은 Comfy SDK(pip install comfy-sdk와 npm install @comfyorg/sdk)를 사용하며, cURL 스니펫은 동일한 호출을 raw HTTP로 수행합니다.
모델 ID: vertexai/gemini-3-pro-image
엔드포인트: POST https://api.comfy.org/v2/models/vertexai/gemini-3-pro-image
- 결과 기다리기
- 실행 대기열에 넣고 나중에 수집
동일한 본문을
POST https://api.comfy.org/v2/models/vertexai/gemini-3-pro-image/requests로 전송합니다. Router는 실행이 접수되는 즉시 request_id와 함께 201로 응답하며, 결과는 준비가 되면 이 프로세스에서든 다른 프로세스에서든 수집할 수 있습니다. 실행 대기열 전송에서 상태, 취소, 수집 과정을 자세히 설명합니다.제공 공급자
요청에서 다른 공급자를 지정하지 않으면 이 모델은 Comfy Router가 직접 제공합니다. 아래 공급자들도 동일한 엔드포인트와 동일한 모델 ID로 이 모델을 제공하며,model_provider 쿼리 매개변수로 선택합니다.
- Comfy(기본값):
POST https://api.comfy.org/v2/models/vertexai/gemini-3-pro-image - fal,
fal/fal-nano-banana-pro이름으로:POST https://api.comfy.org/v2/models/vertexai/gemini-3-pro-image?model_provider=fal - Runware,
runware/runware-nano-banana-pro이름으로:POST https://api.comfy.org/v2/models/vertexai/gemini-3-pro-image?model_provider=runware - WaveSpeed,
wavespeed/wavespeed-nano-banana-pro이름으로:POST https://api.comfy.org/v2/models/vertexai/gemini-3-pro-image?model_provider=wavespeed
strict_mode의 기본값은 거짓이므로, Router는 이 페이지에 문서화된 네이티브 요청 본문을 공급자의 자체 스키마로 변환하고 응답을 다시 변환합니다. API 참조의 model_provider, strict_mode, fallback_provider와, 이 방식으로 라우팅되는 모든 모델에 대한 제공 공급자를 참고하세요.
스키마
입력
object[]
필수
모델과의 현재 대화 콘텐츠입니다. 단일 턴 쿼리의 경우 단일 인스턴스입니다. 다중 턴 쿼리의 경우 대화 기록과 최신 요청을 포함하는 반복 필드입니다.
object[]
필수
object
URI 기반 데이터입니다.
string
URI
string
data 또는 fileUri 필드에 지정된 파일의 미디어 유형입니다. 허용되는 값은 다음과 같습니다. gemini-2.0-flash-lite 및 gemini-2.0-flash의 경우 오디오 파일의 최대 길이는 8.4시간이고 비디오 파일(오디오 없음)의 최대 길이는 1시간입니다. 자세한 내용은 Gemini 오디오 및 비디오 요구 사항을 참조하세요. 텍스트 파일은 UTF-8로 인코딩되어야 합니다. 텍스트 파일의 내용은 토큰 한도에 포함됩니다. 이미지 해상도에는 제한이 없습니다.가능한 값:
application/pdf, audio/mpeg, audio/mp3, audio/wav, image/png, image/jpeg, image/webp, text/plain, video/mov, video/mpeg, video/mp4, video/mpg, video/avi, video/wmv, video/mpegps, video/flv, image/heic, image/heif, audio/flac, video/webmobject
원시 바이트 형식의 인라인 데이터입니다. gemini-2.0-flash-lite 및 gemini-2.0-flash의 경우 inlineData를 사용하여 최대 3000개의 이미지를 지정할 수 있습니다.
string (byte)
프롬프트에 인라인으로 포함할 이미지, PDF 또는 비디오의 base64 인코딩입니다. 미디어를 인라인으로 포함할 때는 데이터의 미디어 유형(mimeType)도 지정해야 합니다. 크기 제한: 20MB형식:
bytestring
data 또는 fileUri 필드에 지정된 파일의 미디어 유형입니다. 허용되는 값은 다음과 같습니다. gemini-2.0-flash-lite 및 gemini-2.0-flash의 경우 오디오 파일의 최대 길이는 8.4시간이고 비디오 파일(오디오 없음)의 최대 길이는 1시간입니다. 자세한 내용은 Gemini 오디오 및 비디오 요구 사항을 참조하세요. 텍스트 파일은 UTF-8로 인코딩되어야 합니다. 텍스트 파일의 내용은 토큰 한도에 포함됩니다. 이미지 해상도에는 제한이 없습니다.가능한 값:
application/pdf, audio/mpeg, audio/mp3, audio/wav, image/png, image/jpeg, image/webp, text/plain, video/mov, video/mpeg, video/mp4, video/mpg, video/avi, video/wmv, video/mpegps, video/flv, image/heic, image/heif, audio/flac, video/webmstring
모델이 이 부분의 비디오를 읽는 방식입니다. 고정 레이트 프레임 샘플링 대신 모델이 검사할 세그먼트를 직접 결정하도록 하려면 “AGENTIC”으로 설정하세요. 기본 고정 레이트 샘플링을 사용하려면 생략하세요. gemini-3.7-flash 및 최신 Flash 모델에서 지원됩니다.
string
텍스트 프롬프트 또는 코드 조각입니다.
boolean
이 부분이 모델의 사고/추론 단계임을 나타냅니다.
string
가능한 값:
user, modelobject
생성을 위한 샘플링, 길이 및 출력 설정입니다. 모든 필드는 선택 사항입니다. 아래에서
default를 선언한 필드는 생략 시 해당 값을 적용하고, 나머지는 모델 자체 동작을 따릅니다.object
이미지 생성 구성
string
생성된 이미지의 가로세로 비율
object
선택 사항입니다. 생성된 이미지의 이미지 출력 형식입니다.
integer
선택 사항입니다. 출력 이미지의 압축 품질입니다.
string
선택 사항입니다. 출력을 저장할 이미지 형식입니다.
string
선택 사항입니다. 생성된 이미지의 크기를 지정합니다. 지원되는 값은 1K, 2K, 4K입니다. 지정하지 않으면 모델은 기본값 1K를 사용합니다.
integer
응답에서 생성할 수 있는 최대 토큰 수입니다. 토큰은 약 4자입니다. 100 토큰은 대략 60~80 단어에 해당합니다.범위:
16 ~ 65536`TEXT`, `IMAGE`[]
integer
시드를 특정 값으로 고정하면 모델은 반복 요청에 대해 동일한 응답을 제공하기 위해 최선을 다합니다. 결정적 출력은 보장되지 않습니다. 또한 temperature와 같은 모델이나 매개변수 설정을 변경하면 동일한 시드 값을 사용하더라도 응답에 변동이 생길 수 있습니다. 기본적으로 임의의 시드 값이 사용됩니다. 다음 모델에서 사용할 수 있습니다: gemini-2.5-flash, gemini-2.5-pro, gemini-2.5-flash-preview-04-1, gemini-2.5-pro-preview-05-0, gemini-2.0-flash-lite-00, gemini-2.0-flash-001
string[]
number
기본값:"1"
temperature는 응답 생성 중 샘플링에 사용되며, 이는 topP와 topK가 적용될 때 발생합니다. temperature는 토큰 선택의 무작위성 정도를 제어합니다. 낮은 temperature는 덜 개방적이거나 창의적인 응답이 필요한 프롬프트에 적합하며, 높은 temperature는 더 다양하거나 창의적인 결과로 이어질 수 있습니다. temperature가 0이면 확률이 가장 높은 토큰이 항상 선택됩니다. 이 경우 주어진 프롬프트에 대한 응답은 대부분 결정적이지만, 약간의 변동은 여전히 가능합니다. 모델이 너무 일반적이거나 너무 짧은 응답을 반환하거나 대체 응답을 제공한다면 temperature를 높여 보세요.범위:
0 ~ 2형식: floatobject
선택 사항. thinking 기능에 대한 설정입니다. thinking은 모델이 복잡한 작업을 더 작은 단계로 나누어 더 높은 품질의 응답을 생성하는 과정입니다.
boolean
선택 사항. true이면 모델이 응답에 자신의 생각을 포함합니다.
integer
선택 사항. 모델의 thinking 과정을 위한 토큰 예산입니다. 모델은 이 예산을 넘지 않도록 최선을 다합니다.
string
선택 사항. 모델의 thinking 수준입니다.가능한 값:
THINKING_LEVEL_UNSPECIFIED, LOW, MEDIUM, HIGH, MINIMALinteger
기본값:"40"
Top-K는 모델이 출력을 위해 토큰을 선택하는 방식을 변경합니다. Top-K가 1이면 다음에 선택되는 토큰은 모델 어휘의 모든 토큰 중에서 가장 확률이 높은 토큰입니다. Top-K가 3이면 temperature를 사용하여 확률이 가장 높은 3개의 토큰 중에서 다음 토큰이 선택됩니다.범위:
1 ~ …number
기본값:"0.95"
지정된 경우 nucleus 샘플링이 사용됩니다.
Top-P는 모델이 출력을 위해 토큰을 선택하는 방식을 변경합니다. 토큰은 확률이 가장 높은 것(top-K 참조)부터 가장 낮은 것까지 선택되며, 확률의 합이 top-P 값과 같아질 때까지 진행됩니다. 예를 들어 토큰 A, B, C의 확률이 각각 0.3, 0.2, 0.1이고 top-P 값이 0.5라면, 모델은 temperature를 사용하여 A 또는 B를 다음 토큰으로 선택하고 C는 후보에서 제외합니다.
덜 무작위적인 응답에는 낮은 값을, 더 무작위적인 응답에는 높은 값을 지정하세요.범위:
0 ~ 1형식: floatobject[]
안전하지 않은 콘텐츠를 차단하기 위한 요청별 설정입니다. GenerateContentResponse.candidates에 적용됩니다.
string
필수
가능한 값:
HARM_CATEGORY_SEXUALLY_EXPLICIT, HARM_CATEGORY_HATE_SPEECH, HARM_CATEGORY_HARASSMENT, HARM_CATEGORY_DANGEROUS_CONTENTstring
필수
가능한 값:
OFF, BLOCK_NONE, BLOCK_LOW_AND_ABOVE, BLOCK_MEDIUM_AND_ABOVE, BLOCK_ONLY_HIGHobject
모델을 더 나은 성능으로 이끌기 위한 지침입니다. 예를 들어 “가능한 한 간결하게 답변하세요” 또는 “응답에 전문 용어를 사용하지 마세요”와 같습니다. 텍스트 문자열은 토큰 한도에 포함됩니다. systemInstruction의 역할 필드는 무시되며 모델 성능에 영향을 주지 않습니다. 참고: parts에는 텍스트만 사용해야 하며, 각 part의 content는 별도의 단락에 있어야 합니다.
object[]
필수
하나의 메시지를 구성하는 순서가 지정된 parts 목록입니다. part마다 서로 다른 IANA MIME 유형을 가질 수 있습니다. 최대 토큰 수나 이미지 수와 같은 입력 제한은 Google 모델 페이지의 모델 사양을 참조하세요.
string
텍스트 프롬프트 또는 코드 스니펫.
string
메시지를 생성하는 주체의 정체성입니다. 다음 값이 지원됩니다: user: 메시지가 실제 사람이 보낸 것으로, 일반적으로 사용자가 생성한 메시지임을 나타냅니다. model: 메시지가 모델에 의해 생성되었음을 나타냅니다. model 값은 여러 턴에 걸친 대화에서 모델의 메시지를 대화에 삽입할 때 사용됩니다. 여러 턴이 아닌 대화에서는 이 필드를 비워 두거나 설정하지 않아도 됩니다.가능한 값:
user, modelobject[]
시스템이 모델의 지식과 범위를 벗어난 작업 또는 일련의 작업을 수행하기 위해 외부 시스템과 상호작용할 수 있게 해주는 코드 조각입니다. Function calling을 참조하세요.
object[]
string
string
필수
object
함수 파라미터에 대한 JSON 스키마
boolean
true이면 생성된 이미지가 클라우드 스토리지에 업로드되고 인라인 base64 데이터 대신 서명된 URL로 반환됩니다. URL은 24시간 후에 만료됩니다.
object
비디오 입력의 경우, 동영상의 시작 및 종료 오프셋을 Duration 형식으로 지정합니다. 예를 들어 1:00에서 시작하는 10초 클립을 지정하려면 “startOffset”: { “seconds”: 60 } 및 “endOffset”: { “seconds”: 70 }으로 설정합니다. 이 메타데이터는 비디오 데이터가 inlineData 또는 fileData로 제공되는 동안에만 지정해야 합니다.
object
비디오 타임라인 위치에 대한 재생 시간 오프셋을 나타냅니다.
integer
나노초 해상도로 표현된 부호 있는 초의 소수 부분입니다. 소수 부분이 있는 음수 초 값이라도 nanos 값은 음수가 아니어야 합니다.범위:
0 ~ 999999999integer
시간 범위의 부호 있는 초입니다. -315,576,000,000부터 +315,576,000,000까지(양 끝 포함)여야 합니다.범위:
-315576000000 ~ 315576000000object
비디오 타임라인 위치에 대한 재생 시간 오프셋을 나타냅니다.
integer
나노초 해상도로 표현된 부호 있는 초의 소수 부분입니다. 소수 부분이 있는 음수 초 값이라도 nanos 값은 음수가 아니어야 합니다.범위:
0 ~ 999999999integer
시간 범위의 부호 있는 초입니다. -315,576,000,000부터 +315,576,000,000까지(양 끝 포함)여야 합니다.범위:
-315576000000 ~ 315576000000GET /v2/models/vertexai/gemini-3-pro-image/openapi.json에서 제공하는 스키마에서 생성되었으며, 요청이 공급자에게 도달하기 전에 호출을 검증하는 대상이 되는 것과 동일한 문서입니다.
출력
object[]
object
object[]
string[]
integer
string
string (date)
형식:
dateinteger
string
string
object
모델과의 현재 대화 콘텐츠입니다. 단일 턴 쿼리의 경우 단일 인스턴스입니다. 다중 턴 쿼리의 경우 대화 기록과 최신 요청을 포함하는 반복 필드입니다.
object[]
필수
object
URI 기반 데이터입니다.
string
URI
string
data 또는 fileUri 필드에 지정된 파일의 미디어 유형입니다. 사용 가능한 값은 다음과 같습니다. gemini-2.0-flash-lite 및 gemini-2.0-flash의 경우 오디오 파일의 최대 길이는 8.4시간이고 비디오 파일(오디오 없음)의 최대 길이는 1시간입니다. 자세한 내용은 Gemini 오디오 및 비디오 요구 사항을 참조하세요. 텍스트 파일은 UTF-8로 인코딩되어야 합니다. 텍스트 파일의 내용은 토큰 한도에 포함됩니다. 이미지 해상도에는 제한이 없습니다.가능한 값:
application/pdf, audio/mpeg, audio/mp3, audio/wav, image/png, image/jpeg, image/webp, text/plain, video/mov, video/mpeg, video/mp4, video/mpg, video/avi, video/wmv, video/mpegps, video/flv, image/heic, image/heif, audio/flac, video/webmobject
원시 바이트 형식의 인라인 데이터입니다. gemini-2.0-flash-lite 및 gemini-2.0-flash의 경우 inlineData를 사용하여 최대 3000개의 이미지를 지정할 수 있습니다.
string (byte)
프롬프트에 인라인으로 포함할 이미지, PDF 또는 비디오의 base64 인코딩입니다. 미디어를 인라인으로 포함할 때는 데이터의 미디어 유형(mimeType)도 지정해야 합니다. 크기 제한: 20MB형식:
bytestring
data 또는 fileUri 필드에 지정된 파일의 미디어 유형입니다. 사용 가능한 값은 다음과 같습니다. gemini-2.0-flash-lite 및 gemini-2.0-flash의 경우 오디오 파일의 최대 길이는 8.4시간이고 비디오 파일(오디오 없음)의 최대 길이는 1시간입니다. 자세한 내용은 Gemini 오디오 및 비디오 요구 사항을 참조하세요. 텍스트 파일은 UTF-8로 인코딩되어야 합니다. 텍스트 파일의 내용은 토큰 한도에 포함됩니다. 이미지 해상도에는 제한이 없습니다.가능한 값:
application/pdf, audio/mpeg, audio/mp3, audio/wav, image/png, image/jpeg, image/webp, text/plain, video/mov, video/mpeg, video/mp4, video/mpg, video/avi, video/wmv, video/mpegps, video/flv, image/heic, image/heif, audio/flac, video/webmstring
모델이 이 부분의 비디오를 읽는 방식입니다. 고정 비율 프레임 샘플링 대신 모델이 검사할 세그먼트를 결정하도록 하려면 “AGENTIC”으로 설정하세요. 기본 고정 비율 샘플링을 사용하려면 생략하세요. gemini-3.7-flash 및 최신 Flash 모델에서 지원됩니다.
string
텍스트 프롬프트 또는 코드 스니펫입니다.
boolean
이 부분이 모델의 사고/추론 단계임을 나타냅니다.
string
가능한 값:
user, modelstring
object[]
string
가능한 값:
HARM_CATEGORY_SEXUALLY_EXPLICIT, HARM_CATEGORY_HATE_SPEECH, HARM_CATEGORY_HARASSMENT, HARM_CATEGORY_DANGEROUS_CONTENTstring
콘텐츠가 지정된 안전 카테고리를 위반할 확률가능한 값:
NEGLIGIBLE, LOW, MEDIUM, HIGH, UNKNOWNstring
응답이 생성된 타임스탬프입니다.
string
응답을 생성하는 데 사용된 모델 버전입니다.
object
string
string
object[]
string
가능한 값:
HARM_CATEGORY_SEXUALLY_EXPLICIT, HARM_CATEGORY_HATE_SPEECH, HARM_CATEGORY_HARASSMENT, HARM_CATEGORY_DANGEROUS_CONTENTstring
콘텐츠가 지정된 안전 카테고리를 위반할 확률가능한 값:
NEGLIGIBLE, LOW, MEDIUM, HIGH, UNKNOWNstring
응답의 고유 식별자.
object
integer
출력 전용. 입력에서 캐시된 부분(캐시된 콘텐츠)의 토큰 수.
integer
응답에 포함된 토큰 수.
object[]
모달리티별 후보 토큰의 세부 내역.
string
입력 또는 출력 콘텐츠의 모달리티 유형.가능한 값:
MODALITY_UNSPECIFIED, TEXT, IMAGE, VIDEO, AUDIO, DOCUMENTinteger
해당 모달리티의 토큰 수.
integer
요청의 토큰 수. cachedContent가 설정된 경우에도 이는 총 유효 프롬프트 크기이며, 캐시된 콘텐츠의 토큰 수를 포함합니다.
object[]
모달리티별 프롬프트 토큰의 세부 내역.
string
입력 또는 출력 콘텐츠의 모달리티 유형.가능한 값:
MODALITY_UNSPECIFIED, TEXT, IMAGE, VIDEO, AUDIO, DOCUMENTinteger
해당 모달리티의 토큰 수.
integer
thoughts 출력에 포함된 토큰 수.
integer
도구 사용 프롬프트에 포함된 토큰 수.
object[]
모달리티별 도구 사용 프롬프트 토큰의 세부 내역.
string
입력 또는 출력 콘텐츠의 모달리티 유형.가능한 값:
MODALITY_UNSPECIFIED, TEXT, IMAGE, VIDEO, AUDIO, DOCUMENTinteger
해당 모달리티의 토큰 수.
integer
총 토큰 수(프롬프트 + 후보).
string
요청에 사용된 트래픽 유형(예: PROVISIONED_THROUGHPUT).
예시
입력
출력
parts 읽기
기본적으로 생성된 이미지 part에는inlineData.data에 base64 바이트가, inlineData.mimeType에 미디어 타입이 들어 있습니다. 바이트를 디코딩해 파일로 저장하세요. uploadImagesToStorage: true인 경우에는 업로드된 이미지가 대신 서명된 URL에 fileData.fileUri를, 미디어 타입에 fileData.mimeType을 사용합니다. 이 이미지들은 URL이 생성된 후 24시간 뒤에 만료되므로 만료되기 전에 다운로드하세요.
fileData는 요청하지 않은 응답에 나타날 수 있습니다. 두 가지 형태는 응답 단위가 아니라 part 단위입니다. 즉 uploadImagesToStorage: true가 설정된 경우 업로드에 실패한 이미지는 inlineData로 남으므로 하나의 응답에 두 형태가 섞일 수 있습니다. 요청한 내용이 아니라 어떤 키가 존재하는지를 기준으로 분기하세요. 일어날 수 없는 유일한 경우는 그 반대입니다. 필드가 설정되지 않았거나 false이면 모든 생성 이미지가 inlineData로 반환되고 fileData 이미지 part는 만들어지지 않습니다. 텍스트 part도 나타날 수 있고 이미지가 첫 번째 part라는 보장이 없으므로, 인덱스가 아니라 필요한 필드를 기준으로 part를 선택하세요. 위 퀵스타트 샘플의 candidates[0].content.parts[0].inlineData.data 경로는 이 페이지의 샘플 응답에 있는 단일 인라인 part를 읽는 것입니다. 실제 응답을 대상으로 할 때는 위치 0을 인덱싱하는 대신 parts를 스캔해 원하는 키를 찾으세요.
thoughtSignature도 part 필드이며, 크기가 큽니다. part는 thoughtSignature를 포함할 수 있는데, 이는 나중 요청에서 사고를 재현할 수 있도록 존재하는 모델 추론의 불투명한 base64 서명입니다. 위의 생성된 스키마에는 없으며, 그 스키마는 Router가 게시하는 요청/응답 문서를 따릅니다. 실제 응답에서 측정하면 part당 대략 1~2MB로 이미지 자체와 비슷한 수준이므로, 응답을 로깅하거나 서버리스 함수를 통해 전달하거나 저장한다면 용량을 예산에 넣거나 명시적으로 버리는 것이 좋습니다.
imageSize는 너비가 아니라 클래스입니다
generationConfig.imageConfig.imageSize는 1K, 2K, 4K를 받으며, 각 단계는 너비를 설정하는 것이 아니라 양쪽 변의 길이를 두 배로 늘립니다. 16:9 요청은 1K에서 약 1.35MB로 1376x768, 2K에서 약 5.6MB로 2752x1536으로 측정되었습니다. 같은 화면 비율에 픽셀은 네 배, 바이트는 대략 네 배입니다. 따라서 2K가 2048픽셀 너비의 이미지를 의미하는 것은 아니며, 2K를 너비인 것처럼 취급해 업로드 경로, 응답 본문 제한 또는 스토리지 버킷의 크기를 산정하면 약 네 배나 부족하게 프로비저닝하게 됩니다.
참조 체이닝
이전에 생성된 이미지를 그대로 다시 입력하면 같은 피사체를 새로운 카메라 앵글로 얻을 수 있습니다. 따라서 한 장면의 연속된 샷은 모든 것을 한 번에 설명해야 하는 하나의 프롬프트가 아니라 호출의 체인입니다. 아키텍처, 재질, 조명은 체인을 따라 이어지는 경우가 많지만 모델이 이를 보장하지는 않습니다. 연속성을 신뢰할 수 있는 속성이 아니라 확인해야 할 가능성 높은 결과로 취급하세요. 이미지는 이전 응답에서 사용한 형태 그대로 다시 보내세요.inlineData part의 경우 inlineData.data에서 base64 바이트를 가져와 아래와 같이 inlineData로 변경 없이 보냅니다. uploadImagesToStorage: true에서 fileData로 반환된 part의 경우에는 서명된 URL이 아직 유효한 동안 대신 fileData.fileUri와 fileData.mimeType을 fileData part로 보내세요. 바이트를 inlineData로 다시 업로드하는 방법도 작동하며 만료되지 않습니다. 그런 다음 원하는 변경을 요청하세요:
2K 이미지는 1K 이미지보다 바이트가 약 네 배입니다.
배포 전 확인
SDK는Idempotency-Key를 생성하고 자동 재시도에 재사용합니다. 수동으로 재시도할 때는 원본 키를 재사용하세요. Router는 연결을 최대 10분간 유지할 수 있습니다.
요청이 실패하면 Router는 그 이유를 설명하는 X-Comfy-Error-Type 응답 헤더를 보냅니다. 422는 Router가 공급자를 호출하기 전에 입력을 거부했음을 의미하고, 413은 요청 본문이 Router가 허용하는 크기보다 컸음을 의미합니다. 결과 URL이 만료될 수 있으므로 생성된 에셋은 즉시 다운로드하세요.
위의 필드 설명에 명시된 크기 제한은 해당 필드에 대한 공급자 자체의 한도이며, 공급자 사양에서 인용한 것입니다. Router는 전체 요청 본문에 별도의 상한을 적용하며, base64로 인코딩된 미디어도 여기에 포함됩니다. 요청 본문 크기를 참고하세요.
이 페이지는 Comfy Router를 통해 호출하는 하나의 파트너 모델을 설명합니다. 동일한 comfy-sdk / @comfyorg/sdk 패키지에는 Comfy Cloud에서 전체 ComfyUI 워크플로 그래프를 실행하기 위한 두 번째 클라이언트도 포함되어 있습니다: Comfy(api_key=...) / new Comfy({ apiKey }), 그리고 client.workflows, client.assets, client.jobs가 있습니다. Comfy SDKs를 참조하세요.
헤더
인증, 멱등성, 요청 ID, 오류 분류, 재시도 간격, 지출 한도.
Router API 사용
모델 검색, 검증 오류, 재시도, 과금.
제한 사항
Router가 현재 지원하지 않는 기능과 대신 사용할 방법.