Skip to main content
openai/gpt-6-luna の API リファレンス。OpenAI から Comfy Router によって提供されます。

クイックスタート

Comfy ワークスペースでキーを作成し、COMFY_API_KEY としてエクスポートします。Python と TypeScript のスニペットは Comfy SDK(pip install comfy-sdk と npm install @comfyorg/sdk)を使用しています。cURL のスニペットは、同じ呼び出しを raw HTTP 経由で行うものです。 モデル ID: openai/gpt-6-luna エンドポイント: POST https://api.comfy.org/v2/models/openai/gpt-6-luna
同じボディを POST https://api.comfy.org/v2/models/openai/gpt-6-luna/requests に送信します。Router は実行が受け付けられるとすぐに 201 と request_id を返し、結果は準備ができ次第、このプロセスからでも別のプロセスからでも収集できます。キュー配信では、ステータス、キャンセル、収集について順を追って説明します。

スキーマ

入力

string[]
モデルのレスポンスに含める追加の出力データ。
string | object[]
required
モデルへのテキスト、画像、ファイル入力。レスポンスの生成に使用されます。このコントラクトで Router が補えない唯一のフィールドであり、以下の required にある唯一の項目です。
string
モデルのコンテキストの先頭項目として、システム(または開発者)メッセージを挿入します。
integer
レスポンスのために生成されるトークン数の上限。可視の出力トークンと reasoning トークンを含みます。reasoning の id では、この上限は隠れた reasoning トークンと共有されるため、小さな値では可視テキストが一切生成される前に予算を使い切ってしまいます。だからこそ reasoning のスモークテストは 1024 を送信し、chat のものは 16 を送信します。範囲: 1 から …
string
OpenAI モデル識別子。Comfy Router ではこのフィールドは任意で、Router が {model} パスセグメントからこれを補います。明示的な null も同じように置き換えられます。パスと一致しない値を送信すると拒否されます。
boolean
モデルがツール呼び出しを並列で実行することを許可するかどうか。
string
マルチターン会話のための、前のレスポンスの ID。
object
REASONING ティア専用。reasoning モデルの設定で、例: {"effort": "medium"}。そのまま転送されます。受け入れられるキーについては OpenAI の reasoning ガイドを参照してください。chat ティアの id はこれを無視します。
boolean
OpenAI が生成されたレスポンスを後で取得できるように保存するかどうか。
boolean
これを送信した呼び出し元が拒否されないように宣言されていますが、このサーフェスでは無効です。Router はディスパッチ前にこれを false に確定します。Router は text/event-stream を中継するのではなくプロバイダーのレスポンスをキャプチャするためであり、openAiResponsesProxy の ModifyResponse はこれをデコードできません。そのため、ストリーミングされた生成は OpenAI に課金され、誰にも計量されないことになります。ストリームが必要な場合は POST /proxy/openai/v1/responses を使用してください。
number
サンプリング温度。CHAT ティア専用です。o シリーズの reasoning id(o1、o1-pro、o3、o4-mini)は OpenAI でこのパラメータを拒否します。Router はそれらに対してこれを拒否しません(2 つのティアが 1 つのスキーマを共有する理由については、このコンポーネントの注記を参照してください)。そのため、これを送信する reasoning 呼び出しは OpenAI 自身のエラーとして応答されます。範囲: 0 から 2
object
出力形式の設定で、Structured Outputs のための {"format": {"type": "json_schema", ...}} など。そのまま転送されます。
string | object
モデルが使用するツールをどのように選択すべきか。文字列のモードか、ツールを指定するオブジェクトのいずれかです。
object[]
モデルが呼び出せるツール定義。Router はツールの分類を狭めません。受け入れられる形については OpenAI の Responses API リファレンスを参照してください。
number
ニュークラスサンプリングのカットオフ。CHAT ティア専用で、temperature と同じ条件です。範囲: 0 から 1
string
コンテキストがモデルのウィンドウを超えたときの切り詰め戦略。上記の 3 つの語彙とは異なり、ここでは enum が適用されます。これらの 2 つの値は OpenAI が文書化する完全な集合であり、増えていないためです。明示的な null は、上記のフィールドと同じ条件で引き続き受け入れられます。取り得る値: auto、disabled
object
トークン使用量のエンベロープ。v1 オペレーションがリクエストボディで宣言しているため、このコントラクトに存在します。OpenAI はこれを RESPONSE で埋めるので、呼び出し元が送信する理由はありません。
Router が GET /v2/models/openai/gpt-6-luna/openapi.json で提供するスキーマから生成されています。これは、リクエストがプロバイダーに到達する前に Router が呼び出しを検証する対象となる同じドキュメントです。

出力

string
システム(または developer)メッセージを、モデルのコンテキストの最初の項目として挿入します。previous_response_id と併用する場合、前のレスポンスの instructions は次のレスポンスに引き継がれません。これにより、新しいレスポンスでシステム(または developer)メッセージを簡単に差し替えられます。
integer
1 つのレスポンスで生成できるトークン数の上限。表示される出力トークンと推論トークンが含まれます。
string
レスポンスの生成に使用するモデル
number
default:"1"
レスポンスのランダム性を制御します範囲: 0 から 2
number
default:"1"
ニュークリアスサンプリングによるレスポンスの多様性を制御します範囲: 0 から 1
string
default:"\"disabled\""
モデルレスポンスに使用する切り捨て戦略。
  • auto: このレスポンスおよび以前のレスポンスのコンテキストがモデルのコンテキストウィンドウサイズを超える場合、モデルは会話の途中にある入力項目を削除してコンテキストウィンドウに収まるようにレスポンスを切り捨てます。
  • disabled(デフォルト): モデルレスポンスがモデルのコンテキストウィンドウサイズを超える場合、リクエストは 400 エラーで失敗します。 指定可能な値: auto, disabled
string
モデルへの前のレスポンスの一意の ID。これを使用してマルチターンの会話を作成します。会話状態について詳しく学びましょう。
object
o シリーズモデルのみ推論モデルの設定オプション。
string
以降のターンでモデルに返される推論項目を制御します(例: auto、current_turn、all_turns)。
string
default:"\"medium\""
o シリーズモデルのみ推論モデルの推論にかける労力を制約します。現在サポートされている値は low、medium、high です。推論の労力を減らすと、レスポンスが速くなり、レスポンス内で推論に使用されるトークンが少なくなる場合があります。指定可能な値: low, medium, high
string
非推奨: 代わりに summary を使用してください。モデルが実行した推論の要約。これはデバッグや、モデルの推論プロセスの理解に役立ちます。auto、concise、detailed のいずれかです。指定可能な値: auto, concise, detailed
string
レスポンスに使用される推論モード。
string
モデルが実行した推論の要約。これはデバッグや、モデルの推論プロセスの理解に役立ちます。auto、concise、detailed のいずれかです。指定可能な値: auto, concise, detailed
object
object
モデルが出力しなければならない形式を指定するオブジェクト。{ "type": "json_schema" } を設定すると Structured Outputs が有効になり、モデルが指定された JSON schema に一致することが保証されます。詳細は Structured Outputs ガイドをご覧ください。デフォルトの形式は追加オプションなしの { "type": "text" } です。gpt-4o 以降のモデルには非推奨:{ "type": "json_object" } に設定すると、古い JSON モードが有効になり、モデルが生成するメッセージが有効な JSON であることが保証されます。対応しているモデルでは json_schema の使用が推奨されます。
string
モデルのレスポンスの詳細度を制約します。low、medium、high のいずれかです。
`none`, `auto`, `required` | object
レスポンスを生成する際にモデルがどのツール(または複数のツール)を選択すべきかを指定します。モデルが呼び出せるツールの指定方法については、tools パラメータを参照してください。
object[]
boolean
モデルレスポンスをバックグラウンドで実行するかどうか。
object
レスポンスの課金情報。
string
レスポンスの支払いを担当する主体。
number
このレスポンスが完了したときの Unix タイムスタンプ(秒)。ステータスが completed の場合にのみ存在します。
number
このレスポンスが作成されたときの Unix タイムスタンプ(秒)。
object
モデルがレスポンスの生成に失敗したときに返されるエラーオブジェクト。
string
required
レスポンスのエラーコード。指定可能な値: server_error, rate_limit_exceeded, invalid_prompt, vector_store_timeout, invalid_image, invalid_image_format, invalid_base64_image, invalid_image_url, image_too_large, image_too_small, image_parse_error, image_content_policy_violation, invalid_image_mode, image_file_too_large, unsupported_image_media_type, empty_image_file, failed_to_download_image, image_file_not_found
string
required
エラーの人間が読める形式の説明。
number
これまでのテキスト内での出現頻度に基づいて新しいトークンにペナルティを与えます。
string
この Response の一意の識別子。
object
レスポンスが不完全である理由の詳細。
string
レスポンスが不完全である理由。指定可能な値: max_output_tokens, content_filter
integer
1 つのレスポンスで処理できる組み込みツールへの呼び出し合計回数の上限。
object
レスポンスに添付できるキーと値のペアのセット。
object
モデレーション済みの完了が要求された場合の、レスポンスの入力と出力に対するモデレーション結果。
string
このリソースのオブジェクト型。常に response に設定されます。指定可能な値: response
object[]
モデルによって生成されたコンテンツ項目の配列。
  • output 配列内の項目の長さと順序はモデルの レスポンスによって異なります。
  • output 配列の最初の項目にアクセスして、それがモデルに よって生成されたコンテンツを含む assistant メッセージであると 決め打ちするよりも、SDK でサポートされている場合は output_text プロパティの使用を検討してください。
string
SDK 専用の便利なプロパティで、output 配列内のすべての output_text 項目 (存在する場合)からの集約されたテキスト出力を含みます。 Python SDK と JavaScript SDK でサポートされています。
boolean
default:"true"
モデルがツール呼び出しを並列で実行することを許可するかどうか。
number
これまでのテキスト内に出現するかどうかに基づいて新しいトークンにペナルティを与えます。
string
キャッシュヒット率を最適化するために、類似したリクエストに対するレスポンスをキャッシュする目的で OpenAI が使用します。user フィールドを置き換えます。
string
プロンプトキャッシュの保持ポリシー(例: in_memory または 24h)。
string
OpenAI の利用ポリシーに違反している可能性のあるアプリケーションのユーザーを検出するために使用される安定した識別子。
string
リクエストの処理に使用される処理階層(例: auto、default、flex、scale、priority)。
string
レスポンス生成のステータス。completed、failed、in_progress、cancelled、queued、incomplete のいずれか。指定可能な値: completed, failed, in_progress, cancelled, queued, incomplete
boolean
レスポンスが後で API 経由で取得できるように保存されるかどうか。
object
組み込みツールごとに分類されたトークンとリクエストの使用状況。
object
画像生成ツールのトークン使用状況。
integer
object
integer
integer
integer
object
integer
integer
integer
Web 検索ツールの使用状況。
integer
integer
各トークン位置で返す、関連する対数確率を伴う最も可能性の高いトークンの最大数。
object
入力トークン、出力トークン、出力トークンの内訳、および 使用されたトークンの合計を含むトークン使用状況の詳細を表します。
integer
required
入力トークンの数。
object
required
入力トークンの詳細な内訳。
integer
キャッシュに書き込まれた入力トークンの数。
integer
required
キャッシュから取得されたトークン数。 プロンプトキャッシュの詳細。
integer
required
出力トークン数。
object
required
出力トークンの詳細な内訳。
integer
required
推論トークン数。
integer
required
使用されたトークンの合計数。
string
エンドユーザー用の非推奨の識別子。safety_identifier と prompt_cache_key に置き換え済み。

例

入力

出力

出荷前の確認

SDK は Idempotency-Key を生成し、自動リトライで再利用します。手動リトライでは元のキーを再利用してください。Router は最大 10 分間接続を保持できます。 リクエストが失敗すると、Router は理由を説明する X-Comfy-Error-Type レスポンスヘッダーを送信します。422 は、プロバイダーを呼び出す前に Router が入力を拒否したことを意味し、413 はリクエスト本文が Router の受け入れ可能なサイズを超えていたことを意味します。生成されたアセットは 結果 URL の有効期限 があるため、早めにダウンロードしてください。 上記のフィールド説明に記載されているサイズ制限は、プロバイダーの仕様から引用した、そのフィールドに対するプロバイダー自身の上限です。Router はリクエスト本文全体に対して別の上限を適用し、base64 エンコードされたメディアもこれにカウントされます。リクエスト本文のサイズ を参照してください。 このページは、Comfy Router 経由で呼び出す 1 つのパートナーモデルについて説明しています。同じ comfy-sdk / @comfyorg/sdk パッケージには、Comfy Cloud 上で ComfyUI のワークフローグラフ全体を実行するための 2 つ目のクライアントも含まれています: Comfy(api_key=...) / new Comfy({ apiKey })、および client.workflows、client.assets、client.jobs。Comfy SDKs を参照してください。

ヘッダー

認証、冪等性、リクエスト ID、エラー分類、リトライ間隔、支出上限。

Router API の利用

モデルの検出、バリデーションエラー、リトライ、課金。

制限事項

Router が現在対応していないことと、代替手段。